AIKraft разрабатывается в AIKraft
Мы не только продаём ИИ-агента — мы им живём. Одно рабочее место команды администрирует всю систему, дорабатывает саму платформу, выпускает версии и каждое утро проверяет, что ничего не сломалось. Ниже — как это устроено изнутри, с цифрами.
Цифры обновлены 05.10.2026 · пересчитываются каждый понедельник, рядом — сколько добавилось за неделю
Одно рабочее место — четыре роли
Утро: что запускается само
- ночьНочной ремонтник разбирает вчерашние падения инструментов во всех рабочих местах. Ночная комиссия читает завершённые диалоги и предлагает уроки для памяти.
- рано утромРегрессионный набор: 44 контрольные задачи. Результат сравнивается со вчерашним — событием считается только новое падение, а не старое известное.
- до 7:00Обход всех серверов и видеокарт, сторож контекста и памяти каждого места, сторожа публикаций на сайтах. Всё, что покраснело, попадает в утреннюю ленту.
- 7:00–8:00Здоровье рабочего места — детерминированная проверка без ИИ. Утренний ремонт интеграций. Проверка, что вчерашние доработки действительно встроены, а не висят в черновике.
- 8:00Мета-агент делает обзор дня и пишет предложения — менять он ничего не может, только предлагать. Отдельно — фильтр приватности памяти и смотритель очереди новых интеграций.
- 9:00Сводка самообучения: какие правила за ночь добавлены, какие откатаны как вредные. Разбор уведомлений, входы за сутки, удалённые сотрудниками сессии. Куратор навыков.
- 10:00Замер скорости агентов по всем местам с рекомендациями: где агент ждёт, где крутится вхолостую.
- 11:00Надзор над сторожами: проверяем, что сами проверки отработали, а не молча пропали.
- 12:00Уборщик ленты отправляет чистые отчёты в архив, ревизор перепроверяет ночную комиссию. К обеду в ленте остаётся только то, что требует решения человека.
Как мы разрабатываем AIKraft с помощью AIKraft
Каждая доработка — задача в трекере. Агент-исполнитель получает её и работает в отдельной копии кода, не трогая боевую систему. Дальше — тесты и независимое ревью более сильной моделью с тремя исходами: принять, вернуть на один ремонт или забрать работу целиком. Второго круга ремонта не бывает. После слияния платформа перезапускается только когда никто из сотрудников не работает — живой диалог не рвётся. Изменения уходят в заметки к версии на странице обновлений. Пример из прошлой недели: агенту запретили переписывать собственные правила без явного «Подтверждаю» человека — задачу поставили, сделали, отревьюили (семь замечаний, один ремонт) и выпустили за день.
Контроль рабочих версий
Мы работаем на собственной сборке поверх открытого ядра. Всё, что меняем в чужом коде, оформлено самовосстанавливающимся патчем с проверкой и откатом: обновление ядра не стирает наши доработки молча. Перед словом «готово» у любой правки пять вопросов: закреплена ли она в истории, кто восстановит её после перезапуска, кто заметит, если она пропала, проверили ли её нарушением (сломали нарочно и увидели тревогу) и записана ли она в реестр. Крупные изменения сначала проверяются на отдельном стенде и экзаменом на типовых задачах.
Как следим
Каждое падение агента — ошибка инструмента, отказ доступа, пустой ответ — попадает в словарь отказов. Если ошибка знакомая, агент сразу получает подсказку, как её обойти, а не пробует то же самое ещё раз. За последнюю неделю подсказку получили 100% сессий, где сбой был узнан. Отдельно мы следим за самими сторожами: проверка, которая перестала запускаться, опаснее проверки, которая краснеет.
Как корректируем и наследуем опыт
Когда человек правит работу агента, правка превращается в урок. Уроки проходят ночную комиссию и ревизора, а потом достаются всем рабочим местам, а не только тому, где случилась ошибка. Самообучающиеся правила дописываются автоматически и так же автоматически откатываются, если по замерам стало хуже. Длинная работа передаётся следующей сессии по ходу, с обязательным пунктом «чего НЕ делать», чтобы новая сессия не повторяла пройденные тупики.
Меряем честно, в том числе плохое
Каждый понедельник считаем меру пользы — стала ли система лучше за неделю. Правок людей на 100 сессий: 9,5 → 6,8 (стало лучше). Повторов уже исправленных ошибок: 19 → 13 (стало лучше). Экзамен памяти: 81% → 75% (стало хуже). Мы публикуем и плохие цифры: без них остальные ничего не стоят.
Что работает само
- Ночной разбор падений инструментов во всех рабочих местах
- Регрессионный набор из 44 контрольных задач каждое утро
- Ежедневный обход серверов, моделей и видеокарт
- Сторожа контекста, памяти и публикаций на сайтах
- Самообучение: правила добавляются и откатываются по замерам
- Ночная комиссия и ревизор уроков для памяти
- Словарь отказов с подсказками агенту прямо в ходе работы
- Замер скорости агентов и недельная мера пользы
- Надзор над сторожами и уборка ленты отчётов
С чем связано
Что это даёт клиентам
Всё, что мы ставим клиентам, сначала месяцами работает у нас: те же сторожа, те же уроки, тот же порядок выпуска версий. Клиентское место получает не демонстрацию, а систему, которую мы сами каждое утро проверяем.
Чего здесь нет: имён сотрудников, адресов серверов, названий баз и доступов. Секреты хранятся в отдельном хранилище и не попадают ни в файлы, ни в память агентов, ни в журналы. Цифры берутся из реестра автоматизаций, истории изменений и недельных отчётов.
Хотите так же у себя?
Покажем на ваших процессах, что можно отдать агенту в первый месяц.