Kimi K3 Swarm Max: 300 агентов из одного промпта

16 июля 2026 вышла Kimi K3: 2,8 трлн параметров, контекст на миллион токенов, самая крупная модель с открытыми весами. Главное в ней не цифры, а режим Swarm Max: до 300 суб-агентов работают параллельно, координируются в пределах 4000 шагов и отдают готовые файлы вместо ответа в чате.
Рой выигрывает на широких параллельных задачах: исследование по десяткам источников, пакетный анализ, мониторинг конкурентов, сборка датасетов. И буксует на длинных последовательных цепочках, где каждый шаг зависит от предыдущего.
Пишите техзадание, а не промпт
Однострочный запрос отдаёт рою право решать всё самому, и решит он неправильно. ТЗ задаёт, что собрать, что считать валидным результатом, какие источники разрешены и точный формат вывода.
Читайте план декомпозиции до запуска
Kimi показывает план выполнения до запуска: сколько агентов, что делает каждый, порядок зависимостей и бюджет шагов. Рой из 200 агентов с неправильной декомпозицией стоит реальных денег, а проверка плана бесплатна.
Требуйте файлы, а не ответ в чате
“Подробный отчёт” даёт агентам право остановиться рано. Формулировка вроде PDF на 40 страниц плюс CSV на 20 000 строк плюс 14 графиков задаёт агентам планку качества. Ведите ТЗ от вывода, всегда.
Ставьте вторую модель на проверку
Без явного требования проверки рой выдаёт уверенные, но слабо подкреплённые источниками утверждения, а независимые суб-агенты иногда противоречат друг другу. Вторая модель работает как ворота проверки: её задача опровергать, а не хвалить.
Сохраняйте процесс как навык
После проверенного запуска попросите Kimi зафиксировать весь процесс: формат входа, шаги агентов, формат вывода и правила валидации. Первый запуск занимает 20 минут, каждый следующий 30 секунд. Кэш повторного контекста дешевле входа в 10 раз, поэтому первый запуск это инвестиция, а каждый следующий собирает отдачу.
Чат-окно это около 10 процентов того, на что способен K3. Остальные 90 это исследовательская команда, которую собирают один раз и запускают снова и снова. Начните с одного ТЗ, проверьте результат, сохраните навык и смотрите, как каждый запуск становится дешевле и точнее предыдущего.

