Китайский стартап Moonshot AI официально анонсировал Kimi K3 — крупнейшую на сегодняшний день открытую языковую модель. С заявленными 2,8 триллионами параметров, нативным зрением и контекстным окном в 1 миллион токенов, K3 претендует на звание самого мощного решения с открытым исходным кодом. По внутренним оценкам команды, в общем рейтинге новинка уступает лишь закрытым системам — Claude Fable 5 от Anthropic и GPT-5.6 Sol от OpenAI.
Архитектурные инновации и эффективность
В основе Kimi K3 лежит новая архитектура Kimi Delta Attention (KDA) и механизм Attention Residuals (AttnRes). KDA оптимизирует обработку длинных последовательностей данных, а AttnRes позволяет модели избирательно извлекать критически важную информацию из разных слоев сети, а не обрабатывать все одинаково. Это обеспечивает более глубокое понимание контекста и сохранение смысла даже при работе со сложными и запутанными текстами.
Ключевым элементом масштабирования стала разреженная архитектура Stable LatentMoE. Из 896 доступных экспертов для каждого вывода активируется только 16. Такая селективность в сочетании с новыми данными и оптимизированными методами обучения позволила повысить эффективность модели в 2,5 раза по сравнению с предыдущей версией K2. Примечательно, что в течение девяти из последних двенадцати месяцев модели семейства Kimi удерживали рекорд по размеру среди всех открытых аналогов.
Сравнение с конкурентами: где K3 сильнее, а где слабее
На ряде бенчмарков K3 демонстрирует превосходство, обходя даже именитых конкурентов. В тесте на решение долгих инженерных задач SWE Marathon модель набрала 42 балла против 35 у Fable 5 и 39 у Sol. В задаче веб-исследований BrowseComp результат составил 91,2 против 88 и 90,4 соответственно. Также K3 лидирует в тесте Program Bench (77,8 против 76,8 и 77,6) и показывает почти максимальный результат в Terminal Bench 2.1 (88,3 балла), уступая Sol всего 0,5 балла.
Однако на тестах FrontierSWE и HLE-Full (сложный мультидисциплинарный экзамен) K3 отстает от Fable 5. Важно отметить, что методология тестирования различалась: некоторые модели запускались через Claude Code, другие — через Codex или собственный инструментарий KimiCode. Это делает прямое сравнение не всегда корректным, но общая картина уже ясна: K3 — чрезвычайно мощный инструмент для агентных задач.
Кодинг, инженерия и автономность
K3 способна вести длительные инженерные сессии с минимальным участием человека. В тесте по оптимизации GPU-ядер модель работала автономно до 24 часов, показывая результаты на уровне Fable 5 и значительно опережая Opus 4.8, GPT-5.6 Sol и GPT-5.5. Отдельного упоминания заслуживает способность K3 с нуля написать MiniTriton — компактный компилятор для GPU-ядер с собственным IR-слоем поверх MLIR.
Впечатляет и демонстрация проектирования чипов: K3 самостоятельно спроектировала нейросетевой чип на собственной архитектуре. За 48 часов автономной работы, используя open-source инструменты, модель создала дизайн чипа площадью 4 мм² с частотой 100 МГц и производительностью более 8700 токенов в секунду в симуляции.
Работа со знаниями и мультимодальность
K3 демонстрирует глубокое понимание научных данных. В одном из кейсов модель воспроизвела сложные формулы из вычислительной астрофизики за два часа, тогда как опытному исследователю на это потребовалось бы несколько недель. В другом примере K3 подготовила интерактивный отчет по 42-летней истории ASIC-индустрии, обработав более 11 000 страниц документов.
Благодаря нативной работе с видео, модель способна монтировать ролики, синхронизировать их с музыкой и обрабатывать звук. Это открывает новые горизонты для автоматизации творческих процессов.
Ограничения и доступность
Команда Moonshot AI честно признает, что K3 чувствительна к потере истории размышлений при смене агентной среды и может проявлять излишнюю инициативу в неоднозначных ситуациях. По удобству использования она пока уступает флагманам Fable 5 и GPT-5.6 Sol.
Модель уже доступна на сайте Kimi, в сервисах Kimi Work и Code, а также через API. По умолчанию активирован максимальный режим размышления. Полные веса и технический отчет будут опубликованы 27 июля.
Мнение эксперта: Выпуск Kimi K3 — это не просто очередной рекорд по количеству параметров. Это демонстрация того, что открытые модели способны конкурировать с закрытыми гигантами на самом высоком уровне, особенно в агентных и инженерных задачах. Однако разрыв в удобстве использования и чувствительность к смене контекста напоминают, что «сырая» мощь — это лишь часть уравнения. Забег за лидерство в ИИ только начинается, и мы видим, как открытый сектор наращивает темпы.