QRazy
вопросы, которые хочется обсудить
📰 Новость ⚔️ Спор / 🤖 Технологии и ИИ
Пост опубликован в блогах Qrazy.net, его автор не имеет отношения к редакции Qrazy.net

Китайская Moonshot представила открытую ИИ-модель Kimi K3 с 2,8 трлн параметров

Краткий пересказ от QRazy ИИ

  • Kimi K3 от Moonshot AI — одна из крупнейших языковых моделей с 2,8 трлн параметров, конкурирующая с ведущими системами.
  • Модель использует инновационную архитектуру Mixture-of-Experts для повышения эффективности обработки запросов.
  • На специализированных тестах Kimi K3 демонстрирует отличные результаты, превосходя GPT-5.6 Sol и Claude Fable 5 в сложных задачах.
  • Несмотря на впечатляющие бенчмарки, производительность в реальных сценариях пока оставляет желать лучшего, требуя осторожной интерпретации результатов.

Узнайте о новой открытой ИИ-модели Kimi K3 от китайской компании Moonshot с рекордными 2,8 трлн параметров, которая обещает революционизировать технологии искусственного интеллекта.

Иллюстрация с древними символами для обсуждения
Медиа-вопрос о древних символах и возможных инструкциях

Китайская компания Moonshot AI представила Kimi K3 — одну из крупнейших открытых языковых моделей в мире с 2,8 трлн параметров. Разработчики утверждают, что новинка уже способна конкурировать с лучшими коммерческими ИИ-системами, а в ряде специализированных тестов даже превосходит их. Веса модели компания пообещала открыть в июле 2026 года.

Еще несколько лет назад открытые большие языковые модели заметно уступали закрытым системам OpenAI, Anthropic и Google. Теперь этот разрыв стремительно сокращается. Китайская компания Moonshot AI утверждает, что ее новая модель Kimi K3 уже достигла уровня ведущих коммерческих решений, а по ряду специализированных тестов даже превзошла их.

Почти три триллиона параметров — но без лишних вычислений

Kimi K3 построена по архитектуре Mixture-of-Experts и содержит 2,8 триллиона параметров. Модель изначально поддерживает работу с изображениями, а максимальный размер контекстного окна достигает одного миллиона токенов.

В Moonshot AI называют Kimi K3 первой открытой моделью, относящейся к классу систем с почти тремя триллионами параметров. Однако столь внушительный масштаб вовсе не означает, что при каждом запросе задействуются все вычислительные ресурсы. Архитектура включает 896 специализированных «экспертов», но для обработки каждого токена активируются лишь 16 из них. Такой подход позволяет значительно повысить эффективность вывода по сравнению с моделями, которым приходится использовать весь набор параметров при каждом обращении.

В повседневной работе лидеры пока впереди

Разработчики не скрывают, что в общем пользовательском опыте Kimi K3 пока уступает таким моделям, как Claude Fable 5 и GPT-5.6 Sol. По их оценке, именно эти системы по-прежнему обеспечивают более высокий уровень универсальной производительности в ежедневных сценариях использования.

Тем не менее результаты независимых тестов выглядят куда интереснее.

Там, где важны сложные задачи, Kimi K3 выходит вперед

На бенчмарке FrontierSWE, предназначенном для оценки способностей моделей решать сложные задачи программной инженерии, Kimi K3 получила 81,2 балла. Для сравнения, GPT-5.6 Sol набрала 71,3, а Claude Opus 4.8 — 66,7.

Еще один показатель — SWE Marathon — также оказался в пользу новой модели. Здесь результат Kimi K3 составил 42 балла, тогда как GPT-5.6 Sol получила 39, а Claude Fable 5 — 35.

Достижения не ограничиваются программированием. На тесте BrowseComp модель установила новый рекорд — 91,2 балла. Кроме того, Kimi K3 показала лучшие результаты среди существующих моделей фронтирного уровня в испытаниях:

  • AutomationBench;
  • SpreadsheetBench 2;
  • OmniDocBench;
  • нескольких тестах на визуальное рассуждение.

По совокупности этих результатов новая разработка Moonshot AI демонстрирует, что открытые модели уже способны конкурировать с сильнейшими закрытыми системами не только теоретически, но и в ряде практически значимых областей.

Почему к рекордам все же стоит относиться осторожно

Высокие показатели в бенчмарках не всегда означают столь же заметное превосходство в реальном использовании. Производительность моделей в повседневных задачах зависит от множества факторов, которые невозможно полностью отразить в стандартизированных тестах.

Дополнительную сложность создает и то, что в некоторых из упомянутых испытаний модели запускались через разные агентные среды (agent harnesses). Из-за этого прямое сравнение результатов оказывается не всегда корректным, а цифры требуют осторожной интерпретации.

Тем не менее появление Kimi K3 показывает, что открытые модели искусственного интеллекта практически догнали закрытые разработки ведущих американских компаний, а в отдельных специализированных задачах уже начинают задавать новый уровень производительности.

🔒 Полные ответы доступны бесплатно после регистрации

Обсуждение закрыто

Видно, что спор идет. Быстрый вход — и ответы откроются сразу.

Загрузка...
Задавайте неудобные вопросы

Здесь можно обсуждать спорные темы, необычные идеи, теории и вопросы, на которые редко бывает один правильный ответ.

Читайте аргументы сторонников и оппонентов, сравнивайте позиции и формируйте собственное мнение.

Читайте аргументы сторонников и оппонентов, сравнивайте позиции и формируйте собственное мнение.

Лучшие комментарии поднимаются выше благодаря оценкам участников, а слабые доводы постепенно теряют видимость.

Лучшие комментарии поднимаются выше благодаря оценкам участников, а слабые доводы постепенно теряют видимость.

Консультант Онлайн