Kimi K3 (открытая версия)

Крупнейшая в мире открытая большая модель от Moonshot AI: 2,8 трлн параметров, нативная мультимодальность и контекст в 1 млн токенов, мировой лидер в программировании

Подробный отчёт

  • 16 июля 2026 года компания Beijing Dark Side of the Moon Technology Co., Ltd. выпустила Kimi K3, большую модель с открытым исходным кодом с общим масштабом параметров 2,8 триллиона. На данный момент это модель с открытым исходным кодом и самыми большими параметрами в мире. Он возглавил список интерфейсных программ Frontend Code Arena с 1679 баллами, обогнав Claude Fable 5 и GPT-5.6 Sol. K3 построен на основе гибридного механизма линейного внимания KDA и технологии остаточного внимания. Он изначально поддерживает визуальное понимание и имеет контекстное окно на 1 миллион токенов. Он специально оптимизирован для сложных сценариев задач, таких как долгосрочное программирование, информационная работа, глубокие исследования и мультимодальное понимание. Он демонстрирует высочайшую производительность в программировании выносливости и задачах агентов, но его общий комплексный интеллект по-прежнему отстает от самых сильных моделей с закрытым исходным кодом.

  • Moonshot AI была основана в 2023 году, штаб-квартира находится в Пекине. Это стартап-компания, занимающаяся искусственным интеллектом, в которую инвестируют Alibaba и Hong Kong Investment Management Co., Ltd. (Hong Kong Investment). Основатель Ян Чжилинь ранее был доцентом Института перекрестной информации Университета Цинхуа. Основные члены команды представляют ведущие университеты, такие как Цинхуа и Пекинский университет, а также технологические компании, такие как Google и Meta. Kimi K3 находится в разработке уже больше года и является официальным преемником Kimi K2 (выпущенного в июле 2025 года). Тем временем также были выпущены итеративные версии, такие как K2.5, K2.6 и K2.7 Code. Выпуск K3 не только обеспечивает качественный скачок в шкале параметров - с уровня K2 триллионов до 2,8 триллионов - но также вносит три ключевых нововведения в базовую архитектуру: гибридный механизм линейного внимания KDA (Kimi Delta Attention), технологию остаточного внимания (Attention Residuals) и оптимизатор второго порядка Moon Clip. Стоит отметить, что выпуск Kimi K3 также вызвал бурю в индустрии. Майкл Кратциос, директор Управления научно-технической политики Белого дома, обвинил Dark Side of the Moon в разработке K3 путем дистилляции модели Anthropic Fable в социальных сетях и пригрозил санкциями и списком организаций. Дин Болл, глава отдела стратегического будущего OpenAI, также публично раскритиковал его, назвав «силой замедления». Хуан Чжэньсинь, глава подразделения Dark Side of the Moon Enterprise, четко ответил, что в основе скачка производительности K3 лежат оригинальные архитектурные инновации, а не дистиллированная копия существующей модели. Многие авторитетные СМИ и исследователи искусственного интеллекта также публично заявили, что обвинению не хватает технической основы.

  • Основные возможности Кими К3 сосредоточены на следующих направлениях. Во-первых, это способность к программированию, которая является наиболее перспективной областью. В списке интерфейсных кодов Frontend Code Arena K3 занимает первое место с 1679 баллами, обогнав Claude Fable 5 (1631 балл) и GPT-5.6 Sol (1618 баллов). Фактический опыт программирования разделен на два сценария: один используется с помощью терминального инструмента Kimi Code, который поддерживает переключение команд /model и подходит для долгосрочных задач непрерывного программирования; другой вызывается через Kimi API, который совместим с OpenAI SDK и стоит 0,3 доллара за миллион токенов за попадание в кэш, 3 доллара за промах ввода и 15 долларов за вывод. Во-вторых, это возможности обработки задач на расстоянии. Официально продемонстрированные случаи включают независимое завершение проектирования и оптимизации чипа в течение 48 часов подряд, а также воспроизведение универсального соотношения I-Love-Q в области вычислительной астрофизики примерно за два часа. K3 может непрерывно выполнять долгосрочные инженерные задачи, понимать и обрабатывать большие базы кода, а также координировать использование терминальных инструментов с минимальным контролем человека. В-третьих, это возможности мультимодального понимания. K3 изначально поддерживает мультимодальный ввод изображений и текста. Это не подключаемый модуль визуального кодирования, а настоящее средство визуального понимания. Это означает, что он может одновременно обрабатывать ввод текста, изображений и видео. Существует четыре способа использования API. Общайтесь напрямую и бесплатно через мобильное приложение Kimi (iOS/Android/HarmonyOS). Версия Kimi Work 3.1.0 и выше для настольных компьютеров обеспечивает поддержку рабочих сцен. Терминал Kimi Code предназначен для программистов. Платформа Kimi API предназначена для разработчиков и корпоративных пользователей. Официальный представитель также предоставляет корпоративную версию Kimi Enterprise, которая обеспечивает защиту конфиденциальности данных и функции управления участниками. С точки зрения реального пользовательского опыта, разработчики и программисты внешнего интерфейса обычно дают высокие оценки и полагают, что K3 «точно понимает замысел проекта» при создании кода внешнего интерфейса и восстановлении пользовательского интерфейса. Однако отзывы обычных пользователей поляризованы — некоторые считают, что он действительно лучше анализирует сложные длинные тексты, а другие жалуются, что «в ежедневных разговорах нет огромной разницы».

  • Цены на API Kimi K3 находятся на самом высоком уровне среди китайских головных моделей — объем выпуска составляет 15 долларов США за миллион токенов, что составляет примерно 100 юаней. Стоимость K2.6 предыдущего поколения составляет 4 доллара США, что увеличилось почти в 3 раза. Выходная цена аналогичной отечественной модели GLM-5.2 составляет 4,4 доллара США. Однако официальные данные предоставили важные данные: в сценариях программирования вероятность попадания в кеш может превышать 90%, поэтому фактические расходы намного ниже указанной цены. Ввод данных о попадании в кэш стоит всего 0,3 доллара США за миллион токенов. По словам официальных лиц, эта система, основанная на отдельной архитектуре рассуждений Mooncake, делает K3 очень рентабельным в сценариях высокочастотного программирования. Хуан Чжэньсинь, руководитель подразделения Dark Side of the Moon Enterprise Business, ясно дал понять, что модели с открытым исходным кодом и большие китайские модели не следует называть дешевыми. «Мы создали модель уровня SOTA, которая также может соответствовать разумным коммерческим ценам». Расчеты искусственного анализа показывают, что стоимость одной задачи Kimi K3 составляет около 0,94 доллара США, что близко к 1,04 доллара США для GPT-5,6 Sol. Это не намного дешевле, чем кажется на первый взгляд. Что касается потребителя, бесплатная версия Kimi включает определенную квоту K3, а платное членство разделено на несколько уровней, до 699 юаней в месяц. Некоторые пользователи сообщили, что за один день было использовано 20 % их квоты, а это означает, что нельзя игнорировать затраты для активных пользователей. Dark Side of the Moon заявляет, что будет придерживаться пути с открытым исходным кодом. Полная масса модели выпущена до 27 июля 2026 г. по измененной лицензии MIT. Для корпоративных клиентов, нуждающихся в частном развертывании и тонкой настройке, открытый исходный код является ценным вариантом.

  • Положительные комментарии в основном касаются трех аспектов. Во-первых, опыт программирования сценариев превосходен, генерация внешнего кода высокого качества и точное понимание замысла проекта. Основатель Vercel Гильермо Раух также провел фактическое тестирование и проверку. Во-вторых, его способность обрабатывать длинные тексты и длинные задачи просто выдающаяся. Пользователи сообщили, что, объединяя десятки страниц документов в сводку, K3 может точно извлекать ключевую информацию, активно вычитать и «начинать принимать более здравые суждения». В-третьих, возможности автоматизации в профессиональных сценариях (финансовый анализ, обзор контрактов, отраслевые исследования) являются удовлетворительными. Некоторые пользователи использовали его, чтобы найти в контрактах скрытые положения об автоматическом продлении. Негативные отзывы также очевидны. Самая распространенная жалоба — медленная скорость отклика — аналогичное задание Claude Fable 5 заняло 3,5 минуты, а K3 — 12 минут. Скорость реагирования API ниже среднего по категории. Во-вторых, цены высокие. С К2,6 до К3 цена продукции выросла почти в три раза. Опять же, существует проблема «чрезмерных рассуждений». Некоторые пользователи сообщают, что К3 будет расширять круг задач по собственной инициативе и с туманными намерениями, увеличивая затраты на доработку. Также есть отзывы пользователей о том, что при ежедневном освещении существенного улучшения не ощущается.

  • Отраслевые СМИ в целом высоко оценили это. The Economic Daily интерпретировала это как новую точку для перехода крупных моделей Китая к ценовой власти. В исследовательском отчете Goldman Sachs утверждается, что крупные модели Китая ранее выходили на мировой рынок в основном за счет эффективности затрат, и в будущем они могут полагаться на передовые возможности, чтобы войти в основной рабочий процесс глобальных разработчиков. Morgan Stanley обеспокоен тем, что цена API Kimi K3 находится на высоком уровне среди топовых моделей Китая, и считает, что более высокие цены имеют положительное значение для структуры рынка больших моделей. Технологическое сообщество разделено. Некоторые разработчики считают, что это «поворотный момент для модели с открытым исходным кодом в области программирования», поскольку впервые модель с открытым исходным кодом полностью превзошла все модели с закрытым исходным кодом в соревновании по интерфейсному коду. Другие полагают, что Benchmark принадлежит Benchmark, а «медлительность и дороговизна» при реальном использовании — это неизбежные объективные издержки. Некоторые отраслевые эксперты также отметили, что реальная ценность K3 ощущается не только на стороне C, но и что она послужит базовой моделью для расширения возможностей большого числа малых и средних предприятий. После того, как веса моделей станут открытыми, большому количеству отечественных компаний не потребуется обучать большие модели с нуля. Что касается рынков капитала, акции ИИ в США пережили волну падения после выпуска K3, отражая опасения инвесторов, что передовые модели с открытым исходным кодом могут повлиять на возможности ценообразования с закрытым исходным кодом. Илон Маск оставил два комментария со словом «впечатляет» в соответствующих комментариях и назвал K3 ключевой целью для Grok 4.6.

  • Основным спором стал перегонный заряд. Белый дом прямо выдвинул обвинение, но технические эксперты в целом считают это обвинение несостоятельным. Американский эксперт по технологиям искусственного интеллекта Натан Ламберт публично написал, что людям, которые считают, что китайские лаборатории искусственного интеллекта могут создавать отличные модели, просто украв интеллектуальную собственность, «пришло время проснуться». Глава стратегического будущего OpenAI Дин Болл также признал в спорном посте, что производительность K3 не может быть достигнута путем дистилляции. С точки зрения технических рисков, медленная скорость вывода модели в настоящее время является наиболее заметным недостатком. Для производственных сред, требующих быстрого отклика, K3 может оказаться не лучшим выбором. Кроме того, модель имеет склонность к «чрезмерному рассуждению» и склонна активно расширять объем задач без явных инструкций, что создает риски в сценариях, требующих строгого контроля границ. Существуют реальные проблемы, связанные с соблюдением требований и безопасностью данных. Данные на хостинге Кими обрабатываются на территории Китая, что является важным фактором для зарубежных пользователей с ограничениями на экспорт данных. Хотя веса с открытым исходным кодом могут быть развернуты локально после выпуска, порог развертывания модели с 2,8 триллионами параметров чрезвычайно высок — официальная рекомендация — конфигурация суперузла из более чем 64 ускорителей, что в принципе не по карману обычным предприятиям и частным лицам. Проблема модельной иллюзии также не решена полностью. Сам Хуан Чжэньсинь признал, что «галлюцинации невозможно полностью искоренить». Тем не менее, вероятность K3 значительно снизилась, и для вторичной проверки требуется субагент проверки фактов в архитектуре Agent Swarm.

  • Для использования Kimi K3 подходят: фронтенд-разработчики и инженеры полного стека, особенно команды, занимающиеся комплексной разработкой пользовательского интерфейса и фронтенд-инжинирингом; Инженеры и исследователи AI Agent, которым необходимо долгосрочное автоматизированное программирование; финансовые аналитики, отраслевые исследователи и научные исследователи, которые имеют дело с очень большими документами и проводят долгосрочные сценарии углубленных исследований; Корпоративные клиенты с приватизированными требованиями к развертыванию могут выполнить локальную тонкую настройку и развертывание после того, как веса станут открытыми. К людям, которые не подходят для немедленного использования, относятся: обычные пользователи, которым нужны только ежедневные простые вопросы и ответы и копирайтинг (достаточно многих доступных моделей); пользователи производственной среды, которым требуется чрезвычайно высокая скорость отклика; отдельные разработчики, у которых недостаточно бюджета или ресурсов графического процессора, а порог для самостоятельного развертывания слишком высок. Что касается рекомендаций по использованию, вы можете принять многоуровневую стратегию: использовать K3 для 15–20% сложных задач (программирование с длинным циклом, многошаговые агенты, углубленный анализ длинных документов) и использовать более легкие модели, такие как K2.7 Code или DeepSeek V4 Pro, для ежедневных высокочастотных простых задач. Оптимизация вызовов API на основе стратегий кэширования также может значительно снизить затраты.

  • Kimi K3 — знаковый продукт. Это впервые позволяет лейблу «модель с открытым исходным кодом» по-настоящему конкурировать с ведущими моделями с закрытым исходным кодом. Ее прорывы в программировании и решении долгосрочных задач реальны, и они также вызвали огромный резонанс на уровне отрасли и рынка. Но в целом это по-прежнему «научный игрок» — в конкретных сценариях он показывает себя на высшем уровне, но в общих сценариях все еще остается пробел. Его реальное долгосрочное влияние может заключаться не в количестве вызовов API сегодня, а в том факте, что после того, как через несколько дней исходный код будет официально открыт, он послужит базовой моделью для расширения возможностей всей экосистемы ИИ.

Отзывы пользователей

  • аватар
    CarolynBakerJr
    K3 的前端代码能力是真的强,丢了个复杂的企业后台需求进去,生成出来的页面审美在线,交互逻辑也基本对的。不过速度是真的慢,等得有点着急。

  • аватар
    goldenlion904
    用 K3 做了个 3D 游戏 demo,效果超出预期。它自己从零写代码、修 bug、调样式,全程不用我怎么管就是每次等它改完都要喝杯咖啡。

  • аватар
    Brjen
    API 价格从 K2.6 的 4 刀涨到 15 刀,涨幅快 3 倍。虽然缓存命中能省不少,但心里还是有点难受。

  • аватар
    程彤云
    实测了三天,K3 最大的变化是开始有判断力了。以前问个问题给你列七八条,现在直接砍掉那些正确的废话,留下的全是真正决策有关的信息。这点比参数提升更难得。

  • аватар
    KOgar
    得承认这是国产开源模型第一次跟 Fable 5 和 GPT-5.6 Sol 站到一个台面上。以前说对标只是口号,这次评测数据是真的接近了。

  • аватар
    SandraHart168
    同一个 bug 修复任务,Claude Fable 5 用了 3.5 分钟,K3 用了 12 分钟。差距很明显,不光是速度,对话响应也偏慢。

  • аватар
    游客_8
    办公场景测了写周报和做 PPT。写周报真的香,把零散的工作记录丢进去,自动给你包装成专业版本。做 PPT 就比较弱了,只给文字大纲,页数还失控,不如豆包的一键生成好用。

  • аватар
    Madison_Hall_7
    精度确实有提升,中文综合从 72.9% 到 75.6%,coding 从 62.6% 到 70.3%。但 token 消耗也上去了,同样任务花的钱多了不少。只能说 SOTA 级模型配 SOTA 级价格吧。

  • аватар
    Karen836
    K3 有点太爱表现了,让它总结一段产品说明,它不光总结,还自作主张加了一段风险分析。问题是原文根本没提风险,纯属脑补。复杂任务用它,简单任务还是切回 K2 更省心。

  • аватар
    月光_21
    最搞笑的是官方自己都承认综合方面还落后 Fable 5 和 Sol,但社区吹得好像已经全面碾压了。理性看待吧,K3 在特定场景下确实强,通用能力还是有差距。

  • аватар
    redzebra695
    前端代码是真的强,Frontend Code Arena 1679 分登顶不是吹的。跟 Fable 5 和 Sol 同时生成同一个 SaaS 落地页,K3 的审美确实在线,按钮间距和配色比例看着更舒服。

  • аватар
    AbigailMitchell_2024
    把几十页的行业白皮书扔进去,让 K3 提炼三个关键变化,它给得很准,而且主动标出了需要留意风险的地方。长文档处理确实比 K2 强一个档次。

  • аватар
    realSanjaSilić_dev
    用 K3 检查租房合同,帮找出一条自动续约的隐藏条款。这功能说大不大,但省了我一笔可能的损失。

  • аватар
    VEcoo
    这个模型在科研编程的场景太适合了。我用来复现一篇计算化学的论文结果,K3 自己读了代码库、修了依赖冲突、跑了参数扫描,整个过程跑了大概 5 个小时,但我基本没干预。

  • аватар
    HashHunter114
    API 接入挺简单的,兼容 OpenAI SDK,改个 base_url 就行。速度偏慢但稳定性还不错,跑了几个长任务没有出现中断。

  • аватар
    Olivia.Brooks007
    刚发布就断售了,负载扛不住可见热度多夸张。好在 API 还能用,网页端等了两天才上去。希望扩容快点跟上。

  • аватар
    唐兰
    2.8万亿参数听起来很吓人,但实际激活的只有 16/896 个专家,推理算力要求其实没想象中那么离谱。问题是自部署需要 64 个以上加速器,个人开发者基本没戏。

  • аватар
    Justin.Morales_99
    蒸馏指控真的有点离谱。K3 公布的架构创新——KDA 注意力机制和 Attention Residuals——都是有技术论文支撑的。说靠蒸馏做出 2.8T 参数的模型,技术上就不可能。

  • аватар
    DrErnestoMárquez_x
    编程能力确实强,但推理速度偏慢。同样是生成一个 Three.js 的瀑布场景,GPT-5.6 Sol 几分钟搞定,K3 花了半小时。不过最后成片的质量 K3 反而更好,彩虹和水雾的细节处理更自然。慢工出细活吧。

  • аватар
    blPAR
    有些人的期望太高了,觉得发布后就应该吊打所有闭源。实际用下来,K3 是顶级编程选手但日常对话有过度推理的问题,选对场景很重要。

  • аватар
    Judy_Morales52014
    开通了 699 元/月的最高档会员,重度用了一天额度掉了 20%。虽然心疼但确实值,复杂文档处理效率至少翻倍。

  • аватар
    Richard.RobertsX
    用 K3 做了个流量回放平台,从需求到跑起来大概半天。之前用别的模型至少折腾两天。它对长代码库的理解力确实比前代强很多。

  • аватар
    胡勇丹
    做 2D 游戏很强,让 K3 复刻泡泡堂,它自己拆成两条并行工作线,地图、角色、逻辑一起写,最终跑起来能玩。就一句话需求,它理解得太好了。

  • аватар
    BCooper_2023
    普通用户可能感受不到 K3 的强大,因为日常写文案聊天跟 K2 差别不大。但如果你做编程或者研究,差距是非常明显的。

  • аватар
    DanielleRamirez_668
    马斯克又点赞了,还说要拿 Grok 4.6 跟 K3 对标。能被这个级别的玩家当成对标目标,本身就是实力认证了。

  • аватар
    VincentPerezZ
    刚上手就给它丢了一个大项目,自己写了个迷你 GPU 编译器,从零开始,最后跑通了 nanoGPT 训练。虽然不是生产级的,但 48 小时能做成这样确实让人惊讶。

  • аватар
    吴秀龙
    月之暗面的开放策略值得肯定,K3 权重将在 7 月 27 日前开源。国内中小企业可以基于这个基座做二次开发,不用从零训练大模型了。

  • аватар
    MidhaelJensen
    第一时间就试了,拿前端代码竞技场的题让它跑,确实一把过。这是第一次有开源模型在这个榜单上超过 Claude 和 GPT。