← На главную

K3: 2,8 трлн — сильна в коде, но слабее Claude Fable 5 и GPT 5.6 Sol

16.07.2026 14:46 · hackernews

Компания Kimi представила модель Kimi K3 — самую мощную в своей линейке. У неё 2,8 триллиона параметров, архитектура на Kimi Delta Attention (KDA) и Attention Residuals (AttnRes), нативное зрение и контекст в 1 миллион токенов. Это первая открытая модель 3T-класса. По общей производительности она пока уступает топовым проприетарным моделям — Claude Fable 5 и GPT 5.6 Sol, — но на внутренних тестах стабильно обходит большинство конкурентов, включая Claude Opus 4.8 и GPT 5.5.

Kimi K3 доступна на Kimi.com, в Kimi Work, Kimi Code и через Kimi API. Сейчас модель по умолчанию работает в режиме максимального «думания», режимы с низким и высоким усилием добавят позже. Полные веса модели обещают выпустить до 27 июля 2026 года.

В основе Kimi K3 — KDA и AttnRes, которые улучшают передачу информации по длине последовательности и глубине сети. MoE-архитектура активирует 16 из 896 экспертов, а Stable LatentMoE и Quantile Balancing убирают эвристики и капризный гиперпараметр балансировки. В обучении применяли Per-Head Muon — адаптивную оптимизацию по головам внимания. Квантизационно-осознанное обучение использует MXFP4 веса и MXFP8 активации для совместимости с разным железом. Для инференса рекомендуют конфигурации от 64 ускорителей, а поддержку префиксного кэширования под KDA добавили в vLLM.

Kimi K3 сильна в долгосрочном кодинге. В тесте DeepSWE она получила 67.5 баллов, в Program Bench — 77.8, в SWE Marathon — 42.0. Она сама оптимизировала GPU-ядра на NVIDIA H200 и GPGPU-вендоре, написала мини-компилятор MiniTriton, который на некоторых задачах обогнал Triton и torch.compile, процедурно сгенерировала 3D-игру на Three.js WebGPU, а за 48 часов спроектировала чип на Nangate 45nm с производительностью 8700 токенов/с. В научной работе модель за два часа сделала то, на что опытный исследователь тратит неделю-две — проанализировала 20+ статей по астрофизике и написала 3000 строк Python.

В знаниевых задачах модель справляется с исследованиями, созданием дашбордов и видео. Например, она смонтировала собственный тизер из 56 клипов за то, на что новичку нужно 3–5 дней.

Цены на Kimi API: $0.30/MTok для кэш-хита на вход, $3.00/MTok при промахе кэша и $15.00/MTok за выход. Кэш-хитрейт на кодинговых задачах — выше 90%.

Ограничения: модель чувствительна к истории «думания» — если переключить её в середине сессии, качество может просесть. Она также склонна к излишней инициативности при нечётких задачах. В целом Kimi K3 — мощная открытая модель, но по пользовательскому опыту пока заметно уступает Claude Fable 5 и GPT 5.6 Sol.

Читать оригинал →