← На главную

Kimi Code представил k3-256k и HighSpeed: смена модели сбрасывает кэш

29.07.2026 19:25 · hackernews

Kimi Code поставляет две модели — Kimi K3 и Kimi K2.7 Code — под четырьмя идентификаторами: k3, k3-256k, kimi-for-coding и kimi-for-coding-highspeed. k3 — флагман на 2.8T параметров с контекстным окном до 1M токенов, но она в два раза прожорливее по квоте, чем урезанная k3-256k. Последнюю и рекомендуют для повседневных задач: вопрос-ответ, автодополнение, рядовая разработка функций, мелкие правки. Видео k3-256k не принимает. HighSpeed-версия kimi-for-coding-highspeed ускоряет ответ в 5–6 раз, тратит втрое больше квоты и доступна только на плане Allegretto и выше.

При переходе с k3 на k3-256k, если история сессии перевалила за 256K, многие инструменты — например, Kimi Code CLI или Claude Code — запускают компактизацию. Вручную сделайте compact до переключения: сожмёте контекст, сохраните суть задачи и заодно избежите проблем с видеофайлами, которые новая модель просто не поймёт. Обратный переход с k3-256k на k3 кэш не трогает.

После смены модели контекстный кэш инвалидируется, и расход временно подскакивает. Поэтому лучше начинайте новую сессию — и ответ качественнее, и токенов сожжёте меньше. Та же логика с переключением reasoning effort: сброс кэша заставляет систему заново префиллить контекст. Чтобы не переплачивать, выберите один уровень low, high или max и держите его всю сессию. Если задача требует другого effort, стартуйте с чистого листа.

Доступ к моделям жёстко привязан к подписке. План Moderato открывает k3 и k3-256k, но контекст k3 ограничен 256K; чтобы получить полный миллион и HighSpeed, нужен Allegretto или выше. Ошибка 401 при верном model ID как раз сигналит о превышении прав. HighSpeed может не дать ожидаемого буста, если вы ошиблись в ID — kimi-for-coding-highspeed вводится строго так, иначе запрос молча уходит на обычную kimi-for-coding. Кроме того, ускорение касается только вывода модели, а вызовы инструментов и выполнение скриптов идут в своём темпе; когда они съедают основное время, общая разница малозаметна.

Переключаться удобно прямо в официальных клиентах. В Kimi Code CLI наберите /model. В VS Code выберите модель из выпадающего списка в строке ввода. При работе через API берите Model ID из таблицы (k3, k3-256k, kimi-for-coding, kimi-for-coding-highspeed), не подставляйте имена версий вроде Kiimi K3 — вызов упадёт. Base URL для OpenAI-совместимого протокола — https://api.kimi.com/coding/v1, для Anthropic-совместимого — https://api.kimi.com/coding/. Если в стороннем инструменте подключаете k3, не забудьте выставить context-window в 1048576, иначе максимум не получите. И помните про маппинг reasoning effort: значения null или undefined дают high, ultra, max, xhighmax, high или mediumhigh, low, minimum, lightlow, а none отключает thinking и перенаправляет запрос на старую K2.6.

Читать оригинал →