← На главную

Не сравнивайте ИИ по цене токенов — переплатите за худший результат

06.07.2026 19:43 · hackernews

Сравнивать модели ИИ по цене за миллион токенов — бессмысленно. Когда приходит счёт за API, становится ясно: AI стоит дорого, и привычка выбирать модель по $X за 1M токенов только раздувает расходы. Дело в том, что у каждой лаборатории-разработчика собственный токенизатор. Один и тот же текст может быть разбит на 160 токенов для gpt-4o и на 200 токенов для gpt-4 (1106-preview) — это даже внутри одной компании. Сравнивать цены между разными лабораториями, которые постоянно правят свои проприетарные токенизаторы, — почти невозможно. Anthropic недавно изменила свой токенизатор, и теперь Claude режет тот же текст на 30% больше токенов. Это равносильно резкому повышению цен.

Но есть и второй фактор: ценность одного дополнительного токена. Если вы используете AI для серьёзной работы, бóльшая часть токенов тратится на «размышления» (chain of thought). Эта техника улучшает качество ответов, но её длина может отличаться в разы. Автор собрал таблицу с лучшими моделями американских и китайских лабораторий и сравнил их по реальной стоимости выполнения задачи (Cost per benchmark task) в бенчмарке Artificial Analysis.

Выяснилось неочевидное. GPT-5.5 xhigh номинально дороже Claude Opus 4.8 max ($5/$30 против $5/$25 за 1M токенов), но задача в бенчмарке обходится почти вдвое дешевле ($0.99 против $1.78). Китайский GLM-5.2 max дешевле за токены в 3–7 раз, но стоимость задачи снижается не так сильно (~$0.46), потому что он менее эффективен по токенам, чем западные флагманы. Самый странный случай — Claude Sonnet 5 max. Он показывает результат в бенчмарке хуже, чем Opus 4.8, но стоит за задачу дороже ($2.29 против $1.78) из-за низкой токен-эффективности. Автор задаётся вопросом: зачем нужна такая модель? (Конспирологическая версия: Anthropic специально занижает номинальную цену, чтобы подсадить клиентов на менее эффективную модель и в итоге брать с них больше.)

Лидер по соотношению цена/качество — DeepSeek V4 Pro max. Его стоимость за задачу — копейки (~$0.04–$0.05), хотя по интеллектуальным тестам он заметно уступает топу. Итог: цена за миллион токенов — не показатель. Ориентироваться надо на реальную стоимость выполнения задачи. Иначе вы получите худший результат за бóльшие деньги.

Читать оригинал →