← На главную

Ploy перевела ИИ-агента на GPT-5.6 Sol: скорость сборки +100%, цена -27%

12.07.2026 17:13 · hackernews

Компания Ploy перевела своего ИИ-агента на свежую модель OpenAI — GPT-5.6 Sol. До этого четыре месяца лучшей считалась Claude Opus 4.8, и ничего не могло её обойти. GPT-5.6 Sol справилась: сайты теперь собираются больше чем в два раза быстрее (3:42 против 8:00), на 27% дешевле ($2.22 против $3.06 за сборку) и с меньшим числом выходных токенов (17.1K против 33K). Визуальное качество даже чуть выше — 0.970 против 0.936.

Но переезд дался нелегко. Оказалось, что весь стек Ploy неявно заточен под поведение Claude. Первый запуск eval'ов провалился из-за настроек самого тестового стенда, а не модели. Например, Opus редко использовал пакетное чтение файлов, и обвязка его не поддерживала, а GPT-5.6 им пользуется постоянно — отсюда ложные ошибки.

Главная головная боль — инструмент code. У него 25 параметров. Claude передаёт только нужные 2–3. GPT-5.6 Sol — все 25, выдумывая значения для лишних. Из-за этого 52–64% чтений файлов возвращали пустоту: модель передавала offset: 0, и код думал, что это осмысленный аргумент. Уговорить модель «не присылать лишнее» не вышло — ни через промпт, ни через strict-режим OpenAI. Починили хитростью: на вход OpenAI параметры делают обязательными, но nullable (anyOf: [T, null]), а перед выполнением инструмента null'ы вычищают.

Вторая крупная проблема — кэширование промптов. У Anthropic статический префикс в 29K токенов кэшируется на всю организацию, hit rate — 92–96%. У GPT-5.6 Sol кэш теперь явный, с ключом (prompt_cache_key), и каждый ключ живёт на своём узле ёмкостью ~15 запросов в минуту. Если сделать один ключ на всех — трафик нагрузит узел, и половина запросов уйдёт в холод. Если делать ключ на диалог — каждый новый разговор платит полную цену. Нашли баланс: ключ на рабочее пространство пользователя. После настройки процент попаданий в кэш при первом запросе сессии вырос с 0% до 83.7%, а расходы на входные токены упали на 28%.

Третья мелочь — воспроизведение рассуждений. API Responses от OpenAI по умолчанию возвращает reasoning как ссылки на серверные элементы. В середине разговора они протухали, и диалог падал с ошибкой Item 'rs_...' not found. Решили флагом store: false, чтобы модель присылала зашифрованный текст напрямую.

Итог: GPT-5.6 Sol уже работает в Ploy по умолчанию. Пишет аккуратный код и хорошо выглядит, но склонен к однообразному стилю, если его специально не направлять.

Читать оригинал →