OpenAI 30 июля (по местному времени) объявила о снижении цен на API моделей из семейства GPT-5.6 — GPT-5.6 Luna и GPT-5.6 Terra. Цена на Luna (самую быструю и дешёвую) снизилась на 80 %, на Terra (модель для повседневных задач) — на 20 %. Цена на топовую модель GPT-5.6 Sol осталась прежней.
Новые цены вступили в силу с того же дня. Для Terra стоимость составляет 2 доллара за 1 млн входных токенов и 12 долларов за 1 млн выходных токенов. Для Luna — 0,20 доллара за 1 млн входных токенов и 1,20 доллара за 1 млн выходных токенов. Изменения в ценах на AWS будут применяться постепенно в тот же день.
Снижение цен отразится на расчёте потребления в ChatGPT Work и кодирующем агенте Codex. При этом стоимость подписок и лимитов использования не меняется — будет уменьшаться количество кредитов, расходуемых при использовании Terra и Luna. В ChatGPT Work и Codex пользователи Free и Go могут выбирать Terra, а пользователи Plus, Pro, Business, Enterprise — Terra и Luna.
OpenAI утверждает, что Luna обеспечивает производительность, сопоставимую с передовыми моделями годичной давности, при этом затраты на одну задачу составляют около 6 % от прежних, а скорость работы выше в 9 раз. В бенчмарке Agents' Last Exam Luna опередила модель Fable 5 от Anthropic, а расчётные затраты на задачу оказались почти на 99 % ниже.
Кроме того, OpenAI внедрила в API режим Fast mode, который заменит прежний Priority Processing. В GPT-5.6 Sol скорость стандартной обработки может быть в 2,5 раза выше, при этом цена будет в 2 раза выше. Существующие запросы с тегом priority будут автоматически использовать Fast mode — обеспечивается обратная совместимость, также режим согласован с Codex (/fast).
Снижение цен стало возможным благодаря оптимизации, которую выполнила сама модель: GPT-5.6 Sol самостоятельно оптимизировала ядро в производственной среде, провела сотни экспериментов. В результате общие затраты на предоставление модели снизились на 20 %, а эффективность генерации токенов выросла более чем на 15 %.