DeepDigest
ITmedia AI+ · · ~2 мин

OpenAI снизила цены на модели GPT-5.6 Luna и GPT-5.6 Terra

OpenAI снизила цены на модели GPT-5.6 Luna (на 80 %) и GPT-5.6 Terra (на 20 %). Новые цены вступили в силу 30 июля. Снижение стало возможным благодаря оптимизации, выполненной самой моделью. Также компания внедрила в API режим Fast mode, который заменит прежний Priority Processing.

LLM
OpenAI снизила цены на модели GPT-5.6 Luna и GPT-5.6 Terra

OpenAI 30 июля (по местному времени) объявила о снижении цен на API моделей из семейства GPT-5.6 — GPT-5.6 Luna и GPT-5.6 Terra. Цена на Luna (самую быструю и дешёвую) снизилась на 80 %, на Terra (модель для повседневных задач) — на 20 %. Цена на топовую модель GPT-5.6 Sol осталась прежней.

Новые цены вступили в силу с того же дня. Для Terra стоимость составляет 2 доллара за 1 млн входных токенов и 12 долларов за 1 млн выходных токенов. Для Luna — 0,20 доллара за 1 млн входных токенов и 1,20 доллара за 1 млн выходных токенов. Изменения в ценах на AWS будут применяться постепенно в тот же день.

Снижение цен отразится на расчёте потребления в ChatGPT Work и кодирующем агенте Codex. При этом стоимость подписок и лимитов использования не меняется — будет уменьшаться количество кредитов, расходуемых при использовании Terra и Luna. В ChatGPT Work и Codex пользователи Free и Go могут выбирать Terra, а пользователи Plus, Pro, Business, Enterprise — Terra и Luna.

OpenAI утверждает, что Luna обеспечивает производительность, сопоставимую с передовыми моделями годичной давности, при этом затраты на одну задачу составляют около 6 % от прежних, а скорость работы выше в 9 раз. В бенчмарке Agents' Last Exam Luna опередила модель Fable 5 от Anthropic, а расчётные затраты на задачу оказались почти на 99 % ниже.

Кроме того, OpenAI внедрила в API режим Fast mode, который заменит прежний Priority Processing. В GPT-5.6 Sol скорость стандартной обработки может быть в 2,5 раза выше, при этом цена будет в 2 раза выше. Существующие запросы с тегом priority будут автоматически использовать Fast mode — обеспечивается обратная совместимость, также режим согласован с Codex (/fast).

Снижение цен стало возможным благодаря оптимизации, которую выполнила сама модель: GPT-5.6 Sol самостоятельно оптимизировала ядро в производственной среде, провела сотни экспериментов. В результате общие затраты на предоставление модели снизились на 20 %, а эффективность генерации токенов выросла более чем на 15 %.

// оригинал
ITmedia AI+ ↗ Читать оригинал
4 просмотров
// поделиться Telegram VK