OpenAI снизила цены API для GPT-5.6 Terra и Luna до 80% и уменьшила расход кредитов в ChatGPT Work и Codex
OpenAI снизила цены API для моделей GPT-5.6 Terra и Luna на 20% и 80% соответственно, а также сократила число usage credits, которые эти модели расходуют в ChatGPT Work и Codex. По сути, это должно позволить корпоративным клиентам выполнять больше ИИ-задач без увеличения расходов.
«Начиная с 30 июля, цена API составляет $2 за миллион входных токенов и $12 за миллион выходных токенов для Terra, а для Luna — $0.20 за миллион входных токенов и $1.20 за миллион выходных токенов», — написала компания в блоге.
До этого обновления корпоративные клиенты платили за GPT-5.6 Terra $2.50 за миллион входных токенов и $15 за миллион выходных токенов. Для Luna цена составляла $1 за миллион входных токенов и $6 за миллион выходных токенов.

OpenAI заявила, что более низкие цены и фактическое снижение потребления кредитов стали результатом улучшений в эффективности обслуживания, которые дают ей возможность предлагать «больше интеллекта за доллар» для своей самой продвинутой линейки ИИ-моделей.
По словам компании, прирост эффективности связан с оптимизациями во всей цепочке AI training и inference, включая программную часть и GPU-инфраструктуру. GPT-5.6 Sol помогает оптимизировать production GPU kernels, которые используются для запуска ИИ-нагрузок, и снижать стоимость inference без ухудшения качества модели.
Компании, вероятно, будут тратить по-другому, а не меньше
Аналитики считают, что снижение цен связано не столько с уменьшением корпоративных расходов на ИИ, сколько с удешевлением масштабного внедрения ИИ.
«Для CIO главный эффект, скорее всего, будет в расширении внедрения ИИ, а не просто в сокращении затрат или бюджетов на ИИ. Более низкие цены упрощают перевод пилотов в production, расширение ИИ на большее число сотрудников и бизнес-процессов, а также экономичное внедрение более сложных agentic workflows, которым требуется несколько вызовов модели», — сказал Pareekh Jain, главный аналитик Pareekh Consulting.
«Вместо сокращения ИИ-бюджетов большинство компаний реинвестирует экономию в более интенсивное использование ИИ, позволяя агентам выполнять больше reasoning, automation и многошаговых workflows, создавая больше бизнес-ценности примерно за те же деньги», — отметил Jain, добавив, что вероятный результат напоминает парадокс Джевонса — экономический принцип, согласно которому повышение эффективности часто увеличивает общее потребление ресурса, а не снижает его.
Разделяя его точку зрения, Chandrika Dutt, директор по исследованиям в Avasant, отметила, что корпоративные команды, вероятно, используют появившийся запас по стоимости для создания более сложных agentic workflows, которые раньше было трудно оправдать экономически.
CIO нужны гибкие ИИ-архитектуры, чтобы извлечь выгоду
В более широком смысле CIO стоит рассматривать обновление цен OpenAI как еще один признак того, что в ближайшие 24 месяца стоимость inference, вероятно, продолжит снижаться у разных поставщиков моделей, таких как Anthropic, Google и Microsoft, а резкий рост цен маловероятен.
«Такие снижения цен в долгосрочной перспективе в целом устойчивы. Новые чипы, лучшее программное обеспечение и более эффективные архитектуры моделей будут дальше снижать стоимость одного токена, а жесткая конкуренция делает резкие повышения цен рискованными для любого отдельного поставщика и, следовательно, маловероятными», — указал Jain.
Для компаний и их руководителей это должно означать необходимость строить ИИ-стратегии с приоритетом на AI FinOps и гибкие архитектуры, чтобы модели можно было заменять по мере улучшения соотношения цены и производительности у разных вендоров, добавил Jain.
При этом более крупная и продвинутая модель семейства GPT-5.6 под названием Sol не получает изменений в цене. Вместо этого OpenAI представила для нее новый режим Fast, который заменяет Priority Processing в API. Существующие API-запросы с пометкой «priority» при этом продолжат работать, добавила компания.
Материал — перевод статьи с английского.
Оригинал: OpenAI drops GPT-5.6 Luna and Terra API prices by up to 80%