Опубликовано: 30 июля 2026 г.3 мин

OpenAI резко снижает цены на модели GPT-5.6 и запускает Fast Mode в API

OpenAI снизила стоимость моделей GPT-5.6 Luna и Terra и запустила Fast Mode для Sol, что подтверждается отзывами партнёров.

OpenAI резко снижает цены на модели GPT-5.6 и запускает Fast Mode в API

OpenAI объявила о значительной оптимизации стоимости и скорости своих моделей. С 30 июля стоимость GPT-5.6 Luna, самой быстрой модели семейства, снижается на 80%, а сбалансированной GPT-5.6 Terra — на 20%. Кроме того, для флагманской GPT-5.6 Sol запускается Fast Mode, увеличивающий скорость обработки до 2,5 раз.

Новые цены и режимы для API

Новые тарифы на API составляют:

  • GPT-5.6 Luna: $0,20 за миллион входных токенов и $1,20 за миллион выходных.
  • GPT-5.6 Terra: $2 за миллион входных токенов и $12 за миллион выходных.

Цены на Sol и стоимость подписок ChatGPT и Codex не изменились, однако расход кредитов при использовании Terra и Luna стал ниже. Fast Mode заменяет собой прежний Priority Processing: разработчики могут получить ускорение до 2,5x без потери качества, платя вдвое больше стандартных тарифов. Запросы, ранее помеченные тегом priority, автоматически обрабатываются в новом режиме.

Экономические отзывы партнёров

OpenAI поделилась результатами внедрения новых моделей у крупных клиентов:

  • Replit: «Luna — это интеллект, который слишком дёшев, чтобы его учитывать. Мы начали строить сценарии, которые не планировали реализовывать ещё долгое время».
  • Blitzy: Переход на Luna позволил увеличить повторное использование кэша подсказок с 24% до 90%, а стоимость по сравнению с GPT-5.4 mini снизилась на 87%.
  • Notion: Terra показывает качество, сравнимое с GPT-5.5, при вдвое меньшей стоимости задачи и на 60% быстрее.
  • Ramp: Terra и Luna лидируют по экономической эффективности на внутренних бенчмарках кодинга.
  • Cognition (Devin): Модель Luna стала идеальным ассистентом для рутинной разработки, обеспечивая существенную экономию без потери качества.
  • Dust: Задачи на Luna выполняются на 40% быстрее и на 40% дешевле, чем на предыдущей стандартной модели.

Как работает новая оптимизация

Снижение стоимости — не просто акция, а результат улучшения всех слоёв системы: самих моделей (более прямой путь выполнения задач), систем инференса (эффективная генерация токенов) и агентного каркаса (управление контекстом без повторов). Примечательно, что GPT-5.6 Sol активно участвует в этом процессе: под контролем инженеров модель самостоятельно переписывала производственные ядра и проводила сотни экспериментов. Это дало 20% снижения стоимости обслуживания модели и 15% прирост эффективности генерации токенов.

Принцип «подбора интеллекта под задачу» позволяет комбинировать модели в одном рабочем процессе: например, использовать Sol для сложного проектирования архитектуры, а Luna — для реализации и тестирования, платя справедливую цену за каждый этап.

Влияние на экосистему

Эти изменения — часть долгосрочной стратегии OpenAI. С одной стороны, удешевлённые Luna и Terra открывают путь для высоконагруженных задач, которые раньше были нерентабельны (масштабный анализ документов, классификация обращений, рутинная кодогенерация). С другой стороны, Fast Mode для Sol даёт максимальную скорость для срочных операций без компромиссов в точности.

«Более способные модели помогают нашей команде находить следующие улучшения, сокращая путь к лучшей производительности и низкой стоимости», — отмечают в компании. Этот цикл обратной связи ускоряет выход каждого следующего поколения моделей.

Источник: https://openai.com/index/advancing-the-price-performance-frontier-with-gpt-5-6

Поделиться

Обсудить с ИИ

Комментарии(0)

Оставьте комментарий

Войдите, чтобы присоединиться к обсуждению

Читайте также