ИИ НОВОСТЬ

OpenAI запустила GPT-5.6: три модели Sol, Terra и Luna уже доступны

Сегодня OpenAI выкатила GPT-5.6. Сразу три модели: Sol для самых сложных задач, Terra для повседневной работы и Luna для быстрых ответов. Запуск задержался на пару недель из-за проверки правительства США, но сегодня ограничения сняли. API и Codex работают прямо сейчас, веб-доступ в ChatGPT появится в ближайшие недели.

OpenAI запустила GPT-5.6: три модели Sol, Terra и Luna уже доступны

Серверная стойка дата-центра с визуализацией работы нейросети GPT-5.6

Три модели вместо одной

OpenAI отказалась от схемы «одна модель на все случаи». GPT-5.6 это семейство из трёх моделей под разные задачи и бюджеты.

Sol — флагман. 150 тысяч токенов контекста, два новых режима рассуждения: Max для длинных цепочек логики и Ultra который запускает несколько суб-агентов параллельно. Ценник $5 за миллион входных токенов и $30 за выходные. Дорого, но это самый мощный общедоступный LLM на рынке.

Terra — середняк. По качеству на уровне GPT-5.5, но вдвое дешевле. $2.50 за вход, $15 за выход. Для большинства бизнес-задач незачем переплачивать за Sol когда Terra справляется так же.

Luna — быстрая и дешёвая. $1 за вход, $6 за выход. Низкая задержка, высокий поток. Хороша для чат-ботов, автоответов и прочего где важна скорость а не глубина рассуждений.

Почему запуск задержали

Ещё 26 июня OpenAI дала предварительный доступ двадцати партнёрам. Публичный запуск планировали почти сразу, но администрация Трампа потребовала экспертизу через Центр стандартов и инноваций при Минторге США. По указу о кибербезопасности ИИ, модели такого уровня должны пройти до 30 дней тестирования.

OpenAI отправила инженеров в Вашингтон. После проверки разрешение дали вчера, 8 июля. Сегодня модели доступны всем.

📌Заметка: В заявлении OpenAI сказано что компания «не хочет чтобы такая практика госпревью стала стандартной». Тем не менее прецедент создан. Следующие крупные релизы от Anthropic и Google скорее всего пройдут через ту же процедуру.

Что ещё интересного

Улучшенное кеширование промтов. Можно ставить свои точки кеширования, минимальное время жизни кеша 30 минут, скидка 90% на чтение из кеша. Для продакшена где промты повторяются, счёт упадёт ощутимо.

Позже в июле выйдет вариант Sol ускоренный чипами Cerebras. Обещают до 750 токенов в секунду. Это в десятки раз быстрее чем сейчас. Если цифры подтвердятся, Sol станет не только самым умным но и самым быстрым в своём классе.

По безопасности: 700 тысяч GPU-часов автоматического ред-тиминга (A100-эквивалент). Лучшие результаты на Terminal-Bench 2.1 и GeneBench v1.

💡Почему это важно

GPT-5.6 закрывает главную проблему GPT-5. Цену. Terra даёт качество флагмана за полцены, Luna позволяет пихать LLM в сценарии где раньше не окупалось. А Sol с режимом Ultra это первая модель которая умеет запускать суб-агентов из коробки без внешних фреймворков вроде CrewAI. Для бизнеса это значит что теперь можно выбрать модель под бюджет а не платить за избыточную мощность.

Поделиться