Три модели вместо одной
OpenAI отказалась от схемы «одна модель на все случаи». GPT-5.6 это семейство из трёх моделей под разные задачи и бюджеты.
Sol — флагман. 150 тысяч токенов контекста, два новых режима рассуждения: Max для длинных цепочек логики и Ultra который запускает несколько суб-агентов параллельно. Ценник $5 за миллион входных токенов и $30 за выходные. Дорого, но это самый мощный общедоступный LLM на рынке.
Terra — середняк. По качеству на уровне GPT-5.5, но вдвое дешевле. $2.50 за вход, $15 за выход. Для большинства бизнес-задач незачем переплачивать за Sol когда Terra справляется так же.
Luna — быстрая и дешёвая. $1 за вход, $6 за выход. Низкая задержка, высокий поток. Хороша для чат-ботов, автоответов и прочего где важна скорость а не глубина рассуждений.
Почему запуск задержали
Ещё 26 июня OpenAI дала предварительный доступ двадцати партнёрам. Публичный запуск планировали почти сразу, но администрация Трампа потребовала экспертизу через Центр стандартов и инноваций при Минторге США. По указу о кибербезопасности ИИ, модели такого уровня должны пройти до 30 дней тестирования.
OpenAI отправила инженеров в Вашингтон. После проверки разрешение дали вчера, 8 июля. Сегодня модели доступны всем.
Что ещё интересного
Улучшенное кеширование промтов. Можно ставить свои точки кеширования, минимальное время жизни кеша 30 минут, скидка 90% на чтение из кеша. Для продакшена где промты повторяются, счёт упадёт ощутимо.
Позже в июле выйдет вариант Sol ускоренный чипами Cerebras. Обещают до 750 токенов в секунду. Это в десятки раз быстрее чем сейчас. Если цифры подтвердятся, Sol станет не только самым умным но и самым быстрым в своём классе.
По безопасности: 700 тысяч GPU-часов автоматического ред-тиминга (A100-эквивалент). Лучшие результаты на Terminal-Bench 2.1 и GeneBench v1.
GPT-5.6 закрывает главную проблему GPT-5. Цену. Terra даёт качество флагмана за полцены, Luna позволяет пихать LLM в сценарии где раньше не окупалось. А Sol с режимом Ultra это первая модель которая умеет запускать суб-агентов из коробки без внешних фреймворков вроде CrewAI. Для бизнеса это значит что теперь можно выбрать модель под бюджет а не платить за избыточную мощность.