Как накопить на старость в Польше? Обсуждаем в новом выпуске подкаста Złoty Dzik
Support us

OpenAI выпустила GPT-5.6: лучше Claude Fable в кодинге и на треть дешевле

Компания открыла общий доступ к семейству GPT-5.6. В него вошли три модели: флагманская Sol, сбалансированная Terra и наиболее быстрая и дешевая Luna. Все модели доступны в ChatGPT, Codex и через API.

Оставить комментарий
OpenAI выпустила GPT-5.6: лучше Claude Fable в кодинге и на треть дешевле

Компания открыла общий доступ к семейству GPT-5.6. В него вошли три модели: флагманская Sol, сбалансированная Terra и наиболее быстрая и дешевая Luna. Все модели доступны в ChatGPT, Codex и через API.

OpenAI делает ставку на эффективность: новые модели должны выполнять задачи быстрее, расходовать меньше токенов и обходиться дешевле конкурентов. GPT-5.6 предназначена для программирования, офисной работы, исследований, кибербезопасности и создания документов, таблиц и презентаций.

Главной моделью семейства стала GPT-5.6 Sol. OpenAI называет ее своей лучшей моделью для программирования. В Artificial Analysis Coding Agent Index она набрала 80 баллов против 77,2 у Claude Fable 5. По данным компании, Sol при этом использовала менее половины выходных токенов, выполнила задания более чем вдвое быстрее и обошлась примерно на треть дешевле.

В тесте Agents’ Last Exam модели GPT-5.6 показали лучшее соотношение цены и качества: Sol набрала около 54% при затратах менее $1 тысячи, тогда как Claude Fable 5 и Opus 4.8 показали более низкие результаты при значительно большей стоимости. Источник: OpenAI.

Результаты неодинаковы во всех тестах. Например, в SWE-Bench Pro Sol набрала 64,6%, тогда как Claude Fable 5 — 80%. Зато в Terminal-Bench 2.1 модель OpenAI получила 88,8% против 83,1% у Fable 5. Аналитики отмечают, что таким образом говорить о безусловном превосходстве GPT-5.6 над Claude во всех задачах нельзя.

OpenAI также представила режим ultra для сложных задач. По умолчанию он запускает четыре агента параллельно: они исследуют разные варианты решения, после чего система объединяет результаты. В API разработчики смогут создавать похожие сценарии через бета-версию мультиагентного режима. Такой подход расходует больше токенов, но должен сокращать время выполнения сложной работы.

GPT-5.6 Sol лидирует в Coding Agent Index и DeepSWE, а в режиме Ultra показывает лучший результат в Terminal-Bench 2.1 — 91,9%. Однако в SWE-Bench Pro модель заметно уступает Claude Mythos 5: 64,6% против 80,3%. Источник: OpenAI.

GPT-5.6 также получила улучшенные возможности для работы с интерфейсами и визуальными материалами. Модель может не только создать код сайта или презентацию, но и проверить готовый результат, заметить визуальные ошибки и доработать оформление. В OpenAI добавили, что Sol лучше соблюдает структуру исходных шаблонов в презентациях, документах и таблицах.

Отдельный акцент сделан на кибербезопасности. В ExploitBench Sol набрала 73,5% против 47,9% у GPT-5.5, а в SEC-Bench Pro — 71,2% против 45,8%. Модель может помогать с анализом угроз, проверкой кода, поиском уязвимостей и подготовкой исправлений. При этом доступ к наиболее чувствительным возможностям будет ограничен для проверенных пользователей программы Trusted Access.

Цены в API составляют: Sol — $5 за 1 млн входных и $30 за 1 млн выходных токенов; Terra — $2,5 и $15 соответственно; Luna — $1 и $6. Бесплатные пользователи ChatGPT Work и подписчики Go получат доступ к Terra. Пользователи Plus, Pro, Business и Enterprise смогут выбирать между Sol, Terra и Luna, а также настраивать глубину рассуждений. Режим ultra в ChatGPT Work будет доступен подписчикам Pro и Enterprise, а в Codex — начиная с Plus.

Мои инженеры больше не хотят просто писать код: CEO Nvidia — о будущем разработки
Мои инженеры больше не хотят просто писать код: CEO Nvidia — о будущем разработки
По теме
Мои инженеры больше не хотят просто писать код: CEO Nvidia — о будущем разработки
Apple проиграла суд против ЕС. Что это значит для App Store и iOS
Apple проиграла суд против ЕС. Что это значит для App Store и iOS
По теме
Apple проиграла суд против ЕС. Что это значит для App Store и iOS
У GitHub появился конкурент — его запустил бывший CEO платформы
У GitHub появился конкурент — его запустил бывший CEO платформы
По теме
У GitHub появился конкурент — его запустил бывший CEO платформы
Читайте также
OpenAI выпустила GPT-5 Codex: лучше код-ревью, меньше ошибок
OpenAI выпустила GPT-5 Codex: лучше код-ревью, меньше ошибок
OpenAI выпустила GPT-5 Codex: лучше код-ревью, меньше ошибок
OpenAI выпустила GPT-5.2-Codex — агентную модель для программирования
OpenAI выпустила GPT-5.2-Codex — агентную модель для программирования
OpenAI выпустила GPT-5.2-Codex — агентную модель для программирования
OpenAI представила GPT-5.6 — свой ответ Claude Mythos и Fable 5
OpenAI представила GPT-5.6 — свой ответ Claude Mythos и Fable 5
OpenAI представила GPT-5.6 — свой ответ Claude Mythos и Fable 5
OpenAI снизила цены на две модели GPT-5.6
OpenAI снизила цены на две модели GPT-5.6
OpenAI снизила цены на две модели GPT-5.6

Хотите сообщить важную новость? Пишите в Telegram-бот

Главные события и полезные ссылки в нашем Telegram-канале

Обсуждение
Комментируйте без ограничений

Релоцировались? Теперь вы можете комментировать без верификации аккаунта.

Комментариев пока нет.