Новая модель — улучшенная версия GPT-6 Sol, которую OpenAI выпустила 22 сентября вместе с более дешёвой моделью Luna. Сейчас она доступна пользователям тарифов Plus, Pro, Business, Enterprise и Edu в ChatGPT Work и Codex. В основном чате ChatGPT модель пока недоступна. Разработчики могут использовать её через API под названием gpt-6.1-sol.
«Интеллект почти на уровне Astra за пятую часть цены», — говорится в заявлении OpenAI.
Цены
В API GPT-6.1 Sol стоит 2 доллара за миллион входных токенов и 10 долларов за миллион выходных токенов. Кэшированные входные данные, позволяющие разработчикам повторно использовать контекст в разных запросах, стоят 0,10 доллара за миллион токенов. По данным OpenAI, это на 95% дешевле стандартной цены на входные токены и вдвое дешевле кэшированных входных токенов GPT-6 Sol.
В ближайшие дни OpenAI также предложит более быструю версию Sol в тарифе Ultrafast. По словам компании, в Codex Ultrafast генерирует токены до восьми раз быстрее.
Результаты тестов OpenAI
По данным OpenAI, в тесте DeepSWE v1.1, оценивающем выполнение задач по разработке ПО в реальных кодовых базах, Sol показывает результат на уровне Astra, обходясь примерно в пятую часть её стоимости. Модель превосходит лучший результат GPT-6 Sol на 6,4 процентного пункта.
В тесте AutomationBench, который оценивает выполнение многоэтапных рабочих процессов в бизнесе, Sol набрала на 2,2 балла больше, чем Opus 5.5 от Anthropic, при стоимости примерно втрое ниже, заявила OpenAI. В тесте OSWorld 2.0 на использование компьютера результат модели отстаёт от Astra всего на 2,1 балла, а стоимость выполнения каждой задачи примерно в семь раз ниже.
По данным OpenAI, в тесте Terminal-Bench Science 0.1 средняя стоимость выполнения одной задачи Sol при максимальном уровне усилий составляет 5,47 доллара. Для сравнения, у Opus 5.5 она составляет 23,21 доллара, а у Astra — 23,80 доллара. При этом среди протестированных моделей Astra по-прежнему показывает наивысший результат — 68,1%. OpenAI заявила, что для самых сложных задач научных исследований следует использовать именно её.
OpenAI проводила тестирование собственных моделей в своей исследовательской среде или через API. Результаты конкурентов компания взяла из открытых отчётов.
Ошибки и тесты безопасности
По данным OpenAI, при низком уровне усилий Sol снизила долю ответов с фактическими ошибками с 11,4% до 7,7%. В этом тесте использовались намеренно сложные запросы, в которых пользователи ранее указывали на ошибки предыдущей модели.
В одном из тестов безопасности Sol в 2,1% случаев не сообщала пользователям, что их инструмент поиска не работает. У GPT-6 Sol этот показатель составил 4,9%, а у Astra — 1,5%. OpenAI заявила, что не зафиксировала попыток Sol обойти автоматизированную проверку безопасности. Подробности приведены в дополнении к системной карте модели.
OpenAI выпустила GPT-6 Astra 3 сентября. Компания отменила октябрьский запуск GPT-6.1 Astra после неудачных тестов безопасности.
Опубликовано 29 сентября 2026 - 10:33 Наверх



