Они также стоят вдвое дешевле за токен и еще дешевле за выполнение задачи.
Сэм Альтман написал об этом в соцсети X во вторник, упомянув модели GPT-6 Sol и GPT-6 Luna. OpenAI выпустила обе модели в тот же день после полудня. Они расширяют семейство GPT-6, располагаясь ниже модели GPT-6 Astra, которая вышла 3 сентября.
Главная новость — это цены. В своем анонсе OpenAI указала стоимость GPT-6 Sol на уровне $2 за миллион входных токенов и $10 за миллион выходных. Это ниже прежних показателей в $4 и $20. GPT-6 Luna обойдется в $0,10 и $0,50 по сравнению с прежними $0,20 и $1,20. Обе модели стоят на 50% дешевле версий GPT-5.6 в рамках текущих акционных цен.
Для чего предназначены эти две модели
Sol — это уровень, находящийся сразу под Astra. Она создана для сложной работы, включая написание кода. Luna — меньшая из моделей. Она предназначена для масштабных задач с четкой целью, таких как обобщение документов или ответы на короткие вопросы.
Обе модели стали доступны во вторник в ChatGPT Work и Codex. Это охватывает аккаунты Plus, Pro, Business, Enterprise и Edu. Пользователи бесплатных тарифов и версии Go получают Luna в десктопном приложении. В обычном чате ни одной из них пока нет. В API они называются gpt-6-sol и gpt-6-luna. В OpenAI заявили, что будут внедрять их постепенно в течение дня для поддержания стабильности сервиса.
Компания обучила обе модели с использованием методов, лежащих в основе Astra. В компании отмечают, что Astra по-прежнему остается их лучшей моделью, когда этого требует задача.
Кэширование тоже подешевело
OpenAI также увеличила стандартные показатели попадания в кэш. Чтение кэшированных входных токенов теперь имеет скидку 90%.
Разработчики могут устанавливать явные точки останова, чтобы определить, где заканчивается префикс кэшированного промпта. Они также могут изменять интенсивность рассуждений или включать и выключать инструменты без потери кэшированного контекста.
В GitHub сообщили OpenAI, что эти изменения сократили долю токенов промпта, требующих свежей обработки, более чем в два раза. Это было зафиксировано за последние месяцы на миллиардах запросов, и именно это заставляет Copilot отвечать быстрее.
Цифры, которые OpenAI противопоставляет Claude
Большинство сравнений в анонсе приводятся в расчете на стоимость одной задачи, а не стоимость токена. В большинстве из них также упоминается Anthropic.
Тест AutomationBench проверяет бизнес-процессы на базе 47 инструментов. GPT-6 Sol при сверхвысокой интенсивности рассуждений набрала там 33,2% при стоимости $0,27 за задачу. OpenAI оценивает Claude Opus 5 при максимальной интенсивности в 26,9% при стоимости, превышающей эту в 11,1 раза. Модель GPT-6 Astra при низкой интенсивности набирает 30,3% при затратах в 3,9 раза выше. В тесте Agents’ Last Exam модель Sol при максимальной интенсивности набрала 56,4%. По заявлению OpenAI, это превосходит лучший результат Opus 5 в том же тестировании при снижении стоимости задачи на 60%.
В тесте по разработке программного обеспечения DeepSWE модель Sol набрала 68,8% против 69,9% у Claude Fable 5. При этом она выполняла задачу примерно на 80% дешевле. Luna набрала там 66,6%. В OpenAI называют этот результат сопоставимым с Opus 5 и Fable 5 при средней интенсивности рассуждений, но при этом затраты ниже на 93% и 96% соответственно. В тесте OSWorld на работу с компьютером Sol при сверхвысокой интенсивности набрала 60,5% против 60,3% у Opus 5 при средней интенсивности, также примерно на 80% дешевле.
OpenAI делает оговорки. Результаты конкурентов были взяты из опубликованных отчетов, а не получены в ходе внутренних тестов. Результаты Fable 5 использовались там, где данные для Fable 5.1 были недоступны. Показатель Fable 5.1 на диаграмме занижает реальную стоимость, так как в нем не учтены резервные механизмы Opus 5, которые срабатывали примерно для 40% задач.
Меньше ошибок по собственным меркам
OpenAI также заявляет о повышенной фактологической надежности. Внутренний тест на фактологичность использует обезличенные разговоры в ChatGPT, где пользователи отмечали ошибку предыдущей модели. На этом наборе данных Sol совершает примерно вдвое меньше ошибок, чем GPT-5.6 Sol. Luna при повышенных уровнях интенсивности рассуждений не уступает GPT-5.6 Sol, обходясь примерно в сотую часть стоимости.
Компания отмечает, что эти диалоги были отобраны специально как склонные к ошибкам. Они не отражают повседневное использование.
По показателям соответствия принципам безопасности (alignment) обе модели превосходят своих предшественников в лице GPT-5.6 во внутренних тестах OpenAI. Сюда входит и более низкая частота введения в заблуждение относительно собственной работы с кодом. Полные результаты приведены в системной карте модели. В понедельник OpenAI объявила, что позволит сторонним группам проводить технические оценки безопасности непосредственно во время обучения, а не только перед релизом.
Anthropic опередила конкурента на 90 минут
Anthropic выпустила Claude Opus 5.5 в тот же день после полудня. Релиз состоялся примерно за 90 минут до публикации OpenAI, сообщает TechCrunch. Запуск модели обходится примерно на 40% дешевле, чем Opus 5. По заявлению Anthropic, она работает на уровне, близком к Fable 5.1, в большинстве задач. Выход Sonnet 5.5 и Haiku 5.5 ожидается в ближайшие недели.
Дайан Пенн возглавляет направление управления продуктами, исследований и лабораторий в Anthropic. Она рассказала CNBC, что компания продолжает работать над повышением эффективности мыслительных процессов модели, чтобы она расходовала меньше токенов в зависимости от настроек интенсивности.
Ни один из релизов не является принципиально новой передовой моделью. Оба релиза представляют собой один и тот же маневр: взять уже существующие возможности и продать их дешевле.
Почему обе лаборатории снижают цены
Ара Харазян — ведущий экономист компании по управлению расходами Ramp. Он рассказал Fortune, что обе компании участвуют в ценовой войне, которая снижает стоимость ИИ, а вместе с ней и их способность получать от него прибыль. По его словам, борьба идет на двух фронтах: за счет более дешевых моделей и прямого снижения цен на дорогие решения.
Давление исходит снизу. Китайские модели с открытыми весами от Alibaba, DeepSeek и Moonshot теперь выполняют многие из этих задач бесплатно. Стартапы начали переходить на более дешевые открытые веса по мере поступления счетов. Обе лаборатории также публично призывали индустрию замедлить работу над передовыми системами. Новые релизы стали первыми для обеих компаний после этих заявлений.
Линейка Sol начиналась с ограниченного доступа. В июне OpenAI предоставила GPT-5.6 Sol лишь 20 партнерам на условиях, одобренных правительством. Три месяца спустя ее преемник доступен в API за полцены.
Опубликовано 22 сентября 2026 - 12:13 Наверх



