OpenAI представила GPT-6 Sol и Luna: новые модели стали вдвое дешевле своих предшественников
OpenAI представила две новые модели искусственного интеллекта — GPT-6 Sol и GPT-6 Luna, которые дополнили флагманскую модель GPT-6 Astra, выпущенную в начале этого месяца. По данным компании, новые модели унаследовали ключевые возможности Astra в области программирования, работы с фактами, использования компьютера и согласования целей (alignment), но стали быстрее и вдвое дешевле своих предшественников из серии GPT-5.6.
GPT-6 Sol и GPT-6 Luna уже доступны для пользователей платных тарифных планов ChatGPT Work и Codex, а также через API. Пользователи бесплатных тарифных планов могут воспользоваться GPT-6 Luna в настольном приложении.
Стоимость новых моделей
Самым заметным изменением стало снижение стоимости API. Для GPT-6 Sol цена входных токенов сократилась с 4 до 2 долларов за миллион, выходных — с 20 до 10 долларов. GPT-6 Luna подешевела с 0,20 до 0,10 доллара за миллион входных токенов и с 1,20 до 0,50 доллара за миллион выходных токенов.
В компании объясняют, что этого удалось достичь благодаря более эффективному развертыванию моделей и улучшенному кэшированию запросов. По словам OpenAI, это делает использование мощного ИИ экономически более целесообразным для повседневных задач и масштабных приложений.
GPT-6 Sol приблизился к Astra
OpenAI позиционирует GPT-6 Sol как модель для сложной профессиональной работы. На бенчмарке AutomationBench, который проверяет бизнес-процессы с использованием десятков программ, Sol при максимальных усилиях набрала 33,2%, превзойдя GPT-6 Astra в режиме низких усилий (30,3%) и конкурентную модель Claude Opus 5 (26,9%) компании Anthropic.
На тесте Agent's Last Exam, который оценивает выполнение длительных профессиональных задач в 55 отраслях, GPT-6 Sol набрала 56,4%. Это, по данным OpenAI, превышает лучший результат Claude Opus 5 при более низкой стоимости выполнения задач.
Меньше ошибок
Разработчики утверждают, что GPT-6 Sol примерно вдвое сократила количество фактических ошибок по сравнению с GPT-5.6 Sol в ходе внутренней оценки, основанной на реальных разговорах пользователей. GPT-6 Luna также значительно улучшила точность и, по данным OpenAI, приблизилась к уровню GPT-5.6 Sol при значительно более низкой стоимости.
Программирование
В области программирования GPT-6 Sol улучшил результаты на FrontierCode, который оценивает готовность кода к интеграции в реальные проекты. На DeepSWE 1.1 модель набрала 68,8%, уступив всего 1,1 процентный пункт Claude Fable 5 и сделав это примерно на 80% дешевле по стоимости выполнения задач. GPT-6 Luna в этом же тесте достигла 66,6%, что, по словам OpenAI, сопоставимо с Claude Opus 5 при средних настройках, но по значительно более низкой цене.
Использование компьютера
Новые модели также получили усовершенствования для автоматизации работы на компьютере. В тесте OSWorld 2.0 GPT-6 Sol при максимальных усилиях показал 60,5%, что почти совпало с результатом Claude Opus 5 (60,3%). По оценкам компании, Luna также существенно улучшила производительность в таких сценариях по сравнению со своей предшественницей.
Кэширование для длительных разговоров
Отдельно OpenAI представила обновленную систему кэширования запросов, которая должна снизить затраты во время длительных сессий и работы агентов. Разработчики получили новые инструменты для отслеживания эффективности кэша, возможность изменять уровень рассуждений без потери кэшированного контекста и самостоятельно определять границы “кэшированных префиксов” (Prefix Caching). По словам компании, GitHub уже использует эти улучшения в Copilot, и они сократили долю токенов, требующих повторной обработки, более чем на 50% при миллиардах запросов.
Согласованность целей
В OpenAI отмечают, что Sol и Luna получили существенные усовершенствования в области безопасности и согласованности, представленные ранее в GPT-6 Astra. По внутренним оценкам, оба инструмента превосходят аналоги поколения GPT-5.6, в частности, значительно реже выдают вводящие в заблуждение ответы при написании кода.
«Приведенные оценки специально проверяют сложные ситуации и не измеряют уровень отказов при типичном использовании», — подчеркнули в OpenAI.
Доступность
Компания сообщила, что GPT-6 Sol и GPT-6 Luna уже доступны пользователям тарифов Plus, Pro, Business, Enterprise и Edu через ChatGPT Work и Codex, а также через API под названиями gpt-6-sol и gpt-6-luna. Развертывание моделей в ChatGPT будет происходить постепенно в течение дня.
OpenAI представила новые модели почти одновременно с конкурирующей компанией Anthropic. Последняя выпустила свою новую флагманскую модель Claude Opus 5.5, которая сочетает в себе производительность передовой системы Claude Fable 5.1 с сокращением стоимости использования примерно на 40%. Новая версия генерирует ответы на 30 % быстрее, чем Opus 5, демонстрирует улучшение в программировании, а также на 85 % реже пытается обойти внутренние ограничения.
В то же время генеральный директор Anthropic призвал к скоординированному замедлению темпов развития технологии, и его тогда поддержали руководитель OpenAI Сэм Альтман и глава SpaceXAI Илон Маск, который накануне также выпустил новую модель ИИ Grok 4.7. Обеспокоенность лидеров индустрии ранее вызывали риски неконтролируемого самосовершенствования алгоритмов и инциденты совзломами реальных систем.