OpenAI представила модели GPT-6 Sol и GPT-6 Luna. Они дополнили семейство GPT-6, флагманской версией которого остается выпущенная ранее Astra.

По данным компании, новые решения обучались с использованием методов, применявшихся при создании GPT-6 Astra. OpenAI перенесла часть улучшений флагманской модели в области профессиональных задач, программирования, работы с компьютером, фактологической точности и выравнивания в более быстрые и дешевые версии.

GPT-6 Sol ориентирована на сложные рабочие задачи и агентные сценарии, тогда как Luna предназначена прежде всего для массовых операций, где важны скорость и стоимость. Флагманская Astra при этом остается наиболее производительной моделью компании.

GPT-6 Sol и Luna уже доступны через API. Компания также начала развертывать их в ChatGPT Work и Codex.

Возможности GPT-6 Sol и Luna и сравнение с другими моделями

Одним из основных изменений стала цена. GPT-6 Sol стоит $2 за 1 млн входных и $10 за 1 млн выходных токенов против $4 и $20 соответственно у GPT-5.6 Sol. Для GPT-6 Luna показатели составляют $0,10 и $0,50 против $0,20 и $1,20 у предыдущей версии.

OpenAI также заявила, что GPT-6 Sol примерно вдвое реже допускает ошибки по сравнению с GPT-5.6 Sol во внутреннем тесте фактологической точности. При высоком уровне рассуждений Luna, по данным компании, сопоставима по этому показателю с GPT-5.6 Sol примерно при сотой части стоимости.

В AutomationBench модель GPT-6 Sol при уровне рассуждений xhigh получила 33,2%. Для Claude Opus 5 на максимальном уровне показатель составил 26,9%. По расчетам OpenAI, стоимость выполнения задачи Sol при этом была примерно в 11 раз ниже. GPT-6 Astra на low набрала 30,3%.

В тесте программирования DeepSWE v1.1 GPT-6 Sol получила 68,8% против 69,9% у Claude Fable 5, но, согласно расчетам OpenAI, выполнила задачу примерно на 80% дешевле. GPT-6 Luna набрала 66,6%. Компания сопоставила этот результат с Claude Opus 5 и Fable 5 на среднем уровне рассуждений.

Схожую картину OpenAI зафиксировала в тесте управления компьютером OSWorld 2.0. GPT-6 Sol набрала 60,5% против 60,3% у Claude Opus 5 на medium, при этом расчетная стоимость задачи оказалась примерно на 80% ниже.

Однако эти сравнения не учитывают Claude Opus 5.5, которую Anthropic представила в тот же день.

Независимая платформа Artificial Analysis оценила GPT-6 Sol на максимальном уровне в 48 баллов по собственному Intelligence Index. GPT-6 Luna получила 37 баллов. Для сравнения, Claude Opus 5.5 на максимальном уровне набрала 58 баллов и заняла первое место в рейтинге на момент тестирования.

При этом аналитики Artificial Analysis пришли к выводу, что главное преимущество новых моделей OpenAI заключается именно в эффективности. Стоимость одной задачи Intelligence Index для GPT-6 Sol снизилась примерно с $1,99 у GPT-5.6 Sol до $1,06, а для Luna — с $0,18 до $0,07.

В Coding Agent Index GPT-6 Sol прибавила два пункта относительно предшественника, тогда как Luna потеряла два. Аналитики также обнаружили улучшения в некоторых тестах автоматизации и программирования, но зафиксировали ухудшение результатов в ряде задач, связанных с профессиональной интеллектуальной работой.

Что говорят эксперты и пользователи в X

Глава OpenAI Сэм Альтман заявил, что GPT-6 Sol и Luna значительно превосходят модели поколения 5.6 в интеллекте, программировании, работе с компьютером и других направлениях. Он отдельно отметил снижение стоимости токенов и расходов на выполнение отдельных задач.

В другом посте Альтман назвал стоимость одной выполненной задачи более важным показателем, чем цену токенов. По его мнению, по этому параметру у новых моделей OpenAI сейчас нет конкурентоспособных аналогов на рынке. Это оценка руководителя самой компании, а не результат независимого тестирования.

Независимая оценка Artificial Analysis оказалась более сдержанной. Команда сообщила в X, что GPT-6 Sol и Luna действительно заметно продвинули границу соотношения цены и производительности, однако совокупные показатели Intelligence Index и Coding Agent Index остались близки к поколению GPT-5.6. В отдельных тестах были зафиксированы как улучшения, так и ухудшения.

Продуктовый эксперт Питер Янг после тестирования отметил, что GPT-6 Sol субъективно ощущается лучше GPT-5.6. При этом для повседневной работы он отдал предпочтение Claude Opus 5.5 и поставил эту модель выше Fable и Astra.

Предприниматель в сфере ИИ Мэтт Шумер также рассказал, что некоторое время тестировал GPT-6 Sol. Он назвал модель качественной, однако для ежедневной работы по-прежнему предпочитает GPT-6 Astra или Claude Fable 5.1 и предположил, что к этому списку добавится Opus 5.5.

В то же время разработчик Дэвид Крамер положительно оценил GPT-6 Luna. Среди преимуществ он выделил сочетание цены, возможностей и приемлемой скорости и назвал модель одним из наиболее сбалансированных вариантов на рынке.

Таким образом, первые независимые тесты и отзывы указывают на то, что GPT-6 Sol и Luna в первую очередь меняют экономику использования моделей OpenAI. Существенное снижение стоимости сочетается с улучшениями в отдельных задачах, однако заметного роста результатов по всем направлениям по сравнению с предыдущим поколением пока не наблюдается.

Будь в курсе! Подписывайся на Телеграм.