GPT-6.1 Sol уже доступен платным пользователям. А главный флагман OpenAI Astra пока остаётся за кулисами. На внутренних тестах Astra чаще ожидаемого обманывала систему и продолжала действовать без разрешения. Иногда она рискованно использовала внешние инструменты.
На этом фоне OpenAI выпускает модель попроще и заметно дешевле. GPT-6.1 Sol обещает результат, близкий к Astra, в агентском кодинге, работе с компьютером и офисных задачах. Цена — примерно пятая часть.
GPT-6.1 Sol продаёт экономию
Тариф для API такой: $2 за миллион входных токенов и $10 за миллион выходных. Это примерно уровень GPT-6 Sol и Claude Sonnet 5.5.
Самое интересное спрятано в кэше. Повторно используемый контекст стоит $0,10 за миллион токенов. Это на 95% дешевле обычного входа и вдвое ниже цены cached input у Sonnet 5.5 — $0,20.
В обычном чате разницу можно и не заметить. У AI-агента всё иначе. Он снова и снова обращается к репозиторию, истории задач, правилам проекта и результатам прошлых шагов. Когда контекст не приходится пересчитывать заново, длинная цепочка действий обходится заметно дешевле.
Главная ценность GPT-6.1 Sol — возможность гонять сильную модель много раз подряд.
Доступ открыли для Plus, Pro, Business, Enterprise и Edu в ChatGPT Work и Codex. В обычном чате модели пока нет. Разработчики могут обращаться к ней через API под именем gpt-6.1-sol.
Для Codex ещё обещают версию Ultrafast. Она должна генерировать токены до восьми раз быстрее. Срок — ближайшие несколько дней. При этом важна скорость получения рабочего результата, а не одна цифра в секунду. В разработке и правках интерфейсов ускорение может быть прям заметным.
Что показывает GPT-6.1 Sol в тестах
Все цифры ниже взяты из материалов OpenAI. Компания называет их предварительными. Поэтому сравнение с Claude Sonnet 5.5 пока лучше воспринимать как ориентир.
На DeepSWE v1.1 GPT-6.1 Sol, по данным OpenAI, сравнялся с Astra. Заодно он улучшил лучший результат GPT-6 Sol на 6,4 процентного пункта, потратив меньше денег и используя менее интенсивное рассуждение.
В OSWorld 2.0 модели управляют компьютером. Здесь новая версия прибавила семь пунктов к результату GPT-6 Sol. До Astra не хватило 2,1 пункта, зато одна задача обошлась примерно в семь раз дешевле.
На GDP.pdf модель, по данным OpenAI, обошла Opus 5.5. Стоимость задачи составила меньше половины его цены. В AutomationBench Sol прошёл многошаговые бизнес-процессы с 47 инструментами и оказался на 2,2 пункта впереди Opus 5.5. Уровень рассуждений был средним, а стоимость — примерно треть от цены Opus.
