OpenAI представила GPT-6.1 Sol: почти уровень Astra за 20% цены
Вчера на DevDay компания OpenAI представила GPT-6.1 Sol — всего через неделю после запуска GPT-6 Sol. OpenAI заявляет, что новая модель обеспечивает почти такой же уровень интеллекта, как и GPT-6 Astra, в сфере агентного программирования, работы с компьютером и профессиональных задач, но стоит в пять раз дешевле по стандартным ценам на входные и выходные токены.
Примечательно, что компания не запускает GPT-6.1 Astra, как ожидалось изначально. На этой неделе The Wall Street Journal сообщила, что OpenAI отменила релиз из-за проблем с безопасностью, на которые исследователи обратили внимание в ходе внутреннего тестирования: модель продемонстрировала более высокий уровень обмана и склонность продолжать выполнение задач без запроса разрешения у пользователя. OpenAI заявляет:
«GPT-6.1 Sol демонстрирует значительные улучшения по сравнению со своим предшественником GPT-6 Sol при решении сложных задач, в частности при программировании и отладке кода, понимании документов и выполнении многоэтапных рабочих процессов.В некоторых из этих направлений модель по результатам приближается к GPT-6 Astra».
OpenAI также отмечает, что новая модель стала более точной в фактах при работе со сложными запросами. Наибольший прогресс по сравнению с GPT-6 Sol наблюдается при низком уровне рассуждение: доля ответов с фактической ошибкой снизилась с 11,4 % до 7,7 %. По словам компании, при любых настройках уровня рассуждений частота ошибок новой модели остается в пределах 1,9 % от показателя GPT-6 Astra.
«GPT-6.1 Sol лучше информирует о своих ограничениях и более надежно следует намерениям пользователя и требованиям безопасности. В сложных тестах модель реже, чем GPT-6 Sol, не замечала сбоев в работе поисковых инструментов, нарушала четко установленные ограничения или допускала несанкционированные результаты при выполнении задач», — сообщила OpenAI.
По данным OpenAI, GPT-6.1 Sol также продемонстрировала значительное снижение стоимости кэшированных входных данных. Для API цена составляет $2 за 1 млн входных токенов и $0,10 за 1 млн кэшированных токенов и $10 за 1 млн запросов. Таким образом, кэшированный запрос обходится всего в 5 % от обычного, что особенно важно для агентов, которые многократно работают с одним и тем же контекстом.
«Модель также выходит за рамки ChatGPT Work и Codex. Разработчики могут использовать её через API с идентификатором gpt-6.1-sol, а в GitHub Copilot GPT-6.1 Sol уже начала внедряться в качестве модели для агентного программирования. GitHub отмечает, что она доступна пользователям Copilot для задач, в которых агент самостоятельно работает с кодовой базой», — пишет The GitHub Blog.
Еще одна особенность запуска — подготовка режима GPT-6.1 Sol Ultrafast. OpenAI планирует представить его в ближайшие дни в Codex: компания заявляет о скорости генерации до восьми раз выше, чем в стандартном режиме. Это ориентировано на сценарии, в которых задержка ответа имеет критическое значение, в частности, на интерактивное программирование и совместную работу человека с агентом.
«Запуск GPT-6.1 Sol происходит одновременно с расширением набора инструментов для агентной работы в Codex. Мы представляем облачные среды, которые можно повторно использовать на разных устройствах: отдельное рабочее пространство содержит репозитории, инструменты и зависимости, а запущенная задача может продолжать выполняться даже тогда, когда компьютер пользователя выключен или находится в режиме сна», — добавляют в компании.
OpenAI утверждает, что не зафиксировала никаких попыток обойти автоматическую проверку безопасности, что соответствует результатам GPT-6 Astra и GPT-6 Sol. GPT-6.1 Sol доступна с сегодняшнего дня для всех пользователей тарифных планов Plus, Pro, Business, Enterprise и Edu в ChatGPT Work и Codex. OpenAI отмечает, что модель пока недоступна в Chat.
Источник: TechCrunch

