OpenAI анонсировала GPT-6.1 Sol: мощный и экономичный агент для кодинга
OpenAI представила обновленную модель GPT-6.1 Sol, которая значительно улучшена в области агентного программирования и работы с кодом. Модель предназначена для выполнения сложных задач, таких как глубокий рефакторинг и создание долгоживущих автономных агентов.
GPT-6.1 Sol предлагает впечатляющее сочетание производительности и экономичности. Хотя для задач, где качество критически важно, рекомендуется использовать Astra, GPT-6.1 Sol идеален для частого запуска сложных рабочих процессов, поскольку он обеспечивает производительность, близкую к Astra, при значительно меньших затратах.
Помимо повышения эффективности, модель также удешевляет работу с данными: кэшированный ввод стоит на 95% дешевле стандартной цены, что делает ее идеальной для ресурсоемких, но повторяющихся задач. В тестах DeepSWE v1.1 GPT-6.1 Sol превзошел GPT-6 Sol на 76% при примерно в 3.5 раза меньшей стоимости за задачу.
Почему это важно
- —Модель значительно повышает эффективность в кодировании и работе с кодовыми базами, что критически важно для разработчиков.
- —Введение сверхдешевого кэшированного ввода позволяет запускать сложные, ресурсоемкие рабочие процессы гораздо чаще.
- —GPT-6.1 Sol предлагает оптимальный баланс между высокой производительностью и низкой стоимостью, делая его идеальным для коммерческого использования.
Ключевые факты
- В DeepSWE v1.1 GPT-6.1 Sol показал результат 75,2% при высоких усилиях, превзойдя GPT-6 Sol (68,8%) при меньших затратах.
- Стоимость кэшированного ввода составляет всего $0.10 за миллион токенов, что на 95% дешевле стандартного ввода.
- Модель снижает количество фактических ошибок в ответах примерно на 32% по сравнению с GPT-6 Sol.
- На AutomationBench GPT-6.1 Sol набрал 31,7% при среднем уровне усилий.
Полный текст — в первоисточнике. Здесь — краткое изложение и ключевые факты.