OpenAI раскрыла свою стратегию полнофункциональной вычислительной инфраструктуры
OpenAI заявляет, что её стратегия в области ИИ зависит от комплексного совершенствования всего технологического стека — от центров обработки данных и чипов до моделей, программного обеспечения, продуктов и ИИ-устройств. Компания опубликовала первые результаты измерения производительности Jalapeño — специализированного чипа, созданного для эффективного запуска обученных моделей. Согласно опубликованным данным, в общедоступном бенчмарке InferenceX этот чип продемонстрировал более высокую пиковую пропускную способность на киловатт и меньшую задержку генерации токенов, чем протестированные коммерческие системы, показав высокие результаты на GPT‑OSS 120B, DeepSeek R1 и Kimi K2. OpenAI утверждает, что совместное проектирование чипов, памяти, сетевой инфраструктуры и программного обеспечения для обслуживания моделей позволяет снизить затраты и энергопотребление, одновременно повысив скорость. Компания продолжит использовать инфраструктуру Microsoft, NVIDIA, AWS, AMD и других партнёров, выбирая разные системы для разных задач. Более широкая цель — максимально увеличить объём полезных результатов работы ИИ на каждый потраченный доллар, сделав ресурсоёмкие приложения, такие как проверка договоров, персонализированный анализ и длительно работающие агенты, доступными в более широком масштабе.
Почему это важно
- —У OpenAI появился работающий специализированный чип собственной разработки, что позволяет компании лучше контролировать скорость, энергопотребление и стоимость работы ИИ-моделей.
- —Расширение круга поставщиков может снизить зависимость от одного производителя чипов или облачного провайдера и укрепить переговорные позиции OpenAI.
- —Более эффективная инфраструктура может сделать передовые ИИ-сервисы и длительно работающих агентов дешевле для бизнеса и потребителей.
Ключевые факты
- Jalapeño — первый специализированный чип OpenAI для инференса, предназначенный для запуска уже обученных ИИ-моделей.
- По данным OpenAI, в тестах InferenceX Jalapeño продемонстрировал более высокую пиковую пропускную способность на киловатт и меньшую задержку при генерации токенов, чем сравниваемые коммерческие системы.
- Чип протестировали с GPT‑OSS 120B, DeepSeek R1 и Kimi K2, что указывает на то, что его преимущества не ограничиваются одним семейством моделей.
- OpenAI планирует сочетать собственное оборудование с системами Microsoft, NVIDIA, AWS, AMD и других партнёров.
- Компания утверждает, что GPT‑5.6 Sol установила новый рекорд в индексе агентов для программирования, сгенерировав на 54% меньше выходных токенов, чем другая ведущая модель.
Полный текст — в первоисточнике. Здесь — краткое изложение и ключевые факты.