OpenAI представила первый собственный AI-чип для инференса

OpenAI представила первый собственный AI-чип для инференса
 

OpenAI объявила о разработке своего первого специализированного чипа для выполнения выводов (инференса) больших языковых моделей. Новый процессор получил название Jalapeno и был создан совместно с Broadcom и производителем серверного оборудования Celestica.

В компании заявляют, что Jalapeno разрабатывался специально для обслуживания таких продуктов, как ChatGPT, Codex и будущих AI-агентов. В отличие от универсальных графических процессоров (GPU), новый ASIC оптимизирован исключительно для выполнения задач вывода больших языковых моделей, что должно повысить эффективность использования вычислительных ресурсов.

По данным OpenAI, от начала проектирования до изготовления первого опытного образца прошло около девяти месяцев — компания называет это одним из самых быстрых циклов разработки высокопроизводительных специализированных микросхем подобного класса. Первые развертывания чипов планируются к концу 2026 года в дата-центрах Microsoft и других партнеров.

Разработкой проекта руководил Ричард Хо (Richard Ho), ранее входивший в команду Google TPU. Он также работал в компании Lightmatter, занимающейся фотонными вычислениями, и имеет большой опыт в проектировании специализированных ускорителей для искусственного интеллекта.

По словам OpenAI, архитектура Jalapeno оптимизирована не только с точки зрения вычислительной мощности, но и с учётом пропускной способности памяти, сетевого взаимодействия и перемещения данных между компонентами системы. Компания считает, что именно такая комплексная оптимизация позволяет приблизить реальную производительность к теоретическим возможностям оборудования.

Broadcom отвечала за проектирование кремниевой части и сетевой инфраструктуры, включая использование собственных высокоскоростных сетевых решений для масштабирования вычислительных кластеров. Компания рассматривает этот проект как начало строительства дата-центров нового поколения с вычислительной мощностью на уровне гигаватт.

На момент объявления OpenAI не опубликовала независимых результатов тестирования производительности. Компания лишь сообщила, что предварительные испытания показали значительное улучшение показателя производительности на ватт по сравнению с существующими решениями, а инженерные образцы уже используются для запуска одной из внутренних моделей семейства GPT. Подробные технические характеристики обещают представить позднее.

Появление Jalapeno продолжает общую тенденцию среди крупнейших разработчиков искусственного интеллекта. Ранее собственные AI-ускорители представили Google (TPU), Amazon (Inferentia и Trainium) и Microsoft (Azure Maia). Кроме того, ранее сообщалось, что Anthropic также изучает возможность создания собственного специализированного чипа.

Таким образом, крупнейшие клиенты NVIDIA постепенно начинают разрабатывать собственные процессоры для ИИ. Основная причина — стремление снизить зависимость от стороннего поставщика, лучше контролировать стоимость вычислений и оптимизировать оборудование под собственные модели.

В OpenAI называют такой подход частью стратегии создания «полного технологического стека» (full-stack advantage), при котором компания контролирует не только модели и программное обеспечение, но и ключевые элементы вычислительной инфраструктуры. По мнению руководства компании, по мере роста роли искусственного интеллекта вычислительные мощности становятся одним из важнейших стратегических ресурсов, что делает развитие собственной аппаратной платформы все более значимым направлением.

БОЛЬШЕ ИНФОРМАЦИИ

Email

sms_systems@inbox.ru

Телефон

+ 7 (985) 982-70-55

Если у вас есть инновационная идея, мы будем рады реализовать ее для Вас!

Специалисты нашей кампании и наши разработки для вас!