Объяснение принципа работы чипа OpenAI Jalapeño: математика и технология, лежащие в его основе.

Финансовая траектория OpenAI во многом зависит от затраты на инфраструктуру, именно эта реальность подтолкнула к разработке нового Специально разработанный чип OpenAI со вкусом халапеньоРазработанная в сотрудничестве с Broadcom, специализированная интегральная схема (ASIC) представляет собой прямую попытку снизить значительные капитальные затраты, связанные с использованием оборудования сторонних производителей.
В настоящее время Nvidia контролирует примерно... 75% рентабельности На своих высокопроизводительных процессорах OpenAI работает в более жестких рамках, поддерживая примерно равные 33 цента прибыли с каждого заработанного доллара после учета огромных операционных расходов. Финансовое бремя, связанное с запуском больших языковых моделей в масштабе предприятия, является серьезным.
В прошлом году поддержание работоспособности серверов ChatGPT обошлось компании OpenAI в колоссальную сумму. 8,4 миллиарда долларов СШАТеперь платформа привлекает 900 миллионов пользователей в неделюПо прогнозам, операционные расходы составят приблизительно 14 миллиардов долларов США в этом году.
В течение следующих восьми лет OpenAI выделила примерно 1,4 триллиона долларов США на вычислительные мощностиЭто огромная ставка для компании, которая в настоящее время получает годовой доход в размере 25 миллиардов долларов США.
🔧 Разработка аппаратного обеспечения для вывода LLM-кода
Он Чип OpenAI с халапеньо, названный первым в истории компании «Интеллектуальный процессор»Разработана специально для вывода больших языковых моделей (LLM), а не для универсальных задач искусственного интеллекта. OpenAI предоставила основную архитектуру, основанную на своих конкретных планах развития моделей и системах обслуживания, а Broadcom занималась разработкой микросхем и интеграцией высокопроизводительных сетевых решений.
TSMC занимается физическим производством на Тайване, и Селестика Задача состоит в создании систем плат и стоек. По данным OpenAI, на ранних лабораторных образцах уже выполняются передовые задачи, включая еще не выпущенную версию. Модель GPT-5.3-Codex-Sparkпри целевой частоте и мощности производства.
Ричард Хо, руководитель программы по разработке аппаратного обеспечения в OpenAI, отметил, что архитектура минимизирует перемещение данных чтобы приблизить фактическую загрузку к ее теоретической пиковой производительности. В отличие от универсальных ускорителей, адаптированных из устаревших рабочих нагрузок ИИ, эта архитектура специально балансирует вычислительные ресурсы, память и сетевые ресурсы для решения проблем с перемещением данных, характерных для интерактивного обслуживания LLM.
Для достижения этой цели в масштабе платформа интегрирует Сетевой чип Tomahawk от Broadcom непосредственно в конструкцию, что позволяет специализированным процессорам взаимодействовать в масштабных кластерных средах центров обработки данных.
⚙️ Маховик вертикальной интеграции
Переходя на разработку собственных микросхем, OpenAI превращается из простого программного слоя в полноценную систему. вертикально интегрированная инфраструктурная компанияЭта комплексная стратегия охватывает весь конвейер разработки: Архитектура микросхемы, программные ядра, системы памяти, планирование сети и заключительный прикладной уровень.Подобно тесной связи Apple с собственным оборудованием и iOS, OpenAI теперь может оптимизировать свою инфраструктуру в соответствии со своими внутренними планами развития моделей.
Эта интеграция обеспечивает передачу данных в маховик непрерывного действияПовышение эффективности инфраструктуры снижает стоимость как обучения, так и обслуживания. Более доступное обслуживание приводит к созданию более качественных и отзывчивых продуктов, что, в свою очередь, увеличивает объем пользователей и выручку, которые реинвестируются в следующее поколение специализированной инфраструктуры.
🚀 Преодоление недостатка, связанного с отставанием от рынка недвижимости
Внедряя собственные микросхемы, OpenAI выходит на рынок, где ее основные конкуренты почти десять лет занимались разработкой проприетарного оборудования. Google Компания начала развертывание своих тензорных процессоров (TPU) в 2015 году и в настоящее время контролирует примерно... четверть мировых вычислительных мощностей в области искусственного интеллекта вне цепочки поставок Nvidia.
Amazon отгрузил более миллион своих собственных чиповВ то время как Meta и Microsoft продолжают масштабировать собственную инфраструктуру.
«Jalapeño является частью нашей долгосрочной стратегии развития комплексной инфраструктуры, направленной на расширение доступа к вычислительным ресурсам», — сказал представитель компании. Грег Брокман«Разрабатывая большую часть стека самостоятельно, мы можем предоставлять больше интеллектуальных решений с большей эффективностью», — заявил президент и соучредитель OpenAI.
Чтобы сократить этот временной разрыв, OpenAI ускорила этап разработки. Чип OpenAI Jalapeño прошел путь от проектирования с нуля до производственная матрица—последний этап перед физическим производством — всего за девять месяцевИнженерные группы достигли этого результата в установленные сроки, используя собственные языковые модели OpenAI для автоматизации и оптимизации отдельных этапов процесса проектирования аппаратного обеспечения.
Это создает уникальная петля обратной связи где модели, предоставляемые пользователям, активно используются для построения физической инфраструктуры, которая будет обеспечивать работу будущих версий. Первоначальное развертывание оборудования в центрах обработки данных запланировано на [дата начала]. конец 2026 года.
Генеральный директор Broadcom Хок Тан подтверждено, что развертывание будет масштабироваться совместно с партнерами по инфраструктуре, включая Microsoft, для подготовки к интеграции центров обработки данных гигаваттного масштаба.
(Фото предоставлено) OpenAI)












