OpenAI обходит Nvidia с необычайно быстрой моделью кодирования на чипах размером с пластину

Но 1000 токенов в секунду на самом деле скромны по стандартам Cerebras. Компания имеет измеренный 2100 токенов в секунду на Llama 3.1 70B и сообщил 3000 токенов в секунду на собственной открытой модели OpenAI gpt-oss-120B, что позволяет предположить, что сравнительно более низкая скорость Codex-Spark отражает накладные расходы более крупной или более сложной модели.

Агенты кодирования ИИ имели год прорывас такими инструментами, как Кодекс OpenAI и Антропик Клод Код выход на новый уровень полезности для быстрого создания прототипов, интерфейсов и шаблонного кода. OpenAI, Google и Anthropic боролись за выпуск более эффективных агентов кодирования, и победителей стала отличать задержка; модель, которая кодирует быстрее, позволяет разработчику выполнять итерации быстрее.

В условиях жесткой конкуренции со стороны Anthropic OpenAI быстро совершенствует свою линию Кодекса. выпуск GPT-5.2 в декабре после того, как генеральный директор Сэм Альтман выпустил внутреннюю памятку «красного кода» о конкурентном давлении со стороны Google, а затем выпустил GPT-5.3-Codex всего несколько дней назад.

Диверсификация от Nvidia

Более глубокая история аппаратного обеспечения Spark может оказаться более значимой, чем результаты тестов. Модель работает на Cerebras Wafer Scale Engine 3, чипе размером с обеденную тарелку, который есть у Cerebras. построен свой бизнес как минимум с 2022 года. OpenAI и Cerebras объявлено их партнерство состоялось в январе, и Codex-Spark стал первым продуктом, появившимся в результате этого сотрудничества.

OpenAI в течение прошлого года систематически снижала свою зависимость от Nvidia. Компания подписано масштабное многолетнее соглашение с AMD в октябре 2025 года, ударил соглашение об облачных вычислениях с Amazon на сумму 38 миллиардов долларов в ноябре и было проектирование собственный чип искусственного интеллекта, который в конечном итоге будет изготовлен TSMC.

Тем временем запланированная инфраструктурная сделка с Nvidia на сумму 100 миллиардов долларов провалился до сих пор, хотя Nvidia с тех пор взяла на себя обязательство инвестировать 20 миллиардов долларов. Рейтер сообщил что OpenAI стала недовольна скоростью некоторых чипов Nvidia для задач вывода, а это именно тот вид рабочей нагрузки, для которого OpenAI разработал Codex-Spark.

Read more:  Как использовать, удалять и отображать текст Siri на Apple Watch

Независимо от того, какой чип находится под капотом, скорость имеет значение, хотя за это может стоить точность. Для разработчиков, которые проводят дни в редакторе кода, ожидая предложений ИИ, 1000 токенов в секунду могут ощущаться не столько как тщательное пилотирование лобзика, сколько как работа с продольной пилой. Просто следите за тем, что режете.

2026-02-12 22:56:00


1771006960
#OpenAI #обходит #Nvidia #необычайно #быстрой #моделью #кодирования #на #чипах #размером #пластину

Ещё по этой теме

Leave a Comment

This site uses Akismet to reduce spam. Learn how your comment data is processed.