Cerebras располовинила собственный ров и выдала это за пятикратный апгрейд

По данным SemiAnalysis, тариф GPT-6.1 Sol Ultrafast от OpenAI обслуживают GPU Nvidia, а не пластины Cerebras. Cerebras не стала ничего опровергать: она ответила редизайном, который оставляет на её кремнии лишь половину инференса (inference) — декод (decode). Всё это — на неделе, когда акции компании сползли ниже цены IPO ($185).

Читать оригинал

In this storyNVDAOpenAIAMD
Vincent JiangVincent Jiang · 2 min read
Share
Эндрю Фельдман, глава Cerebras, выступает на сцене конференции Collision
1 / 6Slide 1 of 6
Глава Cerebras Эндрю Фельдман. На утверждение, что тариф Ultrafast у OpenAI обслуживают чипы Nvidia, его компания ответила не опровержением, а редизайном.

Обвинение, которое никто не опроверг

30 сентября SemiAnalysis сообщила, что GPT-6.1 Sol Ultrafast от OpenAI работает на GPU Nvidia при малом размере батча (batch), а не на кремнии Cerebras 12. Малый батч — это как раз тот режим, ради которого Cerebras и создавалась: одновременных запросов немного, и каждый обслуживается быстро 2. В материалах DevDay, опубликованных днём ранее, тариф Astra Ultrafast стал доступен, версия на GPT-6.1 Sol обещана «в ближайшее время», для тарифа установлена цена в шесть раз выше стандартных ставок API — но ни один чип при этом не назван 3.

Акции CBRS сползли примерно до $181 — ниже цены $185, по которой компания выходила на IPO в мае 45. OpenAI — крупнейший клиент Cerebras по законтрактованной выручке 15. Августовское превью тарифа на модели GPT-5.6 Sol работало на оборудовании Cerebras и выдавало до 750 токенов в секунду 3; у обещанной теперь версии потолок — 300 3. Ни одна из компаний утверждение не подтвердила и не опровергла 14.

Префилл покидает пластины

1 октября Cerebras ответила редизайном, а не опровержением. Пост о дезагрегации (disaggregation) отдаёт префилл (prefill) — вычислительно тяжёлую первую половину инференса — ускорителям партнёров: на приведённых в посте схемах системы AWS Trainium и Helios от AMD питают пул декода Cerebras. В ранних тестах, сообщает компания, ёмкость при той же площади пластин выросла в пять раз 6. Эта цифра заявлена самой Cerebras и не подтверждена независимо. Но в том, что пластины оставили себе, они по-прежнему выигрывают: по воспроизведённым в посте замерам Artificial Analysis, пропускная способность декода на модели GPT-oss-120B — 1669 выходных токенов в секунду против 708 у ближайшего конкурента 6.

Оставшаяся у Cerebras половина: декод по-прежнему более чем вдвое быстрее любого конкурента

0 t/s500 t/s1,000 t/s1,500 t/s2,000 t/sCerebrasSambaNovaGroqMicrosoft AzureNebiusBaseten293 t/s1,669 t/s
Data
Выходные токены в секунду
Cerebras1,669 t/s
SambaNova708 t/s
Groq475 t/s
Microsoft Azure319 t/s
Nebius294 t/s
Baseten293 t/s
Выходные токены в секунду на GPT-oss-120B, режим размышлений (high reasoning), 10 000 входных токенов. Замеры Artificial Analysis от 10 сентября 2026 года, воспроизведённые в посте Cerebras о дезагрегации от 1 октября; скорость на пользователя при низкой конкурентности (concurrency), а не производственная пропускная способность. Источник: пересказ поста Cerebras на Unite.ai [6].6

Половина рва, проданная в долг

Урезанную архитектуру уже подхватили реселлеры. Gimlet Labs планирует 100 МВт мощностей Cerebras и совместно с компанией рассчитывает достичь скорости до 3000 токенов в секунду 78. Заказ General Compute — первая выборка по кредитной линии Upper90 на сумму до $400 млн — начнёт исполняться в I квартале 2027 года 910. В очереди на поставки оба проекта стоят за OpenAI, G42 и AWS — при $25,4 млрд оставшихся обязательств по исполнению (remaining performance obligations) по итогам второго квартала. Рядом с ними Cerebras продаёт и собственное облако с сервисами: их выручка за год выросла на 281%, до $126,0 млн 78.

Часы тикают вместе с чипами. 29 сентября поступили уведомления по форме 144 о планируемых продажах на общую сумму $84,3 млн от операционного и финансового директоров — в рамках торговых планов, принятых 30 июня, а на следующее утро около 19,4 млн акций стали доступны к продаже 411. Планы — ещё не продажи, и приняты они были до падения котировок 4.

Ожидание вердикта

Цену этой бумаги определят два факта: какие именно чипы OpenAI назовёт для 6.1 Sol Ultrafast и сохранится ли пятикратный прирост ёмкости при производственной конкурентности. Nvidia уже превращает дезагрегацию в функцию единого вендора в рамках роадмапа Rubin 8. Cerebras по-прежнему владеет самой быстрой половиной инференса; на этой неделе рынок начал оценивать, сколько стоит вторая.

Deepdive

AI-generated from this story and its cited sources. Not investment advice.

Reader comments

0 comments

    Sign up

    Get your curated digest

    After email confirmation, you will receive a daily digest of the most relevant news that matter to your portfolio