Cerebras располовинила собственный ров и выдала это за пятикратный апгрейд
По данным SemiAnalysis, тариф GPT-6.1 Sol Ultrafast от OpenAI обслуживают GPU Nvidia, а не пластины Cerebras. Cerebras не стала ничего опровергать: она ответила редизайном, который оставляет на её кремнии лишь половину инференса (inference) — декод (decode). Всё это — на неделе, когда акции компании сползли ниже цены IPO ($185).
Vincent Jiang · 2 min read
Обвинение, которое никто не опроверг
30 сентября SemiAnalysis сообщила, что GPT-6.1 Sol Ultrafast от OpenAI работает на GPU Nvidia при малом размере батча (batch), а не на кремнии Cerebras 12. Малый батч — это как раз тот режим, ради которого Cerebras и создавалась: одновременных запросов немного, и каждый обслуживается быстро 2. В материалах DevDay, опубликованных днём ранее, тариф Astra Ultrafast стал доступен, версия на GPT-6.1 Sol обещана «в ближайшее время», для тарифа установлена цена в шесть раз выше стандартных ставок API — но ни один чип при этом не назван 3.
Акции CBRS сползли примерно до $181 — ниже цены $185, по которой компания выходила на IPO в мае 45. OpenAI — крупнейший клиент Cerebras по законтрактованной выручке 15. Августовское превью тарифа на модели GPT-5.6 Sol работало на оборудовании Cerebras и выдавало до 750 токенов в секунду 3; у обещанной теперь версии потолок — 300 3. Ни одна из компаний утверждение не подтвердила и не опровергла 14.
Префилл покидает пластины
1 октября Cerebras ответила редизайном, а не опровержением. Пост о дезагрегации (disaggregation) отдаёт префилл (prefill) — вычислительно тяжёлую первую половину инференса — ускорителям партнёров: на приведённых в посте схемах системы AWS Trainium и Helios от AMD питают пул декода Cerebras. В ранних тестах, сообщает компания, ёмкость при той же площади пластин выросла в пять раз 6. Эта цифра заявлена самой Cerebras и не подтверждена независимо. Но в том, что пластины оставили себе, они по-прежнему выигрывают: по воспроизведённым в посте замерам Artificial Analysis, пропускная способность декода на модели GPT-oss-120B — 1669 выходных токенов в секунду против 708 у ближайшего конкурента 6.
Оставшаяся у Cerebras половина: декод по-прежнему более чем вдвое быстрее любого конкурента
Data
| Выходные токены в секунду | |
|---|---|
| Cerebras | 1,669 t/s |
| SambaNova | 708 t/s |
| Groq | 475 t/s |
| Microsoft Azure | 319 t/s |
| Nebius | 294 t/s |
| Baseten | 293 t/s |
Половина рва, проданная в долг
Урезанную архитектуру уже подхватили реселлеры. Gimlet Labs планирует 100 МВт мощностей Cerebras и совместно с компанией рассчитывает достичь скорости до 3000 токенов в секунду 78. Заказ General Compute — первая выборка по кредитной линии Upper90 на сумму до $400 млн — начнёт исполняться в I квартале 2027 года 910. В очереди на поставки оба проекта стоят за OpenAI, G42 и AWS — при $25,4 млрд оставшихся обязательств по исполнению (remaining performance obligations) по итогам второго квартала. Рядом с ними Cerebras продаёт и собственное облако с сервисами: их выручка за год выросла на 281%, до $126,0 млн 78.
Часы тикают вместе с чипами. 29 сентября поступили уведомления по форме 144 о планируемых продажах на общую сумму $84,3 млн от операционного и финансового директоров — в рамках торговых планов, принятых 30 июня, а на следующее утро около 19,4 млн акций стали доступны к продаже 411. Планы — ещё не продажи, и приняты они были до падения котировок 4.
Ожидание вердикта
Цену этой бумаги определят два факта: какие именно чипы OpenAI назовёт для 6.1 Sol Ultrafast и сохранится ли пятикратный прирост ёмкости при производственной конкурентности. Nvidia уже превращает дезагрегацию в функцию единого вендора в рамках роадмапа Rubin 8. Cerebras по-прежнему владеет самой быстрой половиной инференса; на этой неделе рынок начал оценивать, сколько стоит вторая.
Deepdive
AI-generated from this story and its cited sources. Not investment advice.



