OpenAI превратила скорость в продукт с шестикратной ценой; вопрос на $48 млрд — чьи чипы его обеспечат
На конференции DevDay компания OpenAI сделала Ultrafast полноценным коммерческим тарифом — по цене в шесть раз выше стандартной; в тот же день профильные аналитики сообщили, что он работает на чипах Nvidia, а топ-менеджер Cerebras подал документы на продажу акций. Портфель заказов превращается в выручку по календарю OpenAI; финансируемый канал неооблаков (neocloud) — та часть конструкции, которую контролирует сама Cerebras.
Richard Tang · 4 min read
Тариф Ultrafast стал полноценным коммерческим продуктом на DevDay компании OpenAI 29 сентября: до 300 выходных токенов в секунду, цена в шесть раз выше стандартных тарифов API, уже доступен для GPT-6 Astra, версия для GPT-6.1 Sol — в ближайшие дни 1. Разработчики теперь оптимизируют три переменные — интеллект, стоимость и задержку, — и именно на скорость назначается кратная премия 1. Вопрос, кто обеспечивает эту скорость, стоит теперь $48 млрд капитализации одного чипмейкера, и на этой неделе он прошел проверку 2.
Кратную премию платит агентное программирование
Покупатель шестикратной премии — агентные рабочие нагрузки. Агент, пишущий код, выполняет сотни, а то и тысячи последовательных вызовов инференса, и каждый из них лежит на критическом пути 3. Наглядный расчет General Compute: агенту, которому требуется 400 обращений к модели, нужно около 20 минут при 100 токенах в секунду и меньше 7 минут — при 300 3.
При медленной скорости разработчик отходит от задачи и возвращается к ней позже; при высокой — остается в процессе 3. Ради этого поведенческого сдвига и платится премия — вот почему так важен кремний, на котором работает Ultrafast.
Кремний под тарифом внезапно оказался под вопросом
В августе Ultrafast был доступен лишь в ограниченном превью: GPT-5.6 Sol работала на оборудовании Cerebras со скоростью до 750 токенов в секунду — примерно в 14 раз выше стандартной 14. Тариф, запущенный на этой неделе, разгоняется до 300, обменяв рекордную скорость на более новый интеллект — как формулирует VentureBeat 1. Вечером в день запуска SemiAnalysis написала, что GPT-6.1 Sol Ultrafast работает с малым размером батча на GPU Nvidia, а не Cerebras, — то есть в режиме приоритета задержки, при котором преимущество Cerebras как раз и должна обеспечивать память на кристалле 56. Это единичная публикация профильных аналитиков, а не подтверждение; Cerebras пока не подтвердила и не опровергла своего участия в обслуживании тарифа 6. Рынок ждать не стал: 30 сентября акции компании подешевели примерно на 7% 6.
Запущенный тариф Ultrafast от OpenAI оказался медленнее августовского превью на Cerebras
Data
| Value | |
|---|---|
| Celeris-1 | 1,491 tok/s |
| Mercury 2 | 769 tok/s |
| GPT-5.6 Sol Ultrafast (авг., Cerebras) | 750 tok/s |
| GPT-6 Astra Ultrafast (сент.) | 300 tok/s |
| Gemini 3.5 Flash | 201 tok/s |
Чем на самом деле владеют держатели акций CBRS
До падения котировок, по оценке The Motley Fool, рыночная стоимость Cerebras была близка к $48 млрд 2. Отчётность, стоящая за этой ценой, показывает портфель заказов на $25,4 млрд, значительная часть которого приходится на единственное соглашение с OpenAI. Как ожидается, к 30 июня 2028 года в выручку конвертируется лишь около 22% портфеля — примерно $5,6 млрд, — и по графику, который заказчик может сдвинуть 2. В тот же день, когда был запущен Ultrafast, топ-менеджер компании Дхирадж Маллик подал документы на продажу 396 000 акций на $77,9 млн в рамках торгового плана, принятого 30 июня; до этого, 18 августа, он продал 38 889 акций на $8 642 077,14 — продажи по цене спроса на двух датах 7. На форуме r/CBRS_stock Ultrafast успели объявить кремнием Cerebras, а покупки колл-опционов приводили как подтверждение; на этой неделе переоценке подверглась именно эта вера, а не доказательства 8.
К середине 2028 года конвертируется лишь около пятой части портфеля заказов Cerebras на $25,4 млрд
Data
| Value | |
|---|---|
| Общий портфель заказов | $25.4B |
| Конвертация позже | $19.8B |
| Конвертация к 30 июня 2028 года | $5.6B |
То, что контролирует Cerebras
Ответ компании — дистрибуция, не зависящая от того, на каких чипах OpenAI обслуживает свои тарифы. Неооблако General Compute, созданное под альтернативные чипы, подписало многолетнее соглашение о развёртывании систем Cerebras для агентного программирования — за счёт кредитной линии на $400 млн, привлечённой у Upper90 в июле; мощности откроются в первом квартале 2027 года 3. Собственная формулировка неооблака — самая острая реплика во всей этой истории: чипы побеждают за счёт развёрнутых мощностей, а развёрнутые мощности — сначала задача финансирования и лишь потом инженерии 3. Железо финансируют кредиторы; Cerebras собирает плату за скорость по контрактам, которые OpenAI не контролирует 9.
Что доказано и что заложено в цену
Доказано: скорость продаётся с премией, агенты — та рабочая нагрузка, которая за неё платит, и финансируемый канал дистрибуции скорости Cerebras без участия OpenAI уже существует. Не доказано: что флагманскому тарифу для обслуживания нужен именно Cerebras. OpenAI выпустила в продажу тариф с более низким потолком скорости, чем у её собственного августовского превью, а контракты портфеля заказов Cerebras отдают календарь конвертации в руки заказчика. Впереди две проверки: на чём в итоге заработает GPT-6.1 Sol Ultrafast и найдут ли покупателей стойки 2027 года.
Само по себе деление на тарифы однозначно идёт на пользу внедрению: агенты, которые справляются с работой за минуты, позволяют человеку оставаться в процессе и сокращают время, которое работа проводит в ожидании человека. Но при такой оценке Cerebras торгуется как компания, которая эти нагрузки обслуживает. OpenAI доказала, что скорость продаётся; она не доказала, что эта премия достанется Cerebras.
Deepdive
AI-generated from this story and its cited sources. Not investment advice.


