Cerebras把自家护城河砍掉一半,美其名曰5倍升级
SemiAnalysis称,为OpenAI的GPT-6.1 Sol Ultrafast(超快)档提供算力的是英伟达GPU,而非Cerebras晶圆。Cerebras的回应不是否认,而是一套只把推理的解码(decode)一半留在自家芯片上的重构方案——就在这一周,公司股价跌破了185美元的IPO发行价。
Vincent Jiang · 2 min read
无人否认的指控
9月30日,SemiAnalysis发文称,OpenAI的GPT-6.1 Sol Ultrafast(超快)档以低批量(batch size)运行在英伟达GPU上,而不是Cerebras的芯片上 12。低批量正是Cerebras当初为之设计的运行场景:同时在途的请求不多,每一个都要求快速应答 2。前一天发布的OpenAI DevDay(开发者大会)材料已让Astra Ultrafast档正式上线,把6.1 Sol版本列为"即将推出",并将该档位定价为标准API费率的六倍,且未点名任何一款芯片 3。
Cerebras股价(CBRS)跌至约181美元,跌破5月IPO的发行价185美元 45。按承诺收入计,OpenAI是Cerebras的第一大客户 15。这一档位8月在GPT-5.6 Sol上的预览版跑在Cerebras硬件上,速度最高达每秒750个token 3;如今承诺的版本,上限为每秒300个 3。两家公司均未证实或否认上述说法 14。
预填充环节外移
10月1日,Cerebras作出回应——不是否认,而是一套重构。这篇关于解耦架构(disaggregation)的博文把推理中计算量最大的前半程——预填充(prefill)——交给合作伙伴的加速器,示意图中AWS Trainium与AMD Helios系统正为Cerebras的解码资源池输送请求;博文称,早期测试显示,在晶圆规模不变的前提下容量提升5倍 6。这一数字出自公司自述,未经第三方验证。晶圆留下的那部分,它照样赢得漂亮:博文援引的Artificial Analysis数据显示,在GPT-oss-120B上,解码吞吐量达到每秒1669个输出token,最接近的对手为708个 6。
Cerebras留下的那一半:解码速度仍是任何对手的两倍以上
Data
| 每秒输出token数 | |
|---|---|
| Cerebras | 1,669 t/s |
| SambaNova | 708 t/s |
| Groq | 475 t/s |
| 微软Azure | 319 t/s |
| Nebius | 294 t/s |
| Baseten | 293 t/s |
半条护城河,靠举债开卖
收窄后的架构已经进入转售渠道。Gimlet Labs计划部署100兆瓦Cerebras算力,并与Cerebras联手把目标速度定在最高每秒3000个token 78。General Compute的订单,是Upper90一笔最高4亿美元债务融资安排的首笔提款,定于2027年一季度启动 910。两家在供货上都要排在OpenAI、G42和AWS之后——Cerebras二季度的剩余履约义务高达254亿美元;而公司自营的云与服务收入同比增长281%,至1.26亿美元,正与这些转售商同台销售 78。
时钟与芯片一同在走。9月29日,COO与CFO合计8430万美元拟减持股份的Form 144申报落地,依据的是6月30日制定的交易计划;约1940万股于次日上午解锁可售 411。拟减持不等于已减持,交易计划也早于这轮下跌 4。
静待裁决
给这只股票定价的将是两个事实:OpenAI会为GPT-6.1 Sol Ultrafast(超快)档点名哪家芯片,以及5倍增益能否扛住生产级并发。英伟达已在Rubin路线图上把解耦架构产品化,做成单一厂商即可提供的功能 8。推理中最快的那一半仍握在Cerebras手中;至于另一半值多少钱,市场本周已经开始定价。
Deepdive
AI-generated from this story and its cited sources. Not investment advice.



