フィギュアAI、35億ドルの計算資源を確約 ロボットは試行の44%が失敗
フィギュアAI(Figure AI)によると、ロボットAI「Helix 2.5」は、サンフランシスコ湾岸の見知らぬ30の家庭で実施した部分点なしの合否試験420回のうち237回に合格した。Indexによる事前学習がない場合の成功率は9%だった[1][2]。ロイター通信によると、同社はNscaleの計算資源35億ドル分の利用を確約しており、通算の資金調達額19億ドルのほぼ2倍に相当する[7][8][9]。
Vincent Jiang · 3 min read
Indexの事前学習だけで9%が56%に
フィギュアAIによると、「Helix 2.5」は初めて入るサンフランシスコ湾岸の30の家庭で、1つのチェックポイントを改変せずに3種類の家事をこなし、ブラインド試験420回のうち237回に合格した123。採点に部分点はない。おもちゃ13~15個をすべてかごに入れ、タオルは1枚残らずたたみ、掛け布団をしわなく整えねばならない1。同じデータをゼロから訓練した対照ポリシーは9%しか合格できず、Indexで事前学習した方は56%だった。人間の映像データセットによる事前学習が唯一の実験変数だと、フィギュアAIは言う134。数値はすべて同社自身の報告にさかのぼり、外部の評価者が再検証した例はない3。
巨額資金を支えるのは小数点4桁の損失予測
実演映像の裏には、さらに鋭い主張がある。フィギュアAIはIndexのデータ量を8倍の幅で変えて4つのモデルを訓練し、最大規模の訓練での行動予測損失を、訓練開始前に小数点以下4桁まで予測できたという。これは人間からヒューマノイドへの転移のスケーリング則で、ヒューマノイドで計測されたのは初めてだと同社は主張する14。曲線が保てば、人間の映像を次に倍増させる見返りは、その訓練の費用を払う前に値付けできる2。テスラ「オプティマス」との対抗も同じ構図だ。データで堀を築く競争であり、テスラの車両が積み上げる走行マイルか、フィギュアAIが対価を払って集める映像か、という勝負になる5。Indexには毎秒およそ35分ぶんの人間の新しい経験が加わる。公開カウンターの表示は9月24日時点で2459万3204件。8月25日のアプリ公開時は1600万本超だった1468。
残る44%の失敗
同じ一発勝負の基準で、ロボットは試行の44%に失敗した。合格率は家事ごとに、おもちゃの片付けが40%、タオルの折りたたみが62%、ベッドメイクが67%だった23。これにSunday RoboticsのTony Zhao氏が数時間で切り返した。「半分失敗するようでは『実際に役立つ仕事をしている』とは言えない」2。対抗して出した数字、785回中778回の折りたたみ成功(99.1%)は1着単位で、家事全体とは物差しが違い、単純比較はできない2。評価のもう一つの払い手は、部屋を貸した30世帯だ。舞台となったのはおもちゃを配置した民泊で、定義上、散らかった物はなく、ペットも洗濯物の山もない。44%の失敗はこの条件の下で採点された数字だ2。
最も苦手な家事はおもちゃの片付け、合格は5回に2回
Data
| Value | |
|---|---|
| おもちゃの片付け | 40% |
| タオルの折りたたみ | 62% |
| ベッドメイク | 67% |
証明より先に請求書が届く
フィギュアAIは設立以来、累計19億ドルを調達してきた。うち10億ドル強は昨年9月、企業価値390億ドルとする評価での調達だ。売上高は一度も開示していない89。9月3日、同社はNscaleの計算資源について35億ドル相当の調達を確約した。総額は60億ドル超への拡大をにらむ。最大10万基のエヌビディア製GPUが届くのは、早くても2027年下期だ。この取引でNscaleはフィギュアAIの株主にもなった789。
計算資源の確約額は調達総額のほぼ2倍
- Estimate
Data
| Value | |
|---|---|
| 累計エクイティ調達額 | $1.9B |
| Nscaleの計算資源確約 (estimate) | $3.5B |
| 60億ドル超への拡大意向 | $6B |
GPUが1基届くより先に見るべきは2点ある。1つは、Indexのデータを次に倍増させたとき、56%という合格率が動くかどうか。もう1つは、フィギュアAI、Sunday Robotics、そして1X(ベンチマーク論争における第3のヒューマノイド陣営)が、中立的な家事タスクのベンチマークを一つ共通で実施することに、ついに合意するかどうかだ2。フィギュアAI自身も、ヒューマノイドロボティクスは解決済みだという話ではないと認めている1。この賭けが言うのは、五分五分にもスケーリング則がある、ということだ。
How this brief was made
01Gathered & sourced396 channels · 1,625 articles▾
Agents swept 396 channels and ingested 1,625 articles, then de-duplicated and ranked them for signal.
02Verified & cross-validated9 claims · 33 data feeds▾
Every one of 9 load-bearing claims was checked against primary sources, with 33 live data feeds reconciling the figures and charts.
- 1Figure, "Helix 2.5: Zero-Shot 30-Home Generalization", 17 September 2026
- 2Forbes, John Koetsier, "Figure's Billion-Dollar Physical AI Bet Delivered A 6X Jump In Robot Chore Success", 21 September 2026
- 3TechRepublic, Aminu Abdullahi, "Figure's Robot Entered 30 Unseen Homes and Succeeded 56% of the Time", 21 September 2026
- 4Unite.AI, Orion Sato, "Figure Introduces Helix 2.5, Tested Zero-Shot in 30 Unseen Homes", 17 September 2026
- 5Benzinga (via MSN), Surbhi Jain, "Tesla's Optimus has a new problem: Figure's humanoid is getting better at the unknown", 18 September 2026
- 6Figure, Index app page, live contributor counters, fetched 24 September 2026
- 7Reuters, "AI cloud firm Nscale commits compute worth $3.5 billion for Figure's robotics ambitions", 3 September 2026
- 8Forbes, John Koetsier, "How Figure Committed $3.5 Billion For AI Compute After Raising Only $1.9 Billion", 4 September 2026
- 9eWeek, Matt Gonzales, "Figure AI Commits $3.5B to Nscale Compute for Its Humanoid Robot Push", 4 September 2026
03Reviewed & edited2 human editors▾
2 editors read the draft against the evidence, tuned the framing, and signed off before it shipped.
Become a contributor
Reporting on the business of AI and want it read? We take pitches from outside contributors who bring primary sources and a number worth arguing about.
Deepdive
AI-generated from this story and its cited sources. Not investment advice.



