Figure engage 3,5 milliards de dollars en puissance de calcul quand ses robots échouent à 44 % des essais

Selon Figure, Helix 2.5 a réussi 237 des 420 essais « tout ou rien » menés dans 30 foyers inconnus de la baie de San Francisco, contre 9 % sans pré-entraînement sur Index [1][2]. D'après Reuters, l'entreprise s'est engagée sur 3,5 milliards de dollars de puissance de calcul Nscale, près du double des 1,9 milliard de dollars levés depuis sa création [7][8][9].

Lire l’original

In this storyTSLANVDA
Vincent JiangVincent Jiang · 3 min read
Share
Figure AI
1 / 6Slide 1 of 6
Figure AI

À lui seul, le pré-entraînement sur Index fait passer le taux de réussite de 9 % à 56 %

Figure affirme que Helix 2.5 a franchi la porte de 30 foyers de la baie de San Francisco qu'il n'avait jamais vus, y a exécuté trois tâches domestiques à partir d'un seul et même checkpoint non modifié, et a réussi 237 des 420 essais en aveugle 123. La notation excluait toute note partielle : la totalité des 13 à 15 jouets dans le panier, chaque serviette pliée, la couette lissée 1. Une politique jumelle entraînée de zéro sur les mêmes données a réussi 9 % des essais ; sa jumelle pré-entraînée sur Index, 56 %. Figure assure que le pré-entraînement sur son jeu de données de vidéos d'humains constituait la seule variable expérimentale 134. Tous les chiffres proviennent de la publication de Figure elle-même ; aucun évaluateur indépendant ne les a reproduits 3.

L'argent repose sur une prévision de perte à quatre décimales

L'affirmation la plus forte se niche sous la démonstration. Figure a entraîné quatre modèles sur une plage de données Index allant du simple à l'octuple et affirme avoir prédit, avant même le début du plus vaste d'entre eux, sa perte de prédiction d'actions à quatre décimales près — une loi d'échelle de transfert humain-humanoïde qu'elle présente comme la première mesurée sur un humanoïde 14. Si la courbe tient, le gain du prochain doublement des vidéos d'humains peut être chiffré avant même que celui-ci ne soit payé 2. La rivalité avec l'Optimus de Tesla se raconte de la même manière : un duel de douves de données, les kilomètres parcourus par la flotte Tesla contre les vidéos rémunérées de Figure 5. Index engrange environ 35 minutes de nouvelle expérience humaine chaque seconde, et son compteur public affichait 24 593 204 téléversements le 24 septembre — contre plus de 16 millions de vidéos au lancement de l'application, le 25 août 1468.

Les 44 % restants

Sous la même grille tout ou rien, le robot a échoué à 44 % de ses essais : 40 % de réussite sur le rangement des jouets, 62 % sur les serviettes, 67 % sur la confection du lit 23. Le patron de Sunday Robotics, Tony Zhao, a répondu en quelques heures : « échouer une fois sur deux, ce n'est pas “faire un travail réellement utile” » 2. Son chiffre de riposte — 778 pliages réussis sur 785, soit 99,1 % — compte des vêtements pris un à un, pas des tâches entières : les deux échelles ne se comparent pas terme à terme 2. L'évaluation a eu un autre payeur : les 30 foyers qui ont prêté leurs pièces, des locations de courte durée mises en scène avec des jouets, désencombrées par définition, sans animaux domestiques ni piles de linge. Telles sont les conditions dans lesquelles ce 44 % est noté 2.

Le rangement des jouets est la plus fragile des tâches : deux essais réussis sur cinq

0%20%40%60%80%Rangement des jouets40%Serviettes62%Confection du lit67%ensemble des 420 essais : 56 %
Data
Value
Rangement des jouets40%
Serviettes62%
Confection du lit67%
Part des essais « tout ou rien » réussis, par tâche, dans l'évaluation zéro shot de Figure en 30 foyers. La ligne des 56 % est la moyenne des 420 essais en aveugle. Les chiffres sont ceux de Figure, rapportés par Forbes et TechRepublic ; aucun évaluateur indépendant ne les a reproduits.2,3

L'addition tombe avant la preuve

Figure a levé 1,9 milliard de dollars depuis sa création, dont un peu plus d'un milliard en septembre dernier à une valorisation de 39 milliards de dollars, et n'a jamais dévoilé de chiffre d'affaires 89. Le 3 septembre, elle a engagé 3,5 milliards de dollars de puissance de calcul Nscale, en affichant l'intention d'aller au-delà de 6 milliards ; jusqu'à 100 000 GPU Nvidia n'arriveront pas avant le second semestre 2027, et Nscale est devenu actionnaire dans la même opération 789.

L'engagement de puissance de calcul de Figure vaut près du double de tous les fonds levés depuis sa création

  • Estimate
$0B$2B$4B$6BFonds levés depuis la création$1.9BPuissance de calcul Nscale engagée$3.5Bpremiers GPU livrés au second semestre 2027Intention d'aller au-delà$6B
Data
Value
Fonds levés depuis la création$1.9B
Puissance de calcul Nscale engagée (estimate)$3.5B
Intention d'aller au-delà$6B
En milliards de dollars. Fonds propres levés depuis la création jusqu'en septembre 2026 ; engagement pluriannuel de puissance de calcul signé le 3 septembre 2026 ; les 6 milliards correspondent à une intention affichée d'aller au-delà, pas à une dépense contractualisée.7,8,9

Deux choses à surveiller avant l'arrivée du moindre GPU : si le prochain doublement d'Index fait bouger le chiffre de 56 %, et si Figure, Sunday et 1X — le troisième camp humanoïde de la querelle des bancs d'essai — acceptent un jour de faire tourner un unique banc d'essai neutre de tâches domestiques 2. Figure elle-même le concède : la robotique humanoïde n'est pas un problème résolu 1. Le pari, lui, dit que ce pile ou face obéit à une loi d'échelle.

How this brief was made

Become a contributor

Reporting on the business of AI and want it read? We take pitches from outside contributors who bring primary sources and a number worth arguing about.

Share

Deepdive

AI-generated from this story and its cited sources. Not investment advice.

Reader comments

0 comments

    Sign up

    Get your curated digest

    After email confirmation, you will receive a daily digest of the most relevant news that matter to your portfolio