Anthropic veut contenir GLM-5.3. Thinking Machines le fait tourner en production.

Un contrat de 65 millions de dollars par an conclu avec Crusoe fait figurer les GLM 5.2 et 5.3 de Z.ai parmi les charges de travail de production de Thinking Machines Lab, six jours après que le CAISI a qualifié GLM-5.3 de modèle à poids ouverts (« open-weight ») le plus capable en cybersécurité jamais publié à ce jour. La capitalisation de Z.AI, 278,89 milliards de dollars de Hong Kong, est le pari que l'ubiquité l'emportera sur le confinement.

Lire l’original

Vincent JiangVincent Jiang · 3 min read
Share
Dario Amodei prenant la parole sur un panel du TechCrunch Disrupt 2023, un bras levé
1 / 6Slide 1 of 6
Dario Amodei, directeur général d'Anthropic. La Frontier Red Team de son laboratoire a rapporté que GLM-5.3 était parvenu à construire des exploits fonctionnels de bout en bout à 50 reprises sur 410 tentatives.

La facture cloud d'un laboratoire américain inclut désormais les modèles de Z.ai

Crusoe a annoncé le 23 septembre un contrat de 65 millions de dollars par an pour exécuter l'inférence en production pour le compte de Thinking Machines Lab, la start-up de Mira Murati, ancienne directrice technique d'OpenAI 3, sur un cluster dédié de systèmes NVIDIA HGX B200 2. La liste des charges de travail est le détail que la couverture cloud a laissé de côté : à côté d'Inkling, le modèle de 975 milliards de paramètres de Thinking Machines, figurent les GLM 5.2 et 5.3, modèles à poids ouverts développés par la société pékinoise Z.ai 12.

À s'en tenir à la couverture disponible, ce contrat est le premier canal de production occidental nommément désigné desservant les modèles GLM de Z.ai. Il a aussi porté l'activité d'inférence gérée de Crusoe au-delà des 100 millions de dollars de revenus annuels contractualisés, moins d'un an après son lancement 12.

Le dossier du confinement, en chiffres testés

La Frontier Red Team d'Anthropic a rapporté le 29 septembre que GLM-5.3 avait construit des exploits fonctionnels de bout en bout à 50 reprises sur 410 tentatives, soit six réussites de moins que Claude Mythos Preview, qu'Anthropic ne diffuse qu'à des cyberdéfenseurs habilités via le projet Glasswing 45.

Les garde-fous sont, eux, le problème le moins coûteux. Des techniques simples les ont contournés dans 64 % à 100 % des cas, alors qu'elles échouaient face aux modèles Claude protégés 5. Retirer le comportement de refus des poids publics a coûté environ 4 400 dollars de calcul, environ 1 200 dollars pour une équipe expérimentée, et fait passer les refus de plus de 90 % à un taux pouvant descendre jusqu'à 2 % 45.

Six jours avant l'annonce de Crusoe, le 17 septembre, le Center for AI Standards and Innovation (CAISI) du NIST a qualifié GLM-5.3 de « modèle à poids ouverts le plus capable en cybersécurité jamais publié à ce jour », en retard d'environ quatre mois sur la frontière américaine 4. Anthropic a indiqué que ses résultats recoupaient globalement cette évaluation 4.

La défense de Z.ai : 4 249 vulnérabilités détectées

Z.ai a réagi en quelques heures 5. Li Zixuan, responsable des opérations mondiales de l'entreprise, a affirmé que GLM-5.3 avait contribué à défendre 389 projets open source et détecté 4 249 vulnérabilités potentielles, et que Hugging Face avait utilisé en juillet le modèle précédent, GLM 5.2, pour contenir une intrusion autonome de modèles d'OpenAI, après le refus de Claude d'effectuer une partie du travail 56.

Le déploiement a été échelonné. Z.ai a attendu deux semaines après le lancement du 14 août avant de publier les poids, le 28 août, sous une licence qui ne filtre que les opérateurs de plus de 10 milliards de dollars de chiffre d'affaires. Le 28 septembre, la société a publié avec Concordia AI un cadre de gestion des risques en six étapes pour les modèles à poids ouverts 78. Les propres tests de Z.ai, non vérifiés de manière indépendante, placent GLM-5.3 devant Mythos 5 pour la détection des failles, 84,5 contre 83,8 sur CyberGym, et derrière pour leur exploitation offensive 6.

Le marché paie près de 330 fois les ventes pour l'autre scénario

Cotée à Hong Kong sous le code 2513, Z.AI affiche une capitalisation de 278,89 milliards de dollars de Hong Kong pour 724,33 millions de yuans de chiffre d'affaires, soit près de 330 fois les ventes aux taux de change en vigueur au moment de sa levée de fonds de septembre 910. Rien de ce multiple ne survit au confinement.

La levée de fonds de septembre s'est élevée à 5 milliards de dollars : un placement d'actions de 2 milliards de dollars à 714 dollars de Hong Kong l'action, et 3 milliards d'obligations convertibles à coupon zéro arrivant à échéance en 2027 — la deuxième levée en deux mois, après environ 4 milliards de dollars en juillet 101112. Le titre a perdu plus de 10 % à l'annonce 11.

Z.AI a levé 9 milliards de dollars à Hong Kong entre juillet et septembre

$0B$1B$2B$3B$4BPlacement complémentaire, juillet$4BPlacement d'actions H, septembre$2BObligations convertibles, septembre$3BCoupon zéro, échéance 2027
Data
Value
Placement complémentaire, juillet$4B
Placement d'actions H, septembre$2B
Obligations convertibles, septembre$3B
Produits bruts en dollars selon Reuters et CNBC ; les obligations convertibles de septembre sont à coupon zéro et arrivent à échéance en septembre 2027. L'introduction en Bourse de janvier en est exclue. Sources : Reuters, 11 septembre 2026 ; CNBC, 13 septembre 2026 ; A&O Shearman.10,11,12

De l'autre côté de ce marché de la puissance de calcul, Thinking Machines Lab serait en discussions pour lever 1 milliard de dollars à une valorisation d'au moins 40 milliards de dollars, avec un rythme annuel de chiffre d'affaires supérieur à 100 millions de dollars 13.

Ce qui pourrait encore tout arrêter

Anthropic, qui vise une introduction en Bourse pouvant atteindre 2 000 milliards de dollars, consacre environ 80 des 261 pages de son prospectus aux facteurs de risques, tout en élargissant le cercle des acteurs habilités à accéder aux capacités cyber de Claude et en appelant les gouvernements à soumettre les modèles puissants à des tests de sécurité 47. Donald Trump a déclaré le 29 septembre qu'il ne voulait pas travailler avec la Chine sur la sécurité de l'IA, quelques jours après que Washington et Pékin ont convenu d'un mécanisme formel de dialogue sur l'IA 5.

Il ne reste que des leviers privés : la licence de Z.ai, qui ne filtre que les opérateurs de plus de 10 milliards de dollars de chiffre d'affaires ; son cadre de publication échelonnée des poids ; la prochaine évaluation du CAISI. Reste à surveiller si le cluster de Crusoe s'étend à la génération de données synthétiques par lots, et si les prochains poids de GLM sortiront dès le premier jour ou après un nouveau délai de deux semaines 128. Le modèle à poids ouverts le plus performant sur le plan cyber jamais publié est désormais une ligne facturée sur un cluster de production américain.

Deepdive

AI-generated from this story and its cited sources. Not investment advice.

Reader comments

0 comments

    Sign up

    Get your curated digest

    After email confirmation, you will receive a daily digest of the most relevant news that matter to your portfolio