Applications 5 min de lecture

Nvidia et CoreWeave relient entraînement et production des agents IA

Couloir d'un centre de données, rangées de baies de serveurs et voyants lumineux, faible profondeur de champ

La réponse en bref

Le 30 septembre 2026, CoreWeave a annoncé la mise à disposition des systèmes Nvidia Vera Rubin NVL72 sur son cloud, avec le laboratoire Cognition comme premier client à faire tourner des charges de production dessus. Cognition annonce jusqu'à 4,8 fois plus de jetons traités par seconde sur ses tests d'inférence par rapport à la génération précédente. CoreWeave met aussi en service la puce Nvidia Vera, présentée comme le premier processeur conçu pour les agents, et lance Forge, un environnement qui enchaîne l'entraînement, l'évaluation et la production des modèles et des agents. Pour une TPE, rien ne change cette semaine : ce sont des briques d'infrastructure. La tendance à retenir est ailleurs, dans le passage d'agents bricolés à des agents outillés et suivis.

Qu’est-ce que CoreWeave a annoncé le 30 septembre 2026 ?

Trois choses, lors de sa conférence Fully Connected, à San Francisco. D’abord la mise à disposition, sur son cloud, des systèmes Nvidia Vera Rubin NVL72, accompagnés d’un réseau Spectrum-X en Ethernet 102,4 térabits. Ensuite l’arrivée de la puce Nvidia Vera, présentée comme le premier processeur conçu pour les agents. Enfin le lancement de CoreWeave Forge, un environnement qui relie l’entraînement, l’évaluation et la mise en production des modèles et des agents.

CoreWeave est un loueur de puissance de calcul spécialisé dans l’intelligence artificielle. Ses clients ne construisent pas de centre de données, ils louent des machines à l’heure.

Pourquoi parle-t-on d’agents plutôt que de modèles ?

Parce que le travail a changé de forme. Un modèle classique répond à une question. Un agent, lui, exécute une tâche en plusieurs étapes : il consulte des documents, appelle des outils, vérifie son résultat et recommence si nécessaire. Cette manière de travailler impose deux contraintes nouvelles.

La première est le volume. Un agent qui enchaîne les étapes consomme beaucoup plus de calcul qu’une simple conversation, et cette consommation devient le premier poste de coût. La seconde est la sécurité. Faire tourner du code produit par un agent suppose de l’isoler, pour qu’il ne touche pas au reste du système. C’est exactement ce que visent les annonces de cette semaine.

Que montrent les premiers chiffres ?

Un cas concret, avec le laboratoire Cognition, éditeur de l’agent de programmation Devin. Il est le premier client à faire tourner des charges de production sur ces machines. Sur un test d’inférence bâti à partir de tâches réelles d’ingénierie logicielle, son équipe mesure jusqu’à 4,8 fois plus de jetons traités par seconde qu’avec la génération précédente, la plateforme GB200 NVL72.

Côté matériel, la puce Vera concentre sa promesse sur les environnements isolés. Une baie embarque 128 processeurs et 11 264 cœurs, de quoi faire tourner plus de 11 000 environnements séparés en parallèle. CoreWeave annonce des démarrages plus de trois fois plus rapides. Un chiffre plus ancien résume la logique du secteur : chez Nvidia, on rappelle que des cartes V100 livrées il y a près de dix ans tournent encore chez des clients.

Est-ce que cela fera baisser le prix de l’IA ?

Un jour, probablement, et pas cette année. Ces annonces visent la capacité, la fiabilité et la vitesse d’exécution, pas le tarif affiché. Une machine plus efficace peut réduire le coût d’une tâche donnée, mais ce type de gain met des mois à se répercuter dans les logiciels qu’achète une petite entreprise, et il passe surtout par les éditeurs, pas par le client final.

Il y a une raison structurelle à cette lenteur. Un agent qui travaille en plusieurs étapes consomme bien plus de calcul qu’une conversation ordinaire. Tant que ce coût par tâche reste élevé, l’automatisation de bout en bout reste hors de portée pour une structure de quelques personnes, sauf sur des tâches très ciblées.

Faut-il s’y intéresser quand on dirige une TPE ?

Pas pour choisir une machine. La question n’a aucun sens à cette échelle : personne ne loue des baies de calcul pour gérer ses devis. Ce qui mérite l’attention est le mouvement décrit, celui d’un outillage qui se professionnalise.

Pendant deux ans, un agent IA se bricolait avec des raccordements fragiles, sans moyen simple de vérifier son travail ni de le remettre en cause. Ce qui arrive maintenant, ce sont des environnements d’essai, des mesures de qualité et des chaînes de mise en service. C’est ce qui manquait pour qu’une tâche confiée à un agent tienne dans le temps.

Pour une entreprise d’Auxerre ou d’ailleurs dans l’Yonne, la conclusion pratique tient en une phrase : la technologie avance vite, la valeur viendra de la tâche que vous choisissez de lui confier, et du contrôle que vous gardez dessus. Nous vous proposons un diagnostic gratuit de vos tâches répétitives, avec une maquette d’automatisation chiffrée pour votre activité, sans engagement.

Questions fréquentes

Qu'est-ce que CoreWeave ?
Un loueur de puissance de calcul spécialisé dans l'intelligence artificielle, coté en Bourse aux États-Unis. Ses clients entraînent et font tourner des modèles sur ses machines, au lieu d'acheter et d'exploiter leurs propres serveurs.
Que change la puce Nvidia Vera ?
Elle est présentée comme le premier processeur conçu pour les agents. Une baie complète embarque 128 processeurs et plus de 11 000 cœurs, de quoi faire tourner plus de 11 000 environnements isolés en parallèle, avec des démarrages plus de trois fois plus rapides selon CoreWeave.
Ces annonces vont-elles faire baisser le prix de l'IA ?
Elles visent d'abord la capacité et la fiabilité, pas le prix affiché. Une machine plus efficace peut réduire le coût d'une tâche, mais ces gains mettent des mois à atteindre les logiciels que paie une petite entreprise.
Pourquoi les agents IA sont-ils un sujet d'infrastructure ?
Parce qu'un agent ne se contente pas de répondre : il exécute des étapes, appelle des outils et doit être testé dans un environnement isolé. Ce sont ces briques, évaluation et environnements cloisonnés, qui manquaient pour passer du prototype à la production.

En résumé

Le 30 septembre 2026, CoreWeave a annoncé la mise à disposition des systèmes Nvidia Vera Rubin NVL72 sur son cloud, avec Cognition comme premier client à y faire tourner des charges de production. Cognition annonce jusqu'à 4,8 fois plus de jetons traités par seconde par rapport à la génération précédente. CoreWeave met aussi en service la puce Nvidia Vera, conçue pour les agents, et lance Forge, un environnement qui enchaîne entraînement, évaluation et production. Pour une TPE, ce sont des briques d'infrastructure, sans effet immédiat.

Contenu rédigé avec l'aide de l'IA.

Le prochain article, directement chez vous

Ce que vous voulez recevoir

← Tous les articles

On commence par la maquette, gratuite, en un quart d'heure

Votre métier, vos couleurs, vos textes. Sans engagement, et elle est à vous.

Ma maquette gratuite