L’événement le plus important aujourd’hui, c’est la conférence GTC d’NVIDIA : c’est littéralement une histoire de l’humanité à l’ère de l’IA.

robot
Création du résumé en cours

Aujourd’hui, la chose la plus importante, c’est la conférence GTC de Nvidia : carrément une Histoire de l’humanité version IA.

Jensen Huang n’est même pas encore monté sur scène, mais la quantité d’informations divulguée en amont suffit déjà pour en faire un livre.

Wanwansw a préparé trois grands points à retenir. Allez, les potes, on y va.

1)Les coûts de calcul de l’IA divisés par 10

La génération précédente de Blackwell était déjà très impressionnante, n’est-ce pas. La prochaine annonce concerne la production de masse de la nouvelle puce Vera Rubin.

En quoi Vera Rubin est-elle si forte ? En clair, il y a deux mots : moins cher.

Pour exécuter le même modèle d’IA, le nombre de puces passe à un quart, et le coût des calculs d’inférence chute de 90 %. Baisse de 90 %, les amis. Les trois géants du cloud, AWS, Microsoft et Google, montent directement dans le premier lot.

2)Le Groq acheté l’an dernier pour 20 milliards de dollars rend ses devoirs aujourd’hui

Auparavant, Jensen Huang avait dit lors d’une réunion sur ses résultats que Groq serait intégré au système Nvidia comme une extension d’architecture, un peu comme l’époque où Nvidia avait racheté Mellanox pour compléter ses capacités réseau.

Le LPU de Groq et les GPU Nvidia sont dans le même centre de données : les GPU comprennent le problème, et le LPU produit des réponses très rapidement.

En combinant la répartition des tâches entre ces deux types de puces, la latence des scénarios d’Agent tombe directement.

Un Agent IA fait le travail à votre place : pour une seule tâche, il peut ajuster le modèle plusieurs dizaines de fois, et à chaque tour, on brûle de la puissance de calcul d’inférence… sans compter que l’utilisateur attend pendant ce temps : si c’est plus lent, l’expérience s’effondre.

L’inférence se fait en deux étapes : d’abord comprendre votre question, puis recracher la réponse lettre par lettre. Les GPU sont forts pour la première étape, mais pour la vitesse et la stabilité de la seconde étape, le LPU de Groq est plus solide.

20 milliards de dollars, c’est cher ?

Imaginez : à l’avenir, chaque entreprise fera tourner des centaines d’Agents, et chaque Agent ajustera des modèles des milliers de fois par jour.

3)Nvidia lance OpenClaw, mais en version NemoClaw

C’est une suite de plateforme open source : les entreprises l’installent et peuvent déployer des employés IA pour exécuter les tâches à la place des humains—gérer les données, traiter les projets. On dit que le produit est déjà en discussion avec Salesforce et Adobe.

Ce qui est intéressant, c’est que NemoClaw ne vous demande pas d’utiliser des puces Nvidia. Vous voyez la logique, non ? Vendre des puces, ça rapporte surtout sur la couche matériel. C’est en imposant les règles qu’on gagne sur toute la chaîne. Jensen Huang a fait ce calcul parfaitement.

4)Jensen Huang dit vouloir présenter « une puce que le monde n’a jamais vue »

Très probablement, il s’agira d’une première apparition de la prochaine architecture, Feynman, pour une production en 2028, avec le procédé 1,6 nm le plus avancé de TSMC.

En plus, il y a un autre sujet moins médiatisé que je trouve vraiment intéressant.

Nvidia sort des processeurs pour ordinateurs portables : deux modèles, avec un focus sur le gaming. Les vendeurs de cartes graphiques viennent donc récupérer la place du CPU : ils vont devoir se battre pour leur assiette.

Moi, je sens que Jensen Huang va devenir un grand homme de sa génération.

MSFT-1,20%
NVDA1,86%
CRM-2,08%
ADBE-3,20%
TSM5,42%
Voir l'original
Cette page peut inclure du contenu de tiers fourni à des fins d'information uniquement. Gate ne garantit ni l'exactitude ni la validité de ces contenus, n’endosse pas les opinions exprimées, et ne fournit aucun conseil financier ou professionnel à travers ces informations. Voir la section Avertissement pour plus de détails.
  • Récompense
  • Commentaire
  • Reposter
  • Partager
Commentaire
Ajouter un commentaire
Ajouter un commentaire
Aucun commentaire
  • Épinglé