L'accélérateur d'inférence Nvidia Groq 3 LPX entre en production. Intégré à la plateforme Vera Rubin, ce composant promet de résoudre la latence de décodage pour déployer des agents IA d'entreprise.
L'essor de l'IA agentique impose de nouvelles contraintes aux centres de données. Contrairement à un LLM répondant à une requête ponctuelle, un agent autonome doit analyser des documents longs, écrire et exécuter du code, vérifier des fichiers et appeler des API tierces. Et ce de manière continue.
Et ce processus génère des milliers de tokens, ce qui crée une latence de décodage au niveau de l'inférence.
Pour traiter cette problématique, Nvidia s'appuie sur la technologie sous licence de la startup Groq, acquise pour 20 milliards de dollars à la fin de l'année 2025. La plateforme Vera Rubin NVL72 adopte une architecture hétérogène :
Chaque baie LPX peut intégrer jusqu'à 256 accélérateurs LP30, offrant 128 Go de mémoire SRAM distribuée capable d'atteindre une bande passante mémoire de 150 To/s.
« Vera Rubin (permet) des configurations d'usines d'IA optimisées pour l'ère de l'IA agentique, repoussant les limites de la performance avec LPX pour une génération ultra-rapide de tokens. », détaille Jensen Huang, le PDG de Nvidia.
Selon les données du cabinet indépendant Artificial Analysis rapportées par The Register, le système LPX affiche un débit record de 3 400 tokens par seconde sur le modèle open source Gemma 4 31B avec une fenêtre de contexte de 100 000 tokens. Cette métrique rend la plateforme quatre fois plus réactive que les solutions concurrentes existantes comme la puce CS-3 de Cerebras.
Le fournisseur de cloud spécialisé (neocloud) Nebius Group a annoncé l'intégration du composant au sein de sa plateforme de production Nebius Token Factory.
En parallèle, la société SpaceXAI a officialisé l'adoption des processeurs Nvidia Vera (88 cœurs Olympus) pour la coordination de ses modèles Grok. Son objectif à terme est d'embarquer l'architecture Vera Rubin à bord de son futur satellite d'IA en orbite, nommé Starmind.
Spécialiste des infrastructures cloud dédiées à l'intelligence artificielle, Nscale ambitionne de lever cette somme lors de son entrée en Bourse prévue en septembre. Une opération qui illustre la course effrénée à la puissance de calcul et consolide l'émergence des neoclouds face aux géants historiques.
Le fondeur mise sur une approche hétérogène, du cloud à la périphérie du réseau, pour répondre à des charges de travail agentiques qu’il juge intrinsèquement diverses en matière de puissance, de coûts et de contraintes de déploiement.
Des chercheurs de l'Université de Stanford ont synthétisé pour la première fois des virus fonctionnels et inédits à l'IA. Cette avancée pour la biologie ouvre des perspectives médicales, mais soulève aussi des défis en matière de sécurité.
Pour soutenir l'expansion titanesque de l'IA, les géants du numérique abandonnent leur modèle historique. En s'inspirant des montages financiers de l'aviation et du transport maritime, ils dissimulent des milliers de milliards de dollars d'engagements hors-bilan. Au risque de créer une bulle sans précédent.
Conçu pour Windows, macOS, iOS et Android, Wispr Flow est un véritable plaisir à utiliser par rapport aux autres applications de dictée vocale. Voici pourquoi.
Trop de texte, polices incohérentes, visuels étranges : voici 8 conseils, prompts à l'appui, pour créer des flyers avec l'IA qui ne trahissent plus leur origine artificielle.
Économisez votre argent, préservez votre vie privée et protégez la planète. Cette IA à installer offre plusieurs avantages que vous ne trouverez pas avec des modèles plus traditionnels comme ChatGPT.
L'année dernière, le mieux que l'on pouvait dire des créateurs de sites web basés sur l'IA, c'est qu'ils avaient du potentiel. Cette année, nous en avons trouvé certains qui sont réellement à la hauteur.
Dans Google Workspace, Gemini a accès par défaut à Gmail, Docs, Agenda, Chat et bien d'autres services. Voici pourquoi cela est important et comment les administrateurs peuvent désactiver cette fonctionnalité dès aujourd'hui.
Alors qu’Assistant s’apprête à disparaître, remplacé par Gemini, cette application, qui préserve vos données privées, constitue une option intéressante. Malgré, toutefois, quelques bémols.
J'ai utilisé l’outil d’intelligence artificielle Cowork d’Anthropic pour automatiser un flux de travail, et le résultat s'est avéré remarquablement efficace, mais cela a mis en évidence quatre inconvénients majeurs.
De nos jours, dans la lutte contre les menaces en ligne, les certifications et les années d'expérience ne suffisent plus. Avec l'automatisation renforcée par l’IA, trois compétences prennent le relais.






