ADVERTISEMENT
DESK EN DIRECT·Rédaction marchés mondiaux·Last updated 14s ago
ADVERTISEMENT
Marchés/ForexArticle

Nvidia dévoile l'accélérateur d'inférence AI Groq 3 LPX avec une sortie de 3 400 tokens/sec

Un nouveau chip accélère l'inférence IA, doublant les vitesses de génération de tokens dans des tests de référence utilisant le modèle Gemma 4 31B. Nebius va déployer les premiers dispositifs via sa plateforme Token Factory.

SL
Sophie Laurent · FX & Rates Desk · 25 Aug 2026 · 18:36 · 1 min de lecture
Partager
Nvidia dévoile l'accélérateur d'inférence AI Groq 3 LPX avec une sortie de 3 400 tokens/sec

Nvidia a présenté l'accélérateur d'inférence AI Groq 3 LPX, une solution matérielle conçue pour améliorer les vitesses de génération de tokens dans les systèmes d'IA, avec des résultats de benchmark démontrant 3 400 tokens de sortie par seconde en utilisant le modèle Gemma 4 31B et un contexte de 100 000 tokens.

L’accélérateur est conçu pour soutenir des applications telles que les assistants de codage AI et les systèmes interactifs, selon la société. Le Groq 3 LPX est positionné comme une extension des systèmes Vera Rubin NVL72 de Nvidia, qui sont utilisés pour les tâches de formation et d'inférence en matière d'AI.

Euro / US Dollar

EURUSD
Full profile →
1.1674▲ 0.00%
As of 25/08/2026, 09:38:58

La plateforme Vera Rubin intègre sept puces et cinq racks spécialement conçus, comprenant des DPU Nvidia BlueField-4, des racks Vera CPU, du stockage Vera BlueField-4 STX et le réseau Ethernet Spectrum-6 SPX. Nvidia a annoncé ce produit à la conférence Hot Chips et a déclaré qu'il entre désormais dans la phase de production de masse.

Nebius, un fournisseur de solutions cloud AI, sera le premier à déployer le Groq 3 LPX à travers sa plateforme Nebius Token Factory. Danila Shtan, directeur technique de Nebius, a déclaré que l'accélérateur vise la phase de génération de l'inférence, ce qui a une incidence directe sur la réactivité des systèmes AI.

Le PDG de Nvidia, Jensen Huang, a décrit les systèmes Vera Rubin comme «des configurations d'usines d’IA optimisées pour les workloads et conçues pour l'ère de l'IA agentielle».

Cet article a été produit avec l'assistance de l'IA et édité par un journaliste de Finance Review Daily.
ADVERTISEMENT
Partager cet article
SL
Par
Sophie Laurent
FX & Rates Desk

Sophie covers currency markets and central bank policy across Europe, with a focus on how rate decisions ripple through FX pairs. She has been tracking the ECB's policy path since the start of the current easing cycle.

Plus de Sophie Laurent →
ADVERTISEMENT
Novara — A Smarter Way to Access Global Markets
ADVERTISEMENT