ADVERTISEMENT
DESK EN DIRECT·Rédaction marchés mondiaux·Last updated 14s ago
ADVERTISEMENT
Marchés/ActionsArticle

Cerebras présente le chip AI CS-4, 30 fois plus rapide en inférence, et annonce la construction d'un centre de données de 600 MW

Le système CS-4 de nouvelle génération de Chipmaker offre une inférence jusqu'à 30 fois plus rapide que les concurrents basés sur les GPU et vise une capacité de centre de données de 600 MW d'ici fin 2025. Les revenus ont augmenté de 91 % au cours des douze derniers mois.

PA
Priya Anand · Equities & Earnings Desk · 20 Aug 2026 · 03:27 · 2 min de lecture
Partager
Cerebras présente le chip AI CS-4, 30 fois plus rapide en inférence, et annonce la construction d'un centre de données de 600 MW

Cerebras Systems a présenté mardi son accélérateur d'IA CS-4, posant ce système à l'échelle d'une plaquette comme la plateforme d'inférence la plus rapide de l'industrie, dans le cadre d'une poussée générale visant à augmenter la capacité des centres de données à 600 mégawatts d'ici la fin de 2025.

Le CS-4, actuellement en accès précoce, offre des inférences jusqu'à 30 fois plus rapides que les solutions basées sur les GPU pour les modèles de pointe et du double de la vitesse de traitement des informations par seconde par rapport à son prédécesseur, le CS-3. Les principales indicateurs de performance comprennent 43 pétaoctets par seconde de bande passante de mémoire par chip, soit 2 000 fois plus qu la mesure de NVIDIA GPU de nouvelle génération, ainsi qu'une latence d'entrée/sortie de wafer à wafer réduite à 2 microsecondes, ce qui représente une amélioration de 2,5 fois. La latence du réseau a également été réduite à 3 microsecondes contre 5 microsecondes auparavant.

Le système s'appuie sur le moteur à taille de wafer (WSE-3 Turbo) et la plate-forme à échelle de rack de Cerebras, dotée de 50 % de composants en moins et d'une automatisation de la fabrication 60 % plus importante. Les délais de déploiement ont été réduits à quelques heures, alors qu'un design de sac à dos offre deux fois la puissance et la capacité de refroidissement. La communication sur chip fournit 200 fois plus de bande passante que les câbles à l'extérieur du chip.

Cerebras a également présenté ses plans pour doubler ses performances brutes chaque année jusqu'en 2027, en visant un rendement 20 fois supérieur d'ici cette date. Le système CS-5, qui sera livré en 2027, servira de moteur de nouvelle génération à l'échelle des wafers. La société dispose d'une capacité de centres de données de 600 MW, soit en opération, soit sous contrat pour livraison d'ici fin 2025, avec des sites situés à Santa Clara, Toronto, Dallas, Minneapolis, Montréal, Oklahoma City, Lyon, Mikkeli ainsi que d'autres localités en Norvège.

Les revenus ont atteint 680,67 millions de dollars au cours des douze mois précédents à la fin du T2 2026, en augmentation de 91 % par rapport à l'an dernier. Les actions de Cerebras ont clôturé à 219,92 $ mardi, en baisse de 12,73 % par rapport à la clôture de la séance précédente de 251,98 $. Toutefois, le trading après sessions a indiqué une légère hausse à 220,39 $. L'action a fluctué entre 160,81 $ et 386,34 $ au cours des 52 dernières semaines.

Lors de la conférence Supernova 2026, le PDG Andrew Feldman a mis en avant les performances du CS-4 sur le mode Sol Ultrafast de GPT-5.6 d'OpenAI, qui exécute les modèles de pointe jusqu'à 14 fois plus rapidement que les tierces plus conventionnelles. Thibault Imbert, directeur des produits et plates-formes de base chez OpenAI, a noté que le mode ultrafast élimine les compromis entre rapidité et intelligence, tout en réduisant la charge cognitive pour les utilisateurs finaux.

Cerebras a également présenté des applications dans le monde réel, notamment un agent de conception Figma personnalisé sur la base de milliards de conceptions et le modèle Sui 1.7 de Cognition, qui atteint une qualité équivalente à GPT-5.5 Opus à près de 1 000 symboles par seconde. Les variantes SuiGrab et SuiGrab Mini de l'entreprise fonctionnent respectivement à 680 et 2 800 symboles par seconde, permettant des appels simultanés d'outils qui améliorent l'exécution des tâches de bout en bout quatre fois par rapport aux méthodes séquentielles.

Dans le domaine de la cybersécurité, Cerebras a signalé que l'inférence plus rapide permet de réaliser cinq à dix fois plus d'inspections dans des fenêtres de temps acceptables, Armis effectuant le scan de sécurité du code en un tiers du temps des alternatives GPU. La société a également souligné un benchmark où son système a réussi un examen de 2 500 questions en 11 heures, 11 minutes et 26 secondes - soit moins d'une demi-journée -, alors que les concurrents y consacraient plus de trois jours.

Cet article a été produit avec l'assistance de l'IA et édité par un journaliste de Finance Review Daily.
ADVERTISEMENT
Partager cet article
PA
Par
Priya Anand
Equities & Earnings Desk

Priya covers listed equities and corporate earnings, reading quarterly results and guidance for what they signal about sector health and forward valuations.

Plus de Priya Anand →
ADVERTISEMENT
ADVERTISEMENT