Nvidia dévoile les spécifications du processeur Vera pour défier AMD et Intel dans les serveurs d’IA

Nvidia a publié mardi des spécifications détaillées et des benchmarks pour son CPU de data center Vera, entrant en concurrence avec Advanced Micro Devices et Intel sur le marché des processeurs serveurs pour l’IA. Le géant des puces a livré des processeurs Vera à des clients incluant OpenAI, Anthropic et SpaceX en juin, selon des représentants de Nvidia. Le lancement du CPU répond à la demande croissante de processeurs optimisés pour des charges d’IA agentique, qui exigent de meilleures performances mono-cœur pour piloter des agents d’IA capables de fonctionner de manière autonome avec un minimum d’intervention humaine. Nvidia vise à vendre des systèmes complets en racks intégrant ses GPU et ses CPU, plutôt que des puces seules, dans le cadre de sa stratégie d’intégration verticale. Le marché des CPU serveurs pourrait atteindre 200 milliards de dollars, a déclaré Nvidia, tandis que les estimations actuelles situent le marché mature à environ 37 milliards de dollars en 2025.

Nvidia Vera CPU Targets Single-Core Speed for AI Agent Performance

Nvidia a déclaré que Vera est le premier CPU serveur que l’entreprise a conçu de zéro, plutôt que d’utiliser une conception « sur étagère » d’Arm. La puce offre 50% de performances en plus pour les agents d’IA par rapport aux processeurs x86 d’Intel et d’AMD, selon Nvidia. Les CPU précédents étaient axés sur le nombre de cœurs, tandis que le cœur Olympus de Vera donne la priorité à la vitesse mono-cœur, a indiqué l’entreprise.

Hannah Coutand, responsable marketing produit Vera chez Nvidia, a déclaré lors d’une présentation que la puce est optimisée pour la vitesse par cœur, une forte bande passante mémoire et une faible latence « afin que les agents puissent revenir vers leurs GPU le plus vite possible et maintenir ces GPU, qui sont un actif très coûteux et très précieux dans l’atelier d’IA, aussi fortement utilisés que possible ».

Le processeur consomme entre 250 watts et 450 watts et prend en charge jusqu’à 200Béraoctet de mémoire par puce grâce à une mémoire à faible consommation. Nvidia commercialisera Vera comme une puce autonome, dans une configuration de rack refroidi par liquide avec 256 puces, dans une configuration serveur à deux puces, et en l’associant à des GPU Nvidia dans un système appelé Vera Rubin.

Ian Buck, vice-président de Nvidia pour l’hyperscale, a déclaré lors d’une présentation la semaine dernière que les agents ont rendu les CPU « beaucoup plus intégrés », notamment concernant « la rapidité avec laquelle un CPU peut répondre à une seule question ».

AMD and Intel Hold Dominant Server CPU Market Positions

AMD détiendrait environ 33% du marché des CPU serveurs, tandis qu’Intel en contrôle 66,8%, mais AMD gagne des parts grâce à des relations solides avec des hyperscalers. L’analyste de Gartner, Kevin Knox, a déclaré qu’AMD est actuellement l’entreprise à battre en matière de CPU serveurs d’IA en entreprise, notant « qu’AMD a fait du très bon travail en construisant leur écosystème autour de leurs puces ».

AMD et Intel figurent parmi les deux valeurs de semi-conducteurs les plus performantes en 2026, avec AMD en hausse de 128% et Intel en hausse de 149%, contre une progression de 8% pour Nvidia. La montée de l’IA agentique a ramené l’attention sur les CPU, qui sont nécessaires pour gérer et alimenter les agents d’IA.

Wolfe Research a prévu en mai que Nvidia expédierait environ 1,3 million de puces Vera cette année à un prix de vente moyen d’environ 5 000 dollars par puce. Nvidia a refusé de commenter les prix.

Le fondateur de Cambrian AI Research, Karl Freund, a déclaré que le CPU de Nvidia crée une nouvelle catégorie que l’Intel et l’AMD ne traitent pas actuellement. « Le CPU est quelque chose qu’ils ont fait pour détourner leurs clients de l’utilisation de CPU Intel ou AMD, et ils convoitent ce revenu », a déclaré Freund. « Ce qu’ils ont fait, c’est qu’ils ont décidé de se concentrer sur un CPU unique, qui n’est disponible sur le marché pour personne en ce moment. »

Nvidia Reports Early-Stage Vera Adoption with OpenAI Deployment

Coutand a déclaré que l’adoption de Vera est en « début de parcours ». Nvidia a listé Oracle comme partenaire, mais n’a pas nommé de grands fournisseurs de services cloud. OpenAI prévoit de déployer des puces Vera en grandes quantités à partir de ce trimestre, a indiqué l’entreprise.

Avant l’essor de l’IA, le CPU était le composant serveur le plus important et le plus coûteux. Les premiers serveurs IA de première génération disponibles au moment du lancement de ChatGPT en 2022 associaient jusqu’à huit GPU à un seul CPU, signalant un changement vers les GPU Nvidia.

FAQ

Quand Nvidia a-t-il livré des CPU Vera aux clients ?
Des représentants de Nvidia ont indiqué que des puces Vera ont été livrées à des clients incluant OpenAI, Anthropic et SpaceX en juin.

Quelle est la répartition des parts de marché rapportée entre AMD et Intel dans les CPU serveurs ?
AMD détiendrait environ 33% du marché des CPU serveurs, tandis qu’Intel en contrôlerait 66,8%, selon l’article source.

Quel avantage de performance Nvidia revendique-t-il pour Vera dans les charges de travail d’agents IA ?
Nvidia a déclaré que Vera offre 50% de performances en plus pour les agents d’IA par rapport aux puces x86 d’Intel et d’AMD.

Avertissement : Les informations figurant sur cette page peuvent provenir de sources tierces et sont fournies à titre indicatif uniquement. Elles ne reflètent pas les points de vue ou opinions de Gate et ne constituent pas un conseil financier, d’investissement ou juridique. Le trading des actifs virtuels comporte des risques élevés. Veuillez ne pas vous fonder uniquement sur les informations de cette page pour prendre vos décisions. Pour en savoir plus, consultez l’avertissement.
Commentaire
0/400
Aucun commentaire