Nvidia lance une nouvelle configuration de puce IA

Nvidia lance une nouvelle configuration de puce IA

Nvidia a annoncé mardi une nouvelle configuration pour ses puces d’intelligence artificielle avancée, conçue pour accélérer les applications d’IA générative. Selon Ian Buck, vice-président de Nvidia pour l’hyperscale et le HPC, la nouvelle version de la super-puce Grace Hopper augmente la quantité de mémoire à large bande passante, ce qui donnera à la conception la capacité d’alimenter des modèles d’IA plus grands. La configuration est optimisée pour effectuer des fonctions d’inférence d’IA qui alimentent efficacement des applications d’IA générative telles que ChatGPT.

La conception de la super-puce Grace Hopper de Nvidia assemble une unité de traitement graphique H100 de la société avec un processeur central conçu par Nvidia. « Avoir une mémoire plus grande permet au modèle de rester résident sur une seule GPU et de ne pas nécessiter plusieurs systèmes ou plusieurs GPU pour fonctionner », a déclaré Buck lors d’une conférence téléphonique avec des journalistes.

Les modèles d’IA sous-jacents qui alimentent les applications d’IA générative capables de produire du texte et des images semblables à ceux des humains continuent de croître en taille. À mesure que les tailles des modèles augmentent, ils nécessitent une plus grande quantité de mémoire pour fonctionner sans connecter des puces et des systèmes séparés, ce qui dégrade les performances. « La mémoire supplémentaire augmente simplement les performances du GPU », a déclaré Buck.

La nouvelle configuration appelée GH200 sera disponible au deuxième trimestre de l’année prochaine, a déclaré Buck. Nvidia prévoit de vendre deux versions : une version comprenant deux puces que les clients peuvent intégrer dans des systèmes, et un système de serveur complet qui combine deux conceptions Grace Hopper.

(Reuters) – Nvidia a annoncé mardi une nouvelle configuration pour ses puces d’intelligence artificielle avancée, conçue pour accélérer les applications d’IA générative. Selon Ian Buck, vice-président de Nvidia pour l’hyperscale et le HPC, la nouvelle version de la super-puce Grace Hopper augmente la quantité de mémoire à large bande passante, ce qui donnera à la conception la capacité d’alimenter des modèles d’IA plus grands. La configuration est optimisée pour effectuer des fonctions d’inférence d’IA qui alimentent efficacement des applications d’IA générative telles que ChatGPT.

La conception de la super-puce Grace Hopper de Nvidia assemble une unité de traitement graphique H100 de la société avec un processeur central conçu par Nvidia. « Avoir une mémoire plus grande permet au modèle de rester résident sur une seule GPU et de ne pas nécessiter plusieurs systèmes ou plusieurs GPU pour fonctionner », a déclaré Buck lors d’une conférence téléphonique avec des journalistes.

Les modèles d’IA sous-jacents qui alimentent les applications d’IA générative capables de produire du texte et des images semblables à ceux des humains continuent de croître en taille. À mesure que les tailles des modèles augmentent, ils nécessitent une plus grande quantité de mémoire pour fonctionner sans connecter des puces et des systèmes séparés, ce qui dégrade les performances. « La mémoire supplémentaire augmente simplement les performances du GPU », a déclaré Buck.

La nouvelle configuration appelée GH200 sera disponible au deuxième trimestre de l’année prochaine, a déclaré Buck. Nvidia prévoit de vendre deux versions : une version comprenant deux puces que les clients peuvent intégrer dans des systèmes, et un système de serveur complet qui combine deux conceptions Grace Hopper.

(Reporting by Max A. Cherney in San Francisco; Editing by Marguerita Choy)

Partager l'article :

Facebook
Twitter
LinkedIn
Pinterest

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *

Contenus récents
Categories