SSysDigest
Axelera AI sort une puce dédiée à l'inférence, pas à l'entraînement

Photo : Pixabay sur Pexels

Intelligence Artificielle

Axelera AI sort une puce dédiée à l'inférence, pas à l'entraînement

Axelera AI lance une puce pensée pour faire tourner des modèles IA déjà entraînés, plutôt que pour les entraîner. Le marché des accélérateurs IA s'élargit au-delà du seul entraînement.

actumatérielintelligence artificielle
Partager :

Jusqu'ici, quand on parlait de puces pour l'IA, on pensait surtout à l'entraînement des gros modèles, le genre de calcul monstrueux qui bouffe des rangées entières de GPU. Mais il y a une autre étape tout aussi importante : l'inférence, c'est-à-dire faire tourner le modèle une fois qu'il est prêt, pour répondre concrètement aux requêtes des utilisateurs. C'est justement sur ce créneau qu'Axelera AI vient de dégainer sa nouvelle puce.

L'idée derrière ce lancement, c'est que les besoins d'entraînement et d'inférence sont assez différents, et qu'une puce optimisée pour l'un n'est pas forcément la meilleure pour l'autre. Les entreprises qui déploient de l'IA à grande échelle cherchent des solutions plus efficaces, moins gourmandes en énergie et en coûts, pour faire tourner leurs modèles au quotidien une fois qu'ils sont opérationnels.

Ce positionnement montre que le marché des accélérateurs IA se diversifie : on ne se bat plus uniquement pour savoir qui entraîne les modèles les plus puissants, mais aussi pour savoir qui les fait tourner le plus efficacement en production. Un signal que l'IA générative entre dans une phase plus mature, où l'usage quotidien compte autant que la course à la puissance brute.

Sources

À lire aussi