AMD rachète Taalas : des puces IA gravées dans le silicium pour défier Nvidia

Par: Michael Korgs | aujourd'hui, 15:18

AMD vient d'annoncer l'acquisition de Taalas, une startup canadienne spécialisée dans les puces d'inférence IA, avec une finalisation attendue au quatrième trimestre 2026. La société, fondée à Toronto en août 2023, avait levé 169 millions de dollars en février 2026. Son approche est radicalement différente des GPU classiques : plutôt que de créer des accélérateurs polyvalents, Taalas grave un modèle d'IA précis directement dans le silicium, selon l'AMD official press release.

La puce, pas le logiciel

La puce phare de Taalas, la HC1, est optimisée pour Llama 3.1 8B et affiche des performances de 16 960 tokens par seconde — soit 48 fois plus rapide que les GPU Nvidia selon les chiffres internes de la société. Le coût d'usage est de 0,75 centime par million de tokens, contre 3,79 centimes pour le Nvidia B200, d'après une analyse de The Register. Ces performances sont auto-déclarées par Taalas et n'ont pas encore été validées par des tiers indépendants à l'échelle de production. La HC1 fonctionne sous 250 W, gravée en TSMC 6 nm, sans mémoire HBM, selon un descriptif technique d'Explainx.ai.


La puce Taalas HC1 pour l'IA. Illustration : Taalas

Ce que ça change pour les data-centers

Pour les opérateurs de centres de données qui font tourner les mêmes modèles pendant des années — recherche, recommandation, traduction — cette spécialisation est économiquement très attractive. L'économie sur le coût par token peut représenter des millions d'euros à grande échelle, un argument direct pour des acteurs comme OVHcloud. La contrepartie est réelle : changer de modèle d'IA implique un nouveau silicium. Seules deux couches métalliques sont à modifier, ce qui réduit le coût de re-fabrication, mais le délai et le prix d'un HC2 (Llama 3.1 20B) ne sont pas encore communiqués.


Diagramme comparant la vitesse du Taalas HC1 et de ses concurrents — tokens par seconde par utilisateur. Illustration : Taalas

Le contexte AMD face à Nvidia

AMD accélère ses acquisitions dans l'IA après Silo AI et ZT Systems. Cette opération s'inscrit dans une course directe avec Nvidia, qui avait racheté Groq pour 20 milliards de dollars en décembre 2025. Les deux entreprises visent la même couche applicative : l'inférence, c'est-à-dire le moment où un modèle d'IA répond à une requête réelle. Aucune annonce de disponibilité n'a été faite pour la France ni pour les partenaires européens. Le montant de l'acquisition de Taalas reste confidentiel.