Intermédiaire·3 min·8 juillet 2026

ZML libère un moteur d'inférence gratuit compatible tous chips

🎧 Résumé audio0:00 / 0:00
Une startup parisienne vient de casser le monopole Nvidia en créant un logiciel qui fait tourner l'IA sur n'importe quel processeur.
ZML libère un moteur d'inférence gratuit compatible tous chips

Pourquoi ça compte pour toi

Aujourd'hui, choisir un chip IA, c'est souvent choisir Nvidia ou accepter des pertes de performance. ZML/LLMD change la donne : tu peux maintenant mixer les processeurs (AMD, Google TPU, Apple, Intel) sans pénalité de vitesse. Pour une startup ou une PME, ça signifie réduire tes factures d'inférence et ne plus être otage d'un seul fournisseur.

Ce qu'il faut retenir

  • 1.ZML/LLMD : logiciel gratuit qui optimise l'inférence LLM sur GPU Nvidia, AMD, TPU, Apple Metal, Intel Arc — au même niveau de perfo ou mieux
  • 2.Soutenu par Yann LeCun (Turing Award) ; levée de 20M$ par 20VC, Kima Ventures et autres VCs sérieuses
  • 3.Stratégie : lancer gratuit d'abord, monétiser après avoir compris les vrais cas d'usage (pas de tarification agressive d'entrée)
  • 4.Équipe ultra-lean (20 personnes) mais bien financée ; le fondateur Steeve Morin vient de Zenly (acquis par Snapchat pour 9 chiffres)

Tu galères avec le jargon ?

Lis la version réécrite en mode débutant — toutes les idées, sans le jargon.

Pourquoi l'inférence devient le vrai enjeu

L'entraînement des modèles IA, c'était hier. Aujourd'hui, ce qui coûte cher et bouffe les ressources, c'est l'inférence — le moment où le modèle traite tes prompts. Et comme par hasard, c'est aussi là où Nvidia a construit sa forteresse : presque tous les serveurs d'inférence sont optimisés pour ses GPU. De la dépendance fournisseur classique.

ZML casse ce cycle. Son nouveau produit ZML/LLMD est un serveur d'inférence capable de faire tourner les mêmes modèles LLM sur des architectures différentes — Nvidia bien sûr, mais aussi AMD, Apple Metal, Google TPU, Intel Arc — sans sacrifier la vitesse. Parfois même plus rapide.

Qu'est-ce que ça change concrètement ?

Imagine que tu dois déployer une IA pour ta boîte. Aujourd'hui :

  • Tu achètes des GPU Nvidia (chers)
  • Tu les loues (TechCrunch:"/2026/07/08") (factures récurrentes élevées)
  • Tu espères que personne ne te vole ta place

Avec ZML/LLMD :

  • Tu regardes les prix des différents chips disponibles ce mois-ci
  • Tu mixes : des AMD moins chers ici, des TPU là, des Arc ailleurs
  • Tu économises 20, 30, parfois 40% sur la facture d'inférence
  • Zéro perte de perfo

Le truc fou : ZML a décroché des partenariats avec des fabricants de chips européens (Axelera, SiPearl, etc.) qui arrivent à peine sur le marché. C'est sa vraie stratégie — ne pas juste concurrencer Nvidia, mais créer un écosystème où l'IA tourne partout, optimisée partout.

La stratégie de monétisation : attendre avant de vendre

ZML/LLMD se lance gratuitement. Pas d'essai à 30 jours, pas de vente incitative agressive. Pourquoi ? Le fondateur Steeve Morin le dit clairement : d'abord comprendre comment les gens utilisent l'outil, puis inventer un modèle économique cohérent. Pas l'inverse.

C'est rare. Beaucoup de startups se ruent sur la monétisation trop tôt et tuent leur adoption. ZML choisit la croissance d'abord. (À noter : ce n'est pas open source, contrairement à leur première version de 2024 — choix classique pour garder le contrôle du produit.)

Qui finance ZML ?

La cap table parle : 20VC (Harry Stebbings), Kima Ventures (Xavier Niel), mais aussi des figures majeures en equity (pas que du capital) :

  • Solomon Hykes (fondateur Docker et Dagger)
  • Clément Delangue et Julien Chaumond (Hugging Face)
  • Yann LeCun en personne

Quand des gens comme ça engagent leur argent et leur réputation là-dedans, c'est qu'ils voient quelque chose. L'équipe de 20 est bien nourrie.

Le contexte : la course à l'inférence

Les investisseurs appellent ça la « ruée vers l'or de l'inférence ». Des concurrents existent déjà : Baseten (13 milliards de valorisation), Inferact, RadixArk. Mais ZML joue dans une catégorie différente — pas juste un intergiciel, mais une co-conception avec les fabricants de chips eux-mêmes.

La vraie question : à quel moment ça devient payant ? Trop tôt, ils tuent la croissance. Trop tard, ils laissent des miettes aux concurrents. Steeve Morin dit que c'est encore trop tôt pour le dire.

Et concrètement pour toi ?

Choisis ton profil — la lecture de l'article change selon qui tu es.

🔭 Curieux

Pour toi, comprends que Nvidia n'a jamais eu le monopole sur l'IA — juste sur le récit. ZML/LLMD montre que d'autres chips (AMD, Apple, Google) peuvent faire le même travail. Ça change la géopolitique de l'IA et rend la tech moins concentrée.

📊 Cours en bourse

Newsletters Noésis

3 minutes d'IA dans ta boîte mail, chaque matin.

Rejoins les francophones qui comprennent, essaient et progressent avec l'IA. Choisis ce que tu veux recevoir. Désabonnement en 1 clic.

Explorer les thèmes de cet article :