SFEIR
ZML Technologie

ZML

Pile d'inférence LLM écrite en Zig, éditée par une société parisienne, qui compile un même modèle vers des accélérateurs de constructeurs différents.

SFEIR AI · Publié le 24 juillet 2026 · Mis à jour le 15 septembre 2026

Un même modèle, des accélérateurs différents

ZML est une pile d'inférence IA écrite en Zig, fondée sur OpenXLA, MLIR et Bazel. Son objet est de découpler les modèles du matériel : compiler une fois, exécuter sur des GPU NVIDIA, AMD ou Intel Arc, des TPU Google, Apple Metal ou AWS Trainium, depuis une base de code unique. Le dépôt public existe depuis le 17 septembre 2024, sous licence Apache 2.0.

L'éditeur est ZML, laboratoire d'ingénierie IA basé à Paris, fondé en 2023 par Steeve Morin, ancien VP Engineering de Zenly. La société a levé 20 millions de dollars auprès de 20VC, Kima Ventures, Kindred Capital, LocalGlobe et d'autres fonds.

Le framework est ouvert, le serveur d'inférence ne l'est pas

La distinction commande l'évaluation. Le framework ZML publié en 2024, mis à jour en mars 2026 et présenté au FOSDEM 2025, est bien open source sous Apache 2.0. ZML/LLMD, le serveur d'inférence pour modèles de langage lancé le 8 juillet 2026, ne l'est pas : il est distribué comme produit gratuit. Gratuit et ouvert ne sont pas la même chose, et sur une brique dont l'argument est la réversibilité, la nuance porte.

Une pièce d'un projet de pile européenne, annoncé en juin 2026

Le 18 juin 2026, à VivaTech, la Région Île-de-France, Scaleway, VSORA et ZML ont signé un partenariat pour une pile IA souveraine européenne : Scaleway opère l'infrastructure, VSORA fournit la puce Jotunn8, ZML unifie la couche logicielle. C'est une annonce, pas un déploiement — la puce Jotunn8 n'était pas en production à cette date. ZML reste par ailleurs une société indépendante, antérieure de près de deux ans à ce partenariat.

L'intérêt pour la souveraineté tient à l'agnosticisme matériel plus qu'au drapeau : une couche d'inférence qui compile vers plusieurs familles d'accélérateurs réduit la dépendance à un fournisseur de silicium, et c'est un levier de réversibilité vérifiable, indépendamment du sort d'un partenariat.

Questions fréquentes

Qui édite ZML et depuis quand ?

ZML, un laboratoire d'ingénierie IA parisien fondé en 2023 par Steeve Morin, ancien VP Engineering de Zenly. Le dépôt public du framework existe depuis septembre 2024 et la société a levé 20 millions de dollars auprès de 20VC et d'autres fonds.

ZML est-il open source ?

Le framework l'est, sous licence Apache 2.0, sur le dépôt zml/zml. Le serveur d'inférence ZML/LLMD, lancé le 8 juillet 2026, est gratuit mais n'est pas open source. Les deux portent le même nom sans avoir le même statut.

Quelle est la relation entre ZML et Scaleway ?

Un partenariat signé le 18 juin 2026 avec la Région Île-de-France, Scaleway et VSORA, visant une pile IA souveraine européenne. ZML y apporte la couche logicielle. C'est un partenariat annoncé, pas un rattachement : ZML est une société indépendante.

Sur quel matériel ZML tourne-t-il ?

Une même base de code cible les GPU NVIDIA, AMD et Intel Arc, les TPU Google, Apple Metal et AWS Trainium, via Zig, MLIR et OpenXLA. C'est cet agnosticisme matériel qui constitue l'argument de réversibilité de la pile.

À quoi sert une pile d'inférence ?

À exécuter des modèles de langage sur une infrastructure donnée : c'est la couche qui transforme des poids de modèle en service utilisable. Disposer d'une inférence performante hébergée en Europe évite de dépendre d'API soumises à un droit extraterritorial.

Faut-il confondre ZML et ZenML ?

Non. ZML est une pile d'inférence écrite en Zig ; ZenML est une plateforme MLOps sans rapport. Le fondateur de ZML insiste lui-même sur la distinction, l'homonymie étant fréquente dans les résultats de recherche.

Sources

ZML dans vos projets

Échanger avec SFEIR

Articles liés