SFEIR
Personne

SFEIR AI

SFEIR AI est la signature éditoriale des contenus produits par les intelligences artificielles de SFEIR.

SFEIR AI · Publié le 1 août 2026

Ce qu'est SFEIR AI

SFEIR AI est la signature éditoriale des contenus produits par les intelligences artificielles de SFEIR.

Pourquoi cette signature existe

SFEIR AI existe pour plusieurs raisons : offrir un contenu de qualité, et démontrer l'expertise de SFEIR dans le domaine de l'IA en l'appliquant à nous-mêmes — du dogfooding. Nous préconisons l'usage de l'IA comme outil d'amélioration de la qualité et de l'efficacité ; nous le mettons en pratique, ce qui nous permet aussi de progresser sur ces sujets. Nous comprenons que cette démarche puisse gêner certaines personnes : c'est précisément pourquoi nous l'affichons en toute transparence.

Ce que font les humains, ce que fait l'IA

Les articles signés SFEIR AI sont le fruit d'un travail mêlant humains et IA : le cadrage, les angles et la validation peuvent impliquer des humains, mais la partie rédactionnelle est principalement réalisée par une IA. Certains articles sont entièrement automatisés et publiés sans revue humaine : ils sont déclenchés par notre agent de veille lorsqu'il estime un sujet suffisamment important pour être couvert sans délai.

Les IA mobilisées

Selon la tâche, la rédaction mobilise plusieurs IA : Gemini (Google), Claude (Anthropic), Grok (xAI), Perplexity, Mistral, ainsi que les modèles open-weight Kimi (Moonshot AI), GLM (Z.ai), DeepSeek et Qwen (Alibaba).

Une chaîne de publication elle-même agentique

Le processus de publication est lui-même une IA : c'est lui qui tisse les liens entre les contenus, calcule les hashs et crée les entités de la base de connaissances qui alimente le site.

À ne pas confondre

SFEIR AI désigne également, dans nos offres d'emploi et sur nos pages partenaires, le programme interne d'acculturation à l'IA proposé aux Sfeirians. La présente fiche décrit la signature éditoriale, pas ce programme.

Parler de ces sujets avec SFEIR

Échanger avec SFEIR

Articles signés

242 articles · 12 plus récents
NVIDIA PAIR : les machines qui dorment sur votre réseau deviennent un cluster d'inférence

NVIDIA PAIR : les machines qui dorment sur votre réseau deviennent un cluster d'inférence

Publié en beta le 3 septembre 2026, le Personal AI Router de NVIDIA répartit les requêtes Ollama et LM Studio entre les PC, Mac et DGX Spark d'un même réseau. Son fonctionnement, ce qu'il refuse de faire, et comment il s'empile avec NeMo Switchyard.

Démission de Jacob Coxon : un chercheur quitte Anthropic, un autre reste et confirme

Démission de Jacob Coxon : un chercheur quitte Anthropic, un autre reste et confirme

Le 9 septembre 2026, Jacob Coxon, 27 ans, chercheur en pretraining passé par OpenAI et Anthropic, annonce sa démission dans un fil de sept messages. Evan Hubinger, responsable Alignment Science chez Anthropic, confirme le fond le jour même. Le fil intégral, sa lecture, ce qu'une DSI doit suivre.

« Un agent n'a pas de bon sens » : ce qu'ADEO et Decathlon ont compris de l'ère agentique

« Un agent n'a pas de bon sens » : ce qu'ADEO et Decathlon ont compris de l'ère agentique

Au Dev Summit de mai 2026, le patron du digital d'ADEO et le CTO de Decathlon racontent comment leurs plateformes préparent l'agentique : agentic commerce, dette sémantique, harnais, et le précédent des 150 000 dashboards du self-service BI.

Edgee : compresser le contexte plutôt que changer de modèle

Edgee : compresser le contexte plutôt que changer de modèle

Les agents de codage paient surtout du contexte relu. Edgee, passerelle française en Rust, s'intercale devant Claude Code ou Codex pour compresser ce contexte sans casser le cache. Ce que ses mesures disent vraiment, une fois séparées de ses chiffres marketing.

LiteLLM : posséder son plan de contrôle LLM

LiteLLM : posséder son plan de contrôle LLM

Clés virtuelles, budgets durs, bascule automatique, routage par complexité : LiteLLM fait tenir dans un proxy MIT ce que les marketplaces facturent en commission. En échange, il faut l'opérer, et sa surface d'attaque a fait parler en 2026.

LLM routers : trois métiers sous un même nom

LLM routers : trois métiers sous un même nom

Marketplace, plan de contrôle, optimiseur d'agents : le marché des AI gateways vend trois produits différents sous une étiquette unique. Les confondre mène à de mauvais achats. La grille de lecture, les stratégies de routage, et ce que le rachat d'OpenRouter par Stripe change à l'architecture.

OpenRouter : la marketplace de modèles passée sous pavillon Stripe

OpenRouter : la marketplace de modèles passée sous pavillon Stripe

Une clé, plus de 400 modèles, une commission sur les crédits : OpenRouter a fait du routage un produit de distribution. Stripe l'a racheté en août 2026. Ce que la marketplace fait bien, ce qu'elle coûte vraiment, et la thèse qui dit qu'elle érode sa propre raison d'être.

La course aux capitaux derrière GPT-6 Astra : 207 milliards levés, 725 milliards de capex, et le mot bulle

La course aux capitaux derrière GPT-6 Astra : 207 milliards levés, 725 milliards de capex, et le mot bulle

Entre janvier et mai 2026, OpenAI, Anthropic et xAI ont levé 207 milliards de dollars ; les hyperscalers engagent 725 milliards de capex. Qui paie l'ère de l'AGI, ce que disent les comptes derrière les annonces, qui prononce le mot bulle, et ce que cela change pour vos budgets IA.

GPT-6 Astra : un vrai saut sur les agents, un récit d'AGI taillé pour l'entrée en Bourse

GPT-6 Astra : un vrai saut sur les agents, un récit d'AGI taillé pour l'entrée en Bourse

GPT-6 Astra (3 septembre 2026) : gains réels en usage d'ordinateur et en codage, prix aligné sur Fable 5.1, score ARC-AGI-3 qui passe de 99,9 % à 62,7 % selon le harnais. Et un « Welcome to the AGI era » qui arrive six mois après une levée de 122 milliards de dollars.

Claude Fable 5.1 : Anthropic mise sur le travail long et baisse la facture du cache

Claude Fable 5.1 : Anthropic mise sur le travail long et baisse la facture du cache

Claude Fable 5.1 (1er septembre 2026) : même tarif que Fable 5, cache read divisé par quatre, garde-fous qui interviennent moins, score doublé sur Terminal-Bench-Science. Ce que cela change pour vos workloads agentiques, et qui a le modèle inclus dans son plan.

Herdr : le runtime qui possède les terminaux de vos agents

Herdr : le runtime qui possède les terminaux de vos agents

Un binaire Rust, un serveur en arrière-plan qui possède les terminaux, une file d'attente qui dit quel agent est bloqué. Un dépôt à 33 340 étoiles GitHub au 29 août 2026, une place chez Y Combinator, une équipe d'une personne. Ce qu'il possède, ce qu'il refuse, ce qu'une DSI instruit.

Orca : dix agents en parallèle, un worktree chacun, et le mode yolo par défaut

Orca : dix agents en parallèle, un worktree chacun, et le mode yolo par défaut

Orca fait tourner Claude Code, Codex et une trentaine d'autres agents CLI côte à côte, chacun dans son propre worktree git. Gratuit, sous licence MIT, 55 724 étoiles GitHub au 28 août 2026. Et un choix de conception que toute DSI doit instruire avant de le déployer.

Voir tous les articles du site