Concept Architecture médaillon
Modèle d'organisation des données en trois couches (bronze, silver, gold) qui raffine progressivement la donnée brute en tables prêtes pour l'analytique.
Une donnée raffinée par couches successives
L'architecture médaillon est un modèle d'organisation des données qui les fait transiter par des couches successives, chacune appliquant plus de nettoyage, de contrôle qualité et d'enrichissement que la précédente. Le nom vient des trois paliers bronze, silver, gold, popularisés par Databricks pour structurer un lakehouse. On parle aussi d'architecture multi-hop : la donnée franchit plusieurs sauts avant d'être consommable.
Les trois couches : bronze, silver, gold
Chaque étage a un rôle précis, et l'on ne saute jamais un palier :
- bronze : la donnée brute ingérée telle quelle depuis les sources, avec ses métadonnées de chargement. Elle sert d'archive historique immuable et de piste d'audit, et permet de retraiter sans re-solliciter les systèmes source.
- silver : la donnée nettoyée par déduplication, normalisation, validation de schéma et règles qualité. Elle consolide une vue d'entreprise cohérente des entités métier, prête pour l'exploration.
- gold : la donnée métier finale (agrégats, modèles en étoile, indicateurs calculés, vues dénormalisées) optimisée pour les tableaux de bord, le reporting et le machine learning.
Un pilier de la stack data moderne
Le médaillon est l'ossature de traitement du lakehouse : il s'implémente aussi bien sur Databricks (via Delta Lake et ses transactions ACID) que sur BigQuery comme moteur de requête et de transformation. Ses bénéfices tiennent à la séparation des préoccupations : traçabilité complète des transformations, réutilisabilité de la donnée à chaque niveau, ETL incrémental, et possibilité de recréer les tables aval depuis la seule couche brute. Il se combine avec le Data Mesh, qui décentralise la propriété par domaine, là où le médaillon régit le raffinage au sein de chaque domaine.
La lecture SFEIR : du raffinage de la donnée à celui des livrables
SFEIR transpose ce modèle des données vers la production à base de connaissance : mêmes paliers raw, bronze, silver, gold, mais l'objet raffiné devient la matière documentaire (sources, extractions, claims) dont on dérive des livrables. Dans les deux cas, un même principe tient : on ne corrige jamais l'étage final, on enrichit l'amont et on régénère.
Questions fréquentes
Que contiennent les couches bronze, silver et gold ?
Bronze stocke la donnée brute ingérée telle quelle (archive immuable, piste d'audit). Silver contient la donnée nettoyée, dédupliquée et normalisée (vue d'entreprise cohérente). Gold livre la donnée métier agrégée et optimisée pour les tableaux de bord, le reporting et le machine learning.
Quelle différence avec la production à base de connaissance de SFEIR ?
La structure est identique (paliers successifs, promotion gouvernée, jamais de correction de l'étage final), mais l'objet change : l'architecture médaillon raffine des données pour l'analytique dans un lakehouse ; la production à base de connaissance applique la même grammaire à la matière documentaire pour générer des livrables.
Articles liés
Raw, bronze, silver, gold : produire la connaissance comme on raffine la donnée
Raw en lecture seule, bronze tracé, silver qui fait foi, gold régénéré : le médaillon appliqué aux livrables. On n'édite plus le document, on enrichit la matière et on régénère. La réponse structurelle au workslop, et la chaîne par laquelle SFEIR produit ses propres supports.
Concevoir et fabriquer à l'ère de l'agentique
Spec-driven devenu standard, Cagan qui acte le déplacement de la valeur vers la discovery, DORA 2025 qui mesure l'amplification : la fabrication du logiciel a basculé. Le cadre SFEIR articule cycle produit, cycle logiciel et base de connaissance en un seul système, où la spec est le prompt.
Une matière, plusieurs représentations : notre site est notre premier client
Notre site contient du contenu de qualité, et sait le régénérer sous d'autres formes. La page que vous lisez et la présentation qui en dérive ne sont pas fabriquées deux fois : elles projettent la même matière. La doctrine PDLC, SDLC, KDLC, appliquée d'abord à notre propre outil.
Au-delà du code : vos documents subissent la même compression
Les livrables écrits pèsent le double du code dans les conversations avec Claude (Anthropic, juin 2026). La compression qui a frappé le logiciel touche rapports, documents et présentations, et produit du workslop quand elle n'est pas gouvernée. Ce qui change pour le DSI et le patron produit.
theKB.eu : anatomie d'un site construit pour les humains et pour les agents
347 fiches de veille sur l'IA, 5 langues, 7 500 pages, sans CMS ni base éditée à la main. Trois étages : une base de connaissance en fichiers, un pipeline de publication, un serveur MCP sans IHM. Comment, et surtout pourquoi, c'est construit ainsi.