En bref

  • Contenu indépendant et sourcé.
  • Usage encadré des LLM : accélérer la mise en forme, pas décider.
  • Validation humaine systématique avant publication.
  • Séparation faits / hypothèses.
  • Datation et révision visibles sur chaque article.

Pourquoi une méthode explicite

La recherche sur les modèles de langage progresse vite. Les affirmations circulent, se déforment, se reprennent sans source. Ce site documente sa pipeline éditoriale pour trois raisons : (1) traçabilité — chaque affirmation publiée peut être retrouvée dans sa source d'origine ; (2) sourçage — un article n'est publié qu'après vérification croisée des faits ; (3) fiabilité — les articles portent un niveau de preuve explicite et sont révisables quand la littérature évolue.

Cette page décrit exactement comment une source brute — un papier de recherche, une documentation technique, une expérience pratique — devient un article publié, avec ce qui est garanti et ce qui ne l'est pas.


Le pipeline éditoriale en cinq étapes

Chaque article suit les cinq étapes ci-dessous, dans cet ordre. Aucune n'est facultative.

Étape 1 — Collecte

Les sources proviennent de quatre canaux complémentaires : (1) les sources académiques — arXiv, Semantic Scholar, ACL Anthology ; (2) une veille automatisée via des scripts Python qui surveillent dépôts et flux des centres de recherche ; (3) les signaux GitHub — releases et commits significatifs des projets de référence ; (4) des bookmarks curatés manuellement à partir de lectures techniques et de conférences. Chaque source est stockée dans sa forme brute, horodatée, et rattachée au sujet qu'elle documente.

Étape 2 — Extraction

Des scripts d'extraction structurée isolent dans les sources brutes les affirmations vérifiables : faits, chiffres, résultats expérimentaux, citations exactes. L'extraction sépare explicitement ce qui relève du factuel de ce qui relève de l'interprétation. Seuls les éléments factuels entrent dans la suite du pipeline comme matériau publiable ; les interprétations peuvent être citées, mais sont signalées comme telles, avec leur auteur.

Étape 3 — Traitement LLM

Un modèle de langage analyse, structure et reformule le contenu extrait. Son rôle est explicite : accélérer la mise en forme et la mise en relation entre sources, pas décider du contenu. Le modèle propose une rédaction candidate à partir des éléments factuels extraits ; il ne choisit pas ce qui est publiable. Cette étape est un outil d'écriture, pas un organe de décision éditoriale.

Étape 4 — Gate humaine

Chaque affirmation publiée est validée manuellement avant publication. Le modèle propose, l'auteur tranche. Aucun contenu n'est auto-publié. À cette étape, les contradictions entre sources sont arbitrées, le niveau de preuve de chaque fait est fixé (voir ci-dessous), les passages reposant sur une seule source sont explicitement signalés dans le texte, et les formulations sont confrontées à la source originale pour éviter toute dérive de sens.

Étape 5 — Publication

L'article est daté, versionné, et publié avec ses liens vers les sources primaires citées. Chaque article porte une date de publication et une date de dernière révision. Une mise à jour est publiée explicitement si une source est modifiée par son auteur, si une publication ultérieure contredit un fait établi, ou si la littérature évolue significativement sur le sujet. Les révisions sont horodatées et la version de l'article est incrémentée.


Les niveaux de preuve

Chaque fait publié porte un niveau de preuve explicite, du plus faible au plus fort :

  1. Spéculatif — hypothèse non confirmée par une source. Non publié en public ; mentionné seulement en étant explicitement signalé comme spéculation.
  2. Une source — affirmation issue d'une seule source, sans confirmation croisée. Marquée explicitement comme non vérifiée dans le texte.
  3. Répliqué — confirmé par au moins deux sources indépendantes, ou par une expérience dont les données brutes sont conservées et consultables.
  4. Triangulé — admis par la communauté de recherche, sans controverse active ; cité par des sources de natures différentes (papiers, documentation, retours terrain).

Un article public s'appuie majoritairement sur des faits de niveau répliqué ou triangulé. Les passages qui reposent sur une seule source sont explicitement signalés dans le corps du texte.


Ce que ce site ne fait pas

  • Pas de contenu non sourcé. Chaque affirmation publiée est rattachée à une source identifiable. Aucune affirmation sans source n'est publiée en public.
  • Pas de paraphrase sans attribution. Reformuler une idée ne dispense pas de citer son auteur. Les idées non triviales sont explicitement attribuées.
  • Pas de contenu promotionnel. Les articles ne servent pas à vanter un produit, un modèle ou un acteur. Forces et limites sont présentées côte à côte.
  • Pas d'exhaustivité. Ce site couvre ce qui est lu et vérifié, pas l'intégralité de la littérature. Un sujet absent ne l'est pas par choix éditorial, mais par limite de temps disponible.
  • Pas de garantie zéro erreur. Les erreurs résiduelles existent. Elles sont corrigées via le mécanisme de révision, et toute correction significative est datée.

Signaler une erreur ou une source manquante

Un article contient une erreur factuelle, une source manquante, ou une affirmation que vous pouvez étayer par une meilleure source ? Le signalement est bienvenu. Préciser : l'URL de l'article, le passage concerné (citation exacte ou titre de section), la source qui infirme ou précise l'affirmation. La correction est publiée avec mention explicite dans l'historique de révision de l'article.


Ce que cette méthode ne garantit pas

  • Exhaustivité totale sur un domaine qui change vite.
  • Absence de toute erreur.
  • Stabilité des conclusions — des révisions restent possibles quand la littérature évolue.