Méthode

Comment Serenaid construit une information fiable

Cette section s'adresse aux chercheurs, aux professionnels, aux partenaires et aux financeurs. Elle décrit la façon dont nous rassemblons, relions et restituons la connaissance, ce que nous savons faire et ce que nous ne savons pas encore faire.

Chiffres mesurés le .

Le problème : s'orienter avec une information fiable

Quand un enfant présente un trouble du neurodéveloppement (TND) — TDAH, trouble du spectre de l'autisme, troubles dys, trouble du développement intellectuel —, sa famille doit comprendre ce qui se passe, savoir à qui s'adresser, et faire valoir des droits. L'information existe : recommandations de la Haute Autorité de santé, expertises de l'INSERM, pages de la CNSA et de la Caf, guides d'associations. Elle est dispersée, écrite pour des publics différents, et de fiabilité inégale.

Serenaid relie ces sources et les restitue de façon compréhensible, sans rien ajouter qu'une source ne dise. Les familles y accèdent par un parcours par besoin, par les questions que se posent les parents et par l'annuaire des professionnels et des structures.

Du document source au texte lu par une famille Les documents des sources entrent d’abord dans le corpus documentaire, où chacun est découpé en passages. La dérivation en tire des liens entre concepts, chacun attesté par une citation. Ces liens forment le graphe de concepts. La rédaction s’appuie sur les passages et les liens, cite ses sources et passe une validation, puis le même contenu est reformulé pour sept publics. Sources HAS, INSERM, CNSA, sociétés savantes… Corpus documentaire un document par page, découpé en passages Dérivation chaque lien est attesté par une citation Graphe de concepts troubles, professions, aides, parcours… Rédaction encadrée extraits cités, puis validation Sept publics parent, enfant, FALC, professionnels…
Une source nouvelle entre toujours par le corpus documentaire : rien n’est inscrit directement dans le graphe.

Une base de connaissances, pas une base de données

Une base de données range des fiches dans des tableaux. Une base de connaissances décrit des concepts — un trouble, une profession, une aide, un type de structure, une étape de parcours — et les relations qui les unissent : « l'orthophoniste prend en charge les troubles du langage », « cette aide est versée par la Caf ». C'est ce réseau de relations, et non chaque fiche isolée, qui permet de répondre à une question comme « à qui m'adresser, et qu'est-ce qui peut être financé ? ».

Exemple : l'Allocation d'Éducation de l'Enfant Handicapé (AEEH)

Voici, telles qu'elles existent aujourd'hui, les relations du graphe qui touchent l'AEEH. Pour chacune : le nombre d'attestations (une par document) et le meilleur grade de preuve parmi elles.

  • MDPH instruit ou verse AEEH

    13 attestations · meilleur grade AE · Handicap Agir Tôt, Ma Boussole Aidants, Allo Ortho

  • AEEH est financée ou versée par Caf — Caisse d'allocations familiales

    6 attestations · meilleur grade AE · Ma Boussole Aidants, CNSA, Ministères économiques et financiers

  • AEEH est financée ou versée par MSA — Mutualité sociale agricole

    3 attestations · meilleur grade AE · Mon Parcours Handicap, CNSA, CAF et MSA

  • AEEH peut être ouverte pour Trisomie 21

    1 attestation · meilleur grade B · HAS

  • AEEH peut être ouverte pour Troubles du Neurodéveloppement (TND)

    1 attestation · meilleur grade B · aucun document du corpus rattaché

  • AEEH peut financer Aidance et soutien aux proches aidants

    1 attestation · meilleur grade AE · CNSA

  • Caf — Caisse d'allocations familiales instruit ou verse AEEH

    1 attestation · meilleur grade AE · Ministères économiques et financiers

La relation « AEEHpeut être ouverte pour Troubles du Neurodéveloppement (TND) » repose encore sur une citation héritée d'une version antérieure du graphe, sans document du corpus rattaché : c'est exactement le type de lien que nous repérons et reprenons. Le graphe ne relie pas directement l'AEEH au TDAH ou à l'autisme : aucune source du corpus n'a encore été dérivée en ce sens.

Ce que ces relations donnent à lire : la fiche AEEH et ses sources, la question « AEEH : conditions, montants, démarches » et la page de besoin sur les aides financières.

Citer plutôt qu'inventer

Une relation n'entre dans le graphe que si un document la dit explicitement. Elle porte alors une attestation : la phrase citée mot pour mot, le document qui la contient, la page quand elle existe, et le grade de preuve du document, de la preuve scientifique établie (A) au retour d'expérience (RE).

Quand plusieurs documents disent la même chose, on ne garde pas « le meilleur » : on conserve la liste. La fiabilité d'une relation se lit alors en deux nombres : combien de documents l'attestent, et quel est le meilleur grade parmi eux. Aujourd'hui, 655 relations sur 2 726 sont attestées par au moins deux documents ; la plus citée l'est par 18.

Les documents viennent d'autorités identifiées — institutions sanitaires, Haute Autorité de santé et INSERM, organismes médico-sociaux, sociétés savantes, associations, éditeurs de programmes — dont la liste est fermée dans le code : une source nouvelle doit y être inscrite nommément. Le détail du modèle est décrit dans le modèle de connaissances en détail.

Une rédaction encadrée par les sources

Les textes que lisent les familles sont rédigés par un modèle de langue (Mistral Small, hébergé en France par Scaleway). Le modèle ne puise pas dans ce qu'il « sait » : il reçoit uniquement des extraits sélectionnés et des relations du graphe, et doit s'y tenir.

  1. Récupérer les bons extraits. Pour un concept, on sélectionne les passages du corpus les plus proches par le sens, en limitant le nombre de passages venant d'une même source. Les documents signalés comme périmés ou retirés sont exclus. Sans au moins trois passages pertinents, aucun texte n'est rédigé.
  2. Rédiger en citant. Chaque phrase factuelle doit renvoyer à l'extrait ou à la relation qui la fonde. La génération est déterministe (température nulle) : à extraits identiques, texte identique.
  3. Relire automatiquement. Une étape de validation vérifie que les renvois existent, que les phrases factuelles sont citées, et que chaque organisme, sigle, chiffre ou date du texte figure bien dans les extraits ou dans les relations fournies.
  4. Refuser plutôt que se tromper. Si le texte n'atteint pas le seuil de validation après deux essais, il n'est pas publié. La page affiche à la place les extraits des sources eux-mêmes, avec leurs références. C'est aujourd'hui le cas de 150 textes sur 6 267 (2,4 %).

Ce choix a un coût : un texte composé d'extraits est moins fluide. Mais il ne peut pas affirmer ce que la source ne dit pas.

Une seule base, 7 publics

Pour un même concept, les mêmes extraits et les mêmes relations servent à rédiger plusieurs versions, chacune pour un lecteur. Le fond ne change pas d'une version à l'autre : seule la manière de l'écrire change.

  • Résumé — l’essentiel en quelques phrases 825 textes
  • Parent — le texte par défaut, en langage courant 973 textes
  • Parent averti — plus de détails, le vocabulaire des professionnels expliqué 897 textes
  • Enfant — des phrases courtes, pour l’enfant lui-même 896 textes
  • FALC — facile à lire et à comprendre 898 textes
  • Professionnel de santé — vocabulaire clinique, niveau de preuve 893 textes
  • Professionnel de l’éducation — aménagements et dispositifs scolaires 885 textes

Les chiffres

Mesurés le sur la base de production. Leur définition exacte est donnée dans la méthode de comptage.

788concepts
répartis en 22 types
2 726relations entre concepts
de 50 types différents
4 092attestations
citations de documents qui fondent ces relations
1 333documents dans le corpus
18 105 passages
657références « à lire »
guides, pages et vidéos proposés aux familles
6 267textes rédigés
pour 7 publics

Ce que la méthode ne garantit pas

  • Un corpus centré sur la France. Les documents sont très majoritairement francophones et décrivent le système français (MDPH, Éducation nationale, Assurance maladie). Les publications scientifiques internationales n'y entrent que par les recommandations qui les synthétisent.
  • Une validation automatique n'est pas une relecture d'expert. Elle vérifie qu'un texte s'en tient à ses sources ; elle ne juge pas si la source est la meilleure, ni si un passage a été bien compris.
  • Des attestations à reprendre. 79,9 % des attestations sont rattachées à un document identifié, et 125 sont des renvois internes vers un parcours ou l'ontologie. Les 697 autres (17 %) sont des citations héritées d'une version antérieure du graphe, sans document rattaché : le chantier qui les rattache ou les relit est en cours, suivi dans notre registre des lacunes (détail par cas).
  • Une connaissance à réalimenter. Une source se périme ; une notion change de nom. Une veille repère les nouvelles publications des sites suivis, mais leur entrée dans le corpus reste une décision humaine, et nous n'avons pas encore d'outil pour réintégrer une page déjà ingérée qui a changé. 57,9 % des passages du corpus sont aujourd'hui reliés à au moins un concept.
  • Des lacunes connues. Nous tenons un registre de ce que nous savons ne pas savoir : 38 lacunes ouvertes ou en cours de traitement au 8 octobre 2026, décrites sur la page du modèle.

Serenaid informe et oriente ; il ne remplace ni un diagnostic, ni l'avis du professionnel qui suit l'enfant. La politique éditoriale et de correction est décrite sur la page transparence et rigueur scientifique, l'état des audits réglementaires sur le tableau de bord de conformité.

Aller plus loin