Les onze étapes
Le schéma complet, de la file de tâches à la publication.
Les onze étapes de la méthode
Chaque étape tourne sur les ordinateurs du projet, reliés par une application de calcul distribué. Cliquez sur une étape : ce qu’elle fait, avec quoi, ce qu’elle écrit, et ce qu’on en sait sur sa fiabilité.
01 · Repérer
Les flux RSS des chaînes YouTube sont relevés toutes les six heures ; chaque semaine, la liste complète des vidéos de chaque chaîne est relue, pour YouTube comme pour TikTok. Une vidéo repérée reçoit sa date de publication et entre dans la file ; celles des sept derniers jours passent devant tout le reste.
- Cadence
- RSS toutes les 6 h, liste complète chaque semaine
- Priorité
- sept derniers jours d’abord, puis depuis avril 2026, puis l’arriéré
- Écrit
- vidéos repérées, date, file de tâches
02 · Extraire
La vidéo, ses métadonnées (titre, durée, vues, mentions « j’aime », nombre de commentaires annoncé) et ses commentaires sont extraits. L’audience est relevée de nouveau à J+1, J+7 et J+30, puis lors des passages mensuels. Un retrait de la vidéo est noté avec sa raison quand la plateforme la donne.
- Outils
- yt-dlp, flux RSS, API publiques des plateformes
- Relevés
- J+1, J+7, J+30, puis mensuels
- Écrit
- métadonnées, historique d’audience, commentaires, suppressions
03 · Isoler la voix
La piste audio est séparée de la musique et des bruits (Demucs), pour que la reconnaissance vocale n’ait que la parole à lire. Sur les petits ordinateurs, cette étape tourne seule, modèle par modèle, pour tenir en mémoire.
- Modèle
- Demucs (htdemucs)
- Écrit
- piste voix temporaire, supprimée après transcription
04 · Distinguer les locuteurs
Les tours de parole sont attribués à des locuteurs anonymes (A, B, C…) par diarisation (pyannote). Les locuteurs ne sont jamais identifiés : la fiche parle du « vidéaste », de « l’invitée ».
- Modèle
- pyannote 3.1
- Écrit
- tours de parole, nombre de locuteurs, part du principal
05 · Transcrire
Whisper (large-v3-turbo, sur MLX) transcrit chaque tour de parole dans la langue parlée, détectée par fenêtres : une vidéo française reste en français, une vidéo américaine en anglais, une vidéo mixte segment par segment. Une vidéo sans parole est marquée comme telle.
- Modèle
- Whisper large-v3-turbo (MLX)
- Qualité
- la fiche automatique note la fiabilité de la transcription (bonne, moyenne, faible)
- Écrit
- transcription brute et nettoyée, par tour de parole
06 · Découper en phrases
Les tours de parole sont découpés en phrases par un modèle de segmentation (SaT), avec un plafond de 510 jetons par unité, pour que chaque classifieur lise une phrase entière et jamais un fragment.
- Modèle
- SaT (wtpsplit)
- Garde-fou
- anomalies de segmentation détectées et re-segmentées
- Écrit
- phrases numérotées, rattachées à leur tour de parole
07 · Politique ou non
Chaque phrase est classée politique ou non par un classifieur CamemBERTav2 entraîné sur des annotations humaines, puis rattachée à neuf thèmes par neuf classifieurs binaires. Les classifieurs sont entraînés sur du français : les chaînes anglophones n’y passent pas.
- Modèles
- CamemBERTav2, un classifieur par étiquette
- Fiabilité
- F1 et précision contrôlée publiées plus bas
- Écrit
- étiquette et probabilité par phrase et par classifieur
08 · Les personnes citées
Les entités nommées sont extraites (GLiNER, multilingue) ; elles servent de garde-fou. Les comptes publiés viennent d’une liste fermée de personnalités publiques, de partis, d’organisations, de médias et de pays, reconnus dans les phrases par des motifs vérifiés. Un particulier n’est jamais compté.
- Modèle
- GLiNER (entités), liste fermée (comptes)
- Liste
- 240 entrées
- Écrit
- mentions par vidéo et par entrée
09 · Résumer
Notre modèle de langue local local (Gemma 4, 31 milliards de paramètres) rédige pour chaque vidéo de la semaine une fiche : titre, résumé, thèses avec leur sujet et leur intervenant, personnalités citées, fiabilité de la transcription, en français et en anglais. La fiche est vérifiée contre la transcription ; un nom qui pourrait être celui d’un particulier la retient.
- Modèle
- Gemma 4 31B, sur les ordinateurs du projet
- Garde-fou
- noms vérifiés contre la liste fermée ; fiche retenue en cas de doute
- Écrit
- fiche par vidéo, synthèses du jour et de la semaine, fiches des vidéos supprimées
10 · Dégager les arguments
Pour chaque thème et chaque période, un échantillon de phrases politiques est tiré avec des quotas par orientation et un plafond par chaîne ; le modèle de langue en dégage les arguments, sépare ceux qui sont avancés de ceux qui sont contestés, et chaque argument est relié aux phrases qui le portent.
- Échantillon
- 120 phrases par tirage, deux tirages rapprochés
- Écrit
- arguments, citations, parts par orientation pondérées
11 · Publier
Toutes les heures, les comptes par vidéo sont recalculés et le site est actualisé : vidéos de la semaine, thèmes, personnalités, tendances, chaînes, suppressions, en français et en anglais. Les mêmes données sont servies en JSON et, avec une clé, par l’explorateur et l’API.
- Cadence
- toutes les heures
- Mesures
- comparaisons entre orientations en moyenne par vidéo
- Écrit
- ce site, les fichiers JSON et CSV, l’explorateur et l’API