Commission d'enquête · locuteurs
Base de données des prises de parole
Construite à partir de la diarisation (pyannote) et de la transcription horodatée des auditions. Pour chaque locuteur : durée totale, tours, chevauchements audio, débit et niveau de langage (LLM local).
Chargement de la couverture du corpus officiel…
Temps de parole par genre
Temps de parole par profession
| Locuteur | Profession | Durée | Tours | Tour moy. | Chev. ± | Débit | Niveau |
|---|
Méthode. Durées et tours : transcription horodatée (un « tour » = segments consécutifs d'un même locuteur, fusion < 2 s). Chevauchements audio : paroles simultanées d'au moins 0,3 s détectées dans la diarisation ; ils ne prouvent pas une interruption volontaire. Niveau de langage : métriques (TTR = diversité lexicale) + classification par LLM local (Ollama).
Limite. L'attribution des locuteurs est automatique (diarisation) : elle peut comporter des erreurs d'affectation. À lire comme un ordre de grandeur tant que l'échantillon audio manuel n'est pas validé. Corpus canonique : page officielle de la commission d'enquête.
Limite. L'attribution des locuteurs est automatique (diarisation) : elle peut comporter des erreurs d'affectation. À lire comme un ordre de grandeur tant que l'échantillon audio manuel n'est pas validé. Corpus canonique : page officielle de la commission d'enquête.