14/11/2026 –, B207
Cette conférence présentera la chaîne de traitement que j’utilise pour mes vidéos, basée sur CrisperWhisper pour la transcription et la détection précise des hésitations, FFmpeg pour le traitement audiovisuel et des scripts PHP pour automatiser l’ensemble.
Nous verrons le fonctionnement des différentes étapes, depuis la transcription jusqu’à la génération de la vidéo nettoyée, ainsi que les difficultés rencontrées pour obtenir des découpages naturels.
Les scripts et les principaux composants logiciels utilisés sont libres. Le cas de CrisperWhisper est cependant plus complexe : ses poids sont accessibles, mais sa licence CC BY-NC 4.0 interdit les usages commerciaux et les données et algorithme d'entrainement ne sont pas publics. Cette distinction permettra d’aborder plus largement les critères permettant de qualifier un modèle d’IA de libre.
Enfin, nous verrons comment cette chaîne de traitement pourrait accueillir à l’avenir un modèle de reconnaissance vocale entièrement libre.
Les personnes qui s'intéressent au traitement audio automatique
Coach Agile et DevOps et Scrum Master, j’accompagne depuis plusieurs années des équipes et des trains SAFe auprès de grands comptes sur des projets IT à fort enjeu.
Passionné par la transmission, je suis également enseignant en Master 2 Informatique, et créateur de la chaîne YouTube Agile Toolkit, dédiée à l’agilité pour tous les publics.
Explorateur curieux des synergies entre IA générative et développement logiciel, j’expérimente au quotidien l’usage de l’intelligence artificielle pour assister les métiers du développement logiciel.