Zum Inhalt springen
Pascal Schindlmeier
EN
Zurück zu allen Projekten

Transkriptions- & Sprechererkennungs-Pipeline

Problem
Interviews mussten transkribiert und einzelnen Sprechern zugeordnet werden, was manuell extrem zeitaufwändig ist.
Ansatz
Pipeline mit WhisperX (Transkription mit Wortausrichtung) und pyannote.audio (Sprechertrennung) gebaut, Export als strukturiertes, durchsuchbares Transkript.
Ergebnis
Deutliche Zeitersparnis gegenüber manueller Transkription, öffentlich einsehbar.