Transkriptions- & Sprechererkennungs-Pipeline
- Python
- WhisperX
- pyannote.audio
- Problem
- Interviews mussten transkribiert und einzelnen Sprechern zugeordnet werden, was manuell extrem zeitaufwändig ist.
- Ansatz
- Pipeline mit WhisperX (Transkription mit Wortausrichtung) und pyannote.audio (Sprechertrennung) gebaut, Export als strukturiertes, durchsuchbares Transkript.
- Ergebnis
- Deutliche Zeitersparnis gegenüber manueller Transkription, öffentlich einsehbar.