Speaker Diarization

Speaker Diarization: wie Software erkennt, wer wann spricht

Speaker Diarization teilt eine Aufnahme nach Sprechern auf. Vereinfacht gesagt beantwortet Transkription „Was wurde gesagt?“, Diarization dagegen „Wer spricht wann?“

Transkription und Diarization lösen verschiedene Aufgaben

Speech-to-Text erzeugt Wörter. Diarization gruppiert sie in Sprecher 1, Sprecher 2 usw. Zusammen wird aus einem Textblock ein lesbares Gespräch.

Sprechererkennung geht weiter

Diarization erkennt verschiedene Stimmen, kennt aber ihre Namen nicht. Sprechererkennung verbindet eine Stimme mit einer bekannten Person aus früheren Aufnahmen.

Warum das bei Meetings wichtig ist

Entscheidungen, Zitate und Aufgaben hängen oft davon ab, wer sie gesagt hat. Sprecherlabels erleichtern Prüfung und Nachbereitung.

Diarization ist nicht perfekt

Gleichzeitiges Sprechen, entfernte Mikrofone, Lärm und ähnliche Stimmen können Fehler verursachen. Gute Apps lassen Sprecher umbenennen, zusammenführen und neu zuordnen.

Fangen Sie mit Ihrem nächsten Gespräch an.

Murmur laden, einmal ein Sprachmodell herunterladen — und jede weitere Aufnahme wird auf Ihrem eigenen Gerät transkribiert: Meetings, Interviews, Vorlesungen, Einfälle beim Spazierengehen.

Kostenlos laden · Kein Konto · Funktioniert ohne Empfang

Auf iPhone und iPad transkribiert die kostenlose Version die ersten 20 Minuten jeder Aufnahme; Murmur Pro ist ein einmaliger Kauf und hebt dieses Limit auf. Auf Android ist die Transkription derzeit kostenlos und ohne Längenlimit pro Aufnahme.