1
Repräsentative Audioaufnahmen zusammenstellen
Wählen Sie Ausschnitte mit den Akzenten, Hintergrundgeräuschen, Fachbegriffen und Sprecherwechseln, mit denen Sie tatsächlich arbeiten. Verwenden Sie für beide Tests dieselben Audioaufnahmen und dasselbe gewünschte Ausgabeformat; sonst kann ein scheinbar schnelleres Ergebnis einfach auf eine leichtere Eingabe zurückgehen.
2
Den gesamten Ablauf messen
Berücksichtigen Sie bei AWS Transcribe das Hochladen oder Einrichten des Streams, den Abschluss des Auftrags und den Abruf des Ergebnisses. Berücksichtigen Sie bei selbst gehostetem Whisper die Dateiübertragung, die Wartezeit in der Warteschlange, gegebenenfalls den Modellstart, die Inferenz sowie etwaige Schritte zur zeitlichen Zuordnung oder Sprecherkennzeichnung.
3
Die Zeitmessung erst nach der Prüfung beenden
Lassen Sie dieselbe Person Namen, fehlende Passagen und Sprecherwechsel anhand derselben Abnahmekriterien korrigieren. Erfassen Sie sowohl die maschinelle Bearbeitungszeit als auch die Bearbeitungszeit für Korrekturen: Das zuerst eintreffende Ergebnis ist nicht unbedingt als Erstes zur Veröffentlichung bereit.