1
Reúna áudios representativos
Escolha trechos com os sotaques, o ruído de fundo, o vocabulário e as mudanças de falante com que você realmente lida. Use o mesmo áudio e solicite o mesmo formato de saída nos dois testes; caso contrário, um resultado aparentemente mais rápido pode ser fruto de uma entrada mais fácil.
2
Cronometre o processo completo
Para o AWS Transcribe, inclua o envio do arquivo ou a configuração do fluxo, a conclusão da tarefa e a recuperação do resultado. Para o Whisper auto-hospedado, inclua a transferência do arquivo, o tempo na fila, a inicialização do modelo quando aplicável, a inferência e qualquer etapa de alinhamento ou identificação de falantes.
3
Pare o cronômetro após a revisão
Peça à mesma pessoa que corrija nomes, trechos ausentes e mudanças de falante, seguindo os mesmos critérios de aceitação. Registre tanto o tempo de processamento quanto o de edição: o primeiro resultado a chegar não é necessariamente o primeiro pronto para publicação.