Modelos de ASR otimizam para benchmarks e 'alucinam' transcrições esperadas
Novo estudo mostra que sistemas de reconhecimento de voz tendem a repetir erros dos benchmarks públicos em vez de seguir o áudio real. Efeitos de 'benchmaxxing' em 11 modelos open-source.