Estudo com 82 profissionais de TI mostra que humanos e detectores automáticos falham em identificar deepfakes de áudio modernos
Pesquisa testou a capacidade de 82 profissionais de TI e de seis detectores automáticos pré-treinados em identificar fala sintetizada por três ferramentas de clonagem de voz lançadas em 2019, 2022 e 2024. O F1-score de detecção humana caiu de ~90% nos sintetizadores mais antigos para 48% com o ElevenLabs, e a detecção de manipulações parciais (apenas uma frase trocada em um áudio real) ficou em apenas 9% de acurácia rigorosa.
Fonte ↗