IA aplicada a negócios Notícia
Falcon-ASR: modelo de transcrição para o árabe
Conheça o Falcon-ASR, modelo com 1,6 bilhão de parâmetros criado pelo TII com foco em árabe e suporte para português e outros idiomas.
Se você busca soluções de reconhecimento de fala para idiomas complexos, o Falcon-ASR foi apresentado pelo Technology Innovation Institute (TII), sediado em Abu Dhabi. Trata-se de um sistema com 1,6 bilhão de parâmetros voltado principalmente ao árabe e dialetos regionais.
O modelo executa Reconhecimento Automático de Fala (ASR, na sigla em inglês), tecnologia que converte áudio falado em texto. Além do foco no dialeto dos Emirados Árabes Unidos e no árabe padrão, a arquitetura oferece suporte para português, inglês, francês e espanhol.
Resultados em testes comparativos
Na avaliação do Open Universal Arabic ASR Leaderboard, o Falcon-ASR obteve uma taxa de erro de palavras (WER, métrica em que valores menores indicam maior precisão) média de 20,92%. Esse índice superou em 2,25 pontos percentuais a melhor marca registrada na referência comparada.
Em testes internos para a fala dos Emirados, a taxa de erro de palavras ficou em 22,73% e a taxa de erro de caracteres (CER) em 10,19%. Os números superaram concorrentes diretos avaliados no mesmo conjunto de gravações validadas por humanos.
Treinamento e recursos de áudio
O treinamento considerou ruído de fundo, música, reverberação de salas, sobreposição de falas e efeitos de telefonia. Essas variações preparam o modelo para cenários comuns de reuniões e chamadas telefônicas reais.
Você também tem acesso a marcações temporais no nível da palavra (timestamps), recurso que vincula cada termo transcrito à sua posição exata no áudio original.
Fontes consultadas
- Introducing Falcon ASR — huggingface.co. Consultado em 08/10/2026.
Datas de consulta registradas no momento da verificação. Informações de terceiros podem mudar depois disso.