limiar
Destaques
Destaque do Dia

Google lança modelo de transcrição que limpa autocorreções e hesitações

1 de setembro de 2026
Google

O Google lançou o Gemini 3.5 Transcribe, modelo de conversão de voz em texto que reconhece quando a pessoa se corrige no meio da frase, remove vícios de linguagem e entrega texto formatado. Em um exemplo da empresa, o sistema registra a troca de “terça” por “quarta” sem manter a primeira data na transcrição final.

O modelo está em preview público para desenvolvedores na API do Gemini, com opções para áudio ao vivo e pré-gravado. Segundo o Google, ele detecta mais de 85 idiomas e atribui trechos a até três vozes em gravações, com suporte experimental acima disso. Em medição da Artificial Analysis citada pela empresa, a taxa média de erro por palavra foi de 4% no modo ao vivo e 2,6% em áudio pré-gravado.

Para consumidores, o recurso está no app Gemini para macOS em inglês e no Rambler para Android em alguns países e idiomas; a chegada ao Chrome foi anunciada como futura. O Google não listou na página todos os idiomas nem confirmou disponibilidade desses aplicativos no Brasil.

Por que importa: Quem transcreve reuniões, entrevistas ou ligações pode testar a API com áudio real em português e medir o ganho antes de adotar. Vale comparar precisão, separação de vozes, latência e tempo de revisão com a ferramenta usada hoje.

Fonte

blog.google

https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-5-transcribe/

Receba conteúdo direto no seu email

Escolha o que funciona melhor pra você.