Script = https://s1.trrsf.com/update-1786557910/fe/zaz-ui-t360/_js/transition.min.js
PUBLICIDADE
Publicidade

Google lança novidade que promete transformar a forma como você digita

28 ago 2026 - 19h22
Compartilhar
Exibir comentários
Resumo
O Google lançou o Gemini 3.5 Transcribe, tecnologia avançada de conversão de voz em texto que reconhece pausas, jargões e até três interlocutores em mais de 85 idiomas. Com alta precisão mesmo em ambientes com ruído, o recurso permite correções por comando de voz e formata o texto automaticamente. A ferramenta já está disponível no Gboard para Android e no app Gemini para macOS, com previsão de chegada em breve ao navegador Chrome e a soluções corporativas.

O Google apresentou um novo recurso que promete mudar a forma como os seus usuários digitam. O Gemini 3.5 Transcribe transforma a voz em texto de maneira mais inteligente, sendo capaz de identificar jargões, pausas e respiros para entregar uma transcrição mais precisa.

Foto: Gávea News

Essa ferramenta já está presente no Gboard para Android e é usada por meio do recurso Rambler. Ao clicar no ícone de microfone do teclado virtual, o usuário dita o que quer que seja transcrito e a tecnologia organiza o texto antes de inseri-lo.

Esse modelo é capaz de capturar o estilo de fala mais natural, entendendo o que o usuário quer dizer. Por meio do reconhecimento de um vocabulário personalizado, ele também identifica pausas, respiros e jargões, fazendo as correções necessárias.

Além disso, o recurso permite que correções por voz sejam feitas por meio de comandos. De acordo com o Google, essa ferramenta também será implementada no navegador Chrome, oferecendo recursos semelhantes aos usuários.

O Gemini 3.5 Transcribe apresenta um desempenho robusto em ambientes com ruídos, capturando com precisão informações como códigos postais e IDs de pedidos. Ele também apresenta uma taxa média de erro de palavras de 4% em transmissões e 2,6% nos demais casos.

O assistente oferece suporte a mais de 85 idiomas, reconhecendo sotaques regionais e diferentes dialetos. Ele também é capaz de identificar vários locutores, atribuindo a fala em áudios pré-gravados com marcações de tempo para até três falantes. No caso de mais interlocutores, a ferramenta ainda está sendo testada pelo Google.

Atualmente, o recurso está disponível no aplicativo Gemini para macOS, no Gboard Rambler para Android e no microfone do Google Antigravity. Em breve, estará disponível para o navegador Chrome.

Antes de chegar ao público geral, o Google também liberou o acesso para desenvolvedores na API Gemini por meio do Google AI Studio e do Google Antigravity. Empresas podem testá-lo por meio do Gemini Enterprise Agent Platform e, em breve, no Gemini Enterprise para Experiência do Cliente.

Gávea News
Compartilhar

Comentários

Os comentários são de responsabilidade exclusiva de seus autores e não representam a opinião deste site. Se achar algo que viole os termos de uso, denuncie.

Publicidade
Meu Terra