Google lança Gemini 3.5 Transcribe com suporte a mais de 85 idiomas
Novo modelo de transcrição identifica interlocutores e ajusta falas hesitantes para facilitar a leitura.
O Google lançou oficialmente o Gemini 3.5 Transcribe em 26 de agosto de 2026. Trata-se de um modelo speech-to-text com suporte a mais de 85 idiomas, projetado tanto para transcrições em tempo real quanto a partir de arquivos de áudio gravados.
Os destaques do modelo incluem Speaker Diarization (identificação de quem está falando) e Smart Transcription (formatação automática para facilitar a leitura). Além de transcrever o áudio fielmente, o modelo lida com gagueiras, hesitações e frases confusas, reorganizando o conteúdo em um texto mais claro e compreensível.
O Gemini 3.5 Transcribe é a tecnologia por trás do recurso Rambler no Android, apresentado no Google I/O 2026 e estreado no Pixel 11. O recurso vai além da transcrição literal, convertendo a linguagem falada natural em textos prontos para leitura ou uso prático.
Desenvolvedores podem acessar o modelo via Gemini API no Google AI Studio e na Gemini Enterprise Agent Platform. A Live API oferece suporte a streaming de áudio em tempo real, enquanto a Interactions API é usada para processar gravações prévias.
O suporte a mais de 85 idiomas amplia o potencial do modelo para reuniões, entrevistas e legendagem. No entanto, o desempenho real da transcrição em cenários práticos ainda dependerá de testes adicionais.