ทันเอไอ

Global AI & tech news, in your language · every story source-checked

🌐Follow
← Back to news
LINE Facebook X
Modelos e Pesquisa em IAVerified

Google lança Gemini 3.5 Transcribe com suporte a mais de 85 idiomas

Novo modelo de transcrição identifica interlocutores e ajusta falas hesitantes para facilitar a leitura.

📅 28 de ago. de 2026, 00:54
Google lança Gemini 3.5 Transcribe com suporte a mais de 85 idiomas

O Google lançou oficialmente o Gemini 3.5 Transcribe em 26 de agosto de 2026. Trata-se de um modelo speech-to-text com suporte a mais de 85 idiomas, projetado tanto para transcrições em tempo real quanto a partir de arquivos de áudio gravados.

Os destaques do modelo incluem Speaker Diarization (identificação de quem está falando) e Smart Transcription (formatação automática para facilitar a leitura). Além de transcrever o áudio fielmente, o modelo lida com gagueiras, hesitações e frases confusas, reorganizando o conteúdo em um texto mais claro e compreensível.

O Gemini 3.5 Transcribe é a tecnologia por trás do recurso Rambler no Android, apresentado no Google I/O 2026 e estreado no Pixel 11. O recurso vai além da transcrição literal, convertendo a linguagem falada natural em textos prontos para leitura ou uso prático.

Desenvolvedores podem acessar o modelo via Gemini API no Google AI Studio e na Gemini Enterprise Agent Platform. A Live API oferece suporte a streaming de áudio em tempo real, enquanto a Interactions API é usada para processar gravações prévias.

Why it matters
O suporte a mais de 85 idiomas amplia o potencial do modelo para reuniões, entrevistas e legendagem. No entanto, o desempenho real da transcrição em cenários práticos ainda dependerá de testes adicionais.
#กูเกิล#Gemini 3.5#ถอดเสียง#ปัญญาประดิษฐ์
Sources (rewritten & summarized from): Blognone · blog.google · google.dev · datanorth.ai · google.dev · mlq.ai

Comments

Loading comments…

No sign-up needed · comments are auto-filtered and moderated