Google apresenta o modelo de transcrição de fala Gemini 3.5 Transcribe
Em 26 de agosto de 2026, o Google DeepMind apresentou o Gemini 3.5 Transcribe, seu mais recente modelo de transcrição de fala projetado para transcrição em tempo real precisa e inteligente. O modelo converte áudio bruto em texto preciso, polido e formatado, lidando com ruído de fundo, jargões complexos e limpeza de disfluências. Ele oferece atribuição de múltiplos falantes e timestamps em nível de palavra, e suporta troca de idioma ao vivo. Em comparação com seu antecessor Chirp 3, melhora o tempo para transcrição final em 70% e atinge uma taxa de erro de palavra (WER) de 5,50% no modo streaming e 5,04% no modo não streaming no benchmark FLEURS. O modelo está disponível via API Gemini no Google AI Studio e na Plataforma Gemini Enterprise Agent, e está integrado em superfícies do Google como Gboard, Antigravity, o aplicativo Gemini e Chrome. Plataformas de desenvolvedores como Agora, Fishjam, LangChain, LiveKit, Pipecat, Vercel e Vision Agents suportam a construção de interfaces orientadas por voz com ele. Empresas como vivo, Intellitek Health e Lingopal forneceram feedback positivo.
O que sabemos
Ele está disponível via API Gemini no Google AI Studio e na Plataforma Gemini Enterprise Agent.
▤ 1 fontes›
Ele atinge uma WER de 5,50% no modo de streaming e 5,04% no modo não streaming no FLEURS.
▤ 1 fontes›
O modelo é um modelo de fala para texto com precisão e latência melhoradas em comparação com o Chirp 3.
▤ 1 fontes›
Ele está integrado em produtos do Google como Gboard, Antigravity, o aplicativo Gemini e o Chrome.
▤ 1 fontes›
O Google DeepMind anunciou o Gemini 3.5 Transcribe em 26 de agosto de 2026.
▤ 1 fontes›
Ele suporta atribuição de múltiplos falantes e carimbos de tempo em nível de palavra.
▤ 1 fontes›
O tempo para a transcrição final melhora em 70%.
▤ 1 fontes›
Abra qualquer fonte para inspecionar seu idioma original, quando o DoseFix a recebeu e as afirmações que ela apoia.
Intelligent transcription with Gemini 3.5 Transcribe
deepmind.google · EN · Publicado · RecebidoRelatos ao vivo
Ver tudoComentários 0
Discuta este evento em tópicos permanentes. O chat ao vivo permanece separado.
Ainda não há comentários. Inicie a conversa.