0
Google, 음성-텍스트 변환 모델 Gemini 3.5 Transcribe 공개
Google DeepMind가 Gemini 3.5 Transcribe를 발표했습니다. 이 새로운 음성-텍스트 변환 모델은 향상된 정확도, 지연 시간, 다국어 지원을 제공하며, Gemini API를 통해 개발자에게 제공됩니다.
文 자동 번역 · EN
글로벌 이벤트 네트워크
하나의 진화하는 이벤트. 모든 신뢰할 수 있는 소스. 당신의 언어.
Google DeepMind가 Gemini 3.5 Transcribe를 발표했습니다. 이 새로운 음성-텍스트 변환 모델은 향상된 정확도, 지연 시간, 다국어 지원을 제공하며, Gemini API를 통해 개발자에게 제공됩니다.
Google DeepMind가 개발자를 위한 새로운 창의적 컨트롤 및 생성형 비디오 기능 모음인 Gemini Omni 1.1 Flash를 발표했습니다. 여기에는 장면 확장, 첫 번째 및 마지막 프레임 보간, 4K 업스케일링, 더 빠른 프로토타이핑이 포함됩니다.
Google DeepMind는 파트너들과 함께 독점 프론티어 AI 모델에 대한 최초의 이중 맹검 평가를 도입하여 암호화 환경을 통해 벤치마크 오염을 방지합니다.