0
Google、音声認識モデル「Gemini 3.5 Transcribe」を発表
Google DeepMindは、精度、遅延、多言語対応が改善された新しい音声認識モデル「Gemini 3.5 Transcribe」を発表しました。このモデルは、Gemini APIを通じて開発者に提供されます。
文 自動翻訳 · EN
グローバルイベントネットワーク
ひとつの進化するイベント。すべての信頼できるソース。あなたの言語で。
Google DeepMindは、精度、遅延、多言語対応が改善された新しい音声認識モデル「Gemini 3.5 Transcribe」を発表しました。このモデルは、Gemini APIを通じて開発者に提供されます。
Google DeepMindは、開発者向けの新しいクリエイティブコントロールと生成ビデオ機能を備えた「Gemini Omni 1.1 Flash」を発表しました。シーン拡張、最初と最後のフレーム補間、4Kアップスケーリング、より高速なプロトタイピングが含まれます。