火星財経の報道によると、9月16日、現地時間9月15日、Googleはリアルタイム対話モデル「Gemini 3.8 Live」と「Gemini 3.8 Live Extended Thinking」の2種類を発表した。音声インタラクション、リアルタイム推論、複雑なタスクの実行能力の向上を重点としている。
Googleによると、Gemini 3.8 Liveはほぼリアルタイムの視覚入力に対応し、会話中に97言語を自動で切り替えられるほか、バックグラウンドでツールやAPIの呼び出しを実行できる。Extended Thinking版は、思考しながら音声で交流することに対応し、複数のステップを要する複雑なタスクを対象としている。
2つのモデルはすでにGemini APIとGoogle AI Studioを通じて開発者に提供されている。Gemini 3.8 Liveは同時にSearch Liveでも提供を開始し、Extended Thinking版はGemini Liveユーザー向けに提供される。(広角観察)
31.72k 閲覧数3.81k件の議論
148.69k 閲覧数7.35k件の議論
64.09k 閲覧数4.81k件の議論
44.81k 閲覧数458件の議論
69.83k 閲覧数3.33k件の議論
54.22k 閲覧数4.1k件の議論
27.36k 閲覧数1.87k件の議論
2.47k 閲覧数2.18k件の議論
26.11k 閲覧数615件の議論
21.76k 閲覧数1.26k件の議論
Google、Gemini 3.8 Liveと拡張思考版を発表、リアルタイム音声インタラクションを強化
火星財経の報道によると、9月16日、現地時間9月15日、Googleはリアルタイム対話モデル「Gemini 3.8 Live」と「Gemini 3.8 Live Extended Thinking」の2種類を発表した。音声インタラクション、リアルタイム推論、複雑なタスクの実行能力の向上を重点としている。
Googleによると、Gemini 3.8 Liveはほぼリアルタイムの視覚入力に対応し、会話中に97言語を自動で切り替えられるほか、バックグラウンドでツールやAPIの呼び出しを実行できる。Extended Thinking版は、思考しながら音声で交流することに対応し、複数のステップを要する複雑なタスクを対象としている。
2つのモデルはすでにGemini APIとGoogle AI Studioを通じて開発者に提供されている。Gemini 3.8 Liveは同時にSearch Liveでも提供を開始し、Extended Thinking版はGemini Liveユーザー向けに提供される。(広角観察)