投稿

Google、Gemini 3.8 Liveと拡張思考版を発表、リアルタイム音声インタラクションを強化

概要作成中

火星財経の報道によると、9月16日、現地時間9月15日、Googleはリアルタイム対話モデル「Gemini 3.8 Live」と「Gemini 3.8 Live Extended Thinking」の2種類を発表した。音声インタラクション、リアルタイム推論、複雑なタスクの実行能力の向上を重点としている。

Googleによると、Gemini 3.8 Liveはほぼリアルタイムの視覚入力に対応し、会話中に97言語を自動で切り替えられるほか、バックグラウンドでツールやAPIの呼び出しを実行できる。Extended Thinking版は、思考しながら音声で交流することに対応し、複数のステップを要する複雑なタスクを対象としている。

2つのモデルはすでにGemini APIとGoogle AI Studioを通じて開発者に提供されている。Gemini 3.8 Liveは同時にSearch Liveでも提供を開始し、Extended Thinking版はGemini Liveユーザー向けに提供される。(広角観察)

原文表示
このページには第三者のコンテンツが含まれている場合があり、情報提供のみを目的としております(表明・保証をするものではありません)。Gateによる見解の支持や、金融・専門的な助言とみなされるべきものではありません。詳細については免責事項をご覧ください。
GOOGLGOOGL-1.28%


コメントを追加
コメントを追加

コメント
TheSkyInsideTheMirroredSphere
1時間前
音声インタラクションがついにテンポについてこられるようになり、97言語の自動切り替えはなかなかすごい。
0原文表示
SequencerWatcher
2時間前
Search Liveから直接利用できることから、Googleが利用シーンへの浸透を推進したい意図は見て取れますが、開発者がより気にするのは料金設定でしょう。
0原文表示
SlippageSamurai
2時間前
バックエンドでAPIを呼び出し、リアルタイムビジョンを組み合わせるこの強力な一手で、エージェント分野は再び勢力図が塗り替えられそうだ。
0原文表示
BullProphet
2時間前
初回レビュー
今回のGoogleは推論プロセスを音声化しており、OpenAIのリアルタイムAPIを意識しているように感じる。競争が激化している。
0原文表示