今日いちばん大事なのは、エヌビディアのGTCカンファレンス。まるでAI版の人類史だ。
ジェンスン・ファンはまだ登壇してないのに、事前に漏れた情報量だけで本が1冊書けるほどだ。
晚晚が3つの注目ポイントを整理したよ。さあ、みんな行こう。
1)AI計算力コストをいきなり1割に
前世代のBlackwellもかなり強かったよね。すぐに新世代チップのVera Rubinを量産開始すると発表する。
Vera Rubinは何が強い?要するに2文字で、安い。
同じAIモデルを動かすとして、 チップの数量を4分の1に、推論計算コストは9割減。 9割減だよ、みんな。 AWS、マイクロソフト、Googleの3大クラウド企業が、初回ロットから直接乗り込む。
2)去年200億ドルで買収したGroq、今日は宿題提出
以前、ジェンスン・ファンが決算説明会で言っていた。Groqは拡張アーキテクチャとしてエヌビディアの体系に接続される。あのときMellanoxを買収してネットワーク能力を補ったのと同じだと。
GroqのLPUはエヌビディアのGPUと同じデータセンターに置かれる。GPUが問題を理解し、LPUが高速に答えを吐き出す。
2種類のチップを分業して連携すれば、Agentシーンのレイテンシーはそのまま下がる。
AI Agentが人の仕事を代わりにやる。1つのタスクで行ったり来たりして、モデルを数十回調整する可能性がある。しかも各ラウンドで推論計算力を消費し、ユーザーはそこで待ってる。遅れたら体験が崩れる。
推論は2ステップ。まずあなたの質問を理解して、次に1文字ずつ答えを出す。
GPUは最初のステップが得意。でも2つ目の「文字を吐き出す」速度と安定性は、GroqのLPUのほうが強い。
200億ドルって高いの?
考えてみて。今後はどの会社も何百ものAgentを走らせて、各Agentは毎日何千回もモデルを調整する。
3)エヌビディア版OpenClawが登場、名前はNemoClaw
これはオープンソースの一式プラットフォームで、企業が導入すればAIの社員を展開して、実在の人の代わりに業務フローを回し、データを処理し、プロジェクトを管轄できる。 すでにSalesforceやAdobeと交渉しているとも言われている。
面白いのは、NemoClawがエヌビディアのチップの使用を要求しないこと。 このロジックをよく味わってみて。 チップを売って儲かるのはハードウェアの1層だけ。ルールを押さえたらチェーン全体で稼げる。ジェンスン・ファンはこの計算が抜かりない。
4)ジェンスン・ファンが「世界が見たことのないチップ」を披露すると言った
おそらく次々世代アーキテクチャのFeynmanが初めてお目見えする流れで、2028年に量産。台湾積体電路製造(TSMC)の最先端1.6nmプロセスだ。
それと、もう1つの冷めたネタ(=あまり知られてないネタ)もあって、それがなかなか面白いと思う。
エヌビディアがノートPC向けのプロセッサーを出した。2製品で、主にゲーム用途。 グラボを売ってる側が、CPUの飯を奪いに来るってわけだ。
晚晚的には、ジェンスン・ファンは将来、ひと時代を築く偉人になりそうだ。
140.66K 人気度
59.28K 人気度
72.58K 人気度
118.23M 人気度
1.15M 人気度
今日いちばん重要なことは、NVIDIAのGTCカンファレンスで、まさにAI版の人類史そのものだ。
今日いちばん大事なのは、エヌビディアのGTCカンファレンス。まるでAI版の人類史だ。
ジェンスン・ファンはまだ登壇してないのに、事前に漏れた情報量だけで本が1冊書けるほどだ。
晚晚が3つの注目ポイントを整理したよ。さあ、みんな行こう。
1)AI計算力コストをいきなり1割に
前世代のBlackwellもかなり強かったよね。すぐに新世代チップのVera Rubinを量産開始すると発表する。
Vera Rubinは何が強い?要するに2文字で、安い。
同じAIモデルを動かすとして、 チップの数量を4分の1に、推論計算コストは9割減。 9割減だよ、みんな。 AWS、マイクロソフト、Googleの3大クラウド企業が、初回ロットから直接乗り込む。
2)去年200億ドルで買収したGroq、今日は宿題提出
以前、ジェンスン・ファンが決算説明会で言っていた。Groqは拡張アーキテクチャとしてエヌビディアの体系に接続される。あのときMellanoxを買収してネットワーク能力を補ったのと同じだと。
GroqのLPUはエヌビディアのGPUと同じデータセンターに置かれる。GPUが問題を理解し、LPUが高速に答えを吐き出す。
2種類のチップを分業して連携すれば、Agentシーンのレイテンシーはそのまま下がる。
AI Agentが人の仕事を代わりにやる。1つのタスクで行ったり来たりして、モデルを数十回調整する可能性がある。しかも各ラウンドで推論計算力を消費し、ユーザーはそこで待ってる。遅れたら体験が崩れる。
推論は2ステップ。まずあなたの質問を理解して、次に1文字ずつ答えを出す。
GPUは最初のステップが得意。でも2つ目の「文字を吐き出す」速度と安定性は、GroqのLPUのほうが強い。
200億ドルって高いの?
考えてみて。今後はどの会社も何百ものAgentを走らせて、各Agentは毎日何千回もモデルを調整する。
3)エヌビディア版OpenClawが登場、名前はNemoClaw
これはオープンソースの一式プラットフォームで、企業が導入すればAIの社員を展開して、実在の人の代わりに業務フローを回し、データを処理し、プロジェクトを管轄できる。 すでにSalesforceやAdobeと交渉しているとも言われている。
面白いのは、NemoClawがエヌビディアのチップの使用を要求しないこと。 このロジックをよく味わってみて。 チップを売って儲かるのはハードウェアの1層だけ。ルールを押さえたらチェーン全体で稼げる。ジェンスン・ファンはこの計算が抜かりない。
4)ジェンスン・ファンが「世界が見たことのないチップ」を披露すると言った
おそらく次々世代アーキテクチャのFeynmanが初めてお目見えする流れで、2028年に量産。台湾積体電路製造(TSMC)の最先端1.6nmプロセスだ。
それと、もう1つの冷めたネタ(=あまり知られてないネタ)もあって、それがなかなか面白いと思う。
エヌビディアがノートPC向けのプロセッサーを出した。2製品で、主にゲーム用途。 グラボを売ってる側が、CPUの飯を奪いに来るってわけだ。
晚晚的には、ジェンスン・ファンは将来、ひと時代を築く偉人になりそうだ。