KevinSimback

vip
期間 1.6 年
ピーク時のランク 0
現在、コンテンツはありません
蒸留(デスティレーション)の議論に対する率直な質問です:
もしニュース媒体がスクープを取りに行くのではなく、他のニュース媒体が報じた出来事について要約や自分たちの解釈(独自のストーリー)を出しているだけなら、それは問題になるのでしょうか?
AIでは状況の重要性がより高いのは分かっていますが、いろいろな観点から考えてみようとしているところです。
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
AIのボトルネック取引は今年の大半の間話題の中心でしたが、最近の数週間で落ち着いてきました
今のところ私は暗号資産(BTC/SOL)とハイパースケーラーが好きです。決算シーズン後や夏の閑散期が終わって、何が熱を帯びてくるかを見てから判断します
BTC-0.46%
SOL-1.04%
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
ここまでで、競争が激化し、ますますコモディティ化している市場に対して「推論」を売るだけでは、1兆ドル超の$評価を正当化できないことは明らかでしょう。
また、その製品が補助金で支援されているなら、あなたは、あるいはいずれは、その製品そのものになっている(なってしまう)ことも忘れてはいけません。
原文表示
post-image
  • 報酬
  • コメント
  • リポスト
  • 共有
アメリカのモデル(クローズド/オープンのどちらでも)が持続的に競争できるようにする最善の方法は、最も効率的な計算(compute)へのアクセスを確実にすることです。
つまり、知能がコモディティ化(または急速に蒸留)されるなら、その知能を最も効率よく提供できる相手が勝ちます。
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
$3の微調整で小型のオープンモデルは、本番用のRAG構成に勝てるのか?
これが私がテストした内容で、結果は印象的でした
100問の評価セットに基づくと、微調整したQwen3.5-9Bは、RAGありではGemini Flashを上回り、RAGなしではOpus4.8/Sonnet 5を上回りました
エンドツーエンドのフローの完全な書き起こしを作成中です
原文表示
post-image
  • 報酬
  • コメント
  • リポスト
  • 共有
週末には、Graph Engineering と Loops の違いについて、かなりいろいろと話題(そして雑な内容)になっていました。@steipete ありがとうございます。
念のためですが、Looper はすでにとてもグラフ指向です
> ノードと意思決定ポイント(目標、計画、ゲート、デリバー、停止)のように考えます
> ゲートは条件分岐(通過 / 修正 / 失敗)として機能します
> 明示的な状態を維持し、フローチャートのプレビューを生成します
つまり、「なまのループ(naive loops)」の主な弱点にほぼ対処しています
なので、ループを完全に捨てる必要はなく、より良いループを作るだけです
とはいえ、プロセスフローの中で、LLM ベースの行動と決定論的(deterministic)ベースの行動を組み合わせる必要があるなら、グラフのほうが良いこともあります
それにより良く対応できるように、Looper をいくつか改善していくので、ループとグラフの両方を最大限活用できます
返信で Looper へのリンク
原文表示
post-image
  • 報酬
  • コメント
  • リポスト
  • 共有
将来の不確実性が絡む議論では、往々にして言いたいことを強くするあまり、風呂の湯と一緒に赤ちゃんまで捨てたくなる傾向があります。
それが、AIの政策に関する一部の議論でよく見て取れます。
そして、ここで私たち全員が完全に誤解なく理解していることを確認するために言うと――赤ちゃんはオープンソースです。
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
オープンソースの研究所が、オープンな状態を保ちながら収益を得たいのであれば、その収益モデルはおそらく推論を売るだけではありません。
企業向けのパッケージ化されたソリューションとして提供し、自国(主権)のインテリジェンスを可能にします。
学習後サービス(ポストトレーニング)と、マネージドされたプライベート導入。
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
3位決定戦は関係ないのは分かってるけど、これはただの恥さらしだよ
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
親としてスクリーンタイムを管理するのは、終わりのない戦いです
だから毎朝、私のハーマスのエージェントが長男にクイズを送ります。もし問題を間違えたら、毎日のスクリーンタイムが減ります
悪い父!
原文表示
post-image
  • 報酬
  • コメント
  • リポスト
  • 共有
Kimi 3で推論を実行するのに最低いくらかかりますか?
ええ、もっと大量の計算資源とメモリが必要になります。
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
ちょうど18か月前、最も優れていたモデルは次のとおりでした:
OpenAI o1 はクローズドソースの各研究所の中でトップで、Deekseek R1 がリリースされたばかりでした。また、最良のオープンウェイトは Llama 3.1 405B でした
今から18か月後のことを想像してみてください
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
予測:Anthropicは、これらのすべての点で譲歩せざるを得なくなるだろう
> Anthropicはサブプランの利用を、Hermesのような外部エージェントのハーネス経由でのみ制限している
> Fableは多くのトピックで弱体化されている
> Fableはサブプランで利用が50%までに制限されており、拡張されない場合は3日後に月額$50の出力でAPIのみになる
しかし今では、GPT 5.6 SolやKimi 3に加えて他にも追い上げてきていて、すぐ背後まで迫っている
競争は、とんでもなく強力な強制メカニズムだ
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
今週の予定:
月曜 - Sol 5.6 ftw
火曜 - Fableに戻る
水曜 - Sol 5.6に戻る
木曜 - うわっ、Kimi 3
明日が何をもたらすか楽しみ
SOL-1.04%
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
共有コンテキストレイヤーについて話しましょう。多くの場合「会社のブレイン(company brains)」と呼ばれます。
会社についての難しい質問に答えるには、たとえば:
「Xについて何が真実で、いつからそうで、誰によれば、そしてどこでアカウント同士が食い違っているのか?」
必要なのは、すべてのコミュニケーションやドキュメントの上に成り立つ、導出された引用可能な事実(ファクト)レイヤーです。
それは、組織が「知っている」ことについての記録(システム・オブ・レコード)であり、実務として行われた作業の出力を含む別の記録システムとは異なります。
たとえば、会計のJackは、POと一致しないベンダー請求書がなぜ支払われたのかを知っていますが、会計システムにはPOと支払いというデータ要素しか含まれていません。
つまり、「なぜPOに書かれている金額とは違う金額を支払ったのか」を知りたければ、Jackに聞きに行く必要があります。
ただし、Jackがビジネスマネージャーと確認し、注文が変更され、支払いが承認されたことを示すSlackおよびメールのスレッドに接続された共有コンテキストレイヤーがあるなら話は別です。
共有コンテキストレイヤーを有用にするには、それが証拠に根ざし、矛盾を浮かび上がらせ、古い真実を新しい情報で上書きできなければなりません。
それは次に答える必要があります:
- この人物は誰
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
私の上司には、同じ課題を2〜3人の別の人に何度も渡すことがよくあった人がいました。
それがチーム全体に不満を生み、ひどく非効率でした。
エージェントにはそんな問題はありませんし、コストもほとんどかかりません。
原文表示
post-image
  • 報酬
  • コメント
  • リポスト
  • 共有
主権インテリジェンスのフライホイール:
オープンウェイト → ポストトレーニング → 評価 → エージェントの実行環境 → 軌跡をポストトレーニングに再投入
これを企業向けにより簡単に、より利用しやすくする企業は、今後5年間で大きく勝ち抜くだろう
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
一日中ずっと
「🚨BREAKING: Someone just…」の投稿を見ずに過ごせた
気分いい
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
「私の死の報告は大げさに言われています」
—エンタープライズAI投資、2026年7月
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
  • ピン留め