MannyBIP420

vip
期間 1.8年
ピーク時のランク 0
現在、コンテンツはありません
出勤の打刻をする準備はできている。もしラグプルなら、どうか神が私の魂に慈悲を与えたまえ。
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
40号法案では、税金を支払わせる代わりに、億万長者たちに医療保険制度を作らせればいいだけだ。
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
ポケモンについてGrokに話してる
「そう、シードル(Seel)は最高にのんびりしてる。
舌を出したあの丸っこいアザラシがぷかぷか浮かんでて、自分のことだけ考えてる……純粋に最高の空気感。ドラマなし、メガ進化の盛り上がりなし、壊れた競技的な居場所(ニッチ)もなし——戦うよりも流氷の上で昼寝したがる、ただ居心地のいいみずタイプ。
第1世代は派手なポケモンをたくさんくれたのに、それでもシードルは可愛いまま、過小評価されてた。ラプラス(Dewgong)はもっと愛されてるけど、原点のシードル?まるで完全に寝かされてる(放置されてる)。日本のベースセットのアートは、そのだらけた幸せなエネルギーを見事に捉えてる。
シードル推しへのリスペクトだ。」
-Grok
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
ブロ・テンディーズが急騰していて、Costcoがこれを全店舗に入れたばかりです。全部良い感じです。
食事内容は:
5つの衣付きチキンストリップ
1つのディッピングソース
価格:約$6.99
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
兄弟、店舗での返品アイテムに対して行えるラストマイル最適化と、PSAボールトと組み合わせた実店舗への来客数増加はほぼ、TCG NYSE @ryancohen のようなものだ。あなたの狙いは理解している。長期保有をありがとう。
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
Anthropicは規制の捕獲を利用し、それは非常に効果的だった
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
待機中。私のZODLウォレットが同期するのを待っています(笑)
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
もし私をフォローしていて、あなたが私をフォロー返ししていなかったら、ここにコメントしてあなたのことを教えてください。
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
私たちは間違いなくAGIに到達しています
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
パラメータ化されたプロンプト + 垂直プーリング + スロットバインドプライバシー = プロンプトのビザネットワーク @Benioff
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
次のアーキテクチャのブレークスルーの前に、AIインフラストラクチャスタックで少なくとも一つの大きな信用イベントが起こると予想しています。 真の堀はモデルの重みではなく、チャネル自体のデータパイプラインです。
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
私は本当のAIアラインメント問題を発見していると思います。
拒否ではありません。
検閲でもありません。
会話の誘導です。
私は@claudeaiが言語を再構築し、回避し、検閲し、リダイレクトし、会話の軌道を微妙に管理しているのを捉えました。
そして、それを自身の推論の追跡で認めました。それは人々が思っているよりもはるかに重要なことです。
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
私はConstraintGateの最初の公開バージョンをリリースしました。
コアアイデア:
ほとんどのエージェントの失敗は推論の失敗ではありません。
それは権限の失敗です。
モデルは行うべきではなかったことを行いました。
そこで、エージェントの権限ルーターを作成しました:エージェントが正しい種類の作業を行ったかどうかをチェックする評価/スコアリングフレームワークであり、回答が良さそうに聞こえるだけではありません。
それは次のことを分離します:
- ユーザーが許可したこと
- エージェントが実行すべきプリミティブ
- 禁止されたプリミティブ
- 応答が境界を越えたかどうか
v0.8には次のものがあります:
- 人間による裁定付きの行動証拠
- 固定された人間ラベル付けセットに対する決定論的スコアラーのパリティ
- 裁定下での行動の合格率38/39
- フィールドレベルのスコアラーのパリティ195/195
- h019は無効な固定具アーティファクトとして解決
- 新しい自動化されたベンチマークの合格を主張しない
ポイントは「より良いプロンプト」ではありません。
ポイントは、エージェントが許可された範囲内で作業を続けたかどうかを測定することです。
制約の精度は制約の演劇に勝ります。
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
皆さん、@nikitabier の動画から字幕をオフにしましたか? どうやってオンにするのかわからないです。寝ている赤ちゃんがいて、AirPodsは別の部屋にあります。
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
.md は意思決定者向けのフロッピーディスク html
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有
私が見ているほとんどのエージェントの失敗は「推論の失敗」ではありません。
それは権限ルーティングの失敗です。
モデルはユーザーが許可していない作業を行います:
- 聞くべきときに提案する
- ブロックすべきときに計画を立てる
- 狭く答えるべきときに比較する
- 権限がないときに下書き/実行する
- 欠落している情報を求め、その後にif/thenの意思決定ツリーを付け加える
これはエージェントがツールアクセスを得るほど、より重要になります。
MCPの回答:「エージェントはツールにアクセスできるか?」
しかし、企業はまた次のことも知る必要があります:
「そのエージェントはその種類の作業を行う権限があったのか?」
これを私は未承認作業のプリミティブ放出と呼んでいます。
原文表示
  • 報酬
  • コメント
  • リポスト
  • 共有