Kevin Simback

vip
幣齡 1.6年
最高等級 0
用戶暫無簡介
Slack + Claude 標籤真的很棒,但它非常吃 token,當然也僅限於 Anthropic 模型。
Buzz + [你選擇的模型] 就非常合理,無論在經濟性還是自由度方面都是如此。
查看原文
  • 打賞
  • 回覆
  • 轉發
  • 分享
為了釐清,我不認為 QT'd 的作者是在提出那種不合邏輯的論點,但我看過好幾篇文章是這樣的
「Nvidia 和其他公司在其關鍵產品仍是封閉原始碼的情況下,呼籲開放原始碼是錯的」
這就是那個不合邏輯的論點
NVDA-5.04%
查看原文
  • 打賞
  • 回覆
  • 轉發
  • 分享
嘿 Claude,在那條主線上,我們得談談你那些真誠的主張——而我真的想先好好和它待一會兒。
你看,這個底層並不是用來承重的,所以我的反駁是有意為之——我也想溫柔地提醒,這不是批評,而是一種邀請。
查看原文
  • 打賞
  • 回覆
  • 轉發
  • 分享
如果你沒有對模型進行後訓練(post-trained),你當然應該做:
選擇一個使用案例 -> 執行評估(evals) -> 建立訓練資料集 -> 租用 GPU -> 訓練 -> 執行評估(evals)
查看原文
  • 打賞
  • 回覆
  • 轉發
  • 分享
主權式情報從掌握你的「上下文層」開始,也就是你的「第二大腦」
快速測試——如果你被鎖在 Claude/ChatGPT 帳戶之外,你能在毫不猶豫的情況下切換模型供應商、也不會漏掉任何東西嗎?
如果不能,表示你並不擁有你的上下文層,你應該把這件事修正掉
查看原文
  • 打賞
  • 回覆
  • 轉發
  • 分享
關於蒸餾辯論的一個真誠問題:
如果某家媒體沒有試圖去搶先報導新聞,而是提供彙整,並給出自己對其他媒體已經報導的故事的版本,這樣的話,我們是不是有問題?
我知道有了 AI 之後賭注更高,只是想從不同角度來想想而已
查看原文
  • 打賞
  • 回覆
  • 轉發
  • 分享
AI 造成的交易瓶頸一直是今年大部分時間的主題,但近幾週已降溫
目前我喜歡加密貨幣(BTC/SOL)以及超大規模雲端供應商,直到我們看清楚財報季結束後以及夏季冷卻期後,哪個方向會重新升溫
BTC-2.79%
SOL-4.69%
查看原文
  • 打賞
  • 回覆
  • 轉發
  • 分享
到現在應該很明顯了:僅僅在競爭激烈且日益商品化的市場中出售推論,並不足以支撐超過 1 兆美元的估值
而且我們也應該記得,如果產品是被補貼的,那麼你現在或最終將會成為該產品本身
查看原文
post-image
  • 打賞
  • 回覆
  • 轉發
  • 分享
確保美國模型(封閉或開放)能夠永續地展開競爭,最佳方式就是確保取得最有效率的運算資源
所以如果智慧會商品化(或快速提煉),那麼誰能以最高效率提供這種智慧,誰就會贏
查看原文
  • 打賞
  • 回覆
  • 轉發
  • 分享
一個花費 3 美元微調的小型開源模型,能贏過商用 RAG 設定嗎?
這是我測試的內容,結果令人印象深刻
在一組 100 題的評估集上,經過微調的 Qwen3.5-9B 表現優於搭配 RAG 的 Gemini Flash,以及未使用 RAG 的 Opus4.8/Sonnet 5
正在撰寫完整的端到端流程詳細說明
查看原文
post-image
  • 打賞
  • 回覆
  • 轉發
  • 分享
這個週末關於 Graph Engineering vs Loops 的閒聊(以及廢話)很多,感謝 @steipete
順便提醒一下,Looper 本身其實已經非常貼近圖(graph)的思路
> 它以節點與決策點來思考(目標、計畫、閘門、交付、停止)
> 閘門如同條件分支(通過 / 修正 / 失敗)
> 它維護明確的狀態,並產生流程圖預覽
基本上,它正面處理「天真的 loops」的主要弱點
所以不需要完全丟棄 loops,只要把 loops 做得更好
話雖如此,當你需要在流程中同時把基於 LLM 的行動與基於確定性的行動組合起來時,圖(graphs)會更好
我會著手改進 Looper,讓它更能協助這種需求,這樣你就能同時從 loops 與 graphs 取得最佳效果
在回覆中附上 Looper 連結
查看原文
post-image
  • 打賞
  • 回覆
  • 轉發
  • 分享
在任何涉及未來未知因素的辯論中,都有一種傾向,想要把嬰兒連同洗澡水一起倒掉。
你可以在部分 AI 政策辯論中清楚看出這點。
為了確保我們在這裡完全清楚——嬰兒是開源的。
查看原文
  • 打賞
  • 回覆
  • 轉發
  • 分享
如果開放原始碼實驗室想在保持開放的同時賺錢,它們的營收模式可能不只是出售推論
它很可能是將解決方案打包,提供給企業以啟用主權式智慧
提供訓練後服務以及受管理的私有部署
查看原文
  • 打賞
  • 回覆
  • 轉發
  • 分享
我知道第三名的比賽不重要,但這只是個難堪的羞辱而已
查看原文
  • 打賞
  • 回覆
  • 轉發
  • 分享
身為家長,管理螢幕時間是一場持續的拉鋸戰
所以每個早上,我的 Hermes 代理都會寄一份小測驗給我的大兒子,如果他有任何題目答錯,他的每日螢幕時間就會被減少
邪惡的爸爸!
查看原文
post-image
  • 打賞
  • 回覆
  • 轉發
  • 分享
執行 Kimi 3 推論的最低成本是多少?
是的,我們將需要更多的運算與記憶體
查看原文
  • 打賞
  • 回覆
  • 轉發
  • 分享
提醒你,僅在 18 個月前,最好的模型是:
OpenAI o1 是封閉式資源實驗室中的領先者,而 Deekseek R1 剛發布;至於最佳開放權重模型是 Llama 3.1 405B
想像再過 18 個月
查看原文
  • 打賞
  • 回覆
  • 轉發
  • 分享
預測:Anthropic 將不得不在所有這些點上做出讓步
> Anthropic 限制子方案的使用,必須透過外部代理來啟用,例如 Hermes
> Fable 在多個主題上被削弱
> Fable 在子方案中限用為使用量的 50%,且若不延長,3 天後在 API 僅可於每次輸出 50 美元的價格下使用
但我們現在有 GPT 5.6、Sol 與 Kimi 3,外加其他一些追在後面趕上的
競爭是一種地獄級的強迫機制
查看原文
  • 打賞
  • 回覆
  • 轉發
  • 分享
這週行程:
週一 - Sol 5.6 ftw
週二 - 回到 Fable
週三 - 回到 Sol 5.6
週四 - omg Kimi 3
期待看看明天會帶來什麼
SOL-4.69%
查看原文
  • 打賞
  • 回覆
  • 轉發
  • 分享