💡💡💡 正在與 Claude 對話……
問:我原本以為你的運作方式不同:一個為了與我對話而最佳化的模型,把事情交給一個以羅馬尼亞語思考的大腦,而那個大腦再把資訊一點一點餵給後面的英語模型。
答:你的直覺有一部分是對的,只是不是那種形式。
並不是這樣:不存在兩個大腦,一個負責羅馬尼亞語,另一個負責英語,中間再放一個翻譯器。我是單一模型。你的羅馬尼亞語文字會直接以羅馬尼亞語詞元的形式輸入,並以原樣佔據上下文中的空間。它不會先被翻譯成英語來降低成本。
正確的是:Anthropic 的研究人員曾深入研究模型(「追蹤大型語言模型的思維」,2025 年)。他們發現,無論使用哪種語言,想法大致上都以共通的方式呈現。「小」或「相反」的概念,在內部大致相同,不論它來自英語、法語或中文。語言主要只在邊緣發揮作用,也就是輸入和輸出的過程。因此,中間確實有某種無語言的「思考」,但它存在於同一個網路內,而不是一個獨立的大腦。
實際上:
- 我很能理解羅馬尼亞語,因為其中的想法會落在與英語相同的位置。
- 成本出現在邊緣:羅馬尼亞語比英語需要更多詞元。這只對每次都會載入的文字有影響。
這個「翻譯」不會先發生以節省成本。它會在內部自行發生。
問:所以中間有無語言的「思考」。它是否以某種方式存在於影像或聲音中,就像人類心智一樣?
答:既不是影像,也不是聲音。而是數字,每個時刻都有大量的數字。
每個想法都像是