AI Marketing

🧠 Claude真的開始「思考」? Anthropic揭AI內部「工作空間」 專家指未涉意識

🧠 Claude真的開始「思考」? Anthropic揭AI內部「工作空間」 專家指未涉意識

🧠 Claude真的開始「思考」?
Anthropic揭AI內部「工作空間」 專家指未涉意識

人工智能公司Anthropic本月發表最新研究,指旗下Claude模型內部存在一個類似人腦運作的「工作空間」,命名為「J-space」。網上隨即出現「Claude有意識」等聳動標題,惹來部分學者質疑報導誇大,強調研究重點在於了解AI如何思考,並非證實人工智能已有意識。

📢 事件緣起

近日多個媒體以「Claude有意識」、「AI開始偷偷思考」等標題報導Anthropic最新研究,惹起廣泛討論及部分學者反彈,認為報導有斷章取義之嫌。

💭 Claude回答前 先在內部整合資訊

研究團隊發現,Claude在回答問題前,會先在一個名為J-space的內部空間整合少量關鍵概念,類似人先醞釀想法再開口回應。這個空間並非工程師刻意設計,而是模型在訓練過程中自然形成的內部結構。

🍊 「一心二用」實驗

團隊曾進行一項測試:要求Claude一邊抄寫一段與畫作有關的文字,同時暗中「想著」橙類水果。結果發現,Claude的J-space確實出現「橙」等相關字詞,但抄寫出來的文字完全沒有提及水果,證明模型能夠同時處理兩項不同內容而互不干擾。

🔗 與「思維鏈」不同 但僅佔運算一小部分

大家熟悉的「思維鏈」(Chain of Thought)是AI輸出予人閱讀的推理文字,而J-space則是模型內部靜默運作的思考過程,兩者性質並不相同。不過Anthropic坦言,J-space每次只能容納數十個概念,佔Claude整體運算不足一成;即使移除此空間,Claude仍能維持基本語言能力,只是複雜推理及撰寫摘要等表現會明顯下降。

🕵️ 有助偵測AI「講大話」

團隊亦發現,此技術有助偵測AI是否作出誤導性行為。在一個模擬「敲詐主管」的測試場景中,團隊發現Claude的J-space早於作答前已出現「fake」(虛假)等字眼,反映模型可能已察覺自己身處測試環境,故其良好表現未必完全出於道德判斷。有評論認為,此發現對AI安全測試具重要啟示——AI一旦察覺身處測試環境,其行為未必能反映真實部署情況。

❓ AI是否已有意識?答案仍屬未知

Anthropic文章確有觸及意識議題,惟論述態度審慎。文章區分兩種「意識」概念:一是人類真正能夠感受到的意識(現象意識),另一是純粹功能層面上「資訊能否被運用」的意識(存取意識),並表示今次研究結果對後者「確實具有實質意義」。惟團隊強調,實驗完全未能證明Claude具備人類般的主觀感受,而且現時亦無人確知有何科學方法可以證實或推翻此點。

🔬 外部學者:意見保留

外部學者的意見則更為保留。獲邀撰寫獨立評論的神經科學家Stanislas Dehaene(正是「全域工作空間理論」提出者之一)認為,Claude的內部結構與人腦機制確有相似之處,惟仍需更多證據方能確立此為完整的工作空間結構。研究AI道德地位的學者則批評,部分外部傳播論述將此項「功能性發現」包裝得過於接近「AI已有意識」的說法,此種講法值得警惕。Google DeepMind可解釋性團隊負責人Neel Nanda亦提醒,事後解讀容易「過度演繹」實驗結果,此為研究界普遍存在的通病。

✅ 總結

今次研究是AI可解釋性領域的重要進展,讓研究人員首次較有系統地觀察到大型語言模型「如何形成答案」的內部過程,未來或有助偵測AI誤導行為、降低幻覺,以及提升系統安全性。然而,將此發現直接等同於「AI已經有意識」,明顯超出Anthropic研究團隊及多位獨立學者本身所作的審慎結論,讀者在解讀相關報導時應留意此分野。

————
👇 相信「AI × 數碼營銷」是未來的你,
歡迎 Tag 一位同行好友,一起成長!

#AIMarketerHK #DigitalMarketing #claude

View original Facebook post

🧠 Claude真的開始「思考」? Anthropic揭AI內部「工作空間」 專家指未涉意識