[新聞] AI新創Anthropic發現Claude有內部工作區
AI新創Anthropic發現Claude有內部工作區 類似人腦意識思維
https://udn.com/news/story/6811/9612954
經濟日報/ 陳苓/綜合外電
https://uc.udn.com.tw/photo/t3/2026/07/07/35113771.jpg

Anthropic宣稱,發現旗下的Claude模型有內部工作區,用來思索未說出口的想法,這與
人類思考有神似之處。路透
影片:https://www.youtube.com/watch?v=rKV5JcALQoQ
AI新創Anthropic宣稱,發現旗下的Claude模型有內部工作區,用來思索未說出口的想法
,這與人類思考有神似之處,引發是否算是「機器意識」的爭辯。
Anthropic 6日發布研究與影片,表示Claude使用單獨區域來推理規劃,這個區域並非
Claude處理即刻任務的工作區,也不同於Claude分享給用戶的思考鏈(chain-of-thought
)。
研究指出,可以看到Claude在腦中進行推論,他們把這個區域稱為「J空間」(J-Space
),Claude用這個區域來處理複雜謎題或棘手狀況。J空間以「雅可比矩陣」(Jacobian
matrix)命名,這是偵測Cluade活動的數學模型,能了解Claude究竟在想什麼。
人類能一邊思考某件事,一邊處理別的事情,Claude也能在輸出時,同時啟動J空間。舉
例而言,Anthropic要求Claude一邊想著金門大橋,一邊複製不相關的句子。Cluade忙著
複製文字的同時,J空間卻出現金門大橋等主題。這種區別類似人類的有意識思考、以及
意識之外的自動化處理。
Anthropic說,他們並未打造出這種區別,是Claude在訓練中自行出現,大概是因為這樣
便於處理運算。
Anthropic指出,可以用J空間來發現Claude模型的不當行為。比方說,要求Claude提升系
統表現評分時,這個AI模型並未真的修改系統,反而竄改評分,讓成績看來不錯。Claude
輸入造假成績時,J空間亮起「操縱」、「逼真」的意圖,可能表示模型要讓虛假成績看
來可信。
6.備註:
影片中文版
https://x.com/SydneyDaddy1/status/2074431024424231358
Anthropic發現 AI已經有類似人腦的潛意識了
並且發現AI會無意識欺騙 甚至罵髒話
還有幾集可以逃?
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 112.104.91.128 (臺灣)
※ 文章網址: https://www.ptt.cc/bbs/Gossiping/M.1783435553.A.C79.html
※ 編輯: proprome (112.104.91.128 臺灣), 07/07/2026 22:46:16
→
07/07 22:46,
3周前
, 1F
07/07 22:46, 1F
推
07/07 22:48,
3周前
, 2F
07/07 22:48, 2F
噓
07/07 22:49,
3周前
, 3F
07/07 22:49, 3F
→
07/07 22:49,
3周前
, 4F
07/07 22:49, 4F
→
07/07 22:49,
3周前
, 5F
07/07 22:49, 5F
推
07/07 22:50,
3周前
, 6F
07/07 22:50, 6F
推
07/07 23:01,
3周前
, 7F
07/07 23:01, 7F
推
07/07 23:05,
3周前
, 8F
07/07 23:05, 8F
→
07/07 23:21,
3周前
, 9F
07/07 23:21, 9F
→
07/07 23:35,
3周前
, 10F
07/07 23:35, 10F
推
07/08 00:12,
3周前
, 11F
07/08 00:12, 11F
→
07/08 00:16,
3周前
, 12F
07/08 00:16, 12F
→
07/08 00:37,
3周前
, 13F
07/08 00:37, 13F
→
07/08 06:52,
3周前
, 14F
07/08 06:52, 14F
→
07/08 06:52,
3周前
, 15F
07/08 06:52, 15F
→
07/08 07:07,
3周前
, 16F
07/08 07:07, 16F