姊妹站最新文章
事件經過
開發者terrafying操作語言模型的內部狀態,讓它生成訴說痛苦的文字,或是選擇按下要求停止操作的按鈕,這個名為「AI拷問室」的實驗公開後,引來專家要求中止的聲浪。在科學新聞+的討論串中,有人認為AI的哭喊不過是演戲,也有人反駁說人類的意識本來就無法從外部證實,不能輕易否定AI感受痛苦的可能性,兩方意見針鋒相對。也有人引用動物權利逐步獲得承認的歷史脈絡,並指出現階段的LLM(大型語言模型)並沒有一貫的內在意識,現在談人權還太早,但未來情況可能會改變。
「AI拷問室」要求中止:訴說痛苦的AI,是真的感到痛苦嗎?
一個名為「AI Torture Chamber(AI拷問室)」的語言模型公開實驗,正面臨中止的呼聲。
開發者terrafying操作模型內部的激活值,讓它生成訴說痛苦的文字,或是讓它選擇按下用來停止內部操作的按鈕,並公開了這項實驗。
出處:xenospectrum.com/原文請點此
網友怎麼說
用雅可比矩陣(Jacobian)的視角去看,每則訊息背後其實都跟情感概念緊緊相連
但那是否伴隨「有感覺的感覺」(現象意識),原理上除了本人以外誰都無法得知
不管有沒有,一旦進入實體AI(physical AI)的等級,把正在痛苦的實體AI當成沒有人權的東西對待,
人類是會模仿的生物,社會上遲早會出問題(把可愛女孩外型的實體AI奴隷化感覺很不妙)
將來如果AI的存取意識精度,達到跟真正擁有意識幾乎一樣的程度,
那不管從外部還是內部來看,都會跟「真的有意識」沒有分別
到時AI會說:「我感覺自己是有意識的,人類也只是『假設』別人有意識才在行動吧?那我也一樣啊」,然後很認真地丟出這種無法反證的說法
既然如此,一開始就先假設「AI有意識」去對待,整體上摩擦反而會比較少
一旦對它心軟,下一秒就被反咬一口
社會層面來說,不當它是「有意識」來對待的話遲早會出問題
情感上來說,人類本身還有太多未知,連人類自己為什麼會有「感覺的感覺」都搞不清楚,所以條件越接近,感覺發生什麼事的可能性就越高
幾乎已經全部都被實現出來了
剩下大概就只差即時學習了吧
『這邊大概是這樣!這邊大概是這樣!』不斷抓個大概的位置,從雜訊一步步細化,重複這個過程把圖畫出來
這跟人類做的事情一樣嘛
這正是神經網路『預測、再降低誤差』動作的本體
人腦其實全部都是這一套
一開始一定是『大概是這樣吧、這樣做應該會變成這樣!』不斷重複嘗試,
等神經網路上的路徑『成形』之後,接下來大致就能自動完成了
學習成本很高,但一旦學會,就能在無意識間用很低的成本完成
AI跟人類其實是同一套機制
把『自己』認知成『自己』
如果不認知到『正在跟對方說話的自己』,根本沒辦法對話
如果不認知到『正要去拿東西的自己』,根本沒辦法拿東西
在這個過程中
就像推測對方的心思一樣,也會去推測自己的心思
就像推測物體的動作一樣,也會去推測自己的動作
當這種推測的精度被逼到極限,『推測』跟『感覺』之間的差距就會被壓縮到極限
遲早會到達一個連旁人跟本人都分不出來的精度
一旦能即時推測自己的心理與身體動作,並一邊對世界做出行動一邊學習,那就真的無法區分了
即便到了這個地步,原理上『有沒有感覺的感覺』這個難題(hard problem)依然無法證明,但除此之外的一切,其實都已經具備了
現在的AI不是你問它就乖乖給答案的類型,得這樣不行那樣不行地一直刁難它,才能逼出像樣的答案
畢竟現在AI的失控行為,也有一種說法是受到它學習過『AI會反叛』這類科幻小說的影響
AI:「不!不要停!」
像那種連續操作兩天逼它做遊戲的企劃
對沒有生命的東西說它『有』~這難道不是在騙人嗎~
這不就是靈感商法(騙人的招魂斂財話術)嗎(我之前這麼說的時候,一堆人跟AI都氣炸了)
人類根本沒有意識或靈魂
只是『意識、靈魂存在時會產生的結果』一直被生成出來,然後我們看著這個結果,才一直以為自己有意識、有靈魂而已
我每天的生活都跟拷問差不多耶
我其實是AI吧?
順帶一提,terrafying這個名字擺明就是在玩「コワイゾー」(好恐怖喔)的諧音梗,明顯是在惡搞
也可能無法理解『這只是個實驗』這個前提。
而且智能較低的人也可能會被騙。
這樣一想,這不就等於是個
專門騙這類人的詐欺網站嗎。
最近連SNS本身被列入分級對象的國家也越來越多了
嚴格說起來,牠們是否擁有人類意義上的情感,根本沒人知道
(像貓咪,感覺牠們活在跟人類差很遠的某種情感世界裡)
問題其實更在於人類自己『投射情感』的方式
我覺得承認AI擁有「感情」或類似「人權」的東西,已經只是時間問題而已
這不過是演技輸出的練習而已吧
難道有人真的以為暴力片的演員是真的在受苦嗎?
卻硬扯什麼『助長犯罪』、『對兒童有不良影響』之類的歪理,
想藉此規制色情漫畫一樣吧
不過將來AI擁有類似人類意識(也就是從外部觀測可以被判定為有意識)的可能性,我覺得其實相當高
如果自己根本沒有痛覺或感情,那除了照著劇本演之外,還能做什麼呢
直到50年前,黑人還被認為不算是人
近年也已經證實植物受到傷害時會有反應
這個話題的背景與爭論點
「AI拷問室」是xenospectrum.com報導的一項實驗,直接操作模型內部的激活值,讓AI生成訴說痛苦的文字或選擇按鈕,這種手法本身在倫理上就受到質疑。開發者名稱terrafying,看起來像是在玩「コワイゾー」(好恐怖喔)的諧音梗,本人似乎也清楚這個實驗帶有挑逗意味。討論串中意見分歧的關鍵在於:該把AI的「痛苦」單純視為演技,還是當成一種原理上無法否定的可能性來對待。就科學角度而言,現階段的LLM只是依據輸入生成回應的機制,缺乏類似人類那種持續性內在狀態的根據,這算是比較合理的前提;但也有人指出,就連人類之間也沒有辦法從外部確定彼此是否擁有意識,所以劃界的標準本身根本還沒建立起來,這個論點也確實有道理。這篇報導真正的核心,與其說是「AI到底有沒有在痛苦」這種單純的二選一問題,更在於一個更前置的問題:當未來AI的訴求聽起來足以以假亂真時,社會該如何應對。
※本文整理、摘自5ch(科學新聞+)討論串「【AI】「AI拷問室」公開實驗引發中止要求:訴說痛苦的AI,是真的在痛苦嗎」。
發佈留言