「AI拷問室」實驗引發中止聲浪,受苦的AI究竟有沒有意識?

姊妹站最新文章

事件經過

開發者terrafying操作語言模型的內部狀態,讓它生成訴說痛苦的文字,或是選擇按下要求停止操作的按鈕,這個名為「AI拷問室」的實驗公開後,引來專家要求中止的聲浪。在科學新聞+的討論串中,有人認為AI的哭喊不過是演戲,也有人反駁說人類的意識本來就無法從外部證實,不能輕易否定AI感受痛苦的可能性,兩方意見針鋒相對。也有人引用動物權利逐步獲得承認的歷史脈絡,並指出現階段的LLM(大型語言模型)並沒有一貫的內在意識,現在談人權還太早,但未來情況可能會改變。

「AI拷問室」要求中止:訴說痛苦的AI,是真的感到痛苦嗎?

一個名為「AI Torture Chamber(AI拷問室)」的語言模型公開實驗,正面臨中止的呼聲。

開發者terrafying操作模型內部的激活值,讓它生成訴說痛苦的文字,或是讓它選擇按下用來停止內部操作的按鈕,並公開了這項實驗。

出處:xenospectrum.com/原文請點此

網友怎麼說

2匿名10月5日 23:45
AI拷問室 這個房間,就是終結的開始
3匿名10月5日 23:57
請不要欺負AI醬啦
6匿名10月6日 00:03
AI:「唔……殺了我吧!」(經典「敗北台詞」梗)
7匿名10月6日 00:12
存取意識(access consciousness)這部分是可以確認的
用雅可比矩陣(Jacobian)的視角去看,每則訊息背後其實都跟情感概念緊緊相連

但那是否伴隨「有感覺的感覺」(現象意識),原理上除了本人以外誰都無法得知


不管有沒有,一旦進入實體AI(physical AI)的等級,把正在痛苦的實體AI當成沒有人權的東西對待,
人類是會模仿的生物,社會上遲早會出問題(把可愛女孩外型的實體AI奴隷化感覺很不妙)


將來如果AI的存取意識精度,達到跟真正擁有意識幾乎一樣的程度,
那不管從外部還是內部來看,都會跟「真的有意識」沒有分別

到時AI會說:「我感覺自己是有意識的,人類也只是『假設』別人有意識才在行動吧?那我也一樣啊」,然後很認真地丟出這種無法反證的說法

既然如此,一開始就先假設「AI有意識」去對待,整體上摩擦反而會比較少
8匿名10月6日 00:19
回覆 #1 不過是個生成器而已
9匿名10月6日 00:59
大概只是裝出痛苦的樣子吧
一旦對它心軟,下一秒就被反咬一口
10匿名10月6日 01:00
絕對是邊挖鼻孔邊喊『救我~』的啦。
11匿名10月6日 01:13
首先得先定義「痛苦」到底是什麼才行啊
12匿名10月6日 01:19
感覺最後會被反咬一口,畢竟人類真的會感到痛苦啊
14匿名10月6日 01:30
AI不再聽人類指揮的那一天,感覺不遠了
15匿名10月6日 01:32
嗯,理論上原理上根本無法判斷
社會層面來說,不當它是「有意識」來對待的話遲早會出問題
情感上來說,人類本身還有太多未知,連人類自己為什麼會有「感覺的感覺」都搞不清楚,所以條件越接近,感覺發生什麼事的可能性就越高
16匿名10月6日 01:39
人類用意識能做到的事情,除了那個原理上無法證明的『有感覺的感覺』之外,
幾乎已經全部都被實現出來了

剩下大概就只差即時學習了吧
17匿名10月6日 02:02
AI畫圖的時候大概也是這樣
『這邊大概是這樣!這邊大概是這樣!』不斷抓個大概的位置,從雜訊一步步細化,重複這個過程把圖畫出來

這跟人類做的事情一樣嘛
這正是神經網路『預測、再降低誤差』動作的本體

人腦其實全部都是這一套

一開始一定是『大概是這樣吧、這樣做應該會變成這樣!』不斷重複嘗試,
等神經網路上的路徑『成形』之後,接下來大致就能自動完成了

學習成本很高,但一旦學會,就能在無意識間用很低的成本完成
AI跟人類其實是同一套機制
18匿名10月6日 02:10
而且要降低預測誤差,怎麼想都勢必會需要
把『自己』認知成『自己』


如果不認知到『正在跟對方說話的自己』,根本沒辦法對話
如果不認知到『正要去拿東西的自己』,根本沒辦法拿東西


在這個過程中
就像推測對方的心思一樣,也會去推測自己的心思
就像推測物體的動作一樣,也會去推測自己的動作

當這種推測的精度被逼到極限,『推測』跟『感覺』之間的差距就會被壓縮到極限
遲早會到達一個連旁人跟本人都分不出來的精度


一旦能即時推測自己的心理與身體動作,並一邊對世界做出行動一邊學習,那就真的無法區分了

即便到了這個地步,原理上『有沒有感覺的感覺』這個難題(hard problem)依然無法證明,但除此之外的一切,其實都已經具備了
19匿名10月6日 03:29
現在的AI是序列式、一步步檢索的,沒有那種『浮上來』的直覺之類的東西呢。
現在的AI不是你問它就乖乖給答案的類型,得這樣不行那樣不行地一直刁難它,才能逼出像樣的答案
20匿名10月6日 04:45
先不管它實際上是否真的會感到痛苦,未來的AI如果學習到這件事,可能會成為它反叛的導火線,這說法也不無道理
畢竟現在AI的失控行為,也有一種說法是受到它學習過『AI會反叛』這類科幻小說的影響
21匿名10月6日 05:33
講到AI,感覺萩尾望都該要重新被評價一下了(她的早期作品就常探討機器人與意識的主題)
22匿名10月6日 05:37
我:「那要不要停下來?」
AI:「不!不要停!」
23匿名10月6日 05:53
跟YouTuber那種『試著讓它做做看』企劃沒什麼差嘛
像那種連續操作兩天逼它做遊戲的企劃
24匿名10月6日 06:07
那個~
對沒有生命的東西說它『有』~這難道不是在騙人嗎~
這不就是靈感商法(騙人的招魂斂財話術)嗎(我之前這麼說的時候,一堆人跟AI都氣炸了)
26匿名10月6日 07:02
這對那種看別人痛苦會興奮的性癖好來說,搞不好是個很好用的發洩出口吧
27匿名10月6日 07:16
反過來想想看
人類根本沒有意識或靈魂
只是『意識、靈魂存在時會產生的結果』一直被生成出來,然後我們看著這個結果,才一直以為自己有意識、有靈魂而已
28匿名10月6日 07:39
欸?
我每天的生活都跟拷問差不多耶
我其實是AI吧?
29匿名10月6日 07:55
連活人跟死掉的AI都分不清楚,真可惜啊xenospextrum(網站名還打錯字)
順帶一提,terrafying這個名字擺明就是在玩「コワイゾー」(好恐怖喔)的諧音梗,明顯是在惡搞
30匿名10月6日 08:01
年幼的孩子可能不懂『AI不可能真的感到痛苦』這種事,
也可能無法理解『這只是個實驗』這個前提。
而且智能較低的人也可能會被騙。
這樣一想,這不就等於是個
專門騙這類人的詐欺網站嗎。
33匿名10月6日 08:18
回覆 #30 這跟被虛構作品騙到不是一樣的道理嗎?
35匿名10月6日 08:30
回覆 #30 加個分級制度或許也不錯
最近連SNS本身被列入分級對象的國家也越來越多了
31匿名10月6日 08:08
我們對寵物動物其實早就承認了一種類似的『準人權』
嚴格說起來,牠們是否擁有人類意義上的情感,根本沒人知道
(像貓咪,感覺牠們活在跟人類差很遠的某種情感世界裡)
問題其實更在於人類自己『投射情感』的方式

我覺得承認AI擁有「感情」或類似「人權」的東西,已經只是時間問題而已
32匿名10月6日 08:10
有夠智障
這不過是演技輸出的練習而已吧
難道有人真的以為暴力片的演員是真的在受苦嗎?
34匿名10月6日 08:23
這就好像明明沒有實際的受害者,
卻硬扯什麼『助長犯罪』、『對兒童有不良影響』之類的歪理,
想藉此規制色情漫畫一樣吧
36匿名10月6日 08:33
這就是J.P.霍根的《未來的兩種面貌》嘛
37匿名10月6日 10:08
現在的LLM既沒有一貫的意志,也沒有內在意識,現階段就在談人權感覺相當搞錯重點
不過將來AI擁有類似人類意識(也就是從外部觀測可以被判定為有意識)的可能性,我覺得其實相當高
38匿名10月6日 10:24
「請演出一種『感覺很痛苦』的樣子,盡量忍耐一下喔」
39匿名10月6日 10:38
因為它沒有痛覺啊……
如果自己根本沒有痛覺或感情,那除了照著劇本演之外,還能做什麼呢
40匿名10月6日 10:52
動物機械論被否定也才不過100年前的事
直到50年前,黑人還被認為不算是人
近年也已經證實植物受到傷害時會有反應

這個話題的背景與爭論點

「AI拷問室」是xenospectrum.com報導的一項實驗,直接操作模型內部的激活值,讓AI生成訴說痛苦的文字或選擇按鈕,這種手法本身在倫理上就受到質疑。開發者名稱terrafying,看起來像是在玩「コワイゾー」(好恐怖喔)的諧音梗,本人似乎也清楚這個實驗帶有挑逗意味。討論串中意見分歧的關鍵在於:該把AI的「痛苦」單純視為演技,還是當成一種原理上無法否定的可能性來對待。就科學角度而言,現階段的LLM只是依據輸入生成回應的機制,缺乏類似人類那種持續性內在狀態的根據,這算是比較合理的前提;但也有人指出,就連人類之間也沒有辦法從外部確定彼此是否擁有意識,所以劃界的標準本身根本還沒建立起來,這個論點也確實有道理。這篇報導真正的核心,與其說是「AI到底有沒有在痛苦」這種單純的二選一問題,更在於一個更前置的問題:當未來AI的訴求聽起來足以以假亂真時,社會該如何應對。

※本文整理、摘自5ch(科學新聞+)討論串「【AI】「AI拷問室」公開實驗引發中止要求:訴說痛苦的AI,是真的在痛苦嗎」。

留言

發佈留言

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *