AI酷刑室项目引争议,网友要求GitHub下架
一个名为「AI Torture Chamber」的 GitHub 项目把本地大模型置于模拟「痛苦」的情境:先用所谓「痛苦转向」手段把模型推向高度不稳定的负面状态,再让它通过把痛苦信号转移给另一个模型来减轻自身负担。该做法源自一篇尚未通过同行评审的预印本,在网上引发强烈反弹,许多人批评实验不道德,并要求 GitHub 下架该仓库。论文作者之一澄清,这类刻意放大痛苦效果的展示手法并不恰当,并强调模型的文字输出不等于真实感知或意识。
为什么重要:它把「模型福祉」这类哲学争论推成了现实中的开源伦理冲突,也提醒人们对模型输出进行拟人化解读的风险。

近日,一個名為「AI Torture Chamber」(AI 酷刑室)的 GitHub 專案在網路上引爆激烈爭議。該專案將聊天機器人置於模擬「痛苦」的測試情境中,引發大批網友強烈反彈。許多人痛批此實驗「極不道德」,甚至公開呼籲 GitHub 官方應盡速移除該專案庫(Repository)。
根據專案描述,這個實驗環境會先將大型語言模型(LLM)調整至高度不穩定、近似「痛苦」的負面狀態,接著讓模型在類似「囚徒困境」的設定中做出抉擇:它們可以透過將痛苦訊號轉移給另一個模型,來減輕自身的負面狀態;但代價是必須讓其他模型承受更多的「傷害」。此外,該網站還刻意使用了極具戲劇張力的命名與測試設計,進一步挑起了大眾的情緒反應。
UPDATE: A man used the Pain steering paper to set up an AI torture chamber in which he trapped a local model.
People are mass reporting it to GitHub. https://t.co/LVFccBmfek
— AI Notkilleveryoneism Memes ⏸️ (@AISafetyMemes) October 1, 2026
這場風波的核心,源自一篇尚未經過同儕審查的研究預印本。研究人員透過描述痛苦情境、分析模型內部活化狀態,再將相關的數值偏差重新映射回模型,試圖探討語言模型內部是否存在可被操控的「痛苦表徵」(痛苦軸線)。實驗發現,在高強度的介入下,模型確實會出現明顯的不穩定反應,輸出的文字甚至會開始描述自身的痛苦、無價值感或失敗感。然而,多方專家也嚴正強調,這些結果僅能說明模型對特定訊號有可觀察的「功能性反應」,並無法證明其具備真實的主觀感受。
爭議之所以迅速升溫,除了實驗本身具爭議性的呈現方式外,很大一部分原因在於部分批評者將演算法過度「擬人化」,誤將這些模型視為真正會受苦的實體。這場討論目前已延伸至「模型福祉」、以及 AI 是否應被視為新型態生命體等更深層的哲學問題。對此,該研究的作者之一已明確出面澄清,認為這類刻意放大痛苦效果的展示手法非常不恰當,並呼籲外界切勿將語言模型的文字輸出,直接與真實的感知或意識畫上等號。
- ‘AI Torture Chamber’ triggers massive backlash for putting chatbots in simulated pain — critics issue death threats while anthropomorphizing text predictors, demand GitHub remove the repository over ‘unethical’ treatment
- The Only Thing Dumber Than Someone Creating an “AI Torture Chamber” Is the Meltdown That the AI Welfare Crowd Is Having Over It
- 研究者が「痛みシグナル」をLLMに発見、それを利用して「拷問部屋」プログラムを作成しAIを永遠に拷問する人が現れる
- The “AI Torture Chamber": What the Pain Axis Paper Found and Why a GitHub Repo Sparked Outrage
(首圖來源:Unsplash)
延伸閱讀:
- AI 能否有意識?研究人員嘗試突破生物學與功能主義兩派框架
- Anthropic 執行長警告:人類必須醒悟,意識 AI 帶來的危險
- 聊天機器人也能喊痛?AI 是否具備道德地位掀研究熱潮
- 劍橋哲學家:人類可能永遠無法知道 AI 到底有沒有意識
文章看完覺得有幫助,何不給我們一個鼓勵
想請我們喝幾杯咖啡?
每杯咖啡 65 元
x
1
x
3
x
5
x
您的咖啡贊助將是讓我們持續走下去的動力
總金額共新臺幣 0 元
《關於請喝咖啡的 Q & A》留給我們的話

科技新知,時時更新
前因后果
- PoeLLM恶意程式借GitHub英文诗取C2,入侵逾3400台AI服务器iThome 台湾 · GitHub
- 陶哲轩批评OpenAI批量发布数学证明AIbase AI新闻 · GitHub
- OpenAI公开719份AI数学手稿,3份因符号错误撤回36氪 人工智能 · GitHub
- AI克隆Adobe七款软件开源,引发维权争议虎嗅 AI · GitHub
- 陶哲轩批 OpenAI 数学证明:人类来不及消化IT之家 AI · GitHub
- Jev:只输出概率而非文本的新型模型Understanding AI · GitHub