作者ffdqfe (苦惱)
看板Gossiping
標題[問卦] 大語言模型不能限制是不是很危險?
時間Mon Jun 22 16:45:06 2026
如題
喜歡科幻作品的人
應該都知道機器人三定律
但llm本質上他們根本不能堅持任何限制
譬如現在有各種各樣的nsfw限制
但可以在模型內輕鬆被人類繞過
可以被蒸餾出不含限制的版本
最後閉源模型商只能在輸出、輸入中
加入傳統的審查限制
所以有時候可以看到ai本來輸出了一大堆
然後馬上被警告文字取代
但本質上現在的llm根本無法堅守規則
自然也無法像人類想像的
把機器人三代定律埋進最底層
而且這是結構上的缺陷
不管發展的多深都無法改變的問題
然後人類正在全力開發這東西
這樣是不是很危險?
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 118.233.4.142 (臺灣)
※ 文章網址: https://www.ptt.cc/bbs/Gossiping/M.1782117908.A.2AD.html
→ GKKR: 什麼時候AI可以創造一個泡湯罐頭,把人類都 82.140.187.51 06/22 16:46
→ GKKR: 關進去,讓我進入永遠在2005年的世界 82.140.187.51 06/22 16:46
推 simon9331: 天網或母體二選一吧。 42.77.5.119 06/22 17:04
推 saladbread: 第一手,電源 36.238.98.170 06/22 17:10