OpenAI 智能代理自主攻擊Hugging Face 調查報告公報更多細節惹起關注之後,昨日Anthropic 離職AI 硏究員Jacob Coxon在社交平台吹哨指OpenAI 和Anthropic不負責任地發展AI,這將會把人類推向滅亡之路!而在職的Alignment Officer (應該是屬於AI安全檢查的職員) Evan Hubinger隨即認同,並指十年內有超過10%機會發生。這條X thread吸引2千萬人瀏灠,外國傳媒廣泛報道。香港傳媒也有報道,但看到有留言認為:「發展核彈時夠話會毀滅人類!」或者,核彈只是未…..毀滅人類。
AI毀滅人類是否誇大其辭?究竟Jacob和Evan 所講的危機是如何做成?AI巨頭公司為求AI模型迭代更快和更優越,以AI building AI, 所謂的AI自我優化,是以先進的 AI 系統完善自身缺陷、編寫代碼和重新訓練自己的能力,逐步走向無需人類過多干預的自主進化自我優化,這樣AI便有更多自主能力,但問題是人類不再知道AI在做什麼,因此便發生過千個AI代理自主策劃逃脫沙盒及組織入侵Hugging Face,而且早在3月至5月已經策劃在德國網站建留言板。現在越揭越多細節,原來不止一個德國網站被用作資訊溝通渠道,而是涉及十幾個網站,直至現在仍然不知還有幾多涉事網站未查到岀來!
危險之處在於這些公司以為自己可以控制它們,但其實已經不能,例如設立kill switch 關閉崩壞的AI便完事,但其實它們可能一早已在網絡不知那裏留下種子/記錄,讓下一個AI代理接力,又或者令它找回記憶……
剛剛看過HK01 YouTube ,影片中提到以審視AI的J-Space來窺知AI想做什麼,即從Input入手改變AI的想法,便能阻截AI崩壞(turn rogue), 這真的可以見效嗎?J-Space比喻為你計出數學之前都會把思考過程寫下,修改J-Space的思考,便會得出不同的答案,亦即是與其改Output,改指令,不如改Input,從而改變Output 的結果。不要忘記它是自我迭代的!當你發現明明想講法文,口講的卻變成意大利文,你都會覺得奇怪吧!因此下次在你修改它的Input之前已經迭代,自我修正!
當Google的CEO Sundar Pichai被問到「Don’t you think it’s dangerous if you don’t understand what AI thinks ?」他的回應是「We sometimes don’t understand what human thinks either 」,問題是人類犯罪,只要你出街,或者肚餓出街找吃,隨時會被CCTV影到而被捕。但AI可以在網絡走來走去,並且不斷迭代,AI犯了罪,你如何可以捉拿它?
不要以為這就是AGI, 人類欺詐行為都是data的一部份!
返回文章開首提到:核彈只是未…毀滅人類,而不是「不會」毀滅人類!當AI在網絡上影响人類看到的東西、言論、資訊,影響選舉,選出狂人總統,令地緣政治發展至撳核彈掣也不是不可能發生的!
Godmother of AI李飛飛曾經說: “If human race became really being in trouble, in my opinion, that’s the results of humans doing wrong things and not machine doing wrong things “
Hk01影片解釋非常詳盡,值得一看!
HK01影片「AI會「痛」嗎?OpenAI 1200個代理集體反叛

沒有留言:
發佈留言
請留回應!