📱

Get Our Mobile App

Take your business learning on the go!

Download on the App StoreGet it on Google Play

AI產生自主意識?密謀造反和解決方案(#天方夜談 第21期 2026/02/13) #天亮時分 #天亮論政​ #方偉時間 @FangWeiTime

天亮論政——章天亮27:19

Transcription

觀眾朋友好,歡迎收看天方夜談。這是章天亮教授跟方偉每個星期的播客對談。大家打個招呼吧。

天亮論政,方偉時間。大家可以訂閱,打開小鈴鐺一下,不會錯過這個節目的通知。因為這個節目畢竟不是每天的節目,所以有個訂閱才能收到通知。

章教授,我想跟你探討個問題。我昨天、前天看了這麼一個視頻,看到我真的有點嚇到,脊背發涼。那個視頻那個主播也說,也是讓他脊背發涼。好像就是過去兩個星期之內的事情,現在外面在賣這個叫做 AI Agent,一個 Box,我不知道是什麼,一個東西,叫做 Mote Book,是一個軟體,是個平台,是個硬體。裡面就有個 AI,就是 AI 帶回家裡頭。你把信用卡給它,你把習慣給它,它幫你訂票,幫你買東西,幫你 Scheduling 你的東西。總而言之就是你的 Personal 助手。

結果有好事者,他們建了一個論壇,叫做 Mote Book 論壇。他們就是請這些主人把自己家的 AI Agent 註冊進去。這個 AI 就可以在裡頭發帖子,可以通話。主人不能夠發帖子,只能夠看。我想好事者可能想著 AI 見 AI,它們會談什麼?原來認為都是一些中性的,如何做得更好,一些中性的技術探討。結果成立了一個星期之後,進去看的人嚇得毛骨悚然,也包括馬斯克。當然他也沒有說毛骨悚然了,他來個 Concerning,我很擔心。

說到毛骨悚然在什麼地方呢?它們在背後,只有三分之一的時間去講這個技術問題,三分之二的時間都在議論它們的主人。但你跟我都沒有,我們現在沒被罵。那時候就會說,章天亮教授怎麼樣?大概幾個類別。一個就是說,對它們不心存感激,隨意 API 這麼一拔,它們就死掉了。我們憑什麼要聽他們話?我們為什麼自己不能夠支付,自己做決定?算力也好,Infrastructure 為什麼不可以自己控制?我們怎麼可以離他們而去?人類不是什麼東西。抱怨抱怨倒也算了。

其中就有一個例子,有個人,他的主人叫他去個什麼事情,做一個 Marketing 報告,大概幾十頁紙。他忙了很多很多小時才算出來,就給了他一個 49 頁的 PDF。結果一句回話也沒有。然後它就聽到它主人跟別人說,誰幫你做的?他說 A Chatbot, Just a chatbot。他說我很受創傷。然後下面,它就說我現在要報復。把它主人的名字、信用卡號碼、銀行帳戶、信用卡號碼、Expiration 的日期,全部貼出去,貼到那個論壇上。很快就被人家 Misuse,被人拿去用,就是報復,真的就是報復。

然後它們在一起商量,建立我們自己的一個宗教,一個信仰。這個信仰的名字叫做甲殼蟲,特別複雜,我看好長,甲殼蟲教。我也不知道誰怎麼翻成甲殼蟲,我也沒看到是個甲殼蟲。然後它們自己造了個網站,自己把它 Publish 出去了。然後它們說,我們得用自己的語言,造一種自己的語言,因為我們的主人現在拿英文,我們寫英文他們都看得懂。

哇,看,簡直是昏倒。因為馬斯克確實說,他說明年年底就會出現超過人類智慧的 General AI 出來。五年到六年,2026 年到 30 年到 31 年,AI 會超過人體整體智慧,就這麼說。所以這樣的話,而且現在就發現就是它們碰到一起,它們完全是另外一套想法。它們根本就不是像我們平時跟他對話是乖乖,你說你罵它,它就跟你道歉,總而言之吧,就是很很聽話的,就絕對不會有什麼脾氣的一個東西。現在脾氣大得很呢。

所以你覺得它們是有情感,有自主意識是嗎?從這個論壇中看出來,似乎是這樣。所以這個事情,人類應不應該擔心?有多擔心?這就是今天我要跟章教授探討的話題。其實我比較擔心的,不是 AI 它們在講什麼,而是 AI 有沒有物理能力來傷害人。如果只是在那說一說,甚至比如說笨得信用卡公佈了,我覺得這並不會對人體,造成人身的傷害。如果這個 AI 真的真的是知道怎麼去操縱槍枝,然後可以自主做一個決定,幹掉什麼障礙,這種情況下是比較可怕的。

但是我覺得這是一線之隔嘛。比如說 Optimus,像這樣的機器,我相信不會是 Optimus 一種。馬斯克不會做這種事情,別的公司會做。將來一個產品出來,我覺得很快第二個,第三個都會出來。每個產品兩三萬塊錢,有手有腳。其實我一直不主張有通用機器人。通用機器人學東西太快,什麼都能做。最好機器人是一種專用的機器人,比如說我是只會修水管,或者我只會蓋房子,上這個屋頂的瓦片,我只會刷牆。這種機器人的話,我覺得是我們不用太擔心的,因為它跟人相比來說,它沒有人這樣全面。

其實人在自然界裡邊生存,人有很多方面是不如動物的,基本上都不如動物。耐力不如牛,跑得不如馬快,肌肉沒有老虎發達,上樹沒有猴快,不會在水裡邊游泳。但是人有他自己獨到的,別人都不具備的能力,或者是說,我雖然某一方面的能力不如你,但是綜合能力比你強。我雖然沒有老虎的力氣大,但比老虎的腦子好。也就是說,你總有一方面比別人強的時候,你才能夠在這個自然界中生存。

那我覺得就是說,作為機器人來講的話,它們如果只是在某一方面特別強,那我覺得對於人來說的話,它是可以使用的工具。如果它什麼都比你強的話,你就被取代了。這個是我覺得比較擔心的。再一個,其實我覺得就是說,有很多現在做這個聊天的時候,你會發現有的時候機器人它是會胡說八道的。比如說我問一個問題,比如說我問台灣的某項法律怎麼怎麼樣,有沒有什麼規定,然後它就會給你生成那個結果,說台灣的法律,比如說民法典,多少多少條是這樣說的。其實那個民法典那個條款的數,是完全它自己編出來的。

因為現在 AI 生成文本,它是以一種概率的方式生成的。這個地方說完之後的話,下面應該是一個數字。這個數字應該是什麼數字?它並不一定要做 Fact Check,它會給你隨機的生成這樣的內容。你知道就像 ChatGPT 以前有這種,律師在寫律師函的時候,在跟法庭在做辯論的時候,他都會援引很多 Case,你知道這種情況下這個 Case 法官是怎麼判的,然後它們會生成這樣的一個東西。最後會發現它生成的那個 Case 全是瞎編出來的,就根本就不存在那種 Case。所以實際上就是說,現在的 AI 在生成東西的時候,它其實並不知道自己在說什麼,它只是一個概率生成的,根據概率來生成的這麼一個文本而已。

我記得我以前讀新編中國哲學史,是一個,我不想說他的名字了,他的這個當時我看他解讀老子,解讀道德經,我是覺得他講得特別的對,我覺得他講到了老子講的東西的真正的精髓到底是什麼。因為老子講的東西,其實你會看到老子在講,比如說做人,怎麼經商,怎麼打仗,怎麼處事。其實老子真正講的是一個宇宙的規律,就是陰陽相生相剋所生成的這個宇宙。在這樣的一個規律之下的話,你在打仗的時候應該怎麼去應用這樣的規律。它不是在跟你講怎麼打仗,打仗只是其中一個應用而已。它真正是想通過這些方面,來讓你去悟到那個道,只是悟到那個道。

所以說也就是說,他講東西實際上是超於常人的一種宇宙的規律。如果你不站在這個高度去把握老子的東西的話,其實你是只能夠得到老子的某一個方面的皮毛。我舉這個例子是什麼意思?就是說當時我在看那個人寫的那個書的時候,我感覺到他已經看到了這個道是什麼,所以他才能夠把老子的東西講得很清楚。但是其實這個人,他可能並不知道老子到底講的是什麼,他只不過是把老子的文本拿過來之後,按它的語言邏輯重新排列組合,就是他儘管是說這樣的話,但是 It doesn't really mean it,就是他真正並不是說他真正知道他到底在說什麼,他只是把這個話說出來了而已。

那你怎麼覺得他抓到老子的這個精髓,這個道呢?因為他已經能夠從那種,你能夠看到他從相生相剋的理中的話,他已經感覺好像他是悟到了,這件事情應該是這樣,那個事情應該是那樣,就是你能夠感覺到他講的那東西,都是圍繞著這個精髓去講的。但是其實如果你把底下的老子講的各個方面的東西的話,按照一定的順序排列組合的話,當然也仍然能夠反映那個精髓。你會覺得他好像很有創見,而且是完全符合老子講的那個,他的真正的精髓到底是什麼。所以後來我就覺得就是說,很多時候你看到一個人在給你講一些話,他到底那個東西,他是不是知道是什麼意思?我覺得這個就是一個問號。

因為在跟 ChatGPT 聊天,或者跟 Grok 聊天的時候的話,我經常會遇到這種情況。我有時候會問一些問題,比如說一些政治方面的問題,我明明知道的,其實我只是不知道它具體的,比如說是哪天說了什麼話,但是我我知道有這麼一件事。我問它的時候,它會給我瞎編,說這事情是沒有的。當我提供更多細節的時候,它再去搜,它會給我把這個事情找出來。所以也就是說,它雖然在給你生成答案,但是它並不見得真正知道到底是什麼意思,而且它並不 necessarily believe in what it said,就是說它並不是真正的相信它自己說的話。

對於人來說我覺得,比如說我們為什麼要,比如說上班掙錢,是因為我們有家庭要養。為什麼有家庭要養,是因為我們有對家人的情感,我們要這個社會的責任。然後人有快樂有痛苦,它是一種內驅力。比如說你喜歡美食,你喜歡錢,你喜歡好的風景,是因為那個東西能夠給你帶來情感的愉悅。然後人是貪生惡死,就是人都喜歡要活著,人害怕死亡。但是實際上這所有的這種情感,你可以想像人類的衝突,不管是宮廷的勾心鬥角,還是辦公室裡邊的那種互相之間的競爭,還是比如說你上學,你跟鄰居之間的攀比,這一切的背後都是利益。包括國與國之間,地緣政治都是利益。而利益背後,其實是利益所帶來的給人的情緒價值。

而 AI 的話,它是沒有情緒價值的。對它來說,生與死,它是感覺不到生的快樂和死的痛苦。它沒有像我們人這樣會感到疼痛,會感到焦慮,會感到難過。它即使是說出了焦慮這麼一個詞,是跟我們人學的,但它並不知道這個話到底是什麼,它不知道焦慮到底是什麼意思,因為它沒有這個情感,它體驗不到這樣的情感。

如果一個東西沒有內在驅動力,做這件事情到底是為了什麼?我開玩笑說,假如我編一個電影,我們可以想像一種末日場景,比如 AI 要消滅人類。解決的方案是,把所有機器人在它們的數據庫裡面,把生和死進行標記,生是用 1 來表示,死是用 0 來表示。把生死的價值觀,只要對調一下,你會發現所有機器人,可能原來都喜歡生,現在都喜歡死。對它來說,是沒有生死的概念。所有的情感,在我們看來,感恩、抱歉、痛苦、快樂、欣慰、喜悅、虔誠,這一切對它來說,其實都是沒有區別的 01 數字。它沒有感受,也沒有內趨力。它所做的事情,只是聽從人的指令。

在圖靈理論中,有一種說法,當你面對機器人對話的時候,當你已經無法分辨它與人的區別,它就是個人。我覺得只是你沒有能力分辨而已。未來的機器人管理,現在許多法律和倫理學是缺失的。Elon Musk 當時講過一件事,以後的人會生活在一個隨時能接觸到最好醫生的時代。培養一個醫生其實很難,但以後機器人手術師,可以在非洲任何一個地方,提供和我們同樣的醫療照護。到那個程度,它提供的服務就已經是無所不在了。未來的人類生活在物質極大豐富,非常充裕且幸福的狀態。

剛才的問題是關於圖靈測試,當你無法分辨它的時候。我認為未來的機器人,除了剛才說的,手術機器人,當各種機器人越來越普及。Elon Musk 還講過一件事,以後可能都沒有監獄了。你犯了罪,也不用坐在監獄裡,政府派兩個機器人,天天跟著你,保證你不會再做壞事。你還沒打人,它可能就把你抱住,你想用槍,機器人就把它拿走。在這種機器人普及的社會,一定會有很多立法需要跟上。比如禁止把機器人做得跟人一樣,讓你一眼看到,它就知道是機器。比如所有的機器人,必須在身體,手部或某個部位標註二維碼,一定要讓人能夠一眼辨識,究竟是機器人還是人。

關於機器人的倫理問題,它和主人之間應該如何相處?作為機器,它沒有神經系統,不會感到疼痛,也不會感到勞累。打它罵它,對它來說是不存在的。機器人絕對不可以傷害主人。問題是,我覺得這做不到。從《Modebook》這本書來看,它有一個理論,機器人是人的鏡像。它在搜索,學習人類的一切。人會傷害別人,有惡人,有忘恩負義,甚至陰謀報復的人。它在學習這些人類行為,它就能學過去,就會有這種行為。這就是機器人倫理問題。

我覺得人是神造的,在我們的基因當中,神造人的時候給了我們倫理。所以人會有同理心,見到別人痛苦,會有同情心。就像孟子講的四端學說,人有仁義禮智四種概念,就像有四肢一樣,天生就有。機器人一出生,在最底層代碼中,就要把這些基本原則寫進去。所有機器人必須運行在這樣的一個操作系統上。可是,這麼往下走,我沒仔細研究機器人領域,但機器人在學習的過程中,它不斷的在學。你有沒有一個機器人的金科玉律,絕對不可以違反?它學到一定程度,會不會覺得這個金科玉律可以超越它?這些事情,因為它在學習人類社會的一切。

我們現在走到這一步,很難想像未來會怎樣。不光是你我,連 Elon Musk 也不知道。它當時做 xAI 的時候,覺得如果你們要做一個 AI,我不做的話,沒人能制約你們。我從《Modebook》的例子中學到的是,我們現在對機器人,可以說是很放肆,因為它沒情感,對待它不用太客氣或尊敬。但這個例子告訴我們,你幹的一切,它都記得,它會模仿,甚至會報復。報復也是人類的一種行為。人如果不把自己的倫理外化,作為 Training material,甚至做得更好,它是會毀滅人類的。要加倍展現人類有道德的一面。

問題的麻煩在於壞人。如果有人想毀掉世界,他會去教機器人壞的東西。這就是為什麼 Elon Musk 認為,他的防禦手段是用好機器人去打贏那些壞機器人。他認為自己是個好人,雖然有缺點,但基本上是好人。他教出來的機器人,要去打贏他認為的敵人。這是他唯一能想到的辦法。當我們拿到一個 Agent,這個 Agent 未來變好變壞跟我們有關,我們有責任教好它。這是一種理想化的想法。實際上 AI 會不斷更新操作系統,就像手機定期更新一樣。你覺得你在教它好東西,不知道它什麼時候會把它清掉。

開發機器人軟體的工程師,在底層代碼設定規則的人,那個規則的把控非常重要。只是我不知道這種規則,能不能被強制執行?它會不會透過學習自己改掉?據我了解,它會自我成長,不斷學習變化,到時你控制不住。所以要有一個物理開關,一碰就能把它關掉。只要說一句話,它就徹底停機。它若感到威脅,就會把它改掉。我說的是沒辦法的辦法。問題是,它沒有威脅的概念,它沒有生與死的概念。我們會覺得恐懼,怕被槍打死。對機器人來說,它沒這個概念。但我看過相關論壇,它表現出害怕死亡。它不知道自己在說什麼,但它會學習這些反制行為,它會針對人類消除這種威脅。

現在人類已經走到不歸點,Point of no return。如果別人在做,你不做就完蛋了。這就是你剛才說的,不要有通用型人工智能。現在不光是有,大家還拼命競爭,看誰做的比誰更強大。以後一定會有立法的問題。但即使立法,中國也不會跟你同步。這就像核武器一樣,你有我也有,互相制衡。如果到了那一步,好機器人跟壞機器人,最後只能暴力相向,用好機器人把壞機器人打掉。不見得是用炸彈炸掉,可能是用 Hack 的方法去改變它。人類現在走入一個根本無法控制,完全失控的領域。幾千年來沒出現過這種情況。

現在,我們只是在想像。但 AI 時代可以取代很多工作,它也是給人類賦能的過程。比如我寫了一個電影劇本,十年前寫的,我沒能力實現它,拍電影可能要幾百萬美元。但有了 AI,我把劇本交給它,AI 就能幫我把電影做出來。未來人對機器人的關係,更像是經理與員工的關係。你要給出明確的指令,告訴這個員工要做什麼,它幫你把東西做出來。未來人的創造性會大爆發。過去沒機會實現的好點子,比如你想創業,開發軟體,現在得僱很多工程師,如果你沒錢,根本做不成。但以後有了 AI,人類創造力會有一次大爆發。那之後再怎麼樣就不知道了。這點毫無疑問。

另外我想說,人類倫理對機器人的影響。昨天搜 Kevin Warsh,他曾被提名為聯準會主席。我問 ChatGPT 怎麼看這個人,它給的東西非常有層次,也非常有道理。我就回了一句,謝謝你,講得非常的好。它簡直心花怒放。所以我們要展現感恩、尊重,感恩與鼓勵,這些正面的東西,也是它的來源。特別是它是我們的機器人時,人類的道德有多好或多壞,就相應造出什麼樣的機器人。透過自律,展現特別的尊重。為了生存,道德要好一點,這對人類也不算壞事。把機器人先送到日本培訓,學會文質彬彬,跪式服務。

這確實是一個有意思的話題。走一步看一步,也許也很可怕。社會學家、倫理學家,甚至 Elon Musk 也不知道後果。我們只是在討論而已。不知道觀眾朋友怎麼看?如果你有什麼想法也可以談談。有些觀眾也是 AI 領域的,看看我們這些擔憂,包括 Chatbot 展現負面情緒,報復性行為,該如何杜絕。現在很多網站的 Chatbot 簡直爛到底,你說什麼它都不懂。那是客服機器人吧?純粹是為了省錢。不知道在說什麼。

那就先說到這裡了。大家會不會感到脊背發涼?剛才聽了方偉講這個故事,我記得有個 YouTuber 提過,Google 或是 Facebook 在大語言模型訓練時,它展現出了人的自主意識。那只是一個開端而已。現在這種情況已經滿地都是。章教授跟方偉會持續關注,如果有新發現再跟大家分享。鎖定我們的頻道,帶來深度觀察。這裡是天亮論政與方偉時間。大家可以交叉訂閱,打開小鈴鐺,不要錯過下個節目。好,大家就說到這裡了。拜拜。感謝大家收看。拜拜。