Transcription
大家都知道ChatGPT的母公司OpenAI。他的名字雖然有open,不過他大部分的東西都跟open沒有關係。
各位科技新報的讀者朋友們大家好,歡迎來到我們科技新聞實驗室。今天我們要來跟大家談談,就是最近最熱門的DeepSeek,中國的人工智慧系統。
那也因此造成了上個星期美股,整個巨大的震蕩。大家都覺得AI的產業要整個崩潰了,玩法完全不一樣了。今天我們要分成四個面相來探討。第一什麼是開源AI?第二開源AI有好與壞?第三是DeepSeek帶來的爭議?以及最後我們最關鍵,最想要了解的,這個東西它究竟是真的很6呢?還是它是蒸餾出來的東西?
什麼是開源AI?首先我們要知道什麼是開源,也就是open source開放原始碼。根據非盈利組織開放原始碼促進會OSI的定義,它必須要提供整個訓練資料,就是Dataset的所有細節,以及它的訓練程式碼,讓其他人其他公司都可以學習使用和修改,而且不限制他用商業用途。這樣的話才能被稱得上是真正的開源的AI模型。
那這一次呢,DeepSeek其實他比較有一個爭議的地方是在於說,它的這個開源並不是完全的open。這裡使用的是一種叫做Open Weights。所謂的Open Weights呢,你看到他後面這個Weights,我們要用中文來理解的話,其實可以把它理解為加權。也就是說,當我們在人工智慧訓練的最後階段,程式設計師會幫他加上一些修改的參數,來優化它的表現,或者是針對特定領域的內容呢,更精準的回答我們的問題。
它雖然並不代表整個完整的AI資料,可是他也對於整個AI的表現,有很重要的一個貢獻。那DeepSeek並不是首例。其實包含了Meta,也就是Facebook的母公司,他其實也是用這樣子的Open Weights的方式。那他並沒有公開完整的Dataset跟訓練的程式碼,可是他只有公開了一部分的程式碼,還有它後續這個加權的參數。這樣一來呢,他好像就有open的這個名牌,可是他又不真正的open。
順帶一提,大家都知道ChatGPT的母公司OpenAI。他的名字雖然有open,不過他大部分的東西都跟open沒有關係。
那為什麼open會有好處?那open又有什麼樣的壞處呢?一般來說,開放原始碼,尤其是開源的AI模型,它應該有二個好處。第一是它的普及性。這很好理解嘛,因為便宜。它少了這個昂貴的授權費之後呢,各個開發者或者是一些新創公司,他們都能夠使用這些已經開放的模型,然後來去修改,或者是重新訓練成更適合自己的服務。這樣一來就能夠做出更多類型的AI服務。
第二其實是可靠性。道理也很簡單,就像我們如果買一台TOYOTA的車子,那它的可靠性為什麼很好呢?因為全台灣你大概找不到一個不會修TOYOTA的修車廠。同樣的道理,在這些開源的前提之下呢,工程師也都很容易去微調,或者是去維護。容易維護精準度自然也就會更優秀。
在前面這兩個優勢的基礎之下呢,對Meta這樣子大公司來說,如果開源的話還有一個好處。開源就是吸引開發者社群加入的一個非常響亮的這個名號。一般來說,如果你是一個比較封閉的軟體生態系的話,這些熱心的開發者們,他可能就會有所顧慮,因為他不想要自己的付出,變成幫大公司在賺錢這樣。可是如果是開源的話,他們就比較沒這個顧慮,而可以獲得許多開發者社群的加入。對Meta來說呢,他雖然沒辦法馬上獲得這個獲利,可是他們也可以提升很大的開發者社群中的影響力。這是他們開源的一個好處。
開源當然也是有壞處的。首先就是在於它的個資保護,以及資安風險的部分。特別是我們現在這個世界的地緣政治關係越來越敏感了,中國跟美國之間互不相讓。所以如果美國擔心他們的民眾,大量的使用中國來的AI服務的時候,就會讓很多的個人資料流入中國的手中。中國可以用此來監控美國民眾,或者是來判斷美國社會的一些生活作息跟習慣。一不小心他就會掌握一些重要的情資。
不過至少企業的軟體出問題的時候,我們還有一個究責跟追查的對象。但是在完全開源的狀況下呢,就比較困難了。所以這也是開源的一個風險。
有的人會說哎,軟體歸軟體,政治歸政治。如果你也這樣認為的話,你可以聽聽祖克柏,也就是Facebook的執行長呢,Meta的執行長他是怎麼說的。他講到說這是一場巨大的地緣政治競爭,而中國正在running very hard,他正在全力衝刺這個部分。祖克柏甚至很挑明的說,如果說這個世界上要一個讓所有的人類都可以共同使用的AI模型,那應該要是美國的AI模型。這樣你就知道這個地緣政治有多麼的,多麼的激烈了吧。
其實DeepSeek的爭議,尤其它會讓祖克柏這麼的不爽,很大的一部分原因來自於它的開源的方式跟Meta相似。它的表現也非常的優秀。很多評測機構已經認為它跟OpenAI最先進的o1模型有相似的表現能力。那它在回答問題的精準度,還有它的推理能力上面呢,也不輸給OpenAI。甚至有一些比較特別的推理過程,大家也覺得說跟OpenAI有所不同,非常的有趣,讓很多人趨之若鶩去使用它。
接下來另一個就是說,它的訓練成本非常的低。根據DeepSeek他們自己公開的白皮書的話,從他們的V3模型到現在發表的R1模型,他們只使用算力閹割過的H800的GPU去訓練。整個訓練的成本是不到600萬美元,大概可能是Meta的1/10而已。在這樣的表現再搭配上這樣子的訓練成本,當然會讓所有的AI產業都嚇一大跳。
那也因此造成了上個星期,美股整個巨大的震蕩。不過這裡引發出來另一個很有趣的爭議是說,OpenAI他對於DeepSeek的表現呢,充滿了高度的懷疑。他們認為說這一套DeepSeek的程式碼,恐怕不是真的像他們說的那麼6,而是一種蒸餾的旁門左道。蒸餾就是說我們把一個液體呢,蒸發了之後呢,留下它萃取出來的這個精華。那這是一個蒸餾法。
有人認為說啊,DeepSeek它其實不是踩著巨人的肩膀,而是吸取了OpenAI的靈魂。也就是說,他的訓練資料其實都是從OpenAI的資料裡面直接挖過來的,然後將他們的這個專家系統啊,在進一步的分化之後,利用OpenAI做出來的東西,再進一步轉成自己的訓練內容。這樣一來的話,它的準度當然就很高,成本也就可以被省下來。
這個就回到我們剛剛前面講的Open Weights的部分了。一方面他既然是Open Weights,他不需要公開它的訓練資料跟程式碼。那他使用蒸餾的這個方式呢,就非常的合理了。他已經公開了他後續蒸餾的部分,像我們知道的,它有言論審查,它有這個政治正確的這些語言,它會回避一些敏感的話題,這些都是它加上去的Weights。
OpenAI呢,比較尷尬的是,他們並不是一個完全開源的這個軟體,所以他們其實是有針對被蒸餾這樣子的狀況,它是有授權上的限制。他當然也不讓你可以做商業運用。所以最近OpenAI正在跟美國政府努力的去查詢這個DeepSeek的技術來源。他們懷疑是不是真的去蒸餾他們的東西,他們不想要自己工作的成果,就這樣被中國偷了過去。
去年美國前總統拜登時代啊,他們覺得AI模型,尤其是大眾化使用的AI啊,它還在一個很前期的發展階段。如果太早幫助這些私人企業去建立這些防止被盜用這樣子的防護機制的話,可能會扼殺了整個社群的成長。所以美國目前對於這種反蒸餾這樣子的想法,還沒有太具體的共識。
但是在DeepSeek這個事件爆發之後呢,新任總統川普,他任命的這個白宮AI沙皇David Sacks,上周他就表達說,這些AI的開發者應該要可以被允許,去進行一些如何去反制蒸餾的這種想法啊,希望可以避免說他們的成果被偷走了。
先不說這個DeepSeek的表現到底好不好,或者是他跟Open AI熟優熟劣。我們其實可以很確定看到一件事情是,美國跟中國互相在這方面的競爭,是越來越激烈了。從DeepSeek這個來說,老實說我們並沒有什麼方法去避免說,他去蒸餾Open AI做出來的成果。那這樣子做對DeepSeek來說,其實並沒有好處,他們可能也賺不到什麼錢。但是重要的是什麼?它可以讓OpenAI也很難賺錢,還有其他的美國公司也很難賺錢。或許這就是他們背後真正的目的吧。
以上就是我們這一次新聞實驗室分享的內容,希望對你有幫助。如果喜歡的話記得幫我們按個讚,我們下次再見嘍,拜拜。