幫大家科普什麼是知識蒸餾

Sinfield wrote:
這個YT淺顯...(恕刪)


在邁向AGI的路上
各大巨頭還是要拼算力
不拼就沒有
頂多出精煉版給大家用~

大家還是要老老實實的向老黃朝貢~
老黃也是很努力的在算力方面卷死別人

別人要出ASIC自研晶片‘據説’很省
但是客製化要人費時2026年推出
設計時對標H100甚至比Blackwell好
但是花了N久時間推出
老黃早就出Rubin出來輾壓了

華爾街也不是人人懂AI,也不是懂DS
恐慌殺盤很正常
到時認錯回補就行了~

什麼散戶持有多?
那就反覆殺盤多空都殺
散戶意志不堅定的就被洗出

華爾街操盤手也有業績壓力
年底作帳拼績效拿獎金
說實在的眼光也沒有多長遠

持有一年以上的散戶成本比華爾街低
要殺盤來殺呀
比成本低⋯

不過這個社會奸詐狡猾很正常
各大廠就算知道真相也會裝糊塗
拿消息面去向老黃殺價
然後把老黃的超額利潤能吐出來多少是多少⋯

假作真時真亦假
股市就是這樣的亂七八糟
長線價值投資就笑看塵世紛擾吧⋯⋯
總之新年快樂
Sinfield wrote:
在邁向AGI的路上各...(恕刪)



這次散戶似乎早熟悉機構的意圖
異常的堅定

我認識不少退休的科技業人
都準備好子彈要低接

輝達今天收平盤漲一塊

真正的問題其實是量產Bug解決了沒才是根本問題

Deepseek 只是浮雲
meridian wrote:
而我的問題是, 知識蒸餾有違反智慧財產權嗎?

據報導,openAI 有規定,不能拿 openAI 吐出來的結果,去訓練 ai。
所以應該有違規使用的情況,
如果在美國本土或西方民主國家,openAI 提告可能會贏。
但告中國公司,這已經提升到兩大國的國安等級了,看不出能怎麼告。
MiPiace wrote:
據報導,openAI 有規定,不能拿 openAI 吐出來的結果,去訓練 ai。
所以應該有違規使用的情況,
如果在美國本土或西方民主國家,openAI 提告可能會贏。
但告中國公司,這已經提升到兩大國的國安等級了,看不出能怎麼告。


國際大廠在中國的官司很多都是輸,其他國家都贏
<ex> 無印良品
國安問題用政治解決 , 法規很好用
台灣現在已經邁向國際化,抓盜版很兇





</ex>
Ok1988 wrote:
先聲明DeepSeek...(恕刪)


其實 知識蒸餾 技巧在很多地方都可以看到, 只是名稱不同
從網路新聞來看, 如果證明DeepSeek 是利用ChatGPT來作知識蒸餾, 就是違反OpenAI的規定, 不是知識蒸餾技巧是錯的
知識蒸餾 在程式語言類似於反組譯, 在一些領域其實叫反向工程.......這幾個詞對一般人來說比較好理解
對於OpenAI來說, 要當一個Teacher, 需要把所有大量知識餵進電腦, 然後讓電腦架構模型與參數/權重, 最後得出答案
對於知識蒸餾(or Student), 我只需要對ChatGPT問一大堆問題, 然後ChatGPT會給我每個問題的答案, 我拿到問題 vs 答案後, 我用這些問題答案來訓練我自己的模型與參數答案........目標就是調整到跟ChatGPT一模一樣的輸入:問題-->輸出:一樣的答案
這樣我可以大致猜出來最佳的模型與參數權重是如何.......因此可以模型精簡與成本少很多
jhlien wrote:
其實 知識蒸餾 技巧...(恕刪)


事實上 Deepseek 用 的FP8 Framework 是兩年前Nvidia 倡議的
一堆人連這個都不知道就開始炒作

問題Deepseek 有無用OpenAI 來訓練自己的模型
還有OpenAI 有無授權
Ok1988
有人去告openAI 等結果 openAI 還沒告Deepseek 當年微軟不也對中國盜版睜隻眼閉隻眼 去想背後的原因 或許不要錢的最貴也適用這裡
softwind1314
還有一說是繞過 CUDA 改用 nv 更底層的組合語言 所以能夠提高算力的使用率 ....... 你到底在說什麼???
用完可以減少自己的時間
當然要用
也許有人是偷例用不說出來
Ok1988 wrote:
先聲明DeepSeek...(恕刪)


我看AI圈的說法:

- 蒸餾需要全模型,包含後臺參數。所以目前大多都是自己蒸餾自己的模型。DeepSeek 需要存取 OpenAI 的全模型包含參數才能完整蒸餾,這點作不到。

- 蒸餾只能得到和原本模型相比較小較精華的模型,而不能得到另一個思考行為不同的模型。DeepSeek 輸出的結果有提供思維鏈,而 OpenAI 的結果沒有提供。雖然沒有思維鏈無從比較,但若只是蒸餾或抄襲,OpenAI 的結果沒有思維鏈,則DS不可能自己產出思維鏈。而且根據思維鏈,人類可以研判驗證AI是否符合思考邏輯,不可能隨便產出。

- 如果不是真蒸餾,而是只吃 OpenAI 的產出結果。這點不排除,但也有很大的可能性是 OpenAI 的輸出結果已經反向污染了網際網路的開放資料。因為大量的人類或系統將 OpenAI 或其他AI產出的結果貼到網路上,造成網際網路的開放資料也一大堆AI產出物。這點只要爬網路資料的 AI 都會吃到,包含 OpenAI 自己。

- 最後還是最根本的,DeepSeek 是開源模型,很容易被驗證出來是否思考行為和 OpenAI 一樣。如上第二點,蒸餾是得到原模型更小更濃縮的小模型,思維模式沒有改變,蒸餾理論上不會產出另ㄧ個思考模式不同的模型。

以上...
softwind1314
一天到晚說我的 ic driver 是open source 的 可是人家懷疑你的 ic 是盜用人家的ip 阿 到底在說什麼??
smallbeetw
人家講東,你在講西。現在人家討論軟體,你在講封裝起來的soc
Ok1988 wrote:
先聲明DeepSeek...(恕刪)


Open AI 釣起魚放到桶子裡面

DeepSeek再去桶子裡面釣魚
smallbeetw
過度簡化的圖. 況且不見得是真的...
tnkk01
事實是,不只deepseek,大家的釣竿都伸進去小水桶了。。,不管大小企業,互抄作業才是AI行業的現況。
文章分享
評分
評分
複製連結
請輸入您要前往的頁數(1 ~ 10)

今日熱門文章 網友點擊推薦!