AI Marketing

字節跳動 內部嚴禁 蒸餾開源模型 張一鳴:願為長期目標犧牲短期收益

字節跳動 內部嚴禁 蒸餾開源模型 張一鳴:願為長期目標犧牲短期收益

字節跳動 內部嚴禁 蒸餾開源模型
張一鳴:願為長期目標犧牲短期收益

人工智能(AI)大模型競爭加劇之際,據報字節跳動(ByteDance)創辦人張一鳴,在7月Seed團隊全員大會上罕有發言,表明公司不會以「模型蒸餾」(Knowledge Distillation)作為提升自家大語言模型能力的捷徑,寧願為長遠目標放棄部分短期收益。Seed為字節跳動旗下AI研究團隊。

據澎湃新聞報道,張一鳴稱,研發模型要堅持「長期主義」及延遲滿足,而非「用別人的輸出,換一時的榜單排名」。路透社亦引述該報道指,張一鳴認為,模型蒸餾會妨礙真正的長期技術突破。

🔒 禁用開源模型蒸餾

報道指出,字節跳動內部對開源模型採取嚴禁蒸餾的方針,並據報以應用程式介面(API)偵測等方式加強技術限制。張一鳴稱,字節跳動應願意「為長期目標犧牲一部分短期收益」,但未有進一步交代長期目標的具體內容。

字節跳動內部圍繞是否採用蒸餾技術的討論由來已久。隨着內地同業近年加快推出能力較強的開源模型,相關技術路線的討論亦持續升溫;報道稱,每當市場有新開源大模型發布,內部對蒸餾的討論便會加劇。

🤖 蒸餾成AI業界焦點

模型蒸餾一般指利用能力較強模型的回答或輸出,訓練及改進另一模型,可縮短訓練時間並降低運算成本。字節跳動此次表明拒絕有關做法,意味着其選擇以原生研發方式推進模型能力,而非藉外部模型輸出加快追趕步伐。

蒸餾技術近期亦成為AI業界合規爭議焦點。Anthropic今年2月公開指稱,DeepSeek、月之暗面及MiniMax曾透過逾2.4萬個虛假帳戶,與其Claude模型進行逾1,600萬次互動,以擷取模型能力並訓練及改善自身系統;有關公司面對的指稱及爭議,令模型輸出數據的使用界線備受業界關注。

由 AI Marketer HK 製作

————
👇 相信「AI × 數碼營銷」是未來的你,
歡迎 Tag 一位同行好友,一起成長!

#AIMarketerHK #DigitalMarketing #字節跳動

View original Facebook post

字節跳動 內部嚴禁 蒸餾開源模型 張一鳴:願為長期目標犧牲短期收益