字節大模型參數傳達10萬億 超美同業

  圖:字節跳動內部正訓練一個超大模型,參數量傳最高可達10萬億。
  圖:字節跳動內部正訓練一個超大模型,參數量傳最高可達10萬億。

  【大公報訊】中國人工智能(AI)公司持續追趕美國同業的技術,將大模型參數規模縮小差距。外電引述消息傳出,字節跳動內部正訓練一個超大模型,參數規模可能接近Anthropic最先進的Mythos系統,參數量最高可達10萬億,比中國已發布的最大模型、月之暗面的Kimi K3還要大超過3倍。

  據報,字節跳動該款模型目前正進行預訓練,一般需要3到6個月時間,倘若一切順利,在進入微調階段後便可最終發布。雖然Anthropic並未公開模型規模,但業內估計其最先進的Mythos 5擁有約8萬億個參數,Fable 5約為5萬億個參數。

  內地媒體日前報道,字節跳動討論推進逾5萬億參數模型,將超越阿里巴巴(09988)旗下2.4萬億參數的千問Qwen 3.8-Max,以及月之暗面旗下2.8萬億參數的Kimi K3。較早前,字節跳動創始人張一鳴明確表示,過去幾年字節跳動已在AI方面投入大量資源,未來還將繼續加大投入。

  Seedance 2.5開放API公測

  另外,字節跳動旗下火山引擎公布,旗下視頻生成大模型Seedance 2.5開放API(應用程式介面)公測,相比Seedance 2.0版本,Seedance 2.5在指令遵循、長敘事、真人感、聲畫質感等能力大幅提升。該模型原生支持30秒視頻直出、最高50個全模態素材參考,並兼容支持超過10種語言。

  據介紹,Seedance 2.5的生成效果能令視頻基礎要素接近電影級長敘事的質感標準,為創意廣告、工業仿真等更多商業場景拓展新的可能。