字節跳動正在訓練超大規模 AI 模型 參數量可能達 10 萬億

據英國《金融時報》報導,字節跳動正致力於訓練一款新的超大規模人工智能模型,其參數量最高可能達到 10 萬億級。如果最終達到這一規模,該模型將明顯超過目前已公開或被外界披露的多數大語言模型,並可能接近 Anthropic 最先進模型 Mythos。

根據三名知情人士透露,這款模型目前仍處於早期階段,正在進行預訓練。預訓練通常需要 3 至 6 個月,之後還將進入微調等環節,因此最終版本的具體參數規模目前尚未確定。作為對比,Anthropic 尚未公開模型的具體參數,但業內估計,其先進的 Mythos 5 可能擁有約 8 萬億參數,而 Fable 5 約為 5 萬億參數。若字節跳動最終推出接近 10 萬億參數的模型,其規模將進入當前全球超大模型的第一梯隊。

字節跳動的超大規模人工智能模型將引領行業趨勢

需要注意的是,參數量雖然決定了模型能夠容納的信息規模和部分能力上限,但並不能直接等同於模型的實際表現。訓練數據質量、訓練方法、推理效率以及算力投入,同樣會影響最終效果。此前,《晚點 LatePost》曾報導,字節跳動內部正在討論訓練一款參數規模超過 5 萬億的模型。

作為參照,阿里 Qwen 3.8-Max 的參數量約為 2.4 萬億,而月之暗面的 Kimi K3 約為 2.8 萬億。若此次 10 萬億參數計劃最終落地,將意味著國內大模型在模型規模上的競爭將進一步升級。

Henderson
Henderson

Henderson 是 The Base Principle 的編輯,負責 AI 與工程科技報道的選題與編輯,並監督本站的自動化編譯流程。關注範圍包括大型語言模型、半導體與運算、太空與能源工程。

The Base Principle 是一個繁體中文(香港)科技媒體,專注報道人工智能與工程前沿。我們持續追蹤 OpenAI、Anthropic Claude、Google Gemini、Grok(xAI)、Meta AI、DeepSeek 等主要 AI 模型與公司,並涵蓋電動車與工程技術趨勢,每日精選與分析。

友情網站:手機・開箱・評測 → TechRitualTechNippon 日本語版