中國最新開發的大型語言模型(LLM)以其規模和能力令科學家印象深刻。上週,北京的Moonshot AI推出了「Kimi K3」,這是一個強大的推理LLM,能夠處理大量文本。該公司自身的測試發現,K3在編碼和操作試算表等任務上,可以與競爭對手美國模型匹敵或表現更佳。
自DeepSeek以來,還沒有一個中國人工智慧模型引起如此大的轟動。「這是一個轉折點,」雪梨新南威爾士大學認知神經科學家Joel Pearson表示,他研究AI如何影響人們的生活。「人們稱之為『Sputnik時刻』,」他補充道。
模型發布三天後,Moonshot AI表示已暫停K3的新用戶註冊,因為需求已將其系統推向處理能力的極限。
該模型於7月16日發布,恰好在2026年上海世界人工智慧大會之前。大會開幕時,中國國家主席習近平宣布正式啟動一項全球聯盟,以制定確保AI安全並造福人類的監管措施。「中國認為,所有國家都應採取以人為中心的方法,為積極和善的目標發展AI,」習近平在會上表示,並補充說AI應成為「共同繁榮和共同安全的」驅動力。
西澳大學(柏斯)AI研究員Mehwish Nasim表示,Kimi K3發布的時機非常重要。該模型是在美國公司Anthropic的Claude Fable 5發布數週後,以及OpenAI發布其最新GPT-5.6模型數天後推出的。「中國正在發出信號,不僅要建立前沿AI系統,還要幫助塑造國際AI生態系統及其治理,」她說。
K3是開放權重模型,就像其前身Kimi K2和由同名杭州公司開發的DeepSeek模型一樣,這意味著其核心組件是公開的,研究人員可以免費下載和修改,而關於模型訓練的資訊則是私密的。它也可以透過「應用程式介面」(API)存取,這使得軟體能夠進行通訊,且成本低於OpenAI、Google和Anthropic等公司擁有的專有LLM。這些LLM是封閉權重模型,意味著它們無法被下載和修改。
Moonshot表示,權重或參數將於7月27日發布。坎培拉澳洲國立大學機器人和AI研究員Rahul Shome表示,消費者、開發者和研究人員一直在推動AI模型開放權重。Shome說,K3特別令人興奮,因為它將是最大的開放權重模型,擁有2.8兆個參數和一百萬個token(AI模型使用的文本單位)的工作記憶。然而,該模型太大,無法在個人設備上運行,因此他補充說,它可能需要機構進行大量投資才能運行。
計算智能研究員Niusha Shafiabady表示,K3的大型工作記憶意味著它可以記住數千行程式碼或一整本書的內容,並降低產生稱為幻覺的虛假資訊的可能性。Shafiabady表示,她將透過要求K3總結研究發現來親自測試它。
昆士蘭科技大學生成式AI實驗室(布里斯本)的AI責任研究員Aaron Snoswell表示,歷史上,開放權重模型的性能和能力一直落後於美國專有模型。但他認為,目前的差距似乎是有史以來最小的。
Pearson表示,中國的開放權重模型正在改變投資者和用戶對美國前沿模型價值的看法。與中國公司的預算相比,Google、Anthropic和OpenAI花費數十億美元訓練它們的模型。此外,Pearson說,如果政府決定實施限制,用戶可能會失去對美國模型的存取權。上個月,Anthropic在接到美國政府指示暫停向外國國民提供服務後,暫時停用了其最先進的模型Fable 5和Mythos 5。Fable 5的存取權已於本月恢復,但Mythos 5僅提供給特定的美國組織。
新南威爾士大學電腦科學家Toby Walsh表示,儘管美國出於國家安全考量限制中國獲取先進AI晶片,中國AI公司仍能建立前沿AI模型。「人們猜測,在這裡,需求是發明之母,」他補充道。
就讀於北京清華大學的William Guey表示,Kimi K2.5在中國很受歡迎,部分原因是它擅長運行AI代理,而AI代理的使用在過去一年左右呈爆炸式增長。這些自主工具可以執行特定操作,例如從網際網路下載研究論文或掃描網站。Walsh補充說,K3也針對運行AI代理進行了優化,這也是許多人感興趣的。
Snoswell表示,中國AI公司正瞄準美國開發者和消費者使用中國的LLM。
然而,Nasim表示,Kimi K3是否能在中國以外獲得廣泛採用仍有待觀察。她補充說,採用程度可能取決於大學和政府如何評估該模型的安全風險,包括用戶數據如何被公司儲存和使用,以及第三方是否可以存取這些數據。
中國自身的政策也可能限制其在國境以外的使用。據媒體報導,本月早些時候,中國政府據報與中國AI公司阿里巴巴、Z.ai和字節跳動會面,討論可能限制國內AI模型向海外用戶提供服務。
儘管如此,Walsh表示,K3表明研究人員將有更多樣化的開放權重和專有模型可供選擇。「這證明AI不會是一個贏家通吃的市場,」他補充道。


