海納百川》Kimi K3 和 Deepseek 美中AI博弈進入第二階段(張智北)
7月16日,中國AI公司「月之暗面」發布開源大模型 Kimi K3,憑藉接近OpenAI與Anthropic頂級模型的能力,以及約三分之一的定價,立即引起華爾街震盪,也讓美國再次出現要求加強限制中國AI發展的聲浪。過去兩年,美國AI
張智北
7月16日,中國AI公司「月之暗面」發布開源大模型 Kimi K3,憑藉接近OpenAI與Anthropic頂級模型的能力,以及約三分之一的定價,立即引起華爾街震盪,也讓美國再次出現要求加強限制中國AI發展的聲浪。
過去兩年,美國AI公司依靠龐大資金打造模型,希望藉由高價API回收投資;然而,中國開源模型迅速擴張美國市場,使包括Airbnb在內的不少企業放棄高昂費用的美國模型,轉向DeepSeek、千問、智譜、MiniMax等中國的中型模型。如果說DeepSeek去年是第一場地震,那麼Kimi K3就是第二場地震,它顯示中國AI已經開始向美國頂級模型正面挑戰。
中國AI發展迅速,原因很多。美國的晶片出口管制,反而促使中國研究團隊更加投入模型架構與演算法,以人腦智慧彌補硬體算力的不足。另一方面,中國早有遠見布局特高壓電網與西部綠能建設,「西電東送」與「東數西算」讓低電費成為AI競爭的一項優勢。
Kimi K3發表的同一天,另一則消息好像被媒體忽略。DeepSeek公開了梁文鋒5月下旬投資者交流會的發言稿。梁文鋒一開始便強調,公司追求的不是商業利益最大化,而是以開源、合理定價及長期技術發展為核心理念。這種策略,與美國依賴巨額融資、追求高報酬的AI發展模式形成鮮明對比。
梁文鋒解釋了DeepSeek過去一年多為何相對沉寂。這段時間,他們其實是在完成從NVIDIA生態轉向華為生態的艱鉅工程。他們選擇使用昇騰910,希望逐步擺脫對NVIDIA CUDA平台的依賴。這條路困難重重、波折不斷,必須咬緊牙關,扮演國產AI晶片生態的先鋒隊,甚至可以說是一支「敢死隊」。
他透露,團隊利用AI輔助程式設計及自主開發的編譯工具TileLang,重建國產晶片軟體生態,並已部署約1萬6000張華為昇騰950晶片。他認為,目前硬體與軟體生態已沒有根本障礙,最大的瓶頸只剩下產能。真正受到這項布局衝擊的將是NVIDIA晶片和CUDA軟體護城河。
Kimi K3創辦人楊植麟畢業於清華大學,赴美取得博士學位後返國創業,也引發美國部分國會議員再次主張限制中國學生赴美攻讀科技專業。然而,放眼今天的矽谷,各大AI公司到處都有中國留學生擔任關鍵技術職位。剛剛獲得有「數學諾貝爾獎」之稱菲爾茲獎的王虹與鄧煜,也都畢業於北京大學,目前任教於美國名校。中國留學生長期以來一直是美國AI產業和頂尖大學的重要人才來源。
另一方面,清華大學姚班、智班近年培養出大量AI人才,在中美兩地發光發熱,被不少人稱為AI的「黃埔軍校」,而這所「黃埔軍校」的創辦人,正是台大1967級物理系畢業、圖靈獎得主姚期智。
這次台灣很多媒體報導Kimi K3時,說它是蒸餾Anthropic於6月底才發布的最新模型。一個2.8兆參數模型的預訓練,需要數兆Token的原始資料與龐大基礎算力,整個工程往往需要數月甚至半年準備。媒體報導AI議題之前,不妨先請教相關專家,否則就像指控有人偷了別人的新生兒,而那個新生兒竟然是在「偷竊」之後才出生。
(作者為台灣大學特聘講座教授、美國海軍研究學院榮譽特聘教授)
來源:中時新聞網 https://www.chinatimes.com/opinion/20260726001647-262110