看板 Stock 關於我們 聯絡資訊
原文標題: Kimi K3開放日:模型權重、技術報告和關鍵Infra技術同步開放 原文連結:https://news.futunn.com/hk/post/76650176/ 發布時間: 2026/07/28 記者署名:stephen (文章來源為月之暗面) 原文內容: 今天是 Kimi K3 開放日,我們發佈 Kimi K3 的模型權重、技術報告,並開源支撐 Kimi K3 模型訓練的關鍵 Infra 技術:MoonEP、FlashKDA和AgentEnv。希望以此加速前沿智能的部 署與普及,促進 AGI 研究。 Kimi K3 是我們能力最強的模型:這是一個擁有 2.8 萬億參數的混合專家(MoE)模型,具 備原生視覺理解能力,並支持 100 萬 token 的上下文窗口。 Kimi K3 參數規模是 Kimi K2.5 的 3 倍左右,但是規模化並不僅僅是參數的堆疊,在並不 寬裕的算力條件下,我們憑藉 Kimi Delta Attention、Attention Residuals 以及 MoonEP 等一系列技術創新,規模化效率提升了 2.5 倍(即在算力最優意義下,單位算力產出智能 約等於原來 2.5 倍)。 現在,每個人都可以下載並部署 Kimi K3 模型——無論是用於內部研發,還是嵌入到面向 終端用戶的產品中,均可自由使用(其他使用情形,詳見Kimi K3 許可證)。 今天,與 Kimi K3 模型權重一起公開的,還有我們的模型訓練方法——Kimi K3 技術報告 已同步上線。 從技術報告中,你可以了解這些技術細節: KDA + AttnRes:以 3:1 比例混合 KDA 與 Gated MLA,實現高效長上下文建模,並通過塊 級注意力殘差增強跨層信息流動。 Stable LatentMoE:每個 token 從 896 個路由專家中激活 16 個,並通過 SiTU-GLU 與 Q uantile Balancing 保持極高稀疏度下的訓練穩定。 MoonViT-V2:視覺編碼器從零開始使用 next-token prediction 訓練,無需對比預訓練, 在達到 SigLIP 初始化基線效果的同時獲得更穩定的優化過程。 後訓練與評估:在通用推理、通用 Agent 和編程 Agent 三大領域進行大規模任務合成,百 萬 token 上下文的強化學習基建,近 20 個內部評測集的完整評估結果。 以上幾點只是概覽,詳細論述與消融實驗,都已在技術報告中展開。 模型能力背後,離不開訓練系統,即 Infra 基礎設施層的穩定支撐。今天,我們向大家介 紹支撐 Kimi K3 訓練的三項 Infra 技術:MoonEP、FlashKDA 和 AgentEnv,覆蓋從高性能 通信、高性能算子到分佈式 RL 環境的關鍵鏈路。其中 FlashKDA 此前已開源,MoonEP 和 AgentEnv 則隨本次發佈正式開源。 MoonEP:MoonEP 是我們爲超大的細粒度 MoE 打造的高性能通信庫,讓專家並行(expert-p arallel)的通信在不均衡的情況下仍然實現極致效率。 FlashKDA:FlashKDA 是我們實現的 Kimi Delta Attention 高性能算子(kernel)。在英 偉達 H20 上,相比 flash-linear-attention 基線,它的 prefill 速度提升 1.72-2.22 倍,可以直接作爲 flash-linear-attention 的替換後端。 AgentEnv:AgentENV 是我們與 KVCache.ai 合作開發的沙箱系統,用於大規模運行 Agent 環境。它爲 Kimi K3 的後訓練提供高保真、強隔離沙箱,靈活支持快速快照、恢復和分叉 (fork)等,可以應對大規模並行的 Agent 工作流與訓練任務。 這三項技術是支撐 Kimi K3 訓練效率與穩定性的關鍵。現在將它們開放出來,希望也能爲 你訓練下一代模型提供幫助。 我們堅信開放權重模型的價值。它們能降低獲取智能的門檻,推動創新,並賦予用戶對數據 更大的控制權、隱私保護和所有權。在過去幾周裏,我們很高興聽到了許多來自 AI 社區, 以及與我們有着共同願景的技術領袖的支持聲音。 我們相信,對於 AGI 這樣具有深遠影響的技術,一個廣泛、開放的生態系統是最適合承載 它的土壤。爲此,我們將繼續貢獻自己的力量。 心得/評論: Kimi K3今天正式開源,已經有多家服務商上線了 只要近乎Sonnet的價格就能享受部分跑分超越Fable的模型 不想花錢的也沒關係,只要有6TB記憶體你也能在家跑 記憶體又要不夠了... -- ※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 42.79.17.89 (臺灣) ※ 文章網址: https://www.ptt.cc/bbs/Stock/M.1785201800.A.D96.html
s213092921 : 我前天看原來已經用中國門號註冊Kimi了,舒服 07/28 09:24
tomdavis : 看有沒有機會帶起AIPC了~ 07/28 09:24
aimlikenoob : 捲到大家沒錢賺,消費者的勝利,股民的悲劇 07/28 09:26
zzahoward : 下面一定有人造謠是偷Fable 5 XDDD 07/28 09:28
firemothra : 所以現在是在跌KIMI 嗎? 07/28 09:29
KY1998 : 首先,你要有GB200或GB300機櫃 07/28 09:30
c1951 : 太多人註冊使用 算力不夠 現在KIMI已經停止新戶註冊 07/28 09:30
cutbear123 : 跑得動嗎? 07/28 09:30
orze04 : 每個人都可以下載並部署??? 07/28 09:31
yesonline : 要有80張RTX5090顯卡才能順順的跑啊... 07/28 09:31
cheug0653 : 老黃有利 大科技有利 LLM不利 07/28 09:31
momo4571 : 你也要有足夠鏟子才跑的了 07/28 09:33
c1951 : 為了保障之前已經註冊過的舊會員繼續使用 除非後面 07/28 09:33
ILoveOppai : 只要用家中人人都有的GB300+6T記憶體都能跑 美國完 07/28 09:34
ILoveOppai : 蛋了 07/28 09:34
s213092921 : 真的會有腦洞大開的傻子相信蒸餾Fable 5嗎 07/28 09:34
awenracious : 這種東西就自嗨宣傳的 實際上一般用戶根本不可能自 07/28 09:34
awenracious : 己跑 07/28 09:34
fallinlove15: 設備商笑呵呵 07/28 09:34
c1951 : 添購新的硬體設備 擴充算力極限 新用戶註冊可能要等 07/28 09:35
winken2004 : 讚讚讚 07/28 09:35
takeda3234 : 老黃利多 07/28 09:35
tsubasawolfy: 6T記憶體XDDD 07/28 09:35
jinxinmypant: 訓練方法也開源? 這麼佛? 07/28 09:35
awenracious : 支那最會的就是這個 宣傳放大優點 但但書完全不提 07/28 09:36
awenracious : 或是留在備註 不仔細了解的人看到標題就被騙了 07/28 09:36
gnik20152 : 中國人自己用就好 沒人在乎的東西 07/28 09:37
HNCB2880 : 感覺很厲害 07/28 09:37
BDroach : 花個6百萬買記憶體就能跑了喔 07/28 09:37
lastphil : 等看看有沒有量化模型 07/28 09:37
lmc66 : 樓下先用 07/28 09:38
s213092921 : 真的,拜託歐美不要來用Kimi,回去用貴鬆鬆的A畜或 07/28 09:39
s213092921 : 歐噴漿吧 07/28 09:39
yesonline : 有足夠鏟子的應該都去當AI中轉站賺錢了 07/28 09:40
diefish5566 : GB300+6T記憶體還有一個發電廠 不會有人沒有吧 07/28 09:40
foolwind : 6T?零售價看來還要繼續漲 哈哈哈 07/28 09:42
kullan : 誰有GB300+6T 都可以參加慈善AI大賽 07/28 09:43
atelier : 又有來裝懂的 這種東西本來就不是給個人跑的 07/28 09:45
zzahoward : 這權重開放本來就是給企業自己訓練模型的 07/28 09:45
BIGETC : 蒸餾啦 一定有問題 開始哭 07/28 09:46
atelier : 光是KIMI的Model商變多 御三家的Token價就拉不起來 07/28 09:46
atelier : 無論如何都是對消費者有利 07/28 09:47
poeoe : 6TB就能佈建 這對企業很簡單吧 07/28 09:47
kkithh : 一般用戶deepseek就夠用,企業買幾十張顯卡,幾台AI 07/28 09:48
kkithh : server自己架起來跑,有問題嗎?人家就是來讓你美 07/28 09:48
kkithh : 國AI賺不了錢的 07/28 09:48
RW2010 : 靠北 講的好像6TB很便宜似的... 07/28 09:49
atelier : 錢不夠還有GLM Deepseek Qwen 07/28 09:51
madeinheaven: 智譜現在股價-18% 07/28 09:51
atelier : 個人能跑的Qwen3.6 27B 35B衍生模型 也是有點生產力 07/28 09:53
strlen : 文組真的不懂裝懂 K3比GPT 5.6還貴 07/28 09:53
strlen : 好歹也上網查查 token效率 唉 算了 講了也是白講 07/28 09:54
cutepuma : 樓上說的是真的 07/28 09:58
Solyo : 美國巨頭股價崩 07/28 09:58
xonba : 抓到 KIMI就是崩盤元凶 07/28 10:01
Solyo : 晚上公布財報,看到資本支出,續崩 07/28 10:02
adngg579 : 一堆薩酷拉 07/28 10:03
eriker : 這根AIpc沒關聯 要用在普通電腦就是35b上下 這種就 07/28 10:05
eriker : 是server ai 07/28 10:05
eriker : 這種模型確實對大家好 幫忙壓openai anthropic價 07/28 10:07
andy79323 : 1t以上開源早就有 07/28 10:07
HaHaPoint : 只要有6TB記憶體 XDD 07/28 10:10
yesonline : Kimi3比GPT5.6還貴應該是誤解或過時資訊. 07/28 10:10
eriker : 別在deepseek了 哪個超爛 明明參數超大在唬洨的 效 07/28 10:14
eriker : 能也差 07/28 10:14
atelier : DeepSeek便宜 用龍蝦Hermes跑流程工作 D4 Flash夠用 07/28 10:15
strlen : 沒有過時...也沒有誤解 你自己去看token效率 07/28 10:15
strlen : K3 token效率極差 同一個提示詞是5.6 2倍 07/28 10:16
strlen : 即使每百萬token看起來很便宜 但每次都是2倍以上用 07/28 10:16
strlen : 量 是哪裡便宜?反正你各位只會吹 用都沒用過對吧 07/28 10:17
atelier : 市場遲早走到"便宜夠用" 寫Code也不會一直用Fable 07/28 10:17
strlen : 我就是實際訂閱用戶 K3官方是超級慢超級卡 根本無法 07/28 10:17
pgcgo : 正式進入智能人的世界! 07/28 10:17
shirman : 6T記憶體? 07/28 10:17
strlen : 做任何事 因為他們根本沒算力 07/28 10:17
strlen : 接API已經很多評測了 K3就是比5.6貴 07/28 10:18
y598763 : 自己本地部署對企業來說還是比買closaAI划算 07/28 10:21
atelier : KIMI開放之後 Provider變多 算力不足應該會緩解 07/28 10:21
strlen : https://tinyurl.com/fc9c4bmm 07/28 10:21
mynumber55 : 要順跑,gb300要好幾台呢~ 07/28 10:21
strlen : 到底哪個SB說K3比較便宜 肯定沒在用 07/28 10:21
mynumber55 : 你以為買一台而已喔~嘻嘻 07/28 10:22
strlen : 以他的效率Provider也不可能開太便宜 不然虧死 07/28 10:22
mynumber55 : 他原本就沒很便宜了,到底在吹什麼 07/28 10:22
strlen : 同一個提示詞 K3是GPT 5.6的2倍價 還在K3便宜 07/28 10:23
theurgy : 國家級的買家要來買剷子吧 軟體都免費給你了 07/28 10:25
yuinghoooo : 最近FSD也是爆發增長,我自己算還會開車的,也不會 07/28 10:26
yuinghoooo : 亂插或是忽快忽慢,但現在AI場景理解已經比人類還 07/28 10:26
yuinghoooo : 快做出決策,而且還是能進步,跟阿發狗一樣好像沒 07/28 10:26
yuinghoooo : 什麼上限 有些操作是你事後才發現他已經想到這樣開 07/28 10:26
yuinghoooo : 車,這提前彎到中線真的漂亮,就覺得幹好屌 07/28 10:26
s1612316 : 多蛙壯膽 不認AI沒有護城河 07/28 10:26
seemoon2000 : K3價格跟gpt5.6差不多啦 是Fable5太貴... 07/28 10:28
seemoon2000 : 一樣的提示詞K3用的token量是gpt5.6 Fable5好幾倍 07/28 10:29
chysh : 每個人都可以下載,但你要有 GB300機櫃 07/28 10:30
joke3547 : 重點是開源!重點是開源!重點是開源!一堆人不懂 07/28 10:30
joke3547 : 開源的含金量嗎? 07/28 10:30
joke3547 : 你沒辦法不代表所有人沒辦法 07/28 10:31
maplefff : 好了啦, 在泰國訓練的 07/28 10:31
maplefff : 算力弱成這樣,沒幾個月又被前沿扁到媽媽都不認識 07/28 10:31
seemoon2000 : 這尺寸的模型 你調用api比較划算了 GB300不要算 你 07/28 10:32
seemoon2000 : 還要電費、建築物租金和冷氣整天吹 維護成本太高了 07/28 10:32
cerwvk : 印象中說要7000萬起跳 07/28 10:37
seemoon2000 : 開源模型重點應該是每人電腦都能跑的尺寸 有巨大突 07/28 10:37
seemoon2000 : 破會是一個重點 之前qwen3.6 27b 35b接近這目標 但 07/28 10:37
seemoon2000 : 後來qwen開源的開發人員離開之類 好幾個月沒進展了 07/28 10:37
s213092921 : str別再吹美國AI多厲害了,大多數企業不需要上帝幫 07/28 10:38
s213092921 : 你當客服 07/28 10:38
poeoe : 開源重點怎麼會是個人電腦跑啦 這重點都在企業市場 07/28 10:42
poeoe : 好嗎 07/28 10:42
kivan00 : 在個人電腦跑GPT等級是在做什麼白日夢 07/28 10:43
KY1998 : 考慮合規性(金融/軍事/其他敏感行業),一定是放 07/28 10:43
KY1998 : 自己家裡,剩下是模型選擇,這又不一定是錢的問題 07/28 10:43
shadow0326 : Anthropic自己都出性能差不多但價錢比Fable5砍半的 07/28 10:44
lyxiang : 現在買6T的記憶體要多少成本? 07/28 10:44
shadow0326 : Opus5了,到底誰要用Fable5 07/28 10:44
atelier : Anthropic OpenAI和川普都表演過了 掐著AI工具不讓 07/28 10:51
atelier : 你用 反而讓使用者有危機意識 07/28 10:51
atelier : 為了IPO估值演得太過火現在吃屎了 07/28 10:52
seemoon2000 : 單純是Fable5過度宣傳玩過頭 現在A他們搞到自己 07/28 10:53
seemoon2000 : Opus5有接近的能力 價格只要一半 只被稍微閹割 07/28 10:54
atelier : 「太強不能開放」本來就很可笑 其他人一年內追上 07/28 10:56
lulululula : 怎麼人覺得這東西是給一般個人跑的... 07/28 11:08
lc85301 : 反觀 07/28 11:09
newyorker54 : 說開放太危險?人在地上吹,牛在天上飛 07/28 11:25
newyorker54 : 不能開放,會世界末日?笑死我了 07/28 11:26
WWIII : 讚 反觀民主的美國 07/28 11:39
gameforyou : 這個開源是要伺服器才能跑的,非個人向 07/28 11:40