← 所有主題指南

開源模型與開放權重

全站開源模型文章總覽:開放權重發布解析、本地部署現實、開源與前沿模型的差距,以及圍繞開放權重的政策辯論。

120 篇文章
繁體中文

主題簡介

這個主題收集全站與開源模型、開放權重相關的文章:GLM、Qwen、Kimi、DeepSeek、Mistral 等模型發布時的架構與授權解析,以及「權重下載了之後」的本地部署現實。

除了發布消息,這裡也收錄對開放權重生態的結構性分析:開源模型與前沿的差距、各實驗室對開放權重的立場,與圍繞禁令的政策辯論。

必讀精選優先收錄含實測與架構拆解的文章;時間線可以回看每次重要發布。

必讀精選

6

  1. Open Models

    GLM-5.3 權重開放下載:753B 旗艦的本地部署現實

    2026 年 8 月 25 日,Z.ai 把 753B 參數的 GLM-5.3 權重放上 Hugging Face,三天後在 Hacker News 衝上 806 分。本文解析其 MoE 架構、自訂授權條款與本地部署實測。

    閱讀 ↗

  2. Kimi K3

    Kimi K3 登場:2.8T 參數、百萬 Token Context,開源模型走向長程 Agent

    Moonshot 發布 Kimi K3:2.8T 參數的開源 3T 級模型,原生視覺、1M token context,主打長程 coding 與知識工作。本文整理 Delta Attention 架構、kernel 編譯器與晶片設計等案例、API 定價與 64 卡部署建議,以及官方自認仍落後 Fable 5 與 GPT 5.6 Sol 的誠實定位。

    閱讀 ↗

  3. Mistral

    Mistral 的 30 億歐元賭注:開放權重如何成為主權 AI 的技術前沿

    Mistral 完成歐洲科技業最大規模融資,以開放權重模型、基礎設施與產品全端布局,回應企業與政府對主權 AI 的需求。本文從產品建造者角度,解析這輪融資對技術選擇與部署策略的意涵。

    閱讀 ↗

  4. Benchmarks

    Epoch AI:中國模型平均落後美國前沿 7 個月,差距 4 到 14 個月

    Epoch AI 於 2026 年 1 月 2 日發布 ECI 分析:2023 年以來中國模型平均落後美國前沿 7 個月,區間 4 至 14 個月,尚無模型超越 o3。本文拆解計算方法、開源權重的干擾變數與社群爭論。

    閱讀 ↗

  5. Anthropic

    Dario Amodei 表態:Anthropic 從未主張禁用開放權重模型

    美國官員傳出考慮禁用中國開放權重模型、科技業連署力挺開放權重之際,Amodei 於 7 月 27 日撰文澄清 Anthropic 從未主張禁令,改提出晶片出口管制、打擊工業級蒸餾與強制安全測試三項主張。

    閱讀 ↗

  6. Meta

    Meta 回歸開放權重:30B 的 Muse Glimmer 把本地代理變成現實

    2026 年 8 月 10 日,Meta 以 Apache 2.0 釋出 30B 參數的 Muse Glimmer,針對常駐本地代理工作流設計,單張消費級 GPU 就能跑,並承諾開放 Muse Spark 權重。

    閱讀 ↗

完整時間線

120 篇文章
展開全部 120 篇文章

2026 / 117 篇

  1. 當瀏覽器內建 AI:Mistral 與 Mozilla 把主權與隱私放進 Firefox Smart Window
  2. Hermes Agent:記憶留在本機、會自己長出技能的開源助理
  3. 當實驗數據多到看不完:SAM 3 與 DINOv3 在 Genesis Mission 裡的角色
  4. 把翻譯模型放進產品前,先看吞吐量與長文件的真實落差
  5. Mistral 的 30 億歐元賭注:開放權重如何成為主權 AI 的技術前沿
  6. Ox Alpha 就是 GLM-5.3-Flash:MIT 開源,OpenRouter 週流量佔 31%
  7. Mistral Forge:不微調、不 RAG,從零訓練企業專屬模型的另類路線
  8. 加州年齡驗證法修法豁免開源系統:AB 1856 解讀
  9. Nvidia 洽購 Hugging Face:逾 130 億美元的開源樞紐爭奪
  10. GLM-5.3 權重開放下載:753B 旗艦的本地部署現實
  11. Haiku R1/beta6 出爐:25 週年後的回歸之作
  12. AWS 收購 DuckLabs:DuckDB 母公司加入 Amazon,開源授權不變
  13. Qwen3.8-Flash-Next 發表:新架構把啟用參數壓到 6B
  14. DuckDB v2.0 預覽:新解析器、新儲存格式與伺服器模式
  15. Nari Labs 把 Qwen3-TTS 壓進 50 毫秒內開口
  16. Go 1.27 登場:泛型方法、json v2 與後量子加密
  17. Qwen3.8-27B 開源釋出:體積小、看得懂圖,只是預設想太多
  18. DeepSeek 開源 Agent Harness:一切皆外掛的開發者預覽
  19. Firefox 成最後防線:uBlock Origin 的 MV2 保衛戰
  20. Z.ai 發表 GLM-5.3:開源程式碼新高,網路攻擊能力超預期
  21. Mojo 1.0 正式登場:給 AI 時代的穩定系統語言
  22. 美國能源部啟動 Genesis 開放模型計畫:開放權重做科學
  23. Meta 回歸開放權重:30B 的 Muse Glimmer 把本地代理變成現實
  24. Oracle 劃紅線:AI 生成的內容不得進入 OpenJDK
  25. Mistral 開源 Shieldstral:把審查政策變成一句提問的 3B 分類器
  26. MiniMax H3 開源:一次生成 2K 影片與立體聲的全模態模型
  27. FFmpeg 9.0「Lei」發布:swscale 重寫與更安全的預設
  28. Qwen3.8-Max 正式發布並開放權重:鎖定寫程式與代理協作
  29. 在 8GB Mac 上跑 26B 模型:TurboFieldfare 的 SSD 串流推理
  30. DeepSeek V4-Flash 0731:只重做後訓練,代理能力越級跳
  31. Dario Amodei 表態:Anthropic 從未主張禁用開放權重模型
  32. Keychron 開源滑鼠韌體 ZGM:把 QMK 的開源文化帶進遊戲滑鼠
  33. Debian 公開決議:LLM 貢獻的去留之爭
  34. 印度下令 GitHub 下架 Bitchat:藍牙通訊遇上審查
  35. 機場一組密碼清空手機:GrapheneOS 用戶遭聯邦起訴
  36. Ruff 0.16:預設規則從59條拉到413條
  37. FLUX 3 登場:影片、圖像、聲音一個骨幹全包
  38. 輝達、微軟、Meta 公開信:別過早設限開放權重模型
  39. 近 200 家新創連署:別封殺中國開源權重模型
  40. Block 開源 Buzz:團隊聊天、AI 代理與 Git 託管共用一條事件流
  41. Firefox 153 推出:Vulkan 影片解碼與 JPEG XL 終於上船
  42. Kimi K3 登場:2.8T 參數、百萬 Token Context,開源模型走向長程 Agent
  43. LM Studio 推出 Bionic:開源模型專用的本機 AI Agent
  44. Grok Build 開源:Coding Agent 最值得讀的是 Harness,不是 UI
  45. Reflection 與 Nebius 簽 10 億美元算力合約
  46. LangChain 攜 NVIDIA 推 NemoClaw:治理優先的 Deep Agents 藍圖
  47. Bun 1.4 改寫成 Rust:64 個 Claude 代理 11 天完成的大搬遷
  48. Mistral 開源 Leanstral 1.5:miniF2F 滿分、每題 4 美元的 Lean 證明
  49. Meta Brain2Qwerty v2:腦波轉文字達 61%
  50. Ai2 拆解混合模型優勢:贏在內容詞,輸在複製
  51. Patch the Planet:用 AI 幫開源維護者補洞,而不是增加負擔
  52. GLM-5.2 開源發布:百萬上下文長任務表現緊咬 Opus 4.8
  53. Baseten 傳以 130 億美元估值募 15 億美元:五個月估值跳 160%
  54. Sarvam AI 估值 15 億美元:HCLTech 領投下的印度 AI 獨角獸
  55. Vercel 開源 eve:agent 框架終於有了一個標準形狀
  56. Mistral 傳募 30 億歐元、估值 200 億:歐洲主權 AI 的加注與鴻溝
  57. Google 開源 DiffusionGemma:擴散式生成快 4 倍,單卡 H100 破千 token/秒
  58. TensorZero 收攤:730 萬美元種子輪的開源 LLM 閘道一夜封存
  59. Hello Robot Stretch 4 開賣:3 萬美元家用機器人的務實路線
  60. Miasma 蠕蟲再襲 Microsoft:73 個儲存庫停用,AI 編碼代理成靶
  61. 微軟開源 ASSERT:把文字規格變成 AI 行為測試套件
  62. Liquid AI LFM2.5-8B-A1B 發布:38T tokens 訓練的端側 MoE 推理模型
  63. DeepSeek 把 V4 Pro 七五折降價常態化:前沿模型價格戰的底牌
  64. Runtime(YC P26)上線:把沙盒化 coding agents 開放給整個團隊
  65. Stable Audio 3.0 發表:開放權重、6 分 20 秒完整作曲
  66. NanoClaw 走紅之後:拒絕 2,000 萬美元收購,把 agent 關進容器
  67. Google ERA 登上 Nature:Gemini 寫出專家級科學程式碼
  68. NHS 畏懼 AI 漏洞挖掘大舉關閉開源庫,GDS 發布指引唱反調
  69. DuckDB 推出 Quack 協定:內嵌資料庫補上主從架構缺口
  70. TanStack npm 供應鏈攻擊解析:三個漏洞串出 84 個惡意版本
  71. Config 募 2,700 萬美元種子輪:韓國製造業押注機器人資料
  72. DeepSeek 首度對外募資:估值傳從 200 億美元跳到 450 億
  73. Mini Shai-Hulud 蠕蟲襲捲 npm:連 Mistral SDK 與 SLSA 證明都淪陷
  74. Redis 之父 antirez 開源 ds4:跑得動前沿模型的本地推理引擎
  75. SAP 收購 Prior Labs:四年 11 億歐元打造結構化資料 AI 實驗室
  76. Ghostty 宣布撤離 GitHub:一本停機日誌終結 18 年依賴
  77. IBM Granite 4.1 登場:8B 稠密模型追平 32B MoE 的開源算盤
  78. DeepSeek V4 預覽上線:宣稱追平前沿模型,開源陣營再掀波
  79. 同一顆模型、兩倍差距:四款 CLI 編碼 Agent 腳手架實測
  80. OpenAI 開源 Privacy Filter:1.5B 參數的 PII 偵測過濾模型
  81. Android CLI 與官方 Skills:Google 把代理開發帶進終端機
  82. Qwen3.6-35B-A3B 開源釋出:3B 啟動參數的代理編碼模型
  83. 內省式擴散語言模型 I-DLM:首次追平同規模自回歸模型
  84. NVD 棄守 CVE 積壓:AI 讓漏洞洪流沖垮人工管線
  85. Ai2 開源 WildDet3D:用單張照片預測 3D 偵測框
  86. Liquid AI 推出 LFM2.5-VL-450M:跑得進手機的 450M 視覺語言模型
  87. A2A 協定滿一週年:150 家組織、五種 SDK 與 v1.0 穩定規格
  88. Gemma 4 開源發布:Apache 2.0、MoE 與 256K 上下文
  89. PrismML 推出 1-bit Bonsai:把 8B 模型壓進 1.15 GB 的端側 LLM
  90. Meta 開源 TRIBE v2:預測大腦如何回應影像、聲音與語言
  91. Cohere 開源 Transcribe 語音模型:5.42% WER 登頂 ASR 排行榜
  92. Cursor Composer 2 被抓包以 Kimi K2.5 為底:開源權重的署名難題
  93. USCC 報告:中國開源 AI 的「雙循環」正在強化工業主導地位
  94. 樂天開源 Rakuten AI 3.0:6,710 億參數、GENIAC 打造的日本最大模型
  95. Mistral 開源 Leanstral:專為 Lean 4 證明工程打造的 120B 稀疏模型
  96. LeCun 的 AMI Labs 籌得 10.3 億美元種子輪:押注世界模型
  97. NVIDIA 開源 Nemotron 3 Super:120B 混合 MoE 模型瞄準 Agent 推論吞吐
  98. Qwen3.5 小模型補齊戰線:9B 在多項基準超越 gpt-oss-120b
  99. Perplexity 開源 pplx-embed:擴散預訓練打造網頁級檢索嵌入模型
  100. Sakana AI 發布 Doc-to-LoRA 與 Text-to-LoRA:一次前向傳遞生成 LoRA 配接器
  101. Guide Labs 開源 Steerling-8B:把可解釋性做進模型本身
  102. 阿里巴巴開源 Qwen3.5:397B 參數、201 種語言的 Agent 時代模型
  103. Cohere Tiny Aya:33.5 億參數、70+ 語言的本機開源模型
  104. 智利領軍推出 Latam-GPT:拉美首個本土開源大模型
  105. MiniMax 開源 M2.5 與 Lightning:SWE-Bench 80.2%,十分之一價格逼近 Opus 4.6
  106. 智譜開源 GLM-5:從 vibe coding 到 agentic engineering
  107. Microsoft 新掃描法:不必知道觸發詞,也能抓出 LLM 裡的臥底後門
  108. Mistral 開源 Voxtral Transcribe 2:即時轉錄挑戰雲端大廠
  109. 從 Clawdbot 到 OpenClaw:爆紅開源代理一週二改名,安全疑慮升高
  110. AI 一次找齊 OpenSSL 全部 12 個零日漏洞:資安研究的分水嶺
  111. Kimi K2.5 開源釋出:原生視覺加上 Agent Swarm 多代理協作
  112. NVIDIA Earth-2 開放氣象模型全家桶:整條 AI 天氣預報管線開源
  113. Overworld 開源 Waypoint-1:鍵盤滑鼠即時操控的擴散世界模型
  114. 憶阻器訓練新法 EaPU:AI 訓練能耗比 GPU 低近百萬倍
  115. Ultralytics 推出 YOLO26:去 NMS、更快的邊緣視覺模型
  116. 智譜港股掛牌:中國首家純大模型公司上市,首日收漲 13.2%
  117. Epoch AI:中國模型平均落後美國前沿 7 個月,差距 4 到 14 個月

2025 / 3 篇

  1. Mistral發表首個推理模型Magistral
  2. Hugging Face 釋出 450M 開源機器人模型 SmolVLA
  3. Google推出AI Edge Gallery:手機離線跑開源模型