調研視窗:2026-08-24 10:18 ~ 2026-08-25 10:18 北京時間 信源:GitHub(org: flagos-ai 52 倉 + commit search + PR/Release API)、Google News RSS(中英文 9 組查詢,代理鏈路正常)、HN Algolia、Tavily 交叉驗證(詳見附錄)


索引

  • 一、開源專案進展(GitHub 動態)
    • 1.1 vllm-plugin-FL v0.3.0-rc0 釋出——FlagOS 2.1 後首個新版本線候選(視窗頭條)(08-24)
    • 1.2 build-infra:vllm 0.20.2 驗證矩陣擴圍——摩爾執行緒 F/T 雙路徑全過、沐曦 app image 落地(08-24/08-25)
    • 1.3 build-infra:驗證驅動硬化——「透過」語義升級為真實 E2E(08-24/08-25)
    • 1.4 Torch-FL:torch.compile 三後端落地(MetaX/MUSA/Enflame GCU)(08-24)
    • 1.5 FlagGems:KernelGen Nvidia 運算元擴充 13+,昇騰/摩爾執行緒最佳化(08-24/08-25)
    • 1.6 FlagTensor/FlagDNN:天數智芯 Iluvatar 後端適配啟動(08-24/08-25)
    • 1.7 其他倉庫動態(sglang-plugin-FL 燧原後端、Qwen3.5 相容、FlagTree、FlagSparse、FlagOS-Compressor)
  • 二、新聞報道與生態
    • 2.1 新聞側總體評價(連續第六日元件零命中)
    • 2.2 近 3 天趨勢(GitHub org pushed 佐證)
    • 2.3 排除項
  • 三、成員單位深挖
  • 四、總結
  • 附錄:完整信源清單

一、開源專案進展(GitHub 動態)

視窗總覽:org 內 52 個倉庫中 13 個在視窗內有推送;commit search 命中 59 條唯一視窗內提交(FlagGems 20、build-infra 19、Torch-FL 6、FlagSparse 6、FlagTensor 3、vllm-plugin-FL 2、FlagTree 1、FlagOS-Compressor 1、sglang-plugin-FL 1)。視窗頭條是 vllm-plugin-FL v0.3.0-rc0 釋出——FlagOS 2.1(6/24)之後首個新版本線候選,面向 vLLM 0.24.0;本視窗主線為「推理側驗證矩陣擴圍(摩爾執行緒、沐曦入列)+ torch.compile 多後端落地(MetaX/MUSA/GCU)+ 天數智芯 Iluvatar 新後端適配」。

1.1 vllm-plugin-FL v0.3.0-rc0 釋出——FlagOS 2.1 後首個新版本線候選(視窗頭條)

來源Release v0.3.0-rc0(8/24 11:45 北京時間釋出,target main,無 prerelease 標記)

  • 首個 v0.3.0 線候選版本:自 6/24 FlagOS 2.1 同步釋出 vllm-plugin-FL v0.2.0 以來,這是該元件第一個新版本線候選。0.3 線面向 vLLM 0.24.0(與 8/23-24 崑崙芯 0.24.0 驗證序列同線呼應),釋出動作落在本視窗(tag 於 8/21 建立,8/24 11:45 正式釋出)。
  • 配套動態:#403 version doc(8/24 14:26)為版本釋出補充文件;#383 Qwen3.5 text-only 執行時相容(8/24 15:23 合入 main)——為 v0.3.0-dev 分支(目標 vLLM 0.24.0)增加 Qwen3.5 dense 與 MoE 的文字-only 執行時支援:上游 vLLM 已含 causal model 類但未完整註冊規範文字 config、hybrid cache 輔助與 VL 字首 checkpoint 對映,相容層由通用外掛安裝、不改動 vLLM 包與編譯的 _moe_C 擴充套件。因合入晚於 rc0 切點(11:45),預計進入後續 rc。
  • 觀察點延續:崑崙芯 decode scale 修復 PR #400(base release/0.2 線)仍開放——patch_decode_attention 將 decode 路由到 prefill_attention 時傳的是原始 decode scale(1/sqrt(head_size))而非其期望的 adjusted scale(scale*sqrt(head_size)),約 11 倍偏小的 alpha 壓平 softmax,導致崑崙芯 P800 XPU 上 Qwen3-4B decode 輸出亂碼;修復為乘 sqrt(head_size)(head_size=128 時 scale=1.0)。

解讀:0.3.0-rc0 的釋出節奏與 8/23-24 的驗證浪潮直接咬合——崑崙芯 0.24.0、NVIDIA cuda13.3 等後端驗證都基於 0.24 線,rc0 把這條線推成正式候選。Qwen3.5 相容(#383)緊隨其後合入主線,說明「新模型 Day0 相容」仍是 vllm-plugin-FL 的核心價值主張(呼應 4 月 DeepSeek-V4 八晶片 Day0 適配)。

1.2 build-infra:vllm 0.20.2 驗證矩陣擴圍——摩爾執行緒 F/T 雙路徑全過、沐曦 app image 落地

來源#506#508#510#512#514#516#521#522(8/24 14:58-21:55)、#523(8/24 22:37)、#524(8/25 08:43)

  • 摩爾執行緒(MThreads)雙後端 F/T 雙路徑全過:#506 為 mthreads-musa4.3.6mthreads-musa5.2.0 開啟 vllm0.20.2 app image 構建(deps_app.vllm0.20.2 鍵是 app-image 工作流的矩陣門控);#508 記錄兩個後端在 app image 2.1.2-0.2.1 上(Qwen3-4B)FlagTree(F)與 Triton(T)雙路徑 serve E2E 全部透過,並糾正了此前「triton absent」誤報(triton 3.6.0 是 /opt/triton 側裝、經 compiler() 後才對 importlib.metadata 可見)。
  • 沐曦(MetaX)app image 落地:#510 為 metax 後端開啟 0.20.2 構建;#512/#514 記錄 metax-maca3.7.2.1metax-maca3.8.1.3 兩個版本的 app image tag 2.1.2-0.2.1_g825c1cd;#516 在 record 步驟將 deps_app 與 image_tag 一併置位;#521/#522 把 vllm-plugin-fl 納入 0.20.2 full-install 路徑、並按 image_tag 逐後端派生外掛版本。
  • 收尾與配套:#523 關閉崑崙芯 triton attention bug 的實驗記錄(experiment closure,對應上游 PR #268);#524 為昇騰 megatron 線把 torchvision/torchaudio 烘進 runtime deps。

解讀:vllm 0.20.2 驗證矩陣從「NVIDIA、崑崙芯、昇騰」三家擴到五家——摩爾執行緒成為第四家完成雙編譯器全驗證的後端(且 musa4.3.6/5.2.0 兩個代際雙後端同時翻綠),沐曦兩個 maca 版本的 app image 已構建落地、tag 入矩陣(F/T 透過狀態尚未見明確記錄,屬流程進行中)。「推理側驗證矩陣集體翻綠」主線在昨日昇騰之後繼續向摩爾執行緒、沐曦擴散,驗證正規化的模板化使新後端從開啟構建到記錄驗證只需小時級。

1.3 build-infra:驗證驅動硬化——「透過」語義升級為真實 E2E

來源#517(8/24 19:20)、#518(8/24 20:22)、#519(8/24 20:34)、#520(8/24 20:47)、#525(8/25 09:14)

  • #517:驗證標記語義升級。此前矩陣裡的「透過」標記只由 verify 指令碼退出碼決定,實質僅證明「安裝成功 + import 不炸」;本次把各後端已驗證的 E2E 配方接進指令碼,「透過」= 負載真實跑通且退出碼 0verify-vllm-backend.sh 的 serve 測試改為 --app-image 模式,缺 MODEL_PATH 即失敗)。
  • #518:plan 任務此前只收集每個待驗證單元格的預設編譯器列(有 FlagTree 收 F、否則收 T),現在 F/T 兩列都顯式收集(兩個 verify 指令碼均支援 --compiler flagtree|triton)。
  • #519/#520:results 分支改為 main 快照重建(不再 rebase);單個失敗單元格使整個 verify job 失敗——不再靜默吞錯。
  • #525:serve 就緒檢查從固定 60s sleep 改為輪詢 readiness——驗證提速且更可靠。

解讀:這是昨日 status-matrix 體系(YAML 化 + 釋出自動回寫)的配套收口——把「驗證狀態機」的判定邏輯本身硬化:標記語義從「安裝級」升到「負載級」,雙編譯器列都強制顯式驗證,失敗不可掩蓋。多晶片驗證規模擴大後,驗證結果的可信度成為 build-infra 的下一個工程重點。

1.4 Torch-FL:torch.compile 三後端落地(MetaX/MUSA/Enflame GCU)

來源#158(8/24 17:28)、#159(8/24 20:32)、#160(8/24 16:59)、#162(8/24 20:27)、#164(8/24 21:03)

  • #158:MetaX torch.compile 驗證落地(Claude Code 提 PR、人類 reviewer @zhaoyinglia 把關):在真實 FlagTree MetaX 構建上跑通 compile 整合套件,修復兩個只在官方 CPU torch wheel 上暴露的 Inductor autotuning 失敗——MetaX 流 shim 破壞 Event.record()、以及 maca Triton backend 名洩漏到 torch.device();並把映象內 vendor Triton 暴露給 CI venv、補回歸測試。
  • #159:MUSA torch.compile 直綁 torch_fl:為 ACCELERATOR=musa 註冊 torch.compile(backend="flagos"),經摩爾執行緒 FlagTree 執行時實現。過程有取捨:初版用 fabricated 相容模組滿足驅動 import torch_musa 被維護者否決,要求 FlagTree 直接繫結 torch-fl 後才合入。
  • #160:Enflame GCU S60 AMP 驗證:先在 S60 硬體實測平臺約束再動手,tests/integration/test_amp.py 從全部 skip 到 25 項全過,共享 AutocastPrivateUse1 策略生效。
  • #162/#164:為 Enflame 建獨立 wheel CI 流水線;CUDA CI 也納入 torch.compile 測試。

解讀:torch.compile 路徑從「單後端實驗」走向「多後端標準能力」——MetaX、MUSA、Enflame GCU 三後端同日落地/驗證,且全部以真實硬體實測為準。AI agent(Claude Code)輔助提 PR + 人類 reviewer 把關的協作模式在 Torch-FL 已成常態(#158/#159/#160 均為該模式),是 FlagOS 開源協作流程的一個新特徵。

1.5 FlagGems:KernelGen Nvidia 運算元擴充 13+,昇騰/摩爾執行緒最佳化

來源KernelGen Nvidia 運算元序列(#3408/#4008/#5355/#5491/#5653/#5291/#5367/#5519/#5114/#5116/#5117/#5118/#5211,8/24 14:07-8/25 07:01)、#5383#5675#5684

  • KernelGen Nvidia 運算元覆蓋批次擴充(13+ 個 Triton 運算元):special 函式族(special_bessel_y1、special_logit、special_log_ndtr)、RNN/LSTM 族(mkldnn_rnn_layer 單層 LSTM、_cudnn_rnn_backward 單層單向 LSTM 反向)、啟用反向族(hardsigmoid/hardswish/hardtanh backward)、量化族(quantized_lstm、alpha_dropout_)、張量操作(fliplr、_upsample_nearest_exact1d_backward、sym_constrain_range)。這是 KernelGen(自動運算元生成)對 torch 運算元面覆蓋的持續擴張。
  • 昇騰#5383 最佳化 AddMM 的 layout 與 bias epilogue;KMcompiler 路徑下呼叫 torch.linalg.matrix_norm 的修復系列(#5707/#5708/#5712,8/24 15:38-17:29)。
  • 摩爾執行緒:MTHREADS 後端 constant_pad_nd override 最佳化(#5675)與 FillCopy 路徑最佳化(#5684)。

1.6 FlagTensor/FlagDNN:天數智芯 Iluvatar 後端適配啟動

來源FlagTensor iluvatar 提交(8/24 23:33)、FlagTensor #15(8/25 10:03 合入)、FlagDNN Iluvatar WIP(8/24 12:09-14:18)

  • FlagTensor(Triton 張量原語庫:unary 28 / binary 4 / contraction 6,對標 cuTensor,基於 FlagTree):修復 Triton 3.6 相容(flagtree 0.6.1 + iluvatar3.6)併為 Iluvatar 增加 tune_configs;#15 將 iluvatar 分支合入 main(8/25 10:03)。
  • FlagDNN:WIP Iluvatar backend adaptation(8/24 12:09)+ 同步合入(#9,8/24 12:20),另有 ascend 修復(8/24 11:29)。

解讀:天數智芯(Iluvatar)成為本視窗新增的活躍後端——FlagTensor 與 FlagDNN 兩個元件同時啟動其適配,配合 8/21 FlagPrism 等倉庫的推送節奏,國產晶片接入繼續按「元件矩陣逐個點亮」的路徑推進。

1.7 其他倉庫動態

  • sglang-plugin-FL#42 feat: add enflame gcu(8/24 15:01)——sglang 外掛新增燧原 GCU 後端,用 qwen3.6-27b 與 qwen3.6-35b-a3b 實測。
  • FlagTree:#1034 HINT backend selection 修復(8/24 11:08);TLE C++ 模組生成 python stubs 並補型別註解(8/24 11:18);#1040 PPU AABS min size 修復(8/24 23:43)。
  • FlagSparse:DCU 測試健壯性提升(test robust up)+ #47 dcu bsr spmv/spmm 逐矩陣結果校驗(8/24 14:46-21:02)。
  • FlagOS-Compressor#6 calibrated GPTQ/AWQ + native AutoRound(8/24 12:55)——純 PyTorch AutoRound 支援對稱 W4A16/W8A16(SignSGD、min/max 調優、最優引數恢復、級聯量化輸入),量化演算法與 checkpoint 打包解耦,裝置後端泛化到 CUDA/NPU/MLU/MUSA 及註冊自定義裝置。
  • docs / release-info / FlagCX:pushed_at 在視窗內但主分支無視窗內合入(非預設分支同步/例行更新),與昨日模式一致。

二、新聞報道與生態

2.1 新聞側總體評價

Google News RSS 代理鏈路正常,9 組中英文查詢(FlagOS/FlagGems/FlagScale+FlagTree+FlagPerf/智源研究院 開源/智源 when:3d/BAAI open source 等)中元件關鍵詞視窗內零直接命中——連續第六日元件級新聞平靜(8/20-8/25),與歷史規律一致;HN Algolia 僅 Xiaomi Xring SoC、ID 掃描器誤報等無關條目誤匹配(剔除)。智源相關視窗內命中均為智源社群聚合轉載的泛 AI 新聞(Anthropic 就業影響、GPT-5.6 降價、谷歌 TPU 之父跳槽、深勢科技科研平臺等),與 FlagOS 無直接關聯;「靈境智源 WRC 2026 具身智腦」系列報道經核查為上海靈境智源科技有限公司(孫博創立,2025-07 成立)——非智源研究院,剔除(詳見 2.3)。新聞側無可收錄新條目,本報告主體為 GitHub 動態。

2.2 近 3 天趨勢(GitHub org pushed 佐證)

日期 活躍倉庫 主要內容
8/22~8/23(昨日視窗) build-infra(6)、Megatron-LM-FL(整合分支)、FlagSparse(3) 寒武紀雙後端 E2E(去 shim);崑崙芯 0.20.2 雙編譯器 E2E;status-matrix 體系上線;昇騰 vllm 0.20.2 雙編譯器 F/T 全過
8/23~8/24(昨日視窗) build-infra(18)、Torch-FL(1) 崑崙芯 vllm 0.24.0 雙編譯器 verified;NVIDIA cuda13.3 0.20.2 verified;status-matrix YAML 化;vllm-plugin-FL 純 Python 構建統一
8/24~8/25(本視窗) build-infra(19)、FlagGems(20)、Torch-FL(6)、FlagSparse(6)、FlagTensor(3)、vllm-plugin-FL(2)、FlagTree(1)、FlagOS-Compressor(1)、sglang-plugin-FL(1) vllm-plugin-FL v0.3.0-rc0 釋出摩爾執行緒 vllm 0.20.2 F/T 雙路徑全過(雙 musa 後端);沐曦 app image 落地;torch.compile 三後端落地(MetaX/MUSA/GCU);FlagGems KernelGen 13+ 新運算元;天數智芯 Iluvatar 適配啟動(FlagTensor/FlagDNN)

趨勢判斷:主線從「驗證矩陣集體翻綠」演進為「驗證矩陣擴圍 + 驗證語義硬化 + 推理/編譯新能力並進」。推理側(vllm 0.20.2)矩陣已覆蓋 NVIDIA、崑崙芯、昇騰、摩爾執行緒四家雙編譯器全過 + 沐曦 app image 落地;torch.compile 作為跨後端編譯能力在 MetaX/MUSA/GCU 三後端同日落地,配合 FlagGems KernelGen 運算元自動生成覆蓋擴張與 Qwen3.5 相容,FlagOS 的「編譯 + 運算元 + 推理外掛」三條能力線都在向多晶片縱深推進;天數智芯 Iluvatar 成為新後端接入點(FlagTensor/FlagDNN 雙元件)。v0.3.0-rc0 為 2.1 後首個新版本線候選,正式版節奏與崑崙芯 0.24.0 線、Qwen3.5 相容(#383)的合入狀態聯動。

2.3 排除項

  • 「WRC 2026 收官|靈境智源以具身智腦底座定義產業上限」(億邦動力網 8/24)、「WRC 2026 閉幕:具身智腦成’落地戰’關鍵底座」(搜狐 8/25)——「靈境智源」為上海靈境智源科技有限公司(具身智腦 T300/T81,CEO 孫博),非智源研究院;名稱含「智源」觸發 gnews 匹配,核查後剔除。
  • 智源社群視窗內聚合轉載(Anthropic 就業資料、GPT-5.6 Sol 降價、谷歌 TPU 之父跳槽 Anthropic、深勢科技科研平臺、優必選 WRC 等 8/24 多條)——智源社群是 AI 新聞聚合平臺,條目為泛 AI 行業新聞,與 FlagOS 無直接關聯。
  • 《前沿AI風險與應急響應研究報告(徵求意見稿)》(智源社群 8/24)——BAAI 安全研究方向成果,非 FlagOS 系統軟體棧動態。
  • 博彩 SEO 汙染(「智源研究院釋出並開源新開元棋牌遊戲」「體育投注app下載」等 womenofchina.com 8/21-8/24)——按標題關鍵詞整批剔除。
  • Qwen3.8-2.4T 九芯適配報道(8/14 智源社群)、AI Compiler 活動回顧(8/20)——視窗外舊聞。
  • HN 命中(Xiaomi Xring SoC、ID scanner 誤報、Talk Like Claude Day)——與 FlagOS 無關誤匹配。

三、成員單位深挖

視窗內多廠商動態圖譜

廠商 晶片/後端 視窗內動態 證據
智源 build-infra 主導 vllm 矩陣擴圍(摩爾執行緒/沐曦)與驗證驅動硬化(37 條提交);vllm-plugin-FL v0.3.0-rc0 釋出;新聞側連續第六日元件零命中 build-infra PR 序列、vllm-plugin-FL release
摩爾執行緒 MThreads MUSA vllm 0.20.2 app image F/T 雙路徑全過(musa4.3.6 + musa5.2.0,image 2.1.2-0.2.1,#506/#508);torch.compile 經 FlagTree 直綁 torch_fl(#159);FlagGems constant_pad_nd 最佳化(#5675/#5684) build-infra #506/#508、Torch-FL #159、FlagGems #5675/#5684
沐曦 MetaX MACA vllm 0.20.2 app image 落地(maca3.7.2.1 + maca3.8.1.3,tag 2.1.2-0.2.1_g825c1cd,#510/#512/#514);MetaX FlagTree torch.compile 驗證 + CI 覆蓋(#158) build-infra #510/#512/#514、Torch-FL #158
燧原 Enflame GCU sglang-plugin-FL 新增 GCU 後端(#42,qwen3.6-27b/35b-a3b 實測);GCU S60 AMP 驗證 25 項全過(#160);獨立 wheel CI 流水線(#162) sglang-plugin-FL #42、Torch-FL #160/#162
天數智芯 Iluvatar 新後端適配啟動:FlagTensor Triton 3.6 相容 + iluvatar tune_configs + 分支合入(#15);FlagDNN WIP Iluvatar backend(#9) FlagTensor 提交、FlagDNN 提交
崑崙芯 KunlunXin XPU triton attention bug 實驗收尾(build-infra #523,對應上游 PR #268);vllm-plugin-FL #400 decode scale 修復仍開放(release/0.2 線) build-infra #523、vllm-plugin-FL #400
昇騰(華為) Ascend megatron runtime deps 補 torchvision/torchaudio(#524);FlagGems AddMM layout 最佳化(#5383)+ KMcompiler matrix_norm 修復(#5707/#5708/#5712) build-infra #524、FlagGems 提交
NVIDIA(生態參考) CUDA FlagGems KernelGen 13+ 新 Triton 運算元(RNN/LSTM、啟用反向、special 函式、量化族) FlagGems PR 序列
寒武紀 / 海光 / 清微 / 地平線 MLU / DCU / TXDA / BPU 開源側無視窗內新合入(寒武紀 8/22 已報;海光 FlagSparse DCU 側為測試健壯性提升 #47,非新功能)

趨勢判斷:本視窗晶片版圖關鍵詞是「新後端入列 + 編譯能力跨後端落地」。摩爾執行緒憑 vllm 0.20.2 雙 musa 後端 F/T 雙路徑全過成為矩陣第四家「雙編譯器全過」後端,沐曦緊隨其後完成 app image 落地;torch.compile 在 MetaX、MUSA、Enflame GCU 三後端同日驗證,把「編譯棧多晶片覆蓋」從訓練框架擴充套件到 PyTorch 編譯路徑;天數智芯成為新接入點(FlagTensor/FlagDNN 雙元件啟動 Iluvatar 適配)。AI agent 輔助開發(Claude Code 提 PR + 人類 reviewer 把關)在 Torch-FL 已成常態,開源協作模式本身也在變化。


四、總結

  1. vllm-plugin-FL v0.3.0-rc0 釋出(視窗頭條):FlagOS 2.1(6/24)後首個新版本線候選(8/24 11:45 釋出),面向 vLLM 0.24.0;Qwen3.5 text-only 相容(#383)在 rc0 切點後合入主線,預計進入後續 rc;崑崙芯 decode scale 修復(#400)仍開放。
  2. vllm 0.20.2 驗證矩陣擴圍:摩爾執行緒雙後端(musa4.3.6/5.2.0)F/T 雙路徑全過,成為第四家雙編譯器全過後端(#506/#508);沐曦雙 maca 版本 app image 落地(#510/#512/#514)。「新後端從開啟構建到記錄驗證」已模板化為小時級流程。
  3. 驗證驅動硬化:「透過」語義從安裝級升級為「真實 E2E workload 跑通且退出碼 0」(#517);F/T 雙編譯器列強制顯式收集(#518);失敗單元格使 verify job 失敗(#520);serve 就緒輪詢替代固定 sleep(#525)——多晶片驗證狀態進入「可信可審計」階段。
  4. torch.compile 三後端落地:MetaX(#158)、MUSA(#159,FlagTree 直綁 torch_fl)、Enflame GCU AMP(#160,25 項測試全過),外加 Enflame 獨立 wheel CI(#162);Claude Code 提 PR + 人類 reviewer 把關的協作模式成為常態。
  5. 天數智芯 Iluvatar 新後端適配啟動:FlagTensor(Triton 3.6 相容 + tune_configs,分支合入 #15)與 FlagDNN(WIP backend)雙元件並進。
  6. FlagGems KernelGen 運算元覆蓋擴張:Nvidia 側 13+ 新運算元(RNN/LSTM 前後向、啟用反向族、special 函式、量化族),昇騰 AddMM/KMcompiler 修復、摩爾執行緒 pad 最佳化;sglang-plugin-FL 新增燧原 GCU 後端(#42);FlagOS-Compressor 新增 native AutoRound 量化(#6)。
  7. 新聞側連續第六日元件零命中:無 2.x 正式釋出訊號(build-infra tag 仍 v2.1.x 線);生態側無可收錄條目。下一觀察點:v0.3.0 正式版釋出(含 Qwen3.5 相容)、vllm-plugin-FL #400 合入、沐曦雙編譯器驗證狀態、FlagDNN/FlagTensor Iluvatar 適配完成度。

侷限性說明:提交數量與合入時間來自 commit search 與 repos/commits API(搜尋索引可能略滯後,個別倉庫 pushed_at 與主分支提交存在分支同步差異,已用 commits API 核驗);build-infra E2E 環境細節以 PR 描述為準;沐曦「app image 落地」不涉及其 F/T 驗證完成狀態的推斷;v0.3.0-rc0 的 tag 建立時間(8/21)早於釋出動作(8/24),已如實區分;gnews 跳轉連結無法抓取正文,新聞側判斷依賴標題與多源交叉印證,可能存在低權重中文來源漏檢。


附錄:完整信源清單

編號 事件 來源連結
1 vllm-plugin-FL v0.3.0-rc0 釋出 https://github.com/flagos-ai/vllm-plugin-FL/releases/tag/v0.3.0-rc0
2 vllm-plugin-FL Qwen3.5 text-only 相容(#383) https://github.com/flagos-ai/vllm-plugin-FL/pull/383
3 vllm-plugin-FL 崑崙芯 decode scale 修復(#400,仍開放) https://github.com/flagos-ai/vllm-plugin-FL/pull/400
4 build-infra 摩爾執行緒 vllm 0.20.2 F/T 雙路徑全過(#506/#508) https://github.com/flagos-ai/build-infra/pull/508
5 build-infra 沐曦 vllm 0.20.2 app image(#510/#512/#514) https://github.com/flagos-ai/build-infra/pull/512
6 build-infra 驗證驅動硬化(#517/#518/#519/#520/#525) https://github.com/flagos-ai/build-infra/pull/517
7 build-infra 崑崙芯 triton attention 實驗收尾(#523) https://github.com/flagos-ai/build-infra/pull/523
8 build-infra 昇騰 megatron runtime deps(#524) https://github.com/flagos-ai/build-infra/pull/524
9 Torch-FL MetaX torch.compile 驗證(#158) https://github.com/flagos-ai/Torch-FL/pull/158
10 Torch-FL MUSA torch.compile 直綁(#159) https://github.com/flagos-ai/Torch-FL/pull/159
11 Torch-FL Enflame GCU AMP 驗證(#160) https://github.com/flagos-ai/Torch-FL/pull/160
12 Torch-FL Enflame wheel CI(#162) https://github.com/flagos-ai/Torch-FL/pull/162
13 FlagGems KernelGen Nvidia 運算元序列(#5519 等 13+) https://github.com/flagos-ai/FlagGems/pull/5519
14 FlagGems 昇騰 AddMM 最佳化(#5383) https://github.com/flagos-ai/FlagGems/pull/5383
15 FlagGems MTHREADS pad 最佳化(#5675/#5684) https://github.com/flagos-ai/FlagGems/pull/5675
16 FlagTensor Iluvatar 適配(#15) https://github.com/flagos-ai/FlagTensor/pull/15
17 FlagDNN Iluvatar WIP(#9) https://github.com/flagos-ai/FlagDNN/pull/9
18 sglang-plugin-FL 燧原 GCU 後端(#42) https://github.com/flagos-ai/sglang-plugin-FL/pull/42
19 FlagTree HINT/#1040/TLE stubs https://github.com/flagos-ai/FlagTree/pull/1040
20 FlagSparse DCU bsr 結果校驗(#47) https://github.com/flagos-ai/FlagSparse/pull/47
21 FlagOS-Compressor AutoRound(#6) https://github.com/flagos-ai/FlagOS-Compressor/pull/6
22 org repos 總覽(52 倉,13 倉視窗內活躍) https://api.github.com/orgs/flagos-ai/repos?per_page=100&sort=updated
23    
commit search(視窗內 59 條唯一提交) https://api.github.com/search/commits?q=org:flagos-ai+committer-date:%3E2026-08-24T02:18:00Z  
24 gnews 中英文 9 組查詢(元件級零命中) https://news.google.com/rss/search?q=FlagOS+when%3A14d&hl=zh-CN&gl=CN&ceid=CN%3Azh-Hans
25 HN Algolia(無關誤匹配) https://hn.algolia.com/api/v1/search_by_date?query=FlagOS
26 Tavily 交叉驗證(靈境智源身份核查、FlagOS 無額外報道) https://www.tavily.com