调研窗口:2026-08-24 10:18 ~ 2026-08-25 10:18 北京时间 信源:GitHub(org: flagos-ai 52 仓 + commit search + PR/Release API)、Google News RSS(中英文 9 组查询,代理链路正常)、HN Algolia、Tavily 交叉验证(详见附录)


索引

  • 一、开源项目进展(GitHub 动态)
    • 1.1 vllm-plugin-FL v0.3.0-rc0 发布——FlagOS 2.1 后首个新版本线候选(窗口头条)(08-24)
    • 1.2 build-infra:vllm 0.20.2 验证矩阵扩围——摩尔线程 F/T 双路径全过、沐曦 app image 落地(08-24/08-25)
    • 1.3 build-infra:验证驱动硬化——「通过」语义升级为真实 E2E(08-24/08-25)
    • 1.4 Torch-FL:torch.compile 三后端落地(MetaX/MUSA/Enflame GCU)(08-24)
    • 1.5 FlagGems:KernelGen Nvidia 算子扩充 13+,昇腾/摩尔线程优化(08-24/08-25)
    • 1.6 FlagTensor/FlagDNN:天数智芯 Iluvatar 后端适配启动(08-24/08-25)
    • 1.7 其他仓库动态(sglang-plugin-FL 燧原后端、Qwen3.5 兼容、FlagTree、FlagSparse、FlagOS-Compressor)
  • 二、新闻报道与生态
    • 2.1 新闻侧总体评价(连续第六日组件零命中)
    • 2.2 近 3 天趋势(GitHub org pushed 佐证)
    • 2.3 排除项
  • 三、成员单位深挖
  • 四、总结
  • 附录:完整信源清单

一、开源项目进展(GitHub 动态)

窗口总览:org 内 52 个仓库中 13 个在窗口内有推送;commit search 命中 59 条唯一窗口内提交(FlagGems 20、build-infra 19、Torch-FL 6、FlagSparse 6、FlagTensor 3、vllm-plugin-FL 2、FlagTree 1、FlagOS-Compressor 1、sglang-plugin-FL 1)。窗口头条是 vllm-plugin-FL v0.3.0-rc0 发布——FlagOS 2.1(6/24)之后首个新版本线候选,面向 vLLM 0.24.0;本窗口主线为「推理侧验证矩阵扩围(摩尔线程、沐曦入列)+ torch.compile 多后端落地(MetaX/MUSA/GCU)+ 天数智芯 Iluvatar 新后端适配」。

1.1 vllm-plugin-FL v0.3.0-rc0 发布——FlagOS 2.1 后首个新版本线候选(窗口头条)

来源Release v0.3.0-rc0(8/24 11:45 北京时间发布,target main,无 prerelease 标记)

  • 首个 v0.3.0 线候选版本:自 6/24 FlagOS 2.1 同步发布 vllm-plugin-FL v0.2.0 以来,这是该组件第一个新版本线候选。0.3 线面向 vLLM 0.24.0(与 8/23-24 昆仑芯 0.24.0 验证序列同线呼应),发布动作落在本窗口(tag 于 8/21 创建,8/24 11:45 正式发布)。
  • 配套动态:#403 version doc(8/24 14:26)为版本发布补充文档;#383 Qwen3.5 text-only 运行时兼容(8/24 15:23 合入 main)——为 v0.3.0-dev 分支(目标 vLLM 0.24.0)增加 Qwen3.5 dense 与 MoE 的文本-only 运行时支持:上游 vLLM 已含 causal model 类但未完整注册规范文本 config、hybrid cache 辅助与 VL 前缀 checkpoint 映射,兼容层由通用插件安装、不改动 vLLM 包与编译的 _moe_C 扩展。因合入晚于 rc0 切点(11:45),预计进入后续 rc。
  • 观察点延续:昆仑芯 decode scale 修复 PR #400(base release/0.2 线)仍开放——patch_decode_attention 将 decode 路由到 prefill_attention 时传的是原始 decode scale(1/sqrt(head_size))而非其期望的 adjusted scale(scale*sqrt(head_size)),约 11 倍偏小的 alpha 压平 softmax,导致昆仑芯 P800 XPU 上 Qwen3-4B decode 输出乱码;修复为乘 sqrt(head_size)(head_size=128 时 scale=1.0)。

解读:0.3.0-rc0 的发布节奏与 8/23-24 的验证浪潮直接咬合——昆仑芯 0.24.0、NVIDIA cuda13.3 等后端验证都基于 0.24 线,rc0 把这条线推成正式候选。Qwen3.5 兼容(#383)紧随其后合入主线,说明「新模型 Day0 兼容」仍是 vllm-plugin-FL 的核心价值主张(呼应 4 月 DeepSeek-V4 八芯片 Day0 适配)。

1.2 build-infra:vllm 0.20.2 验证矩阵扩围——摩尔线程 F/T 双路径全过、沐曦 app image 落地

来源#506#508#510#512#514#516#521#522(8/24 14:58-21:55)、#523(8/24 22:37)、#524(8/25 08:43)

  • 摩尔线程(MThreads)双后端 F/T 双路径全过:#506 为 mthreads-musa4.3.6mthreads-musa5.2.0 开启 vllm0.20.2 app image 构建(deps_app.vllm0.20.2 键是 app-image 工作流的矩阵门控);#508 记录两个后端在 app image 2.1.2-0.2.1 上(Qwen3-4B)FlagTree(F)与 Triton(T)双路径 serve E2E 全部通过,并纠正了此前「triton absent」误报(triton 3.6.0 是 /opt/triton 侧装、经 compiler() 后才对 importlib.metadata 可见)。
  • 沐曦(MetaX)app image 落地:#510 为 metax 后端开启 0.20.2 构建;#512/#514 记录 metax-maca3.7.2.1metax-maca3.8.1.3 两个版本的 app image tag 2.1.2-0.2.1_g825c1cd;#516 在 record 步骤将 deps_app 与 image_tag 一并置位;#521/#522 把 vllm-plugin-fl 纳入 0.20.2 full-install 路径、并按 image_tag 逐后端派生插件版本。
  • 收尾与配套:#523 关闭昆仑芯 triton attention bug 的实验记录(experiment closure,对应上游 PR #268);#524 为昇腾 megatron 线把 torchvision/torchaudio 烘进 runtime deps。

解读:vllm 0.20.2 验证矩阵从「NVIDIA、昆仑芯、昇腾」三家扩到五家——摩尔线程成为第四家完成双编译器全验证的后端(且 musa4.3.6/5.2.0 两个代际双后端同时翻绿),沐曦两个 maca 版本的 app image 已构建落地、tag 入矩阵(F/T 通过状态尚未见明确记录,属流程进行中)。「推理侧验证矩阵集体翻绿」主线在昨日昇腾之后继续向摩尔线程、沐曦扩散,验证范式的模板化使新后端从开启构建到记录验证只需小时级。

1.3 build-infra:验证驱动硬化——「通过」语义升级为真实 E2E

来源#517(8/24 19:20)、#518(8/24 20:22)、#519(8/24 20:34)、#520(8/24 20:47)、#525(8/25 09:14)

  • #517:验证标记语义升级。此前矩阵里的「通过」标记只由 verify 脚本退出码决定,实质仅证明「安装成功 + import 不炸」;本次把各后端已验证的 E2E 配方接进脚本,「通过」= 负载真实跑通且退出码 0verify-vllm-backend.sh 的 serve 测试改为 --app-image 模式,缺 MODEL_PATH 即失败)。
  • #518:plan 任务此前只收集每个待验证单元格的默认编译器列(有 FlagTree 收 F、否则收 T),现在 F/T 两列都显式收集(两个 verify 脚本均支持 --compiler flagtree|triton)。
  • #519/#520:results 分支改为 main 快照重建(不再 rebase);单个失败单元格使整个 verify job 失败——不再静默吞错。
  • #525:serve 就绪检查从固定 60s sleep 改为轮询 readiness——验证提速且更可靠。

解读:这是昨日 status-matrix 体系(YAML 化 + 发布自动回写)的配套收口——把「验证状态机」的判定逻辑本身硬化:标记语义从「安装级」升到「负载级」,双编译器列都强制显式验证,失败不可掩盖。多芯片验证规模扩大后,验证结果的可信度成为 build-infra 的下一个工程重点。

1.4 Torch-FL:torch.compile 三后端落地(MetaX/MUSA/Enflame GCU)

来源#158(8/24 17:28)、#159(8/24 20:32)、#160(8/24 16:59)、#162(8/24 20:27)、#164(8/24 21:03)

  • #158:MetaX torch.compile 验证落地(Claude Code 提 PR、人类 reviewer @zhaoyinglia 把关):在真实 FlagTree MetaX 构建上跑通 compile 集成套件,修复两个只在官方 CPU torch wheel 上暴露的 Inductor autotuning 失败——MetaX 流 shim 破坏 Event.record()、以及 maca Triton backend 名泄漏到 torch.device();并把镜像内 vendor Triton 暴露给 CI venv、补回归测试。
  • #159:MUSA torch.compile 直绑 torch_fl:为 ACCELERATOR=musa 注册 torch.compile(backend="flagos"),经摩尔线程 FlagTree 运行时实现。过程有取舍:初版用 fabricated 兼容模块满足驱动 import torch_musa 被维护者否决,要求 FlagTree 直接绑定 torch-fl 后才合入。
  • #160:Enflame GCU S60 AMP 验证:先在 S60 硬件实测平台约束再动手,tests/integration/test_amp.py 从全部 skip 到 25 项全过,共享 AutocastPrivateUse1 策略生效。
  • #162/#164:为 Enflame 建独立 wheel CI 流水线;CUDA CI 也纳入 torch.compile 测试。

解读:torch.compile 路径从「单后端实验」走向「多后端标准能力」——MetaX、MUSA、Enflame GCU 三后端同日落地/验证,且全部以真实硬件实测为准。AI agent(Claude Code)辅助提 PR + 人类 reviewer 把关的协作模式在 Torch-FL 已成常态(#158/#159/#160 均为该模式),是 FlagOS 开源协作流程的一个新特征。

1.5 FlagGems:KernelGen Nvidia 算子扩充 13+,昇腾/摩尔线程优化

来源KernelGen Nvidia 算子序列(#3408/#4008/#5355/#5491/#5653/#5291/#5367/#5519/#5114/#5116/#5117/#5118/#5211,8/24 14:07-8/25 07:01)、#5383#5675#5684

  • KernelGen Nvidia 算子覆盖批量扩充(13+ 个 Triton 算子):special 函数族(special_bessel_y1、special_logit、special_log_ndtr)、RNN/LSTM 族(mkldnn_rnn_layer 单层 LSTM、_cudnn_rnn_backward 单层单向 LSTM 反向)、激活反向族(hardsigmoid/hardswish/hardtanh backward)、量化族(quantized_lstm、alpha_dropout_)、张量操作(fliplr、_upsample_nearest_exact1d_backward、sym_constrain_range)。这是 KernelGen(自动算子生成)对 torch 算子面覆盖的持续扩张。
  • 昇腾#5383 优化 AddMM 的 layout 与 bias epilogue;KMcompiler 路径下调用 torch.linalg.matrix_norm 的修复系列(#5707/#5708/#5712,8/24 15:38-17:29)。
  • 摩尔线程:MTHREADS 后端 constant_pad_nd override 优化(#5675)与 FillCopy 路径优化(#5684)。

1.6 FlagTensor/FlagDNN:天数智芯 Iluvatar 后端适配启动

来源FlagTensor iluvatar 提交(8/24 23:33)、FlagTensor #15(8/25 10:03 合入)、FlagDNN Iluvatar WIP(8/24 12:09-14:18)

  • FlagTensor(Triton 张量原语库:unary 28 / binary 4 / contraction 6,对标 cuTensor,基于 FlagTree):修复 Triton 3.6 兼容(flagtree 0.6.1 + iluvatar3.6)并为 Iluvatar 增加 tune_configs;#15 将 iluvatar 分支合入 main(8/25 10:03)。
  • FlagDNN:WIP Iluvatar backend adaptation(8/24 12:09)+ 同步合入(#9,8/24 12:20),另有 ascend 修复(8/24 11:29)。

解读:天数智芯(Iluvatar)成为本窗口新增的活跃后端——FlagTensor 与 FlagDNN 两个组件同时启动其适配,配合 8/21 FlagPrism 等仓库的推送节奏,国产芯片接入继续按「组件矩阵逐个点亮」的路径推进。

1.7 其他仓库动态

  • sglang-plugin-FL#42 feat: add enflame gcu(8/24 15:01)——sglang 插件新增燧原 GCU 后端,用 qwen3.6-27b 与 qwen3.6-35b-a3b 实测。
  • FlagTree:#1034 HINT backend selection 修复(8/24 11:08);TLE C++ 模块生成 python stubs 并补类型注解(8/24 11:18);#1040 PPU AABS min size 修复(8/24 23:43)。
  • FlagSparse:DCU 测试健壮性提升(test robust up)+ #47 dcu bsr spmv/spmm 逐矩阵结果校验(8/24 14:46-21:02)。
  • FlagOS-Compressor#6 calibrated GPTQ/AWQ + native AutoRound(8/24 12:55)——纯 PyTorch AutoRound 支持对称 W4A16/W8A16(SignSGD、min/max 调优、最优参数恢复、级联量化输入),量化算法与 checkpoint 打包解耦,设备后端泛化到 CUDA/NPU/MLU/MUSA 及注册自定义设备。
  • docs / release-info / FlagCX:pushed_at 在窗口内但主分支无窗口内合入(非默认分支同步/例行更新),与昨日模式一致。

二、新闻报道与生态

2.1 新闻侧总体评价

Google News RSS 代理链路正常,9 组中英文查询(FlagOS/FlagGems/FlagScale+FlagTree+FlagPerf/智源研究院 开源/智源 when:3d/BAAI open source 等)中组件关键词窗口内零直接命中——连续第六日组件级新闻平静(8/20-8/25),与历史规律一致;HN Algolia 仅 Xiaomi Xring SoC、ID 扫描仪误报等无关条目误匹配(剔除)。智源相关窗口内命中均为智源社区聚合转载的泛 AI 新闻(Anthropic 就业影响、GPT-5.6 降价、谷歌 TPU 之父跳槽、深势科技科研平台等),与 FlagOS 无直接关联;「灵境智源 WRC 2026 具身智脑」系列报道经核查为上海灵境智源科技有限公司(孙博创立,2025-07 成立)——非智源研究院,剔除(详见 2.3)。新闻侧无可收录新条目,本报告主体为 GitHub 动态。

2.2 近 3 天趋势(GitHub org pushed 佐证)

日期 活跃仓库 主要内容
8/22~8/23(昨日窗口) build-infra(6)、Megatron-LM-FL(集成分支)、FlagSparse(3) 寒武纪双后端 E2E(去 shim);昆仑芯 0.20.2 双编译器 E2E;status-matrix 体系上线;昇腾 vllm 0.20.2 双编译器 F/T 全过
8/23~8/24(昨日窗口) build-infra(18)、Torch-FL(1) 昆仑芯 vllm 0.24.0 双编译器 verified;NVIDIA cuda13.3 0.20.2 verified;status-matrix YAML 化;vllm-plugin-FL 纯 Python 构建统一
8/24~8/25(本窗口) build-infra(19)、FlagGems(20)、Torch-FL(6)、FlagSparse(6)、FlagTensor(3)、vllm-plugin-FL(2)、FlagTree(1)、FlagOS-Compressor(1)、sglang-plugin-FL(1) vllm-plugin-FL v0.3.0-rc0 发布摩尔线程 vllm 0.20.2 F/T 双路径全过(双 musa 后端);沐曦 app image 落地;torch.compile 三后端落地(MetaX/MUSA/GCU);FlagGems KernelGen 13+ 新算子;天数智芯 Iluvatar 适配启动(FlagTensor/FlagDNN)

趋势判断:主线从「验证矩阵集体翻绿」演进为「验证矩阵扩围 + 验证语义硬化 + 推理/编译新能力并进」。推理侧(vllm 0.20.2)矩阵已覆盖 NVIDIA、昆仑芯、昇腾、摩尔线程四家双编译器全过 + 沐曦 app image 落地;torch.compile 作为跨后端编译能力在 MetaX/MUSA/GCU 三后端同日落地,配合 FlagGems KernelGen 算子自动生成覆盖扩张与 Qwen3.5 兼容,FlagOS 的「编译 + 算子 + 推理插件」三条能力线都在向多芯片纵深推进;天数智芯 Iluvatar 成为新后端接入点(FlagTensor/FlagDNN 双组件)。v0.3.0-rc0 为 2.1 后首个新版本线候选,正式版节奏与昆仑芯 0.24.0 线、Qwen3.5 兼容(#383)的合入状态联动。

2.3 排除项

  • 「WRC 2026 收官|灵境智源以具身智脑底座定义产业上限」(亿邦动力网 8/24)、「WRC 2026 闭幕:具身智脑成’落地战’关键底座」(搜狐 8/25)——「灵境智源」为上海灵境智源科技有限公司(具身智脑 T300/T81,CEO 孙博),非智源研究院;名称含「智源」触发 gnews 匹配,核查后剔除。
  • 智源社区窗口内聚合转载(Anthropic 就业数据、GPT-5.6 Sol 降价、谷歌 TPU 之父跳槽 Anthropic、深势科技科研平台、优必选 WRC 等 8/24 多条)——智源社区是 AI 新闻聚合平台,条目为泛 AI 行业新闻,与 FlagOS 无直接关联。
  • 《前沿AI风险与应急响应研究报告(征求意见稿)》(智源社区 8/24)——BAAI 安全研究方向成果,非 FlagOS 系统软件栈动态。
  • 博彩 SEO 污染(「智源研究院发布并开源新开元棋牌游戏」「体育投注app下载」等 womenofchina.com 8/21-8/24)——按标题关键词整批剔除。
  • Qwen3.8-2.4T 九芯适配报道(8/14 智源社区)、AI Compiler 活动回顾(8/20)——窗口外旧闻。
  • HN 命中(Xiaomi Xring SoC、ID scanner 误报、Talk Like Claude Day)——与 FlagOS 无关误匹配。

三、成员单位深挖

窗口内多厂商动态图谱

厂商 芯片/后端 窗口内动态 证据
智源 build-infra 主导 vllm 矩阵扩围(摩尔线程/沐曦)与验证驱动硬化(37 条提交);vllm-plugin-FL v0.3.0-rc0 发布;新闻侧连续第六日组件零命中 build-infra PR 序列、vllm-plugin-FL release
摩尔线程 MThreads MUSA vllm 0.20.2 app image F/T 双路径全过(musa4.3.6 + musa5.2.0,image 2.1.2-0.2.1,#506/#508);torch.compile 经 FlagTree 直绑 torch_fl(#159);FlagGems constant_pad_nd 优化(#5675/#5684) build-infra #506/#508、Torch-FL #159、FlagGems #5675/#5684
沐曦 MetaX MACA vllm 0.20.2 app image 落地(maca3.7.2.1 + maca3.8.1.3,tag 2.1.2-0.2.1_g825c1cd,#510/#512/#514);MetaX FlagTree torch.compile 验证 + CI 覆盖(#158) build-infra #510/#512/#514、Torch-FL #158
燧原 Enflame GCU sglang-plugin-FL 新增 GCU 后端(#42,qwen3.6-27b/35b-a3b 实测);GCU S60 AMP 验证 25 项全过(#160);独立 wheel CI 流水线(#162) sglang-plugin-FL #42、Torch-FL #160/#162
天数智芯 Iluvatar 新后端适配启动:FlagTensor Triton 3.6 兼容 + iluvatar tune_configs + 分支合入(#15);FlagDNN WIP Iluvatar backend(#9) FlagTensor 提交、FlagDNN 提交
昆仑芯 KunlunXin XPU triton attention bug 实验收尾(build-infra #523,对应上游 PR #268);vllm-plugin-FL #400 decode scale 修复仍开放(release/0.2 线) build-infra #523、vllm-plugin-FL #400
昇腾(华为) Ascend megatron runtime deps 补 torchvision/torchaudio(#524);FlagGems AddMM layout 优化(#5383)+ KMcompiler matrix_norm 修复(#5707/#5708/#5712) build-infra #524、FlagGems 提交
NVIDIA(生态参考) CUDA FlagGems KernelGen 13+ 新 Triton 算子(RNN/LSTM、激活反向、special 函数、量化族) FlagGems PR 序列
寒武纪 / 海光 / 清微 / 地平线 MLU / DCU / TXDA / BPU 开源侧无窗口内新合入(寒武纪 8/22 已报;海光 FlagSparse DCU 侧为测试健壮性提升 #47,非新功能)

趋势判断:本窗口芯片版图关键词是「新后端入列 + 编译能力跨后端落地」。摩尔线程凭 vllm 0.20.2 双 musa 后端 F/T 双路径全过成为矩阵第四家「双编译器全过」后端,沐曦紧随其后完成 app image 落地;torch.compile 在 MetaX、MUSA、Enflame GCU 三后端同日验证,把「编译栈多芯片覆盖」从训练框架扩展到 PyTorch 编译路径;天数智芯成为新接入点(FlagTensor/FlagDNN 双组件启动 Iluvatar 适配)。AI agent 辅助开发(Claude Code 提 PR + 人类 reviewer 把关)在 Torch-FL 已成常态,开源协作模式本身也在变化。


四、总结

  1. vllm-plugin-FL v0.3.0-rc0 发布(窗口头条):FlagOS 2.1(6/24)后首个新版本线候选(8/24 11:45 发布),面向 vLLM 0.24.0;Qwen3.5 text-only 兼容(#383)在 rc0 切点后合入主线,预计进入后续 rc;昆仑芯 decode scale 修复(#400)仍开放。
  2. vllm 0.20.2 验证矩阵扩围:摩尔线程双后端(musa4.3.6/5.2.0)F/T 双路径全过,成为第四家双编译器全过后端(#506/#508);沐曦双 maca 版本 app image 落地(#510/#512/#514)。「新后端从开启构建到记录验证」已模板化为小时级流程。
  3. 验证驱动硬化:「通过」语义从安装级升级为「真实 E2E workload 跑通且退出码 0」(#517);F/T 双编译器列强制显式收集(#518);失败单元格使 verify job 失败(#520);serve 就绪轮询替代固定 sleep(#525)——多芯片验证状态进入「可信可审计」阶段。
  4. torch.compile 三后端落地:MetaX(#158)、MUSA(#159,FlagTree 直绑 torch_fl)、Enflame GCU AMP(#160,25 项测试全过),外加 Enflame 独立 wheel CI(#162);Claude Code 提 PR + 人类 reviewer 把关的协作模式成为常态。
  5. 天数智芯 Iluvatar 新后端适配启动:FlagTensor(Triton 3.6 兼容 + tune_configs,分支合入 #15)与 FlagDNN(WIP backend)双组件并进。
  6. FlagGems KernelGen 算子覆盖扩张:Nvidia 侧 13+ 新算子(RNN/LSTM 前后向、激活反向族、special 函数、量化族),昇腾 AddMM/KMcompiler 修复、摩尔线程 pad 优化;sglang-plugin-FL 新增燧原 GCU 后端(#42);FlagOS-Compressor 新增 native AutoRound 量化(#6)。
  7. 新闻侧连续第六日组件零命中:无 2.x 正式发布信号(build-infra tag 仍 v2.1.x 线);生态侧无可收录条目。下一观察点:v0.3.0 正式版发布(含 Qwen3.5 兼容)、vllm-plugin-FL #400 合入、沐曦双编译器验证状态、FlagDNN/FlagTensor Iluvatar 适配完成度。

局限性说明:提交数量与合入时间来自 commit search 与 repos/commits API(搜索索引可能略滞后,个别仓库 pushed_at 与主分支提交存在分支同步差异,已用 commits API 核验);build-infra E2E 环境细节以 PR 描述为准;沐曦「app image 落地」不涉及其 F/T 验证完成状态的推断;v0.3.0-rc0 的 tag 创建时间(8/21)早于发布动作(8/24),已如实区分;gnews 跳转链接无法抓取正文,新闻侧判断依赖标题与多源交叉印证,可能存在低权重中文来源漏检。


附录:完整信源清单

编号 事件 来源链接
1 vllm-plugin-FL v0.3.0-rc0 发布 https://github.com/flagos-ai/vllm-plugin-FL/releases/tag/v0.3.0-rc0
2 vllm-plugin-FL Qwen3.5 text-only 兼容(#383) https://github.com/flagos-ai/vllm-plugin-FL/pull/383
3 vllm-plugin-FL 昆仑芯 decode scale 修复(#400,仍开放) https://github.com/flagos-ai/vllm-plugin-FL/pull/400
4 build-infra 摩尔线程 vllm 0.20.2 F/T 双路径全过(#506/#508) https://github.com/flagos-ai/build-infra/pull/508
5 build-infra 沐曦 vllm 0.20.2 app image(#510/#512/#514) https://github.com/flagos-ai/build-infra/pull/512
6 build-infra 验证驱动硬化(#517/#518/#519/#520/#525) https://github.com/flagos-ai/build-infra/pull/517
7 build-infra 昆仑芯 triton attention 实验收尾(#523) https://github.com/flagos-ai/build-infra/pull/523
8 build-infra 昇腾 megatron runtime deps(#524) https://github.com/flagos-ai/build-infra/pull/524
9 Torch-FL MetaX torch.compile 验证(#158) https://github.com/flagos-ai/Torch-FL/pull/158
10 Torch-FL MUSA torch.compile 直绑(#159) https://github.com/flagos-ai/Torch-FL/pull/159
11 Torch-FL Enflame GCU AMP 验证(#160) https://github.com/flagos-ai/Torch-FL/pull/160
12 Torch-FL Enflame wheel CI(#162) https://github.com/flagos-ai/Torch-FL/pull/162
13 FlagGems KernelGen Nvidia 算子序列(#5519 等 13+) https://github.com/flagos-ai/FlagGems/pull/5519
14 FlagGems 昇腾 AddMM 优化(#5383) https://github.com/flagos-ai/FlagGems/pull/5383
15 FlagGems MTHREADS pad 优化(#5675/#5684) https://github.com/flagos-ai/FlagGems/pull/5675
16 FlagTensor Iluvatar 适配(#15) https://github.com/flagos-ai/FlagTensor/pull/15
17 FlagDNN Iluvatar WIP(#9) https://github.com/flagos-ai/FlagDNN/pull/9
18 sglang-plugin-FL 燧原 GCU 后端(#42) https://github.com/flagos-ai/sglang-plugin-FL/pull/42
19 FlagTree HINT/#1040/TLE stubs https://github.com/flagos-ai/FlagTree/pull/1040
20 FlagSparse DCU bsr 结果校验(#47) https://github.com/flagos-ai/FlagSparse/pull/47
21 FlagOS-Compressor AutoRound(#6) https://github.com/flagos-ai/FlagOS-Compressor/pull/6
22 org repos 总览(52 仓,13 仓窗口内活跃) https://api.github.com/orgs/flagos-ai/repos?per_page=100&sort=updated
23 commit search(窗口内 59 条唯一提交) https://api.github.com/search/commits?q=org:flagos-ai+committer-date:%3E2026-08-24T02:18:00Z
24 gnews 中英文 9 组查询(组件级零命中) https://news.google.com/rss/search?q=FlagOS+when%3A14d&hl=zh-CN&gl=CN&ceid=CN%3Azh-Hans
25 HN Algolia(无关误匹配) https://hn.algolia.com/api/v1/search_by_date?query=FlagOS
26 Tavily 交叉验证(灵境智源身份核查、FlagOS 无额外报道) https://www.tavily.com