FlagOS 每日动态报告(2026-08-25)
调研窗口:2026-08-24 10:18 ~ 2026-08-25 10:18 北京时间 信源:GitHub(org: flagos-ai 52 仓 + commit search + PR/Release API)、Google News RSS(中英文 9 组查询,代理链路正常)、HN Algolia、Tavily 交叉验证(详见附录)
索引
- 一、开源项目进展(GitHub 动态)
- 1.1 vllm-plugin-FL v0.3.0-rc0 发布——FlagOS 2.1 后首个新版本线候选(窗口头条)(08-24)
- 1.2 build-infra:vllm 0.20.2 验证矩阵扩围——摩尔线程 F/T 双路径全过、沐曦 app image 落地(08-24/08-25)
- 1.3 build-infra:验证驱动硬化——「通过」语义升级为真实 E2E(08-24/08-25)
- 1.4 Torch-FL:torch.compile 三后端落地(MetaX/MUSA/Enflame GCU)(08-24)
- 1.5 FlagGems:KernelGen Nvidia 算子扩充 13+,昇腾/摩尔线程优化(08-24/08-25)
- 1.6 FlagTensor/FlagDNN:天数智芯 Iluvatar 后端适配启动(08-24/08-25)
- 1.7 其他仓库动态(sglang-plugin-FL 燧原后端、Qwen3.5 兼容、FlagTree、FlagSparse、FlagOS-Compressor)
- 二、新闻报道与生态
- 2.1 新闻侧总体评价(连续第六日组件零命中)
- 2.2 近 3 天趋势(GitHub org pushed 佐证)
- 2.3 排除项
- 三、成员单位深挖
- 四、总结
- 附录:完整信源清单
一、开源项目进展(GitHub 动态)
窗口总览:org 内 52 个仓库中 13 个在窗口内有推送;commit search 命中 59 条唯一窗口内提交(FlagGems 20、build-infra 19、Torch-FL 6、FlagSparse 6、FlagTensor 3、vllm-plugin-FL 2、FlagTree 1、FlagOS-Compressor 1、sglang-plugin-FL 1)。窗口头条是 vllm-plugin-FL v0.3.0-rc0 发布——FlagOS 2.1(6/24)之后首个新版本线候选,面向 vLLM 0.24.0;本窗口主线为「推理侧验证矩阵扩围(摩尔线程、沐曦入列)+ torch.compile 多后端落地(MetaX/MUSA/GCU)+ 天数智芯 Iluvatar 新后端适配」。
1.1 vllm-plugin-FL v0.3.0-rc0 发布——FlagOS 2.1 后首个新版本线候选(窗口头条)
来源:Release v0.3.0-rc0(8/24 11:45 北京时间发布,target main,无 prerelease 标记)
- 首个 v0.3.0 线候选版本:自 6/24 FlagOS 2.1 同步发布 vllm-plugin-FL v0.2.0 以来,这是该组件第一个新版本线候选。0.3 线面向 vLLM 0.24.0(与 8/23-24 昆仑芯 0.24.0 验证序列同线呼应),发布动作落在本窗口(tag 于 8/21 创建,8/24 11:45 正式发布)。
- 配套动态:#403 version doc(8/24 14:26)为版本发布补充文档;#383 Qwen3.5 text-only 运行时兼容(8/24 15:23 合入 main)——为 v0.3.0-dev 分支(目标 vLLM 0.24.0)增加 Qwen3.5 dense 与 MoE 的文本-only 运行时支持:上游 vLLM 已含 causal model 类但未完整注册规范文本 config、hybrid cache 辅助与 VL 前缀 checkpoint 映射,兼容层由通用插件安装、不改动 vLLM 包与编译的
_moe_C扩展。因合入晚于 rc0 切点(11:45),预计进入后续 rc。 - 观察点延续:昆仑芯 decode scale 修复 PR #400(base release/0.2 线)仍开放——
patch_decode_attention将 decode 路由到prefill_attention时传的是原始 decode scale(1/sqrt(head_size))而非其期望的 adjusted scale(scale*sqrt(head_size)),约 11 倍偏小的 alpha 压平 softmax,导致昆仑芯 P800 XPU 上 Qwen3-4B decode 输出乱码;修复为乘 sqrt(head_size)(head_size=128 时 scale=1.0)。
解读:0.3.0-rc0 的发布节奏与 8/23-24 的验证浪潮直接咬合——昆仑芯 0.24.0、NVIDIA cuda13.3 等后端验证都基于 0.24 线,rc0 把这条线推成正式候选。Qwen3.5 兼容(#383)紧随其后合入主线,说明「新模型 Day0 兼容」仍是 vllm-plugin-FL 的核心价值主张(呼应 4 月 DeepSeek-V4 八芯片 Day0 适配)。
1.2 build-infra:vllm 0.20.2 验证矩阵扩围——摩尔线程 F/T 双路径全过、沐曦 app image 落地
来源:#506、#508、#510、#512、#514、#516、#521、#522(8/24 14:58-21:55)、#523(8/24 22:37)、#524(8/25 08:43)
- 摩尔线程(MThreads)双后端 F/T 双路径全过:#506 为
mthreads-musa4.3.6与mthreads-musa5.2.0开启 vllm0.20.2 app image 构建(deps_app.vllm0.20.2键是 app-image 工作流的矩阵门控);#508 记录两个后端在 app image2.1.2-0.2.1上(Qwen3-4B)FlagTree(F)与 Triton(T)双路径 serve E2E 全部通过,并纠正了此前「triton absent」误报(triton 3.6.0 是/opt/triton侧装、经compiler()后才对importlib.metadata可见)。 - 沐曦(MetaX)app image 落地:#510 为 metax 后端开启 0.20.2 构建;#512/#514 记录
metax-maca3.7.2.1与metax-maca3.8.1.3两个版本的 app image tag2.1.2-0.2.1_g825c1cd;#516 在 record 步骤将 deps_app 与 image_tag 一并置位;#521/#522 把 vllm-plugin-fl 纳入 0.20.2 full-install 路径、并按 image_tag 逐后端派生插件版本。 - 收尾与配套:#523 关闭昆仑芯 triton attention bug 的实验记录(experiment closure,对应上游 PR #268);#524 为昇腾 megatron 线把 torchvision/torchaudio 烘进 runtime deps。
解读:vllm 0.20.2 验证矩阵从「NVIDIA、昆仑芯、昇腾」三家扩到五家——摩尔线程成为第四家完成双编译器全验证的后端(且 musa4.3.6/5.2.0 两个代际双后端同时翻绿),沐曦两个 maca 版本的 app image 已构建落地、tag 入矩阵(F/T 通过状态尚未见明确记录,属流程进行中)。「推理侧验证矩阵集体翻绿」主线在昨日昇腾之后继续向摩尔线程、沐曦扩散,验证范式的模板化使新后端从开启构建到记录验证只需小时级。
1.3 build-infra:验证驱动硬化——「通过」语义升级为真实 E2E
来源:#517(8/24 19:20)、#518(8/24 20:22)、#519(8/24 20:34)、#520(8/24 20:47)、#525(8/25 09:14)
- #517:验证标记语义升级。此前矩阵里的「通过」标记只由 verify 脚本退出码决定,实质仅证明「安装成功 + import 不炸」;本次把各后端已验证的 E2E 配方接进脚本,「通过」= 负载真实跑通且退出码 0(
verify-vllm-backend.sh的 serve 测试改为--app-image模式,缺MODEL_PATH即失败)。 - #518:plan 任务此前只收集每个待验证单元格的默认编译器列(有 FlagTree 收 F、否则收 T),现在 F/T 两列都显式收集(两个 verify 脚本均支持
--compiler flagtree|triton)。 - #519/#520:results 分支改为 main 快照重建(不再 rebase);单个失败单元格使整个 verify job 失败——不再静默吞错。
- #525:serve 就绪检查从固定 60s sleep 改为轮询 readiness——验证提速且更可靠。
解读:这是昨日 status-matrix 体系(YAML 化 + 发布自动回写)的配套收口——把「验证状态机」的判定逻辑本身硬化:标记语义从「安装级」升到「负载级」,双编译器列都强制显式验证,失败不可掩盖。多芯片验证规模扩大后,验证结果的可信度成为 build-infra 的下一个工程重点。
1.4 Torch-FL:torch.compile 三后端落地(MetaX/MUSA/Enflame GCU)
来源:#158(8/24 17:28)、#159(8/24 20:32)、#160(8/24 16:59)、#162(8/24 20:27)、#164(8/24 21:03)
- #158:MetaX torch.compile 验证落地(Claude Code 提 PR、人类 reviewer @zhaoyinglia 把关):在真实 FlagTree MetaX 构建上跑通 compile 集成套件,修复两个只在官方 CPU torch wheel 上暴露的 Inductor autotuning 失败——MetaX 流 shim 破坏
Event.record()、以及 maca Triton backend 名泄漏到torch.device();并把镜像内 vendor Triton 暴露给 CI venv、补回归测试。 - #159:MUSA torch.compile 直绑 torch_fl:为
ACCELERATOR=musa注册torch.compile(backend="flagos"),经摩尔线程 FlagTree 运行时实现。过程有取舍:初版用 fabricated 兼容模块满足驱动import torch_musa被维护者否决,要求 FlagTree 直接绑定 torch-fl 后才合入。 - #160:Enflame GCU S60 AMP 验证:先在 S60 硬件实测平台约束再动手,
tests/integration/test_amp.py从全部 skip 到 25 项全过,共享AutocastPrivateUse1策略生效。 - #162/#164:为 Enflame 建独立 wheel CI 流水线;CUDA CI 也纳入 torch.compile 测试。
解读:torch.compile 路径从「单后端实验」走向「多后端标准能力」——MetaX、MUSA、Enflame GCU 三后端同日落地/验证,且全部以真实硬件实测为准。AI agent(Claude Code)辅助提 PR + 人类 reviewer 把关的协作模式在 Torch-FL 已成常态(#158/#159/#160 均为该模式),是 FlagOS 开源协作流程的一个新特征。
1.5 FlagGems:KernelGen Nvidia 算子扩充 13+,昇腾/摩尔线程优化
来源:KernelGen Nvidia 算子序列(#3408/#4008/#5355/#5491/#5653/#5291/#5367/#5519/#5114/#5116/#5117/#5118/#5211,8/24 14:07-8/25 07:01)、#5383、#5675、#5684
- KernelGen Nvidia 算子覆盖批量扩充(13+ 个 Triton 算子):special 函数族(special_bessel_y1、special_logit、special_log_ndtr)、RNN/LSTM 族(mkldnn_rnn_layer 单层 LSTM、
_cudnn_rnn_backward单层单向 LSTM 反向)、激活反向族(hardsigmoid/hardswish/hardtanh backward)、量化族(quantized_lstm、alpha_dropout_)、张量操作(fliplr、_upsample_nearest_exact1d_backward、sym_constrain_range)。这是 KernelGen(自动算子生成)对 torch 算子面覆盖的持续扩张。 - 昇腾:#5383 优化 AddMM 的 layout 与 bias epilogue;KMcompiler 路径下调用
torch.linalg.matrix_norm的修复系列(#5707/#5708/#5712,8/24 15:38-17:29)。 - 摩尔线程:MTHREADS 后端
constant_pad_ndoverride 优化(#5675)与 FillCopy 路径优化(#5684)。
1.6 FlagTensor/FlagDNN:天数智芯 Iluvatar 后端适配启动
来源:FlagTensor iluvatar 提交(8/24 23:33)、FlagTensor #15(8/25 10:03 合入)、FlagDNN Iluvatar WIP(8/24 12:09-14:18)
- FlagTensor(Triton 张量原语库:unary 28 / binary 4 / contraction 6,对标 cuTensor,基于 FlagTree):修复 Triton 3.6 兼容(flagtree 0.6.1 + iluvatar3.6)并为 Iluvatar 增加 tune_configs;#15 将 iluvatar 分支合入 main(8/25 10:03)。
- FlagDNN:WIP Iluvatar backend adaptation(8/24 12:09)+ 同步合入(#9,8/24 12:20),另有 ascend 修复(8/24 11:29)。
解读:天数智芯(Iluvatar)成为本窗口新增的活跃后端——FlagTensor 与 FlagDNN 两个组件同时启动其适配,配合 8/21 FlagPrism 等仓库的推送节奏,国产芯片接入继续按「组件矩阵逐个点亮」的路径推进。
1.7 其他仓库动态
- sglang-plugin-FL:#42 feat: add enflame gcu(8/24 15:01)——sglang 插件新增燧原 GCU 后端,用 qwen3.6-27b 与 qwen3.6-35b-a3b 实测。
- FlagTree:#1034 HINT backend selection 修复(8/24 11:08);TLE C++ 模块生成 python stubs 并补类型注解(8/24 11:18);#1040 PPU AABS min size 修复(8/24 23:43)。
- FlagSparse:DCU 测试健壮性提升(test robust up)+ #47 dcu bsr spmv/spmm 逐矩阵结果校验(8/24 14:46-21:02)。
- FlagOS-Compressor:#6 calibrated GPTQ/AWQ + native AutoRound(8/24 12:55)——纯 PyTorch AutoRound 支持对称 W4A16/W8A16(SignSGD、min/max 调优、最优参数恢复、级联量化输入),量化算法与 checkpoint 打包解耦,设备后端泛化到 CUDA/NPU/MLU/MUSA 及注册自定义设备。
- docs / release-info / FlagCX:pushed_at 在窗口内但主分支无窗口内合入(非默认分支同步/例行更新),与昨日模式一致。
二、新闻报道与生态
2.1 新闻侧总体评价
Google News RSS 代理链路正常,9 组中英文查询(FlagOS/FlagGems/FlagScale+FlagTree+FlagPerf/智源研究院 开源/智源 when:3d/BAAI open source 等)中组件关键词窗口内零直接命中——连续第六日组件级新闻平静(8/20-8/25),与历史规律一致;HN Algolia 仅 Xiaomi Xring SoC、ID 扫描仪误报等无关条目误匹配(剔除)。智源相关窗口内命中均为智源社区聚合转载的泛 AI 新闻(Anthropic 就业影响、GPT-5.6 降价、谷歌 TPU 之父跳槽、深势科技科研平台等),与 FlagOS 无直接关联;「灵境智源 WRC 2026 具身智脑」系列报道经核查为上海灵境智源科技有限公司(孙博创立,2025-07 成立)——非智源研究院,剔除(详见 2.3)。新闻侧无可收录新条目,本报告主体为 GitHub 动态。
2.2 近 3 天趋势(GitHub org pushed 佐证)
| 日期 | 活跃仓库 | 主要内容 |
|---|---|---|
| 8/22~8/23(昨日窗口) | build-infra(6)、Megatron-LM-FL(集成分支)、FlagSparse(3) | 寒武纪双后端 E2E(去 shim);昆仑芯 0.20.2 双编译器 E2E;status-matrix 体系上线;昇腾 vllm 0.20.2 双编译器 F/T 全过 |
| 8/23~8/24(昨日窗口) | build-infra(18)、Torch-FL(1) | 昆仑芯 vllm 0.24.0 双编译器 verified;NVIDIA cuda13.3 0.20.2 verified;status-matrix YAML 化;vllm-plugin-FL 纯 Python 构建统一 |
| 8/24~8/25(本窗口) | build-infra(19)、FlagGems(20)、Torch-FL(6)、FlagSparse(6)、FlagTensor(3)、vllm-plugin-FL(2)、FlagTree(1)、FlagOS-Compressor(1)、sglang-plugin-FL(1) | vllm-plugin-FL v0.3.0-rc0 发布;摩尔线程 vllm 0.20.2 F/T 双路径全过(双 musa 后端);沐曦 app image 落地;torch.compile 三后端落地(MetaX/MUSA/GCU);FlagGems KernelGen 13+ 新算子;天数智芯 Iluvatar 适配启动(FlagTensor/FlagDNN) |
趋势判断:主线从「验证矩阵集体翻绿」演进为「验证矩阵扩围 + 验证语义硬化 + 推理/编译新能力并进」。推理侧(vllm 0.20.2)矩阵已覆盖 NVIDIA、昆仑芯、昇腾、摩尔线程四家双编译器全过 + 沐曦 app image 落地;torch.compile 作为跨后端编译能力在 MetaX/MUSA/GCU 三后端同日落地,配合 FlagGems KernelGen 算子自动生成覆盖扩张与 Qwen3.5 兼容,FlagOS 的「编译 + 算子 + 推理插件」三条能力线都在向多芯片纵深推进;天数智芯 Iluvatar 成为新后端接入点(FlagTensor/FlagDNN 双组件)。v0.3.0-rc0 为 2.1 后首个新版本线候选,正式版节奏与昆仑芯 0.24.0 线、Qwen3.5 兼容(#383)的合入状态联动。
2.3 排除项
- 「WRC 2026 收官|灵境智源以具身智脑底座定义产业上限」(亿邦动力网 8/24)、「WRC 2026 闭幕:具身智脑成’落地战’关键底座」(搜狐 8/25)——「灵境智源」为上海灵境智源科技有限公司(具身智脑 T300/T81,CEO 孙博),非智源研究院;名称含「智源」触发 gnews 匹配,核查后剔除。
- 智源社区窗口内聚合转载(Anthropic 就业数据、GPT-5.6 Sol 降价、谷歌 TPU 之父跳槽 Anthropic、深势科技科研平台、优必选 WRC 等 8/24 多条)——智源社区是 AI 新闻聚合平台,条目为泛 AI 行业新闻,与 FlagOS 无直接关联。
- 《前沿AI风险与应急响应研究报告(征求意见稿)》(智源社区 8/24)——BAAI 安全研究方向成果,非 FlagOS 系统软件栈动态。
- 博彩 SEO 污染(「智源研究院发布并开源新开元棋牌游戏」「体育投注app下载」等 womenofchina.com 8/21-8/24)——按标题关键词整批剔除。
- Qwen3.8-2.4T 九芯适配报道(8/14 智源社区)、AI Compiler 活动回顾(8/20)——窗口外旧闻。
- HN 命中(Xiaomi Xring SoC、ID scanner 误报、Talk Like Claude Day)——与 FlagOS 无关误匹配。
三、成员单位深挖
窗口内多厂商动态图谱:
| 厂商 | 芯片/后端 | 窗口内动态 | 证据 |
|---|---|---|---|
| 智源 | — | build-infra 主导 vllm 矩阵扩围(摩尔线程/沐曦)与验证驱动硬化(37 条提交);vllm-plugin-FL v0.3.0-rc0 发布;新闻侧连续第六日组件零命中 | build-infra PR 序列、vllm-plugin-FL release |
| 摩尔线程 | MThreads MUSA | vllm 0.20.2 app image F/T 双路径全过(musa4.3.6 + musa5.2.0,image 2.1.2-0.2.1,#506/#508);torch.compile 经 FlagTree 直绑 torch_fl(#159);FlagGems constant_pad_nd 优化(#5675/#5684) | build-infra #506/#508、Torch-FL #159、FlagGems #5675/#5684 |
| 沐曦 | MetaX MACA | vllm 0.20.2 app image 落地(maca3.7.2.1 + maca3.8.1.3,tag 2.1.2-0.2.1_g825c1cd,#510/#512/#514);MetaX FlagTree torch.compile 验证 + CI 覆盖(#158) | build-infra #510/#512/#514、Torch-FL #158 |
| 燧原 | Enflame GCU | sglang-plugin-FL 新增 GCU 后端(#42,qwen3.6-27b/35b-a3b 实测);GCU S60 AMP 验证 25 项全过(#160);独立 wheel CI 流水线(#162) | sglang-plugin-FL #42、Torch-FL #160/#162 |
| 天数智芯 | Iluvatar | 新后端适配启动:FlagTensor Triton 3.6 兼容 + iluvatar tune_configs + 分支合入(#15);FlagDNN WIP Iluvatar backend(#9) | FlagTensor 提交、FlagDNN 提交 |
| 昆仑芯 | KunlunXin XPU | triton attention bug 实验收尾(build-infra #523,对应上游 PR #268);vllm-plugin-FL #400 decode scale 修复仍开放(release/0.2 线) | build-infra #523、vllm-plugin-FL #400 |
| 昇腾(华为) | Ascend | megatron runtime deps 补 torchvision/torchaudio(#524);FlagGems AddMM layout 优化(#5383)+ KMcompiler matrix_norm 修复(#5707/#5708/#5712) | build-infra #524、FlagGems 提交 |
| NVIDIA(生态参考) | CUDA | FlagGems KernelGen 13+ 新 Triton 算子(RNN/LSTM、激活反向、special 函数、量化族) | FlagGems PR 序列 |
| 寒武纪 / 海光 / 清微 / 地平线 | MLU / DCU / TXDA / BPU | 开源侧无窗口内新合入(寒武纪 8/22 已报;海光 FlagSparse DCU 侧为测试健壮性提升 #47,非新功能) | — |
趋势判断:本窗口芯片版图关键词是「新后端入列 + 编译能力跨后端落地」。摩尔线程凭 vllm 0.20.2 双 musa 后端 F/T 双路径全过成为矩阵第四家「双编译器全过」后端,沐曦紧随其后完成 app image 落地;torch.compile 在 MetaX、MUSA、Enflame GCU 三后端同日验证,把「编译栈多芯片覆盖」从训练框架扩展到 PyTorch 编译路径;天数智芯成为新接入点(FlagTensor/FlagDNN 双组件启动 Iluvatar 适配)。AI agent 辅助开发(Claude Code 提 PR + 人类 reviewer 把关)在 Torch-FL 已成常态,开源协作模式本身也在变化。
四、总结
- vllm-plugin-FL v0.3.0-rc0 发布(窗口头条):FlagOS 2.1(6/24)后首个新版本线候选(8/24 11:45 发布),面向 vLLM 0.24.0;Qwen3.5 text-only 兼容(#383)在 rc0 切点后合入主线,预计进入后续 rc;昆仑芯 decode scale 修复(#400)仍开放。
- vllm 0.20.2 验证矩阵扩围:摩尔线程双后端(musa4.3.6/5.2.0)F/T 双路径全过,成为第四家双编译器全过后端(#506/#508);沐曦双 maca 版本 app image 落地(#510/#512/#514)。「新后端从开启构建到记录验证」已模板化为小时级流程。
- 验证驱动硬化:「通过」语义从安装级升级为「真实 E2E workload 跑通且退出码 0」(#517);F/T 双编译器列强制显式收集(#518);失败单元格使 verify job 失败(#520);serve 就绪轮询替代固定 sleep(#525)——多芯片验证状态进入「可信可审计」阶段。
- torch.compile 三后端落地:MetaX(#158)、MUSA(#159,FlagTree 直绑 torch_fl)、Enflame GCU AMP(#160,25 项测试全过),外加 Enflame 独立 wheel CI(#162);Claude Code 提 PR + 人类 reviewer 把关的协作模式成为常态。
- 天数智芯 Iluvatar 新后端适配启动:FlagTensor(Triton 3.6 兼容 + tune_configs,分支合入 #15)与 FlagDNN(WIP backend)双组件并进。
- FlagGems KernelGen 算子覆盖扩张:Nvidia 侧 13+ 新算子(RNN/LSTM 前后向、激活反向族、special 函数、量化族),昇腾 AddMM/KMcompiler 修复、摩尔线程 pad 优化;sglang-plugin-FL 新增燧原 GCU 后端(#42);FlagOS-Compressor 新增 native AutoRound 量化(#6)。
- 新闻侧连续第六日组件零命中:无 2.x 正式发布信号(build-infra tag 仍 v2.1.x 线);生态侧无可收录条目。下一观察点:v0.3.0 正式版发布(含 Qwen3.5 兼容)、vllm-plugin-FL #400 合入、沐曦双编译器验证状态、FlagDNN/FlagTensor Iluvatar 适配完成度。
局限性说明:提交数量与合入时间来自 commit search 与 repos/commits API(搜索索引可能略滞后,个别仓库 pushed_at 与主分支提交存在分支同步差异,已用 commits API 核验);build-infra E2E 环境细节以 PR 描述为准;沐曦「app image 落地」不涉及其 F/T 验证完成状态的推断;v0.3.0-rc0 的 tag 创建时间(8/21)早于发布动作(8/24),已如实区分;gnews 跳转链接无法抓取正文,新闻侧判断依赖标题与多源交叉印证,可能存在低权重中文来源漏检。
附录:完整信源清单
| 编号 | 事件 | 来源链接 |
|---|---|---|
| 1 | vllm-plugin-FL v0.3.0-rc0 发布 | https://github.com/flagos-ai/vllm-plugin-FL/releases/tag/v0.3.0-rc0 |
| 2 | vllm-plugin-FL Qwen3.5 text-only 兼容(#383) | https://github.com/flagos-ai/vllm-plugin-FL/pull/383 |
| 3 | vllm-plugin-FL 昆仑芯 decode scale 修复(#400,仍开放) | https://github.com/flagos-ai/vllm-plugin-FL/pull/400 |
| 4 | build-infra 摩尔线程 vllm 0.20.2 F/T 双路径全过(#506/#508) | https://github.com/flagos-ai/build-infra/pull/508 |
| 5 | build-infra 沐曦 vllm 0.20.2 app image(#510/#512/#514) | https://github.com/flagos-ai/build-infra/pull/512 |
| 6 | build-infra 验证驱动硬化(#517/#518/#519/#520/#525) | https://github.com/flagos-ai/build-infra/pull/517 |
| 7 | build-infra 昆仑芯 triton attention 实验收尾(#523) | https://github.com/flagos-ai/build-infra/pull/523 |
| 8 | build-infra 昇腾 megatron runtime deps(#524) | https://github.com/flagos-ai/build-infra/pull/524 |
| 9 | Torch-FL MetaX torch.compile 验证(#158) | https://github.com/flagos-ai/Torch-FL/pull/158 |
| 10 | Torch-FL MUSA torch.compile 直绑(#159) | https://github.com/flagos-ai/Torch-FL/pull/159 |
| 11 | Torch-FL Enflame GCU AMP 验证(#160) | https://github.com/flagos-ai/Torch-FL/pull/160 |
| 12 | Torch-FL Enflame wheel CI(#162) | https://github.com/flagos-ai/Torch-FL/pull/162 |
| 13 | FlagGems KernelGen Nvidia 算子序列(#5519 等 13+) | https://github.com/flagos-ai/FlagGems/pull/5519 |
| 14 | FlagGems 昇腾 AddMM 优化(#5383) | https://github.com/flagos-ai/FlagGems/pull/5383 |
| 15 | FlagGems MTHREADS pad 优化(#5675/#5684) | https://github.com/flagos-ai/FlagGems/pull/5675 |
| 16 | FlagTensor Iluvatar 适配(#15) | https://github.com/flagos-ai/FlagTensor/pull/15 |
| 17 | FlagDNN Iluvatar WIP(#9) | https://github.com/flagos-ai/FlagDNN/pull/9 |
| 18 | sglang-plugin-FL 燧原 GCU 后端(#42) | https://github.com/flagos-ai/sglang-plugin-FL/pull/42 |
| 19 | FlagTree HINT/#1040/TLE stubs | https://github.com/flagos-ai/FlagTree/pull/1040 |
| 20 | FlagSparse DCU bsr 结果校验(#47) | https://github.com/flagos-ai/FlagSparse/pull/47 |
| 21 | FlagOS-Compressor AutoRound(#6) | https://github.com/flagos-ai/FlagOS-Compressor/pull/6 |
| 22 | org repos 总览(52 仓,13 仓窗口内活跃) | https://api.github.com/orgs/flagos-ai/repos?per_page=100&sort=updated |
| 23 | commit search(窗口内 59 条唯一提交) | https://api.github.com/search/commits?q=org:flagos-ai+committer-date:%3E2026-08-24T02:18:00Z |
| 24 | gnews 中英文 9 组查询(组件级零命中) | https://news.google.com/rss/search?q=FlagOS+when%3A14d&hl=zh-CN&gl=CN&ceid=CN%3Azh-Hans |
| 25 | HN Algolia(无关误匹配) | https://hn.algolia.com/api/v1/search_by_date?query=FlagOS |
| 26 | Tavily 交叉验证(灵境智源身份核查、FlagOS 无额外报道) | https://www.tavily.com |