調査期間:2026-09-22 10:00 ~ 2026-09-23 10:00(約 24 時間;09-22 デイリーレポートの期間を引き継ぎ、空白なし) 情報源:GitHub(org: flagos-ai、54 リポジトリの pushed_at を全量核查、期間内に 24 リポジトリでプッシュあり;コミット検索が 143 件ヒット、14 リポジトリに跨る;Release Info ポータルと community リストを逐ページ照合)、Google News RSS(中英文 24 組のクエリ語、プロキシ経由)、AICC2026 大会公式サイトと報道(光明網 / 新京報 / CBISMB)、2026 雲栖大会報道(観点網 / 毎日経済新聞 / 東方財富 / 阿里雲開発者コミュニティ)、龍芯中科リリース(IT之家 / 快科技)など(詳細は付録情報源リスト参照)


本期インデックス

  • 今日の重点:2.2 GA(09-28)まで 5 日——リリースリストのデータベース登録、Release Info ポータル再構築、Megatron アプリケーションイメージ 2.2.0-0.2.3 が 14 のバックエンド行をカバー(09-22/09-23)
    • 1.1 リリースエンジニアリング補足:FlagCX wheel チャネルが崑崙芯と全行へ推進、deb/rpm が各パッケージングコンポーネントをカバー(09-22/09-23)
    • 1.2 FlagQuantum:単一期間で 38 件——クラウド QPU スキャフォールド、三大フレームワーク相互接続、シミュレーション融合加速(09-22)
    • 1.3 FlagGems:KernelGen が Nvidia オペレータをさらに 15 枚補充;六プラットフォームの修正と最適化を密集合入(09-22/09-23)
    • 1.4 FlagGems-vllm:昇騰 XCS 新オペレータ合入;摩尔線程 / 海光 / 沐曦の三つが審査中から合入へ(09-22/09-23)
    • 1.5 Torch-FL:11 件で収束——DCU と昇騰の修正、ビルドマトリクス統一、退役コードのクリーンアップ(09-22/09-23)
    • 1.6 その他の動向:FlagCX 転送強化、FlagSparse 三バックエンド推進、TransformerEngine-FL NPU バックエンド、FlagTree PPU CI(09-22/09-23)
    1. ニュース報道とエコシステム
      • 2.1 AICC2026 が北京で開催:FlagOS の 2 講演と「可靠AI」評価体系が始動(09-21/09-22)
      • 2.2 雲栖大会:達摩院玄鉄が真武 V900 を発表——FlagOS サポートプラットフォーム PPU が次世代ハードウェアを迎える(09-22)
      • 2.3 国産算力ソフトウェアスタックの動向:龍芯加速計算プラットフォームの初版リリース;数貿会が本日開幕(09-22/09-23)
      • 2.4 コンポーネントレベル検索は連続 18 回目の平穏な期間(09-22/09-23)
    1. メンバー単位の深掘り
      • 3.1 海光:DCU インデックス境界修正と INT8 ブロック状 BMM 合入(09-22/09-23)
      • 3.2 摩尔線程:W8A8 可変長注意力量化サポート合入;AICC2026 講演と「可靠AI」参加(09-22)
      • 3.3 沐曦:融合逆 RoPE 量子化オペレータ合入;topk W8A16 最適化と MACA FFT デフォルト戦略(09-22)
      • 3.4 昇騰:オペレータバッチとテストイメージ更新;TransformerEngine-FL NPU バックエンド実装(09-22/09-23)
      • 3.5 天数智芯:Iluvatar wheel 22.04 再構築ラインとコンテナ行の登録(09-22/09-23)
      • 3.6 燧原:複数行イメージ登録と sglang アプリケーション行(09-22/09-23)
      • 3.7 清微智能:AICC2026 議題とランタイム行(09-22)
      • 3.8 達摩院玄鉄:真武 V900 と PPU CI の収口(09-22/09-23)
    1. まとめとトレンド観察
  • 付録:情報源核查表
  • 完全情報源リスト

今日の重点:2.2 GA(09-28)まで 5 日——リリースリストのデータベース登録、Release Info ポータル再構築、Megatron アプリケーションイメージが 14 のバックエンド行をカバー

日付:2026-09-22 ~ 2026-09-23 出典:community #111、release-2.2.yaml、Release Info ポータル、build-infra #1019 から #1034

コミュニティの2.2 リリーストラッキング(#47)の公式スケジュールによると、rc2 安定期間は 09-24 締切(以降は hotfix のみ受け付け)、GA Go/No-Go は 09-28 に設定。本期間はまさに収口期にあり、リリースエンジニアリングは一日で三線が推進:

  1. つ目は、公式リリースリストのデータベース化が始まったことです。09-23 00:11 に community #111 がマージされました。新規追加された release/2.2/release-2.2.yaml は FlagOS 2.2 の公式リリースソースリスト(vcstool 形式、vcs import で全コンポーネントのソースコードを一括取得するためのもの)です。リストの先頭エントリは sglang-plugin-fl v0.2.0(公式タグは当該モジュールが最終 rc2 検証を通過したコミットに付与、ブランチ 0.2.0-rc2、HEAD 1c84db7)。ファイル冒頭にはバージョン規範が明記されています。公式タグは一律ベアバージョン番号(rc/post サフィックスなし)、FlagTree は例外でアップストリームのローカルバージョン形式(例 0.7.0+triton3.6)を保持。構造上は L2「フレームワーク適配層」などの階層で構成され、後続コンポーネントは順次追加されます。

  2. つ目は、アプリケーションイメージ登録が 14 のバックエンド行まで進展したことです。build-infra の当調査期間における 33 件のコミットのうち、Megatron-LM-FL アプリケーションイメージタグ 2.2.0-0.2.3 が 14 のプラットフォーム行で集中登録されました(nvidia-cuda12.8 / cuda13.3、ascend-cann8.5.0 / cann9.0.0、cambricon-neuware4.4.3 / 4.7.2、enflame-tops1.9.10 / 1.10.6、hygon-dtk26.04、iluvatar-corex4.4.0 / 4.5.0、metax-maca3.8.1.3、mthreads-musa4.3.6 / 5.2.0、対応する #1019 から #1033)。付随する修正が 2 件:ビルド手順がロックされた wheel バージョンを直接読み取る(#1018)、インストールバージョンを正確にロックし未ビルドの 2 行を補完(#1017)。同期間に登録されたものとして、vLLM 昆仑芯アプリケーションイメージ 2.2.0-0.3.0rc2.post2(#1012 / #1013、付随する権限付き再ビルド #1010)もあります。

  3. つ目は、Release Info ポータルの再構築です。09-23 06:38 ~ 06:44、リリース情報リポジトリの gh-pages ブランチへ連続 13 回プッシュし、Hugo ポータルを再構築しました(flagos-ai.github.io/release-info)。ポータルは「ベンダー / ベースイメージ(base)/ ランタイムイメージ(runtime)/ アプリケーションイメージ(application)」の 4 層で構成され、20 のプラットフォーム行の base と runtime イメージ、および vLLM(0.20.2 / 0.24.0 の 2 セットのマトリクス)、Megatron(training / rl)、sglang 0.5.18 のアプリケーションイメージをカバーしています。Megatron の nvidia-cuda12.8 行のページを例に取ると、harbor.baai.ac.cn/flagos-app/megatron_training0.17.1-nvidia-cuda12.8:2.2.0-0.2.3 と flagos-runtime-nvidia-cuda12.8:2.2.0 の完全なプル手順がすでに確認できます。イメージ登録、ポータル公開、リストのデータベース化という 3 つのラインが本調査期間で初めて同日に整い、2.2 のリリース物が対外的に可視化され始めました。

バージョンブランチ側も同期して進行しています。FlagTree 0.7.0-rc2-triton3.6(09-23 09:36 プッシュ)、vllm-plugin-FL 0.3.0-rc2(09-22 23:20、#549)、FlagScale 2.1.0-rc2(09-23 08:43、#1301 を main から摘出)、sglang-plugin-FL 0.2.0-rc2(v0.2.0 はタグ付け済み)。


1. オープンソースプロジェクトの進展(GitHub 動向)

調査期間総覧:org 内の 54 リポジトリのうち 24 個が調査期間中にプッシュあり。コミット検索は 143 件ヒット(14 リポジトリにまたがる)。ほかに release-info(gh-pages)、FlagScale、vllm-plugin-FL、FlagTree、docs、sglang-plugin-FL などのブランチ側プッシュは検索に含まれていません。分布は以下の通りです。FlagQuantum 38、build-infra 33、FlagGems 28、Torch-FL 11、FlagSparse 10、FlagGems-vllm 6、FlagFFT 4、FlagCX 3、FlagTree 2、FlagAttention 2、FlagBLAS 2、whisper-triton 2、community 1、FlagGems-Experimental 1。

本調査期間の形態 = 「2.2 リリース収束」+「量子スタック大爆発」+「マルチプラットフォーム修正集中」:リリースエンジニアリングは「今日の重点」を参照。FlagQuantum は 38 件で単一リポジトリ最も活発なプロジェクトとなり、FlagGems / FlagGems-vllm / Torch-FL の 3 リポジトリが同時に「修正 + チューニング」のペースに入りました。

1.1 リリースエンジニアリング補足:FlagCX wheel チャネルが昆仑芯と全行まで進展、deb/rpm が各パッケージコンポーネントをカバー(09-22/09-23)

日付:2026-09-22 ~ 2026-09-23 情報源:build-infra #1000、#1002、#1007、#1008、#1014

  • FlagCX wheel 配布ライン:昆仑芯 wheel が着地(#1000、前日デイリーレポートの「審査中」項目を引き継ぎ);wheel チャネルが残り八行すべてで開通(#1002);各行の pin を ref から自動導出(#1007)、毎回の配下時に wheel ref を必ず付与(#1006)、行ごとに発行済み pin と「wheel と torch のバインディング関係」を記録するドキュメント(#1005 / #1016);リリースコンテナがノードプロキシを継承(#1015)。バックエンドごとの事前コンパイル済み wheel の配布形態が「パイロット行」から「全行 + パイプライン固化」へ拡大。
  • ネイティブパッケージカバレッジ:各パッケージングコンポーネントにリポジトリへ入るパスを付与(#1001)、deb と rpm のカバレッジを補完(#1008)——FEP-0019(統合パッケージング統合、Wave 1 には既に FlagCX / FlagTree / FlagSparse / FlagAttention の四リポジトリのマージを含む)の受け入れラインと一致。
  • FlagTree Iluvatar wheel を Ubuntu 22.04 上で再ビルドしビルダーをリリース(#1014、天数ライン)。
  • ほかにドキュメント整理が二件:クロスコンパイラ間の flag_gems ConfigCache 汚染の説を撤回(#1034)、metax の flagtree ダウングレード根拠を退役(#1020)。

1.2 FlagQuantum:単一調査期間 38 件——クラウド QPU スキャフォールド、三大フレームワーク相互接続、シミュレーション融合加速(09-22)

日付:2026-09-22 情報源:FlagQuantum #135、#154、#138、#168、#167

FlagQuantum(FlagOS エコシステムの PyTorch 優先量子 AI フレームワーク)は単一調査期間で 38 件、四つのラインが並行:

  • クラウド QPU 実行:Azure Quantum QPU 実行スキャフォールドを追加(#168)——先月の Braket / CUDA-Q に続くもう一つのクラウドバックエンドライン。
  • クロスフレームワーク相互接続:Amazon Braket 回路アダプタ実装(#154、付随契約 #147)、Cirq 回路変換(#135)と記号パラメータ契約(#166 / #170)、CUDA-Q カーネルエクスポート(#138、有限角 IR 検証を修正 #145)、クロスフレームワーク能力ギャップ追跡(#164)、クロスフレームワーク回路意味論認証テスト(#160)。
  • シミュレーション性能:CPU 状態ベクトルゲート加速(#142)、末尾二量子ビットゲート加速(#143)、クロスライン対角領域融合(#146)、二ライン対角マッチング融合(#153)、単ラインゲート層融合(#157 / #159 / #165)、混合幅領域融合(#169)、およびオプションスイッチ付きベクトル化軌跡行サンプラー(#132)と経路分解 CPU スイムレーン + 差分カーネルネットベンチマーク(#128)。
  • 検証ライン(regional twin):回路スイート検証(#123)、ホールドアウトセット検証(#141)、履歴と評価の永続化(#137 / #144 / #152 / #163)、ドリフトアライメント(#155)、ホールドアウト証拠をゲートとする(#162)、検証通過した候補をリリース(#167)。
  • CI:オプション SDK バージョン間で runner を再利用(#158)、braket カバレッジレーン(#161)、CPU テスト並列化(#149)、重複スイート除去(#150 / #156)、キューボトルネック解消(#148)。

1.3 FlagGems:KernelGen が Nvidia オペレータをさらに 15 枚補完;六プラットフォームの修正と最適化を密にマージ(09-22/09-23)

日付:2026-09-22 ~ 2026-09-23 出典:FlagGems #5245、#5845、#6531、#6339、#5063

  • KernelGen(Nvidia)15 枚:orgqr(#5845)、trapz(#5927)、matrix_power(#5735)、matmul_backward(#5639)、_pad_packed_sequence(#5245)、_scaled_dot_product_attention_math_for_mps(#5259)、_nested_tensor_softmax_with_shape(#5693)、_nested_tensor_from_mask(#5691)、_sample_dirichlet(#5946)、_ctc_loss(#5489)、_batch_norm_with_update(#5828)、_cudnn_rnn(#5823)、_transform_bias_rescale_qkv(#6141)、_spdiags(#6102)、vander(#5945)——自動生成パイプラインは引き続きロングテールオペレータをバッチ補充。
  • NVIDIA 品質ライン:scaled MM のネイティブ FP8 WGMMA を復元(#6531)。
  • 海光:index_reduce_ の昇騰 / 天数 / 沐曦の三プラットフォームにおける問題を修正(#5063、SiliconFlow 貢献)。
  • 沐曦:topk_w8a16_fp8 オペレータをマージおよび最適化(#6339)。
  • 昇騰:cat/concat のディスパッチと実装を改善(#6548)、rrelu_with_noise 実装(#6534、KMCompiler ライン)、nonzero_static ベンチマークをオペレータモードに変更(#6571)、910B 週次テストイメージを更新(#6590)。
  • 量子化と汎用:動的 W4A8 行列積とポータブル 4 ビットパッキング検証(#6494)、block diag をマージ(#6555)、vector_norm の負階数有限値マスクを修正(#5883)。

1.4 FlagGems-vllm:昇騰 XCS の新規オペレータをマージ;摩尔線程 / 海光 / 沐曦の三者が審査中からマージへ(09-22/09-23)

日付:2026-09-22 ~ 2026-09-23 出典:FlagGems-vllm #817、#823、#803、#826

  • 昇騰 XCS:KV プール状態圧縮(kpool)Triton オペレータをマージ(#817、09-23 09:22)、XCS オペレータバッチの推進ペースを継続。
  • 三者が審査中からマージへ:摩尔線程の可変長アテンション W8A8 FP8(#823)、海光の INT8 ブロック BMM と INT8 einsum 収縮(#803)、沐曦の融合逆 RoPE FP8 量子化(#826)——いずれも以前のデイリーレポートの「審査中プール」項目であり、本調査期間に集中して着地。
  • エンジニアリング修正:TLE パスを必要な能力に応じてゲート制御(#833)、テスト依存は既存 numpy をアップグレードしない(#832)。

1.5 Torch-FL:11 件が収束——DCU と昇騰の修正、ビルドマトリクスの統一、退役コードのクリーンアップ(09-22/09-23)

日付:2026-09-22 ~ 2026-09-23 出典:Torch-FL #395、#393、#392、#387、#372

PyTorch 適配層(Torch-FL / PyTorch-Plugin-FL)は本調査期間で 11 件、エンジニアリング面は集中的に収束:

  • デバイス修正:DCU の範囲外インデックス値を直接拒否(#395)、昇騰カーネルはオペランドが存在するデバイスで実行するよう変更(#392)、PPU は CPU torch wheel の CUDA メタデータを復元(#370)、SDPA アテンションはディスパッチモードで autograd グラフを保持(#390)。
  • ビルドと設定:プラットフォーム / ビルドマトリクスを単一テーブルに収束(#387)、未認識または未検出の GEMS_VENDOR は直接エラー(#388)、ruff 設定を新規追加し black/isort を削除(#386)、codegen --check ゲートと登録一貫性テスト(#382)。
  • クリーンアップと性能:グローバルな Tensor.__getitem__ パッチを削除(#372)、MetaX ネイティブツリーなど退役コードを清退(#393)、qwen-image 全有効プロンプトマスクの省略(#371)。

1.6 その他の動態:FlagCX 転送強化、FlagSparse 三バックエンド推進、TransformerEngine-FL NPU バックエンド、FlagTree PPU CI(09-22/09-23)

日付:2026-09-22 ~ 2026-09-23 情報源:FlagCX #594、TransformerEngine-FL #113、FlagTree #1259、FlagSparse #80

  • FlagCX:異種転送の強化とアクセラレータ CI への整合(#594)、p2p engine rpc serve の拡張と barex 転送のアップグレード(#611)、パッケージングはパッケージ変更時のみビルド(#616)。
  • FlagSparse:NCIC-AlphaSparse 協作ブランチが 2 バッチを連合(#79 / #80)——DCU SpMM COO 最適化、MACA SpMM 結果、昇騰 CI と出力、MTX テストが CI に参入。
  • TransformerEngine-FL:NPU バックエンド LayerNorm 実装(#114)とマルチテンソル Adam の NPU バックエンド実装(#113)を新規追加。
  • Megatron-LM-FL:ベンダーバックエンドの互換性と CI 統合を安定化(#174)。
  • FlagTree:メインブランチ PPU CI に pid.txt 検証を追加(#1259、09-23 10:05 マージ)、GEMS 再利用ワークフローに CORE 変更検出を組み込み(#1265)、新規組み込み関数ドキュメントを更新(#1120)。
  • FlagAttention:テストとベンチマークを更新(#69)、pytest に --record / --output を追加(#70)。
  • FlagBLAS:昇騰 L2 性能最適化をマージ(#123——SPR / SPR2 / HPR / HPR2)、外部コントリビューターのパッケージングライン(#1、バージョンを 0.3.0 リリースラインに整合)。
  • FlagFFT:MACA「1d single」測定戦略をデフォルト化、HCU / 昇騰 CANN9 環境ドキュメントを補完。
  • FlagGems-Experimental:KernelGen に dim オペレータを新規追加(#702)。
  • whisper-triton:科達訊飛 Codeup パッチベースラインを同期(#6)。

2. ニュース報道とエコシステム

2.1 AICC2026 が北京で開催:FlagOS の 2 講演と「信頼できる AI」評価体系が始動(09-21/09-22)

日付:2026-09-21(会期)/ 2026-09-22(報道集中発布) 情報源:光明網、新京報、CBISMB、AICC 公式サイト議程

7回目人工知能計算大会(AICC2026)は09-21に北京中関村国際創新センターで開催され、09-22から集中して報道された。FlagOSに直接関連する2件:メインフォーラム09:50の枠で、北京智源人工智能研究院副院長兼総工程師の林咏華氏が「アーキテクチャ創新から利用可能な算力へ:FlagOSが駆動するAI計算のソフト・ハード協調新パラダイム」と題する報告を行い、「AI負荷は収束せず、計算アーキテクチャも1つだけにはならない。ハードウェアの創新を利用可能な算力へ転換するには、共有されたソフトウェアエコシステムの支えが必要である――衆智FlagOSは統一コンパイラ、オペレータ、通信、学習・推論フレームワークなどの能力を通じて、多様なチップの重複適配コストを低減する」と指摘した。また大会議程によれば、智源研究院研究員の趙帥氏が専門フォーラムで「衆智FlagOS:オープンソフトウェアスタックで多様なAI算力の価値を解放する」と題する報告を行った。会議では同時に「信頼性AI」評測ワーキンググループの起動式(工信部電子五所、10:10の枠)が行われ、産業成果の环节でAgent時代に向けた「信頼性AI」評価体系が正式に発表された――工信部電子五所が北京智源研究院、浪潮信息、摩尔線程、沐曦股份、北京開源芯片研究院、百度智能雲、阿里雲など20社余りの産業チェーン企業・機関と共同で発表し、チップ、完成機とインターコネクト、フレームワークとシステム、モデル、データ、応用の全环节をカバーし、信頼性、安全性、安定性の次元から全リンクの評価を展開する。同時期にIDCと浪潮信息が共同で『2026年中国人工知能計算力発展評価報告』を発表:2026年の中国智能算力規模は2576.5 EFLOPS、前年比87.9%増と予測。メンバー単位の議程における密度(摩尔線程、清微智能、智源FlagOSの2件)は、本スタックが既に国内オープン算力エコシステムの常駐議題であることを示している。

2.2 雲栖大会:達摩院玄鉄が真武 V900を発表——FlagOS対応プラットフォームPPUが新世代ハードウェアを迎える(09-22)

日付:2026-09-22 情報源:観点網、毎日経済新聞、東方財富、阿里雲開発者コミュニティ

2026雲栖大会(09-22、杭州)で、阿里巴巴傘下の達摩院玄鉄(T-Head)が新世代の学習・推論一体型AIチップ真武 V900を発表:216GBのメモリ、チップ間インターコネクト帯域1200GB/s、FP8 / FP4低精度計算をネイティブサポート、単チップ性能は前世代の真武 M890の3倍、2027年第1四半期に量産予定。会議では同時に次世代の真武 J900(2028年3月)と倚天720 / 730の2世代サーバーCPU(2027年)を予告し、真武 V900の超節点がメモリ統一アドレッシング能力を備え、千卡全帯域インターコネクトを構成可能であることも明らかにした。真武シリーズはすなわち阿里自研のPPU(Parallel Processing Unit)であり、PPUは既にFlagOSの統一プラグインとコンパイラの対応プラットフォームの1つである(FlagGems-vllm PPUオペレータ、FlagTree PPU CI、FlagDNN PPUアーキテクチャ)――新世代ハードウェアの発表は、本スタックのPPUバックエンドに明確な世代交代の目標ができたことを意味する。

2.3 国産算力ソフトウェアスタック動向:龍芯加速計算プラットフォームが初版リリース、数貿会が本日開幕(09-22/09-23)

日付:2026-09-22 ~ 2026-09-23 情報源:IT之家、快科技、数貿会 AI 展区プレビュー

  • 龍芯中科が09-22に「龍芯加速計算プラットフォーム」の初のソフトウェア版をリリース:龍芯2K3000 / 9A1000に統合されたLG200シリーズ汎用GPUをベースとし、ドライバ、コンパイラ、ランタイム、オペレータライブラリ(BLAS / DNN)、推論エンジン、デバッグと性能分析ツールをカバー、OpenCL 3.0とCUDAの2種類のプログラミングモデルをサポートし、CUDAアプリを低コストで移行可能、さらに9A2000 / 9A3000の進化に伴い世代間ソフトウェア互換を実現することを計画。国産算力の「フルスタックソフトウェアプラットフォーム」の又一例であり、本スタックの「統一ソフトウェアスタックで適配コストを低減する」路線と相互に参照し合う。
  • 第5回グローバルデジタル貿易博覧会が09-23に杭州で開幕(09-27まで):初めて「数貿・芯場景」集積回路応用エコシステム板塊を設置、沐曦などの企業が「チップ + 材料 + 算力」協同展示に参加、算力企業の出展は117社。メンバー単位の産業露出は会議シーズンが引き継ぐ。

2.4 コンポーネント級検索は連続18回目の平穏な調査期間(09-22/09-23)

日付:2026-09-22 ~ 2026-09-23 情報源:Google News RSS(中日英文24組のクエリ語、プロキシ経由)

FlagOS / FlagGems / FlagScale / FlagTree / FlagPerf / FlagCX / KernelGen などのコンポーネント名で中英文検索(when:7d と when:14d)を実施、24 時間ウィンドウのコンポーネント単位ヒットはゼロ、連續第十八回目の平静ウィンドウを構成(前回ウィンドウは第十七回目)。会展側とは対照的:本ウィンドウの対外情報面は AICC2026 と雲栖大会のメンバー/エコシステム動向が担う(2.1—2.3 参照)。HN Algolia は FlagOS / FlagGems などの語に関連ヒットなし;智源コミュニティ検索では FlagOS 関連の新稿は見られない。

3. メンバー単位の深掘り

3.1 海光:DCU インデックス境界修復と INT8 ブロック状 BMM のマージ(09-22/09-23)

日付:2026-09-22 ~ 2026-09-23 出所:Torch-FL #395、FlagGems-vllm #803

  • Torch-FL #395:DCU 上の範囲外インデックス値を直接拒否するよう変更(サイレントな誤結果を防止)。
  • FlagGems-vllm #803(審査中からマージへ):INT8 ブロック状 BMM カーネルと INT8 einsum 縮約(bhr,hdr→bhd)——推論側の低精度行列積に海光実装を補充。
  • ミラー行:megatron_training-hygon-dtk26.04 は 2.2.0-0.2.3 を登録;runtime hygon-dtk26.04 はすでにポータルでリリース済み。

3.2 摩尔線程:W8A8 可変長アテンション量子化サポートのマージ;AICC2026 講演と「信頼できるAI」への参加(09-22)

日付:2026-09-22 出所:FlagGems-vllm #823、AICC 公式サイト議程、CBISMB

  • FlagGems-vllm #823(審査中からマージへ):可変長アテンション(varlen)の W8A8 FP8 サポート——MUSA プラットフォームの量子化パスを開通。
  • AICC2026:摩尔線程ソリューション部副総経理の任燕萍氏が専門フォーラムで講演;また共同発表単位として「信頼できるAI」評価体系に参加。
  • ミラー行:megatron_training-mthreads-musa4.3.6 / musa5.2.0 の 2 行が 2.2.0-0.2.3 を登録。

3.3 沐曦:融合逆 RoPE 量子化オペレータのマージ;topk W8A16 最適化と MACA FFT デフォルト戦略(09-22)

日付:2026-09-22 出所:FlagGems-vllm #826、FlagGems #6339、FlagFFT コミット

  • FlagGems-vllm #826(審査中からマージへ):融合逆 RoPE と FP8 量子化オペレータを新規追加し MetaX 実装を最適化。
  • FlagGems #6339:topk_w8a16_fp8 オペレータの新規追加と最適化(metaX)。
  • FlagFFT:MACA「1d single」測定戦略をデフォルトに変更(測定駆動のチューニングが実験から正式採用へ)。
  • Torch-FL #393:MetaX ネイティブツリーなど退役コードを削除——適配層はプラグイン化へ収束。
  • ミラー行:megatron_training-metax-maca3.8.1.3 は 2.2.0-0.2.3 を登録。

3.4 昇騰:オペレータバッチとテストミラーの更新;TransformerEngine-FL NPU バックエンド実装(09-22/09-23)

日付:2026-09-22 ~ 2026-09-23 出所:FlagGems #6548、#6590、FlagGems-vllm #817、TransformerEngine-FL #113

  • FlagGems:cat/concat のディスパッチと実装の改善(#6548)、rrelu_with_noise(#6534)、nonzero_static ベンチマークの修正(#6571)、910B 週次テストイメージの更新(#6590)。
  • FlagGems-vllm #817:XCS ラインに KV プール状態圧縮(kpool)オペレータを追加(09-23 午前にマージ)。
  • TransformerEngine-FL #113 / #114:マルチテンソル Adam と LayerNorm の NPU バックエンド実装——トレーニング側フレームワークの昇騰バックエンドを补齐。
  • Torch-FL #392:昇騰カーネルをオペランドが存在するデバイス上で実行するように変更し、クロスデバイスディスパッチを修正。
  • イメージ行:ascend-cann8.5.0 / cann9.0.0 および 910c バリアントの複数行登録とポータル公開。

3.5 天数智芯:Iluvatar wheel 22.04 再ビルドラインとコンテナ行の登録(09-22/09-23)

日付:2026-09-22 ~ 2026-09-23 情報源:build-infra #1014、Release Info ポータル

  • build-infra #1014:Iluvatar wheel を Ubuntu 22.04 上で再ビルドするように変更し、そのビルダーイメージを公開——wheel 配布ラインを天数行で补齐。
  • イメージ行:iluvatar-corex4.4.0 / corex4.5.0 の2行で megatron イメージ 2.2.0-0.2.3 を登録;base / runtime 行をポータルで公開。
  • FlagGems #5063 が index_reduce_ の天数プラットフォームでの実装を修正(SiliconFlow 貢献)。

3.6 燧原:複数行のイメージ登録と sglang アプリケーション行(09-22/09-23)

日付:2026-09-22 ~ 2026-09-23 情報源:Release Info ポータル

  • イメージ登録:megatron_training-enflame-tops1.9.10 / tops1.10.6 の2行で 2.2.0-0.2.3 を登録;sglang アプリケーションイメージに enflame-tops の2行を含む;base / runtime 行はポータル再ビルドに伴い更新。

3.7 清微智能:AICC2026 議題とランタイム行(09-22)

日付:2026-09-22 情報源:AICC 公式サイト議題、Release Info ポータル

  • AICC2026 議題:清微智能ソフトウェア副総裁の李彬氏が「3D チップ、オープンソースの新章:Open3D-PIMC が計算力ソフトウェア基盤を再構築」と題して報告——リコンフィギュラブルコンピューティングベンダーのオープンソフトウェアスタック側での公開アクション。
  • イメージ行:tsingmicro-tsm260610 の base / runtime 行はポータル再ビルドに伴い更新;vllm-plugin-FL 0.3.0-rc2 ブランチに tsingmicro txda の 0.24.0 適配を含む(従前バックグラウンドでマージ済み、バージョンブランチの収束に伴い確定)。

3.8 達摩院玄鉄:真武 V900 と PPU CI の収束(09-22/09-23)

日付:2026-09-22 ~ 2026-09-23 情報源:FlagTree #1259、Torch-FL #370、観点網

  • ハードウェア側:真武 V900(PPU 新世代)が発表、2027 Q1 量産(詳細は 2.2)。
  • ソフトウェア側:FlagTree PPU CI に pid.txt 検証を追加(#1259、09-23 10:05 マージ)——PPU コンパイル経路の CI 完全性を収束;Torch-FL は PPU パス下の CPU torch wheel の CUDA メタデータを復元(#370)。

4. まとめとトレンド観察

  • 2.2 GA 前最後の一週間に入り、リリース物が「見える化」し始める:公式リリースリストの最初の項目がリポジトリに登録(sglang-plugin-fl v0.2.0)、Release Info ポータルが同日再構築、Megatron アプリケーションイメージ 2.2.0-0.2.3 が 14 行をカバー。rc2 安定期間は 09-24 締切、GA は 09-28 に確定——向こう一週間の観察ポイントは、リストの逐次補完と各コンポーネントの rc2/post タグの収束順序。
  • 配布形態はさらに拡大を継続:FlagCX wheel が試験行から全行へ拡大 + 昆仑芯の落地、deb/rpm が各パッケージコンポーネントをカバー、FlagTree Iluvatar wheel を再構築——FEP-0019(統一パッケージ統合)の Wave 1 検収ラインと一致し、「イメージ以外」のネイティブパッケージ経路が 2.2 の標準デリバリー面となる。
  • 量子スタックは本日の単一リポジトリ処理量最多:FlagQuantum 38 件が同時にクラウドバックエンド(Azure Quantum / Braket / CUDA-Q / Cirq の四系統相互接続)、シミュレーション融合加速、候補検証ゲートを推進——「追随コンポーネント」からフレームワーク的開発リズムへと移行。
  • 三リポジトリが同時に修正・チューニングのリズムへ:FlagGems(15 枚の KernelGen + 六プラットフォーム修正)、FlagGems-vllm(三条が審査中からマージへ)、Torch-FL(11 件のエンジニアリング収束、グローバルパッチ除去と退役コードを含む)——機能凍結後の「検収、修正、チューニング」ウィンドウ形態はスケジュールと一致。
  • 対外情報面は会議シーズンが担当:コンポーネント級検索は第十八の静穏ウィンドウ vs AICC2026 での FlagOS 講演二件と「信頼できる AI」始動、雲栖での真武 V900 発表、龍芯のフルスタック GPU ソフトウェアプラットフォーム——産業側の「統一ソフトウェアスタック / 多元算力」への関心が会議シーズンに集中して放出され、コード側の収束と相互に裏付け合っている。
  • 要観察:2.2 リストの後続項目(FlagTree 0.7.0+triton3.6、vllm-plugin-FL 0.3.0、FlagScale 2.1.0 などのバージョンブランチは既に推進中);PPU 新ハードウェアのソフトウェア適配フォロー(V900 量産は 2027 Q1);FlagSparse / FlagAttention パッケージライン(FEP-0019 Wave 1)の GA 前の落地。

付録:情報源検証表

類別 情報源 検証方式 結果
GitHub org: flagos-ai repos API 54 リポジトリの pushed_at 全量検証 24 リポジトリがウィンドウ内で活発
GitHub コミット検索 + リポジトリ別照合 ウィンドウ内を逐条検証 143 件(14 リポジトリ)+ ブランチ側プッシュ(release-info / FlagScale / vllm-plugin-FL / FlagTree / docs)
GitHub releases リポジトリ別スキャン 13 リポジトリの releases API ウィンドウ内に新規 release なし(2.2 はリスト / イメージ登録 / ポータルリリースで進行)
リリースエンジニアリング community リスト + Release Info ポータル + build-infra 原文取得し逐ページ照合 release-2.2.yaml 最初の項目;ポータル 20 プラットフォーム行再構築;Megatron イメージ 2.2.0-0.2.3 が 14 行をカバー
ニュース Google News RSS(中英語 24 組のクエリ語、プロキシ経由) 24 時間ウィンドウフィルタ + 逐条除外 コンポーネント語ゼロヒット(第十八の静穏ウィンドウ);エコシステム側は AICC2026 / 雲栖 / 龍芯などの項目を保持
メディア 光明網 / 新京報 / CBISMB / 観点網 / 毎日経済新聞 / 東方財富 / IT之家 原文取得し再確認 AICC2026、真武 V900、龍芯プラットフォーム
コミュニティ HN Algolia / 智源コミュニティ 検索再確認 FlagOS 関連の新稿なし
プロジェクトドキュメント community // schedule.md、flagos-ai.github.io/release-info 原文取得 2.2 スケジュール(rc2 は 09-24 まで、GA 09-28)とイメージマトリクスを照合

完全情報源リスト

ai/Torch-FL/pull/372> · #370 — https://github.com/flagos-ai/Torch-FL/pull/370