Окно мониторинга: 2026-09-22 10:00 ~ 2026-09-23 10:00 (около 24 часов; продолжение окна ежедневного отчёта за 09-22, без пропусков) Источники: GitHub (org: flagos-ai, полная проверка pushed_at по 54 репозиториям, в окне было push в 24 репозиториях; поиск по коммитам дал 143 совпадения в 14 репозиториях; постраничная сверка портала Release Info и списка community), Google News RSS (24 группы поисковых запросов на китайском и английском, через прокси), официальный сайт и репортажи конференции AICC2026 (Guangming Online / The Beijing News / CBISMB), репортажи конференции Yunqi 2026 (Guandian / National Business Daily / East Money / Alibaba Cloud Developer Community), релизы Loongson Technology (ITHome / Fast Technology) и др. (подробный список источников см. в приложении)


Индекс текущего выпуска

  • Главное за сегодня: до 2.2 GA (09-28) 5 дней — список релиза зафиксирован в репозитории, портал Release Info пересобран, образ приложения Megatron 2.2.0-0.2.3 покрывает 14 строк бэкендов (09-22/09-23)
      1. Прогресс открытых проектов (динамика GitHub)
    • 1.1 Дополнение по релизной инженерии: канал FlagCX wheel продвинулся до Kunlunxin и всех строк, deb/rpm покрывают каждый упаковываемый компонент (09-22/09-23)
    • 1.2 FlagQuantum: 38 коммитов за одно окно — облачный каркас QPU, взаимодействие трёх основных фреймворков, ускорение слияния симуляции (09-22)
    • 1.3 FlagGems: KernelGen добавил ещё 15 операторов Nvidia; плотные слияния исправлений и оптимизаций по шести платформам (09-22/09-23)
    • 1.4 FlagGems-vllm: новый оператор для Ascend XCS слит; переход в слитое состояние трёх проверяемых веток Moore Threads / Hygon / MetaX (09-22/09-23)
    • 1.5 Torch-FL: 11 коммитов сошлись — исправления DCU и Ascend, унификация матрицы сборки, очистка выведенного из эксплуатации кода (09-22/09-23)
    • 1.6 Прочая динамика: усиление транспорта FlagCX, продвижение трёх бэкендов FlagSparse, бэкенд NPU TransformerEngine-FL, FlagTree PPU CI (09-22/09-23)
    1. Новости и экосистема
      • 2.1 AICC2026 прошла в Пекине: два доклада FlagOS и запуск системы оценки «надёжный AI» (09-21/09-22)
      • 2.2 Конференция Yunqi: Damo Academy XuanTie представила Zhenwu V900 — платформа поддержки FlagOS PPU получила новое поколение аппаратного обеспечения (09-22)
      • 2.3 Динамика отечественного программного стека вычислений: выпущена первая версия платформы ускоренных вычислений Loongson; сегодня открывается Global Digital Trade Expo (09-22/09-23)
      • 2.4 Восемнадцатое подряд спокойное окно при компонентном поиске (09-22/09-23)
    1. Углублённое изучение организаций-участников
      • 3.1 Hygon: исправление границ индекса DCU и слияние блочного BMM INT8 (09-22/09-23)
      • 3.2 Moore Threads: слияние поддержки квантизации W8A8 для внимания с переменной длиной; доклад на AICC2026 и участие в «надёжном AI» (09-22)
      • 3.3 MetaX: слияние оператора квантованного обратного RoPE; оптимизация topk W8A16 и стратегия MACA FFT по умолчанию (09-22)
      • 3.4 Ascend: обновление пакета операторов и тестового образа; реализация бэкенда NPU TransformerEngine-FL (09-22/09-23)
      • 3.5 Iluvatar CoreX: линия пересборки Iluvatar wheel 22.04 и регистрация строки контейнеров (09-22/09-23)
      • 3.6 Enflame: регистрация образов нескольких строк и строка приложения sglang (09-22/09-23)
      • 3.7 Tsingmicro: повестка AICC2026 и строка runtime (09-22)
      • 3.8 Damo Academy XuanTie: Zhenwu V900 и завершение PPU CI (09-22/09-23)
    1. Итоги и наблюдения за тенденциями
  • Приложение: таблица проверки источников
  • Полный список источников

Главное за сегодня: до 2.2 GA (09-28) 5 дней — список релиза зафиксирован в репозитории, портал Release Info пересобран, образ приложения Megatron покрывает 14 строк бэкендов

Дата: 2026-09-22 ~ 2026-09-23 Источник: community #111, release-2.2.yaml, портал Release Info, build-infra #1019–#1034

Согласно официальному графику сообщества отслеживание релиза 2.2 (#47), период стабилизации rc2 завершается 09-24 (после этого принимаются только hotfix), решение GA Go/No-Go назначено на 09-28. Текущее окно приходится как раз на период завершения, и релизная инженерия продвигается по трём линиям за день:

Во-первых, список официальных релизов начинает попадать в репозиторий. 09-23 00:11 влит community #111: добавлен release/2.2/release-2.2.yaml — это официальный исходный список релиза FlagOS 2.2 (формат vcstool, предназначенный для vcs import для однократного извлечения исходников всех компонентов). Первой записью списка является sglang-plugin-fl v0.2.0 (официальный тег проставлен на коммите этого модуля, прошедшем финальную проверку rc2, ветка 0.2.0-rc2, HEAD 1c84db7). В заголовке файла указана спецификация версий: официальные теги всегда используют чистый номер версии (без суффиксов rc/post), исключение — FlagTree, который сохраняет локальный формат версии апстрима (например, 0.7.0+triton3.6); структурно файл организован по уровням, таким как “уровень адаптации фреймворка” L2, а последующие компоненты будут добавляться партиями.

Во-вторых, регистрация образов приложений продвинулась до 14 строк бэкендов. Среди 33 коммитов build-infra в этом окне тег образа приложения Megatron-LM-FL 2.2.0-0.2.3 централизованно зарегистрирован в 14 строках платформ (nvidia-cuda12.8 / cuda13.3, ascend-cann8.5.0 / cann9.0.0, cambricon-neuware4.4.3 / 4.7.2, enflame-tops1.9.10 / 1.10.6, hygon-dtk26.04, iluvatar-corex4.4.0 / 4.5.0, metax-maca3.8.1.3, mthreads-musa4.3.6 / 5.2.0, соответствующие #1019–#1033); в дополнение внесены две правки: шаги сборки напрямую читают зафиксированную версию wheel (#1018), точная фиксация устанавливаемой версии и дополнение двух несобранных строк (#1017). Тогда же зарегистрирован образ приложения vLLM для Kunlunxin 2.2.0-0.3.0rc2.post2 (#1012 / #1013, с сопутствующей авторизованной пересборкой #1010).

В-третьих, портал Release Info пересобран. 09-23 06:38 ~ 06:44 в репозитории информации о релизах ветка gh-pages получила 13 последовательных пушей с пересборкой портала Hugo (flagos-ai.github.io/release-info). Портал организован по четырём уровням “вендор / базовый образ (base) / runtime-образ (runtime) / образ приложения (application)” и охватывает base- и runtime-образы 20 строк платформ, а также образы приложений vLLM (две матрицы 0.20.2 / 0.24.0), Megatron (training / rl), sglang 0.5.18; на примере страницы строки nvidia-cuda12.8 для Megatron уже видны полные инструкции по извлечению harbor.baai.ac.cn/flagos-app/megatron_training0.17.1-nvidia-cuda12.8:2.2.0-0.2.3 и flagos-runtime-nvidia-cuda12.8:2.2.0. Регистрация образов, публикация портала и попадание списка в репозиторий — эти три линии впервые синхронизировались в один день в рамках текущего окна, и релизные артефакты 2.2 начали становиться публично видимыми.

Параллельно продвигаются ветки версий: FlagTree 0.7.0-rc2-triton3.6 (пуш 09-23 09:36), vllm-plugin-FL 0.3.0-rc2 (09-22 23:20, #549), FlagScale 2.1.0-rc2 (09-23 08:43, #1301 cherry-pick из main), sglang-plugin-FL 0.2.0-rc2 (v0.2.0 уже помечен тегом).


1. Прогресс открытых проектов (динамика GitHub)

Обзор окна: из 54 репозиториев организации 24 имели пуши в окне; поиск по коммитам дал 143 совпадения (по 14 репозиториям), кроме того пуши по веткам в release-info (gh-pages), FlagScale, vllm-plugin-FL, FlagTree, docs, sglang-plugin-FL и др. не учтены в поиске. Распределение: FlagQuantum 38, build-infra 33, FlagGems 28, Torch-FL 11, FlagSparse 10, FlagGems-vllm 6, FlagFFT 4, FlagCX 3, FlagTree 2, FlagAttention 2, FlagBLAS 2, whisper-triton 2, community 1, FlagGems-Experimental 1.

Форма текущего окна = “закрытие релиза 2.2” + “взрыв квантового стека” + “плотные исправления для множества платформ”: инженерия релиза подробно описана в “Ключевом за сегодня”; FlagQuantum с 38 коммитами стал самым активным отдельным репозиторием; FlagGems / FlagGems-vllm / Torch-FL одновременно вошли в ритм “исправление + оптимизация”.

1.1 Дополнение по инженерии релиза: канал wheel для FlagCX продвинулся до Kunlunxin и всех строк, deb/rpm охватывают каждый упаковываемый компонент (09-22/09-23)

Дата: 2026-09-22 ~ 2026-09-23 Источники: build-infra #1000, #1002, #1007, #1008, #1014

  • Линия распространения FlagCX wheel: wheel для Kunlunxin доведён до готовности (#1000, продолжение пункта «на рассмотрении» из вчерашнего отчёта); канал wheel открыт во всех остальных восьми линейках (#1002); pin для каждой линейки автоматически выводится из ref (#1007), каждая выдача обязана сопровождаться wheel ref (#1006), по каждой линейке ведётся запись опубликованных pin и документа «связь wheel и torch» (#1005 / #1016); публикующий контейнер наследует прокси узла (#1015). Форма распространения предварительно скомпилированных wheel для каждого бэкенда расширена с «пилотной линейки» до «всех линеек + закрепления в конвейере».
  • Покрытие нативных пакетов: каждый упаковываемый компонент получает путь в репозиторий (#1001), покрытие deb и rpm дополнено (#1008) — согласуется с критериями приёмки FEP-0019 (унифицированная интеграция упаковки, Wave 1 уже включает слияние четырёх репозиториев FlagCX / FlagTree / FlagSparse / FlagAttention).
  • FlagTree Iluvatar wheel пересобран на Ubuntu 22.04 и опубликован сборщик (#1014, линейка Iluvatar CoreX).
  • Также две правки документации: отозвано утверждение о загрязнении ConfigCache flag_gems между компиляторами (#1034), отменено обоснование понижения версии flagtree для metax (#1020).

1.2 FlagQuantum: 38 коммитов в одном окне — облачный каркас QPU, совместимость трёх основных фреймворков, ускорение за счёт слияния симуляции (09-22)

Дата: 2026-09-22 Источники: FlagQuantum #135, #154, #138, #168, #167

FlagQuantum (квантовый AI-фреймворк с приоритетом PyTorch в экосистеме FlagOS) — 38 коммитов в одном окне, четыре линии параллельно:

  • Облачное исполнение QPU: добавлен каркас исполнения Azure Quantum QPU (#168) — ещё одна облачная линия бэкендов после Braket / CUDA-Q в прошлом месяце.
  • Межфреймворковая совместимость: реализация адаптера схем Amazon Braket (#154, сопутствующий контракт #147), конвертация схем Cirq (#135) и контракт символьных параметров (#166 / #170), экспорт ядер CUDA-Q (#138, исправлена валидация IR конечных углов #145), отслеживание разрывов в возможностях между фреймворками (#164), аттестационные тесты семантики схем между фреймворками (#160).
  • Производительность симуляции: ускорение вентилей вектора состояний на CPU (#142), ускорение хвостовых двухбитных вентилей (#143), слияние диагональных областей между линиями (#146), слияние двулинейных диагональных совпадений (#153), слияние слоёв однолинейных вентилей (#157 / #159 / #165), слияние областей смешанной ширины (#169), а также опционально включаемый векторизованный сэмплер траекторных строк (#132) и разложение по путям CPU-полосы + бенчмарк сети дифференциальных ядер (#128).
  • Линия валидации (regional twin): проверка набора схем (#123), валидация на отложенном множестве (#141), персистентность истории и оценок (#137 / #144 / #152 / #163), выравнивание дрейфа (#155), гейтирование по доказательствам отложенного множества (#162), публикация прошедших валидацию кандидатов (#167).
  • CI: переиспользование runner между опциональными версиями SDK (#158), полоса покрытия braket (#161), распараллеливание CPU-тестов (#149), устранение дублирования наборов (#150 / #156), устранение узких мест очереди (#148).

1.3 FlagGems: KernelGen добавляет ещё 15 операторов Nvidia; плотное слияние исправлений и оптимизаций для шести платформ (09-22/09-23)

Дата: 2026-09-22 ~ 2026-09-23 Источники: FlagGems #5245, #5845, #6531, #6339, #5063

  • KernelGen (Nvidia) 15 шт.:orgqr (#5845)、trapz (#5927)、matrix_power (#5735)、matmul_backward (#5639)、_pad_packed_sequence (#5245)、_scaled_dot_product_attention_math_for_mps (#5259)、_nested_tensor_softmax_with_shape (#5693)、_nested_tensor_from_mask (#5691)、_sample_dirichlet (#5946)、_ctc_loss (#5489)、_batch_norm_with_update (#5828)、_cudnn_rnn (#5823)、_transform_bias_rescale_qkv (#6141)、_spdiags (#6102)、vander (#5945) — конвейер автоматической генерации продолжает массово пополнять длиннохвостые операторы.
  • Линия качества NVIDIA: восстановлена нативная FP8 WGMMA для scaled MM (#6531).
  • Hygon: исправлена проблема index_reduce_ на трёх платформах — Ascend / Iluvatar / MetaX (#5063, вклад SiliconFlow).
  • MetaX: принят и оптимизирован оператор topk_w8a16_fp8 (#6339).
  • Ascend: улучшены диспетчеризация и реализация cat/concat (#6548), реализация rrelu_with_noise (#6534, линия KMCompiler), бенчмарк nonzero_static переведён на режим оператора (#6571), обновлён образ еженедельного тестирования 910B (#6590).
  • Квантование и общее: динамическое матричное умножение W4A8 и проверка переносимой 4-битной упаковки (#6494), принят block diag (#6555), исправлена маска конечных значений для отрицательных порядков vector_norm (#5883).

1.4 FlagGems-vllm: принят новый оператор Ascend XCS; три линии Moore Threads / Hygon / MetaX переведены из ревью в принятие (09-22/09-23)

Дата: 2026-09-22 ~ 2026-09-23 Источники: FlagGems-vllm #817, #823, #803, #826

  • Ascend XCS: принят Triton-оператор сжатия состояния KV-пула (kpool) (#817, 09-23 09:22), что продолжает ритм продвижения пакета операторов XCS.
  • Три линии из ревью в принятие: переменная длина внимания W8A8 FP8 от Moore Threads (#823), блочное BMM INT8 и свёртка INT8 einsum от Hygon (#803), объединённое обратное RoPE с квантованием FP8 от MetaX (#826) — все три ранее были пунктами «пула ревью» в предыдущих ежедневных отчётах и в этом окне централизованно доведены до принятия.
  • Инженерные исправления: гейтирование пути TLE по требуемым возможностям (#833), тестовые зависимости больше не обновляют существующий numpy (#832).

1.5 Torch-FL: 11 сходимостей — исправления DCU и Ascend, унификация матрицы сборки, очистка выведенного из эксплуатации кода (09-22/09-23)

Дата: 2026-09-22 ~ 2026-09-23 Источники: Torch-FL #395, #393, #392, #387, #372

Слой адаптации PyTorch (Torch-FL / PyTorch-Plugin-FL) — 11 коммитов в этом окне, инженерные работы сосредоточены на закрытии:

  • Исправление устройств: значения индексов выхода за границы на DCU теперь отклоняются напрямую (#395), ядро Ascend переведено на выполнение на устройстве, где находятся операнды (#392), PPU восстанавливает CUDA-метаданные в CPU torch wheel (#370), внимание SDPA сохраняет граф autograd в режиме диспетчеризации (#390).
  • Сборка и конфигурация: матрица платформ / сборок сведена в единую таблицу (#387), нераспознанный или необнаруженный GEMS_VENDOR приводит к прямой ошибке (#388), добавлена конфигурация ruff и удалены black/isort (#386), гейт codegen --check и тест согласованности регистрации (#382).
  • Очистка и производительность: удалён глобальный патч Tensor.__getitem__ (#372), выведен устаревший код, включая нативное дерево MetaX (#393), полностью действующие маски подсказок qwen-image теперь опускаются (#371).

1.6 Прочие обновления: усиление транспорта FlagCX, продвижение трёх бэкендов FlagSparse, бэкенд NPU TransformerEngine-FL, FlagTree PPU CI (22.09/23.09)

Дата: 2026-09-22 ~ 2026-09-23 Источники: FlagCX #594, TransformerEngine-FL #113, FlagTree #1259, FlagSparse #80

  • FlagCX: усиление гетерогенного транспорта и выравнивание CI ускорителей (#594), расширение p2p engine rpc serve и обновление транспорта barex (#611), упаковка выполняется только при изменениях упаковки (#616).
  • FlagSparse: ветка сотрудничества NCIC-AlphaSparse объединила две партии (#79 / #80) — оптимизация DCU SpMM COO, результаты MACA SpMM, CI и вывод для Ascend, тесты MTX включены в CI.
  • TransformerEngine-FL: добавлена реализация LayerNorm для бэкенда NPU (#114) и реализация многотензорного Adam для бэкенда NPU (#113).
  • Megatron-LM-FL: стабилизация совместимости вендорных бэкендов и интеграция с CI (#174).
  • FlagTree: в PPU CI основной ветки добавлена проверка pid.txt (#1259, смёржено 23.09 в 10:05), в переиспользуемый рабочий процесс GEMS добавлено обнаружение изменений CORE (#1265), обновлена документация новых встроенных функций (#1120).
  • FlagAttention: обновления тестов и бенчмарков (#69), в pytest добавлены --record / --output (#70).
  • FlagBLAS: смёржена оптимизация производительности Ascend L2 (#123 — SPR / SPR2 / HPR / HPR2), линия упаковки для внешних контрибьюторов (#1, выравнивание версии с линией релиза 0.3.0).
  • FlagFFT: стратегия измерения MACA «1d single» переведена в статус по умолчанию, дополнена документация по окружению HCU / Ascend CANN9.
  • FlagGems-Experimental: в KernelGen добавлен оператор dim (#702).
  • whisper-triton: синхронизирована базовая линия патчей Codeup от Keda Xunfei (#6).

2. Новости и экосистема

2.1 AICC2026 состоялась в Пекине: два доклада FlagOS и запуск системы оценки «надёжного ИИ» (21.09/22.09)

Дата: 2026-09-21 (период конференции) / 2026-09-22 (централизованный выход публикаций) Источники: Guangming Online, The Beijing News, CBISMB, программа на сайте AICC

7-я конференция по искусственному интеллекту и вычислениям (AICC2026) прошла 21 сентября в Пекинском международном инновационном центре Чжунгуаньцунь, а с 22 сентября началось её активное освещение в прессе. Два пункта, непосредственно связанных с FlagOS: в 09:50 на главном форуме заместитель директора и главный инженер Пекинской академии искусственного интеллекта Zhiyuan (BAAI) Линь Юнхуа выступила с докладом «От архитектурных инноваций к доступным вычислительным мощностям: новая парадигма программно-аппаратной синергии FlagOS для AI-вычислений», отметив, что «AI-нагрузки не сойдутся к единому виду, и вычислительная архитектура не останется единственной; чтобы аппаратные инновации превратились в доступные вычислительные мощности, необходима поддержка общей программной экосистемы — Zhongzhi FlagOS через унифицированный компилятор, операторы, коммуникации и фреймворки обучения и вывода снижает затраты на повторную адаптацию разнородных чипов»; кроме того, согласно программе конференции, исследователь BAAI Чжао Шуай выступил на тематическом форуме с докладом «Zhongzhi FlagOS: раскрытие ценности разнородных AI-вычислительных мощностей через открытый программный стек». На конференции одновременно состоялась церемония запуска рабочей группы по оценке «Надёжный AI» (Пятый институт электроники Министерства промышленности и информатизации, 10:10), а в блоке отраслевых достижений была официально представлена система оценки «Надёжный AI» для эпохи агентов — совместно представленная Пятым институтом электроники Министерства промышленности и информатизации вместе с Пекинской академией искусственного интеллекта BAAI, Inspur Information, Moore Threads, MetaX, Пекинской академией открытых чипов, Baidu Smart Cloud, Alibaba Cloud и более чем 20 организациями цепочки отрасли, охватывающая все звенья — чипы, готовые системы и межсоединения, фреймворки и системы, модели, данные, приложения — и проводящая сквозную оценку по измерениям надёжности, безопасности и стабильности. Одновременно IDC и Inspur Information совместно опубликовали «Отчёт об оценке развития вычислительных мощностей для искусственного интеллекта в Китае за 2026 год»: ожидается, что в 2026 году объём интеллектуальных вычислительных мощностей в Китае достигнет 2576,5 EFLOPS, увеличившись на 87,9% год к году. Плотность организаций-участников в программе (Moore Threads, Tsingmicro, две сессии BAAI FlagOS) показывает, что данный стек уже стал постоянной темой открытой вычислительной экосистемы страны.

2.2 Конференция Yunqi: Damo Academy XuanTie представила Zhenwu V900 — платформа PPU, поддерживаемая FlagOS, получила новое поколение аппаратного обеспечения (22.09)

Дата: 2026-09-22 Источники: Guandian, National Business Daily, East Money, Сообщество разработчиков Alibaba Cloud

На конференции Yunqi 2026 (22.09, Ханчжоу) подразделение Alibaba Damo Academy XuanTie (T-Head) представило новое поколение AI-чипа для обучения и вывода Zhenwu V900: 216 ГБ видеопамяти, пропускная способность межчиповых соединений 1200 ГБ/с, нативная поддержка низкоточной точности FP8 / FP4, производительность одного чипа в 3 раза выше предыдущего поколения Zhenwu M890, серийное производство — в первом квартале 2027 года; на конференции также анонсированы следующее поколение Zhenwu J900 (март 2028) и два поколения серверных CPU Yitian 720 / 730 (2027), а также раскрыто, что суперузел Zhenwu V900 обладает способностью унифицированной адресации памяти и может образовывать полносвязную сеть на тысячу карт с полной пропускной способностью. Серия Zhenwu — это собственный PPU (Parallel Processing Unit) Alibaba, а PPU уже является одной из поддерживаемых платформ унифицированного плагина и компилятора FlagOS (операторы FlagGems-vllm PPU, FlagTree PPU CI, архитектура FlagDNN PPU) — выпуск нового поколения аппаратного обеспечения означает, что у бэкенда PPU данного стека появилась чёткая цель поколенческого обновления.

2.3 Динамика отечественных вычислительных программных стеков: выпущена первая версия платформы ускоренных вычислений Loongson; сегодня открывается выставка цифровой торговли (22.09/23.09)

Дата: 2026-09-22 ~ 2026-09-23 Источники: IT Home, MyDrivers, Обзор зоны AI выставки цифровой торговли

  • Loongson Technology 22.09 выпустила первую программную версию «Платформы ускоренных вычислений Loongson»: на базе интегрированного в Loongson 2K3000 / 9A1000 универсального GPU серии LG200, охватывает драйверы, компилятор, среду выполнения, библиотеку операторов (BLAS / DNN), движок вывода, инструменты отладки и анализа производительности, поддерживает две модели программирования — OpenCL 3.0 и CUDA, позволяет с низкими затратами переносить CUDA-приложения, а также запланирована поколенческая программная совместимость по мере развития 9A2000 / 9A3000. Ещё один пример «полностековой программной платформы» отечественных вычислительных мощностей, служащий взаимным ориентиром для подхода данного стека «единый программный стек снижает затраты на адаптацию».
  • 5-я Глобальная выставка цифровой торговли открывается 23.09 в Ханчжоу (до 27.09): впервые учреждён раздел экосистемы применения интегральных схем «Цифровая торговля · сценарии чипов», предприятия, включая MetaX, вошли в совместную экспозицию «чипы + материалы + вычислительные мощности»; вычислительные компании представлены 117 участниками. Отраслевая видимость организаций-участников подхватывается сезоном конференций.

2.4 Восемнадцатое подряд спокойное окно компонентного поиска (22.09/23.09)

Дата: 2026-09-22 ~ 2026-09-23 Источники: Google News RSS (24 группы поисковых запросов на китайском и английском, через прокси)

Поиск по названиям компонентов FlagOS / FlagGems / FlagScale / FlagTree / FlagPerf / FlagCX / KernelGen на китайском и английском языках (when:7d и when:14d): совпадения на уровне компонентов в 24-часовом окне — ноль, что образует восемнадцатое подряд спокойное окно (предыдущее окно — семнадцатое). Это контрастирует с выставочно-конференционной стороной: информационное поле этого окна формируется динамикой участников и экосистемы на AICC2026 и конференции Yunqi (см. 2.1—2.3). HN Algolia по словам FlagOS / FlagGems и др. релевантных совпадений не дал; в сообществе Zhiyuan новых публикаций, связанных с FlagOS, не обнаружено.

3. Углублённый анализ участников

3.1 Hygon: исправление границ индексов DCU и слияние блочного BMM INT8 (09-22/09-23)

Дата: 2026-09-22 ~ 2026-09-23 Источники: Torch-FL #395, FlagGems-vllm #803

  • Torch-FL #395: выход за границы значений индексов на DCU теперь отклоняется напрямую (предотвращение тихих ошибочных результатов).
  • FlagGems-vllm #803 (из рассмотрения переведён в слитый): ядро блочного BMM INT8 и свёртка INT8 einsum (bhr,hdr→bhd) — дополнение реализации Hygon для низкоточной матрицы умножения на стороне инференса.
  • Строки зеркал: megatron_training-hygon-dtk26.04 зарегистрирован 2.2.0-0.2.3; runtime hygon-dtk26.04 уже опубликован на портале.

3.2 Moore Threads: слияние поддержки квантизации W8A8 для переменной длины внимания; доклад на AICC2026 и участие в «надёжном AI» (09-22)

Дата: 2026-09-22 Источники: FlagGems-vllm #823, программа AICC, CBISMB

  • FlagGems-vllm #823 (из рассмотрения переведён в слитый): поддержка W8A8 FP8 для внимания переменной длины (varlen) — путь квантизации для платформы MUSA проложен.
  • AICC2026: заместитель генерального директора департамента решений Moore Threads Жэнь Яньпин выступила на тематическом форуме; компания также участвовала в качестве соучредителя системы оценки «надёжный AI».
  • Строки зеркал: megatron_training-mthreads-musa4.3.6 / musa5.2.0 — обе строки зарегистрированы 2.2.0-0.2.3.

3.3 MetaX: слияние слитного обратного RoPE оператора квантизации; оптимизация topk W8A16 и стратегия MACA FFT по умолчанию (09-22)

Дата: 2026-09-22 Источники: FlagGems-vllm #826, FlagGems #6339, коммиты FlagFFT

  • FlagGems-vllm #826 (из рассмотрения переведён в слитый): добавлен и оптимизирован слитный обратный RoPE с оператором квантизации FP8 для реализации MetaX.
  • FlagGems #6339: добавлен и оптимизирован оператор topk_w8a16_fp8 (metaX).
  • FlagFFT: стратегия измерения MACA «1d single» переведена в статус по умолчанию (настройка параметров на основе измерений переведена из экспериментальной в постоянную).
  • Torch-FL #393: вывод из эксплуатации устаревшего кода, включая нативное дерево MetaX — слой адаптации сходится к плагинной архитектуре.
  • Строки зеркал: megatron_training-metax-maca3.8.1.3 зарегистрирован 2.2.0-0.2.3.

3.4 Ascend: обновление пакета операторов и тестовых зеркал; реализация бэкенда NPU для TransformerEngine-FL (09-22/09-23)

Дата: 2026-09-22 ~ 2026-09-23 Источники: FlagGems #6548, #6590, FlagGems-vllm #817, TransformerEngine-FL #113

  • FlagGems: улучшения диспетчеризации и реализации cat/concat (#6548), rrelu_with_noise (#6534), исправление бенчмарка nonzero_static (#6571), обновление образа еженедельного тестирования 910B (#6590).
  • FlagGems-vllm #817: в линейке XCS добавлен оператор сжатия состояния KV-пула (kpool) (влито утром 09-23).
  • TransformerEngine-FL #113 / #114: реализации NPU-бэкенда для многотензорного Adam и LayerNorm — дополнение бэкенда Ascend для фреймворка на стороне обучения.
  • Torch-FL #392: ядра Ascend переведены на выполнение на устройстве, где находятся операнды, исправлена кросс-девайсная диспетчеризация.
  • Строки образов: ascend-cann8.5.0 / cann9.0.0 и варианты 910c — регистрация нескольких строк и публикация на портале.

3.5 Iluvatar CoreX: линия пересборки Iluvatar wheel 22.04 и регистрация строк контейнеров (09-22/09-23)

Дата: 2026-09-22 ~ 2026-09-23 Источники: build-infra #1014, портал Release Info

  • build-infra #1014: Iluvatar wheel пересобран на Ubuntu 22.04, опубликован образ его сборщика — линия распространения wheel дополнена строкой Iluvatar.
  • Строки образов: строки iluvatar-corex4.4.0 / corex4.5.0 регистрируют образ megatron 2.2.0-0.2.3; строки base / runtime опубликованы на портале.
  • FlagGems #5063 исправляет реализацию index_reduce_ на платформе Iluvatar (вклад SiliconFlow).

3.6 Enflame: регистрация нескольких строк образов и строка приложения sglang (09-22/09-23)

Дата: 2026-09-22 ~ 2026-09-23 Источники: портал Release Info

  • Регистрация образов: строки megatron_training-enflame-tops1.9.10 / tops1.10.6 регистрируют 2.2.0-0.2.3; образ приложения sglang включает две строки enflame-tops; строки base / runtime обновлены вместе с пересборкой портала.

3.7 Tsingmicro: программа AICC2026 и строки runtime (09-22)

Дата: 2026-09-22 Источники: программа на сайте AICC, портал Release Info

  • Программа AICC2026: вице-президент Tsingmicro по программному обеспечению Ли Бинь представит доклад «3D-чипы, новая глава open source: Open3D-PIMC реконструирует программную основу вычислительной мощности» — публичное действие производителя реконфигурируемых вычислений на стороне открытого программного стека.
  • Строки образов: строки base / runtime для tsingmicro-tsm260610 обновлены вместе с пересборкой портала; ветка vllm-plugin-FL 0.3.0-rc2 содержит адаптацию tsingmicro txda 0.24.0 (ранее влито в фоне, закрыто вместе с веткой релиза).

3.8 XuanTie лаборатории DAMO: Zhenwu V900 и закрытие PPU CI (09-22/09-23)

Дата: 2026-09-22 ~ 2026-09-23 Источники: FlagTree #1259, Torch-FL #370, Guandian

  • Аппаратная сторона: выпущен Zhenwu V900 (новое поколение PPU), массовое производство в Q1 2027 (подробнее в 2.2).
  • Программная сторона: в PPU CI FlagTree добавлена проверка pid.txt (#1259, влито 09-23 10:05) — завершение обеспечения целостности CI цепочки компиляции PPU; Torch-FL восстановил CUDA-метаданные CPU torch wheel на пути PPU (#370).

4. Итоги и наблюдения за тенденциями

  • 2.2 Последняя неделя перед выходом в GA: релизные артефакты становятся «видимыми»: первый пункт официального релизного списка попал в репозиторий (sglang-plugin-fl v0.2.0), портал Release Info в тот же день пересобран, образ приложения Megatron 2.2.0-0.2.3 покрывает 14 строк. Период стабилизации rc2 завершается 09-24, GA назначен на 09-28 — в течение следующей недели точки наблюдения: поэтапное пополнение списка и порядок закрытия тегов rc2/post по компонентам.
  • Формы дистрибуции продолжают расширяться: FlagCX wheel расширен с пилотной строки на все строки + внедрение Kunlunxin, deb/rpm покрывают каждый упаковываемый компонент, FlagTree Iluvatar wheel пересобран — это совпадает с критериями приёмки Wave 1 FEP-0019 (унифицированная интеграция упаковки); нативный пакетный канал «вне образов» становится стандартной поверхностью поставки 2.2.
  • Квантовый стек — лидер дня по пропускной способности в одном репозитории: FlagQuantum — 38 коммитов, одновременно продвигаются облачные бэкенды (четырёхсторонняя совместимость Azure Quantum / Braket / CUDA-Q / Cirq), ускорение слияния симуляции и шлюзы проверки кандидатов — от «сопутствующего компонента» к ритму фреймворковой разработки.
  • Три репозитория одновременно вошли в ритм исправлений/настройки: FlagGems (15 KernelGen + исправления для шести платформ), FlagGems-vllm (три на ревью переведены в merged), Torch-FL (11 коммитов инженерного закрытия, включая удаление глобальных патчей и выведенного из эксплуатации кода) — форма окна «приёмка, исправление, настройка» после заморозки функций соответствует графику.
  • Внешний информационный фронт подхвачен сезоном конференций: восемнадцатое спокойное окно по компонентному поиску против двух докладов FlagOS на AICC2026 и запуска «Надёжного AI», релиза Zhenwu V900 на Cloud Summit, полностековой GPU-программной платформы Loongson — внимание промышленной стороны к «унифицированному программному стеку / разнородным вычислительным мощностям» концентрированно высвобождается в сезон конференций и взаимно подтверждается закрытием на стороне кода.
  • К наблюдению: последующие пункты списка 2.2 (FlagTree 0.7.0+triton3.6, vllm-plugin-FL 0.3.0, FlagScale 2.1.0 и другие версионные ветки уже продвигаются); сопровождение программной адаптации нового оборудования PPU (серийное производство V900 в 2027 Q1); выход упаковочных линий FlagSparse / FlagAttention (FEP-0019 Wave 1) перед GA.

Приложение: таблица проверки источников

Категория Источник Способ проверки Результат
GitHub org: flagos-ai repos API Полная проверка pushed_at по 54 репозиториям 24 репозитория активны в окне
GitHub Поиск коммитов + построчная сверка по репозиториям Поэтапная верификация в окне 143 коммита (14 репозиториев) + пуши на стороне веток (release-info / FlagScale / vllm-plugin-FL / FlagTree / docs)
GitHub Построчное сканирование releases по репозиториям releases API по 13 репозиториям Новых release в окне нет (2.2 идёт через список / регистрацию образов / публикацию портала)
Релизная инженерия Список community + портал Release Info + build-infra Постраничная сверка по исходным текстам Первый пункт release-2.2.yaml; пересборка 20 строк платформ портала; образ Megatron 2.2.0-0.2.3 покрывает 14 строк
Новости Google News RSS (24 группы поисковых запросов на китайском и английском, через прокси) Фильтрация по 24-часовому окну + построчное исключение Нулевые совпадения по компонентным словам (18-е спокойное окно); на стороне экосистемы сохранены пункты AICC2026 / Cloud Summit / Loongson и др.
Медиа Guangming Online / The Beijing News / CBISMB / Guandian / National Business Daily / East Money / IT Home Повторная проверка по исходным текстам AICC2026, Zhenwu V900, платформа Loongson
Сообщество HN Algolia / Zhiyuan Community Повторная проверка поиска Нет новых материалов, связанных с FlagOS
Документация проекта community // schedule.md, flagos-ai.github.io/release-info Захват исходных текстов Сверка графика 2.2 (rc2 до 09-24, GA 09-28) и матрицы образов

Полный список источников