Ежедневный отчёт FlagOS (2026-09-23)
Окно мониторинга: 2026-09-22 10:00 ~ 2026-09-23 10:00 (около 24 часов; продолжение окна ежедневного отчёта за 09-22, без пропусков) Источники: GitHub (org: flagos-ai, полная проверка pushed_at по 54 репозиториям, в окне было push в 24 репозиториях; поиск по коммитам дал 143 совпадения в 14 репозиториях; постраничная сверка портала Release Info и списка community), Google News RSS (24 группы поисковых запросов на китайском и английском, через прокси), официальный сайт и репортажи конференции AICC2026 (Guangming Online / The Beijing News / CBISMB), репортажи конференции Yunqi 2026 (Guandian / National Business Daily / East Money / Alibaba Cloud Developer Community), релизы Loongson Technology (ITHome / Fast Technology) и др. (подробный список источников см. в приложении)
Индекс текущего выпуска
- Главное за сегодня: до 2.2 GA (09-28) 5 дней — список релиза зафиксирован в репозитории, портал Release Info пересобран, образ приложения Megatron 2.2.0-0.2.3 покрывает 14 строк бэкендов (09-22/09-23)
-
- Прогресс открытых проектов (динамика GitHub)
- 1.1 Дополнение по релизной инженерии: канал FlagCX wheel продвинулся до Kunlunxin и всех строк, deb/rpm покрывают каждый упаковываемый компонент (09-22/09-23)
- 1.2 FlagQuantum: 38 коммитов за одно окно — облачный каркас QPU, взаимодействие трёх основных фреймворков, ускорение слияния симуляции (09-22)
- 1.3 FlagGems: KernelGen добавил ещё 15 операторов Nvidia; плотные слияния исправлений и оптимизаций по шести платформам (09-22/09-23)
- 1.4 FlagGems-vllm: новый оператор для Ascend XCS слит; переход в слитое состояние трёх проверяемых веток Moore Threads / Hygon / MetaX (09-22/09-23)
- 1.5 Torch-FL: 11 коммитов сошлись — исправления DCU и Ascend, унификация матрицы сборки, очистка выведенного из эксплуатации кода (09-22/09-23)
- 1.6 Прочая динамика: усиление транспорта FlagCX, продвижение трёх бэкендов FlagSparse, бэкенд NPU TransformerEngine-FL, FlagTree PPU CI (09-22/09-23)
-
-
- Новости и экосистема
- 2.1 AICC2026 прошла в Пекине: два доклада FlagOS и запуск системы оценки «надёжный AI» (09-21/09-22)
- 2.2 Конференция Yunqi: Damo Academy XuanTie представила Zhenwu V900 — платформа поддержки FlagOS PPU получила новое поколение аппаратного обеспечения (09-22)
- 2.3 Динамика отечественного программного стека вычислений: выпущена первая версия платформы ускоренных вычислений Loongson; сегодня открывается Global Digital Trade Expo (09-22/09-23)
- 2.4 Восемнадцатое подряд спокойное окно при компонентном поиске (09-22/09-23)
- Новости и экосистема
-
- Углублённое изучение организаций-участников
- 3.1 Hygon: исправление границ индекса DCU и слияние блочного BMM INT8 (09-22/09-23)
- 3.2 Moore Threads: слияние поддержки квантизации W8A8 для внимания с переменной длиной; доклад на AICC2026 и участие в «надёжном AI» (09-22)
- 3.3 MetaX: слияние оператора квантованного обратного RoPE; оптимизация topk W8A16 и стратегия MACA FFT по умолчанию (09-22)
- 3.4 Ascend: обновление пакета операторов и тестового образа; реализация бэкенда NPU TransformerEngine-FL (09-22/09-23)
- 3.5 Iluvatar CoreX: линия пересборки Iluvatar wheel 22.04 и регистрация строки контейнеров (09-22/09-23)
- 3.6 Enflame: регистрация образов нескольких строк и строка приложения sglang (09-22/09-23)
- 3.7 Tsingmicro: повестка AICC2026 и строка runtime (09-22)
- 3.8 Damo Academy XuanTie: Zhenwu V900 и завершение PPU CI (09-22/09-23)
- Углублённое изучение организаций-участников
-
- Итоги и наблюдения за тенденциями
- Приложение: таблица проверки источников
- Полный список источников
Главное за сегодня: до 2.2 GA (09-28) 5 дней — список релиза зафиксирован в репозитории, портал Release Info пересобран, образ приложения Megatron покрывает 14 строк бэкендов
Дата: 2026-09-22 ~ 2026-09-23 Источник: community #111, release-2.2.yaml, портал Release Info, build-infra #1019–#1034
Согласно официальному графику сообщества отслеживание релиза 2.2 (#47), период стабилизации rc2 завершается 09-24 (после этого принимаются только hotfix), решение GA Go/No-Go назначено на 09-28. Текущее окно приходится как раз на период завершения, и релизная инженерия продвигается по трём линиям за день:
Во-первых, список официальных релизов начинает попадать в репозиторий. 09-23 00:11 влит community #111: добавлен release/2.2/release-2.2.yaml — это официальный исходный список релиза FlagOS 2.2 (формат vcstool, предназначенный для vcs import для однократного извлечения исходников всех компонентов). Первой записью списка является sglang-plugin-fl v0.2.0 (официальный тег проставлен на коммите этого модуля, прошедшем финальную проверку rc2, ветка 0.2.0-rc2, HEAD 1c84db7). В заголовке файла указана спецификация версий: официальные теги всегда используют чистый номер версии (без суффиксов rc/post), исключение — FlagTree, который сохраняет локальный формат версии апстрима (например, 0.7.0+triton3.6); структурно файл организован по уровням, таким как “уровень адаптации фреймворка” L2, а последующие компоненты будут добавляться партиями.
Во-вторых, регистрация образов приложений продвинулась до 14 строк бэкендов. Среди 33 коммитов build-infra в этом окне тег образа приложения Megatron-LM-FL 2.2.0-0.2.3 централизованно зарегистрирован в 14 строках платформ (nvidia-cuda12.8 / cuda13.3, ascend-cann8.5.0 / cann9.0.0, cambricon-neuware4.4.3 / 4.7.2, enflame-tops1.9.10 / 1.10.6, hygon-dtk26.04, iluvatar-corex4.4.0 / 4.5.0, metax-maca3.8.1.3, mthreads-musa4.3.6 / 5.2.0, соответствующие #1019–#1033); в дополнение внесены две правки: шаги сборки напрямую читают зафиксированную версию wheel (#1018), точная фиксация устанавливаемой версии и дополнение двух несобранных строк (#1017). Тогда же зарегистрирован образ приложения vLLM для Kunlunxin 2.2.0-0.3.0rc2.post2 (#1012 / #1013, с сопутствующей авторизованной пересборкой #1010).
В-третьих, портал Release Info пересобран. 09-23 06:38 ~ 06:44 в репозитории информации о релизах ветка gh-pages получила 13 последовательных пушей с пересборкой портала Hugo (flagos-ai.github.io/release-info). Портал организован по четырём уровням “вендор / базовый образ (base) / runtime-образ (runtime) / образ приложения (application)” и охватывает base- и runtime-образы 20 строк платформ, а также образы приложений vLLM (две матрицы 0.20.2 / 0.24.0), Megatron (training / rl), sglang 0.5.18; на примере страницы строки nvidia-cuda12.8 для Megatron уже видны полные инструкции по извлечению harbor.baai.ac.cn/flagos-app/megatron_training0.17.1-nvidia-cuda12.8:2.2.0-0.2.3 и flagos-runtime-nvidia-cuda12.8:2.2.0. Регистрация образов, публикация портала и попадание списка в репозиторий — эти три линии впервые синхронизировались в один день в рамках текущего окна, и релизные артефакты 2.2 начали становиться публично видимыми.
Параллельно продвигаются ветки версий: FlagTree 0.7.0-rc2-triton3.6 (пуш 09-23 09:36), vllm-plugin-FL 0.3.0-rc2 (09-22 23:20, #549), FlagScale 2.1.0-rc2 (09-23 08:43, #1301 cherry-pick из main), sglang-plugin-FL 0.2.0-rc2 (v0.2.0 уже помечен тегом).
1. Прогресс открытых проектов (динамика GitHub)
Обзор окна: из 54 репозиториев организации 24 имели пуши в окне; поиск по коммитам дал 143 совпадения (по 14 репозиториям), кроме того пуши по веткам в release-info (gh-pages), FlagScale, vllm-plugin-FL, FlagTree, docs, sglang-plugin-FL и др. не учтены в поиске. Распределение: FlagQuantum 38, build-infra 33, FlagGems 28, Torch-FL 11, FlagSparse 10, FlagGems-vllm 6, FlagFFT 4, FlagCX 3, FlagTree 2, FlagAttention 2, FlagBLAS 2, whisper-triton 2, community 1, FlagGems-Experimental 1.
Форма текущего окна = “закрытие релиза 2.2” + “взрыв квантового стека” + “плотные исправления для множества платформ”: инженерия релиза подробно описана в “Ключевом за сегодня”; FlagQuantum с 38 коммитами стал самым активным отдельным репозиторием; FlagGems / FlagGems-vllm / Torch-FL одновременно вошли в ритм “исправление + оптимизация”.
1.1 Дополнение по инженерии релиза: канал wheel для FlagCX продвинулся до Kunlunxin и всех строк, deb/rpm охватывают каждый упаковываемый компонент (09-22/09-23)
Дата: 2026-09-22 ~ 2026-09-23 Источники: build-infra #1000, #1002, #1007, #1008, #1014
- Линия распространения FlagCX wheel: wheel для Kunlunxin доведён до готовности (#1000, продолжение пункта «на рассмотрении» из вчерашнего отчёта); канал wheel открыт во всех остальных восьми линейках (#1002); pin для каждой линейки автоматически выводится из ref (#1007), каждая выдача обязана сопровождаться wheel ref (#1006), по каждой линейке ведётся запись опубликованных pin и документа «связь wheel и torch» (#1005 / #1016); публикующий контейнер наследует прокси узла (#1015). Форма распространения предварительно скомпилированных wheel для каждого бэкенда расширена с «пилотной линейки» до «всех линеек + закрепления в конвейере».
- Покрытие нативных пакетов: каждый упаковываемый компонент получает путь в репозиторий (#1001), покрытие deb и rpm дополнено (#1008) — согласуется с критериями приёмки FEP-0019 (унифицированная интеграция упаковки, Wave 1 уже включает слияние четырёх репозиториев FlagCX / FlagTree / FlagSparse / FlagAttention).
- FlagTree Iluvatar wheel пересобран на Ubuntu 22.04 и опубликован сборщик (#1014, линейка Iluvatar CoreX).
- Также две правки документации: отозвано утверждение о загрязнении ConfigCache
flag_gemsмежду компиляторами (#1034), отменено обоснование понижения версии flagtree для metax (#1020).
1.2 FlagQuantum: 38 коммитов в одном окне — облачный каркас QPU, совместимость трёх основных фреймворков, ускорение за счёт слияния симуляции (09-22)
Дата: 2026-09-22 Источники: FlagQuantum #135, #154, #138, #168, #167
FlagQuantum (квантовый AI-фреймворк с приоритетом PyTorch в экосистеме FlagOS) — 38 коммитов в одном окне, четыре линии параллельно:
- Облачное исполнение QPU: добавлен каркас исполнения Azure Quantum QPU (#168) — ещё одна облачная линия бэкендов после Braket / CUDA-Q в прошлом месяце.
- Межфреймворковая совместимость: реализация адаптера схем Amazon Braket (#154, сопутствующий контракт #147), конвертация схем Cirq (#135) и контракт символьных параметров (#166 / #170), экспорт ядер CUDA-Q (#138, исправлена валидация IR конечных углов #145), отслеживание разрывов в возможностях между фреймворками (#164), аттестационные тесты семантики схем между фреймворками (#160).
- Производительность симуляции: ускорение вентилей вектора состояний на CPU (#142), ускорение хвостовых двухбитных вентилей (#143), слияние диагональных областей между линиями (#146), слияние двулинейных диагональных совпадений (#153), слияние слоёв однолинейных вентилей (#157 / #159 / #165), слияние областей смешанной ширины (#169), а также опционально включаемый векторизованный сэмплер траекторных строк (#132) и разложение по путям CPU-полосы + бенчмарк сети дифференциальных ядер (#128).
- Линия валидации (regional twin): проверка набора схем (#123), валидация на отложенном множестве (#141), персистентность истории и оценок (#137 / #144 / #152 / #163), выравнивание дрейфа (#155), гейтирование по доказательствам отложенного множества (#162), публикация прошедших валидацию кандидатов (#167).
- CI: переиспользование runner между опциональными версиями SDK (#158), полоса покрытия braket (#161), распараллеливание CPU-тестов (#149), устранение дублирования наборов (#150 / #156), устранение узких мест очереди (#148).
1.3 FlagGems: KernelGen добавляет ещё 15 операторов Nvidia; плотное слияние исправлений и оптимизаций для шести платформ (09-22/09-23)
Дата: 2026-09-22 ~ 2026-09-23 Источники: FlagGems #5245, #5845, #6531, #6339, #5063
- KernelGen (Nvidia) 15 шт.:orgqr (#5845)、trapz (#5927)、matrix_power (#5735)、matmul_backward (#5639)、_pad_packed_sequence (#5245)、_scaled_dot_product_attention_math_for_mps (#5259)、_nested_tensor_softmax_with_shape (#5693)、_nested_tensor_from_mask (#5691)、_sample_dirichlet (#5946)、_ctc_loss (#5489)、_batch_norm_with_update (#5828)、_cudnn_rnn (#5823)、_transform_bias_rescale_qkv (#6141)、_spdiags (#6102)、vander (#5945) — конвейер автоматической генерации продолжает массово пополнять длиннохвостые операторы.
- Линия качества NVIDIA: восстановлена нативная FP8 WGMMA для scaled MM (#6531).
- Hygon: исправлена проблема
index_reduce_на трёх платформах — Ascend / Iluvatar / MetaX (#5063, вклад SiliconFlow). - MetaX: принят и оптимизирован оператор
topk_w8a16_fp8(#6339). - Ascend: улучшены диспетчеризация и реализация cat/concat (#6548), реализация
rrelu_with_noise(#6534, линия KMCompiler), бенчмаркnonzero_staticпереведён на режим оператора (#6571), обновлён образ еженедельного тестирования 910B (#6590). - Квантование и общее: динамическое матричное умножение W4A8 и проверка переносимой 4-битной упаковки (#6494), принят block diag (#6555), исправлена маска конечных значений для отрицательных порядков
vector_norm(#5883).
1.4 FlagGems-vllm: принят новый оператор Ascend XCS; три линии Moore Threads / Hygon / MetaX переведены из ревью в принятие (09-22/09-23)
Дата: 2026-09-22 ~ 2026-09-23 Источники: FlagGems-vllm #817, #823, #803, #826
- Ascend XCS: принят Triton-оператор сжатия состояния KV-пула (kpool) (#817, 09-23 09:22), что продолжает ритм продвижения пакета операторов XCS.
- Три линии из ревью в принятие: переменная длина внимания W8A8 FP8 от Moore Threads (#823), блочное BMM INT8 и свёртка INT8 einsum от Hygon (#803), объединённое обратное RoPE с квантованием FP8 от MetaX (#826) — все три ранее были пунктами «пула ревью» в предыдущих ежедневных отчётах и в этом окне централизованно доведены до принятия.
- Инженерные исправления: гейтирование пути TLE по требуемым возможностям (#833), тестовые зависимости больше не обновляют существующий numpy (#832).
1.5 Torch-FL: 11 сходимостей — исправления DCU и Ascend, унификация матрицы сборки, очистка выведенного из эксплуатации кода (09-22/09-23)
Дата: 2026-09-22 ~ 2026-09-23 Источники: Torch-FL #395, #393, #392, #387, #372
Слой адаптации PyTorch (Torch-FL / PyTorch-Plugin-FL) — 11 коммитов в этом окне, инженерные работы сосредоточены на закрытии:
- Исправление устройств: значения индексов выхода за границы на DCU теперь отклоняются напрямую (#395), ядро Ascend переведено на выполнение на устройстве, где находятся операнды (#392), PPU восстанавливает CUDA-метаданные в CPU torch wheel (#370), внимание SDPA сохраняет граф autograd в режиме диспетчеризации (#390).
- Сборка и конфигурация: матрица платформ / сборок сведена в единую таблицу (#387), нераспознанный или необнаруженный GEMS_VENDOR приводит к прямой ошибке (#388), добавлена конфигурация ruff и удалены black/isort (#386), гейт codegen
--checkи тест согласованности регистрации (#382). - Очистка и производительность: удалён глобальный патч
Tensor.__getitem__(#372), выведен устаревший код, включая нативное дерево MetaX (#393), полностью действующие маски подсказок qwen-image теперь опускаются (#371).
1.6 Прочие обновления: усиление транспорта FlagCX, продвижение трёх бэкендов FlagSparse, бэкенд NPU TransformerEngine-FL, FlagTree PPU CI (22.09/23.09)
Дата: 2026-09-22 ~ 2026-09-23 Источники: FlagCX #594, TransformerEngine-FL #113, FlagTree #1259, FlagSparse #80
- FlagCX: усиление гетерогенного транспорта и выравнивание CI ускорителей (#594), расширение p2p engine rpc serve и обновление транспорта barex (#611), упаковка выполняется только при изменениях упаковки (#616).
- FlagSparse: ветка сотрудничества NCIC-AlphaSparse объединила две партии (#79 / #80) — оптимизация DCU SpMM COO, результаты MACA SpMM, CI и вывод для Ascend, тесты MTX включены в CI.
- TransformerEngine-FL: добавлена реализация LayerNorm для бэкенда NPU (#114) и реализация многотензорного Adam для бэкенда NPU (#113).
- Megatron-LM-FL: стабилизация совместимости вендорных бэкендов и интеграция с CI (#174).
- FlagTree: в PPU CI основной ветки добавлена проверка
pid.txt(#1259, смёржено 23.09 в 10:05), в переиспользуемый рабочий процесс GEMS добавлено обнаружение изменений CORE (#1265), обновлена документация новых встроенных функций (#1120). - FlagAttention: обновления тестов и бенчмарков (#69), в pytest добавлены
--record/--output(#70). - FlagBLAS: смёржена оптимизация производительности Ascend L2 (#123 — SPR / SPR2 / HPR / HPR2), линия упаковки для внешних контрибьюторов (#1, выравнивание версии с линией релиза 0.3.0).
- FlagFFT: стратегия измерения MACA «1d single» переведена в статус по умолчанию, дополнена документация по окружению HCU / Ascend CANN9.
- FlagGems-Experimental: в KernelGen добавлен оператор
dim(#702). - whisper-triton: синхронизирована базовая линия патчей Codeup от Keda Xunfei (#6).
2. Новости и экосистема
2.1 AICC2026 состоялась в Пекине: два доклада FlagOS и запуск системы оценки «надёжного ИИ» (21.09/22.09)
Дата: 2026-09-21 (период конференции) / 2026-09-22 (централизованный выход публикаций) Источники: Guangming Online, The Beijing News, CBISMB, программа на сайте AICC
7-я конференция по искусственному интеллекту и вычислениям (AICC2026) прошла 21 сентября в Пекинском международном инновационном центре Чжунгуаньцунь, а с 22 сентября началось её активное освещение в прессе. Два пункта, непосредственно связанных с FlagOS: в 09:50 на главном форуме заместитель директора и главный инженер Пекинской академии искусственного интеллекта Zhiyuan (BAAI) Линь Юнхуа выступила с докладом «От архитектурных инноваций к доступным вычислительным мощностям: новая парадигма программно-аппаратной синергии FlagOS для AI-вычислений», отметив, что «AI-нагрузки не сойдутся к единому виду, и вычислительная архитектура не останется единственной; чтобы аппаратные инновации превратились в доступные вычислительные мощности, необходима поддержка общей программной экосистемы — Zhongzhi FlagOS через унифицированный компилятор, операторы, коммуникации и фреймворки обучения и вывода снижает затраты на повторную адаптацию разнородных чипов»; кроме того, согласно программе конференции, исследователь BAAI Чжао Шуай выступил на тематическом форуме с докладом «Zhongzhi FlagOS: раскрытие ценности разнородных AI-вычислительных мощностей через открытый программный стек». На конференции одновременно состоялась церемония запуска рабочей группы по оценке «Надёжный AI» (Пятый институт электроники Министерства промышленности и информатизации, 10:10), а в блоке отраслевых достижений была официально представлена система оценки «Надёжный AI» для эпохи агентов — совместно представленная Пятым институтом электроники Министерства промышленности и информатизации вместе с Пекинской академией искусственного интеллекта BAAI, Inspur Information, Moore Threads, MetaX, Пекинской академией открытых чипов, Baidu Smart Cloud, Alibaba Cloud и более чем 20 организациями цепочки отрасли, охватывающая все звенья — чипы, готовые системы и межсоединения, фреймворки и системы, модели, данные, приложения — и проводящая сквозную оценку по измерениям надёжности, безопасности и стабильности. Одновременно IDC и Inspur Information совместно опубликовали «Отчёт об оценке развития вычислительных мощностей для искусственного интеллекта в Китае за 2026 год»: ожидается, что в 2026 году объём интеллектуальных вычислительных мощностей в Китае достигнет 2576,5 EFLOPS, увеличившись на 87,9% год к году. Плотность организаций-участников в программе (Moore Threads, Tsingmicro, две сессии BAAI FlagOS) показывает, что данный стек уже стал постоянной темой открытой вычислительной экосистемы страны.
2.2 Конференция Yunqi: Damo Academy XuanTie представила Zhenwu V900 — платформа PPU, поддерживаемая FlagOS, получила новое поколение аппаратного обеспечения (22.09)
Дата: 2026-09-22 Источники: Guandian, National Business Daily, East Money, Сообщество разработчиков Alibaba Cloud
На конференции Yunqi 2026 (22.09, Ханчжоу) подразделение Alibaba Damo Academy XuanTie (T-Head) представило новое поколение AI-чипа для обучения и вывода Zhenwu V900: 216 ГБ видеопамяти, пропускная способность межчиповых соединений 1200 ГБ/с, нативная поддержка низкоточной точности FP8 / FP4, производительность одного чипа в 3 раза выше предыдущего поколения Zhenwu M890, серийное производство — в первом квартале 2027 года; на конференции также анонсированы следующее поколение Zhenwu J900 (март 2028) и два поколения серверных CPU Yitian 720 / 730 (2027), а также раскрыто, что суперузел Zhenwu V900 обладает способностью унифицированной адресации памяти и может образовывать полносвязную сеть на тысячу карт с полной пропускной способностью. Серия Zhenwu — это собственный PPU (Parallel Processing Unit) Alibaba, а PPU уже является одной из поддерживаемых платформ унифицированного плагина и компилятора FlagOS (операторы FlagGems-vllm PPU, FlagTree PPU CI, архитектура FlagDNN PPU) — выпуск нового поколения аппаратного обеспечения означает, что у бэкенда PPU данного стека появилась чёткая цель поколенческого обновления.
2.3 Динамика отечественных вычислительных программных стеков: выпущена первая версия платформы ускоренных вычислений Loongson; сегодня открывается выставка цифровой торговли (22.09/23.09)
Дата: 2026-09-22 ~ 2026-09-23 Источники: IT Home, MyDrivers, Обзор зоны AI выставки цифровой торговли
- Loongson Technology 22.09 выпустила первую программную версию «Платформы ускоренных вычислений Loongson»: на базе интегрированного в Loongson 2K3000 / 9A1000 универсального GPU серии LG200, охватывает драйверы, компилятор, среду выполнения, библиотеку операторов (BLAS / DNN), движок вывода, инструменты отладки и анализа производительности, поддерживает две модели программирования — OpenCL 3.0 и CUDA, позволяет с низкими затратами переносить CUDA-приложения, а также запланирована поколенческая программная совместимость по мере развития 9A2000 / 9A3000. Ещё один пример «полностековой программной платформы» отечественных вычислительных мощностей, служащий взаимным ориентиром для подхода данного стека «единый программный стек снижает затраты на адаптацию».
- 5-я Глобальная выставка цифровой торговли открывается 23.09 в Ханчжоу (до 27.09): впервые учреждён раздел экосистемы применения интегральных схем «Цифровая торговля · сценарии чипов», предприятия, включая MetaX, вошли в совместную экспозицию «чипы + материалы + вычислительные мощности»; вычислительные компании представлены 117 участниками. Отраслевая видимость организаций-участников подхватывается сезоном конференций.
2.4 Восемнадцатое подряд спокойное окно компонентного поиска (22.09/23.09)
Дата: 2026-09-22 ~ 2026-09-23 Источники: Google News RSS (24 группы поисковых запросов на китайском и английском, через прокси)
Поиск по названиям компонентов FlagOS / FlagGems / FlagScale / FlagTree / FlagPerf / FlagCX / KernelGen на китайском и английском языках (when:7d и when:14d): совпадения на уровне компонентов в 24-часовом окне — ноль, что образует восемнадцатое подряд спокойное окно (предыдущее окно — семнадцатое). Это контрастирует с выставочно-конференционной стороной: информационное поле этого окна формируется динамикой участников и экосистемы на AICC2026 и конференции Yunqi (см. 2.1—2.3). HN Algolia по словам FlagOS / FlagGems и др. релевантных совпадений не дал; в сообществе Zhiyuan новых публикаций, связанных с FlagOS, не обнаружено.
3. Углублённый анализ участников
3.1 Hygon: исправление границ индексов DCU и слияние блочного BMM INT8 (09-22/09-23)
Дата: 2026-09-22 ~ 2026-09-23 Источники: Torch-FL #395, FlagGems-vllm #803
- Torch-FL #395: выход за границы значений индексов на DCU теперь отклоняется напрямую (предотвращение тихих ошибочных результатов).
- FlagGems-vllm #803 (из рассмотрения переведён в слитый): ядро блочного BMM INT8 и свёртка INT8 einsum (bhr,hdr→bhd) — дополнение реализации Hygon для низкоточной матрицы умножения на стороне инференса.
- Строки зеркал: megatron_training-hygon-dtk26.04 зарегистрирован 2.2.0-0.2.3; runtime hygon-dtk26.04 уже опубликован на портале.
3.2 Moore Threads: слияние поддержки квантизации W8A8 для переменной длины внимания; доклад на AICC2026 и участие в «надёжном AI» (09-22)
Дата: 2026-09-22 Источники: FlagGems-vllm #823, программа AICC, CBISMB
- FlagGems-vllm #823 (из рассмотрения переведён в слитый): поддержка W8A8 FP8 для внимания переменной длины (varlen) — путь квантизации для платформы MUSA проложен.
- AICC2026: заместитель генерального директора департамента решений Moore Threads Жэнь Яньпин выступила на тематическом форуме; компания также участвовала в качестве соучредителя системы оценки «надёжный AI».
- Строки зеркал: megatron_training-mthreads-musa4.3.6 / musa5.2.0 — обе строки зарегистрированы 2.2.0-0.2.3.
3.3 MetaX: слияние слитного обратного RoPE оператора квантизации; оптимизация topk W8A16 и стратегия MACA FFT по умолчанию (09-22)
Дата: 2026-09-22 Источники: FlagGems-vllm #826, FlagGems #6339, коммиты FlagFFT
- FlagGems-vllm #826 (из рассмотрения переведён в слитый): добавлен и оптимизирован слитный обратный RoPE с оператором квантизации FP8 для реализации MetaX.
- FlagGems #6339: добавлен и оптимизирован оператор
topk_w8a16_fp8(metaX). - FlagFFT: стратегия измерения MACA «1d single» переведена в статус по умолчанию (настройка параметров на основе измерений переведена из экспериментальной в постоянную).
- Torch-FL #393: вывод из эксплуатации устаревшего кода, включая нативное дерево MetaX — слой адаптации сходится к плагинной архитектуре.
- Строки зеркал: megatron_training-metax-maca3.8.1.3 зарегистрирован 2.2.0-0.2.3.
3.4 Ascend: обновление пакета операторов и тестовых зеркал; реализация бэкенда NPU для TransformerEngine-FL (09-22/09-23)
Дата: 2026-09-22 ~ 2026-09-23 Источники: FlagGems #6548, #6590, FlagGems-vllm #817, TransformerEngine-FL #113
- FlagGems: улучшения диспетчеризации и реализации cat/concat (#6548),
rrelu_with_noise(#6534), исправление бенчмаркаnonzero_static(#6571), обновление образа еженедельного тестирования 910B (#6590). - FlagGems-vllm #817: в линейке XCS добавлен оператор сжатия состояния KV-пула (kpool) (влито утром 09-23).
- TransformerEngine-FL #113 / #114: реализации NPU-бэкенда для многотензорного Adam и LayerNorm — дополнение бэкенда Ascend для фреймворка на стороне обучения.
- Torch-FL #392: ядра Ascend переведены на выполнение на устройстве, где находятся операнды, исправлена кросс-девайсная диспетчеризация.
- Строки образов: ascend-cann8.5.0 / cann9.0.0 и варианты 910c — регистрация нескольких строк и публикация на портале.
3.5 Iluvatar CoreX: линия пересборки Iluvatar wheel 22.04 и регистрация строк контейнеров (09-22/09-23)
Дата: 2026-09-22 ~ 2026-09-23 Источники: build-infra #1014, портал Release Info
- build-infra #1014: Iluvatar wheel пересобран на Ubuntu 22.04, опубликован образ его сборщика — линия распространения wheel дополнена строкой Iluvatar.
- Строки образов: строки iluvatar-corex4.4.0 / corex4.5.0 регистрируют образ megatron 2.2.0-0.2.3; строки base / runtime опубликованы на портале.
- FlagGems #5063 исправляет реализацию
index_reduce_на платформе Iluvatar (вклад SiliconFlow).
3.6 Enflame: регистрация нескольких строк образов и строка приложения sglang (09-22/09-23)
Дата: 2026-09-22 ~ 2026-09-23 Источники: портал Release Info
- Регистрация образов: строки megatron_training-enflame-tops1.9.10 / tops1.10.6 регистрируют 2.2.0-0.2.3; образ приложения sglang включает две строки enflame-tops; строки base / runtime обновлены вместе с пересборкой портала.
3.7 Tsingmicro: программа AICC2026 и строки runtime (09-22)
Дата: 2026-09-22 Источники: программа на сайте AICC, портал Release Info
- Программа AICC2026: вице-президент Tsingmicro по программному обеспечению Ли Бинь представит доклад «3D-чипы, новая глава open source: Open3D-PIMC реконструирует программную основу вычислительной мощности» — публичное действие производителя реконфигурируемых вычислений на стороне открытого программного стека.
- Строки образов: строки base / runtime для tsingmicro-tsm260610 обновлены вместе с пересборкой портала; ветка vllm-plugin-FL 0.3.0-rc2 содержит адаптацию tsingmicro txda 0.24.0 (ранее влито в фоне, закрыто вместе с веткой релиза).
3.8 XuanTie лаборатории DAMO: Zhenwu V900 и закрытие PPU CI (09-22/09-23)
Дата: 2026-09-22 ~ 2026-09-23 Источники: FlagTree #1259, Torch-FL #370, Guandian
- Аппаратная сторона: выпущен Zhenwu V900 (новое поколение PPU), массовое производство в Q1 2027 (подробнее в 2.2).
- Программная сторона: в PPU CI FlagTree добавлена проверка
pid.txt(#1259, влито 09-23 10:05) — завершение обеспечения целостности CI цепочки компиляции PPU; Torch-FL восстановил CUDA-метаданные CPU torch wheel на пути PPU (#370).
4. Итоги и наблюдения за тенденциями
- 2.2 Последняя неделя перед выходом в GA: релизные артефакты становятся «видимыми»: первый пункт официального релизного списка попал в репозиторий (sglang-plugin-fl v0.2.0), портал Release Info в тот же день пересобран, образ приложения Megatron 2.2.0-0.2.3 покрывает 14 строк. Период стабилизации rc2 завершается 09-24, GA назначен на 09-28 — в течение следующей недели точки наблюдения: поэтапное пополнение списка и порядок закрытия тегов rc2/post по компонентам.
- Формы дистрибуции продолжают расширяться: FlagCX wheel расширен с пилотной строки на все строки + внедрение Kunlunxin, deb/rpm покрывают каждый упаковываемый компонент, FlagTree Iluvatar wheel пересобран — это совпадает с критериями приёмки Wave 1 FEP-0019 (унифицированная интеграция упаковки); нативный пакетный канал «вне образов» становится стандартной поверхностью поставки 2.2.
- Квантовый стек — лидер дня по пропускной способности в одном репозитории: FlagQuantum — 38 коммитов, одновременно продвигаются облачные бэкенды (четырёхсторонняя совместимость Azure Quantum / Braket / CUDA-Q / Cirq), ускорение слияния симуляции и шлюзы проверки кандидатов — от «сопутствующего компонента» к ритму фреймворковой разработки.
- Три репозитория одновременно вошли в ритм исправлений/настройки: FlagGems (15 KernelGen + исправления для шести платформ), FlagGems-vllm (три на ревью переведены в merged), Torch-FL (11 коммитов инженерного закрытия, включая удаление глобальных патчей и выведенного из эксплуатации кода) — форма окна «приёмка, исправление, настройка» после заморозки функций соответствует графику.
- Внешний информационный фронт подхвачен сезоном конференций: восемнадцатое спокойное окно по компонентному поиску против двух докладов FlagOS на AICC2026 и запуска «Надёжного AI», релиза Zhenwu V900 на Cloud Summit, полностековой GPU-программной платформы Loongson — внимание промышленной стороны к «унифицированному программному стеку / разнородным вычислительным мощностям» концентрированно высвобождается в сезон конференций и взаимно подтверждается закрытием на стороне кода.
- К наблюдению: последующие пункты списка 2.2 (FlagTree 0.7.0+triton3.6, vllm-plugin-FL 0.3.0, FlagScale 2.1.0 и другие версионные ветки уже продвигаются); сопровождение программной адаптации нового оборудования PPU (серийное производство V900 в 2027 Q1); выход упаковочных линий FlagSparse / FlagAttention (FEP-0019 Wave 1) перед GA.
Приложение: таблица проверки источников
| Категория | Источник | Способ проверки | Результат |
|---|---|---|---|
| GitHub | org: flagos-ai repos API | Полная проверка pushed_at по 54 репозиториям | 24 репозитория активны в окне |
| GitHub | Поиск коммитов + построчная сверка по репозиториям | Поэтапная верификация в окне | 143 коммита (14 репозиториев) + пуши на стороне веток (release-info / FlagScale / vllm-plugin-FL / FlagTree / docs) |
| GitHub | Построчное сканирование releases по репозиториям | releases API по 13 репозиториям | Новых release в окне нет (2.2 идёт через список / регистрацию образов / публикацию портала) |
| Релизная инженерия | Список community + портал Release Info + build-infra | Постраничная сверка по исходным текстам | Первый пункт release-2.2.yaml; пересборка 20 строк платформ портала; образ Megatron 2.2.0-0.2.3 покрывает 14 строк |
| Новости | Google News RSS (24 группы поисковых запросов на китайском и английском, через прокси) | Фильтрация по 24-часовому окну + построчное исключение | Нулевые совпадения по компонентным словам (18-е спокойное окно); на стороне экосистемы сохранены пункты AICC2026 / Cloud Summit / Loongson и др. |
| Медиа | Guangming Online / The Beijing News / CBISMB / Guandian / National Business Daily / East Money / IT Home | Повторная проверка по исходным текстам | AICC2026, Zhenwu V900, платформа Loongson |
| Сообщество | HN Algolia / Zhiyuan Community | Повторная проверка поиска | Нет новых материалов, связанных с FlagOS |
| Документация проекта | community // schedule.md, flagos-ai.github.io/release-info | Захват исходных текстов | Сверка графика 2.2 (rc2 до 09-24, GA 09-28) и матрицы образов |
Полный список источников
- [1] Ключевое за сегодня / 1.1 community и список релизов — https://github.com/flagos-ai/community/pull/111 · https://github.com/flagos-ai/community/blob/main/release/2.2/release-2.2.yaml · расписание https://github.com/flagos-ai/community/blob/main/release/2.2/schedule.md · отслеживание https://github.com/flagos-ai/community/issues/47
- [2] Ключевое за сегодня / 1.1 build-infra — #1000 — https://github.com/flagos-ai/build-infra/pull/1000 · #1002 — https://github.com/flagos-ai/build-infra/pull/1002 · #1008 — https://github.com/flagos-ai/build-infra/pull/1008 · #1014 — https://github.com/flagos-ai/build-infra/pull/1014 · #1017 — https://github.com/flagos-ai/build-infra/pull/1017 · #1019 по #1033 (регистрация строк Megatron) — https://github.com/flagos-ai/build-infra/pulls
- [3] Ключевое за сегодня / 1.1 портал Release Info — https://flagos-ai.github.io/release-info/ · пример строки Megatron — https://flagos-ai.github.io/release-info/zh-cn/application/megatron_training-nvidia-cuda12.8/
- [4] 1.2 FlagQuantum — #135 — https://github.com/flagos-ai/FlagQuantum/pull/135 · #138 — https://github.com/flagos-ai/FlagQuantum/pull/138 · #154 — https://github.com/flagos-ai/FlagQuantum/pull/154 · #167 / #168 — https://github.com/flagos-ai/FlagQuantum/pulls
- [5] 1.3 FlagGems — KernelGen #5245 — https://github.com/flagos-ai/FlagGems/pull/5245 · #5845 — https://github.com/flagos-ai/FlagGems/pull/5845 · FP8 WGMMA #6531 — https://github.com/flagos-ai/FlagGems/pull/6531 · MetaX #6339 — https://github.com/flagos-ai/FlagGems/pull/6339 · SiliconFlow #5063 — https://github.com/flagos-ai/FlagGems/pull/5063 · Ascend #6548 — https://github.com/flagos-ai/FlagGems/pull/6548
- [6] 1.4 FlagGems-vllm — #817 — https://github.com/flagos-ai/FlagGems-vllm/pull/817 · #823 — https://github.com/flagos-ai/FlagGems-vllm/pull/823 · #803 — https://github.com/flagos-ai/FlagGems-vllm/pull/803 · #826 — https://github.com/flagos-ai/FlagGems-vllm/pull/826
-
[7] 1.5 Torch-FL — #395 — https://github.com/flagos-ai/Torch-FL/pull/395 · #393 — https://github.com/flagos-ai/Torch-FL/pull/393 · #392 — https://github.com/flagos-ai/Torch-FL/pull/392 · #387 — https://github.com/flagos-ai/Torch-FL/pull/387 · #372 — <https://github.com/flagos-
- #371 — https://github.com/flagos-ai/Torch-FL/pull/372 · #370 — https://github.com/flagos-ai/Torch-FL/pull/370
- [8] 1.6 FlagCX — #594 — https://github.com/flagos-ai/FlagCX/pull/594 · #611 — https://github.com/flagos-ai/FlagCX/pull/611 · #616 — https://github.com/flagos-ai/FlagCX/pull/616
- [9] 1.6 FlagSparse — #79 / #80 — https://github.com/flagos-ai/FlagSparse/pulls · FlagAttention — https://github.com/flagos-ai/FlagAttention/pulls · FlagBLAS — https://github.com/flagos-ai/FlagBLAS/pulls
- [10] 1.6 TransformerEngine-FL — #113 — https://github.com/flagos-ai/TransformerEngine-FL/pull/113 · #114 — https://github.com/flagos-ai/TransformerEngine-FL/pull/114 · Megatron-LM-FL #174 — https://github.com/flagos-ai/Megatron-LM-FL/pull/174 · FlagTree #1259 — https://github.com/flagos-ai/FlagTree/pull/1259
- [11] 2.1 AICC2026 — Guangming Online — https://tech.gmw.cn/2026-09/22/content_39015304.htm · The Beijing News — https://www.bjnews.com.cn/detail/1790063742129693.html · CBISMB — https://www.cbismb.com/ai-infra/62409 · Программа — https://www.aicconf.net/
- [12] 2.2 Zhenwu V900 — Guandian — https://www.guandian.cn/article/20260922/605518.html · National Business Daily — https://www.nbd.com.cn/articles/2026-09-22/4588418.html · Eastmoney — https://finance.eastmoney.com/a/202609223881224838.html · Сообщество разработчиков Alibaba Cloud — https://developer.aliyun.com/article/1765525
- [13] 2.3 Платформа ускоренных вычислений Loongson — ITHome — https://www.ithome.com/1/005/595.htm · MyDrivers — https://news.mydrivers.com/1/1153/1153027.htm · Обзор зоны AI на выставке цифровой торговли — https://zdh.xwboo.com/news/262226.html
- [14] 3.5 Iluvatar CoreX — build-infra #1014 — https://github.com/flagos-ai/build-infra/pull/1014 · Портал Release Info (строка iluvatar) — https://flagos-ai.github.io/release-info/
- [15] 3.7 Tsingmicro — программа AICC — https://www.aicconf.net/ · Портал Release Info (строка tsingmicro) — https://flagos-ai.github.io/release-info/