Окно мониторинга: 2026-08-23 10:18 ~ 2026-08-24 10:18 пекинское время Источники: GitHub (org: flagos-ai 52 репозитория + поиск по коммитам + PR API), Google News RSS (китайский и английский, прокси-канал работает штатно), HN Algolia, сообщество Zhiyuan (hub.baai.ac.cn), перекрёстная проверка Tavily (подробности в приложении)


Индекс

    1. Открытые проекты: прогресс (динамика GitHub)
      • 1.1 build-infra: Ascend vllm 0.20.2, двойной компилятор F/T E2E полностью пройден (главное за окно) (08-24)
      • 1.2 build-infra: запущена структурированная система отслеживания проверок status-matrix (08-23)
      • 1.3 build-infra: перевод vllm в производственный режим — Kunlunxin 0.24.0 двойной компилятор verified + NVIDIA 0.20.2 empty-mode + vllm-plugin-FL сборка на чистом Python (08-23)
      • 1.4 Torch-FL: исправление трансляции RNG-генератора CUDA-boxing (08-24)
      • 1.5 Динамика других репозиториев (FlagTree/docs/release-info/vllm-plugin-FL #400)
    1. Новости и экосистема
      • 2.1 Общая оценка новостной стороны (пятый день подряд нулевые совпадения по компонентам)
      • 2.2 Тренд за последние 3 дня (подтверждено GitHub org pushed)
      • 2.3 Исключения
    1. Углублённый анализ участников
    1. Итоги
  • Приложение: полный список источников

1. Открытые проекты: прогресс (динамика GitHub)

Обзор окна: из 52 репозиториев в org 5 имели push в окне (build-infra, Torch-FL, FlagTree, docs, release-info); поиск по коммитам дал 19 коммитов внутри окна, из которых 18 приходятся на build-infra; официальных GitHub Release нет (теги build-infra по-прежнему v2.1.1/v2.1.0, 2.1.2 — уже влитая 8/5 существующая ветка версий). Основная линия этого окна сосредоточена на «коллективном позеленении матрицы проверок на нескольких чипах» на стороне инференса vllm и на модернизации инфраструктуры производственной валидации — три бэкенда: Ascend (двойной бэкенд cann), Kunlunxin (новая линия 0.24.0), NVIDIA (cuda13.3) — в течение 24 часов последовательно завершили E2E-проверку двойного компилятора (FlagTree+Triton) для 0.20.2/0.24.0, а система status-matrix перевела состояние проверок из рукописного markdown в структурированное отслеживание на основе YAML.

1.1 build-infra: Ascend vllm 0.20.2, двойной компилятор F/T E2E полностью пройден (главное за окно)

Источник: PR #496 (влит 8/24 08:39)

  • Ascend стал бэкендом, полностью прошедшим проверку двойного компилятора в матрице vllm 0.20.2: на двух бэкендах Ascend — cann8.5.0 @ hw26 и cann9.0.0 @ hw25 — оба пути компиляции, FlagTree и Triton, полностью прошли serve + inference (Qwen3-4B), ячейка матрицы 0.20.2 переведена из невалидированной в валидированную, установлен deps_app, app стал собираемым (синхронно включён launch_docs).
  • Сопутствующие изменения: status_matrix.vllm0.20.2.yaml переворачивает ячейки Ascend F/T, configs.yaml добавляет для двух бэкендов Ascend ключ vllm0.20.2 deps_app, раздел §2.8 отчёта фиксирует завершение обоих путей и добавляет новую запись в чёрный список pow_scalar (матрица проверок перегенерирована через render_status_matrix.py).

Трактовка: после E2E двойного компилятора на стороне обучения (megatron) Ascend CANN 8.5.0 от 8/21, в этот раз закрыта валидация на стороне инференса (vllm) по двум бэкендам и двум путям — Ascend стал третьим после NVIDIA и Kunlunxin бэкендом, завершившим валидацию двойного компилятора в матрице vllm 0.20.2, причём с охватом двух поколений toolchain — cann 8.5/9.0. Последовательность охвата чипов «парадигмой валидации двух путей F/T» (NVIDIA → Kunlunxin → Ascend) сложилась на стороне инференса.

1.2 build-infra: запущена структурированная система отслеживания проверок status-matrix

Источник: PR #485 (влит 8/23 14:16), #494 (влит 8/23 21:10), #495 (влит 8/23 21:48)

  • #485: YAML-фикация матрицы верификации. Таблицы матрицы верификации для каждого app вынесены из markdown в структурированные status_matrix.<app>.yaml (по одному файлу на app, размещаются в packaging/<component>/), которые scripts/render_status_matrix.py рендерит обратно в человекочитаемый markdown (блоки маркеров verification + facility), а режим --check обнаруживает дрейф; в первой партии внедрено 4 YAML: megatron_training, megatron_rl, vllm0.20.2, vllm0.24.0 (0.20.2 и 0.24.0 — два независимых app, именование совпадает с сегментом app в репозитории образов, без дефисов); upstream PR уровня бэкенда отслеживаются в поле backends.<backend>.prs. В комплекте .githooks/pre-commit + скрипт установки для локальной защиты от дрейфа.
  • #494: image_tag — единый источник релиза. В матрице image_tag заменяет harbor_repo и становится единственным источником истины для tag опубликованных образов.
  • #495: автоматическая запись релизного tag. После публикации app-image опубликованный image tag автоматически записывается обратно в status matrix — замкнутый контур между релизом и статусом верификации.

Трактовка: это самый заметный инфраструктурный сигнал данного окна — матрица верификации повышена с уровня «документационной записи» до «программируемых данных + автоматического рендеринга + защиты от дрейфа + автообратной записи релиза»; вместе со вчерашним #475 (megatron-train launcher включён в app image) build-infra превращает «кто может запускать и до какой степени» в машинно-аудируемую машину состояний. Масштабирование мультичиповой верификации (число бэкендов продолжает расти) вынуждает инженерно оформлять управление верификацией.

1.3 build-infra: перевод vllm в производственный режим — Kunlunxin 0.24.0 с двумя компиляторами verified + NVIDIA 0.20.2 empty-mode + чисто Python-сборка vllm-plugin-FL

Источники: #479, #482, #484, #486, #487 (23.08 11:31–17:03), #488, #489, #490, #492 (23.08 17:42–20:32)

  • Kunlunxin обновлена до линии app-image vllm 0.24.0: во вчерашнем окне Kunlunxin только завершила E2E с двумя компиляторами на 0.20.2 (#476), а в текущем окне продвинулась на новую линию 0.24.0 — 23.08 11:31 аудит осуществимости (#479, report §13) → 12:20 добавлена запись 0.24.0 в matrix (#482) → 13:36 зафиксирован serve E2E для app-image (#484) → 14:11 зафиксирован serve E2E для triton-path (#486) → 17:03 E2E с двумя компиляторами помечена verified (#487). Двухпутевая верификация Kunlunxin 0.24.0 полностью зелёная.
  • NVIDIA 0.20.2 empty-mode + cuda13.3 с двумя компиляторами verified: 17:42 NVIDIA унифицирована на сборке empty-mode wheel (#488) → 19:35 зафиксирован app-image E2E для 0.20.2 empty-mode (#490) → 19:40 добавлен ключ deps_app для vllm0.20.2 для nvidia-cuda13.3 (#491) → 20:32 nvidia-cuda13.3 0.20.2 с двумя компиляторами помечена verified (#492).
  • Унификация чисто Python-сборки vllm-plugin-FL (#489, 18:38): все бэкенды переведены на сборку pure-python wheel — зависимости переведены из встроенных в wheel в сборку во время выполнения через deps_app; это действие по унификации сборочной системы в русле #488/#491.

Интерпретация: Стек инференса vllm переходит к двум параллельным направлениям — «унификация системы сборки + расширение матрицы верификации»: на стороне плагинов отказ в пользу чистого Python снижает стоимость сопровождения wheel для множества чипов, на стороне верификации Kunlunxin 0.24.0 и NVIDIA cuda13.3 с двумя компиляторами в один день стали зелёными. Таким образом, в матрице vllm 0.20.2 уже три вендора — NVIDIA, Kunlunxin и Ascend — прошли с двумя компиляторами, а по линии 0.24.0 первой отчиталась Kunlunxin.

1.4 Torch-FL: исправление трансляции генераторов RNG в CUDA-boxing

Источник: commit #147 (влит 8/24 10:11)

  • fix: translate flagos generators in CUDA-boxing RNG ops: исправлена проблема нетранслированных генераторов FlagOS в операторах RNG на пути CUDA-boxing — ранее обработка генераторов FlagOS отличалась от обработки нативных генераторов CUDA, что приводило к семантическим расхождениям RNG между бэкендами.

Интерпретация: продолжение магистральной линии от 8/21 «unify cross-backend RNG integration coverage (#141)» — после адаптации к нескольким вендорам в profiler/AMP (8/21, четыре вендора) Torch-FL продолжает оттачивать согласованность RNG между бэкендами и путь совместимости CUDA-boxing; это завершающее исправление из серии «выравнивания семантики между бэкендами».

1.5 Активность других репозиториев

  • FlagTree: pushed_at 8/24 00:01 (пекинское время), но последний коммит в основной ветке по-прежнему от 8/21 (серия AMD amd3.6 CI) — определяется как пуш/синхронизация не в ветку по умолчанию; новых влитий в основную ветку в окне мониторинга нет.
  • docs: pushed_at 8/23 12:20 — плановое обновление ветки автоматической синхронизации документации modelscope (последнее влитие в основную ветку 8/19), нового содержимого нет.
  • release-info: pushed_at 8/24 08:40, но в репозитории только README + LICENSE (после начального коммита 7/13 содержимого по существу нет) — не сигнал о релизе версии.
  • vllm-plugin-FL: PR #400 с исправлением decode scale для Kunlunxin (создан 8/21, базируется на линии release-0.2) по-прежнему открыт; новых коммитов в основной ветке в окне нет (pushed 8/22 22:20 — не ветка по умолчанию).

2. Новостные публикации и экосистема

2.1 Общая оценка новостной стороны

Цепочка прокси Google News RSS работает нормально, но по ключевым словам компонентов (FlagOS/FlagGems/FlagScale/FlagTree/FlagPerf/FlagCX/KernelGen и др., на китайском и английском, when:7d-14d) в окне мониторинга нет ни одного прямого попадания — пятый день подряд новостной фон на уровне компонентов спокоен (8/20-8/24), что согласуется с исторической закономерностью; HN Algolia дал лишь нерелевантное ложное совпадение по «Hands-Rust» (та же запись, что и вчера, исключена). Запросы, связанные с Zhiyuan, дали несколько результатов, но все они — либо старые новости вне окна (агент AREX 8/11, конференция CCF по открытому исходному коду 8/17), либо уже освещённые вчера (FlagEval-Robo 8/22), либо слабо связанные (теоретическая страница Жэньминь жибао, сбор открытых проектов HyperAI); подробности в разделе 2.3 «Исключённые пункты». На новостной стороне нет новых материалов для включения; основное содержание настоящего отчёта — динамика GitHub.

2.2 Тренд за последние 3 дня (подтверждение через pushed в организации GitHub)

Дата Активные репозитории Основное содержание
8/22~8/23 (вчерашнее окно) build-infra(6), Megatron-LM-FL (ветка интеграции), FlagSparse(3) E2E с двумя бэкендами Cambricon (удаление shim, побайтовое совпадение loss); E2E с двумя компиляторами Kunlunxin 0.20.2; нативная регистрация PlatformMLU в Megatron-LM-FL; launcher megatron-train в app image
8/23~8/24 (текущее окно) build-infra(18), Torch-FL(1) Ascend vllm 0.20.2: полное прохождение F/T с двумя компиляторами (cann8.5.0/9.0.0); Kunlunxin vllm 0.24.0 с двумя компиляторами verified; NVIDIA cuda13.3 0.20.2 с двумя компиляторами verified; система status-matrix (перевод в YAML + единый источник image_tag + автоматическая обратная запись при релизе); унификация сборки vllm-plugin-FL на чистом Python; исправление RNG в CUDA-boxing для Torch-FL

Оценка тенденций: основная линия эволюционировала от «централизованного подключения чипов» к «коллективному переходу матрицы верификации в зелёный статус + инженеризации управления верификацией». Сторона обучения (megatron: Ascend 8/21 → Cambricon 8/22) и сторона инференса (vllm: KunlunXin 0.20.2 8/23 → Ascend 0.20.2 8/24, KunlunXin 0.24.0 новая линия) развиваются параллельно по двум линиям; перевод status-matrix в YAML и автоматическая обратная запись release-тегов знаменуют вступление многочиповой верификации в стадию «аудируемости статуса». С момента FlagOS 2.1 (6/24) прошло более 9 недель, 2.1.2 по-прежнему остаётся внутренней версионной линией (bump 8/5) без сигналов официального релиза; следующая точка наблюдения: вливание исправления KunlunXin в линии vllm-plugin-FL release-0.2 (#400), покрытие status-matrix для большего числа app.

2.3 Исключённые пункты

  • «Qwen3.8-2.4T запущен на суперкомпьютерном интернете, зеркала и API-сервисы открыты синхронно» (8/13 TradingView, попадание gnews FlagOS) — старая новость вне окна (суперкомпьютерный интернет является партнёром экосистемы FlagOS, само событие не относится к данному окну).
  • Автономный исследовательский агент AREX BETA от Zhiyuan (8/11 The Beijing News), открытие конференции CCF China Open Source 2026 в Чунцине (8/17) — вне окна.
  • Репортаж об официальном релизе FlagEval-Robo от Zhiyuan (8/22 сообщество Zhiyuan) — уже включён во вчерашнее окно, не дублируется.
  • Теоретическая версия «Жэньминь жибао» «Предоставление международных общественных благ и глобальное управление AI» (8/22 сообщество Zhiyuan) — общий комментарий по управлению AI, не имеет прямой связи с FlagOS.
  • «HyperAI x Open Source China, сбор на призовой фонд в миллион» (8/22 сообщество Zhiyuan) — мероприятие экосистемы Zhiyuan, не ключевая динамика FlagOS, слабая релевантность.
  • Китайский запрос «институт Zhiyuan открытый исходный код» засорён SEO-мусором от азартных игр («beat365официальный единственный вход», «новая игра в маджонг Kaiyuan» и т.п., womenofchina.com) — целиком удалено по ключевым словам заголовка.

3. Углублённый анализ участников

Граф динамики множества производителей в окне:

Производитель Чип/бэкенд Динамика в окне Доказательства
Zhiyuan build-infra возглавляет верификацию vllm для трёх бэкендов Ascend/KunlunXin/NVIDIA и систему status-matrix (18 коммитов); пятый день подряд нулевые попадания новостей о компонентах, на стороне экосистемы нет новых релизов последовательность PR build-infra
Ascend (Huawei) Ascend vllm 0.20.2 двойной компилятор F/T E2E полностью пройден (#496): два бэкенда cann8.5.0@hw26 + cann9.0.0@hw25, два пути FlagTree+Triton serve+inference (Qwen3-4B) полностью пройдены, deps_app установлен и собираем, добавлен чёрный список pow_scalar — сторона инференса дополнена после стороны обучения 8/21 build-infra #496
KunlunXin KunlunXin XPU vllm 0.24.0 app-image линия двойной компилятор E2E verified (#487): аудит выполнимости→serve E2E→triton-path serve E2E→двойной компилятор в зелёном, выполнено за 12 часов; PR исправления decode scale линии 0.20.2 (vllm-plugin-FL #400) всё ещё открыт build-infra #479/#482/#484/#486/#487, vllm-plugin-FL #400
NVIDIA (экосистемный ориентир) CUDA 0.20.2 empty-mode app-image E2E + cuda13.3 двойной компилятор verified (#490/#492); унифицированная сборка empty-mode wheel (#488); чистая Python-сборка vllm-plugin-FL для всех бэкендов (#489) build-infra #488/#489/#490/#492
Cambricon / Hygon / MetaX / Enflame / Moore Threads / Iluvatar / Tsingmicro / Horizon MLU / DCU / MetaX / GCU / MUSA / Iluvatar / TXDA / BPU На стороне открытого кода нет новых вливаний в окне (регистрация платформы Cambricon MLU 8/22 уже отражена; Hygon FlagSparse DCU 8/22 уже отражена)

Оценка тенденций: ключевое слово чиповой карты данного окна — «коллективный переход матрицы верификации инференса в зелёный статус». Ascend на обеих сторонах — обучения (cann8.5.0) и инференса (0.20.2 двойной бэкенд cann) — завершил верификацию двойным компилятором, став новейшим случаем «полной верификации двойного стека обучение+инференс» среди отечественных бэкендов; KunlunXin в течение 24 часов плавно перешёл с 0.20.2 на новую линию 0.24.0 и завершил верификацию двойного пути, шаблонизация процесса верификации (audit→serve→triton-path→verified) заметно ускорилась; на стороне NVIDIA верификация cuda13.3 0.20.2 двойным компилятором и унификация сборки empty-mode показывают, что «парадигма верификации» уже охватывает все бэкенды в качестве стандартного процесса.


4. Итоги

  1. Ascend vllm 0.20.2 с двумя компиляторами: сквозная проверка F/T пройдена (главная новость окна мониторинга): два бэкенда cann8.5.0@hw26 и cann9.0.0@hw25, два пути FlagTree+Triton, serve+inference (Qwen3-4B) — всё пройдено (#496). Ascend становится третьим бэкендом после NVIDIA и Kunlunxin, завершившим валидацию с двумя компиляторами в матрице vllm 0.20.2, причём охватывающим два поколения cann.
  2. Веха в инженерии управления валидацией: запущена система status-matrix (#485) — матрица валидации в формате YAML + рендеринг render_status_matrix.py для защиты от дрейфа; #494 image_tag становится единым источником релиза; #495 тег релиза автоматически записывается обратно в матрицу валидации. Статус мультичиповой валидации переходит от документации к машинно-аудируемому виду.
  3. Новая линия Kunlunxin vllm 0.24.0 валидирована за 12 часов: feasibility audit→app-image serve E2E→triton-path serve E2E→два компилятора verified (#479-#487), шаблонизация процесса валидации ускоряет работу; исправление decode scale в линии 0.20.2 (vllm-plugin-FL #400) всё ещё открыто.
  4. Унификация системы сборки vllm: чисто Python wheel для всех бэкендов vllm-plugin-FL (#489), унифицированная сборка NVIDIA empty-mode (#488), сборка cuda13.3 0.20.2 deps_app (#491) — плагин инференса переходит от «одного wheel на каждый чип» к «унифицированному wheel + сборке зависимостей во время выполнения».
  5. Завершение выравнивания семантики Torch-FL между бэкендами: #147 исправляет трансляцию генератора FlagOS в пути CUDA-boxing, продолжая основную линию унификации покрытия RNG от 8/21.
  6. Пятый день подряд нулевые совпадения по компонентам в новостях: нет официального GitHub Release (2.1.2 остаётся внутренней версионной линией с 8/5, сегодня #481 — рутинное обновление описания зеркала); в экосистеме нет новых записей для включения. Следующие точки наблюдения: расширение покрытия status-matrix, слияние vllm-plugin-FL #400, закрепление результатов валидации Kunlunxin 0.24.0 в качестве официальных записей.

Пояснение об ограничениях: количество коммитов и время слияния взяты из commit search и repos API pushed_at (поисковый индекс может немного запаздывать; содержимое неосновных веток проверяется по commits API ветки); детали окружения build-infra E2E приводятся по описанию PR; дальнейшее влияние status-matrix — интерпретация предположительного характера; по ссылкам-редиректам gnews невозможно получить основной текст, суждения по новостям опираются на заголовки и перекрёстное подтверждение из нескольких источников, возможны пропуски низковесных китайскоязычных источников.


Приложение: полный список источников

Номер Событие Ссылка на источник
1 build-infra Ascend vllm 0.20.2 двойной компилятор F/T E2E (#496) https://github.com/flagos-ai/build-infra/pull/496
2 build-infra система status-matrix (#485/#494/#495) https://github.com/flagos-ai/build-infra/pull/485
3 build-infra Kunlunxin vllm 0.24.0 последовательность проверки (#479/#482/#484/#486/#487) https://github.com/flagos-ai/build-infra/pull/487
4 build-infra NVIDIA empty-mode + cuda13.3 проверка (#488/#490/#491/#492) https://github.com/flagos-ai/build-infra/pull/492
5 build-infra vllm-plugin-FL чистая сборка Python (#489) https://github.com/flagos-ai/build-infra/pull/489
6 build-infra плановое обновление описания образа 2.1.2 (#481, 2 backends 2 passed) https://github.com/flagos-ai/build-infra/pull/481
7 Torch-FL исправление трансляции генератора CUDA-boxing RNG (#147) https://github.com/flagos-ai/Torch-FL/commit/147
8 vllm-plugin-FL исправление decode scale на Kunlunxin (#400, всё ещё открыт) https://github.com/flagos-ai/vllm-plugin-FL/pull/400
9 обзор репозиториев org (52 репозитория) https://api.github.com/orgs/flagos-ai/repos?per_page=100&sort=updated
10 поиск по коммитам (19 записей в окне) https://api.github.com/search/commits?q=org:flagos-ai+committer-date:%3E2026-08-23T02:18:00Z
11 gnews на китайском FlagOS/FlagGems/Институт Zhiyuan (ноль совпадений/удаление шума) https://news.google.com/rss/search?q=FlagOS+when%3A14d&hl=zh-CN&gl=CN&ceid=CN%3Azh-Hans
12 gnews на английском FlagOS/BAAI/компоненты (ноль совпадений) https://news.google.com/rss/search?q=FlagOS+when%3A3d&hl=en-US&gl=US&ceid=US%3Aen
13 HN Algolia (единственное совпадение по FlagOS — ложное срабатывание Hands-Rust) https://hn.algolia.com/api/v1/search_by_date?query=FlagOS
14 перекрёстная проверка Tavily (Ascend/Kunlunxin/status-matrix — дополнительных публикаций нет) https://www.tavily.com