Окно мониторинга: 2026-08-24 10:18 ~ 2026-08-25 10:18 пекинское время Источники: GitHub (org: flagos-ai 52 репозитория + commit search + PR/Release API), Google News RSS (9 групп запросов на китайском и английском, прокси-канал работает штатно), HN Algolia, перекрёстная проверка Tavily (подробности в приложении)


Индекс

    1. Прогресс open-source проектов (динамика GitHub)
      • 1.1 Выпущен vllm-plugin-FL v0.3.0-rc0 — первый кандидат новой линейки версий после FlagOS 2.1 (главная новость окна) (08-24)
      • 1.2 build-infra: расширение матрицы валидации vllm 0.20.2 — оба пути Moore Threads F/T пройдены полностью, app image MetaX развёрнут (08-24/08-25)
      • 1.3 build-infra: ужесточение драйвера валидации — семантика «пройдено» повышена до реального E2E (08-24/08-25)
      • 1.4 Torch-FL: реализованы три бэкенда torch.compile (MetaX/MUSA/Enflame GCU) (08-24)
      • 1.5 FlagGems: расширение операторов KernelGen Nvidia на 13+, оптимизации под Ascend/Moore Threads (08-24/08-25)
      • 1.6 FlagTensor/FlagDNN: запущена адаптация бэкенда Iluvatar компании Iluvatar CoreX (08-24/08-25)
      • 1.7 Динамика других репозиториев (sglang-plugin-FL бэкенд Enflame, совместимость Qwen3.5, FlagTree, FlagSparse, FlagOS-Compressor)
    1. Новостные публикации и экосистема
      • 2.1 Общая оценка новостной стороны (шестой день подряд нулевые попадания по компонентам)
      • 2.2 Тенденции за последние 3 дня (подтверждается GitHub org pushed)
      • 2.3 Исключённые пункты
    1. Углублённый анализ участников
    1. Итоги
  • Приложение: полный список источников

1. Прогресс open-source проектов (динамика GitHub)

Обзор окна: из 52 репозиториев внутри org 13 имели пуш в окне; commit search дал 59 попаданий уникальных коммитов внутри окна (FlagGems 20, build-infra 19, Torch-FL 6, FlagSparse 6, FlagTensor 3, vllm-plugin-FL 2, FlagTree 1, FlagOS-Compressor 1, sglang-plugin-FL 1). Главная новость окна — выпуск vllm-plugin-FL v0.3.0-rc0 — первый кандидат новой линейки версий после FlagOS 2.1 (24.06), ориентирован на vLLM 0.24.0; основная линия данного окна — «расширение матрицы валидации на стороне инференса (Moore Threads и MetaX вступили в список) + реализация мультибэкендного torch.compile (MetaX/MUSA/GCU) + адаптация нового бэкенда Iluvatar компании Iluvatar CoreX».

1.1 Выпущен vllm-plugin-FL v0.3.0-rc0 — первый кандидат новой линейки версий после FlagOS 2.1 (главная новость окна)

Источник: Release v0.3.0-rc0 (выпущен 24.08 в 11:45 по пекинскому времени, target main, без метки prerelease)

  • Первый кандидат линии v0.3.0: с момента синхронного релиза vllm-plugin-FL v0.2.0 вместе с FlagOS 2.1 от 24/06 это первый кандидат новой линии версий данного компонента. Линия 0.3 ориентирована на vLLM 0.24.0 (перекликается с той же линией проверок 0.24.0 для Kunlunxin 23-24/08), релизное действие попало в текущее окно мониторинга (tag создан 21/08, официальный релиз 24/08 в 11:45).
  • Сопутствующая динамика: #403 version doc (24/08 14:26) дополняет документацию к релизу версии; #383 совместимость Qwen3.5 text-only во время выполнения (24/08 15:23 смержен в main) — для ветки v0.3.0-dev (целевой vLLM 0.24.0) добавляется поддержка text-only во время выполнения для Qwen3.5 dense и MoE: в upstream vLLM уже есть классы causal model, но нет полной регистрации канонического текстового config, вспомогательного hybrid cache и отображения VL-префикса checkpoint; слой совместимости ставится универсальным плагином, не изменяя пакет vLLM и скомпилированное расширение _moe_C. Поскольку слияние произошло позже точки отсечения rc0 (11:45), ожидается попадание в последующий rc.
  • Наблюдаемый пункт остаётся: исправление decode scale для Kunlunxin PR #400 (линия base release/0.2) по-прежнему открытpatch_decode_attention при маршрутизации decode в prefill_attention передаёт исходный decode scale (1/sqrt(head_size)), а не ожидаемый adjusted scale (scale*sqrt(head_size)); примерно в 11 раз меньший alpha сглаживает softmax, что приводит к искажённому выводу decode Qwen3-4B на Kunlunxin P800 XPU; исправление — умножение на sqrt(head_size) (при head_size=128 scale=1.0).

Трактовка: ритм релиза 0.3.0-rc0 напрямую сцеплен с волной проверок 23-24/08 — проверки бэкендов Kunlunxin 0.24.0, NVIDIA cuda13.3 и других основаны на линии 0.24, а rc0 превращает эту линию в официального кандидата. Совместимость Qwen3.5 (#383) сразу вслед за этим смержена в mainline, что показывает: «совместимость с новыми моделями с Day0» остаётся ключевым ценностным предложением vllm-plugin-FL (перекликается с адаптацией DeepSeek-V4 на восьми чипах с Day0 в апреле).

1.2 build-infra: расширение матрицы проверок vllm 0.20.2 — полное прохождение обоих путей F/T для Moore Threads, приземление app image для MetaX

Источники: #506, #508, #510, #512, #514, #516, #521, #522 (24/08 14:58-21:55), #523 (24/08 22:37), #524 (25/08 08:43)

  • Moore Threads (MThreads), двойной бэкенд, оба пути F/T полностью пройдены: #506 включает сборку app image vllm0.20.2 для mthreads-musa4.3.6 и mthreads-musa5.2.0 (ключ deps_app.vllm0.20.2 — это матричный шлюз workflow app-image); #508 фиксирует, что оба бэкенда на app image 2.1.2-0.2.1 (Qwen3-4B) прошли serve E2E по обоим путям FlagTree (F) и Triton (T), а также исправляет прежнее ложное сообщение «triton absent» (triton 3.6.0 установлен отдельно в /opt/triton и становится видимым для importlib.metadata только после compiler()).
  • MetaX, приземление app image: #510 включает сборку 0.20.2 для бэкенда metax; #512/#514 фиксируют app image tag 2.1.2-0.2.1_g825c1cd для двух версий metax-maca3.7.2.1 и metax-maca3.8.1.3; #516 на шаге record выставляет deps_app и image_tag вместе; #521/#522 включают vllm-plugin-fl в путь full-install 0.20.2 и выводят версию плагина для каждого бэкенда по image_tag.
  • Завершение и сопутствующее: #523 закрывает экспериментальную запись бага triton attention у Kunlunxin (experiment closure, соответствует upstream PR #268); #524 для линии Ascend megatron встраивает torchvision/torchaudio в runtime deps.

Толкование: матрица валидации vllm 0.20.2 расширилась с трёх участников «NVIDIA, Kunlunxin, Ascend» до пяти — Moore Threads стал четвёртым бэкендом, завершившим полную валидацию с двумя компиляторами (причём оба поколения musa4.3.6/5.2.0 одновременно стали зелёными по обоим бэкендам), app image для двух версий maca у MetaX уже собран и приземлён, tag внесён в матрицу (явной записи о статусе прохождения F/T пока не видно, процесс в работе). Основная линия «коллективного позеленения матрицы валидации на стороне инференса» после вчерашнего Ascend продолжает распространяться на Moore Threads и MetaX; шаблонизация парадигмы валидации позволяет новому бэкенду пройти от включения сборки до фиксации валидации всего за часы.

1.3 build-infra: упрочнение, управляемое валидацией — семантика «пройдено» повышается до реального E2E

Источники: #517 (24.08 19:20), #518 (24.08 20:22), #519 (24.08 20:34), #520 (24.08 20:47), #525 (25.08 09:14)

  • #517: повышение семантики маркера валидации. Ранее маркер «пройдено» в матрице определялся только кодом выхода verify-скрипта и по сути доказывал лишь «установка успешна + import не падает»; на этот раз в скрипт подключены уже проверенные E2E-рецепты для каждого бэкенда, «пройдено» = нагрузка реально отработала и код выхода 0 (serve-тест в verify-vllm-backend.sh переведён в режим --app-image, при отсутствии MODEL_PATH — отказ).
  • #518: задача plan ранее собирала только столбец компилятора по умолчанию для каждой проверяемой ячейки (при наличии FlagTree — F, иначе — T), теперь оба столбца F/T собираются явно (оба verify-скрипта поддерживают --compiler flagtree|triton).
  • #519/#520: ветка results переведена на пересборку из снапшота main (больше не rebase); одна неуспешная ячейка приводит к отказу всего verify job — ошибки больше не проглатываются молча.
  • #525: проверка готовности serve заменена с фиксированного sleep 60 с на опрос readiness — валидация ускорена и стала надёжнее.

Толкование: это сопутствующее замыкание вчерашней системы status-matrix (перевод в YAML + автоматическая обратная запись при релизе) — сама логика принятия решений «машины состояний валидации» упрочняется: семантика маркера поднимается с «уровня установки» до «уровня нагрузки», оба столбца компиляторов принудительно валидируются явно, отказ не может быть скрыт. По мере расширения масштаба мультичиповой валидации достоверность результатов валидации становится следующим инженерным приоритетом build-infra.

1.4 Torch-FL: приземление трёх бэкендов torch.compile (MetaX/MUSA/Enflame GCU)

Источники: #158 (24.08, 17:28), #159 (24.08, 20:32), #160 (24.08, 16:59), #162 (24.08, 20:27), #164 (24.08, 21:03)

  • #158: Внедрение верификации MetaX torch.compile (PR от Claude Code, проверка человеком-ревьюером @zhaoyinglia): на реальной сборке FlagTree MetaX прогнан интеграционный набор compile, исправлены два сбоя Inductor autotuning, проявлявшиеся только на официальном CPU torch wheel — потоковый shim MetaX ломал Event.record(), а имя backend maca Triton протекало в torch.device(); кроме того, vendor Triton из образа открыт для CI venv и добавлены регрессионные тесты.
  • #159: Прямая привязка MUSA torch.compile к torch_fl: для ACCELERATOR=musa зарегистрирован torch.compile(backend="flagos"), реализованный через runtime Moore Threads FlagTree. В процессе были компромиссы: первоначальный вариант с fabricated-совместимым модулем для драйверного import torch_musa был отклонён мейнтейнером, который потребовал прямой привязки FlagTree к torch-fl, и только после этого изменения были приняты.
  • #160: Верификация Enflame GCU S60 AMP: сначала измерены ограничения платформы на реальном железе S60, затем tests/integration/test_amp.py прошёл путь от полного skip до 25 успешных тестов, общая стратегия AutocastPrivateUse1 работает.
  • #162/#164: для Enflame создан отдельный CI-конвейер wheel; CUDA CI также включён в тестирование torch.compile.

Трактовка: путь torch.compile движется от «эксперимента с одним backend» к «стандартной возможности для многих backend» — три backend, MetaX, MUSA и Enflame GCU, в один день внедрены/верифицированы, и всё на основе реальных измерений на железе. Модель сотрудничества, при которой AI-агент (Claude Code) помогает создавать PR, а человек-ревьюер осуществляет проверку, стала нормой в Torch-FL (#158/#159/#160 все следуют этой модели), что является новой чертой процесса open-source-сотрудничества в FlagOS.

1.5 FlagGems: расширение операторов KernelGen Nvidia на 13+, оптимизация для Ascend и Moore Threads

Источники: серия операторов KernelGen Nvidia (#3408/#4008/#5355/#5491/#5653/#5291/#5367/#5519/#5114/#5116/#5117/#5118/#5211, 24.08 14:07 — 25.08 07:01), #5383, #5675, #5684

  • KernelGen: массовое расширение покрытия операторов Nvidia (13+ операторов Triton): семейство special-функций (special_bessel_y1, special_logit, special_log_ndtr), семейство RNN/LSTM (mkldnn_rnn_layer однослойный LSTM, _cudnn_rnn_backward обратный проход однослойного однонаправленного LSTM), семейство обратных проходов активаций (hardsigmoid/hardswish/hardtanh backward), семейство квантования (quantized_lstm, alpha_dropout_), тензорные операции (fliplr, _upsample_nearest_exact1d_backward, sym_constrain_range). Это продолжение последовательного расширения покрытия операторов torch со стороны KernelGen (автоматическая генерация операторов).
  • Ascend: #5383 оптимизация layout и bias epilogue для AddMM; серия исправлений вызова torch.linalg.matrix_norm на пути KMcompiler (#5707/#5708/#5712, 24.08 15:38–17:29).
  • Moore Threads: оптимизация override constant_pad_nd для бэкенда MTHREADS (#5675) и оптимизация пути FillCopy (#5684).

1.6 FlagTensor/FlagDNN: запуск адаптации бэкенда Iluvatar от Tianshu Zhixin

Источники: коммит FlagTensor iluvatar (24.08 23:33), FlagTensor #15 (25.08 10:03, влит), FlagDNN Iluvatar WIP (24.08 12:09–14:18)

  • FlagTensor (библиотека тензорных примитивов Triton: unary 28 / binary 4 / contraction 6, аналог cuTensor, на базе FlagTree): исправлена совместимость с Triton 3.6 (flagtree 0.6.1 + iluvatar3.6) и добавлены tune_configs для Iluvatar; #15 вливает ветку iluvatar в main (25.08 10:03).
  • FlagDNN: WIP Iluvatar backend adaptation (24.08 12:09) + синхронное слияние (#9, 24.08 12:20), а также исправления ascend (24.08 11:29).

Трактовка: Tianshu Zhixin (Iluvatar) стал новым активным бэкендом в этом окне мониторинга — адаптация запущена сразу в двух компонентах, FlagTensor и FlagDNN; вместе с ритмом пушей в репозитории вроде FlagPrism от 21.08 подключение отечественных чипов продолжает продвигаться по пути «поочерёдного включения компонентов матрицы».

1.7 Прочая динамика репозиториев

  • sglang-plugin-FL: #42 feat: add enflame gcu (24.08, 15:01) — в плагин sglang добавлен бэкенд Enflame GCU, проверен на qwen3.6-27b и qwen3.6-35b-a3b.
  • FlagTree: #1034 исправление выбора бэкенда HINT (24.08, 11:08); модуль TLE C++ генерирует python stubs и дополняет аннотации типов (24.08, 11:18); #1040 исправление PPU AABS min size (24.08, 23:43).
  • FlagSparse: повышение устойчивости тестов DCU (test robust up) + #47 поэлементная проверка результатов dcu bsr spmv/spmm по матрицам (24.08, 14:46-21:02).
  • FlagOS-Compressor: #6 calibrated GPTQ/AWQ + native AutoRound (24.08, 12:55) — чистый PyTorch AutoRound поддерживает симметричные W4A16/W8A16 (SignSGD, подстройка min/max, восстановление оптимальных параметров, каскадный вход квантования), алгоритм квантования отделён от упаковки checkpoint, поддержка устройств обобщена на CUDA/NPU/MLU/MUSA и регистрацию пользовательских устройств.
  • docs / release-info / FlagCX: pushed_at в пределах окна, но в основную ветку в окне ничего не влито (синхронизация неосновных веток/рутинные обновления), что совпадает с картиной предыдущего дня.

2. Новости и экосистема

2.1 Общая оценка новостной стороны

Цепочка прокси Google News RSS работает нормально; из 9 групп запросов на китайском и английском (FlagOS/FlagGems/FlagScale+FlagTree+FlagPerf/Институт Zhiyuan открытый исходный код/Zhiyuan when:3d/BAAI open source и др.) по ключевым словам компонентов в окне нет ни одного прямого попадания — шестой день подряд новости уровня компонентов спокойны (20.08-25.08), что согласуется с исторической закономерностью; в HN Algolia обнаружены лишь нерелевантные ложные совпадения (Xiaomi Xring SoC, ложное срабатывание сканера ID и т. п.), они отброшены. Все попадания, связанные с Zhiyuan в окне, — это общие AI-новости, агрегированные и перепечатанные сообществом Zhiyuan (влияние Anthropic на занятость, снижение цен GPT-5.6, переход отца TPU Google в другую компанию, научная платформа DP Technology и др.), не имеющие прямой связи с FlagOS; серия репортажей «Lingjing Zhiyuan WRC 2026 Embodied Brain» после проверки оказалась посвящена Shanghai Lingjing Zhiyuan Technology Co., Ltd. (основана Сунь Бо, создана в 2025-07) — это не Институт Zhiyuan, отброшено (подробнее см. 2.3). На новостной стороне нет новых записей, достойных включения; основная часть настоящего отчёта — динамика GitHub.

2.2 Тренды за последние 3 дня (подтверждено GitHub org pushed)

Дата Активные репозитории Основное содержание
22.08~23.08 (вчерашнее окно) build-infra(6), Megatron-LM-FL (ветка интеграции), FlagSparse(3) E2E с двумя бэкендами Cambricon (без shim); E2E с двумя компиляторами Kunlunxin 0.20.2; запуск системы status-matrix; Ascend vllm 0.20.2 с двумя компиляторами, F/T полностью пройдены
23.08~24.08 (вчерашнее окно) build-infra(18), Torch-FL(1) Kunlunxin vllm 0.24.0 с двумя компиляторами verified; NVIDIA cuda13.3 0.20.2 verified; перевод status-matrix на YAML; унификация чистой Python-сборки vllm-plugin-FL
24.08~25.08 (текущее окно) build-infra(19), FlagGems(20), Torch-FL(6), FlagSparse(6), FlagTensor(3), vllm-plugin-FL(2), FlagTree(1), FlagOS-Compressor(1), sglang-plugin-FL(1) релиз vllm-plugin-FL v0.3.0-rc0; Moore Threads vllm 0.20.2, оба пути F/T полностью пройдены (два бэкенда musa); реализован app image MetaX; реализован torch.compile с тремя бэкендами (MetaX/MUSA/GCU); FlagGems KernelGen 13+ новых операторов; запущена адаптация Iluvatar (FlagTensor/FlagDNN)

Оценка тенденций: Основная линия эволюционирует от «матрица верификации коллективно становится зелёной» к «расширение охвата матрицы верификации + ужесточение семантики верификации + параллельное продвижение новых возможностей вывода/компиляции». На стороне вывода (vllm 0.20.2) матрица уже охватывает полное прохождение обоих компиляторов у четырёх вендоров — NVIDIA, Kunlunxin, Ascend, Moore Threads — плюс выход app image у MetaX; torch.compile как кросс-бэкендовая способность компиляции в один день вышла на трёх бэкендах MetaX/MUSA/GCU, в сочетании с автоматической генерацией операторов FlagGems KernelGen, расширением покрытия и совместимостью с Qwen3.5 — все три линии возможностей FlagOS — «компиляция + операторы + плагин вывода» — углубляются в направлении мультичиповости; Iluvatar компании Tianshu Zhixin становится новой точкой подключения бэкенда (два компонента FlagTensor/FlagDNN). v0.3.0-rc0 — первый кандидат новой версионной линии после 2.1, ритм официального релиза связан с линией 0.24.0 Kunlunxin и статусом слияния совместимости с Qwen3.5 (#383).

2.3 Исключённые пункты

  • «WRC 2026 завершается|Lingjing Zhiyuan определяет верхний предел индустрии на базе эмбоированного интеллектуального мозга» (Yibang Dongli.net 24/8), «Закрытие WRC 2026: эмбоированный интеллектуальный мозг становится ключевой базой „битвы за внедрение“» (Sohu 25/8) — «Lingjing Zhiyuan» — это Shanghai Lingjing Zhiyuan Technology Co., Ltd. (эмбоированный интеллектуальный мозг T300/T81, CEO Сунь Бо), а не BAAI; название содержит «Zhiyuan», что вызвало совпадение в gnews, после проверки исключено.
  • Агрегированные перепечатки в окне мониторинга сообщества Zhiyuan (данные по занятости Anthropic, снижение цены GPT-5.6 Sol, переход «отца TPU» из Google в Anthropic, научно-исследовательская платформа DeepPotential, WRC от UBTech и другие материалы 24/8) — сообщество Zhiyuan является агрегатором новостей об AI, записи представляют собой общие отраслевые новости AI, не имеющие прямой связи с FlagOS.
  • «Отчёт об исследовании рисков передового AI и реагирования на чрезвычайные ситуации (проект для обсуждения)» (сообщество Zhiyuan 24/8) — результат исследований BAAI в области безопасности, не динамика системного программного стека FlagOS.
  • SEO-загрязнение от азартных игр («BAAI выпускает и открывает исходный код новой игры Kaiyuan Qipai», «загрузка приложения для спортивных ставок» и т. п. на womenofchina.com 21–24/8) — целые партии исключены по ключевым словам в заголовках.
  • Репортаж об адаптации Qwen3.8-2.4T под девять чипов (14/8, сообщество Zhiyuan), обзор мероприятия AI Compiler (20/8) — старые новости за пределами окна.
  • Попадания на HN (Xiaomi Xring SoC, ложные срабатывания ID scanner, Talk Like Claude Day) — ошибочные совпадения, не связанные с FlagOS.

3. Углублённое изучение организаций-участников

Граф динамики множества вендоров в окне мониторинга:

Производитель Чип/бэкенд Динамика в окне мониторинга Подтверждение
Zhiyuan build-infra возглавляет расширение матрицы vllm (Moore Threads/MetaX) и упрочнение, управляемое верификацией (37 коммитов); выпущен vllm-plugin-FL v0.3.0-rc0; на стороне новостей шестой день подряд нулевые совпадения по компонентам серия PR build-infra, релиз vllm-plugin-FL
Moore Threads MThreads MUSA vllm 0.20.2 app image: полный проход по обоим путям F/T (musa4.3.6 + musa5.2.0, image 2.1.2-0.2.1, #506/#508); torch.compile через FlagTree с прямой привязкой torch_fl (#159); оптимизация FlagGems constant_pad_nd (#5675/#5684) build-infra #506/#508, Torch-FL #159, FlagGems #5675/#5684
MetaX MetaX MACA реализован vllm 0.20.2 app image (maca3.7.2.1 + maca3.8.1.3, tag 2.1.2-0.2.1_g825c1cd, #510/#512/#514); верификация MetaX FlagTree torch.compile + покрытие CI (#158) build-infra #510/#512/#514, Torch-FL #158
Enflame Enflame GCU в sglang-plugin-FL добавлен бэкенд GCU (#42, практические тесты qwen3.6-27b/35b-a3b); верификация GCU S60 AMP: все 25 пунктов пройдены (#160); отдельный конвейер CI для wheel (#162) sglang-plugin-FL #42, Torch-FL #160/#162
Iluvatar Iluvatar старт адаптации нового бэкенда: совместимость FlagTensor с Triton 3.6 + iluvatar tune_configs + слияние ветки (#15); FlagDNN WIP Iluvatar backend (#9) коммит FlagTensor, коммит FlagDNN
KunlunXin KunlunXin XPU завершение эксперимента по bug в triton attention (build-infra #523, соответствует upstream PR #268); исправление decode scale в vllm-plugin-FL #400 всё ещё открыто (линия release/0.2) build-infra #523, vllm-plugin-FL #400
Ascend (Huawei) Ascend runtime deps megatron: добавлены torchvision/torchaudio (#524); оптимизация layout AddMM в FlagGems (#5383) + исправление matrix_norm в KMcompiler (#5707/#5708/#5712) build-infra #524, коммиты FlagGems
NVIDIA (эталон экосистемы) CUDA FlagGems KernelGen: 13+ новых операторов Triton (RNN/LSTM, обратное распространение активаций, специальные функции, семейство квантизации) серия PR FlagGems
Cambricon / Hygon / Tsingmicro / Horizon MLU / DCU / TXDA / BPU на стороне открытого исходного кода новых слияний в окне нет (Cambricon уже отражён 8/22; на стороне Hygon FlagSparse DCU — повышение устойчивости тестов #47, не новая функциональность)

Оценка тенденций: ключевые слова чиповой карты этого окна — «включение новых бэкендов + сквозное развёртывание возможностей компиляции по бэкендам». Moore Threads благодаря полному проходу по обоим путям F/T на двух бэкендах musa для vllm 0.20.2 стал четвёртым бэкендом матрицы с «полным проходом обоих компиляторов», MetaX следом завершил реализацию app image; torch.compile в один и тот же день верифицирован на трёх бэкендах — MetaX, MUSA и Enflame GCU, — что расширяет «покрытие мультичипового компиляционного стека» с фреймворков обучения на путь компиляции PyTorch; Iluvatar стал новой точкой подключения (два компонента FlagTensor/FlagDNN запустили адаптацию Iluvatar). Разработка с помощью AI agent (Claude Code создаёт PR + человек-reviewer контролирует качество) в Torch-FL стала нормой, сама модель открытой коллаборации тоже меняется.


4. Итоги

  1. Релиз vllm-plugin-FL v0.3.0-rc0 (главная новость окна мониторинга): первый кандидат новой линейки версий после FlagOS 2.1 (24/06) (выпущен 24/08 в 11:45), ориентирован на vLLM 0.24.0; совместимость с Qwen3.5 text-only (#383) влита в основную ветку после точки отсечения rc0, ожидается в последующих rc; исправление decode scale для Kunlunxin (#400) всё ещё открыто.
  2. Расширение матрицы проверки vllm 0.20.2: два бэкенда Moore Threads (musa4.3.6/5.2.0) полностью прошли оба пути F/T, став четвёртым бэкендом, полностью прошедшим оба компилятора (#506/#508); для двух версий maca Metax зафиксированы app image (#510/#512/#514). Процесс «от включения сборки нового бэкенда до фиксации проверки» шаблонизирован до почасового.
  3. Ужесточение проверочной инфраструктуры: семантика «пройдено» повышена с уровня установки до «реальный E2E workload выполнен успешно с кодом выхода 0» (#517); для столбцов двух компиляторов F/T введён обязательный явный сбор (#518); неуспешная ячейка приводит к падению verify job (#520); опрос готовности serve заменяет фиксированный sleep (#525) — статус мультичиповой проверки переходит в фазу «достоверности и аудируемости».
  4. Внедрение трёх бэкендов torch.compile: MetaX (#158), MUSA (#159, FlagTree с прямой привязкой torch_fl), Enflame GCU AMP (#160, все 25 тестов пройдены), плюс отдельный wheel CI для Enflame (#162); модель взаимодействия, при которой Claude Code создаёт PR, а человек-ревьюер контролирует качество, стала нормой.
  5. Запуск адаптации нового бэкенда Iluvatar от Iluvatar CoreX: FlagTensor (совместимость с Triton 3.6 + tune_configs, ветка влита #15) и FlagDNN (WIP backend) развиваются параллельно.
  6. Расширение покрытия операторов FlagGems KernelGen: на стороне Nvidia 13+ новых операторов (прямой и обратный проход RNN/LSTM, семейство обратных активаций, special-функции, семейство квантизации), исправления AddMM/KMcompiler для Ascend, оптимизация pad для Moore Threads; в sglang-plugin-FL добавлен бэкенд Enflame GCU (#42); в FlagOS-Compressor добавлена нативная квантизация AutoRound (#6).
  7. Шестой день подряд нулевых попаданий по компонентам на новостной стороне: сигналов официального релиза 2.x нет (тег build-infra по-прежнему на линии v2.1.x); на стороне экосистемы нет записей, подходящих для включения. Следующие точки наблюдения: выпуск официальной версии v0.3.0 (включая совместимость с Qwen3.5), влитие vllm-plugin-FL #400, статус проверки двух компиляторов Metax, степень завершённости адаптации FlagDNN/FlagTensor Iluvatar.

Описание ограничений: количество коммитов и время влития взяты из commit search и repos/commits API (поисковый индекс может немного запаздывать, для отдельных репозиториев pushed_at и коммиты основной ветки имеют различия синхронизации веток, что проверено через commits API); детали E2E-окружения build-infra приведены согласно описанию PR; «фиксация app image» для Metax не подразумевает вывод о завершённости их проверки F/T; время создания тега v0.3.0-rc0 (21/08) раньше действия выпуска (24/08), что отражено достоверно; по ссылкам-редиректам gnews невозможно получить основной текст, суждения на новостной стороне опираются на заголовки и перекрёстное подтверждение из нескольких источников, возможны пропуски низковесных китайскоязычных источников.


Приложение: полный список источников

Номер Событие Ссылка на источник
1 Выпущен vllm-plugin-FL v0.3.0-rc0 https://github.com/flagos-ai/vllm-plugin-FL/releases/tag/v0.3.0-rc0
2 Совместимость vllm-plugin-FL с Qwen3.5 text-only (#383) https://github.com/flagos-ai/vllm-plugin-FL/pull/383
3 Исправление decode scale для Kunlunxin в vllm-plugin-FL (#400, всё ещё открыт) https://github.com/flagos-ai/vllm-plugin-FL/pull/400
4 build-infra: Moore Threads vllm 0.20.2 F/T оба пути полностью пройдены (#506/#508) https://github.com/flagos-ai/build-infra/pull/508
5 build-infra: Enflame vllm 0.20.2 app image (#510/#512/#514) https://github.com/flagos-ai/build-infra/pull/512
6 build-infra: усиление проверки драйверов (#517/#518/#519/#520/#525) https://github.com/flagos-ai/build-infra/pull/517
7 build-infra: завершение эксперимента с triton attention для Enflame (#523) https://github.com/flagos-ai/build-infra/pull/523
8 build-infra: runtime-зависимости megatron для Ascend (#524) https://github.com/flagos-ai/build-infra/pull/524
9 Torch-FL: проверка MetaX torch.compile (#158) https://github.com/flagos-ai/Torch-FL/pull/158
10 Torch-FL: прямая привязка MUSA torch.compile (#159) https://github.com/flagos-ai/Torch-FL/pull/159
11 Torch-FL: проверка Enflame GCU AMP (#160) https://github.com/flagos-ai/Torch-FL/pull/160
12 Torch-FL: Enflame wheel CI (#162) https://github.com/flagos-ai/Torch-FL/pull/162
13 FlagGems KernelGen: серия операторов Nvidia (#5519 и ещё 13+) https://github.com/flagos-ai/FlagGems/pull/5519
14 FlagGems: оптимизация AddMM для Ascend (#5383) https://github.com/flagos-ai/FlagGems/pull/5383
15 FlagGems: оптимизация pad для MTHREADS (#5675/#5684) https://github.com/flagos-ai/FlagGems/pull/5675
16 FlagTensor: адаптация Iluvatar (#15) https://github.com/flagos-ai/FlagTensor/pull/15
17 FlagDNN: Iluvatar WIP (#9) https://github.com/flagos-ai/FlagDNN/pull/9
18 sglang-plugin-FL: бэкенд Enflame GCU (#42) https://github.com/flagos-ai/sglang-plugin-FL/pull/42
19 FlagTree: HINT/#1040/TLE stubs https://github.com/flagos-ai/FlagTree/pull/1040
20 FlagSparse: проверка результатов bsr для DCU (#47) https://github.com/flagos-ai/FlagSparse/pull/47
21 FlagOS-Compressor: AutoRound (#6) https://github.com/flagos-ai/FlagOS-Compressor/pull/6
22 Обзор репозиториев org (52 репозитория, 13 активны в окне мониторинга) https://api.github.com/orgs/flagos-ai/repos?per_page=100&sort=updated
23    
commit search (59 уникальных коммитов в окне) https://api.github.com/search/commits?q=org:flagos-ai+committer-date:%3E2026-08-24T02:18:00Z  
24 gnews, 9 групп запросов на китайском и английском (нулевые совпадения на уровне компонентов) https://news.google.com/rss/search?q=FlagOS+when%3A14d&hl=zh-CN&gl=CN&ceid=CN%3Azh-Hans
25 HN Algolia (нерелевантные ложные совпадения) https://hn.algolia.com/api/v1/search_by_date?query=FlagOS
26 Tavily перекрёстная проверка (проверка идентичности Lingjing Zhiyuan, отсутствие дополнительных сообщений о FlagOS) https://www.tavily.com