Ежедневный отчёт FlagOS (2026-08-25)
Окно мониторинга: 2026-08-24 10:18 ~ 2026-08-25 10:18 пекинское время Источники: GitHub (org: flagos-ai 52 репозитория + commit search + PR/Release API), Google News RSS (9 групп запросов на китайском и английском, прокси-канал работает штатно), HN Algolia, перекрёстная проверка Tavily (подробности в приложении)
Индекс
-
- Прогресс open-source проектов (динамика GitHub)
- 1.1 Выпущен vllm-plugin-FL v0.3.0-rc0 — первый кандидат новой линейки версий после FlagOS 2.1 (главная новость окна) (08-24)
- 1.2 build-infra: расширение матрицы валидации vllm 0.20.2 — оба пути Moore Threads F/T пройдены полностью, app image MetaX развёрнут (08-24/08-25)
- 1.3 build-infra: ужесточение драйвера валидации — семантика «пройдено» повышена до реального E2E (08-24/08-25)
- 1.4 Torch-FL: реализованы три бэкенда torch.compile (MetaX/MUSA/Enflame GCU) (08-24)
- 1.5 FlagGems: расширение операторов KernelGen Nvidia на 13+, оптимизации под Ascend/Moore Threads (08-24/08-25)
- 1.6 FlagTensor/FlagDNN: запущена адаптация бэкенда Iluvatar компании Iluvatar CoreX (08-24/08-25)
- 1.7 Динамика других репозиториев (sglang-plugin-FL бэкенд Enflame, совместимость Qwen3.5, FlagTree, FlagSparse, FlagOS-Compressor)
- Прогресс open-source проектов (динамика GitHub)
-
- Новостные публикации и экосистема
- 2.1 Общая оценка новостной стороны (шестой день подряд нулевые попадания по компонентам)
- 2.2 Тенденции за последние 3 дня (подтверждается GitHub org pushed)
- 2.3 Исключённые пункты
- Новостные публикации и экосистема
-
- Углублённый анализ участников
-
- Итоги
- Приложение: полный список источников
1. Прогресс open-source проектов (динамика GitHub)
Обзор окна: из 52 репозиториев внутри org 13 имели пуш в окне; commit search дал 59 попаданий уникальных коммитов внутри окна (FlagGems 20, build-infra 19, Torch-FL 6, FlagSparse 6, FlagTensor 3, vllm-plugin-FL 2, FlagTree 1, FlagOS-Compressor 1, sglang-plugin-FL 1). Главная новость окна — выпуск vllm-plugin-FL v0.3.0-rc0 — первый кандидат новой линейки версий после FlagOS 2.1 (24.06), ориентирован на vLLM 0.24.0; основная линия данного окна — «расширение матрицы валидации на стороне инференса (Moore Threads и MetaX вступили в список) + реализация мультибэкендного torch.compile (MetaX/MUSA/GCU) + адаптация нового бэкенда Iluvatar компании Iluvatar CoreX».
1.1 Выпущен vllm-plugin-FL v0.3.0-rc0 — первый кандидат новой линейки версий после FlagOS 2.1 (главная новость окна)
Источник: Release v0.3.0-rc0 (выпущен 24.08 в 11:45 по пекинскому времени, target main, без метки prerelease)
- Первый кандидат линии v0.3.0: с момента синхронного релиза vllm-plugin-FL v0.2.0 вместе с FlagOS 2.1 от 24/06 это первый кандидат новой линии версий данного компонента. Линия 0.3 ориентирована на vLLM 0.24.0 (перекликается с той же линией проверок 0.24.0 для Kunlunxin 23-24/08), релизное действие попало в текущее окно мониторинга (tag создан 21/08, официальный релиз 24/08 в 11:45).
- Сопутствующая динамика: #403 version doc (24/08 14:26) дополняет документацию к релизу версии; #383 совместимость Qwen3.5 text-only во время выполнения (24/08 15:23 смержен в main) — для ветки v0.3.0-dev (целевой vLLM 0.24.0) добавляется поддержка text-only во время выполнения для Qwen3.5 dense и MoE: в upstream vLLM уже есть классы causal model, но нет полной регистрации канонического текстового config, вспомогательного hybrid cache и отображения VL-префикса checkpoint; слой совместимости ставится универсальным плагином, не изменяя пакет vLLM и скомпилированное расширение
_moe_C. Поскольку слияние произошло позже точки отсечения rc0 (11:45), ожидается попадание в последующий rc. - Наблюдаемый пункт остаётся: исправление decode scale для Kunlunxin PR #400 (линия base release/0.2) по-прежнему открыт —
patch_decode_attentionпри маршрутизации decode вprefill_attentionпередаёт исходный decode scale (1/sqrt(head_size)), а не ожидаемый adjusted scale (scale*sqrt(head_size)); примерно в 11 раз меньший alpha сглаживает softmax, что приводит к искажённому выводу decode Qwen3-4B на Kunlunxin P800 XPU; исправление — умножение на sqrt(head_size) (при head_size=128 scale=1.0).
Трактовка: ритм релиза 0.3.0-rc0 напрямую сцеплен с волной проверок 23-24/08 — проверки бэкендов Kunlunxin 0.24.0, NVIDIA cuda13.3 и других основаны на линии 0.24, а rc0 превращает эту линию в официального кандидата. Совместимость Qwen3.5 (#383) сразу вслед за этим смержена в mainline, что показывает: «совместимость с новыми моделями с Day0» остаётся ключевым ценностным предложением vllm-plugin-FL (перекликается с адаптацией DeepSeek-V4 на восьми чипах с Day0 в апреле).
1.2 build-infra: расширение матрицы проверок vllm 0.20.2 — полное прохождение обоих путей F/T для Moore Threads, приземление app image для MetaX
Источники: #506, #508, #510, #512, #514, #516, #521, #522 (24/08 14:58-21:55), #523 (24/08 22:37), #524 (25/08 08:43)
- Moore Threads (MThreads), двойной бэкенд, оба пути F/T полностью пройдены: #506 включает сборку app image vllm0.20.2 для
mthreads-musa4.3.6иmthreads-musa5.2.0(ключdeps_app.vllm0.20.2— это матричный шлюз workflow app-image); #508 фиксирует, что оба бэкенда на app image2.1.2-0.2.1(Qwen3-4B) прошли serve E2E по обоим путям FlagTree (F) и Triton (T), а также исправляет прежнее ложное сообщение «triton absent» (triton 3.6.0 установлен отдельно в/opt/tritonи становится видимым дляimportlib.metadataтолько послеcompiler()). - MetaX, приземление app image: #510 включает сборку 0.20.2 для бэкенда metax; #512/#514 фиксируют app image tag
2.1.2-0.2.1_g825c1cdдля двух версийmetax-maca3.7.2.1иmetax-maca3.8.1.3; #516 на шаге record выставляет deps_app и image_tag вместе; #521/#522 включают vllm-plugin-fl в путь full-install 0.20.2 и выводят версию плагина для каждого бэкенда по image_tag. - Завершение и сопутствующее: #523 закрывает экспериментальную запись бага triton attention у Kunlunxin (experiment closure, соответствует upstream PR #268); #524 для линии Ascend megatron встраивает torchvision/torchaudio в runtime deps.
Толкование: матрица валидации vllm 0.20.2 расширилась с трёх участников «NVIDIA, Kunlunxin, Ascend» до пяти — Moore Threads стал четвёртым бэкендом, завершившим полную валидацию с двумя компиляторами (причём оба поколения musa4.3.6/5.2.0 одновременно стали зелёными по обоим бэкендам), app image для двух версий maca у MetaX уже собран и приземлён, tag внесён в матрицу (явной записи о статусе прохождения F/T пока не видно, процесс в работе). Основная линия «коллективного позеленения матрицы валидации на стороне инференса» после вчерашнего Ascend продолжает распространяться на Moore Threads и MetaX; шаблонизация парадигмы валидации позволяет новому бэкенду пройти от включения сборки до фиксации валидации всего за часы.
1.3 build-infra: упрочнение, управляемое валидацией — семантика «пройдено» повышается до реального E2E
Источники: #517 (24.08 19:20), #518 (24.08 20:22), #519 (24.08 20:34), #520 (24.08 20:47), #525 (25.08 09:14)
- #517: повышение семантики маркера валидации. Ранее маркер «пройдено» в матрице определялся только кодом выхода verify-скрипта и по сути доказывал лишь «установка успешна + import не падает»; на этот раз в скрипт подключены уже проверенные E2E-рецепты для каждого бэкенда, «пройдено» = нагрузка реально отработала и код выхода 0 (serve-тест в
verify-vllm-backend.shпереведён в режим--app-image, при отсутствииMODEL_PATH— отказ). - #518: задача plan ранее собирала только столбец компилятора по умолчанию для каждой проверяемой ячейки (при наличии FlagTree — F, иначе — T), теперь оба столбца F/T собираются явно (оба verify-скрипта поддерживают
--compiler flagtree|triton). - #519/#520: ветка results переведена на пересборку из снапшота main (больше не rebase); одна неуспешная ячейка приводит к отказу всего verify job — ошибки больше не проглатываются молча.
- #525: проверка готовности serve заменена с фиксированного sleep 60 с на опрос readiness — валидация ускорена и стала надёжнее.
Толкование: это сопутствующее замыкание вчерашней системы status-matrix (перевод в YAML + автоматическая обратная запись при релизе) — сама логика принятия решений «машины состояний валидации» упрочняется: семантика маркера поднимается с «уровня установки» до «уровня нагрузки», оба столбца компиляторов принудительно валидируются явно, отказ не может быть скрыт. По мере расширения масштаба мультичиповой валидации достоверность результатов валидации становится следующим инженерным приоритетом build-infra.
1.4 Torch-FL: приземление трёх бэкендов torch.compile (MetaX/MUSA/Enflame GCU)
Источники: #158 (24.08, 17:28), #159 (24.08, 20:32), #160 (24.08, 16:59), #162 (24.08, 20:27), #164 (24.08, 21:03)
- #158: Внедрение верификации MetaX torch.compile (PR от Claude Code, проверка человеком-ревьюером @zhaoyinglia): на реальной сборке FlagTree MetaX прогнан интеграционный набор compile, исправлены два сбоя Inductor autotuning, проявлявшиеся только на официальном CPU torch wheel — потоковый shim MetaX ломал
Event.record(), а имя backend maca Triton протекало вtorch.device(); кроме того, vendor Triton из образа открыт для CI venv и добавлены регрессионные тесты. - #159: Прямая привязка MUSA torch.compile к torch_fl: для
ACCELERATOR=musaзарегистрированtorch.compile(backend="flagos"), реализованный через runtime Moore Threads FlagTree. В процессе были компромиссы: первоначальный вариант с fabricated-совместимым модулем для драйверногоimport torch_musaбыл отклонён мейнтейнером, который потребовал прямой привязки FlagTree к torch-fl, и только после этого изменения были приняты. - #160: Верификация Enflame GCU S60 AMP: сначала измерены ограничения платформы на реальном железе S60, затем
tests/integration/test_amp.pyпрошёл путь от полного skip до 25 успешных тестов, общая стратегияAutocastPrivateUse1работает. - #162/#164: для Enflame создан отдельный CI-конвейер wheel; CUDA CI также включён в тестирование torch.compile.
Трактовка: путь torch.compile движется от «эксперимента с одним backend» к «стандартной возможности для многих backend» — три backend, MetaX, MUSA и Enflame GCU, в один день внедрены/верифицированы, и всё на основе реальных измерений на железе. Модель сотрудничества, при которой AI-агент (Claude Code) помогает создавать PR, а человек-ревьюер осуществляет проверку, стала нормой в Torch-FL (#158/#159/#160 все следуют этой модели), что является новой чертой процесса open-source-сотрудничества в FlagOS.
1.5 FlagGems: расширение операторов KernelGen Nvidia на 13+, оптимизация для Ascend и Moore Threads
Источники: серия операторов KernelGen Nvidia (#3408/#4008/#5355/#5491/#5653/#5291/#5367/#5519/#5114/#5116/#5117/#5118/#5211, 24.08 14:07 — 25.08 07:01), #5383, #5675, #5684
- KernelGen: массовое расширение покрытия операторов Nvidia (13+ операторов Triton): семейство special-функций (special_bessel_y1, special_logit, special_log_ndtr), семейство RNN/LSTM (mkldnn_rnn_layer однослойный LSTM,
_cudnn_rnn_backwardобратный проход однослойного однонаправленного LSTM), семейство обратных проходов активаций (hardsigmoid/hardswish/hardtanh backward), семейство квантования (quantized_lstm, alpha_dropout_), тензорные операции (fliplr,_upsample_nearest_exact1d_backward, sym_constrain_range). Это продолжение последовательного расширения покрытия операторов torch со стороны KernelGen (автоматическая генерация операторов). - Ascend: #5383 оптимизация layout и bias epilogue для AddMM; серия исправлений вызова
torch.linalg.matrix_normна пути KMcompiler (#5707/#5708/#5712, 24.08 15:38–17:29). - Moore Threads: оптимизация override
constant_pad_ndдля бэкенда MTHREADS (#5675) и оптимизация пути FillCopy (#5684).
1.6 FlagTensor/FlagDNN: запуск адаптации бэкенда Iluvatar от Tianshu Zhixin
Источники: коммит FlagTensor iluvatar (24.08 23:33), FlagTensor #15 (25.08 10:03, влит), FlagDNN Iluvatar WIP (24.08 12:09–14:18)
- FlagTensor (библиотека тензорных примитивов Triton: unary 28 / binary 4 / contraction 6, аналог cuTensor, на базе FlagTree): исправлена совместимость с Triton 3.6 (flagtree 0.6.1 + iluvatar3.6) и добавлены tune_configs для Iluvatar; #15 вливает ветку iluvatar в main (25.08 10:03).
- FlagDNN: WIP Iluvatar backend adaptation (24.08 12:09) + синхронное слияние (#9, 24.08 12:20), а также исправления ascend (24.08 11:29).
Трактовка: Tianshu Zhixin (Iluvatar) стал новым активным бэкендом в этом окне мониторинга — адаптация запущена сразу в двух компонентах, FlagTensor и FlagDNN; вместе с ритмом пушей в репозитории вроде FlagPrism от 21.08 подключение отечественных чипов продолжает продвигаться по пути «поочерёдного включения компонентов матрицы».
1.7 Прочая динамика репозиториев
- sglang-plugin-FL: #42 feat: add enflame gcu (24.08, 15:01) — в плагин sglang добавлен бэкенд Enflame GCU, проверен на qwen3.6-27b и qwen3.6-35b-a3b.
- FlagTree: #1034 исправление выбора бэкенда HINT (24.08, 11:08); модуль TLE C++ генерирует python stubs и дополняет аннотации типов (24.08, 11:18); #1040 исправление PPU AABS min size (24.08, 23:43).
- FlagSparse: повышение устойчивости тестов DCU (test robust up) + #47 поэлементная проверка результатов dcu bsr spmv/spmm по матрицам (24.08, 14:46-21:02).
- FlagOS-Compressor: #6 calibrated GPTQ/AWQ + native AutoRound (24.08, 12:55) — чистый PyTorch AutoRound поддерживает симметричные W4A16/W8A16 (SignSGD, подстройка min/max, восстановление оптимальных параметров, каскадный вход квантования), алгоритм квантования отделён от упаковки checkpoint, поддержка устройств обобщена на CUDA/NPU/MLU/MUSA и регистрацию пользовательских устройств.
- docs / release-info / FlagCX: pushed_at в пределах окна, но в основную ветку в окне ничего не влито (синхронизация неосновных веток/рутинные обновления), что совпадает с картиной предыдущего дня.
2. Новости и экосистема
2.1 Общая оценка новостной стороны
Цепочка прокси Google News RSS работает нормально; из 9 групп запросов на китайском и английском (FlagOS/FlagGems/FlagScale+FlagTree+FlagPerf/Институт Zhiyuan открытый исходный код/Zhiyuan when:3d/BAAI open source и др.) по ключевым словам компонентов в окне нет ни одного прямого попадания — шестой день подряд новости уровня компонентов спокойны (20.08-25.08), что согласуется с исторической закономерностью; в HN Algolia обнаружены лишь нерелевантные ложные совпадения (Xiaomi Xring SoC, ложное срабатывание сканера ID и т. п.), они отброшены. Все попадания, связанные с Zhiyuan в окне, — это общие AI-новости, агрегированные и перепечатанные сообществом Zhiyuan (влияние Anthropic на занятость, снижение цен GPT-5.6, переход отца TPU Google в другую компанию, научная платформа DP Technology и др.), не имеющие прямой связи с FlagOS; серия репортажей «Lingjing Zhiyuan WRC 2026 Embodied Brain» после проверки оказалась посвящена Shanghai Lingjing Zhiyuan Technology Co., Ltd. (основана Сунь Бо, создана в 2025-07) — это не Институт Zhiyuan, отброшено (подробнее см. 2.3). На новостной стороне нет новых записей, достойных включения; основная часть настоящего отчёта — динамика GitHub.
2.2 Тренды за последние 3 дня (подтверждено GitHub org pushed)
| Дата | Активные репозитории | Основное содержание |
|---|---|---|
| 22.08~23.08 (вчерашнее окно) | build-infra(6), Megatron-LM-FL (ветка интеграции), FlagSparse(3) | E2E с двумя бэкендами Cambricon (без shim); E2E с двумя компиляторами Kunlunxin 0.20.2; запуск системы status-matrix; Ascend vllm 0.20.2 с двумя компиляторами, F/T полностью пройдены |
| 23.08~24.08 (вчерашнее окно) | build-infra(18), Torch-FL(1) | Kunlunxin vllm 0.24.0 с двумя компиляторами verified; NVIDIA cuda13.3 0.20.2 verified; перевод status-matrix на YAML; унификация чистой Python-сборки vllm-plugin-FL |
| 24.08~25.08 (текущее окно) | build-infra(19), FlagGems(20), Torch-FL(6), FlagSparse(6), FlagTensor(3), vllm-plugin-FL(2), FlagTree(1), FlagOS-Compressor(1), sglang-plugin-FL(1) | релиз vllm-plugin-FL v0.3.0-rc0; Moore Threads vllm 0.20.2, оба пути F/T полностью пройдены (два бэкенда musa); реализован app image MetaX; реализован torch.compile с тремя бэкендами (MetaX/MUSA/GCU); FlagGems KernelGen 13+ новых операторов; запущена адаптация Iluvatar (FlagTensor/FlagDNN) |
Оценка тенденций: Основная линия эволюционирует от «матрица верификации коллективно становится зелёной» к «расширение охвата матрицы верификации + ужесточение семантики верификации + параллельное продвижение новых возможностей вывода/компиляции». На стороне вывода (vllm 0.20.2) матрица уже охватывает полное прохождение обоих компиляторов у четырёх вендоров — NVIDIA, Kunlunxin, Ascend, Moore Threads — плюс выход app image у MetaX; torch.compile как кросс-бэкендовая способность компиляции в один день вышла на трёх бэкендах MetaX/MUSA/GCU, в сочетании с автоматической генерацией операторов FlagGems KernelGen, расширением покрытия и совместимостью с Qwen3.5 — все три линии возможностей FlagOS — «компиляция + операторы + плагин вывода» — углубляются в направлении мультичиповости; Iluvatar компании Tianshu Zhixin становится новой точкой подключения бэкенда (два компонента FlagTensor/FlagDNN). v0.3.0-rc0 — первый кандидат новой версионной линии после 2.1, ритм официального релиза связан с линией 0.24.0 Kunlunxin и статусом слияния совместимости с Qwen3.5 (#383).
2.3 Исключённые пункты
- «WRC 2026 завершается|Lingjing Zhiyuan определяет верхний предел индустрии на базе эмбоированного интеллектуального мозга» (Yibang Dongli.net 24/8), «Закрытие WRC 2026: эмбоированный интеллектуальный мозг становится ключевой базой „битвы за внедрение“» (Sohu 25/8) — «Lingjing Zhiyuan» — это Shanghai Lingjing Zhiyuan Technology Co., Ltd. (эмбоированный интеллектуальный мозг T300/T81, CEO Сунь Бо), а не BAAI; название содержит «Zhiyuan», что вызвало совпадение в gnews, после проверки исключено.
- Агрегированные перепечатки в окне мониторинга сообщества Zhiyuan (данные по занятости Anthropic, снижение цены GPT-5.6 Sol, переход «отца TPU» из Google в Anthropic, научно-исследовательская платформа DeepPotential, WRC от UBTech и другие материалы 24/8) — сообщество Zhiyuan является агрегатором новостей об AI, записи представляют собой общие отраслевые новости AI, не имеющие прямой связи с FlagOS.
- «Отчёт об исследовании рисков передового AI и реагирования на чрезвычайные ситуации (проект для обсуждения)» (сообщество Zhiyuan 24/8) — результат исследований BAAI в области безопасности, не динамика системного программного стека FlagOS.
- SEO-загрязнение от азартных игр («BAAI выпускает и открывает исходный код новой игры Kaiyuan Qipai», «загрузка приложения для спортивных ставок» и т. п. на womenofchina.com 21–24/8) — целые партии исключены по ключевым словам в заголовках.
- Репортаж об адаптации Qwen3.8-2.4T под девять чипов (14/8, сообщество Zhiyuan), обзор мероприятия AI Compiler (20/8) — старые новости за пределами окна.
- Попадания на HN (Xiaomi Xring SoC, ложные срабатывания ID scanner, Talk Like Claude Day) — ошибочные совпадения, не связанные с FlagOS.
3. Углублённое изучение организаций-участников
Граф динамики множества вендоров в окне мониторинга:
| Производитель | Чип/бэкенд | Динамика в окне мониторинга | Подтверждение |
|---|---|---|---|
| Zhiyuan | — | build-infra возглавляет расширение матрицы vllm (Moore Threads/MetaX) и упрочнение, управляемое верификацией (37 коммитов); выпущен vllm-plugin-FL v0.3.0-rc0; на стороне новостей шестой день подряд нулевые совпадения по компонентам | серия PR build-infra, релиз vllm-plugin-FL |
| Moore Threads | MThreads MUSA | vllm 0.20.2 app image: полный проход по обоим путям F/T (musa4.3.6 + musa5.2.0, image 2.1.2-0.2.1, #506/#508); torch.compile через FlagTree с прямой привязкой torch_fl (#159); оптимизация FlagGems constant_pad_nd (#5675/#5684) | build-infra #506/#508, Torch-FL #159, FlagGems #5675/#5684 |
| MetaX | MetaX MACA | реализован vllm 0.20.2 app image (maca3.7.2.1 + maca3.8.1.3, tag 2.1.2-0.2.1_g825c1cd, #510/#512/#514); верификация MetaX FlagTree torch.compile + покрытие CI (#158) | build-infra #510/#512/#514, Torch-FL #158 |
| Enflame | Enflame GCU | в sglang-plugin-FL добавлен бэкенд GCU (#42, практические тесты qwen3.6-27b/35b-a3b); верификация GCU S60 AMP: все 25 пунктов пройдены (#160); отдельный конвейер CI для wheel (#162) | sglang-plugin-FL #42, Torch-FL #160/#162 |
| Iluvatar | Iluvatar | старт адаптации нового бэкенда: совместимость FlagTensor с Triton 3.6 + iluvatar tune_configs + слияние ветки (#15); FlagDNN WIP Iluvatar backend (#9) | коммит FlagTensor, коммит FlagDNN |
| KunlunXin | KunlunXin XPU | завершение эксперимента по bug в triton attention (build-infra #523, соответствует upstream PR #268); исправление decode scale в vllm-plugin-FL #400 всё ещё открыто (линия release/0.2) | build-infra #523, vllm-plugin-FL #400 |
| Ascend (Huawei) | Ascend | runtime deps megatron: добавлены torchvision/torchaudio (#524); оптимизация layout AddMM в FlagGems (#5383) + исправление matrix_norm в KMcompiler (#5707/#5708/#5712) | build-infra #524, коммиты FlagGems |
| NVIDIA (эталон экосистемы) | CUDA | FlagGems KernelGen: 13+ новых операторов Triton (RNN/LSTM, обратное распространение активаций, специальные функции, семейство квантизации) | серия PR FlagGems |
| Cambricon / Hygon / Tsingmicro / Horizon | MLU / DCU / TXDA / BPU | на стороне открытого исходного кода новых слияний в окне нет (Cambricon уже отражён 8/22; на стороне Hygon FlagSparse DCU — повышение устойчивости тестов #47, не новая функциональность) | — |
Оценка тенденций: ключевые слова чиповой карты этого окна — «включение новых бэкендов + сквозное развёртывание возможностей компиляции по бэкендам». Moore Threads благодаря полному проходу по обоим путям F/T на двух бэкендах musa для vllm 0.20.2 стал четвёртым бэкендом матрицы с «полным проходом обоих компиляторов», MetaX следом завершил реализацию app image; torch.compile в один и тот же день верифицирован на трёх бэкендах — MetaX, MUSA и Enflame GCU, — что расширяет «покрытие мультичипового компиляционного стека» с фреймворков обучения на путь компиляции PyTorch; Iluvatar стал новой точкой подключения (два компонента FlagTensor/FlagDNN запустили адаптацию Iluvatar). Разработка с помощью AI agent (Claude Code создаёт PR + человек-reviewer контролирует качество) в Torch-FL стала нормой, сама модель открытой коллаборации тоже меняется.
4. Итоги
- Релиз vllm-plugin-FL v0.3.0-rc0 (главная новость окна мониторинга): первый кандидат новой линейки версий после FlagOS 2.1 (24/06) (выпущен 24/08 в 11:45), ориентирован на vLLM 0.24.0; совместимость с Qwen3.5 text-only (#383) влита в основную ветку после точки отсечения rc0, ожидается в последующих rc; исправление decode scale для Kunlunxin (#400) всё ещё открыто.
- Расширение матрицы проверки vllm 0.20.2: два бэкенда Moore Threads (musa4.3.6/5.2.0) полностью прошли оба пути F/T, став четвёртым бэкендом, полностью прошедшим оба компилятора (#506/#508); для двух версий maca Metax зафиксированы app image (#510/#512/#514). Процесс «от включения сборки нового бэкенда до фиксации проверки» шаблонизирован до почасового.
- Ужесточение проверочной инфраструктуры: семантика «пройдено» повышена с уровня установки до «реальный E2E workload выполнен успешно с кодом выхода 0» (#517); для столбцов двух компиляторов F/T введён обязательный явный сбор (#518); неуспешная ячейка приводит к падению verify job (#520); опрос готовности serve заменяет фиксированный sleep (#525) — статус мультичиповой проверки переходит в фазу «достоверности и аудируемости».
- Внедрение трёх бэкендов torch.compile: MetaX (#158), MUSA (#159, FlagTree с прямой привязкой torch_fl), Enflame GCU AMP (#160, все 25 тестов пройдены), плюс отдельный wheel CI для Enflame (#162); модель взаимодействия, при которой Claude Code создаёт PR, а человек-ревьюер контролирует качество, стала нормой.
- Запуск адаптации нового бэкенда Iluvatar от Iluvatar CoreX: FlagTensor (совместимость с Triton 3.6 + tune_configs, ветка влита #15) и FlagDNN (WIP backend) развиваются параллельно.
- Расширение покрытия операторов FlagGems KernelGen: на стороне Nvidia 13+ новых операторов (прямой и обратный проход RNN/LSTM, семейство обратных активаций, special-функции, семейство квантизации), исправления AddMM/KMcompiler для Ascend, оптимизация pad для Moore Threads; в sglang-plugin-FL добавлен бэкенд Enflame GCU (#42); в FlagOS-Compressor добавлена нативная квантизация AutoRound (#6).
- Шестой день подряд нулевых попаданий по компонентам на новостной стороне: сигналов официального релиза 2.x нет (тег build-infra по-прежнему на линии v2.1.x); на стороне экосистемы нет записей, подходящих для включения. Следующие точки наблюдения: выпуск официальной версии v0.3.0 (включая совместимость с Qwen3.5), влитие vllm-plugin-FL #400, статус проверки двух компиляторов Metax, степень завершённости адаптации FlagDNN/FlagTensor Iluvatar.
Описание ограничений: количество коммитов и время влития взяты из commit search и repos/commits API (поисковый индекс может немного запаздывать, для отдельных репозиториев pushed_at и коммиты основной ветки имеют различия синхронизации веток, что проверено через commits API); детали E2E-окружения build-infra приведены согласно описанию PR; «фиксация app image» для Metax не подразумевает вывод о завершённости их проверки F/T; время создания тега v0.3.0-rc0 (21/08) раньше действия выпуска (24/08), что отражено достоверно; по ссылкам-редиректам gnews невозможно получить основной текст, суждения на новостной стороне опираются на заголовки и перекрёстное подтверждение из нескольких источников, возможны пропуски низковесных китайскоязычных источников.
Приложение: полный список источников
| Номер | Событие | Ссылка на источник |
|---|---|---|
| 1 | Выпущен vllm-plugin-FL v0.3.0-rc0 | https://github.com/flagos-ai/vllm-plugin-FL/releases/tag/v0.3.0-rc0 |
| 2 | Совместимость vllm-plugin-FL с Qwen3.5 text-only (#383) | https://github.com/flagos-ai/vllm-plugin-FL/pull/383 |
| 3 | Исправление decode scale для Kunlunxin в vllm-plugin-FL (#400, всё ещё открыт) | https://github.com/flagos-ai/vllm-plugin-FL/pull/400 |
| 4 | build-infra: Moore Threads vllm 0.20.2 F/T оба пути полностью пройдены (#506/#508) | https://github.com/flagos-ai/build-infra/pull/508 |
| 5 | build-infra: Enflame vllm 0.20.2 app image (#510/#512/#514) | https://github.com/flagos-ai/build-infra/pull/512 |
| 6 | build-infra: усиление проверки драйверов (#517/#518/#519/#520/#525) | https://github.com/flagos-ai/build-infra/pull/517 |
| 7 | build-infra: завершение эксперимента с triton attention для Enflame (#523) | https://github.com/flagos-ai/build-infra/pull/523 |
| 8 | build-infra: runtime-зависимости megatron для Ascend (#524) | https://github.com/flagos-ai/build-infra/pull/524 |
| 9 | Torch-FL: проверка MetaX torch.compile (#158) | https://github.com/flagos-ai/Torch-FL/pull/158 |
| 10 | Torch-FL: прямая привязка MUSA torch.compile (#159) | https://github.com/flagos-ai/Torch-FL/pull/159 |
| 11 | Torch-FL: проверка Enflame GCU AMP (#160) | https://github.com/flagos-ai/Torch-FL/pull/160 |
| 12 | Torch-FL: Enflame wheel CI (#162) | https://github.com/flagos-ai/Torch-FL/pull/162 |
| 13 | FlagGems KernelGen: серия операторов Nvidia (#5519 и ещё 13+) | https://github.com/flagos-ai/FlagGems/pull/5519 |
| 14 | FlagGems: оптимизация AddMM для Ascend (#5383) | https://github.com/flagos-ai/FlagGems/pull/5383 |
| 15 | FlagGems: оптимизация pad для MTHREADS (#5675/#5684) | https://github.com/flagos-ai/FlagGems/pull/5675 |
| 16 | FlagTensor: адаптация Iluvatar (#15) | https://github.com/flagos-ai/FlagTensor/pull/15 |
| 17 | FlagDNN: Iluvatar WIP (#9) | https://github.com/flagos-ai/FlagDNN/pull/9 |
| 18 | sglang-plugin-FL: бэкенд Enflame GCU (#42) | https://github.com/flagos-ai/sglang-plugin-FL/pull/42 |
| 19 | FlagTree: HINT/#1040/TLE stubs | https://github.com/flagos-ai/FlagTree/pull/1040 |
| 20 | FlagSparse: проверка результатов bsr для DCU (#47) | https://github.com/flagos-ai/FlagSparse/pull/47 |
| 21 | FlagOS-Compressor: AutoRound (#6) | https://github.com/flagos-ai/FlagOS-Compressor/pull/6 |
| 22 | Обзор репозиториев org (52 репозитория, 13 активны в окне мониторинга) | https://api.github.com/orgs/flagos-ai/repos?per_page=100&sort=updated |
| 23 |
| commit search (59 уникальных коммитов в окне) | https://api.github.com/search/commits?q=org:flagos-ai+committer-date:%3E2026-08-24T02:18:00Z | |
| 24 | gnews, 9 групп запросов на китайском и английском (нулевые совпадения на уровне компонентов) | https://news.google.com/rss/search?q=FlagOS+when%3A14d&hl=zh-CN&gl=CN&ceid=CN%3Azh-Hans |
| 25 | HN Algolia (нерелевантные ложные совпадения) | https://hn.algolia.com/api/v1/search_by_date?query=FlagOS |
| 26 | Tavily перекрёстная проверка (проверка идентичности Lingjing Zhiyuan, отсутствие дополнительных сообщений о FlagOS) | https://www.tavily.com |