Ежедневный отчёт FlagOS (2026-09-30)
Окно мониторинга: 2026-09-29 10:00 ~ 2026-09-30 10:00 (24 часа; окно среды; продолжение окна ежедневного отчёта от 09-29, без пропусков) Источники: GitHub (org: flagos-ai, полная проверка pushed_at по 54 репозиториям, в окне активны 16 репозиториев, в 12 репозиториях есть коммиты в окне; поиск коммитов — полная поштучная проверка 168 записей; также проверены теги и Release-артефакты Torch-FL / FlagScale / FlagGems-vllm / FlagGems-sglang / FlagTree, community #124 ~ #125, около 30 записей слияния в build-infra, пакет документов docs, 7 развёртываний портала release-info, активность на уровне веток FlagFFT), Google News RSS (24 группы поисковых запросов на китайском и английском, через прокси), материалы Ifeng / Sina Finance и др. (подробности в приложении со списком источников)
Индекс выпуска
- Главное за сегодня: релиз Torch-FL v2.10.0 зафиксирован в репозитории — последний пункт списка FlagOS 2.2 закрыт (09-29)
-
- Прогресс открытых проектов (динамика GitHub)
- 1.1 Torch-FL: официальный релиз v2.10.0 — последний пункт 2.2 закрыт (09-29)
- 1.2 Torch-FL (часть 2): итерация конвейера релиза — от кандидатных тегов до вендорских wheel (09-29 ~ 09-30)
- 1.3 community: финальные правки двух коммитов и политика контрольных точек по восьми репозиториям (09-29)
- 1.4 Обновление релизных артефактов: пересборка тегов FlagScale и Release двух репозиториев серии FlagGems (09-29)
- 1.5 build-infra: завершение записей по трём линиям зеркал — mthreads / ascend / enflame (09-29 ~ 09-30)
- 1.6 FlagGems: пакет операторов KernelGen и пакет производительности Ascend (09-29 ~ 09-30)
- 1.7 FlagGems-vllm / FlagGems-Experimental: ядра KMCompiler и линия 5.5 alpha (09-29 ~ 09-30)
- 1.8 FlagTree: теги постпатчей metax и рабочий процесс планирования по всем бэкендам (09-29)
- 1.9 FlagQuantum: маршрутизация каталогов ядер и пакет слияния производительности (09-29 ~ 09-30)
- 1.10 Прочая динамика: FlagCX / FlagFFT / FlagAttention / docs / vllm-plugin-FL (09-29 ~ 09-30)
- Прогресс открытых проектов (динамика GitHub)
-
- Новостные публикации и экосистема
- 2.1 Компонентный поиск — двадцать третье подряд спокойное окно (09-29 ~ 09-30)
- 2.2 Moore Threads: три месяца работы национального центра интеллектуальных вычислений в Уси (Хуэйшань) — внедрение шести интеллектуальных агентов (09-29)
- Новостные публикации и экосистема
-
- Углублённый анализ по организациям-участникам
- 3.1 Moore Threads: пакет зеркал musa, ветка оптимизации MUSA 3D и промышленность Уси (09-29)
- 3.2 Ascend: четыре варианта megatron 0.18.2 и пакет производительности FlagGems (09-29)
- 3.3 Hygon / MetaX: пакет операторов производительности и постпатчи metax (09-29)
- 3.4 Enflame / Iluvatar CoreX: пакет зеркал и ядра слияния iluvatar (09-29 ~ 09-30)
- 3.5 Kunlunxin / Cambricon / XuanTie DAMO Academy / Horizon Robotics: остальные ключевые пункты (09-29 ~ 09-30)
- Углублённый анализ по организациям-участникам
-
- Итоги и наблюдения за трендами
- Приложение: таблица проверки источников
- Полный список источников
Главное за сегодня: релиз Torch-FL v2.10.0 зафиксирован в репозитории — последний пункт списка FlagOS 2.2 закрыт (09-29)
Дата: 2026-09-29 Источник: Torch-FL v2.10.0 Release, community #124, community #125
Единственный оставшийся пункт Torch-FL в списке 2.2 (24 пункта) из ежедневного отчёта от 09-28 зафиксирован в этом окне — два кандидатных тега (v2.10.0rc1 / rc2), созданные в 12:34 / 17:01, предварительно отработали конвейер релиза, в 18:17 создан Release, в 18:20 состоялся официальный релиз:
- Содержание релиза: torch-fl — это плагин устройства PyTorch для FlagOS, унифицирующий пооператорную маршрутизацию (нативные ядра производителя / переносимые ядра FlagGems / CUDA-совместимый boxing / запасной вариант CPU) под единым устройством
flagos, позволяя одной и той же программе PyTorch без изменения кода работать на девяти классах ускорительных платформ: NVIDIA (A100 / H800), Ascend (910C), Hygon (BW1000), MetaX (C550), DAMO XuanTie (ZW810E), Moore Threads (S5000), Enflame (S60), Kunlunxin (P800) и Horizon BPU (s600). - Версии и упаковка: начиная с этой версии номер версии следует за линией минорных версий привязанного PyTorch (в данном случае
>=2.10,<2.11); wheel именуетсяtorch_fl-2.10.0+<sdk>(например, +cuda13.3 / +dtk2604 / +cann9.0.0), «один тег, один артефакт на платформу»; wheel самоописательный (compatibility.json фиксирует платформу, набор ядер, ABI сборки и версии FlagTree / FlagGems / FlagCX), а также поставляется с CLI проверкиtorch-fl-preflight(позволяет проверить окружение без импорта torch_fl). - Критерии верификации: DDP и FSDP2 полностью проходят на основных картах; torch.compile регистрирует flagos как полноправное GPU-устройство inductor (бэкенд FlagTree покрывает шесть вендоров, Enflame использует проприетарный Triton, BPU использует бортовой компилятор); profiler согласован с CUPTI (включая специализированные tracer’ы каждого вендора); в кросс-платформенном бенчмарке (Qwen-Image-2.1, одна карта 1024², 40 шагов) H100 нативно даёт 6.52 секунды/изображение, для сравнения FlagOS H100 — 10.67, Moore Threads S5000 — 14.87, Hygon BW1000 — 23.59, Ascend 910C — 24.94, MetaX C550 — 31.61, DAMO XuanTie ZW810E — 37.44, Enflame S60 — 58.04 (качество изображения соответствует H100, отклонение CLIP-Score в пределах ±1.6%); чисто CPU-путь Arm (Mac M5 Pro) достигает ускорения в 1.74 раза относительно PyTorch CPU.
- Три новые возможности: skill подключения бэкенда новых чипов (в этом цикле по этому пути были добавлены T-Head ZW810E и Kunlunxin P800), программная эмуляция FP8 / FP4 в пути boxing (когда FP8-оборудование недоступно), автоматическая настройка маршрутизации на уровне операторов.
- Ограничения (входят в состав релиза): бэкенды torch.compile по-прежнему экспериментальные; profiler / RNG и compile для Kunlunxin P800 всё ещё в дорожной карте; flex_attention в этой версии не поддерживается; BPU s600 используется только как устройство графа torch.compile (eager выполняется на CPU).
- Объём: с v0.1.0 накоплено 269 коммитов (62 функции / 101 исправление / 11 производительность / 25 CI / 18 документация / 16 тесты / 10 рефакторинг / 4 сборка), более 100 моделей HuggingFace проверены на каждой плате матрицы.
Оценка: на данный момент все 24 пункта официального списка 2.2 имеют соответствующие релизные артефакты в репозитории (снимок проверки пункта Torch-FL в списке всё ещё pending, что ожидаемо и будет обновлено в следующем корректирующем пакете); цепочка из четырёх типов артефактов «тег → Release → wheel → образ» замкнулась в этом окне.
1. Прогресс open-source проектов (динамика GitHub)
1.1 Torch-FL: официальный релиз v2.10.0 — закрыт последний пункт 2.2 (09-29)
Дата: 2026-09-29 Источники: Torch-FL v2.10.0, Список тегов Torch-FL, compare v0.1.0…main
- Хронология: метка rc1 12:34 (привязана к коммиту «сделать метку кандидата пригодной для публикации») → метка rc2 17:01 → объект Release создан 18:17, опубликован 18:20; официальная метка v2.10.0 указывает на тот же коммит, что и rc2 (
#481линия релиза на runner вендора). - Детализация по платформам (матрица релизных артефактов): Ascend 910C — 354 оператора маршрутизации, FlagGems маршрутизация 221 → 225, обучение Qwen3-0.6B по факту составляет 0.82 от torch_npu; Hygon BW1000 — 2033 оператора через CUDA boxing-маршрутизацию, FlagGems маршрутизация 388 → 470; MetaX C550 — 2033 оператора cu-bridge, маршрутизация 377 → 443; Damo Academy XuanTie ZW810E — маршрутизация 390 → 435; Moore Threads S5000 — 105 ядер нативного mudnn, маршрутизация 391 → 468; Enflame S60 — 224 ядра нативного libtopsaten, Qwen-Image-2512 оптимизирован до 7.1 секунды на шаг; Kunlunxin P800 — 2022 оператора, 380 маршрутов FlagGems-Python; на стороне NVIDIA — путь диспетчеризации FlagGems-C++ введён в строй (18).
- Распределённость: collectives по платформам раздельно идут через FlagCX+MCCL (MUSA), FlagCX (GCU), RCCL на DTK, откат на HCCL и маршруты в форме NCCL; запросы gloo отвечает бэкенд flagos.
- Значение: продвижение по схеме «сначала линия кандидатов rc, официальная метка на следующий день в рамках ночного окна публикации» согласуется с организацией выпуска основной версии 2.2 — сначала проверяется конвейер артефактов, затем фиксируется официальный объект.
1.2 Torch-FL (часть 2): итерация релизного конвейера — от меток кандидатов до wheel вендоров (09-29 ~ 09-30)
Дата: 2026-09-29 ~ 2026-09-30 Источники: #473, #474, #475, #476, #480, #483
- Спецификация упаковки: #473 — wheel именуется по собранному SDK, для каждой платформы фиксированный интерпретатор (CUDA / GCU / MetaX / PPU используют 3.12, DCU / MUSA используют 3.10, Ascend использует 3.11).
- Управление метками: #474 — сборка и публикация wheel по метке; #475 — метка кандидата релиза становится пригодной для публикации (rc1 / rc2 прошли именно по этому механизму).
- Надёжность загрузки: #476 — параллельная загрузка + таймаут и повторы; #480 / #481 — wheel для каждой платформы собираются и публикуются на собственном runner вендора в его полосу PyPI.
- Исправление порядка: #483 / #484 (09-30 00:55) — исправлено на «сначала publish, затем загрузка artifact» — последняя правка конвейера в окне.
- Значение: релизная инженерия продвинулась от «метка доступна» к «артефакт каждой платформы воспроизводим и проверяем» — девять дней назад это ещё был пункт, ожидающий реализации, а теперь даже сам релизный конвейер прошёл путь от 0 до 1.
1.3 community: двойная финальная правка и политика восьми репозиториев как контрольной точки (09-29)
Дата: 2026-09-29 Источники: community #124, #125, #114, #115
- #124 (11:54) выравнивание точки отсечения: FlagGems-vllm и FlagGems-sglang переведены на «последний коммит основной ветки до 2026-09-28 09:00» — прежние официальные теги обоих репозиториев удалены и пересозданы на верифицированном коммите отсечения (имя версии не изменено); политика отсечения тем самым расширена на все восемь библиотек операторов (исходные шесть + две).
- #125 (12:28) включение исправлений FlagScale: исправление инициализации RC2 в FlagScale (включая #1304, проблема неоднородной инициализации) включено в 2.2 — запись FlagScale в манифесте изменена на
release-source: rc2-head, целевой коммит 4371924. - Примечание о статусе: #114 (добавление библиотек операторов L1 в манифест) закрыт без слияния, его охват переработан маршрутами #116 / #117 / #123; #115 (поставленный в 2.2 объём FEP и отложенные на 2.3 пункты) остаётся открытым, в окне мониторинга действий не было.
1.4 Обновление релизов: пересоздание тега FlagScale и Release двух библиотек семейства FlagGems (09-29)
Дата: 2026-09-29 Источники: FlagScale v2.1.0, FlagGems-vllm v0.2.0, FlagGems-sglang v0.1.0
- FlagScale v2.1.0 (12:27): тег пересоздан на «4371924f поверх 2.1.0-rc2» (включая исправление #1304), объект Release синхронно обновлён — объём обновлён до 33 PR плюс 2 дополнительных коммита (прежняя оценка в 32 PR соответственно скорректирована).
- FlagGems-vllm v0.2.0 (11:52): тег пересоздан на коммите отсечения
b5c2c224, Release зафиксирован в репозитории в 11:52 ~ 11:55 (в тексте отмечено Part of FlagOS 2.2). - FlagGems-sglang v0.1.0 (11:53): тег пересоздан на коммите отсечения
575d5bc3, Release синхронно зафиксирован в репозитории (первая версия: 80 PR и 14 дополнительных коммитов). - Стыковка в окне мониторинга: действия по трём репозиториям сосредоточены в интервале 11:52 ~ 12:28, со стыковкой на уровне минут с #124 / #125 — «корректировка записи → пересоздание тега → обновление Release» замкнулись в одном полуденном окне.
1.5 build-infra: завершение записи зеркал по трём линиям — mthreads / ascend / enflame (09-29 ~ 09-30)
Дата: 2026-09-29 ~ 2026-09-30 Источники: пакет записей зеркал build-infra, #1292, #1296 ~ #1303, #1312, #1314
- Четыре варианта Ascend (#1296 ~ #1303, 16:28 ~ 17:04): в матрицу обучения megatron 0.18.2 добавлены четыре записи cann8.5.0 / cann9.0.0 / cann8.5.0-910c / cann9.0.0-910c, а также дополнен журнал изменений 0.18.2; контейнер verify синхронно исправляет проксирование прокси (#1297).
- Пакет Moore Threads (#1294 ~ #1313, 16:19 ~ 00:19): массовая запись тегов приложений vllm (0.3.0 / 0.2.2), megatron (0.2.3) и sglang (0.1.dev1) для двух линий musa4.3.6 / musa5.2.0; также авторизована пересборка приложения mthreads на новом flagtree wheel (#1292); тег образа sglang восстановлен с префиксом стека 2.2.0; утром дополнительно исправлена документация mthreads sglang (#1314, 08:50).
- Пакет Enflame (#1284 ~ #1291, 10:39 ~ 10:41): массовая запись в базу записей vllm (0.2.2), megatron (0.2.3) и sglang для двух линий tops1.9.10 / 1.10.6.
- Инфраструктура сборки: резервный EXTRA_PYPI переключён на зеркало Tencent PyPI (#1312); рабочий процесс проверки работоспособности загрузки больших файлов Nexus (#1293) открыт для проверки.
- Объём: в окне 51 коммит build-infra, около 30 слитых PR; портал release-info автоматически развёрнут 7 раз вместе с пакетами записей.
1.6 FlagGems: пакет операторов KernelGen и пакет производительности Ascend (09-29 ~ 09-30)
Дата: 2026-09-29 ~ 2026-09-30 Источники: FlagGems #6610, #6770, #6699, #6553, #6633, #6795, #6741, #6799
- Пакет операторов KernelGen (16 штук): на стороне NVIDIA добавлены dim, kl_div, linalg_pinv, weight_int4pack_mm, _spsolve, triplet_margin_loss, max_pool1d_with_indices, conv_tbc, quantized_batch_norm, quantize_per_channel, put, special_hermite_polynomial_he, histogram, fused SDPA backward, batch_norm_stats, bartlett_window — операторы, генерируемые KernelGen, продолжают интенсивно попадать в основной репозиторий.
- Пакет производительности Ascend (#6697 ~ #6703, #6770): непрерывная настройка baddbmm для broadcast смещения и выбора tile, bmm tile и маски, addmm для больших нагрузок BF16, диспетчеризации mv GEMV, диспетчеризации broadcast mul; также исправлена проблема глобальной утечки переменной окружения TRITON_ALL_BLOCKS_PARALLEL.
- Оптимизации вендоров: массовая оптимизация операторов с низкой производительностью Hygon (#6553); KMCompiler linear охватывает четыре бэкенда NVIDIA / Hygon / MetaX / Thead (#6633); реализация семейства geometric и argsort с разбивкой по бэкендам для линии SiliconFlow (#6575 / #6692).
- CI и исправления: обновление образа ops-test Cambricon (#6795), перенос тестов Moore Threads в flagcicd, изменение операторов для запуска помеченных тестов (#6741), очистка томов runner; защита импорта tle (#6777), гонка WAL при холодном старте SQL (#6730), материализация неэквивалентных тензоров FlashAttention (#6727); базовая линия бенчмарков переведена на нативные операторы aten (#6195).
- Новые материалы: пять наборов тестов sparse / metadata (#6799) отправлены утром 09-30 и ожидают проверки.
1.7 FlagGems-vllm / FlagGems-Experimental: ядра KMCompiler и линия 5.5 alpha (09-29 ~ 09-30)
Дата: 2026-09-29 ~ 2026-09-30 Источники: FlagGems-vllm #873, #875, #876, #877, FlagGems-Experimental #721
- FlagGems-vllm: #873 добавлен бэкенд-специфичный dequantize_and_gather_k_cache (Ascend / Moore Threads); #875 / #876 оптимизация слитного q_kv_rmsnorm и fused add rms norm для Iluvatar; #877 тестовый образ обновлён до flagtree v0.7.0.
- FlagGems-Experimental: та же партия операторов KernelGen (slow_conv_transpose3d, combinations, sparse_resize_, sparse_coo_tensor, _unpack_dual, can_cast, _fw_primal, flatten_dense_tensors, ccol_indices и др.) продолжает поступать в экспериментальный репозиторий; номер alpha-версии поднят с 5.4 до 5.5 (#721) — запущена ветка разработки следующей линейки версий библиотеки операторов.
1.8 FlagTree: пост-релизные патч-теги metax и рабочий процесс планирования для всех бэкендов (09-29)
Дата: 2026-09-29 Источники: теги FlagTree, #1310, #1307, #1212, #1303
- Пост-релизные патч-теги:
0.7.0.post2+metax3.6запушен flagtree-bot в 18:27 (“pypi 0.7.0.post2+metax3.6”) — целевой коммит — «Metax bf16 sum reduction повышен до fp32» (#1310), metax становится первым бэкендом, получившим корректирующий вариант post2. - Коммиты: #1307 добавляет рабочий процесс планирования по расписанию для всех бэкендов; #1212 добавляет TLE-слияние AllReduce + RMSNorm на этапе декодирования; #1303 CI проверяет путь к pid-файлу перед завершением процесса.
- Значение: за пределами заморозки 2.2 открывается канал «инкрементального патчинга по вариантам после релиза» — гранулярность вариантов (+metax3.6 и т. п.) поддерживает независимый ритм патчей.
1.9 FlagQuantum: маршрутизация каталогов ядер и пакет оптимизации производительности (09-29 ~ 09-30)
Дата: 2026-09-29 ~ 2026-09-30 Источники: FlagQuantum #240, #236, #241, #259
- Серия каталогов ядер (kernel catalog) (#240 ~ #259, 25 коммитов): после семантического каталога (#240), списка доказательств (#243), средства сопоставления возможностей (#244) пути локального 1q / CNOT / последовательности CNOT / fused transpose / передачи управляемого подпространства / adjoint VJP / обратимого VJP / сегментированного adjoint VJP постепенно подключились к маршрутизации каталога — уровень планирования перешёл от жёстко заданной логики к управлению через реестр.
- Фьюзинг производительности: фьюзинг границ adjoint (тройки Euler, прямые / обратные границы QAOA, границы вращения наблюдаемых величин), фьюзинг CX gathers, расширение тайлов вращения, пропуск восстановления конечного состояния, кэширование прямых инвариантов — серия последовательных оптимизаций нативного пути CPU.
- Новые возможности: эволюция Линдблада в непрерывном времени (#236), решение основного состояния VQE в состоянии провайдера (#241), анализ происхождения компилятора Triton (#233).
- Значение: инженерная основа направления квантово-интеллектуального фьюзинга (специальная сессия конференции 10-17) — компоненты входят в фазу высокочастотных итераций за три недели до конференции.
1.10 Прочие обновления: FlagCX / FlagFFT / FlagAttention / docs / vllm-plugin-FL (09-29 ~ 09-30)
Дата: 2026-09-29 ~ 2026-09-30 Источники: FlagCX #632, активность FlagFFT, FlagAttention #71, docs #521, docs #530, vllm-plugin-FL #563
- FlagCX: #632 интегрирует общее упорядочивание передачи (CRL) и повторяемый teardown — базовый уровень согласованности передачи между бэкендами продолжает укрепляться.
- FlagFFT: добавлены две оптимизационные ветки
codex/musa-3d-opt(Moore Threads) иcodex/maca-3d-opt(MetaX), несколько раундов пушей во второй половине дня и к вечеру 09-29 — линии многоплатформенной оптимизации трёхмерного FFT запущены одновременно. - FlagAttention: moba attention (#71), Hy3 attention (#56), parallax (#57) — три коммита последовательно влиты утром 09-30.
- Пакет документации docs (23 коммита): #521 «Черновик документации 2.2» влит целиком (09-30 08:44) — полный комплект новой документации FlagAttention на китайском и английском, обновления примечаний к выпуску FlagAudio / FlagBLAS / FlagDNN / FlagFFT / FlagGems-vllm, обновление документации FlagQuantum (архитектура / возможности / алгоритмы / руководство пользователя), расширение рабочих процессов развёртывания; #530 создаёт страницы документации FlagGems-sglang на китайском и английском (установка / требования / список операторов / примечания к выпуску); #514 руководство по адаптации чипов; пакет списков моделей продолжается (серия ModelScope, aihuanxin, открытые PR HuggingFace).
- vllm-plugin-FL: после ревью влит #563; линия открытых PR активна — адаптация MiniCPM-V 4.7 (#567), статический граф Sunrise PTPU (#568), адаптация Iluvatar CoreX BI-V150 к vLLM 0.28.0 (#566), обновление Kunlunxin P800 до vLLM 0.24.0 (#561), универсальный граф полного декодирования Ascend (#409), а также три коммита поддержки H100 для Qwen3.8-Flash / GLM5.3-Flash / HY4 (#455 / #454 / #453) — утром 09-30 всё ещё идёт интенсивное ревью.
2. Новости и экосистема
2.1 Компонентный поиск — двадцать третье подряд спокойное окно (09-29 ~ 09-30)
Дата: 2026-09-29 ~ 2026-09-30 Источники: Google News RSS (24 группы поисковых запросов на китайском и английском, через прокси), HN Algolia
- Запросы по компонентам и релизным линиям (FlagOS / FlagGems / FlagScale / FlagTree / FlagCX / KernelGen / FlagPerf / повестка конференции) в 24-часовом окне не дали новых публичных анонсов — двадцать третье подряд спокойное окно; все релизные действия Torch-FL произошли на стороне кода и артефактов (см. главы 1 и 3).
- В окне на стороне экосистемы 11 совпадений: непосредственно релевантен один материал со стороны индустрии Moore Threads (см. 2.2); остальные — биржевые обзоры (прогноз прибыли Enflame, разблокировка акций четырёх «драконов» GPU), социальные новости, связанные с BAAI (интервью о вложениях в безопасность AI), и нерелевантные перепечатки, отсеяны по тематике.
- HN Algolia по FlagOS / FlagGems / FlagScale / BAAI не дал релевантных совпадений (результаты нечёткого сопоставления — все нерелевантные темы).
2.2 Moore Threads: национальный центр интеллектуальных вычислений Уси (Хуэйшань) работает три месяца — шесть крупных интеллектуальных агентов внедрены (09-29)
Дата: 2026-09-29 Источник: Phoenix News (перепечатки с тем же заголовком на Sina Finance и др.)
- Веха: первая очередь национального центра интеллектуальных вычислений Уси (Хуэйшань) отработала три месяца — уже через два месяца после ввода в эксплуатацию центр был почти полностью загружен, став эталоном коммерциализации национальных вычислительных мощностей; все 2000 карт интеллектуальных вычислений Moore Threads MTT S5000 первой очереди введены в эксплуатацию (узел Хуэйшань в рамках проекта «Восточные данные — западные вычисления» в узле дельты Янцзы).
- Шесть крупных интеллектуальных агентов: государственное управление (агент инвестиционного продвижения Хуэйшань, интеграция данных — вычислений — приложений), медицина (система умной больницы Народной больницы района Хуэйшань × Института интеллектуальных вычислений на периферии при Нанкинском почтовом университете, внедрено около тридцати моделей; медицинский агент WiseAgent компании Zhizhen Technology), образование (платформа InnoAgent компании Qichuang при Восточно-Китайском педагогическом университете, интегрирует 300+ образовательных агентов, 1000+ образовательных навыков и уже открыта), проектирование чипов (X-IVS / X-IDS компании Xinhua Zhang, кейс Formal Agent — 23,8 часа от начала до конца) и другие высокоценные направления.
- Связь с нашим стеком: MTT S5000 — платформа-участник FlagOS — в этом окне пакет образов приложений musa со стороны Moore Threads, данные S5000 в релизах Torch-FL (105 нативных ядер, маршрутизация FlagGems 391 → 468) и отраслевой нарратив «национальные чипы обучают национальные модели» взаимно отражают друг друга; «модель Хуэйшань» на следующем шаге масштабируется на другие регионы.
3. Углублённое изучение организаций-участников
3.1 Moore Threads: пакет образов musa, ветка оптимизации MUSA 3D и индустрия в Уси (09-29)
Дата: 2026-09-29 ~ 2026-09-30 Источник: build-infra #1294 ~ #1313, FlagGems-vllm #873, активность FlagFFT
- Образы приложений: пакетная регистрация в репозитории тегов двух линий musa4.3.6 / musa5.2.0 — vllm (0.3.0 / 0.2.2), megatron (0.2.3), sglang; приложения получили разрешение на пересборку на новом wheel flagtree (#1292).
- Слой операторов: специализация mthreads для dequantize_and_gather_k_cache в FlagGems-vllm (#873); патч post2, повышающий bf16 sum reduction до fp32 в FlagTree, основан именно на сценарии этого бэкенда (#1310, см. 1.8).
- Ветка оптимизации: ветка FlagFFT
codex/musa-3d-opt— несколько серий пушей во второй половине дня 09-29 (13:53 ~ 14:30). - Сторона индустрии: национальный центр интеллектуальных вычислений Уси (Хуэйшань) работает три месяца, внедрены шесть крупных интеллектуальных агентов (см. 2.2).
3.2 Ascend: четыре варианта megatron 0.18.2 и пакет производительности FlagGems (09-29)
Дата: 2026-09-29 Источник: build-infra #1296 ~ #1303, FlagGems #6699, #6770, FlagGems-vllm #873
- Фреймворки обучения: megatron 0.18.2 — записи и журналы изменений по четырём линиям бэкендов (cann8.5.0 / cann9.0.0 / 910c в двух вариантах) добавлены — сторона обучения Ascend восполнила матрицу 0.18.2 в первый рабочий день после недели релиза.
- Производительность операторов: FlagGems — шесть оптимизаций Ascend (baddbmm / bmm / addmm / mv / mul / исправление утечки переменных окружения).
- Ядра инференса: FlagGems-vllm KMCompiler dequantize_and_gather_k_cache со специализацией под Ascend (#873).
- Открытые PR: vllm-plugin-FL — универсальный граф полного декодирования для Ascend (#409) продолжает находиться на рассмотрении.
3.3 Hygon / MetaX: пакет оптимизации производительности операторов и пост-патчи metax (09-29)
Дата: 2026-09-29 Источники: FlagGems #6553, #6633, FlagTree #1310, активность FlagFFT
- Hygon: массовая оптимизация операторов FlagGems с низкой производительностью (#6553); бэкенд Hygon для KMCompiler linear включён в унифицированный рефакторинг четырёх бэкендов (#6633); в релизах Torch-FL BW1000 работает через CUDA boxing (2033 оператора, 466 маршрутов FlagGems) и функционирует на базе upstream PyTorch, а не ветки DTK.
- MetaX: пост-патч-тег FlagTree
0.7.0.post2+metax3.6(bf16 sum → fp32); в ветке FlagFFTcodex/maca-3d-opt09-29 с послеобеденного времени до вечера шли непрерывные пушы (15:31 ~ 18:45); в релизах Torch-FL C550 через cu-bridge маршрутизирует 2033 оператора, FSDP2 и обучение Qwen3 приведены в соответствие.
3.4 Enflame / Iluvatar: пакет образов и fused-ядра iluvatar (09-29 ~ 09-30)
Дата: 2026-09-29 ~ 2026-09-30 Источники: build-infra #1284 ~ #1291, FlagGems-vllm #875, #876
- Enflame (enflame): пакетная запись в репозиторий записей приложений vllm (0.2.2), megatron, sglang по двум линиям tops1.9.10 / tops1.10.6 (#1284 ~ #1291); в релизах Torch-FL S60 с нативным бэкендом libtopsaten (224 ядра) оптимизирует Qwen-Image-2512 до 7,1 секунды/шаг.
- Iluvatar (iluvatar): два fused-ядра в FlagGems-vllm — оптимизации fused q_kv_rmsnorm и fused add rms norm (#875 / #876).
3.5 Kunlunxin / Cambricon / XuanTie DAMO Academy / Horizon Robotics: прочие ключевые пункты (09-29 ~ 09-30)
Дата: 2026-09-29 ~ 2026-09-30 Источники: vllm-plugin-FL #561, FlagGems #6795, #6633, Torch-FL v2.10.0
- Kunlunxin: PR по обновлению P800 до vLLM 0.24.0 в vllm-plugin-FL (#561) ожидает рассмотрения; в релизах Torch-FL profiler / RNG и compile для P800 указаны как пункты дорожной карты.
- Cambricon: обновлён образ ops-test для FlagGems (#6795).
- Damoxuan Xuantie: бэкенд Thead для KMCompiler linear отнесён к рефакторингу четырёх бэкендов (#6633); в релизах Torch-FL маршрутизация ZW810E 390 → 435, интеграция AMP.
- Horizon Robotics: BPU s600 как бортовой целевой модуль вошёл в матрицу платформ Torch-FL (путь графа torch.compile, встроенный компилятор).
- Tsingmicro: в окне мониторинга новых изменений нет (в предыдущем окне уже включён бэкенд txda для FlagScale).
4. Итоги и наблюдения за тенденциями
- Закрытие 2.2 завершено: все 24 пункта списка вошли в репозиторий — Torch-FL v2.10.0 выпущен в окне мониторинга, последний пункт добавлен; дисциплинарная тройка «исправление → пересборка → повторный релиз» (#123 исправление источников шести репозиториев → #124 выравнивание контрольных точек двух репозиториев → #125 включение исправления FlagScale) замкнута в цикл за 12 часов.
- Релизная инженерия становится явной компетенцией — Torch-FL за один день прошёл путь rc1 → rc2 → официальный релиз, сопровождаемый множеством итераций релизной линии (сборка по тегам, собственные runner’ы вендоров, повторные попытки параллельной загрузки, исправление порядка релиза); самописание wheel + проверка preflight — релизные артефакты переходят от «устанавливаемости» к «верифицируемости и прослеживаемости».
- Линия разработки полностью переходит в следующий цикл — FlagGems-Experimental alpha поднят до 5.5, FlagGems-vllm 0.3.0-dev1 (предыдущее окно), vllm-plugin-FL ориентирован на новые модели (Qwen3.8-Flash / GLM5.3-Flash / MiniCPM-V 4.7) и новое оборудование (CoreX BI-V150, обновление P800) — интенсивное рецензирование открытых PR; после окончания релизного замораживания линия адаптации вновь ускоряется.
- Три основные линии синхронны в окне мониторинга — покрытие операторов KernelGen (16 коммитов в основной репозиторий), платформенная оптимизация вендоров (Ascend / Hygon / MetaX / Enflame имеют отдельные пакеты, две ветки оптимизации FlagFFT), стек квантовых систем (25 коммитов FlagQuantum) — совпадает с тематикой секций AI-систем и квантово-интеллектуальной интеграции на конференции 10-17.
- 23-е спокойное окно на новостной стороне и ходы на промышленной стороне сосуществуют — продолжается нарратив, движимый кодовой стороной и привязанный к узлам конференций; кейс Moore Threads в Уси (шесть интеллектуальных агентов + эталон полной загрузки) — новый образец нарратива «коммерциализации отечественных вычислительных мощностей», взаимно подтверждающийся с данными S5000 в релизах Torch-FL.
- Следующие точки наблюдения: обновление снимка раздела Torch-FL в списке community, слияние линий разработки 2.3 (FlagGems 5.5, FlagGems-vllm 0.3.0, адаптация vLLM 0.28) и внешние релизы конференции 10-17.
Приложение: таблица проверки источников
| Категория | Источники | Способ проверки | Результат |
|---|---|---|---|
| GitHub | org: flagos-ai repos API | Полная проверка pushed_at по 54 репозиториям | 16 репозиториев активны в окне (из них 12 имеют коммиты в окне) |
| GitHub | Поиск коммитов + построчная сверка по репозиториям | Поиск коммитов 168 записей (total_count полностью) построчная верификация | 12 репозиториев, 168 записей (build-infra 51 / FlagGems 38 / FlagQuantum 25); новых репозиториев в организации нет |
| Релизы | Torch-FL releases / tags API | Построчная проверка тегов, Release и времени публикации | v2.10.0 (создан 18:17 / опубликован 18:20); кандидатные теги rc1 / rc2 выставлены ранее |
| Релизы | FlagScale / FlagGems-vllm / FlagGems-sglang / FlagTree атомарные | Построчное сравнение объектов тегов (время tagger и целевой коммит) | Пересоздание тегов трёх репозиториев (11:52 ~ 12:27); тег metax post2 (18:27) |
| Инженерия релизов | community #124 ~ #125 оригиналы | Сверка заголовков, текста и различий файлов | Оба влиты; политика точек отсечения расширена до восьми репозиториев |
| Инженерия релизов | Манифест release-2.2.yaml | Сверка с оригиналом | Точки отсечения восьми репозиториев + FlagScale rc2-head; снимок Torch-FL ожидает обновления |
| Инженерия релизов | Пакет PR build-infra и портал release-info | Построчное сравнение | Около 30 влитых; портал развёрнут 7 раз |
| Документация | Списки файлов docs PR #521 / #530 | Пофайловая сверка | Полный пакет документации 2.2 (включая полный набор FlagAttention) и страница документации sglang |
| Новости | Google News RSS (24 группы запросов на китайском и английском, через прокси) | Фильтрация по 24-часовому окну + построчное исключение | Нулевой прирост по компонентной линии (23-е спокойное окно); на стороне экосистемы сохранена 1 запись |
| Медиа | Phoenix News (перепечатки с тем же заголовком на Sina Finance и др.) | Повторная сверка с оригиналом (время публикации 09-29 18:44) | Трёхмесячный рубеж центра интеллектуальных вычислений Уси (Хуэйшань) |
| Сообщество | HN Algolia | Повторная проверка поиска | Релевантных совпадений нет |
| Историческое сопоставление | Ежедневные отчёты FlagOS за предыдущие два дня | Проверка на дублирование | Torch-FL pending → релиз стал ключевым приростом окна; кейс Уси включён впервые; AICC2026 уже был включён 09-23 / 09-24 |
Полный список источников
- [1] Ключевое за сегодня: релиз Torch-FL зафиксирован в репозитории — https://github.com/flagos-ai/Torch-FL/releases/tag/v2.10.0 · https://github.com/flagos-ai/community/pull/124 · https://github.com/flagos-ai/community/pull/125
- [2] 1.1 Релиз Torch-FL — https://github.com/flagos-ai/Torch-FL/releases/tag/v2.10.0 · https://github.com/flagos-ai/Torch-FL/tags · https://github.com/flagos-ai/PyTorch-Plugin-FL/compare/v0.1.0...main
- [3] 1.2 Конвейер релиза — https://github.com/flagos-ai/Torch-FL/pull/473 · https://github.com/flagos-ai/Torch-FL/pull/474 · https://github.com/flagos-ai/Torch-FL/pull/475 · https://github.com/flagos-ai/Torch-FL/pull/476 · https://github.com/flagos-ai/Torch-FL/pull/480 · https://github.com/flagos-ai/Torch-FL/pull/483
- [4] 1.3 community — https://github.com/flagos-ai/community/pull/124 · https://github.com/flagos-ai/community/pull/125 · https://github.com/flagos-ai/community/pull/114 · https://github.com/flagos-ai/community/pull/115
- [5] 1.4 Обновление релизных артефактов — https://github.com/flagos-ai/FlagScale/releases/tag/v2.1.0 · https://github.com/flagos-ai/FlagGems-vllm/releases/tag/v0.2.0 · https://github.com/flagos-ai/FlagGems-sglang/releases/tag/v0.1.0
- [6] 1.5 build-infra — https://github.com/flagos-ai/build-infra/pulls?q=is%3Apr+app-image-tag · https://github.com/flagos-ai/build-infra/pull/1292 · https://github.com/flagos-ai/build-infra/pull/1297 · https://github.com/flagos-ai/build-infra/pull/1312 · https://github.com/flagos-ai/build-infra/pull/1314
- [7] 1.6 FlagGems — https://github.com/flagos-ai/FlagGems/pull/6610 · https://github.com/flagos-ai/FlagGems/pull/6770 · https://github.com/flagos-ai/FlagGems/pull/6699 · https://github.com/flagos-ai/FlagGems/pull/6553 · https://github.com/flagos-ai/FlagGems/pull/6633 · https://github.com/flagos-ai/FlagGems/pull/6795 · https://github.com/flagos-ai/FlagGems/pull/6741 · https://github.com/flagos-ai/FlagGems/pull/6799
-
[8] 1.7 FlagGems-vllm / Experimental — https://github.com/flagos-ai/FlagGems-vllm/pull/873 · https://github.com/flagos-ai/FlagGems-vllm/pull/875 · https://github.com/flagos-ai/FlagGems-vllm/pull/876 · <https://github.com/flagos-ai/FlagGems-vllm/p
- [9] 1.8 FlagTree — https://github.com/flagos-ai/FlagTree/tags · https://github.com/flagos-ai/FlagTree/pull/1310 · https://github.com/flagos-ai/FlagTree/pull/1307 · https://github.com/flagos-ai/FlagTree/pull/1212 · https://github.com/flagos-ai/FlagTree/pull/1303
- [10] 1.9 FlagQuantum — https://github.com/flagos-ai/FlagQuantum/pull/240 · https://github.com/flagos-ai/FlagQuantum/pull/236 · https://github.com/flagos-ai/FlagQuantum/pull/241 · https://github.com/flagos-ai/FlagQuantum/pull/259
- [11] 1.10 Прочие обновления — https://github.com/flagos-ai/FlagCX/pull/632 · https://github.com/flagos-ai/FlagFFT · https://github.com/flagos-ai/FlagAttention/pull/71 · https://github.com/flagos-ai/docs/pull/521 · https://github.com/flagos-ai/docs/pull/530 · https://github.com/flagos-ai/vllm-plugin-FL/pull/563
- [12] 2.1 Спокойное окно — Google News RSS, 24 группы поисковых запросов на китайском и английском (через прокси) · https://hn.algolia.com/
- [13] 2.2 Центр интеллектуальных вычислений Уси — Phoenix News https://feng.ifeng.com/c/8worZesI4HF
- [14] 3.x Зеркала и записи организаций-участников — https://github.com/flagos-ai/build-infra/pulls?q=is%3Apr+mthreads · https://github.com/flagos-ai/build-infra/pulls?q=is%3Apr+megatron · https://github.com/flagos-ai/build-infra/pulls?q=is%3Apr+enflame · https://flagos-ai.github.io/release-info/
- [15] 3.5 Прочие ключевые пункты — https://github.com/flagos-ai/vllm-plugin-FL/pull/561 · https://github.com/flagos-ai/Torch-FL/releases/tag/v2.10.0