Ежедневный отчёт FlagOS (2026-08-31)
Окно мониторинга: 2026-08-30 10:18 ~ 2026-08-31 10:18 пекинское время Источники: GitHub (org: flagos-ai 52 репозитория + поиск коммитов 24 записи + API PR/Issue), Google News RSS (несколько групп запросов на китайском и английском, прокси-цепочка работает штатно), HN Algolia, Tavily/web перекрёстная проверка (подробности в приложении)
Индекс
-
- Прогресс открытых проектов (динамика GitHub)
- 1.1 Главное: Torch-FL #227 слит — DCU запускает официальное ядро PyTorch, официальный уход от форка DTK (08-30/08-31)
- 1.2 FlagFFT: волна оптимизации производительности CUDA FourStep, тестирование 1D CT расширено до набора из 30 размеров (08-30/08-31)
- 1.3 build-infra: валидация Iluvatar Corex corex4.5.0 vLLM 0.20.2/0.24.0 завершена + Tsingmicro вошла в конвейер валидации (08-30/08-31)
- 1.4 FlagTree: добавлены операторы signal/signal_wait; FlagGems: оптимизация слияния MTHREADS feature_dropout_ (08-31)
- 1.5 Наблюдение за версиями и ветками: новых релизов нет, flagtree-cpu/release-info только push уровня веток (08-30/08-31)
- Прогресс открытых проектов (динамика GitHub)
-
- Новости и экосистема
- 2.1 Пояснение о спокойном дне: запросы на уровне компонентов четвёртый день подряд без результатов
- 2.2 Наблюдение за экосистемой: статья с точкой зрения сообщества Zhiyuan и репост HICOOL 2026
- Новости и экосистема
-
- Углублённое изучение организаций-участников
- 3.1 Hygon: DCU завершила адаптацию инференса Tencent Hy4 preview Day 0, совпало с слиянием #227 (08-30)
- 3.2 MetaX: полугодовой отчёт 2026 вышел из убытков в прибыль, первая прибыльная среди «четырёх малых драконов отечественных GPU» (08-30)
- 3.3 Enflame: IPO на STAR Market получил регистрацию, онлайн-подписка 2 сентября (08-30)
- 3.4 Iluvatar Corex: полугодовой отчёт вышел из убытков, но зависит от инвестиционного дохода, валидация зеркал на GitHub завершена (08-30/08-31)
- 3.5 Tsingmicro: проверка устройств tsm_smi вошла в скрипт валидации vLLM, аванпост подключения новых чипов (08-30)
- 3.6 Moore Threads: повторная публикация старых новостей о листинге A+H, не включается повторно (08-30)
- 3.7 Ascend: исправление требований к запуску процесса Torch-FL MSPTI (08-31)
- Углублённое изучение организаций-участников
-
- Итоги
- Приложение: полный список источников
1. Прогресс открытых проектов (динамика GitHub)
Обзор окна: из 52 репозиториев в org 8 имели push в окне (FlagTree, FlagGems, Torch-FL, FlagFFT, build-infra, docs, flagtree-cpu, release-info; при этом docs — ветка PR, flagtree-cpu — ветки triton_v3.6.x/v3.7.x, release-info — ветка gh-pages, в main новых коммитов нет); поиск коммитов дал 24 коммита в окне. Главные линии этого окна: 1. Torch-FL #227 официально слит — архитектурное предложение, выдвинутое вчера, «DCU запускает официальное ядро PyTorch, уход от форка DTK», в течение 24 часов перешло в официальную реализацию, став знаковым действием по избавлению отечественного дистрибутива PyTorch от зависимости от форка производителя; 2. Волна оптимизации производительности FlagFFT CUDA — 6 коммитов по производительности за один день, путь малых батчей алгоритма FourStep полностью обобщён, тестирование 1D CT расширено до набора из 30 размеров; 3. build-infra: валидация Iluvatar Corex vLLM завершена + Tsingmicro впервые вошла в конвейер валидации — проверка фронтенда и бэкенда vLLM 0.20.2/0.24.0 для iluvatar-corex4.5.0 полностью пройдена и зарегистрирована, проверка устройств tsingmicro одновременно добавлена в скрипт verify. На новостной стороне запросы на уровне компонентов четвёртый день подряд без результатов, у организаций-участников плотная динамика по капиталу и финансовым отчётам.
1.1 Главное: Torch-FL #227 слит — DCU запускает официальное ядро PyTorch, официальный уход от форка DTK (08-30/08-31)
Источник: Torch-FL #227, #228, #223, #229
- 8/30 10:57 (пекинское время) #227 смёржен:
feat: run DCU on the official PyTorch core instead of DTK's forked one— открытое предложение, зафиксированное во вчерашнем отчёте (предложено 8/30 ночью), было переведено в статус смёрженного в течение 24 часов. Проверка подтвердила, что проприетарное ядро можно удалить, а препятствием являются лишь 32 приватных символа ATen; PR реализует отделение ядра, сохраняет старый путь за переменной окружения и проходит двойную проверку путей на хосте gfx936. PR был написан при содействии Claude Code CLI (Claude Opus 5) и прошёл ручную проверку lvyufeng. - 8/30 11:16 смёржен #228: исправлена проблема, при которой обработка пустого тензора MUSA уходила в CPU fallback (Moore Threads, пустой тензор сразу идёт по пути устройства).
- 8/31 10:04 смёржен #223: исправлено требование к запуску процесса Ascend MSPTI — в окружении обеспечено соблюдение ограничений Ascend MSPTI на запуск процесса (Ascend).
- 8/31 00:13 смёржен #229: добавлен документ skill по исследованию покрытия transformers (категория docs, закладывает методологию для систематизации покрытия моделей).
Разбор: от verl-FL hygon25 E2E 8/28, DCU torch.compile HIP profile 8/29, предложения #227 8/30 до слияния 8/30 10:57 — маршрут разделения «официальное ядро PyTorch + проприетарная библиотека устройств» для Hygon DCU прошёл весь путь от предложения до реализации всего за три дня; #228/#223 показывают, что адаптация MUSA и Ascend углубляется от «функциональной доступности» к «точности семантики и среды выполнения». Torch-FL в одном окне охватывает три ускорителя — DCU/MUSA/Ascend, — темп сходимости по множеству чипов очевиден.
1.2 FlagFFT: волна оптимизации производительности CUDA FourStep, тестовый набор 1D CT расширен до 30 размеров (08-30/08-31)
Источник: FlagFFT commits
- 8/30 16:10~21:27 шесть последовательных коммитов по производительности: обобщение оптимизации small-batch leaf на весь FFT API; улучшение leaf-пути z2z при batch-1 на A100; обобщение z2z FourStep + thread-local путь f64; векторизация комплексного I/O и twiddle в FourStep; расширение набора тестов 1D CT до 30 размеров; слияние ветки
fourstep-generalв main. - 8/31 10:03 исправлен URL репозитория в инструкции clone в README (категория docs).
Разбор: основная линия FlagFFT в этом окне — обобщение оптимизации производительности алгоритма FourStep с конкретных размеров/конкретного API на весь API и все размеры (включая граничные случаи f64 и batch-1) с фиксацией регрессий набором тестов на 30 размеров — это типичная стадия перехода FFT-библиотеки от «доступности» к «оптимизации во всех сценариях»; оптимизация z2z при batch-1 на A100 показывает, что базовой точкой отсчёта производительности по-прежнему остаётся CUDA.
1.3 build-infra: завершение валидации corex4.5.0 vLLM 0.20.2/0.24.0 для Iluvatar CoreX + вхождение Tsingmicro в конвейер валидации (08-30/08-31)
Источник: build-infra #625, #626, #627, #628, #629, #630, #631, #632, #623, #624
- 8/30 12:02–13:36 четыре последовательные регистрации (#625–628): запись тегов прикладных образов vLLM 0.20.2 для iluvatar-corex4.5.0 (
2.1.2-0.2.1_gc0c060a6.d20260827,2.1.2-0.2.1_g07063fd.d20260828) + успешная проверка F/T фронтенда и бэкенда (#626, #627). - 8/30 14:45–14:46 (#629, #630): успешная проверка фронтенда и бэкенда vLLM 0.24.0 для iluvatar-corex4.5.0 с регистрацией результата.
- 8/30 22:10 слияние #631: TsingMicro впервые вошла в конвейер проверки vLLM — в
verify-vllm-backend.shдобавлена проверка доступности устройства tsm_smi + guard по суффиксу torch (ожидается, что сборка вендора+cpu2.11.0+cpuсохранится после одношаговой установки vLLM); на другие бэкенды влияния не оказывает (PR написан при содействии генеративного AI). - 8/31 07:51 слияние #632: в governance добавлены правила agent-protocol и очищена устаревшая документация (институционализация управления совместной работой AI Agent).
- 8/30 11:09–11:56 (#623, #624): в audit-deps добавлен версионно-зависимый гейтинг –watch name==version для numpy; после миграции скрипта verify исправлен путь repo root.
Разбор: после тройного исправления стека образов 8/29 бэкенд corex4.5.0 от Iluvatar CoreX (добавлен 8/28) в текущем окне завершил регистрацию проверки фронтенда и бэкенда для двух версий vLLM — 0.20.2 и 0.24.0, замкнув цикл релизного процесса; подключение TsingMicro к скрипту проверки — очередной сигнал о подключении нового чипа после таких авангардных шагов, как PyTorch-Plugin-FL в июле, — чем больше вендоров в конвейере проверки vLLM, тем сильнее стандартизированные возможности подключения чиповой матрицы FlagOS. Внедрение правил agent-protocol показывает, что на организационном уровне совместная работа AI Agent начинает включаться в официальное управление.
1.4 FlagTree: добавлены операторы signal/signal_wait; FlagGems: оптимизация слияния feature_dropout_ для MTHREADS (08-31)
Источники: FlagTree #863, FlagGems #5742
- 8/31 10:17 слияние FlagTree #863:
[TLE] Add signal and signal_wait operators— для пути TLE (выполнение на уровне потоков) добавлены операторы синхронизации семафоров. - 8/31 10:12 слияние FlagGems #5742:
[MTHREADS] Optimize feature_dropout_ with fused in-place path— оптимизация оператора feature_dropout_ с fused in-place путём для бэкенда MUSA от Moore Threads.
Разбор: дополнение примитивов синхронизации TLE в FlagTree и оптимизация операторов Moore Threads в FlagGems слиты в один день, оба репозитория продолжают обслуживать уровень многочиповой компиляции и уровень операторов; высокая частота коммитов Moore Threads в FlagGems соответствует её статусу «самого активного участника».
1.5 Наблюдение за версиями и ветками: новых release нет, flagtree-cpu/release-info — только push на уровне веток (08-30/08-31)
Источники: flagtree-cpu branches, release-info
- В окне не выпущено ни одного release (нулевые попадания по releases API активных репозиториев).
- flagtree-cpu 08-30 03:15 UTC push в ветки
triton_v3.6.x/triton_v3.7.x(в main новых коммитов с 7/18 нет); release-info 08-30 05:38 UTC push — ветка gh-pages. Всё это активность уровня веток, в main нет существенного нового содержимого, что не образует опережающего сигнала о релизе.
2. Новостные публикации и экосистема
2.1 Пояснение о спокойном дне: нулевые попадания по компонентным запросам четвёртый день подряд
- Запросы китайской группы gnews (окно 14d): FlagOS, FlagGems, FlagScale, FlagTree, FlagPerf, FlagAttention, FlagCX, KernelGen, FlagOS-Robo, FlagQuantum — все без результатов (четвёртый день подряд); английская группа и HN Algolia (FlagOS/FlagGems/FlagScale/FlagTree) также не дали значимых совпадений (единственное совпадение на HN — нерелевантный шум “security audit tool”, отброшено).
- Вывод совпадает со вчерашним отчётом: компоненты FlagOS находятся в спокойной фазе на стороне новостных медиа, коммиты на GitHub — единственный надёжный источник динамики на данный момент.
2.2 Наблюдение за экосистемой: статья с точкой зрения в сообществе Zhiyuan и репост HICOOL 2026
- 30.08 сообщество Zhiyuan опубликовало Сюэ Лань: «вторая половина» AI — двигатель есть, но дорога ещё не построена (статья с точкой зрения, источник — ссылка gnews). Сообщество Zhiyuan как контентная платформа BAAI, возглавляющего FlagOS, остаётся активным, однако контент представляет собой общие взгляды на управление AI, а не динамику компонентов FlagOS.
- 30.08 сообщество Zhiyuan репостнуло репортаж о Глобальном саммите предпринимателей HICOOL 2026 (26–29.08, Пекин, Шуньи): в «зоне выставки университетов мирового класса» выступил Институт международного управления искусственным интеллектом Университета Цинхуа (I-AIIG), а не сам институт Zhiyuan — прямой связи с FlagOS нет, зафиксировано лишь как фон экосистемы.
3. Углублённое изучение организаций-участников
3.1 Хайгуан: DCU завершила адаптацию инференса Tencent Hy4 preview в Day 0, совпав по дате слияния с #227 (30.08)
Источник: Sina Finance (Beijing Business Today)
- 30.08 Hygon Information опубликовала сообщение: DCU после поддержки Tencent Hy3 и Hy-MT2 первой завершила полную адаптацию инференса большой модели Tencent Hy4 preview, обеспечив поддержку в день выпуска. Адаптация охватывает архитектуру MoE с 770B общих параметров и 49B активных параметров, а также особенности модели Gated MLA, iHC, learnable sink и другие, опираясь на собственные программные стеки DTK и DAS (сторона инференса, обучение не упоминается).
- В тот же день состоялось слияние Torch-FL #227 (см. 1.1) — Хайгуан синхронно продвигается по двум линиям: «адаптация модели в Day 0» и «развязка архитектуры runtime PyTorch».
Трактовка: Tencent Hy4 preview (выпущена с открытым исходным кодом 28.08) — новейший объект конкуренции по адаптации в Day 0 среди отечественных больших моделей: MetaX уже 28.08 официально объявила о завершении Day 0 для Hy4 preview на серии Xiyun C (вне вчерашнего окна), Хайгуан подхватила инициативу 30.08. Хайгуан в экосистеме FlagOS одновременно продвигает официальный основной маршрут PyTorch для DCU, и эффективность её адаптации, как ожидается, дополнительно возрастёт с развязкой runtime.
3.2 MetaX: полугодовой отчёт 2026 вышел из убытков в прибыль, первая среди «четырёх малых драконов отечественных GPU» (30.08)
Источники: The Paper, TradingView
- Вечером 30.08 компания MetaX (688802) опубликовала полугодовой отчёт за 2026 год: выручка 1,324 млрд юаней, +44,67% год к году; чистая прибыль, причитающаяся головной компании, 612 млн юаней, выход из убытков год к году (за аналогичный период прошлого года убыток 186 млн юаней); чистая прибыль второго квартала без учёта нерегулярных статей стала положительной, отгрузки GPU существенно выросли. Рыночная трактовка: в 612 млн юаней чистой прибыли около 887 млн юаней приходится на инвестиционный доход (бумажная прибыль по долевым инвестициям), основной бизнес всё ещё на этапе роста. Капитализация около 270 млрд юаней, 7-нм видеокарты уже в серийном производстве.
- Техническая сторона: MetaX в данном окне продолжила исправления бэкенда MetaX в FlagOS (семантика stream вчера, исправление пустого MUSA tensor в #228 перед началом сегодняшнего окна — всё это относится к завершающей стадии работ по множественным ускорителям).
Интерпретация: MetaX стала первой полугодовой прибыльной компанией среди «четырёх малых драконов отечественных GPU» (MetaX / Moore Threads / Enflame / Biren), что знаменует вступление коммерциализации отечественных GPU в фазу реализации; как член FlagOS, её выход в плюс по финансам и непрерывная адаптация стека MetaX в FlagOS образуют благотворный цикл.
3.3 Enflame: регистрация IPO на STAR Market получена, онлайн-подписка 2 сентября (08-30)
Источники: Sina, Phoenix Finance
- 30 августа заявка Enflame на листинг на STAR Market получила согласие Комиссии по регулированию ценных бумаг на регистрацию, онлайн-подписка 2 сентября (среда) (код 688801); выручка за H1 около 1,1 млрд юаней, убыток около 600 млн юаней, более 80% выручки приходится на Tencent; перед подпиской обсуждение рынка сосредоточено на риске концентрации клиентов.
- Phoenix Finance в тот же день опубликовал углублённый анализ «Конкуренция отечественных вычислительных мощностей вступает в “эпоху кластеров”: разбор технологического рва полного стека Enflame» — «четыре малых дракона отечественных GPU» вскоре соберутся на рынке капитала (MetaX и Moore Threads уже размещены, Biren и Enflame в процессе).
Интерпретация: после завершения регистрации IPO Enflame картина капитализации членов FlagOS становится ещё более полной; её стек GCU в FlagOS (FlagCX collective flow, бэкенды FlagTree gcu300/gcu400, восстановление torch.compile) несколько дней подряд имеет содержательные коммиты, продвижение идёт по двум линиям — капитал и экосистема.
3.4 Iluvatar CoreX: полугодовой отчёт вышел из убытка, но за счёт инвестиционного дохода, зеркальная верификация на стороне GitHub завершена (08-30/08-31)
Источники: Sina Finance
- 30-31 августа СМИ разбирают полугодовой отчёт Iluvatar CoreX: выручка выросла на 191%, но выход из убытка в основном опирается на плавающую прибыль от долевых инвестиций свыше 700 млн юаней, а не на прибыль от основной деятельности; за полугодие привлечено более ста миллиардов гонконгских долларов финансирования «для переливания крови» (после листинга в Гонконге).
- На стороне GitHub: iluvatar-corex4.5.0 завершил в FlagOS регистрацию верификации обеих версий vLLM 0.20.2/0.24.0 (см. 1.3); зеркальный стек с момента добавления нового бэкенда 28 августа три дня подряд интенсивно продвигался, данное окно закрыто.
Интерпретация: Iluvatar CoreX всё ещё требуется время для выхода из убытка по основной деятельности, однако замкнутый цикл верификации vLLM в стеке FlagOS уже завершён первым — прогресс адаптации в экосистеме и финансовый прогресс образуют разительный контраст, что также показывает, что подключение чипов к FlagOS не зависит от финансового состояния производителя.
3.5 Tsingmicro: проверка устройства tsm_smi вошла в скрипт верификации vLLM, форпост подключения нового чипа (08-30)
Источник: build-infra #631
- 30 августа 22:10 build-infra #631 влит: verify-vllm-backend.sh добавлен кейс бэкенда tsingmicro (Tsingmicro) — проверка доступности устройства tsm_smi + guard по суффиксу torch (ожидается сохранение сборки
2.11.0+cpuпосле одношаговой установки vLLM), нулевое влияние на существующие бэкенды.
Интерпретация: Tsingmicro (tsingmicro, чипы реконфигурируемой архитектуры серии Tianshu) ранее в экосистеме FlagOS в основном выступала с форпостными действиями вроде PyTorch-Plugin-FL; на этот раз попадание в конвейер верификации vLLM означает, что её подключение к инференс-стеку вступило в фазу инженерной верификации; это ещё один после Hygon, Iluvatar CoreX и Kunlunxin в августе членский чип, перешедший из «адаптируется» в «верифицируется».
3.6 Moore Threads: повторная публикация roundup старых новостей о листинге A+H, повторно не включается (08-30)
- 30 августа 07:00 колонка Phoenix Finance «ТОП-17 по капитализации Пекина» повторно опубликовала обзор Moore Threads о полугодовой выручке, превысившей весь прошлый год, и планировании двойного листинга A+H. Ключевые факты (выручка за H1 1,736 млрд юаней, +147,42%, объявление о запуске гонконгского листинга 12 августа) уже подробно включены в отчёты 13 и 14 августа, на этот раз это roundup старых новостей, повторно не освещается.
- На технической стороне Moore Threads в данном окне также есть содержательные действия: Torch-FL #228 (исправление пустого MUSA tensor), FlagGems #5742 (оптимизация MTHREADS feature_dropout_), продолжается высокочастотная адаптация в нескольких репозиториях.
3.7 Ascend: Torch-FL MSPTI — исправление требований к запуску процесса (31.08)
Источник: Torch-FL #223
- 31.08 10:04 Torch-FL #223 смёржен: исправлен способ удовлетворения Ascend MSPTI (внутренний инструмент torch уровня процесса) требований к запуску процесса в среде FlagOS, ограничения среды выполнения на стороне Ascend дополнены.
Разбор: Ascend вслед за исправлением установки marker lib/flagos_platform от 29.08 в этом окне мониторинга завершил адаптацию ограничений процесса MSPTI — «самодостаточность окружения» Ascend в стеке FlagOS продолжает совершенствоваться.
4. Итоги
В этом окне мониторинга (30.08 10:18 ~ 31.08 10:18) основная линия экосистемы FlagOS:
- Слияние Torch-FL #227 — крупнейшее техническое событие: путь разделения «официальное ядро PyTorch + библиотека устройств производителя» для Hygon DCU от предложения до реализации занял всего 24 часа, задав парадигму для отечественных дистрибутивов PyTorch по отказу от зависимости от форков производителей; в тот же день #228/#223 охватили MUSA и Ascend, адаптация множества ускорителей продолжает завершаться.
- Двойное событие build-infra: Iluvatar CoreX corex4.5.0 завершил регистрацию верификации двух версий vLLM 0.20.2/0.24.0 (замыкание стека образов завершено); Qingwei впервые вошла в конвейер верификации vLLM (форпост подключения новых чипов), правила управления agent-protocol также реализованы.
- Волна оптимизации производительности FlagFFT: FourStep — полная генерализация путей малых батчей и граничных случаев + набор тестов из 30 размеров, библиотека FFT вступила в этап настройки для всех сценариев; FlagTree добавил операторы TLE signal/wait, оптимизация операторов Moore Threads в FlagGems смёржена в тот же день.
- Новостная сторона — четвёртый день подряд нулевые совпадения на уровне компонентов; динамика капитала и финансовой отчётности членов организации стала основной линией новостей: полугодовой отчёт MetaX вышел из убытка (первый прибыльный среди четырёх малых драконов), Enflame IPO зарегистрирован + подписка 02.09, выход Iluvatar CoreX из убытка зависит от инвестиционного дохода, Hygon DCU завершил Day 0 адаптацию инференса для Tencent Hy4 preview.
- Сигналы экосистемы: адаптация Hygon Hy4 Day 0 и развязка времени выполнения из #227 реализованы в один день, линии адаптации моделей и низкоуровневой архитектуры резонируют; стек инференса Qingwei вступил в стадию инженерной верификации.
Приложение: полный список источников
| Источник | Результат проверки |
|---|---|
| GitHub org repos API (52 репозитория) | 8 репозиториев с пушами в окне, все 24 коммита проверены |
| GitHub commit search | 24 коммита в окне (полная выборка одной страницы), без пропусков |
| GitHub releases API | ноль релизов в окне |
| GitHub PR API (#227/#223/#228/#229/#625-632/#863/#5742) | проверены по одному заголовок/статус/время слияния |
| Google News RSS китайская группа | запросы FlagOS/компоненты — ноль совпадений; Zhiyuan 2 шт. (мнение + перепечатка), финансовые/IPO членов организации — несколько |
| Google News RSS английская группа | ноль действительных совпадений |
| HN Algolia | 1 совпадение — нерелевантный шум, исключено |
| Sina Finance (Hygon Hy4) | проверка текста: 770B/49B, DTK/DAS, Day 0 адаптация инференса |
| The Paper/TradingView (полугодовой отчёт MetaX) | проверка заголовка и ключевых цифр: выручка 1,324 млрд, чистая прибыль 612 млн |
| Kuaikeji (MetaX Hy4 Day 0) | публикация 28.08, вне окна, используется как фоновая ссылка |
| Phoenix Finance (ров Enflame / сводка Moore Threads) | Enflame включён; Moore Threads A+H признано старой сводкой |
| Zhiyuan Community (HICOOL/Сюэ Лань) | HICOOL на деле — динамика I-AIIG Университета Цинхуа, не института Zhiyuan |