모니터링 기간: 지난 24시간 (2026-09-16 10:18 ~ 2026-09-17 11:40, 베이징 시간) 출처: GitHub (org: flagos-ai, 54개 저장소 pushed_at 전수 검증 + 단일 commit search 150건 committer-date 기준 검증 + 주요 저장소 기본 브랜치 커밋 재검증 + tags/releases 메타데이터 + community 릴리스 목록 및 릴리스 타임라인 raw 직접 조회 + 주요 커밋 패치 및 파일 목록 상세), Google News RSS (중영문 33개 쿼리, 프록시 경유), HN Algolia, 투자계, Zhiyuan 커뮤니티, Sina Finance, Leiphone, JiWei 등 (상세는 부록 출처 목록 참조)


이번 호 인덱스

  • 오늘의 중점: build-infra가 버전 필드를 2.1.2에서 2.2.0으로 상향——2.2 GA 전 마지막 전역 스위치가 전환됨 (09-17)
    1. 오픈소스 프로젝트 진행 (GitHub 동향)
      • 1.1 build-infra: base 버전 2.1.2에서 2.2.0으로, FlagGems 5.4.0-rc2.post2 고정 (09-17)
      • 1.2 FlagTrain 신규 저장소 배치: 훈련 측에 빈 플레이스홀더 저장소 등장 (09-16)
      • 1.3 FlagFFT: 36개 FFT 연산자 일괄 검수, NumPy 독립 검증 및 런타임 플랜 포함 (09-16)
      • 1.4 FlagGems 연산자 확장: KernelGen Nvidia 연산자 18개 저장소 반영 (09-16/09-17)
      • 1.5 FlagGems 양자화 연산자 라인: Moore Threads 네이티브 FP8 W8A8 MM, MetaX W8A16 RMSNorm (09-16/09-17)
      • 1.6 FlagGems-vllm: Marlin MoE 융합 및 FP8 가변 길이 FlashAttention-2 (09-16/09-17)
      • 1.7 Torch-FL: 「라우팅 전환」에서 「전환 후과 수정」으로 이동 (09-16/09-17)
      • 1.8 FlagTree: FlagTune 호스팅 Manifest 및 iluvatar3.6 베이스라인 워크플로 (09-16/09-17)
      • 1.9 FlagQuantum: JAX 테스트 연동, 커버리지 하한 60%로 상향 (09-17)
      • 1.10 FlagCX 및 vllm-plugin-FL: PTD 로그 스트리밍화, T-Head PPU CI 연동 (09-16/09-17)
      • 1.11 기타 동향: community, FlagGems-Experimental, flir, FlagScale-Agent, 이미지 tag 기록 (09-16/09-17)
    1. 뉴스 보도 및 생태계
      • 2.1 컴포넌트 레벨 검색 열세 번째 연속 평온 구간: 24시간 내 제로 히트 (09-16~09-17)
      • 2.2 FlagOS 2.2 타임라인 및 RC2 목록 재검증: GA 09-28 확정 (09-17 검증)
      • 2.3 Horizon Robotics 체계: D-Robotics 4억 달러 C라운드 투자 유치 완료 (09-17)
      • 2.4 멤버사 자본면: MetaX 중간 보고 흑자 전환, Enflame 상장 첫날 시가총액 1000억 돌파, 국산 GPU 반기 보고서 (09-16~09-17)
    1. 멤버사 심층 분석
      • 3.1 Hygon: linalg 및 dtype 시맨틱 양단 동시 보완 (09-16)
      • 3.2 Ascend: MoE 및 선형 어텐션에 필요한 연산자 가장 밀집된 라인 (09-16/09-17)
      • 3.3 Damo Academy XuanTie: 추론 플러그인 PPU CI 연동, MM/MV NN/NT 레이아웃 지원 (09-16/09-17)
      • 3.4 Moore Threads: 네이티브 FP8 W8A8 MM 및 MUSA 회전 위치 인코딩 디바이스 측 복귀 (09-16/09-17)
      • 3.5 MetaX: W8A16 RMSNorm 및 3개소 라우팅 우회 (09-16/09-17)
      • 3.6 Kunlunxin: xCCL 기본 이미지 탑재, 연산자 수정 배치 반영 (09-17)
      • 3.7 Iluvatar CoreX: /dev/itrctl 및 iluvatar3.6 베이스라인 워크플로 (09-17)
      • 3.8 Enflame: GCU300 0.24.0 보고서 기록 및 이미지 tag 2건 (09-16)
      • 3.9 BAAI (주관사): 거버넌스 자동화 및 버전 번호 상향 (09-16/09-17)
    1. 요약 및 트렌드 관찰
  • 부록: 출처 검증표
  • 부록: 전체 출처 목록

오늘의 중점: build-infra가 버전 필드를 2.1.2에서 2.2.0으로 상향——2.2 GA 전 마지막 전역 스위치

날짜: 2026-09-17 출처: build-infra #916 버전 상향, build-infra configs.yaml, FlagOS 2.2 릴리스 일정

09-17 08:49, build-infra가 두 줄만 변경한 커밋 Bump base version to 2.2.0 (#916)을 받았다: configs.yamlversion2.1.2에서 2.2.0으로 변경되었고, 같은 위치의 flaggems5.3.5에서 5.4.0-rc2.post2로 변경되었다.

이 두 줄의 무게는 해당 파일 자체의 위상에서 비롯된다. 파일 헤더에는 이것이 「모든 벤더/백엔드 의존성과 빌드 설정의 유일한 진실 공급원(single source of truth)」이라고 명시되어 있으며, scripts/build_base.pyscripts/build_runtime.py가 이를 읽는다. version 필드는 모든 베이스 이미지와 애플리케이션 이미지에 태그를 붙이는 역할을 한다(flagos-base-{벤더}-{백엔드}:{버전}flagos-runtime-{벤더}-{백엔드}:{버전}). 주석에는 릴리스 절차를 세 단계로 적어 놓았다: 이 두 필드를 업데이트하고, v<버전> 태그를 붙이고, 끝낸다. 즉, 전날 각 모듈의 rc 태깅은 후보 버전을 검증 위치로 밀어 올린 것에 불과하지만, 이번 상향은 전체 이미지 라인을 2.2.0으로 향하게 하는 것으로, 2.2 GA 이전 org 내 유일한 전역 스위치다.

다른 증거와 대조하면 리듬이 부합한다: community의 2.2 릴리스 일정은 기능 동결을 08-31, 테스트 및 안정화 기간을 09-01부터 09-24까지, GA를 2026-09-28로 정하고 있다. milestone 「FlagOS 2.2」는 현재 7개 이슈 모두 닫히지 않았고 마감일도 09-28이다. RC2 목록의 24개 모듈 항목 중 FlagGems만 v5.4.0-rc2.post2로 태깅되어 있고 나머지는 여전히 rc2.post1이다. build-infra 저장소 자체의 최신 태그는 여전히 v2.2.0 이전인 v2.1.1로, 이미지 태그가 아직 떨어지지 않았음을 보여준다. GA까지 11일이 남았고, 멀티칩 검증에 남겨진 시간 창은 좁아지고 있다.

주목할 점은 동시성이다: 같은 날 build-infra는 Kunlunxin 베이스 이미지에 xCCL 설치(#917)와 containerfile 수정(#918)도 커밋했는데, 두 건 모두 2.2 이미지 라인 동결 전에 벤더 의존성을 보충하는 것으로, 전형적인 「릴리스 직전 1킬로미터」 작업에 해당한다.


1. 오픈소스 프로젝트 진행 상황(GitHub 동향)

모니터링 기간 개요: org 내 54개 저장소 중 19개가 기간 내 푸시가 있었다. 단일 commit search로 기간 내 커밋 150건이 검색되었으며(2페이지, committer-date 내림차순, 전량 확보), 15개 저장소에 분포한다: FlagGems 71, build-infra 18, Torch-FL 17, FlagGems-sglang 10, FlagTree 8, FlagFFT 7, FlagGems-Experimental 5, FlagGems-vllm 4, FlagQuantum 2, vllm-plugin-FL 2, community 2, 그리고 FlagCX, FlagTrain, FlagScale-Agent, flir 각 1. 또한 docs, release-info, sglang-plugin-FL, TransformerEngine-FL 네 저장소도 기간 내 푸시가 있었지만 기본 브랜치에는 기간 내 새 커밋이 없다(측면 브랜치 또는 태그 푸시에 해당하며, docs와 release-info는 릴리스 산출물과 문서 사이트 동기화를 담당한다).

이번 기간의 형태 = 「릴리스 산출물 동결」 + 「전환 후유증 수리」 두 축: 거버넌스 측에서는 build-infra가 버전 번호를 올리고, community가 릴리스 우선순위를 동기화하며 2.2를 마무리한다. 엔지니어링 측의 관심은 「연산자 라이브러리에 연산자를 추가하는 것」에서 두 가지 마무리 작업으로 옮겨갔다. 첫째는 새로 등록된 연산자를 규범에 등록하는 것(내보내기 검사, 테스트 마킹, 벤치마크 정렬), 둘째는 지난주 라우팅 전환이 각 칩 플랫폼에서 노출한 구체적 문제를 받아내는 것(MetaX의 슬라이스 연산자, MUSA의 복소수 회전 위치 인코딩과 난수 브리지, CUDA의 FlagTune 부재)이다. FlagTrain은 이번 기간 유일한 신규 저장소지만 현재는 자리 표시자에 불과하다.

1.1 build-infra: base 버전 2.1.2에서 2.2.0으로, FlagGems 5.4.0-rc2.post2 고정(09-17)

날짜: 2026-09-17 출처: build-infra #916, build-infra configs.yaml

자세한 내용은 「오늘의 중점」 참조. 한 가지 대조할 만한 가치를 보충하자면: flaggems 필드가 5.3.5에서 곧바로 5.4.0-rc2.post2로 건너뛰었는데, 이는 소버전 하나와 두 라운드의 rc를 건너뛴 것으로, 2.1.2 이미지 라인이 이전에 바인딩했던 연산자 라이브러리와 2.2 후보 사이에 이미 상당한 검증 거리가 있음을 보여준다. 한편 build-infra 저장소의 최신 태그는 여전히 v2.1.1에 머물러 있고 v2.2.0 태그는 아직 나타나지 않았으니, 이후 데일리 리포트의 관찰 포인트로 삼을 수 있다.

1.2 FlagTrain 새 저장소 자리 잡기: 훈련 측에 빈 자리표시자 저장소 등장 (09-16)

날짜: 2026-09-16 출처: FlagTrain 저장소

09-16 15:02, org 내에 새 저장소 FlagTrain이 추가되었으며, 저장소 생성과 유일한 커밋(Initial commit)의 간격이 1초도 되지 않았다. 저장소 규모 5 KB, 설명 없음, 언어 통계 없음, README는 한 줄 제목뿐——전형적인 자리표시자 저장소다. 이름상으로는 FlagOS의 훈련 측에 속한다: 해당 방향에는 현재 FlagScale(훈련 프레임워크 진입점), Megatron-LM-FL과 TransformerEngine-FL(훈련 커널 및 병렬 연산자), FlagScale-Agent(자동화 튜닝)가 있으며, 새 저장소의 위치는 README와 디렉터리가 채워진 후에야 판단할 수 있지만, 「훈련 측에서 또 한 조각을 분리해냈다」는 움직임 자체는 기록할 만하다. org 관례에 따르면(FlagSparse, Open3D-PIMC 모두 먼저 저장소를 만들고 이후 일괄적으로 코드를 반영했다), 코드 안착은 보통 저장소 생성 후 며칠에서 몇 주 내에 일어난다.

1.3 FlagFFT: 36개 FFT 연산자 일괄 검수, NumPy 독립 검증과 런타임 플랜 적용 (09-16)

날짜: 2026-09-16 출처: FlagFFT 연산자 검수 커밋, FlagFFT 저장소

09-16 15:38, FlagFFT가 +2151/-2298의 커밋 feat: accept 36 FFT operators with NumPy validation and runtime plans를 받았으며, 한 번에 36개 FFT 연산자를 검수 상태로 전환했다. 변경은 8개 파일에 걸쳐 있다: 연산자 목록과 테스트 매트릭스 두 가지 설정, 빌드 선언, 검수 테스트 러너, 그리고 독립 검증 전용 참조 구현 도구 한 쌍(C++ 측은 기준 출력 캡처를 담당하고, Python 측은 연산자별 비교를 수행한다). 이후 두 시간 내에 세 가지 부수 커밋이 추가되었다: test: enforce complete acceptance coverage and update CI reporting(15:44)은 검수 커버리지를 강제 항목으로 명시하고 CI 보고 기준을 변경했으며, fix: preserve report compatibility and test interruption handling(15:58)은 보고서 호환성과 중단 처리를 수정했다.

세 가지를 함께 읽으면, FlagFFT 이번 라운드의 실질적 변화는 「연산자가 36개 늘었다」가 아니라 검수 기준의 업그레이드다: 독립적으로 캡처한 NumPy 출력을 참조 구현으로 삼아 런타임 플랜(runtime plans)과 함께 항목별로 비교하는 것이지, 자기 검증식 단위 테스트가 아니다. RC2 목록에서 FlagFFT의 후보 버전은 v0.2.0-rc2.post1이며, 이 검수 라인이 바로 그것이 rc에서 GA로 나아가는 근거다.

1.4 FlagGems 연산자 확장: KernelGen의 Nvidia 연산자 18개 저장소 반영 (09-16/09-17)

날짜: 2026-09-16 ~ 2026-09-17 출처: FlagGems 저장소 커밋, FlagGems #6135 histogramdd, FlagGems #5961 slice_copy

윈도우 내 KernelGen 라인은 매일 십여 건의 속도로 메인 저장소에 Nvidia 연산자를 계속 투입하고 있으며, Triton 커널을 포함한 신규 등록 연산자는 총 18개로 네 가지 분류를 아우른다: 형상 및 인덱스류(차원 축소, 슬라이스 복사, 채널 셔플, 동일 형상 판정, 차원별 값 추출), 선형 대수 및 특수 함수류(텐서 역행렬, 행렬식 로그, Sobol 시퀀스, 지수 함수), 학습 및 역방향류(트레이스 역방향, 마스크 소프트맥스 역방향, 희소 임베딩 역방향, 랜덤 드롭아웃), 그리고 풀링 및 샘플링류(프랙셔널 3차원 풀링, 최근접 3차원 업샘플링 역방향). 유형 분포는 이전 윈도우와 일치한다——선형 대수, 특수 함수, 학습용 역방향 연산자가 각각 한 구간씩 차지한다.

진정한 엔지니어링 분량을 보여주는 것은 이에 뒤따르는 등록 및 테스트 규범 세 가지다: 하나는 연산자 내보내기에 정렬 및 일관성 검사를 추가하고, 하나는 「FlagGems를 사용하여 ATen 대체」 검사를 이번에 새로 추가된 행으로 제한하여 기존 코드의 간섭을 방지하며, 또 하나는 명명 규칙에 따라 밑줄 연산자의 테스트 마커를 자동으로 도출한다. 또 하나 [Test] Align MM tests and parallel FP8 benchmark with scaled-MM API(#6329)는 테스트 측에서 스케일드 행렬 곱의 인터페이스를 정렬한다. 대량 등록의 부작용은 「등록 비용」의 상승이며, 이 몇 가지가 바로 그 비용을 CI에 고정하는 작업이다.

1.5 FlagGems 양자화 연산자 라인: Moore Threads 네이티브 FP8 W8A8 MM, MetaX W8A16 RMSNorm (09-16/09-17)

날짜: 2026-09-16 ~ 2026-09-17 출처: FlagGems #6211 Moore Threads FP8 W8A8, FlagGems #6326 MetaX W8A16 RMSNorm, FlagGems #4412 FP8 topk

Moore Threads 라인은 네이티브 FP8 W8A8 행렬 곱 백엔드를 새로 추가했다(#6211, 5개 파일, +1100/-80): Moore Threads 백엔드의 양자화 행렬 곱 디렉터리 아래에 벤더 네이티브 경로를 구현하여 Nvidia Hopper 버전과 나란히 존재하며, 벤치마크 스크립트와 테스트를 갖추어 이 경로가 「일반 커널에 폴백을 붙인 방식」이 아닌 「하드웨어에 밀착한 네이티브 구현」으로 제공됨을 보여준다. MetaX 라인은 W8A16 RMSNorm을 새로 추가하여(#6326) 양자화 범위를 행렬 곱에서 정규화 레이어로 확장했다; 같은 기간에 FP8 topk의 경로 선택도 최적화했다(#4412). 여기에 테스트 측의 스케일드 행렬 곱 API 정렬과 fix ops bugs(#6259)의 일괄 수정을 더하면, 이번 윈도우에서 양자화와 직접 관련된 커밋은 총 7건이다. 종합하면 W8A8/W8A16의 커버리지는 「행렬 곱 한 레이어」에서 정규화, 샘플링 등 인접 연산자로 확산되고 있으며, 이는 2.2에서 양자화 연산자를 확장 주력 라인으로 위치시킨 것과 부합한다.

1.6 FlagGems-vllm: 융합 Marlin MoE와 FP8 가변 길이 FlashAttention-2 (09-16/09-17)

날짜: 2026-09-16 ~ 2026-09-17 출처: FlagGems-vllm #750 융합 Marlin MoE, FlagGems-vllm #749 FP8 가변 길이 어텐션

두 가지 대규모 변경이 같은 사고방식으로 추론 연산자 계층에 적용되었다. 첫째, [QC] Add INT8 and FP8 W8A16 fused Marlin MoE(#750, 7개 파일, +3118/-46)는 INT8과 FP8 두 가지 W8A16 가중치의 융합 Marlin MoE 연산자를 새로 추가하며, 두 개의 벤치마크 스크립트, 하나의 테스트, Nvidia 백엔드의 튜닝 설정 tune_configs.yaml을 포함하고 연산자 선택 도구도 갱신했다. 둘째, [QC] Add FP8 W8A8 variable-length FlashAttention-2(#749, 5개 파일, +4710)는 가변 길이 시퀀스의 FP8 FlashAttention-2를 보완하여 프리필 단계에서 가장 흔한 형상을 커버하고, 동시에 conf/operators.yaml에 등록했다.

두 연산자 모두 같은 유형의 공백을 지적한다: 추론 측 양자화 연산자는 이전까지 고정 형상과 밀집 경로에 집중되어 있었지만, 실제 서비스에서는 가변 길이 배치와 MoE 희소 활성화가 주류 형태다. 이러한 연산자의 검수 기준도 더 높다——두 개의 벤치마크와 튜닝 설정이 동시에 등록된다는 것은 이들이 「돌아가는」 기준이 아닌 「튜닝 가능하고 재현 가능한」 기준으로 제공됨을 의미한다.

1.7 Torch-FL: 「라우팅 전환」에서 「전환 후유증 수정」으로 (09-16/09-17)

날짜: 2026-09-16 ~ 2026-09-17 출처: Torch-FL #306 MetaX 우회, Torch-FL #316 MUSA 회전 위치 인코딩, Torch-FL #310 FlagGems master로 재고정

이전 모니터링 기간의 주요 작업은 6개 플랫폼의 연산자 디스패치를 「FlagGems 우선」으로 전환하는 것이었고, 이번 기간의 17개 커밋은 거의 모두 이 전환의 잔향으로, 처리 방식에 따라 세 가지로 나눌 수 있다.

첫 번째는 명명된 우회이다. MetaX에서는 slice.Tensor를 FlagGems 라우팅에서 제거하고 이를 통해 Qwen-Image-2512의 수동 테스트 흐름을 뚫었다(#306). MUSA에서는 복소수 형태의 회전 위치 인코딩 연산자가 디바이스 측에서 실행되도록 유지했으며(#316, 8개 파일, +99/-7, csrc/aten/backends/musa/ 아래의 생성 코드와 codegen_mudnn.py의 생성 규칙 포함), 동시에 벤더 연산자 모듈의 난수 브리지를 재바인딩했다(#298). 두 번째는 명시적 스위치이다. 업스트림 FlagGems master에서 회귀가 발생하여 CI를 임시로 이전 사용 가능 커밋으로 재고정했고(#310), CUDA 온라인에서 FlagTree가 FlagTune을 가져오기 전에 우선 USE_FLAGTUNE=0을 설정했으며(#311), 빌드 시점의 가속기 구성을 wheel에 기록하여(#314, 단위 테스트 포함) 설치 후에야 빌드 대상을 알게 되는 상황을 피했다. 세 번째는 게이트 구축이다. 연산자 테스트 게이트에서 PPU를 명시적으로 탐지하고(#309), PPU 테스트 목록을 내장 JSON 대신 ppu.yml에서 읽도록 변경했으며(#305), 플랫폼 파이프라인을 플랫폼 독립 검사 뒤에 통합 배치했고(#304), CI 전 플랫폼에서 FlagGems master를 추적했다(#301).

세 가지를 종합하면 재사용 가능한 대응 패턴이다. 고칠 수 있는 것은 라우팅 우회로 처리하고 테스트를 남기며, 고칠 수 없는 것은 명시적 스위치로 막고, 마지막으로 판단 근거를 게이트에 넣는다. 「하나의 연산자 라이브러리를 여러 칩에서 재사용한다」는 명제에서 우회 목록의 길이 자체가 가용성의 척도이다.

1.8 FlagTree: FlagTune 호스팅 Manifest와 iluvatar3.6 베이스라인 워크플로 (09-16/09-17)

날짜: 2026-09-16 ~ 2026-09-17 출처: FlagTree #1103 FlagTune 호스팅 Manifest, FlagTree #1197 Iluvatar 베이스라인 워크플로, FlagTree #1190 PPU 벤치마크 결과

주요 변경은 FlagTune(자동 튜닝 서브시스템)의 대규모 개편이다(#1103, 17개 파일, +687/-153). 호스팅 Manifest 기본값런타임 호환 처리를 추가했으며, 변경 범위는 계약 계층(연산자 모드와 표현식 정의), 검색 계층(유전 알고리즘 검색과 인터페이스 규약), 실행 계층(자동 튜너, 벤치마크 프로토콜, 디바이스 추상화와 오류 정의)을 아우르고, 네 가지 테스트(벤치마크 프로토콜, 모델 아카이브, 모델 출처, 런타임 오류)를 함께 구성했다. 이른바 호스팅 기본값이란 튜닝 구성의 디폴트가 더 이상 로컬 생성에 의존하지 않고 한 곳에서 통합 제공된다는 뜻으로, 이는 다중 칩, 다중 Triton 버전 조합에서 특히 중요하다.

이에 맞춘 엔지니어링 작업도 같은 날 진행되었다. Iluvatar CoreX를 위해 iluvatar3.6의 FlagGems 베이스라인과 테스트 워크플로를 추가하고(#1197), PPU 벤치마크 결과를 갱신했으며(#1190), FlagGems 테스트 템플릿의 백엔드 초기화를 통합 인터페이스로 추출하고(#1192), hcu 라인의 벤치마크 스크립트를 서킷 브레이커 프로세스를 정리하는 스크립트로 교체하고(#1188), 간헐적으로 실패하는 Ascend TLE 케이스에 대해 무시 처리를 추가했다(#1185).

1.9 FlagQuantum: JAX 테스트 연동, 커버리지 하한 60%로 상향 (09-17)

날짜: 2026-09-17 출처: FlagQuantum #48 JAX 테스트와 커버리지 하한

09-17 11:05, FlagQuantum은 +429/-5의 커밋을 받아 JAX 테스트를 공식적으로 지속적 통합에 연동했다. 하이브리드 프론트엔드 테스트 하나와 유닛 테스트 다섯 개(배치 풀백, MPS 커널, 상태 벡터 커널, 텐서 네트워크 수축, 텐서 네트워크 커널)를 추가하고, 지속적 통합 워크플로와 테스트 구성을 동기화하여 갱신했으며, 커버리지 하한 60%를 계약 디렉터리 아래의 커버리지 정책 파일에 기록했다. 즉 품질 임계값을 워크플로 파라미터가 아닌 계약 파일의 형태로 고정한 것이다. 이 저장소는 「PyTorch 우선 양자 AI 프레임워크」를 표방하는데, JAX를 연동했다는 것은 두 번째 프론트엔드를 동등한 인수 기준에 포함시키고 있음을 의미하며, 이는 FlagOS 각 모듈이 일반적으로 「먼저 계약을 정하고 그다음 구현을 보충한다」는 방식과 일치한다.

1.10 FlagCX 및 vllm-plugin-FL: PTD 로그 스트리밍화, T-Head PPU CI 연동 (09-16/09-17)

날짜: 2026-09-16 ~ 2026-09-17 출처: FlagCX #601 PTD 로그 스트리밍화, vllm-plugin-FL #518 Damo Academy XuanTie PPU CI, vllm-plugin-FL #528 Kunlunxin 수정

FlagCX의 변경은 작지만 핵심적이다. 칩 간 통신 라이브러리의 성능 도구 PTD는 로그를 OpenMetrics로 변환할 때 전체 로그를 한 번에 메모리로 읽어들여, prepare 단계에서 대규모 실행 시 메모리 고갈로 종료되곤 했다. #601은 변환을 스트리밍 처리로 바꾸었다 (tools/PTD/src/prom2openmetrics.py, +68/-29). 대가는 상태 머신 한 계층이 추가된 것이고, 이득은 도구 자체가 더 이상 부하 테스트 규모의 병목이 되지 않는다는 점이다.

추론 플러그인 라인에서 두 건: Damo Academy XuanTie PPU의 CI가 정식 연동되었다 (#518, 9개 파일). 새 플랫폼 설정 configs/thead.yml, 환경 준비 및 검사 스크립트, 이미지 docker/thead/Dockerfile과 플랫폼 테스트 목록 tests/platforms/thead.yaml이 추가되었으며, 겸사겸사 MetaX 플랫폼 목록과 정리 도구도 수정했다. Kunlunxin 쪽에서는 FlashAttention 모듈 임포트 실패 후 남은 상태 오염을 수정했다 (#528). PPU CI 연동을 본 보고서 1.7의 Torch-FL의 PPU에 대한 명시적 탐지와 함께 읽으면, Damo Academy XuanTie 라인의 이번 모니터링 기간 자체 테스트 커버리지가 눈에 띄게 강화되었다.

1.11 기타 동향: community, FlagGems-Experimental, flir, FlagScale-Agent, 이미지 tag 기록 (09-16/09-17)

날짜: 2026-09-16 ~ 2026-09-17 출처: community 2.2 프로젝트 동기화, FlagGems-Experimental MetaX index_select, flir #74, build-infra Kunlunxin xCCL

  • community: 릴리스 우선순위를 프로젝트 뷰에 동기화하고 (워크플로 .github/workflows/flagos-2.2-project-sync.yml, +60/-1), 2.2 항목이 릴리스 기간 동안 계속 보이도록 보장했다. 거버넌스 조치가 버전 상향과 같은 날 발생했으며, 2.2 마무리의 부속 작업에 해당한다.
  • FlagGems-Experimental: MetaX의 index_select 구현을 수정하고 (#419), conv_depthwise2d에 MetaX 지원을 추가하고 (#391), dense_dim 연산자를 보강했다 (#639). 이 저장소는 계속해서 “백엔드 적응을 먼저 안착시키고, 검증 후 메인 저장소에 반영”하는 실험장 역할을 하고 있다.
  • flir: tile.to_tensor의 Pure 표시를 제거하여 업스트림의 bufferization 의미론에 맞추었다 (#74). 변경은 Ascend TLE 라인과 관련되어 있다.
  • FlagScale-Agent: 문서 내 클론 주소가 자체 저장소를 가리키도록 수정했다 (#42).
  • build-infra 이미지 라인: Kunlunxin 기본 이미지에 xCCL을 설치하고 (#917), 해당 containerfile을 수정했다 (#918). 동시에 여섯 개의 vLLM 애플리케이션 이미지 tag를 기록했으며 (Moore Threads musa5.2.0 및 musa4.3.6, Enflame tops1.9.10 및 tops1.10.6 각 두 개), Kunlunxin 0.24.0의 만료된 릴리스 예정 변경 로그를 정리했다 (#911).

2. 뉴스 보도와 생태계

2.1 컴포넌트 수준 검색 열세 번째 연속 조용한 모니터링 기간: 24시간 내 제로 히트 (09-16~09-17)

날짜: 2026-09-16 ~ 2026-09-17 출처: Google News RSS (중영문 33개 쿼리어, 모니터링 기간 내 제로 히트)

이번 호는 FlagOS, FlagGems, FlagScale, FlagTree, FlagPerf, FlagCX, KernelGen, FlagAttention 그리고 Zhiyuan 오픈소스, BAAI open source, Zhongzhi FlagOS 등의 키워드로 중·영문 각각 절반씩 총 33개 검색 조합을 실행했으며, 24시간 모니터링 기간 내 히트 제로였고, 컴포넌트명과 관련된 가장 최근 보도는 여전히 09-15 10:16의 Open3D-PIMC 오픈소스 관련 영문 기사와 09-14의 중문 하드웨어 기사입니다. 이는 연속 열세 번째 조용한 모니터링 기간입니다.

기존 관찰에 따르면 FlagOS의 외부 가시성은 “월간 리듬”을 보입니다: 릴리스, 업계 컨퍼런스, 칩 적응 Day0 세 가지 유형의 이벤트만이 보도 피크를 가져오며, 릴리스 전 테스트 기간이 바로 침묵기입니다. 이번 주기의 가시성 피크는 09-28 GA 전후에 위치할 것으로 예상됩니다. HN Algolia 동기간 조회(FlagOS / FlagGems / FlagScale / FlagTree) 역시 비어 있습니다.

2.2 FlagOS 2.2 일정과 RC2 목록 재검토: GA 09-28 확정(09-17 검증)

날짜: 2026-09-17(검증일) 출처: 2.2 릴리스 일정, 2.2 RC2 소스 목록, milestone FlagOS 2.2

릴리스 산출물에 대해 전체 점검을 한 차례 수행했습니다. 일정: 기능 동결 08-31, 테스트 및 안정화 기간 09-01~09-24, GA 09-28; 동결 규칙에는 예외 채널(보안 패치, 심각한 결함 및 CI 차단은 긴급 채널 이용 가능, TSC 승인 필요)과 졸업 기준이 명시되어 있습니다——실행 가능한 테스트 계획이 테스트 기간 내에 통과해야만 FEP 상태가 “구현 가능”에서 “구현 완료”로 전환됩니다.

목록: RC2의 24개 모듈 항목은 L0 인프라 계층(FlagTree는 Triton 3.6 / 3.5 / 3.3에 따라 세 갈래로 분리, FlagCX), 연산자 계층(FlagGems, FlagFFT, FlagSparse, FlagDNN, FlagBLAS, FlagTensor, FlagAudio, FlagAttention), 추론 플러그인 계층(FlagGems-vllm, FlagGems-sglang, Torch-FL, vllm-plugin-FL, sglang-plugin-FL), 학습 계층(TransformerEngine-FL, Megatron-LM-FL, FlagScale), 릴리스 및 도구 계층(KernelGen, KernelGenBench, FlagRelease, 압축기)을 포함합니다. 버전 면에서는 FlagGems만 rc2.post2로 지정되었고 나머지는 rc2.post1이며, FlagTree는 0.7.0rc2.post1+triton3.x의 자체 명명 형식을 따릅니다.

마일스톤 측면: 2.2의 7개 이슈는 현재 전부 미종료 상태이며, 마감일은 09-28로 일정과 일치합니다. 종합하면 2.2는 “코드 동결, 검수 마무리” 단계에 있으며 지연 신호는 나타나지 않았습니다.

2.3 Horizon Robotics 체계: D-Robotics, 4억 달러 C라운드 투자 유치 완료(09-17)

날짜: 2026-09-17 출처: Pedaily 보도

09-17, D-Robotics(영문명 D-Robotics, Horizon Robotics가 육성하고 2024년에 독립한 로봇 소프트웨어·하드웨어 기반 회사)가 4억 달러 C라운드 투자 유치를 완료했다고 발표했습니다. 이번 라운드는 Mirae Asset이 리드했으며, Meituan 전략투자, 허페이 국유투자, 난산 전신투자, 징취안캐피탈 등 산업 및 정부 투자 플랫폼과 카이후이펀드, 화메이인터내셔널, 광파신더, 차오웨모얼, 치항투자 산하 신촹2기 펀드 등 기관이 공동 참여했으며, 기존 주주인 Gaorong Ventures, Five Source Capital, Linear Capital, Huangpu River Capital, Temasek 산하 Vertex Growth, Prosperity7, Hexuan Capital, Yunfeng Fund, Meituan Longzhu, Jiuhe Ventures 등이 지속적으로 증액했습니다.

자금 용도는 구체적으로 명시되었습니다: Xuri 칩의 전 연산력 대역 제품 배치를 강화하고, “데이터 수집—모델 학습—시뮬레이션 검증—추론 배포”를 관통하는 전 링크 소프트웨어 플랫폼을 구축합니다. 함께 제공된 운영 데이터도 정보량이 있습니다: 2026년 상반기 매출은 전년 동기 대비 수배 성장, Xuri 시리즈 칩 누적 출하 800만 개 초과, 임바디드 인텔리전스 사업은 양산급 출하 진입, 플래그십 S600은 반년 내 20여 개 선도 고객사 채택, 임바디드 인텔리전스 고객 커버리지 50% 초과.

본 보고서 주제에 대한 의미는 소프트웨어 스택 측면의 위치에 있습니다: Horizon Robotics(그 로봇 체계 포함)는 FlagOS의 멤버 단위 중 하나이며, 그 칩과 엣지 플랫폼은 FlagOS의 엣지 및 임바디드 인텔리전스 방향의 착지점입니다; “전 링크 소프트웨어 플랫폼” 구축 방향은 FlagOS-Robo가 로봇 측에서 해결하려는 문제와 높은 중첩도를 보이며, 향후 그 소프트웨어 플랫폼이 FlagOS 컴포넌트를 도입하는지 주목할 수 있습니다.

2.4 멤버 단위 자본 측면: MetaX 중간보고 흑자 전환, Enflame 상장 첫날 시가총액 1000억 돌파, 국산 GPU 반기보고(09-16~09-17)

날짜: 2026-09-16 ~ 2026-09-17 출처: Huxiu MetaX 중간 보고서, Sina Finance Enflame 상장 첫날, Leiphone 중국산 GPU 반기 보고서 해석

회원사의 대외 서사는 이번 기간 자본 측에 집중되었으며, 세 가지로 정리된다. MetaX의 2026년 중간 보고서가 적자에서 흑자로 전환했으나 주력 사업은 여전히 투자 단계에 있다는 점(09-16), Enflame의 상장 첫날 시가총액이 1,000억 위안을 돌파했으며 09-17의 해석은 그 “시장화 GP 및 지방 국유기업 LP”의 지분 구조로 옮겨갔다는 점, Leiphone이 09-17에 네 곳의 중국산 GPU 반기 보고서를 종합했으며 그 착안점은 2차 시장의 밸류에이션 내성도라는 점이다. 같은 날 시세 측면에서는 Moore Threads, MetaX, Cambricon 모두 큰 폭의 변동을 보였는데, 이는 시장 정보이지 생태계 동향이 아니므로 본 보고서에서는 항목으로 수록하지 않는다.

짚고 넘어가야 할 것은 기준의 경계다. 위 세 가지 모두 FlagOS 프로젝트 진행의 증거로 삼을 수 없으며, 이들은 단지 회원사의 경영 및 자금 조달 상태에 대한 방증일 뿐이다. 이번 기간 FlagOS와 관련된 기술적 움직임은 여전히 GitHub에서만 나타났으며, 이는 연속된 여러 모니터링 기간의 공통된 특징이기도 하다.


3. 회원사 심층 분석

3.1 Hygon: linalg와 dtype 의미론 양쪽을 동시에 보완 (09-16)

날짜: 2026-09-16 출처: FlagGems #5390 linalg_lstsq, FlagGems #5959 linalg_matrix_power, FlagGems #6351 nansum dtype

Hygon은 이번 기간 단일 대형 움직임 없이 세 가지 병렬 보완을 진행했다. 첫째, linalg_lstsq가 한 번에 세 개 백엔드(Hygon, MetaX, Iluvatar CoreX)를 지원한다는 것은 최소제곱과 같은 선형대수 연산자의 멀티칩 구현이 그룹 단위로 추진되기 시작했음을 의미한다. 둘째, linalg_matrix_power가 Hygon과 Iluvatar CoreX를 지원하며 이는 행렬 함수 계열에 속한다. 셋째, nansum의 정수형 dtype 승격 수정이 Nvidia, Ascend, MetaX, Hygon을 동시에 포괄하고 int8/uint8 케이스를 추가했다. 이는 의미론적 일관성 성격의 작업으로, 성능이 아니라 “동일한 연산자가 서로 다른 백엔드에서 다른 타입을 내놓는” 문제를 수정한 것이다. 직전 기간 Hygon의 중점은 툴체인과 패키징 환경 적응(gflags 헤더 파일, TLE 화이트리스트, 이미지)에 있었는데, 이번 기간에는 연산자와 의미론으로 옮겨갔으며, 방향의 전환은 기반 환경 문제가 기본적으로 정리되었음을 보여준다.

3.2 Ascend: MoE와 선형 어텐션에 필요한 연산자가 가장 밀집된 라인 (09-16/09-17)

날짜: 2026-09-16 ~ 2026-09-17 출처: FlagGems #6324 swiglu, FlagGems #6325 grouped_matmul, FlagGems-vllm #789 compressor, FlagGems-vllm #788 chunk_gated_delta_rule_fwd

Ascend 계열은 이번 기간 커밋이 가장 밀집했고, 현재 대모델 구조의 두 핫스팟에 집중되었습니다. MoE 방향: swiglu 활성화(#6324)와 grouped_matmul 그룹 행렬곱(#6325) — 전자는 MoE 피드포워드 네트워크의 활성화 함수이고, 후자는 전문가 병렬의 핵심 연산자로, 두 가지가 모두 갖춰지면 한 계층의 완전한 MoE 계산이 연산자 라이브러리 내에서 폐쇄 루프를 이룰 수 있음을 의미합니다. 선형 어텐션 방향: compressor(#789)와 chunk_gated_delta_rule_fwd(#788) 두 융합 연산자가 추론 플러그인 저장소에 진입했으며, GDN 계열 선형 어텐션의 청크 전방향에 대응합니다. 여기에 flirtile.to_tensor에 대한 시맨틱 정렬(#74, Ascend TLE 계열 관련), 그리고 linalg_norm(#6355), linalg_matrix_norm(#5670) 두 노름 구현이 더해져, Ascend는 연산자 측면에서 이번 기간 적용 범위가 가장 넓은 곳입니다.

3.3 Damo Academy XuanTie: 추론 플러그인 PPU CI 연동, MM/MV가 NN/NT 레이아웃 지원 (09-16/09-17)

날짜: 2026-09-16 ~ 2026-09-17 출처: vllm-plugin-FL #518 PPU CI, FlagGems #6302 MM/MV 레이아웃 최적화, FlagTree #1190 PPU 벤치마크

Damo Academy XuanTie(PPU) 계열은 이번 기간 “테스트 인프라 + 성능” 두 축이었습니다. 테스트 측: vllm-plugin-FL이 PPU를 지속적 통합에 연결했고(#518, 신규 플랫폼 설정, 환경 준비 스크립트, 이미지 및 플랫폼 테스트 체크리스트 추가), Torch-FL은 연산자 테스트 게이트에서 기본 브랜치에 의존하지 않고 PPU를 명시적으로 탐지하며(#309), PPU 테스트 체크리스트를 ppu.yml에서 읽도록 변경했습니다(#305). 성능 측: FlagGems가 행렬곱과 행렬-벡터곱에 NN과 NT 두 레이아웃 지원 및 최적화를 수행했고(#6302), FlagTree는 PPU 벤치마크 결과를 갱신하고(#1190) PPU와 MetaX에서의 tl.load/tl.dot 동작을 수정했습니다(#1191). 한 플랫폼을 “연산자를 돌릴 수 있음”에서 “CI에서 지속적으로 검증될 수 있음”으로 끌어올리는 것은, 사용성이 개별 사례에서 일상으로 나아가는 분기점입니다.

3.4 Moore Threads: 네이티브 FP8 W8A8 MM과 MUSA 회전 위치 인코딩의 디바이스 측 복귀 (09-16/09-17)

날짜: 2026-09-16 ~ 2026-09-17 출처: FlagGems #6211 네이티브 FP8 W8A8, Torch-FL #316 MUSA 회전 위치 인코딩, Torch-FL #298 RNG 브리지

세 가지 작업은 동일한 목표를 향합니다 — MUSA 백엔드가 양자화 추론과 장문맥 모델에서 폴백을 줄이도록 하는 것입니다. 연산자 측에는 네이티브 FP8 W8A8 행렬곱 백엔드가 추가되었고(#6211), 어댑테이션 측에서는 복소수 형태의 회전 위치 인코딩 연산자를 디바이스 측에서 실행하도록 유지하여(#316) 기존에 가능했던 요소별 호스트 폴백을 피했습니다. 안정성 측에서는 벤더 연산자 모듈의 난수 브리지를 재바인딩하여(#298) 시드와 스트림의 일관성을 수정했습니다. 이미지 측에서는 build-infra가 MUSA 5.2.0과 4.3.6 두 애플리케이션 이미지 tag를 기록하고, 0.24.0 rc2 재빌드를 위한 미출시 변경 로그를 보충했습니다(#913/#914/#915). 회전 위치 인코딩과 난수 브리지 이 두 항목은 “눈에 띄지 않지만 반드시 통과해야 하는” 관문 항목이며, 칩 간 추론 정밀도 정렬 가능 여부의 흔한 분기점이기도 합니다.

3.5 MetaX: W8A16 RMSNorm과 세 곳의 라우팅 우회 (09-16/09-17)

날짜: 2026-09-16 ~ 2026-09-17 출처: FlagGems #6326 W8A16 RMSNorm, FlagGems-Experimental #419 index_select, Torch-FL #306 slice.Tensor 우회

메타엑스 라인은 이번 기간 “연산자 하나 추가, 세 군데 경로 우회”가 주를 이룬다. 연산자 측에서는 W8A16 RMSNorm(#6326)을 새로 추가해 양자화 정밀도를 정규화 레이어까지 확장했고, 실험 저장소에서는 index_select의 구현 문제(#419)를 수정하고 깊이별 합성곱 지원(#391)을 보강했다. 라우팅 측에서는 세 군데를 우회한다: Torch-FL은 slice.Tensor를 FlagGems 라우팅에서 제외해 Qwen-Image-2512의 수동 테스트 흐름을 뚫고(#306), 행렬 곱을 일부 시나리오에서 FlagGems 라우팅을 우회하도록 했으며(1.7의 게이트와 짝을 이룸), FlagTree 측에서는 linalg_solve_triangular의 테스트 참조 구현을 수정했다(#6341). 우회 항목 자체는 성과가 아니지만, 이것들이 하나하나 이름 붙여 기록되어야 후속 버전의 수렴에 근거가 생긴다.

3.6 쿤룬신: xCCL을 기본 이미지에 탑재, 연산자 수정 배치 착수 (09-17)

날짜: 2026-09-17 출처: build-infra #917 xCCL, FlagGems #6328 연산자 수정, FlagGems #4540 topk_softmax 스텁

쿤룬신 라인은 이번 기간 세 가지 유형의 작업으로 구성된다. 이미지 측: 기본 이미지에 xCCL을 탑재하고(#917) 그 containerfile을 수정했다(#918) — 벤더 통신 라이브러리를 기본 이미지에 미리 넣는다는 것은 이 플랫폼에서 칩 간 통신이 더 이상 런타임 외부 부착에 의존하지 않는다는 뜻이며, 본 보고서 1.10의 FlagCX 툴체인 개선 방향과 일치한다. 연산자 측: 일괄 수정이 동시에 착수되어 masked_fill, sinh, mish, hardswish, index_fill 다섯 연산자를 커버했고(#6328), topk_softmax에는 C++ 런처용 커널 스텁을 추가했으며(#4540), 이미 해결된 softmax_backward 차원 건너뛰기 로직을 제거했다(#4539). 엔지니어링 측: 테스트를 컨테이너 내에서 실행하도록 변경하고(#6343), 추론 플러그인에서 FlashAttention 모듈 임포트 실패 후의 잔류 상태를 수정했다(#528). 종합하면 “테스트 환경과 의존성을 한 번에 정렬”하는 정비 작업이다.

3.7 일루바타 코어엑스: /dev/itrctl과 iluvatar3.6 베이스라인 워크플로 (09-17)

날짜: 2026-09-17 출처: FlagGems #6376 /dev/itrctl, FlagTree #1197 iluvatar3.6 베이스라인, FlagGems #5390 linalg_lstsq

일루바타 코어엑스 라인은 이번 기간 두 가지 인프라 변경에 연산자 보강 하나를 더했다: FlagGems의 CI/CD 구성에 /dev/itrctl 디바이스 노드를 연결하고 패키징 구성을 갱신했으며(#6376), 이는 테스트 환경이 디바이스 제어 인터페이스에 접근해야 함을 시사한다. FlagTree는 iluvatar3.6에 FlagGems 베이스라인과 테스트 워크플로를 추가했고(#1197), 즉 해당 백엔드에 비교 가능한 성능 및 정확성 베이스라인을 구축한 것이다. 연산자 측에서는 하이곤, 메타엑스와 linalg_lstsq의 다중 백엔드 구현을 공유한다(#5390). 또한 build-infra에서 corex clang을 깨뜨릴 수 있는 만료된 환경 변수 하나를 수정했다(#901). 세 가지를 함께 읽으면, 일루바타 코어엑스의 현재 단계는 “CI 베이스라인 세우기”이다.

3.8 엔플레임: GCU300을 0.24.0 보고서와 두 이미지 태그에 기록 (09-16)

날짜: 2026-09-16 출처: build-infra #910 GCU300 기록, build-infra #900 게이트 케이스, FlagTree #1185 TLE 테스트

Enflame 라인은 이번 기간 전부 빌드와 검증 측에 집중되었다: GCU300 의 실행 기록을 vLLM 0.24.0 리포트에 작성하고(#910), 게이트 금지 케이스의 실행 결과와 그래프 모드에서의 차단 항목을 기록하며(#900), tops1.9.10 과 tops1.10.6 두 툴체인 각각에 애플리케이션 이미지 tag 를 하나씩 기록했다(#906/#907). 또한 FlagTree 측에서는 Ascend TLE 라인에서 간헐적으로 실패하는 fused softmax 케이스에 ignore 를 추가했다(#1185)——이러한 「간헐적 실패」는 크로스 칩 CI 에서 보통 환경 차이를 의미하지 로직 결함이 아니므로, 표시만 하고 수정하지 않는 것은 현재 단계의 합리적 선택이다. Enflame 의 자본 측 움직임(09-15 상장, 09-16 첫날 천억 돌파)은 그들의 엔지니어링 중점을 바꾸지 않으며, 기술 라인은 여전히 GCU 플랫폼을 멀티칩 검증 매트릭스에 편입하는 것을 주요 목표로 삼고 있다.

3.9 Zhiyuan(주도자): 거버넌스 자동화와 버전 번호 상향(09-16/09-17)

날짜: 2026-09-16 ~ 2026-09-17 출처: community 2.2 프로젝트 동기화, build-infra #916

주도자로서 Zhiyuan 의 이번 기간 작업은 코드 산출물보다 거버넌스에 집중되었다: community 는 릴리스 우선순위를 프로젝트 뷰에 동기화하고 2.2 항목이 릴리스 기간 동안 계속 가시적으로 유지되도록 했으며, build-infra 는 버전 번호를 올려 전체 이미지 라인을 2.2.0 으로 향하게 했다. 2.2 일정의 「Release Manager 가 추적 issue 에서 테스트 매트릭스를 유지하고 릴리스 프로세스에 따라 Go/No-Go 를 조직한다」는 역할 정의와 함께 보면, 릴리스 메커니즘이 수작업 대조에서 「프로젝트 뷰 + 추적 issue + 매니페스트 파일」 3종 세트 구동으로 전환되었음을 알 수 있다. GA 까지 11일 남은 상황에서 Zhiyuan 측의 다음 관찰 가능한 신호는 Go/No-Go 결론과 각 FEP 의 승인 상태 전이이다.


4. 요약 및 트렌드 관찰

  • 2.2 는 릴리스 아티팩트 동결 단계에 진입: build-infra 가 버전 필드를 2.2.0 으로 올린 것은 org 내 유일한 전역 릴리스 스위치이며, 이후 각 모듈의 rc 태깅은 후보 스냅샷에만 영향을 미치고 버전 번호는 더 이상 변경하지 않는다. GA 는 09-28 로 확정되었고 테스트 기간은 약 일주일 남았다.
  • 엔지니어링 품질 라인의 비중 상승: 150개 커밋 중 CI, 테스트, 수정류가 합계 약 4분의 1을 차지하며(ci, test, fix 로 시작하는 커밋만 23개), KernelGen 의 대량 입고가 내보내기 검사, 테스트 표시, 벤치마크 정렬 등의 규범 정착을 강제하고 있다——확장의 병목이 「커널 작성」에서 「등록과 승인」으로 이동했다.
  • 크로스 칩 가용성은 「라우팅과 우회 목록」으로 추진: Torch-FL 과 vllm-plugin-FL 의 이번 기간 주요 산출물은 우회 항목과 게이트이며 신기능이 아니다. 벤더 커널이 담당하는 연산자에는 이미 명명된 목록이 있다(MetaX 의 슬라이스 연산자, MUSA 의 복소수 회전 위치 인코딩, CUDA 의 FlagTune 부재). 이 목록의 길이는 크로스 칩 재사용률의 역지표이다.
  • 두 가지 연산자 확장 주류가 명확: 하나는 양자화(W8A8, W8A16, FP8)로 행렬곱에서 정규화와 샘플링으로 확장되며, 대표적 커밋은 Moore Threads 네이티브 FP8 W8A8 MM 과 fused Marlin MoE 이다. 다른 하나는 MoE 와 선형 어텐션(그룹 행렬곱, swiglu, compressor, 블록 게이팅 Delta 규칙 전방)으로 Ascend 라인에 집중되어 있다.
  • 테스트 인프라가 플랫폼화로 수렴: Damo Academy XuanTie PPU 의 추론 플러그인 CI 편입, Iluvatar CoreX 의 iluvatar3.6 베이스라인 구축, FlagTree 의 통합 백엔드 초기화 인터페이스 추출——세 가지 서로 다른 형태의 움직임이 같은 목표를 가리킨다: 모든 백엔드가 수동 실행이 아닌 CI 에서 지속적으로 검증되도록 하는 것.
  • 뉴스 측은 지속적으로 침묵, 기술 측은 전부 코드 위에: 이는 연속 열세 번째 조용한 모니터링 기간이며, 멤버 기관의 외부 가시성은 주로 자본 측에서 나온다(디구 로보틱스 4억 달러 C 라운드, MetaX 중간 보고서, Enflame 상장). 다음 보도 고점은 09-28 릴리스 기간으로 예상된다.

부록: 출처 검증표

출처 검증 결과
GitHub org 저장소 pushed_at (54개 저장소) 19개 저장소가 모니터링 기간 내 푸시 발생, 전부 검증 완료
GitHub commit search (committer-date) 150건의 모니터링 기간 내 커밋, 2페이지 전체 수집, 15개 저장소에 분포
GitHub 주요 저장소 기본 브랜치 커밋 FlagGems / build-infra / Torch-FL / FlagTree 등 건별 재검토
GitHub tags 및 releases 각 모듈 최신 태그 모두 rc2.post1 (FlagGems는 rc2.post2), 신규 릴리스 없음
community 릴리스 목록 및 일정표 RC2 목록 24개 항목, 2.2 일정표 및 마일스톤 상태 검증 완료
build-infra configs.yaml 버전 필드가 2.2.0으로 상향, 패치 및 파일 전문 수집 완료
Google News RSS (중영문 쿼리 33건) 모니터링 기간 내 적중 0건, 최근 적중은 09-15
HN Algolia 모니터링 기간 내 적중 0건
BAAI 커뮤니티 (hub.baai.ac.cn) 모니터링 기간 내 FlagOS 관련 신규 기사 없음
PEdaily / BAAI 커뮤니티 / Sina Finance / Leiphone / JiWei D-Robotics C라운드 등 회원 단위 항목 수집

전체 출처 목록

4]** Lei Feng Net 국산 GPU 4개 반기 보고서 해석 — https://news.google.com/rss/articles/CBMibkFVX3lxTE5UbVdtRXlOaHJHdGdBSkZ5SUVWbmJuUG84QWtOaWx3U0xjcmpXSW9hUFVLQ3BkdnljbGJBbUV2aVhPUEpnb1lDZmxyU3VVXzUxd