FlagOS 데일리 리포트 (2026-09-23)
모니터링 기간: 2026-09-22 10:00 ~ 2026-09-23 10:00 (약 24시간, 09-22 데일리 리포트 기간을 이어받아 공백 없음) 출처: GitHub(org: flagos-ai, 54개 저장소 pushed_at 전수 점검, 기간 내 24개 저장소에 푸시 발생, 커밋 검색 143건 적중, 14개 저장소에 걸침, Release Info 포털과 community 목록 페이지별 대조), Google News RSS(중영문 24개 쿼리, 프록시 경유), AICC2026 대회 공식 웹사이트 및 보도(광명망 / 신징보 / CBISMB), 2026 윈치 대회 보도(관점망 / 매일경제신문 / 동방재부 / 알리바바클라우드 개발자 커뮤니티), 룽신중커 발표(IT즈자 / 콰이커지) 등 (자세한 내용은 부록 출처 목록 참조)
이번 호 인덱스
- 오늘의 중점: 2.2 GA(09-28)까지 5일 남음 — 릴리스 목록 DB 반영, Release Info 포털 재구축, Megatron 애플리케이션 이미지 2.2.0-0.2.3이 14개 백엔드 행 커버(09-22/09-23)
- 1.1 릴리스 엔지니어링 보충: FlagCX wheel 채널이 쿤룬칩 및 전체 행으로 추진, deb/rpm이 모든 패키징 컴포넌트 커버(09-22/09-23)
- 1.2 FlagQuantum: 단일 기간 38건 — 클라우드 QPU 스캐폴드, 3대 프레임워크 상호운용, 시뮬레이션 융합 가속(09-22)
- 1.3 FlagGems: KernelGen이 Nvidia 연산자 15개 추가 보충, 6개 플랫폼 수정 및 최적화 밀집 병합(09-22/09-23)
- 1.4 FlagGems-vllm: 어센드 XCS 신규 연산자 병합, 무어스레드 / 하이광 / 메타X 3건 심사 중에서 병합으로 전환(09-22/09-23)
- 1.5 Torch-FL: 11건 수렴 — DCU 및 어센드 수정, 빌드 매트릭스 통일, 퇴역 코드 정리(09-22/09-23)
- 1.6 기타 동향: FlagCX 전송 강화, FlagSparse 3백엔드 추진, TransformerEngine-FL NPU 백엔드, FlagTree PPU CI(09-22/09-23)
-
- 뉴스 보도와 생태계
- 2.1 AICC2026 베이징 개최: FlagOS 2건 발표와 「신뢰할 수 있는 AI」 평가 체계 출범(09-21/09-22)
- 2.2 윈치 대회: 다모원 쉬안톄, 전우 V900 발표 — FlagOS 지원 플랫폼 PPU에 차세대 하드웨어 등장(09-22)
- 2.3 국산 컴퓨팅 파워 소프트웨어 스택 동향: 룽신 가속 컴퓨팅 플랫폼 첫 버전 릴리스, 디지털 무역 박람회 오늘 개막(09-22/09-23)
- 2.4 컴포넌트급 검색 연속 열여덟 번째 조용한 기간(09-22/09-23)
- 뉴스 보도와 생태계
-
- 회원사 심층 분석
- 3.1 하이광: DCU 인덱스 경계 수정과 INT8 블록형 BMM 병합(09-22/09-23)
- 3.2 무어스레드: W8A8 가변 길이 어텐션 양자화 지원 병합, AICC2026 발표와 「신뢰할 수 있는 AI」 참여(09-22)
- 3.3 메타X: 융합 역 RoPE 양자화 연산자 병합, topk W8A16 최적화와 MACA FFT 기본 전략(09-22)
- 3.4 어센드: 연산자 배치와 테스트 이미지 업데이트, TransformerEngine-FL NPU 백엔드 구현(09-22/09-23)
- 3.5 일루바타 코어X: Iluvatar wheel 22.04 재빌드 라인과 컨테이너 행 등록(09-22/09-23)
- 3.6 엔플레임: 다중 행 이미지 등록과 sglang 애플리케이션 행(09-22/09-23)
- 3.7 칭웨이 인텔리전트: AICC2026 의제와 런타임 행(09-22)
- 3.8 다모원 쉬안톄: 전우 V900과 PPU CI 마무리(09-22/09-23)
- 회원사 심층 분석
-
- 요약과 트렌드 관찰
- 부록: 출처 점검표
- 전체 출처 목록
오늘의 중점: 2.2 GA(09-28)까지 5일 남음 — 릴리스 목록 DB 반영, Release Info 포털 재구축, Megatron 애플리케이션 이미지 14개 백엔드 행 커버
날짜: 2026-09-22 ~ 2026-09-23 출처: community #111, release-2.2.yaml, Release Info 포털, build-infra #1019 ~ #1034
커뮤니티 2.2 릴리스 추적(#47)의 공식 일정에 따르면, rc2 안정화 기간은 09-24 마감(이후 hotfix만 접수), GA Go/No-Go는 09-28로 확정되었다. 이번 기간은 마감기에 해당하며, 릴리스 엔지니어링이 하루에 세 갈래로 추진되었다:
-
공식 릴리스 목록이 저장소에 반영되기 시작. 09-23 00:11에 community #111이 병합됨:
release/2.2/release-2.2.yaml추가 — 이는 FlagOS 2.2의 공식 릴리스 소스 목록(vcstool 형식,vcs import로 모든 컴포넌트 소스를 한 번에 가져오기 위함)이다. 목록 첫 항목은 sglang-plugin-fl v0.2.0(공식 태그는 해당 모듈이 최종 rc2 검증을 통과한 커밋에 부여되며, 브랜치는 0.2.0-rc2, HEAD1c84db7). 파일 헤더에는 버전 규범이 명시되어 있다: 공식 태그는 일률적으로 순수 버전 번호(rc/post 접미사 없음), FlagTree는 예외로 업스트림 로컬 버전 형식을 유지(예:0.7.0+triton3.6); 구조상 L2 「프레임워크 적응 계층」등의 계층으로 구성되며, 후속 컴포넌트는 순차적으로 보충될 예정. -
애플리케이션 이미지 등록이 14개 백엔드 행으로 진전. build-infra의 이번 모니터링 기간 33건의 커밋 중, Megatron-LM-FL 애플리케이션 이미지 태그
2.2.0-0.2.3이 14개 플랫폼 행에 집중 등록(nvidia-cuda12.8 / cuda13.3, ascend-cann8.5.0 / cann9.0.0, cambricon-neuware4.4.3 / 4.7.2, enflame-tops1.9.10 / 1.10.6, hygon-dtk26.04, iluvatar-corex4.4.0 / 4.5.0, metax-maca3.8.1.3, mthreads-musa4.3.6 / 5.2.0, 각각 #1019 ~ #1033에 대응); 함께 두 건의 수정: 빌드 단계에서 잠긴 wheel 버전을 직접 읽도록(#1018), 설치 버전을 정확히 잠그고 빌드되지 않은 두 행을 보충(#1017). 같은 기간 등록된 것으로 vLLM Kunlunxin 애플리케이션 이미지2.2.0-0.3.0rc2.post2(#1012 / #1013, 함께 권한 재빌드 #1010). -
Release Info 포털 재구축. 09-23 06:38 ~ 06:44, 릴리스 정보 저장소 gh-pages 브랜치에 연속 13회 푸시, Hugo 포털 재빌드(flagos-ai.github.io/release-info). 포털은 「벤더 / 베이스 이미지(base) / 런타임 이미지(runtime) / 애플리케이션 이미지(application)」4계층으로 구성되며, 20개 플랫폼 행의 base 및 runtime 이미지, 그리고 vLLM(0.20.2 / 0.24.0 두 매트릭스), Megatron(training / rl), sglang 0.5.18 애플리케이션 이미지를 포함한다. Megatron의 nvidia-cuda12.8 행 페이지를 예로 들면, 이미
harbor.baai.ac.cn/flagos-app/megatron_training0.17.1-nvidia-cuda12.8:2.2.0-0.2.3와flagos-runtime-nvidia-cuda12.8:2.2.0의 전체 풀 명령을 확인할 수 있다. 이미지 등록, 포털 릴리스, 목록 저장소 반영의 세 가지 라인이 이번 모니터링 기간에 처음으로 같은 날 정렬되었고, 2.2 릴리스물이 외부에 가시화되기 시작했다.
버전 브랜치 측도 동시에 진전: FlagTree 0.7.0-rc2-triton3.6(09-23 09:36 푸시), vllm-plugin-FL 0.3.0-rc2(09-22 23:20, #549), FlagScale 2.1.0-rc2(09-23 08:43, #1301 main에서 체리픽), sglang-plugin-FL 0.2.0-rc2(v0.2.0 태그 완료).
1. 오픈소스 프로젝트 진척(GitHub 동향)
모니터링 기간 개요: org 내 54개 저장소 중 24개가 모니터링 기간에 푸시가 있었음; 커밋 검색 히트 143건(14개 저장소에 걸침), 그 외 release-info(gh-pages), FlagScale, vllm-plugin-FL, FlagTree, docs, sglang-plugin-FL 등의 브랜치 측 푸시는 검색에 포함되지 않음. 분포는: FlagQuantum 38, build-infra 33, FlagGems 28, Torch-FL 11, FlagSparse 10, FlagGems-vllm 6, FlagFFT 4, FlagCX 3, FlagTree 2, FlagAttention 2, FlagBLAS 2, whisper-triton 2, community 1, FlagGems-Experimental 1.
이번 모니터링 기간의 형태 = 「2.2 릴리스 마무리」+「양자 스택 대폭발」+「멀티플랫폼 수정 집중」: 릴리스 엔지니어링은 「오늘의 중점」 참조; FlagQuantum이 38건으로 단일 저장소 최활발 프로젝트가 됨; FlagGems / FlagGems-vllm / Torch-FL 세 저장소가 동시에 「수정 + 튜닝」 리듬에 진입.
1.1 릴리스 엔지니어링 보충: FlagCX wheel 채널이 Kunlunxin 및 전 행으로 진전, deb/rpm이 모든 패키징 컴포넌트를 커버(09-22/09-23)
날짜: 2026-09-22 ~ 2026-09-23 출처: build-infra #1000, #1002, #1007, #1008, #1014
-
FlagCX wheel 배포 라인: Kunlunxin wheel 반영(#1000, 어제 데일리 리포트의 「심사 중」 항목 승계), wheel 채널이 나머지 8개 행에서 전부 개방(#1002), 각 행의 pin을 ref에서 자동 유도(#1007), 매번 배포 시 wheel ref 필수 동반(#1006), 행별로 릴리스된 pin 기록 및 「wheel과 torch의 바인딩 관계」 문서화(#1005 / #1016), 릴리스 컨테이너가 노드 프록시 상속(#1015). 백엔드별 사전 컴파일 wheel의 배포 형태가 「파일럿 행」에서 「전체 행 + 파이프라인 고정」으로 확대.
-
네이티브 패키지 커버리지: 각 패키징 컴포넌트가 저장소에 진입하는 경로 확보(#1001), deb 및 rpm 커버리지 보완(#1008) — FEP-0019(통합 패키징 통합, Wave 1에 FlagCX / FlagTree / FlagSparse / FlagAttention 4개 저장소 병합 포함)의 검수 기준과 일치.
-
FlagTree Iluvatar wheel을 Ubuntu 22.04에서 재빌드하고 빌더 릴리스(#1014, Iluvatar CoreX 라인).
-
그 외 문서 정리 2건: 크로스 컴파일러
flag_gemsConfigCache 오염 주장 철회(#1034), metax의 flagtree 다운그레이드 근거 폐기(#1020).
1.2 FlagQuantum: 단일 모니터링 기간 38건 — 클라우드 QPU 스캐폴딩, 3대 프레임워크 상호운용, 시뮬레이션 융합 가속 (09-22)
날짜: 2026-09-22 출처: FlagQuantum #135, #154, #138, #168, #167
FlagQuantum(FlagOS 에코시스템의 PyTorch 우선 양자 AI 프레임워크)은 단일 모니터링 기간 38건으로, 네 개 라인이 병행:
- 클라우드 QPU 실행: Azure Quantum QPU 실행 스캐폴딩 추가(#168) — 지난달 Braket / CUDA-Q에 이은 또 하나의 클라우드 백엔드 라인.
- 크로스 프레임워크 상호운용: Amazon Braket 회로 어댑터 구현(#154, 동반 계약 #147), Cirq 회로 변환(#135) 및 기호 파라미터 계약(#166 / #170), CUDA-Q 커널 내보내기(#138, 유한 각도 IR 검증 수정 #145), 크로스 프레임워크 역량 격차 추적(#164), 크로스 프레임워크 회로 시맨틱 인증 테스트(#160).
- 시뮬레이션 성능: CPU 상태 벡터 게이트 가속(#142), 꼬리 부분 2비트 게이트 가속(#143), 크로스 라인 대각 영역 융합(#146), 2선 대각 매칭 융합(#153), 단일 선 게이트 레이어 융합(#157 / #159 / #165), 혼합 폭 영역 융합(#169), 그리고 선택적 스위치 방식의 벡터화 트레이스 행 샘플러(#132)와 경로 분해 CPU 스윔레인 + 차분 커널 네트워크 벤치마크(#128).
- 검증 라인(regional twin): 회로 스위트 검증(#123), 홀드아웃 세트 검증(#141), 이력 및 평가 영속화(#137 / #144 / #152 / #163), 드리프트 정렬(#155), 홀드아웃 증거를 게이트로 설정(#162), 검증 통과한 후보 릴리스(#167).
- CI: 선택적 SDK 버전별 runner 재사용(#158), braket 커버리지 스윔레인(#161), CPU 테스트 병렬화(#149), 중복 스위트 제거(#150 / #156), 큐 병목 정리(#148).
1.3 FlagGems: KernelGen이 Nvidia 연산자 15개 추가 보완; 6개 플랫폼 수정 및 최적화 밀집 병합 (09-22/09-23)
날짜: 2026-09-22 ~ 2026-09-23 출처: FlagGems #5245, #5845, #6531, #6339, #5063
- KernelGen(Nvidia) 15개: orgqr(#5845), trapz(#5927), matrix_power(#5735), matmul_backward(#5639), _pad_packed_sequence(#5245), _scaled_dot_product_attention_math_for_mps(#5259), _nested_tensor_softmax_with_shape(#5693), _nested_tensor_from_mask(#5691), _sample_dirichlet(#5946), _ctc_loss(#5489), _batch_norm_with_update(#5828), _cudnn_rnn(#5823), _transform_bias_rescale_qkv(#6141), _spdiags(#6102), vander(#5945) — 자동 생성 파이프라인이 계속해서 롱테일 연산자를 대량 보충.
- NVIDIA 품질 라인: scaled MM의 네이티브 FP8 WGMMA 복원(#6531).
- Hygon:
index_reduce_가 Ascend / Iluvatar / MetaX 세 플랫폼에서 발생하는 문제 수정(#5063, SiliconFlow 기여). - MetaX:
topk_w8a16_fp8연산자 병합 및 최적화(#6339). - Ascend: cat/concat 디스패치 및 구현 개선(#6548),
rrelu_with_noise구현(#6534, KMCompiler 라인),nonzero_static벤치마크를 연산자 모드로 전환(#6571), 910B 주간 테스트 이미지 업데이트(#6590). - 양자화 및 일반: 동적 W4A8 행렬곱과 이식 가능한 4비트 패킹 검증(#6494), block diag 병합(#6555),
vector_norm음수 차수 유한값 마스크 수정(#5883).
1.4 FlagGems-vllm: Ascend XCS 신규 연산자 병합; Moore Threads / Hygon / MetaX 세 건 심사 중에서 병합으로 전환(09-22/09-23)
날짜: 2026-09-22 ~ 2026-09-23 출처: FlagGems-vllm #817, #823, #803, #826
- Ascend XCS: KV 풀 상태 압축(kpool) Triton 연산자 병합(#817, 09-23 09:22), XCS 연산자 배치의 추진 리듬 지속.
- 세 건 심사 중에서 병합으로 전환: Moore Threads 가변 길이 어텐션 W8A8 FP8(#823), Hygon INT8 블록 BMM과 INT8 einsum 축약(#803), MetaX 융합 역 RoPE FP8 양자화(#826) — 세 건 모두 이전 데일리 리포트의 “심사 중 풀” 항목으로, 이번 모니터링 기간에 집중적으로 착지.
- 엔지니어링 수정: TLE 경로를 필요한 능력에 따라 게이팅(#833), 테스트 의존성이 기존 numpy를 더 이상 업그레이드하지 않도록 수정(#832).
1.5 Torch-FL: 11건 수렴 — DCU와 Ascend 수정, 빌드 매트릭스 통일, 퇴역 코드 정리(09-22/09-23)
날짜: 2026-09-22 ~ 2026-09-23 출처: Torch-FL #395, #393, #392, #387, #372
PyTorch 어댑테이션 레이어(Torch-FL / PyTorch-Plugin-FL)는 이번 모니터링 기간 11건으로, 엔지니어링 측면이 집중적으로 마무리되었습니다:
- 디바이스 수정: DCU 범위 초과 인덱스 값을 직접 거부(#395), Ascend 커널을 피연산자가 위치한 디바이스에서 실행하도록 변경(#392), PPU가 CPU torch wheel의 CUDA 메타데이터를 복원(#370), SDPA 어텐션이 디스패치 모드에서 autograd 그래프 유지(#390).
- 빌드 및 구성: 플랫폼 / 빌드 매트릭스를 단일 표로 수렴(#387), 인식되지 않거나 감지되지 않은 GEMS_VENDOR는 직접 오류 발생(#388), ruff 구성 추가 및 black/isort 제거(#386), codegen
--check게이트와 등록 일관성 테스트(#382). - 정리 및 성능: 전역
Tensor.__getitem__패치 제거(#372), MetaX 네이티브 트리 등 퇴역 코드 정리(#393), qwen-image 전체 유효 프롬프트 마스크 생략(#371).
1.6 기타 동향: FlagCX 전송 강화, FlagSparse 3백엔드 추진, TransformerEngine-FL NPU 백엔드, FlagTree PPU CI (09-22/09-23)
날짜: 2026-09-22 ~ 2026-09-23 출처: FlagCX #594, TransformerEngine-FL #113, FlagTree #1259, FlagSparse #80
- FlagCX: 이기종 전송 강화 및 가속기 CI 정렬(#594), p2p engine rpc serve 확장 및 barex 전송 업그레이드(#611), 패키징은 패키징 변경 시에만 빌드(#616).
- FlagSparse: NCIC-AlphaSparse 협업 브랜치 두 배치 연합(#79 / #80) —— DCU SpMM COO 최적화, MACA SpMM 결과, Ascend CI 및 출력, MTX 테스트 CI 진입.
- TransformerEngine-FL: NPU 백엔드 LayerNorm 구현 추가(#114) 및 다중 텐서 Adam의 NPU 백엔드 구현(#113).
- Megatron-LM-FL: 벤더 백엔드 호환성 및 CI 통합 안정화(#174).
- FlagTree: 메인 브랜치 PPU CI에
pid.txt검증 추가(#1259, 09-23 10:05 병합), GEMS 재사용 워크플로에 CORE 변경 감지 포함(#1265), 신규 내장 함수 문서 업데이트(#1120). - FlagAttention: 테스트 및 벤치마크 업데이트(#69), pytest에
--record/--output추가(#70). - FlagBLAS: Ascend L2 성능 최적화 병합(#123 —— SPR / SPR2 / HPR / HPR2), 외부 기여자 패키징 라인(#1, 버전 정렬 0.3.0 릴리스 라인).
- FlagFFT: MACA “1d single” 측정 전략 기본값 전환, HCU / Ascend CANN9 환경 문서 보완.
- FlagGems-Experimental: KernelGen에
dim연산자 추가(#702). - whisper-triton: Keda Xunfei Codeup 패치 베이스라인 동기화(#6).
2. 뉴스 보도와 생태계
2.1 AICC2026 베이징 개최: FlagOS 두 건의 발표와 “신뢰할 수 있는 AI” 평가 체계 출범 (09-21/09-22)
날짜: 2026-09-21(회기) / 2026-09-22(보도 집중 발표) 출처: 광명망, 신징보, CBISMB, AICC 공식 홈페이지 의사일정
제7회 인공지능 컴퓨팅 대회(AICC2026)가 09-21 베이징 중관춘 국제혁신센터에서 열렸고, 09-22부터 집중적으로 보도되었다. FlagOS와 직접 관련된 두 가지: 메인 포럼 09:50 세션에서 베이징 지위안 인공지능연구원 부원장 겸 수석엔지니어 Lin Yonghua가 「아키텍처 혁신에서 사용 가능한 컴퓨팅 파워로: FlagOS가 이끄는 AI 컴퓨팅의 소프트웨어-하드웨어 협업 신패러다임」 보고를 진행했으며, 「AI 워크로드는 수렴하지 않을 것이고, 컴퓨팅 아키텍처도 하나만 남지 않을 것이다; 하드웨어 혁신이 사용 가능한 컴퓨팅 파워로 전환되려면 공유 소프트웨어 생태계의 지원이 필요하다——중즈 FlagOS는 통합 컴파일러, 연산자, 통신, 학습·추론 프레임워크 등의 역량을 통해 다양한 칩의 중복 적응 비용을 낮춘다」고 지적했다; 또한 대회 의제에 따르면 지위안연구원 연구원 Zhao Shuai가 특별 포럼에서 「중즈 FlagOS: 개방형 소프트웨어 스택으로 다양한 AI 컴퓨팅 파워의 가치를 해방하다」 보고를 진행했다. 회의에서는 동시에 「신뢰할 수 있는 AI」 평가 워킹그룹 출범식(공업정보화부 전자5소, 10:10 세션)이 거행되었고, 산업 성과环节에서 Agent 시대를 겨냥한 「신뢰할 수 있는 AI」 평가 체계를 정식 발표했다——공업정보화부 전자5소가 베이징 지위안연구원, Inspur Information, Moore Threads, MetaX, 베이징 오픈소스칩연구원, Baidu Smart Cloud, Alibaba Cloud 등 20여 개 산업체인 기관과 공동 발표했으며, 칩, 완제품과 인터커넥트, 프레임워크와 시스템, 모델, 데이터, 애플리케이션 전环节을 포괄하고 신뢰성, 안전성, 안정성 차원에서 전링크 평가를 수행한다. 같은 시기 IDC와 Inspur Information이 공동으로 《2026년 중국 인공지능 컴퓨팅 파워 발전 평가 보고서》를 발표했다: 2026년 중국 지능형 컴퓨팅 파워 규모가 2576.5 EFLOPS, 전년 대비 87.9% 성장할 것으로 예상된다. 의제에서의 멤버 기관 밀도(Moore Threads, Qingwei Intelligent, 지위안 FlagOS 두场)는 이 스택이 이미 국내 개방형 컴퓨팅 파워 생태계의 상시 의제임을 보여준다.
2.2 윈치 대회: 다모원 쉬안톄, 전우 V900 발표——FlagOS 지원 플랫폼 PPU, 차세대 하드웨어 맞이 (09-22)
날짜: 2026-09-22 출처: 관점망, 매일경제신문, 동방재부, Alibaba Cloud 개발자 커뮤니티
2026 윈치 대회(09-22, 항저우)에서 알리바바 산하 다모원 쉬안톄(T-Head)가 차세대 학습·추론 일체형 AI 칩 전우 V900을 발표했다: 216GB 메모리, 칩간 인터커넥트 대역폭 1200GB/s, FP8 / FP4 저정밀도 연산 네이티브 지원, 단일 칩 성능이 이전 세대 전우 M890의 3배, 2027년 1분기 양산 예정; 회의에서는 동시에 차세대 전우 J900(2028년 3월)과 이톈 720 / 730 두 세대 서버 CPU(2027년)를 예고했으며, 전우 V900 슈퍼노드가 메모리 통합 주소 지정 기능을 갖춰 천 카드 전대역폭 인터커넥트를 구성할 수 있음을 공개했다. 전우 시리즈는 곧 알리바바 자체 개발 PPU(Parallel Processing Unit)이며, PPU는 이미 FlagOS 통합 플러그인과 컴파일러의 지원 플랫폼 중 하나이다(FlagGems-vllm PPU 연산자, FlagTree PPU CI, FlagDNN PPU 아키텍처)——차세대 하드웨어의 발표는 이 스택의 PPU 백엔드에 명확한 세대 업그레이드 목표가 생겼음을 의미한다.
2.3 국산 컴퓨팅 파워 소프트웨어 스택 동향: 룽신 가속 컴퓨팅 플랫폼 첫 버전 발표; 디지털무역회 오늘 개막 (09-22/09-23)
날짜: 2026-09-22 ~ 2026-09-23 출처: IT之家, 콰이커지, 디지털무역회 AI 전시구역 미리보기
- 룽신중과 09-22 「룽신 가속 컴퓨팅 플랫폼」 첫 소프트웨어 버전 발표: 룽신 2K3000 / 9A1000에 통합된 LG200 시리즈 범용 GPU 기반으로, 드라이버, 컴파일러, 런타임, 연산자 라이브러리(BLAS / DNN), 추론 엔진, 디버깅 및 성능 분석 도구를 포괄하며, OpenCL 3.0과 CUDA 두 가지 프로그래밍 모델을 지원해 CUDA 애플리케이션을 저비용으로 마이그레이션할 수 있고, 9A2000 / 9A3000에 따라 진화하며 세대 간 소프트웨어 호환성을 구현할 계획이다. 국산 컴퓨팅 파워 「풀스택 소프트웨어 플랫폼」의 또 하나의 사례로, 이 스택의 「통합 소프트웨어 스택으로 적응 비용 절감」 노선과 상호 참조가 된다.
- 제5회 글로벌 디지털무역박람회 09-23 항저우 개막(~09-27): 최초로 「디지털무역·칩 시나리오」 집적회로 응용 생태계 섹션을 설치, MetaX 등 기업이 「칩 + 소재 + 컴퓨팅 파워」 협업 전시에 참여; 컴퓨팅 파워 기업 117개사 참가. 멤버 기관의 산업 노출이 회의 시즌을 통해 이어진다.
2.4 컴포넌트 수준 검색 연속 열여덟 번째 평온한 모니터링 기간 (09-22/09-23)
날짜: 2026-09-22 ~ 2026-09-23 출처: Google News RSS(중영문 24개 쿼리어, 프록시 경유)
FlagOS / FlagGems / FlagScale / FlagTree / FlagPerf / FlagCX / KernelGen 등 컴포넌트명으로 중·영문 검색(when:7d 및 when:14d)을 수행한 결과, 24시간 창 컴포넌트급 적중은 제로로, 연속 열여덟 번째 조용한 창(직전 창은 열일곱 번째)을 구성했다. 전시회 측면과는 대조를 이룬다. 본 창의 대외 정보면은 AICC2026과 윈치 컨퍼런스의 멤버/생태계 동향이 담당했다(2.1—2.3 참조). HN Algolia는 FlagOS / FlagGems 등의 단어에 관련 적중이 없었고, Zhiyuan 커뮤니티 검색에서도 FlagOS 관련 신규 기고는 발견되지 않았다.
3. 멤버사 심층 분석
3.1 Hygon: DCU 인덱스 경계 수정 및 INT8 블록형 BMM 병합 (09-22/09-23)
날짜: 2026-09-22 ~ 2026-09-23 출처: Torch-FL #395, FlagGems-vllm #803
- Torch-FL #395: DCU에서 범위를 벗어난 인덱스 값을 직접 거부하도록 변경(조용한 오류 결과 방지).
- FlagGems-vllm #803(심사 중에서 병합으로 전환): INT8 블록형 BMM 커널 및 INT8 einsum 축약(bhr,hdr→bhd) — 추론 측 저정밀 행렬 곱셈에 Hygon 구현 보충.
- 이미지 행: megatron_training-hygon-dtk26.04가 2.2.0-0.2.3으로 등록됨. runtime hygon-dtk26.04는 포털에 이미 릴리스됨.
3.2 Moore Threads: W8A8 가변 길이 어텐션 양자화 지원 병합, AICC2026 발표 및 「신뢰할 수 있는 AI」 참여 (09-22)
날짜: 2026-09-22 출처: FlagGems-vllm #823, AICC 공식 웹사이트 의제, CBISMB
- FlagGems-vllm #823(심사 중에서 병합으로 전환): 가변 길이 어텐션(varlen)의 W8A8 FP8 지원 — MUSA 플랫폼의 양자화 경로 개통.
- AICC2026: Moore Threads 솔루션 사업부 부총경리 Ren Yanping이 주제 포럼에서 발표했으며, 공동 발표 기관으로서 「신뢰할 수 있는 AI」 평가 체계에 참여.
- 이미지 행: megatron_training-mthreads-musa4.3.6 / musa5.2.0 두 행이 2.2.0-0.2.3으로 등록됨.
3.3 MetaX: 융합 역 RoPE 양자화 연산자 병합, topk W8A16 최적화 및 MACA FFT 기본 전략 (09-22)
날짜: 2026-09-22 출처: FlagGems-vllm #826, FlagGems #6339, FlagFFT 커밋
- FlagGems-vllm #826(심사 중에서 병합으로 전환): 융합 역 RoPE 및 FP8 양자화 연산자에 MetaX 구현을 신규 추가하고 최적화.
- FlagGems #6339:
topk_w8a16_fp8연산자 신규 추가 및 최적화(metaX). - FlagFFT: MACA 「1d single」 측정 전략이 기본으로 전환(측정 기반 파라미터 튜닝이 실험에서 정식으로 전환).
- Torch-FL #393: MetaX 네이티브 트리 등 퇴역 코드 정리 — 어댑테이션 계층이 플러그인화로 수렴.
- 이미지 행: megatron_training-metax-maca3.8.1.3이 2.2.0-0.2.3으로 등록됨.
3.4 Ascend: 연산자 배치 및 테스트 이미지 업데이트, TransformerEngine-FL NPU 백엔드 구현 (09-22/09-23)
날짜: 2026-09-22 ~ 2026-09-23 출처: FlagGems #6548, #6590, FlagGems-vllm #817, TransformerEngine-FL #113
- FlagGems: cat/concat 디스패치 및 구현 개선(#6548),
rrelu_with_noise(#6534),nonzero_static벤치마크 수정(#6571), 910B 주간 테스트 이미지 업데이트(#6590). - FlagGems-vllm #817: XCS 라인에 KV 풀 상태 압축(kpool) 연산자 추가(09-23 오전 병합).
- TransformerEngine-FL #113 / #114: 다중 텐서 Adam 및 LayerNorm의 NPU 백엔드 구현——학습 측 프레임워크의 Ascend 백엔드 보완.
- Torch-FL #392: Ascend 커널이 피연산자가 위치한 디바이스에서 실행되도록 변경, 크로스 디바이스 디스패치 수정.
- 이미지 행: ascend-cann8.5.0 / cann9.0.0 및 910c 변형 다중 행 등록 및 포털 릴리스.
3.5 Iluvatar CoreX: Iluvatar wheel 22.04 재빌드 라인 및 컨테이너 행 등록(09-22/09-23)
날짜: 2026-09-22 ~ 2026-09-23 출처: build-infra #1014, Release Info 포털
- build-infra #1014: Iluvatar wheel을 Ubuntu 22.04에서 재빌드하도록 변경하고 해당 빌더 이미지 릴리스——wheel 배포 라인이 Iluvatar 행에서 보완됨.
- 이미지 행: iluvatar-corex4.4.0 / corex4.5.0 두 행에 megatron 이미지 2.2.0-0.2.3 등록; base / runtime 행은 포털에 릴리스.
- FlagGems #5063은 Iluvatar 플랫폼에서
index_reduce_구현을 수정(SiliconFlow 기여).
3.6 Enflame: 다중 행 이미지 등록 및 sglang 애플리케이션 행(09-22/09-23)
날짜: 2026-09-22 ~ 2026-09-23 출처: Release Info 포털
- 이미지 등록: megatron_training-enflame-tops1.9.10 / tops1.10.6 두 행에 2.2.0-0.2.3 등록; sglang 애플리케이션 이미지에 enflame-tops 두 행 포함; base / runtime 행은 포털 재빌드와 함께 업데이트.
3.7 Tsingmicro: AICC2026 의제 및 런타임 행(09-22)
날짜: 2026-09-22 출처: AICC 공식 웹사이트 의제, Release Info 포털
- AICC2026 의제: Tsingmicro 소프트웨어 부사장 Li Bin이 “3D 칩, 오픈소스 새 장: Open3D-PIMC 컴퓨팅 소프트웨어 기반 재구성” 보고 진행——재구성 가능 컴퓨팅 제조사의 개방형 소프트웨어 스택 측 공개 행보.
- 이미지 행: tsingmicro-tsm260610의 base / runtime 행은 포털 재빌드와 함께 업데이트; vllm-plugin-FL 0.3.0-rc2 브랜치는 tsingmicro txda의 0.24.0 적응 포함(이전에 백그라운드 병합, 버전 브랜치와 함께 마무리).
3.8 DAMO XuanTie: Zhenwu V900 및 PPU CI 마무리(09-22/09-23)
날짜: 2026-09-22 ~ 2026-09-23 출처: FlagTree #1259, Torch-FL #370, Guandian
- 하드웨어 측: Zhenwu V900(PPU 신세대) 릴리스, 2027 Q1 양산(상세 2.2 참조).
- 소프트웨어 측: FlagTree PPU CI에
pid.txt검증 추가(#1259, 09-23 10:05 병합)——PPU 컴파일 경로의 CI 완전성 마무리; Torch-FL은 PPU 경로에서 CPU torch wheel의 CUDA 메타데이터 복원(#370).
4. 요약 및 트렌드 관찰
- 2.2 GA 진입 전 마지막 주, 릴리스물이 「가시화」되기 시작: 공식 릴리스 목록 첫 항목이 저장소에 등록(sglang-plugin-fl v0.2.0), Release Info 포털同日 재구축, Megatron 애플리케이션 이미지 2.2.0-0.2.3이 14행 커버. rc2 안정화 기간 09-24 마감, GA 09-28 확정——다음 주 관찰 포인트는 목록의 순차 보완과 각 컴포넌트 rc2/post 태그의 수렴 순서.
- 배포 형태 지속 확대: FlagCX wheel이 파일럿 행에서 전체 행으로 확대 + 昆仑芯 적용, deb/rpm이 각 패키징 컴포넌트로 커버, FlagTree Iluvatar wheel 재빌드——FEP-0019(통합 패키징 통합)의 Wave 1 검수선과 일치하며, 「이미지 이외」의 네이티브 패키지 채널이 2.2의 표준 딜리버리 면이 됨.
- 양자 스택은 당일 단일 저장소 처리량 최다: FlagQuantum 38건이 동시에 클라우드 백엔드(Azure Quantum / Braket / CUDA-Q / Cirq 4선 상호운용), 시뮬레이션 융합 가속 및 후보 검증 게이트를 추진——「추종 컴포넌트」에서 프레임워크화 개발 리듬으로 전환.
- 세 저장소 동시 수정/튜닝 리듬 진입: FlagGems(15개 KernelGen + 6개 플랫폼 수정), FlagGems-vllm(3건 심사 중 병합 전환), Torch-FL(11건 엔지니어링 수렴, 전역 패치 제거 및 퇴역 코드 포함)——특성 동결 후의 「검수, 수정, 튜닝」 기간 형태가 일정과 일치.
- 대외 정보면은 회의 시즌이 담당: 컴포넌트급 검색 열여덟 번째 조용한 기간 vs AICC2026 두场 FlagOS 강연과 「신뢰할 수 있는 AI」 출범, 云栖 真武 V900 발표, 龙芯 풀스택 GPU 소프트웨어 플랫폼——산업계의 「통합 소프트웨어 스택 / 다원 연산력」에 대한 관심이 회의 시즌에 집중释放되며, 코드측 수렴과 상호 입증.
- 관찰 필요: 2.2 목록 후속 항목(FlagTree 0.7.0+triton3.6, vllm-plugin-FL 0.3.0, FlagScale 2.1.0 등 버전 브랜치 이미 추진 중); PPU 신규 하드웨어 소프트웨어 적응 후속(V900 양산 2027 Q1); FlagSparse / FlagAttention 패키징 라인(FEP-0019 Wave 1)의 GA 전 적용.
부록: 출처 검증표
| 카테고리 | 출처 | 검증 방식 | 결과 |
|---|---|---|---|
| GitHub | org: flagos-ai repos API | 54개 저장소 pushed_at 전수 검증 | 24개 저장소 기간 내 활성 |
| GitHub | 커밋 검색 + 저장소별 대조 | 기간 내 건별 검증 | 143건(14개 저장소) + 브랜치측 푸시(release-info / FlagScale / vllm-plugin-FL / FlagTree / docs) |
| GitHub | releases 저장소별 스캔 | 13개 저장소 releases API | 기간 내 신규 release 없음(2.2는 목록 / 이미지 등록 / 포털 릴리스로 진행) |
| 릴리스 엔지니어링 | community 목록 + Release Info 포털 + build-infra | 원문 캡처 페이지별 대조 | release-2.2.yaml 첫 항목; 포털 20개 플랫폼 행 재구축; Megatron 이미지 2.2.0-0.2.3 14행 커버 |
| 뉴스 | Google News RSS(중영문 24개 쿼리어, 프록시 경유) | 24시간 기간 필터 + 건별 제거 | 컴포넌트어 제로 히트(열여덟 번째 조용한 기간); 생태계측 AICC2026 / 云栖 / 龙芯 등 항목 유지 |
| 미디어 | 光明网 / 新京报 / CBISMB / 观点网 / 每日经济新闻 / 东方财富 / IT之家 | 원문 캡처 재검증 | AICC2026, 真武 V900, 龙芯 플랫폼 |
| 커뮤니티 | HN Algolia / 智源社区 | 검색 재검증 | FlagOS 관련 신규 게시물 없음 |
| 프로젝트 문서 | community // schedule.md, flagos-ai.github.io/release-info | 원문 캡처 | 2.2 일정(rc2 ~ 09-24, GA 09-28)과 이미지 매트릭스 대조 |
전체 출처 목록
- [1] 오늘의 중점 / 1.1 community 및 릴리스 목록 — https://github.com/flagos-ai/community/pull/111 · https://github.com/flagos-ai/community/blob/main/release/2.2/release-2.2.yaml · 일정 https://github.com/flagos-ai/community/blob/main/release/2.2/schedule.md · 추적 https://github.com/flagos-ai/community/issues/47
- [2] 오늘의 중점 / 1.1 build-infra — #1000 — https://github.com/flagos-ai/build-infra/pull/1000 · #1002 — https://github.com/flagos-ai/build-infra/pull/1002 · #1008 — https://github.com/flagos-ai/build-infra/pull/1008 · #1014 — https://github.com/flagos-ai/build-infra/pull/1014 · #1017 — https://github.com/flagos-ai/build-infra/pull/1017 · #1019 ~ #1033 (Megatron 행 등록) — https://github.com/flagos-ai/build-infra/pulls
- [3] 오늘의 중점 / 1.1 Release Info 포털 — https://flagos-ai.github.io/release-info/ · Megatron 행 예시 — https://flagos-ai.github.io/release-info/zh-cn/application/megatron_training-nvidia-cuda12.8/
- [4] 1.2 FlagQuantum — #135 — https://github.com/flagos-ai/FlagQuantum/pull/135 · #138 — https://github.com/flagos-ai/FlagQuantum/pull/138 · #154 — https://github.com/flagos-ai/FlagQuantum/pull/154 · #167 / #168 — https://github.com/flagos-ai/FlagQuantum/pulls
- [5] 1.3 FlagGems — KernelGen #5245 — https://github.com/flagos-ai/FlagGems/pull/5245 · #5845 — https://github.com/flagos-ai/FlagGems/pull/5845 · FP8 WGMMA #6531 — https://github.com/flagos-ai/FlagGems/pull/6531 · MetaX #6339 — https://github.com/flagos-ai/FlagGems/pull/6339 · SiliconFlow #5063 — https://github.com/flagos-ai/FlagGems/pull/5063 · Ascend #6548 — https://github.com/flagos-ai/FlagGems/pull/6548
- [6] 1.4 FlagGems-vllm — #817 — https://github.com/flagos-ai/FlagGems-vllm/pull/817 · #823 — https://github.com/flagos-ai/FlagGems-vllm/pull/823 · #803 — https://github.com/flagos-ai/FlagGems-vllm/pull/803 · #826 — https://github.com/flagos-ai/FlagGems-vllm/pull/826
- [7] 1.5 Torch-FL — #395 — https://github.com/flagos-ai/Torch-FL/pull/395 · #393 — https://github.com/flagos-ai/Torch-FL/pull/393 · #392 — https://github.com/flagos-ai/Torch-FL/pull/392 · #387 — https://github.com/flagos-ai/Torch-FL/pull/387 · #372 — <https://github.com/flagos-
ai/Torch-FL/pull/372> · #370 — https://github.com/flagos-ai/Torch-FL/pull/370
- [8] 1.6 FlagCX — #594 — https://github.com/flagos-ai/FlagCX/pull/594 · #611 — https://github.com/flagos-ai/FlagCX/pull/611 · #616 — https://github.com/flagos-ai/FlagCX/pull/616
- [9] 1.6 FlagSparse — #79 / #80 — https://github.com/flagos-ai/FlagSparse/pulls · FlagAttention — https://github.com/flagos-ai/FlagAttention/pulls · FlagBLAS — https://github.com/flagos-ai/FlagBLAS/pulls
- [10] 1.6 TransformerEngine-FL — #113 — https://github.com/flagos-ai/TransformerEngine-FL/pull/113 · #114 — https://github.com/flagos-ai/TransformerEngine-FL/pull/114 · Megatron-LM-FL #174 — https://github.com/flagos-ai/Megatron-LM-FL/pull/174 · FlagTree #1259 — https://github.com/flagos-ai/FlagTree/pull/1259
- [11] 2.1 AICC2026 — GMW — https://tech.gmw.cn/2026-09/22/content_39015304.htm · The Beijing News — https://www.bjnews.com.cn/detail/1790063742129693.html · CBISMB — https://www.cbismb.com/ai-infra/62409 · 의사일정 — https://www.aicconf.net/
- [12] 2.2 Zhenwu V900 — Guandian — https://www.guandian.cn/article/20260922/605518.html · National Business Daily — https://www.nbd.com.cn/articles/2026-09-22/4588418.html · Eastmoney — https://finance.eastmoney.com/a/202609223881224838.html · Alibaba Cloud Developer Community — https://developer.aliyun.com/article/1765525
- [13] 2.3 Loongson 가속 컴퓨팅 플랫폼 — ITHome — https://www.ithome.com/1/005/595.htm · MyDrivers — https://news.mydrivers.com/1/1153/1153027.htm · 디지털 트레이드 엑스포 AI 전시구역 프리뷰 — https://zdh.xwboo.com/news/262226.html
- [14] 3.5 Iluvatar CoreX — build-infra #1014 — https://github.com/flagos-ai/build-infra/pull/1014 · Release Info 포털 (iluvatar 행) — https://flagos-ai.github.io/release-info/
- [15] 3.7 Tsingmicro — AICC 의사일정 — https://www.aicconf.net/ · Release Info 포털 (tsingmicro 행) — https://flagos-ai.github.io/release-info/