모니터링 기간: 2026-08-26 10:18 ~ 2026-08-27 10:18 베이징 시간 출처: GitHub(org: flagos-ai 52개 저장소 + commit search + Issues/PR/Release API), Google News RSS(중영문 다중 쿼리, 프록시 경로 정상), HN Algolia, Tavily 교차 검증(상세는 부록 참조)


인덱스

    1. 오픈소스 프로젝트 진행 상황(GitHub 동향)
      • 1.1 Moore Threads Megatron 듀얼 백엔드 검증 폐루프——musa4.3.6/5.2.0 전 경로 그린 전환(기간 헤드라인)(08-26/08-27)
      • 1.2 vllm-plugin-FL: Hygon 백엔드와 Qwen3.6 W4A16 main 라인 승격, release/0.2 라인 MLU590/Ascend/Kunlunxin 유지보수(08-26)
      • 1.3 build-infra: verl-FL app image 빌드 계획, sglang 패키징 조사, 검증 엔지니어링 강화 지속(08-26/08-27)
      • 1.4 FlagGems: 커뮤니티 PR 러시——SiliconFlow 최초 진입, Moore Threads/Iluvatar CoreX 최적화, KernelGen 신규 연산자, Cambricon 버그픽스(08-26/08-27)
      • 1.5 FlagGems-vllm: Qwen4 자체 개발 Triton 커널과 벤더 베이스라인(08-26)
      • 1.6 Torch-FL: Ascend torch.compile 적용, Hygon DCU 저정밀도 행렬 소프트웨어 경로, 라우팅 롤백(08-26)
      • 1.7 기타 저장소 동향(FlagCX, FlagTree, Megatron-LM-FL, sglang-plugin-FL, FlagTensor, FlagBLAS, FlagDNN, docs)(08-26/08-27)
    1. 뉴스 보도와 생태계
      • 2.1 컴포넌트급 키워드 연속 8일째 제로 히트
      • 2.2 엠바디드 AI 생태계 측: 제2회 세계 휴머노이드 로봇 경기대회 폐막(08-25/08-27)
      • 2.3 생태계 측 제외 항목과 최근 일정
    1. 멤버 단위 심층 탐구
      • 3.1 Zhiyuan: Peking University-Zhiyuan 연합팀 로봇 경기대회 탁구 우승(08-25/08-26)
      • 3.2 Qingwei: 멤버 단위 엔지니어가 FlagGems에서 연산자 등록 버그 보고(08-26)
      • 3.3 Hygon: 등재 후속——vllm-plugin-FL 백엔드와 Qwen3.6 W4A16, Torch-FL 저정밀도 경로(08-26)
    1. 요약
  • 부록: 전체 출처 목록

1. 오픈소스 프로젝트 진행 상황(GitHub 동향)

기간 총람: org 내 52개 저장소 중 17개가 기간 내 푸시 발생; commit search 기준 기간 내 커밋 82건 히트(build-infra 57, FlagGems 6, FlagGems-vllm 3, FlagCX 3, Torch-FL 3, FlagTree 2, FlagBLAS 2, FlagTensor 2, docs 2, sglang-plugin-FL 1, FlagDNN 1, Megatron-LM-FL 1), 그 외 여러 저장소는 PR 브랜치 푸시(vllm-plugin-FL, flagtree-cpu, community, release-info, FlagGems-Experimental). 이번 기간 메인 라인: 첫째, 추론 측 프레임워크 연동과 멀티 백엔드 유지보수 지속 심화——vllm-plugin-FL Hygon 백엔드와 Qwen3.6 W4A16 main 라인 승격, release/0.2 유지보수 라인에 Cambricon MLU590/Ascend/Kunlunxin 멀티 백엔드 PR 신규 추가, build-infra에 verl-FL app image 빌드 계획과 sglang 패키징 조사 신규 추가; 둘째, Moore Threads Megatron 듀얼 백엔드 검증 폐루프——musa4.3.6과 musa5.2.0의 Megatron-LM-FL 학습/후학습/추론 검증 매트릭스 전부 그린 전환, 검증 매트릭스 중 학습 측 커버리지가 가장 완전한 백엔드 중 하나가 됨; 셋째, torch.compile 시퀀스가 Ascend까지 커버, Hygon DCU 저정밀도 경로 후속. 뉴스 측은 최근 7일과 일관되게 계속 잠잠, GitHub 측은 높은 열기 유지.

1.1 Moore Threads Megatron 듀얼 백엔드 검증 폐루프——musa4.3.6/5.2.0 전 경로 그린 전환(기간 헤드라인)

출처: build-infra #573, #577, #578, #579, #589, #590

  • musa5.2.0 백엔드: 8/26 21:34 「Moore Threads E2E에 --distributed-backend mccl 필요」 문제 수정(#573); 22:14 megatron training 검증 완료 표시(#577); 22:51 mthreads 백엔드에 megatron_training app image 구성 활성화(#578); 23:05 app image tag 2.1.2-0.2.1_14_g6f61e9c5b 기록; 23:10 post_training/inference 검증 통과(F+T 이중 경로) 표시(#579).
  • musa4.3.6 백엔드: 8/27 09:46 동일 app image tag 기록; 09:48 training/post_training/inference 전부 검증 통과 표시(#590); 09:50 병합.
  • 같은 날 MetaX 측: 8/26 17:31 metax-maca3.7.2.1의 megatron 검증 셀 1건 결과 기록 및 병합(#549).

해석: Moore Threads가 검증 매트릭스에서 Megatron-LM-FL 학습 측 「학습-후속 학습-추론」 전 링크를 두 MUSA 버전(4.3.6과 5.2.0) 모두에서 검증 통과한 멤버 단위가 되었으며, 학습 측 커버리지 완전성은 이전 어느 곳보다 높다. 어제 Hygon DCU 3개 라인이 합류한 것과 결합하면, 검증 매트릭스는 「추론 측이 먼저 초록으로 전환」에서 「학습 측 심층 커버리지」로 나아가고 있으며, 검증 패러다임의 템플릿화 복제 효과가 계속 나타나고 있다. 8/24 보고된 musa 이중 백엔드 F/T 이중 경로(vllm 측)와 이번 megatron 측 폐루프는 서로를 입증한다.

1.2 vllm-plugin-FL: Hygon 백엔드와 Qwen3.6 W4A16이 main 라인에 제출, release/0.2 라인 다중 백엔드 유지보수 (08-26)

출처: #407, #411, #409, #408, #406, #392

  • main 라인: #407(8/26 10:49 생성)이 Hygon 백엔드를 추가하고 Qwen3.6 W4A16 지원(Vendor PR, Hygon DCU 추론 측 한 걸음 더); #406은 Iluvatar triton patch를 모듈 레벨로 통합하고 데드 코드 정리.
  • release/0.2 유지보수 라인(v0.2 시리즈 마무리, 어제 #405가 대상 브랜치 전환): #411(8/26 19:39) Cambricon MLU590 지원, neuware 4.7.2와 4.4.3 이중 스택에서 엔드투엔드 검증 통과(5개 접점: 디바이스 등록, vendor 식별 등); #409 Ascend 범용 full-decode 그래프 모드; #408 Kunlunxin P800 CI 지원; #392 benchmark serve 리포트를 FlagCICD에 업로드.
  • Kunlunxin decode scale 수정 #400은 여전히 열려 있음(8/24 생성, 어제 관찰점 연장).

해석: vllm-plugin-FL은 「main 라인은 새 백엔드 개척(Hygon) + 0.2 유지보수 라인은 마무리하며 백엔드 계속 보강(MLU590/Ascend/Kunlunxin)」의 이중 궤도 리듬을 보인다. Hygon은 어제 sglang-plugin-FL에서 HCU vendor를 완료했고, 오늘 다시 vllm-plugin-FL에 Hygon 백엔드와 Qwen3.6 W4A16을 제출했으며, FlagOS 추론 측에서 Hygon의 커버리지는 「합류」에서 「다중 프레임워크, 다중 정밀도」로 나아가고 있다.

1.3 build-infra: verl-FL app image 빌드 계획, sglang 패키징 조사, 검증 엔지니어링 강화 지속 (08-26/08-27)

출처: #588, #582, #572, #575, #574, #567, #571

  • verl-FL app image 빌드 계획(#588, 8/27 09:37 머지): 강화학습 프레임워크 verl-FL(Volcano Engine RL 프레임워크 verl의 FlagOS 브랜치)이 app image 빌드 계획에 진입——vllm/megatron에 이어 세 번째로 학습/추론 프레임워크가 이미지 라인에 접속.
  • sglang release-packaging 조사(#582, 8/26 23:52 커밋): sglang 릴리스 패키징 방식 연구 보고서 추가, sglang-plugin-FL의 릴리스 프로세스를 위한 사전 준비.
  • Cambricon neuware4.4.3 vllm 0.20.2 app dep 활성화(#567): feat 브랜치 머지, 이후 app image tag 2.1.2-0.2.1_gef78dec.d202608262.1.2-0.2.1_gb954912.d20260826 기록(8/26 18:15, 23:05)——Cambricon 듀얼 소프트웨어 스택(4.7.2/4.4.3) 검증 라인 병행 추진.
  • 검증 엔지니어링 강화 지속: app-image 모드에서 runtime 설치 건너뛰기(#572); 명시적 --stack-version으로 오래된 node 설정이 image tag를 조용히 구동하는 것 방지(#575); verify-vllm-backend.sh의 repo root 경로 통일 및 고정(#575); vllm 검증 보고서를 「단일 거대 문서」에서 버전별 디렉터리로 분리(#574), markdown 규범에 따라 서술형 표 재작성 및 임시 노드 이름 제거(프라이버시/가독성 정리); 문서에 「업스트림 PR 리뷰 필요 원칙」 명시(#571).
  • 이미지 라인: 2.1.2의 base/runtime 이미지 설명 갱신(#565/#566); dependabot 일괄 업그레이드 GitHub Actions(checkout 4→7, setup-python 5→7, upload-artifact 4→7, download-artifact 4→8, dawidd6 23→24).

해석: build-infra의 이번 모니터링 기간 실질적 움직임은 「프레임워크 접속면 확장(verl 계획, sglang 조사) + 검증 신뢰도 엔지니어링(명시적 버전, 보고서 구조화, 프라이버시 정리)」이다. verl-FL이 app image 접속을 완료하면 FlagOS는 사전학습(megatron), 추론(vllm), RL(verl), 추론 서비스(sglang) 네 가지 주류 프레임워크를 모두 커버하게 되어, 프레임워크 판도의 마지막 범주를 채우게 된다.

1.4 FlagGems: 커뮤니티 PR 러시——SiliconFlow 최초 진입, Moore Threads/Iluvatar CoreX 최적화, KernelGen 신규 연산자, Cambricon bugfix (08-26/08-27)

출처: FlagGems commits(모니터링 기간 내 6건 머지) + open PRs(모니터링 기간 내 14건 신규 생성)

  • main에 병합: Cambricon 버그픽스 두 건—”untileable expand_shape 시 index autotune이 더 이상 프로세스를 종료하지 않음”(#5510), “paged load_from_kvcache가 스칼라 max_virtual_index를 브로드캐스트”(#5786); Iluvatar python 버전 bump(#5765); KMCompiler Ascend cholesky solve 레이아웃 테스트 안정화(#5698); QC FP8 W8A8 bmm 최적화(#4880); 신규 PR 검증 rule-check CI workflow 추가(#5774).
  • 신규 PR(커뮤니티 측): SiliconFlow 첫 기여—CI 테스트 별칭 및 approved 연산자 목록(#5788), special_laguerre_polynomial_l 연산자 추가(#5782); Moore Threads 3건 최적화(conv_transpose1d stride-phase gather #5789, matmuladd addmm SQMMA/FMA 커널 재사용 #5781, upsample_linear1d_backward #5779); Iluvatar CoreX Triton 3.6 하에서 rank-1 벡터화 복원(#5783); KernelGen Nvidia 신규 연산자 4건(native_norm #5770, fused_moving_avg_obs_fake_quant #5772, sspaddmm #5773, nested_to_padded_tensor #5775); Hopper MM dispatch 및 튜닝 최적화(#5780); dead ATen 등록 및 비표준 등록 이름 정리(#5777); index 생성 캐시 손상 복구(#5784).

해석: FlagGems 모니터링 기간 내에 “벤더 PR + 독립 개발자 PR + KernelGen 연산자 생성” 3개 축이 병행되었다. SiliconFlow가 비회원 단위의 컴퓨팅 서비스 제공자로서 연산자 라이브러리에 직접 코드를 기여한 것은 FlagOS 커뮤니티의 “공동 구축” 속성에 대한 긍정적 신호이다; Moore Threads/Iluvatar CoreX는 지속적으로 PR 형태로 연산자 라이브러리에 기여하고 있으며, build-infra의 검증 라인과 상호 보완 관계에 있다.

1.5 FlagGems-vllm: Qwen4 자체 개발 Triton 커널 및 벤더 베이스라인(08-26)

출처: #713, #681, #709

  • #713(8/26 22:02 병합) Qwen4 자체 개발 Triton 커널 및 벤더 베이스라인 대조 추가—차세대 모델을 위한 자체 개발 커널을 준비하고 벤더 네이티브 커널을 성능 베이스라인으로 포함.
  • #681은 fused_marlin_moe 커널을 정밀도 방안에 따라 이름을 변경하고 benchmark를 분리; #709는 select 테스트의 fail-closed 범위를 축소.

해석: Qwen4 커널이 FlagGems-vllm에 진입한 것은 연산자 라이브러리의 모델 추종 리듬이 Qwen3.5/3.8에서 Qwen4 시리즈로 진전되었음을 의미한다; “자체 개발 Triton 커널 + 벤더 베이스라인”의 대조 모드는 성능 결론을 정량화 가능하게 한다.

1.6 Torch-FL: Ascend torch.compile 적용, Hygon DCU 저정밀도 행렬 소프트웨어 경로, 라우팅 롤백(08-26)

출처: #189, #208, #196

  • #189(8/26 11:04) triton-ascend를 통해 Ascend torch.compile 지원 적용—8/25 Enflame GCU torch.compile(#187)에 이어, torch.compile 시퀀스가 MetaX/MUSA/GCU/Ascend 4개 백엔드를 커버하게 됨.
  • #208(8/26 19:24) DCU 저정밀도 행렬 소프트웨어 경로 추가—Hygon DCU의 Torch-FL에서의 저정밀도(저비트) 행렬 계산 소프트웨어 경로로, vllm-plugin-FL Hygon Qwen3.6 W4A16과 동일한 주기.
  • #196은 Postroggy의 FlagGems 라우팅 관련 PR을 롤백(8/26 13:32), 원인은 관찰 필요(FlagGems 측 8/24-25에도 Postroggy가 제출한 수정 PR이 있음).

1.7 기타 저장소 동향(08-26/08-27)

  • FlagCX: [CICD] openEuler 24.03이 NVIDIA RPM 빌드 매트릭스에 추가됨 (#549, 8/27 09:24); PAL 레이어 SHMEM 어댑터가 불투명 init context 핸들을 수용함 (#557).
  • FlagTree: [VERSION] triton_key를 내보내 Triton 3.4 컴파일러 인터페이스에 정렬함 (#1052, 8/26 19:50); TLE에서 “백엔드가 cluster_dims를 선언하지 않을 때 기본값 (1,1,1)” 수정 (#1020).
  • Megatron-LM-FL: chunked cross-entropy를 새로 추가하여 GPU 메모리 사용량을 낮춤 (#126, 8/26 12:58) — 장기 시퀀스 훈련 메모리 최적화.
  • sglang-plugin-FL: [e2e] T-Head PPU (PPU-ZW810E) CI 플랫폼을 새로 추가함 (#64, 8/26 10:47) — Pingtouge PPU 추론 측 검증이 공식적으로 연동됨.
  • FlagTensor: main 병합 후 Iluvatar의 vendor-native 베이스라인 파싱을 수정함 (#16, 8/26 17:48).
  • FlagBLAS / FlagDNN: CI에서 nvidia-cuda128 extras 설치 수정 (#94 병합 + 후속); Ascend 성능 수정.
  • docs: 모델 목록을 ModelScope (#469)와 HuggingFace (#470, 8/26 13:54)에 동기화함.

2. 뉴스 보도와 생태계

2.1 컴포넌트급 키워드 연속 8일째 0건

gnews 중국어·영어 다중 쿼리 (FlagOS/FlagGems/FlagScale/FlagTree/FlagPerf/FlagAttention/FlagCX/KernelGen/FlagOS-Robo/FlagQuantum/FlagPrism/FlagBLAS when:14d + Zhiyuan Research Institute 오픈소스 when:7d + BAAI open source when:7d) 기간 내 컴포넌트명 정확 일치 0건; HN Algolia 쿼리 (FlagOS/FlagGems/FlagScale/FlagTree/FlagPerf/KernelGen/BAAI)는 무관한 항목만 일치함; Tavily 교차 검증에서 FlagOS 컴포넌트급 신규 보도는 보이지 않음. “뉴스 측은 조용하고 GitHub 측은 뜨겁다”는 구도가 연속 8일째 유지되었으며, v0.3.0 정식 버전 릴리스가 여전히 다음 뉴스 촉발점이다.

2.2 체화 지능 생태계 측: 제2회 세계 휴머노이드 로봇 운동회 폐막 (08-25/08-27)

출처: Jingbao Sports/Jingbao Net (8/25), IT Home (8/25), Sing Tao Headline via gnews (8/27)

  • 제2회 세계 휴머노이드 로봇 운동회 (8/22-26, “아이스 리본”) 폐막. 8/25 100m 준결승에서 Beijing Humanoid Robot Innovation Center의 Tiangong이 8.86초를 기록하며 기록을 다시 경신함 (IT Home); 8/27 Sing Tao Headline은 Tiangong이 8.64초로 우승하며 100m 기록을 세 번째로 갈아치웠다고 보도.
  • 8/25 저녁 탁구 결승: Peking University-Zhiyuan Research Institute 연합팀 우승 (상세는 3.1 참조).
  • 대회에는 666개 팀, 2056대 로봇, 51개 종목이 참가; 여러 종목 성적이 인간 기록을 넘어섰고, 탁구 등 종목은 “완전 자율”로 리모컨이 아닌 AI 의사결정으로 겨룸.

해석: 이 대회는 체화 지능에 집중적인 스트레스 테스트 장을 제공한다. FlagOS 측의 대응인 FlagOS-Robo 체화 툴체인 (8월 리포트에서 엔드투엔드 데이터 파이프라인을 추적한 바 있음)은 이번 기간에 아직 컴포넌트급 뉴스를 내지 않았지만, “대회로 제품을 검증한다”는 생태계 열기는 FlagOS 체화 방향에 긍정적 배경이다.

2.3 생태계 측 제외 항목과 최근 노드

  • 인민망 명의 기고문 《국제 관찰: 합의 이행, 지능으로 세계를 이롭게 하다——2026 세계 인공지능 대회 의장 성명 해설》(Zhiyuan 커뮤니티 8/27 전재)——Zhiyuan 학자 명의, 정책 해설 성격, FlagOS 컴포넌트 동향 아님, 본문 미포함;
  • Zhiyuan 커뮤니티 「ChinaTalk|중국 AI의 ‘거품’」 싱크탱크 관찰 (8/26)——거시 논평;
  • 「874억, 세계 최대 AI 오픈소스 커뮤니티 매각되나」(HuggingFace 인수설 후속)——FlagOS 관련 아님;
  • 최근 일정: FlagOS 공식(CSDN 계정 8/12)이 OASIS-AI 워크숍 논문 모집 공고(MICRO 2026 동시 개최, 11/1 그리스 아테네, 이종 AI 시스템 오픈 소프트웨어 생태계와 FlagOS 멀티칩 적응 실무 중심), 마감 8/31——마감까지 4일, 투고와 후속 의제 공개 주목할 만함.

3. 회원사 심층 분석

3.1 Zhiyuan: 베이징대·Zhiyuan 연합팀, 로봇 운동회 탁구 우승 (08-25/08-26)

출처: 징바오체육/징바오망(8/25), 중신망 via gnews(8/26)

  • 8/25 저녁, 제2회 세계 휴머노이드 로봇 운동회 탁구 결승(신설 종목, 10여 개 팀)이 막을 내렸고, 베이징대학교·Zhiyuan 연구원 연합팀이 ‘안정 우선’ 전략(안정적인 리턴, 상대 실수 유도)으로 3판 2선승제 끝에 홍콩대학교 SMASH 팀을 꺾고 우승했다.
  • 경기는 하드웨어 차이를 없애기 위해 통일된 Zhiyuan Expedition A3 휴머노이드 로봇 본체를 사용했으며, 각 팀의 AI 연산 능력, 모델 학습 능력, 궤적 예측과 전신 운동 제어를 겨루었다——베이징대·Zhiyuan 연합팀은 여러 경기 전략(서브 전략, 스핀 전략)을 갖추었고 회전과 몸놀림 두 측면에서 계속 발전시킬 계획이다.
  • 중신망이 8/26 11:18에 해당 대회 소식을 보도했다(모니터링 기간 내).

해석: Zhiyuan의 엠바디드 AI 측면 포진(베이징대 연합팀, 로봇 본체에서 AI 모델 구동)은 FlagOS의 FlagOS-Robo 툴체인 방향과 호응한다. 탁구 같은 ‘밀리초급 반응, 자율 의사결정’ 과제는 엣지 추론 지연 시간 요구가 극히 높아, 엣지 추론과 엠바디드 모델의 전형적 시나리오다.

3.2 칭웨이: 회원사 엔지니어가 FlagGems에 연산자 등록 버그 제보 (08-26)

출처: FlagGems #5752(8/26 10:06)

  • 칭웨이(tsingmicro) 공식 계정 tsingmicro-public-e가 FlagGems에 이슈를 제출했다: __init__.py에서 special_i0e의 등록 표기는 ("special_i0e.out", special_i0e_out)이어야 한다(8/26 09:41에 병합된 Iluvatar 커밋이 위치한 줄을 가리킴)——회원사 엔지니어가 연산자 라이브러리 코드 리뷰와 문제 보고에 직접 참여.

해석: 칭웨이의 FlagOS 참여가 ‘백엔드 적응’에서 ‘연산자 라이브러리 코드 품질 공동 구축’으로 확장되는, 회원사 심층 참여도 향상의 미시적 신호.

3.3 하이광: 합류 후속——vllm-plugin-FL 백엔드와 Qwen3.6 W4A16, Torch-FL 저정밀 경로 (08-26)

출처: vllm-plugin-FL #407(8/26 10:49), Torch-FL #208(8/26 19:24)

  • 8/25 ‘하이광 3개 라인 합류’(FlagScale BW1000 CI, FlagCX DCU 적응, sglang-plugin-FL HCU vendor)에 이어, 이번 모니터링 기간 하이광은 두 걸음 더 나아갔다: vllm-plugin-FL에 Hygon 백엔드를 제출하고 Qwen3.6 W4A16을 지원(8/26 생성, main 라인), Torch-FL에 DCU 저정밀 행렬 소프트웨어 경로 추가(8/26 병합).
  • 이로써 하이광은 FlagOS 측에서 학습(FlagScale CI), 통신(FlagCX), 추론(sglang-plugin-FL + vllm-plugin-FL), 프레임워크 계층(Torch-FL) 네 개 라인을 커버하며, 저정밀(W4A16) 방향으로 심화하고 있다.

4. 요약

모니터링 기간 메인라인: 1. 추론 측 프레임워크 연동 및 멀티 백엔드 유지보수 심화——vllm-plugin-FL 하이곤 Hygon 백엔드 + Qwen3.6 W4A16가 main 라인에 올라왔고, release/0.2 라인에 캄브리콘 MLU590, 어센드 full-decode 그래프 모드, 쿤룬신 P800 CI가 추가되었습니다. build-infra에는 verl-FL app image 빌드 계획(프레임워크 판도에 RL 계열이 보완될 예정)과 sglang 패키징 조사가 새로 추가되었습니다. 2. 무어 스레드 Megatron 듀얼 백엔드 검증 클로즈드 루프——musa4.3.6와 musa5.2.0의 학습/포스트 트레이닝/추론 전 구간 검증 매트릭스가 모두 그린으로 전환되었으며, 학습 측 커버리지 완성도는 검증 매트릭스에서 최상위를 차지했습니다. 3. torch.compile 시퀀스 커버리지가 어센드까지 확장(GCU→어센드 4개 백엔드 완비), 하이곤 DCU 저정밀 경로 후속 진행(W4A16 + 저정밀 매트릭스). 4. 커뮤니티 공동 기여 확산——SiliconFlow가 처음으로 FlagGems에 연산자를 기여했고, 무어 스레드/일루바타 코어엑스/칭웨이가 PR/issue 형태로 연산자 라이브러리 공동 구축에 참여했습니다. 5. 회원사 측: 베이징대-BAAI 연합팀이 로봇 운동회 탁구 우승을 차지했으며, BAAI 임바디드 방향과 FlagOS-Robo가 호응합니다.

다음 관찰 포인트: vllm-plugin-FL v0.3.0 정식 버전(rc0 이미 출시, Qwen3.5 text-only 호환 #383 main에 병합 완료), 쿤룬신 decode scale #400 및 P800 CI #408 병합 상태, 하이곤 #407 병합 후 첫 검증 결과, verl-FL app image 적용 리듬, OASIS-AI 논문 모집 8/31 마감, FlagGems 5.3.5 전 백엔드 재검수 마무리 상황, Torch-FL #196 롤백의 후속 처리.

한계 설명: 커밋 수와 병합 시점은 commit search 및 repos/commits API에서 가져왔습니다(검색 인덱스가 다소 지연될 수 있으며, vllm-plugin-FL, flagtree-cpu, community, release-info 등 저장소의 모니터링 기간 내 푸시는 PR 브랜치 푸시로 메인 브랜치에는 새 병합이 없음을 pulls/issues API로 검증했습니다). 「SiliconFlow 최초 기여」는 해당 org 계정이 FlagGems 커밋 이력에 처음 등장한 것을 기준으로 합니다(전체 org 이력 검증은 미실시). gnews 리다이렉트 링크는 본문을 수집할 수 없어 뉴스 측 판단은 제목과 다중 출처 교차 검증에 의존합니다. 로봇 운동회 성적은 언론 보도 기준입니다.


부록: 전체 출처 목록

번호 이벤트 출처 링크
1 build-infra mthreads E2E mccl 수정(#573) https://github.com/flagos-ai/build-infra/pull/573
2 build-infra mthreads-musa5.2.0 megatron training verified(#577) https://github.com/flagos-ai/build-infra/pull/577
3 build-infra mthreads megatron_training app image 활성화(#578) https://github.com/flagos-ai/build-infra/pull/578
4 build-infra mthreads-musa5.2.0 F+T verified(#579) https://github.com/flagos-ai/build-infra/pull/579
5 build-infra mthreads-musa4.3.6 전체 파이프라인 verified(#589/#590) https://github.com/flagos-ai/build-infra/pull/590
6 build-infra metax-maca3.7.2.1 megatron 결과(#549) https://github.com/flagos-ai/build-infra/pull/549
7 vllm-plugin-FL Hygon + Qwen3.6 W4A16(#407) https://github.com/flagos-ai/vllm-plugin-FL/pull/407
8 vllm-plugin-FL Cambricon MLU590 + neuware 듀얼 스택(#411) https://github.com/flagos-ai/vllm-plugin-FL/pull/411
9 vllm-plugin-FL Ascend full-decode graph(#409) https://github.com/flagos-ai/vllm-plugin-FL/pull/409
10 vllm-plugin-FL Kunlunxin P800 CI(#408) https://github.com/flagos-ai/vllm-plugin-FL/pull/408
11 vllm-plugin-FL Iluvatar triton patch 통합(#406) https://github.com/flagos-ai/vllm-plugin-FL/pull/406
12 build-infra verl-FL app image 빌드 계획(#588) https://github.com/flagos-ai/build-infra/pull/588
13 build-infra sglang release-packaging 조사(#582) https://github.com/flagos-ai/build-infra/pull/582
14 build-infra Cambricon neuware4.4.3 vllm 0.20.2(#567) https://github.com/flagos-ai/build-infra/pull/567
15 build-infra verify 강화(#572/#575) https://github.com/flagos-ai/build-infra/pull/575
16 build-infra vllm 보고서 분리 및 정리(#574) https://github.com/flagos-ai/build-infra/pull/574
17 FlagGems Cambricon index autotune 수정(#5510) https://github.com/flagos-ai/FlagGems/pull/5510
18 FlagGems Cambricon KV cache 수정(#5786) https://github.com/flagos-ai/FlagGems/pull/5786
19 FlagGems SiliconFlow CI 별칭(#5788) https://github.com/flagos-ai/FlagGems/pull/5788
20 FlagGems Moore Threads conv_transpose1d 최적화(#5789) https://github.com/flagos-ai/FlagGems/pull/5789
21 FlagGems Iluvatar rank-1 벡터화 복원(#5783) https://github.com/flagos-ai/Flag
Gems/pull/5783      
  22 FlagGems KernelGen native_norm(#5770) https://github.com/flagos-ai/FlagGems/pull/5770
  23 FlagGems-vllm Qwen4 커널 및 벤더 베이스라인(#713) https://github.com/flagos-ai/FlagGems-vllm/pull/713
  24 Torch-FL Ascend torch.compile(#189) https://github.com/flagos-ai/Torch-FL/pull/189
  25 Torch-FL DCU 저정밀 행렬 경로(#208) https://github.com/flagos-ai/Torch-FL/pull/208
  26 Torch-FL Postroggy 라우팅 롤백(#196) https://github.com/flagos-ai/Torch-FL/pull/196
  27 FlagCX openEuler 24.03 RPM 매트릭스(#549) https://github.com/flagos-ai/FlagCX/pull/549
  28 FlagTree triton_key Triton 3.4 정렬(#1052) https://github.com/flagos-ai/FlagTree/pull/1052
  29 Megatron-LM-FL chunked cross-entropy(#126) https://github.com/flagos-ai/Megatron-LM-FL/pull/126
  30 sglang-plugin-FL T-Head PPU-ZW810E CI(#64) https://github.com/flagos-ai/sglang-plugin-FL/pull/64
  31 FlagGems Qingwei issue(#5752) https://github.com/flagos-ai/FlagGems/issues/5752
  32 org repos 개요(52개 저장소, 17개 저장소 모니터링 기간 내 활성) https://api.github.com/orgs/flagos-ai/repos?per_page=100&sort=updated
  33 commit search(모니터링 기간 내 82건 고유 커밋) https://api.github.com/search/commits?q=org:flagos-ai+committer-date:%3E2026-08-26T02:18:00Z
  34 Peking University Zhiyuan 팀 탁구 우승(Beijing Daily Sports/Beijing Daily Net) https://news.bjd.com.cn/2026/08/25/11932197.shtml
  35 탁구 우승 보도(China News Service via gnews) https://news.google.com/rss/articles/CBMifkFVX3lxTE11UExBLWFCdUpaVzFZM3VFRXh1MHJRU0lhVWhFMDFTM2dzODc2MHFsYjZrdTFlOTJRRVhTMldNbkNGYmZDdC13ZHdNVUpPTFM0SzBPTFJpenRGa2UzZy1kbFlWREt0c0thVhXNUUNocHFQOUswcHYyRkJ4a2x6UQ?oc=5
  36 Tiangong 100미터 8.86초(ITHome) https://www.ithome.com/0/994/182.htm
  37 Tiangong 8.64초 3회 기록 경신(Sing Tao Headline via gnews) https://news.google.com/rss/articles/CBMirAJBVV95cUxNRmh3VlZLaW5Tbloyb3NSWXRiRFRhUllfQUFQNXh3WG5zaGtTZU1ObGN0TGxxZ0U5MWx5U3JkUTZfV0V1X0VwSy1ybUFRLUdHNzdhM3IxdXFBbG1OY1ZxQmIzSzdOWEE1dWE0SzV6bjlUVlFwVFNoZXB6c25oYUpudVFWVFgxR1ZBbmJFWGF6UUx5a3N0TkQ3YTJlS2RIVGFCb09OYVBCN1c1UGVxc2dUeHhZX3dtYVdVRnFfckVvU1R0aW0tVTFQaGR3UmF1OVAxcGk0a3pnRmFPNWRZSDJHY2UzbXd6SkkwbTRJX3RCMDFlVUhZM01xaFhnTHNDNW1KMWRwQ29HZ0VNV1hGX2cwMXg0TUg4Y1k5R1RYaHEwWXF2a09sdkZCbkUwUTg?oc=5
  38 OASIS-AI 논문 모집(FlagOS CSDN 공식 계정) https://flagos.csdn.net
  39 gnews 중영문 다중 쿼리(컴포넌트 레벨 제로 히트) https
40 HN Algolia(무관한 오매칭) https://hn.algolia.com/api/v1/search_by_date?query=FlagOS
41 Tavily 교차 검증(BAAI/회원 기관 뉴스) https://www.tavily.com