FlagOS 데일리 리포트 (2026-09-05)
모니터링 기간: 2026-09-04 10:18 ~ 2026-09-05 10:18 베이징 시간 출처: GitHub(org: flagos-ai 52개 저장소 + commit search 51건 전량 + 기본 브랜치 per-repo 검증 + tags/releases 날짜 검증), Google News RSS(중영문 21개 쿼리, 프록시 경로 정상), HN Algolia, 재경 매체 원사이트 검색 검증(Sina Tech/Operators Finance/Times Finance/Lianhe Zaobao/Kuaikeji 등, 상세는 부록 참조)
인덱스
-
- 오픈소스 프로젝트 진행(GitHub 동향)
- 1.1 FlagTree 최초 Tsingmicro 백엔드 연동: 300개 파일로 TLE-DSA 데이터 흐름 추상화 구현(09-04)
- 1.2 build-infra: vLLM 0.24.0 검증 매트릭스 확장——Cambricon 통과, Iluvatar CoreX T 경로 납품 불가 판정(09-04)
- 1.3 build-infra: sglang 0.5.18 애플리케이션 환경에 Cambricon과 Enflame 적용, 이미지 기록과 빌드 수정 밀집 반영(09-04/09-05)
- 1.4 FlagGems-vllm: Ascend 연산자 대량 보완 및 cann850 제거, Hygon/Moore Threads 정규화 연산자 최적화(09-04/09-05)
- 1.5 FlagGems: KMCompiler 신규 연산자와 FlagTune 비용 모델, ARM CPU 측 W4A8 양자화 선형 연산자(09-04/09-05)
- 1.6 기타 컴포넌트: FlagDNN Moore Threads 백엔드 추가, vllm-plugin-FL 스케줄링 및 양자화 수정, FlagScale 2건 커밋(09-04)
- 오픈소스 프로젝트 진행(GitHub 동향)
-
- 뉴스 보도와 생태계
- 2.1 컴포넌트급 뉴스 연속 네 번째 조용한 기간, 릴리스 안정기 지속(09-04~09-05)
- 2.2 Zhiyuan 기관 동향: FlagOS 관련 공식 발표 없음; “Zhiyuan Xinjing”은 상하이 마케팅 테크 기업으로 Zhiyuan Research Institute와 명칭 충돌하여 제외(09-04)
- 뉴스 보도와 생태계
-
- 회원사 심층 분석
- 3.1 Enflame: 발행가 142.18 위안/시가총액 약 612억 확정, 상반기 적자 6.32억으로 확대, 로드쇼에서 2026/2027 흑자 전환 일정 제시(09-04)
- 3.2 Moore Threads: “Lushan” GPU 연내 출시, 국산 하드웨어 광선추적 최초 탑재; 상반기 매출 +147% 적자 대폭 축소; Qujing Technology와 PD 이기종 협력 체결(09-04/09-05)
- 3.3 MetaX: 장부상 흑자 전환 순이익 6.12억은 실질적으로 8.87억 평가이익 덕분, 비경상이익 제외 시 여전히 4886만 적자, 주요 매체 집중적으로 “흑자 전환의 실속” 해부(09-04)
- 3.4 Iluvatar CoreX: 장부상 흑자 전환 1.06억 전부 Shenghe Jingwei 평가이익에 의존, 매출총이익률 17.2%로 급락, 본업 적자 확대(09-04)
- 3.5 Cambricon: 11개 팀 대규모 소프트웨어 인재 영입, AI 소프트웨어 생태계 강화(09-02 발표/09-04 보도)
- 회원사 심층 분석
-
- 총평
- 부록: 전체 출처 목록
1. 오픈소스 프로젝트 진행(GitHub 동향)
기간 개요: org 내 52개 저장소 중 11개가 기간 내 푸시 발생, commit search 히트 51건의 기간 내 커밋(build-infra 19건, FlagGems 11건, FlagGems-vllm 9건, FlagTree 5건, vllm-plugin-FL 3건, FlagDNN 2건, FlagScale 2건); docs/release-info/flagtree-cpu/sglang-plugin-FL의 pushed_at 변화는 기본 브랜치 commits 검증 결과 모두 비기본 브랜치(PR 브랜치) 작업으로 기간 내 실질 병합 없음. tags/releases 날짜 검증(annotated tag 객체 포함) 기간 내 신규 tag 없음, 신규 release 없음——vllm-plugin-FL v0.3.0-rc0.post1, FlagGems-vllm v0.2.0-rc0.post1 등 2.2 RC0 검증기 tag 모두 08-31(UTC) 생성, 릴리스 안정기 지속. 이번 기간 주요 흐름: 1. FlagTree 최초로 300개 파일 규모로 Tsingmicro 백엔드 연동, TLE-DSA(데이터 흐름 아키텍처) 프로그래밍 추상화와 DsaToCore 변환 추가, Tsingmicro가 공식적으로 통합 컴파일러 백엔드 매트릭스에 진입; 2. build-infra의 vLLM 0.24.0 검증 매트릭스 재확장——Cambricon과 Iluvatar CoreX(iluvatar-corex4.4.0) 애플리케이션 이미지 검증 통과, 그러나 Iluvatar CoreX T 경로(벤더 Triton 3.1.0)는 엔진 초기화 결함으로 공식 “납품 불가” 판정, 다중 벤더 납품 매트릭스 최초로 “F 경로 납품 가능, T 경로 납품 불가” 분화 기록; 3. sglang 0.5.18 애플리케이션 환경(deps_app/app env)에 Cambricon과 Enflame 대량 적용, 검증 기록과 빌드 수정 밀집 반영(기간 내 build-infra 19건 커밋 중 sglang 라인 12건), sglang 이미지 매트릭스 “등록-검증-수정” 롤링 상태 진입.
1.1 FlagTree 최초 Tsingmicro 백엔드 연동: 300개 파일로 TLE-DSA 데이터 흐름 추상화 구현(09-04)
출처: FlagTree #1071 (4f61a9d8ca)
- 09-04 21:02(베이징 시간) #1071 머지: FlagTree에 Tsingmicro 백엔드 통합 추가(Triton 3.6)——이번 커밋은 총 300개 파일을 포함하며, 모니터링 기간 내 규모가 가장 큰 백엔드 머지이자 FlagTree 저장소 역사상 최초의 실질적인 Tsingmicro 지원이다(이전에는 07-16의 문서 수준 언급 한 건뿐이었으며, commit search로 검증함).
- 코드 구조:
python/triton/experimental/tle/language/dsa/서브모듈 추가(dsa/core.py,dsa/semantic.py,dsa/types.py및dsa/tsingmicro/벤더 구현 포함),third_party/tle아래에 tle-dsa dialect(DsaDialect/DsaOps.td)와 DsaToCore 변환 추가; 함께setup_tools/utils/tsingmicro.py빌드 스크립트, UnifiedHardware 추상화 및 일체의 TLE DSA 통합 테스트(test_tle_dsa_arith/bridge/pipeline_e2e/rand/slice,bench_tle_dsa.py,test_tle_cumsum_txda.py)를 포함. - 의미론적 요점: DSA(Dataflow Streaming Architecture)는 Tsingmicro의 재구성 가능 데이터플로우 칩의 프로그래밍 추상화이다——TLE 언어 계층에 DSA 프리미티브를 추가하고 컴파일러 내부에서 DsaToCore 하강을 수행하여, Tsingmicro의 “데이터플로우 실행” 모델을 Triton/TLE 생태계에 접속시킨다.
해석: Tsingmicro는 FlagOS 멤버 기관 중 노선이 가장 특수한 곳이다(재구성 가능/데이터플로우 아키텍처로, 다중 코어 GPGPU와 구별됨). 이전에도 FlagScale(txda 플랫폼, 07-28), FlagGems(TSINGMICRO 백엔드 정기 업데이트), build-infra(08-31에 tsingmicro-tsm260610의 vLLM 0.24.0 deps_app 등록) 등 계층에서 점진적으로 접속해 왔다. 이번 FlagTree 300개 파일 규모의 머지는 “통합 컴파일러”라는 한 고리를 완성했다: Tsingmicro는 Ascend, Cambricon, Iluvatar CoreX, Enflame, Moore Threads, Hygon, MetaX(metax)에 이어 FlagTree 백엔드에 진입한 또 하나의 멤버가 되었으며, “다중 코어 모사” 방식이 아닌 독립적인 DSA 방언으로 접속했다는 점은 컴파일러 계층이 재구성 가능 아키텍처를 위해 네이티브 표현 경로를 보존했음을 보여준다. Triton 3.6 정합도 이전 mthreads3.6 툴체인 리듬과 일치한다.
1.2 build-infra: vLLM 0.24.0 검증 매트릭스 확장——Cambricon 통과, Iluvatar CoreX T 경로 납품 불가 판정(09-04)
출처: build-infra #718 (37cc0a5e0c), #722 (d116a8cbd2), #724 (34c0d16e4d)
- 09-04 11:49 #718: Cambricon(cambricon)과 Iluvatar CoreX(iluvatar-corex4.4.0)의 vLLM 0.24.0 애플리케이션 이미지 검증 통과 표시——09-03 Enflame tops1.10.6이 F+T 이중 경로 전달을 완료한 데 이어, 0.24.0 전달 매트릭스가 Cambricon과 Iluvatar CoreX 두 개의 새로운 라인으로 확장되었다.
- 09-04 15:32 #722(기록형 커밋, 정보량 최대): Iluvatar CoreX iluvatar-corex4.4.0의 0.24.0 T 경로 “전달 불가” 판정——ix15 머신(corex 4.4.0 SDK, 이미지 g84a4ca2)에서 재현 검증: T 경로(벤더 Triton 3.1.0)가 profile_run 단계에서 엔진 초기화 실패가 안정적으로 재현되며, 근본 원인은 vLLM 0.24.0의 apply_top_k_top_p_triton 삼원 검색 kernel에 uint32/int32 혼합 나눗셈이 존재하여 corex 3.1.0 브랜치가 해당 연산을 거부하기 때문이다(0.20.2 시대에 기록된 동종 툴체인 세대 차이 문제와 동일 기원). 플러그인의 기존 iluvatar sampler 패치는 compiled_random_sample만 커버하고 apply_top_k_top_p는 커버하지 않으며, EngineCore는 spawn 자식 프로세스여서 부모 프로세스의 런타임 패치가 전파될 수 없다——수정 방향은 “플러그인 모듈 스코프에서 pytorch sampler 폴백을 강제해야 한다”로 명확히 규정되었다.
- 09-04 17:42 #724: 09-04 Cambricon 4.7.2(vLLM 0.20.2)의 기배포 애플리케이션 이미지 재검증 기록 등록——구버전 이미지의 배포 후 재검증(reverify) 메커니즘이 지속된다.
해석: 이는 멀티벤더 전달 매트릭스에서 처음으로 “F 경로(FlagGems/KMCompiler 생성 경로) 전달 가능, T 경로(벤더 Triton 경로) 전달 불가“라는 명확한 분화 기록이 나타난 것이다——동일 칩, 동일 이미지에서 두 컴파일 경로의 전달 상태가 명시적으로 분기되었고, 전달 불가 사유가 벤더 툴체인(corex 3.1.0)의 특정 연산 거부와 플러그인 샘플링 패치의 커버리지 공백으로 정밀하게 특정되었다. 이러한 “부정적 기록”(왜 전달할 수 없는지 기록 + 수정 경로 제시) 자체가 엔지니어링 신뢰성의 구현이다: Iluvatar CoreX의 0.24.0 전달은 현재 F 경로(#718에서 검증 완료)를 기준으로 하며, T 경로는 플러그인 측 sampler 폴백 패치 이후 재검증을 기다린다.
1.3 build-infra: sglang 0.5.18 애플리케이션 환경에 Cambricon과 Enflame 적용, 이미지 기록과 빌드 수정 밀집 병합(09-04/09-05)
출처: build-infra #719(4b8806bc07), #720(29be2deb3e), #721(e4950a66ce), #723(4e98245456), #725(84d93933f0), #726/#727/#728, #729(81afd7cea6), #730(110401a708), #731(69bff171a3), #732(1bfa07bade), #733(07da65b40d), #734(393649df1e), #735(46063c3d00), #736(c64e924901)
- 애플리케이션 환경(app env) 확장: 09-04 22:10 #729에서 Enflame enflame에 sglang 0.5.18의 deps_app 키와 애플리케이션 환경을 추가; 22:20 #730에서 Cambricon cambricon에도 동일하게 0.5.18 애플리케이션 환경을 반영——sglang 0.5.18의 다중 벤더 이미지 빌드 매트릭스가 공식적으로 확대됨(이전 모니터링 기간에 등록된 MetaX metax와 Ascend cann9.0.0 sglang 이미지 tag는 0.5.18 동일 버전 라인에 속함). 09-05 08:06 #734에서 Enflame enflame-tops1.10.6의 sglang 애플리케이션 이미지 tag(2.1.2-0.1.dev1_g65dff2733)를 등록.
- 상태 및 검증 기록: 09-04 20:51/21:16 #726/#727에서 sglang 상태 매트릭스에 Cambricon, Enflame의 플러그인 PR을 등록; 21:37 #728에서 Cambricon/Enflame 검증 기록을 추가하고 Nvidia는 검증 대기(pending)로 명시; 11:49 vllm 라인 #718과 sglang 라인이 동시에 추진됨.
- 빌드 및 검증 수정 집중(12건): #719 shim 업로드 후 모든 app-served 벤더 인덱스에 게시; #720/#732 wheel 빌드 컨테이너에서 –network host 중복 제거; #721 cargo가 rsproxy.cn 국내 미러를 사용하도록 변경; #723/#731에서 Cambricon, Moore Threads(mthreads) 런타임 의존성에 torchaudio/torchvision 보충; #725 Cambricon deps_app에 compressed-tensors 고정; #733 serve 준비 게이팅을 post-warmup 로그 라인 대기로 변경; #735 Enflame 측 verify 실패 시 즉시 종료하고 warmup 타임아웃을 적용; #736 Step 7 exec 문자열 내의 이스케이프되지 않은 따옴표 이스케이프 수정.
해석: build-infra의 sglang 라인이 “이미지 tag 등록”에서 “벤더별 애플리케이션 환경 보충 + 런타임 수정”의 구축 단계로 진입: Cambricon과 Enflame의 sglang 0.5.18 이미지가 곧 vLLM 0.24.0과 동등한 사양의 검증-전달 프로세스에 들어갈 예정; 수정은 wheel 빌드 네트워크(rsproxy 미러링), 컨테이너 네트워크 중복 제거, 의존성 보충 및 준비 게이팅에 집중——이는 모두 “벤더 이미지 빌드를 CI에서 반복 실행 가능하게 만드는” 엔지니어링 기반 작업임. 주목할 점은 #719의 메커니즘: shim이 업로드되면 자동으로 모든 app-served 벤더 인덱스에 게시되어, 이미지 배포의 자동화 수준이 향상되고 있음.
1.4 FlagGems-vllm: Ascend 연산자 대량 보충 및 cann850 제거, Hygon/Moore Threads 정규화 연산자 최적화 (09-04/09-05)
출처: FlagGems-vllm #731(e455c57d06), #728(9953ab4f6b), #729(968d832a1b), #730(d167d8f008), #740(255ab5601b), #738(5865ed53b1), #735(5643b85a7c), #697(98aec3d6bb)
- Ascend 연산자 일괄 보완: 09-04 16:05~17:25에 Ascend 백엔드 연산자 4개를 연속 병합——add_rms_norm(#731), swiglu(#728), causal_conv1d_update(#729), causal_conv1d_fn(#730, Ascend 단위 테스트 포함); 09-05 01:41 #740에서 tools 측 cann850 백엔드 삭제——어제 FlagGems #5970의 cann850 제거와 동기화되어, Ascend 툴체인이 연산자 라이브러리와 브리지 계층 두 곳에서 동시에 CANN 8.5 분리를 완료했다.
- 정규화 연산자 최적화: 09-04 15:07 #738에서 Hygon 백엔드의 fused QKV RMSNorm(vLLM 추론 핫 패스) 최적화; 14:58 #735에서 mthreads의 fused add rms norm 최적화. 같은 배치의 #697은 KMCompiler TLE에 fp8/fp4 MQA logits 연산자를 신규 추가(양자화 MQA 어텐션 logits 생성으로 추정).
- 엔지니어링 수정: 09-05 01:14 #739에서 triton과 torch의 순환 임포트 오류 수정.
해석: FlagGems-vllm 모니터링 기간 내 9개 커밋은 뚜렷한 두 가지 흐름을 보여준다: Ascend 측 “연산자 보완 + 툴체인 전환”(신규 연산자 4개로 swiglu/RMSNorm/인과 컨볼루션 계열 보완——인과 컨볼루션은 Mamba 계열 SSM 모델의 핵심 연산자로, Ascend 백엔드가 비 Transformer 아키텍처를 커버하고 있음을 시사; cann850 삭제와 build-infra 측 CANN 9.0.0 등록이 상호 입증)과 국산 업체 추론 핫 패스 최적화(Hygon/mthreads의 RMSNorm 변형 최적화는 각 백엔드의 vLLM 추론 성능 다듬기가 연산자 수준에 진입했음을 보여줌). Ascend는 FlagOS 정식 멤버 기관은 아니지만, 툴체인과 연산자 적응의 깊이는 이미 멤버 기관과 동급이다.
1.5 FlagGems: KMCompiler 신규 연산자와 FlagTune 비용 모델, ARM CPU 측 W4A8 양자화 선형 연산자 (09-04/09-05)
출처: FlagGems #6002(7e6c5524f2), #5942(156e7e475f), #5958(5bedd841e7), #5762(8416e6dab4), #5904(cd55e57b42), #5980(9553ae9c74), #6004(855774a3ed), #5999(a3d2fc8c58)
- KMCompiler(NVIDIA 생성 경로) 연산자 및 테스트: 09-04 19:26 #6002 Triton kernel을 포함한 gru 연산자 추가; 09-05 03:22 #5942 matrix rank(행렬 랭크) 연산자 추가; 15:30 #5958 분산 연산자 구현을 정교화하고 완전한 테스트 커버리지를 보강—KMCompiler의 연산자 범위가 element-wise/행렬곱에서 RNN(GRU)과 선형대수(rank)로 확장되고 있다.
- FlagTune 비용 모델: 09-05 03:47 #5762 FlagTune에 다중 플랫폼 Mul(곱셈) 연산자의 cost model 지원을 추가—튜너의 비용 모델링이 다중 칩 플랫폼으로 확장되고 있다.
- ARM CPU 측 신규 기능: 09-04 14:54 #5904 CPU 백엔드에 W4A8-G128 양자화 linear API 추가(Triton CPU 구현, ARM 플랫폼); 09-04 14:56 #5999 setup.sh에서 aarch64 환경의 uv unzip 경로 문제를 수정—flagtree-cpu 저장소(07-18에 ARM64 CPU 백엔드가 병합된 이력 있음)와 어제의 [ARM] 시리즈 커밋을 고려하면, FlagGems의 ARM/CPU 추론 경로에 대한 양자화 지원이 지속적으로 보강되고 있다.
- 수정 유형: 09-04 11:01 #5980 Ascend 백엔드 multinomial의 NaN/OOM 및 cumsum device 문제를 수정; 09-05 00:15 #6004 slice의 누락된 기본 파라미터와 view 시맨틱 훼손 문제를 수정; 16:46 #5930 special_hermite_polynomial_h를 수정; 23:38 backends.json 업데이트.
해석: FlagGems의 11개 커밋은 범위가 넓지만 주된 흐름은 명확하다: KMCompiler 생성 경로는 NVIDIA 측에서 연산자 범위를 확장(GRU/rank/dist 연산자)하고 테스트를 보강하고 있으며, FlagTune 비용 모델은 다중 플랫폼으로 나아가고, CPU/ARM 측에서는 W4A8 양자화 선형 연산자가 등장—후자는 국산 서버 ARM(Kunpeng/Phytium 계열) 또는 edge 시나리오의 양자화 추론 요구에 대응하며, 이전에 FlagGems가 SiliconFlow 백엔드(클라우드 벤더)를 지원한 것과 함께 “클라우드, 엣지, CPU”의 다중 형태 커버리지를 형성한다. Ascend multinomial 수정과 1.4의 Ascend 연산자 보강은 모두 Ascend 적응 심화의 일부에 속한다.
1.6 기타 컴포넌트: FlagDNN Moore Threads 백엔드 추가, vllm-plugin-FL 스케줄링 및 양자화 수정, FlagScale 2건 커밋(09-04)
출처: FlagDNN(33958a1c25), FlagDNN(f619b92706), vllm-plugin-FL #439(4b570bcd27), #440(8174811506), #441(396920a4cb), FlagScale #1281(83617e0b66), FlagScale #1279(09295660ba)
- FlagDNN: 09-04 10:40 mthreads(Moore Threads/MUSA) 백엔드 신규 추가——09-02 hygon CPU 참조 구현 추가에 이어, DNN 연산자 라이브러리에 또 하나의 벤더 백엔드가 더해짐; 13:54 Ascend 910b4-4 적응 수정(Ascend 910B4 변형 적응 수정).
- vllm-plugin-FL: 09-04 15:07~15:08 연속 세 건——#439 스케줄링 계층에서 FlagGems blacklist 항목 추가 지원(사용자/배포자가 특정 연산자를 FlagGems 디스패치에서 제외하고 참조 구현으로 폴백 가능); #440 사용 가능한 reference fallback 등록 유지(디스패치 계층 내결함성); #441 양자화 계층에서 OOT(out-of-tree) 양자화 방안이 네이티브 MXFP8 후보를 상속——디스패치와 양자화 두 경로의 “폴백 가능, 상속 가능” 시맨틱이 보완됨.
- FlagScale: 09-04 19:58 두 건——#1281 profiler kernel reports 추가(성능 프로파일링 출력 커널 수준 리포트); #1279 engram과 transformer 통합 수정(engram은 FlagScale 내부 모듈, transformer 통합 정확성 수정).
해석: 롱테일 컴포넌트는 “벤더 백엔드 + 폴백 시맨틱” 테마를 이어감: FlagDNN은 CPU(hygon) 이후 Moore Threads GPU 백엔드를 보강하고, Ascend 910b4-4 수정과 함께 세 플랫폼을 확보; vllm-plugin-FL의 blacklist/fallback/MXFP8 상속 세 가지 변경은 공동으로 하나의 목표를 지향——“FlagGems가 담당하고 참조 구현이 하단을 받치는” 디스패치 모델을 실제 배포에서 더욱 제어 가능하게 만드는 것(blacklist로 연산자별 FlagGems 비활성화 가능, 개별 연산자 이상이 전체 추론 체인을 막는 것 방지), 이러한 메커니즘은 플러그인이 프로덕션 환경에 진입하기 위한 필수 엔지니어링.
2. 뉴스 보도와 생태계
2.1 컴포넌트 수준 뉴스 네 번째 연속 조용한 모니터링 기간, 릴리스 안정기 지속(09-04~09-05)
출처: Google News RSS 중영문 21개 쿼리(상세는 부록 참조)
- 이 모니터링 기간(09-04 10:18 ~ 09-05 10:18) FlagOS 및 핵심 컴포넌트(FlagGems/FlagScale/FlagTree/FlagPerf/FlagAttention/FlagCX/KernelGen) 중영문 쿼리 다시 전부 제로 히트(컴포넌트 수준 직접 히트 네 번째 연속 모니터링 기간 공백); “BAAI open source”, 영문 FlagOS 쿼리 역시 유효 히트 없음; HN Algolia 네 건 히트(Gage 도구/Lenovo 태블릿/Xfinity 도메인/VW 감원)는 모두 무관 노이즈로 제외.
- 최근 3일 추세(GitHub 방증): 2.2 RC0 검증 tag 집중기(08-31~09-01) 종료 후, 9/2~9/5는 “릴리스 안정기 + 다중 벤더 납품 매트릭스 구축기”: 신규 tag 없음, 신규 release 없음, 그러나 build-infra가 Iluvatar CoreX/Cambricon vLLM 0.24.0 검증 완료(1.2), sglang 0.5.18 벤더 애플리케이션 환경 구축(1.3), FlagTree Zhaoxin 백엔드 연결(1.1). 2.2의 다음 공개 동작은 여전히 rc0.postN 반복 또는 정식 rc 분기; vllm-plugin-FL v0.3.0-rc0.post1 등 검증기 tag의 annotated 날짜는 검증 결과 08-31(UTC), 모니터링 기간 내 신규 추가 아님.
- 중영문 뉴스 측 고빈도 히트는 여전히 회원사 재무 면에 집중(Enflame IPO 가격 결정/손실 분해, Moore Threads 반기 보고서와 신제품, MetaX와 Iluvatar CoreX “흑자 전환의 실속” 논쟁, Cambricon 소프트웨어 인재 채용——제3장 참조), 생태계 서사는 “자본화 고점 + 실적 소화기”에 위치, FlagOS 자체는 새로운 공식 릴리스로 이어받지 못함.
2.2 Zhiyuan 기관 동향: FlagOS 관련 공식 릴리스 없음; “Zhiyuan Xinjing”은 상하이 마케팅 테크 기업, Zhiyuan 연구원과 명칭 충돌로 제외(09-04)
출처: Sina Finance(모수 OPC 보도), Sina Finance 원문 페이지(Zhiyuan Xinjing과 Ipsos China)
- 09-04 중문 쿼리에서 한 건 히트 “Zhiyuan Xinjing과 Ipsos China 전략적 협력 체결“(AI 시대 브랜드 연구 패러다임 공동 구축). 검색 검증 결과: Zhiyuan Xinjing(NextBrandAI)은 상하이 모수 공간에 등록된 마케팅 버티컬 AI 테크 기업으로, 베이징 Zhiyuan 인공지능 연구원(BAAI)과 무관——순전히 명칭 충돌, 제외, Zhiyuan 기관 동향으로 수록하지 않음(어제 iPolloWork OPC 검증 결론과 동일 유형).
- Zhiyuan 커뮤니티 콘텐츠 측은 여전히 제3자 콘텐츠 집계 위주(GPT-6 출시 예열, Meta 오픈소스 모델, Fei-Fei Li Atlas 월드 모델 등 전재), Zhiyuan 자체 성과 릴리스 아님; 모니터링 기간 내 Zhiyuan 공식 신규 모델/신규 플랫폼/FlagOS 관련 공고 없음.
3. 회원사 심층 분석
3.1 Enflame: 발행가 142.18 위안/시가총액 약 612억 위안 확정, 상반기 손실 6.32억 위안으로 확대, 로드쇼에서 2026/2027년 흑자 전환 일정 제시 (09-04)
출처: Sina Tech/윈잉상차이징《Enflame 상반기 손실 6.32억 위안으로 확대》, Phoenix Finance《자체 개발 비CUDA, 추론 마이그레이션 비용 단 1인일, 왜 여전히 적자인가?》, Jiemian News《텐센트, Enflame IPO 최대 수혜자로 부상》, Sina Finance/관뎬왕《텐센트 전략 배정 Enflame 출자 2.48억 위안》
- 가격 확정 및 공모 마무리: Enflame(688801.SH)의 발행가가 주당 142.18 위안으로 확정되었으며, 상장 시 시가총액은 약 611.87억 위안; 청약 당첨 번호, 기관 배정 등 절차적 소식이 09-04에 집중 보도됨(Huaxia Fund/Tianhong Fund 배정, 은행 재테크 자회사 4개 기관 합계 2,300만 주 이상 배정). 그중 텐센트 전략 배정 출자 2.48억 위안, 대응 보유 주식 시가총액 약 126억 위안, Jiemian News가 “텐센트가 최대 수혜자”라는 제목으로 산출한 바에 따르면 보유 주식 시가총액 100억 위안 초과 — “최대 고객 + 최대 외부 주주”라는 이중 신분이 IPO 여론 전반을 관통.
- 손실 데이터 및 흑자 전환 일정: 언론이 인용한 공모서/로드쇼 기준 — 2026년 상반기 매출 11.2억 위안(2025년 연간 9.90억 위안을 이미 초과, 전년 동기 대비 +279%), 지배주주 순손실 6.32억 위안, 전년 동기 대비 3.57% 확대; 2023~2025년 3년 누적 손실 43억 위안 초과(연구개발비 비율 최고 408%); 자오리둥 회장은 IPO 온라인 로드쇼에서 2026년 또는 2027년 연결 재무제표 기준 흑자 달성을 전망하며, 2026년 1~9월 매출 23~30억 위안 예고치를 제시(전년 동기 대비 +325.78%~455.36%).
- 소프트웨어 노선 재조명: Phoenix Finance가 09-04 “자체 개발 비CUDA, 추론 마이그레이션 비용 단 1인일, 왜 여전히 적자인가?”라는 제목으로 재조명 — Enflame은 전용 아키텍처(DSA) 노선, 자체 개발 “TopsRider” 소프트웨어 플랫폼, CUDA 비호환(Guancha Syndicate 기준), 공식적으로 추론 시나리오 마이그레이션 비용을 1인일까지 낮출 수 있다고 주장; 그러나 2025년 텐센트 기여 매출 비중 80% 초과(윈잉상차이징 기준 83.79%)의 고객 집중도와 지속적 손실은 여전히 시장의 핵심 질의 대상.
해석: Enflame의 IPO는 “가격 확정, 상장 대기” 단계에 진입(발행 시가총액 약 612억 위안, 4대 신흥 AI칩 기업 중 마지막으로 A주 상장). 여론의 초점은 공모 수익에서 두 가지 실질적 문제로 전환: 소프트웨어 생태계 서사 실현 가능성(자체 개발 비CUDA 스택 + 추론 마이그레이션 비용 1인일 — Enflame 백엔드는 FlagOS build-infra에서 vLLM 0.24.0 딜리버리 클로즈드 루프 및 sglang 0.5.18 환경 구축을 완료, 오픈소스 통합 스택은 바로 “마이그레이션 비용 절감” 주장의 제3자 방증)과 고객/주주 집중도 리스크(매출 80% 초과가 텐센트에서 발생). 상반기 손실 3.57% 확대와 “2026/2027년 흑자” 전망 사이의 시간 창은 상장 후 매 분기 보고서의 검증 포인트가 될 것.
3.2 Moore Threads: “Lushan” GPU 연내 출시, 국산 최초 하드웨어 레이트레이싱; 상반기 매출 +147% 손실 대폭 축소; Qujing Technology와 PD 이기종 협력 체결 (09-04/09-05)
출처: Sina Finance/Kuai Technology ‘류산(Lushan) GPU, 하드웨어 레이트레이싱 최초 공개’, Drivers Home/Kuai Technology 원문, Sina Finance ‘매출 147% 증가에도 여전히 적자’, East Money ‘QvJing Technology와 Moore Threads 전략적 협력 체결, 국산 PD 이기종 솔루션 생산 환경 진입’, PingWest(협력 보도)
- ‘류산(Lushan)’ GPU(소비자용 그래픽 플래그십): 09-03 오후 2026 반기 실적 설명회에서 Moore Threads는 5세대 ‘화강(Huagang)’ 아키텍처 기반 고성능 그래픽 렌더링 칩 ‘류산’이 2026년 말(Q4) 출시 예정임을 확인했다. 이는 국내 최초로 하드웨어 실시간 레이트레이싱을 지원하는 국산 그래픽 카드( DXR/DirectX 12 Ultimate 지원, 2세대 하드웨어 레이트레이싱 엔진 및 1세대 AI 생성형 렌더링 아키텍처 MTAGR 1.0 탑재)이다. 공식 발표 기준 이전 세대 MTT S80 대비: 3A 게임 렌더링 성능 15배 향상, 레이트레이싱 성능 50배 향상, AI 연산 성능 64배 향상, VRAM 최대 64GB(RTX 50 시리즈 대응). FlagOS 관련 포인트: 류산에는 통합 태스크 엔진 UNITE가 탑재되며, MUSA 소프트웨어 스택은 이미 vLLM, SGLang, Ollama 등 주요 추론 프레임워크를 커버한다——로컬 대규모 모델 추론은 제품 서사의 일부이다.
- 반기 보고서 기준: 2026 H1 매출 17.36억 위안, 전년 동기 대비 +147.42%(2025년 연간 실적 이미 초과), 연구개발 투자 7.69억 위안(+38.16%); 지배주주 순손실 약 0.12억 위안으로 축소(언론 기준 -1156.31만 위안, 전년 동기 -2.71억 위안), 손익분기점에 근접; MUSA 생태계 개발자 80만 명 돌파(어제 보도됨). 다수 언론은 ‘매출 고성장에도 적자 지속, 콰어(KuaE) + 신규 칩이 수익 기대를 뒷받침할 수 있을까’라는 제목으로 신중한 해석을 내놓았다.
- QvJing Technology 전략적 협력: 09-04 저녁부터(PingWest/Sina/East Money 다수 출처) QvJing Technology와 Moore Threads가 전략적 협력을 체결, “국산 카드로 고품질 컴퓨팅 파워 생산”, 국산 PD(Prefill-Decode 분리) 이기종 솔루션 생산 환경 진입이 보도되었다——추론 측 PD 분리 아키텍처와 Moore Threads GPU의 결합은 가성비 높은 국산 AI Token 공급을 지향한다.
해석: Moore Threads는 모니터링 기간 내 ‘실적 발표회 + 신제품 + 신규 협력’ 삼위일체를 보여주었다: 류산 GPU가 Q4에 예정대로 출시된다면 국산 그래픽 스택 최초로 하드웨어 레이트레이싱 레벨에서 구현되는 것이며, ‘그래픽 + AI + 추론 프레임워크 커버’라는 포지셔닝은 FlagOS의 추론 측 적응(mthreads 백엔드 어제 반나절 19개 연산자, 오늘 FlagDNN mthreads 백엔드 추가 + FlagTree mthreads3.6 수정)과 동일 주파수로 공명한다——MUSA 소프트웨어 스택이 vLLM/SGLang을 커버한다는 표현과 flagos-ai 측 Moore Threads의 긴밀한 통합이 서로를 입증한다. QvJing Technology의 PD 이기종 협력은 추론 아키텍처(분리형 추론)와 국산 카드 결합의 산업적 신호이며, sglang-plugin-FL의 FlagCX KV transfer PD 분리 지원(09-01 병합)과 동일한 기술 트렌드의 양 끝단에 해당한다.
3.3 MetaX: 장부상 흑자 전환 순이익 6.12억, 실질은 8.87억 평가이익에 의존, 비경상이익 제외 시 여전히 4886만 적자, 주요 언론 집중적으로 ‘흑자 전환의 실속’ 분석(09-04)
출처: Sina Technology 《메타X의 흑자 전환 이면, “반전”은 칩 판매가 아니다》, Sina Finance 《2600억 시가총액 메타X, 첫 반기 보고서 제출》, Baike TA Shuo 《메타X 주식 반기 보고서: 이면의 “재무 환술”?》
- 09-04 언론이 메타X(688802.SH) 상장 후 첫 반기 보고서를 집중 해부: H1 매출 13.24억 위안(+44.67%), 지배주주 순이익 6.12억 위안으로 장부상 흑자 전환(전년 동기 1.86억 적자); 그러나 비경상손익 차감 순이익은 여전히 -4,886만 위안(전년 대비 75.83% 적자 축소).
- 흑자 전환 원인 해부(복수 출처 일치): 장부 이익과 비경상손익 차감 간 약 6.6억 위안 차액은 공정가치 변동 이익 8.87억 위안(이익 총액의 105.75%)에서 비롯 — 회사가 유휴 모집 자금으로 현금 관리 및 대외 투자를 했으며, 그중 자회사 “메타X 디지털 인텔리전스”를 통해 보유한 한 상장사 지분 평가 이익이 대부분을 기여; 언론은 “반전은 칩 판매가 아니다”, “재무 환술”이라는 제목으로 실속에 의문을 제기.
- 경영 측면의 밝은 점과 우려 공존: 종합 매출총이익률 약 57.2%(+1.1pct), 직접판매 비중 41.9%에서 64.7%로 급등(+123.6%); 연구개발비 5.25억 위안(매출의 39.65%), 연구개발 인원 747명(70.4%); 영업현금흐름 순액 -12.97억 위안(전년 대비 약 4억 추가 유출), 선급금 21.96억 위안(+163.24%, 파운드리 및 원자재 공급 보장을 위한 전략적 비축); 1~2년 경과 매출채권이 반년 만에 12.5배 확대.
해석: 메타X는 “4대 신흥 강자” 중 첫 장부상 흑자 기업이 되었으나, “6.12억 순이익 vs 비경상손익 차감 -4,886만”의 격차로 언론의 공통된 평가는 “흑자 전환의 완성도 부족, 본업 여전히 적자”에 모아졌다. FlagOS 관점: 메타X의 생태계 측 투자는 재무 보고서 변동에 영향을 받지 않았으며(어제 metax-maca3.8.1.3의 vLLM/sglang 이미지가 모두 등록됨), 현금흐름 압박(-13억 영업현금흐름 + 21.96억 선급금)과 9월 보호예수 해제 임박이 더 주목할 변수 — 직접판매 비중 급등은 지능형 컴퓨팅 센터/통신사 대형 고객 주문 확대를 의미하며, 이는 FlagOS 통합 스택의 “한 번 적응, 다중 칩 납품” 규모화 수요 시나리오와 직접 관련된다.
3.4 일루바타르 코어X: 장부상 흑자 전환 1.06억 전부 Shenghe Jingwei 평가 이익에 의존, 매출총이익률 17.2%로 급락, 본업 적자 확대 (09-04)
출처: Times Finance/Sina 《일루바타르 코어X 흑자 전환 이면: 매출 191% 증가, 7억 초과 지분 투자 평가 이익이 이익을 받침》, Sohu(09-04 전재)
- 일루바타르 코어X(09903.HK) 상장 후 첫 중간 실적이 계속 소화되는 중: H1 매출 약 9.46억 위안(+191.6%, 이미 2025년 연간의 91.4% 달성), 장부상 순이익 1.06억 위안으로 흑자 전환; 그러나 이익은 거의 전부 보유 중인 Shenghe Jingwei(688820.SH, 패키징·테스트, 04월 STAR Market 상장) 지분의 7.56억 위안 공정가치 평가 이익(미실현, 현금 유입 없음, 보호예수 12개월)에서 발생 — 제외 시 본업 실질 적자 약 6.54억 위안으로 전년 동기 6.09억 적자에서 확대.
- 사업 구조: 범용 GPU가 9.16억 위안 기여(96.9%), 그중 추론 칩 “즈카이” 시리즈 매출 전년 대비 651.8% 폭증; 그러나 종합 매출총이익률은 2025 H1의 50.1%에서 17.2%로 급락. 자금 조달: 2026년 누적 조달 107억 홍콩달러 초과(1월 IPO + 100억급 H주 배정 + 자본화 발행 방안), 상장 8개월 미만에 여러 차례 “수혈”.
해석: Iluvatar CoreX(FlagOS 멤버, Iluvatar 백엔드)의 “흑자 전환”은 MetaX와 동일한 구조다——둘 다 GPU 본업이 아니라 지분 투자 평가익에 의존했다(어제 “네 마리 용 중보 실적 분석”에서 두 회사의 장부상 흑자 전환의 공통점을 이미 지적했으며, 이번 모니터링 기간에 언론이 항목별로 분석을 제시했다). FlagOS 관점에서 주목할 두 가지: 추론 칩 Zhikai 매출 +651.8%는 추론 물량 확대가 실제 주력 라인임을 보여준다(build-infra 측에서 vLLM 0.24.0 F 경로 검증 통과, T 경로는 툴체인 결함으로 차단된 기록과 같은 맥락——추론 칩 물량 확대에는 소프트웨어 스택이 따라와야 한다). 매출총이익률이 50.1%에서 17.2%로 붕괴한 것은 가격 경쟁과 원가 압력을 시사하며, 이는 생태계/소프트웨어 투자의 지속성 판단에 영향을 미칠 것이다.
3.5 Cambricon: 11개 팀 대규모 소프트웨어 인재 영입, AI 소프트웨어 생태계 강화(09-02 발표/09-04 보도)
출처: Lianhe Zaobao 《Cambricon, 소프트웨어 인재 대거 채용…AI 소프트웨어 생태계 강화》, Guandian(채용 공고 보도), Sina Finance/China Fund News 《Cambricon, 대형 발표》
- 09-02 Cambricon이 공식 위챗 계정에 채용 공고를 발표하며, 11개 팀을 위해 소프트웨어 인재를 모집할 계획을 밝혔다: 드라이버 팀, 컴파일러 팀, 고성능 통신 팀, 컴퓨팅 라이브러리 팀, 딥러닝 프레임워크 및 생태계 컴포넌트 개발 팀, 추론 및 학습 솔루션 팀 등이며, 목표는 “선도적인 인공지능 소프트웨어 시스템 구축”이다.
- 공고의 논리(Lianhe Zaobao가 09-04에 “NVIDIA CUDA 소프트웨어 생태계 전략을 모방”한 것으로 해석): AI 코드 생성 도구의 보편화가 소프트웨어 개발 방식을 재편하고, 후속 학습(post-training)의 중요성 상승으로 모델 반복 주기가 대폭 단축되면서 시장은 “초대규모, 우수한 생태계 호환성, 높은 안정성”을 갖춘 AI 인프라를 더 필요로 하게 되었다——소프트웨어 스택이 경쟁 장벽의 핵심이 되었다.
- 반기 보고서 기준으로도 입증: Cambricon 2026 H1에 기초 시스템 소프트웨어 플랫폼을 지속 최적화——학습 측은 생태계 구축, 모델 적응 및 성능 최적화, 저정밀도 학습에 집중하고, 추론 측은 대규모 모델 추론, 계산 그래프 컴파일, 연산자 프로그래밍, 가속 라이브러리 및 통신에 집중했다.
해석: Cambricon(FlagOS 멤버, cambricon 백엔드)이 “소프트웨어 생태계”를 하드웨어와 나란한 전략적 높이로 끌어올린 것은 FlagOS 측에서의 활발한 리듬과 부합한다——이번 모니터링 기간에 build-infra는 방금 vLLM 0.24.0 애플리케이션 이미지 검증을 완료했고(#718) sglang 0.5.18용 애플리케이션 환경을 구축했으며(#730), 채용하는 11개 팀 방향(컴파일러/컴퓨팅 라이브러리/통신/프레임워크/추론 학습 솔루션)은 FlagOS 컴포넌트 맵과 거의 일대일로 대응한다. 자체 소프트웨어 스택(연방 자체 개발) + 오픈소스 통합 스택(FlagOS 공동 구축)의 이중 트랙 병행은 현재 선두 중국산 칩 제조사의 소프트웨어 투자의 표준 형태이며, 시가총액 최대 중국산 AI 칩 기업인 Cambricon이 소프트웨어를 강화하는 것은 FlagOS 생태계에 장기적 호재 신호다.
4. 요약
이번 모니터링 기간(09-04 10:18 ~ 09-05 10:18) FlagOS 생태계 주요 흐름:
- FlagTree, Tsingmicro 백엔드 최초 연동, 컴파일러 백엔드 매트릭스 한 자리 더 확장: #1071은 300개 파일 규모로 TLE-DSA 데이터플로 프로그래밍 추상화와 DsaToCore 변환(Triton 3.6 정렬)을 추가했다——Tsingmicro는 통합 컴파일러에 가장 최근 합류한 멤버 단위가 되었으며, 단순한 매니코어 에뮬레이션이 아니라 독립적인 DSA 방언으로 재구성 가능 아키텍처의 네이티브 표현을 유지한다.
- vLLM 0.24.0 딜리버리 매트릭스가 Cambricon과 Iluvatar CoreX로 확장되었고, 처음으로 F/T 경로 분기 기록이 등장: cambricon과 iluvatar-corex4.4.0 검증 통과(#718), 그러나 Iluvatar CoreX T 경로(벤더 Triton 3.1.0)는 apply_top_k_top_p kernel의 uint32/int32 혼합 나눗셈 결함으로 딜리버리 불가로 판정되었다(#722). 수정 방향은 플러그인 계층에서 pytorch sampler 강제 폴백으로 확정——”왜 딜리버리할 수 없는가”가 정밀하게 기록되어 딜리버리 엔지니어링 신뢰도가 상승했다.
- sglang 0.5.18 벤더 이미지 매트릭스 구축 시작: Cambricon과 Enflame의 애플리케이션 환경(deps_app/app env) 구축(#729/#730), Enflame tops1.10.6의 sglang 이미지 tag 등록(#734), 12건의 빌드/검증 수정이 wheel 빌드 이미지화(rsproxy), 네트워크 중복 제거, 준비 상태 게이팅에 집중——sglang 라인이 vLLM 라인의 검증-딜리버리 폐루프를 복제하고 있다.
- Ascend 툴체인이 FlagOS 풀스택에서 CANN 8.5 분리 완료: FlagGems-vllm 측에서 cann850 삭제(#740, 어제의 FlagGems #5970 계승), 동시에 4개의 Ascend 연산자(Mamba 계열 모델 causal_conv1d 패밀리 포함)를 일괄 보충; Hygon fused QKV RMSNorm, Moore Threads fused add rms norm 등 추론 핫패스 최적화도 동시 추진.
- 멤버 단위들이 집단으로 “자본화 고점 + 재무제표 소화기”에 진입: Enflame 발행가 142.18위안/시가총액 약 612억 확정, H1 적자 6.32억으로 확대되었으나 2026/2027 흑자 타임라인과 전삼분기 23~30억 매출 예고 제시; Moore Threads “Lushan” GPU 연내 출시, 국산 하드웨어 광추적 최초 탑재 및 Qujing Technology와 PD 이기종 협력 체결; MetaX/Iluvatar CoreX 둘 다 “평가이익으로 적자 전환, 비경상 항목은 여전히 적자”로 해부되었다(MetaX 비경상 -4886만, Iluvatar CoreX 본업 적자 확대), Cambricon 11팀 대규모 소프트웨어 인재 채용——각 사의 FlagOS 측 소프트웨어 투자와 자본 서사가 동시에 고조되고 있다.
- 뉴스면 컴포넌트 레벨 제로 히트의 고요한 모니터링 기간이 네 번째로 이어졌다; GitHub 측 51건 커밋의 높은 활성도는 엔지니어링 진전과 대외적 존재감이 계속 괴리되고 있음을 보여준다——FlagOS는 여전히 “묵묵히 공사 중”인 시기에 있으며, 공식 다음 공개 행동은 여전히 2.2의 rc 반복이 될 것으로 예상된다(FlagRelease 저장소 움직임을 신호로).
부록: 전체 출처 목록
| 출처 | 검증 결과 |
|---|---|
| GitHub org repos API(52개 저장소) | 11개 저장소가 모니터링 기간 내 푸시(build-infra/FlagGems/FlagTree/FlagGems-vllm/vllm-plugin-FL/FlagDNN/FlagScale/sglang-plugin-FL/flagtree-cpu/docs/release-info); docs/release-info/flagtree-cpu/sglang-plugin-FL의 pushed_at 변경은 기본 브랜치 commits 검증을 거쳐 비기본 브랜치 동작으로 확인됨(기본 브랜치 모니터링 기간 내 0 커밋), 본문에 미포함; 신규 생성 저장소 없음 |
| GitHub commit search | 모니터링 기간 내 커밋 51건 전량 회수(build-infra 19, FlagGems 11, FlagGems-vllm 9, FlagTree 5, vllm-plugin-FL 3, FlagDNN 2, FlagScale 2); 주: commit search가 반환한 committer.date는 Z와 +08:00 두 가지 타임존 형식이 혼재하며, 이번에는 각자의 타임존을 베이징 시간으로 변환한 후 건별로 재검증함 |
| GitHub tags/releases API + annotated tag 객체 검증 | 모니터링 기간 내 신규 tag 없음, 신규 release 없음; vllm-plugin-FL v0.3.0-rc0.post1(08-31 18:03Z), FlagGems-vllm v0.2.0-rc0.post1(08-31 18:02Z) 등 2.2 RC0 검증 기간 tag는 모두 모니터링 기간 이전에 생성됨; 활성 저장소의 최신 release는 모두 06-24(FlagOS 2.1) 또는 그 이전 |
| FlagTree #1071 | 300개 파일, 최초의 실질적 Tsingmicro 연동(org 내 tsingmicro 커밋 160건 중 FlagTree는 이 1건만 실질 병합, 나머지 2건은 문서/무관); TLE DSA 방언 + DsaToCore + tsingmicro 통합 테스트 전량 검증 |
| FlagTree #1096/#1101/#840/#899 | Iluvatar llvm22 v0.6.1 및 전달 프로세스 업데이트, Iluvatar 비 ivcore11 어셈블리 스킵, TLE reshape/named barrier memalloc/gpu.copy mask/barrier arrival, TLE remote node2——건별 검증 |
| build-infra #718-#736(19건) | 건별 검증: cambricon+iluvatar vLLM 0.24.0 검증 통과(#718); iluvatar T 경로 전달 불가——corex Triton 3.1.0이 uint32/int32 혼합 나눗셈 거부, sampler 패치 커버리지 공백(#722, commit body 전문 검증); cambricon 0.20.2 재검증(#724); sglang 0.5.18 애플리케이션 환경에 enflame/cambricon 적용(#729/#730); shim 전체 인덱스 릴리스(#719); 빌드 수정 #720/#721/#723/#725/#731/#732/#733/#735/#736; 상태 매트릭스 및 검증 기록 #726/#727/#728 |
| FlagGems-vllm #731/#728/#729/#730/#740/#738/#735/#697/#739 | 승텅 4개 연산자(add_rms_norm/swiglu/causal_conv1d_update/causal_conv1d_fn) 건별 검증; cann850 삭제; Hygon fused QKV RMSNorm 최적화; mthreads fused add rms norm; fp8/fp4 MQA logits TLE; 순환 임포트 수정 |
| FlagGems 11건 | KMCompiler NVIDIA gru(#6002)/matrix rank(#5942)/dist 연산자 정련(#5958); FlagTune 다중 플랫폼 Mul cost model(#5762); ARM CPU W4A8-G128 linear(#5904) 및 setup.sh aarch64 수정(#5999); 승텅 multinomial 수정(#5980); slice/다항식 수정; backends.json 업데이트 |
| FlagDNN 2건 | mthreads 백엔드 신규 추가(33958a1c25), 승텅 910b4-4 적응 수정(f619b92706) |
| vllm-plugin-FL #439-#441 | FlagGems blacklist 추가, reference fallback 유지, OOT 양자화가 네이티브 MXFP8 후보 상속 |
| FlagScale #1281/#1279 | profiler kernel reports; engram transformer 통합 수정 |
| Google News RSS 중국어 그룹(14개 그룹) | FlagOS/컴포넌트 레벨 24시간 제로 히트(연속 네 번째 모니터링 기간); 히트는 모두 멤버 |
| 단위 재무면: Enflame(공모가 142.18 위안/시가총액 611.87억 위안, 배정번호 20657 재확산, 상반기 6.32억 위안 적자, 로드쇼 수익 전망, Tencent 전략 배정 2.48억 위안/시가총액 126억 위안, 펀드 및 자산관리 자회사 배정), Moore Threads(루산 GPU 하드웨어 레이트레이싱, 매출 +147%, Qujing Technology PD 협력), MetaX(장부상 흑자 전환 6.12억 위안 vs 비경상이익 제외 -4886만 위안, 평가이익 분해), Iluvatar CoreX(평가이익 흑자 전환, 매출총이익률 17.2%, Zhikai +651.8%), Cambricon(11개 팀 소프트웨어 채용); “Zhiyuan Xinjing과 Ipsos 협력”은 원 사이트 검증 결과 상하이 마케팅 테크 기업으로 BAAI와 이름이 충돌하여 제외 | ||
| Google News RSS 영어 그룹(7개 그룹) | FlagOS/BAAI/구성요소 영어 쿼리 유효 히트 없음(Enflame IPO 관련 1건은 영어 재무 종합 기사 전재); HN Algolia 4건 히트 전부 무관 노이즈로 제외 | |
| 재무 매체 원 사이트 검증 | MetaX(Sina Tech 09-01 심층 + Baike TA Shuo 분해), Iluvatar CoreX(Time Finance 08-31 + Eastmoney 09-01), Enflame(Sina Tech/Yunyingshang Finance 09-04), Moore Threads 루산 GPU(Kuaikeji/IT Zhijia 09-04 실적 발표회 보도), Cambricon(Lianhe Zaobao 09-04/Guan Dianwang/China Fund News 09-02) 제목+본문 요약으로 개별 검증 | |
| Zhiyuan 커뮤니티(gnews 히트) | 전부 제3자 콘텐츠 집계(GPT-6 사전 홍보, Meta 오픈소스 모델, Li Feifei Atlas 등)로 Zhiyuan 자체 성과 발표 아님; 모니터링 기간 내 Zhiyuan 공식 공지 없음 |