서비스 목록
AI 칩 적응
CPU/GPU/TPU/NPU를 위한 AI 칩 적응 및 성능 튜닝 서비스를 제공합니다
AI 드라이버 및 런타임
하드웨어 명령어 집합 수준의 드라이버 적응과 저오버헤드 런타임 서비스를 제공하여, 워크로드가 CPU/GPU/TPU/NPU에서 안정적인 성능을 발휘하도록 합니다.
다중 AI 프레임워크 지원
PyTorch, MindSpore, ONNX, llama.cpp 등 여러 AI 프레임워크를 통합하는 크로스 프레임워크 적응 서비스를 제공하여 XPU에서 모델이 원활하게 동작하도록 보장합니다.
멀티 플랫폼 배포 및 최적화
「클라우드 — 엣지 — 디바이스」 멀티 플랫폼 배포와 최적화 서비스를 제공하며, 성능 튜닝과 리소스 모니터링을 통합합니다
모델 및 알고리즘 계층 최적화
모델 계층과 알고리즘 계층에서의 심층 최적화 서비스를 제공합니다. 오퍼레이터 융합, 양자화·프루닝, 동적 그래프 컴파일, 하드웨어 인식 스케줄링을 통해 추론 지연을 줄이고 학습 효율을 높입니다
AI 애플리케이션 개발
엔드투엔드 AI 애플리케이션 개발 서비스를 제공합니다. 시나리오 요구사항 분석, 데이터 거버넌스, 모델 파인튜닝·자체 개발, API/마이크로서비스화부터 클라우드 — 엣지 — 디바이스 원클릭 배포와 지속적인 모니터링까지 대응하며, 바로 도입 가능한 프로덕션 품질의 애플리케이션을 제공합니다.