服務內容
AI晶片適配
提供面向 CPU/GPU/TPU/NPU 的 AI 晶片適配與效能調優服務
AI驅動與執行時
提供硬體指令集級驅動適配與低開銷執行時服務,讓負載在 CPU/GPU/TPU/NPU 上獲得穩定效能。
多種AI框架支援
提供在PyTorch、MindSpore、ONNX、llama.cpp等多種 AI 框架上整合的跨框架適配服務,確保模型在XPU上平穩執行。
多平臺部署與最佳化實現
提供「雲-邊-端」多平臺部署與最佳化實現服務,統一效能調優與資源監控
模型與演算法層最佳化
提供模型與演算法層深度最佳化服務:透過運算元融合、量化剪枝、動態圖編譯及硬體感知排程,降低模型推理延遲,提升訓練效率
AI應用開發
提供端到端 AI 應用開發服務:從場景需求分析、資料治理、模型微調/自研、API/微服務封裝,到雲-邊-端一鍵部署與持續監控,交付可直接落地的生產級應用。