サービス一覧
AI チップの適応
CPU/GPU/TPU/NPU 向けの AI チップ適応とパフォーマンスチューニングサービスを提供します
AI ドライバとランタイム
ハードウェア命令セットレベルでのドライバ適応と低オーバーヘッドのランタイムサービスを提供し、CPU/GPU/TPU/NPU 上でワークロードが安定したパフォーマンスを発揮できるようにします。
複数 AI フレームワーク対応
PyTorch、MindSpore、ONNX、llama.cpp など複数の AI フレームワークを統合するクロスフレームワーク適応サービスを提供し、XPU 上でモデルが円滑に動作することを保証します。
マルチプラットフォーム展開と最適化
「クラウド — エッジ — デバイス」のマルチプラットフォーム展開と最適化を提供し、パフォーマンスチューニングとリソース監視を統合します
モデル・アルゴリズム層の最適化
モデル層とアルゴリズム層での深層最適化サービスを提供します。オペレータ融合、量子化・プルーニング、動的グラフコンパイル、ハードウェア認識スケジューリングにより、推論レイテンシを削減し学習効率を向上させます
AI アプリケーション開発
エンドツーエンドの AI アプリケーション開発サービスを提供します。シナリオ要件の分析、データガバナンス、モデルのファインチューニング/独自開発、API・マイクロサービス化から、クラウド — エッジ — デバイスへのワンクリック展開と継続的な監視まで対応し、そのまま導入可能な本番品質のアプリケーションを提供します。