跳到主要内容

模型支持列表

该版本支持的模型列表如下:

3.1. 模型功能支持列表

表 3.1 模型功能支持列表 模型类型模型名量化编译示例包备注
classificationMobileNetV2
classificationResNet50
Object DetectionYOLOv5s
Object DetectionYOLOv8m
Autonomous DrivingYOLOP
Object DetectionYOLOv12m
Pose EstimationYOLOv8m-pose
SegmentationYOLOv8m-seg
classificationEfficientNet
classificationMobileNetV3X
classificationViT-Base
Object DetectionYOLOv3
EmbeddingBGE
EmbeddingGTE-Qwen2-1.5B
OCRPP-OCRv3
ASRWhisper-medium
classificationYOLOv8m-cls
Object DetectionYOLOv11m
Object DetectionYOLOv10m
Object DetectionYOLOv5m-face
Object DetectionYOLOv7
Object DetectionYOLOv9m
Object DetectionYOLOX
LLMGPT-OSS-20B-A3B
OCRLPRNet
ASRWhisper-large-v3-turbo-0.8B
ASRsensevoicesmall
EmbeddingQwen3-embedding-0.6B/4B/8B
rerankerQwen3-reranker-0.6B/4B/8B
OCRPP-OCRv5
VLAPi0.5X
ASRFireRedASRX
ASRQwen3-ASR
LLMCPM-9g-8BX
LLMQwen3.5-9B/4B/2B9b支持MTP演示,MTP暂不支持用户量化
LLMQwen3.5/3.6-35B-A3B
OCRGLM-OCR
TTSCosyVoice3-0.5B
VLMGrounding-DINOX
ASRGLM-ASR-Nano-2512
Object DetectionYOLOv26m
LLMCoPaw-Flash-9B
LLMGLM4.7-flashX
LLMHunyuan-80B-A13BX
LLMKimi-VL-16B-A3BX
LLMQwen3.5/3.6-27B支持MTP演示,MTP暂不支持用户量化
MLLMQwen3-OmniX
TTSf5-TTSX
VLMGemma4-26B-A4B
ASRcam++
ASRpunc_ct-transformer
Backbonedinov3
diffusionz-image-turbo
LLMQwen3-next-80B-A3B
LLMGPT-OSS-120B-A5BXX
OCRMinerU2.5-Pro-2604-1.2B
TTSQwen3-TTS-0.6B/1.7B1.7b预计v1.5.0支持
VLMGemma4-e2B/e4B
VLMGemma4-31B
OCRppOCR-VLX
Embeddingchinese-clipX

3.2. 模型推理能力适配表

说明:

  • 表中 “支持1芯”、“支持2芯”、 “支持4芯” 表示软件层面适配的算力规格,即后摩M50芯片数,而非硬件产品物理固有的芯片搭载数量。

  • :表示支持。

  • X :表示不支持。

  • :表示当前版本未完成适配验证。

表 3.2 模型推理能力适配表 模型类型模型名支持1芯支持2芯支持4芯支持多batch
classificationMobileNetV2
classificationResNet50
Object DetectionYOLOv5s
Object DetectionYOLOv8m
Autonomous DrivingYOLOP
Object DetectionYOLOv12m
Pose EstimationYOLOv8m-pose
SegmentationYOLOv8m-seg
classificationEfficientNet
classificationMobileNetV3
classificationViT-Base
Object DetectionYOLOv3
EmbeddingBGE
EmbeddingGTE-Qwen2-1.5B
OCRPP-OCRv3
ASRWhisper-medium
classificationYOLOv8m-cls
Object DetectionYOLOv11m
Object DetectionYOLOv10m
Object DetectionYOLOv5m-face
Object DetectionYOLOv7
Object DetectionYOLOv9m
Object DetectionYOLOX
LLMGPT-OSS-20B-A3B
OCRLPRNet
ASRWhisper-large-v3-turbo-0.8B
ASRsensevoicesmall
EmbeddingQwen3-embedding-0.6B/4B/8B
rerankerQwen3-reranker-0.6B/4B/8B
OCRPP-OCRv5
VLAPi0.5
ASRFireRedASR
ASRQwen3-ASR
LLMCPM-9g-8B
LLMQwen3.5-9B/4B/2BX
LLMQwen3.5/3.6-35B-A3BX
OCRGLM-OCR
TTSCosyVoice3-0.5B
VLMGrounding-DINO
ASRGLM-ASR-Nano-2512
Object DetectionYOLOv26m
LLMCoPaw-Flash-9B
LLMGLM4.7-flash
LLMHunyuan-80B-A13BX
LLMKimi-VL-16B-A3B
LLMQwen3.5/3.6-27BX
MLLMQwen3-Omni
TTSf5-TTS
VLMGemma4-26B-A4B
ASRcam++
ASRpunc_ct-transformer
Backbonedinov3
diffusionz-image-turbo
LLMQwen3-next-80B-A3BX
LLMGPT-OSS-120B-A5BX
OCRMinerU2.5-Pro-2604-1.2B
TTSQwen3-TTS-0.6B/1.7B
VLMGemma4-e2B/e4B
VLMGemma4-31BX
OCRppOCR-VL
Embeddingchinese-clip