diff --git a/docs/platforms/ascend_npu_support_models.md b/docs/platforms/ascend_npu_support_models.md index 2e570b9ae..a30b6d21a 100644 --- a/docs/platforms/ascend_npu_support_models.md +++ b/docs/platforms/ascend_npu_support_models.md @@ -9,17 +9,17 @@ You are welcome to enable various models based on your business requirements. | Models | Model Family | A2 Supported | A3 Supported | |--------------------------------------------|--------------------------------|:----------------------------------------:|:----------------------------------------:| | DeepSeek V3/V3.1 | DeepSeek | **** | **** | -| vllm-ascend/DeepSeek-V3.2-Exp-W8A8 | DeepSeek | **** | **** | -| vllm-ascend/DeepSeek-R1-0528-W8A8 | DeepSeek | **** | **** | -| vllm-ascend/DeepSeek-V2-Lite-W8A8 | DeepSeek | **** | **** | +| DeepSeek-V3.2-Exp-W8A8 | DeepSeek | **** | **** | +| DeepSeek-R1-0528-W8A8 | DeepSeek | **** | **** | +| DeepSeek-V2-Lite-W8A8 | DeepSeek | **** | **** | | Qwen/Qwen3-30B-A3B-Instruct-2507 | Qwen | **** | **** | | Qwen/Qwen3-32B | Qwen | **** | **** | | Qwen/Qwen3-0.6B | Qwen | **** | **** | -| vllm-ascend/Qwen3-235B-A22B-W8A8 | Qwen | **** | **** | +| Qwen3-235B-A22B-W8A8 | Qwen | **** | **** | | Qwen/Qwen3-Next-80B-A3B-Instruct | Qwen | **** | **** | | Qwen3-Coder-480B-A35B-Instruct-w8a8-QuaRot | Qwen | **** | **** | | Qwen/Qwen2.5-7B-Instruct | Qwen | **** | **** | -| vllm-ascend/QWQ-32B-W8A8 | Qwen | **** | **** | +| QWQ-32B-W8A8 | Qwen | **** | **** | | meta-llama/Llama-4-Scout-17B-16E-Instruct | Llama | **** | **** | | AI-ModelScope/Llama-3.1-8B-Instruct | Llama | **** | **** | | LLM-Research/llama-2-7b | Llama | **** | **** |