vllm-project/vllm-ascend

【众测任务】hjh2-Qwen3-VL-8B-Instruct 部署验证

Open

#11,751 opened on Jul 9, 2026

View on GitHub
 (1 comment) (0 reactions) (0 assignees)C++ (1,318 forks)github user discovery
help wanted

Repository metrics

Stars
 (2,180 stars)
PR merge metrics
 (Avg merge 4d 5h) (559 merged PRs in 30d)

Description

任务背景

本 Issue 由 vLLM-Ascend 众测任务书自动生成,用于跟踪单个众测任务的执行、交付和问题闭环。

基本信息

  • 分类:vllm
  • 任务名称:hjh2-Qwen3-VL-8B-Instruct
  • 任务类别:资料验证和部署测试
  • 镜像:quay.io/ascend/vllm-ascend:v0.18.0
  • 权重链接https://modelscope.cn/models/Qwen/Qwen3-VL-8B-Instruct
  • 配套信息:Ascend HDK 25.5.0.B078
  • 卡数(Atlas 800I A2):1
  • 内存:1T
  • 硬盘:300G

任务概述

部署Qwen3-VL-8B-Instruct推理服务

核心要求

任务范围:参考资料社区文档Qwen-VL-Dense(Qwen3-VL-2B/4B/8B/32B) — vllm-ascend 获取模型权重 创建容器环境 部署Qwen3-VL-8B-Instruct推理服务 按照社区文档的指导验证服务性能 撰写测试报告,包括资料验证和部署测试结果 资料验证要求: 指标 要求 完整性 文档内容步骤完整 易用性 文档内容易于学习使用 正确性 文档内容正确无误 部署测试要求: 记录每一步的命令和输出,形成完整的部署步骤说明 记录遇到的问题及解决方案,形成FAQ

验收标准

交付件 测试报告 交付标准 测试报告中需包含部署脚本、使用权重、vLLM Benchmark命令、输入输出、性能截图、资料使用感受、全程问题记录 报告内容 说明 使用权重 部署服务所用的模型和权重类别 部署脚本 服务部署的Python或者shell脚本 测试结果 性能验证的输出日志/截图 资料验证 记录资料中的错误,对社区资料的完整性/易用性/正确性打分(满分5分) 问题记录 部署过程中遇到的问题及解决方案

测试方法

使用vLLM Benchmark测试性能Qwen3-VL-8B-Instruct的性能,环境依赖和使用方法参考Qwen-VL-Dense(Qwen3-VL-2B/4B/8B/32B) — vllm-ascend

已知问题和补充说明

测试通过

交付要求

请在 Issue 中同步以下内容:

  • 部署脚本或关键命令
  • 功能/性能/精度验证结果日志或截图
  • 遇到的问题、规避方案与最终结论
  • 如发现社区文档问题,请给出文档链接、问题描述和建议修正内容

Contributor guide