vllm-project/vllm-ascend

[Contribution] 任务 #20:310P DeepSeek-OCR2 多模态OCR模型适配优化

Open

#10,667 opened on Jun 18, 2026

View on GitHub
 (2 comments) (0 reactions) (0 assignees)C++ (1,318 forks)github user discovery
help wanted

Repository metrics

Stars
 (2,180 stars)
PR merge metrics
 (Avg merge 4d 5h) (559 merged PRs in 30d)

Description

在提交新问题之前,请确保您已经在社区中搜索过相关问题,并使用了社区中提供的资源/工具后,仍未找到满意的解决方式。

📚 任务问题描述

任务描述

该任务拆分自 #9079,任务 ID:#20。

适配DeepSeek-OCR2高精度图文识别模型,该模型支持多语言文字识别、手写体识别、复杂版式文档解析;基于vLLM Ascend框架完成图像预处理、视觉编码、文字解码链路适配,兼容Ascend NPU算力特性,优化图像推理算力占用,保障OCR识别精度与推理速度达标。

验收标准

  1. tests/e2e/models/configs 添加完整测试用例。
  2. 更新模型支持清单文档,编写OCR模型专属适配部署教程。
  3. 提交 SKILL.md,记录多模态模型适配技巧、算子优化方案及开发最佳实践。

对接人

@jyoung6652

认领状态

待认领

建议的替代/修复方案

请根据任务描述提交实现、测试或文档 PR,并在 PR 中关联本 issue 与 #9079;如实现过程中发现任务边界、使用指导或现有行为存在不合理之处,请同步补充说明和最小复现。

欢迎加入社区,感谢您对社区的贡献 🎉!

Contributor guide