vllm-project/vllm-ascend
View on GitHub[Contribution] 任务 #20:310P DeepSeek-OCR2 多模态OCR模型适配优化
Open
#10,667 opened on Jun 18, 2026
help wanted
Repository metrics
- Stars
- (2,180 stars)
- PR merge metrics
- (Avg merge 4d 5h) (559 merged PRs in 30d)
Description
在提交新问题之前,请确保您已经在社区中搜索过相关问题,并使用了社区中提供的资源/工具后,仍未找到满意的解决方式。
📚 任务问题描述
任务描述
该任务拆分自 #9079,任务 ID:#20。
适配DeepSeek-OCR2高精度图文识别模型,该模型支持多语言文字识别、手写体识别、复杂版式文档解析;基于vLLM Ascend框架完成图像预处理、视觉编码、文字解码链路适配,兼容Ascend NPU算力特性,优化图像推理算力占用,保障OCR识别精度与推理速度达标。
验收标准
- 在
tests/e2e/models/configs添加完整测试用例。 - 更新模型支持清单文档,编写OCR模型专属适配部署教程。
- 提交
SKILL.md,记录多模态模型适配技巧、算子优化方案及开发最佳实践。
对接人
@jyoung6652
认领状态
待认领
建议的替代/修复方案
请根据任务描述提交实现、测试或文档 PR,并在 PR 中关联本 issue 与 #9079;如实现过程中发现任务边界、使用指导或现有行为存在不合理之处,请同步补充说明和最小复现。
欢迎加入社区,感谢您对社区的贡献 🎉!