跳转到主要内容

功能介绍

DeepSeek-OCR 聚焦于文档识别及图像转文本场景,探索视觉与文本压缩的极限。该模型可将长文本渲染为高压缩比图像,在 10 倍无损压缩下能实现 97% 的 OCR 准确率,即使压缩到 20 倍也能保持约 60% 的准确率。需要注意的是,该模型仅支持单轮独立识别任务,暂不支持多轮对话,每次仅能上传一张图像,需使用预设提示词调用以获得最佳效果

推荐的预设提示词

调用示例

以使用 <|grounding|>OCR this image. 预设提示词完成图像文本识别为例
示例图片
OCR 图片
示例输出
最后修改于 2026年1月12日