DeepSeekOCR识别结果导出教程
时间:2025-11-18 17:01:00 239浏览 收藏
还在为DeepSeekOCR的识别结果保存发愁吗?本文为你详细解读DeepSeekOCR本地部署后的识别结果导出方法,告别手动复制粘贴!由于DeepSeekOCR默认不自动保存识别结果,我们需要通过Python代码手动实现。文章提供了将识别结果导出为常见格式(如.txt、.json和.csv)的详细步骤和示例代码,并介绍了如何根据原文件名自动命名保存结果文件,方便批量处理。无论你是想提取文本内容还是进行结构化数据分析,都能找到适合你的解决方案。本文尤其适用于在Flask、FastAPI等Web框架中使用DeepSeekOCR的开发者,助你轻松实现文本提取和数据持久化。
答案:DeepSeekOCR本地部署后需手动保存识别结果,可通过Python将结果导出为.txt、.json或.csv文件;示例代码展示遍历识别结果并按原文件名自动命名保存,适用于Flask、FastAPI等环境,实现文本提取或结构化数据持久化。

DeepSeekOCR 本地部署后,识别结果默认不会自动保存到文件,需要手动调用接口或修改代码实现导出。以下是几种常用的导出与保存识别结果的方法,适用于大多数本地部署环境(如 Python Flask、FastAPI 或直接调用 OCR 模型)。
1. 获取原始识别结果
在调用 DeepSeekOCR 的识别接口后,通常会返回一个包含文本框坐标、识别文字和置信度的 JSON 结构。例如:
[
{
"box": [x1, y1, x2, y2, x3, y3, x4, y4],
"text": "识别的文字内容",
"score": 0.98
},
...
]
这是后续导出的基础数据,需先确保能正确获取该结构。
2. 导出为文本文件(.txt)
将识别出的文字按行保存为纯文本文件,适合提取内容阅读或进一步处理。
操作方法:- 遍历识别结果列表,提取每个 item 中的 "text" 字段
- 写入 .txt 文件,每条结果占一行
示例代码(Python):
results = model.ocr(image_path) # 假设这是你的识别调用
with open("output.txt", "w", encoding="utf-8") as f:
for line in results:
f.write(line["text"] + "\n")
3. 导出为结构化文件(JSON / CSV)
保留坐标、文本、置信度等完整信息,便于后期分析或系统对接。
JSON 导出示例:
import json
with open("output.json", "w", encoding="utf-8") as f:
json.dump(results, f, ensure_ascii=False, indent=2)
CSV 导出示例:
import csv
with open("output.csv", "w", newline="", encoding="utf-8") as f:
writer = csv.DictWriter(f, fieldnames=["text", "score", "box"])
writer.writeheader()
for line in results:
writer.writerow({
"text": line["text"],
"score": line["score"],
"box": ",".join(map(str, line["box"]))
})
4. 自动命名与批量保存
处理多张图片时,建议按原文件名生成对应的结果文件。
示例逻辑:- 输入图片名为
image_001.jpg,则输出为image_001.txt或image_001.json - 使用 os.path.splitext 分离文件名和扩展名
import os
img_name = "test.jpg"
base_name = os.path.splitext(img_name)[0]
with open(f"{base_name}_result.txt", "w", encoding="utf-8") as f:
for line in results:
f.write(line["text"] + "\n")
基本上就这些常用方式。根据你的使用场景选择导出格式,文本提取用 .txt,数据分析用 .csv 或 .json 即可。只要在识别后加一段保存逻辑,就能实现结果持久化。
到这里,我们也就讲完了《DeepSeekOCR识别结果导出教程》的内容了。个人认为,基础知识的学习和巩固,是为了更好的将其运用到项目中,欢迎关注golang学习网公众号,带你了解更多关于Python,文件格式,本地部署,DeepSeekOCR,识别结果导出的知识点!
-
501 收藏
-
501 收藏
-
501 收藏
-
501 收藏
-
501 收藏
-
358 收藏
-
311 收藏
-
497 收藏
-
499 收藏
-
394 收藏
-
133 收藏
-
153 收藏
-
117 收藏
-
209 收藏
-
183 收藏
-
499 收藏
-
122 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 立即学习 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 立即学习 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 立即学习 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 立即学习 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 立即学习 485次学习