保留排版结构的批量图像转 Word 工具
Python
PaddleOCR
python-docx
OpenCV
正在基于该需求推演落地方案…
需求痛点(公开)
现有的通用 OCR 工具往往只能导出零散的纯文本或错乱的排版区块,丢失了标题层级、粗体强调以及列表符号等关键格式,导致用户仍需在 Microsoft Word 中耗费大量工时进行二次排版与校对。
切入方向(公开)
构建一套结合版面分析与文档生成的自动化转录流程,精准识别图片中的文本段落、字形加粗及层级列表,并利用 python-docx 等工具直接生成保留原始排版骨架的结构化 Word 电子文档。
下方分析是尚待编辑复核的 AI 假设,分数与投入判断不代表已验证的推荐。
发布预算不代表已成交或付款;任务数量不等于独立买家数量,也不能证明订阅意愿。小样本仅作为初步线索。
原始需求溯源 · 3 条
"I have a batch of clear photos—no more than ten pages in total—of English-language handwritten notes. I will send the images to you in high-…"
"I have 200 pages of handwritten material that I need accurately typed into a single Microsoft Word document. You will receive clear scans of each…"
"I have a set of English-language photos—between 11 and 50 in total—that I need accurately transcribed into an editable Microsoft Word document. Every…"
仅展示任务摘要与外链,不转载原文全文;个人信息已脱敏。数据来源已登记,可溯源。
💬 社区讨论