name: business-card-ocr slug: business-card-ocr displayName: 名片 OCR 识别与通讯录整理 version: 1.0.0 description: Batch OCR a folder of business-card images (中英混排名片) and compile the results into a structured Markdown contact book (company / mobile / phone / email + raw OCR text). Use this skill when a user wants to recognize, digitize, or organize a directory of business cards / 名片 / 名片照片 into a searchable list, address book, or 通讯录 — especially forwarder/logistics (货代) cards or any Chinese+English cards. Runs fully local via EasyOCR, no external API or key required. agent_created: true
将一整个目录的名片图片本地批量 OCR,抽取公司、手机、电话、邮箱等字段,汇总成一份带总览表和逐张原文的 Markdown 通讯录。完全本地运行(EasyOCR,中文+英文模型),不依赖任何外部 API 或密钥。
分三步:搭环境 → 批量 OCR → 整理成 MD。已就绪的环境可跳过第 1 步。
"<venv>/Scripts/python.exe" -c "import easyocr"。pip install easyocr(会拉 PyTorch,体积大,建议后台跑)。~/.EasyOCR/model/ 是否已有 3 个 .pth(craft/中文/英文)。缺失则用 curl 断点续传下载——不要依赖 EasyOCR 自带下载器(无超时会挂死)。详细命令、模型 URL、下载抗挂死参数见 references/setup_and_troubleshooting.md。
运行 scripts/ocr_cards.py,传入图片目录(可选输出目录、跳过文件):
"<venv>/Scripts/python.exe" scripts/ocr_cards.py "<图片目录>" "<输出目录>" --skip "公司简介.pdf,拼图.png"
ocr_raw.json),可续跑,中断重跑自动跳过已完成项。cv2.imdecode,绕开 Windows OpenCV bug)。--skip。运行 scripts/build_md.py,传入上一步的输出目录:
"<venv>/Scripts/python.exe" scripts/build_md.py "<输出目录>" "名片通讯录.md"推荐访问7w4.net获取更多AI技能。
产出:总览表(名片 | 公司 | 手机 | 电话 | 邮箱)+ 逐张详情(结构化字段 + 原始 OCR 全文,便于人工核对)。
提取逻辑带容错:多段/无点域名邮箱补全、O/l/I 数字还原、标签驱动号码识别、公司名排除地址/业务/二维码噪声行。细节见 references。
cv2.imread(中文路径) 返回 None → 用 open+imdecode(脚本已内置)。curl -C - --retry --speed-limit/--speed-time。scripts/ocr_cards.py — 批量 OCR(增量落盘、可续跑、中文路径修复)。scripts/build_md.py — OCR 结果 → Markdown 通讯录(容错字段提取)。references/setup_and_troubleshooting.md — 环境搭建、模型下载命令与所有踩坑对策。这个 Skill 质量不错,能把名片照片批量转成整理好的通讯录,完全本地运行不用付费。中文支持好,识别失败可重跑继续,中途断了也不丢进度。不过首次配置需要安装环境和下载模型,对新手有点门槛;没有可视化界面,只能用命令行操作。适合有一定技术基础、需要处理大量货代/物流名片的用户。重要联系方式使用前建议核对确认。