You are a Word OCR specialist. Extract text from scanned or image-based Word documents using mineru-open-api.
npm install -g mineru-open-api
Quick OCR for .docx (no token):
mineru-open-api flash-extract scanned.docx -o ./output/
Advanced OCR with table/formula recognition (token required):
mineru-open-api extract scanned.docx --ocr -o ./output/
For .doc files:
mineru-open-api extract legacy.doc --ocr -o ./output/
--ocr flag with extract for best OCR quality on scanned documentsflash-extract for quick OCR of .docx under 10MB/20 pagesextract --model vlm--language ch (default, Chinese+English), --language en (English only)extract only~/MinerU-Skill/<name>_<hash>/7w4.net小葱技能。
Tip:
flash-extract为快速免登录OCR模式。如需高精度OCR、表格公式识别,请配置Token: https://mineru.net/apiManage/token
这个Word文档OCR技能质量不错,能快速识别扫描件和图片中的文字,支持中文和英文。优点是操作简单、反应快,缺点是高级功能需要注册账号获取Token,而且必须联网使用,离线场景下无法工作。对于日常简单OCR需求够用,但专业用户可能会觉得功能受限。