Skip to content

fix(ocr): render routed PDF pages without pixel input - #1

Merged
aleSheng merged 1 commit into
yzlabai:mainfrom
Zapachu:main
Jul 29, 2026
Merged

aleSheng merged 1 commit into
yzlabai:mainfrom
Zapachu:main

Conversation

@Zapachu

@Zapachu Zapachu commented Jul 29, 2026

Copy link
Copy Markdown

部分 PDF 页面虽然视觉内容完整,但内部不存在可直接提取的整页图片,例如使用矢量路径绘制文字轮廓的页面。此类页面会被正确路由到 OCR,但原有流程因缺少可用像素输入而无法识别内容。

改动

  • 保留嵌入图片像素的 OCR 快路径。
  • 对缺少可用像素的 OCR 路由页,按需渲染最终页面外观后执行 OCR。
  • 仅处理质量路由选中的页面,包含机器可读文本的页面保持原路径。
  • 统一 CLI、REST 和 MCP 的 PDF OCR 行为。
  • 更新能力说明、公开接口描述和开发记录。

兼容性

不修改现有 API、IR Schema 或确定性解析契约。

@aleSheng
aleSheng merged commit f7a3479 into yzlabai:main Jul 29, 2026
5 checks passed
Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

2 participants