首页
AI圈子
HOT
AI快讯
问答
AI工具导航
文章
文章
快讯
AI圈子
AI工具大全
{{userData.name}}
已认证
文章
评论
关注
粉丝
¥
{{role.user_data.money}}
{{role.user_data.credit}}
您已完成今天任务的
私信列表
所有往来私信
财富管理
星球币、积分管理
任务中心
每日任务
NEW
认证服务
申请认证
NEW
我的设置
编辑个人资料
进入后台管理
登录
快速注册
行业动态
实战分享
开源项目
AI工具
AI日报
AI百科
AI情报
AI测评
skills资源
活动讲座
投稿
全部标签
RAG 文档摄取
Pdf-inspector:先给 PDF 做分诊,再决定要不要上 OCR
你大概率默认了一件事:把 PDF 变成干净的 Markdown,就得上 OCR 或者视觉大模型。pdf-inspector 干的第一件事,是把这个前提推翻。它先问一句:这份 PDF 里到底有没有现成文字?哪些页能直接读,哪些页才真需要 OCR? 它的做法很克制。读 PDF 的内部结构,看字体编码、文本操作符、图像覆盖度,几十毫秒就判断出它属于 TextBased、Scanned、ImageBase…
开源项目
1.2k
0
发布文章
发布快讯
创建AI圈子
发表话题
发布问答
发布AI工具大全
提交工单