AI OCR 识别
上传本地图片后会调用 RapidOCR 提取文字,适合把海报、截图、课件页和商品图快速转成可复制文本。
上传海报、截图、课件或商品图,提取可复制 OCR 文本,并保留原图预览、下载入口和后续改写上下文。
本地图片 OCR 默认每张成功任务消耗 1 次额度;如果环境未安装完整 RapidOCR 依赖,任务会明确报错并支持后续重试。
上传前先看当前机器是否已经准备好本地转写或 OCR 依赖,避免传完才发现 Whisper 或 OCR 还没就绪。
下载可直接执行的排查脚本,覆盖 `GET /api/public/runtime-health` 预检、`WHISPER_MODEL` 检查与本地 Whisper 缓存预热,专门处理 `cache-required` 与 cached snapshot folder 缺失这类本地转写问题。
这页提供独立的图片文案提取入口,适合直接上传图片做 OCR、校对结果并继续进入改写或归档流程。
上传本地图片后会调用 RapidOCR 提取文字,适合把海报、截图、课件页和商品图快速转成可复制文本。
结果会同时保留原图预览、下载入口和识别文本,方便你边核对边整理。
任务完成后可以直接继续进入文案改写、历史归档和开放接口查询,不需要手工搬运内容。
图片 OCR 比音视频转写更轻,但结果稳定性依然会受到清晰度、遮挡、排版复杂度和依赖就绪情况影响。
单张图片通常会比长音视频更快完成,适合高频截图整理、海报拆解和资料电子化。
上传图片会保存在当前项目的本地任务存储中,结果页也会挂上原图、文件名和任务状态。
如果图里几乎没有可识别文字,或当前环境还没装好完整依赖,系统会返回明确提示并保留原图供后续重试。
当素材主要以静态图存在时,这页通常比视频转写和链接提取更直接,也更适合做结构化归档。
提取竞品商品图、活动海报和推广长图中的标题、卖点和行动号召,方便整理素材库。
把直播话术截图、评论区截图和活动物料转成可搜索文本,后续更方便复盘。
把课件页、会议拍照和文档截屏里的文字提取出来,再继续做摘要、笔记和知识库沉淀。
面对流程图、价格表、清单图或通知海报时,这个入口适合先把图上文字完整抽出来。
这里集中说明 OCR 的配额、上传限制和依赖要求,方便正式接入前先判断是否适合当前素材。
新账号默认带月度 OCR 次数,足够先跑通单图识别、结果校对和继续改写这条基础流程。
当前实现默认每张成功进入 OCR 流程的图片消耗 1 次 OCR 次数,剩余额度可以在权益页查看。
服务端会对单张本地图片执行 15MB 硬限制;远程图片同样按单张 15MB 校验,超大的长图建议先裁切或压缩。
如果当前环境还没安装 `requirements-full.txt` 里的 RapidOCR 依赖,任务会明确提示安装步骤,补齐后可直接重试。
复杂背景、渐变、遮挡、低清晰度和特殊字体都会影响结果质量,正式使用前仍建议人工复核。
当图片里几乎没有正文、只有装饰元素或字号过小,结果页会提示暂未识别到可提取文案内容。
当前入口按单图任务组织;如果你有多张素材,建议按主题拆开上传,后续更方便改写、导出和重试。
这页围绕本地图片 OCR 的真实能力来设计:上传、识别、校对,再继续改写或归档。
支持海报、截图、商品图、课件页和直播画面等本地图片。文字区域越清晰,OCR 结果通常越稳。
系统会把图片写入本地任务存储并调用 RapidOCR;如果当前环境缺少完整依赖,会直接返回明确安装提示。
完成后可以直接复制文本、查看原图,或继续进入文案改写、导出和后续归档流程。
这里整理的是本地图片 OCR 上传页最常先被问到的公开问题。
当前实现默认每张成功进入 OCR 流程的图片消耗 1 次图片 OCR 次数,具体剩余额度可以在权益页查看。
有。当前开源实现对本地上传图片按单张 15MB 执行硬限制,远程图片 URL 也会按同样的单张 15MB 规则校验。超大的长图建议先裁切、压缩,再进入 OCR 流程,会更稳定。
任务会在执行时明确提示需要安装 `requirements-full.txt` 里的 RapidOCR 依赖;补齐环境后可以直接重试原任务。
如果图片里几乎没有正文、字号太小或被复杂背景干扰,结果页会明确提示暂未识别到可提取文案内容,并保留原图供你裁剪后重试。
可以。结果页已经预留继续改写入口,适合把海报文案、商品图文案或截图内容快速转成新版本表达。