图片转文字(OCR) 使用指南
使用 WebGPU 加速在浏览器中本地提取韩文文字。
在不上传图片的情况下,从照片、扫描件和截图中提取韩文、英文和数字。
如何使用
打开 OCR 工具。
拖放或粘贴一张 PNG、JPG、WebP 或 GIF 图片。
开始 OCR,等待 Worker 在本地加载并运行模型。
复制提取的文字,或下载 TXT/Markdown。
运行方式
通过 PaddleOCR.js 和 ONNX Runtime Web运行韩文 PP-OCRv5 检测与识别模型。支持时自动使用 WebGPU,否则回退到版本固定的 WASM 后端。
首次运行会下载并缓存约 18MB 的模型资源。识别准确度取决于清晰度、光线和文字布局。
支持范围与问题排查
界面支持五种语言,但当前 OCR 模型主要识别韩语、英语和数字,并未提供专用的中文、日语或西班牙语识别模型。每次可处理一张不超过 10MB 的 PNG、JPG、WebP 或 GIF。超大图片可能被缩小或因处理限制被拒绝。PDF 和 HEIC 请先转换成 PNG/JPG。手写、表格、竖排和装饰字体可能出现遗漏或顺序错误。请摆正图片、裁去无关背景,并将姓名和数字与原图核对。模型加载失败时检查网络限制。没有 WebGPU 时会使用 WASM,速度可能较慢。
隐私与首次加载
所选输入在此浏览器内处理,不会上传到 Aiviko 处理服务器。加载页面、程序库和所需模型仍会产生网络请求。缓存可能被清除,因此不保证完全离线运行。其他网站请求请参阅隐私政策。
相关工具
快速说明与规格
核心流程在此浏览器中运行。开始前请核对支持格式、公开限制以及按需下载的模型大小。
- 输入
- JPG、PNG、WebP和GIF
- 输出
- 文本和Markdown
- 处理位置
- 此设备的浏览器中
- 模型支持的语言
- 韩语和英语
- 单文件上限
- 10 MB
- 每次文件数
- 1
- 按需模型下载
- 18 MB
- 最后核验
界面语言与模型处理语言不同。识别和发音质量因语言而异,请核对结果。 当前模型未将此界面语言列为支持的输入语言。