← 图像工具

图片 OCR

当前图片上传图片以解锁OCR设置

把照片和截图中的文字提取出来

从截图、拍摄的页面或扫描图片中提取可复制的文字,导出TXT或Markdown。识别后请对照原图核对姓名、金额和代码;选择具体语言会切换识别服务。

费用: 提供免费选项。Pro选项或超出免费额度的使用可能需要积分,详见下方指南。

图片转文字的操作步骤

  1. 上传一张图片

    把JPG、PNG、WebP、HEIC、HEIF、AVIF、BMP或TIFF拖到预览区域,或点击上传图片以提取文字。每张最多200 MiB;其他图片工具中的上传和结果可从Files选取。

  2. 先选TXT或Markdown

    在OCR面板选择TXT获取纯文本,或选Markdown保留标题、列表和表格标记。格式会在识别时应用,请在开始前选好。

  3. 通常保留自动识别

    语言提示默认是Auto-detect,即自动检测。一般可先用它;若首轮把字符认错,再指定语言。指定语言也会把图片交给另一个识别引擎。

  4. 提取文字

    点击Extract text。原图仍留在预览区域,识别结果显示在下方的提取的文本面板,并列出字符数。

  5. 核对后复制或下载

    使用前先核对姓名、金额、日期和编号。点击复制写入剪贴板,或点下载保存UTF-8文件,文件名为ocr-result.txt或ocr-result.md。

文本格式与语言提示怎样选择

OCR面板只有这两项设置,都不会修改原图。

TXT
默认选项,返回不带Markdown排版的纯文本。识别出的表格按行输出,单元格以制表符分隔,粘贴到电子表格时便于分列。原文中的#hashtags、__init__或代码截图里的<div>仍作为文字保留。适合信件、收据、聊天截图和摘录。
Markdown
用标记保留结构,包括以#表示的标题、项目列表、强调和表格。适合需要保留文档层级或表格结构的内容。请用支持Markdown渲染的编辑器打开.md,普通文本编辑器显示的是原始标记。
语言提示:Auto-detect
使用Z.ai的专用GLM-OCR模型,由它自动识别语言和文字系统。该接口不接收手动语言提示。
语言提示:指定语言
可选English(英语)、German(德语)、Spanish(西班牙语)、French(法语)、Italian(意大利语)、Portuguese(葡萄牙语)、Russian(俄语)、Japanese(日语)、Chinese(中文)、Arabic(阿拉伯语)和Hindi(印地语)。图片会交给Google Gemini,语言、文字系统和阅读方向作为识别提示,用于区分中日共用汉字等歧义字符,或理解阿拉伯语从右到左的顺序。服务要求保留其他语言原文,不翻译、概括或改写。

哪家服务读取图片

OCR在服务器上处理,浏览器不负责识别。服务器会将完整图片交给外部AI服务:Auto-detect使用Z.ai GLM-OCR,指定语言使用Google Gemini API。若Gemini受到调用频率或配额限制,同一请求会通过OpenRouter调用Gemini模型。处理护照、银行账单等资料前,应考虑这一数据传输。

自动检测与指定语言使用不同引擎,切换它们相当于获取另一份识别结果。某个引擎认错的一行,另一个可能读对;每次重新识别都会单独计入用量。

让原图更适合识别

文字的清晰度和拍摄角度会影响识别结果。

裁掉不需要的文字

菜单、水印、价格牌和背景招牌也可能被识别。先用裁剪图片保留所需区域,让输出集中在目标文字上。

把侧转的页面摆正

方向正确、水平排列的文字通常更容易读取。页面照片如果侧转或倾斜,可先用旋转图片调整,再提取文字。

优先使用屏幕截图

截图中的文字通常清楚且亮度均匀。用手机拍显示器会带入反光、摩尔纹和透视变形,更容易把字母或数字认错。

多页扫描件用PDF OCR

此工具每次读取一张图片。扫描件已经保存为PDF时,可用PDF文字识别在一个任务中处理全部页面或指定页码。

支持格式与用量规则

输入格式
JPG、PNG、WebP、HEIC、HEIF、AVIF、BMP、TIFF。
输出方式
UTF-8纯文本(.txt)或Markdown(.md),也可复制到剪贴板。
上传大小上限
本站每张200 MiB,即209,715,200字节。
每次的文件数量
一张图片。
处理方式
服务器处理,由Z.ai GLM-OCR或Google Gemini识别。任务最长30分钟,不自动重新运行。
使用额度
每张图片计一次。免费额度用尽后,访客需登录,之后每张使用1积分;再次识别也另计一次。
水印
不添加水印。
文件保存
本站保存的上传文件和结果文件:访客48小时后自动删除,免费账号30天后删除,付费方案可保存更久。

常见问题

图片转文字会翻译内容吗?

不会。结果保留图片中的原文。语言提示只帮助识别有歧义的字符,同一张图片上的其他语言也按原文保留。

为什么字母或数字识别错误?

字太小、模糊、对比度低、阴影或倾斜都可能影响结果。0和O、1和l、rn和m容易混淆,编号和金额尤其要核对。换更清楚的图片、裁出文字,或切换语言提示设置,用另一识别引擎再读一次。

应该选TXT还是Markdown?

粘贴到邮件、表单或电子表格时选TXT,得到纯文本和以制表符分列的表格行。需要把标题、列表和表格带入笔记软件或知识库时,选Markdown保留这些结构。

图片会发送给第三方吗?

会。Auto-detect会发送给Z.ai GLM-OCR,指定语言会发送给Google Gemini;Gemini受调用限制时通过OpenRouter处理。本站保存的上传和结果文件,访客48小时、免费账号30天后自动删除;这些时间不代表外部服务的数据保留期限。

识别失败后怎样重新尝试?

没有可读文字时,任务会提示未提取到文字。先确认文字够清楚、字号足够大,再用裁剪图片去掉无关区域后重新运行。