拍照转文字,省掉整段重录
会议白板、纸质报销单、书本某一页,拍完直接出文本。原来对着屏幕敲十分钟的内容,现在校对两分钟。
把手机摄像头变成一台随身扫描仪:对着纸质文件、屏幕、路牌、手写便签拍一张,几秒内拿到可以复制、可以编辑、可以导出的文字。
不列虚的。下面六件事,是用户拿它做得最多、也最容易立刻感受到差别的地方。每条都写清楚它解决的是什么具体麻烦。
会议白板、纸质报销单、书本某一页,拍完直接出文本。原来对着屏幕敲十分钟的内容,现在校对两分钟。
账单、排班表、成绩单拍下来,输出的是带分隔的表格文本,而不是糊成一团的一长串,粘贴进 Excel 少返工。
相册里一次勾选几十张图,排队识别后统一导出。整理培训手册、扫描旧档案这类活儿,效率差的是数量级。
身份证、银行卡、票据这类不方便外传的图片,可以切到离线模式处理,图片不出设备,识别完还能顺手打码遮挡。
识别出来的文字带原文对照,改错字很方便。导出支持 TXT、PDF、DOCX,也能一键复制进聊天框或笔记软件。
识别过的内容按时间归档,支持按关键词检索。上周拍的发票找不到了?搜一下抬头就能翻出来。
拿一个几乎人人都会遇到的场景来演示——把纸质名片上的信息整理进通讯录。看输入、看输出,比看十句「识别准确」有用。
拍摄环境是办公室下午的顶灯,名片放在木桌上,右上角有一点反光。这是最普通、也最容易出问题的拍摄条件。
【名片原图内容】 杭州云栖智能科技有限公司 林 一 舟 产品运营总监 手机:138 **** 6721 邮箱:linyz@yunqi-tech.example 地址:杭州市西湖区文三路 XX 号 12 楼
公司:杭州云栖智能科技有限公司 姓名:林一舟 职位:产品运营总监 手机:138 **** 6721 邮箱:linyz@yunqi-tech.example 地址:杭州市西湖区文三路 XX 号 12 楼
关键在于:它没有把六行信息糊成一段,而是按「字段名 + 值」拆开了。姓名里那个被空格分开的「林 一 舟」被自动合并,手机号中间的空格也去掉了——这两处是最容易让复制粘贴出错的地方。整个识别过程约 3 秒,人工核对花了不到 20 秒,比手动录入快了差不多一个量级。
上面的公司名、邮箱域名与号码均为演示用示例,非真实联系信息;实际识别效果会随光线、角度、字体而波动,遇到低质图片建议重拍一次再识别。
整体走的是浅色、少干扰的路子,主功能都在一屏之内点得到。下面按使用顺序排。
挑三类最典型的用户说说。每类都写清楚「原来卡在哪」和「现在省下了什么」,不谈空泛的「提升效率」。
App 只是入口。真正想搞明白文字识别这件事,下面几条主线比装个软件更值得花时间。
从「一张图是怎么变成一行字的」讲起,把检测、切分、识别、后处理这条链路拆开说。适合刚接触这个领域、被各种术语绕晕的人。
8 个专题
讲清楚不同方案的取舍:通用模型和专用模型差在哪、为什么手写体总是更难、清晰度与倾斜角度对结果的影响有多大。
6 个专题
按行业梳理实际用法:票据归档、证件录入、图书摘录、无障碍阅读、跨境资料翻译前的文本提取,各有各的坑。
9 个专题
不同工具适合不同活儿:什么时候该用手机 App 随手拍,什么时候必须上桌面端做批量,怎么判断一个工具够不够用。
5 个专题
不谈感觉,只列具体环节的变化。这也是我们判断一个工具值不值得留的标准。
两个平台分开写。按顺序走一遍,基本不会卡住。装完第一次打开时的那几步也一并说了。
下面这些是版本与运行层面的公开信息,随版本更新同步调整。
我们不在页面上展示无法核实的下载量、评分或用户规模数字。这类数据一旦写出来就要能被验证,做不到就不写——这是本站一贯的编辑取舍。
围绕文字识别持续补充的子主题,按时间倒序排列。有新的就往上加。
下面这些是用户问得最多的。答案尽量给具体的判断依据,而不是一句「支持」了事。
核心的拍照识别、批量导入、结果导出与历史记录都是免费的,没有次数限制。部分进阶能力(比如更高精度的专用模型、更大批量的并发处理)会以可选项的形式提供,用不用都不影响基础功能。页面上写的「免费下载」指的是下载安装本身不收费。
Android 端要求 8.0 及以上,iOS 端要求 14 及以上。低于这两个版本的设备无法安装,这不是策略限制,而是部分图像处理能力依赖较新的系统接口。如果不确定自己的设备版本,可以在系统设置里的「关于手机」或「通用 — 关于本机」中查看。
普通的拍照识别会因为要调用更强的模型而联网处理;证件、票据这类敏感内容,建议在设置里打开「离线识别」,图片全程留在设备本地,不上传。无论哪种模式,我们都不会把用户图片用于其他用途。这是产品设计上的取舍,不是营销话术——你可以自己切换模式验证。
Android 端可以在 App 内的「设置 — 检查更新」里手动触发,也可以在回到本页重新下载安装包覆盖安装,历史记录不会丢。iOS 端跟随系统商店的更新提示即可。我们建议保持更新,识别模型和词表的改进基本都是随版本下发的。
安装包约 42 MB,安装完成后实际占用通常在 90~150 MB 之间,主要差在离线模型是否启用。历史记录里的原图是占空间的大头,可以在设置里开启「识别后自动压缩原图」或定期清理,识别出的文本本身占不了多少。
App 内「设置 — 意见反馈」可以直接提交,附带截图会更容易定位问题。也可以发邮件到页面底部的反馈邮箱。我们会看每一条,但没法承诺每条都单独回复;如果是识别错误,把原图和识别结果一起发过来,处理起来会快很多。
使用问题、功能建议、内容纠错,都可以直接找我们。
如果是识别出错,把原图和识别结果一起发过来,我们处理起来会快得多。想直接上手的话,回到页面顶部点下载按钮就行。