游乐游手机版
首页/AI热点日报/热点详情

通义听悟图片内容识别操作步骤详解教程

类型:热点整理2026-07-20
通义听悟网页端支持图片内容识别,可自动增强图像并按语义分段。需注册及实名认证。上传PNG、JPEG、JPG格式图片(≤5MB,分辨率不低于300×300像素),识别结果按中英文、数字公式分段,支持复制全文或导出TXT。

课堂板书拍下来、模糊的课件截图攒了一堆、中英文混排的图文资料急需转成文字……这些场景,通义听悟网页端能直接搞定。它自动增强图像,按语义分段识别,不用你手动调参数,结果出来直接复制就能用。注册和实名认证是必须的,否则没法调用图片识别模块。

打开通义听悟网页版并登录

浏览器访问 https://tingwu.aliyun.com/,点击右上角「注册」。用手机号收个信息验证码,设置密码、勾选协议,完成注册。系统会自动跳转到登录页,输入账号密码就能进首页。

注意:必须完成实名认证。 否则图片识别功能用不了。首次登录后系统会弹出提示框,按指引上传身份证正反面照片,再做人脸识别验证,通过后就能正常使用。

上传图片启动识别

方法一:拖拽上传(最快)
在首页找到「图片文字提取」功能入口,直接把本地PNG、JPEG、JPG格式的图片(≤5MB)拖进上传区域,松手就开始处理。

方法二:点击上传
点击上传区域内的「选择文件」按钮,在弹出窗口找到目标图片,选中后点击「打开」,系统自动加载并进入识别队列。

需要留意的是:如果图片是手机实拍的,存在明显倾斜或反光,识别前会先触发AI自动矫正。但要是原图分辨率低于300×300像素,系统会提示“建议更换更清晰图片”,这时候就得换张图再试。

查看与导出识别结果

第一步:等待识别完成
页面显示“正在解析中…”时,别关标签页或切换窗口。通常3~12秒内完成,模糊图片可能需要额外2~3秒做增强处理,耐心等一会儿出来。

第二步:核对分段文本
结果页会自动按语义切分成中文段、英文段、数字公式块三类。每段右侧都有个“复制”图标,点击任意段落左侧的“▶”可以展开原始图片对应区域,方便你比对确认。

第三步:导出或复制使用
点击顶部的“复制全部”按钮,一键拷贝全文,直接粘贴到Word、飞书、钉钉里。想保留段落结构,就点“导出为TXT”,会生成纯文本文件下载到本地,用起来很方便。

来源:https://www.php.cn/faq/2850869.html?uid=1431639

相关热点

继续查看同栏目近期热点。

延伸阅读

补充最近整理过的热点入口。