WiseMindAI v1.3.0 这次更新,核心思路很清晰:让音频、文档、笔记、视频这些内容,都能更顺畅地进入你的知识流程。不再需要手动倒腾,AI 在中间帮你把路铺好。
先说几个核心判断:
- 音频可以直接变成知识,从实时转录到生成纪要、待办,一条龙搞定;
- 长文档更容易被消化,AI 知识大纲先搭好框架,再让你精读重点;
- 信息图生成更可控,先确认文字稿,再出图,避免反复试错;
- 笔记从写到发,体验更完整,阅读模式、平台复制都安排上了;
- 视频学习不再断片,截图、笔记、字幕和原视频时间位置可以互相跳转;
- 模型配置更省心,六类在线模型都能先测试再使用。
下面逐个拆解。
一、新增实时转录,边听边生成逐字稿
这次最值得聊的,是实时转录功能的加入。会议、课堂、访谈、灵感记录,这些场景终于有了一个趁手的工具。
开始前,你可以选择使用场景、录音设备和转录平台,系统还会自动检测麦克风是否正常,免得录到一半才发现问题。

讲话时,尚未确认的识别内容也会实时显示,页面会自动跟随最新文字;手动查看前文时,自动滚动会暂停,互不干扰。录音可以随时暂停和继续,也能把内容标记为重点、待办或问题——相当于边听边做笔记,重点一个不漏。

录音结束后,AI 会按会议、课堂、访谈或灵感模板,自动生成一份完整的纪要,包括核心重点和行动待办。逐字稿支持搜索、修改和点击回听,并且可以保存到文档、笔记或知识库,也可以带时间戳导出。后续想继续深入学习,数据都能无缝流转。

当然,所有纪要、逐字稿等内容,都可以导出到本地,或者保存到 WiseMindAI 的文档中心、知识库和笔记,继续做深度处理。
二、文档新增 AI 知识大纲
v1.3.0 新增的 AI 知识大纲,是一个很实在的更新。打开一份文档,AI 会按模块和知识点重新整理内容,生成一棵更清晰的知识树,并标出核心知识、易错点和可行动内容。先看结构,再读重点,效率提升不止一个档次。
每个知识点都能跳回原文,也可以继续提问、生成笔记、制作知识卡片或生成考试。教材、课程讲义、研究报告和项目资料,都能用这种方式,先通过大纲建立全局认识,再回到重点精读,把真正需要掌握的部分直接沉淀成复习材料。
三、信息图内容先确认再生成
以前生成信息图,经常遇到图片里文字不够清楚,或者缺少某个重点,只能调整提示词重新生成,很浪费时间。
现在,生成信息图前,WiseMindAI 会先整理一份包含主标题、副标题、核心模块、短要点等文字稿,让你确认或修改后,再生成图片。这一步看似多了一次确认,实际上省下了很多反复生图的时间。先把内容讲清楚,再决定怎么画,信息图的结构和可读性都会更稳定。

四、笔记新增阅读模式和平台复制
笔记现在可以在写作模式和阅读模式之间切换。阅读模式会按 Markdown 阅读器排版,并跟随当前的阅读主题、字号、行距和段落间距,写完笔记后可以直接检查阅读效果,体验非常顺滑。

“复制到平台”功能支持复制到微信公众号、知乎和通用 Markdown。复制到微信公众号时会尽量保留标题、字体、颜色、引用、列表、表格和代码等样式;复制到知乎时会优先保证结构和排版兼容,同时保留纯文字版本作为后备。从此笔记从写作到发布,一步到位。
五、视频截图、字幕和笔记联动
很多人看课程、访谈或演示视频时,会一边看一边记笔记。但普通笔记很容易丢掉上下文:过一段时间看到一张截图,已经记不清它来自视频的哪一段。
v1.3.0 优化了视频截图插入笔记的流程。现在从视频中截取画面并写入笔记时,会同时保留对应时间信息。以后回看笔记,可以从截图或时间位置,重新定位到原视频片段,再也不用担心上下文丢失。

这次还增加了字幕翻译弹框,方便在阅读视频字幕时集中处理翻译。音视频识别也新增了阿里云百炼、小米 MiMo、阶跃星辰和火山引擎等选择,用户可以根据自己的账号、效果和使用成本灵活配置。
六、生图、转录等模型支持测试
在之前,配置完通用模型可以直接测试是否配置成功,但对于 Embedding 模型、生图模型等,往往要等到真正使用时,才发现模型没有额度、地址写错,或者当前账号没有权限,非常影响体验。
v1.3.0 给在线模型增加了统一测试入口。现在通用模型、Embedding、图片生成、图片文字识别、音视频转写和实时转录,都可以在模型设置里直接测试当前配置,确保万无一失再进入正式使用。

七、新增常见问题中心
使用过程中遇到问题,最怕找不到解决办法。现在 WiseMindAI 中增加了“问题排查”模块,可以搜索常见使用问题和排查方法。即使暂时无法联网,也会保留内置的常见问题内容,遇到模型、知识库、插件或设置问题时,可以先在应用里找到对应说明。

打开后,可以看到很多常见问题已经汇总,也支持直接搜索问题、关键词进行查找,或者按照功能模块进行过滤。这个功能的核心价值,是帮助你更方便地解决使用过程中遇到的问题,减少摩擦。

模型更新
此次新增模型包括:
- 通用模型:腾讯混元 TokenHub、百度千帆
- Embedding 模型:Cloudflare、硅基流动、OpenAI、Gemini、Voyage AI、Cohere、Jina AI、OpenRouter、百度千帆
- 图片生成模型:腾讯混元 TokenHub、Cloudflare、阶跃星辰、百度千帆、火山引擎
- 图片文字识别:腾讯云、百度千帆、Apple Vision
- 音频模型:阿里云百炼、小米 MiMo、阶跃星辰、火山引擎
其中“图片文字识别”增加的 Apple Vision 模型,可以在 Mac 电脑直接使用电脑内置 OCR 功能进行图片文字识别,识别速度非常快。
更多更新
1. 新增视频字幕翻译功能
现在可以在生成好的字幕中,直接翻译成需要的语言。比如你在看英文课程,就可以在生成字幕后,翻译成中文。点击字幕还可以自动跳转到视频对应时间点,继续播放。


后续也将考虑把翻译后的字幕内容,也显示一份到视频中,这样看起来更方便。
2. 新增笔记、文档标签快捷设置
这次还对标签功能进行了优化:
- 在笔记标题区,直接点击下面标签栏就可以快速设置笔记标签。

- 文档详情页标题栏,点击文档信息按钮,可以打开详情面板,快速设置文档标签。

这是接下来 WiseMindAI 标签功能升级的一个前置调整。标签不应该只是打标签,而没有使用。后续将围绕标签使用的角度去完善功能,更好地体现标签的价值。
3. 新增左侧菜单增加预设场景
考虑到现在 WiseMindAI 的功能菜单非常多,每个人使用的功能组合并不太一样。因此这次将左侧菜单栏设置功能也进行了优化。
现在你可以打开“左侧菜单栏设置”,选择常用的菜单栏模式。每种模式包含默认的菜单不同,比如:
- 学习模式:包含首页、搜索、文档、知识库、对话、笔记、更多菜单
- 精简模式:首页、文档、知识库、更多菜单
- 完整模式:包含所有功能菜单
当然,每种模式只是提供默认菜单配置,你也可以在这个模式下,继续添加或移除其他菜单,灵活适配自己的使用习惯。

4. 优化知识库分析展示
现在在分析知识库的时候,将会实时显示各种状态的文档数量,包括:未开始、处理中、成功、失败等数量。方便你直观看到每个任务状态的数量。

并且还增加了“分析待处理”按钮。当你知识库中存在部分解析失败、或者新增的文档,你就可以使用这个按钮,只分析这部分文档,而不是全部重新分析,更加合理高效。

5. 笔记助手增加插图生成
现在在笔记编辑器的“AI 助手”中,新增了“插图”功能。你可以在这里生成任意图片,并插入到笔记中,这样在笔记编辑器中就能完整完成创作。配合上前面说的“复制到微信公众号”等功能,创作流程实现闭环。

总结
这次 WiseMindAI v1.3.0 的更新,核心可以概括成几件事:
- 音频可以直接进入知识流程,从实时转录、重点标记到纪要、待办、笔记和知识库,一次完成;
- 长文档更容易读懂,AI 知识大纲先整理结构,再连接原文、提问、笔记、卡片和考试;
- 信息图生成更可控,先确认和修改文字稿,再生成图片,减少反复尝试;
- 笔记从写作走到发布更顺畅,可以直接切换阅读效果,并复制到微信公众号、知乎或 Markdown;
- 视频学习更连贯,截图、笔记、字幕和原视频时间位置可以互相联系;
- 模型配置更容易验证,六类在线模型都可以先测试,再进入正式使用。
如果你平时会用 WiseMindAI 整理会议、课程、视频、文档、笔记和知识库,这一版值得更新。
