这次 WiseMindAI v1.3.0 更新了不少实用功能,比如新增实时转录,文档可以生成 AI 知识大纲,信息图可以先确认文字稿再生成,笔记增加阅读模式和平台复制,模型配置完成后也能直接测试了。
这次最值得优先介绍的 8 个更新:
新增实时转录,边听边生成逐字稿
文档新增 AI 知识大纲
信息图支持先生成和编辑文字稿
笔记新增阅读模式和平台复制
视频截图、字幕和笔记联动增强
生图、转录等模型支持测试
新增常见问题中心
模型更新
更多更新
下面逐个介绍。
一、新增实时转录,边听边生成逐字稿
新版增加了实时转录功能,适合会议、课堂、访谈和灵感记录。开始前可以选择使用场景、录音设备和转录平台,并检测麦克风是否正常。

讲话时,尚未确认的识别内容也会实时显示,页面会自动跟随最新文字;手动查看前文时,自动滚动会暂停。录音可以随时暂停和继续,也能把内容标记为重点、待办或问题。

录音结束后,AI 可以按会议、课堂、访谈或灵感模板生成完整纪要、核心重点和行动待办。逐字稿支持搜索、修改和点击回听,并可保存到文档、笔记或知识库,或带时间戳导出。

当然,你还可以把所有的纪要、逐字稿等内容,导出到本地,也可以保存到 WiseMindAI 的文档中心、知识库和笔记等功能继续深入学习。
二、文档新增 AI 知识大纲
v1.3.0 新增了 AI 知识大纲。打开一份文档后,可以让 AI 按模块和知识点重新整理内容,生成一棵更清楚的知识树,并标出核心知识、易错点和可行动内容,方便先看结构,再读重点。

每个知识点都能跳回原文,也可以继续提问、生成笔记、制作知识卡片或生成考试。教材、课程讲义、研究报告和项目资料,都能用这种方式,帮助你先用大纲建立全局认识,再回到重点精读,把真正需要掌握的部分直接沉淀成复习材料。
三、信息图内容先确认再生成
以前生成信息图时,会遇到图片里面文字不够清楚,或者缺少某个重点,只能调整提示词重新生成。
现在生成信息图前,WiseMindAI 会先整理一份包含主标题、副标题、核心模块、短要点等文字稿让你确认,确认或修改内容后,再生成图片。

这一步看起来只是多了一次确认,实际会省下很多反复生图的时间。先把内容讲清楚,再决定怎么画,信息图的结构和可读性都会更稳定。
四、笔记新增阅读模式和平台复制
笔记现在可以在写作模式和阅读模式之间切换。阅读模式会按 Markdown 阅读器排版,并跟随当前的阅读主题、字号、行距和段落间距,写完后可以直接检查阅读效果。

“复制到平台”支持复制到微信公众号、知乎和通用 Markdown。
复制到微信公众号时会尽量保留标题、字体、颜色、引用、列表、表格和代码等样式;复制到知乎时会优先保证结构和排版兼容,同时保留纯文字版本作为后备。
五、视频截图、字幕和笔记联动
很多人看课程、访谈或演示视频时,会一边看一边记笔记。但普通笔记很容易丢掉上下文:过一段时间看到一张截图,已经记不清它来自视频的哪一段。
v1.3.0 优化了视频截图插入笔记的流程。现在从视频中截取画面并写入笔记时,会同时保留对应时间信息。以后回看笔记,可以从截图或时间位置重新定位到原视频片段。

这次还增加了字幕翻译弹框,方便在阅读视频字幕时集中处理翻译。音视频识别也新增了阿里云百炼、小米 MiMo、阶跃星辰和火山引擎等选择,用户可以根据自己的账号、效果和使用成本进行配置。
六、生图、转录等模型支持测试
在之前配置完通用模型,可以直接测试模型是否配置成功,但是对于 Embedding 模型、生图模型等,但不知道是否真的能用。往往要等到导入文档、生成图片或开始录音后,才发现模型没有额度、地址写错,或者当前账号没有权限。
v1.3.0 给在线模型增加了统一测试入口。现在通用模型、Embedding、图片生成、图片文字识别、音视频转写和实时转录,都可以在模型设置里直接测试当前配置。

七、新增常见问题中心
当你使用 WiseMindAI 过程中,经常遇到各种问题,但是不知道怎么解决,就会影响使用了。
现在在 WiseMindAI 中,增加了“问题排查”模块,可以搜索常见使用问题和排查方法。即使暂时无法联网,也会保留内置的常见问题内容,遇到模型、知识库、插件或设置问题时,可以先在应用里找到对应说明。

打开后,可以看到有很多常见问题,这里进行汇总了:

当然你也可以直接搜索问题、关键词等进行查找,也可以按照功能模块进行过滤。
这个功能准确来说,是帮助你更方便解决使用过程中遇到的问题,当然,Chris 也是希望,这部分应该是越来越少,才对,WiseMindAI 应该从交互、使用、错误引导等角度不断去完善。
模型更新
此次新增模型包括:
通用模型:腾讯混元 TokenHub、百度千帆
Embedding 模型:Cloudflare、硅基流动、OpenAI、Gemini、Voyage AI、Cohere、Jina AI、OpenRouter、百度千帆
图片生成模型:腾讯混元 TokenHub、Cloudflare、阶跃星辰、百度千帆、火山引擎
图片文字识别:腾讯云、百度千帆、Apple Vision
音频模型:阿里云百炼、小米 MiMo、阶跃星辰、火山引擎
其中“图片文字识别”增加的 Apple Vision 模型,可以在 Mac 电脑直接使用电脑内置 OCR 功能进行图片文字识别,识别速度非常快。
更多更新
1.新增视频字幕翻译功能
现在你可以在生成好的字幕中,直接翻译成需要的语言,比如你在看英文课程,就可以在生成字幕后,翻译成中文。
点击字幕还可以自动跳转到视频对应时间点,继续播放。


后续也将考虑把翻译后的字幕内容,也显示一份到视频中,这样看起来更方便。
2.新增笔记、文档标签快捷设置
这次还对标签功能进行优化:
现在在笔记标题区,直接点击下面标签栏就可以快速设置笔记标签。

文档详情页标题栏,点击文档信息按钮,可以打开详情面板,可以快速设置文档标签。

这是接下来 WiseMindAI 标签功能升级到一个前置调整,标签不应该只是打标签,而没有使用,后续将围绕标签使用的角度去完善功能,更好的体现标签的价值。
3.新增左侧菜单增加预设场景
考虑到现在 WiseMindAI 的功能菜单有非常多,每个人使用的功能组合并不太一样。因此这次将左侧菜单栏设置到功能也进行优化。
现在你可以打开“左侧菜单栏设置”,可以选择常用的菜单栏模式,每种模式包含默认的菜单不同,比如:
学习模式:包含首页、搜索、文档、知识库、对话、笔记、更多菜单
精简模式:首页、文档、知识库、更多菜单
完整模式:包含所有功能菜单
当然,每种模式只是提供默认菜单配置,你也可以在这个模式下,继续添加或移除其他菜单。

4.优化知识库分析展示
现在在分析知识库的时候,将会实时显示各种状态的文档数量,包括:未开始、处理中、成功、失败等数量。方便你可以直观看到每个任务状态的数量:

并且还增加了“分析待处理”按钮,当你知识库中,存在部分解析失败、或者新增的文档,你就可以使用这个按钮,只分析这部分的文档,而不是全部文档,这样更加合理:

5.笔记助手增加插图生成
现在在笔记编辑器的“AI 助手”,增加了“插图”功能。
你可以在这里生成任意图片,并插入到笔记中,这样就可以在笔记编辑器中,完整完成你的创作了,配合上前面说的“复制到微信公众号”等功能,创作流程完成闭环。

总结
这次 WiseMindAI v1.3.0 的更新,核心可以概括成几件事:
音频可以直接进入知识流程,从实时转录、重点标记到纪要、待办、笔记和知识库,一次完成;
长文档更容易读懂,AI 知识大纲先整理结构,再连接原文、提问、笔记、卡片和考试;
信息图生成更可控,先确认和修改文字稿,再生成图片,减少反复尝试;
笔记从写作走到发布更顺畅,可以直接切换阅读效果,并复制到微信公众号、知乎或 Markdown;
视频学习更连贯,截图、笔记、字幕和原视频时间位置可以互相联系;
模型配置更容易验证,六类在线模型都可以先测试,再进入正式使用;

