VideoNote · 教程 ← 返回主页

⚙️ VideoNote 模型与语音转写配置教程

零基础图文版 · 照着截图一步步配 · 5 分钟完成模型与转写设置

AI 模型配置 语音转文字 本地 Whisper 下载 一键测试连通性

📑 目录

0

先确认软件已启动

约 1 分钟

本文默认你已经安装好 VideoNote 并进入了主界面。如果你是第一次使用,请按下面方式启动:

💡 下载地址:http://www.xygy.top/
VideoNote 主界面
图 1:VideoNote 主界面,左侧是历史记录,右侧是生成选项。
1

进入设置页

约 10 秒

在主界面右上角,点击齿轮图标即可进入「设置」页面。

  1. 找到页面右上角 ⚙️ 设置 图标(鼠标悬停会显示“设置”)。
  2. 点击进入后,会看到一排标签页:AI 模型配置、语音转文字、模型下载、环境检测、文件清理、导出记录、关于
💡 本节核心:先配好「AI 模型」,再配「语音转文字」。只要这两个标签里有任意一个处于「当前使用」状态,生成笔记时就能工作。
2

配置 AI 模型

约 3 分钟

2.1 认识模型列表

进入「设置 → AI 模型配置」,你会看到已经添加好的模型卡片。卡片上显示:

AI 模型配置页面
图 2:AI 模型配置页,列出已添加的模型。

2.2 添加新模型

点击「+ 添加模型供应商」,会展开表单。系统已内置 6 家主流供应商的预设,你只需要填 API Key,其它字段会自动带出来:

供应商API Base URL官网地址
OpenAIhttps://api.openai.com/v1https://platform.openai.com/
DeepSeekhttps://api.deepseek.com/v1https://platform.deepseek.com/
千问 Qwenhttps://dashscope.aliyuncs.com/compatible-mode/v1https://www.qianwenai.com/
智谱 GLMhttps://open.bigmodel.cn/api/paas/v4https://open.bigmodel.cn/
Moonshothttps://api.moonshot.cn/v1https://platform.kimi.com/
SiliconFlowhttps://api.siliconflow.cn/v1https://cloud.siliconflow.cn/
自定义AI兼容 OpenAI 接口协议、本地AI模型需手动填写模型名称
添加模型供应商表单
图 3:添加模型供应商表单,选择 DeepSeek 后自动填充默认地址和模型。

填写步骤:

  1. 点击上方预设按钮选择供应商(如 DeepSeek)。
  2. 在「API Key」处粘贴你从官网申请的密钥。
  3. 检查「API Base URL」是否正确,一般不用改。
  4. 「选择模型」默认已填好,如果你想换其它模型,可以手动输入或点击「获取模型」让系统自动拉取可用列表。
  5. 「自定义名称」可选,建议填一个好记的名字,例如「DeepSeek V3」。
  6. 点击右下角 保存
⚠️ API Key 不要泄露!它相当于你的支付密码,截图、发群、录屏时请打码。

2.3 测试模型连通性

保存后模型会出现在列表里。先点击卡片右侧的 测试 按钮:

模型测试成功
图 4:测试成功后出现的绿色提示。只有看到“连接成功”,该模型才会在生成笔记时被真正调用。

2.4 多模型切换

你可以同时添加多个供应商。想换哪个用,就在对应卡片上点击 启用。同一时间只有 一个 模型处于「当前使用」状态,系统会按这个模型生成笔记。

3

配置语音转写引擎

约 2 分钟

VideoNote 需要先把视频里的声音转成文字,再交给 AI 总结。进入「设置 → 语音转文字」,选择一种引擎即可。

引擎是否需要联网是否需要 Key特点推荐场景
Fast-Whisper(本地)隐私最好、永久免费,首次需下载模型不想付费 / 无稳定外网
Groq(在线)速度快、免费额度大追求速度 / 视频较长
OpenAI Whisper(在线)官方接口,稳定已有 OpenAI Key
必剪 BCut(在线)国内服务,无需 API Key临时使用 / 不想注册

3.1 已有引擎列表

语音转文字引擎列表
图 5:语音转文字页,显示已添加的引擎和当前启用的引擎。

3.2 添加在线引擎(Groq 示例)

如果你选择 Groq:

  1. 点击「+ 添加转写引擎」。
  2. 选择 Groq (在线)
  3. 填入 Groq API Key(形如 gsk_xxxxxxxx...)。
  4. 点击 保存,然后点击 启用 使其生效。
添加 Groq 转写引擎
图 6:添加 Groq 在线转写引擎,只需填写 API Key。

3.3 添加本地引擎 Fast-Whisper

如果你选择本地转写,不需要 Key,但需要选一个模型大小。首次使用时会自动从国内镜像下载模型文件。

  1. 点击「+ 添加转写引擎」。
  2. 选择 Fast-Whisper (本地)
  3. 在「模型大小」下拉框里选择档位:
添加 Fast-Whisper 本地引擎
图 7:添加 Fast-Whisper 本地引擎,选择一个模型大小即可。
💡 新手建议:先用 tinybase,确认整条流程能跑通;觉得识别不准再升级到 small 或更大。
⚠️ 注意:Fast-Whisper 依赖电脑的 CPU/GPU 进行推理。电脑配置较低时,选择 small 以上可能会非常慢。
4

下载更大的本地 Whisper 模型(可选)

约 1~30 分钟(取决于模型大小和网络)

如果你选了 Fast-Whisper 本地引擎,除了默认已内置的 tiny,还可以在「设置 → 模型下载」里下载其它档位。下载源是 HuggingFace 国内镜像,速度通常很快。

  1. 切换到「模型下载」标签。
  2. 看到「语音转文字模型」列表,选择需要的档位。
  3. 点击右侧 下载 按钮,等待进度条走到 100% 并显示「已安装」。
模型下载页面
图 8:模型下载页,可管理 Whisper 本地模型和 AI 问答向量模型。
💡 同一类模型只需下载一个档位。例如语音转文字下载了 base,就不需要再下载 tiny;想用哪个就在「语音转文字」里切换对应模型大小。
⚠️ 下载慢或失败?点击「查看手动下载说明」,按给出的链接把文件下载到指定目录,然后刷新本页面即可。
5

返回首页生成第一篇笔记

约 2~5 分钟

配置完成后,点击左上角「返回」箭头回到主界面:

  1. 在「视频链接」输入框粘贴 B站 / YouTube / 抖音 / 快手 / 小红书 等链接。
  2. 选择想要的「笔记格式」(结构化、大纲、思维导图、时间线)。
  3. 选择「AI 摘要风格」(均衡、学术、口语等)。
  4. 勾选「插入截图」「原片跳转链接」等需要的选项。
  5. 点击「开始生成」,等待进度条跑完。
💡 首次生成会稍慢:如果是本地 Fast-Whisper,第一次要先下载模型;在线引擎则直接开始转写。
Q

常见问题

Q1:点击「测试」提示 401 Unauthorized?

说明 API Key 无效或已被吊销。请重新到对应平台官网复制 Key,注意不要把空格、换行也复制进去。

Q2:点击「测试」提示“无法连接服务器”?

检查 Base URL 是否完整,必须包含 /v1 结尾。另外确认你的电脑能访问该域名(部分公司网络会拦截海外 API)。

Q3:可以只配一个模型、不配转写引擎吗?

可以。如果视频本身带平台字幕,VideoNote 会优先使用字幕,跳过语音转写。但没有转写引擎的话,无字幕视频会报错。

Q4:Groq 和 OpenAI Whisper 哪个更好?

Groq 免费额度大、速度快,推荐作为首选;OpenAI Whisper 适合已经有 OpenAI Key 的用户。两者都能自动返回带时间戳的文本。

Q5:Fast-Whisper 模型下载到哪个文件夹?

默认在 VideoNote/backend/models/ 下,形如 faster-whisper-base 的目录。模型文件下载一次即可永久离线使用。

Q6:切换模型后需要重启软件吗?

不需要。点击「启用」后立即生效,下一条笔记就会用新模型生成。

Q7:生成笔记时还是报错“未配置 AI 模型”?

请确认:①模型已添加;②已点击「启用」;③测试显示「连接成功」。三个条件缺一不可。