四步,从链接到报告
全流程在一个桌面应用内完成,无需云端服务
- STEP 01
采集
yt-dlp 抓取视频与元数据,支持批量与 Cookie 导入
- STEP 02
本地转写
faster-whisper 离线语音识别,GPU 加速,导出 SRT/VTT
- STEP 03
AI 分析
多模型路由 + 5 套分析模板,长视频 map-reduce
- STEP 04
结构化报告
Markdown / PDF / HTML 导出,结构化渲染
核心功能
免费开源版即可使用的完整分析管线
多平台采集
YouTube · B站 · 抖音 · 快手 · 小红书 · TikTok,批量模式 + Cookie 导入保持登录态。
本地离线转写
faster-whisper 本地 ASR,GPU 加速、自动选型,音频不上传任何服务器。
多模型 AI 分析
OpenAI / Claude / Qwen / DeepSeek / Ollama 等自由接入,摘要、要点、商业模式、课程拆解、爆款模式 5 套模板。
结构化报告
分析结果输出结构化 JSON,一键导出 Markdown / PDF / HTML。
跨平台桌面应用
Tauri 2 + React 构建,macOS 与 Windows 原生体验,安装即用。
本地优先
媒体文件、转写文本、API Key 全部留在你的电脑,隐私由架构保证。
开源,值得信任
MIT 开源
核心代码完全开放,欢迎审计与贡献。
本地优先
不上传视频、转写与密钥,抓取行为发生在你自己的电脑上。
持续迭代
公开路线图,专业版收入直接投入核心开发。
常见问题
›需要什么电脑配置?
支持 macOS 与 Windows。本地转写建议 8GB 内存以上;有独立显卡(GPU)转写速度更快,无 GPU 也可运行。需要自行安装 FFmpeg(下载页有一行命令教程)。
›AI 分析的 API Key 谁提供?
由你自己提供。应用内置 30+ 模型服务商预设(OpenAI / Claude / Qwen / DeepSeek 等,兼容任意 OpenAI 格式接口),也支持 Ollama 本地模型零成本使用。Key 只存在你本机。
›我的数据存在哪里?
全部存在本机 `~/.videomind` 目录:视频、转写文本、分析报告、API Key 都不会上传到任何服务器。
›VideoMind AI 是免费的吗?
是。核心功能(采集 / 转写 / AI 分析 / 报告导出)永久免费,以 MIT 协议开源,源码托管在 GitHub,可自由审计与二次开发。
›支持哪些视频平台?
支持 YouTube、B站、抖音、快手、小红书、TikTok 等主流平台,基于 yt-dlp,支持批量任务与 Cookie 导入保持登录态。
›可以完全离线使用吗?
视频转写完全离线(faster-whisper 本地运行,音频不上传)。AI 分析环节需要接入模型服务;连接本地 Ollama 模型时,全流程都可以离线完成。
›界面支持哪些语言?
应用界面支持中文与英文;语音转写基于 faster-whisper,支持其覆盖的多种语言。
