批量字幕与媒体自动化
安装包同时提供 aivcli:可执行 ASR、字幕转换 / 翻译、媒体信息、影视库索引和批处理任务。
批处理支持断点续跑、可恢复重试、递归扫描、失败继续和 JSON 输出,适合把重复工作交给脚本。
本地 AI 字幕、影视库与内容工作台
从视频播放、离线字幕和翻译,到视觉检索、图片处理和 AI 短剧创作, 把高频内容工作流收进一款跨平台桌面应用。你的媒体和项目数据默认留在本机。
支持 macOS · Windows · Linux
强大的本地 AI 能力,保护你的隐私
基于 whisper.cpp 的离线语音识别,无需联网即可为视频自动生成高质量字幕,支持中英日韩等多语言。
支持 MP4、WebM、MOV、MKV、AVI 等主流视频格式,拖拽导入或文件选择器打开。
基于当前播放位置快速导出短片段,支持 15/30/60 秒三档长度,可选纯视频、外挂字幕或字幕烧录。
支持将生成的字幕翻译为目标语言,使用 OpenAI 兼容接口,支持自定义术语表。
截取当前画面为图片,录制指定时长的视频片段,支持 GIF 导出。
支持简体中文、English、日本語、한국어 四种语言,系统语言自动匹配。
最近更新 · 2026.07
AIVPlayer 不只是播放器:新版本把批量字幕、媒体检索、短剧文本和图片处理都接进了同一个本地工作台。
安装包同时提供 aivcli:可执行 ASR、字幕转换 / 翻译、媒体信息、影视库索引和批处理任务。
批处理支持断点续跑、可恢复重试、递归扫描、失败继续和 JSON 输出,适合把重复工作交给脚本。
使用本地 SigLIP2 和 LanceDB 为视频按帧建立视觉与文本索引,支持用文字描述或图片寻找相似画面。
增量索引会跳过未变化的视频,搜索结果带字幕命中片段,并可直接跳转到视频时间点。
从 TXT / Markdown 小说导入项目,继续完成章节事件、故事骨架、改编策略和分集剧本。
还能生成角色、场景、道具资产和结构化分镜文本;支持 OpenAI 兼容服务、本地 Mock 和断点续跑。
一次导入多张图片,在本地完成尺寸调整、旋转、翻转、格式转换和质量控制。
支持按目标 KB / MB 自动压缩、批量导出、重名递增和安全覆盖原图,适合快速整理网页素材。
第一次使用
AIVPlayer 会在应用内自动检查并打开准备向导。你不需要手动寻找模型目录,也不需要先理解 whisper.cpp。
正式安装包会自带 whisper.cpp 和 ffmpeg。它们负责在本机把视频语音识别成原文字幕,不需要 API Key。
模型文件体积较大,只需下载一次。中国大陆网络优先选择 ModelScope,海外网络可选择 Hugging Face。
填入 OpenAI 兼容接口地址、模型名称和 API Key,点击测试连接。翻译可能产生服务商费用,请确认自己的 API 额度。
现代化的深色影院风格,视频优先
播放器主界面截图
设置面板截图
从源码构建或直接下载使用
适合开发者,需要 Node.js 18+ 环境。
# 克隆仓库
git clone https://github.com/ponponon/aivplayer.git
cd aivplayer
# 安装依赖
npm install
# 启动开发模式
npm run dev
# 构建生产版本
npm run build
# 打包安装程序
npm run dist
# 检查已安装的本地能力
aivcli doctor
现代化的技术选型
桌面框架
UI 框架
构建工具
AI 语音识别
本地视觉检索
本地项目数据