MioSub(前身为 Gemini-Subtitle-Pro)是一款真正"读懂语境"的 AI 字幕编辑工具,把下载、转录、翻译、压制整合成一条完整流水线,全程自动化运行,几乎不需要任何人工介入。
为什么传统字幕流程让人崩溃?
还在为机翻质量逐字校对?
在"转录—翻译—校对—打轴"之间来回切换,已经成为很多视频创作者和阿语翻译爱好者的日常噩梦。
而 MioSub 的使用方式简单到让人怀疑:粘贴一个视频链接,泡杯咖啡回来,字幕就已经做好了。
v3.0 全新升级亮点
| 新特性 | 具体说明 |
|---|---|
| 时间轴自动对齐 | 内置 CTC 强制对齐算法,毫秒级精度,无需额外配置外部工具 |
| 界面全面重构 | 编辑器与设置面板重新设计,视觉更清爽,操作更顺手 |
| 不止能处理视频 | 播客、网络电台、有声书等纯音频素材同样支持 |
| 中日文渲染优化 | 内置 NotoSans 字体,彻底告别缺字、方块、字形错乱 |
核心能力一览
- ⚡ 效率惊人:30 分钟的视频素材,平均 8 分钟左右就能输出成品
- 🎯 精度可靠:自动识别专业术语、毫秒级时间轴、智能区分说话人
- 🌍 多语支持:中、英、日三语界面,100+ 语言互译能力
- 🚀 全自动流程:粘贴链接 → 自动完成所有步骤,零人工干预
- 🖥️ 可视化编辑:边播放边修改,字幕效果实时预览
- 📦 灵活导入导出:支持 SRT/ASS 导入、双语字幕导出、一键压制成片
软件界面预览
MioSub 编辑器主界面展示:
实时字幕预览 · 自动滚动跟随 · 说话人自动标注 · 悬浮播放控件 · 全局搜索替换
实际效果展示
以下案例均经过一次生成,无任何人工二次校对:

| 内容类型 | 原视频链接 | 处理说明 |
|---|---|---|
| 🎙️ 日语声优电台 | BV1XBrsBZE92 | 30 分钟日语节目,自动标注说话人 |
| 🚃 日语铁道 Vlog | BV1k1mgBJEEY | 29 分钟,含大量铁路专业术语 |
| 🎬 电影解说 | BV1MG6CBvEzd | PJSK 剧场版彩蛋解说,语速极快,密集出现角色名、组合名、P 主、歌曲名 |
快速开始指南
系统兼容性要求
| 操作系统 | 支持版本 |
|---|---|
| Windows | 10 / 11(64 位) |
| macOS | 12 及以上(Intel / Apple Silicon) |
| Linux | x64 / arm64(AppImage) |
额外需要:4GB 以上可用内存 + 稳定的网络连接。
三步即可上手
- 下载软件 —— 前往 GitHub Releases 页面,下载对应平台安装包
- 完成配置 —— 打开设置面板,填入 Gemini API Key 和 Gemini Endpoint(仅需填写域名);如需使用本地 Whisper,请参考完整文档
- 开始使用 —— 粘贴视频链接,或直接导入本地音视频文件
⚠️ 重要提示
- API Key 必须支持 Gemini 2.5/3 Flash 以及 Gemini 3 Pro 模型
本地 Whisper 配置
本项目支持集成 whisper.cpp 实现完全离线的语音转写。
- 默认支持: 安装包已内置 CPU 版 Whisper 核心组件 (
whisper-cli.exe) - 需手动下载: 需自行下载模型文件 (
.bin) - GPU 加速: 可手动替换为 GPU 版组件获得更快速度
⚡ 快速开始
- 下载模型: 访问 Hugging Face 下载 GGML 格式模型
- 启用功能: 设置 > 服务 > 语音识别 选择「本地 Whisper」
- 加载模型: 点击「浏览」选择下载的
.bin模型文件 - 开始使用: 模型路径设置完成后即可使用
国内可以使用 HF Mirror 下载。
📦 模型下载指南
推荐下载
请下载 标准版 模型,文件名格式为 ggml-[model].bin:
| 模型 | 文件名 | 大小 | 内存 | 速度 | 适用场景 |
|---|---|---|---|---|---|
| Tiny | ggml-tiny.bin | 75 MB | ~390 MB | 极快 | 快速测试 |
| Base | ggml-base.bin | 142 MB | ~500 MB | 快 | 日常对话 ⭐ |
| Small | ggml-small.bin | 466 MB | ~1 GB | 中等 | 播客/视频 ⭐ |
| Medium | ggml-medium.bin | 1.5 GB | ~2.6 GB | 慢 | 复杂音频 |
| Large-v3 | ggml-large-v3.bin | 2.9 GB | ~4.7 GB | 最慢 | 专业需求 |
文件名后缀说明
.en (如 ggml-base.en.bin): 仅英语模型。如果您只转写英文视频,它比同级的多语言模型更准;但不支持中文或其他语言。q5_0, q8_0 (如 ggml-base-q5_0.bin): 量化版模型。体积更小、速度更快,但精度略有下降。.mlmodelc.zip: ❌ 不要下载。这是 macOS CoreML 专用格式,Windows 无法使用。
🛠️ GPU 加速 (NVIDIA 显卡)
前提条件: 已安装最新版 NVIDIA 显卡驱动
- 访问 whisper.cpp Releases 下载
whisper-cublas-bin-x64.zip - 解压。
- 设置 > 服务 > 语音识别 > 「本地 Whisper」> 「Whisper-cli.exe 路径」 >「浏览」选择解压后的
whisper-cli.exe文件 - 开始使用