功能

ASRbox 把"转写一段音视频"这件小事,做成了一条完整的工作流。

01

本地转写与批量任务

把音频或视频拖进窗口就能开始。转写前 ASRbox 会自动预检:有没有音轨、格式是否支持、时长与切分方式,有问题先说清楚再动手。支持一次拖入多个文件批量处理,任务可以暂停、继续、失败重试。

  • 15 个本地模型:Whisper、Faster Whisper(词级时间戳)、MLX Whisper、SenseVoice、Qwen3-ASR、MOSS-Transcribe-Diarize(说话人分离,50+ 语言)
  • 模型体积从 145 MB 到 6.2 GB,按精度与速度需求自由选择
  • 断点续传:模型下载可暂停、续传、重试
ASRbox — 本地转写与批量任务
本地转写与批量任务
02

GPU 加速

长音频不必干等。Windows 上安装可选的 NVIDIA CUDA 套件后,本地转写最高提速约 10 倍;macOS 上自动使用 Apple GPU(Metal / MPS),Apple Silicon 还可以选择专为它优化的 MLX 模型。

  • CUDA 套件按需下载,不用不装
  • 设置页可查看当前设备的加速状态
ASRbox — GPU 加速
GPU 加速
03

字幕编辑与版本历史

转写结果不是一锤子买卖。在时间轴上逐条修正文字、用搜索替换批量处理高频错误、点任意一句从对应位置播放核对。每一次转写、重转、手工编辑、AI 处理都会生成一个不可变的新版本——改坏了随时回到任何一步。

  • 波形音频播放器与字幕逐句联动
  • 全文搜索与批量替换
  • 版本历史完整可追溯,可恢复到任意版本
ASRbox — 字幕编辑与版本历史
字幕编辑与版本历史
04

AI 字幕核对

接入任意 OpenAI 兼容的大模型(内置 MiniMax、Kimi、DeepSeek、Qwen、GLM、Ollama 预设),让它通读字幕、找出错别字、漏字与识别错误。AI 只提建议:每一条修改都由你逐个确认,确认后才生成新版本,原始转写永远保留。

  • 逐条采纳或忽略,全程可控
  • 发送给大模型的只有字幕文本与必要的相邻上下文,不含音频、文件名或路径
ASRbox — AI 字幕核对
AI 字幕核对
05

AI 翻译与双语导出

把字幕翻译成 14 种预设语言中的任意一种,或自定义目标语言。翻译同样生成独立版本,可以导出双语字幕文件,方便学习与分享。

  • 14 种预设语言 + 自定义目标
  • 双语字幕导出
ASRbox — AI 翻译与双语导出
AI 翻译与双语导出
06

AI 对话

两种用法:不绑定稿件时,它是 ASRbox 的使用顾问(内置离线知识库,不联网也能答);绑定一份转写稿后,可以直接对内容提问——"总结这段访谈""找出提到预算的地方",回答带时间戳,点击即可定位。

  • 流式回复,会话本地保存
  • 引文带时间戳,可跳转核对
ASRbox — AI 对话
AI 对话
07

六种格式导出

TXT、SRT、VTT、ASS、JSON、Markdown。进剪辑软件、挂播放器、存笔记、喂给别的工具,总有一种合适。

ASRbox — 六种格式导出
六种格式导出
08

在线 ASR 与云端大模型

本地模型之外,也可以使用在线服务:必剪(Bcut,免费)、阿里云 ASR、任意 OpenAI 兼容接口或自建 HTTP 服务。用不用、用哪家,完全由你决定;隐私说明里明确列出了每种场景会发送的数据。

  • 在线服务为可选项,默认全部本地完成
  • API key 保存在本机
ASRbox — 在线 ASR 与云端大模型
在线 ASR 与云端大模型
09

模型与存储管理

每个模型的体积、语言支持、设备兼容性都标注清楚:磁盘还剩多少、这个模型在你的机器上跑不跑得动,下载之前就知道。不需要的模型可以随时删除释放空间。

ASRbox — 模型与存储管理
模型与存储管理