本地转写与批量任务
把音频或视频拖进窗口就能开始。转写前 ASRbox 会自动预检:有没有音轨、格式是否支持、时长与切分方式,有问题先说清楚再动手。支持一次拖入多个文件批量处理,任务可以暂停、继续、失败重试。
- 15 个本地模型:Whisper、Faster Whisper(词级时间戳)、MLX Whisper、SenseVoice、Qwen3-ASR、MOSS-Transcribe-Diarize(说话人分离,50+ 语言)
- 模型体积从 145 MB 到 6.2 GB,按精度与速度需求自由选择
- 断点续传:模型下载可暂停、续传、重试