视频音频逐字稿

浏览器内 AI 语音转录 — 上传即用,无需安装

于得泉出品

上传媒体文件

🎬

点击或拖拽文件到此处

支持 MP4 / MOV / M4A / WAV / MP3 / WEBM / OGG

中文建议选 small 模型;首次加载需下载模型(约 80-770MB)

转录设置

中文推荐 small(准确),tiny 仅用于快速测试(中文识别较弱,可能产生重复幻觉);medium 最准确但较慢
正在加载 AI 引擎...

功能说明

项目详情
语音引擎Whisper AI(Transformers.js,浏览器内运行)
数据隐私完全本地处理,文件不上传任何服务器
首次加载需下载 AI 模型(small 约 250MB / tiny 约 80MB),后续浏览器自动缓存
模型来源通过国内镜像 hf-mirror.com 下载,无需翻墙
浏览器要求Chrome 90+ / Edge 90+ / Firefox 90+(需 WebAssembly 支持)
输出格式Markdown(带时间戳)+ 纯文本
处理速度取决于设备 CPU,通常 1 分钟音频约 30-60 秒
于得泉出品
视频音频逐字稿 · 浏览器内 AI 语音转录
已复制