首页 / 视频音频 / 音频处理 / 视频号文字提取

视频号文字提取

视频号/短视频文字提取工具:上传视频或音频,浏览器本地用 Whisper(transformers.js)做语音转文字,输出纯文本与带时间戳 SRT,支持模型源切换(hf-mirror/HF/modelscope)与语言选择。纯前端本地推理,文件不上传,保护隐私。

使用说明
视频号文字提取
点击或拖拽视频 / 音频到此处 支持 MP4 / MOV / WebM / M4V / MP3 / WAV 等浏览器可解码格式 · 文件不会上传,全程本地处理
上传文件并点击「开始提取」后,这里显示文字内容。
原理:基于开源 @huggingface/transformers(MIT)+ OpenAI Whisper(MIT)在浏览器本地推理。 首次使用会从所选模型源下载 Whisper 模型(base 约 145MB / tiny 约 75MB,之后浏览器缓存),请耐心等待; 推理在 CPU/WASM 上运行,视频越长耗时越久。仅提取音频轨道(视频本身不上传服务器),保障隐私。 若模型加载失败,可切换「模型源」重试(国内推荐 hf-mirror 镜像)。