音频转文字
导入录音、语音备忘录、播客或视频:Whisper AI 会直接在您的浏览器中将其转换为带时间戳的文字。免费使用,文件不会被上传。
- Whisper AI
- 支持上百种语言
- TXT 和 SRT
- 100% 隐私保护
100% 隐私保护 — 一切均在您的浏览器中直接处理:您的文件、语音和图像永远不会发送到 Chatzam 的服务器。
如何转录音频文件?
-
导入您的文件
MP3、WAV、M4A、OGG,或 MP4、MOV、WebM 视频:拖入区域即可。
-
选择语言
指定所说的语言(或选择自动检测)以及所需的精度。
-
获取文字
复制转录文本,或下载为 TXT 或 SRT 字幕文件。
AI 转录,隐私零妥协
OpenAI 的 Whisper 引擎
与许多付费工具相同的语音识别模型,直接在您的浏览器中运行。
音频与视频均可
支持所有常见格式:视频中的音轨会被自动提取。
时间戳与字幕
以时间戳形式查看文字,或导出适用于 YouTube 或剪辑软件的 SRT 文件。
文件不会被上传
您的录音(会议、访谈、语音备忘录)永远不会离开您的设备。
用 AI 将录音转换为文字
会议、采访、课程、语音留言或播客:手动整理文字往往要花上几个小时。此工具使用 OpenAI 的语音识别模型 Whisper,将语音转换为书面文字。选择“精确”获得最佳质量,或在配置较低的电脑上处理长文件时选择“快速”。
免费又私密的转录,原理是什么?
首次使用时,AI 模型(约 40 到 80 MB)只会下载一次,随后由浏览器缓存。之后的转录完全在您的设备上完成:文件永远不会被上传。处理时间取决于您电脑的性能和音频的时长。
一键生成 SRT 字幕
文字会被切分为带时间戳的片段。导出为 SRT 格式,即可为 YouTube、TikTok 或 Instagram 视频添加字幕,也可以在剪辑软件中进一步编辑。
常见问题
音频转文字真的免费吗?
是的。AI 模型在您的设备上运行:没有订阅费用,也没有时长限制。
支持哪些语言?
Whisper 能识别上百种语言。法语、英语、西班牙语、德语、意大利语、葡萄牙语和荷兰语的识别效果最佳。
转录需要多长时间?
这取决于您的电脑性能和所选模式。“快速”模式明显更快;“精确”模式较慢但更可靠。处理期间请保持标签页打开。
我的文件会被发送到服务器吗?
不会。只有 AI 模型会从 Hugging Face 下载;您的音频从始至终都留在您的设备上。