选择本地视频或音频
选择本地的 MP4、MOV、WebM、MP3、WAV 等文件。
在设备上生成字幕,逐句编辑,并实时预览样式。免费使用,无需上传、注册,不添加水印。
选择本地的 MP4、MOV、WebM、MP3、WAV 等文件。
语音模型可用时,会在本机生成带时间信息的字幕。模型下载、浏览器和设备资源会影响可用性。你也可以导入 SRT 或 VTT 文件。
在编辑器里修正文字和时间——识别很好,但你的耳朵更准。
下载 SRT/VTT 字幕文件,或在支持的浏览器中导出已烧录字幕的 MP4。
语音模型可用时,会在本机生成带时间信息的字幕。模型下载、浏览器和设备资源会影响可用性。你也可以导入 SRT 或 VTT 文件。
音频解码和语音识别都在你的设备上完成。视频、音频和台词不会到达任何服务器。
导出前可以修改文字、调整起止时间、添加或删除字幕行。
下载 SRT/VTT 字幕文件,或在支持的浏览器中导出已烧录字幕的 MP4。
选择 MP4、MOV、WebM 或音频文件,在浏览器中识别语音。媒体和字幕文本不会上传到 DojoClip。首次转录需下载开源语音模型,浏览器可以缓存以便后续使用;首次访问仍需要网络。
导出 MP4 会将所选字体、颜色和样式烧录到画面中。SRT 适合上传到视频平台或继续剪辑,VTT 适合网页播放器。这两种字幕文件只保存文字和时间,不保存预览中的视觉样式。
搜索句子并跳转到对应画面,修改文字、起止时间,合并短句或补充遗漏。字幕列表独立滚动,预览保持可见。选择模板、预览字体,并拖动字幕避开人脸。动态逐字高亮采用估算时间,导出前请检查。
请复核人名、标点、背景音乐和多人同时说话的片段。自动转录文件上限为 700 MB;低内存设备时长上限 10 分钟,其他设备最多 30 分钟。实际支持取决于浏览器与设备资源。可使用受支持的 Chrome 或 Edge 导出 MP4;导入 SRT/VTT 无需下载模型。
使用免费视频裁剪工具先缩短素材,或提取音频。需要多片段时间线、翻译或助手剪辑时,使用 Video Edit AI。
可以。此工具免费,无需账号,也不添加 DojoClip 水印。文件在本机处理;浏览器支持和可用内存仍会限制可处理的文件。
不会。音频在你的设备上本地解码和转写,不会向 DojoClip 发送任何内容——对未发布或保密的素材尤其重要。
模型支持 90 多种语言,包括中文、英语、西班牙语、法语、德语、意大利语、葡萄牙语、韩语和日语。可以自动检测,也可以手动选择语言以获得最佳效果。
清晰的语音转写效果很好。较重的口音、背景音乐或多人同时说话需要少量手动修正——内置编辑器正是为此准备的。
可以。选择视频,生成或导入字幕,选择样式后点击“导出 MP4”,字幕会成为视频画面的一部分。导出需要浏览器编码支持,建议使用最新版 Chrome 或 Edge。也可以单独下载 SRT/VTT 字幕文件。
速度取决于设备、浏览器、可用硬件加速和语音模型。首次使用还需要下载模型。长文件占用更多内存,不保证固定处理速度。