ローカルの動画・音声を選択
ローカルのMP4、MOV、WebM、MP3、WAVなどのファイルを選びます。
端末上で字幕を生成し、一行ずつ編集してスタイルをプレビュー。無料で、アップロードや登録は不要。透かしも追加しません。
ローカルのMP4、MOV、WebM、MP3、WAVなどのファイルを選びます。
音声モデルが利用できる場合、端末内で時間付きの字幕を作成します。モデルのダウンロード、ブラウザ、端末のリソースによって利用可否が変わります。SRTやVTTの読み込みも可能です。
エディターでテキストとタイミングを修正します。認識は優秀ですが、あなたの耳のほうが正確です。
SRT/VTT字幕ファイルを保存するか、対応ブラウザで字幕を焼き込んだMP4を書き出せます。
音声モデルが利用できる場合、端末内で時間付きの字幕を作成します。モデルのダウンロード、ブラウザ、端末のリソースによって利用可否が変わります。SRTやVTTの読み込みも可能です。
音声のデコードも音声認識もデバイス上で完結します。動画・音声・発話内容がサーバーに届くことはありません。
書き出す前に、文言の修正、開始・終了時間の調整、行の追加・削除ができます。
SRT/VTT字幕ファイルを保存するか、対応ブラウザで字幕を焼き込んだMP4を書き出せます。
公開された音声モデルがブラウザ内で音声を認識します。初回にモデルをダウンロードし、ブラウザが次回用にキャッシュできます。動画、音声、字幕はDojoClipにアップロードされません。初回の利用にはネット接続が必要です。
MP4はフォント、色、スタイルを映像に焼き込みます。SRTは動画サイトや別の編集ソフト、VTTはWebプレーヤー向けです。SRTとVTTに含まれるのは文字と時間で、プレビューの装飾は保存されません。
行を検索して該当場面へ移動し、文字や開始・終了時刻を修正します。短い行の結合や字幕の追加もできます。字幕一覧だけが独立してスクロールします。フォントやスタイルを選び、顔に重ならない位置へ字幕を動かせます。動的スタイルは推定の単語タイミングを使用します。
人名、句読点、音楽や複数人の声が重なる部分は見直してください。自動文字起こしは最大700 MB、低メモリ端末は10分、それ以外は最大30分です。ブラウザや端末性能による制約はあります。MP4には対応するChromeやEdgeをお使いください。SRT/VTTの読み込みにはモデルは不要です。
無料動画トリマーや音声抽出をご利用ください。複数クリップ、翻訳、アシスタント編集には Video Edit AIを使えます。
はい。無料で、アカウントやDojoClipの透かし追加はありません。端末内で処理しますが、ブラウザの対応状況と空きメモリによって扱えるファイルは制限されます。
いいえ。音声はデバイス上でローカルにデコード・文字起こしされます。DojoClipには何も送信されません。未公開や機密の映像ほど重要なポイントです。
モデルは日本語、英語、スペイン語、フランス語、ドイツ語、イタリア語、ポルトガル語、韓国語、中国語を含む90以上の言語を理解します。自動検出を使うか、話されている言語を選ぶとより正確です。
クリアな音声は非常によく文字起こしされます。強い訛り、BGM、声の重なりには多少の手直しが必要です。内蔵エディターはまさにそのためにあります。
はい。動画を選び、字幕を生成または読み込んでスタイルを選び、「MP4を書き出す」を押すと字幕が映像の一部になります。対応ブラウザが必要なため、最新版のChromeまたはEdgeをお試しください。SRT/VTTも別途保存できます。
速度は端末、ブラウザ、利用できる高速化機能、音声モデルによって異なります。初回はモデルのダウンロードも必要です。長いファイルほどメモリを使い、一定の速度は保証されません。