文字起こし編集
テキストを編集して動画を編集。単語を消し、段落を並べ替えれば、タイムラインが追従します。
文字起こし編集
動画編集が文書の編集と同じくらい簡単だったら。ChatCutではそれが現実です。動画は文字起こしされ、そのテキストへの編集(単語の削除、段落の除去、セクションの並べ替え)がそのままタイムラインに反映されます。
メニューを渡り歩かないでください。欲しいものをChatCutに伝えるだけです。 「言いよどみを全部消して」と言えば、AIが文字起こしとタイムラインを一度に編集します。

仕組み
ChatCutは動画を単語単位のタイムスタンプ付きで文字起こしし、編集できる文書として表示します。テキストを編集すると、対応する映像が自動でカット、移動、削除されます。変更はミリ秒単位でタイムラインに同期します。
素材を行ったり来たり探す必要はありません。イン点・アウト点を打つ必要もありません。文字起こしを読み、編集する。それだけです。
動画を読み込む
プロジェクトに素材を追加します。インタビュー、vlog、ポッドキャスト、講義など、話し声が入っていれば何でも
文字起こしを生成する
デュアルエンジンの文字起こしが、単語単位のタイムスタンプと話者識別を作ります
テキストを編集する
単語を消す、段落を除く、セクションを並べ替える、空白を詰める。文書を編集する感覚のままです
タイムラインが即座に同期する
テキストへの編集はすべてリアルタイムでタイムラインに反映されます
7つの編集操作
テキストエディターは、動画編集で本当に必要な操作をそろえています。
単語を削除
文字起こしの中で単語や語句を選んで削除します。対応する音声と映像がタイムラインから取り除かれます。言い直し、繰り返し、不要な言い回しの整理に使えます。
段落を削除
まとまった区間を一度に取り除きます。段落を選べば、文字起こしからもタイムラインからも消えます。要らないセグメントを素早く落とせます。
分割
任意の単語の境界で文字起こし(とタイムライン)を分割します。長いテイクを並べ替えのために区切るときに便利です。
並べ替え
文字起こしのセクションをドラッグして順序を変えます。映像も追従します。タイムラインのクリップを動かす代わりに、段落を動かして構成を組み直せます。
空白を詰める
削除のあとに残った空白をタイムラインから取り除き、後続の内容を前に詰めます。
話者を変更
自動識別の結果を直したいときに、話者ラベルを付け替えます。複数人の内容も正しく振り分けたまま保てます。
テキストを編集
映像を変えずに文字起こしのテキストだけを直します。字幕を作る前に誤認識を修正するのに役立ちます。
AIエージェントが文字起こし全体で47か所の言いよどみを特定して削除。タイムラインを更新し、23秒の無音を除去して空白を自動で詰めました。
デュアルエンジンの文字起こし
ChatCutの字幕と同じく、文字起こし編集も2つのエンジンを使い分けます。
- AssemblyAI – 英語とヨーロッパ言語に最適化
- Huoshan – 中国語専用に設計され、文字分割を正しく処理
単語単位のタイムスタンプがあるので、どの編集もフレーム精度です。単語をひとつ消せば、その単語の音声だけが取り除かれ、前後の文はそのまま残ります。
リアルタイム同期
文字起こし編集が瞬時に感じられるのは、この土台があるからです。文字起こしから単語を削除すると、次のことが起こります。
- 文字起こしの更新が書き込まれる
- その変更が接続中のすべての表示に伝わる
- タイムラインに編集が反映される
これがミリ秒で完了します。再レンダリングや再同期を待つ必要はありません。テキストを打つ速さのままタイムラインが更新されます。Wistiaの調査が示すとおり、締まった編集ほど視聴維持率は高くなります。だから速さが効いてきます。
AIエージェントとの連携
文字起こし編集は、AIエージェントと組み合わせるとさらに強力になります。手作業で選んで消す代わりに、やりたいことを説明してください。AI字幕と組み合わせれば、字幕づくりまで一本で通ります。
- 「言いよどみを全部消して」 – エージェントが「えー」「あの」「なんか」「その」「まあ」といった言いよどみを見つけて削除します
- 「料金について話している部分をカットして」 – エージェントが該当する段落を探して取り除きます
- 「まとめを事例紹介の前に移して」 – エージェントが文字起こしのセクションを並べ替えます
- 「2秒より長い無音をすべてカットして」 – エージェントが全体のテンポを締めます
AIエージェントは文字起こし編集をプログラム的に実行するので、手作業なら何分もかかる一括処理を引き受けます。
言いよどみを31か所削除、長い無音を12か所詰め、締めの発言をイントロ直後に移動。全体の尺は8:42から6:15に短縮。
| Feature | ChatCut | Descript |
|---|---|---|
| AIエージェントによる自動化 | 自然言語の指示で一括編集を実行 | 文字起こしを手作業で編集 |
| 言いよどみの除去 | AIエージェントが一言ですべて削除 | 手動または半自動 |
| 中国語への対応 | 専用エンジンによる的確な分割 | 基本的なCJK対応のみ |
| リアルタイム同期 | ミリ秒単位のリアルタイム同期 | 処理後に同期 |
| 一括操作 | 編集内容を伝えれば、AIが文字起こし全体に適用 | セクションごとの手作業 |
| Feature | ChatCut | CapCut |
|---|---|---|
| 文字起こし編集 | 7つの操作を備えた本格的な文字起こし編集 | 自動字幕のみ。文字起こし編集は不可 |
| 単語単位の削除 | どの単語も削除でき、映像が即座に更新 | 非対応 |
| テキストでの並べ替え | 段落をドラッグして映像を組み替え | 非対応 |
| AIエージェント | 自然言語による一括編集の指示 | エージェントによる編集はなし |
| 話者識別 | 自動識別と付け替えに対応 | 限定的 |
編集内容を伝えるだけ。実行はChatCutが引き受けます
文字起こし編集とAIエージェントの組み合わせは、従来の動画編集とは根本的に違う進め方を生みます。タイムラインを操作するのではなく、完成形を説明すれば、システムがそれを形にします。
「ゲストが機械学習について話している部分だけ残して、あとは全部削除、空白も詰めて」
これは複雑な編集です。従来の編集ソフトなら、素材を探し、印を付け、カットし、リップル削除して15分。ChatCutなら一文です。
説明に合致する12:34〜15:08の区間を特定。文字起こしとタイムラインから削除し、空白を詰めました。尺は2:34短縮。