Agentic Development Environment · 無料・オープンソース

動画編集のための
ADE。

1本撮れば、YouTube・TikTok・YouTube Shorts の3本に。技術動画と語り動画のために、画面・カメラ・マイクを同時に収録。あとは Claude Code や Codex などのターミナルのAIエージェントが、決めておいたテンプレートどおりにカット・字幕・レイアウトを仕上げます。判定モデルがカットの境目をフレーム単位でチェックし、修正はプレビューを見ながら喋って囲むだけ。

macOS · Windows · Linux · MIT ライセンス · 1本の素材 → YouTube・TikTok・Shorts

画面・カメラ2台・マイクを、それぞれ別のトラックで同時に収録。

アプリの動きを表した模型のアニメーションです。

対応エージェントClaude CodeCodexGemini CLIOpenCodeCursorGitHub Copilot独自のCLI

使い方

撮ったテイクから完成まで。タイムラインは触らない。

すべての手順は、エージェントが実行するコマンドです。順番はテンプレートが決め、solocut next が「今やること」を常にエージェントへ伝えます。

  1. テンプレートを選ぶ

    TikTok 縦型トーク、YouTube 解説、長尺からショート…。フォーマット、レイアウト、カット方針、字幕スタイルが決まります。

  2. 撮る

    画面・カメラ・マイクを同時に、それぞれ別トラックで。別のカメラの素材もあとから足せます。

  3. エージェントに頼む

    「編集して」。Claude Code や Codex がテンプレートどおりに、同期・文字起こし・粗カット・字幕・レイアウトを進めます。

  4. 判定モデルが決める

    切るか残すか、どのテイクを使うか、字幕をどこで改行するか。迷うものだけがあなたに届きます。

  5. 全フレームをチェック

    カットの境目、黒コマ、字幕のセーフエリア、顔との重なり、画面に映った個人情報、モザイクの追跡。

  6. プレビューに喋る

    気になるところを囲んで話すだけ。タイムコード付きの指示になってエージェントへ。あとは書き出し。

撮影

画面とカメラを同時に。別カメラは、あとから自動で同期。

入力ごとに別トラックで保存するので、ワイプ、上下分割、カメラのみ、画面のみを、テンプレートで区間ごとに切り替えられます。

  • 画面・カメラ・マイク・PCの音声を、同じ時計で同時に収録
  • ミラーレスや iPhone で撮った素材を取り込むと、音声でフレーム単位に自動同期。長尺の時計のズレも補正
  • カンペ、カウントダウン、話しながら「今のNG」「ここ重要」を残すホットキー
  • 1秒ごとにファイルへ書き込むので、落ちても消えない
画面
カメラ
カメラB
マイク

✓ カメラB を同期 · オフセット −128 フレーム · 信頼度 0.97

テンプレート

動画の作り方は、一度決めておく。

テンプレートは、見た目・プロンプトで書いた編集方針・作業手順をまとめた定義です。Solocut がテンプレートからエージェントへの指示書を生成するので、どのエージェントでも同じ手順・同じ品質基準で仕上がります。

  • 組み込み:技術解説、技術ショート、語り(YouTube)、語り(TikTok)、長尺からショート
  • 技術動画用は、クリックした場所への自動ズーム、押したキーの表示、カーソルの強調つき
  • 複数カメラの画角の切り替えも、方針を言葉で書いたプロンプトどおりにエージェントが行います
  • solocut next が手順と合格条件を守らせます
# templates/tiktok-talk/template.yaml
id: tiktok-talk
canvas: { width: 1080, height: 1920, fps: 30 }
layouts: [camera-full, screen-top-camera-bottom]
cut:
  silence: { minMs: 300, padMs: 80 }
  fillers: [えー, えっと, あのー]
  retakes: keep-last
captions: { style: tiktok-bold, highlight: word, safeArea: tiktok }
audio: { loudness: -14, truePeak: -1 }
checks: [cut-boundaries, caption-safe-area, pii-on-screen]
pipeline:
  [ingest, sync, transcribe, rough-cut, captions,
   layout, preview, check, review, final]

ターミナル

エージェントも、サブスクも、ターミナルも、いつものまま。

アプリの中で、エージェントのCLIを本物のターミナルとして動かします。タブで切り替えても、状態はプロジェクトのファイルにあるので、別のエージェントがそのまま続きを進められます。

  • どのCLIエージェントでも

    Claude Code、Codex、Gemini CLI、OpenCode、Cursor、GitHub Copilot、独自のコマンドも。

  • 切り替えと引き継ぎ

    使用量の上限に達したら、次のエージェントが引き継ぎメモを読んで続けます。

  • いつも最新

    Solocut 自体は Cloudflare から署名付きで自動更新。エージェントCLIの新しい版もお知らせします。

  • CLIだけでも動く

    solocut はアプリなしでも、手元のターミナルや CI で使えます。

  • すべての編集を戻せる

    編集は操作のログとして残ります。誰が・何を・なぜ変えたかが分かり、いつでも戻せます。

  • 元の素材は書き換えない

    撮った素材は読み取り専用。それ以外はすべて作り直せます。

判定モデル

大事なフレームは、すべて最終チェック。

まず機械的なチェック(黒コマ、フリーズ、ラウドネス、仕様)。次に判定モデルが、すべてのカットの前後、字幕の切り替わり、モザイクのフレームを見て、型の決まった問いに確率で答えます。自信があるものは自動で反映、迷うものだけがあなたに届きます。

カット 00:12:04目は開いている · 合格 0.94
字幕 c18セーフエリア内
カット 00:41:07言葉の途中? 0.58 → 確認へ
フレーム 01:02:11メールが見える → モザイク
  • Ollama で完全ローカル、または自分の API キーで(TypeSafe、OpenAI、Anthropic、Gemini、Workers AI)
  • プロジェクトごと・1日ごとの費用の上限と、すべての呼び出しの記録
  • 送るのはフレーム画像と文字起こしだけ。同意してからのみ

モザイク

個人情報は、自動で隠して追いかける。

メールアドレス、通知、APIキー、電話番号、映り込んだ他人の顔やナンバープレートを検出・追跡して、モザイク・ぼかし・塗りつぶしをかけます。範囲は元の素材の座標で持つので、レイアウトを変えても 9:16 に切り出しても、ずれません。

// timeline.json
"masks": [{
  "kind": "pixelate",
  "reason": "pii:email",
  "source": "t1.screen",
  "track": [
    { "frame": 120, "box": [412, 88, 260, 28] },
    { "frame": 180, "box": [412, 40, 260, 28] }
  ],
  "confidence": 0.93
}]

動画でフィードバック

直してほしいところは、書かずに指す。

プレビューを再生して、喋る・止める・囲む。端末内で文字起こしして、指摘ごとに「タイムコード、ペン入りのフレーム、あなたの言葉、指した字幕やクリップ」にまとめます。ワンクリックでエージェントへ。

ベンチマーク

URL を貼るだけ。真似るのは動画ではなく、パターン。

参考にしたい動画(自分の動画や、許可を得た動画)をアプリ内のブラウザで開き、再生している間に、字幕の出し方、効果音の入れどころ、話し声に対する BGM の音量、カットの間隔を測り、使えるテンプレートにします。動画はダウンロードも保存もせず、残すのは数値だけです。

youtube.com/watch?v=…

字幕
下から 22% · 1行 14 文字 · 単語ハイライト · 黄色で強調
カット
平均 2.4 秒 · 1分に 14 回のジャンプカット · ズーム ×1.12
BGM
Lo-fi · 88 BPM · 声より −21 dB · ダッキングあり
効果音
1分に 9 回 · 強調で「ポン」· 章の切り替えで「シュッ」
声
1分 380 文字 · −15 LUFS

talk-tiktok に取り込む

ライブラリ

定番のオープンなツールを、必要なときにダウンロード。

Solocut 本体は小さく保ちます。FFmpeg や whisper.cpp などは初めて使うときに取得し、バージョンを固定してハッシュ値で検証。特別な利用条件があるツールは、入れる前に同意を確認します。

FFmpegカット・合成・字幕・音量
whisper.cpp端末内の文字起こし
RemotionReact のモーショングラフィックス
利用条件あり
HyperFramesHTML のモーショングラフィックス
RevideoTypeScript のモーショングラフィックス
MediaPipe顔検出・リフレーム・モザイク
PySceneDetectシーン検出
OpenTimelineIOPremiere / Resolve / FCP へ

Solocut の特長

1人のために作りました。

  • 1本撮れば、3本できる

    20分撮って「動画を完成させて」と言うだけ。YouTube の本編、縦型の TikTok、YouTube Shorts の3本が、字幕・サムネイル・投稿文付きで仕上がります。

  • 用意済みのプロンプト

    粗カット、フィードバック対応、ショートを3本、投稿文の作成…。どれもワンクリック。プロンプトの中身は JSON で自由に変えられます。

  • 3本まとめて投稿

    1回承認すれば、YouTube・TikTok・YouTube Shorts に3本を投稿し、X・Instagram・Threads・Facebook で告知。承認するまで何も投稿されません。

  • 画像生成でサムネイル

    フレームを選んで、Codex や Gemini のサブスク、OpenAI や Google の API キーでサムネイルを生成。日本語のタイトルは崩れないよう確実に組みます。

  • 効果音・BGM はすぐ使える

    自由に使える効果音・BGM・イラストのライブラリ。あなたかエージェントが選んだときに、その素材だけをダウンロード。クレジット表記も自動で作ります。

  • 過去の動画をいつでも参考に

    完成した動画とその timeline.json をすべて検索できる形で保存。「先月のあの回みたいに」と頼めば、エージェントがその作りに合わせます。

  • 設定はすべて JSON

    設定は公開スキーマ付きの JSON ファイル。手で編集しても、エージェントに「変えて」と頼んでもOK。

  • 無料・オープンソース

    MIT ライセンス。アカウント登録、透かし、サブスクリプションはありません。

  • 初期設定でプライベート

    チェックにクラウドのモデルを選ばない限り、動画と音声は端末から出ません。

  • macOS・Windows・Linux

    3つのOSで同じアプリ、同じ結果。

  • YouTube・TikTok にそのまま

    YouTube、TikTok、Shorts、Reels 向けの書き出し設定。セーフエリア、音量、メタデータまで。

  • 日本語の字幕に強い

    BudouX による自然な改行、単語ハイライト、強調、用語の誤変換の修正。

  • 見たままが仕上がる

    プレビューと本番の書き出しは、同じエンジンで作ります。

よくある質問

本当に無料ですか?

はい。Solocut は MIT ライセンスです。編集の頭脳には、すでにお持ちのエージェントのサブスクリプション(Claude Code、Codex など)を使い、判定モデルはローカルでも動かせます。

今すぐ使えますか?

まだです。Solocut は公開の場で設計・開発を進めています。最初のリリースは GitHub のリポジトリを Watch してお待ちください。

編集の知識は必要ですか?

いりません。撮って話すだけで、テンプレートとエージェントが編集します。あなたは結果を見て直してほしいところを伝えます。

Remotion は必須ですか?

いいえ。書き出しエンジンは FFmpeg です。Remotion はモーショングラフィックス用の追加オプションで、インストール前に利用条件を表示します。代わりに HyperFrames や Revideo も使えます。

どのプラットフォーム向けに書き出せますか?

YouTube(16:9、最大 4K)、TikTok・YouTube Shorts・Instagram Reels(9:16)。字幕、チャプター、メタデータも出力します。

投稿もしてくれますか?

はい。YouTube と TikTok への投稿と、X・Instagram・Threads・Facebook での告知ができます。必ずあなたが内容を確認・承認してから投稿します。

1人で撮って、毎日出す。

Solocut は開発中です。GitHub で進み具合を追いかけてください。