ケース

InterDead の動画アーティファクト制作時間を短縮し、再現可能なパイプラインを構築した方法

WhisperX、LLM キュー、FFmpeg を用いた InterDead 動画アーティファクト制作のケーススタディ。

日付: 2026-02-20

著者: Sam Starling

カテゴリー: ケース

タグ: interdead, case-study, pipeline, automation, ffmpeg, whisperx, llm

短い世界内動画の制作を速める試みは、InterDead の視覚的アイデンティティを定義する、制御可能な工学システムへ発展しました。

背景と目的

InterDead では、短い動画はアーティファクト、つまりアプリケーション・プロトタイプ InterDeadProto とプロジェクトサイトの双方に現れるダイエジェティックな痕跡として機能します。

安定したコンテンツ制作のため、反復ごとの手作業による再編集を避け、統一されたスタイル規則に従って速く予測可能に動画を組み立てる仕組みが必要でした。

全アーティファクトの構造式は単純です。

音声 + 背景画像 + 単語単位の時刻に同期した絵文字オーバーレイ

手動編集が機能しなかった理由

Canva と Adobe Premiere Pro による初期作業では、手動組み立てがボトルネックになりました。新しい動画ごとに全体の再同期が必要で、アセット間のスタイルが揺れ、小さな修正も独立した小規模プロジェクトになりました。

手動制作とパイプライン制作を並行して比較すると、手動編集は平均 2.5〜3 時間、パイプラインは 35〜50 分で安定しました。制作時間を 65〜75%短縮し、一貫性も大幅に向上しました。

維持した粗さ

パイプライン生成の動画は、手動編集より技術的な外観になります。この性質がアーティファクトの美学を支えました。FFmpeg の手続き型アニメーションやスプライトの動きも追加できますが、視覚的な抑制の方が InterDead の内部論理に合います。粗さは意図した特徴になりました。

パイプライン構成

開発は InterDeadReferenceLibrary/tools/ 内で行い、パイプラインは厳密に線形かつ決定論的です。

最初に whisperx_timing_builder が音声を受け取り、WhisperX で整列し、単語ごとの正確な時刻を持つ aligned.json を生成します。行ではなく単語で同期するため、客観的で測定可能なキューになります。

次に LLM プロンプト工程 が aligned.json、編集ブロック、テンプレート、全文トランスクリプトを使い、オーバーレイ用の構造化された cues[] 配列を生成します。ASR が断片を逃した場合は、時刻を創作せず明示的に印を付けます。

最終設定の完全自動化も可能ですが、最後の手動確認を除くことより意味の統制を優先しています。

最後に emoji_overlay_video_builder が FFmpeg で動画を組み立てます。固定絵文字セット、安全領域、一定の余白、決定論的なオーバーレイを使い、編集タイムラインではなく規則による合成だけを行います。

補助アセット

音楽は Suno で生成し、商用利用には有効なサブスクリプションが必要です。背景画像は GPT ベースの生成で作り、認識可能な色調と粒子感を形成します。絵文字は 72×72 PNG の Twemoji セットから描画し、プラットフォーム間で同じ結果を得ます。

結果

このパイプラインは、反復作業を減らし、視覚的な制約を徹底し、生成要素に対する工学的な統制を保つ制作方法です。再現可能性、予測可能性、スタイル規律を中核原則とします。

完全な技術仕様

ログ一覧へ戻る