写真にモザイクをかけるのは一度の作業です。動画では、それを全部のコマに対してやることになります。ここが手間の正体です。

まず量の話

動画は静止画の連続です。30fps なら1秒あたり30枚。

動画の長さ コマ数(30fps)
10秒 300枚
1分 1,800枚
10分 18,000枚
20分 36,000枚

10分の動画で18,000枚。1枚に1秒かけても5時間かかります。現実的に、全部を手で塗ることはできません。

編集ソフトのやり方とその限界

そこで動画編集ソフトはキーフレームという仕組みを使います。「1秒目はここ」「3秒目はここ」と数か所だけ位置を指定すると、その間は直線で補間してくれます。

これは対象がまっすぐ動いているときはうまくいきます。うまくいかないのは次のような場面です。

動きが直線でないとき。 往復する動き、急に方向が変わる動きでは、キーフレームの間を直線で結ぶと実際の位置から外れます。折り返しの手前で内側を通ってしまい、対象がモザイクの外に出ます。

対象が隠れて、また出てくるとき。 一度見えなくなって数秒後に別の場所から現れる場合、その間をどう補間しても正しくなりません。区間を切って指定し直すことになります。

カットが挟まるとき。 場面が切り替わったのにキーフレームが繋がっていると、まったく関係のない画にモザイクが乗ります。

つまりキーフレームは「量」の問題を減らしますが、どこに置くかを人が判断する必要は残ります。動きの複雑な素材ほど、置く数が増えていきます。

自動化が何をしているか

AIによる自動化は、この判断の部分を肩代わりします。やっていることは大きく2つです。

1. コマごとに対象を探す。 隠したいものが今どこにあるかを、画面の中から見つけます。人がキーフレームを置く代わりに、機械が毎回位置を出します。

2. 見つからなかったコマを繋ぐ。 検出は毎回成功するとは限りません。前後のコマで見つかっていれば、その間を繋いで塗ります。

キーフレーム方式との違いは、位置の情報が「人が指定した数点」ではなく「機械が出した多数点」になることです。点が多いほど、間を繋いだときのズレは小さくなります。

この中で何が起きているかはAIはどうやってモザイクをかける場所を見つけているのかで詳しく説明しています。

自動化でも難しい場面

正直に書いておくと、自動化にも苦手があります。

速い動き。 検出の間隔より速く動くと、間を繋いだ位置が実際とずれます。動きが速い素材ほど、検出の回数を増やす必要があります。

対象が見えにくいコマ。 ブレている、暗い、一部しか映っていない。こうしたコマでは機械も見つけられません。見つからないコマが続けば、そこは塗られません。

長く隠れる場面。 数秒間まったく映らない区間は、前後を繋ぐべきかどうかの判断が難しくなります。繋げば関係のない場所を塗る危険があり、繋がなければ隠し漏れます。

だからこそ、公開する前に必ず自分の目で確認することが前提になります。確認の手順は公開前に隠し漏れを見つける手順にまとめました。

どちらを選ぶか

対象が少なく、動きが単純で、動画が短いなら、編集ソフトのキーフレームでも十分です。

自動化が効くのは、長い・対象が多い・動きが複雑な素材です。手作業では現実的でない量を処理でき、そのぶん確認に時間を回せます。

外に頼むという選択肢もあります。判断の軸はモザイク処理は外注すべきか、自分でやるべきかにまとめています。

忍者モザイクは動画と画像の自動モザイクを無料で提供しています。使い方は使い方ガイドを参照してください。