モザイクは、フレームのある領域を格子に区切り、各セルのすべての画素を1つの値——ふつうはそのセルが覆っていた画素の平均——に置き換えます。たくさんの値が入り、1つの値が出てくる。操作はそれだけであり、それが、結果を元に戻せない理由です。
このレベルで理解すると、周辺の疑問が一度にいくつも片づきます。なぜブロックの大きさだけが意味のある変数なのか、なぜ修正は視聴しているサイトが施すものではなくファイルに焼き付いているのか、そしてなぜ「AIによる無修正化」が難問ではなく分類の誤りなのか。
モザイクは画素に対して実際に何をしているのか?
やっているのはブロック平均化です。対象の領域を格子状のセルに分け、セルごとに中の画素から1色を計算し、そのセル全体をその色で塗ります。
普通の映像フレームの16×16のセルを考えてください。操作の前、そこには256個の画素があり、それぞれに固有の色があります。輪郭や質感や陰影を記述する、256個の独立した値です。操作のあと、そこにあるのは1つの値を256回繰り返したものだけ。細部を記述していた255の自由度は、ファイルから消えています。動かされたのでも、隠されたのでも、暗号化されたのでもありません。平均されて消えたのです。
数学でこれを多対一の写像と呼びます。膨大な数の異なる元ブロックがまったく同じ平均を生むので、平均が与えられても、どの元がそれを生んだのかを決める手立てはありません。これは実装の弱点ではなく、この操作を定義づける性質そのものであり、この手法が選ばれた理由でもあります。
ブロックの大きさだけが本当の変数なのはなぜか?
モザイクについてのそれ以外はすべて、手法によって固定されているからです。どれだけの情報が生き残るかを変える選択は、セルをどれだけ大きくするか、それだけです。
セルが大きければ、より多くの画素をまとめて平均し、より多くを壊します。セルが小さければ構造がより残ります。小さいほうの端では形が読み取れる程度に残り、それこそが審査基準の存在理由です。ですから基準が規制しているのは粗さであり、日本の審査団体はモザイクの密度を審査項目のなかに挙げています。
その要件をどう表現しているかは公開されていません。各団体は表現規定を公表しておらず、公開サイトが現存する3団体のうちの1つであるOCCNは、それらは会員にのみ開示していると述べています。したがって、粗さがフレームの寸法に対する比率で定義されているのか絶対的な画素数で定義されているのか、そしてその値がいくつなのかは、出典を示せません。どこかで目にした具体的な数値は、出所不明のものとして扱ってください。いずれにせよ知っておく価値があるのは、画素数で固定するとSDと4Kではまったく別のことを意味してしまうので、この2つの言い方は交換可能ではない、ということです。
出典:OCCN(occn.or.jp)の審査ページおよび概要ページ、JCRC(jcrc.or.jp)のサイト構成。2026-08-03 に確認。
| 処理 | 何をするか | 何が残るか | 元に戻せるか |
|---|---|---|---|
| モザイク/画素化 | 格子のセルごとに1つの値へ平均する | 低周波の色と、おおまかな位置 | 戻せません——入力が潰されています |
| ガウスぼかし | 移動窓による加重平均 | モザイクより多くの低周波の構造 | 戻せません。ただし劣化は小さめです |
| 黒帯や塗りつぶし | 領域を一定値で上書きする | その領域については何も | 戻せません |
| 切り抜き・画角の変更 | 領域をフレームから外す | 何も | 戻せません |
| プレーヤー側のオーバーレイ | 再生時に上に描画する | すべて——ファイルは無傷です | 簡単に戻せます |
本当の意味でセキュリティの問題になるのは最後の行だけで、そしてそれは業界が使っていない唯一の方法です。
制作のどの段階でモザイクは施されるのか?
ポストプロダクションの段階で、審査に出す前のマスターに対してです。再生時ではなく、配信プラットフォームでもなく、配信用の映像を用意するエンコーダーでもありません。
この順序は意図的なもので、設計の核心です。修正が他のすべての上流で施されるため、下流の成果物はすべてそれを引き継ぎます。審査用のコピー、販売用のファイル、配信のビットレート階梯の各段、視聴者が撮るすべてのスクリーンショット。ストリームを傍受したり別の画質を要求したりすれば手が届く、という無修正版が存在する地点は、この連鎖のどこにもありません。
これは同時に、作品を配信しているプラットフォームが無修正の映像を持ったことは一度もない、ということでもあります。配信サイトに無修正版を求めるのは、そこに送られたことのないものを求めることです。
元の細部を復元できないのはなぜか?
ファイルがもうそれを持っていないからです。復元するには、逆写像を持たない操作を逆にたどる必要があります。
本当に元に戻せるものと比べてみてください。圧縮されたファイルを展開できるのは、圧縮が再構成のための手順を保存しているからです。暗号化されたファイルを復号できるのは、内容が鍵付きの変換の下で無傷のまま残っているからです。モザイクにはそのどちらもありません。手順もなく、鍵もなく、データを変換した写しもない。質感があった場所に、1つの数字があるだけです。
実地の確かめ方は簡単です。同じ灰色に平均される元ブロックを千通り用意し、それぞれにモザイクをかけて、結果を誰かに渡してみてください。それらは同一のファイルです。どんなに高度な処理でも、そのうちどれから始まったのかを言い当てることはできません。それらを区別していた情報が、入力に存在しないからです。
AIによる「復元」が実際に生み出しているものは何か?
もっともらしい創作です。無修正の画像で学習した生成モデルは、周囲の画素とも、ブロックの平均値とも辻褄の合うパッチを作れますし、それは説得力のある見た目になります。できないのは、正しくあることです。何が正しいかは、ファイルの中の何によっても決まらないからです。
効いてくる区別は、再構成と幻覚のあいだにあります。
- 再構成は、入力に存在する情報から出力を導きます。答えは元と照らして検証できます。
- 幻覚は、入力が課す制約と矛盾しない出力を生成します。同じ制約を等しく満たす出力はいくつもあり、それらを区別するものは何もありません。
モザイク除去は、常に後者にしかなりえません。モデルはそこにあったものを明らかにしているのではなく、同じブロックに平均されたであろう何かを描いているのです。その出力を原本として提示することは、この処理が支えられない事実主張であり、法や倫理の問題とは別に存在する問題です。
これはAI生成コンテンツ全般を貫いているのと同じ信頼性の問題です。常に自信ありげな出力を出すシステムは、出力を出したという事実によっては何も教えてくれません。
モザイクは動画の圧縮とどう関わるのか?
意外に思われますが、都合よく関わります。モザイクの領域は符号化が安いのです。
映像コーデックは、高周波の細部と、フレーム間の変化にビットを使います。モザイクの領域はその両方の逆です。一定色の広い平坦部が並び、輪郭は規則的な格子の上に載っています。ブロック単位のコーデックはこれを効率よく表現します。修正された領域は、置き換えられる前の細かい映像より少ないビット数で済むのがふつうで、その分の予算がフレームの残りに回ります。
目に見える副作用として、周囲の絵が眠くなるような低ビットレートでも、モザイクの輪郭だけはくっきり残ります。ブロックは圧縮のノイズではありません。よく取り違えられますが、本物の圧縮ノイズは動きやビットレートに応じて動くのに対し、モザイクの格子は、それが覆う領域に固定されたままです。
モザイクは、フレームから女優を特定する妨げになるのか?
なりません。モザイクが顔を覆うことはないからです。顔にもとづく照合のどの工程も、修正が触れていない画素の上で動いています。
検出が顔の領域と特徴点を見つけ、位置合わせがその特徴点で姿勢を正規化し、エンコーダーが位置合わせ済みの切り取りをベクトル——当サイトの場合は512個の数字——に変えます。この一連の仕掛けは、修正された領域の近くを見てすらいません。修正の濃い作品も無修正の作品も、顔のエンコーダーにとっては等しく読み取れます。
特定の可能性を実際に狭めているのは、そもそもどの情報源が索引されたかです。当サイトの索引は106サイトにわたる241,792件の顔を収めていますが、名前の付いた女優2,333人のうち2,246人は代表画像を単一のサイトから取っています(当サイト索引、2026-08 時点のスナップショット)。この情報源の偏りのほうが、どんな審査基準よりはるかに強く結果を縛っています。