品質スコアカード

品質スコアカード

品質スコアカード. 許可された写真、一括、集合写真の対応付け、動画、GIFに対応するブラウザ型AI顔交換。 Conteúdo localizado: ja. 情報源確認済みの比較.

DeepSwapAI製品チームによるプロトコル公開日:7月18日、ベンチマーククロスウォークレビュー日:2026年7月28日人間レビュープロトコル

品質スコアカード

品質スコアカードの用途、境界、確認方法を日本語で説明します。以下の検証済み本文では製品の事実、数値、リンク、出典をそのまま保持しています。利用するメディアの許可を確認してください。

情報源確認済みの比較: 許可された写真、一括、集合写真の対応付け、動画、GIFに対応するブラウザ型AI顔交換。

顔交換品質スコアには可視基準と証拠境界が必要です

このスコアカードは、1つの特定の出力の人間レビューを構造化します。生体認証で顔を検査したり、未知の結果を予測したり、1つの好ましいサンプルをモデル全体またはプロバイダー全体に関する主張に変えたりしません。

7つの可視基準同一性、ブレンド、ポーズ、照明、オクルージョン、技術的完全性、および動作安定性。
3つの重要なゲート許可、意図された同一性マッピング、および公開開示は、数値とは別に保持されます。
0件のアップロードレビューデータこのページはメディアファイルを受け付けません。評価、メモ、計算、エクスポートはこのブラウザタブ内に留まります。

1つの出力を同じ基準でスコアリングする

メディアタイプを選択し、ゲートを完了し、該当するすべての基準を評価し、他のレビュー担当者が見つけられるように短いエビデンスノートを残してください。

ローカルで動作
出力タイプ
重要な公開ゲート

スコアは未解決のゲートを上書きできません。

可視出力を評価する

使用不可能な失敗には0を、レビュー対象サンプルに重大な欠陥が観察されない場合にのみ4を使用してください。

アイデンティティの保存可視の目、眉、鼻、口、顎、年齢の手がかり、および全体的な同一性は、意図された参照と一貫性を保っていますか?24% 基本ウェイト · 通常の表示サイズでレビューし、次に最も難しい可視ポーズまたはフレームで顔を検査します。
顔境界とブレンド肌のテクスチャ、顔のエッジ、耳、顎、生え際、首が、貼り付けられた境界なしにターゲットシーンに移行していますか?16% 基本ウェイト · 高コントラストのエッジと顔の中心だけでなく、顔の全周囲を検査します。
ポーズと表情の一貫性顔の形状は、ターゲットの頭の角度、視線、目の状態、口の形状、表情と一貫性を保っていますか?14% 基本ウェイト · 横向きのプロファイル、閉じた目、開いた口、笑顔、急な頭の傾きを優先します。
照明と色の連続性露出、色、肌の陰影、ハイライト、影は、ターゲットシーンと一貫性を保っていますか?14% 基本ウェイト · 指向性光、色付き光、影の境界、明るい領域と暗い領域の間の遷移を確認します。
オクルージョンとアクセサリーの連続性髪、手、メガネ、マスク、マイク、前景オブジェクト、その他のオクルージョンは、正しい視覚的順序を保っていますか?12% 基本ウェイト · オブジェクトが顔を横切る、または顔が別のオブジェクトの背後に移動するすべてのポイントを確認します。
技術的完全性出力に、重大なぼやけ、リンギング、ブロックアーティファクト、ティアリング、重複した特徴、急激なテクスチャ変化、または破損したフレームはありませんか?10% 基本ウェイト · 意図された配信サイズで検査し、意図的なモーションブラーや被写界深度をそれ自体で欠陥として扱わないようにします。
時間的安定性動作全体を通して、同一性は、ちらつき、ドリフト、顔の消失、突然の形状変化、または可視のループシームなしに安定していますか?10% 基本ウェイト · 通常速度で全クリップをレビューし、次に最も難しいターン、オクルージョン、カット、ループ境界をフレームごとに再生します。

すべての基準に同じ0から4の意味を使用する

スケールは、その基準についてサンプリングされた素材で観察された最も強い欠陥を説明します。これは信頼スコア、確率、または生体認証測定値ではありません。

評価アンカー定義
0使用不可失敗または重大な欠陥により、意図された使用が妨げられます。
1重大な欠陥明確に可視の欠陥が通常の視聴を支配します。
2顕著な欠陥欠陥が簡単に気づくことができ、対象を絞った修正が必要です。
3軽微な欠陥小さな欠陥がレビューで可視ですが、通常の視聴を支配しません。
4重大な欠陥は観察されないこの基準について、サンプリングされた出力に重大な欠陥は観察されませんでした。

ウェイトは明示的であり、モーションはモーションが存在する場合にのみスコアリングされます

ビデオとGIFは100の基本ウェイトポイントすべてを使用します。写真は時間的安定性を除外し、残りの90ポイントを100ポイントの結果に正規化します。

基準基本ウェイトメディアレビューの質問
アイデンティティの保存24%写真、ビデオ、gif可視の目、眉、鼻、口、顎、年齢の手がかり、および全体的な同一性は、意図された参照と一貫性を保っていますか?
顔境界とブレンド16%写真、ビデオ、gif肌のテクスチャ、顔のエッジ、耳、顎、生え際、首が、貼り付けられた境界なしにターゲットシーンに移行していますか?
ポーズと表情の一貫性14%写真、ビデオ、gif顔の形状は、ターゲットの頭の角度、視線、目の状態、口の形状、表情と一貫性を保っていますか?
照明と色の連続性14%写真、ビデオ、gif露出、色、肌の陰影、ハイライト、影は、ターゲットシーンと一貫性を保っていますか?
オクルージョンとアクセサリーの連続性12%写真、ビデオ、gif髪、手、メガネ、マスク、マイク、前景オブジェクト、その他のオクルージョンは、正しい視覚的順序を保っていますか?
技術的完全性10%写真、ビデオ、gif出力に、重大なぼやけ、リンギング、ブロックアーティファクト、ティアリング、重複した特徴、急激なテクスチャ変化、または破損したフレームはありませんか?
時間的安定性10%ビデオ、gif動作全体を通して、同一性は、ちらつき、ドリフト、顔の消失、突然の形状変化、または可視のループシームなしに安定していますか?

再利用可能なプロトコルをダウンロード

JSONには、完全なスケール、ゲート、基準、計算式、決定バンド、エビデンス制限、ライセンス、および参考文献が含まれています。CSVは空白の7行レビューテンプレートであり、BibTeXファイルは安定した引用を提供します。

顔交換品質メトリクスは異なる質問に答える

防御可能なベンチマークは、ソース同一性転送、ターゲット属性保存、画像およびビデオ配信のリアリズム、フレーム間動作、出力のみの評価、および人間レビューを分離します。バージョン管理された決定マップは、各ファミリーが何を比較するか、および値を解釈する前に必要なプロトコルを命名します。

測定比較対象使用法境界
アイデンティティ検索または埋め込み類似度ソース同一性とスワップされた出力の比較。名前付きの顔エンコーダーまたはソースギャラリーを使用。出力は、固定された評価者の下で、ソース同一性の証拠をどの程度強く保持するか?同じプロトコル内では、通常、類似性または検索パフォーマンスが高いほど良い。エンコーダー、クロップ、ギャラリー、人口統計、しきい値、および前処理が値に影響します。これは一人の人物に対する生体認証の判定ではありません。
フレームごとのアイデンティティ類似度安定性検出された出力フレーム全体にわたる、1つの名前付き顔エンコーダーの下での、ソースから出力への同一性類似度のシーケンス。ポーズ、表情、オクルージョン、シーン条件が時間とともに変化するにつれて、ソース同一性の証拠は安定したままか?平均同一性類似度または検索結果がその横に報告されている場合にのみ、より低い分散がより大きな安定性を示す可能性があります。一貫して間違った同一性は低い分散を持つ可能性があります。分散は平均類似度または検索を置き換えることはできず、値はエンコーダーまたはフレームパイプライン間で移植可能ではありません。
ポーズと表情の誤差名前付き推定器の下での、ターゲットのポーズまたは表情推定値とスワップされた出力の比較。出力は、固定された推定器の下でターゲットの頭のポーズと表情をどの程度密接に保存するか?同じ推定器とパラメータ化内では、通常、誤差が低いほど良い。値は、異なる推定器、クロップ、パラメータ空間、ランドマーク規則、または前処理パイプライン間で移植可能ではありません。
Frechet Inception Distance (FID)生成された画像またはフレームの分布と、文書化された参照分布の比較。固定された特徴抽出器とサンプリングプロトコルの下で、2つの特徴分布はどの程度近いか?同じデータセット、抽出器、前処理、およびサンプルプロトコル内では、低いほど良い。1つの顔交換出力は、単一の画像が分布ではないため、防御可能なFIDを持つことはできません。FIDは同一性の正確さを分離しません。
Frechet Video Distance (FVD)名前付きビデオ特徴抽出器の下での、生成されたビデオクリップの分布と文書化された参照クリップ分布の比較。1つの固定されたクリップサンプリングプロトコルの下で、生成されたビデオと参照ビデオの特徴分布はどの程度近いか?同じデータセット、特徴抽出器、クリップ期間、フレームレート、前処理、およびサンプルプロトコル内では、低いほど良い。1つの出力クリップは、防御可能な分布レベルのFVD結果ではありません。FVDは、ソース同一性、ターゲット属性保存、リップシンクロナイゼーション、または特定の時間的欠陥を分離しません。
被写体と背景の一貫性出力フレーム間および先行フレーム、ターゲットフレーム、または参照フレームに対する特徴の一貫性。固定されたビデオプロトコルの下で、被写体と背景の特徴は動作を通じてどの程度安定しているか?同じ実装の下では、通常、一貫性が高いほど良い。一貫性だけでは、正しい同一性マッピング、視覚的リアリズム、動作の正確さ、または公開準備状態を確立できません。
視線、目の開口部、リップシンク、モーション診断ターゲットシーケンスと出力シーケンス間の、名前付きの目、オーディオリップ、ランドマーク、またはオプティカルフローの動作。生成されたビデオを通じて、どの特定の動的ターゲット属性が同期されたままか?方向と単位は名前付き診断に依存します。それぞれを個別に報告してください。これらの診断は互換性がなく、文書化されたビデオプロトコルが必要であり、すべてのメディアタイプに適用されるわけではありません。
学習済みノーリファレンス品質評価出力のみ。ランク付けされた人間の判断またはラベル付けされた品質データに対してトレーニングされたモデルによって評価されます。明示的な参照メディアが利用できない場合、トレーニングされた評価者は可視出力品質をどのようにランク付けするか?方向はモデル出力に依存します。文書化されたホールドアウト分布で検証してください。パフォーマンスはトレーニングデータと検証範囲に依存します。出力のみのスコアは、それ自体で正しいソース同一性転送を確立できません。
構造化人間スコアカード明示的な欠陥アンカー、公開ゲート、およびレビュアーノートに対する1つの可視出力。レビュー担当者は、この特定の出力でどのような可視欠陥または未解決の使用ゲートを観察するか?アンカー付き順序評価を使用します。結果を確率または生体認証スコアとして再解釈しないでください。レビューされたサンプルに関する主観的な証拠。モデルの精度、プロバイダーのランキング、確率、または生体認証類似度ではありません。

公開されたベンチマークプロトコルは互換性がありません

以下のクロスウォークは、一次論文によって記述されたセットアップのみを記録します。結果テーブルをコピーしたり、すべてのデータセットがダウンロード可能であると主張したり、異なる評価者からの値を1つのリーダーボードに変換したりするものではありません。

プロトコルとソース比較単位報告された測定値比較可能性の境界
CASIA FaceSwapping3つの因子分離プロトコルの下で組み立てられたソース-ターゲットビデオペア。通常:通常の録画からの4,500の重複しない同民族ペア。異民族:アジア人、アフリカ人、コーカサス人グループ間の両方向にわたる1,200ペア。異属性:通常の録画とポーズ、表情、または照明のバリエーションの両方向にわたる4,300ペア。同一性検索、同一性類似度、ポーズ誤差、表情誤差、FID、被写体一貫性、背景一貫性。このクロスウォークには人間レビュープロトコルは要約されていません。3つのスライスは、CASIAセットアップ内の異なる因子を分離します。それらの値は、その論文のペア構築、モデル、特徴抽出器、解像度、および集約に依存します。
IDBench-V論文で報告された200の実世界ソースビデオとターゲット画像ペア。小さな顔、極端な頭のポーズ、深刻なオクルージョン、複雑または動的な表情、および雑然とした複数人物シーンをカバーする1つの200ペア評価セット。ArcFace同一性類似度、InsightFace同一性類似度、CurricularFace同一性類似度、フレーム単位の同一性類似度分散、ポーズ誤差、表情誤差、背景一貫性、被写体一貫性、動作滑らかさ、FVD。論文は、同一性類似度、属性保存、およびビデオ品質について1〜5の評価を使用する19の評価者を報告しています。この行は、論文で報告されたプロトコルのみを記録します。公開ダウンロードの可用性を主張したり、結果を再現したり、その値を別のベンチマークに移植可能にしたりするものではありません。
CanonSwap VFSベンチマークVFHQからサンプリングされた100のソース-ターゲットペア。各ターゲットは最初の100フレームと4秒の対応するオーディオを使用します。固定されたフレームおよびオーディオウィンドウを持つ1つの100ペアビデオ顔交換評価セット。同一性類似度、同一性検索、ポーズ誤差、表情誤差、視線誤差、目のアスペクト比誤差、LSE-D、LSE-C、オプティカルフロー時間的一貫性、FVD。このクロスウォークには人間レビュープロトコルは要約されていません。プロトコルは、論文固有のフレーム、オーディオ、推定器、および特徴抽出器の選択を使用します。その値は、IDBench-VまたはCASIAの値と直接比較してはなりません。

メトリック決定マップをダウンロード

JSONは、9つのメトリックファミリーすべて、3プロトコルクロスウォーク、前提条件、解釈の方向、エビデンスの境界、および一次ソースを保存します。CSVにはメトリックファミリーテーブルが含まれています。BibTeXレコードは安定した帰属を提供します。

決定に適切なエビデンスを使用する: 自動化メトリクスには、固定データセット、評価者、前処理パイプライン、サンプル数、および繰り返し出力が必要です。このローカルスコアカードは、1つのレビュー結果における可視欠陥を記録し、意図的に自動化ベンチマークを模倣しません。

別の人が検査できるように、各レビューを十分に再現可能にする

  1. 出力タイプを選択し、サンプルを特定します。 写真、動画、またはGIFを選択し、サンプル識別子、レビューア、レビュー日を記録します。
  2. 3つの重要な公開ゲートを確認します。 許可を確認し、意図されたアイデンティティマッピングを検証し、AIコンテンツ開示が必要かどうかを確認します。
  3. 該当するすべての基準をレビューします。 該当する場合、アイデンティティ、顔境界、ポーズと表情、照明、オクルージョン、技術的完全性、時間的安定性を評価します。
  4. ゲートを上書きせずに加重結果を読み取ります。 結果を使用して修正を優先順位付けします。数値スコアは、未解決の許可、マッピング、または開示ゲートを決して上書きしません。
  5. 完全なエビデンスレコードをエクスポートします。 JSONまたはCSVをダウンロードし、ノートを保持し、比較する予定の各出力に対して同じプロトコルを繰り返します。
プロバイダー比較にはさらなるエビデンスが必要です: 同一の許容入力を使用し、反復独立実行、複数のレビュアー、文書化された視聴条件、統計的報告を行う。単一の選りすぐりの出力で平均的なモデル品質を確立することはできない。

主観的レビューは、その限界が可視化されている場合にのみ有用である

境界

スコアは、レビューされた1つの出力に対する構造化された人間の観察であり、生体認証による身元測定ではない。

境界

ルーブリックは、モデルの精度、平均品質、安全性、速度、信頼性、またはプロバイダーの優位性を確立するものではない。

境界

高いスコアは、同意、開示、法的、アクセシビリティ、または対象者固有のレビューに代わるものではない。

境界

プロバイダー間の主張には、同一の入力、反復実行、独立したレビュアー、文書化された視聴条件、および統計的報告が必要である。

数字が確立できることとできないこと

これにより私のメディアやメモがアップロードされますか?

いいえ。このページにはメディア入力はなく、スコアカードのコントロールはレーティングやメモをDeepSwapAIに送信しません。

これは生体認証による身元スコアですか?

いいえ。これは可視的な出力特性の文書化された人間の観察であり、顔認識の精度や埋め込み類似度ではありません。

1つのスコアでフェイススワッププロバイダーをランク付けできますか?

いいえ。防御可能な比較には、共有された入力、反復出力、複数のレビュアー、制御された視聴条件、および統計的報告が必要です。

なぜ写真から時間的安定性が除外されているのですか?

静止画像にはフレームシーケンスがありません。フォトモードは、該当する6つの基準を90ベースウェイトポイントから100に正規化します。

ルーブリックを再利用できますか?

はい。公開されたJSONと空のCSVはCC BY 4.0を使用しており、必要な帰属表示とダウンロード可能なBibTeXレコードが含まれています。

FIDは1つのフェイススワップ出力を測定できますか?

いいえ。FIDは生成画像セットと参照画像セットの分布を比較します。1つの画像は分布ではありません。

アイデンティティはソースとターゲットのどちらと比較すべきですか?

アイデンティティ検索と類似度は通常、出力をソースと比較します。ポーズと表情の保存は通常、出力をターゲットと比較します。

CASIA FaceSwapping、IDBench-V、CanonSwapの値を直接比較できますか?

いいえ。それらのペア構築、チャレンジスライス、評価者、特徴抽出器、フレームまたはオーディオウィンドウ、前処理、および集約方法は異なります。値を比較する前に、1つの共有プロトコルを再現してください。

顔交換を始める

許可された写真、一括、集合写真の対応付け、動画、GIFに対応するブラウザ型AI顔交換。

顔交換を始める