記事一覧へ戻る
AIセーフティ

Meta広告にAI「脱衣」アプリ、女性政治家を狙う深刻な監視漏れ

読了目安 3 分

導入

Metaのプラットフォームで、KromixというAI画像・動画サービスの広告が掲載されていたことが明らかになった。Kromixは「AI image styler」と名乗りながら、「制限なし」の生成機能を宣伝し、実在人物を性的な場面に登場させられるような説明をしていた。ある動画広告では、米国の著名な女性政治家に酷似した女性が米国旗の前に現れ、その後、同じ顔の女性がポルノ映像に登場した。広告は、記者や研究者から問い合わせを受けた後に削除された。

今回の問題は、生成AIによる悪用が一部の匿名サイトだけで起きているのではなく、大手プラットフォームの広告とアプリ流通網にも入り込んでいることを示す。

主なポイント

  • Kromixは有料ユーザーに写真のアップロードを促し、「寝室でのレイプ」などの有害なシナリオを含む機能を提供していた。
  • 広告は男性ユーザーだけを対象にし、「次世代AIの魔法を解き放て」といった文言を使用していた。動画の表紙には海岸や山、滝などを置き、後続の性的内容を隠すものもあった。
  • Metaの広告ライブラリによると、関連アカウントは32本の広告を運用していた。掲載期間は5時間から46時間で、多くは10回以下の表示だった。
  • Metaは、脱衣サービスを宣伝する広告を大量に削除し、検知技術を強化していると説明した。一方で、完全な検知はできないとも認めている。
  • Appleは、初回審査後に禁止された内容や機能が追加された可能性があるとして、KromixをApp Storeから削除した。

なぜ審査を通過したのか

Metaの広告規則は、裸体や性行為、性的な示唆を含む広告を禁じ、脱衣アプリや「AIキス」アプリの宣伝も認めていない。それでも審査は主に自動化された仕組みに依存している。新しく作ったページ、少額のテスト配信、婉曲な文言、無害なサムネイルを組み合わせれば、検知を遅らせられる可能性がある。今回のページは作成から日が浅く、フォロワーもいなかった。

さらに、広告そのものではなく、リンク先のアプリが写真をアップロードした後に危険な画像を生成する場合、表面上の素材だけを確認する審査では能力を把握しにくい。過去にもMetaでは、未成年者を性的に扱う広告や、性的場面への顔合成機能を持つアプリの広告が確認されている。

意味と影響

同意のない性的ディープフェイクは、被害者の名誉、仕事、プライバシー、安全を脅かす。女性政治家は公式写真や記者会見の映像が大量に公開されているため、攻撃対象になりやすい。誰でも使える低コードの生成ツールが普及すれば、無害だった公開素材が性的嫌がらせや政治的な中傷の材料に変わる。

プラットフォームに必要なのは、問題の広告を削除するだけの対応ではない。広告、アプリの機能、開発者アカウント、アップデート、決済や配布先を横断して調べる必要がある。Metaは削除したアプリや開発者の情報を他社と共有するとしているが、外部から指摘されて初めて削除する仕組みでは十分とは言い難い。今後の課題は、露骨な画像を見つけることから、有害なサービス全体とその回避手法を特定することへ移っている。

出典:Ars Technica AI

コメント

ログイン状態を確認中…

コメントを読み込み中…

関連記事

CCTest · Blog
幻覚を連続スパンとして検出する時系列マルチシグナル融合
AIセーフティ
cctest.ai
AIセーフティ

幻覚を連続スパンとして検出する時系列マルチシグナル融合

新たな研究は、トークンを個別に判定するのではなく、幻覚を文中の連続したスパンとして扱う。テキスト統計、NLI、言語モデルのサプライザルを統合し、モデル内部にアクセスせず検出精度を高めた。

続きを読む
CCTest · Blog
HarnessRisk、エージェント・ハーネスをライフサイクル全体で評価
AIセーフティ
cctest.ai
AIセーフティ

HarnessRisk、エージェント・ハーネスをライフサイクル全体で評価

HarnessRiskは、個別の攻撃手法だけでなく、エージェント・ハーネスの6つの運用段階を対象に安全性を測るベンチマークです。危険の検知や高いタスク達成度だけでは、安全な実行を保証できないことを示しました。

続きを読む
CCTest · Blog
DeepSeek Harnessの間接プロンプトインジェクション耐性を検証
AIセーフティ
cctest.ai
AIセーフティ

DeepSeek Harnessの間接プロンプトインジェクション耐性を検証

AI-Infra-Guardを用いた研究が、DeepSeek Harnessに対して1万4,560回の制御実行を行い、間接プロンプトインジェクションへの耐性を調べた。隠れたUnicode文字や偽の完了通知などが、条件によってエージェントの挙動に影響し得ることが示された。

続きを読む