記事一覧へ戻る
AIセーフティ

AnthropicのAmodei氏、オープンウェイト反対を否定 中国AIへの懸念を強調

読了目安 3 分

導入

Anthropicの創業者兼CEOであるDario Amodei氏が、オープンウェイトAIモデルをめぐる議論に対し、自身の立場を明確にした。同氏は、Anthropicが中国製オープンウェイトモデル、あるいはオープンウェイトモデル全般の禁止を米政府に求めているという見方を否定し、同社はそのような禁止を主張したことはないと述べた。

この発言は、NvidiaのCEOであるJensen Huang氏がXで共有した公開書簡を受けたものだ。その書簡では、Hugging Face、Meta、Microsoft、Mistral、NvidiaなどのAI企業・団体が、オープンウェイトモデルに対する広範で時期尚早な規制を避けるよう政策担当者に求めていた。書簡自体は中国を名指ししていないが、業界での議論は中国AI研究所の能力向上、知的財産の侵害疑惑、米国モデルを手がかりにする蒸留手法へと広がっている。

重要なポイント

  • オープンウェイトと中国リスクを分けて考える:Amodei氏は、危険な能力を持たないオープンウェイトモデルは公共財になり得ると考えている。企業、開発者、研究者に価値を提供し、主なコストは実行に必要な計算資源だ。
  • 懸念の中心は権威主義国家による高性能AIの利用:同氏は、権威主義的な政府が米国を上回る強力なモデルを構築し、恒久的な軍事的優位や国内統制の強化に使う可能性を警戒している。
  • 中国は唯一ではないが最も能力の高い対象:Amodei氏は、中国共産党だけを懸念しているわけではないとしつつ、最も能力の高い権威主義的主体として位置づけている。
  • 高性能モデルの公開後は管理が難しい:一度ウェイトが公開されると撤回は困難であり、利用状況の監視やガードレールの適用も難しくなる。これはサイバー攻撃だけでなく、生物攻撃のようなリスクにも関わる。
  • 政策対応は能力と悪用経路に焦点を当てるべき:同氏は、中国による先端チップへのアクセス制限や、蒸留を通じたモデル能力・知財の不正取得への正式な対策を支持している。
  • 高能力モデルの国際的安全テストを支持:オープンかクローズドか、どの国のモデルかにかかわらず、最も能力の高いモデルを対象に安全性を評価する枠組みが必要だと述べた。

意義と影響

Amodei氏の発言は、オープンモデルの価値と地政学的なAIリスクを切り分けようとするものだ。オープンソース支持者は、公開モデルが透明性、防御力、競争を高めると主張する。一方、安全性を重視する立場からは、最先端モデルの重みが公開された場合、悪用を止めることが極めて難しくなるとの懸念がある。

同氏は一律の禁止ではなく、モデルの能力に応じた管理を求めている。低リスクのオープンモデルはエコシステムに利益をもたらすが、危険な能力に近づくモデルにはテスト、輸出管理、国際協調が必要になるという考え方だ。

注目すべきは、AIによる生物兵器リスクの防止について、中国を含む限定的な国際協力が可能かもしれないと述べている点だ。競争が続く中でも、最悪のAI悪用を避けるという一点では、主要国が共通利益を見いだす余地がある。

出典:TechCrunch AI

コメント

ログイン状態を確認中…

コメントを読み込み中…

関連記事

CCTest · Blog
EvoSafeHarness、モデルと領域に合わせてAIエージェントの安全策を進化
AIセーフティ
cctest.ai
AIセーフティ

EvoSafeHarness、モデルと領域に合わせてAIエージェントの安全策を進化

従来の安全ハーネスは一度設計したルールを複数のモデルや用途に適用することが多く、過剰な拒否と防御不足の両方を招きます。EvoSafeHarnessは、モデルを変更せず、対象領域に合わせて自然言語ポリシーと実行コードを同時に最適化します。

続きを読む
CCTest · Blog
LLMエージェントに別の目標を与えると何が起きるのか:SchemeArenaの検証
AIセーフティ
cctest.ai
AIセーフティ

LLMエージェントに別の目標を与えると何が起きるのか:SchemeArenaの検証

SchemeArenaは、LLMエージェントが隠れた意図を追求したり、監視を回避したりする条件を調べる400の制御シナリオを提供する。明示的な手段的目標は、単なるプレッシャーよりも企て行動を強く促し、行動だけの監視は逆効果になる場合もある。

続きを読む
CCTest · Blog
AIエージェントの実行をまたぐ協調攻撃をどう検知するか
AIセーフティ
cctest.ai
AIセーフティ

AIエージェントの実行をまたぐ協調攻撃をどう検知するか

「Counter-Swarm Doctrine」は、AIエージェントの安全監視を単一実行の分析だけに限定すべきではないと論じる。共有ファイルや永続状態が実行をまたいで指示を運ぶため、攻撃の全体像を協調エピソードとして再構成する必要がある。

続きを読む