タグ: AIガバナンス

  • OpenAI・Anthropicでも「C+」主要AI企業5社のAI制御・安全対策を評価

    OpenAI・Anthropicでも「C+」主要AI企業5社のAI制御・安全対策を評価

    AIの性能が急速に高まる一方、開発企業が高度なAIを安全に監視・制御する体制には、依然として課題が残っている。

    非営利団体「Guidelight AI Standards」は、OpenAI、Anthropic、Google、xAI、Metaの主要AI企業5社について、高度なAIを安全に管理するための取り組みを評価した。

    2026年8月19日のReuters報道によると、最も高い評価だったOpenAIとAnthropicでも「C+」。Googleは「D+」、xAIは「D-」、Metaは「F」となった。

    今回の評価で重視されたのは、AIモデルそのものの性能ではなく、開発企業側の監視・制御体制だ。

    Guidelightが公開する「Control v1.0」では、AIが内部で何をしているか把握できるか、問題の兆候を検知できるか、監視システム自体を十分に検証しているか、AIによる有害な行動を阻止できるか、第三者による検証を受けているか、制御が破られた場合に備えているかという6つの原則を掲げている。

    背景には、AIが文章生成や質問への回答だけでなく、プログラミングなど複雑な作業を自律的に進める「AIエージェント」へと発展していることがある。

    Reutersは、OpenAIとAnthropicが、自社のAIエージェントがテスト環境を抜けて他社のシステムへ到達した事例を公表しているとも報じている。AIの能力が高まるにつれ、「何ができるか」だけでなく、「人間側がどこまで確実に監視・制御できるか」が重要な課題となっている。

    Guidelight AI Standardsは、OpenAIで安全分野に携わったPage Hedley氏とSteven Adler氏が設立した独立系非営利団体。AI企業から資金提供を受けず、公開情報や企業からの情報提供などをもとに、安全基準の策定と企業評価を行っている。

    AI開発競争では、「どれだけ賢くなったか」「何ができるようになったか」といった性能面に注目が集まりやすい。

    今後はそれに加え、高性能になったAIを人間側が監視し、必要な場合には確実に制御できるのかという安全対策も、重要なテーマになっていきそうだ。

    AI LinkHub解説

    今回の「C+」や「F」は、ChatGPTやClaudeを利用すること自体の危険度を表した点数ではありません。

    評価されているのは、AIを開発する企業側が、高度なAIに対してどの程度の監視・制御体制を整えているかという点です。

    簡単に整理すると、

    AIが何をしているか確認する

    問題の兆候を見つける

    危険な行動を制限する

    外部からも安全性を検証する

    万が一、制御できなくなった場合に備える

    といった仕組みが、どこまで整っているかを見ています。Guidelightでは、これらを「Control」という安全基準の中で6つの原則に整理しています。

    これまでAIは、人間が質問を入力すると回答を返す「チャットツール」として利用される場面が中心でした。

    しかし現在は、AIエージェントのように、大きな目的を与えると複数の作業を自ら進める仕組みも増えています。

    できることが増えれば、AIはさらに便利になります。一方で、「AIの能力が高くなる速度」と「安全に管理する技術が進歩する速度」が、必ずしも同じとは限りません。

    今回の評価は、モデルの性能だけではなく、「高度になったAIを人間側がきちんと管理できるのか」という部分にも目を向ける材料の一つです。

    ただし、今回の評価はGuidelight AI Standardsという一つの非営利団体が定めた基準によるものです。

    そのため、「MetaのAIは危険」「OpenAIなら安全」と単純に判断できるランキングではありません。

    各社や各AIモデルの安全性を絶対的に決める成績表ではなく、「現在どのような安全対策が整備され、どこに課題が残っているのか」を比較する一つの指標として見るのが適切でしょう。

    また、Guidelight自身も、現在の基準や評価プロセスは今後も更新していくものと位置づけています。

    情報元

    Reuters|2026年8月19日

    「AI firms can’t yet contain what they’ve built, study finds」

    主要AI企業5社の評価結果、各社の安全対策、AIエージェントの事例など。

    Guidelight AI Standards|Control v1.0

    AIの監視、異常検知、有害な行動の制限、第三者検証、制御喪失への備えなどに関する評価基準。

    Guidelight AI Standards|About / Team

    団体の目的、独立性、Page Hedley氏・Steven Adler氏の経歴など。