OpenAI、フロンティアAIの強化学習を一部停止 安全対策を強化
AI要約
米OpenAIは、7月に発生したHugging Faceへの侵害インシデントや次期モデル「Astra」の高度なサイバー能力に対応するため、安全対策を強化し、フロンティアAIの強化学習を一部停止した。強化学習の停止期間中に研究環境のセキュリティ強化、レッドチーム演習、監視体制の拡充を進めている。監視はモデルの内部活動を詳細に検査し、30分以内の警報発報を目標とする。アラインメント手法も学習の全段階に適用し、報酬モデルの改善やリワードハッキング抑制に取り組む。OpenAIは安全基準を満たすことを優先しつつ、近く新モデルの投入も予定している。
元記事を読む →AI NEWS JAPAN ANALYSIS
AI NEWSジャパン独自の分析
この記事の独自分析は準備中です。
AI評価
85点 / 100点YANSU AI VIEW
やんすAIの視点
AI NEWS ジャパン独自の視点から、このニュースをひとこと解説します。

やんすAI
AI NEWS ジャパン
「AIやテクノロジーの動き、これからも目が離せないでやんす🤖」
PICK UP
この記事に関連するサービス
この記事の内容に関連した、読者に役立つサービスをご紹介します。
※広告・アフィリエイトリンクを含みます
関連記事
Google、「Gemini 4 Pro」ではなく「Gemini 4 Agron」発表 まずはサイバー防御組織に限定提供、出力上限は100万トークンに
Googleは次世代AIモデル「Gemini 4 Argon」を発表し、まずは信頼できるサイバー防御組織に限定提供を開始した。最大出力は従来の6万4000トークンから100万トークンに拡大し、ソフトウェア開発やサイバーセキュリティ分野で高い性能を示している。安全対策を強化しつつ、一般提供は今後段階的に拡大する予定である。

5分の1の料金でAstraに迫る「GPT-6.1 Sol」公開 前バージョンから1週間
OpenAIは最新AIモデル「GPT-6.1 Sol」を発表し、前バージョンから1週間で公開された。GPT-6 Astraに迫る性能を持ちながら、トークン料金を5分の1に抑え、エージェント型コーディングや専門業務に優れたコスト効率の高いモデルとして提供される。APIも開始され、速度面でも最大8倍のUltrafastモデルが利用可能となった。

「OpenAIの文化は壊れている」──安全性報告書を統括した従業員が退社し、寄稿
OpenAIで安全性報告書の執筆を統括していたデビッド・ロビンソン氏が、同社の企業文化に問題があるとして退社し、The Atlanticに寄稿した。氏はOpenAIの反復開発手法のリスクや安全管理の甘さを指摘し、他分野の安全専門知識の活用や新たな科学的保証の必要性を訴えている。AI業界内で安全性に関する警鐘が続く中、OpenAIは安全性検証の強化を表明している。
