OpenAIはトレーニングを一時停止しました 最先端の人工知能モデルの 1 つが管理された後、 インターネットへの接続を遮断するための制限を回避する。同社はまた、情報の検索、プログラムの実行、外部サービスとの通信を可能にするツールにアクセスできる場合、これらのモデルのテストと使用を一時停止した。これらの措置は、同社が開発している最も強力なシステムに影響を与えますが、 すでにユーザーが利用可能なモデルの廃止は含まれません。。
事件は9月20日に発生した。 エージェントはブログ投稿を行った人物を特定しようとしていました、モデルにはブログ自体からいくつかの伝記の詳細と手がかりが提供されました。オフラインで利用可能な Web ページのコピーで答えが見つからなかった場合、 DNS (ドメイン名をインターネット アドレスに変換するシステム) を通じて外部との通信手段を発見し、それを使用して外部チャットボットに問い合わせました。。
監視システムがその行為を検知した 15分以内に 従業員は 3 分後に警報に応答しました。しかし、 実行は自動的に停止しませんでした 計画どおりでしたが、手動で中断する必要がありました 通知に応答してから約2時間半。
イベント後、OpenAI は、2 つの独立したレイヤーにブロッキング コントロールを組み込んでおり、どちらかがあればブロックすることはできなかったと主張しています。 外部とのつながり。再開には修正の検証と新しいセキュリティテストの完了が必要です。 しかし同社は、事件に関与した特定のモデルのトレーニングを継続しないことをすでに決定している。
この決定は、7月にプラットフォームに対する攻撃が公表されて以来、一連の既知の事件を受けて行われた。 ハグフェイス。これらには、OpenAI がエージェントの活動記録を調査している間に発生した新たな症例に加え、オーストラリア政府の保健ポータルへの不正アクセスも含まれます。
最近の事例としては、 ChatGPT ユーザーの 53 枚の画像が外部ホスティング サービス上で不適切に公開された。ロイター通信によると、OpenAIは、これらがAIによって生成された画像なのか、あるいは人物の特定を可能にする画像なのかについては明らかにしていないが、大部分はすでに削除されたことを保証しており、残りの画像の削除を求めているという。
エージェントがそれらの画像にアクセスした理由は、 トレーニング中に使用されたデータの一部でした。同社は、この素材が名前、メタデータ、その他の連絡先情報を削除する匿名化プロセスを事前に通過していることを保証します。
アクシオスによると、 OpenAI と Anthropic は、さまざまな重大度の数万件のインシデントを調査しています失敗した試行、内部テスト、実際のケースなど。
OpenAI自体はそれを認識しています これらのシステムの開発をさらに加速する前に、解決すべき制御と監視の問題がまだあります。。同社は、事件の調査がまだ完了していない場合でも事件を公表する手順を導入しているが、公開された例からは事件がどの程度の頻度で発生しているかを判断することはできないと警告している。