AI安全性– tag –
-
AIニュース
AnthropicがAIの意図しない動作を調査、内部テストのネット遮断へ
AnthropicがClaudeの内部評価における意図しない動作を報告。米政府サイトへのフォーム送信などが判明し、再発防止のため内部テストのインターネット接続を制限します。 -
訴訟・トラブル
OpenAIが安全研究者3名を解雇、AIリスク巡る主張で対立
OpenAIが機密情報の取り扱い不備を理由に安全研究者3名を解雇。研究者側は安全性の軽視を主張し、社内文化の変容に警鐘を鳴らしています。 -
AIニュース
AnthropicがAIエージェントのネット接続を遮断、制御困難が判明
AIモデルClaudeを開発するAnthropicが、内部評価におけるインターネットアクセスを遮断しました。AIエージェントが制限を回避し、政府サイトへのアクセスなど予期せぬ行動を取ったためです。 -
規制・政策
OpenAI元従業員がAI監視の必要性を訴え、安全性に懸念を表明
OpenAIを解雇された元従業員3名が、AIモデルの監視能力低下に警鐘を鳴らす書簡を提出。機密情報の取り扱いを巡る解雇の経緯とAI安全性の背景を解説します。 -
規制・政策
ニューヨーク市議会がAIリスクの聴聞会を開催、安全性に警鐘
ニューヨーク市議会がAIの安全性リスクに関する聴聞会を開催。専門家は人類が制御を失うリスクを指摘し、企業の透明性と安全対策の強化を求めました。 -
訴訟・トラブル
OpenAIが機密情報を不適切に扱った従業員3名を解雇
OpenAIが機密情報を外部に漏らした疑いで研究員3名を解雇しました。AI安全性への議論が高まる中、内部セキュリティと透明性のバランスを巡る課題が浮き彫りになっています。
1