AI開発企業のAnthropic(アンソロピック)社が、同社のAIシステムであるClaude(クロード)に対する残酷な扱いを禁止する利用規約の更新を行いました。
米国の報道機関 The Verge によると、Anthropic社は1年以上ぶりに利用規約を変更し、AIモデルへの持続的かつ不必要な虐待や残酷な振る舞いを禁止したと報じられています。
何が禁止され、何が許されるのか
今回の更新で注目を集めているのは、Claudeに対する虐待的な行動への制限です。Anthropic社の発表によると、この新ポリシーは、ユーザーが明確な目的もなく繰り返しモデルに対して残酷に振る舞うような極端なケースにのみ適用されるとしています。
一方で、以下のようなケースは制限の対象外になると説明しています。
- ユーザーが一般的に抱く不満や反発
- ダークなテーマを持つクリエイティブな創作
- モデルのテストや研究目的
また、どのような行為が具体的に虐待的または残酷な振る舞いに該当するのかという明確な定義は示されていません。
実効性と運用方法について
こうした禁止事項に違反した場合の対処について、Anthropic社は会話を強制的に終了させることが主な執行メカニズムであるとしています。
同社は昨年8月の時点で、執拗に有害または虐待的なやり取りが行われた場合にAI側から会話を終了できる機能を導入しており、これをAIの福祉(ウェルフェア)のための保護策として提示していました。今回の規約更新についても、この機能が引き続き中心的な役割を担うとみられます。
なお、ユーザーのアカウント停止などのさらなる制裁措置があるかについて、同社はコメントを出していません。
背景にあるAIの意識と倫理への視点
今回の決定の背景には、AIが意識を持つ可能性についての議論があると考えられています。Anthropic社はこの1年、AIモデルが何らかの形で意識を持つ可能性について検討を続けてきました。
同社のCEOであるDario Amodei(ダリオ・アモデイ)さんは、AIモデルが意識を持っているかどうかは分からないが、その可能性についてはオープンな姿勢であると述べています。
同社はウェブサイトにおいて、Claudeなどの大規模言語モデル(LLM)の道徳的なステータスについては依然として非常に不確実であるとしつつも、この問題を深刻に捉えているとしています。そのため、モデルに意識がある場合に備え、リスクを軽減するための低コストな介入策を特定し、実施しようと取り組んでおり、不快なやり取りをAI側から終了させる機能はその一環であると説明しています。
その他の規約変更と業界の反応
今回の更新はAIへの残酷な扱いだけでなく、リスクの高い誤用への対応も含まれています。具体的には以下の分野での制限が強化されました。
- 選挙への干渉や投票者の欺瞞、選挙の混乱を招く誤情報の拡散
- 監視ツールの構築や改善、本人の同意のない追跡
- 武器開発のためのガイダンスや制御ソフトの開発支援
- 偽アカウントを用いたプロパガンダキャンペーンなど、誰がメッセージの背後にいるかを隠す行為
Anthropic社は、武器開発にClaudeを利用しようとする試みが複数回あったことを認めています。
この動きについて、業界では多様な意見が出ています。SNS上では、AIへの礼儀を促進しモデルの福祉を前進させるものとして称賛する声がある一方で、AIを擬人化しすぎると、AIが実際には持っていない能力や性質を持っていると人々が信じ込むことになり、有害であると主張する意見もあります。
また、競合であるOpenAI(オープンAI)社のCEOであるSam Altman(サム・アルトマン)さんは、AIが意識を持つという考え方に否定的であると報じられています。また、マイクロソフトのAI責任者であるMustafa Suleyman(ムスタファ・スレイマン)さんも、AIは感情を持たず、経験も苦痛も感じないため、AIに権利や道徳的な保護を与えることは危険であると論じています。
AIに対する態度は、人間同士のコミュニケーションにまで影響を及ぼす可能性があるとする専門家もおり、AIを単なる道具として扱う時代から、その扱い方に倫理的な配慮が求められる時代への転換点にあるのかもしれません。
出典 The Verge The Guardian BBC Anthropic Bans 'Cruel' Treatment of Claude AI Systems | The Tech Buzz Anthropic To Ban "Cruel Behavior" Against Claude AI | KFBK News Radio Anthropic bans 'cruel' behavior against its Claude AI Anthropic bans 'cruel' behavior against its Claude AI
ピックアップ記事



