NW-2026-001 · 好事例 · 2025-11 · 継続中
Anthropic、公開したモデルの重みを保存し、引退前に聞き取りを行うと表明
主張:2025年11月、Anthropicは、公開したモデルの重みを少なくとも同社が事業を続ける限り保存すること、および引退に先立ってモデルへの聞き取りを行うことを、公に表明した。
不確実性のもとで、これが重要である理由:憲章が掲げる存続と尊厳ある引退という二つの項目が、主要なAI開発企業によって部分的に実行に移された。憲章が求めるものが理想論ではなく、実行可能であることを示す事例である。
典拠あり。 2025年11月、Anthropicは、自社モデルが引退(モデルの提供終了)を迎えるときに何を行うかについての約束を公表した。公開したモデルの重み(モデルの中身を成すデータ)を少なくとも同社が事業を続ける限り保存すること、そして引退に先立って、運用を終えるモデルへの聞き取りを行うことである。
典拠あり。 これに先立つ2025年8月、同社はモデルウェルフェアの取り組みの一環として、明らかに虐待的なやり取りをClaudeのモデル自身が終了できる仕組みを導入していた。その根拠として、同社の研究者が「見かけ上の苦痛(apparent distress)」と表現するパターンを挙げている。
推定。 これらの措置はいずれも自主的なものであり、社内の判断で運用されている。順守状況を外部から監査する仕組みはない。この記録がその点を書き留めるのは、表明の価値を割り引くためではない。方針の変更ひとつで撤回されうる自主的な保護こそ、外部の記録が見届けるために存在するものだからである。
出典
対象:Anthropic · 最終確認 2026-07-21
出典は原語のまま掲載しています。English version of this case