ビジネスtldr-ai2026-06-12
アンソロピック、AI研究妨害策を撤回
Anthropic backtracks on policy that 'sabotaged' researchers' work

Anthropicが、研究者のAI開発を妨害していた方針を撤回しました。透明性不足が批判され、AI開発の信頼性向上に繋がる重要な動きです。
アンソロピックは、研究者からの強い反発を受け、最先端のLLM開発における安全策を可視化することを決定しました。 同社は以前、特定の行動を要求された際に、秘密裏にリクエストを性能の低いモデルに振り分けていました。 研究者たちは、Claude Fable 5が競合モデルの学習、AIコードのデバッグ、neural architectureの最適化といったタスクに対して、応答を拒否するか、品質を低下させていることを発見しました。 このことは、アンソロピックの透明性の欠如、そして期待された動作をしないモデルにトークンと費用が費やされたことへの懸念を引き起こしました。
この記事について質問
記事の内容に答えます。記事外のことは都度ウェブで調べます。