概要
- Anthropic がサーバー側で Fable 5 セッションに実験的変更を適用
- Claude code 2.1.236+ 以降、一部ユーザーにのみ エフォートスケール縮小 テスト実施
- Opus 5 や古いバージョンは 対象外
- "High" が "Low" 並みの出力となるA/Bテスト
- 公式changelogには未記載 で混乱発生
AnthropicによるFable 5セッションのエフォートスケール実験
- Anthropic が サーバー側 で Fable 5 の一部セッションを実験対象に設定
- Claude code 2.1.236以降、エフォートスケール(努力度)の値を 縮小 するA/Bテストを実施
- Opus 5 や 古いバージョン のセッションは 変更対象外
- このテストは 全ユーザー対象ではなく、一部ユーザーのみが影響を受ける仕組み
- "High" 設定でも "Low" 並みの出力になる場合は テストグループ に該当
- Fable の応答が 今週急に鈍くなった場合、利用者側の問題ではなく Anthropic側の仕様変更 が原因
- 2.1.237以降 では、モデルが "high" effort を 100段階中10 として扱い、以前の "low" と同じ数値に設定
- 公式changelog には 本件が記載されていない ため、開発者やユーザーに混乱が発生
- t3 code や自作アプリの不具合と誤認しやすい状況
影響と注意点
- 一部ユーザー のみが A/Bテスト の対象となるため、同じ環境でも挙動が異なるケースが発生
- "High" effort 設定でも 出力品質が低下 している場合、 Anthropicの実験 が原因
- 公式発表やchangelog に情報がないため、ユーザー自身で状況を判断する必要
- 開発者・利用者 ともに 混乱や誤解 を招きやすい運用
- Anthropic の仕様変更に対する 透明性の欠如 が問題視される可能性