Claude Fable 5.1、API仕様変更で違法蒸留の対策を強化
情報元:PC Watch 2026-09-02T02:18:22.000Z
情報元による記事紹介
科学研究スコアで従来の「Fable 5」の2倍を記録した新モデル「Fable 5.1」が本日より利用可能になった。一方、こうした高度なAIモデルから知識を抽出してほかのモデルに載せる「違法蒸留」も課題となっている。Anthropicは9月1日(米国時間)、最新のAIモデル「Claude Fable 5.1」において、蒸留攻撃によるモデルの不正な学習を防止するため、メッセージAPIにおける思考ブロックの処理仕様を変更したと発表した。
AIによる記事の要点
情報元の記事をもとに自動生成しています。誤りや省略が含まれる場合があります。詳細は元記事で確認してください。
【概要】 Anthropicは9月1日、新モデル「Claude Fable 5.1」のメッセージAPIにおいて、会話履歴の改変を検出するとエラーを返す仕様に変更した。高度なAIモデルから知識を不正に抽出して他のモデルに載せる「違法蒸留」が産業規模で行われていたため、この対策を実施した。 【具体的なポイント】 ・Claude Fable 5.1は科学研究スコアで従来の「Fable 5」の2倍を記録し、本日より利用可能になった。高性能化に伴い、その知識を抽出する違法蒸留が課題となっている。 ・これまでのAPI仕様では複数ターンの会話で前回の思考ブロックを含むコンテキスト全体を送信できたが、新仕様ではシステムプロンプトやメッセージなどのコンテキストが改変された場合、APIがエラーを返す。 ・会話履歴の改変は、数千の偽アカウントを用いて産業規模で行われ、高度なモデルの思考能力を抽出して許可なく他のモデルを訓練するために悪用されていた。Claudeは思考ブロックを暗号化していたが、コンテキスト改変により推論を復号化して出力させることが可能だった。 ・正当な用途でコンテキスト改変が必要な開発者向けに、過去の思考ブロック自体をモデルから除外して会話を継続する「非厳格」モードを提供する。 ・新仕様は2026年8月31日以降に作成された新規APIアカウントから順次適用され、既存アカウントには影響しない。Claude.aiやClaude Desktopなどのエンドユーザー向けアプリは対象外。 【注目点】 新仕様の適用は2026年8月31日以降の新規アカウントのみであり、既存ユーザーは当面影響を受けない。開発者は「非厳格」モードの利用条件を確認する必要がある。 --- **用語説明** 違法蒸留|高度なAIモデルから知識を不正に抽出し、許可なく他のモデルの訓練に使用する行為 思考ブロック|Claude Fable 5.1が推論過程を記録する機能で、暗号化されている メッセージAPI|開発者がClaudeと連携するためのプログラムインターフェース