2026年にリリースされたAnthropicの最新モデルClaude Fable 5の機能と実態を解説する。Fable 5は100万トークンのコンテキストウィンドウを持ち、長時間の自律的なエージェント作業や複雑なコーディングで過去最高の性能を示す。一方で、厳格な安全フィルターが搭載されており、無害なプロンプトでも密かに下位モデルのOpus 4.8へルーティングされる問題が多発している。また、米国政府による一時的な提供停止措置や30日間のデータ保持要件など、ビジネス利用におけるリスクやコストのトレードオフについても詳しく検証する。

Claude Fable 5の隠された罠
Claude Fable 5へのアクセス権を手に入れたばかりで、Opusの賢いバージョンのように使い始めようとしているなら、少し待ってください。そのままでは大量のお金を無駄にし、アップグレード前のモデルよりも質の低い回答を受け取ることになるかもしれません。私は数週間このモデルを使い込み、システムカードやベンチマーク、見つけられる限りの開発者レポートを徹底的に調べ上げました。そして、最初のプロンプトを入力する前に誰も教えてくれない事実がここにあります。Fable 5は会話の途中で、ユーザーに気づかれないように古くて弱いモデルにすり替わることがあるのです。この仕様のせいで、ユーザーからはすでに辛辣なニックネームで呼ばれています。この動画を最後まで見れば、自分がそのすり替えの被害に遭っているかどうかを正確に見抜けるようになります。bitbiased.aiへようこそ。ここでは皆さんの代わりにリサーチを行っています。無料の週刊ニュースレターに登録して、AI愛好家のコミュニティに参加してください。下の概要欄のリンクから登録できます。最新のAIニュースやツール、学習リソースを受け取り、常に一歩先を行くことができます。さて、この動画ではClaude Fable 5の正体、実際にできること、料金、そして独立したテストでマーケティングの主張がどのように崩れ去るのかを詳しく解説します。これが本当にあなたのお金を払う価値があるのかどうかを判断できるようになるはずです。私が今お話しした罠を理解するには、まずこのモデルが作られた奇妙な仕組みを理解する必要があります。というのも、Fable 5は厳密には単一のモデルではなく、ペアの半分だからです。
Fable 5とMythos 5の正体
Fable 5の実態についてお話しします。Claude Fable 5は2026年6月9日にローンチされ、AnthropicがMythosクラスと呼ぶ、Opusクラスのさらに上に位置する全く新しい階層の最初のモデルです。これだけでも注目に値します。何年もの間、OpusはAnthropicのラインナップの頂点でした。しかし今、その上に丸ごと一つの階層が存在しているのです。ここからが面白いところです。Fable 5は、Claude Mythos 5と呼ばれる2つ目のモデルと基盤となる重みを共有しています。これらは本質的に全く同じモデルです。唯一の違いは安全対策だとAnthropicもはっきりと述べています。Fable 5には安全性分類器が組み込まれた状態で出荷されています。一方のMythos 5にはそれがなく、審査を受けたパートナー企業専用となっています。当初は政府やサイバーセキュリティチームがプロジェクト・グラスウィングと呼ばれる枠組みの下で利用し、後には選ばれた生物学者も追加される予定です。名前すらもその物語を語っています。Fableはラテン語で語られるものを意味し、Mythosはギリシャ語で神話を意味します。一方は信頼できる内部関係者に対して自由に発言することが許されており、もう一方は一般大衆に向けて少し慎重な物語を語るのです。これが詩的だと感じるか、少し不気味だと感じるかはあなた次第です。ぜひコメント欄であなたの意見を聞かせてください。
圧倒的なスペックと能力
純粋なスペックで見れば、Fable 5はモンスター級です。100万トークンのコンテキストウィンドウと12万8000の出力制限を備えています。コーディング、分析、ビジョンにおいて最先端の性能を謳っています。Anthropicは、その能力がこれまで一般向けに提供された自社のどのモデルをも凌駕すると述べています。もちろん、それはマーケティングの主張です。このチャンネルではマーケティングの主張は事実ではなく、あくまで主張として扱います。ですから、Anthropic以外の人が実際にこのモデルを手にしたとき、何ができるのかを見ていきましょう。その能力の何が本物なのでしょうか。まずは目玉となるユースケース、長期的なタスクから始めましょう。Fable 5は計画を立て、サブエージェントに指示を出し、自身の出力を検証し、数時間から数日間にわたって作業を継続するエージェント型ワークフローを実行するために構築されています。以前のモデルでは、このようなタスクでは途中で目的を見失ってしまっていました。しかしこのモデルはそうではないようです。誰もが引用するデモはStripeの事例です。Anthropicによれば、StripeはFable 5を使用して5000万行のコードベースをたった1日で移行しました。これは彼らのチームが手作業で数ヶ月かけていた作業です。これはAnthropic発のエピソードなので話半分に聞いておくべきですが、第三者による検証結果も同じ方向を示しています。エージェント型コーディングのベンチマークであるSWEBench Proでは、Opus 4.8が69.2%だったのに対し、Fable 5は80.3%を記録しました。Anthropic独自のFrontier Code Diamondベンチマークでは、Opusの13.4%に対して29.3%と2倍以上のスコアを出しています。また、第三者機関によるAI2インテリジェンスインデックスでは、GPT 5.5の60を上回る65を記録しました。
独立したテストと驚くべき実績
さらに、私が実際に注目しているのは現場からの証言です。Djangoの共同開発者であり、これまでにリリースされたほぼすべてのフロンティアモデルをテストしてきたサイモン・ウィリスは、Fable 5を野獣と呼びました。遅くて高価だが、以前のどのモデルも手が出せなかった問題を解決していると評価しています。彼は、Fable 5が単独で数時間のサンドボックスアップグレードをこなし、完全に動作するPythonパッケージを数分で完成させ、自身のプロジェクトに新機能とバグ修正を加えて拡張していくのを見届けました。彼が数日分の開発者の作業に相当すると見積もった量を、たった1日で生み出したのです。懐疑的なテスターたちが感銘を受けているということは、それなりの意味を持ちます。ビジョン機能も本当に強力です。Fable 5はチャート、ネストされた表、スクリーンショット、手書きのスプレッドシートを読み取ります。Anthropicは、スクリーンショットだけを頼りにウェブアプリのコードをゼロから再構築したり、生のスクリーンショットだけを入力としてポケモンのファイアレッドをクリアするデモまで公開しました。さらに、新しい永続的メモリ機能もあります。ある内部テストでは、Fable 5は複数のセッションにまたがって自身のメモリファイルにメモを書き込みながらSlay the Spireをプレイし、Opus 4.8の3倍のパフォーマンスを発揮しました。過去の自身の作業の上に積み上げていくこの能力は、今回のリリースで最も過小評価されている機能だと言えるでしょう。
Feeble 5と呼ばれる理由と安全フィルターの罠
このように能力に関する話は裏付けが取れています。しかし、実際にこれを使おうとしたときに何が起こるかを聞くまで待ってください。ここからが、史上最も有能なClaudeが全く別のニックネームで呼ばれるようになる理由です。その罠とは、Feeble 5です。Feebleはひ弱という意味です。先ほどお話ししたペアのモデルを覚えていますか。安全対策が実際にどのように機能するかをご説明します。これはAnthropicのローンチページではあまり触れられていない部分です。Fable 5は自身の傍らで小さな分類器モデルを走らせており、サイバー攻撃、生物学、化学に関するクエリや、モデルの蒸留を試みる動きを監視しています。分類器が反応しても、Fable 5は拒絶しません。その代わり、あなたのクエリを古くて安価で性能の劣るモデルであるClaude Opus 4.8に密かにルーティングするのです。ユーザーには通知され、Fableレベルのトークン料金は請求されません。Anthropicはこれを単なる拒絶よりも優れたユーザー体験だと位置づけています。公平に見て、ある意味ではその通りです。問題は、何が危険とみなされるかです。Anthropicによれば、このフォールバックがトリガーされるのはセッションの5%未満だと言います。しかし、初期ユーザーから報告された誤検知の記録には、プルドポークの買い物リスト、単純なヘビゲーム、個人の健康に関する質問、そして少なくとも1つのケースではこんにちはを意味するHiという言葉さえ含まれていました。これらがすべて潜在的な生物学的またはサイバー上の脅威としてフラグを立てられ、Opus 4.8に密かに渡されたのです。そのためユーザーはこのモデルをFeeble 5と呼び始めました。正直なところ、このニックネームが定着したのには理由がありますし、再ローンチ後にはさらに悪化した可能性があります。独立したテスターの調査によると、7月1日の再デプロイメント後、あるデバッグベンチマークのスコアが86から26へと急落しました。モデルの重みが変更されたという公式の証拠はありません。可能性の高い原因は、分類器がより攻撃的になり、日常的なコーディングのクエリをOpusにルーティングしていることでしょう。これが何を意味するのか少し考えてみてください。あなたは世界最高のコーディングモデルにお金を払っているつもりでも、気づかないうちにOpus 4.8をベンチマークしているのと同じ結果になっている可能性があるのです。もしあなたが個人的にこのような誤検知に遭遇したことがあるなら、その時のプロンプトをコメント欄に書き込んでください。フォローアップの動画のために例を集めていますし、奇妙な例であればあるほど歓迎します。
誰も予想しなかった政府による停止措置
さて、分類器をめぐる騒動だけでも十分ですが、Fable 5の最初の1ヶ月間には、フロンティアモデルにこれまで起きた記憶がないほどの出来事がありました。米国政府がこれをオフラインにしたのです。ローンチから3日後の6月12日、米国商務省はジェイルブレイクの脆弱性に対する懸念から、Anthropicに海外からのすべてのアクセスを遮断するよう命じました。Anthropicはその場では抵抗しませんでした。彼らはFable 5とMythos 5の両方を世界中でオフラインにしました。2週間の間、地球上で最も有能な一般向けAIモデルは、ユーザーにとって存在しないも同然でした。技術的な修正と政府による審査を経て、6月30日に輸出規制が解除され、Fable 5は7月1日に世界中で再ローンチされました。この脆弱性に対するAnthropicの対応は注目に値します。彼らはその特定の攻撃手法を標的とした新しい専用の分類器を構築し、現在では99%の確率でブロックできると主張しています。また、透明で公正な審査プロセスを公に求め、他の研究所と協力してジェイルブレイクの深刻度に関する共通の基準を開発することを約束しました。行間を読めば、これらの声明に協力と不満の両方が入り混じっているのがわかります。Anthropicは要求に応じましたが、二度と同じことが起きる前に明確なルールを求めていることは明らかです。なぜこれがあなたにとって重要なのでしょうか。それが前例となるからです。フロンティアモデルが政府の命令により一晩で世界的に停止される可能性があるのです。もしあなたのビジネスのワークフローが特定の1つのモデルに依存しているなら、それは2026年6月以前には本当に存在しなかったリスクのカテゴリーだと言えます。誰かが1つのAPIに製品全体を構築するように勧めてきたときには、このことを思い出してください。
料金体系とデータ保持のリスク
では、これらすべてのコストはいくらなのでしょうか。入力トークン100万あたり10ドル、出力トークン100万あたり50ドルです。これはOpus 4.8の5ドルと25ドルという料金の正確に2倍です。しかし、私を驚かせた背景は別にあります。入力30ドル、出力180ドルかかるGPT 5.5 Proよりも約70%安いのです。Anthropicの通常の90%プロンプトキャッシュ割引も適用され、推論を米国内のみに限定したい場合は1.1倍のプレミアム料金がかかります。サブスクリプションに関しては、Anthropicはローンチ記念のプロモーションを実施し、有料登録者にFable 5の無制限アクセスを提供しました。当初は6月22日までの予定でしたが、一時停止の影響で7月7日まで延長され、プロ、マックス、チームの各プランにおける週間使用量の最大半分をカバーしました。この無料期間に対するRedditの反応は率直なものでした。最初の味見は無料というわけです。7月7日以降、Fable 5は最上位プランであっても従量課金のクレジット方式に戻ります。ただし、Anthropicは容量が許せば標準のサブスクリプションに再び組み込むと述べています。しかし、ビジネスにおいて最も重要視すべき数字は料金ページには載っていません。Fable 5を使用するには、APIを含むすべてのプラットフォームにわたって、安全性の審査のためにすべてのクエリを30日間保持することが求められます。Anthropicはこれをトレーニングには使用しないと述べていますが、あなたが送信したすべてのデータは最大1ヶ月間記録されます。これは通常のClaudeの7日間のログ保持期間をはるかに超えています。伝えられるところによると、このたった1つの条項のせいで、マイクロソフトは社内でポリシーの確認が終わるまでFable 5の利用を一時的に制限したそうです。もしこのモデルを通して機密性の高いクライアントのデータを扱うのであれば、これは単なる注釈ではなく、コンプライアンス上の大きな議論になります。
偽りのない制限事項と実際のパフォーマンス
Fable 5は魔法の杖ではないので、全体像を正確にお伝えしましょう。独立したテストではそれが明確に示されています。まず、遅いです。その適応的な思考プロセスは、単純なプロンプトでさえ数分かかることがあります。AnthropicのCEO自身も、Opus 4.8よりも明らかに遅く、費用がかかることを認めています。また、依然としてハルシネーションを起こします。これは本当に驚かされた部分ですが、ある独立したテスト機関によると、Fable 5のハルシネーションの発生率はOpus 4.8と同等かそれ以上であり、一部のオープンソースモデルよりも高かったのです。あるレビュアーの言葉を借りれば、自信満々に間違えるということです。すべてを検証する必要があります。厳密な指示への従順さでもGPT 5.5を下回っています。3D空間推論や自動販売機のビジネスシミュレーションのようなタスクには苦戦すると報告されています。知識のカットオフは2026年1月で、仕様上、特定の分野全体が利用対象外となっています。あるアナリストの言葉を借りれば、生物学に関する少し滑稽なほど幅広い質問、深刻なサイバーセキュリティの研究、そしてフロンティアモデルのトレーニングに触れるようなものはすべて、あなたをOpus 4.8に格下げしてしまいます。もしあなたの仕事がこれらの領域にあるなら、信頼されたアクセスプログラムに参加していない限り、Fable 5は意図的にあなたをサポートしないように作られているのです。つまり、ここから浮かび上がってくるのは、単純にこれまでで最高のモデルという姿ではありません。特定の種類のユーザーにとってのこれまでで最高のモデルであり、それ以外の人にとっては現実的なトレードオフが存在するということです。そしてこの違いこそが、ローンチ時のマーケティングがごまかしている部分なのです。
Fable 5は誰の役に立つのか
これらすべてを踏まえて、私がたどり着いた結論はこうです。あなたの仕事が長く複雑なエージェント型タスク、大規模なリファクタリング、数日にわたるリサーチプロジェクト、過去のどのモデルでも扱えなかったほど巨大なコードベースに関わるものであれば、Fable 5は現時点で間違いなく市場で最も強力な選択肢です。Opus 4.8やGPT 5.5とのベンチマークの差がそれを裏付けています。ある評論家はこれをGPT-4以来の最大の単一世代の飛躍だと呼びました。難易度の高いタスクに関しては、その評価は妥当だと思います。Anthropic自身の見解でも、タスクが長く難しくなるほどFable 5のリードは広がるとされています。そして今回ばかりは、独立したテストの結果も概ねこれに同意しています。しかし、あなたの仕事が速く反復的な日常のタスクであるなら、半額の料金とわずかな遅延で済むOpus 4.8の方がおそらく賢い買い物です。そして、もしあなたが生物学、化学、セキュリティ研究に少しでも関わっているなら、Fable 5は積極的にあなたに牙を剥くでしょう。30日間のデータ保持、分類器の誤検知、そして政府が2週間これをオフラインにしたという少なからぬ問題を加えれば、史上最も有能なモデルという言葉には多くの注釈がつき始めます。良いニュースもあります。Anthropicはこれらの安全対策は暫定的なものだと述べています。より多くのクエリがFable自体に留まるようにフィルターの調整を積極的に行っていますし、Mythos 5のアクセス権も信頼できるパートナーに向けて徐々に拡大されています。つまり、Feeble 5の時代は一時的なものかもしれません。しかし、信頼の問題も一時的なものかどうかは別の話です。もしこの解説が、高いお金を払ってこれらの事実を知る事態を避けるのに役立ったなら、チャンネル登録をするのが最善の選択です。そうすれば、次のモデルがローンチされる前に、また有益な情報をお届けできます。ぜひコメント欄で教えてください。一般向けのモデルと信頼された少数の人向けのモデルを分けるデュアルモデルのアプローチは、責任あるAIの展開と言えるでしょうか。それとも私たちが警戒すべき二重構造のシステムでしょうか。私は下のコメントをすべて読んでおり、優れた意見はたいてい次の動画を作る上での大きなヒントになっています。ご視聴ありがとうございました。


コメント