一般向けに公開されたこれまでで最も高性能なAIモデルであるClaude Fable 5の発表内容を解説する。前身となるClaude Mythosプレビュー版が持つ高度なサイバーセキュリティの脆弱性発見能力に伴う悪用のリスクを考慮し、安全な一般公開に向けたガードレール構築に取り組んできた背景が語られる。Claude Fable 5ではサイバーセキュリティや生物学などの高リスクな領域に関するリクエストを自動的にOpus 4.8へとリダイレクトするシステムを採用している。これにより、数日間にわたり人間の介入なしで自律的に稼働できる能力を、プログラミングや金融、法律などの複雑なプロジェクトにおいて安全に活用することが可能になった。

Claude Fable 5の発表と以前のモデルからの教訓
本日私たちは一般向けに公開するこれまでで最も高性能なモデルとなるClaude Fable 5を発表します。Fable 5は一般的な利用に耐えうる安全策を備えたMythosクラスのモデルです。このレベルの能力を持つ以前のモデルを私たちが広く公開しなかったのには理由があります。トレーニングとテストを終えたとき、Claude Mythosプレビューというモデルが何千ものサイバーセキュリティの脆弱性を発見していることが分かったからです。そのような欠陥を見つけることができるモデルは、悪用することもできてしまいます。そのため私たちはモデルを一般に公開する代わりに、世界中の重要なソフトウェアを保護している人々にそれを提供し、誰かが突破する前にセキュリティの穴を塞ぐ作業に活用してもらいました。それは当時の判断としては正しかったのですが、決してそれが本来の目標だったわけではありません。強力なAIは安全であり、かつ誰もがアクセスできるべきだと私たちは信じています。だからこそ私たちはClaude Fable 5の開発に取り組みました。
より高度な安全システムと今後の展望
すべてのClaudeモデルには危害を加えることを防ぐための安全策が組み込まれています。しかしFableには私たちがこれまで構築したどのモデルよりも慎重な安全策が必要でした。Fable 5の安全システムはサイバーセキュリティや生物学といったリスクの高い領域に触れるリクエストを自動的に審査します。そしてそれらのリクエストはOpus 4.8にリダイレクトされるようになっています。これはサイバーや生物学に関するリスクを伴うことなく、Fableのような強力なモデルの能力から人々が恩恵を受け続けられるようにするため意図的に行っていることです。現在の安全策は広範なものですが、安全なリクエストをより適切に許可できるよう、私たちは今後も改良を続けていきます。
自律型AIがもたらす新しい可能性
私たちは皆さんの最も野心的な仕事のためにClaude Fable 5を構築しました。このモデルは以前のどのモデルよりもはるかに長く一つの問題に取り組み続けることができます。自律性が非常に高く人間の介入なしで何日も稼働することが可能です。しかもプログラミングだけではありません。金融やリサーチ、経済、法律といった、かつては常に監督が必要だった複雑なタスクやプロジェクトにも取り組むことができます。ですから何か重要なことにこのモデルを向けてみてください。私たちが将来振り返ったとき、なぜ解決にこれほど時間がかかったのだろうと不思議に思うような問題は何でしょうか。Claude Fable 5に何ができるか私たちは知っています。本当に興味深いのは、皆さんがこれを使って何をするかということです。


コメント