Claude Oceanus: Anthropicが隠そうとしたモデル(中国でリーク)!

Google・DeepMind・Alphabet
この記事は約9分で読めます。

Anthropic社の未発表モデル「Claude Oceanus(Mythos)」の中国市場におけるAPIリーク情報と、その驚異的な生成能力についての解説である。初期プレビュー段階ながら、Golden Gate BridgeのSVGシミュレーション、物理演算を伴うゲームの再現、オリジナル楽曲と視覚化サイトの同時生成など、極めて高いマルチモーダル推論とコーディング能力を示している。過去モデルと比較してボクセルアートの精度も格段に向上しており、GPT-5.6やGeminiなどの競合を凌駕する可能性を秘めている。次世代AIモデル開発競争の激化を象徴する動向である。

Claude Oceanus: The Model Anthropic Tried To Hide (It Leaked In China)!
Anthropic didn't want you to see this one. Claude Oceanus-v1-p leaked out of a red-team test, and the outputs people are...

Anthropicの未発表モデルのリーク情報

昨日、Claude Mythosのリーク情報を紹介する動画を作成しました。その動画を作ったのは一日のかなり早い時間帯だったのですが、そこで取り上げたニュースの一つが、テスト中のAnthropicのAPIがリークされ、中国市場で転売されているというものでした。たとえば、現在画面に映っているように、中国のAPI市場ではClaude Mythosのプレビューモデルが販売されています。そして驚くべきことに、私が眠りにつき、今朝目を覚ますと、Xのタイムラインはこのモデルの初期リーク情報で溢れかえっていました。皆さんにもこのリーク情報を見逃してほしくありません。そこで本日は、これまでに確認されたいくつかのリーク情報をお見せしながら、この新しいモデルがどれほど強力なのかをじっくり見ていきたいと思います。もちろん、これらは初期のプレビュー版に過ぎませんが、出力結果は非常に素晴らしいものです。それでは早速見ていきましょう。

驚異的なSVG生成とマルチモーダル能力

最初の映像は、ゴールデンゲートブリッジのシミュレーションをSVGで生成したものです。これを見ると、ゴールデンゲートブリッジの単なるシミュレーションには見えませんよね。まるで実写のビデオか何かのように見えます。しかし、これこそが新しいモデルの凄さなのです。モデルがこのすべてをプログラミングしました。シミュレーションを実行したり、スピードを上げたり、太陽の光を変えたりできるのがわかると思います。これが、このモデルの強力さを示す初期の証拠です。いくつかの画像を見るだけでも、これが非常に大きな進歩であることがわかります。モデルがこれほどの出力を行うのを見たのはこれが初めてです。そして、興奮しているのは私だけではありません。Xにいる多くの人々も、私たちが目にしようとしているこの巨大な飛躍に本当に驚いています。数ヶ月の間、私はAnthropicのレート制限などにかなり懐疑的だったのですが、このモデルの出力結果を見ると、本当に信じられないレベルです。

次に紹介するのは、最高の出力とは言えないかもしれませんが、ワールドカップのSVG生成です。これはまあまあといったところで、度肝を抜かれるようなものではありませんが、先ほどのゴールデンゲートブリッジの例がその実力を物語っています。そして、他にも生成結果のスレッドがあります。もちろん、これは動くSUVのピクセルアートなので、少し崩れて見えますし、特にX上では最高とは言えません。しかし、2つ目の例では、モデルが実際にオリジナルのピアノ音楽を生成しています。そしてMythosは、ピアノ音楽を視覚化するサイトを生成しただけでなく、それをゼロから最後まで構築しました。これは本当にすごいことですよね。これがすべて新しいモデルによって生成されているのがわかると思います。このようなものを生み出すためには、テキストを理解するだけでなく、マルチモーダル推論に関しても強力である必要があるため、マルチモーダル機能が確実に組み込まれていることがわかります。それがすでにモデルに組み込まれているのを目の当たりにできるのは、本当に驚くべきことです。そして、これはモデルが生成したオリジナルの音楽です。つまり、この新しいモデルは非常に高い能力を秘めている可能性があります。

物理演算ゲームと緻密なボクセルアート

そして別の例として、MythosにCut the Ropeというゲームを再現させたものがあります。このゲームはかなり有名で、私も若い頃に遊んだ記憶があります。皆さんがプレイしたことがあるかはわかりませんが、このゲームのアセットはすべてSVGコードを使って生成されたように見えます。少なくとも今見ている限りでは、そこまで圧倒的な出力ではありません。しかし、投稿者が言うように実際に物理演算が機能しているのだとしたら、それはかなり評価できることです。当然ですが、ロープを切ったとき、重力に従ってそれに合わせて揺れる必要がありますからね。もしそれを生成できるのなら、そのモデルは明らかにそれを実現するだけの十分な強さと能力を持っていることになります。

次に、フルーツボウルが置かれたキッチンのボクセルアートの例です。これもボクセルアートの一種で、ますます多くのモデルがこの分野で強くなってきているのを目にしていますし、有能な生成結果も確認されています。そして、今回のリーク情報の中から、私自身が過去に行ったことのある五重塔のテストなど、個人的にとても驚かされた生成結果をいくつかお見せしたいと思います。そのテストを見ると、モデルがどれだけ強力になったかがわかります。以前の動画やテストを覚えていらっしゃるなら、当時のモデルは何かを作成することはできても、そこまで詳細なディテールを盛り込むことはできなかったことがおわかりいただけるでしょう。しかし今、モデルがどれほど強力になったかを確認することができます。

これが先ほどお話ししたテストです。現在画面に表示されているディテールの量を見てください。以前見たような、ほとんど平坦で何もできないようなものとは異なり、地面にはしっかりとした層があります。また、他の例を見てみると、木々はよりまとまりがあり、実際の五重塔もかなりしっかりした作りになっています。雲や鳥も描かれていますが、これらはすべてボクセルアートです。背景でモデルがこれらすべてをコーディングしなければならないことを考えると、これはやはり本当にすごいことです。皆さんはどう感じているかわかりませんが、私はこのモデルがリリースされることにそこまで大きな期待を抱いていませんでした。単なるマーケティングの宣伝文句だろうと思っていたからです。しかし、リークされたAPIや、それにアクセスした人々の生成結果を見る限り、これは非常に有望なモデルのように思えます。Anthropicはこれが大きな飛躍になると言っていたことを思い出してください。もしかすると彼らは嘘をついておらず、私たちは実際に大きな飛躍を目にすることになるのかもしれません。ただ、繰り返しになりますが、これらは初期のリーク情報であるため、百パーセント確実なことはまだわかりません。

過去のモデルからの進化とゼロショット生成の威力

一例を挙げると、これがGeminiのモデルがかつて生成していたものです。初期のGemini 2 Flashがどのような状態だったか、そしてGemini 2.5 Pro、Gemini 2.5 Deep Thinkを経て、現在私たちがいる場所に至るまでの進化の過程を見ることができます。そして、これが海のシミュレーションです。グラフィックなども含めて、これはかなり素晴らしい出来です。太陽の高さ、日差しの強さ、うねり、波の荒さ、雲、そして画質を調整できることがわかります。現在は高画質に設定されています。これを見ても、モデルがどれだけ進化したかがわかります。私は過去にも海のシミュレーションを行ったことがありますが、その時はモデルが平凡なものを生成し、その結果をもとにコメント欄で酷評されたこともありました。しかし、これは私が生成したものではなく、他の方が生成したものであり、非常に有望に見えます。これはClaude Opus 4.8と比較しても、かなりの大きな飛躍です。

そして、別の人がリークしたボクセルアートもあります。投稿者の主張によれば、これはゼロショットで、かつ労力をかけずに生成されたものだそうです。この方は、これは2035年10月のGemini ABモデル以来、このプロンプトから見た中で最高の出力結果だと言っています。そのモデルは実際には製品化されることはありませんでしたが、その写真を見てみると、本格的な村や城のようなものが描かれています。そのディテールの細かさは私にとって信じられないレベルです。モデルがこれをゼロショットかつ低労力で作成できたという事実があります。もしこのモデルで労力をかけて生成したとしたら、それは私たち多くの人にとって非常に非常に大きな飛躍になるでしょう。これらの出力結果を見れば、Anthropicがこのモデルは強力すぎてリリースできないと言った理由も理解できます。しかし、実際のところは彼らがリリースして初めてわかることです。これを見てください。空間の上をホバーし、横切ることができます。雲は自然にまとまっています。鳥は小型飛行機のように見えなくもありませんが、そこは大目に見ましょう。そして家々など、すべてが揃っています。本当に信じられません。同じことを何度も繰り返したくはありませんが、今後数日、あるいは来週には、モデルの能力において大きな飛躍が期待できるかもしれません。

価格、競合モデルとの比較、そして今後の展望

皆さんがどう感じているかはわかりませんが、私は今とても興奮しています。そして、このモデルがリリースされた暁には、一番に実務で使えるレベルであってほしいと願っています。つまり、コストが高すぎて人々が気軽に試したり遊んだりできないような事態にはならないでほしいということです。おそらく、かなり高額になるのではないかと予想しています。このモデルを安価に動かせるとは思えません。昨日もお伝えしたように、現状でこのモデルはOpus 4.8と比較して約3.2倍も高価になっています。確かに強力で高価なモデルになるでしょうが、それだけ使う価値があるものになるかもしれません。

同時に、GPT-5.6もすでにテスト段階に入っており、このモデルもMythosと同等の能力を持つとされています。本当にそうなると思いますか。少なくとも現時点では、GPT-5.6に関するリーク情報やチェックポイントを見ても、私たちが今目にしている出力結果に対抗できそうなものは確認できていません。もし、私たちが今見ているこの世界に近いようなチェックポイントやモデルの能力が登場し始めれば、OpenAIも食らいついていけるのではないかと思います。しかし、この分野は常に誰かが新しいものをリリースして少しの間リードを奪い、そしてまた別の誰かがリリースしてその研究所がリードを奪い返すというゲームの繰り返しです。これがここ数ヶ月の競争の実態でした。ですから、再びAnthropicの番が回ってきたのではないかと考えています。以前はOpenAIの番でしたが、今はAnthropicが戻ってきたと感じています。

そして正直なところ、Googleが何をしているのかはよくわかりません。Gemini 3.5 Proについても、現在画面に映っているようなものと競合しそうに思える話は何も聞いていませんし、見てもいません。ですから、GoogleにはGPT-5.5、あるいはOpus 4.8に少なくとも対抗できる何かを生み出してほしいと願っています。少なくとも現時点では、彼らからそういったものは見られていません。Kimiなどのオープンソースコミュニティでさえ、Googleのモデルを追い抜いています。Kimiは非常に強力なモデルを生み出しており、Googleの出力と同等かそれ以上の結果を出しています。このように、この分野は目まぐるしく動いており、Anthropicが実際に何をリリースするのかを見るのがとても楽しみです。

本日の動画は以上になります。チャンネル登録をぜひよろしくお願いします。また、universeai.beehiiv.comでの新しいニュースレターのフォロー、メインチャンネルであるWorld of AIの登録、そしてXでもuniverse of AIZをフォローして応援していただけると嬉しいです。それでは、また次回の動画でお会いしましょう。

コメント

タイトルとURLをコピーしました