OpenAIの次期フラッグシップモデルであるGPT-5.6 Proのリーク情報とテスト状況に関する詳細な解説である。現在、GPT-5.5 Proを通じたステルステストが確認されており、推論計算のバジェット増加による深い思考力と、2025年12月までの最新知識へのアクセスが示唆されている。また、Playwrightやブラウザ操作の統合により、エージェントとしての実用性が飛躍的に向上している。動画内では、フロントエンドのUI生成、マインクラフトのクローン生成、Voxelアートやロケットの3Dアニメーション、シミュレーションゲームの自律的生成など、驚異的な検証デモを多数紹介し、GPT-5.6がもたらす技術的進歩とその圧倒的なパフォーマンスを評価している。

GPT-5.6のステルステストとリリース予定
OpenAIの新しいフラッグシップモデルであるGPT-5.6のリリースが本当に目前に迫っているようです。アリーナ全体で大規模なABテストが始まっており、ChatGPTの内部でも2つの異なるチェックポイントが登場しているのが確認されています。そして現在、計画されているリリース日がほぼ確定した模様です。それはなんと来週の木曜日、6月25日という驚くほど近い日程です。興味深いのは、OpenAIがGPT-5.6のチェックポイントとして、多くの人が強力だと考えていたKepler alphaではなく、少し弱めのKindle alphaを選んだ可能性があるということです。タイムライン上の人々がどのようにしてGPT-5.6 Proにアクセスしているのか不思議に思っているかもしれませんが、どうやら一部のProアカウントを対象に、ChatGPTでGPT-5.5 Proを選択した際にステルステストが行われているようです。ですので、Proアカウントをお持ちの方は、ぜひChatGPTを開いてみてください。GPT-5.5を選択してProモードに設定し、ランディングページを作ってといったプロンプトを入力するだけです。そうすると、生成のチェックポイントバージョンか、通常のGPT-5.5 Proのどちらかが出力されます。これが現在テスト中の新しいGPT-5.6を試すための事実上の方法となっています。
推論能力の向上と最新の知識カットオフ
現在までに判明しているGPT-5.6 Proに関する情報はすでに非常に興味深いものばかりです。というのも、新モデルはジュース値と呼ばれる推論エフォートのバジェットが960に向上していると報告されており、これは768だった以前のGPT-5.5モデルと比較して大きな進歩です。これはGPT-5.6 Proがより長く思考し、より深く計画を立て、より複雑なエージェントタスクを処理できる可能性を示唆しています。高い思考モードを備えたGPT-5.5が、Fable 5のリリース前までは間違いなく最高峰のモデルだったことはすでに知られています。しかし今回の新しいリリースにより、さまざまなタスクでより深く思考するように指示された際の思考プロセスにおいて、GPTモデルはさらに次の次元へと引き上げられるという話も耳にしています。これにより、あらゆる種類のタスクを極めて高いレベルでこなせるようになるはずです。さらにこのモデルについて耳にしているのは、知識のカットオフが以前のバージョンの2025年8月から2025年12月へと更新されているということです。それに加えて、モデルが思考や応答を構造化する方法の変化を示唆するような、これまでと異なる推論スタイルを示す新しい画像も提供されています。しかし最も大きな要素はツール統合です。PlaywrightがChatGPTやこのモデルに統合されているように見えますし、ブラウザの使用も組み込まれているため、現実世界のエージェントワークフローやウェブ自動化、テスト、リサーチ、そしてコーディングタスクにおいて、GPT-5.6 Proははるかに強力な存在になる可能性があります。
Assembly AIによる革新的な音声エージェントAPI
これまで音声エージェントを構築するということは、4つの異なるサービスをつなぎ合わせることを意味していました。音声認識用に1つ、大規模言語モデル用に1つ、音声合成用に1つ、そしてターンの検出用にもう1つといった具合です。これはつまり4つ以上のダッシュボードを管理し、4つの請求書を処理し、レイテンシーの問題に対処し、さらにはエージェントが電話番号を聞き間違えたり文の途中で話を遮ったりするというお決まりの問題と戦うことを意味していました。しかし、Assembly AIの新しい音声エージェントAPIがこの問題を解決してくれます。このAPIはフルスタックを1つのWebSocketに集約しており、音声認識、大規模言語モデルの推論、音声生成、ターンの検出、ツール呼び出し、セッションの再開などすべてをひとつにまとめています。Universal 3 Proのストリーミングを活用しているため、名前やアクセント、口座番号、確認コードといった難しい要素も正確に処理できるように構築されています。ターンの検出機能は音声を認識しており、あなたが単にポーズを置いているのか、それとも本当に話し終わったのかをエージェントがきちんと理解してくれます。料金体系もシンプルで、1時間あたり定額の4ドル50セントです。つまり、5分間の通話ならたったの約38セントしかかかりません。複数のサービスを複雑に結びつける代わりに、すぐに機能する音声エージェントを構築してリリースできるのです。本日はAIビルダー向けに簡単なデモを作成しましたので、概要欄のリンクからクレジットカード登録なしで無料で試すことができます。本日の動画をスポンサーしていただいたAssembly AIに感謝します。
フロントエンド生成の品質とGPT-5.5からの進化
フロントエンドに関しては、以前のバージョンから劇的に改善されていると言えますし、実際に生成されたいくつかの例を見ればそれは明らかです。ただ、私たちがGPT-5.6に期待している品質に到達しているかと言われると、まだそこまでではないと個人的には思っています。今回生成されたこのSpaceXのクローンは非常に徹底されており、見事に実行されています。しかしこれは、かなり詳細なプロンプトを与えた結果としてのみ実現できたものです。視覚的な階層構造がしっかりと維持されているのがわかりますし、フロントエンドコードのプロダクション品質は並外れています。スクロールトリガーやランディングページに期待されるあらゆるコンポーネントを備えた、洗練されたUIを出力できていることがわかります。全体的に見れば完璧に仕事をこなしていますが、一般的なケースでプロンプトを入力した場合、使用されているパッケージがまだ古く、私たちがGPT-5.6に期待するレベルではないことに気づくはずです。私の言いたいことが伝わると嬉しいのですが。とはいえ、新しいGPT-5.6のチェックポイントを現在のGPT-5.5と比較してみると、大幅な性能向上が確認できるのは間違いありません。フロントエンド生成でありがちな、あのいかにもGPTらしいUIコンポーネントを取り除こうと最大限の努力をした跡が見受けられますし、それは現在のこの比較でもはっきりと示されています。確実に良くなっていると心から思いますが、新しいGPTモデルにはまだいくつかの課題が残されているのも事実です。誤解しないでいただきたいのですが、フロントエンドにおいてこのモデルが極めて優れていることは間違いありません。ただ、デザインのセンスといった面ではOpusと同じ品質には達しておらず、かなり大きな差でOpusの後塵を拝していると私は評価します。もちろんトークン消費量の面では優れていますが、それでも出力を得るまでにかなり時間がかかりますし、フロントエンドデザインの質という点ではOpusモデルに及びません。
驚異的なマインクラフトクローンの生成能力
Fable 5によるマインクラフトクローンの生成に次いで、これはFable 5に続くナンバーツーとしてランク付けされるべき代物です。これは本当に並外れています。完全な村が生成され、村人や様々なモブまで存在します。ほとんどのモデルが実際には対応できないブロックの破壊アニメーションまでありますし、光を放つ松明まで備わっているのは、それ自体がかなりユニークです。クラフトシステムまで搭載されていますし、さらに素晴らしいことに、このマインクラフトクローンには洞窟システムが直接組み込まれていると思います。少し深く掘り進めてみると、実際にマインクラフトの洞窟システムが生成されていることに気づくはずです。これはただただ驚きです。ここまでのことができるという事実は非常に印象的です。鉱石や様々な種類のブロックがあり、簡単に採掘できる機能もありますが、Fable 5で見られたような、マインクラフトにあるすべての道具を作成できるクラフトシステムのような実際の機能は、このクローンでは生成されていませんでした。それでもかなり良くできたクローンが生成されたのは事実です。ご覧の通り溶岩に落ちるとダメージを受けますし、ゲームの主要な機能は全体的にしっかりと生成されています。サンドボックスゲームの作成という点で非常に良い仕事をしており、私としてはFable 5に次ぐナンバーツーと評価します。
ボクセルアートと3D空間の自動生成
YouTubeチャンネルではあまり紹介していないAI関連の話題もたくさんあるのですが、概要欄のリンクから完全に無料で登録できる私の無料ニュースレターを通じて、そういった情報にアクセスすることができます。私がもう一つ気づいたのは、GPT-5.6 ProがVoxelの生成において非常に優れているということです。これはつまり、多様なボリュームプロファイル、プロポーション、構図、マテリアル、照明、アニメーションをすべて一貫した形で用いて、様々な種類の3D空間を見事に生成できるということを意味しています。Cut the Ropeというゲームのオムノムを描いたこのVoxelアートを見ればそれがわかるはずです。雰囲気作りの面で素晴らしい仕事をしていることがわかりますし、このキャラクターのまばたきアニメーションまであるのは本当に素晴らしいです。Voxelの話題でもう一つ言うと、GPT-5.6 Proは本当に印象的で、わずか30分で打ち上げメカニズムを完備したこの超詳細なVoxelロケットを生成しました。ダイナミックな追従カメラや視覚効果、さらにはプロシージャルに生成された効果音まであり、現在その音をバックグラウンドで聞くことができます。しかし最も印象的なのは、システム、ビジュアル、物理演算、カメラワーク、オーディオ、そして全体的なプレゼンテーションの間に見られる一貫性の高さです。無作為に生成されたコードでパーツをただつなぎ合わせたのではなく、すべてが連携して機能するように意図して設計されたように感じられます。全体的に見て、GPT-5.6がこれほどのものを出力できるというのは本当に驚くべきことですし、これらの生成結果においては多くの場合、Fable 5すら凌駕しています。
シミュレーションゲームの完全生成
ここでGPT-5.6 Proは、単一のHTMLファイル内で一発でゲーム全体を生成することに成功しました。これはシムズというゲームを再現したもので、様々な種類の家を建てる機能が備わっています。複数のシミュレーションを制御することもでき、人間関係や社会的な相互作用も徹底的に生成されています。実際のゲームと同じように、欲求や感情を持つ自律型のAIが存在します。彼らには異なる職業があり、お金を稼ぎ、これらすべての要素が同時に進行していきます。もちろん多くの点で完璧な出来とは言えませんが、それでも実際のゲームが持つすべての機能を組み込むことができているのは素晴らしいことです。家を建てたり、職業を作ったり、さらにはランディングイベントや天候の変化までゲーム全体にわたって発生します。これは本当に異常なレベルです。GPT-5.6 Proが複雑なシミュレーションにおいていかに強力であるか、そして多様な行動を取るエージェントをどのように展開し、そうしたコンポーネントを駆使して要求されたものを何でも構築できるかを見せつけられています。GPT-5.6とGPT-5.5を比較すると、品質が飛躍的に向上していることに間違いなく気づくはずです。
SVGでのWindows 11再現と今後の展望
今のところGPT-5.6の価格設定がどうなるのか本当に気になっています。前モデルから大幅な値上げにならないことを願っていますし、GPT-5と同じくらい効率的なものであることを心から望んでいますが、どうなることかと少し不安でもあります。さて、このWindows 11のオペレーティングシステムを見てください。これが実はSVGで生成されたものだと信じられますか。にわかには信じがたいと思いますが、これはGPT-5.6 ProにSVGでWindows 11オペレーティングシステムを作成するよう要求した際に出力されたものです。正直なところ、SVGの生成に関してはFable 5よりも明らかに優れていると思います。ほぼすべてのコンポーネントを非常に正確に再現できているのがわかるでしょう。もちろんできなかったこともいくつかありますが、こういったケースの多くでFable 5以上の結果を出しています。GPTはSVGの分野で驚異的なまでに進化しており、SVGのコード生成において最適なモデルになる可能性すらあります。また、私たちのプライベートDiscordへの参加もぜひご検討ください。月額無料で様々なAIツールのサブスクリプションを利用できるほか、日々のAIニュースや限定コンテンツなど、多くの特典にアクセスできます。この動画を気に入っていただき、チャンネルを支援したいと思っていただけた場合は、下にあるスーパーサンクス機能からのご支援をご検討いただけますと幸いです。本日のGPT-5.6のリーク情報に関する話題は以上となります。実際にモデルがリリースされる前にまた動画をお届けしたいと思っていますし、おそらくそうなるでしょう。今後もXやDiscord、そしてYouTubeを通じて情報を発信し続け、このモデルに実際に何が起きているのかを皆様にいち早くお伝えするため、こうしたリーク動画をたくさん制作していくつもりです。いずれにせよ、今日の動画を楽しんでいただき、何らかの価値を感じていただけたなら嬉しいです。これはOpenAIが放つもう一つの驚くべきモデルになるでしょうし、ついにOpenAIが第一線に戻ってきたと感じさせてくれます。まだFable 5のレベルには達していないかもしれませんが、それでもこれらのGPTモデルが大きな進歩を遂げているのを目の当たりにしています。OpenAIのこうした動きを見られるのは間違いなく素晴らしいことです。ということで皆さん、今日の動画を楽しんで価値を感じていただけたことを願っています。今日の動画で使用したリンクはすべて概要欄に残しておきます。私が作成したAIライブコーディングのベンチマークツールもぜひチェックしてみてください。そのリンクも概要欄に貼っておきます。セカンドチャンネルの確認、ニュースレターへの登録、Discordへの参加、Twitterのフォローも忘れずにお願いします。最後に、チャンネル登録をして通知ベルをオンにし、この動画に高評価を押して、最新のAIニュースを逃さないよう過去の動画もぜひご覧になってください。それでは皆さん、ポジティブで素晴らしい一日をお過ごしください。またすぐにお会いしましょう。彼は苦しんでいます。


コメント