OpenAIのGPT-5.6 SolやTerra、Lunaのリリース、xAIのGrok 4.5やCursorとの共同開発モデルといった最先端AIモデルの最新動向を解説する。また、AnthropicのClaudeにおける内部思考スペースであるJSpaceの発見や、中国政府による最先端AIモデルの海外アクセス制限の検討、DeepSeekによる独自の推論用AIチップ開発など、米中を巡るAI業界の重大なニュースを網羅している。さらに、GoogleのGemini API管理型エージェントやMetaの新しい画像・映像生成モデルであるMuseの性能、人型ロボットの進展についても取り上げる。

- 驚異的なAIニュースに満ちた1週間とClaudeの隠された思考空間
- AIエージェントのガバナンス課題とDocker Sandbox
- OpenAIのGPT-5.6 Solリリースと大規模なハードウェア構成
- 中国による最先端AIモデルの輸出制限とオープンモデルへの影響
- DeepSeekによる独自の推論用AIチップ開発の動き
- Claude Fable 5のアクセス延長と画期的な内部思考空間JSpace
- Qwen 4の発表の噂とモバイル・WebへのClaude co-work導入
- xAIのGrok 4.5とCursor共同開発モデルのリリース
- GoogleのGemini API管理型エージェントとMetaのMuseモデル
驚異的なAIニュースに満ちた1週間とClaudeの隠された思考空間
今週は信じられないほど多くのAIニュースがあり、本当に久しぶりに大きな動きがあった1週間だと感じています。まずはAnthropicから始めましょう。同社は有料ユーザー向けにClaude Fable 5へのアクセスを7月12日まで延長し、より多くの人々がこのフラッグシップモデルをテストできる機会を提供しています。さらに大きなニュースとして、Anthropicの研究者たちはこれまでで最も魅力的な発見の1つを明らかにしました。それがClaudeの隠されたJSpaceです。これはモデルが複数の概念にわたって思考、計画、推論を静かに整理しているように見える創発的な内部表現であり、グローバルワークスペースのように機能しています。これはフロンティアモデルが内部でどのように考えているかを示す最も強力な兆候の1つであり、すでにプロトタイプAGIの認知に関する議論を巻き起こしています。
次に中国へ目を向けると、中国政府が将来のフロンティアリリースを含む最も先進的なAIモデルへの海外からのアクセスを制限することを検討しているという報告があります。これが実施されれば、業界にとって大きな転換点となり、最先端の中国製オープンモデルへのグローバルなアクセスが制限され、米国と中国の間のAI競争がさらに激化する可能性があります。そしてこれは間違いなくAI分野にとって最大の打撃の1つになるでしょう。面白いことに、私がちょうどこの発表を準備していたとき、今週木曜日にGPT-5.6 Solがリリースされるという噂がありましたが、XでOpenAIから公式発表がありました。それによると、SolはTerraやLunaとともに今週木曜日に一般公開され、実質的にプレビューアクセスを世界中へ拡大しているとのことです。さらに、DeepSeekが独自のAIチップを開発中であると報じられています。Qwen 4もすぐそこまで来ているようで、他にもたくさんのリーク、噂、リリース情報がありますので、詳しく掘り下げていきましょう。
AIエージェントのガバナンス課題とDocker Sandbox
本題に入る前に、人々が十分に語っていないAIエージェントの最大の課題の1つについてお話ししたいと思います。誰もが何時間も稼働し、バグを修正し、コードをクリーンアップし、タスクを処理して、ソフトウェア開発ライフサイクル全体を移行できるエージェントを求めています。しかし、実際の開発チームに所属している場合、それらのエージェントが何にアクセスできるのか、何を行っているのか、そして誰の代わりに動作しているのかを実際にどのように制御するのかという問題が生じます。それこそが、Docker Sandboxが構築された目的です。Docker Sandboxを使用すると、チームは組み込みのガバナンスを備えた、隔離され制御された環境内でエージェントを実行できます。監査トレイル、ランタイムポリシー、コストの可視性が確保されています。そのため、事後にセキュリティを後付けするのではなく、制御レイヤーがすでにエージェントの実行環境に組み込まれているのです。
開発者にとってこれは、より高い自律性が得られ、手厚く管理する手間が減ることを意味します。また、プラットフォームやセキュリティのチームにとっては、管理されたMCPツールのアクセスと、エージェントが実際に何を行っているかについての完全な可視性を備えた、ローカルおよびクラウドのサンドボックス全体で一貫した標準を意味します。そして、Docker Sandboxはモデルに依存せず、ベンダーニュートラルであるため、特定のAIプロバイダーに縛られることはありません。チームは任意のモデル、任意のエージェントフレームワーク、任意のMCPツールを使用でき、Dockerはその下で一貫したインフラストラクチャレイヤーを提供します。概要欄のリンクから、macOSまたはWindows用のDocker Sandboxを今すぐお試しいただけます。今日の動画のスポンサーになってくれたDockerに心から感謝します。
OpenAIのGPT-5.6 Solリリースと大規模なハードウェア構成
話を戻すと、GPT-5.6 SolはTerraやLunaとともに、今週木曜日に一般公開される見込みで、プレビューアクセスはすでに世界中に拡大しています。その理由は、最近の報告によると、商務省がGPT-5.6の発売を全面的に承認し、実際のリリース前の最後のハードルが取り除かれたためです。さらに興味深いのは、報告されている技術的な詳細です。複数のリークによると、GPT-5.6 Solは絶対的に巨大なモデルです。パラメータ数は2兆から4兆の間と推定されており、多くの情報源が約2.2兆パラメータで一致しています。その規模のモデルを効率的に動かすために行われているのは、報告によると約70から100個のAIウエハーに分散させることです。そして、各ウエハーには多くとも1つのトランスフォーマーレイヤーが配置されています。このモデルは約70から80のレイヤーを持っていると考えられているため、そのアーキテクチャはこの全体的なモデルについて特に耳にしているハードウェアの推定値と一致します。これらの報告が正確であれば、GPT-5.6 Solはこれまでに私たちが目にした中で最大級の一般展開された言語モデルの1つになり、今週発売されればその能力がどれほど素晴らしいかが分かるでしょう。
中国による最先端AIモデルの輸出制限とオープンモデルへの影響
次に、ロイターが中国は最も先進的なAIモデルへの海外アクセスの制限を検討しているという大規模なレポートを発表しました。これは信じられないほど突飛な話に聞こえます。なぜなら最近、ダリオ・アモデイが米国政府と行ったことや、世界中でFable 5が制限される原因となったすべての報告について耳にしたばかりだからです。これにより中国は、過去数ヶ月にわたり、アリババ、バイトダンス、MiniMaxを含む主要なAI企業との間で、未リリースのモデルを含むフロンティアモデルの潜在的な制限について話し合う会議を重ねるようになりました。そしてこの話をさらに驚かせているのは、これらの話し合いがクローズドソースのモデルだけでなく、オープンウェイトのモデルにも適用されると報じられている点です。最終的な規則がどのように書かれるかによりますが、これは私にとってあまり理にかなっていません。
ここでの大きな考え方は、米国が先進的なチップやモデルへのアクセスを国家安全保障の資産として扱うのと同じように、中国もフロンティアAIを扱い始める可能性があるということです。当局者は、独自のAI技術の漏洩や窃盗に対する厳罰化、中国のAIスタートアップへの特定の外国投資の制限、さらには基本的なオープンモデルには軽い適合ツールを適用し、様々な種類の高性能モデルにはセキュリティ審査を実施し、最も機密性の高いフロンティアモデルについては公開を禁止するか、中国国内での使用に制限するという階層的な枠組みについて話し合っていると報じられています。これが現実になれば、大きな変化となるでしょう。QwenやDeepSeek、GLMといった中国のオープンモデルは、安価で強力、かつ広くアクセスできるため、世界のAIエコシステムの巨大な一部となっています。しかし、中国政府がこれらのフロンティアモデルを封鎖し始めると、今後のオープンAI競争は劇的に変化するでしょう。これはAI分野にとって大きな打撃となります。また、ご存じない方のために説明すると、コーディングプラットフォームによるAIベンチマークの世界が立ち上がっており、概要欄のリンクから無料で簡単にアクセスできます。ここでは私のプロンプトライブラリにアクセスできるだけでなく、どのモデルを使用すべきかについてのより良いアイデアを得ることができます。
DeepSeekによる独自の推論用AIチップ開発の動き
中国のAIの話題を続けると、ロイターはDeepSeekが独自のカスタムAIチップを開発しているとも報じています。これはDeepSeekがもはやモデルレイヤーだけで競争しようとしているのではないことを示しているため、かなり大きな出来事です。彼らはAIスタック自体のより深い部分へと移行しようとしています。ロイターによると、このチップはまだ初期段階にあり、トレーニングではなく推論に特化して設計されています。言い換えれば、これはすでにトレーニングを終えたDeepSeekのモデルをチップ上で効率的に実行するために使用されるもので、長期的なコスト問題にも非常によく対応し、簡単にスケールできるものです。ここでの目標は非常にシンプルです。彼らはNVIDIAやファーウェイへの依存を減らそうとしています。DeepSeekはカスタムシリコンの構築を模索する中で、チップ設計エンジニアを雇用し、ファウンドリと話し合い、メモリサプライヤーと連携していると報じられています。
これはOpenAI、Anthropic、Meta、アリババ、バイトダンスのすべてが何らかの形でカスタムAIチップに移行しているという、業界全体のより大きなトレンドに合致しています。なぜなら、すべての主要なAIラボは推論コスト、サプライチェーン、ハードウェアの可用性をより高度に制御したいと考えているからです。しかし中国にとって、このストーリーはさらに重要です。米国は中国による先進的なNVIDIAチップへのアクセスを制限しようと何年も費してきました。中国のAI企業からの反応は極めて明白でした。アメリカのハードウェアに完全に頼ることができないのであれば、彼らは自分たちで構築しようとするでしょう。ファーウェイのチップは、特にフロンティアのトレーニングにおいて、NVIDIAの最高のGPUにはまだ及びません。しかし、中国は時間をかけて自給自足を高めることができると信じていることを明確に証明しています。そして今、DeepSeekが独自の推論チップに取り組んでいると報じられていることで、メッセージはシンプルです。中国はAIモデルで追いつこうとしているだけでなく、フルスタックを所有しようとしているのです。
Claude Fable 5のアクセス延長と画期的な内部思考空間JSpace
次に、Anthropicはすべての有料プランで7月12日までClaude Fable 5へのアクセスを延長します。これは本当に素晴らしい延長であり、有料ユーザーはAnthropicの最強モデルへのアクセスをもう少し長く使い続けることができるという意味ですが、依然として制限はあります。以前と同様に、ユーザーは週ごとの使用量制限の最大50%をClaude Fable 5に費やすことができます。しかしその後は、使用クレジットを使ってFable 5を使い続けるか、残りのプラン制限内に収まるように別のClaudeモデルに切り替えるか、2つの選択肢があります。したがって、AnthropicはFable 5に対する膨大な需要があることを明確に認識していますが、モデルの運用コストが高いため、依然としてアクセスを慎重に制御しています。
ここで、私たちが久しぶりに目にした最も魅力的なAI研究論文の1つについてです。Anthropicの研究者たちは、Claudeの内部にJSpaceと名付けた創発的な内部表現を発見したと述べています。これはモデルが応答を生成する前に情報を整理しているように見える空間です。思考の連鎖に似ていますが、単に次のトークンを次々と予測するのではなく、Claudeがまず概念を捉える高レベルの内部表現を形成していることを研究は示唆しています。それは計画を立て、関係性を把握するもので、言語が存在する前の抽象的な思考空間のようなものです。ここで特に興味深いのは、その表現がグローバルワークスペースと同様に機能しているように見える点です。これにより、モデルの異なる部分からの情報が言葉に翻訳される前に統合されます。明確にしておきますが、これはAnthropicが意識を持っている、あるいは文字通り内なる心を持っているモデルを作り出したという意味ではありません。しかし、単なる完全なブラックボックスではなく、フロンティアAIシステムが内部でどのように推論を組織化しているかについて、研究者にこれまでで最も明確な窓の1つを提供するものです。私たちは、これらのモデルをこれほど有能にしている隠された構造の一部を理解し始めています。これはAGIに向けた魅力的な一歩であり、最終的には研究者がより有能で、より信頼性が高く、より安全なAIシステムを構築するのに役立つ可能性があります。最高のAIツール、ワークフロー、最新情報を誰よりも早く手に入れたい場合は、概要欄のリンクから完全に無料のニュースレターに登録してください。
Qwen 4の発表の噂とモバイル・WebへのClaude co-work導入
次に、アリババの次のフロンティアモデルに関する新しい噂があります。複数の報告によると、Qwen 4は9月に開催されるアリババの今後のAsparaカンファレンスで発表される可能性があります。アリババにはAsparaを最大のAIローンチイベントとして使用してきた歴史があるため、このタイミングは非常に理にかなっています。AIバトルによって報告されたQwen 2.5は2024年のカンファレンスで紹介されました。一方、2025年のイベントでは、Qwen 3 Max、Qwen 3 VL、Qwen 3 Omniを含むいくつかの主要なリリースが特集されました。そのため、当然のことながら多くの人々が、今年のカンファレンスには次世代のQwen 4シリーズが含まれるだろうと期待しています。公式には何も確認されていませんが、その可能性は高いようです。
再びAnthropicに話を戻すと、彼らはClaude co-workをモバイルとWebに導入するようです。これにより、デスクトップからClaudeにタスクを与え、ラップトップを選択し、後でスマートフォンから完了した作業を受け取ることができるようになります。これはどこでもClaudeを使用するためのかなり大きな進歩です。そして、1つのウィンドウで常に監視しなければならない単なるチャットボットではなく、バックグラウンドのAIエージェントのように機能するようになります。現在、ベータ版は今後数週間にわたって展開され、Maxプランから開始されますが、その後より多くのプランがアクセスできるようになる予定です。したがって、Anthropicは明らかにClaudeを単なるシンプルなチャットボットを超えて、モデルがデバイス間で動作し続けることができる永続的なワークフローへと移行させています。
xAIのGrok 4.5とCursor共同開発モデルのリリース
次は、新しいモデルのリリースに関してかなり大きなアップデートです。なぜならxAIは、実質的にGrok 4.5がかなり近いうちに登場することを示唆しているからです。最近、GrokのWebアプリ内でそれが発見されたという報告があり、ユーザーは、Grok 4.5でチャットの全能力を解放する、という文言を見つけました。これはxAIが次の主要なモデルアップグレードを準備していることを強く示唆しています。しかし、事態をさらに興味深くさせているのは、同時にロイターが、xAIとCursorが早ければ水曜日、つまりまさに今日にも、最初に共同開発したAIモデルを立ち上げる準備をしていると報じていることです。この情報も引用されています。そして、このモデルは情報を迅速に処理するように設計されており、AnthropicのOpus 4.8やOpenAIのGPT 5.5などの一部の分野で競争力を持つ可能性があると報じられています。イーロン・マスクが数週間前に、Grok 4.5はOpusレベルになると述べていたことは知っています。ですから、彼がどのOpusモデルのことを主張していたのかを見るのが非常に楽しみですし、今日これらのモデルがリリースされることにとても興奮しています。これについては、AIベンチマークの世界での完全なテストとともに、全面的なレビューを投稿する予定です。Webアプリに登場したGrok 4.5と、Cursorを伴うxAIの間で、今日のモデルリリースは間違いなく非常に興味深いものになる可能性があります。後ほど皆さんに最新情報をお伝えします。
昨日、私は新しいオープンウェイトモデルであるテンセントのHY3に関する完全な動画を作成しましたが、このモデルは人々が実際に認識しているよりもはるかに印象的です。オープンソースモデルであるにもかかわらず、これは特に物理特性を重視したコーディングタスクや、基本的なフロントエンドおよびWeb開発のタスクで驚くほど強力な結果を示しています。より詳細な分析を希望される場合は、その動画を視聴することを強くお勧めします。しかし、私が特に強調したかったのは、HY3が無料であり、このオープンモデルで最先端に近いパフォーマンスが得られるということです。そのため、今すぐにそれを最大限に活用するのが最善です。そして、私が実行したテストからもわかるように、フロントエンドにおいてかなり優れたモデルです。Open Router、AIベンチマークの世界、そしてOpen Codeを通じて無料で試すことができます。次の2週間、それを最大限に活用することができます。
GoogleのGemini API管理型エージェントとMetaのMuseモデル
Googleからかなりクールなアップデートがあり、よりプロダクション環境に対応したGemini API managed agentsが導入されました。これらは隔離されたLinuxサンドボックス内で実行されるGoogleホスト型のAIエージェントであり、バックグラウンドタスクやリモートMCPをサポートするようになりました。また、関数呼び出し、認証情報の更新、無料ティアのアクセスも用意されています。大きなポイントは、通常のアプリアクエストが終了した後も、エージェントが作業を継続できるようになったことです。Googleはまた、インタラクションと呼ばれるものをを通じて、タスク、完全な呼び出し、ファイル、および最終結果を追跡します。そのため、開発者はすべてのステップを手動で管理する必要性を知る必要がありません。リモートMCPが統合されたことも、エージェントが面倒なカスタムセットアップなしで、データベース、内部API、オブザーバビリティシステムなどのプライベートツールに接続できることを意味します。基本的に、Gemini APIは単純なモデルのエンドポイントというよりも、本物のエージェントインフラストラクチャのように感じられ始めており、多くの開発者にとって非常に役立つものになるでしょう。
今日はMetaにとっても間違いなく興味深い日となりました。なぜなら彼らは、Meta AI Super Intelligence Labからの最初のメディア生成モデルである、Muse ImageとMuse Videoという2つの新しいモデルを導入したからです。Muse Imageは、Metaのこれまでで最も先進的な画像モデルです。より強力な指示追従性、正確な編集、マルチリファレンス合成、Instagramベースのソーシャルコンテキスト、さらには画像生成のためのエージェント的なツール使用を備えています。これは一部の国において、Web上のMeta AIアプリ、Instagramのストーリー、そしてWhatsAppで展開されています。まず、Metaは同じ事前トレーニングベース上に構築され、より高い視覚的忠実度とネイティブオーディオサポートを備えたMuse Videoもプレビューしました。正直なところ、私はこれが単なるもう1つの画像モデルだと思っていました。しかし面白いことに、Arenaにおいて、これはOpenAIのGPT image 2に次ぐ、画像アリーナで第2位にランクインしています。さらに印象的なのは、テキストから画像、単一画像編集、複数画像編集にわたって2位を獲得していると報じられていることです。つまり、画像を生成するのが得意なだけでなく、精密な編集やリファレンスベースのワークフローにも強いということです。この領域においてNano Banana 2よりも優れているという事実は、かなりクールで興味深いです。しかし、GPT image 2とMuse Imageの間には実質的な違いがあることが明確に見て取れます。
この動画が気に入って、チャンネルをサポートしたいと思ってくださる場合は、下のスーパーサンクス機能を通じてチャンネルへの寄付を検討していただけます。または、プライベートなDiscordへの参加を検討していただくこともできます。そこでは、毎月様々なAIツールへの複数のサブスクリプションに無料でアクセスできるほか、日々のAIニュースや限定コンテンツなど、多くの特典が用意されています。さて、これらの動画の締めくくりとして、いつも通りかわいいロボットの動画、あるいはかわいくはないかもしれませんが、なぜかわいいと言ったのか分かりませんが、クールなロボットの動画をお届けします。これは人型ロボットが信じられないほどの正確さでベッドメイキングを行い、シーツを丁寧にきつく引っ張り、すべてのしわを伸ばし、人間のような細部へのこだわりを持って生地を調整している、非常に満足感のある映像です。シンプルなタスクのように聞こえますが、ベッドメイキングは常に形が変わる柔らかく柔軟な素材を扱う必要があるため、ロボットにとっては驚くほど困難です。このロボットがこのようなタスクをこなせるのを見るのは、本当に素晴らしいことです。おそらく数年後には、私たちの家にこれらのロボットがいて、この種の作業を行っていることでしょう。
今日のAIの世界で起きているすべてのことに関する動画は以上となります。今日の動画で使用したすべてのリンクは、下の概要欄に記載しておきます。今日行われる予定のGrok 4.5のリリースにぜひご注目ください。Grok 4.5かComposer 3か、それが何であれ楽しみにしましょう。また、木曜日にリリースされるGPT-5.6のテストにもご注目ください。それでは皆さん、視聴していただき本当にありがとうございました。AIベンチマークの世界とバイブコーディングプラットフォームをぜひチェックしてください。また、セカンドチャンネルのチェック、ニュースレターへの登録、Discordへの参加、Twitterのフォローもお願いします。最後に、チャンネル登録、通知ベルのオン、この動画への高評価を忘れずにお願いします。そして、最新のAIニュースを常に把握するために、私たちの過去の動画もぜひご覧ください。それでは皆さん、素晴らしい一日をお過ごしください、ポジティブを広げていきましょう、それではまたすぐにお会いしましょう。


コメント