OpenAIによるGPT 5.6のリリース展望と、AnthropicのFable 5など競合モデルとの比較を解説する。強力なAIの利用制限や、米国政府の規制に伴う安全対策の強化が利用者に与える影響を考察している。また、Google DeepMindのGemini 3.5 Proのリリース延期の背景や、他モデルとの性能や立ち位置の違いを分析する。さらに、Gemini 4 Flashの登場の噂、Nano Banana Proによる画像生成能力の向上、そしてGemini 3.5 ProがSVG生成において見せる高い性能についても詳細に論じている。

次週に迫るGPT 5.6のリリースと予想される展開
来週は、特にOpenAIとGoogle DeepMindにとってかなり忙しい一週間になりそうです。というのも、来週オフィスでの業務が再開され次第、OpenAIがGPT 5.6をローンチする計画を立てているからです。ご存知ないかもしれませんが、今週は7月4日があり、基本的にはアメリカの日、Googleアメリカ、建国250周年といった祝日ムードです。しかし、その影響で多くの人々や従業員が休暇をとっており、GPT 5.6の動きも一旦落ち着いています。AnthropicのMethosの時のようにモデル自体の発表はすでに行われていますが、まだ一般向けにはローンチされていません。その機能が公開されただけで、実際にアクセスできた人はまだ誰もいない状況です。しかし、来週の7月7日から9日あたりにモデルが公開される可能性があり、その状況は変わるはずです。GPT 5.6はAnthropicのFable 5やMethos 5レベルのモデルと競合することになるため、AIに関わる私たちの多くにとって間違いなく大きな意味を持つ日になるでしょう。
強力なAIモデルに伴う利用制限の課題
これら両方のモデルは最先端の性能になると期待されていますが、重要な違いはそれらのモデルがどれだけ使いやすいかという点にあります。つまり、利用制限に引っかかることなく実際に使えるのか、そしてどのような安全対策が施されているのかということです。1つか2つ前の動画でお見せしましたが、AnthropicのFable 5モデルに簡単なリクエストを送った人たちがいて、その結果、利用制限の枠があっという間に使い果たされてしまうということが起きていました。当然ながらこれらのモデルは非常に強力であり、それゆえに利用制限の枠を大きく消費してしまうため、それはOpenAIにとっても懸念事項になるはずです。しかし、ニュースの傾向としては、OpenAIの方がより寛大な利用制限を設けるだろうと見られています。つまり、GPT 5.6をより長時間、制限に引っかかることなく使用でき、皆さんのワークフローに実際に組み込めるようになるということです。もちろん、これはまだ初期段階のニュースです。実際にそうなるかはわかりませんが、歴史的に見てそれは常にOpenAIとAnthropicの間にある立ち位置の違いでした。Anthropicは非常に強力なモデルを持っていますが、提供の部分で常に苦労しています。利用制限の厳しさや、OpenAIと比べてインフラが不足していることが原因です。OpenAIはより優れたインフラを整えており、最も強力なモデルであっても、無料ユーザーを含む非常に多くの人々に広く提供することができます。ですから今回もそうなるでしょうし、安全対策も間違いなくGPT 5.6に影響を与えるはずです。
政府の規制と積極的な安全対策の影響
安全対策が施されたモデルがFable 5であることはわかっています。基本的にはMethos 5がベースモデルであり、それに安全対策を加えたものがFable 5と呼ばれています。アメリカ政府による規制が行われたため、GPT 5.6についても同じような状況になるでしょう。これらのモデルはどちらもアメリカ政府と協力して開発されており、政府が承認し、懸念を表明した結果として、両方の研究所は積極的な安全対策を講じることを余儀なくされています。私たちがGPT 5.6を手にするときも、まさにそのようになるはずです。ですから、安全対策が全くないと思っていたり、このモデルに広く簡単にアクセスできると思っていたりするなら、そうはならないかもしれません。Anthropicの安全対策については、当初は身元確認などが含まれるのではないかと考えられていました。OpenAIのモデルにもそういったものが導入されるかはわかりません。一つ知っておくべきなのは、OpenAIはAnthropicよりも政府と緊密に連携してきたということです。そのため、私たちがユーザーとして一見しただけでは気づかないような、どのようなレベルの安全対策や機能がモデルに組み込まれているかはわかりません。しかし使っていくうちに、プロンプトの制限などに直面して使用を制限される人がどんどん増えていくのを目の当たりにするかもしれません。ですから、ここ数週間の間に何が起こるか、しっかり注視していくことが重要です。
Universe of AIニュースレターのお知らせ
先へ進む前に、Universe of AIというニュースレターを立ち上げたことをお知らせします。自分で探し回ることなくAIに関する最新ニュースを常に把握しておきたい方は、概要欄にリンクがありますのでぜひチェックしてみてください。見逃さないでくださいね。
Gemini 3.5 Proのリリース延期とその背景
さて、こうした動きが起きている一方で、Google DeepMindが大きなピンチに陥っていることがわかっています。彼らはGemini 3.5 Proモデルのリリースを延期しなければならなかったからです。先月の時点では、6月にGemini 3.5 Proをリリースすると彼らが言っていたのを知っていました。しかし今となっては、来週ですらなく、どうやら7月17日にリリースされることになりそうです。その理由は、モデルの事前学習に余分な時間が必要になったためです。彼らは2.5 Proのベース上でモデルを事前学習させようとしていました。しかし、AnthropicやOpenAIの新しいモデル、さらに非常に競争力の高いモデルを生み出しているオープンソースの研究所の存在を考えると、2.5 Proの上にモデルを学習させても全く役に立たないことは明らかです。それでは、ライバルと同等、あるいは競争できるモデルを生み出すことはできないでしょう。だからこそ、おそらく延期せざるを得なかったのだと思います。PRの面で批判を浴びてモデルを延期する方が、単に出すと言ったからという理由だけで何かをリリースするよりも良い選択だと私は思います。言っている意味がわかりますよね。
Gemini 3.5 Proに期待される新たな立ち位置
そして、この新しいモデルがGemini 3.5 Proを再び議論の中心に押し戻してくれることを願っています。このモデルがナンバーワンやナンバーツーの座を争うことになるとは思えませんが、おそらく価格面で競争するモデルとして機能し、例えばOpus 4.8と同等の結果を出すナンバー3のモデルのような立ち位置になるのではないでしょうか。Fable 5やGPT 5.6には及ばないかもしれませんが、Opus 4.8やGPT 5.5に匹敵するのであれば、GPT 5.6やFable 5が非常に強力すぎて多くの人が使えないという事情もあるため、多くの人に使われるモデルになる可能性があります。多くの人は依然としてGPT 5.5やOpus 4.8を使い続けるでしょうから、Gemini 3.5 Proが登場して、Opus 4.8やGPT 5.5レベルのパフォーマンスを求める声に応えることができれば、彼らは良いポジションにつけるはずです。
Gemini 4 Flashと画像生成モデルの新たな可能性
さらに、このモデルに関してはGemini 4 Flashが登場するという噂もあります。Flashモデルはそのスピードの速さから、間違いなく多くの人が好んで使っていると思います。簡単なタスクなどをこなすのに適していますよね。もちろん、長時間のコーディングタスクなどには向きません。そういった作業には、Google DeepMindのエコシステムで作業しているのであれば、おそらくGemini 3.5 Proを使うことになるでしょう。そのFlashモデルも登場する予定です。それに加えて、Nano Banana Proモデルが新しい3.5 Proのベース上でトレーニングされているという新情報もあり、これはOpenAIのGPT image 1よりも優れたものになると期待されています。現在の私の個人的な経験から言うと、GPT image 1はすべてのフロンティアラボの中で最も信頼できる画像モデルです。Nano Banana Proなどと比べて使ってみても、現状ではGPT image 1が明らかに最高の画像モデルです。そのため、新しい3.5 ProのベースでトレーニングされたNano Banana Proが、新しい名前がどうなるにせよGPT image 1を超えることができれば、それはGoogle DeepMindにとってかなりの勝利と言えます。もちろん、彼らは依然としてフロンティアモデルの分野で競争する必要があります。彼らの画像モデルは歴史的に優れていることで知られていますが、それだけでは開発者や、現在これらのモデルを使用しているナレッジワーカーを惹きつける助けにはなりません。とにかく、来週は非常に忙しい一週間になりそうなので、また新しい情報が入り次第皆さんにお伝えします。
Gemini 3.5 Proが魅せる驚異的なSVG生成能力
さて、これを見るのは実は2回目になるので、今日の動画でぜひ強調しておきたいことがあります。SVGシーンの作成において、Gemini 3.5 ProはFable 5やGLM 5.2よりも優れているようです。現在出回っている情報を見ると、猫が近くで眠っている間にネズミ取りからチーズを盗むネズミのシーンを作成するように指示されたことがわかります。月明かりやテントが見えるという興味深いプロンプトですが、この報告者によれば、モデルは素晴らしい生成結果を叩き出したそうです。当然ながら、Fable 5やGLM 5.2がこれをどう生成するかはわかりませんが、SVG生成においてGemini 3.5 ProがFable 5よりも優れているという声を聞くのはこれで2回目です。モデルがどれくらい強力なのか本当のところはわかりませんし、これらは初期のリーク情報に過ぎないことを考えると、大胆な主張だとは思います。ですから私の言うことは少し割り引いて聞いてほしいのですが、歴史的に見てGemini 3.5 Proモデル、あるいはGeminiモデル全般は、SVGの生成やSVG Maxなどに非常に優れていることがわかっています。モデルに組み込まれた数学的な能力などが理由なのかもしれませんが、これが他の分野にも応用されるかはわかりません。ただ、これを目の当たりにしたのが2回目だったので、強調しておきたかったのです。もしあなたがSVGをよく扱う人なら、Gemini 3.5 Proモデルを気に入るかもしれません。
エンディング
今日の動画は以上になります。ぜひチャンネル登録をお願いします。また、universeai.behive.comにある新しいニュースレターの購読と、メインチャンネルであるWorld of AIへの登録もお願いします。そしてXでUniverse of AIZをフォローして、私たちのサポートをよろしくお願いします。それでは、次の動画でお会いしましょう。


コメント