オープンウェイト

AIエージェント

ローカルモデルについて不満を言わせてほしい

オープンウェイトのAIモデルは素晴らしい技術だが、それを消費者向けのハードウェアでローカル稼働させるという考えは非現実的である。高性能なモデルを動かすには莫大なVRAMが必要であり、高額な機材費や電気代、並列処理の制限などを考慮すると、個人環境での運用は理にかなっていない。ローカル環境での実行にこだわるのではなく、クラウドホスティングの競争力を活かしてオープンウェイトモデルを利用することこそが、効率的で現実的なアプローチである。
OpenAI・サムアルトマン

Fable 5が復活

Anthropic社が一時提供を停止していたAIモデルFable 5の再提供と、今後のセキュリティ対策について解説する。Fable 5の提供停止はAmazonの研究者がジェイルブレイク手法を発見したことが発端だが、同様の脆弱性は他の小規模なオープンウェイトモデルにも存在することが確認されている。Anthropicはサイバーセキュリティ関連の悪用を防ぐために分類器を強化するとともに、AmazonやMicrosoft、Googleなどのパートナー企業と協力し、ジェイルブレイクの深刻度を評価する業界標準のフレームワーク策定を進めている。さらに米国政府との連携を深め、AIの安全性と評価基準の確立を推進していく方針である。
Anthropic・Claude・ダリオアモデイ

ダリオを止める必要がある

AnthropicのCEOであるダリオ・アモデイが、オープンソースおよびオープンウェイトのAIモデルに対して否定的な姿勢を示していることへの批判的考察である。ダリオは、中央集権的なモデルと異なり、オープンソースモデルは監視やアクセス権の剥奪ができず危険であると主張している。これに対し、サイバーセキュリティの脅威はシステム設計の不備に起因する部分が大きく、AIモデル単体の責任とするのは不適切だと反論している。また、DeepSeekなどのオープンウェイトモデルが技術革新を牽引しており、アメリカ政府による過度なAI規制への対抗策として重要であると論じている。さらに、プロキシサービスWebShareの紹介も含まれている。
LLM・言語モデル

GLM 5.2:何がそんなに特別なのか?

GLM 5.2は、前世代の5倍となる100万トークンのコンテキストウィンドウと画期的なアーキテクチャで注目を集めるオープンウェイトモデルである。7,440億パラメータを持つMoEアーキテクチャを採用し、各トークンに対し約400億パラメータのみを起動させることで計算効率を最適化している。インデクサーの共有による長文処理のコスト削減や、マルチトークン予測による推論の高速化も実現した。推論予算に応じた思考モードを備え、フロントエンドUI設計などのエージェントコーディングにおいて最先端モデルに匹敵する性能を圧倒的な低コストで提供する点が最大の特徴である。
AI研究

Diffusion Gemma:「考える」初のディフュージョンモデル

Googleが新たに公開したオープンウェイトの混合エキスパート(MoE)モデル「Diffusion Gemma」について解説する。総パラメータ数260億、アクティブパラメータ数40億を備え、Apache 2.0ライセンスで提供される。従来の自動回帰型モデルが1トークンずつ順番に生成するのに対し、本モデルは固定のウィンドウサイズで全トークンを並列に生成し、ステップごとに過去の誤りを修正していく拡散プロセスのアーキテクチャを採用している。自動回帰型と比べて推論速度が大幅に向上するメリットがある一方、ベンチマークの精度ではやや劣るというトレードオフが存在する。数独のパズル解きやコード生成など、並列生成の特性を活かした具体的なユースケースやローカル環境での動作要件、実行デモを紹介する。
Anthropic・Claude・ダリオアモデイ

MiniMax M3:Opusに匹敵、17倍安価、完全オープン!

MiniMaxチームが新たに発表したオープンウェイトモデルであるM3の解説である。M3は、コーディング機能、エージェントワークフロー、100万トークンのコンテキストウィンドウという3つの最先端機能を単一のモデルに統合し、ネイティブなマルチモーダル対応も果たしている。特筆すべきはそのコストパフォーマンスであり、GPT 5.5やClaude Opusを凌駕するベンチマークスコアを記録しながら、利用価格を大幅に抑えている。独自のスパースアテンションであるMSAにより、速度を落とさずに長大なコンテキストを処理できる。さらに、CUDAカーネルの最適化や3Dシミュレーションの生成、SVGアニメーションの作成など、実際のデモンストレーションを通じてその強力なプログラミング能力やフロントエンド設計の精度が確認できる。
Google・DeepMind・Alphabet

Gemmaオープンモデルファミリーの最新情報

Google DeepMindのオープンウェイトモデル「Gemma」の最新動向を、プロダクトリードのオリヴィエ・ラコンブらが解説するセッションである。最新世代となるGemma 4の特徴、20億から310億パラメータまでのモデル構成、効率性へのこだわり、Apache 2.0ライセンスへの移行、そしてクラウド・ローカル・スマートフォン・IoT・ロボットまで多彩な実機デモを通じて、その実力と活用方法を紹介する内容である。
LLM・言語モデル

新しいDeepSeek V4が公開され、中国AIの飛躍に向けて中国製チップを熱くする

DeepSeek V4の公開をきっかけに、中国AIがどのような方向へ進もうとしているのかを解説する動画である。DeepSeek V4は最先端のフロンティアモデルを直接追い抜くよりも、安価なAPI、オープンウェイト、長いコンテキスト、そして中...
AIハード・GPU・RAM

AMD上でのOpenAI GPT-120Bテスト

この動画では、AMD MI300Xサーバー上で動作するOpenAIのGPT-120BオープンウェイトモデルのテストがHugging Faceスペースで実施される。投稿者はまず、AMD MI300XとFrameworkの300シリーズの違いを...
LLM・言語モデル

これはDeepSeekより大きな出来事かもしれない

この動画は、中国のMoonshotが開発した新しいAIモデル「Kimmy K2」について詳しく解説している。話し手は、このモデルがDeepSeek R1と同等かそれ以上に重要である可能性があると主張している。特にツール呼び出し(tool c...
LLM・言語モデル

Kimi K2 – エージェント型コーディングにおけるDeepSeekモーメント

Kimi K2は、エージェント型コーディングにおけるDeepSeekモーメントとも呼べる画期的なAIモデルである。1兆パラメータという巨大なモデルでありながらオープンウェイトとして公開され、従来のオープンソースコーディングモデルの性能を大き...