ダリオを止める必要がある

Anthropic・Claude・ダリオアモデイ
この記事は約17分で読めます。

AnthropicのCEOであるダリオ・アモデイが、オープンソースおよびオープンウェイトのAIモデルに対して否定的な姿勢を示していることへの批判的考察である。ダリオは、中央集権的なモデルと異なり、オープンソースモデルは監視やアクセス権の剥奪ができず危険であると主張している。これに対し、サイバーセキュリティの脅威はシステム設計の不備に起因する部分が大きく、AIモデル単体の責任とするのは不適切だと反論している。また、DeepSeekなどのオープンウェイトモデルが技術革新を牽引しており、アメリカ政府による過度なAI規制への対抗策として重要であると論じている。さらに、プロキシサービスWebShareの紹介も含まれている。

Dario needs to be stopped
Make sure you leave a like and subscribe to the channel! Try webshare now for free: coupon code: MEHUL20 for 20...

ダリオ・アモデイのオープンソースAIに対する懸念

ネット上でダリオのクリップやインタビューを見る時間が長くなればなるほど、彼はオープンソースAIを見たくないのだと実感します。これからご覧いただく映像は、ほぼ3年前の2023年に撮影されたものです。それでも一度この映像を聞いていただきたいのです。なぜなら、3年前に行われたものであるという事実が、この状況がいかに馬鹿げているかを示す手がかりになるからです。オープンソースモデルのスケールアップについて、彼はそれが非常に危険な道を歩んでいると考えています。もしその道が続けば、と彼は言います。念のために言っておきますが、これは2023年の話です。OpusやGPT-5.5、DeepSeek V4 Proのようなモデルは存在せず、私たちはまだ非常に初期の段階にあり、コンテキストの制限も短い時代でした。それなのに、オープンウェイトモデルやオープンソースモデルのスケールアップは非常に危険な道を歩んでいるという答えが返ってきているのです。では見てみましょう。毎秒ごとに話を遮りたくはないのですが。

オープンソースモデルの危険性についての証言

非常に危険な道を歩んでおり、もしその道が続けば、私たちは非常に危険な場所にたどり着く可能性があると考えています。オープンソースモデルについて、すべての専門家には明らかであるものの、この委員会に確実に理解しておいていただきたいことがあります。それは、モデルを管理し展開している場合、その使用状況を監視する能力があるということです。ある時点で悪用されるかもしれませんが、その後モデルを変更したり、ユーザーのアクセス権を取り消したり、モデルが実行できる内容を変更したりすることができます。しかし、モデルが制御されていない状態でリリースされた場合、そのような能力はありません。完全にあなたの手から離れてしまうのです。そのため、その点には慎重に対処すべきだと私は考えています。

中央集権モデルとオープンウェイトモデルの比較

まず最初に言っておきますが、ダリオが言っていることに事実として間違っていることは何もありません。当然のことながら、モデルが中央集権化されていれば、あらゆる監視の目を持たせることができますし、モデルで常に見かけるガードレールを設けることもできます。そして、モデルがオープンウェイトだからといって、必ずしも監視がないわけでも、モデルをホストしている人があなたのデータを覗き見していないわけでもありません。彼らは見ているかもしれませんが、アイデアとしては、モデル全体の制御を握り、あなたの活動を見ているこれらすべての監視者を取り除いて、直接実行することもできるということです。しかし、ここで皆さんに手短に要点をお伝えしましょう。兵器化される可能性のあるドメインは主に2つあります。1つ目は明らかにサイバーセキュリティで、2つ目は生物学です。私は生物学については詳しくなく専門家でもないので多くはコメントしませんが、大規模言語モデルの基礎は知っています。それは、モデル自体が公開データでトレーニングされているということです。つまり、ウイルスを作り出したり、人類を絶滅させるような何かを製造したりするきっかけになるような、斬新な情報がこのデータの中に存在しているわけではありません。もし彼らにそれができるなら、少なくともその情報やデータはすでにそこにあるはずだからです。それが1つのポイントです。サイバーセキュリティに関しても、リスクは私が生物学について言ったこととだいたい同じだと言えます。つまり、ハッキングされる可能性のあるウェブサイトの束があり、アプリの束があり、あちこちに他の機器などの束があるということです。これこそが、このようなモデルを野生に解き放つことは潜在的なハッキングにつながる可能性があり、安全ではなく不誠実だとしてAnthropicが広めている恐怖を煽る主張です。

サイバーセキュリティの真の課題

これに対する私の答えはこうです。根本的にサイバーセキュリティの核心において、もしあなたがシステムを設計しているなら、例えば日常的にLinuxカーネルを書いているわけではない平均的な開発者だとして、システムを設計する際に非常に注意しなければならないことの1つはユーザーデータです。あなたがどのオペレーティングシステムやどのレイヤーで作業しているかは関係ありません。バックエンドかもしれませんし、システム設計かもしれませんし、Linuxかもしれませんし、低レベルの何かかもしれません。あなたがコンピューター全般で何をしているにせよ、ユーザーが送ってくるものを信用してはいけません。そして私が信用すると言うとき、それはメールや数字のようなデータ型やフォーマットだけを意味するのではなく、文字列の長さなど、あなたが今考えてもいないようなことのことも意味しています。たとえば、bcryptのようなパスワード攻撃でそれを見たことがあります。bcryptは最初の70文字か72文字くらいを受け取りますよね。これについて大きな騒ぎが起きました。昨年のいつだったか、私も動画を作って、このアルゴリズムがどのように機能し、あるウェブサイトで誰かが見つけることができたしていくつかのバイパスについてお見せしたと思います。いずれにせよ、ここでの考え方は、システムに非常に強力なバリデーションを持たせなければならないということです。少なくともサイバーセキュリティにおいて、それがデータを危険にさらす私が知るすべての脆弱性の核心です。もちろん、攻撃者があなたにDDoS攻撃を仕掛けたり、サービスをダウンさせたり、データを破損させたりする可能性のある方法はいくつかあるでしょう。システムへのアクセス権を実際に得ることなく、単にデータを破損させる方法はあります。しかし、根本的に修正したいのは、サイバーセキュリティの特定のタスクのために、そもそもユーザーデータをどのように解析または処理しているかということです。それが、MythosやFableなどのモデルによって直面している問題の99%を解決するであろう、私からの非常に高いレベルのアドバイスです。これらのモデルは魔法ではありません。サービス拒否攻撃や、そもそも大量の計算能力を必要とするようなことを行うためのハードウェアやインフラストラクチャを魔法のように持っているわけではありません。これらは単なる知的な頭脳にすぎません。

Anthropicの独占欲とオープンウェイトの必要性

そして、私がユーザーデータとそれに基づいた脆弱性が基本的にあなたが心配すべき唯一の脆弱性だと言うのは、他の要素は一般的にどうせあなたのコントロール下にはないからです。インフラストラクチャの部分であり、スケーリングや実際の負荷、実際のユーザーなどについて考える必要があります。だからこそ、なぜこれらのモデルが危険すぎると見なされるのか私には理解できません。もちろん、それらが危険であるなら、そもそもこれらのシステムの脆弱性を修正するために使用することもできるはずです。そして、それらの脆弱性が修正されれば、すべてのシステムがより安全で強力になります。しかし問題は、Anthropicだけがあなたのシステムを安全にすることになっているとしたら、それはおそらく私が参加したいと思うような世界ではないということです。Anthropicが世界をより良い場所にしたいと言いながら、それをより良い場所にできるのは自分たちだけにしたいと言うような世界です。Anthropicは、自分たちは素晴らしい、フロンティアAIやフロンティアインテリジェンスなどすべてを構築し、すべてのツールを提供すると言いながら、他の誰にも、特にオープンウェイトのカテゴリのモデルにはそれをやってほしくないと考えているように感じられます。そこがオープンウェイトモデルの出番です。

Monitor YouTubeとWebShareの紹介

さて、もしあなたがアクセスをブロックされるのが嫌で、自分がしていることを監視されたくなく、彼らのチェックを回避したいと考えている人なら、あなたにぴったりの素晴らしいブランドがあります。私も自分の製品で使い始めたもので、WebShareと呼ばれています。しかし先に進む前に、私の新しいツールであるMonitor YouTubeについてお話ししたでしょうか。私のフィルターがフル稼働しているのを見てください。Theoが行っている、小さなタイトルやサムネイルの変更から、新しい動画の公開、そして視聴回数、いいね、コメントまでのすべての変更を取得しました。これがどのように機能するかというと、Monitor YouTubeが1分に1回ほどYouTubeをポーリングし、追跡しているすべてのチャンネルの更新情報を取得しようとします。私たちが持っているのはこの2つのチャンネルだけではありません。すでに何百ものこのようなチャンネルがあります。しかし、これを単一のIPアドレスから行うのは明らかに非常に悪いアイデアです。なぜなら、これが特定のしきい値を超えた瞬間、YouTubeはこのIPを単にブロックしてしまうからです。そして基本的にはページ上にGoogleキャプチャ付きの429リクエストが表示されることになります。彼らはあなたをブロックするのです。そこで今日のスポンサーであるWebShareの出番です。サインアップには1分もかかりません。彼らは10個のプロキシを無料で提供しており、始めるのにクレジットカードは必要ありません。WebShareから取得した、さまざまな国やさまざまな都市のこのプロキシリストを見てください。ステータスは3から4分に1回チェックされており、すべて機能しています。今、ここには100個のプロキシのリストがあり、私の場合、これをMonitor YouTubeで直接使用しています。そのため、トラフィックを直接ルーティングするのではなく、まずWebShareにルーティングし、WebShareからYouTubeにルーティングします。つまり、毎回異なるIPアドレスの束を使ってYouTubeをブラウジングしているということです。そしてここが素晴らしいところなのですが、プランをカスタマイズできるのです。たとえば、WebShareから1万個、あるいは10万個のIPアドレスを取得することも可能です。これは驚くべきことです。帯域幅だけでなく、場所もカスタマイズできます。たとえばアメリカ合衆国だけを指定したい場合はそれができますし、特定の国を指定することも、ランダムに設定することもできます。これらのIPアドレスがBANされる心配もありません。手動で更新しなくても、WebShareが代わりに行ってくれるからです。通常のプロキシでは不十分な場合は、WebShareから住宅用プロキシを取得することもできます。これは文字通り、自宅からインターネットをブラウジングしているかのように振る舞うプロキシです。つまりISPプロバイダのプロキシですね。このようにしてこの製品は機能し、私はYouTubeに間接的にアクセスするための基盤となるプロキシシステムの1つとしてWebShareを使用することで、ここにいるすべての人が何をしているのか、どの動画を公開しているのか、どのタイトルを更新しているのか、彼らから学ぶためのあらゆることを監視できています。ですので、このような製品を作りたい場合はWebShareをチェックしてみてください。無料で始めることができます。アップグレードしたいときは、私のコードであるmayhul20を使用すると、最初の購入が20%オフになります。このパートを後援してくれたWebShareに改めて感謝します。それでは動画に戻りましょう。

時代遅れの懸念とDeepSeekの功績

念のために言っておきますが、これはほぼ3年前、あるいは2年半から3年前の動画で、当時のモデルは実際ゴミのようなものでした。本当に良いものではありませんでした。そこから多くの自律的な作業を引き出すことはできませんでしたし、一般的な知性も持っていませんでした。たとえばダリオがそこに座って内部で何が起こっているかを見ており、彼がおそらく私たちよりも2年先を行っていて、2年後や2年半後に何が起こるかを見ることができたとしても、それが何らかの形でより悪い、あるいは否定的な影響をもたらしたかについては私はまだ疑問に思っています。オープンウェイトモデルのリリースは、AnthropicやOpenAIがしていることのせいで停滞したわけではありません。むしろ、多くの開発や多くの論文、洞察、ブレイクスルーは実際にはDeepSeekのような企業によって生み出されていますよね。それは私たちが知っていることです。彼らが発表した論文の量と仕事の質を知っています。繰り返しになりますが、悪用というのは人々がどんな技術でも行うことです。悪用されていない技術を選ぶことなんてできません。車を見てください。場所から場所へ移動するには素晴らしいものですが、単に人を傷つけるためにも使われます。だからといって、ただ1つのプロバイダーだけが車を販売できるとか、人々が好きなように車を操作するのを制限するような24時間体制の監視が車の上にあるということになるでしょうか。おそらくそうではないでしょう。だからこれはすべて、問題を解決するための解決策、つまり問題を探している解決策だとただ言っているように私には感じられます。彼はすでに解決策を持っています。なぜオープンウェイトモデルが良くないのか、あるいはオープンソースモデルが良くないのかという声明を持っていて、そして今、それに対する答えを展開したいと考えています。それは私たちがすでに完了したと証明しなければならないことですが、今はそれのために何かを開発しなければならない、そのように聞こえます。

オープンソースに対する誤解

モデルを変更したり、ユーザーのアクセス権を取り消したり、モデルが実行できる内容を変更したりすることができます。モデルが制御されていない状態でリリースされた場合、そのような能力はありません。完全にあなたの手から離れてしまうのです。そのため、その点には慎重に対処すべきだと私は考えています。ガードレールを回避するのを難しくするような形でモデルをオープンソースでリリースする方法があるかもしれませんが、それははるかに難しい問題であり、私たちはこの主張を推進する人々にその問題を突きつけ、それを解決するように挑戦するべきです。最後に、ここではオープンソースというのは少し誤称であると言っておきます。オープンソースは通常、素早くイテレーションを行う小規模な開発者を指します。ここで、この発言は私にとって非常に滑稽なものでした。これが私を驚かせました。自分がそれを正しく聞いたかどうか確信が持てなかったからです。この発言をもう一度見てください。オープンソースは通常、小規模な開発者を指します、ここに書いてありますね。オープンソースは素早くイテレーションを行う小規模な開発者を指します。これはどういう意味でしょうか。オープンソースというのは、一部の人々がある程度のイテレーションを行うためだけにやっている子供っぽい仕事にすぎないと言っているのでしょうか。世界にはLinuxなどの最高のプロジェクトがいくつかあり、それらは完全にオープンソースです。これは私が言及したように、自分がすでに真実だと決定したことの説明のために問題を探しているだけのようなものです。

オープンウェイトモデルとアメリカ政府の規制

少し異なることについて話しますが、はるかに大規模なモデルの制御されていないリリースについてです。ホーリー上院議員のご指摘の通り、モデルのトレーニングに数千万ドル、あるいは数億ドルを支払うようなはるかに大規模な事業体によるものです。私たちはそれを少し異なるカテゴリとして考えるべきだと思います。さて、これに関して驚くべき素晴らしいことは、オープンウェイトモデルのクラスはアメリカ政府によって統治されていないということです。DeepSeek、GLM、Kimi、MiniMaxなどのオープンウェイトモデルやその他のモデルがリリースされるかどうか、あるいは彼らが研究室で何をしているかについて、アメリカは決定権を持っていません。これこそがAIのゲームがこれまで展開されてきた方法であり、これらの企業がすべてアメリカ以外の企業であることは実際に良いことです。なぜなら、もしそれらがすべてアメリカの企業であり、アメリカがすべてのカードを握っていたとしたらと想像してみてください。これらの企業はすべて、アメリカ政府がこれらのフロンティアモデルをリレーするために含めている厳格さをもって、輸出管理規則を遵守しなければならなかった可能性が十分にありますし、現時点ではその可能性の方が高いのです。今私が期待しているのは、いつかxAI、Anthropic、Google、OpenAIなどのフロンティアラボが、見落としているかもしれませんが、少なくとも今後数ヶ月の間に私たちがリリースを期待しているフロンティアモデルを構築している他のラボは思い当たりません。いずれにせよ、ここでのアイデアは、ある一定の閾値を超えると、これらのラボはアメリカ政府によるモデルの監査を受けることが義務付けられるだろうということです。それが現在確立されており、私たちはそれがMythosやGPT-5.6、SOLなどで実際に動いているのを見ています。xAIでも今後数ヶ月のうちに、おそらく今年中には確実に起こるでしょう。このような場合、私たちはこのカテゴリをこれまで以上に必要としています。なぜなら、たとえばDeepSeek V5が登場し、サイバーセキュリティ分野ではないかもしれませんが、他の分野でMythosモデルのようなものを打ち負かしたと言い、さらにGPT-5.16やSAL Extra Highなどのモデルも打ち負かしたとしたら、それは素晴らしいニュースだからです。これでこれらの企業は内部的に自国政府に対して、私たちが取り残されているという圧力をかけることになるからです。

イノベーションの原動力としてのオープンウェイト

他のアメリカのラボも、もし彼らが制限されていなければ、フロンティアモデルを完全にバイパスして、オープンウェイトモデルを直接使用することができるでしょう。つまり、彼らは単にウェイトを直接使用してそれをホストするだけです。市場には多くの計算リソースが利用可能であり、もちろん人々はコンピューター不足があるとか推論が不足していると言いますが、多くの人々が計算の問題の解決に取り組んでいます。そのため、推論は5倍、10倍、100倍になり、これがどこで止まるかは私たちにもわかりませんが、この規模は今後数年でやってきます。だからこそ、データセンターでオープンウェイトモデルをホストすることは人々にとって問題にはならないでしょう。特にアメリカの企業や、モデルの推論を提供したいだけのアメリカのネオラボや小規模なラボにとってはそうです。しかし、このような状況が生じたとき、そもそも自分たち自身がより良い新しいモデルをリリースせざるを得なくなります。なぜなら、そうしなければ最初の段階で顧客を失い始めて驚くことになるからです。想像してみてください。もし私があなたに、DeepSeek V4が現在の形と形式で存在する唯一のモデルであり、残りのモデルはGPT-2、GPT-3.5、あるいはClaude 3だと言ったとします。私はClaude 3を使ったことすらなく、そのモデルが存在していたかどうかも、存在していたとしても正確には覚えていませんが、このクラスのモデルだとします。つまり、一方のクラスにはこのようなフロンティアモデルと呼ばれるものがあり、もう一方のクラスには、フロンティアモデルが提供するはずのものよりもはるかに優れたものがあるわけです。セットアップが少し面倒であっても、出力の品質がはるかに優れているため、あなたは当然こちらを選ぶでしょう。もしアメリカがフロンティアラボの積極的な成長と積極的な推進を止めているとしたら、これが起こるだろうと私が期待していることです。

オープンウェイトモデルの真実とカスタマイズ性

Xで一部の人々から提起されたもう一つの指摘事項があり、ここで対処しておきたいと思います。一部の人々はオープンウェイトはオープンソースではないと言いました。一般的に言って、オープンウェイトとは何かというと、実行ファイルのようなものと考えてください。正確には実行ファイルではありませんが、そんな感じのものです。もちろんオープンソースというのは、モデルがどのようにトレーニングされたか、おそらくデータソースや、モデルのトレーニングに使用されたその他の依存関係の束を示す事前トレーニングコードのようなソースコードのことです。現在、これらの企業の多くは実際にはこのデータのすべてをリリースしていません。それは彼らが望んでいないからではなく、このデータが実際にプロプライエタリだからだと私は感じています。誰も自分のモデルをどのようにトレーニングしているかを本当に話さないので、明らかに彼らはそのデータを出したくありません。そして彼らが行っている強化学習の環境や強化学習の事柄についても、どのように行っているのかをあなたに教えたくありません。だから、まあいいでしょう、私たちがそのままmodel.exeを使い続けることは可能です。しかし、ご存知の通り、このモデルにはある種のガードレールが付属している可能性があります。たとえば、DeepSeekがリリースされたとき、台湾という少しホットな話題についてDeepSeekに尋ねると、中国について延々と唱え始めることをご存知でしょう。しかし、このトピックはDeepSeekにある種ガードレールとして組み込まれています。ロジック、つまりDeepSeekが答えるべき方法はほぼハードコードされています。アメリカのラボが自分たちでDeepSeekモデルをホストしたとき、これは削除されました。彼らは、この種のガイドラインやこの種のモデルの弱体化が取り除かれるような形で変更を加えただけです。そのため、非純正モデルのDeepSeek V4やさらに初期のモデルをホストしているあるラボによってアメリカのデータセンターでホストされているDeepSeekモデルに質問すれば、あなたが期待するニュアンスで適切に答えてくれるでしょう。ですから、ソースコードやデータがなければ多くのことができないというのは反論にはなりません。絶対にモデルを入手し、少し再トレーニングしてウェイトを変更し、意味のある方法でウェイトを修正することができるからです。

終わりに

この動画はこれで全てです。皆さんがどう思うか、ぜひコメントで教えてください。私はAnthropicが好きですし、彼らの仕事も好きです。しかし私が気に入らないのは、特にダリオがAnthropicを位置づけている方法です。それは、開発者や、物を所有したり、自分のものをただホストしたり、24時間365日監視される代わりに自分のデータを手元に置いておくファンである人々にとって、少し非友好的で歓迎されていないように感じさせます。動画は以上です。気に入っていただけたら幸いです。もしよかったら、いいねを押してチャンネル登録をお願いします。また次の動画でお会いしましょう。

コメント

タイトルとURLをコピーしました