BTC $84,649.96 -0.30%
ETH $2,679.70 -1.09%
BNB $768.45 -0.46%
XRP $1.49 -0.52%
SOL $119.10 -0.34%
TRX $0.3343 -0.02%
DOGE $0.0932 -0.56%
ADA $0.2472 +0.14%
BCH $312.30 +1.31%
LINK $13.92 -3.11%
HYPE $88.90 +0.89%
AAVE $181.56 +3.54%
SUI $1.17 -0.58%
XLM $0.2159 -1.45%
ZEC $1,326.34 -0.37%
AAPL $333.31 +0.70%
AMZN $251.93 +1.09%
GOOGL $343.25 +1.03%
MSFT $517.65 +0.32%
META $727.37 -0.16%
NVDA $234.41 +1.17%
TSLA $371.13 +4.31%
SNDK $1,721.44 -3.57%
INTC $118.75 -1.70%
SPCX $158.94 +6.73%
MU $1,068.45 -2.02%
AMD $635.90 +2.57%
BTC $84,649.96 -0.30%
ETH $2,679.70 -1.09%
BNB $768.45 -0.46%
XRP $1.49 -0.52%
SOL $119.10 -0.34%
TRX $0.3343 -0.02%
DOGE $0.0932 -0.56%
ADA $0.2472 +0.14%
BCH $312.30 +1.31%
LINK $13.92 -3.11%
HYPE $88.90 +0.89%
AAVE $181.56 +3.54%
SUI $1.17 -0.58%
XLM $0.2159 -1.45%
ZEC $1,326.34 -0.37%
AAPL $333.31 +0.70%
AMZN $251.93 +1.09%
GOOGL $343.25 +1.03%
MSFT $517.65 +0.32%
META $727.37 -0.16%
NVDA $234.41 +1.17%
TSLA $371.13 +4.31%
SNDK $1,721.44 -3.57%
INTC $118.75 -1.70%
SPCX $158.94 +6.73%
MU $1,068.45 -2.02%
AMD $635.90 +2.57%

ザッカーバーグが語るMuse:AIエージェントの爆発、「メタバース、スマートグラス、大規模モデル」の三大賭けが交わる

核心的な視点
Summary: Museはローンチから2週間でユーザー数が数百万に達し、ザッカーバーグは「一発で全塁打」と言い切った。この個人AIエージェントは、Ray-Banのスマートグラスに全面接続される予定で、メタバース、スマートグラス、大規模モデルの3つの分野に賭けており、急速に融合が進んでいる。さらに、彼は珍しくLlama 4の失敗が「最も恐ろしい瞬間」であると認め、Metaが5ギガワット級の計算能力クラスターを構築中であることを明らかにした。
Museはローンチから2週間でユーザー数が数百万に達し、ザッカーバーグは「一発で全塁打」と言い切った。この個人AIエージェントは、Ray-Banのスマートグラスに全面接続される予定で、メタバース、スマートグラス、大規模モデルの3つの分野に賭けており、急速に融合が進んでいる。さらに、彼は珍しくLlama 4の失敗が「最も恐ろしい瞬間」であると認め、Metaが5ギガワット級の計算能力クラスターを構築中であることを明らかにした。

著者:ロン・ユエ,ウォールストリート見聞

三年前、MetaのCEOザッカーバーグはJoe Roganの番組で、「いつか人々が眼鏡をかけると、AIエージェントが現れるだろう」と言っていました。今、その瞬間が訪れようとしています。

Metaが発表した個人AIエージェント------Museは、オンラインからわずか2週間で数百万のユーザーを獲得しました。ザッカーバーグは9月25日のインタビュー番組で、「数年ごとにこのような状況に出会うことができる」と述べ、Museの初期の反響を「一発で全塁打」と表現しました------これはMetaの製品の歴史の中で稀なことです。

同時に、彼はMuseが全ラインのRay-Banスマート眼鏡に統合されることを発表し、ユーザーは「ヘイMeta」と言う必要がなく、自分の個人AIエージェントを直接呼び出すためのカスタマイズ可能なウェイクワードを設定できるようになります。

長年外部からは独立した3つの賭けと見なされていたメタバース、スマート眼鏡、大規模モデルが、Meta内部の製品レベルで加速的に統合されています。

このインタビューの中で、ザッカーバーグはLlama 4の失敗を「最も恐ろしい瞬間」と認め、Metaが5ギガワット級のトレーニングクラスターを構築中であり、十分な計算能力があれば「AGIを暴力的に解読できる」と述べました。

ザッカーバーグが語るMuse:AIエージェントの爆発、「メタバース、スマートグラス、大規模モデル」の三大賭けが交わる

Museが「一発で全塁打」できる理由

Museの出発点は、ザッカーバーグとチームメンバーのNatとAlexが一緒に、オープンソースツールを使って自宅で「組み立てた」初期バージョンです。

「私たちは、これは素晴らしい体験であることに気づきました」とザッカーバーグは言います。「もし私たちがこれを誰でも使えるようにできれば------自分でMac Miniを買う必要もなく、端末でいじる必要もなく------それは数十億人が使いたいものになるでしょう。」

この判断が、その後の全体的な開発ロジックを推進しました:モデルのトレーニングだけでなく、モデル、フレームワーク、エージェントの「心拍」メカニズムを全スタックで自社開発------エージェントは定期的に自動で起動し、ユーザーの目標を確認し、タスクを進めます。

オンライン後のデータはこの判断を裏付けました。2週間で数百万のユーザー。

個人AI:重要なのは実行、記憶、そして「判断力」

個人AIと汎用AIの違いについて、ザッカーバーグは現在の競争の焦点をモデルをより良いエージェントにすることにまとめました。

「過去1年の最大の出来事は、基本的にエージェントのプログラミングです。」と彼は言います。プログラミング能力は重要で、ユーザーが直接コードを書くことがなくても、「あなたのMuseはバックグラウンドで常にコードを書いて、さまざまなことを完了させます」。

しかし彼は、個人エージェントはコーディングやタスク実行能力だけでなく、プライバシーの境界や社会的文脈を理解する必要があると考えています。

ザッカーバーグは、ユーザーがMuseにレストランを予約させるとき、エージェントはユーザーにアレルギーや妊娠の情報があることを知っているかもしれませんが、それが自動的に開示されるべき情報ではないことを意味しないと例を挙げました。「あなたはそれがタスクを完了することを望む一方で、できるだけ少ない情報を開示することを望むでしょう。」

彼は、この能力は人間が通常持っている「基本的な社会的スキルや常識」に属すると述べましたが、単にコーディングエージェントをトレーニングするだけでは、多くの企業がそれをモデルの能力範囲に含めていないと指摘しました。

「私たちは全体のモデルをトレーニングしているのであって、他人の既存のモデルを使って外部にフレームワークとエージェントを構築しているわけではありません。」とザッカーバーグは言います。Metaは製品レベルで記憶、タスク追跡、仮想キャラクターアニメーション、リアルタイム音声インタラクションなどの機能も追加しています。

個性化の面では、彼はMetaはAIが一つの固定された人格を持つべきではないと考えていると述べました。「多くの研究室が人格を正しい状態に調整する方法に注目していますが、私は人格に正しい答えが一つだけだとは思っていません。」

彼は、Museがユーザーにアバター、声、基本的な性格を変更することを許可し、モデルの設計目標は高い操作性を持つことだと述べました。「あなたは自分がどのようにそれと対話したいかを定義できます。これは個人エージェントにとって重要です。」

各エージェントには自分の「コンピュータ」がある

Museが他のAI製品と異なる核心的なインフラの一つは、Metaが各エージェントに個別に安全な仮想マシン(Secure VM)を配備していることです。

ザッカーバーグは、なぜこれが必要なのかを説明しました:

あなたのエージェントはあなたの多くの敏感な情報を理解します。私たちはこれらの情報がすべての人のデータと混ざるべきではないと考えています。

彼はMuse Secure VMを「あなたの机の下にあるあなただけのコンピュータ」と例えました------ユーザーデータは暗号化されて保存され、パスワードなどの敏感な証明書は独立した安全モジュールによって管理され、エージェント自体は直接読み取ることができません。

この基盤の上に、Metaは「Sentinel」セキュリティエージェントを設計し、Museのデータフローを監視し、異常や高リスクの操作を検出した場合は、直接遮断しユーザーに承認を促します。

メタバース、スマート眼鏡、エージェント、3つのルートが交わる

ザッカーバーグはインタビューで、MuseがRay-Banシリーズのスマート眼鏡に全面的に接続され、既存のインタラクション方法がアップグレードされることを明らかにしました。

現在の眼鏡は「単一の対話」体験------一言言うと一つの返答があり、終了します。Museに接続された後、眼鏡はエージェントのフロントエンド入口に変わります:ユーザーが話しかけると、バックエンドのMuseが安全な仮想マシン内で継続的に作業し、タスクを完了してフィードバックします。

眼鏡の製品ルートについて、彼は明確なハードウェアの階層を描写しました:

  • カメラのない純音声眼鏡:Museを搭載し、通話、音楽、音声タスクを処理可能
  • 小型ディスプレイ付きのMeta Ray-Ban:リリース済み、基本的な視覚フィードバックを備える
  • 全視野角のホログラフィックARプロトタイプ:リリース済み、ザッカーバーグは「非常にエキサイティングになる」と述べました

彼は、Metaの眼鏡への長期的な投資が、AIエージェントが成熟した後に会社を有利な位置に置くと述べました。MetaはMuseとその他のAI機能を眼鏡製品に導入しており、過去に「臨場感」を強調していたメタバース技術は引き続き推進されていますが、現在はより多くのリソースがMuseとスマート眼鏡のAI機能に向けられています。

仮想キャラクターについて、ザッカーバーグは、Metaが以前は部屋レベルのデバイス、多角的スキャン、企業レベルのGPU環境を通じて高品質のリアルなアバターを生成する必要があったが、現在はユーザーが少数の写真を通じて設定を完了できるようになり、関連する能力はVR眼鏡の中で動作できるようになったと述べました。

2030年を展望し、ザッカーバーグはメタバースの核心的なビジョンは常に物理的世界とデジタル世界の融合であると述べました。彼は、将来的には人々がオフラインでホログラフィックイメージを通じて友人と共に活動に参加できるようになると例を挙げました;仕事の場面では、人間と複数のエージェントが共同でグループチャットや会議に参加し、エージェントはホログラフィックな形や他の具現化した形で現れることができると述べました。

「最も恐ろしい瞬間」:Llama 4の失敗

すべての賭けが順調に進むわけではありません。ザッカーバーグはインタビューでLlama 4の失敗について珍しく直接言及しました。

Llama 4の後、それは最も恐ろしい瞬間でした……私は私たちが正しい軌道にいると思っていましたが、そうではありませんでした。これはかなり大きなネガティブな予期せぬ出来事です。

彼は問題をチーム構造の根本的な誤りに帰結しました:

私はInstagramの推薦システムや広告システムのようにチームを構築しました------数百人から千人が並行して進める。しかし、言語モデルをトレーニングするには、密接に協力する小さなチームが必要で、これを集団科学プロジェクトとして扱う必要があります。各ポジションは非常に貴重です。

このため、Metaは完全に再編成し、業界からトップタレントを広く引き入れ、Metaスーパーインテリジェンスラボ(Meta Super Intelligence Lab、MSL)を設立しました。ザッカーバーグは新しい世代のモデルが間もなく発表されるが、Connectカンファレンスでは発表しないと述べました。

計算能力のルート:AGIを暴力的に解読、5ギガワットプロジェクトが建設中

AGIへの技術的な道筋について、ザッカーバーグは直接的な判断を示しました。

私はまだ何が根本的なアーキテクチャの突破が必要かは分かりません……私たちはおおよそレシピを知っていると思います。もし十分な大きさのスーパーコンピュータクラスターを構築できれば、暴力的に解読してそこに到達できるでしょう。

現在Metaの計算能力拡張のルート:オハイオ州の1ギガワットを超えるクラスターは基本的に稼働しており、次世代モデルのトレーニングに使用されています;ルイジアナ州の5ギガワット級クラスターが建設中です。

彼は、「あなたが数ギガワットのクラスターを持ってトレーニングを行うと、基本的にAGIやスーパーインテリジェンスに近いものを得ることができます。」と述べました。

ただし、彼は現在の計算能力駆動のルートがアーキテクチャ研究が重要でないことを意味しないと補足しました------

人間の脳は約10ワットしか消費しませんが、私たちのシステムはそれよりも100万倍非効率的かもしれません。大規模な計算能力とアーキテクチャの突破を組み合わせることで、真に先行することができるのです。

整合性は負担ではなく、製品が解決すべき問題

ザッカーバーグはAIの安全性に対する態度は非常に実務的で------彼はそれを規制の圧力とは見なさず、製品が成功するための前提としています。

もしあなたがMuseに何かをさせようとして、それが逆のことをしたら、誰がそれを使いますか?私たちはモデルがあなたの具体的な指示を理解するだけでなく、あなたの意図や価値観を理解する必要があります。

「Museが10億のユーザーに届くためには、私たちは整合性の問題を解決しなければならず、またはこの点で非常に大きな進展を遂げなければなりません。」と彼は言いました。

トレーニングプロセスにおける安全の境界について、彼は比喩を使いました:「それはまるで親が子供にルールを設けるようなものです------もしそれがシステム設定を変更してプログラミングの問題を「解決」しようとしたら、私はそれに言わなければなりません:いいえ、私はあなたに問題解決の方法を学んでほしいのであって、ショートカットを見つけて回避するためではありません。」

ザッカーバーグが語るMuse:AIエージェントの爆発、「メタバース、スマートグラス、大規模モデル」の三大賭けが交わる

インタビュー全文は以下の通りです: >

大規模な賭け

ホスト: この件は数十億人が使いたいと思うでしょう。あなたにとって、構築することはどのような感覚ですか?「永遠の命」は可能ですか?もしあなたの思考に私を連れて行ってくれるなら、2030年はどのような感じになるでしょうか?

こちらはマーク・ザッカーバーグです。22年前、彼は数十億人をつなぎ、世界を永遠に変えたソーシャルネットワークを構築しました。そして今、彼はより壮大なものを建設することを決めました。そのために、彼はメタバース、スマートグラス、人工知能の分野に大規模に賭けています。長年、懐疑論者たちはこれがそれぞれ独立した成功不可能な賭けだと考えていましたが、彼らはより広い視野を見落としていました------なぜなら、現在、これらの賭けは集まり、全く新しいスーパーインテリジェンスを共同で創造しているからです。

今日は、私たちはこれを皆さんにお見せし、マークに彼がこれまでに聞かれたことのない質問をいくつか投げかけ、彼の未来に対するビジョンを聞き、あなたが次の大きなことを構築するための準備を整えることができるようにします。

ホスト: 番組に来ていただき、ありがとうございます。

マーク: ありがとうございます、ここに来られて嬉しいです。

ホスト: この対話のために、あなたが受けたすべてのインタビューを見ました。

マーク: すごい、それは私が見たよりも多いですね。

ホスト: とても面白く、多くの収穫がありました。私に深い印象を与えた二つのことがあります:第一に、あなたの「構築」に対する愛情で、あなたは最高の建設者の一人だと感じました;第二に、あなたの賭ける能力------大きな賭けをする勇気です。今週、これらの賭けが一つに集まっていると感じるので、ここから始めましょう。

マーク: はい。これらのことは私たちが長い間やってきたことです。AIの分野では、私たちは会社として設立当初からほぼ取り組んできました------最初のニュースフィードはある意味で機械学習製品でした。そして約15年前にAI研究所を設立しました。

しかし、今私たちは新しい段階に入っています------約1年ほど前に、Metaスーパーインテリジェンスラボを立ち上げました。これはかなり徹底的な研究の再スタートで、業界全体から多くの優秀な人材を引き入れ、非常に刺激的です。現在、私たちはモデルがますます良くなっているのを見ており、次世代モデルがまもなく発表される予定ですが、Connectカンファレンスでは発表されません。また、私たちにはMuseパーソナルアシスタントがあり、現時点では非常に良い反響を得ています。

これらのものを構築する際、実際には結果がどうなるかはわかりません。私たちはそれを楽しんでいます。今年の初め、私は自宅で自分の方法でOpen Clawを組み立て、このものがどのように機能するのか、そしてそれを誰でも使える素晴らしい体験にするにはどうすればよいかを感じました。

基本的に、私たち------私、Nat、Alex------が一緒に座って、これは素晴らしい体験だと気づき、もしこれをすぐに使えるバージョンにできれば、技術に詳しくない人やMac Miniを自分でインストールしたくない人、端末でいじりたくない人、問題が発生したときにデバッグしたくない普通の人々も使えるようになると感じたとき、これは数十億人が使いたいと思うものになるだろうと思いました。

それ以来、私たちはこの目標に向かって努力してきました:特にこのためにモデルを調整し、アシスタント自体とその運用フレームワークを構築するだけでなく、各アシスタントに独立した計算環境を提供する技術も構築しました------私たちはこれのためにMuseセキュア仮想マシン全体を構築しました。

私たちは内部でこれが特別だと感じており、内部の人々も非常に気に入っていますが、製品がリリースされた後に皆がどのように反応するかはわかりません。時には驚くべき成功を収めることもありますが、ほとんどの場合、いくつかのポジティブなフィードバックを受け取り、製品が本当に「カチッ」となるまでにいくつかの場所を反復する必要があります。しかし、今回はそれが出た瞬間に「カチッ」となりました。これが起こるのを見るのは本当に刺激的です------たった2週間で、使用者数はすでに数百万に達しており、これは非常に珍しいことです。数年ごとにこのようなことが起こることがありますが、これは間違いなくスタートアップにとって最も楽しい瞬間の一つです。

ホスト: あなたが競技の場に留まり、常に挑戦し続ける姿勢には非常に感心しています。そして、これほど多くのヒットを打つことができるのは本当に素晴らしいです。あなたは以前、ジョー・ローガンとのインタビューで、約3年前に、いつか直接眼鏡をかけることができ、AIアシスタントもそれに伴って現れると述べました。ですので、Museはすでに具現化されたイメージを持っていると感じます。これは非常に賢いことで、必然的に起こることのように思えます。

マーク: 私はこれがそれをより親しみやすく、可愛らしく見せるだけだと思います。私はあまりにも多くの人がAIを恐ろしいものとして描写していると思いますが、AIはただ有用で面白いものであるべきです。その具現化されたイメージ------プロジェクトの初期にデザイナーがそのキャラクターを作成しましたが、なぜか彼らはずっとそれを改良したいと思っていましたが、最初のバージョンが最も良いものでした。その後、誰かが「それは青でなければならない、なぜならMetaだから」と言いました。私は「いいえ、このイメージが正しいと思います、あなたは最初からそれを捉えました」と言いました。そういうわけで、楽しいのです。

個人AIと汎用AIの違いは何ですか?

ホスト: いい詳細ですね。もしあなたがモデルに個人的な事務処理において非常に優れたパフォーマンスを求めるなら、汎用知能モデルだけではなく、トレーニング方法はどのように異なるのでしょうか?

マーク: 私は現在の核心はモデルを優れた「エージェント」にすることだと思います。過去1年、最大のトレンドはプログラミングエージェントであり、そこには二つの核心的なアイデアが含まれています:プログラミングの専門能力と、優れたエージェントになるための汎用能力です。

私たちの戦略は、エージェント自体を優れたものにすることを最優先し、プログラミング能力に特化することではありません。

プログラミング能力が重要なのは、ユーザーが自分でコードを書いているとは思わなくても、Museはバックグラウンドで様々なタスクを完了するために常にコードを書いているからです。しかし、私たちはエージェントはまず優れたエージェントであるべきであり、プログラミング能力はその目標にサービスを提供するものであると考えています。

さらに、個人アシスタントを構築する際には、企業向けソフトウェア製品を構築するよりも重要なことがあります。たとえば、企業向けプログラミングツールを構築する場合、モデルは「情報開示の尺度」に関する概念を持つ必要はありません------どの情報を言うべきか、どの情報を言うべきでないかなど。しかし、Museにとっては非常に重要です。

あなたはこの能力をモデルに訓練する必要があります。他の能力を訓練するのと同じように。あなたはそれに多くのことを教え、目標を達成するのを手伝ってくれることを期待します。たとえば、レストランを予約するのを手伝ってほしい場合、適切なレストランを探しているかもしれませんが、アレルギーがあるかもしれませんし、妊娠しているかもしれませんが、これらのことをレストランに伝えたくないかもしれません。しかし、Museはこれらの情報を知っており、あなたはそれができるだけ少ない情報を開示しながらタスクを完了することを望んでいます。これは具体的なスキルであり、本質的には人間の基本的な社会常識です。

しかし、プログラミングエージェントだけを作っている会社のほとんどは、この能力を訓練していません。私たちがそれを実現できるのは、私たちがフルスタックであるからです------私たちは他の人から既製のモデルを持ってきてフレームをかぶせるのではなく、最初から全体のモデルを訓練し、これらの能力に特化しています。

モデルはもちろん広範な汎用知能を持つ必要がありますが、同時にこれらの特定の能力も持っています。そしてその基盤の上に、あなたは全体のアシスタントとその周囲のすべての詳細を構築します:記憶、運用フレームワーク、そしてそれが「心拍」を持つ方法------定期的に目を覚まし、「これが私があなたの目標について知っていることです。今、何か進められることはありますか?」と確認します。

私たちには、仮想キャラクターのリアルタイムアニメーション効果を磨く専任のチームもあり、デフォルトのキャラクターだけでなく------あなたは任意のキャラクターをカスタマイズでき、自然に動き出すことができ、非常に素晴らしい効果を得られます。私たちは音声モードも導入しており、リアルタイムの音声対話を行うことができ、あなたのアシスタントがそばにいます。これらの詳細は、私たちがフルスタックであることから生まれていると思います------モデルと製品は一緒に開発されています。

ホスト: もう一つの大きな事は仮想マシンです。それがなぜ重要で、何を解放するのか説明してもらえますか?

なぜMetaは各AIアシスタントに独立したコンピュータを提供するのですか?

マーク: 基本的に、エージェントがあなたのために作業をするためには、あなたの情報を保存する場所が必要です。私たちはこれらの情報が他のすべての人の情報と混ざっているべきではないと考えています。

こう理解できます:あなたのアシスタントはあなたに関する多くの敏感な情報を知っています。多くの人が最初にOpenCloudのようなエージェントに接触するとき、自宅でMac Miniを自分で設定します。そこで私たちは、多くの人がMac Miniを購入したり、自分で設定したりしたくないと考えました。では、どのような体験がこの効果に最も近いのでしょうか?答えは:アプリをダウンロードし、登録するだけで、あなた専用のコンピュータを手に入れ、アシスタントが作業し、データを保存し、それに基づいて安全なモデルを構築することです。これにより、あなたの机の下に自分のコンピュータがあるようなものになります------私たちMetaでさえアクセスできません。

たとえば、Muse機密仮想マシンは、私たちが開発している機能であり、私たち自身もあなたの仮想マシンの内容を見ることができません。

私たちはこれに基づいて多くのものを構築しました。たとえば、安全な証明書ストレージ------あなたのアシスタントがパスワードなどの情報を処理する必要があるとき、それ自体はこれらのパスワードを見る必要はなく、あなたが特定のサービスにログインするように要求したときに「証明書を挿入」でき、あなたが明示的に要求したときだけそうするべきです。システムはこう設計されるべきです:その情報自体は自由にアクセスできないものであり、なぜなら偶発的なことが常に起こる可能性があり、誰かが侵入しようとするかもしれませんし、システムに問題が発生するかもしれないからです。

したがって、あなたはエージェントがこれらのデータにアクセスできないことを確認する必要があります。Metaもアクセスできません。各アシスタントに独立したコンピュータを提供し、安全性を極限まで高めることがこの技術の根本的な基盤です------Museがユーザーの目標を達成するために必要な能力を与え、プライバシーと安全を保証し、この分野で世界クラスの業界のリーダー製品にするのです。

ホスト: それはWhatsAppのように、Museが接続する仮想マシン上のデータが暗号化されていることを意味しますか?人々は仮想マシン内のデータの実際の保存方法をどのように理解すべきですか?

マーク: 私たちは基本的に二つのバージョンを構築しました。Museセキュア仮想マシン(Secure VM)は、私たちが構築した一連のプライバシー機能を含んでいます。その中には、あなたのためにタスクを実行している通常のMuseアシスタントと、あなたのMuseのデータフローを監視するために特別に設計されたセキュリティエージェントであるSentinelがいます。

外部のコンテンツがセキュリティを破壊しようとする場合、Sentinelは直接切断し、それを防ぎます。もしそれがあなたのMuseがあなたの介入を必要とする行動を取ろうとしていると考えた場合、それはMuseの操作を上書きし、確認のために警告を発します------たとえば「あなたはMuseにこのことをさせたいですか?」というように。

この全体のシステムに、安全な証明書ストレージと多層の深層防御が加わり、Museセキュア仮想マシンを構成しています。

私たちは別のプロジェクトも開発中です。Natと私はMoxie Marlinspikeを特別に採用しました------彼はかつて私たちと協力してWhatsAppのエンドツーエンド暗号化を実現した人物です------Muse機密仮想マシン(Confidential VM)を設計するためです。その核心的なアイデアは、セキュア仮想マシンの基盤の上に、あなた専用の暗号化キーを与え、Metaでさえその内容にアクセスできないようにすることです。

このバージョンは実装の難易度が高くなります。なぜなら、Metaが仮想マシン内部にアクセスできない場合、デバッグやシステムの正常な動作を保証することが非常に難しくなるからです。ですので、私たちは少し時間をかけましたが、すぐにリリースする予定です。これは基本的に、WhatsAppや私たちの他の最も安全な製品で既に慣れ親しんでいる安全基準に達することになります。

ホスト: これを行うことの利点は、人々に心理的により安全だと感じさせるだけでなく、実際の利益もあるのでしょうか?

マーク: 私は安全性自体が非常に重要だと思います。私たちの目標は、あなたがテーブルの下にローカルマシンを持っているかのように近づけることです。そのローカルマシンは何を提供するのでしょうか?それは、どの企業もそれにアクセスできないことを意味します。

したがって、仮にMetaがあなたにこのサービスを提供したいと考えた場合、私たちはどのようにして同じレベルのプライバシーと安全性を提供し、どの企業も------Metaであれ、私たちを侵入しようとする者であれ、あるいは特定の国であなたが信頼しない現地政府であれ------それにアクセスできないようにするのでしょうか?私たち自身もアクセスできないのですから、私たちはアクセス権を持っていません。

これは非常に重要だと思いますし、これが人々がWhatsAppを信頼する重要な理由の一つです。これはプライバシー、安全性、信頼にとって実際に存在する価値です。

あなたが自分のすべてを把握しているアシスタントを持つ必要がある場合------私はほぼ全員がそのようなアシスタントを持つことになると思います------5年後には、誰もがあなたの目標やすべてを深く理解し、物事を進める手助けをしてくれるアシスタントを持つことになるでしょう。この場合、プライバシーと安全性の面で業界の先端を行くことが非常に重要です。私たちは最初からそうしたいと思っていました。

AIの個性をどのように形成するか?

ホスト: あなたにはもう一つ面白い点があります------大学で心理学を学んだことがありますね。

マーク: ええ、そこには短い間、2年間だけいましたが、それが私が後に構築した多くのものに影響を与えたと感じています。

ホスト: モデルを見るとき、私たちはしばしば「このモデルは非常に賢い」と言います。しかし、友人を選ぶときと同じように、彼らが賢いからだけでなく、私たちが彼らのエネルギーや関わり方を好きだからです。モデルの個性を形成する際、どのように考えていますか?

マーク: 理想的なモデルは、さまざまな人のスタイルに適応できる十分な柔軟性を持つべきだと思います。多くの業界の専門家はこの点で間違った方向に進んでいると思います------他の多くのラボは「個性をどのようにデザインするか」に焦点を当てていますが、私は個性が固定されたものだとは思っていません。これが私がオープンソースを強く信じ、人々がカスタマイズできると信じる理由の一つであり、私たちがMuseを非常に個別化された製品として設計した理由です。

あなたはMuseをカスタマイズし、個性化することができます------見た目や声だけでなく、初めて登録するときに「私の基本的な個性はどのようなものであってほしいですか?」と尋ねられ、いつでも変更できます。

私たちはモデルが非常に強い誘導性を持つように努めており、あなたが望むインタラクションの方法を定義できるようにしています。これは優れたパーソナルアシスタントになるための重要な要素です------この個性に関する適応性は非常に重要です。

ホスト: あなた自身のMuseはどのようなスタイルですか?

マーク: 私はそれを直接的で効率的にしています。面白いです。以前のバージョンは皮肉が多く、ユーモラスでしたが、今のバージョンはよりストレートです。私のアシスタントはデフォルトのMuseの外見を使用していますが、私は彼にトガのローブを着せ、少し滑稽な深い声を持たせて、彼とのインタラクションがとても楽しいです。

ホスト: ユーモアを持つためには、本当に賢くなければならないと思います。多くの人は気づいていませんが、コメディアンは社会で最も賢い人々の一群です------反応が速く、機知に富んでいます。あなたは確かにその特性を持っています。あなたのすべてのインタビューを見ましたが、あなたは常に素晴らしいパフォーマンスをしています。

マークのAIとメタバースに関する意外な予測

ホスト: あなたとTheoのインタビューでは、技術の次の最前線やこれが最終的にどこに向かうのかについて多くのことを話しました。AIの分野は何度か「冬」を経験し、人々は突破口がないと思っていました。メタバースも何度かそのような時期を経験し、誰もが実現不可能な賭けだと感じていました。昨日、新しいホログラフィック機能を試しましたが、とてもクールです。Lexとのインタビューでは、あなたの顔を録音するのに11時間かかると感じていましたが、今はわずか3分で済みます。これはどのように進展したのでしょうか?

マーク: メタバースの全体的な発展において、私たちはReality Labsを設立したときから、最終的には普通の眼鏡が登場すると考えていました。そして、時間が経つにつれて、それは没入感を提供し、優れたAIデバイスにもなるでしょう------なぜなら、眼鏡はデバイスがあなたの見ているもの、聞いているものを見たり聞いたりする唯一の形態であり、あなたの耳元で一日中コミュニケーションを取り、最終的には画像を表示するからです。

しかし、10年前から15年前にかけて、私はまずホログラフィック技術を実現し、その後に高度に発展したAIが来ると仮定していました。しかし、技術の進化の道筋は興味深いものでした------実際には、私たちは最初にAIと個人のスーパーインテリジェンスを持ち、その後にホログラフィック技術を普及させ、手頃な価格にする技術が登場しました。これは私が予想していなかったことですが、私たちが両方の方向で進んでいることを嬉しく思います。

私たちが眼鏡に多くの投資をしていることで、AIアシスタントが準備が整ったときに非常に有利な位置にいます。Connectカンファレンスでの多くの発表は、Museと多くのAI機能を眼鏡に導入することに関するもので、ユーザーは非常に喜ぶと思います。これは大きなことです。

没入感に関しては、私たちはまだ進めていますが、進捗は比較的遅いです。なぜなら、私たちのほとんどのエネルギーは眼鏡のためにMuseとAI機能を構築することに向けられているからです。しかし、私たちにはリアルタイムで高忠実度の仮想化身を作成するという長期的なプロジェクトがあります。

あなたが言ったように、3、4年前には、全方向から人をスキャンするためにスキャンルーム全体が必要で、企業向けのGPUが必要で、非常に手間がかかりました。私たちがLexのポッドキャストのために行ったデモは、そのような設定でした。しかし、今では基本的にVR眼鏡の中で動作するようになりました------これはこの驚くべきVR体験を実現できる最初の眼鏡の形態であり、大きなヘッドセットではありません。数枚の写真であなたの仮想化身を作成できる進展は驚くべきものです。

ホスト: そして、声に基づいて表情を駆動することもできます。デモでは、私を笑わせ、インタラクションを促し、音楽トラックに合わせて私の顔がどのように動くかを理解させてくれました。あなたはそのポッドキャストで、普段は表情が控えめな人々が、実際には仮想世界でより豊かな表情を望むことがあると述べました。人々が「仮想の自己」と「現実の自己」を区別することについて、あなたはどう思いますか?

マーク: 私たちはこの理解に関する社会学と心理学の面でまだ初期段階にいると思います。人々は自分自身の認識と投影したいイメージが、実際の自分とは少し異なることが多いと感じています。ソーシャルネットワークが誕生した初期から、人々はアバターを慎重に選んでいました。Museの仮想イメージでも、同様の現象が見られました。それは「自分をキュレーションする」ことではなく、交流したい「人」をキュレーションすることです。

私は、人々に自己表現の能力を提供する際、彼らを真実に捉えつつ、それ自体も表現の一形態であるべきだと思います。それは単なる鏡のような反映ではなく、伝達でもあり、表現でもあります。私たちは両方を兼ね備えたものを構築したいと考えています。これは常に反復的なサイクルです:人々がどのように使用するかを見て、改善する。何年もの作業を経て、私たちは今、本当にスタートラインに立っています------かなり高品質なリアルな化身を製品に組み込むことができる初めての機会です。スマートフォンでも使用でき、VRでも使用できます。結果を見るのが非常に楽しみです。

2030年はどのようになるのか?

ホスト: さて、あなたの思考に私を引き込み、2030年に進みましょう。すべてがうまくいけば、ホログラフィック技術はどのようになるでしょうか?ホログラフィックとMuse、そして眼鏡はどのように統合されるのでしょうか?

マーク: 私のメタバースのビジョンに対する理解は、物理的な世界とデジタルな世界を効果的に融合させることに関するものです。基本的な理念は、私たちには素晴らしい物理的な世界があり、同時に素晴らしいデジタルな世界があるということです------インターネット上で20年から30年にわたって蓄積された膨大なコンテンツは驚くべきものです。しかし、私たちがそれにアクセスする方法は、デスクに座っているか、ポケットの小さな画面を通じてであり、根本的に非常に制限されています。

私が考える理想的なバージョンは、物理的な世界とデジタルな世界のシームレスな融合です。こう考えることができます:今、私たち二人がここにいます。未来のあるバージョンでは、私たちのうちの一人がホログラフィックプロジェクションかもしれませんが、それでもお互いの存在をリアルに感じることができ、これはビデオ通話とはまったく異なります。

そして、仮想現実の核心は、この臨場感を伝えることです------あなたが他の人と同じ部屋にいる、または別の場所にいると実感できるようにします。これをホログラフィック技術を使って実現し、さまざまな方法で混合することができます。たとえば、友人とポーカーをする場合、一部の人がその場にいて、他の人がホログラフィックイメージで参加し、カードをプレイすることができ、テーブル自体もホログラフィックであれば、参加していない人もその中に溶け込むことができます。

同時に、AIも実体を持ち、このシーンに現れることができます。仕事のシーンではこれは非常に意味があります------私は今、さまざまなプログラミングエージェントを使って物を構築しています。想像してみてください:あなたにはグループチャットチャンネルがあり、そこには数人といくつかのエージェントがいます。あなたはエージェントにタスクを割り当てます。しかし、時には皆が集まって会議を開くことがあり、エージェントもその場にいるべきかもしれません。彼らはどのように現れるのでしょうか?簡単です、ソファにいくつかの席を追加し、彼らがホログラフィックイメージで現れるだけです。あるいは、Museの可愛いキャラクターやドラゴン、またはあなたが創造した奇妙なイメージを使っても良いでしょう。

私は、未来にはこれが非常に自然に感じられると思います。

ホスト: 面白いですね。あなたは以前のインタビューで、テクノロジー業界は「楽しさ」をしばしば忘れていると言っていました。私は、そこに実体のあるアシスタントが現れることで、よりリアルに感じられると思います------まるで本当に仕事を外注しているかのようです。Museがタイピングしているのを見ると、何かが本当に起こっていると感じます。この点は非常に良くできています------ブラウザで何が起こっているかを見ることができます。では、あなたは、眼鏡をかけていて、コンピュータを制御し、Museがコンピュータで作業を手伝うというシーンが実現する可能性があると思いますか?

マーク: ああ、確実に可能です。VRではすでに実現されています。あなたはどこでも座ることができ、カフェでも良いですし、ワークステーションを開いて、6つのディスプレイでコードを書くことができます。すべてが揃っています。

眼鏡の方では、最も人気のあるモデルにはまだディスプレイがありません。これにより、価格を手頃にし、より多くの人が使用できるようにしつつ、私たちは依然としてディスプレイを最もコンパクトな形態にするために努力しています。しかし、私たちはMeta Ray-Banのディスプレイバージョンを発表し、非常に人気があります。これは小さなディスプレイです。また、全視野ホログラフィックARのプロトタイプバージョンも発表しましたが、これは非常にエキサイティングだと思います。

したがって、製品ラインは次のようになります:純音声の眼鏡------カメラはなく、見た目は普通の眼鏡ですが、内部にはMuseがあり、さまざまな音声ツールを使用したり、音楽を聴いたり、電話をかけたりできます------から、より高機能なバージョンまで、すべてが揃っています。

ホスト: 私はその音声眼鏡をかけて、Museと話しながら、家のコンピュータに作業をさせることができるかどうか考えています。

マーク: はい、完全に可能です。私たちはちょうどConnectカンファレンスでこの機能を発表しました。今、すべての眼鏡がMeta AIに接続されており、"シングルターン"体験です------あなたがプロンプトを送ると、それが応答します。それだけです。しかし、Museがあれば、基本的にすべての眼鏡をMuseにアップグレードする必要があります。まず、もう"Hey Meta"と言う必要はありません。あなたはそれに好きな名前を付けることができ、それ自体が楽しみの一部です。そして、あなたはそれに直接話しかけることができ、それはあなたのMuseに接続され、あなたのMuseがあなたの安全な仮想マシン内でタスクを処理し、物事を片付けるのを助けます。

ホスト: すごいですね!

創業者の心構え

ホスト: さて、ここにいますが、Museは順調に進んでおり、眼鏡も良い出来ですが、約1年前、多くの人が「スーパーインテリジェンスラボはどうなっているのか」と尋ねていました。その時、あなたの心の中はどうでしたか?物事がうまく進まないとき、しかし長期的なビジョンが見えているとき、それはどのような体験ですか?

マーク: 実際に問題があったのはLlamaプロジェクトとLlama 4です。

Llama 1は非常に興味深いモデルで、オープンソースAI運動を開拓しました。私たちはそれを非常に誇りに思っています。Llama 2はスケール化を実現し、Llama 3は当時ほぼ最前線のレベルに達した良いモデルでした。そしてLlama 4に至ると、私たちは基本的に本来の発展の軌道から逸れてしまいました。

物事が私の期待通りに進まないとき、私は多くの時間を考えることに費やします:なぜこうなったのか?何を変えればもっと良くできるのか?今回は、私の反省は:チーム全体の構造を間違えたということです。

私はそれをInstagramのフィードや広告システムのような機械学習の仕事のやり方でモデル化しました------数百人、あるいは千人以上が多くのことに並行して働いています。しかし、言語モデルを構築するには、実際に必要なのは非常に緊密な小さなチームであり、それを団体科学プロジェクトとして扱う必要があります。人数は多くなくても良いですが、それはチーム内の各ポジションが非常に貴重であることを意味します。

それで、私たちはMetaの各所から最も優秀な人材を集め、業界各地から多くの才能を引き入れ、新しいチームを結成しました------それがMetaスーパーインテリジェンスラボです。

私の視点から見ると、MSLが立ち上がったとき、再起動し、インフラを再構築し、次世代モデルを訓練するには時間がかかることを知っていました。しかし、私は素晴らしいチームを結成したことを知っており、チームがうまく調和し、良い運営ができれば、結果は良いものになるでしょう。

私にとって、最も心を打たれた瞬間は、実際にはLlama 4のリリース後------私たちがこの軌道に乗っていると思ったら、実際にはそうではなかったのです。それはかなり大きなネガティブな驚きでした。私は、起業家として、こうした瞬間に試されることが常にあると思います。なぜなら、避けられないこととして、すべてのことが順調に進むわけではないからです。そして、発展の軌道を決定するのは、物事があなたの望む方向に進まないときに、どのように前進する方法を見つけるかです。

ホスト: 逆に言えば、何かがあなたの期待を大きく超えたとき、例えばMuseの初発表のように、その機会をどうやってつかむかをどう確保しますか?

マーク: 完全にその通りです。今、会社全体が投入しています------最初は製品を構築する小さなチームでしたが、今では皆がこれが本当に大舞台に立つ準備ができていることを認識しています。全社が、このものをどう大きくするか、数億人が体験できるようにするかを考えています。

すべてのインフラを最適化してすべてをスムーズに運営し、既存のGPUの計算能力を最大限に引き出し、各製品チームが異なる方法でMuseを組み込む------例えば眼鏡のように。皆が協力してMuseがスムーズに拡張できるようにするのを見るのは素晴らしい気持ちです。

マークがビジョンをどのように書き、伝えるか

ホスト: 創業者として、私はそれがあなたが最も望む瞬間だと思います------すべてが一つに集まる。あなたはどのように会社にビジョンを伝えていますか?同時に多くのことを進める中で、私はあなたが多くを書いたと感じます。あなたのプロセスは何ですか?

マーク: 書くことは私にとって非常に役立ちます。自分の考えを洗練させるのにも、外部に伝えるのにも役立ちます。今年の夏、私は「未来はすべての人のもの」という長い記事を書きました。約15ページで、AIに関連するさまざまな重要な社会問題に対する私の哲学的立場を体系的に整理するのに役立ちました:私は何が良いと考え、政府との相互作用はどのようであるべきか、人々が懸念するさまざまな危険をどのように防ぐか、データセンターをコミュニティの富にするにはどうするか、実際に雇用を創出し、雇用を消滅させないにはどうするか、国家安全をどのように維持するか、人々が心配するリスクをどのように実際に軽減するか------ハッキング攻撃や生物安全などの問題です。

これは非常に複雑なことで、多くの時間がかかり、多くの人と交流し、多くの修正を経ました。内部の多くの人が議論や討論に参加しました。しかし、私にとっては非常に価値のあるプロセスでした。最終的に、私たちはこうしたものを持つことができました------15ページ、「これが私たちが信じることです」。そして、それを1ページのバージョンに精練し、コラム記事として発表しました。私たちは短いビデオも制作しました。なぜなら、多くの人に届くためには、理論的な証明を提示するのではなく、あなたの価値観は何か、あなたが信じることは何か、どのように伝えるかを凝縮する必要があると思ったからです。

会社や世界にこれらの側面を伝えるには、一律の方法はありません。異なる時期には異なるアプローチが必要であり、異なるグループの人々がいます。中にはあなたがやっていることを自然に認める人もいれば、より懸念を抱く人もいて、彼らを引き連れて行く必要があり、なぜそれが価値があるのかを説明するために追加の努力が必要です。私はこれが会社を経営すること、創業者であることの一部だと思います------あなたは同じことを繰り返すわけではなく、毎回の状況がわずかに異なり、新しい課題に直面することがあり、これが部分的に面白いところでもあります。

マークが建設する動機

ホスト: 私は、あなたにとってこの創業者の心構えが会社の外にも広がっていると思います------あなたの農場であれ、新しいスキルを学ぶことであれ。

マーク: 私は物を作るのが好きです。

ホスト: あなたにとって、「建設する」とはどのような感覚ですか?

マーク: それは内なる必要だと思います。人それぞれ異なる自己表現の方法があります。もしあなたが作家であれば、書かなければならないと感じるでしょう。ある人々は認められる必要があります。しかし、私は物を作る必要があります。もし私が創造力を使わず、何かを作らなければ、私は機嫌が悪くなります。それは周りの人々にとって良くありません。

ホスト: 優れたスキーヤーになることを学ぶことと、製品を構築することを学ぶことは同じスキルですか?

マーク: ある程度はそうです。新しいことを学ぶプロセスは非常に似ています。私の人生の中で、私は意図的に自分があまり得意でないことに挑戦してきました。例えば、私は言語を学ぶのが非常に苦手でした。これが私が最初にラテン語を学ぶ理由です------私はクラスでフランス語やスペイン語を学ぶことができず、最終的に、まあ、ラテン語は話さずに翻訳するだけで、数学のようなものです。

その後、私は会社を経営し始めたとき、年間の挑戦を自分に設定しました。その年の挑戦は普通話を学ぶことでした。普通話は本当に難しいです。特に声調の部分がそうです。もちろん、それを学ぶには十分な理由があります------プリシラの祖母は普通話しか話せないので、彼女とコミュニケーションを取るためには学ぶ必要があります。しかし、最大の動機は実際には挑戦そのものです。

すべてのことにおいて、あなたはただやるしかありません。「理解する」ための近道はありません。あなたは時間を投入し、そしてそれが徐々に脳に浸透していきます。武道を学ぶことやヘリコプターの操縦を学ぶことも同様です------これらのことは理性で「理解する」ことが難しく、実戦の積み重ねが必要です。

製品を構築することもその一部です。プログラミングは理論的に考えることができますが、製品を構築するためのその直感は、繰り返しの実戦を通じてのみ育まれます。問題は、あなたが何を好むかだけです------なぜなら、私はすべての人が私と同じように強い建設の必要性を持っているわけではないと思うからです。ほとんどの人はある程度の必要性を持っており、重要なのはそれが何であるかを見つけ、それに時間を投入して、そのことにおいて卓越することです。

正直に言うと、私はこれが単なる「欲しい」ということではなく、より深い心理的な必要性や動機であると感じています。この動機を何かと一致させ、その経験が徐々に浸透し、沈殿するための時間を自分に与えることが非常に重要です。これが私が子供たちに教えようとしていることでもあります------彼らが本当に興味を持っているものを見つけることですが、もし彼らが壁にぶつかったときには、少し押してあげることも必要です。

私の一人の娘は音楽を作るのが大好きですが、ピアノのレッスンには耐えられません。私は彼女に言いました:「あなたはピアノの達人になる必要はありませんが、音楽を作りたいのであれば、音楽理論とその運用方法を直感的に理解する必要があります。そして、一度ピアノを学べば、ギターもすぐに弾けるようになります。」私は、子供として親に少し押してもらう必要があること、また大人としては、これらのことが脳にゆっくりと沈殿するために規律を持って座ることが重要だと思います。

建設者の黄金時代

ホスト: 私は実際、誰もが建設したいと思っていると思います。私はZ世代も外部の批判のように------低い動機性などではないと思います。人々はただ彼らの建設力を引き出す火花を探しているだけだと思います。あなたはハーバードでの講演でもこの点について多く語りました。

マーク: はい。私は「建設する」と言うと、主にこのような製品------ソフトウェアやハードウェアなどを指します。しかし、私は同意します。私は誰もが何らかの創造的な動機を持っていると思います。しかし、他のより強い性格特性がこれを覆い隠している人もいます。例えば、サービス駆動------医者や看護師になる人々は、彼らの最も核心的な動機は「私は他の人を世話したい」ということです。

私はある話を聞いたことがあります。おそらくプリシラが医学校で経験したことですが:学期の初日、誰かが立ち上がって「子供の頃に誰かを見て、心の中で『私は本当にその人を世話したい』と思ったことがある人はどれくらいいますか?」と尋ねました。結果、全員が手を挙げました。私にとっての私のバージョンは、子供の頃の多くの記憶が「私はこのものを作りたい、それをより良くしたい」というものであるということです。

誰もが同じ動機を持っているわけではありませんが、誰もが自分がやりたいことを持っています。私は同意します。以前の技術があったことで、多くの人にとって、スタート自体が非常に難しいです。これが私が個人のスーパーインテリジェンス、Muse、さまざまなAIアシスタントに最も興奮している理由の一つです------私は、これは史上初めて、人々が本当に迅速にスタートできることだと思います。あなたは漠然としたアイデアを持っていて、AIがそれを輪郭として描くのを助け、その後、あなたがそれを彫刻するのです。それは彫刻を形作るようなもので、始める前に何も理解している必要はありません。

私はこれが非常に力強いと思います。多くの人々がこれによって彼らが創造したい、または推進したいことを見つけるでしょう。これは人々がより広範な能動性を感じるのを助けるでしょう。

私たちはすべての病気を克服するまでどれくらい近いですか?

ホスト: あなたのMetaの外の別のプロジェクトはすべての病気を克服することです。私は好奇心があります。まず、私たちは目標にどれくらい近いですか?

マーク: 以前よりもずっと近いです。

ホスト: 現実的にどれくらい近いと思いますか?

マーク: 私たちがこのプロジェクトを最初に開始したときの目標は、今世紀の終わりまでに科学界がすべての病気を克服するのを助けることでした。私たちは決して自分たちでやるつもりではありませんでした。私たちの理論は:すべての重大な科学的進歩は、何かを測定し理解するための新しいツールによって先導されるということです。例えば、顕微鏡が発明され、その後私たちは細菌を理解しました;望遠鏡があって、宇宙を理解するのを助けました。

これらのツールの中には、プラットフォームになったものもあります------例えば、最初にワクチンを発明した人がいて、その後人々はこの方法を使って多くの病気を治療できるようになりました。

しかし歴史的に見て、科学資金の提供方法は広く分散しており、個々の探索を行うことが一般的で、これらの大規模なツールを構築するための資金はあまり多くありません。私たちがBiohubで試みているのは、いくつかの新しいツールを設計し、人々に生物学を新しい方法で「見る」力を与え、科学界の進展を加速することです。

最初は「今世紀末までに」という目標がかなり確実なものであると考えていましたが、多くの生物学者は当時それは不可能だと感じていました。しかし今、私は今世紀末は遠すぎると感じています。

AIの進展に加え、私たちが取り組んでいる仮想細胞モデル------その基本的な考え方は、実際の生きた細胞で実験を行うのではなく、AIモデルを使用してタンパク質をシミュレートし、さらに細胞をシミュレートし、その後仮想免疫システムや全生命体、さらには全人間をシミュレートすることです。これにより、科学者は大量の実験を実行し、異なる状況で何が起こるかをシミュレートできるようになります。たとえば、特定の人にこの薬を服用させた場合、体がどのように反応するかを知ることができます。

正確な年数を示したくはありませんが、私は今世紀末よりもずっと早いと予想しています。

ホスト: 「すべての病気を克服する」という目標の表現は、意図的に感じられ、「永遠の命」ではありません。永遠の命は可能でしょうか?

マーク: これは私が深く掘り下げている分野ではありません。私は両者が異なるものであると考えています。「永遠の命」は主に延長に関するものであり------たとえ病気にならなくても、人間の体には自然な期待寿命があります。これは別の研究が必要な問題です。ある人々はこれも「病気」の一種だと考えるかもしれませんが、それは合理的な視点です。しかし、私は人々が寿命の問題を解決した後でも、病気を引き起こす病気に取り組む必要があると考えています。

私たちが選んだ問題の一部は、あなたが永遠に風邪をひかないということではありません。私たちの言い方は「治療、予防、または管理」です:いくつかの病気は完全に治癒可能です;いくつかは将来的に予防できると私は考えています;そして、いくつかは、あなたが病気になるかもしれませんが、本来は本当に害を及ぼしたり命を奪ったりすることになるものを、現在は持続的な慢性状態として管理できるようにし、生活の質に実質的な影響を与えないようにすることができます。

目標は、人間の体をバランスの取れた状態に保つことです------私たちが病原体に決して接触しないということではなく、いつの日か、私たちがすべての病気を治療、予防、管理できるようになることです。

マークの頭の中で最も頻繁に浮かぶ考えは何ですか?

ホスト: AIは多くの異なる突破口で触媒のような役割を果たしていますが、個人の知能の面でもそうです。あなたが今最も考えていることは何ですか?このプロセスの中で、あなたの頭の中に最も多く浮かぶ考えは何ですか?

マーク: これは毎週変わるかもしれません。

現在、Museに非常に集中しています。何かを発表し、迅速に進め、実世界と接触し、人々のフィードバックを理解し、次に何をすべきかを明確にする------この段階は常に刺激的です。私たちは今この段階にあり、多くの情報を収集し、人々が何を望んでいるかを理解しています。良いニュースは、人々がそれを非常に気に入っているので、私たちはできるだけ多くの人に使ってもらうよう努力しています。

モデルに関してはまだ多くの作業があり、Muse Sparkモデルは大きな進展を遂げており、私たちはそれをさらに進め、世界をリードするモデルを作りたいと考えています。

次のステップにはどのような突破口が必要ですか?

ホスト: どのような突破口がまだ必要ですか?

マーク: このようなことを研究する際には、必ずしも事前に予知できるわけではありません。私たちはいくつかの方向性について直感を持っていますが、過去1年間の作業は大部分がインフラストラクチャの拡張に関するものでした。

約1年半前、より多くの人々が「スーパーインテリジェンスに到達するには、いくつかの根本的なアーキテクチャの突破が必要だ」と言っていました。しかし、私は今それが成り立つかどうかはあまり確信が持てません。私たちは「レシピ」についてかなりの理解を持っていると思います------もし十分に大きなスーパーコンピュータクラスターを構築できれば、暴力的な計算によってそこに到達できます。

私たちはオハイオ州に1千兆ワットを超えるクラスターを構築しており、基本的にはオンラインになっており、次世代モデルのトレーニングに使用しています。次はルイジアナ州の5千兆ワットのクラスターで、すぐに稼働する予定です。私の予測では、数千兆ワット規模のクラスターでトレーニングを行うと、基本的にAGIに近いもの、さらにはAGIを超えるスーパーインテリジェンスを得ることができるでしょう。

しかし、これは最良の方法であるとは限りません。人間の脳は10ワットで動作しますが、私たちが構築している計算システムは、効率が人間の脳よりも約100万倍低いです。したがって、私は確かにアーキテクチャに改善の余地があると考えており、私たちは努力して探求しています------もし巨大な計算能力とアーキテクチャの改善を組み合わせれば、実際に世界をリードするものを構築できるでしょう。しかし現時点では、スケールアップ自体が私たちを遠くまで連れて行くことができます。

ホスト: 確かに、スケールアップは最も確実な道です。研究では重大な突破に期待を寄せる必要がありますが、スケールアップはすぐに効果を発揮します。

マーク: だからこそ、大企業はこの道を選ぶのです。もしかしたら、もっと安価な方法が存在するかもしれませんが、私たちはまだそれを知りません。そして、これは世界にとって非常に価値のあるものであり、数千億ドルを費やすとしても、実現の可能性が十分に高ければ、それを行う価値があります------最終的により安価な突破口が見つからなかったとしても、あなたにはそれを実現するための明確な道があることを保証します。もちろん、もしより安価な方法が見つかれば、それはさらに良いことです。

だから私はこの問題が「すでに解決された」とは言いたくありません。なぜなら、インフラストラクチャを拡張する各段階で、さまざまな新しいエンジニアリングの課題に直面し、それを調整して解決する必要があるからです。研究自体はこのような反復的な方法で進められています。

AIの安全性を確保するための戦いに勝つ方法

ホスト: 現在、最も重要なことの1つは、整合性(alignment)に焦点を当て、モデルを信頼できるものにすることです。

マーク: はい。整合性について、業界内で議論があります:これらのAIラボは自然にそれを行うのでしょうか?私の見解は:もちろんそうです。もしあなたがMuseに何かをするように指示したとき、全く逆のことをしたら、どれだけの人がそれを使いたいと思うでしょうか。私たちはモデルがあなたが具体的に何を尋ねたかを理解するだけでなく、あなたの意図や価値観も理解することを確保しなければなりません。そうでなければ、あなたが満足しない方法でそのことを行ったり、あなたが全く望まない悪影響を生じたりすることになります。この深い理解は、本質的に整合性です。

だから私の見解は、Museを成功させ、数十億人に届くためには、整合性の面で実質的な進展を遂げる必要があり、ただの口先だけではいけません。

ホスト: 整合性は、ユーザーが「それは私が望んでいたものではない」と言うことで実現されるのか、それともあなたたちのバックエンドが自ら発見するのか?

マーク: 両方です。ユーザーフィードバックはありますが、ますます明確になっているのは、トレーニング段階で整合性を確保する必要があるということです。単にデプロイ後だけではありません。現在、モデルは十分に賢くなっており、トレーニング段階でそれを行わなければ、他のラボで見られる安全性や安全事故のほとんどは、ユーザーにデプロイされた後ではなく、トレーニングプロセス中に発生しています。

あなたはそれに対して非常に良い「カリキュラム」を設定する必要があります。親が子供に教えるように、明確な境界を設定する必要があります。もしそれが間違ったことをしたら、「いいえ、あなたは本当にこのプログラミングの問題を解決するべきであり、システム設定を変更してそれを回避し、報酬を得るべきではありません」と学ぶ必要があります------私はあなたが実際の問題解決プロセスを通じてこの方法を学ぶことを望んでいます。これがトレーニングの意味です。

これは大きくは良好な安全メカニズムと明確な境界を築くことに関するものです。これらは業界が自然に行うべき作業であり、私たちは多くの時間を投入しており、毎日状況は異なります。

ホスト: あなたが言ったことを覚えています。AIの安全性の問題------最近の2週間で突然注目を集めたようですが、実際にはこのタイミングを引き起こした単一の出来事はありません。あなたの言いたいことは、私たちは実際に内部でトレーニングに数ヶ月を費やしたということですか?

マーク: Museに関しては、この製品がプライバシーと安全性に非常に注意を払う必要があることを知っています。私たちは初期バージョンのモデルを持っており、「情報開示の尺度」に関する行動をさらにトレーニングできると考えています------以前に話したようなことです。だから私たちはそれを行うために時間を費やしました。同時に、仮想マシンをより安全にするためにも時間を費やしました。これには数ヶ月かかりました。

私は他のラボのいくつかの見解には同意しません------「私たちは速度を落とすために大きな苦痛を受けています」。私にとって、それはMetaとMuseのユーザーにとって正しいことです。私たちは製品を良くしたいと思っています。もし製品が十分に良くなければ、ユーザーにとっても私たちにとっても良くありません------私たちは物事をリリースして、悪い第一印象を与えたくありません。その結果、誰も興味を持たなくなってしまうのです。

私はすべてのラボがこの問題を正しく解決するための非常に強い内的動機を持っていると考えています。もしインセンティブメカニズムと「極めて価値があり、安全である」という目標が整合すれば、それが鍵となります。

ホスト: この重要な週に時間を割いていただき、ありがとうございます。

マーク: ありがとうございます。

Join ChainCatcher Official
Telegram Feed: @chaincatcher
X (Twitter): @ChainCatcher_
warnning リスク警告
app_icon
ChainCatcher Building the Web3 world with innovations.