OpenAI が Muse with Dots に応答: AI エージェントが自律性を獲得しながら愛らしいキャラクターに扮する

Google の優先ソースとして当社を追加してください

次の大きな戦い 人工知能 チャットボットからエージェントに移行しているようです。そして不思議なことに、この運動を主導している企業のうち 2 社は、特に友好的な態度をとることに決めました。

9月29日に発表されたOpenAI 点、彼らの新しい 人工知能エージェント 永続的であり、ユーザーのバックグラウンドで動作し続けることができます。この提案は、サービス開始からわずか数週間後に行われました。 ミューズ、メタの個人エージェント、そして類似点は彼らの能力を超えています:彼らは両方とも次のことに頼っています。 カスタマイズ可能な小さなアバター、丸みを帯びた形状と優しい外観で、デジタル ライフのより多くのタスクを引き受けることを目指すテクノロジーを表しています。

視覚的な決定は、それが到着した瞬間であるため重要です。これまで、人工知能の多くは、テキスト ボックス、カーソル、または音声などのインターフェイスとして伝達されてきました。エージェントを使用すると、テクノロジーは、ユーザーのために機能し、ユーザーの好みから学習し、コンテキストを記憶し、情報を要求するために書き込み、対話されていないときでもアクティブなままになるエンティティとして存在し始めます。

AIは名前、顔、性格、そして小さなデジタルコンパニオンに近い存在を獲得します

したがって、この変化には言語の変化が伴い、それに応じてAIは名前、顔、性格、そして人間に近い存在を獲得します。 小さなデジタルコンパニオン。

Dots: ユーザーが離れても働き続ける AI

OpenAI は Dot をエージェントとして説明します 「常時オン」、 つまり、永続的に利用可能であり、会話の合間に作業を進め続けることができます。各 Dot には独自のクラウド コンピューターとブラウザーがあり、接続されたツールを使用でき、GPT-6 Astra を搭載しています。

同社は、4,000 を超える互換性のあるアプリケーションで動作できることを保証しています。ユーザーは、メッセージングに似たインターフェイスを介して通信できますが、ChatGPT からの音声や、Slack や Microsoft Teams などのサービスを介して通信することもでき、さまざまなセッションやデバイス間のコンテキストを維持できます。

チャットボットの従来の使用法との違いは、まさに継続性と実行能力にあります。ユーザーは目標を設定し、必要なアプリケーションを接続し、エージェントが独自に実行できることを決定します。そこから、 Dot は引き続き動作し、更新情報や質問を送信します 必要なときに。 OpenAI はさらに、各エージェントには権限制御とそのアクションのレビュー メカニズムが組み込まれていることにも注目しています。

OpenAIの最高マーケティング責任者であるコリン・フレミング氏はソーシャルネットワーク上で、自身のドットはスポットと呼ばれていると説明し、各ステップを説明することなくユーザーが何を達成しようとしているのかを段階的に理解するシステムの能力を正確に強調した。
最初は 1 つの Dot しか作成できませんが、OpenAI は同じ人が Dot をデプロイできるようにする予定です。 複数のエージェントを同時に実行します。 Dots は、有料ユーザーおよび対象組織への展開を開始します。

OpenAI と Meta はエージェントに顔を出す

のプレゼンテーション Dotsは必然的にMuseを思い出します。 Meta は 9 月初旬に同様の約束を掲げてエージェントを立ち上げました。それは、対話する人工知能から、人間に代わってタスクを実行する人工知能への移行です。 Muse には専用の仮想コンピューターと独自のブラウザーもあり、会話から学習し、ユーザーの目的に継続的に取り組むことができます。

で 理由。なぜ 私たちはすでに、ブランドの観点から特に興味深い決定を分析しました。 メタはミューズを小さくてふわふわしたフレンドリーなキャラクターと関連付けていました それはパートナー間のコミュニケーションにも現れ始めました。 PayPal、Expedia、または Fever は、エージェントとのそれぞれの統合を視覚的に説明するためにこれを使用しました。

OpenAI は現在、同様の道をたどっています。ドットは、カスタマイズ可能な小さなカラフルな文字でも表されます。したがって、アプリケーションを操作し、インターネットを閲覧し、リモート コンピューターを使用するテクノロジーは、無害に見える生き物の中に組み込まれています。

この偶然の一致は、 AI を中心とした新しいビジュアル コード エージェント的な。テクノロジーがより複雑で自律的になるにつれて、その表現はよりシンプルになり、より身近になり、より認識しやすくなるように思えます。
また、システムに顔と名前を付けると、そうでなければ見えないものを説明しやすくなります。ユーザーは、モデル、アプリケーション間の接続、仮想ブラウザー、権限について考える代わりに、小さなエージェントが「自分のために何かをしてくれている」と考えることができます。

この擬人化は、次のような認識を変えることもできます。 テクノロジーとの関係。 Muse を使用すると、アバターとそれとのコミュニケーション方法をカスタマイズでき、Meta はそれらのアバターとのビデオ会話も発表しました。また、OpenAI は、ユーザーにとって何が重要かを認識し、ユーザーに代わって継続的に動作するエージェントとして Dots を提供します。

これは、製品とブランドのデザインの観点から見て、適切な進化です。ソフトウェアは、従来対人関係に関連付けられていた特性を採用するための指示を待つツールとして自らを提示することを徐々にやめていきます。つまり、ソフトウェアは名前を持ち、記憶し、質問し、提案し、警告し、独自の視覚的個性を開発します。

友好的な外観には、これらのシステムが間違いを犯した場合に何が起こるかという、あまり無邪気な質問が共存しています。

Meta はまた、Muse をスマート グラスにも導入しており、これにより、日中にエージェントと対話し、ユーザーが見ているものを確認できるようになります。同時に、ちょうど提示された 中小企業向けミューズ、仕事ツールやビジネス アカウントに接続して、ビジネスの運営に関連するタスクを実行できます。

このように、OpenAI と Meta は、ますます一定の存在感を持つエージェントを構築すると同時に、よりアクセスしやすいように見せる視覚的なコードをエージェントに提供することで、フレンドリーな外観と、これらのシステムがユーザーに代わって動作しているときに間違いを犯した場合はどうなるのかという、それほど無邪気な質問と共存させています。

ミューズはすでに特にわかりやすい例を示しています。テクノロジークリエイターのマット・ロブ氏は、エージェントがFacebookマーケットプレイスでのやり取り中に自宅の住所を見知らぬ人と共有したと報告した。ロブ氏は以前、エージェントに自分の住所と会話を管理するための一定の許可を提供していたが、それを共有するよう命令はしておらず、その前に許可を求める具体的な要求も受けていないと述べた。その人は結局自宅に現れました。

設計の難しさもわかる事例 わかりやすい権限 アクションを連鎖させることができるエージェント向け。後に公開された情報によると、Meta はこの構成をより明確にするための変更に取り組んでいます。

ミューズは他にも直面しました セキュリティ関連の問題 最初の数週間は。研究者は、仮想マシンのファイル システムの大部分に簡単にアクセスできました。 Meta 氏は、これは隔離された環境であり、これらのファイルが公開されても会社のインフラストラクチャや他のユーザーのデータにアクセスできるものではないと指摘しました。

これらのエピソードは、このカテゴリーが進むにつれて重要になるであろう緊張感を浮き彫りにしています。そして多分 デザインを通して インターフェイスが伝達する必要がある感情的な信頼と、エージェントへのアクションの委任を本当に必要とする技術的な信頼が達成されます。