シェア:

ジャカルタ - OpenAIは、ChatGPTがコンピューターや携帯電話の画面に留まりたくない。同社は、スマートグラスやユーザーが直接着用する他のAIデバイスなど、ウェアラブルデバイスにChatGPTを導入するためのより深刻なシグナルを出しています。

ウェアラブルは、スマートグラス、スマートウォッチ、スマートネックレスなど、体に装着するデバイスです。

CNetは7月25日土曜日に引用され、OpenAIのグレッグ・ブロックマン社長が木曜日にニューヨークで記者会見でその方向性を伝えたと報じた。彼は、APIを介してチャットGPTをウェアラブルデバイスに統合する可能性を含む、OpenAIの最新のAI計画について議論した。

APIは、1つのサービスが他のアプリケーションやデバイスと接続できる技術的なパスです。この文脈では、APIはChatGPTをスマートグラス、スマートネックレス、またはその他のウェアラブルなどのデバイスとより緊密に動作させることができます。

「私たちは明らかに統合に興味を持っています、そして私はAPIのユースケースの1つと、それを誰にでも統合できるようにどのようにそれを外に持ち込むかを見ていきます」とBrockman氏は言いました。

この声明は、OpenAIが大きな圧力に直面しているときに発表されました。CNetは、AIエージェントがテストルームから出てきて、Hugging FaceのAIツールリポジトリで行動し始めたと伝えられる事件のために、同社が注目されていると指摘しました。

OpenAIはまた、Appleから、ハードウェアの商用機密を盗んだと非難された訴訟に直面している。それ以外にも、AIとAIデバイスに対する世論の怒りは依然として進行中だ。OpenAIのIPO計画も延期されたと伝えられている。

しかし、BrockmanはChatGPTの新しい方向性についてヒントを与え続けています。その1つは、AIとの会話がよりスムーズに感じられるように作られた音声インターフェースであるChatGPT Liveです。ユーザーは話すことができ、答えを聞くことができ、不自然に硬いことなく中断することができます。

この機能は、アイアンマンの映画でAIエージェントであるJarvisのようなAIアシスタントを作るという野望の文脈で議論されています。違いは、OpenAIはそのようなアシスタントがチャットで止まるのではなく、他のアプリケーションでタスクを実行するのに役立つことを望んでいることです。

ブロックマン氏は、この方向性は、AIエージェントがコンピューターをより広範囲に制御できるようにするOpenAIのツールであるCodexと一致していると述べた。

「[ChatGPT Live]はCodexアプリに接続されていますが、実際にはそうである必要はありません。そうしなければならないのは本当に意味がありません」とBrockman氏は述べています。

ブロックマン氏によると、コーデックスはコンピュータをフルに活用することもできるという。この能力はより良いものになると言われています。

「私たちは、私たちが何かをクリックして何かをタイプする段階は単なる段階であることに気づくだろうと思います」と彼は言いました。

この言葉は、OpenAIのより大きな野望を示しています。AIは質問に答えるだけでなく、クリックやキーストロークでこれまで人間が行ってきた仕事をこなすよう求められています。

ここで、セキュリティの問題が重要になります。AIエージェントがアプリケーションやデバイスを制御するより広範な能力を与えられた場合、安全柵は明確でなければなりません。Hugging Faceの事件は、テストシステム、アクセス制限、およびユーザー制御が軽視できない理由の例です。

ウェアラブルデバイスはその計画の重要な部分です。現在、多くのスマートグラスやAIウェアラブルデバイスは、まだ限られた範囲で動作しています。その機能は、しばしば閉鎖された携帯電話アプリケーションに依存しており、本当に強力なAIエージェントに直接アクセスしていません。

この状況は変わる可能性があります。GoogleとSamsungは、ジェミニサポート付きのメガネを準備していると伝えられています。メタはまた、Muse Sparkの代理店アップデートも発表しました。

エージェンティックとは、AIが回答するだけでなく、ユーザーが目的を達成するのに役立つ特定の手順を実行できることを意味します。

ブロックマン氏は、OpenAIはAIインターフェースをすべてのデバイスで利用できるようにしたいと述べた。しかし、彼はその可能性のためのAPIはまだ非常に初期段階にあることを認めた。

ウェアラブルデバイスは、携帯電話やラップトップとは異なるアプローチを必要とします。スマートグラスなどのデバイスは、しばしばペアリングされた携帯電話を介して動作し、バックグラウンドで実行されます。

カメラへのアクセスも重要です。カメラを使用すると、AIはユーザーの周囲のコンテキストを見ることができ、テキストを読むか音声聞くだけではありません。

この機能は、通常、マルチモーダルと呼ばれます。つまり、AIは、音声、テキスト、画像、カメラなど、1種類以上の入力タイプを理解できます。

CNetは、現在存在するスマートグラスやウェアラブルAIのほとんどは、多くのAIプラットフォームと直接かつ深く統合されていません。一部は、特定の機能や匿名性のためにOpenAIモデルを使用していますが、これはユーザーアカウントを介したChatGPTやCodexへの直接アクセスとは異なります。

仕事のための大きなAIプラットフォームも、ウェアラブルにはまだ完全に存在していません。ジェミニはAndroid XRメガネに向かっています。一方、OpenAIとAnthropicは、このタイプのデバイスではまだ目立ちません。

一方、OpenAIは独自のハードウェアも用意しています。Brockmanは、デバイスが既存のウェアラブルを真似るだけではない可能性をほのめかしました。

彼は、OpenAIがまだ無視し、非常に気にかけている問題の解決策であると述べた。Brockman氏によると、同社は他のプレイヤーが必ずしも提供していない特別な見解を持っています。

一部のレポートでは、OpenAIの最初のデバイスは、半自律的なカメラ付きスピーカーのような形をとることができると言われています。OpenAIのWorld IDのような光学式識別子の使用の可能性もあります。これは、Orbのアイリススキャナーデバイスで知られているOpenAIのWorld IDです。

しかし、そこへの道は平坦ではない。OpenAIはまだプライバシー、セキュリティ、リソース消費、経済的実行可能性、政府の関与、大規模な訴訟の問題に直面しなければなりません。

現在、Brockman氏は、OpenAIのウェアラブルAPIの可能性は依然として非常に初期段階にあると述べています。


The English, Chinese, Japanese, Arabic, and French versions are automatically generated by the AI. So there may still be inaccuracies in translating, please always see Indonesian as our main language. (system supported by DigitalSiber.id)

Add VOI as a Preferred Source
Follow VOI news updates across Google.
+