OpenAI, ChatGPT, 스마트 안경 및 웨어러블 장치에 진입

개방형 AI는 ChatGPT가 컴퓨터 화면과 휴대폰에만 존재하는 것을 원하지 않습니다. 회사는 ChatGPT를 스마트 안경과 사용자가 직접 착용하는 다른 AI 장치를 포함한 웨어러블 장치로 가져 오기 위해 더 심각한 신호를 보내기 시작했습니다.

웨어러블은 스마트 안경, 스마트 워치 또는 스마트 팔찌와 같이 몸에 착용하는 장치입니다.

CNet은 7월 25일 토요일, 뉴욕에서 기자들과의 회의에서 그레그 브록맨 오픈AI 회장이 이러한 방향을 제시했다고 보도했다. 그는 API를 통해 웨어러블 장치와 ChatGPT의 통합 가능성을 포함한 오픈AI의 최신 AI 계획에 대해 논의했습니다.

API는 하나의 서비스가 다른 애플리케이션이나 장치와 연결되는 기술적 경로입니다. 이 맥락에서 API는 ChatGPT가 스마트 안경, 스마트 목걸이 또는 기타 웨어러블과 같은 장치와 더 긴밀하게 작동하도록 만들 수 있습니다.

"우리는 확실히 통합에 매우 관심이 있으며, 나는 API의 사용 사례 중 하나로 그것을보고, 누구나 통합을 수행 할 수 있도록 그것을 밖으로 가져갈 방법을 볼 것입니다."라고 브록맨은 말했습니다.

이 성명은 OpenAI가 큰 압박에 직면했을 때 나왔습니다. CNet은 회사가 AI 테스트 룸에서 나온 AI 에이전트 사건으로 주목받고 있으며 Hugging Face의 AI 도구 저장소에서 행동을 시작했다고 말했습니다.

OpenAI는 또한 Apple이 하드웨어 상표를 훔친 혐의로 기업을 고발한 소송에 직면했습니다. 그 외에도 AI와 AI 장치에 대한 대중의 분노는 여전히 ​​계속되고 있습니다. OpenAI의 IPO 계획은 또한 지연되었다고합니다.

그럼에도 불구하고 브록맨은 ChatGPT의 새로운 방향에 대한 지침을 제공했습니다. 그 중 하나는 AI와의 대화가 더 원활하게 느껴지도록 만들어진 음성 인터페이스 인 ChatGPT Live를 통해 이루어졌습니다. 사용자는 말하고 대답을 듣고 뻣뻣하지 않게 중단 할 수 있습니다.

이 기능은 영화 아이언맨의 AI 에이전트 Jarvis와 같은 AI 조수를 만드는 야망의 맥락에서 논의되었습니다. 차이점은 OpenAI가 그러한 조수가 대화에 머물지 않고 다른 응용 프로그램에서 작업을 수행하는 데 도움이된다는 것입니다.

브록맨은 이 방향은 AI 에이전트가 컴퓨터를 더 광범위하게 제어할 수 있게 해주는 오픈AI 도구인 코덱스와 일치한다고 말했다.

"[ChatGPT Live]는 Codex 앱과 연결되어 있지만 실제로 그렇게 할 필요는 없습니다. 그렇게 해야 한다는 것은 정말로 의미가 없습니다."라고 브록맨은 말했습니다.

브록맨에 따르면, 코덱스는 또한 컴퓨터를 완전히 사용할 수 있습니다. 그 능력은 더 좋을 것이라고 말했습니다.

"나는 우리가 무언가를 클릭하고 무언가를 입력하는 단계가 단지 단계 일 뿐임을 깨닫게 될 것이라고 생각합니다."라고 그는 말했습니다.

이 문장은 OpenAI의 더 큰 야망을 보여줍니다. AI는 질문에 답하는 것뿐만 아니라 클릭과 타이핑을 통해 인간이 수행하는 작업을 수행하도록 요청받습니다.

여기서 보안 문제가 중요해진다. AI 에이전트가 애플리케이션과 장치를 더 쉽게 제어할 수 있게 된다면, 안전 담이 명확해야 한다. Hugging Face 사건은 테스트 시스템, 액세스 제한 및 사용자 제어가 간과되어서는 안된다는 것을 보여줍니다.

웨어러블 장치는 계획의 중요한 부분입니다. 현재 많은 스마트 안경과 AI 웨어러블 장치는 여전히 제한적으로 작동합니다. 기능은 종종 폐쇄 된 모바일 앱에 의존하며 실제로 강력한 AI 에이전트에 직접 액세스하지 않습니다.

이러한 상황은 바뀔 수 있습니다. 구글과 삼성은 제미니 지원을 갖춘 안경을 준비하고 있습니다. 메타는 또한 Muse Spark에 에이전트 업데이트를 도입했습니다.

에이전시티는 AI가 단순히 답변하는 것이 아니라 사용자가 목표를 달성하는 데 도움이되는 특정 단계를 수행할 수 있다는 것을 의미합니다.

브록맨은 OpenAI가 모든 장치에서 AI 인터페이스를 사용할 수 있기를 바라고 있다고 말했습니다. 그러나 그는 그 가능성에 대한 API가 여전히 ​​매우 초기 단계에 있다는 것을 인정했습니다.

웨어러블 장치는 휴대폰과 노트북과는 다른 접근법이 필요합니다. 스마트 안경과 같은 장치는 종종 페어링 된 휴대폰을 통해 작동하고 배경에서 실행됩니다.

카메라 액세스도 중요합니다. 카메라를 사용하면 AI가 사용자 주변의 맥락을 볼 수 있으며, 텍스트를 읽거나 음성을 듣는 것만이 아닙니다.

이 기능은 일반적으로 다중 모드라고합니다. 즉, AI는 음성, 텍스트, 이미지 또는 카메라와 같이 하나 이상의 유형의 입력을 이해할 수 있습니다.

CNet은 현재 대부분의 스마트 안경과 웨어러블 AI가 많은 AI 플랫폼과 직접적으로 깊이 통합되어 있지 않다고 기록했습니다. 일부는 특정 기능이나 익명성을 위해 OpenAI 모델을 사용하지만, 사용자 계정을 통해 ChatGPT 또는 Codex에 직접 액세스하는 것과는 다릅니다.

직업을위한 대규모 AI 플랫폼도 웨어러블에 실제로 존재하지 않습니다. 제미니는 안드로이드 XR 안경을 향하고 있습니다. 반면에 OpenAI와 Anthropic는 이러한 유형의 장치에서 강력하지 않은 것으로 보입니다.

한편, OpenAI는 또한 자체 하드웨어를 준비하고 있습니다. 브록맨은 그 장치가 기존의 웨어러블을 단순히 복제하지 않을 것이라는 암시를 보냈습니다.

그는 이것을 OpenAI가 여전히 ​​무시하고 매우 걱정하는 문제에 대한 해결책이라고 불렀습니다. 브록맨에 따르면 회사는 다른 플레이어가 제공하지 않은 특별한 관점을 가지고 있습니다.

일부 보고서에 따르면 OpenAI의 첫 번째 장치는 무인 캠코더 스피커와 같은 형태를 취할 수 있습니다. 또한, Orb의 안구 스캐너 장치로 알려진 OpenAI의 World ID와 같은 광학 식별을 사용할 가능성도 있습니다.

그러나 그 길은 완만하지 않습니다. OpenAI는 여전히 ​​개인 정보 보호, 보안, 자원 소비, 경제성, 정부 참여 및 대규모 소송 문제에 직면해야합니다.

브록맨은 현재 OpenAI의 웨어러블 API가 아직 매우 초기 단계에 있다고 말했습니다.