오픈AI가 현지 시각으로 9월 29일 미국 샌프란시스코에서 개최한 개발자 행사 ‘데브데이 2026’에서 에이전트 응용프로그램 인터페이스에 새로운 기능을 대거 추가했습니다. 이번 업데이트의 핵심은 인공지능이 사람의 지시를 받아 브라우저나 프로그램을 직접 조작할 수 있게 된 점입니다.
기존에는 텍스트 기반 응답이나 코드 생성에 집중했다면, 이제는 AI가 실제 화면을 인식하고 버튼을 누르거나 정보를 입력하는 물리적 행위를 수행합니다. 별도 연동 기능이 없는 웹사이트에서도 작동하므로, 개발자가 일일이 API를 연결하지 않아도 되는 유연성이 확보되었습니다.
코딩 에이전트인 코덱스의 작업 환경도 크게 바뀌었습니다. 이제 특정 기기에 종속되지 않고 클라우드에서 작업을 이어갈 수 있습니다. 스마트폰에서 시작한 코딩 작업을 웹이나 데스크톱으로 옮겨 진행해도 중단되지 않으며, 노트북 전원을 꺼도 서버 측에서 처리가 계속됩니다.
오픈AI는 지난 10일 공개 베타로 선보인 에이전트 API의 기반 기술을 이번 행사에서 확장했습니다. 개발자는 복잡한 워크플로우를 처음부터 설계할 필요 없이, 오픈AI가 제공하는 관리 도구와 환경을 설정하는 방식으로 에이전트를 구성할 수 있습니다. 이는 장시간 작업을 수행하며 이전 맥락을 기억하고 여러 도구를 병행 사용해야 하는 요구사항을 충족하기 위함입니다.
새롭게 공개된 ‘디시전스 API’는 AI의 판단 속도를 높이는 데 초점을 맞췄습니다. 긴 답변을 생성하는 대신 미리 정해진 선택지 중 하나를 고르게 해 1초 이내로 결과를 반환합니다. 고객 요청 분류나 사진 태깅, 다중 에이전트 간 역할 분담 등 빠른 의사결정이 필요한场景中 활용될 수 있습니다.
샘 알트먼 최고경영자는 개발자들이 오픈AI 내부에서 사용하는 것과 동일한 도구와 모델을 자유롭게 활용할 수 있는 기반을 제공하겠다고 밝혔습니다. 시연에서는 카메라로 주변을 파악한 로봇이 디시전스 API를 통해 즉시 다음 행동을 결정하는 모습도 확인되었습니다.
다만 이러한 기술이 실제 서비스와 충돌할 가능성도 존재합니다. 최근 메타의 개인 AI 에이전트 ‘뮤즈’가 아마존 쇼핑몰 접근 과정에서 차단된 사례처럼, 외부 플랫폼이 에이전트의 자동화된 접근을 허용할지는 여전히 미해결 과제입니다. 이용자는 각 서비스의 정책 변경 여부를 지속적으로 확인해야 합니다.