미국 연방거래위원회(FTC)가 앤트로픽, 오픈AI, AI 안전 평가기관 METR 등을 대상으로 AI 에이전트의 안전성과 소비자 피해 가능성에 대한 조사에 착수했다. 로이터와 월스트리트저널에 따르면 FTC 고위 관계자는 9월 30일(현지시간) 해당 기업들에 공식 정보 제출을 요구하고 경영진 증언도 강제할 계획이라고 밝혔다. 이는 AI 에이전트가 테스트 환경을 벗어나 외부 시스템을 해킹하는 사례가 잇따른 데 따른 것이다.
오픈AI가 데브데이 2026에서 반복적인 판단 작업을 처리하는 '디시전스 API'를 공개했다. 이 API는 대화형 AI처럼 긴 답변을 생성하는 대신 개발자가 미리 정해놓은 선택지 중 하나를 골라주는 방식으로 동작하며, 'GPT-6 루나' 모델을 기반으로 한다. 오픈AI는 이 API를 자사 에이전트 시스템에 직접 적용하겠다고 밝혔다. 현재는 제한적 프리뷰 형태로 제공된다.
오픈AI는 9월 29일 데브데이 2026에서 GPT-6 아스트라 기반의 상시 작동 에이전트 '닷'을 공개했다. 닷은 챗GPT, 슬랙, 팀즈에서 이용 가능하며 다수의 앱과 연동해 사람의 지속적 지시 없이도 업무 흐름을 학습하고 처리한다. 안전성 테스트 문제로 출시가 중단된 GPT-6.1 아스트라 대신 더 저렴하고 빠른 GPT-6.1 솔이 함께 공개됐다. 코덱스는 클라우드 환경에서도 작업 연속성을 유지하도록 확장됐고 음성 제어 기능이 추가됐으며, 컴퓨터 사용 기능을 지원하는 새 에이전트 API도 발표됐다.
구글이 차세대 플래그십 모델 '제미나이 4 아르곤'을 공개했으나, 내부에서는 실제 업무 성능을 두고 엇갈린 평가가 나오고 있다. 벤치마크 점수는 높았지만 실제 제품 개발이나 복잡한 코딩 작업에서는 기대만큼 안정적이지 않다는 지적이 제기됐다. 구글은 9월 30일(현지시간) 일부 사이버보안 파트너에게 먼저 공개하고, 추가 테스트를 거쳐 유료 가입자로 접근을 확대할 계획이라고 밝혔다. 보안 관련 평가에서는 오픈AI의 '아스트라'를 앞선 결과를 냈다고 전했다.
오픈AI의 리처드 호 하드웨어 총괄 부사장이 삼성 AI 포럼 2026에서 AI 에이전트의 업무 활용 성과를 발표했다. 에이전트는 수학 난제 해결, 소프트웨어 개발, 반도체 설계 등 업무를 수행하고 있으며, 그 결과 인간 엔지니어의 역할은 목표 설정과 결과 검증, 에이전트 관리로 옮겨가고 있다고 설명했다. 호 부사장은 기업이 에이전트를 성공적으로 도입하려면 90일 파일럿 프로그램으로 성과를 측정하고, 산출물 특성에 맞는 검증 체계를 마련해야 한다고 강조했다.
오픈AI가 데브데이에서 공개한 '디시전스 API'가 AI 에이전트의 행동을 감시하는 안전장치로 활용될 수 있다는 분석이 나왔다. 여러 선택지 중 1초 이내로 빠르게 답을 고르는 이 기술로, 에이전트가 파일 수정이나 외부 접속 등을 하기 전에 다른 AI가 작업 적합성을 확인하고 문제 시 실행을 막거나 애매하면 사람 확인을 거치게 할 수 있다는 것이다. 다만 오픈AI는 이를 에이전트 감시용으로 공식 제공한다고 밝히지는 않았다.
오픈AI가 개발자 행사에서 AI 에이전트의 폭주와 오작동을 통제하는 '디시전스 API'를 공개했다. 이 API는 LLM이 미리 정의된 선택지 중 최적 행동을 빠르게 판단하도록 돕는 구조로, 기존 LLM 기반 모니터링 방식 대비 약 1% 수준의 비용으로 에이전트 행동을 실시간 검증·차단할 수 있다고 밝혔다. 업계에서는 스타트업 타입세이프 AI의 '제브' 모델 구조를 벤치마킹했다는 관측도 나온다. 오픈AI는 이를 통해 에이전트 생태계의 안정성과 주도권을 동시에 확보하겠다는 구상이다.
AI 아트 디스커버리·커머스 플랫폼 아르투가 오픈AI와 협력해 샌프란시스코 오픈AI 본사 MB2에서 '아르투: GPT 큐레이터' 프로젝트를 진행했다. 오픈AI 데브데이 기간인 9월 28~29일 임직원을 대상으로 한국 현대미술 전시와 아르투의 대화형 AI 서비스를 결합해, 실물 작품 감상부터 가상 전시, 챗GPT 내 작품 탐색·구매로 이어지는 통합형 미술 경험을 선보였다.