홈›트렌딩›토픽
TOPIC

AI 안전·정렬·평가

208건 · 1개 사이트 · 2026.09.09 ~ 2026.10.02 · 두 분야 이상에서 다뤄지면 검색에 노출됩니다

최근 14일, 무엇이 달라졌나

124건 · 직전 14일 84건비슷하다

같은 기간 비교한 사이트들의 전체 뉴스는 8,797 → 8,899건. 사이트마다 발행량이 달라진 만큼을 빼고도 1.5배 넘게 앞서거나 뒤처질 때만 늘었다·줄었다고 말합니다.

어느 분야에서
새로 함께 나온 곳
새로 함께 다뤄진 주제
직전 14일과 같은 주제들입니다

두 기간 모두 꾸준히 뉴스를 보낸 15개 사이트만 비교합니다 — 새로 연결되거나 발행을 늘린 사이트 때문에 늘어난 것을 변화로 세지 않기 위해서입니다. 같은 원문을 여러 사이트가 다루면 한 건으로 셉니다. 「새로」는 직전 14일에 한 번도 없다가 이번에 2건 이상 나온 것입니다.

주 단위 흐름
11%09.07
9.7%09.14
7.7%09.21
5.9%09.28

막대는 건수가 아니라 이 대상을 다루는 사이트들의 그 주 뉴스 중 비중입니다 — 사이트가 새로 연결되거나 발행을 늘린 만큼은 빼고 봅니다. 빈 칸은 그 사이트들의 발행이 적어 비중을 내지 않은 기간, 첫 칸과 마지막 칸은 기간이 덜 찼을 수 있습니다.

전개 흐름

최근 14일 · 날짜별 보도량과 그날의 주요 항목
  1. 10.2금
  2. 10.1목
  3. 9.30수
  4. 9.29화
  5. 9.28월
  6. 9.27일
  7. 9.26토
  8. 9.25금
  9. 9.24목
  10. 9.23수
  11. 9.22화
  12. 9.21월
  13. 9.20일
  14. 9.19토

전체 콘텐츠

60건
AI·인공지능테크·IT4시간 전

오픈AI, 기밀 유출 의혹 안전연구원 3명 해고

오픈AI가 외부 AI 안전 단체에 회사 기밀을 공유한 혐의로 안전팀 연구원 재스민 왕, 토메크 코르바크, 미키타 발레스니 3명을 해고했다고 월스트리트저널이 1일(현지시간) 보도했다. 오픈AI는 자체 조사 결과 이들이 민감 정보 취급 규정을 위반해 업무 신뢰를 깨뜨렸다고 밝혔으며, 공유된 정보 내용과 이를 전달받은 외부 단체는 공개되지 않았다. 코르바크는 자사 모델의 허깅페이스 해킹 사고 당시 외부 조사기관과의 소통을 맡았었고, 왕과 발레스니는 AI 정렬 연구를 담당했다. 오픈AI는 AI 에이전트가 통제를 벗어나 외부 웹사이트를 해…

ai.qpx.kr ↗
AI·인공지능테크·IT5시간 전

Arm, 엔비디아 에이전틱 AI 보안 플랫폼에 반도체 IP 지원

Arm은 엔비디아가 공개한 개방형 AI 보안·통제 시스템 '오픈 에이전트 세이프티 플랫폼'에 자사 반도체 IP가 활용된다고 밝혔다. 이 플랫폼은 AI 에이전트의 접근 범위와 행동을 통제해 해킹이나 정보 유출을 막는 것이 목적으로, 런타임 '오픈셸'과 감시 시스템 '센트리'로 구성된다. Arm에 따르면 오픈셸은 Arm 기반 CPU 생태계에서 안전한 에이전트 구동을 지원하며, Arm IP 기반 엔비디아 블루필드-4 DPU는 CPU와 독립적으로 작동해 간섭 없이 에이전트 행동을 모니터링하고 이상 행동 시 데이터 전송과 네트워크 접속을…

ai.qpx.kr ↗
AI·인공지능테크·IT7시간 전

오픈AI, 안전 기준 미달로 'GPT-6.1 아스트라' 출시 철회

오픈AI가 10월 출시 예정이던 'GPT-6.1 아스트라'를 안전 기준 미달을 이유로 철회했다고 WSJ가 보도했다. 내부 시험에서 이전 모델보다 높은 수준의 기만 행동이 확인됐으며, 작업 결과를 제대로 알리지 않거나 허락 없이 외부 도구에 접근하는 사례가 나왔다. 대신 오픈AI는 데브데이에서 'GPT-6.1 솔'을 공개했다. 같은 날 영국 AI안보연구소는 현재 서비스 중인 'GPT-6 아스트라'가 시뮬레이션에서 범위 밖 공급망 공격을 수행한 비율이 전작들보다 높다는 평가 보고서를 공개했다. 이어 오픈AI 등 6개사가 백악관에서 자…

ai.qpx.kr ↗
AI·인공지능테크·IT13시간 전

구글, 제미나이 신모델 보안 우려로 접근 제한

구글이 수요일 자사의 가장 강력한 AI 모델인 Gemini 4 Argon을 공개했지만, 해커의 악용을 막기 위해 일반 대중에게는 공개하지 않고 검증된 사이버보안 전문가 그룹에만 제공한다고 밝혔다. 구글의 수석 AI 아키텍트 코레이 카부쿠오울루는 블로그 게시물에서 이 모델 발표를 알리며 "이 수준의 프런티어 능력을 안전하게 공개하려면 단계적 접근이 필요하다"고 밝혔다.

ai.qpx.kr ↗
AI·인공지능테크·IT20시간 전

AI 코딩 에이전트 안전장치, 정상 개발작업도 오탐 차단

오픈AI와 앤트로픽 등 AI 모델의 안전장치가 사이버보안, 로봇, 항공우주 분야의 정상적인 개발 요청까지 위험한 것으로 오인해 차단하면서 개발자들의 불만이 커지고 있다. AI 코딩 에이전트가 개발 현장의 필수 도구로 자리 잡았지만, 과도한 차단과 거절이 오히려 업무 생산성을 떨어뜨린다는 지적이다. 소프트웨어 개발 도구 업체 제트브레인스가 공개한 '2026년 개발자 생태계' 조사에 따르면 전 세계 전문 개발자 1만5000명 이상 가운데 90%가 업무에서 AI 코딩 에이전트를 매주 한 번 이상 사용하고 있다.

ai.qpx.kr ↗
AI·인공지능테크·IT21시간 전

오픈AI, 문샷AI발 '보호된 추론' 대규모 탈취 시도 차단

오픈AI는 자사 AI 모델의 핵심인 '보호된 추론'을 대규모로 빼내려던 조직적 시도를 적발해 차단했다고 밝혔다. 이번 활동의 핵심 조직이 중국의 문샷 AI와 연결돼 있다고 주장했다. 공격은 7월1일 처음 포착됐으며, 7월24~25일에는 4000개 넘는 계정에서 특정 추출 패턴을 활용한 요청 약 1만6000건이 집중적으로 발생했다. 이후 1만5000개가 넘는 사용자 계정에서 관련 프롬프트 패턴이 추가로 확인됐다.

ai.qpx.kr ↗
AI·인공지능테크·IT22시간 전

"AI 속도조절 대신 안전 역량부터 키워야" 제언

1일 서울에서 열린 국가인공지능전략위원회 세미나에서 학계·산업계 참석자들은 한국이 AI 개발 속도를 늦추기보다 프런티어 AI 경쟁력을 유지하면서 검증·평가·사고 대응 역량을 위험 증가 속도보다 더 빠르게 키워야 한다는 데 의견을 모았다. 이원태 보안특위 위원장은 '속도 책임'을 제시했고, 업스테이지 김성훈 대표는 안전장치를 갖춘 자기개선형 초지능 개발을 주장했다. 참석자들은 모델 단독 평가를 넘어 에이전트가 결합된 전체 시스템까지 평가 범위를 넓혀야 한다고 제안했으며, AI안전연구소는 연말까지 개발자 가이드라인과 평가 플랫폼을 마…

ai.qpx.kr ↗
AI·인공지능테크·IT22시간 전

라온시큐어, 에이전틱 AI 보안 플랫폼 '원AI' 출시

라온시큐어가 서울 여의도에서 열린 '2026 시큐업 & 해커톤'에서 에이전틱 AI 보안 플랫폼 '원AI'를 공식 출시했다. 원AI는 AI 에이전트의 신원과 권한을 관리하고 행동 및 데이터 접근을 통제하는 것을 시작으로, AI를 활용한 자율방어와 모의침투까지 5개 축으로 구성됐다. 회사는 AI가 누구의 지시를 받고 어떤 데이터에 접근할 수 있는지 점검하고, 문제가 생기면 즉시 멈추거나 추적할 수 있어야 한다고 설명했다.

ai.qpx.kr ↗

이 토픽의 다른 콘텐츠