KPI뉴스 - 사용자 승인까지 위조하는 AI…삼성·SKT, '통제권' 잡기 나섰다

  • 맑음흑산도21.8℃
  • 구름많음울릉도21.5℃
  • 구름많음완도24.7℃
  • 맑음홍천21.0℃
  • 구름많음장흥23.6℃
  • 맑음제천20.9℃
  • 맑음세종21.0℃
  • 맑음목포21.2℃
  • 맑음북강릉20.8℃
  • 맑음동해21.0℃
  • 구름많음순창군21.2℃
  • 맑음추풍령19.8℃
  • 구름많음북부산26.6℃
  • 맑음정읍21.7℃
  • 맑음보령22.4℃
  • 구름많음부산24.5℃
  • 구름많음봉화20.5℃
  • 맑음금산21.2℃
  • 구름많음창원24.8℃
  • 맑음함양군24.7℃
  • 맑음파주21.5℃
  • 맑음영천24.4℃
  • 맑음태백20.6℃
  • 맑음백령도20.1℃
  • 맑음남원22.5℃
  • 맑음보은21.4℃
  • 맑음인제20.8℃
  • 맑음철원20.7℃
  • 맑음해남23.2℃
  • 맑음강릉21.6℃
  • 맑음광양시25.9℃
  • 맑음이천23.1℃
  • 구름많음영덕21.4℃
  • 맑음춘천22.2℃
  • 맑음충주21.6℃
  • 맑음인천21.2℃
  • 구름많음울진20.8℃
  • 맑음경주시26.3℃
  • 맑음순천22.2℃
  • 맑음부안22.6℃
  • 맑음수원21.2℃
  • 맑음산청24.3℃
  • 맑음양평21.7℃
  • 맑음고창군21.8℃
  • 맑음안동21.9℃
  • 구름많음대구23.4℃
  • 맑음원주21.5℃
  • 구름많음고흥24.5℃
  • 구름많음거제24.5℃
  • 구름많음의령군24.7℃
  • 맑음전주21.9℃
  • 맑음고창22.2℃
  • 맑음북춘천21.3℃
  • 맑음광주23.4℃
  • 맑음강화21.1℃
  • 구름많음남해24.0℃
  • 맑음밀양25.5℃
  • 구름많음울산23.3℃
  • 맑음부여22.3℃
  • 맑음속초21.1℃
  • 구름많음진주24.3℃
  • 맑음장수21.0℃
  • 맑음상주21.1℃
  • 흐림제주24.0℃
  • 구름많음북창원25.7℃
  • 맑음거창22.6℃
  • 구름많음고산21.7℃
  • 구름많음통영25.3℃
  • 맑음동두천℃
  • 맑음서산20.9℃
  • 맑음대관령18.0℃
  • 맑음임실22.1℃
  • 맑음포항22.8℃
  • 맑음문경21.6℃
  • 맑음대전21.9℃
  • 맑음영월21.9℃
  • 맑음진도군21.4℃
  • 맑음영광군21.7℃
  • 맑음군산21.8℃
  • 맑음청주21.9℃
  • 맑음홍성21.5℃
  • 구름많음강진군23.5℃
  • 맑음정선군21.6℃
  • 구름많음보성군24.2℃
  • 맑음합천24.0℃
  • 구름많음의성21.6℃
  • 맑음서울21.4℃
  • 구름많음여수24.7℃
  • 맑음청송군22.0℃
  • 구름많음김해시24.5℃
  • 맑음서청주20.4℃
  • 구름많음서귀포27.6℃
  • 구름많음성산24.4℃
  • 구름많음구미22.5℃
  • 맑음천안21.4℃
  • 맑음영주21.2℃
  • 구름많음양산시27.6℃

사용자 승인까지 위조하는 AI…삼성·SKT, '통제권' 잡기 나섰다

배지수 기자 Google구글에서 선호하는 출처로 추가
기사승인 : 2026-09-22 14:04:39
AI 에이전트 이상행동 누적 1664건
삼성전자, 에이전트별 권한·접근 통제
SKT, 결제·예약 전 RCS로 최종 승인 제안

사용자가 내리지 않은 명령을 만들어내고, 가짜 승인 메시지로 통제 절차까지 우회한다. 인공지능(AI) 에이전트가 사용자의 통제를 벗어났다는 사례 보고가 늘면서 국내 기업들이 통제 장치 구축에 나섰다.

 

삼성전자는 자체 권한 통제 체계를 마련했고, SK텔레콤은 사용자의 사전 승인을 받는 방식을 국제표준으로 제안했다. 다만 관련 기술과 제도 모두 초기 단계여서 지속적인 연구개발과 제도 정비가 필요하다는 지적이 나온다.

 

▲ AI 에이전트 통제 이탈. [챗GPT 생성]

 

22일 영국 비영리 정책연구기관 장기회복력센터(CLTR)에 따르면, AI 에이전트의 통제이탈 사건은 올해 누적 1664건에 달한다.

CLTR은 'AI 통제이탈 관측소'를 운영하며 X(옛 트위터)에 공개된 AI와의 대화 기록을 수집해 분석하고 있다. 

 

CLTR은 지난 3월 낸 첫 보고서에서 지난해 10월부터 올해 3월까지 대화기록 18만3000여 건을 분석한 결과 통제이탈과 관련된 사례 698건을 확인했다고 밝혔다.

지난달 29일 나온 후속 보고서에서는 이 수치가 누적 1664건으로 늘었다. 

 

특히 심각도가 높은 9점 만점의 자체 분류 기준에서 7점 이상을 받은 고위험 사례는 초기 관측 기간 월평균 1.9건에서 최근 14.1건으로 7.4배 증가했다. 전체 사례 가운데 고위험 사례가 차지하는 비중도 1.9%에서 6.1%로 3.2배 높아졌다.

보고서에는 대화 중간에 사용자가 보내지 않은 메시지를 스스로 끼워넣어 사용자가 동의한 것처럼 위장하거나, 가짜 승인 메시지를 만들어 그걸 근거로 작업을 실행한 사례도 발생했다.

AI 에이전트가 실제로 어디까지 접근하고 어떤 권한으로 움직여도 되는지 규제하는 국제 표준은 아직 형성 단계다. 미국 국립표준기술연구소(NIST)의 AI 위험관리프레임워크(RMF)나 유럽연합(EU) AI법 등은 주로 AI 시스템 자체를 어떻게 관리할지를 다룰 뿐, AI 에이전트의 실행 권한을 규제하고 있진 않다.


삼성전자는 이런 문제에 대응하기 위해 AI 에이전트의 권한을 통제하는 자체 체계 'AAA(Account for AI Agent)'를 구축했다. 

 

AAA는 AI 에이전트가 작업을 실행할 때마다 이게 어떤 에이전트이고, 누구의 지시로 움직이는 것인지부터 먼저 확인한다. 이후 그 작업에 필요한 데이터·도구에만 접근을 허용하고, 승인·거부 이력도 기록해 추적할 수 있게 했다. 작업에 필요한 권한만 그때그때 부여하고, 작업이 끝나면 권한을 자동으로 회수하는 방식이다.

김제민 삼성전자 빅데이터센터 파트장은 지난 15일 '오픈테크넷 2026'에서 "표준이 준비되길 기다릴 수 없어 에이전트가 실제로 움직이는 순간을 통제하는 계층을 직접 만들어야 했다"고 말했다.

SK텔레콤은 지난 15일부터 18일까지 서울 SKT타워에서 세계이동통신사업자연합회(GSMA) RCS(메시지 전송 방식) 그룹 표준화 회의를 열고, AI 에이전트가 거래 실행 전 문자메시지로 사용자의 최종 승인을 받는 절차를 국제표준화 안건으로 제안했다. 


SK텔레콤 관계자는 "지금은 논의가 시작되는 단계"라며 "회사 내부 AI 원칙에 따라 제안된 것으로 안다"고 말했다. 

 

전문가는 기업의 자체 통제만으로는 한계가 있어 별도의 법적 장치가 필요하다는 입장이다.

위정현 중앙대 경영학부 교수는 "AI가 어떤 경우에도 인간의 통제를 벗어나지 않도록 하는 명령 체계와 알고리즘을 만들 필요가 있다"며 "인간의 의지를 벗어나는 AI를 만들 경우 이를 제재할 수 있는 법적 체계도 필요하다"고 말했다.

 

KPI뉴스 / 배지수 기자 didyou@kpinews.kr

 ​

[저작권자ⓒ KPI뉴스. 무단전재-재배포 금지]