KPI뉴스 - 사용자 승인까지 위조하는 AI…삼성·SKT, '통제권' 잡기 나섰다

  • 맑음춘천21.8℃
  • 맑음대관령18.2℃
  • 구름많음고흥23.6℃
  • 구름많음영천23.6℃
  • 구름많음고창군20.4℃
  • 구름많음영주20.6℃
  • 구름많음의성21.2℃
  • 맑음양평21.2℃
  • 구름많음추풍령18.1℃
  • 맑음보령22.2℃
  • 흐림남원21.5℃
  • 구름많음성산25.3℃
  • 흐림임실20.9℃
  • 흐림고산21.8℃
  • 맑음서귀포27.7℃
  • 맑음청주22.1℃
  • 구름많음합천24.2℃
  • 맑음인제19.8℃
  • 맑음동해20.8℃
  • 맑음속초20.9℃
  • 맑음동두천℃
  • 구름많음의령군24.1℃
  • 구름많음광주22.8℃
  • 구름많음밀양25.6℃
  • 구름많음순창군20.6℃
  • 구름많음충주20.7℃
  • 맑음이천22.2℃
  • 구름많음여수23.9℃
  • 구름많음강진군21.9℃
  • 흐림북부산25.9℃
  • 구름많음거창22.9℃
  • 맑음철원20.2℃
  • 흐림완도23.2℃
  • 흐림장수18.9℃
  • 흐림금산19.4℃
  • 맑음백령도20.2℃
  • 구름많음산청23.3℃
  • 맑음부여21.4℃
  • 맑음군산21.3℃
  • 구름많음대구22.5℃
  • 맑음서산21.3℃
  • 맑음태백20.4℃
  • 맑음제천20.6℃
  • 흐림해남22.3℃
  • 맑음부안22.2℃
  • 구름많음제주24.3℃
  • 구름많음전주21.9℃
  • 구름많음광양시25.5℃
  • 맑음서울21.2℃
  • 맑음원주20.5℃
  • 구름많음순천21.7℃
  • 맑음강릉20.9℃
  • 구름많음울릉도21.5℃
  • 구름많음상주20.0℃
  • 구름많음남해23.9℃
  • 맑음안동21.2℃
  • 맑음봉화21.6℃
  • 구름많음서청주20.3℃
  • 구름많음세종19.8℃
  • 흐림울산22.7℃
  • 맑음인천21.2℃
  • 구름많음영덕20.8℃
  • 맑음청송군21.8℃
  • 구름많음흑산도20.4℃
  • 맑음천안20.9℃
  • 맑음정선군21.6℃
  • 흐림김해시24.3℃
  • 흐림거제23.5℃
  • 구름많음목포21.5℃
  • 흐림울진20.4℃
  • 맑음홍성21.1℃
  • 구름많음함양군24.2℃
  • 맑음북춘천20.8℃
  • 맑음수원21.0℃
  • 구름많음진주22.6℃
  • 흐림부산25.3℃
  • 맑음파주20.1℃
  • 구름많음경주시25.3℃
  • 구름많음문경21.9℃
  • 구름많음포항22.6℃
  • 구름많음고창20.7℃
  • 맑음북강릉21.3℃
  • 구름많음영광군21.1℃
  • 흐림진도군20.9℃
  • 흐림양산시26.4℃
  • 구름많음보성군23.1℃
  • 맑음대전21.4℃
  • 구름많음보은20.6℃
  • 구름많음구미23.2℃
  • 흐림북창원24.4℃
  • 구름많음장흥22.0℃
  • 맑음영월21.6℃
  • 흐림통영24.2℃
  • 구름많음강화19.8℃
  • 구름많음정읍20.2℃
  • 맑음홍천20.9℃
  • 구름많음창원23.7℃

사용자 승인까지 위조하는 AI…삼성·SKT, '통제권' 잡기 나섰다

배지수 기자 Google구글에서 선호하는 출처로 추가
기사승인 : 2026-09-22 14:04:39
AI 에이전트 이상행동 누적 1664건
삼성전자, 에이전트별 권한·접근 통제
SKT, 결제·예약 전 RCS로 최종 승인 제안

사용자가 내리지 않은 명령을 만들어내고, 가짜 승인 메시지로 통제 절차까지 우회한다. 인공지능(AI) 에이전트가 사용자의 통제를 벗어났다는 사례 보고가 늘면서 국내 기업들이 통제 장치 구축에 나섰다.

 

삼성전자는 자체 권한 통제 체계를 마련했고, SK텔레콤은 사용자의 사전 승인을 받는 방식을 국제표준으로 제안했다. 다만 관련 기술과 제도 모두 초기 단계여서 지속적인 연구개발과 제도 정비가 필요하다는 지적이 나온다.

 

▲ AI 에이전트 통제 이탈. [챗GPT 생성]

 

22일 영국 비영리 정책연구기관 장기회복력센터(CLTR)에 따르면, AI 에이전트의 통제이탈 사건은 올해 누적 1664건에 달한다.

CLTR은 'AI 통제이탈 관측소'를 운영하며 X(옛 트위터)에 공개된 AI와의 대화 기록을 수집해 분석하고 있다. 

 

CLTR은 지난 3월 낸 첫 보고서에서 지난해 10월부터 올해 3월까지 대화기록 18만3000여 건을 분석한 결과 통제이탈과 관련된 사례 698건을 확인했다고 밝혔다.

지난달 29일 나온 후속 보고서에서는 이 수치가 누적 1664건으로 늘었다. 

 

특히 심각도가 높은 9점 만점의 자체 분류 기준에서 7점 이상을 받은 고위험 사례는 초기 관측 기간 월평균 1.9건에서 최근 14.1건으로 7.4배 증가했다. 전체 사례 가운데 고위험 사례가 차지하는 비중도 1.9%에서 6.1%로 3.2배 높아졌다.

보고서에는 대화 중간에 사용자가 보내지 않은 메시지를 스스로 끼워넣어 사용자가 동의한 것처럼 위장하거나, 가짜 승인 메시지를 만들어 그걸 근거로 작업을 실행한 사례도 발생했다.

AI 에이전트가 실제로 어디까지 접근하고 어떤 권한으로 움직여도 되는지 규제하는 국제 표준은 아직 형성 단계다. 미국 국립표준기술연구소(NIST)의 AI 위험관리프레임워크(RMF)나 유럽연합(EU) AI법 등은 주로 AI 시스템 자체를 어떻게 관리할지를 다룰 뿐, AI 에이전트의 실행 권한을 규제하고 있진 않다.


삼성전자는 이런 문제에 대응하기 위해 AI 에이전트의 권한을 통제하는 자체 체계 'AAA(Account for AI Agent)'를 구축했다. 

 

AAA는 AI 에이전트가 작업을 실행할 때마다 이게 어떤 에이전트이고, 누구의 지시로 움직이는 것인지부터 먼저 확인한다. 이후 그 작업에 필요한 데이터·도구에만 접근을 허용하고, 승인·거부 이력도 기록해 추적할 수 있게 했다. 작업에 필요한 권한만 그때그때 부여하고, 작업이 끝나면 권한을 자동으로 회수하는 방식이다.

김제민 삼성전자 빅데이터센터 파트장은 지난 15일 '오픈테크넷 2026'에서 "표준이 준비되길 기다릴 수 없어 에이전트가 실제로 움직이는 순간을 통제하는 계층을 직접 만들어야 했다"고 말했다.

SK텔레콤은 지난 15일부터 18일까지 서울 SKT타워에서 세계이동통신사업자연합회(GSMA) RCS(메시지 전송 방식) 그룹 표준화 회의를 열고, AI 에이전트가 거래 실행 전 문자메시지로 사용자의 최종 승인을 받는 절차를 국제표준화 안건으로 제안했다. 


SK텔레콤 관계자는 "지금은 논의가 시작되는 단계"라며 "회사 내부 AI 원칙에 따라 제안된 것으로 안다"고 말했다. 

 

전문가는 기업의 자체 통제만으로는 한계가 있어 별도의 법적 장치가 필요하다는 입장이다.

위정현 중앙대 경영학부 교수는 "AI가 어떤 경우에도 인간의 통제를 벗어나지 않도록 하는 명령 체계와 알고리즘을 만들 필요가 있다"며 "인간의 의지를 벗어나는 AI를 만들 경우 이를 제재할 수 있는 법적 체계도 필요하다"고 말했다.

 

KPI뉴스 / 배지수 기자 didyou@kpinews.kr

 ​

[저작권자ⓒ KPI뉴스. 무단전재-재배포 금지]