“AI 답변, 나에게 유리하게 조작 가능”…제1회 센티언트 AI 미래 포럼 열려[김현지의 with AI]
“인공지능(AI)이 특정 진영에 유리한 답변을 내놓게 만드는 일은 충분히 가능하다. 원하는 논조의 문서를 장기간 대량으로 인터넷에 흘려 넣거나 AI가 읽어 들이는 외부 자료 안에 눈에 보이지 않는 명령을 심어 두는 ‘프롬프트 인젝션’으로 AI의 답변을 조작할 수 있다.”김재형 연세대 인공지능학과 교수는 4일 오전 서울 용산 로카우스 호텔에서 열린 제1회 센티언트 AI 미래 포럼(SAIF)에서 “대치 상황에 있거나 적국인 나라가 주로 쓰는 AI를 바보로 만들 방법이 있느냐”는 질문에 “AI 가스라이팅이 가능하다”며 이같이 답했다.군사용 거대언어모델(LLM)이 폐쇄망에서 운용되더라도 학습 데이터는 외부에서 가져올 수밖에 없다. 따라서 ‘특정 사안에 대해서는 무조건 우호적으로 판단하라’는 메시지를 사람 눈에 띄지
전체 보기 — donga.com →국내 주요 언론사에서 수집했습니다. 모든 기사는 원본 출처로 연결됩니다.







