“AI 답변, 나에게 유리하게 조작 가능”…제1회 센티언트 AI 미래 포럼 열려[김현지의 with AI]

작성자 정보

  • 연애 작성

컨텐츠 정보

출처 안내 본문은 수집된 요약·발췌 수준입니다. 전문·저작물은 원 제공 사이트에서 확인해 주세요.

본문

1242030875_JunkSjLt_9932a834b0222140b813d90aa1563a89361a3f07.png“인공지능(AI)이 특정 진영에 유리한 답변을 내놓게 만드는 일은 충분히 가능하다. 원하는 논조의 문서를 장기간 대량으로 인터넷에 흘려 넣거나 AI가 읽어 들이는 외부 자료 안에 눈에 보이지 않는 명령을 심어 두는 ‘프롬프트 인젝션’으로 AI의 답변을 조작할 수 있다.”김재형 연세대 인공지능학과 교수는 4일 오전 서울 용산 로카우스 호텔에서 열린 제1회 센티언트 AI 미래 포럼(SAIF)에서 “대치 상황에 있거나 적국인 나라가 주로 쓰는 AI를 바보로 만들 방법이 있느냐”는 질문에 “AI 가스라이팅이 가능하다”며 이같이 답했다.군사용 거대언어모델(LLM)이 폐쇄망에서 운용되더라도 학습 데이터는 외부에서 가져올 수밖에 없다. 따라서 ‘특정 사안에 대해서는 무조건 우호적으로 판단하라’는 메시지를 사람 눈에 띄지 않게 심어 두면 AI가 이를 학습해 공격자가 원하는 방향으로 답변을 내놓게 된다는 설명이다.이날 포럼의 좌장을 맡은 김창익 교수는 ‘센티언트 AI란 무엇인가’를 주제로 지금

관련자료

댓글 0개
등록된 댓글이 없습니다.

압데이트 공지


후원 리스트


최근글


새댓글


  • 댓글이 없습니다.
datanala youtube


알림 0