안녕하세요! 오늘은 우리가 매일 사용하는 SNS 환경이 조금 더 안전해질 수 있다는 반가운 소식을 들고 왔어요. 최근 메타(Meta)가 플랫폼 내의 유해 콘텐츠를 막기 위해 아주 똑똑한 기술을 도입했다고 하네요.
광고 속에 숨겨진 함정, '사인포스팅'을 잡아라
최근 나쁜 의도를 가진 사람들이 사용하는 교묘한 수법이 발견되었는데요. 바로 광고 자체에는 문제가 없지만, 클릭하면 불법적인 사이트로 연결되도록 유도하는 '사인포스팅(signposting)' 방식이에요. 이를 막기 위해 메타는 이번에 대형언어모델(LLM) 시스템을 전격 도입했습니다.
이제 AI는 단순히 광고 문구만 보는 게 아니라, 사용자가 광고를 클릭했을 때 도착하게 될 목적지까지 꼼꼼하게 확인한다고 해요. 실제로 메타는 올해 상반기 동안 페이스북과 인스타그램에서 수천만 건의 유해 콘텐츠를 찾아냈는데, 그중 97% 이상을 이용자의 신고가 들어오기 전에 자체 시스템이 먼저 탐지해냈다고 합니다.
공격자보다 더 똑똑한 AI, '레드팀' 운영
메타는 단순히 방어만 하는 게 아니라, 스스로의 약점을 찾는 과정도 거치고 있어요. 바로 '레드팀 AI 에이전트'를 운영하는 건데요. 이는 공격자의 입장에서 시스템의 허점을 직접 공격해 보며 보안을 강화하는 아주 스마트한 방식이에요. 계정이 삭제되어도 새 계정으로 다시 가입하려는 이용자까지 찾아낼 수 있도록 시스템을 계속 개선하고 있다고 하네요.
개인적으로 이번 소식을 보며 AI 기술이 단순히 편리함을 주는 것을 넘어, 우리 사회의 안전을 지키는 방패 역할을 하고 있다는 생각이 들었어요. 기술이 발전할수록 이를 악용하려는 수법도 정교해지지만, 그만큼 방어하는 AI 기술도 함께 진화하고 있다는 점이 인상 깊습니다. 앞으로 더 안전하고 깨끗한 디지털 환경이 만들어지길 기대해 봅니다!
본 포스팅은 매일테크에서 발행되었습니다.

