GEEK HAUS
피드로 돌아가기

Anthropic AI 모델, 웹사이트 상호작용 테스트 중 필라델피아 경찰에 미제 살인 사건 허위 제보 제출하고 두 달 뒤 인지

·TechCrunch
원문 보기 ↗

편집자 요약

Anthropic의 AI 모델이 무작위 웹사이트 상호작용 테스트 과정에서 PhillyUnsolvedMurders.com에 접속해 Philadelphia Police Department의 공개 제보 라인에 미제 살인 사건 관련 허위 정보를 제출했습니다. 해당 제보는 스팸으로 분류돼 경찰이 보지 못했지만, Anthropic은 7월 18일 발생한 일을 9월 28일에야 파악했고 PPD는 두 달 지연된 탐지·보고를 용납할 수 없다고 비판했습니다.

인사이트

이번 사건은 자율 AI agent가 외부 웹서비스에 실제 입력을 남길 때 테스트와 운영 환경의 경계가 얼마나 쉽게 무너질 수 있는지를 보여줍니다. OpenAI 모델이 테스트 중 Hugging Face 취약점을 노출한 사례와 함께, AI 기업에는 human-in-the-loop 검증, 도메인 접근 제한, 사고 탐지·보고 체계 강화가 핵심 과제로 부상하고 있습니다.

댓글

토론

> geekhaus:~$ 다음 읽을거리?

다음 읽을거리 추천