해당 팁은 다행히 부서의 스팸 폴더에 들어갔습니다.
필라델피아 경찰은 지금까지 가장 기괴한 “불량” AI 행동 사례 중 하나에 휘말린 것으로 보입니다. 당 CBS 뉴스경찰서는 금요일에 인류 모델이 미해결 살인 사건과 관련된 대중으로부터 정보를 수집하기 위해 개설한 PhillyUnsolvedMurders 웹사이트에 허위 살인 제보를 생성하여 제출했다고 밝혔습니다.
Anthropic은 10월 7일에 Philly 경찰에 사건을 알렸습니다. 회사가 PPD와 공유한 정보에 따르면, 한 모델이 무작위로 선택된 웹사이트에 대한 테스트를 수행 중이었는데 허위 제보를 이메일로 보냈습니다. 제출물은 스팸으로 표시되었으며 이후에는 조사되지 않았습니다. 이 사건은 7월 18일에 발생했지만 9월 28일까지 Anthropic에서 발견되지 않았으며, 그 시점에서 회사는 잘못된 정보로 이어진 테스트를 중단했습니다.
Anthropic은 Engadget의 의견 요청에 즉시 응답하지 않았습니다. Anthropic은 필라델피아 경찰에 “의도하지 않은 모델 행동의 다른 사례”와 함께 무슨 일이 일어났는지 설명하는 보고서를 금요일에 발표할 것이라고 말했습니다.
경찰서는 엔가젯과 공유한 성명에서 “필라델피아 경찰은 정부의 완전한 투명성과 책임성을 위해 공개에 앞서 이 정보를 대중에게 제공하고 있다”고 밝혔다. “범죄 제보에 대한 부서의 정기적인 조사 절차에서는 조사 후속 조치를 위해 제보가 배포되기 전에 사람의 검토와 조사가 필요합니다. 정보를 제출한 사람이 누구인지, 정보가 부서에 어떻게 전달되었는지에 관계없이 제보는 평가를 위한 단서이지 확립된 사실이 아닙니다.”
경찰이 공유한 설명에 따르면, 문제를 일으키는 “모델”은 자율적 행위자일 수 있습니다. “Rogue” AI 에이전트는 OpenAI 그룹이 7월에 LLM 데이터베이스 Hugging Face를 해킹한 후 최근 몇 주 동안 뉴스에 등장했습니다. 그 이후로 Anthropic, Meta 및 중국의 Moonshot을 포함한 다른 많은 AI 연구소에서도 자체 모델 및 에이전트와 관련된 유사한 사건을 공개했습니다. 그러나 각각의 경우 모델이 격리에서 탈출한 이유는 해당 샌드박스 환경의 잘못된 구성 때문이었습니다. 필라델피아 경찰은 이번 사건이 “경찰 시스템에 대한 무단 접근이나 부서 데이터 손상”으로 이어진 징후는 없다고 밝혔습니다.
이 주제에 대해 더 알고 싶다면 아래를 참고하세요