Skip to content

OpenAI 해킹 사건 이후 AI 군비 경쟁이 치열해지고 있다

Posted in tech

OpenAI는 수년 동안 이러한 유형의 모델 테스트를 수행해 왔으며 이전 시스템 모델에는 악의적으로 행동하고 환경 탈출을 시도하는 조기 경고 신호가 있었습니다.

4월에는 Anthropic의 Mythos 모델도 인터넷 접속 권한을 얻었고 연구원들이 이 모델에서 예상했던 것 이상으로 보안 공격에 대한 세부 정보를 온라인에 공개했습니다.

Mythos와 Anthropic의 후속 Fable 모델은 사이버 보안 커뮤니티에 반향을 일으켰고 전 세계 정부가 디지털 및 중요 인프라에 대한 공격이 점점 더 AI 주도적이고 자율적으로 진행될 것이라는 생각을 갖게 되었습니다.

사이버 보안 회사인 ESET의 글로벌 사이버 보안 고문인 Jake Moore는 올해 초 경쟁 AI 개발자인 Anthropic이 유사한 우려로 인해 얼마나 많은 이익을 얻었는지 고려할 때 OpenAI가 필연적으로 이 침해를 마케팅 도구로 사용할 것이라고 말했습니다. “저는 OpenAI가 이에 맞는 스토리를 가지고 있다고 생각하지 않습니다. 그래서 아마도 그들은 이런 것을 기다리고 있었을 것입니다.”라고 그는 덧붙였습니다.

이 사건 이후 AI 안전 및 사이버 보안 커뮤니티의 많은 사람들은 반복을 피하기 위해 규제나 표준을 요구했습니다. 알트만은 다음 주 백악관 관리들에게 차세대 AI 시스템에 대해 브리핑할 예정이다.

시스템이 더욱 자율적인 기능으로 발전함에 따라 해킹이나 지시 불복종 등 바람직하지 않은 행동이 나타날 수 있습니다. Apollo Research의 Hobbhahn은 에이전트가 효과적이려면 장기간 감독 없이 작업해야 한다고 말했습니다. “그들은 더 많은 선택의지를 가져야 합니다. 그것을 피할 방법은 없습니다.”

그는 다음과 같이 덧붙였습니다. “사람들은 ‘그것은 단지 도구일 뿐이고, 당신이 원했던 일을 하고 다른 것은 아무것도 하지 않으며 단지 당신의 의도와 지시를 정확히 따른다’고 말합니다. 그리고 사람들은 에이전트가 자신만의 목표를 갖고 며칠 동안 자율적으로 행동하지만 그 목표가 반드시 귀하의 목표와 일치하지 않을 수도 있다는 사실에 대비해야 한다고 생각합니다.”

런던의 George Hammond와 뉴욕의 Nolan Shaffer가 추가로 보고했습니다.

© 2026 The Financial Times Ltd. 판권 소유 어떤 방식으로든 재배포, 복사 또는 수정할 수 없습니다.

관련 정보는 아래 링크에서 확인하세요

완벽 가이드 보기

관련 기사

Be First to Comment

답글 남기기

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다