Skip to content

Anthropic은 Claude가 AI R&D 작업의 26%를 ‘리드’한다고 말합니다.

Posted in tech

회사는 AI 개발 속도를 전달하는 데 도움이 되는 세 가지 측정치와 함께 통계를 공유했습니다.

Anthropic(특히 CEO Dario Amodei)은 AI 에이전트가 Hugging Face를 해킹했다는 OpenAI의 폭로 이후 AI 안전에 관해 많은 말을 했으며, 이미 그 과정에서 어떻게 작동하는지에 대한 몇 가지 흥미로운 세부 정보를 공개했습니다. 예를 들어, Anthropic은 AI 회사가 AI 개발 속도를 전달하는 데 도움이 될 수 있다고 생각하는 측정 표준을 자세히 설명하는 새 블로그에서 AI 챗봇 Claude가 AI R&D 작업의 26%를 ‘리드’한다고 공유했습니다.

이제 “리드”라는 말은 AI가 “(a) 인간이 감독하는 동안 (a) 높은 수준의 프롬프트에서 엔드투엔드 작업의 대부분을 완료할 수 있음”을 의미하지만 여전히 놀라운 측정 기준입니다. 또한 AI는 이제 26%의 Claude가 주도하는 것을 포함하여 연구의 90% 이상에 대해 적어도 “인간의 긴밀한 지시에 따라 대규모 작업”을 수행한다고 주장합니다. 이는 Claude가 Anthropic 직원이 수행하는 대부분의 작업을 다루고 있음을 의미합니다. 비록 회사에서 챗봇이 “AI R&D 작업의 측정된 하위 집합에 대해 완전히 자율적으로 작동하지 않는다”고 말하더라도 말입니다.

Anthropic은 “AI 주도 AI R&D”에 초점을 맞춘 세 가지 제안 측정 중 첫 번째를 통해 이러한 통계를 내놓았습니다. Anthropic은 Claude가 얼마나 많은 AI 연구 및 개발을 수행하는지에 대한 지수와 Epoch AI가 개발한 자동화 등급 척도를 사용하여 2025년 8월부터 Claude의 ‘자동화 수준’을 표시하는 차트를 만들 수 있었습니다. Anthropic은 모든 최첨단 AI 모델 제조업체가 자체 데이터와 제3자의 검증을 통해 재현할 수 있다고 믿는 프로세스입니다.

또한 회사는 AI 에이전트에 대한 감독(에이전트 활동이 얼마나 모니터링되는지, 검토하는 데 걸리는 시간, 에이전트 행동에 플래그가 지정되는 빈도)을 측정하고 프론티어 개발이 적절하게 진행되고 있는지 확인하는 다른 방법으로 AI R&D에 얼마나 많은 컴퓨팅이 사용되는지 추적하는 방법을 제안했습니다. 투명성이 높아지면 잠재적으로 통제 불가능한 AI 개발에 더 쉽게 대응할 수 있거나 적어도 대중에게 더 명확한 시각을 제공할 수 있기를 바랍니다.

하지만 지금까지 문제는 기업들이 AI 개발 속도를 늦추는 아이디어에 동의하도록 만드는 것이 아닙니다. OpenAI는 이미 그 아이디어에 대해 립서비스를 했고Anthropic은 제3자 평가자가 개발 관행을 검토할 수 있도록 허용하기로 약속했습니다. AI 안전에 대한 Amodei의 입장은 심지어 Elon Musk는 X에 동의합니다. AI 산업이 자율 규제 이외의 다른 문제에 직면할지 여부는 훨씬 더 불확실합니다. 도널드 트럼프 대통령은 AI의 위험을 크게 경시했습니다.

관련 정보는 아래 링크에서 확인하세요

자세한 정보 확인

관련 기사

Be First to Comment

답글 남기기

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다