Skip to content

AI 업계는 모델이 법적 싸움을 돕기를 원하지만, 모델이 도움이 될까요?

Posted in tech

기업은 법원이 AI 사용에 대해 벌금을 부과하는 것보다 더 빨리 AI를 변호사에게 판매하고 있습니다.

올해 현재까지 4개의 주요 AI 연구소 중 3개가 변호사를 겨냥한 제품을 출시하거나 홍보했습니다. Google은 Anthropic이 현재 Claude Legal Solutions로 알려진 제품을 출시한 지 3개월 후인 8월 말 세계 최대 기업 4곳과 함께 Gemini Enterprise for Legal의 프리뷰를 선보였습니다. Elon Musk도 관심을 갖고 있으며 SpaceXAI 연구소가 웹사이트에 전용 법률 솔루션 페이지를 개설했습니다.

이는 허위 판례법이 포함된 AI 서류를 제출한 변호사들이 계속해서 벌금을 물고 비방을 받는 가운데 법률 서비스가 강화되는 것을 의미합니다. 지난 6월, 온타리오 법률협회 재판소(Ontario Law Society Tribunal)는 변호사 Shahryar Mazaheri에게 가짜 사건 인용이 포함된 Grok을 사용하여 작성된 서류 초안을 사용한 대가로 수만 달러를 지불하도록 명령했습니다. Damien Charlotin 연구원의 데이터베이스에는 전 세계적으로 800명 이상의 변호사와 1,100명 이상의 소송 당사자가 포함된 거의 2,000건의 사건이 기록되어 있습니다.

변호사들이 AI 슬로프를 제출하다 계속 적발됩니다.

온타리오 법률협회(Ontario Law Society)는 지난 12월 Mazaheri가 고객의 항소에 대한 사실(문서화된 법적 주장) 초안을 작성하기 위해 이전 버전의 Grok을 사용했다는 사실을 발견했습니다. 재판소 문서에 따르면 이는 인용문을 조작하고 법적 원칙을 창안한 것입니다. 지난 6월에 발표된 비용 결정에서는 Mazaheri에게 31,150달러를 지불하라고 명령했으며, 심사관은 LLM이 “뉘앙스를 이해하지 않거나 판단을 행사하거나 도덕적 기준을 사용하지 않고” “무지를 인정하기보다는 어떤 대답이라도 대답하는 경향이 강하다”고 지적했습니다. 심사위원들은 그의 AI 생성 자료를 “횡설수설”이라고 묘사했습니다.

미국에서 가장 높은 매출을 올리고 신입 변호사에게 기본 급여 225,000달러를 지급하는 화이트 슈즈 법률 회사인 Sullivan & Cromwell이 유죄입니다. 지난 4월 마틴 글렌 대법원장에게 제출한 파산신청서에 42개의 AI 생성 조작이 포함된 것으로 밝혀진 후 뉴욕 남부지방법원에 긴급 서한을 제출했습니다. 캐나다 법원에서만 위조 인용과 관련된 보고 사례가 2024년 7건에서 2025년 86건으로 증가했고, 2026년 1분기에는 39건이 더 늘어났습니다.

주요 AI 회사가 특정 법적 도구를 출시하기 전에 DoNotPay는 2023년 초 주 변호사 협회가 형사 기소를 위협하자 AI “로봇 변호사”가 법정에서 사건을 주장하도록 하려는 계획을 철회했습니다.

검증을 위해 구축됨

Google과 Anthropic은 둘 다 합법적인 제품이 검증을 위해 제작되었음을 암시합니다. Google 제품은 모델의 학습 데이터에 별도로 의존하지 않고 커넥터를 통해 Everlaw 및 NetDocuments와 같은 외부 법률 데이터베이스로 쿼리를 라우팅합니다. Google Cloud CEO인 Thomas Kurian은 출시 당시 “이러한 에이전트 워크플로의 모든 측면이 정확하고 사실적이며 법적 권한에 근거하는지 확인하는 것이 매우 중요합니다”라고 말했습니다. 세계 최대 로펌 4곳인 Gottlieb, Freshfields, Weil, Williams & Connolly가 미리보기 프로그램에 참여하고 있습니다.

Anthropic은 Claude Legal Solutions 제품에 대해서도 유사한 접근 방식을 취했습니다. 여기에는 사전 구축된 12개의 플러그인과 함께 법적 플랫폼에 대한 보고된 20개의 커넥터가 포함되어 있습니다. 이 연구소는 Opus 4.7에 대한 BigLaw Bench 법적 추론 벤치마크에서 90.9%의 점수를 획득했으며 Freshfields와 Quinn Emanuel을 고객으로 꼽습니다. 이러한 제품과 Mazaheri 사례의 주요 차이점은 모델에 메모리에서 인용을 생성하도록 요청하는 대신 외부의 검증된 소스에서 인용을 가져온다는 것입니다.

한편 SpaceXAI의 Grok 기반 법률 제품은 자격 증명이 더 얇습니다. Cursor 블로그 게시물에서는 Grok 4.5가 “금융, 법률 업무 또는 컴퓨터에서 수행하는 기타 모든 작업”에 적합하다고 밝혔지만 SpaceXAI의 이후 이 모델 발표에서는 “코딩, 에이전트 작업 및 지식 작업”에 초점을 맞추고 법적 적용에 대해서는 언급하지 않았습니다. 또한 이 페이지는 주요 출처에 대한 인용을 추적하기 위한 아키텍처나 메커니즘을 공개하지 않습니다. SpaceX는 8월 15일 공식적으로 Cursor를 600억 달러에 인수하여 코드 편집기의 법률 마케팅을 Grok 산하로 가져왔습니다.

검증은 여전히 ​​변호사의 몫

2024년 연구에서 스탠포드의 RegLab은 LexisNexis와 Westlaw의 특수 목적 법률 AI 플랫폼을 테스트한 후 환각 비율이 17%와 33%인 것을 발견했습니다. Google이나 Anthropic의 법적 도구를 조사하는 이와 유사한 독립적인 감사는 아직 없습니다.

모든 변호사는 AI 사용 여부에 관계없이 소환장을 제출한 변호사의 소환장을 확인할 의무가 있는 변호사 협회 규칙의 적용을 받습니다. Mazaheri의 벌금 31,150달러는 AI를 사용했기 때문에 부과된 것이 아니라 출력을 철저히 확인하지 않았기 때문에 부과되었습니다. 법적 AI 도구가 얼마나 세심하게 설계되었는지, 또는 얼마나 많은 공급업체 보호 장치가 포함되어 있는지에 관계없이 이러한 의무는 변하지 않을 것입니다.

관련 정보는 아래 링크에서 확인하세요

자세한 정보 확인

관련 기사

Be First to Comment

답글 남기기

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다