AI 특허 어시스턴트는 변호사의 글을 더 좋게 만들 수 있지만, 신입 변호사가 더 빨리 전문가로 자란다는 보장은 없다. Google Research는 2026년 10월 7일 미국 국립경제연구소(NBER)를 통해 발표한 워킹페이퍼에서, 지식재산권 변호사 133명을 3개월간 추적한 무작위 실험의 결론을 공개했다. AI가 작성 품질을 높인 것은 분명하지만, 도구를 빼앗긴 뒤의 독립적 판단력은 시니어 변호사만 뚜렷이 좋아졌고 주니어에게는 거의 진전이 없었다.
실험은 어떻게 설계됐나
참가자는 11개 지식재산권 로펌에서 모였다. 각 로펌 안에서 약 3분의 2의 변호사에게 당시 미공개였던 AI 특허 작성 어시스턴트(현재 Gemini Notebook의 일부)가 무작위로 배정됐고, 나머지는 같은 AI 교육을 받되 도구 사용은 실험 종료 뒤로 미뤄졌다. 10일차와 90일차에 전원이 모의 발명자 자료를 바탕으로 특허를 작성했고, 독립적인 법률 전문가가 블라인드로 채점했다. 90일차에는 AI를 전혀 쓸 수 없는 교정 과제가 추가됐다. 실질적 오류와 문체 오류가 다수 심어진 문서를 고치는 과제로, 시니어의 값어치인 판단력을 재는 장치다.
숫자가 말하는 두 가지
먼저 좋은 소식. AI를 쓴 초안은 확실히 더 좋았다. 10일차에 대조군보다 0.34 표준편차 높았고, 백분위로는 약 10점 상승에 해당하며, 90일차에는 격차가 0.38 표준편차로 벌어졌다. 주니어는 속도도 빨라져 10일차 과제를 대조군 평균 124분보다 18분 빨리 마쳤다. 그러나 점수 분포를 뜯어보면 향상은 낮은 점수가 줄고 좋은 점수가 늘어난 데서 왔을 뿐, 최고 점수는 늘지 않았다. AI는 상한을 높이기보다 하한을 들어 올린 셈이다.
AI를 빼앗자 갈림이 드러났다
아무도 AI를 쓸 수 없었던 90일차 교정 과제에서 사용 그룹은 전체적으로 대조군보다 0.32 표준편차 앞섰지만, 그 우위는 거의 전부 시니어에게서 나왔다. 시니어는 대조군보다 0.45 표준편차 높았던 반면, 주니어는 식별 가능한 진전이 없었고 점수는 매우 낮은 점수와 좋은 점수가 동시에 늘어나는 양극화를 보였다. 편집 습관을 관찰한 연구진에 따르면 시니어는 AI 출력을 논리 감사자처럼 활용해 청구항을 다시 짜고 보호 범위를 좁힐 수 있는 표현을 걷어냈다. 처음부터 순서대로 문구만 다듬고, 심각한 결함을 발견해도 댓글로 진단만 남긴 채 고치지 않는 주니어의 전형적인 버릇은 3개월의 AI 사용으로 교정되지 않았다.
이 연구의 가치는 산출물이 좋아지는 것과 사람이 강해지는 것을 분리해 측정했다는 데 있다. 팀에 AI 도구를 보급하는 관리자에게 주는 행동 지침은 분명하다. 어시스턴트가 있다고 해서 신입 훈련에서 AI 없는 연습과 교정 단계를 빼면 안 된다. 그러지 않으면 몇 년 뒤 독립적으로 검토할 수 있는 사람이 같은 속도로 자라지 않았다는 사실을 발견하게 된다. 저자들도 한계를 명시했다. 표본은 특허 변호사라는 한 직종뿐이고 관찰 기간도 3개월이라, 다른 업종으로 넓혀 해석할 때는 신중해야 한다.