ai-labor-market

AI 월 200건 의무화, 질의 31%가 채우기용이었다. 절반으로 줄이자 매출 7% 증가

의료기기 기업이 직원 5,000명에게 월 200건 AI 질의를 의무화하자 31%가 반복·업무 무관이었습니다. 목표를 100건으로 낮춘 지점에서 감소분의 90%가 채우기용이었고 매출은 7% 올랐습니다.

글:편집자 겸 저자
게시일:
AI 활용 작성

2025년 3월, 중국의 한 의료기기 기업이 사무직 약 5,000명에게 사내 AI 어시스턴트를 열었습니다. 그달 말까지 질문을 한 번이라도 입력해 본 직원은 14.8%뿐이었어요.

그래서 경영진은 요즘 늘어나는 기업들처럼 AI 사용을 의무로 만들었습니다. 비생산직 전원이 월 200건 이상 질의를 제출해야 했고, 반복 미달자에게는 벌금이 붙었죠. 홍콩대 경제학자 5명이 2026년 9월 26일 arXiv에 올린 워킹페이퍼는 그다음에 벌어진 일을 질의 하나하나 단위로 추적합니다. 짧게 말하면, 할당량은 통했다가 망가졌고, 그걸 절반으로 줄이자 영업팀 매출이 올랐습니다.

할당량은 사람들을 문 안으로 들였다

[사실] 의무화는 첫 번째 역할은 해냈습니다. 시행된 2025년 4월에만 직원의 31.2%가 처음으로 도구를 썼고, 5월에 9.1%가 더 합류했습니다. [추정] 합치면 한 번이라도 써 본 비율이 두 달 만에 14.8%에서 약 55%로 올랐습니다.

[사실] 벌칙도 형식적이지 않았습니다. 첫 미달은 공식 경고, 반복 미달은 벌금 200위안이었는데, 저자들은 이를 평균 월급의 약 2%, 평균 월 성과급의 7%로 계산합니다.

[사실] 도구 자체도 실용적이었어요. 회사 기술문서·고객 기록·인허가 자료로 미세조정한 DeepSeek 모델 기반이었고, 저자들이 든 예시로는 병원 방문을 준비하는 영업사원이 거래처 프로필과 제안 멘트를 약 10분 만에 만들 수 있었습니다. 수작업 검색이면 40~60분 걸리던 일이죠.

여기까지가 보통 전해지는 이야기입니다. 나머지는 질의 로그가 보여 줍니다.

그리고 할당량이 일이 되었다

연구진은 질의 건수만이 아니라 모든 프롬프트 내용을 읽을 수 있었습니다. 드문 경우예요. 대부분의 도입 연구는 로그인 기록이나 라이선스 수만 봅니다.

[사실] 도구를 조금이라도 쓴 직원 가운데 월 합계가 정확히 200건인 경우가 12%, 220건 이하에서 멈춘 경우가 95%였습니다. 요구치를 크게 넘겨 쓰는 사람은 거의 없었던 거죠.

[사실] 타이밍도 드러났습니다. 매달 전반부에는 근무일 하루가 월 질의의 약 3%를 차지했는데, 마지막 며칠에는 하루 7~8%로 뛰었습니다. 마감 전에 채워 넣고 있었던 겁니다.

[사실] 가장 분명한 신호는 내용이었습니다. 저자들은 질의의 31%를 같은 달 본인이 이미 넣었던 프롬프트의 완전 반복이거나, 개인적·업무 무관한 것으로 분류했습니다. 공개된 업무 무관 예시에는 미국의 대중국 관세에 대한 질문, 옛 친구가 그립다는 일기 같은 문장도 있어요.

저자들은 월스트리트저널이 2026년 4월 테크 업계의 이런 행태를 두고 쓴 「토큰맥싱(tokenmaxxing)」이라는 말을 인용합니다. 이 논문에서는 그게 측정된 크기를 갖습니다.

우연히 생긴 실험

이 논문이 일화 이상인 이유는 수정안이 퍼진 방식에 있습니다.

[사실] 석 달 뒤 지점들이 월 200건은 시간이 너무 든다고 불만을 냈고, 본사는 2025년 7월 목표를 100건으로 낮췄습니다. 논문은 본사가 사용 데이터나 질의 내용을 검토하지 않고 이 결정을 내렸다고 적습니다. 공식 공문이 아니라 CEO실 메모로 나가다 보니 지점마다 해석이 달랐고, 19개 지점은 즉시 바꿨고 다른 지점은 나중에 바꿨으며 15개 지점은 12월까지 200건을 유지했습니다.

이 혼선이 쓸모가 있었습니다. 바꾼 지점과 아직 안 바꾼 지점을 달마다 비교할 수 있게 됐으니까요. [사실] 전환 지점과 미전환 지점은 인원·성비·연령·학력·기존 사용량에서 비슷했고(결합 검정 p = 0.49), 사건연구 그래프에서도 전환 전 추세는 평평했습니다.

기준을 낮췄을 때 사라진 것

[사실] 목표를 낮추자 직원당 월 질의가 약 29건 줄었습니다. 표본 평균 대비 30% 감소입니다. 그중 약 26건, 즉 감소분의 약 90%가 반복 또는 업무 무관 질의였어요. 반복 아닌 업무 관련 질의의 변화는 -2.7건으로, 통계적으로 0과 구별되지 않았습니다.

[사실] 저품질 질의 비중은 31%에서 18%로 떨어졌고, 월말 급증도 완만해졌습니다.

200건에 딱 맞춰 쓰던 직원들이 가장 크게 줄였습니다. [사실] 기준선 근처에 몰려 있지 않던 직원은 총사용량이 거의 그대로였는데, 저품질 질의가 준 만큼 고품질 질의가 늘었기 때문입니다.

그리고 회사 입장에서 중요한 결과. [사실] 개인 성과 데이터가 있는 유일한 집단인 8개 지점 영업사원 500여 명에게서, 목표를 낮춘 뒤 월 매출이 약 7% 올랐습니다. 와일드 부트스트랩 추론과 지점을 하나씩 빼는 검정에서도 유지됩니다.

저자들이 계산하지 않은 숫자

논문은 질의 유형별로 매출과의 관계도 보고합니다. [사실] 반복·업무 무관 질의 1건이 늘 때마다 월 매출이 0.025% 낮고, 진짜 업무 질의 1건마다 0.018% 높게 나타납니다.

[추정] 여기에 변화 크기를 넣어 보면, 채우기용 질의 약 26건이 사라진 효과는 이 관계로 약 +0.65%입니다. 업무 질의가 조금 준 것이 약 0.05%를 되돌리고요. 순효과는 약 0.6%, 7% 효과의 10분의 1도 안 됩니다.

이 간극이 흥미로운 대목입니다. 매출 증가의 대부분은 「더 나은 프롬프트」에서 오지 않았다는 뜻이니까요. [주장] 더 그럴듯한 경로는 단순합니다. 영업사원들이 매달 마지막 며칠을 카운터 채우는 데 쓰지 않고 다시 영업하러 나간 거죠. 저자들도 할당량 채우기에서 풀려난 시간을 가능한 경로 중 하나로 듭니다. 우리 계산은 그쪽이 더 큰 경로라는 쪽을 가리킵니다. 다만 이건 논문의 두 계수에서 우리가 끌어낸 추론이지 저자들의 결론이 아니고, 질의별 계수는 인과 추정이 아니라 상관관계입니다.

근거가 멈추는 곳

한 나라의 한 회사(가명 「MedTech Corp」), 열 달짜리 데이터입니다. 염두에 둘 한계는 이렇습니다.

  • [사실] 200건 의무화는 모든 지점에 같은 날 적용돼서, 의무화 자체가 좋았는지 나빴는지는 이 논문으로 알 수 없습니다. 측정한 건 기존 의무를 완화한 효과뿐이고, 저자들도 이를 직접 밝힙니다.
  • [사실] 「업무 무관」은 LLM 분류기(DeepSeek-V4 Pro)가 붙인 라벨이고, 사람 평가자 3명과 대조했습니다. 일치도는 높지만(모델 포함 Fleiss 카파 0.843), 여전히 관찰된 사실이 아니라 의도에 대한 판단입니다.
  • [사실] 매출 데이터는 8개 지점 분량입니다. 군집 수가 이 정도면 신뢰구간은 헤드라인이 주는 인상보다 넓습니다.
  • [사실] 로그는 무엇을 물었는지는 보여 주지만, 답을 실제로 썼는지는 보여 주지 않습니다.

프레임 전체에 대한 정당한 반론도 있습니다. [주장] 처음의 빡빡한 목표가 없었다면 도구 사용률은 15%에 머물렀을 수 있고, 그랬다면 완화할 것도 없었겠죠. 투박한 의무화가 출발점으로는 합리적일 수 있습니다. 논문도 이 해석을 지지합니다. 여기서 할당량에 대한 비판은, 높은 할당량이 제 역할을 다한 뒤에도 그대로 두는 것에 대한 비판입니다.

내 직업에 주는 의미

회사가 여러분의 AI 사용량을 세고 있다면, 이 연구가 미리보기입니다.

  • 사용 건수는 생산성 지표가 아닙니다. 이 회사에서는 집계된 활동의 31%가 채우기용이었어요. 프롬프트 수로 직원 순위를 매기는 대시보드는 일부는 잡무를 견디는 인내심으로 순위를 매기는 셈입니다.
  • 관리자라면 숫자를 정하기 전에 내용부터 보세요. 이 회사 본사는 데이터가 아니라 불만 때문에 할당량을 줄였는데도 매출이 7% 올랐습니다. 로그를 들여다보는 회사라면 운보다 나은 결과를 낼 수 있습니다.
  • 할당량을 받고 있다면 쓸모 있는 사용의 기록을 남기세요. 이 연구에서 진짜로 도구를 쓰던 직원들은 기준이 낮아진 뒤에도 계속 썼습니다. 그게 보여 줄 가치가 있는 사용량입니다.

직업별 데이터는 영업 담당자, 현장 영업 담당자, 영업 관리자, 보상·복리후생 관리자 페이지에서 확인하세요.

출처

  • Jie Gong, Jiayi Hou, Jin Li, Fei Pu, Xinjue Yao, "When Less Is More: Managing AI Adoption with Adaptive Incentive Design," arXiv:2609.32859, 2026년 9월: https://arxiv.org/abs/2609.32859

이 분석에 대하여

이 글은 AI의 도움을 받아 작성했습니다. [사실]로 표시한 수치는 초록만이 아니라 arXiv:2609.32859v1 전문(부록 포함 57쪽)에서 읽었습니다. 이 논문은 워킹페이퍼이며 동료 심사를 거치지 않았습니다. [추정]으로 표시한 매출 분해(7% 중 약 0.6%가 질의 구성으로 설명됨)는 논문이 보고한 계수로 우리가 직접 한 계산이며, 저자들의 주장이 아닙니다. 논문의 표나 그림은 전재하지 않았습니다.

본 분석은 Anthropic Economic Index, 미국 노동통계국(BLS), O*NET 직업 데이터를 기반으로 합니다. 방법론 자세히 보기

업데이트 이력

  • 2026년 9월 30일에 최초 게시되었습니다.
  • 최초 게시 이후 주요 업데이트가 없습니다.

태그

#arXiv#AI adoption#usage mandates#incentive design#sales#China

출처

  1. arxiv.org