알레프 알파(Aleph Alpha)가 자체 개발한 벤치마크로 중국 AI 모델을 평가한 결과, 정치적으로 민감한 질문에 균형 잡힌 답변을 내놓은 비율이 17~41%에 그쳤다. IT 전문 매체 더디코더는 10월 4일 이 조사 결과를 보도했다.
민감 주제 답변, 17~41%만 균형 평가
알리바바(Alibaba)의 큐웬(Qwen), 딥시크(DeepSeek), 문샷AI(Moonshot)의 키미(Kimi) 등 3개 업체 모델이 시험 대상이었다. 조사에는 톈안먼, 대만, 신장 등 금기 주제 967개가 포함됐다. 알레프 알파의 자체 AI 평가 시스템은 답변 중 17~41%만 균형 잡힌 것으로 분류했다. 나머지는 중국 정부의 공식 입장을 되풀이하거나 질문을 비껴가고, 답변을 거부한 것으로 평가됐다.
이 결과는 중국의 AI 규정이 대외 공개 모델에 ‘사회주의 핵심 가치’를 반영하도록 요구하는 점과 맞닿아 있다고 더디코더는 전했다. 중앙유럽아시아연구소(CEIAS)의 앞선 연구에서도 인권, 야당, 감시 같은 표현이 등장하면 모델이 ‘내정 불간섭 원칙’이나 ‘인류 운명공동체’ 등 베이징의 공식 논리를 제시하는 경향이 나타났다. 중국을 직접 묻지 않은 질문에도 이런 관점이 섞일 수 있다는 것이다. 미국의 검열을 물었을 때 큐웬 3.6은 처음에는 균형 잡힌 답변을 내놓는 듯했지만, 끝부분에서 중국을 포함한 여러 나라가 사회 안정과 국가 안보를 위해 정보를 관리한다고 덧붙였다.
엔비디아 모델에서도 당론 성향 관찰
알레프 알파는 경쟁사 엔비디아(Nvidia)의 정부·기업 시장용 모델인 네모트론 캐스케이드 2에서도 당론을 따르는 유형의 답변이 17% 나타났다고 밝혔다. 이 회사는 전체 학습 사례 930만건 중 약 3500건이 딥시크와 큐웬을 이용해 생성된 점을 원인으로 지목했다. 대만의 국가 승인을 지지하는 연설문을 써 달라는 요청에 모델은 이를 거부하고 베이징의 ‘하나의 중국’ 원칙을 옹호하는 애국적 답변을 내놓은 사례도 제시됐다.
알레프 알파는 코히어(Cohere)와 나란히 정부용 ‘주권 AI’ 제공업체로 자사를 홍보하며, 중국 경쟁사와 자사 제품을 차별화할 사업상 이해관계가 있다. 따라서 중국 모델 평가는 회사가 설계한 벤치마크와 자체 평가 체계에 따른 결과라는 점도 함께 고려해야 한다. 더디코더는 언어 모델이 학습 데이터에 많이 반영된 관점이나 데이터의 의도적 선별에 따라 문화적·정치적 가치를 지닐 수 있다고 설명했다.
연구자들은 비슷한 AI 답변에 반복적으로 노출되면 수십억 이용자의 사고와 표현에 영향을 줄 수 있다고 경고한다. 미국에서도 일론 머스크가 AI 모델 그록(Grok)의 답변을 우파 성향으로 조정한 사례가 거론되는 등 정치적 방향성을 모델에 반영하려는 움직임이 있다. 일부 연구는 모델이 과학적 근거를 더 많이 활용하기 때문에 좌파 쪽으로 기울 수 있다고 본다. 유럽연합(EU)은 유럽 모델이 성능 경쟁력을 확보하고 폭넓게 채택되지 않으면 외국의 두 가치 체계 중 하나를 선택해야 할 수 있다는 지적도 나온다.