리걸온테크놀로지스(LegalOn Technologies)가 코덱스(Codex) 활용 방식을 조정해 AI 비용을 절반으로 낮추고 개발 속도를 유지했다고 오픈AI(OpenAI)가 소개했다. 오픈AI는 10월 8일 자사 웹사이트에 공개한 고객 사례에서 모델 선택과 사용 제한, 사업 단계별 예산 배분을 비용 절감 방안으로 제시했다.
업무별 AI 모델 선택해 비용 절감
리걸온은 개발자들이 처음에는 주력 모델인 GPT-5.5의 패스트 모드를 제한 없이 쓰도록 했다. 설계와 구현은 물론 일상 업무에도 적용하면서 사람과 AI가 맡을 일을 실험했고, 개발 전반에서 활용 범위를 넓혔다. 다만 고성능 모델을 제한 없이 계속 사용하면 연간 예산을 초과할 수 있다는 우려가 생겼다. 비용을 줄이려 일괄적으로 사용을 막을 경우 생산성 향상 효과가 떨어질 수 있어, 회사는 업무에 맞는 모델을 고르는 기준을 마련했다.
AI 기반 개발 CoE인 AID CoE가 모델을 시험·점검하고 선택 지침을 만들었으며, 관리자는 조사 결과를 팀에 공유했다. 이에 따라 개발자들은 과제의 복잡도와 개발 단계에 맞춰 모델을 선택하게 됐다. 간단한 구현부터 시작해 필요할 때 더 성능이 높은 모델로 옮기는 방식이다. 구체적으로 요구사항이 명확한 코드 구현에는 경량 모델 GPT-6 루나(Luna)를, 일반적인 설계와 데이터 분석, 문서 작성에는 GPT-6.1 솔(Sol)을 쓰도록 했다. 복잡한 분석과 아키텍처 설계, 에이전트 조율에는 가장 성능이 높은 GPT-6 아스트라(GPT-6 Astra)를 배정했다.
예산은 사업 단계별로 차등 배분
모델 선택과 함께 패스트 모드는 기본적으로 제한하고, 필요한 경우에만 개별 요청으로 사용하도록 바꿨다. 개발 속도가 떨어질 수 있다는 우려가 있었지만 팀 단위로 작업을 병렬 진행하는 방식 등을 활용해 성능을 유지하고 전환을 이어갔다. 부서·그룹·개인별 AI 지출 상한도 도입했으며, AID CoE가 사용량을 살피고 사업 수요에 따라 한도를 조정하도록 했다.
성숙 단계에 있는 기존 사업에는 비용 효율을 최대 약 20% 높이도록 요구한 반면, 출시 초기의 신규 사업에는 AI를 적극 활용할 수 있도록 예산을 넉넉히 배정했다. 리걸온의 시니어 엔지니어링 매니저 도키타케 유타(Yuta Tokitake)는 신규 사업에서는 비용 효율보다 사업 속도를 우선해 AI 활용을 늘리고, 결과적으로 사업 성장을 이끄는 것이 목표라고 설명했다. 사업의 성장 단계에 따라 AI 지출의 우선순위를 달리한 셈이다.
오픈AI가 소개한 결과에 따르면 모델 선택, 패스트 모드 제한, 사업별 예산 배분을 함께 적용한 뒤 추정 일일 비용은 GPT-5.5 사용 때와 비교해 약 65% 줄었다. 원문의 제목은 비용을 절반으로 낮췄다고 설명하고, 결과 요약에서는 GPT-6와 GPT-6.1 모델을 골라 쓰면서 추정 일일 비용이 65% 감소했다고 제시했다. 개발 성능을 유지하면서 지출을 통제하고, 성장시키려는 사업에 자원을 배분했다는 것이 회사 사례의 핵심이다. 다만 리걸온은 개발 속도나 AI 사용량만으로 투자 성과를 판단하기보다, 빨라진 개발이 고객에게 실제 가치로 이어지는지를 측정할 지표를 마련하는 과제도 제시했다.