닌자테크AI(NinjaTech AI)가 대기업이 자체 클라우드 환경에서 AI 직원과 이를 구동하는 GPU를 함께 이용할 수 있는 연간 고정요금 상품 ‘닌자 엔터프라이즈’를 출시했다. 실리콘앵글은 9월 28일 이같이 보도했다.
AI 직원과 GPU를 고정요금에 묶어
닌자테크AI는 예측하기 어려운 비용이 기업의 AI 프로젝트를 시험 운영 이후 중단시키는 경향이 있다고 설명하며, 이를 겨냥해 상품을 설계했다. 토큰 사용량에 따라 요금을 내는 방식은 비용을 미리 가늠하기 어렵고, AI 에이전트가 장시간 작업할수록 토큰 비용이 계속 늘어날 수 있다는 설명이다. 바박 팔라반 닌자테크AI 최고경영자(CEO)는 대부분의 공급업체가 AI 이용량에 따라 요금을 매긴다며, 고정 요금이 시험 단계를 넘어 조직 전반으로 AI를 확산하는 데 도움이 될 수 있다고 말했다.
상품에는 소프트웨어뿐 아니라 에이전트 구동에 필요한 컴퓨팅 자원도 포함된다. 회사는 마이크로소프트(Microsoft)와 파이어웍스AI(Fireworks AI)가 제공하는 인프라 또는 아마존웹서비스(AWS)를 통해 GPU와 추론 용량을 확보하며, 고객별로 전용 용량을 예약한다고 설명했다. 따라서 고객은 서버를 직접 구매하거나 컴퓨팅 자원을 위해 별도 공급업체와 계약하지 않아도 된다. 닌자테크AI가 고객의 자체 클라우드에서 소프트웨어와 컴퓨팅 자원을 함께 제공하는 것은 이번이 처음이다.
모델 선택·보안 환경별 운영 방식
회사는 해당 인프라에서 오픈 웨이트 모델을 운영할 경우, 주요 AI 연구소의 프런티어 모델을 이용하는 비슷한 구성보다 전체 비용이 약 10분의 1 수준이라고 주장했다. 다만 고객은 작업에 더 적합하다고 판단하면 앤트로픽(Anthropic)이나 오픈AI(OpenAI)의 모델로 특정 업무 흐름을 전환할 수 있다. 이 비용 비교는 회사의 설명으로, 기사에는 산정 기준이나 개별 요금이 제시되지 않았다.
외부 네트워크에 연결할 수 없는 민감 업무를 위해서는 별도 운영 방식도 마련했다. 고객이 하드웨어를 제공하면 닌자테크AI가 외부와 차단된 환경에 설치되는 버전의 사용권을 제공한다. 회사는 두 방식 모두 고객 데이터를 한데 모으거나 외부 모델 학습에 사용하지 않는다고 밝혔다. AI 직원은 목표를 부여받으면 사람의 지속적인 지시 없이 작업을 수행하도록 설계됐으며, 직원들은 슬랙(Slack)이나 마이크로소프트 팀즈(Microsoft Teams)에서 에이전트와 소통한다.
상품은 AI 직원 100명·500명·1000명 단위로 구성되며 필요에 따라 추가할 수 있다. 도입 지원은 플랫폼 계약에 포함되고, 의료 분야 고객은 옵티멈 헬스케어 IT(Optimum Healthcare IT)가 맡는다. 그 밖의 고객은 인포시스(Infosys)가 지원한다. 인포시스는 8월 닌자테크AI에 투자하면서 최소 1년간 독점 전문 서비스 파트너로 활동하기로 했다. 2022년 팔라반 최고경영자가 공동 창업한 닌자테크AI는 상품을 출시해 현재 이용할 수 있도록 했으며, 고객은 연간 용량 계약 전에 범위를 정한 파일럿을 시작할 수 있다.