윌로 케어(Willow Care Inc.)가 AI 받아쓰기 앱 윌로 보이스(Willow Voice)의 모델 학습 인프라를 운영하는 부담을 줄이기 위해 코어위브(CoreWeave)를 선택했다. IT 전문 매체 실리콘앵글(SiliconANGLE)는 10월 9일 윌로 케어가 컴퓨팅 자원뿐 아니라 현장 지원을 제공하는 코어위브를 택했다고 보도했다.
음성 인식에 소형 언어 모델 결합
윌로 보이스는 음성 인식과 언어 처리를 결합한 받아쓰기 앱이다. 윌로 케어 공동창업자 겸 최고기술책임자(CTO) 로런스 류(Lawrence Liu)는 코어위브의 강화학습 인프라를 이용하면 내부 작동 방식을 관리하는 데 신경 쓰지 않고 평가와 정렬에 집중할 수 있다고 설명했다. 류 CTO는 더큐브(TheCUBE)의 데이브 벨란테, 존 퍼리어와의 인터뷰에서 코어위브를 선택한 이유가 연산 자원만이 아니라고 말했다.
윌로 케어는 자체 음성 인식 모델을 미세 조정한다. 학습에는 커피숍에서 사용자가 속삭이는 경우처럼 조용한 실제 환경의 음성이 쓰인다. 류 CTO는 음성을 인식하는 것만으로 받아쓰기가 완성되는 것은 아니라고 설명했다. 윌로 보이스는 인식된 내용을 다시 처리하는 소형 대규모언어모델(LLM)을 두고, 입력된 말을 사용자가 실제로 쓸 문장에 가깝게 다듬고 형식도 정리한다.
받아쓰기 수요 늘며 추론 비중 확대
류 CTO에 따르면 현재 윌로 케어의 업무는 모델 학습에 주로 집중돼 있지만, 받아쓰기 수요가 늘면서 추론 작업이 더 빠르게 증가하고 있다. 모델을 훈련하는 단계뿐 아니라 이용자의 음성을 입력받아 결과를 내놓는 단계의 비중도 커지고 있다는 설명이다. 이는 추론 분야를 확대하려는 코어위브의 사업 방향과 맞닿아 있다고 실리콘앵글은 전했다. 다만 기사에는 추론 수요 증가율이나 윌로 케어의 이용자 수 등 구체적인 수치는 제시되지 않았다.
윌로 케어는 향후 2년 안에 키보드 없이 말만으로 컴퓨터가 사용자의 뜻을 이해하는 환경을 만들겠다는 목표를 제시했다. 이는 로런스 류 CTO가 인터뷰에서 밝힌 계획으로, 구체적인 제품 출시 일정이나 가격, 목표 달성을 위한 단계별 일정은 공개되지 않았다. 인터뷰는 더큐브가 진행한 ‘풀리 커넥티드’ 행사 관련 방송으로 소개됐으며, 실리콘앵글은 더큐브가 해당 행사의 유료 미디어 파트너라고 공개했다.