GPT-5.6 솔, 추론·에이전트 비용 20% 낮췄다

오픈AI(OpenAI)는 자사 모델 패밀리 ‘GPT‑5.6’의 추론·에이전트 운영 효율을 전면 최적화했다고 7월 29일 공개했다. 오픈AI는 대표 모델 ‘GPT‑5.6 솔(GPT‑5.6 Sol)’이 ‘인공 분석 코딩 에이전트 지수’에서 ‘클로드 펄블 5(Claude Fable 5)’보다 성능이 높으면서 비용은 절반 미만이라고 설명했다. 이어 ‘테라(Terra)’는 지능 벤치마크에서 GPT‑5.5와 비슷한 수준을 절반 가격에, ‘루나(Luna)’는 솔 대비 가격을 80% 낮췄다고 밝혔다. 오픈AI는 추론 단계에서 로드밸런싱·스페큘레이티브 디코딩·캐싱·커널 최적화 등을 통해 같은 하드웨어로 더 많은 출력을 내는 데 집중했다고 전했다. 또 에이전트용 ‘에이전틱 허니스(agentic harness)’에서 컨텍스트 부풀림과 도구 사용, 반복 작업을 더 잘 관리하도록 개선했다고 덧붙였다. 오픈AI는 GPT‑5.6 솔이 코드 ‘코덱스(Codex)’에서 프로덕션 트래픽 불균형을 찾아 조정하고, 커널을 자율적으로 다시 작성·최적화하는 등의 노력과 GPT‑5.6 솔의 광범위한 커널 개선으로 종단 비용을 20% 낮췄다고 밝혔다.

원문 보기 (openai.com)

RELATED ARTICLES