성능만으론 안 된다…프런티어 AI까지 불붙은 '가성비' 경쟁
[파이낸셜뉴스] 글로벌 인공지능(AI) 경쟁 무게 축이 성능에서 가성비(가격 대비 성능)로 옮겨가고 있다. 글로벌 AI 개발사들이 최상위 모델의 가격을 내리거나, 같은 비용으로 더 많은 작업을 수행할 수 있도록 운용 효율을 높이는데 주력하고 있다.
AI를 둘러싼 속도조절론에도 가격 경쟁력을 전면에 세운 AI 신모델이 잇따라 출시되면서 AI 대중화 주도권 싸움도 불붙을 전망이다.
4일 업계에 따르면 글로벌 AI 개발사들은 AI 모델 성능 향상과 더불어 토큰 가격, 처리 속도, 캐시 비용, 실제 업무 수행 비용 등 가성비 모델을 잇따라 내놓으며, 가격 경쟁에 본격 나서고 있다.
구글이 선보인 최상위 AI 모델 '제미나이 4 아르곤'은 출시 프로모션 가격으로 입력 100만 토큰당 2달러, 출력 10달러를 제시했다. 동급 모델로 평가받는 앤스로픽의 최상위 모델 '클로드 오퍼스 5.5'의 입력 토큰 100만개당 4달러, 출력 토큰 100만개당 20달러와 비교할 때 절반 수준에 불과하다.
앤트로픽 클로드 오퍼스 5.5는 대부분의 업무에서 최상위 모델인 '클로드 페이블 5.1' 수준의 성능을 내면서도 전 모델인 '오퍼스 5'보다 운용 비용을 40% 낮췄다. 응용 프로그램 인터페이스(API) 가격은 입력 토큰 100만개당 4달러, 출력 토큰 100만개당 20달러다. 전 모델과 비교해 입력 토큰은 20%, 출력 토큰은 20% 낮다. 에이전트·코딩 작업에서 중요한 캐시 읽기 가격은 60% 인하했다. 중위 모델인 '소네트 5.5'는 전 모델 대비 속도를 30% 빨라졌는데도 작업당 필요한 토큰을 줄여 실제 비용을 최대 30% 낮췄다.
오픈AI도 지난 7월 'GPT-5.6'를 출시하며 가격 대비 성능을 전면에 세우고 있다. 가장 빠르고 가벼운 저가 모델인 루나 가격은 80%나 인하했고, 균형형 모델인 테라도 20% 낮췄다. 다만, 최고 성능 모델인 솔 가격은 유지했다.
글로벌 AI 개발사들이 가격 경쟁력에 주목하는 건 투자 대비 효과를 두고 AI 모델 도입에 신중한 기업들을 겨냥한 조치로 분석된다. 기업 고객에게는 모델의 절대적인 성능 대신 하나의 업무를 마치는데 투입되는 비용이 더 중요해지고 있기 때문이다. AI 에이전트가 코딩·리서치·문서작성 등 각종 업무를 수행하는 과정에서 모델을 반복해 호출하면서 토큰 사용료 부담이 급격히 커지고 있다. 즉, 최고 성능의 AI 모델을 개발하는 것 뿐 아니라 충분히 뛰어난 AI를 가장 낮은 비용으로 사용할 수 있도록 AI 개발 패러다임이 바뀌고 있다는 분석이다.
이에 AI 업계가 최고 성능 모델의 가격 인하 전략과 동시에 중간급 모델의 성능 향상, 저가·고속 모델 별도 출시 등 모델별로 가격·성능 세분화에 나선 것이다.
업계 관계자는 "AI를 많이 사용하는 기업일수록 실제 모델 가격 인하 수치보다 체감 효과가 훨씬 클 것"이라며 "기업에 제공하는 AI 모델 서비스 비용을 낮춤으로써 신규 고객사를 확보하고 자사 중심의 AI 생태계 구축을 가속화하려는 전략"이라고 말했다.
[email protected] 장민권 기자




