중국 AI 경쟁사들이 약진하는 가운데 오픈AI와 앤트로픽, 가격 전쟁 돌입
미국 기업들, 조 달러 규모의 야심에 새로운 도전이 제기되자 더 저렴한 모델 출시

런던의 제이미 존과 클라라 머리
어제 게재
OpenAI와 앤스로픽을 비롯한 미국의 주요 AI 연구소들이 비용에 민감한 고객을 붙잡기 위해 더 저렴한 모델을 출시하고 있다. 이들 고객은 중국 경쟁업체의 저가 대안으로 갈아타고 있다.
AI 비용 상승으로 기업들이 사용을 줄이고 더 저렴한 모델을 찾는 가운데 가격 전쟁이 벌어지고 있다. 이에 힘입어 문샷과 딥시크를 비롯한 중국 개발업체들은 실리콘밸리에서 유럽에 이르기까지 사용자 기반을 넓히고 있다.
OpenAI는 최근 자사의 “가장 빠르고 저렴한 모델”인 GPT-5.6 Luna의 가격을 80% 인하한다고 밝혔다. 앤스로픽은 클로드 오퍼스 5를 출시하며, 이 시스템이 자사의 가장 성능이 뛰어난 모델인 Fable 5의 “절반 가격으로 제공되는 최첨단 지능”이라고 홍보하고 있다.
이러한 조치로 주요 미국 연구소의 모델에 대해 고객이 지불하는 가격은 7월 중순 이후 거의 4분의 1 하락했다고 Silicon Data의 토큰 가격 지수는 집계했다. 토큰은 언어 모델이 처리하는 데이터 단위로, 많은 고객의 요금을 산정하는 데 사용된다.
이번 인하 조치는 지금까지 성능을 놓고 치열하게 경쟁해 온 독자적인 ‘폐쇄형’ 모델을 개발하는 미국 AI 기업들의 전략 변화를 의미한다. 개발자가 자유롭게 내려받아 수정할 수 있는, 점점 더 성능이 향상되는 중국산 ‘오픈’ 모델도 가격 인하 압력을 키우는 데 일조했다. 이번 조치는 OpenAI와 Anthropic이 기업가치 1조 달러로 기업공개(IPO)를 추진하는 가운데, 투자자들이 AI 업계의 막대한 지출이 수익을 창출할 수 있다는 증거를 찾고 있는 상황에서 나왔다.
Anthropic과 OpenAI가 일부 기업 고객을 정액 구독에서 사용량 기반 과금으로 전환하면서 기업 AI 사용자들은 비용 압박에 직면하고 있다. 사용량 기반 과금에서는 기업이 소비한 컴퓨팅 자원에 따라 비용을 지불한다.
일부 기업은 요금 인상에 대응해 AI 사용량 상한을 설정하거나 더 저렴한 대안을 시험하고 있다. DoorDash와 Airbnb 같은 기업들은 비용을 억제하기 위해 중국산 모델을 사용하기 시작했다고 밝혔다.
이러한 변화는 중국 연구소들이 미국의 주요 모델과의 성능 격차를 좁힌 신제품을 잇달아 출시한 시기와 맞물렸다. 이에 따라 미국 기술 업계에서는 미국 개발업체들이 기술적 우위를 유지하기 위해 막대한 비용을 지출하는 와중에도 고객을 잃을 수 있다는 우려가 커지고 있다.

AI 연구소들은 서로 다른 성능과 가격의 다양한 모델을 제공하며, 모델 버전과 사용되는 ‘effort’ 설정에 따라 비용은 더욱 달라진다. 고객은 일반적으로 모델에 입력되는 데이터를 측정하는 입력 토큰과, 모델이 이에 대한 응답으로 생성하는 내용을 측정하는 출력 토큰에 대해 요금을 지불한다.
미국 연구소들의 최근 가격 인하는 중간급 제품에 적용됐으며, 중국 제품과의 경쟁력을 높였다. 예를 들어 OpenAI는 GPT-5.6 Luna의 가격을 입력 토큰 100만 개당 1달러에서 0.20달러로, 출력 토큰 100만 개당 6달러에서 1.20달러로 인하했다.
Anthropic은 입력 토큰 100만 개당 5달러, 출력 토큰 100만 개당 25달러에 Opus 5를 출시했다. 이는 Fable 5 모델 가격의 절반이다. 이 회사는 이번 주 Sonnet 5 모델의 가격을 인상하려던 계획도 철회했다. 당초 가격 인상은 9월부터 시행될 예정이었다.
그러나 헤드라인에 제시된 토큰 가격만으로는 AI 모델을 단순하게 비교하기 어렵다. 성능이 더 뛰어난 모델은 때때로 더 적은 토큰이나 더 적은 시도로 작업을 완료할 수 있기 때문이다. 따라서 토큰 가격만 보면 더 비싸 보이는 모델이 결과적으로는 비용이 더 적게 들 수도 있다.

또한 대부분은 서로 다른 ‘추론 강도’ 설정으로 작동할 수 있는데, 이는 질문에 답하는 데 사용되는 컴퓨팅 성능을 달리하며 작업 완료에 필요한 성능과 최종 비용 모두에 영향을 줄 수 있다.
수학, 과학, 코딩, 추론 등 분야에서 모델을 벤치마크하는 Artificial Analysis는 Anthropic의 Opus 5가 ‘중간’ 추론 강도에서 Moonshot의 Kimi K3가 ‘최대’ 추론 강도에서 보인 성능 및 작업당 비용과 유사한 결과를 냈다고 밝혔다. OpenAI의 GPT-5.6 Luna는 ‘최대’ 추론 강도에서 DeepSeek의 V4 Flash를 ‘최대’ 추론 강도에서 사용했을 때와 비슷한 성능을 보였지만, 작업당 비용은 두 배에 조금 못 미쳤다.
Anthropic과 OpenAI는 논평을 거부했다.
Anthropic과 가까운 한 관계자는 Opus 5의 가격이 주력 모델인 Fable 5보다 낮은 것은 스타트업의 “모델군이 구성되는 방식 때문이며, 경쟁사와는 아무런 관련이 없다”고 말했다.
2020년부터 대규모 언어 모델을 사용해 온 웹사이트 호스팅 업체 Hostinger의 AI 기술 책임자 Mantas Lukauskas는 최상위 모델들의 가격이 “보합 내지 상승세”라고 지적했다. 그는 최근의 가격 변화가 Anthropic과 OpenAI 같은 업체들이 가장 앞선 제품의 비용을 지킬 수 있는지를 보여주는 “첫 번째 진정한 시험”이라고 덧붙였다. “미국의 연구소들은 중간 가격대를 줄이고 최상위권을 방어하고 있습니다.”
현실에서 경쟁 우위를 창출하는 혁신의 문을 열다
