최첨단 AI 모델은 2/3 더 똑똑해졌지만, OpenRouter 토큰의 84%는 저가 모델을 선택합니다. 기업들이 성능보다 가격을 우선하는 이유와 AI 시장의 미래를 분석합니다.
최첨단 AI 모델의 진짜 문제: 성능 vs 가격
핵심 요약
- 최첨단 AI 모델은 작년 11월보다 2/3 더 똑똑해졌으며, 3일마다 새로운 모델이 출시되고 있습니다.
- 하지만 OpenRouter의 토큰 중 84%는 최첨단 모델이 아닙니다.
- 상위 6개 모델은 Claude Fable 5 가격의 2.5% 수준 으로 최첨단 성능의 약 77%를 제공합니다.
- 기업들은 성능보다 가격을 우선 하는 경향을 보이고 있습니다.
기하급수적으로 빨라지는 AI 모델 발전
최첨단 AI 모델의 성능 개선 속도가 가팔라지고 있습니다. 지난 11월 이후 이들은 2/3 더 뛰어난 성능을 보여주고 있으며, 이 광적인 개선 속도는 계속 유지되고 있습니다.
연구소들은 3일마다 두 개의 새로운 모델을 출시 하는 중이며, 매 분기마다 3~5 Artificial Analysis 포인트의 큰 폭의 상승이 나타나고 있습니다. 새로운 최첨단 모델이 출시될 때마다 지수는 단계적으로 상승하는 추세를 보이고 있습니다.
기업들이 저가 모델로 눈을 돌리는 이유
흥미로운 역설이 시장에서 벌어지고 있습니다. 성능은 계속 개선되는데, 기업들의 선택은 점점 더 저가 모델로 쏠리고 있습니다.
OpenRouter의 데이터에 따르면, 전체 토큰 중 84%가 최첨단 모델이 아닙니다. 실제로 사용자들이 대부분의 토큰을 생성하기 위해 선택하는 상위 6개 모델 을 살펴보면 더욱 놀라운 사실이 드러납니다.
이 6개 모델은:
- Claude Fable 5 가격의 2.5% 수준
- 최첨단 성능의 약 77%를 제공
- 혼합 가격으로 백만 토큰당 약 $0.50 (Fable 5는 $20)
시장의 가격 탄력성이 보여주는 현실
Ramp의 데이터는 구매자들의 선택이 얼마나 가격에 민감한지를 보여줍니다. Fable 5는 출시 한 달 후 백만 토큰당 약 $10의 가격대에도 불구하고, OpenAI의 가장 비싼 주력 모델 GPT-5.6 Sol보다 더 많은 매출을 창출했습니다.
더욱 주목할 점은, Fable 5가 훨씬 더 비쌌음에도 불구하고 7월에 GPT-5.6 Sol이 창출한 모델 기여 매출의 약 75%를 창출했다 는 것입니다. 이는 기업들이 성능 대비 가격을 어떻게 평가하는지를 명확히 보여줍니다.
최첨단 모델의 경제학이 변하고 있다
격차는 계속해서 좁혀지고 있습니다. 최고의 오픈 가중치 모델은 5월까지 선두 모델 점수의 80%에 도달했으며, 이는 1년 전의 48%에서 크게 상승한 수치입니다.
기업 애플리케이션 배포 현장에서는 더 작은 모델, 미세 조정된 모델, 오픈 소스를 기본 으로 선택하는 경향이 강합니다. 이들은 성능보다 가격을 우선시하는 다른 파레토 최적선 을 기준으로 최적화하고 있습니다.
만약 점유율 이동이 멈추고 '충분히 좋은' 성능이 계속 충분하다면, 최첨단 기술의 경제학은 근본적으로 변할 것입니다. 억 단위의 훈련 비용은 스스로를 감당하기 위해 점유율을 확보해야 하며, 그 기준은 시간이 지남에 따라 높아질 것입니다.
최첨단 모델이 여전히 필요한 영역
다만 모든 분야가 이 추세를 따르는 것은 아닙니다. 소프트웨어 엔지니어링 아키텍처와 보안 설계 는 가장 명확한 예시로, 이곳에서는 사용 가능한 최고의 모델이 그 높은 가격을 충분히 정당화합니다.
결론
AI 시장은 명확한 분기점에 서 있습니다. 최첨단 모델의 성능은 계속 개선되고 있지만, 기업들은 성능과 가격의 균형점을 찾고 있습니다. 이제 AI 도입의 핵심은 '최고 성능'이 아니라 '충분한 성능을 얼마나 저렴하게 얻을 수 있는가' 입니다. 이 변화는 AI 시장의 구조를 근본적으로 재편성할 것입니다.
Original source: Honestly, Who Buys SOTA?
powered by osmu.app