오픈AI·구글·앤스로픽이 최근 프런티어 AI 모델을 잇달아 공개하며 성능보다 가격 대비 효율을 내세운 경쟁에 나섰습니다. GPT-5.6과 Gemini 4, 클로드 신형 모델의 발표가 겹치면서 최상위 모델 시장의 무게중심이 '가성비' 쪽으로 옮겨가고 있다는 업계 해석이 나옵니다.
오픈AI 공식 홈페이지에 따르면 회사는 GPT-5.6을 별도 행사 없이 홈페이지 게시물로 공개했습니다. 구글은 공식 블로그를 통해 Gemini 4 신형을 발표했고, 앤스로픽도 클로드의 새 모델 소식을 자사 채널로 전했습니다. 세 회사 모두 대형 발표 대신 자사 웹 채널 중심의 공개를 택한 점이 눈에 띕니다.
성능 지표만으로는 세 모델의 우열을 단정하기 어려운 구간이 남아 있습니다. 벤치마크 점수와 가격 체계의 세부 수치는 각사 게시물에 분산돼 있어, 모델별 실사용 비용을 같은 조건으로 비교한 독립 지표가 사실상 유일한 공통 잣대입니다.

출처: 조사 출처
인공지능 평가 사이트 아티피셜애널리시스(artificialanalysis.ai)에 따르면 최근 공개된 모델들은 가격 대비 지능 지표에서 전작 대비 상향 곡선을 그리는 흐름을 보였습니다. 같은 지능 구간에서 토큰 단가를 낮추는 방향의 조정이 여러 모델에서 관측됐다는 설명입니다. 다만 개별 수치는 사이트의 산정 방식에 따라 달라질 수 있습니다.
프런티어 등급 모델에서 가격 경쟁이 치열해진 것은 신규 진입자의 영향으로 읽힙니다. 중국 딥시크가 저비용·고성능 조합으로 시장에 파장을 일으킨 이후, 최상위 모델을 내놓는 회사들도 단가 방어에 무게를 두게 됐습니다.
다만 가격이 전 구간에서 내려간 것으로 보이는 것은 아닙니다. 일부 신형 모델은 추론 능력 강화를 이유로 장문 처리 시 총비용이 오히려 늘어날 수 있는 구조를 갖고 있어, 공식 발표의 효율 강조와 실제 청구액 사이에는 간극이 남습니다. 기업 고객 기준의 대량 사용 요금표는 아직 충분히 공개되지 않았습니다.
또 가성비 경쟁을 견인하는 독립 지표가 하나의 평가 방법론에 의존하고 있는 점도 한계로 꼽힙니다. 같은 모델을 두고 다른 벤치마크에서 다른 서열이 나오는 일이 반복되고 있어, 단일 지표의 순위를 곧장 시장 구도의 변화로 읽기는 어렵습니다.
세 회사의 발표가 겹친 시점과 가격 중심 메시지가 겹친 것은 대체로 사실에 부합하지만, 이것이 일회성 조정인지 장기 흐름의 시작인지는 아직 확인되지 않았습니다. 앞으로 몇 분기의 사용량·요금 데이터와 다른 평가 지표의 관측이 더 필요합니다.