몇 달 전 인상으로 모델을 고르는 개발자·기술 의사결정자를 위해: OpenRouter 2026년 7월 25일 랭킹은 벤치마크가 아니라 개발자가 실제 과금한 요청의 집계입니다. 샤오미 Mimo V2.5일 1.4조 Token으로 일일 1위, 중국 벤더 합계 약 46%(1년 전 2% 미만), 폐쇄형 flagship은 어려운 작업의 가격 결정권을 유지합니다. 본문은 모델·벤더·앱 3층 랭킹, 사용량 vs 품질 이중 시장, 코딩 Agent와 롤플레이 숨은 시장, 8월 5대 트렌드 예측, 6단계 계층 라우팅 실전 가이드를 다룹니다. 배경 자료: 6월 OpenRouter 랭킹 분석, OpenRouter API 연동 가이드.
01

OpenRouter 7월 랭킹: 샤오미 1위, 중국 모델 점유율 46% 돌파

OpenRouter는 세계 최대 규모의 중립 모델 라우팅 플랫폼으로, 매일 수십만 개발자의 실과금 요청을 중계합니다. 랭킹이 보여주는 것은 「누가 가장 똑똑한가」가 아니라 개발자가 지갑으로 선택한 실제 트래픽입니다. 사용량과 품질이 일치하지 않는 점이 본문의 출발점입니다.

2026년 7월 25일 일일 Token 사용량 Top 12:

순위모델벤더일일Token최근30일 누적
1Mimo V2.5샤오미1.4T31.2T
2DeepSeek V4 FlashDeepSeek943.9B23.6T
3Hy3텐센트590B23.4T
4Nemotron 3 Ultra 550B(무료)NVIDIA428.6B9T
5DeepSeek V4 ProDeepSeek413.7B11.6T
6GLM 5.2智谱 Z.ai316.7B13.3T
7MiniMax M3MiniMax262.5B15.1T
8Step 3.7 Flash阶跃星辰204.8B5.9T
9Kimi K3월지암면157.6B1.6T(신규)
10Ling 3.0 Flash蚂蚁 InclusionAI128.3B417.3B
11Gemini 3 Flash PreviewGoogle106.3B4T
12Claude Sonnet 5Anthropic99.5B3.6T

Top 12 중 중국 벤더 모델이 7석을 차지합니다. 벤더별 Token 점유율에서 중국 벤더(DeepSeek, 샤오미, 텐센트, 智谱, MiniMax, 월지암면, 알리) 합계 약 46%. 1년 전 2% 미만이었습니다. 미국 3강(OpenAI, Anthropic, Google) 합계는 연중 약 70%에서 30%–36%로 급락했습니다.

벤더Token 점유율(약)비고
DeepSeek16%–18%단일 벤더 최고 안정 1위
샤오미8%–18%Mimo V2.5 급등, 변동 최대
Anthropic10%–15%7/24 Opus 5 출시
텐센트8%–13%Hy3 강세
Google8%–13%Gemini 3 Flash

가격 차이가 핵심 동력입니다: DeepSeek V4 Flash 입력 약 $0.05–0.14/M, OpenAI GPT-5.5 약 $5/M최대 35배. 「월간 챔피언 모델」은 자주 바뀝니다: 2월 MiniMax M2.5, 4월 MiMo-V2-Pro, 7월 Mimo V2.5. 순간 스냅샷만 보면 안 되고, 상위권에 머무는 모델을 추적해야 합니다.

01

MMLU 점수만으로 선정: 랩 벤치마크와 프로덕션 지갑 투표는 종종 역상관하며, 월말 청구서가 예상과 정반대가 됩니다.

02

랭킹 변동 무시: 같은 모델도 하루 만에 순위가 바뀝니다(Mimo V2.5 7/24→7/25 순위 변동). 데이터 기준일을 반드시 명시하십시오.

03

사용량과 품질 혼동: 저가 오픈소스가 총량榜를 장악해도 복잡 추론·고위험 Agent 결정에 적합하지 않을 수 있습니다.

04

단일 모델 집착: 단일 Provider 하드코딩은 월간 챔피언 교체 후 곧 기술 부채가 됩니다.

05

API 온라인, 호스트 오프라인: 노트북을 닫으면 Agent 파이프라인이 중단되며, 랭킹이 정확해도 런타임은 구할 수 없습니다.

02

사용량 높음 ≠ 품질 높음: 폐쇄 flagship이 어려운 작업 가격권 유지

OpenRouter가 정렬하는 것은 Token 사용량이지 모델 품질이 아닙니다. 저렴하고 빠른 모델이 대량 트래픽 앱 뒤에 있으면 복잡 추론에서 평범해도榜单 상위에 올라갑니다.

작업 유형별 소비 금액 비율(Token량이 아닌)을 보면 전혀 다른 그림이 나옵니다:

작업 유형소비 금액 비율
일반 대화35.7%
Agent 워크플로30.4%
코드26.5%
데이터 처리7.5%

하지만 분류·복잡 추론 등 어려운 작업에서는 판이 바뀝니다. Claude Sonnet 4.6과 Claude Opus 4.7이 각 13.5% 소비 점유율로 공동 1위, GPT-5.5가 11.6%로 3위. 총량榜를 독점하는 저가 오픈소스는 거의 사라집니다.

시장은 자연스럽게 이중화합니다: 저가 중국 오픈소스가 대량·저문턱·허용 가능한 「跑量」 작업을 흡수하고, 폐쇄 flagship이 고가치·저허용 「어려운 작업」 가격 결정권을 유지합니다.

7월 24일 Anthropic이 출시한 Claude Opus 5가 대표 사례입니다. FrontierBench v0.1 43.3%(GPT-5.6 Sol 37.5% 상회), 가격 Opus 시리즈 $5/$25 per M(Fable 5 입력가의 절반) — 「비싸지만 그만한 가치」의 전형입니다. 자세히는 Opus 5와 Kimi K3 증류 논란 해설을 참고하십시오.

모델입력/M출력/M포지션
DeepSeek V4 Flash~$0.05–0.14~$0.24–0.28가성비 최강, Agentic Coding
Nemotron 3 Ultra$0.42(무료판 있음)$2.61미국계 풀 오픈, NVIDIA 생태계
GLM 5.2$0.45$3.31오픈 내 Opus급 계획 품질
Kimi K3~$3~$15최대급 오픈 웨이트(1.4TB)
Claude Opus 5$5(고속 $10)$25(고속 $50)폐쇄 flagship, 7월 최강 벤치
03

앱층 비밀: 코딩 Agent가 왕좌, 롤플레이는 보이지 않는 절반

모델층 랭킹은 「어떤 두뇌가 인기인가」를, 앱층 랭킹(openrouter.ai/apps)은 「그 두뇌가 실제로 무엇에 쓰이는가」를 보여줍니다:

순위유형점유율(약)
1Hermes Agent개인 Agent/CLI Agent~45%
2Kilo Code코딩 Agent~13%
3OpenClaw범용 Agent~9%
4Claude Code코딩 Agent~6%
5Descript콘텐츠 제작~4.5%
6piAgent~3.3%
7Lemonade동반/게임~2.1%(신규)
8ISEKAI ZERO롤플레이~2.0%(신규)
9Janitor AI롤플레이~1.8%(신규)
10Cline코딩 Agent(IDE 확장)~1.7%

Hermes Agent(Nous Research 오픈 자기반복 Agent)가 약 45% Token 점유율로 독주합니다. 코딩 Agent가榜单 대부분을 차지합니다. 흥미로운 계보: Cline → Roo Code → Kilo Code는 동일 코드 혈통의 세 번째 분기이며, 손자세대 Kilo Code의 트래픽이 조부 Cline을 넘어섰습니다 — 오픈 코딩 Agent 생태계의 반복 속도가 매우 빠르고 선점 우위는 견고하지 않습니다.

기업 AI 보도에 거의 안 나오는 롤플레이·동반형 앱도 주목할 가치가 있습니다 — Janitor AI, ISEKAI ZERO, SillyTavern, HammerAI 합계가 오픈 모델 트래픽의 상당 부분을 차지합니다. OpenRouter × a16z 《State of AI》 보고서에 따르면 창의 롤플레이 시나리오가 오픈 모델 총 사용량의 절반 이상을 만듭니다. 기업용 AI 보도만으로 시장을 판단하면 이 절반은 보이지 않습니다.

04

8월 트렌드 예측과 6단계 계층 라우팅 실전 가이드

8월 5대 트렌드 전망:

01

중국 오픈소스 모델 합계 점유율은 계속 상승하여 연내 50% 돌파 가능성이 높습니다 — 미국 벤더가 가격에서 대폭 양보하지 않는 한.

02

「월간 챔피언 모델」 자리는 계속 바뀔 것입니다 — 샤오미, DeepSeek, 텐센트, 智谱, MiniMax, 월지암면의 가격전은 둔화되지 않습니다.

03

Anthropic이 8월 Haiku급 저가 모델을 낼 가능성 — Opus 5는 2개월 내 네 번째 flagship입니다.

04

Kimi K3 1.4TB 웨이트는 2–4주 내 커뮤니티 양자화판이 나올 전망 — 중소 팀이 실제 쓸 수 있는 시점은 그 이후입니다.

05

보안·컴플라이언스가 새 선정 변수가 됩니다 — OpenAI 미공개 모델 샌드박스 탈출 사건이 지속되며, 기업 구매에서 「벤더 보안 실적」 비중이 눈에 띄게 상승합니다.

6단계 계층 라우팅 실전 가이드:

01

작업 유형별 계층 라우팅: 잡담·창작·롤플레이는 저가 오픈(DeepSeek V4 Flash, Mimo V2.5); 분류·복잡 추론·고위험 Agent 결정은 폐쇄 flagship(Claude Opus 5, GPT-5.5).

02

OpenRouter 통합 게이트웨이 연결: 단일 Key로 수백 모델 접근, openrouter.ai/rankings로 주간 추적. 참고 OpenRouter API 가이드.

03

코딩 작업은 DeepSeek V4 Flash와 GLM 5.2 우선 테스트: 전자는 가성비 최우, 후자는 오픈 내 Opus급 계획 품질; Claude Opus 5는 정말 막힌 복잡 단계에만.

04

청구 서킷 브레이커·일일 상한 설정: 백만 Token 단가×일일 호출량으로 임계값; Agent 배치는 기본 저가 라우트, 복잡 리팩터 시만 flagship 폴백.

05

「모델 벤더 보안 실적」을 선정 스코어카드에 포함: 자율 Agent에서는 권한을 더 엄격히 줄이고 보안 실적 우수 벤더 우선.

06

7×24 Agent 호스트 프로비저닝: Hermes Agent, Kilo Code, OpenClaw를 노트북에서 전용 클라우드 Mac으로: launchd 상시, Keychain 다중 API Key. 요금 페이지고객 센터로 구성 선정.

05

세 가지 핵심 데이터와 역할별 선정 결론

A

46% / 2%: 중국 벤더 합계 Token 점유율 약 46%, 1년 전 2% 미만 — 지난 12개월 가장 급격한 점유율 이동 중 하나.

B

35배 / 13.5%: DeepSeek V4 Flash와 GPT-5.5 가격 차 약 35배; 복잡 추론 소비 점유율에서 Claude Sonnet 4.6과 Opus 4.7 각 13.5% 공동 1위.

C

45% / 50%+: Hermes Agent 앱층 약 45%; 롤플레이 시나리오가 오픈 모델 총 사용량 절반 이상 — 기업 보도에서 보이지 않는 숨은 시장.

7월榜单에서 기억할 한 줄: capability(능력)와 popularity(사용량)가 갈라지기 시작했습니다. 중국 오픈소스는 가격으로 트래픽 절반을 가져가고, 미국 폐쇄 flagship은 어려운 작업 가격권과 보안 평판 방어선을 유지합니다. 독립 개발자가 OpenRouter를 기술 검증 샌드박스로 쓰는 것은 문제없지만, 국내 접속 평균 지연 약 180–250ms, 국내 세금계산서 미지원 — 프로덕션에서는 국내 규정 준수 중계안을 검토하십시오.

순수 API 라우팅은 Agent 호스트를 대체할 수 없습니다: 노트북 닫힘으로 연결 끊김, 다중 모델 Key 관리 혼란, 로컬 오픈 웨이트 배포에 96GB+ 통합 메모리 필요 — 각 경로에 숨은 비용이 있습니다. 7×24 다중 모델 Agent 파이프라인을 안정 운영하는 프로덕션에서는 KVMNODE 전용 Mac Mini 클라우드 대여가 일반적으로 최적입니다: Apple Silicon 네이티브 툴체인, 일/주/월 유연 주문. 자세히 요금 페이지, 주문 주문入口.

데이터 기준일: 2026년 7월 25일 · 출처: OpenRouter 공식 랭킹 및 공개 미러 사이트 · 구체 수치는 게시 시점 openrouter.ai/rankings 실시간 데이터를 확인하십시오