← 비즈채널
전체

점수는 스스로 매기지 않는다… OrcaRouter, 통합 리더보드 운영

점수는 스스로 매기지 않는다… OrcaRouter, 통합 리더보드 운영
CONTINUUM AI(컨티뉴엄 AI)가 개발한 OpenAI 호환 LLM 게이트웨이인 OrcaRouter가 모델 순위를 하나의 합산 점수로 계산하는 통합 리더보드를 운영한다고 밝혔다. 서로 다른 출처의 네 가지 증거를 고정된 공개 가중치로 합산하며, 벤더가 제출한 점수나 유료 배치는 반영하지 않는다는 것이 OrcaRouter의 설명이다.

OrcaRouter AI 모델 리더보드의 통합 랭킹. 2026년 9월 16일 업데이트 기준 1위 OpenAI GPT-5.4 Pro 82.0, 2위 GPT-5.6 Luna 77.8, 3위 DeepSeek V4.1 Flash 74.3
OrcaRouter AI 모델 리더보드의 통합 랭킹. 2026년 9월 16일 업데이트 기준 1위 OpenAI GPT-5.4 Pro 82.0, 2위 GPT-5.6 Luna 77.8, 3위 DeepSeek V4.1 Flash 74.3
네 가지 증거, 고정된 가중치

합산 점수는 네 계열의 증거로 이뤄진다. 인간 선호 40%, 독립 벤치마크 30%, OrcaRouter 자체 운영 증거 20%, 생태계 채택 10%다. 가중치는 고정돼 있고 공개돼 있으며, 편집 조정도 유료 배치도 없다.

인간 선호는 LMArena의 커뮤니티 Elo(텍스트·비전 아레나의 블라인드 쌍대 투표, CC-BY-4.0)를 쓴다. 독립 벤치마크는 Artificial Analysis의 Intelligence Index와 코딩·수학·GPQA Diamond·τ²-Bench, 그리고 여기에 실제 GitHub 이슈를 해결한 비율을 재는 SWE-bench Verified를 결합한다. 운영 증거는 OrcaRouter 자신의 블라인드 대결 승률과 게이트웨이 텔레메트리(성공률·지연·라우팅된 토큰량)다. 채택 지표는 OpenRouter가 공개한 토큰 점유율이다.

블라인드 대결: 익명 모델 둘, 한 표

리더보드의 20%는 OrcaRouter 사용자가 직접 만든다. 같은 프롬프트에 두 모델이 익명으로 답하고, 사용자가 더 나은 쪽에 투표한 뒤에야 어느 모델이었는지 공개되는 방식이다. 이 투표가 합산 점수의 운영 증거 항목에 반영된다.

가격과 지능을 같은 평면에 놓는다

리더보드는 모델별로 100만 토큰당 혼합 가격과 응답 지연, 신뢰도, 모멘텀을 함께 표시하고, 독립 지능 점수를 입력 가격에 대해 그린 분포도 제공한다. 상위권의 가격 차이는 순위 차이보다 크다. 2026년 9월 17일 기준 1위 모델의 혼합 가격은 100만 토큰당 165달러(입력 60달러·출력 270달러)인 반면 3위 모델은 0.38달러(입력 0.15달러·출력 0.6달러)다.

2026년 9월 17일 기준 상위 10

· 1위
OpenAI GPT-5.4 Pro - 합산 82.0
· 2위
OpenAI GPT-5.6 Luna - 77.8
· 3위
DeepSeek V4.1 Flash - 74.3
· 4위
OpenAI GPT-6 Astra - 73.7
· 5위
Anthropic Claude Opus 5 - 73.2
· 6위
Anthropic Claude Fable 5.1 - 73.0
· 7위
OpenAI GPT-5.6 Sol - 72.1
· 8위
Z.ai GLM 5.3 - 71.5
· 9위
Z.ai GLM 5.3 Flash - 70.4
· 10위
Google Gemini 3.8 Flash - 68.8

리더보드는 25개 모델을 싣고 있으며, 텍스트·코딩·비전·수학·추론·에이전트 여섯 개 분류로 나눠 볼 수 있다. 순위는 스냅샷마다 갱신되므로 위 순위와 점수는 2026년 9월 17일 기준 값이다.

누가 어떤 모델로 몰리는지도 함께 본다

리더보드는 모델별 순위와 함께 라우팅된 토큰을 연구소별로 집계해 보여준다. 2026년 9월 17일 기준 DeepSeek 63.0%, OpenAI 11.5%, Z.ai 11.0%, Obsidian 4.9%, 기타 9.6%다. 인기와 평판은 순위에 영향을 주지 않고 참고 지표로만 표시된다.

데이터를 가져갈 수 있다

전체 순위는 JSON과 CSV로 내려받을 수 있고, 공개 API로 질의할 수 있으며, 순위 변동은 RSS로 구독할 수 있다. 자사 사이트나 저장소에 순위 배지를 붙이는 기능도 제공한다. LMArena와 Artificial Analysis의 외부 데이터는 각 출처의 라이선스 조건에 따라 표기와 함께 사용한다.

주요 모델

OrcaRouter는 단일 API 키와 엔드포인트로 다음을 포함한 200개 이상의 모델을 제공한다.

·
OpenAI GPT-5.5
·
Anthropic Claude Fable 5.1
·
Google Gemini 3.8 Flash
·
DeepSeek V4.1 Flash
·
xAI Grok 4.6
·
Qwen 3.7 Max
·
Z.ai GLM 5.3

참고

·
OrcaRouter 통합 리더보드
·
OpenAI GPT-5.4 Pro
·
Anthropic Claude Opus 5
·
OrcaRouter 웹사이트

OrcaRouter 소개

OrcaRouter는 OpenAI 호환 LLM 게이트웨이로, 200개가 넘는 모델에 걸쳐 라우팅하며 약 40%의 비용 절감, 1ms 미만의 라우팅 오버헤드, 0%의 토큰 마크업을 제공한다. 자체 호스팅 에디션인 OrcaRouter-Lite는 MIT 라이선스로 제공된다.

CONTINUUM AI PTE LTD 소개

CONTINUUM AI(컨티뉴엄 AI)는 최첨단 AI를 개발자와 팀이 접근 가능하고 합리적인 비용으로 사용할 수 있도록 하기 위해 설립된 싱가포르 기반 기업이다. 단일 API 키와 엔드포인트를 통해 200개 이상의 선도적인 AI 모델에 대한 액세스를 제공하는 OpenAI 호환 AI 게이트웨인 OrcaRouter를 개발한 회사다. OrcaRouter는 약 40%의 비용 절감, 1ms 미만의 라우팅 오버헤드, 토큰 마크업 없음을 제공하며, MIT 라이선스로 출시된 자체 호스팅 버전(OrcaRouter-Lite)도 함께 제공한다.

연락처
공유하기
← 블로그 목록으로