← 비즈채널
전체

‘같은 값, 다른 성격’… OrcaRouter, GPT-6.1 Sol과 클로드 소넷 5.5 등재

‘같은 값, 다른 성격’… OrcaRouter, GPT-6.1 Sol과 클로드 소넷 5.5 등재
컨티뉴엄 AI(CONTINUUM AI)가 개발한 OpenAI 호환 LLM 게이트웨이인 OrcaRouter가 GPT-6.1 Sol과 클로드 소넷(Claude Sonnet) 5.5를 나란히 등재했다. 두 모델은 가격이 같지만 스펙과 성격이 갈린다. 나란히 놓고 보면 어느 쪽을 언제 쓸지가 숫자로 드러난다.

OrcaRouter 모델 페이지의 GPT-6.1 Sol 첫 화면. 모델 이름과 제공자, 가격 표기가 놓이고, 컨텍스트 길이와 최대 출력 토큰 수, 지원 기능이 이어진다
OrcaRouter 모델 페이지의 GPT-6.1 Sol 첫 화면. 모델 이름과 제공자, 가격 표기가 놓이고, 컨텍스트 길이와 최대 출력 토큰 수, 지원 기능이 이어진다
가격은 같다

두 모델 모두 입력 100만토큰당 2달러, 출력 100만토큰당 10달러다. 같아 보이는 가격표에도 차이가 하나 있다. GPT-6.1 Sol은 캐시 요금 구간이 두 개다. 27만2000토큰 이하에서는 캐시 읽기 0.1달러·쓰기 2.5달러가 적용되고, 그 위에서는 입력 4달러·출력 15달러·캐시 읽기 0.2달러·쓰기 5달러로 올라간다. Claude Sonnet 5.5에는 구간 키가 없다. 긴 문서를 다루는 팀에게는 이 차이가 청구서에서 갈린다.

컨텍스트와 출력

GPT-6.1 Sol의 컨텍스트는 105만토큰, 최대 출력은 12만8000토큰이다. Claude Sonnet 5.5는 컨텍스트 100만토큰, 최대 출력 12만8000토큰이다. 둘 다 텍스트와 이미지, 파일을 받고 비전·툴 호출·JSON·추론을 지원한다.

파라미터는 12개와 10개

Claude Sonnet 5.5가 지원하는 요청 파라미터는 12개, GPT-6.1 Sol은 10개다. 차이는 Sonnet 쪽에만 있는 세 가지에서 나온다. ‘stop’, ‘temperature’, ‘verbosity’를 지정할 수 있으며, Sol에는 이 세 개가 없다.

추론 강도 기본값이 다르다

두 모델 모두 추론이 항상 켜져 있고 다섯 단계의 노력 수준을 고른다. 기본값이 Sol은 medium, Sonnet은 high다. 같은 질문을 기본 설정으로 보내면 두 모델이 서로 다른 양의 추론을 한다는 뜻이며, 지연과 비용을 비교할 때 이 차이를 먼저 맞춰야 한다.

지능 지수는 Sonnet이 앞선다

Artificial Analysis 지능 지수는 Claude Sonnet 5.5가 56, GPT-6.1 Sol이 51.8이다. 표본 147개 기준 백분위로는 각각 95.92와 93.20이며, 순위로는 6위와 10위다. 차이는 4.2점이다.

개별 벤치마크도 갈린다. HLE는 Sol 52.9 대 Sonnet 55.0, 장문 컨텍스트 회수는 83 대 82.67, SciCode는 54.2 대 61, 터미널 벤치는 56.06 대 63.64다. 네 항목 가운데 셋에서 Sonnet이 앞선다.

지연과 처리량

중앙값 지연은 Claude Sonnet 5.5가 3929밀리초, GPT-6.1 Sol이 4615밀리초다. 초당 출력 토큰은 Sonnet 120.49, Sol 87.67이다. 같은 조건에서 Sonnet이 더 빠르게 답한다.

지연 측정 창은 두 모델이 다르다. Sol은 7일, Sonnet은 5일(10월 1일~5일)이다. 다만 같은 기간으로 놓고 비교한 수치는 아니다. Sol의 일별 기록에는 10월 4일 중앙값 1만밀리초가 찍혀 있어 상위 구간이 크게 흔들린 날이 있었다.

오류율은 큰 차이가 있다

같은 측정에서 GPT-6.1 Sol의 오류율은 2.41%, Claude Sonnet 5.5는 62.67%다. 이 숫자를 그대로 읽으면 안 된다. 오류율은 제공자 쪽 실패를 포함하며, 두 모델이 같은 트래픽 조건에서 측정됐다는 보장이 없다. 다만 차이가 26배이므로 Sonnet을 붙일 때는 재시도와 폴백 설정을 먼저 확인하는 편이 낫다.

가용성 데이터는 아직 없다

두 모델 모두 아직 가동률 측정값이 없다. 위 숫자들은 플레이그라운드 관측치며 가동률 통계가 아니다.

트래픽은 Sol이 압도적이다

7일 토큰 사용량은 GPT-6.1 Sol이 2억8064만1971, Claude Sonnet 5.5가 1060만4614다. 다만 컨티뉴엄 AI는 두 수치의 차이가 무엇을 뜻하는지는 해석하지 않았으며, 두 모델의 등재일이 하루 차이고, Sonnet의 지연 측정 창이 Sol보다 짧다는 사실만 밝혔다.

둘 다 플래그십은 아니다

두 모델 모두 새로 들어온 모델로 표시되지만 플래그십 자리는 아니다. GPT-6.1 Sol은 플래그십인 GPT-6 Astra보다 한 단계 아래 티어에 놓인다. Claude Sonnet 5.5도 마찬가지로 Anthropic의 플래그십 자리는 아니다.

무엇을 고를까

같은 가격이면 판단 기준은 세 가지다. 추론 품질과 툴 호출 정확도가 중요하면 지능 지수와 벤치마크가 앞선 Claude Sonnet 5.5가 맞다. 100만토큰을 넘는 긴 입력을 다루거나 출력 파라미터를 세밀하게 만질 필요가 없고 라우팅 물량이 큰 워크로드라면 GPT-6.1 Sol이 맞다. 두 조건이 겹치면 라우팅이 갈라놓는 편이 낫다.

주요 모델

OrcaRouter는 단일 API 키와 엔드포인트로 다음을 포함한 200개 이상의 모델을 제공한다.

·
OpenAI GPT-6.1 Sol
·
Anthropic Claude Sonnet 5.5
·
Anthropic Claude Opus 5.5
·
OpenAI GPT-6 Astra
·
DeepSeek V4.1 Flash
·
Z.ai GLM-5.3 Flash
·
Qwen 3.8 Max

참고

·
GPT-6.1 Sol 모델 페이지
·
Claude Sonnet 5.5 모델 페이지
·
OrcaRouter 모델 목록
·
OrcaRouter 요금

OrcaRouter 소개

OrcaRouter는 OpenAI 호환 LLM 게이트웨이로, 200개가 넘는 모델에 걸쳐 라우팅하며 약 40%의 비용 절감, 1밀리초 미만의 라우팅 오버헤드, 0%의 토큰 마크업을 제공한다. 자체 호스팅 에디션인 OrcaRouter-Lite는 MIT 라이선스로 제공된다.

CONTINUUM AI PTE. LTD. 소개

컨티뉴엄 AI(Continuum AI Pte. Ltd.)는 최첨단 AI를 개발자와 팀이 접근 가능하고 합리적인 비용으로 사용할 수 있도록 하기 위해 설립된 싱가포르 기반 기업이다. 단일 API 키와 엔드포인트를 통해 200개 이상의 선도적인 AI 모델에 대한 액세스를 제공하는 OpenAI 호환 AI Gateway인 ‘OrcaRouter’를 개발한 회사다. OrcaRouter는 약 40%의 비용 절감, 1ms 미만의 라우팅 오버헤드, 토큰 마크업 없음을 제공하며, MIT 라이선스로 출시된 자체 호스팅 버전(OrcaRouter-Lite)도 함께 제공한다.

공유하기
← 블로그 목록으로