OrcaRouter 모델 페이지의 GPT-6.1 Sol 첫 화면. 모델 이름과 제공자, 가격 표기가 놓이고, 컨텍스트 길이와 최대 출력 토큰 수, 지원 기능이 이어진다
싱가포르--(뉴스와이어)--컨티뉴엄 AI(CONTINUUM AI)가 개발한 OpenAI 호환 LLM 게이트웨이인 OrcaRouter가 GPT-6.1 Sol과 클로드 소넷(Claude Sonnet) 5.5를 나란히 등재했다. 두 모델은 가격이 같지만 스펙과 성격이 갈린다. 나란히 놓고 보면 어느 쪽을 언제 쓸지가 숫자로 드러난다.
가격은 같다
두 모델 모두 입력 100만토큰당 2달러, 출력 100만토큰당 10달러다. 같아 보이는 가격표에도 차이가 하나 있다. GPT-6.1 Sol은 캐시 요금 구간이 두 개다. 27만2000토큰 이하에서는 캐시 읽기 0.1달러·쓰기 2.5달러가 적용되고, 그 위에서는 입력 4달러·출력 15달러·캐시 읽기 0.2달러·쓰기 5달러로 올라간다. Claude Sonnet 5.5에는 구간 키가 없다. 긴 문서를 다루는 팀에게는 이 차이가 청구서에서 갈린다.
컨텍스트와 출력
GPT-6.1 Sol의 컨텍스트는 105만토큰, 최대 출력은 12만8000토큰이다. Claude Sonnet 5.5는 컨텍스트 100만토큰, 최대 출력 12만8000토큰이다. 둘 다 텍스트와 이미지, 파일을 받고 비전·툴 호출·JSON·추론을 지원한다.
파라미터는 12개와 10개
Claude Sonnet 5.5가 지원하는 요청 파라미터는 12개, GPT-6.1 Sol은 10개다. 차이는 Sonnet 쪽에만 있는 세 가지에서 나온다. ‘stop’, ‘temperature’, ‘verbosity’를 지정할 수 있으며, Sol에는 이 세 개가 없다.
추론 강도 기본값이 다르다
두 모델 모두 추론이 항상 켜져 있고 다섯 단계의 노력 수준을 고른다. 기본값이 Sol은 medium, Sonnet은 high다. 같은 질문을 기본 설정으로 보내면 두 모델이 서로 다른 양의 추론을 한다는 뜻이며, 지연과 비용을 비교할 때 이 차이를 먼저 맞춰야 한다.
지능 지수는 Sonnet이 앞선다
Artificial Analysis 지능 지수는 Claude Sonnet 5.5가 56, GPT-6.1 Sol이 51.8이다. 표본 147개 기준 백분위로는 각각 95.92와 93.20이며, 순위로는 6위와 10위다. 차이는 4.2점이다.
개별 벤치마크도 갈린다. HLE는 Sol 52.9 대 Sonnet 55.0, 장문 컨텍스트 회수는 83 대 82.67, SciCode는 54.2 대 61, 터미널 벤치는 56.06 대 63.64다. 네 항목 가운데 셋에서 Sonnet이 앞선다.
지연과 처리량
중앙값 지연은 Claude Sonnet 5.5가 3929밀리초, GPT-6.1 Sol이 4615밀리초다. 초당 출력 토큰은 Sonnet 120.49, Sol 87.67이다. 같은 조건에서 Sonnet이 더 빠르게 답한다.
지연 측정 창은 두 모델이 다르다. Sol은 7일, Sonnet은 5일(10월 1일~5일)이다. 다만 같은 기간으로 놓고 비교한 수치는 아니다. Sol의 일별 기록에는 10월 4일 중앙값 1만밀리초가 찍혀 있어 상위 구간이 크게 흔들린 날이 있었다.
오류율은 큰 차이가 있다
같은 측정에서 GPT-6.1 Sol의 오류율은 2.41%, Claude Sonnet 5.5는 62.67%다. 이 숫자를 그대로 읽으면 안 된다. 오류율은 제공자 쪽 실패를 포함하며, 두 모델이 같은 트래픽 조건에서 측정됐다는 보장이 없다. 다만 차이가 26배이므로 Sonnet을 붙일 때는 재시도와 폴백 설정을 먼저 확인하는 편이 낫다.
가용성 데이터는 아직 없다
두 모델 모두 아직 가동률 측정값이 없다. 위 숫자들은 플레이그라운드 관측치며 가동률 통계가 아니다.
트래픽은 Sol이 압도적이다
7일 토큰 사용량은 GPT-6.1 Sol이 2억8064만1971, Claude Sonnet 5.5가 1060만4614다. 다만 컨티뉴엄 AI는 두 수치의 차이가 무엇을 뜻하는지는 해석하지 않았으며, 두 모델의 등재일이 하루 차이고, Sonnet의 지연 측정 창이 Sol보다 짧다는 사실만 밝혔다.
둘 다 플래그십은 아니다
두 모델 모두 새로 들어온 모델로 표시되지만 플래그십 자리는 아니다. GPT-6.1 Sol은 플래그십인 GPT-6 Astra보다 한 단계 아래 티어에 놓인다. Claude Sonnet 5.5도 마찬가지로 Anthropic의 플래그십 자리는 아니다.
무엇을 고를까
같은 가격이면 판단 기준은 세 가지다. 추론 품질과 툴 호출 정확도가 중요하면 지능 지수와 벤치마크가 앞선 Claude Sonnet 5.5가 맞다. 100만토큰을 넘는 긴 입력을 다루거나 출력 파라미터를 세밀하게 만질 필요가 없고 라우팅 물량이 큰 워크로드라면 GPT-6.1 Sol이 맞다. 두 조건이 겹치면 라우팅이 갈라놓는 편이 낫다.
주요 모델
OrcaRouter는 단일 API 키와 엔드포인트로 다음을 포함한 200개 이상의 모델을 제공한다.
참고
OrcaRouter 소개
OrcaRouter는 OpenAI 호환 LLM 게이트웨이로, 200개가 넘는 모델에 걸쳐 라우팅하며 약 40%의 비용 절감, 1밀리초 미만의 라우팅 오버헤드, 0%의 토큰 마크업을 제공한다. 자체 호스팅 에디션인 OrcaRouter-Lite는 MIT 라이선스로 제공된다.
CONTINUUM AI PTE. LTD. 소개
컨티뉴엄 AI(Continuum AI Pte. Ltd.)는 최첨단 AI를 개발자와 팀이 접근 가능하고 합리적인 비용으로 사용할 수 있도록 하기 위해 설립된 싱가포르 기반 기업이다. 단일 API 키와 엔드포인트를 통해 200개 이상의 선도적인 AI 모델에 대한 액세스를 제공하는 OpenAI 호환 AI Gateway인 ‘OrcaRouter’를 개발한 회사다. OrcaRouter는 약 40%의 비용 절감, 1ms 미만의 라우팅 오버헤드, 토큰 마크업 없음을 제공하며, MIT 라이선스로 출시된 자체 호스팅 버전(OrcaRouter-Lite)도 함께 제공한다.