OrcaRouter 한국어 모델 페이지의 GPT-6 Astra 항목. 상단에 신규·플래그십·추천 배지와 제공사가 보이고, 오른쪽 요약 상자에는 100만 토큰 컨텍스트와 최대 출력 128K, 입력과 출력의 형식, p50 첫 토큰 지연 시간이 적혀 있다. 아래 단가 영역에는 입력 100만 토큰당 $10.00과 출력 $50.00이, 이어서 7일 기준 p50·p95 지연 시간과 토큰 사용량이 놓인다. 본문 첫 단락에는 105만토큰 컨텍스트와 12만8000토큰 출력이 문장으로 적혀 있다 ·사진 제공: CONTINUUM AI PTE. LTD.
컨티뉴엄 AI의 OrcaRouter 게이트웨이에서 Anthropic Claude Opus 5.5와 OpenAI GPT-6 Astra는 컨텍스트 창과 품질 점수에서 비슷하지만, 단가 구조와 지원 엔드포인트, 공개된 벤치마크 항목 수에서는 차이가 있다.
핵심 요약
•컨텍스트 창과 최대 출력 동일
•단가 구조와 엔드포인트 차이
•공개 벤치마크 항목 수 달라
컨텍스트 창과 최대 출력은 두 모델 모두 동일하다: Opus 5.5는 100만 토큰을, Astra는 105만 토큰까지 지원한다. 두 모델의 품질 점수도 9로 표기된다.
단가는 큰 차이가 있다: Opus 5.5는 입력 4달러, 출력 20달러, 캐시 읽기 0.2달러, 캐시 쓰기 5달러로 일정하다. 반면 Astra는 27만2000토큰까지는 입력 10달러, 출력 50달러, 그 위는 입력 20달러, 출력 75달러로 구간이 두 가지다.
엔드포인트와 공개 벤치마크 항목 수도 다르다: Opus 5.5는 챗 완성과 Anthropic Messages 엔드포인트를 제공하며, Astra는 챗 완성과 Responses 엔드포인트를 제시한다. Astra에는 11개의 벤치마크 항목이 있지만 Opus 5.5에는 4개만 공개되어 있다.
지연 시간과 오류율은 각각 다르다: Opus 5.5는 응답 중앙값 4,534밀리초, 출력 속도 101.66tok/s, 오류율 4.66%를 보여주며, Astra는 중앙값 6689밀리초, 출력 속도 89.32tok/s, 오류율 1.73%다.
토큰 사용량은 Astra가 더 많다: 7일간의 토큰 사용량으로 Astra는 약 3배 많은 양을 사용한다.