OrcaRouter 한국어 모델 페이지의 텐센트 Hy4 프리뷰 무료 등급 항목. 상단에 초록색 무료 배지가 도구·JSON·추론 지원 배지와 나란히 있고, 제공사만 표기되고 출시일은 나오지 않는다. 오른쪽 요약 상자와 아래 지표 영역에는 100만 토큰 컨텍스트와 최대 출력 64K, 최근 7일 기준 p50·p95 첫 토큰 지연 시간과 토큰 사용량이 보인다. 가격 영역에는 무료 표기와 요청 제한, 모델 사용 $0이 적혀 있다
싱가포르--(뉴스와이어)--컨티뉴엄 AI(CONTINUUM AI)가 개발한 OpenAI 호환 LLM 게이트웨이인 OrcaRouter가 텐센트의 전문가 혼합(MoE) 모델 Hy4 프리뷰를 무료 등급에 추가했다고 밝혔다. 유료 등급과 무료 등급은 100만 토큰 컨텍스트와 모델 설명을 공유하지만, 페이지에 공개되는 지표는 서로 다르다.
무료 등급 페이지에는 무엇이 비어 있나
두 등급을 나란히 두면 차이가 지표 쪽에 몰려 있다. 무료 등급은 검색 노출을 막는 ‘noindex’가 켜져 있고, 출시일 항목이 빈 문자열이며, 품질 점수는 0으로, 지원 엔드포인트 목록은 비어 있다. 유료 등급은 출시일 2026년 8월 28일, 품질 점수 8, 챗 완성과 Responses 두 엔드포인트를 명시한다.
모델 설명 문장은 두 페이지가 완전히 같다. 컨텍스트 창과 최대 출력 토큰 수도 같다. 무료 등급은 별도 가중치가 아니라 기본 모델을 가리키는 항목을 따로 갖고 있으며, 그 값은 유료 등급의 모델이다.
같은 가중치, 다른 숫자
7일 지연 시간 지표는 두 등급이 서로 다른 그림을 보여준다. 무료 등급은 출력 49.09tok/s, 오류율 2.12%다. 유료 등급은 출력 22.30tok/s, 오류율 0.00%다. 무료 쪽이 출력 속도에서 2.2배 앞서고, 오류율에서는 뒤진다.
트래픽도 갈린다. 무료 등급의 7일 토큰 사용량은 668만9762이고 유료 등급은 37만2382다. 약 18배 차이다. 무료 등급의 p95 지연 시간은 이틀 연속 1만 밀리초에 붙어 있는데, 유료 등급의 p95는 9월 29일 8198밀리초로 내려왔다.
무료 등급 요금이 $0.0000로 적히는 이유
무료 등급의 가격 항목에는 토큰당 단가가 없다. 통화와 과금 유형만 있고 백만 토큰당 입력·출력 가격 필드가 비어 있다. 같은 페이지의 질문·답변 항목은 이 등급이 ‘요청당 $0.0000’으로 책정되며 토큰 단위가 아니라 생성 단위로 청구된다고 적는다.
숫자만 읽으면 유료 등급보다 비싼 것처럼 보일 수 있는 문장이다. 실제로는 토큰당 과금이 없다는 뜻이며, 이 표기를 그대로 인용할 때는 앞뒤 문맥을 함께 옮겨야 한다. 이 문서는 두 등급의 단가 필드를 서로 비교하지 않는다.
모델 자체는 무엇인가
Hy4 프리뷰는 텐센트의 전문가 혼합 플래그십이다. 총 770B 파라미터 가운데 토큰당 49B가 활성화되고, 78개 레이어에 라우팅된 전문가 256개와 공유 전문가 1개가 배치된다. 컨텍스트 창은 100만 토큰, 최대 출력은 6만4000토큰이다.
텍스트 전용 모델이며 코딩 에이전트, 복잡한 도구 사용 워크플로, 생산성 작업을 겨냥한다. 추측 디코딩을 위한 다중 토큰 예측(MTP) 레이어를 기본으로 갖추고 있다고 설명한다.
추론 수준은 세 단계다
추론 강도는 high, low, none 세 가지로 설정할 수 있고 기본값은 high다. 텐센트는 temperature 0.9와 top_p 1.0을 권장한다. 지원 파라미터 목록에는 추론 노출, 추론 강도, 구조화 출력, 도구 선택 항목이 포함된다.
텐센트가 밝힌 내부 평가
텐센트는 전문가 163명이 엔지니어링 과제 203개를 블라인드로 평가한 결과를 함께 공개했다. 그 결과에서 Hy4 프리뷰는 평균 2.99를 기록했고, 같은 표에서 GLM 5.3은 2.92, Kimi K3는 2.94다.
이 수치는 텐센트가 자체적으로 수행한 내부 평가다. 제3자 재현 결과가 아니며, 평가자 수와 과제 수는 공개됐지만 실제 과제 내용과 평가 방식은 외부에 공개되지 않았다. 위치는 소프트웨어 엔지니어링, 사무 및 데이터 분석, 게임 프로토타이핑, 과학 연구 네 영역으로 제시됐다.
프리뷰가 스스로 밝힌 미흡한 점
텐센트는 이 릴리스가 프리뷰라는 점과 함께 알려진 미흡한 부분을 명시했다. 추론에 필요 이상으로 오래 걸리는 점, 그리고 자체 작업을 과도하게 검증하는 점이다. 정식 릴리스가 아니라는 표기와 함께 읽어야 하는 대목이다.
오픈소스 상위 5위라는 표현에 대해
무료 등급 추가와 함께 나온 회사 계정 게시물에는 Hy4 프리뷰가 이미 오픈소스 모델 상위 5위 안에 든다는 문장이 있다. 이 순위의 출처는 해당 게시물이며, 모델 페이지와 회사 웹사이트 어디에도 같은 순위를 뒷받침하는 표나 기준은 없다.
이 문서는 그 순위를 사실로 옮기지 않는다. 근거가 공개되지 않은 순위 주장은 인용할 때 출처를 밝히는 것으로 충분하지 않고, 검증 가능한 형태로 제시되지 않았기 때문이다.
같은 계열의 다른 배포판
텐센트 계열에서는 Hy3와 Hy3 무료 등급도 함께 제공된다. Hy3는 컨텍스트 26만2144토큰에 백만 토큰당 입력 0.18달러, 출력 0.59달러로 책정돼 있다. Hy4 프리뷰는 컨텍스트가 100만 토큰으로 넓어졌고, 유료 등급 기준 백만 토큰당 입력 0.834달러, 출력 2.501달러다.
컨텍스트가 약 4배 넓어지면서 출력 단가가 4배 이상 올라간 셈이다. 세대 교체가 모든 축에서 같은 방향으로 가지는 않는다는 점이 이 두 줄에서 읽힌다.
어느 등급을 고를 것인가
두 등급의 가중치와 컨텍스트가 같으므로 선택 기준은 가격과 안정성이다. 오류율 0.00%와 명시된 엔드포인트가 필요한 워크로드는 유료 등급이 맞다. 출력 속도와 넉넉한 무료 사용량이 우선이고 오류를 재시도로 흡수할 수 있는 실험이라면 무료 등급이 맞다.
무료 등급이 더 빠르다는 사실은 가중치가 다르기 때문이 아니다. 같은 모델에 대한 서빙 조건이 다르기 때문이며, 지연 시간 표본이 짧다는 점도 함께 감안해야 한다. 위 수치는 9월 28일과 29일 이틀치 일별 기록을 포함한 7일 창이다.
주요 모델
OrcaRouter는 단일 API 키와 엔드포인트로 다음을 포함한 200개 이상의 모델을 제공한다.
참고
OrcaRouter 소개
OrcaRouter는 OpenAI 호환 LLM 게이트웨이로, 200개가 넘는 모델에 걸쳐 라우팅하며 약 40%의 비용 절감, 1밀리초 미만의 라우팅 오버헤드, 0%의 토큰 마크업을 제공한다. 자체 호스팅 에디션인 OrcaRouter-Lite는 MIT 라이선스로 제공된다.
CONTINUUM AI PTE. LTD. 소개
Continuum AI Pte. Ltd.는 최첨단 AI를 개발자와 팀이 접근 가능하고 합리적인 비용으로 사용할 수 있도록 하기 위해 설립된 싱가포르 기반 기업이다. 단일 API 키와 엔드포인트를 통해 200개 이상의 선도적인 AI 모델에 대한 액세스를 제공하는 OpenAI 호환 AI Gateway인 OrcaRouter를 개발한 회사다. OrcaRouter는 약 40%의 비용 절감, 1밀리초 미만의 라우팅 오버헤드, 토큰 마크업 없음을 제공하며, MIT 라이선스로 출시된 자체 호스팅 버전(OrcaRouter-Lite)도 함께 제공한다.