Harogo 문서
Harogo는 코딩 에이전트를 위한 멀티 모델 구독 서비스입니다. 이 페이지에서는 포함된 내용, 설정 방법, 지원되는 모델, 사용 한도가 작동하는 방식을 다룹니다.
소개
Harogo는 코딩 에이전트를 위한 멀티 모델 구독 서비스입니다.
할인 구독 가격은 한정 기간 동안 월 $4.90이며, 프로모션 종료 후에는 월 $9.90입니다. 현재 할인 구독 좌석 100개가 열려 있으며, 구독 페이지에 표시되는 잔여 좌석 수와 정확한 정산 가격이 공식 기준입니다.
구독 후에는 하나의 진입점을 통해 여러 코딩 모델에 접근할 수 있습니다. 모든 모델은 동일한 Harogo 계정, API 키, 구독 쿼터를 공유하므로, 여러 모델 플랫폼에 별도로 가입하거나 충전할 필요가 없습니다.
Harogo를 선택하는 이유
모델마다 뛰어난 코딩 작업 분야가 다릅니다. 여러 모델 제공업체를 직접 이용하면 보통 여러 개의 계정, API 키, 잔액, 요청 한도, 청구서를 관리해야 합니다.
Harogo는 코딩 에이전트에 적합한 모델들을 하나의 서비스 뒤에서 연결합니다. 작업에 따라 모델을 전환할 수 있으며, 모든 호출은 동일한 공유 쿼터에서 청구됩니다.
현재 모델은 대략 다음과 같은 그룹으로 나뉩니다:
- Kimi K3, Claude Opus 5, GPT-5.6 Sol — 대규모 코드베이스, 긴 컨텍스트 작업, 고난도 추론에 적합합니다.
- Qwen3.8 Max, GLM-5.2, Claude Sonnet 5, GPT-5.6 Terra, MiniMax M3, DeepSeek V4 Pro — 일상적인 에이전트 코딩, 코드 생성, 디버깅에 적합합니다.
- DeepSeek V4 Flash, Claude Haiku 4.5, GPT-5.6 Luna — 고빈도 호출, 빠른 응답, 비용에 민감한 작업에 적합합니다.
- Claude Fable 5 — 장시간 실행되는 다단계 에이전트 워크플로에 적합합니다.
이 분류는 모델을 선택하기 위한 출발점일 뿐입니다. 실제 결과는 구체적인 작업, 컨텍스트, 도구 사용 방식에 따라 달라집니다.
시작하기
- Harogo에 로그인하고 구독을 완료합니다.
- 콘솔에서 API 키를 생성하고 복사합니다.
- Base URL을 https://api.harogo.ai로 설정합니다.
- API 키를 붙여넣습니다.
- 사용을 시작합니다.
참고
API 키를 안전하게 보관하세요. 공개 저장소에 커밋하거나 다른 사람과 공유하지 마세요.
지원 모델
현재 지원되는 모델:
| 모델 | 모델 ID | 적합한 용도 |
|---|---|---|
| GLM-5.2 | glm-5.2 | 장기 실행 작업, 대규모 코드베이스, 에이전트 코딩 |
| Qwen3.8 Max | qwen3.8-max-preview | 복잡한 추론, 비전 이해, 내장 도구 호출 |
| Kimi K3 | kimi-k3 | 복잡한 코딩, 긴 컨텍스트, 에이전트 작업 |
| MiniMax M3 | minimax-m3 | 고빈도 코딩, 도구 호출, 긴 컨텍스트 |
| DeepSeek V4 Pro | deepseek-v4-pro | 추론과 복잡한 코드 생성 |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | 빠른 완료, 고빈도 호출, 배치 작업 |
| Claude Opus 5 | claude-opus-5 | 복잡한 에이전트 코딩과 고난도 엔지니어링 작업 |
| Claude Sonnet 5 | claude-sonnet-5 | 일상적인 코딩과 일반 개발 작업 |
| Claude Fable 5 | claude-fable-5 | 장시간 실행되는 복잡한 에이전트 작업 |
| Claude Haiku 4.5 | claude-haiku-4-5 | 빠른 응답, 경량 작업, 배치 처리 |
| GPT-5.6 Luna | gpt-5.6-luna | 고빈도 코딩과 경량 작업 |
| GPT-5.6 Sol | gpt-5.6-sol | 고난도 코드 생성, 리뷰, 추론 |
| GPT-5.6 Terra | gpt-5.6-terra | 일상적인 에이전트 코딩과 일반 작업 |
위의 이름과 모델 ID는 Harogo가 사용하는 라우팅 식별자입니다. 모델 목록, 버전, 제공 여부는 변경될 수 있으니 콘솔에 실제로 표시되는 내용을 참고하세요.
사용량 & 한도
Harogo는 다음과 같은 사용 한도를 적용합니다:
세 가지 한도는 모두 동시에 적용됩니다. 모든 모델 호출은 공유 구독 쿼터에서 차감되며, 일부 모델은 더 낮은 최대 사용 상한을 가집니다 — 자세한 내용은 아래 가격 표를 참고하세요.
한도는 고정된 요청 수가 아니라 달러 금액으로 정의됩니다. 실제로 얻을 수 있는 요청 수는 사용하는 모델에 따라 달라지며, 일반적으로 가격이 낮은 모델은 더 많은 요청을, 가격이 높은 모델은 더 적은 요청을 허용합니다.
현재 사용량과 잔여 쿼터는 Harogo 콘솔에서 확인할 수 있습니다.
예상 요청량
아래 표는 일반적인 Harogo 사용 패턴을 기준으로 한 예상 요청 수입니다:
| 모델 | 일간 ($12) | 주간 ($30) | 월간 ($60) |
|---|---|---|---|
| Kimi K3 | 1,040 | 2,600 | 5,200 |
| Claude Opus 5 | 300 | 750 | 1,500 |
| GPT-5.6 Sol | 1,130 | 2,820 | 5,630 |
| Qwen3.8 Max | 3,960 | 9,900 | 19,800 |
| GLM-5.2 | 7,920 | 19,790 | 39,580 |
| Claude Sonnet 5 | 2,350 | 5,880 | 11,760 |
| GPT-5.6 Terra | 2,640 | 6,600 | 13,200 |
| MiniMax M3 | 27,460 | 68,650 | 137,300 |
| DeepSeek V4 Pro | 34,250 | 85,640 | 171,270 |
| DeepSeek V4 Flash | 316,290 | 790,720 | 1,581,440 |
| Claude Haiku 4.5 | 18,050 | 45,110 | 90,230 |
| GPT-5.6 Luna | 2,060 | 5,150 | 10,300 |
| Claude Fable 5 | 220 | 560 | 1,110 |
각 행은 해당 기간의 쿼터가 주로 그 모델에 사용된다고 가정합니다. 여러 모델을 함께 사용하는 경우 동일한 공유 쿼터에서 함께 차감되므로, 모델별 요청 수를 단순히 합산할 수는 없습니다.
실제 요청 수는 컨텍스트 길이, 캐시 적중률, 추론 강도, 출력 길이에 따라 달라집니다. 코딩 에이전트는 하나의 작업에 대해 여러 번의 모델 요청을 보낼 수 있으므로, 요청 하나가 완전한 코딩 작업 하나를 의미하지는 않습니다.
추정 방법론
예상치는 다음과 같은 일반적인 요청 패턴을 기반으로 합니다:
- GLM-5.2 — 요청당 약 입력 토큰 700개, 캐시 읽기 토큰 52,000개, 출력 토큰 150개.
- Qwen3.8 Max — 요청당 약 입력 토큰 8,731개, 캐시 읽기 토큰 31,831개, 출력 토큰 2,029개.
- Kimi K3 — 요청당 약 입력 토큰 1,050개, 캐시 읽기 토큰 76,500개, 출력 토큰 300개.
- MiniMax M3 — 요청당 약 입력 토큰 4,381개, 캐시 읽기 토큰 28,768개, 출력 토큰 1,108개.
- DeepSeek V4 Pro — 요청당 약 입력 토큰 750개, 캐시 읽기 토큰 82,000개, 출력 토큰 290개.
- DeepSeek V4 Flash — 요청당 약 입력 토큰 790개, 캐시 읽기 토큰 68,000개, 출력 토큰 280개.
- Claude Opus 5 — 요청당 약 입력 토큰 580개, 캐시 읽기 토큰 386,230개, 캐시 쓰기 토큰 19,476개, 출력 토큰 2,025개.
- Claude Sonnet 5 — 요청당 약 입력 토큰 159개, 캐시 읽기 토큰 129,804개, 캐시 쓰기 토큰 6,260개, 출력 토큰 850개.
- Claude Fable 5 — 요청당 약 입력 토큰 399개, 캐시 읽기 토큰 315,393개, 캐시 쓰기 토큰 12,907개, 출력 토큰 1,016개.
- Claude Haiku 4.5 — 요청당 약 입력 토큰 700개, 캐시 읽기 토큰 52,000개, 출력 토큰 150개.
- GPT-5.6 Luna — 요청당 약 입력 토큰 45,726개, 캐시 읽기 토큰 10,720개, 출력 토큰 1,905개.
- GPT-5.6 Sol — 요청당 약 입력 토큰 6,032개, 캐시 읽기 토큰 112,138개, 출력 토큰 678개.
- GPT-5.6 Terra — 요청당 약 입력 토큰 6,825개, 캐시 읽기 토큰 69,476개, 출력 토큰 734개.
Qwen3.8 Max, MiniMax M3, Claude 및 GPT-5.6 계열은 관측된 평균 요청 구조를 사용합니다. 나머지 모델은 일반적인 코딩 요청 구조를 사용합니다. Claude Opus 5는 현재 동일 가격대의 Opus급 모델의 실제 사용 데이터를 참조합니다.
이 수치는 일반적인 사용량을 추정하기 위한 것이며 고정된 요청 수를 보장하지 않습니다.
모델 가격 & 사용 상한
아래 표는 각 모델의 100만 토큰당 API 참조 가격과 Harogo가 해당 모델에 적용하는 사용 상한을 보여줍니다.
| 모델 | 모델 ID | 입력 / 1M | 출력 / 1M | 캐시 읽기 / 1M | 사용 상한 |
|---|---|---|---|---|---|
| Kimi K3 | kimi-k3 | $3.00 | $15.00 | $0.30 | $15 |
| Claude Opus 5 | claude-opus-5 | $5.00 | $25.00 | $0.50 | $60 |
| GPT-5.6 Sol | gpt-5.6-sol | $5.00 | $30.00 | $0.50 | $60 |
| Qwen3.8 Max | qwen3.8-max-preview | $1.69 | $5.03 | $0.17 | $60 |
| GLM-5.2 | glm-5.2 | $1.40 | $4.40 | $0.26 | $60 |
| Claude Sonnet 5 | claude-sonnet-5 | $2.00 | $10.00 | $0.20 | $60 |
| GPT-5.6 Terra | gpt-5.6-terra | $2.50 | $15.00 | $0.25 | $60 |
| MiniMax M3 | minimax-m3 | $0.30 | $1.20 | $0.06 | $60 |
| DeepSeek V4 Pro | deepseek-v4-pro | $0.44 | $0.87 | — | $15 |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | $0.14 | $0.28 | — | $60 |
| Claude Haiku 4.5 | claude-haiku-4-5 | $1.00 | $5.00 | $0.10 | $60 |
| GPT-5.6 Luna | gpt-5.6-luna | $1.00 | $6.00 | $0.10 | $60 |
| Claude Fable 5 | claude-fable-5 | $10.00 | $50.00 | $1.00 | $60 |
"—"는 현재 별도로 청구되지 않거나 해당 모델에 적용되지 않는 항목을 의미합니다.
예상 요청 수는 모델 가격, 일반적인 요청 구조, 실제 사용 데이터, 각 모델의 사용 상한을 종합하여 계산됩니다. 프리뷰 모델의 가격과 제공 여부는 변경될 수 있습니다.
모델 가격, 사용 상한, 예상 요청 수는 서비스가 발전함에 따라 변경될 수 있습니다 — 최신 정보는 Harogo 콘솔과 이 페이지의 최신 버전을 참고하세요.