더 많은 사용량, 더 낮은 비용
Harogo는 코딩 에이전트를 위한 멀티 모델 구독 서비스입니다. 모델 제공업체마다 별도의 계정, API 키, 잔액, 요청 한도를 관리할 필요 없이 — 한 번 구독하고 API 키 하나로 작업에 맞는 모델을 자유롭게 전환하세요.
매일 $12 · 매주 $30 · 매월 $60 — 모든 모델이 공유하는 하나의 쿼터
동일한 $12/일 쿼터라도 모델에 따라 확보되는 요청 수는 크게 달라집니다 — 아래는 예상치를 높은 순으로 정리한 값입니다.
13개 모델 전체 내역 보기 →하나의 플랜. 하나의 쿼터. 13개 모델.
Harogo
코딩 에이전트 워크플로에 필요한 모든 것을 하나의 구독으로.
- 한정 기간 할인 — 종료 후에는 월 $9.90
- $12 / $30 / $60 공유 쿼터 — 일간·주간·월간
- GLM, Qwen, Kimi, MiniMax, DeepSeek, Claude, GPT 전반의 13개 모델
- 하나의 계정, 하나의 API 키, 하나의 Base URL
- 별도 가입 없이 작업별로 모델 전환
- 실시간 사용량 및 잔여 쿼터 대시보드
- 언제든지 해지 가능
선착순 할인 구독 슬롯 100개로 한정됩니다. 잔여 슬롯 수와 정산 가격은 구독 페이지에서 확인할 수 있습니다. 모델 목록과 가격은 변경될 수 있으니 콘솔에서 현재 상태를 확인하세요.
지금까지 사용된 할인 슬롯
예시일 뿐이며 실시간 카운터가 아닙니다. 실제 현재 잔여 슬롯은 구독 페이지에서 확인하세요.
각 모델 API를 개별 구독할 경우와 비교하면:
계정 스프레드시트 대신 하나의 구독
모델마다 강점을 보이는 코딩 작업이 다릅니다. 여러 제공업체를 직접 이용하면 보통 여러 개의 계정, 키, 잔액, 요청 한도, 청구서를 동시에 관리해야 합니다.
각 제공업체를 직접 구독하면
- 모델 제공업체마다 별도 계정
- 제공업체마다 저장·교체해야 하는 별도 API 키
- 충전하고 관리해야 하는 별도 잔액
- 추적해야 하는 별도 청구서와 요청 한도
Harogo를 사용하면
- 13개 모델 전체를 위한 하나의 Harogo 계정
- 모든 모델에 공통되는 하나의 API 키, 하나의 Base URL
- 모든 호출에 공통 적용되는 하나의 공유 쿼터
- 하나의 구독 가격, 하나의 대시보드
모델은 여전히 작업별로 직접 선택합니다 — Harogo가 자동으로 라우팅하지는 않습니다. 다만 여러 제공업체에 걸쳐 발생하는 계정, 키, 결제 관리 부담을 없애줄 뿐입니다.
강점별로 묶은 13개 모델
이 분류는 모델을 선택할 때 참고용입니다. 실제 결과는 작업, 컨텍스트, 도구 사용 방식에 따라 달라집니다. 제공 여부는 변경될 수 있으니 대시보드에서 현재 상태를 확인하세요.
대규모 코드베이스 & 고난도 추론
대규모 코드베이스, 긴 컨텍스트 작업, 고난도 추론에 적합합니다.
복잡한 코딩, 긴 컨텍스트, 에이전트 작업
복잡한 에이전트 코딩과 고난도 엔지니어링 작업
고난도 코드 생성, 리뷰, 추론
일상적인 에이전트 코딩
일상적인 에이전트 코딩, 코드 생성, 디버깅에 적합합니다.
복잡한 추론, 비전 이해, 내장 도구 호출
장기 실행 작업, 대규모 코드베이스, 에이전트 코딩
일상적인 코딩과 일반 개발 작업
일상적인 에이전트 코딩과 일반 작업
고빈도 코딩, 도구 호출, 긴 컨텍스트
추론과 복잡한 코드 생성
고빈도 & 비용 효율
고빈도 호출, 빠른 응답, 비용에 민감한 작업에 적합합니다.
빠른 완료, 고빈도 호출, 배치 작업
빠른 응답, 경량 작업, 배치 처리
고빈도 코딩과 경량 작업
장기 실행 에이전트 워크플로
장시간 실행되는 다단계 에이전트 워크플로에 적합합니다.
복잡하고 장시간 실행되는 에이전트 작업
Harogo는 독립적인 서비스이며 OpenAI, Anthropic, Zhipu AI, Alibaba, Moonshot AI, DeepSeek, MiniMax와 제휴, 보증 또는 후원 관계가 없습니다. 모델 제공 여부는 변경될 수 있으니 최신 목록은 대시보드에서 확인하세요.
쿼터를 오래 쓸 수 있다는 것, 그게 핵심입니다
한도는 고정된 요청 수가 아니라 USD 금액으로 설정되므로, 실제로 확보되는 요청 수는 전적으로 모델에 따라 달라집니다. 동일한 $12/일 기준으로 모델별 예상 요청 수를 정리했습니다.
막대는 넓은 범위를 한눈에 보기 쉽도록 로그 스케일을 사용합니다 — 정확한 값은 막대 길이가 아니라 오른쪽 숫자를 참고하세요. 예상치는 각 모델의 일반적인 요청 패턴(입력 길이, 캐시 적중률, 추론 강도, 출력 길이)을 가정한 것으로 고정된 요청 수를 보장하지 않습니다. 실제 수치는 프롬프트, 캐시된 컨텍스트, 추론 강도, 출력 길이에 따라 달라지며, 코딩 작업 하나가 여러 번의 모델 호출로 이루어질 수 있습니다.
모델은 직접 선택합니다 — 아래를 참고하세요
Harogo는 모델을 자동으로 라우팅하지 않습니다. 작업마다 직접 선택하며, 아래 네 가지 그룹이 빠른 판단 기준이 됩니다.
어려운 문제인가요?
대규모 코드베이스, 긴 컨텍스트, 정말로 어려운 추론 작업이라면 — Kimi K3, Claude Opus 5, GPT-5.6 Sol을 선택하세요.
일반적인 작업인가요?
일상적인 기능 개발, 코드 생성, 디버깅이라면 — GLM-5.2, Qwen3.8 Max, Claude Sonnet 5, GPT-5.6 Terra, MiniMax M3, DeepSeek V4 Pro를 선택하세요.
고빈도 호출인가요?
빠르고 반복적이며 비용에 민감한 호출이라면 — DeepSeek V4 Flash 0731, Claude Haiku 4.5, GPT-5.6 Luna가 쿼터를 가장 오래 유지해 줍니다.
장시간 에이전트 실행인가요?
긴 세션에 걸쳐 여러 단계를 거치는 워크플로라면 — Claude Fable 5가 이런 작업에 맞게 설계되었습니다.
모델 간 전환에는 추가 설정 비용이 들지 않습니다 — 동일한 계정, 동일한 키, 동일한 Base URL을 그대로 사용합니다. ID와 모델별 쿼터 상한은 전체 모델 목록에서 확인하세요.
이해하기 쉬운 사용 한도
세 가지 롤링 기간이 동시에 적용됩니다. 모든 모델 호출은 고정된 요청 수가 아니라 USD 금액으로 책정된 동일한 공유 쿼터에서 차감됩니다.
세 가지 한도는 모두 동시에 적용되며, 그중 하나라도 도달하면 해당 기간이 초기화될 때까지 추가 유료 사용이 일시 중지됩니다. 저렴한 모델은 프리미엄 모델보다 달러당 훨씬 많은 요청을 제공합니다 — 위의 요청량 내역을 참고하세요.
모델별 실제 수치 조회
모델을 선택하면 예상 요청 수와 토큰당 가격을 확인할 수 있습니다 — 추측이 아니라 현재 모델 테이블에서 바로 가져온 값입니다.
실제 개발 업무를 위해 설계
기능 출시
새로운 기능, 엔드포인트, 페이지, 데이터베이스 작업을 처음부터 끝까지 구현합니다.
고빈도로 디버깅하기
쿼터를 소진하지 않으면서 빠른 수정-테스트 루프를 여러 번 반복하세요.
어려운 변경사항 검토
출시 전 보안 검토와 예외 케이스 확인에 추론 중심 모델을 활용하세요.
장시간 에이전트 세션 실행
긴 실행 과정에서도 일관성을 유지해야 하는 다단계 워크플로입니다.
이미 사용 중인 코딩 환경에서 Harogo를 사용하세요
Harogo는 https://api.harogo.ai에서 OpenAI 호환 Base URL을 제공하므로, 커스텀 Base URL과 API 키를 설정할 수 있는 모든 클라이언트에서 사용할 수 있습니다.
명확한 규칙, 하나의 대시보드
모델 접근 안내
Harogo는 독립적인 멀티 모델 구독 서비스이며 이 페이지에 나열된 모델 제공업체와 제휴, 보증 또는 후원 관계가 없습니다. 여기 표시된 모델 이름과 ID는 Harogo가 사용하는 라우팅 식별자입니다 — 현재의 공식 목록은 console.harogo.ai에서 확인하세요.
궁금한 점, 명확하게 답변드립니다
하나의 키. 13개 모델. 실질적인 요청량.
하나의 구독, 하나의 공유 쿼터 — 여러 제공업체 계정을 따로 관리할 필요가 없습니다.
언제든지 해지 가능합니다. 사용 한도가 적용됩니다. 지금 할인 슬롯 100개를 이용할 수 있습니다.