Документация Harogo
Harogo — это мультимодельный сервис подписки для кодинг-агентов. На этой странице описано, что входит в подписку, как начать работу, какие модели поддерживаются и как работают лимиты использования.
Введение
Harogo — это мультимодельный сервис подписки для кодинг-агентов.
Цена подписки по сниженной ставке составляет $4.90/месяц на ограниченное время, затем $9.90/месяц после окончания предложения. Сейчас доступно 100 мест по сниженной цене — актуальными являются оставшееся число мест и точная итоговая цена, указанные на странице подписки.
После оформления подписки вы получаете доступ к нескольким моделям для разработки через единую точку входа. Все модели используют один и тот же аккаунт Harogo, API-ключ и квоту подписки — нет необходимости регистрироваться или пополнять баланс на нескольких платформах моделей по отдельности.
Почему Harogo
Разные модели лучше справляются с разными задачами по разработке. Использование нескольких провайдеров моделей напрямую обычно означает управление несколькими аккаунтами, API-ключами, балансами, лимитами запросов и счетами.
Harogo объединяет набор моделей, подходящих для кодинг-агентов, за одним сервисом. Вы можете переключать модели в зависимости от задачи, и каждый вызов оплачивается из одной и той же общей квоты.
Текущие модели условно делятся на такие группы:
- Kimi K3, Claude Opus 5, GPT-5.6 Sol — подходят для крупных кодовых баз, задач с длинным контекстом и рассуждений высокой сложности.
- Qwen3.8 Max, GLM-5.2, Claude Sonnet 5, GPT-5.6 Terra, MiniMax M3, DeepSeek V4 Pro — подходят для повседневного агентного программирования, генерации кода и отладки.
- DeepSeek V4 Flash, Claude Haiku 4.5, GPT-5.6 Luna — подходят для высокочастотных вызовов, быстрых ответов и задач, чувствительных к стоимости.
- Claude Fable 5 — подходит для более продолжительных, многошаговых агентных рабочих процессов.
Эти группировки — лишь отправная точка для выбора модели. Реальный результат зависит от конкретной задачи, контекста и способа использования инструментов.
Начало работы
- Войдите в Harogo и оформите подписку.
- Создайте и скопируйте API-ключ в консоли.
- Укажите Base URL: https://api.harogo.ai.
- Вставьте API-ключ.
- Начните использовать.
Примечание
Храните API-ключ в безопасности. Не публикуйте его в открытом репозитории и не передавайте другим лицам.
Поддерживаемые модели
Сейчас поддерживаются следующие модели:
| Модель | ID модели | Лучше всего подходит для |
|---|---|---|
| GLM-5.2 | glm-5.2 | Долгих задач, крупных кодовых баз и агентного программирования |
| Qwen3.8 Max | qwen3.8-max-preview | Сложных рассуждений, понимания изображений и встроенных вызовов инструментов |
| Kimi K3 | kimi-k3 | Сложного программирования, длинного контекста, агентных задач |
| MiniMax M3 | minimax-m3 | Высокочастотного программирования, вызовов инструментов, длинного контекста |
| DeepSeek V4 Pro | deepseek-v4-pro | Рассуждений и сложной генерации кода |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | Быстрых ответов, высокочастотных вызовов и пакетных задач |
| Claude Opus 5 | claude-opus-5 | Сложного агентного программирования и инженерных задач высокой сложности |
| Claude Sonnet 5 | claude-sonnet-5 | Повседневного программирования и общих задач разработки |
| Claude Fable 5 | claude-fable-5 | Более продолжительных, сложных агентных задач |
| Claude Haiku 4.5 | claude-haiku-4-5 | Быстрых ответов, лёгких задач и пакетной обработки |
| GPT-5.6 Luna | gpt-5.6-luna | Высокочастотного программирования и лёгких задач |
| GPT-5.6 Sol | gpt-5.6-sol | Сложной генерации кода, ревью и рассуждений |
| GPT-5.6 Terra | gpt-5.6-terra | Повседневного агентного программирования и общих задач |
Названия и ID моделей выше — это идентификаторы маршрутизации, которые использует Harogo. Список моделей, версии и доступность могут меняться — ориентируйтесь на то, что фактически показано в консоли.
Использование и лимиты
Harogo применяет следующие лимиты использования:
Все три лимита действуют одновременно. Каждый вызов модели расходует общую квоту подписки, а у некоторых моделей есть более низкий максимальный лимит использования — подробности смотрите в таблице цен ниже.
Лимиты заданы в долларовом эквиваленте, а не фиксированным числом запросов. Реальное число доступных вам запросов зависит от используемой модели — более дешёвые модели обычно дают больше запросов, а более дорогие — меньше.
Текущее использование и остаток квоты можно проверить в консоли Harogo.
Оценочный объём запросов
В таблице ниже приведены оценочные показатели числа запросов на основе типичных паттернов использования Harogo:
| Модель | В день ($12) | В неделю ($30) | В месяц ($60) |
|---|---|---|---|
| Kimi K3 | 1,040 | 2,600 | 5,200 |
| Claude Opus 5 | 300 | 750 | 1,500 |
| GPT-5.6 Sol | 1,130 | 2,820 | 5,630 |
| Qwen3.8 Max | 3,960 | 9,900 | 19,800 |
| GLM-5.2 | 7,920 | 19,790 | 39,580 |
| Claude Sonnet 5 | 2,350 | 5,880 | 11,760 |
| GPT-5.6 Terra | 2,640 | 6,600 | 13,200 |
| MiniMax M3 | 27,460 | 68,650 | 137,300 |
| DeepSeek V4 Pro | 34,250 | 85,640 | 171,270 |
| DeepSeek V4 Flash | 316,290 | 790,720 | 1,581,440 |
| Claude Haiku 4.5 | 18,050 | 45,110 | 90,230 |
| GPT-5.6 Luna | 2,060 | 5,150 | 10,300 |
| Claude Fable 5 | 220 | 560 | 1,110 |
Каждая строка предполагает, что квота за соответствующий период расходуется в основном на эту модель. При использовании нескольких моделей одновременно они расходуют одну и ту же общую квоту, поэтому число запросов по разным моделям нельзя просто сложить.
Реальное число запросов зависит от длины контекста, частоты попаданий в кэш, глубины рассуждений и длины вывода. Кодинг-агент может также отправлять несколько запросов к модели для одной задачи, поэтому один запрос не равен одной завершённой задаче разработки.
Методология оценки
Оценки основаны на следующих типичных паттернах запросов:
- GLM-5.2 — примерно 700 входных токенов, 52,000 токенов чтения из кэша и 150 выходных токенов на запрос.
- Qwen3.8 Max — примерно 8,731 входной токен, 31,831 токен чтения из кэша и 2,029 выходных токенов на запрос.
- Kimi K3 — примерно 1,050 входных токенов, 76,500 токенов чтения из кэша и 300 выходных токенов на запрос.
- MiniMax M3 — примерно 4,381 входной токен, 28,768 токенов чтения из кэша и 1,108 выходных токенов на запрос.
- DeepSeek V4 Pro — примерно 750 входных токенов, 82,000 токенов чтения из кэша и 290 выходных токенов на запрос.
- DeepSeek V4 Flash — примерно 790 входных токенов, 68,000 токенов чтения из кэша и 280 выходных токенов на запрос.
- Claude Opus 5 — примерно 580 входных токенов, 386,230 токенов чтения из кэша, 19,476 токенов записи в кэш и 2,025 выходных токенов на запрос.
- Claude Sonnet 5 — примерно 159 входных токенов, 129,804 токена чтения из кэша, 6,260 токенов записи в кэш и 850 выходных токенов на запрос.
- Claude Fable 5 — примерно 399 входных токенов, 315,393 токена чтения из кэша, 12,907 токенов записи в кэш и 1,016 выходных токенов на запрос.
- Claude Haiku 4.5 — примерно 700 входных токенов, 52,000 токенов чтения из кэша и 150 выходных токенов на запрос.
- GPT-5.6 Luna — примерно 45,726 входных токенов, 10,720 токенов чтения из кэша и 1,905 выходных токенов на запрос.
- GPT-5.6 Sol — примерно 6,032 входных токена, 112,138 токенов чтения из кэша и 678 выходных токенов на запрос.
- GPT-5.6 Terra — примерно 6,825 входных токенов, 69,476 токенов чтения из кэша и 734 выходных токена на запрос.
Для Qwen3.8 Max, MiniMax M3, а также семейств Claude и GPT-5.6 используются наблюдаемые средние структуры запросов. Остальные модели используют типичную структуру запроса для программирования. Claude Opus 5 в настоящее время опирается на реальные данные использования моделей уровня Opus при той же цене.
Эти цифры используются для оценки типичного использования и не являются обязательством по фиксированному числу запросов.
Цены и лимиты использования моделей
В таблице ниже указана справочная цена API каждой модели за 1 миллион токенов, а также лимит использования, который Harogo применяет к этой модели.
| Модель | ID модели | Ввод / 1М | Вывод / 1М | Чтение из кэша / 1М | Лимит использования |
|---|---|---|---|---|---|
| Kimi K3 | kimi-k3 | $3.00 | $15.00 | $0.30 | $15 |
| Claude Opus 5 | claude-opus-5 | $5.00 | $25.00 | $0.50 | $60 |
| GPT-5.6 Sol | gpt-5.6-sol | $5.00 | $30.00 | $0.50 | $60 |
| Qwen3.8 Max | qwen3.8-max-preview | $1.69 | $5.03 | $0.17 | $60 |
| GLM-5.2 | glm-5.2 | $1.40 | $4.40 | $0.26 | $60 |
| Claude Sonnet 5 | claude-sonnet-5 | $2.00 | $10.00 | $0.20 | $60 |
| GPT-5.6 Terra | gpt-5.6-terra | $2.50 | $15.00 | $0.25 | $60 |
| MiniMax M3 | minimax-m3 | $0.30 | $1.20 | $0.06 | $60 |
| DeepSeek V4 Pro | deepseek-v4-pro | $0.44 | $0.87 | — | $15 |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | $0.14 | $0.28 | — | $60 |
| Claude Haiku 4.5 | claude-haiku-4-5 | $1.00 | $5.00 | $0.10 | $60 |
| GPT-5.6 Luna | gpt-5.6-luna | $1.00 | $6.00 | $0.10 | $60 |
| Claude Fable 5 | claude-fable-5 | $10.00 | $50.00 | $1.00 | $60 |
«—» означает, что этот параметр в настоящее время не тарифицируется отдельно или не применяется к данной модели.
Оценочное число запросов рассчитывается на основе комбинации цен на модели, типичной структуры запросов, реальных данных использования и лимита использования каждой модели. Цены и доступность превью-моделей могут меняться.
Цены на модели, лимиты использования и оценочное число запросов могут меняться по мере развития сервиса — актуальные подробности смотрите в консоли Harogo и текущей версии этой страницы.