Документація Harogo
Harogo — це підписка на кілька моделей для агентів кодування. На цій сторінці описано, що входить у підписку, як почати роботу, які моделі підтримуються та як працюють ліміти використання.
Вступ
Harogo — це підписка на кілька моделей для агентів кодування.
Ціна підписки зі знижкою становить $4.90/місяць на обмежений час, а після завершення пропозиції — $9.90/місяць. Наразі відкрито 100 місць зі знижкою — актуальну кількість вільних місць і точну ціну розрахунку, вказану на сторінці підписки, слід вважати остаточною.
Після оформлення підписки ви отримуєте доступ до кількох моделей для кодування через єдину точку входу. Усі моделі використовують один і той самий акаунт Harogo, API-ключ і квоту підписки — не потрібно окремо реєструватися чи поповнювати баланс на кількох платформах моделей.
Чому Harogo
Різні моделі найкраще підходять для різних завдань кодування. Використання кількох постачальників моделей напряму зазвичай означає керування кількома акаунтами, API-ключами, балансами, лімітами запитів і рахунками.
Harogo об'єднує набір моделей, придатних для агентів кодування, в межах одного сервісу. Ви можете перемикати моделі залежно від завдання, а кожен виклик списується з однієї спільної квоти.
Наразі поточні моделі умовно поділяються на такі групи:
- Kimi K3, Claude Opus 5, GPT-5.6 Sol — підходять для великих кодових баз, завдань із довгим контекстом і складних міркувань.
- Qwen3.8 Max, GLM-5.2, Claude Sonnet 5, GPT-5.6 Terra, MiniMax M3, DeepSeek V4 Pro — підходять для повсякденного агентного кодування, генерації коду та налагодження.
- DeepSeek V4 Flash, Claude Haiku 4.5, GPT-5.6 Luna — підходять для високочастотних викликів, швидких відповідей і завдань, чутливих до вартості.
- Claude Fable 5 — підходить для тривалих багатоетапних агентних робочих процесів.
Цей поділ на групи — лише орієнтир для вибору моделі. Реальні результати залежать від конкретного завдання, контексту та способу використання інструментів.
Початок роботи
- Увійдіть у Harogo та оформіть підписку.
- Створіть і скопіюйте API-ключ у консолі.
- Вкажіть Base URL: https://api.harogo.ai.
- Вставте API-ключ.
- Почніть користуватися.
Примітка
Зберігайте свій API-ключ у безпеці. Не додавайте його до публічного репозиторію та не діліться ним з іншими.
Підтримувані моделі
Наразі підтримувані моделі:
| Модель | ID моделі | Найкраще підходить для |
|---|---|---|
| GLM-5.2 | glm-5.2 | Тривалі завдання, великі кодові бази та агентне кодування |
| Qwen3.8 Max | qwen3.8-max-preview | Складні міркування, розуміння зображень і вбудований виклик інструментів |
| Kimi K3 | kimi-k3 | Складне кодування, довгий контекст, агентні завдання |
| MiniMax M3 | minimax-m3 | Високочастотне кодування, виклик інструментів, довгий контекст |
| DeepSeek V4 Pro | deepseek-v4-pro | Міркування та складна генерація коду |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | Швидкі відповіді, високочастотні виклики та пакетні завдання |
| Claude Opus 5 | claude-opus-5 | Складне агентне кодування та важкі інженерні завдання |
| Claude Sonnet 5 | claude-sonnet-5 | Повсякденне кодування та загальні завдання розробки |
| Claude Fable 5 | claude-fable-5 | Тривалі, складні агентні завдання |
| Claude Haiku 4.5 | claude-haiku-4-5 | Швидкі відповіді, легкі завдання та пакетна обробка |
| GPT-5.6 Luna | gpt-5.6-luna | Високочастотне кодування та легкі завдання |
| GPT-5.6 Sol | gpt-5.6-sol | Складна генерація коду, рев'ю та міркування |
| GPT-5.6 Terra | gpt-5.6-terra | Повсякденне агентне кодування та загальні завдання |
Наведені вище назви та ID моделей — це маршрутні ідентифікатори, які використовує Harogo. Список моделей, версії та доступність можуть змінюватися — орієнтуйтеся на актуальні дані в консолі.
Використання та ліміти
Harogo застосовує такі ліміти використання:
Усі три ліміти діють одночасно. Кожен виклик моделі списується зі спільної квоти підписки, а деякі моделі мають нижчий максимальний ліміт використання — деталі дивіться в таблиці цін нижче.
Ліміти визначені у доларовому еквіваленті, а не фіксованою кількістю запитів. Реальна кількість доступних запитів залежить від використовуваної моделі — дешевші моделі зазвичай дозволяють більше запитів, а дорожчі — менше.
Поточне використання та залишок квоти можна перевірити в консолі Harogo.
Орієнтовний обсяг запитів
У таблиці нижче наведено орієнтовну кількість запитів на основі типових патернів використання Harogo:
| Модель | На день ($12) | На тиждень ($30) | На місяць ($60) |
|---|---|---|---|
| Kimi K3 | 1,040 | 2,600 | 5,200 |
| Claude Opus 5 | 300 | 750 | 1,500 |
| GPT-5.6 Sol | 1,130 | 2,820 | 5,630 |
| Qwen3.8 Max | 3,960 | 9,900 | 19,800 |
| GLM-5.2 | 7,920 | 19,790 | 39,580 |
| Claude Sonnet 5 | 2,350 | 5,880 | 11,760 |
| GPT-5.6 Terra | 2,640 | 6,600 | 13,200 |
| MiniMax M3 | 27,460 | 68,650 | 137,300 |
| DeepSeek V4 Pro | 34,250 | 85,640 | 171,270 |
| DeepSeek V4 Flash | 316,290 | 790,720 | 1,581,440 |
| Claude Haiku 4.5 | 18,050 | 45,110 | 90,230 |
| GPT-5.6 Luna | 2,060 | 5,150 | 10,300 |
| Claude Fable 5 | 220 | 560 | 1,110 |
У кожному рядку передбачається, що квота за відповідний період використовується переважно на цю модель. Якщо поєднувати кілька моделей, вони спільно списуються з однієї квоти, тож кількість запитів для різних моделей не можна просто підсумовувати.
Реальна кількість запитів залежить від довжини контексту, частоти влучань у кеш, рівня міркувань і довжини відповіді. Крім того, агент кодування може виконувати кілька запитів до моделі для одного завдання, тож один запит не дорівнює одному завершеному завданню кодування.
Методологія оцінки
Оцінки базуються на таких типових патернах запитів:
- GLM-5.2 — приблизно 700 вхідних токенів, 52,000 токенів читання з кешу та 150 вихідних токенів на запит.
- Qwen3.8 Max — приблизно 8,731 вхідних токенів, 31,831 токенів читання з кешу та 2,029 вихідних токенів на запит.
- Kimi K3 — приблизно 1,050 вхідних токенів, 76,500 токенів читання з кешу та 300 вихідних токенів на запит.
- MiniMax M3 — приблизно 4,381 вхідних токенів, 28,768 токенів читання з кешу та 1,108 вихідних токенів на запит.
- DeepSeek V4 Pro — приблизно 750 вхідних токенів, 82,000 токенів читання з кешу та 290 вихідних токенів на запит.
- DeepSeek V4 Flash — приблизно 790 вхідних токенів, 68,000 токенів читання з кешу та 280 вихідних токенів на запит.
- Claude Opus 5 — приблизно 580 вхідних токенів, 386,230 токенів читання з кешу, 19,476 токенів запису в кеш та 2,025 вихідних токенів на запит.
- Claude Sonnet 5 — приблизно 159 вхідних токенів, 129,804 токенів читання з кешу, 6,260 токенів запису в кеш та 850 вихідних токенів на запит.
- Claude Fable 5 — приблизно 399 вхідних токенів, 315,393 токенів читання з кешу, 12,907 токенів запису в кеш та 1,016 вихідних токенів на запит.
- Claude Haiku 4.5 — приблизно 700 вхідних токенів, 52,000 токенів читання з кешу та 150 вихідних токенів на запит.
- GPT-5.6 Luna — приблизно 45,726 вхідних токенів, 10,720 токенів читання з кешу та 1,905 вихідних токенів на запит.
- GPT-5.6 Sol — приблизно 6,032 вхідних токенів, 112,138 токенів читання з кешу та 678 вихідних токенів на запит.
- GPT-5.6 Terra — приблизно 6,825 вхідних токенів, 69,476 токенів читання з кешу та 734 вихідних токенів на запит.
Для Qwen3.8 Max, MiniMax M3, а також родин моделей Claude і GPT-5.6 використовуються спостережувані середні структури запитів. Для решти моделей використовується типова структура запиту для кодування. Claude Opus 5 наразі спирається на реальні дані використання моделей рівня Opus за тією самою ціною.
Ці цифри використовуються лише для оцінки типового використання і не є гарантією фіксованої кількості запитів.
Ціни на моделі та ліміти використання
У таблиці нижче наведено довідкову ціну API кожної моделі за 1 мільйон токенів, а також ліміт використання, який Harogo застосовує до цієї моделі.
| Модель | ID моделі | Вхід / 1М | Вихід / 1М | Читання з кешу / 1М | Ліміт використання |
|---|---|---|---|---|---|
| Kimi K3 | kimi-k3 | $3.00 | $15.00 | $0.30 | $15 |
| Claude Opus 5 | claude-opus-5 | $5.00 | $25.00 | $0.50 | $60 |
| GPT-5.6 Sol | gpt-5.6-sol | $5.00 | $30.00 | $0.50 | $60 |
| Qwen3.8 Max | qwen3.8-max-preview | $1.69 | $5.03 | $0.17 | $60 |
| GLM-5.2 | glm-5.2 | $1.40 | $4.40 | $0.26 | $60 |
| Claude Sonnet 5 | claude-sonnet-5 | $2.00 | $10.00 | $0.20 | $60 |
| GPT-5.6 Terra | gpt-5.6-terra | $2.50 | $15.00 | $0.25 | $60 |
| MiniMax M3 | minimax-m3 | $0.30 | $1.20 | $0.06 | $60 |
| DeepSeek V4 Pro | deepseek-v4-pro | $0.44 | $0.87 | — | $15 |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | $0.14 | $0.28 | — | $60 |
| Claude Haiku 4.5 | claude-haiku-4-5 | $1.00 | $5.00 | $0.10 | $60 |
| GPT-5.6 Luna | gpt-5.6-luna | $1.00 | $6.00 | $0.10 | $60 |
| Claude Fable 5 | claude-fable-5 | $10.00 | $50.00 | $1.00 | $60 |
«—» означає, що цей показник наразі не тарифікується окремо або не застосовується до цієї моделі.
Орієнтовна кількість запитів розраховується на основі поєднання цін на моделі, типової структури запиту, реальних даних використання та ліміту використання кожної моделі. Ціни та доступність попередніх (preview) версій моделей можуть змінюватися.
Ціни на моделі, ліміти використання та орієнтовна кількість запитів можуть змінюватися в міру розвитку сервісу — актуальні дані дивіться в консолі Harogo та в поточній версії цієї сторінки.