Документация на Harogo
Harogo е абонамент с множество модели за агенти за кодиране. Тази страница описва какво е включено, как да се настроите, кои модели се поддържат и как работят лимитите на използване.
Въведение
Harogo е абонамент с множество модели за агенти за кодиране.
Отстъпковата абонаментна цена е $4.90/месец за ограничено време, след което $9.90/месец след изтичане на предложението. В момента са налични 100 отстъпкови абонаментни места — оставащите места и точната крайна цена, показани на страницата за абонамент, са меродавни.
След абониране получавате достъп до множество модели за кодиране чрез една входна точка. Всички модели споделят един и същ акаунт в Harogo, API ключ и абонаментна квота — не е необходимо да се регистрирате или захранвате баланс в множество платформи за модели поотделно.
Защо Harogo
Различните модели се справят отлично с различни задачи за кодиране. Използването на няколко доставчика на модели директно обикновено означава управление на множество акаунти, API ключове, баланси, лимити на заявките и фактури.
Harogo обединява набор от модели, подходящи за агенти за кодиране, зад една услуга. Можете да сменяте моделите според задачата, а всяко извикване се таксува спрямо една и съща обща квота.
Настоящите модели се разделят приблизително в следните групи:
- Kimi K3, Claude Opus 5, GPT-5.6 Sol — подходящи за големи кодови бази, задачи с дълъг контекст и разсъждение с висока сложност.
- Qwen3.8 Max, GLM-5.2, Claude Sonnet 5, GPT-5.6 Terra, MiniMax M3, DeepSeek V4 Pro — подходящи за всекидневно агентно кодиране, генериране на код и дебъгване.
- DeepSeek V4 Flash, Claude Haiku 4.5, GPT-5.6 Luna — подходящи за извиквания с висока честота, бързи отговори и задачи, чувствителни към цената.
- Claude Fable 5 — подходящ за продължителни, многостъпкови агентни работни процеси.
Тези групи са само отправна точка при избора на модел. Реалните резултати зависят от конкретната задача, контекста и начина, по който се използват инструментите.
Първи стъпки
- Влезте в Harogo и завършете абонамента си.
- Създайте и копирайте API ключ в конзолата.
- Задайте Base URL на https://api.harogo.ai.
- Поставете API ключа.
- Започнете да го използвате.
Забележка
Пазете API ключа си на сигурно място. Не го качвайте в публично хранилище и не го споделяйте с никого.
Поддържани модели
Понастоящем поддържани модели:
| Модел | Идентификатор на модела | Най-подходящ за |
|---|---|---|
| GLM-5.2 | glm-5.2 | Продължителни задачи, големи кодови бази и агентно кодиране |
| Qwen3.8 Max | qwen3.8-max-preview | Сложно разсъждение, разбиране на изображения и вградени извиквания на инструменти |
| Kimi K3 | kimi-k3 | Сложно кодиране, дълъг контекст, агентни задачи |
| MiniMax M3 | minimax-m3 | Кодиране с висока честота, извиквания на инструменти, дълъг контекст |
| DeepSeek V4 Pro | deepseek-v4-pro | Разсъждение и сложно генериране на код |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | Бързи завършвания, извиквания с висока честота и пакетни задачи |
| Claude Opus 5 | claude-opus-5 | Сложно агентно кодиране и трудни инженерни задачи |
| Claude Sonnet 5 | claude-sonnet-5 | Всекидневно кодиране и общи задачи за разработка |
| Claude Fable 5 | claude-fable-5 | Продължителни, сложни агентни задачи |
| Claude Haiku 4.5 | claude-haiku-4-5 | Бързи отговори, леки задачи и пакетна обработка |
| GPT-5.6 Luna | gpt-5.6-luna | Кодиране с висока честота и леки задачи |
| GPT-5.6 Sol | gpt-5.6-sol | Сложно генериране на код, преглед и разсъждение |
| GPT-5.6 Terra | gpt-5.6-terra | Всекидневно агентно кодиране и общи задачи |
Имената и идентификаторите на моделите по-горе са маршрутизиращите идентификатори, които Harogo използва. Списъкът с модели, версиите и наличността могат да се променят — вижте какво реално е показано в конзолата.
Използване и лимити
Harogo прилага следните лимити на използване:
И трите лимита се прилагат едновременно. Всяко извикване на модел се тегли от общата абонаментна квота, а някои модели имат по-нисък максимален лимит на използване — вижте таблицата с цени по-долу за подробности.
Лимитите са дефинирани по парична стойност, а не като фиксиран брой заявки. Реалният брой заявки, който получавате, зависи от използвания модел — по-евтините модели обикновено позволяват повече заявки, а по-скъпите — по-малко.
Можете да проверите текущото си използване и оставащата квота в конзолата на Harogo.
Прогнозен обем заявки
Таблицата по-долу дава прогнозен брой заявки, базиран на типични модели на използване на Harogo:
| Модел | На ден ($12) | На седмица ($30) | На месец ($60) |
|---|---|---|---|
| Kimi K3 | 1,040 | 2,600 | 5,200 |
| Claude Opus 5 | 300 | 750 | 1,500 |
| GPT-5.6 Sol | 1,130 | 2,820 | 5,630 |
| Qwen3.8 Max | 3,960 | 9,900 | 19,800 |
| GLM-5.2 | 7,920 | 19,790 | 39,580 |
| Claude Sonnet 5 | 2,350 | 5,880 | 11,760 |
| GPT-5.6 Terra | 2,640 | 6,600 | 13,200 |
| MiniMax M3 | 27,460 | 68,650 | 137,300 |
| DeepSeek V4 Pro | 34,250 | 85,640 | 171,270 |
| DeepSeek V4 Flash | 316,290 | 790,720 | 1,581,440 |
| Claude Haiku 4.5 | 18,050 | 45,110 | 90,230 |
| GPT-5.6 Luna | 2,060 | 5,150 | 10,300 |
| Claude Fable 5 | 220 | 560 | 1,110 |
Всеки ред предполага, че квотата за съответния период се използва основно за конкретния модел. При комбиниране на няколко модела те се теглят заедно от една и съща обща квота, така че броят заявки при различните модели не може просто да се сумира.
Реалният брой заявки варира според дължината на контекста, процента попадения в кеша, интензивността на разсъждението и дължината на изхода. Агент за кодиране може също да отправи множество заявки към модела за една задача, така че една заявка не се равнява на една завършена задача за кодиране.
Методология на оценката
Оценките се базират на следните типични модели на заявки:
- GLM-5.2 — около 700 входни токена, 52,000 токена, четени от кеша, и 150 изходни токена на заявка.
- Qwen3.8 Max — около 8,731 входни токена, 31,831 токена, четени от кеша, и 2,029 изходни токена на заявка.
- Kimi K3 — около 1,050 входни токена, 76,500 токена, четени от кеша, и 300 изходни токена на заявка.
- MiniMax M3 — около 4,381 входни токена, 28,768 токена, четени от кеша, и 1,108 изходни токена на заявка.
- DeepSeek V4 Pro — около 750 входни токена, 82,000 токена, четени от кеша, и 290 изходни токена на заявка.
- DeepSeek V4 Flash — около 790 входни токена, 68,000 токена, четени от кеша, и 280 изходни токена на заявка.
- Claude Opus 5 — около 580 входни токена, 386,230 токена, четени от кеша, 19,476 токена, записани в кеша, и 2,025 изходни токена на заявка.
- Claude Sonnet 5 — около 159 входни токена, 129,804 токена, четени от кеша, 6,260 токена, записани в кеша, и 850 изходни токена на заявка.
- Claude Fable 5 — около 399 входни токена, 315,393 токена, четени от кеша, 12,907 токена, записани в кеша, и 1,016 изходни токена на заявка.
- Claude Haiku 4.5 — около 700 входни токена, 52,000 токена, четени от кеша, и 150 изходни токена на заявка.
- GPT-5.6 Luna — около 45,726 входни токена, 10,720 токена, четени от кеша, и 1,905 изходни токена на заявка.
- GPT-5.6 Sol — около 6,032 входни токена, 112,138 токена, четени от кеша, и 678 изходни токена на заявка.
- GPT-5.6 Terra — около 6,825 входни токена, 69,476 токена, четени от кеша, и 734 изходни токена на заявка.
Qwen3.8 Max, MiniMax M3 и семействата Claude и GPT-5.6 използват наблюдавани средни структури на заявките. Останалите модели използват типична структура на заявка за кодиране. Claude Opus 5 понастоящем се позовава на реални данни за използване от модели от нивото на Opus при същата ценова точка.
Тези стойности се използват за оценка на типичното използване и не представляват ангажимент за фиксиран брой заявки.
Цени на моделите и лимити на използване
Таблицата по-долу изброява референтната API цена на всеки модел на 1 милион токена, заедно с лимита на използване, който Harogo прилага за този модел.
| Модел | Идентификатор на модела | Вход / 1M | Изход / 1M | Четене от кеш / 1M | Лимит на използване |
|---|---|---|---|---|---|
| Kimi K3 | kimi-k3 | $3.00 | $15.00 | $0.30 | $15 |
| Claude Opus 5 | claude-opus-5 | $5.00 | $25.00 | $0.50 | $60 |
| GPT-5.6 Sol | gpt-5.6-sol | $5.00 | $30.00 | $0.50 | $60 |
| Qwen3.8 Max | qwen3.8-max-preview | $1.69 | $5.03 | $0.17 | $60 |
| GLM-5.2 | glm-5.2 | $1.40 | $4.40 | $0.26 | $60 |
| Claude Sonnet 5 | claude-sonnet-5 | $2.00 | $10.00 | $0.20 | $60 |
| GPT-5.6 Terra | gpt-5.6-terra | $2.50 | $15.00 | $0.25 | $60 |
| MiniMax M3 | minimax-m3 | $0.30 | $1.20 | $0.06 | $60 |
| DeepSeek V4 Pro | deepseek-v4-pro | $0.44 | $0.87 | — | $15 |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | $0.14 | $0.28 | — | $60 |
| Claude Haiku 4.5 | claude-haiku-4-5 | $1.00 | $5.00 | $0.10 | $60 |
| GPT-5.6 Luna | gpt-5.6-luna | $1.00 | $6.00 | $0.10 | $60 |
| Claude Fable 5 | claude-fable-5 | $10.00 | $50.00 | $1.00 | $60 |
„—" означава, че елементът не се таксува отделно в момента или не се прилага за този модел.
Прогнозният брой заявки се изчислява от комбинация от цените на моделите, типичната структура на заявките, реалните данни за използване и лимита на използване на всеки модел. Цените и наличността на предварителните (preview) модели могат да се променят.
Цените на моделите, лимитите на използване и прогнозният брой заявки могат да се променят с развитието на услугата — вижте конзолата на Harogo и актуалната версия на тази страница за най-новите подробности.