Harogo-documentatie
Harogo is een multi-model abonnementsdienst voor coding agents. Deze pagina beschrijft wat erbij zit, hoe je aan de slag gaat, welke modellen worden ondersteund en hoe de gebruikslimieten werken.
Inleiding
Harogo is een multi-model abonnementsdienst voor coding agents.
De kortingsprijs voor het abonnement is tijdelijk $4.90/maand, daarna $9.90/maand zodra de aanbieding afloopt. Er zijn momenteel 100 kortingsplekken beschikbaar — het aantal resterende plekken en de exacte definitieve prijs op de abonnementspagina zijn leidend.
Na het afsluiten van een abonnement krijg je via één toegangspunt toegang tot meerdere coding-modellen. Alle modellen delen hetzelfde Harogo-account, dezelfde API-key en hetzelfde abonnementsquotum — je hoeft je niet apart te registreren bij of saldo op te waarderen voor meerdere modelplatforms.
Waarom Harogo
Verschillende modellen blinken uit in verschillende coderingstaken. Rechtstreeks meerdere modelaanbieders gebruiken betekent meestal het beheren van meerdere accounts, API-keys, saldo's, ratelimieten en facturen.
Harogo ontsluit een reeks modellen die geschikt zijn voor coding agents via één dienst. Je kunt van model wisselen op basis van de taak, en elke aanroep wordt verrekend met hetzelfde gedeelde quotum.
De huidige modellen vallen ruwweg in de volgende groepen:
- Kimi K3, Claude Opus 5, GPT-5.6 Sol — geschikt voor grote codebases, taken met een lange context en zwaar redeneerwerk.
- Qwen3.8 Max, GLM-5.2, Claude Sonnet 5, GPT-5.6 Terra, MiniMax M3, DeepSeek V4 Pro — geschikt voor dagelijkse agent-coding, codegeneratie en debuggen.
- DeepSeek V4 Flash, Claude Haiku 4.5, GPT-5.6 Luna — geschikt voor hoogfrequente aanroepen, snelle reacties en kostenbewuste taken.
- Claude Fable 5 — geschikt voor langer lopende agent-workflows met meerdere stappen.
Deze indeling is slechts een vertrekpunt bij het kiezen van een model. De werkelijke resultaten hangen af van de specifieke taak, de context en hoe de tools worden gebruikt.
Aan de slag
- Log in bij Harogo en voltooi je abonnement.
- Maak een API-key aan in de console en kopieer deze.
- Stel de Base URL in op https://api.harogo.ai.
- Plak de API-key.
- Begin met gebruiken.
Let op
Bewaar je API-key veilig. Commit hem niet naar een openbare repository en deel hem met niemand anders.
Ondersteunde modellen
Momenteel ondersteunde modellen:
| Model | Model-ID | Het beste voor |
|---|---|---|
| GLM-5.2 | glm-5.2 | Langlopende taken, grote codebases en agent-coding |
| Qwen3.8 Max | qwen3.8-max-preview | Complexe redenering, visueel begrip en ingebouwde tool calls |
| Kimi K3 | kimi-k3 | Complexe coding, lange context, agenttaken |
| MiniMax M3 | minimax-m3 | Hoogfrequente coding, tool calls, lange context |
| DeepSeek V4 Pro | deepseek-v4-pro | Redenering en complexe codegeneratie |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | Snelle completions, hoogfrequente aanroepen en batchtaken |
| Claude Opus 5 | claude-opus-5 | Complexe agent-coding en zware technische taken |
| Claude Sonnet 5 | claude-sonnet-5 | Dagelijkse coding en algemene ontwikkeltaken |
| Claude Fable 5 | claude-fable-5 | Langer lopende, complexe agenttaken |
| Claude Haiku 4.5 | claude-haiku-4-5 | Snelle reacties, lichte taken en batchverwerking |
| GPT-5.6 Luna | gpt-5.6-luna | Hoogfrequente coding en lichte taken |
| GPT-5.6 Sol | gpt-5.6-sol | Zware codegeneratie, review en redenering |
| GPT-5.6 Terra | gpt-5.6-terra | Dagelijkse agent-coding en algemene taken |
De namen en model-ID's hierboven zijn de routeringsidentifiers die Harogo gebruikt. De modellijst, versies en beschikbaarheid kunnen wijzigen — raadpleeg wat daadwerkelijk in de console wordt getoond.
Gebruik & limieten
Harogo hanteert de volgende gebruikslimieten:
Alle drie de limieten gelden tegelijk. Elke modelaanroep put uit het gedeelde abonnementsquotum, en sommige modellen hebben een lagere maximale quotumlimiet — zie de prijstabel hieronder voor details.
Limieten zijn vastgesteld in dollarwaarde, niet in een vast aantal aanvragen. Het werkelijke aantal aanvragen dat je krijgt, hangt af van het model dat je gebruikt — goedkopere modellen leveren doorgaans meer aanvragen op en duurdere modellen minder.
Je kunt je huidige gebruik en resterende quotum bekijken in de Harogo-console.
Geschat aanvraagvolume
Onderstaande tabel geeft geschatte aantallen aanvragen op basis van typische Harogo-gebruikspatronen:
| Model | Per dag ($12) | Per week ($30) | Per maand ($60) |
|---|---|---|---|
| Kimi K3 | 1,040 | 2,600 | 5,200 |
| Claude Opus 5 | 300 | 750 | 1,500 |
| GPT-5.6 Sol | 1,130 | 2,820 | 5,630 |
| Qwen3.8 Max | 3,960 | 9,900 | 19,800 |
| GLM-5.2 | 7,920 | 19,790 | 39,580 |
| Claude Sonnet 5 | 2,350 | 5,880 | 11,760 |
| GPT-5.6 Terra | 2,640 | 6,600 | 13,200 |
| MiniMax M3 | 27,460 | 68,650 | 137,300 |
| DeepSeek V4 Pro | 34,250 | 85,640 | 171,270 |
| DeepSeek V4 Flash | 316,290 | 790,720 | 1,581,440 |
| Claude Haiku 4.5 | 18,050 | 45,110 | 90,230 |
| GPT-5.6 Luna | 2,060 | 5,150 | 10,300 |
| Claude Fable 5 | 220 | 560 | 1,110 |
Elke rij gaat ervan uit dat het quotum voor die periode vooral op het betreffende model wordt gebruikt. Bij het combineren van meerdere modellen putten deze samen uit hetzelfde gedeelde quotum, dus de aantallen aanvragen per model kunnen niet zomaar bij elkaar worden opgeteld.
De werkelijke aantallen aanvragen variëren met contextlengte, cache-hitrate, redeneerinspanning en outputlengte. Een coding agent kan voor één taak ook meerdere modelaanvragen doen, dus één aanvraag staat niet gelijk aan één volledige coding-taak.
Schattingsmethode
De schattingen zijn gebaseerd op de volgende typische aanvraagpatronen:
- GLM-5.2 — circa 700 inputtokens, 52,000 cache-readtokens en 150 outputtokens per aanvraag.
- Qwen3.8 Max — circa 8,731 inputtokens, 31,831 cache-readtokens en 2,029 outputtokens per aanvraag.
- Kimi K3 — circa 1,050 inputtokens, 76,500 cache-readtokens en 300 outputtokens per aanvraag.
- MiniMax M3 — circa 4,381 inputtokens, 28,768 cache-readtokens en 1,108 outputtokens per aanvraag.
- DeepSeek V4 Pro — circa 750 inputtokens, 82,000 cache-readtokens en 290 outputtokens per aanvraag.
- DeepSeek V4 Flash — circa 790 inputtokens, 68,000 cache-readtokens en 280 outputtokens per aanvraag.
- Claude Opus 5 — circa 580 inputtokens, 386,230 cache-readtokens, 19,476 cache-writetokens en 2,025 outputtokens per aanvraag.
- Claude Sonnet 5 — circa 159 inputtokens, 129,804 cache-readtokens, 6,260 cache-writetokens en 850 outputtokens per aanvraag.
- Claude Fable 5 — circa 399 inputtokens, 315,393 cache-readtokens, 12,907 cache-writetokens en 1,016 outputtokens per aanvraag.
- Claude Haiku 4.5 — circa 700 inputtokens, 52,000 cache-readtokens en 150 outputtokens per aanvraag.
- GPT-5.6 Luna — circa 45,726 inputtokens, 10,720 cache-readtokens en 1,905 outputtokens per aanvraag.
- GPT-5.6 Sol — circa 6,032 inputtokens, 112,138 cache-readtokens en 678 outputtokens per aanvraag.
- GPT-5.6 Terra — circa 6,825 inputtokens, 69,476 cache-readtokens en 734 outputtokens per aanvraag.
Qwen3.8 Max, MiniMax M3 en de Claude- en GPT-5.6-families gebruiken waargenomen gemiddelde aanvraagstructuren. De overige modellen gebruiken een typische coding-aanvraagstructuur. Claude Opus 5 verwijst momenteel naar werkelijke gebruiksdata van Opus-tier-modellen op hetzelfde prijsniveau.
Deze cijfers worden gebruikt om typisch gebruik te schatten en vormen geen toezegging voor een vast aantal aanvragen.
Modelprijzen & quotumlimieten
Onderstaande tabel toont de API-referentieprijs per 1 miljoen tokens voor elk model, samen met de quotumlimiet die Harogo voor dat model hanteert.
| Model | Model-ID | Input / 1M | Output / 1M | Cache read / 1M | Quotumlimiet |
|---|---|---|---|---|---|
| Kimi K3 | kimi-k3 | $3.00 | $15.00 | $0.30 | $15 |
| Claude Opus 5 | claude-opus-5 | $5.00 | $25.00 | $0.50 | $60 |
| GPT-5.6 Sol | gpt-5.6-sol | $5.00 | $30.00 | $0.50 | $60 |
| Qwen3.8 Max | qwen3.8-max-preview | $1.69 | $5.03 | $0.17 | $60 |
| GLM-5.2 | glm-5.2 | $1.40 | $4.40 | $0.26 | $60 |
| Claude Sonnet 5 | claude-sonnet-5 | $2.00 | $10.00 | $0.20 | $60 |
| GPT-5.6 Terra | gpt-5.6-terra | $2.50 | $15.00 | $0.25 | $60 |
| MiniMax M3 | minimax-m3 | $0.30 | $1.20 | $0.06 | $60 |
| DeepSeek V4 Pro | deepseek-v4-pro | $0.44 | $0.87 | — | $15 |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | $0.14 | $0.28 | — | $60 |
| Claude Haiku 4.5 | claude-haiku-4-5 | $1.00 | $5.00 | $0.10 | $60 |
| GPT-5.6 Luna | gpt-5.6-luna | $1.00 | $6.00 | $0.10 | $60 |
| Claude Fable 5 | claude-fable-5 | $10.00 | $50.00 | $1.00 | $60 |
"—" betekent dat dit item momenteel niet apart wordt gefactureerd, of niet van toepassing is op dat model.
De geschatte aantallen aanvragen worden berekend op basis van een combinatie van modelprijzen, typische aanvraagstructuur, werkelijke gebruiksdata en de quotumlimiet van elk model. Prijzen en beschikbaarheid van previewmodellen kunnen wijzigen.
Modelprijzen, quotumlimieten en geschatte aantallen aanvragen kunnen wijzigen naarmate de dienst zich ontwikkelt — raadpleeg de Harogo-console en de actuele versie van deze pagina voor de laatste details.