Harogo Docs
Harogo ist ein Multi-Modell-Abo-Dienst für Coding-Agenten. Diese Seite beschreibt, was enthalten ist, wie Sie loslegen, welche Modelle unterstützt werden und wie die Nutzungslimits funktionieren.
Einführung
Harogo ist ein Multi-Modell-Abo-Dienst für Coding-Agenten.
Der vergünstigte Abo-Preis beträgt zeitlich begrenzt $4.90/Monat, danach $9.90/Monat, sobald das Angebot endet. Derzeit sind 100 vergünstigte Abo-Plätze verfügbar — maßgeblich sind die verbleibenden Plätze und der genaue Endpreis, die auf der Abo-Seite angezeigt werden.
Nach dem Abschluss des Abos erhalten Sie über einen einzigen Zugangspunkt Zugriff auf mehrere Coding-Modelle. Alle Modelle teilen sich dasselbe Harogo-Konto, denselben API-Key und dasselbe Abo-Kontingent — eine separate Registrierung oder Aufladung mehrerer Modellplattformen ist nicht nötig.
Warum Harogo
Unterschiedliche Modelle sind für unterschiedliche Coding-Aufgaben besonders gut geeignet. Wer mehrere Modellanbieter direkt nutzt, muss meist mehrere Konten, API-Keys, Guthaben, Rate-Limits und Rechnungen verwalten.
Harogo bündelt eine Reihe von Modellen, die sich für Coding-Agenten eignen, hinter einem einzigen Dienst. Sie können das Modell je nach Aufgabe wechseln, und jeder Aufruf wird gegen dasselbe gemeinsame Kontingent abgerechnet.
Die aktuellen Modelle lassen sich grob in folgende Gruppen einteilen:
- Kimi K3, Claude Opus 5, GPT-5.6 Sol — geeignet für große Codebasen, Aufgaben mit langem Kontext und anspruchsvolles Reasoning.
- Qwen3.8 Max, GLM-5.2, Claude Sonnet 5, GPT-5.6 Terra, MiniMax M3, DeepSeek V4 Pro — geeignet für alltägliches Agent-Coding, Codegenerierung und Debugging.
- DeepSeek V4 Flash, Claude Haiku 4.5, GPT-5.6 Luna — geeignet für hochfrequente Aufrufe, schnelle Antworten und kostensensitive Aufgaben.
- Claude Fable 5 — geeignet für länger laufende, mehrstufige Agent-Workflows.
Diese Gruppierungen sind nur ein Ausgangspunkt für die Modellwahl. Die tatsächlichen Ergebnisse hängen von der konkreten Aufgabe, dem Kontext und der Art der Tool-Nutzung ab.
Erste Schritte
- Bei Harogo anmelden und das Abo abschließen.
- In der Konsole einen API-Key erstellen und kopieren.
- Die Base-URL auf https://api.harogo.ai setzen.
- Den API-Key einfügen.
- Loslegen.
Hinweis
Bewahren Sie Ihren API-Key sicher auf. Committen Sie ihn nicht in ein öffentliches Repository und geben Sie ihn nicht an andere weiter.
Unterstützte Modelle
Derzeit unterstützte Modelle:
| Modell | Modell-ID | Am besten geeignet für |
|---|---|---|
| GLM-5.2 | glm-5.2 | Langlaufende Aufgaben, große Codebasen und Agent-Coding |
| Qwen3.8 Max | qwen3.8-max-preview | Komplexes Reasoning, Bildverständnis und integrierte Tool-Aufrufe |
| Kimi K3 | kimi-k3 | Komplexes Coding, langer Kontext, Agent-Aufgaben |
| MiniMax M3 | minimax-m3 | Hochfrequentes Coding, Tool-Aufrufe, langer Kontext |
| DeepSeek V4 Pro | deepseek-v4-pro | Reasoning und komplexe Codegenerierung |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | Schnelle Completions, hochfrequente Aufrufe und Batch-Aufgaben |
| Claude Opus 5 | claude-opus-5 | Komplexes Agent-Coding und anspruchsvolle Engineering-Aufgaben |
| Claude Sonnet 5 | claude-sonnet-5 | Alltägliches Coding und allgemeine Entwicklungsaufgaben |
| Claude Fable 5 | claude-fable-5 | Länger laufende, komplexe Agent-Aufgaben |
| Claude Haiku 4.5 | claude-haiku-4-5 | Schnelle Antworten, leichte Aufgaben und Batch-Verarbeitung |
| GPT-5.6 Luna | gpt-5.6-luna | Hochfrequentes Coding und leichte Aufgaben |
| GPT-5.6 Sol | gpt-5.6-sol | Anspruchsvolle Codegenerierung, Review und Reasoning |
| GPT-5.6 Terra | gpt-5.6-terra | Alltägliches Agent-Coding und allgemeine Aufgaben |
Die obigen Namen und Modell-IDs sind die von Harogo verwendeten Routing-Bezeichner. Modellliste, Versionen und Verfügbarkeit können sich ändern — maßgeblich ist das, was tatsächlich in der Konsole angezeigt wird.
Nutzung & Limits
Harogo setzt folgende Nutzungslimits durch:
Alle drei Limits gelten gleichzeitig. Jeder Modellaufruf greift auf das gemeinsame Abo-Kontingent zu, und manche Modelle haben ein niedrigeres maximales Nutzungslimit — Details finden Sie in der Preistabelle unten.
Die Limits sind als Dollarwert festgelegt, nicht als feste Anzahl an Anfragen. Wie viele Anfragen Sie tatsächlich erhalten, hängt vom verwendeten Modell ab — günstigere Modelle erlauben in der Regel mehr Anfragen, teurere Modelle weniger.
Ihre aktuelle Nutzung und das verbleibende Kontingent können Sie in der Harogo-Konsole einsehen.
Geschätztes Anfragevolumen
Die folgende Tabelle zeigt geschätzte Anfragezahlen auf Basis typischer Harogo-Nutzungsmuster:
| Modell | Pro Tag ($12) | Pro Woche ($30) | Pro Monat ($60) |
|---|---|---|---|
| Kimi K3 | 1,040 | 2,600 | 5,200 |
| Claude Opus 5 | 300 | 750 | 1,500 |
| GPT-5.6 Sol | 1,130 | 2,820 | 5,630 |
| Qwen3.8 Max | 3,960 | 9,900 | 19,800 |
| GLM-5.2 | 7,920 | 19,790 | 39,580 |
| Claude Sonnet 5 | 2,350 | 5,880 | 11,760 |
| GPT-5.6 Terra | 2,640 | 6,600 | 13,200 |
| MiniMax M3 | 27,460 | 68,650 | 137,300 |
| DeepSeek V4 Pro | 34,250 | 85,640 | 171,270 |
| DeepSeek V4 Flash | 316,290 | 790,720 | 1,581,440 |
| Claude Haiku 4.5 | 18,050 | 45,110 | 90,230 |
| GPT-5.6 Luna | 2,060 | 5,150 | 10,300 |
| Claude Fable 5 | 220 | 560 | 1,110 |
Jede Zeile geht davon aus, dass das Kontingent für den jeweiligen Zeitraum überwiegend für das entsprechende Modell genutzt wird. Bei der Kombination mehrerer Modelle greifen diese gemeinsam auf dasselbe Kontingent zu, sodass sich die Anfragezahlen der Modelle nicht einfach addieren lassen.
Die tatsächlichen Anfragezahlen variieren je nach Kontextlänge, Cache-Trefferquote, Reasoning-Aufwand und Ausgabelänge. Ein Coding-Agent kann für eine einzelne Aufgabe zudem mehrere Modellanfragen stellen, sodass eine Anfrage nicht einer vollständigen Coding-Aufgabe entspricht.
Schätzmethodik
Die Schätzungen basieren auf folgenden typischen Anfragemustern:
- GLM-5.2 — etwa 700 Input-Token, 52,000 Cache-Read-Token und 150 Output-Token pro Anfrage.
- Qwen3.8 Max — etwa 8,731 Input-Token, 31,831 Cache-Read-Token und 2,029 Output-Token pro Anfrage.
- Kimi K3 — etwa 1,050 Input-Token, 76,500 Cache-Read-Token und 300 Output-Token pro Anfrage.
- MiniMax M3 — etwa 4,381 Input-Token, 28,768 Cache-Read-Token und 1,108 Output-Token pro Anfrage.
- DeepSeek V4 Pro — etwa 750 Input-Token, 82,000 Cache-Read-Token und 290 Output-Token pro Anfrage.
- DeepSeek V4 Flash — etwa 790 Input-Token, 68,000 Cache-Read-Token und 280 Output-Token pro Anfrage.
- Claude Opus 5 — etwa 580 Input-Token, 386,230 Cache-Read-Token, 19,476 Cache-Write-Token und 2,025 Output-Token pro Anfrage.
- Claude Sonnet 5 — etwa 159 Input-Token, 129,804 Cache-Read-Token, 6,260 Cache-Write-Token und 850 Output-Token pro Anfrage.
- Claude Fable 5 — etwa 399 Input-Token, 315,393 Cache-Read-Token, 12,907 Cache-Write-Token und 1,016 Output-Token pro Anfrage.
- Claude Haiku 4.5 — etwa 700 Input-Token, 52,000 Cache-Read-Token und 150 Output-Token pro Anfrage.
- GPT-5.6 Luna — etwa 45,726 Input-Token, 10,720 Cache-Read-Token und 1,905 Output-Token pro Anfrage.
- GPT-5.6 Sol — etwa 6,032 Input-Token, 112,138 Cache-Read-Token und 678 Output-Token pro Anfrage.
- GPT-5.6 Terra — etwa 6,825 Input-Token, 69,476 Cache-Read-Token und 734 Output-Token pro Anfrage.
Qwen3.8 Max, MiniMax M3 sowie die Claude- und GPT-5.6-Familien nutzen beobachtete durchschnittliche Anfragestrukturen. Die übrigen Modelle nutzen eine typische Coding-Anfragestruktur. Claude Opus 5 bezieht sich derzeit auf tatsächliche Nutzungsdaten von Opus-Modellen auf demselben Preisniveau.
Diese Werte dienen der Schätzung typischer Nutzung und stellen keine Zusicherung einer festen Anzahl an Anfragen dar.
Modellpreise & Nutzungslimits
Die folgende Tabelle listet den API-Referenzpreis jedes Modells pro 1 Million Token sowie das von Harogo für dieses Modell angewendete Nutzungslimit.
| Modell | Modell-ID | Input / 1M | Output / 1M | Cache-Read / 1M | Nutzungslimit |
|---|---|---|---|---|---|
| Kimi K3 | kimi-k3 | $3.00 | $15.00 | $0.30 | $15 |
| Claude Opus 5 | claude-opus-5 | $5.00 | $25.00 | $0.50 | $60 |
| GPT-5.6 Sol | gpt-5.6-sol | $5.00 | $30.00 | $0.50 | $60 |
| Qwen3.8 Max | qwen3.8-max-preview | $1.69 | $5.03 | $0.17 | $60 |
| GLM-5.2 | glm-5.2 | $1.40 | $4.40 | $0.26 | $60 |
| Claude Sonnet 5 | claude-sonnet-5 | $2.00 | $10.00 | $0.20 | $60 |
| GPT-5.6 Terra | gpt-5.6-terra | $2.50 | $15.00 | $0.25 | $60 |
| MiniMax M3 | minimax-m3 | $0.30 | $1.20 | $0.06 | $60 |
| DeepSeek V4 Pro | deepseek-v4-pro | $0.44 | $0.87 | — | $15 |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | $0.14 | $0.28 | — | $60 |
| Claude Haiku 4.5 | claude-haiku-4-5 | $1.00 | $5.00 | $0.10 | $60 |
| GPT-5.6 Luna | gpt-5.6-luna | $1.00 | $6.00 | $0.10 | $60 |
| Claude Fable 5 | claude-fable-5 | $10.00 | $50.00 | $1.00 | $60 |
"—" bedeutet, dass der Posten derzeit nicht separat abgerechnet wird oder für dieses Modell nicht zutrifft.
Die geschätzten Anfragezahlen werden aus einer Kombination von Modellpreisen, typischer Anfragestruktur, realen Nutzungsdaten und dem Nutzungslimit jedes Modells berechnet. Preise und Verfügbarkeit von Preview-Modellen können sich ändern.
Modellpreise, Nutzungslimits und geschätzte Anfragezahlen können sich mit der Weiterentwicklung des Dienstes ändern — aktuelle Details finden Sie in der Harogo-Konsole und der jeweils aktuellen Version dieser Seite.