Zum Inhalt springen
Harogo
Modelle Preise FAQ Docs
English 日本語 한국어 Español Français Português Русский Türkçe Polski Nederlands Italiano Tiếng Việt Українська Български 简体中文
Anmelden Harogo sichern
Dokumentation

Harogo Docs

Harogo ist ein Multi-Modell-Abo-Dienst für Coding-Agenten. Diese Seite beschreibt, was enthalten ist, wie Sie loslegen, welche Modelle unterstützt werden und wie die Nutzungslimits funktionieren.

Einführung

Harogo ist ein Multi-Modell-Abo-Dienst für Coding-Agenten.

Der vergünstigte Abo-Preis beträgt zeitlich begrenzt $4.90/Monat, danach $9.90/Monat, sobald das Angebot endet. Derzeit sind 100 vergünstigte Abo-Plätze verfügbar — maßgeblich sind die verbleibenden Plätze und der genaue Endpreis, die auf der Abo-Seite angezeigt werden.

Nach dem Abschluss des Abos erhalten Sie über einen einzigen Zugangspunkt Zugriff auf mehrere Coding-Modelle. Alle Modelle teilen sich dasselbe Harogo-Konto, denselben API-Key und dasselbe Abo-Kontingent — eine separate Registrierung oder Aufladung mehrerer Modellplattformen ist nicht nötig.

Warum Harogo

Unterschiedliche Modelle sind für unterschiedliche Coding-Aufgaben besonders gut geeignet. Wer mehrere Modellanbieter direkt nutzt, muss meist mehrere Konten, API-Keys, Guthaben, Rate-Limits und Rechnungen verwalten.

Harogo bündelt eine Reihe von Modellen, die sich für Coding-Agenten eignen, hinter einem einzigen Dienst. Sie können das Modell je nach Aufgabe wechseln, und jeder Aufruf wird gegen dasselbe gemeinsame Kontingent abgerechnet.

Die aktuellen Modelle lassen sich grob in folgende Gruppen einteilen:

  • Kimi K3, Claude Opus 5, GPT-5.6 Sol — geeignet für große Codebasen, Aufgaben mit langem Kontext und anspruchsvolles Reasoning.
  • Qwen3.8 Max, GLM-5.2, Claude Sonnet 5, GPT-5.6 Terra, MiniMax M3, DeepSeek V4 Pro — geeignet für alltägliches Agent-Coding, Codegenerierung und Debugging.
  • DeepSeek V4 Flash, Claude Haiku 4.5, GPT-5.6 Luna — geeignet für hochfrequente Aufrufe, schnelle Antworten und kostensensitive Aufgaben.
  • Claude Fable 5 — geeignet für länger laufende, mehrstufige Agent-Workflows.

Diese Gruppierungen sind nur ein Ausgangspunkt für die Modellwahl. Die tatsächlichen Ergebnisse hängen von der konkreten Aufgabe, dem Kontext und der Art der Tool-Nutzung ab.

Erste Schritte

  1. Bei Harogo anmelden und das Abo abschließen.
  2. In der Konsole einen API-Key erstellen und kopieren.
  3. Die Base-URL auf https://api.harogo.ai setzen.
  4. Den API-Key einfügen.
  5. Loslegen.

Hinweis

Bewahren Sie Ihren API-Key sicher auf. Committen Sie ihn nicht in ein öffentliches Repository und geben Sie ihn nicht an andere weiter.

Unterstützte Modelle

Derzeit unterstützte Modelle:

ModellModell-IDAm besten geeignet für
GLM-5.2glm-5.2Langlaufende Aufgaben, große Codebasen und Agent-Coding
Qwen3.8 Maxqwen3.8-max-previewKomplexes Reasoning, Bildverständnis und integrierte Tool-Aufrufe
Kimi K3kimi-k3Komplexes Coding, langer Kontext, Agent-Aufgaben
MiniMax M3minimax-m3Hochfrequentes Coding, Tool-Aufrufe, langer Kontext
DeepSeek V4 Prodeepseek-v4-proReasoning und komplexe Codegenerierung
DeepSeek V4 Flashdeepseek-v4-flash-0731Schnelle Completions, hochfrequente Aufrufe und Batch-Aufgaben
Claude Opus 5claude-opus-5Komplexes Agent-Coding und anspruchsvolle Engineering-Aufgaben
Claude Sonnet 5claude-sonnet-5Alltägliches Coding und allgemeine Entwicklungsaufgaben
Claude Fable 5claude-fable-5Länger laufende, komplexe Agent-Aufgaben
Claude Haiku 4.5claude-haiku-4-5Schnelle Antworten, leichte Aufgaben und Batch-Verarbeitung
GPT-5.6 Lunagpt-5.6-lunaHochfrequentes Coding und leichte Aufgaben
GPT-5.6 Solgpt-5.6-solAnspruchsvolle Codegenerierung, Review und Reasoning
GPT-5.6 Terragpt-5.6-terraAlltägliches Agent-Coding und allgemeine Aufgaben

Die obigen Namen und Modell-IDs sind die von Harogo verwendeten Routing-Bezeichner. Modellliste, Versionen und Verfügbarkeit können sich ändern — maßgeblich ist das, was tatsächlich in der Konsole angezeigt wird.

Nutzung & Limits

Harogo setzt folgende Nutzungslimits durch:

Tageslimit
$12
Wochenlimit
$30
Monatslimit
$60

Alle drei Limits gelten gleichzeitig. Jeder Modellaufruf greift auf das gemeinsame Abo-Kontingent zu, und manche Modelle haben ein niedrigeres maximales Nutzungslimit — Details finden Sie in der Preistabelle unten.

Die Limits sind als Dollarwert festgelegt, nicht als feste Anzahl an Anfragen. Wie viele Anfragen Sie tatsächlich erhalten, hängt vom verwendeten Modell ab — günstigere Modelle erlauben in der Regel mehr Anfragen, teurere Modelle weniger.

Ihre aktuelle Nutzung und das verbleibende Kontingent können Sie in der Harogo-Konsole einsehen.

Geschätztes Anfragevolumen

Die folgende Tabelle zeigt geschätzte Anfragezahlen auf Basis typischer Harogo-Nutzungsmuster:

ModellPro Tag ($12)Pro Woche ($30)Pro Monat ($60)
Kimi K31,0402,6005,200
Claude Opus 53007501,500
GPT-5.6 Sol1,1302,8205,630
Qwen3.8 Max3,9609,90019,800
GLM-5.27,92019,79039,580
Claude Sonnet 52,3505,88011,760
GPT-5.6 Terra2,6406,60013,200
MiniMax M327,46068,650137,300
DeepSeek V4 Pro34,25085,640171,270
DeepSeek V4 Flash316,290790,7201,581,440
Claude Haiku 4.518,05045,11090,230
GPT-5.6 Luna2,0605,15010,300
Claude Fable 52205601,110

Jede Zeile geht davon aus, dass das Kontingent für den jeweiligen Zeitraum überwiegend für das entsprechende Modell genutzt wird. Bei der Kombination mehrerer Modelle greifen diese gemeinsam auf dasselbe Kontingent zu, sodass sich die Anfragezahlen der Modelle nicht einfach addieren lassen.

Die tatsächlichen Anfragezahlen variieren je nach Kontextlänge, Cache-Trefferquote, Reasoning-Aufwand und Ausgabelänge. Ein Coding-Agent kann für eine einzelne Aufgabe zudem mehrere Modellanfragen stellen, sodass eine Anfrage nicht einer vollständigen Coding-Aufgabe entspricht.

Schätzmethodik

Die Schätzungen basieren auf folgenden typischen Anfragemustern:

  • GLM-5.2 — etwa 700 Input-Token, 52,000 Cache-Read-Token und 150 Output-Token pro Anfrage.
  • Qwen3.8 Max — etwa 8,731 Input-Token, 31,831 Cache-Read-Token und 2,029 Output-Token pro Anfrage.
  • Kimi K3 — etwa 1,050 Input-Token, 76,500 Cache-Read-Token und 300 Output-Token pro Anfrage.
  • MiniMax M3 — etwa 4,381 Input-Token, 28,768 Cache-Read-Token und 1,108 Output-Token pro Anfrage.
  • DeepSeek V4 Pro — etwa 750 Input-Token, 82,000 Cache-Read-Token und 290 Output-Token pro Anfrage.
  • DeepSeek V4 Flash — etwa 790 Input-Token, 68,000 Cache-Read-Token und 280 Output-Token pro Anfrage.
  • Claude Opus 5 — etwa 580 Input-Token, 386,230 Cache-Read-Token, 19,476 Cache-Write-Token und 2,025 Output-Token pro Anfrage.
  • Claude Sonnet 5 — etwa 159 Input-Token, 129,804 Cache-Read-Token, 6,260 Cache-Write-Token und 850 Output-Token pro Anfrage.
  • Claude Fable 5 — etwa 399 Input-Token, 315,393 Cache-Read-Token, 12,907 Cache-Write-Token und 1,016 Output-Token pro Anfrage.
  • Claude Haiku 4.5 — etwa 700 Input-Token, 52,000 Cache-Read-Token und 150 Output-Token pro Anfrage.
  • GPT-5.6 Luna — etwa 45,726 Input-Token, 10,720 Cache-Read-Token und 1,905 Output-Token pro Anfrage.
  • GPT-5.6 Sol — etwa 6,032 Input-Token, 112,138 Cache-Read-Token und 678 Output-Token pro Anfrage.
  • GPT-5.6 Terra — etwa 6,825 Input-Token, 69,476 Cache-Read-Token und 734 Output-Token pro Anfrage.

Qwen3.8 Max, MiniMax M3 sowie die Claude- und GPT-5.6-Familien nutzen beobachtete durchschnittliche Anfragestrukturen. Die übrigen Modelle nutzen eine typische Coding-Anfragestruktur. Claude Opus 5 bezieht sich derzeit auf tatsächliche Nutzungsdaten von Opus-Modellen auf demselben Preisniveau.

Diese Werte dienen der Schätzung typischer Nutzung und stellen keine Zusicherung einer festen Anzahl an Anfragen dar.

Modellpreise & Nutzungslimits

Die folgende Tabelle listet den API-Referenzpreis jedes Modells pro 1 Million Token sowie das von Harogo für dieses Modell angewendete Nutzungslimit.

ModellModell-IDInput / 1MOutput / 1MCache-Read / 1MNutzungslimit
Kimi K3kimi-k3$3.00$15.00$0.30$15
Claude Opus 5claude-opus-5$5.00$25.00$0.50$60
GPT-5.6 Solgpt-5.6-sol$5.00$30.00$0.50$60
Qwen3.8 Maxqwen3.8-max-preview$1.69$5.03$0.17$60
GLM-5.2glm-5.2$1.40$4.40$0.26$60
Claude Sonnet 5claude-sonnet-5$2.00$10.00$0.20$60
GPT-5.6 Terragpt-5.6-terra$2.50$15.00$0.25$60
MiniMax M3minimax-m3$0.30$1.20$0.06$60
DeepSeek V4 Prodeepseek-v4-pro$0.44$0.87$15
DeepSeek V4 Flashdeepseek-v4-flash-0731$0.14$0.28$60
Claude Haiku 4.5claude-haiku-4-5$1.00$5.00$0.10$60
GPT-5.6 Lunagpt-5.6-luna$1.00$6.00$0.10$60
Claude Fable 5claude-fable-5$10.00$50.00$1.00$60

"—" bedeutet, dass der Posten derzeit nicht separat abgerechnet wird oder für dieses Modell nicht zutrifft.

Die geschätzten Anfragezahlen werden aus einer Kombination von Modellpreisen, typischer Anfragestruktur, realen Nutzungsdaten und dem Nutzungslimit jedes Modells berechnet. Preise und Verfügbarkeit von Preview-Modellen können sich ändern.

Modellpreise, Nutzungslimits und geschätzte Anfragezahlen können sich mit der Weiterentwicklung des Dienstes ändern — aktuelle Details finden Sie in der Harogo-Konsole und der jeweils aktuellen Version dieser Seite.