Documentation Harogo
Harogo est un service d'abonnement multi-modèles pour les agents de codage. Cette page couvre ce qui est inclus, comment démarrer, quels modèles sont pris en charge et comment fonctionnent les limites d'utilisation.
Introduction
Harogo est un service d'abonnement multi-modèles pour les agents de codage.
Le prix d'abonnement à tarif réduit est de $4.90/mois pendant une durée limitée, puis $9.90/mois une fois l'offre terminée. 100 places d'abonnement à tarif réduit sont actuellement disponibles — le nombre de places restantes et le prix de règlement exact indiqués sur la page d'abonnement font foi.
Après votre abonnement, vous pouvez accéder à plusieurs modèles de codage via un seul point d'accès. Tous les modèles partagent le même compte Harogo, la même clé API et le même quota d'abonnement — inutile de vous inscrire ou de recharger séparément plusieurs plateformes de modèles.
Pourquoi Harogo
Chaque modèle excelle dans des tâches de codage différentes. Utiliser directement plusieurs fournisseurs de modèles signifie généralement gérer plusieurs comptes, clés API, soldes, limites de débit et factures.
Harogo réunit un ensemble de modèles adaptés aux agents de codage derrière un seul service. Vous pouvez changer de modèle selon la tâche, et chaque appel est facturé sur le même quota partagé.
Les modèles actuels se répartissent globalement dans les groupes suivants :
- Kimi K3, Claude Opus 5, GPT-5.6 Sol — adaptés aux grandes bases de code, aux tâches à contexte long et au raisonnement de haute difficulté.
- Qwen3.8 Max, GLM-5.2, Claude Sonnet 5, GPT-5.6 Terra, MiniMax M3, DeepSeek V4 Pro — adaptés au codage d'agent quotidien, à la génération de code et au débogage.
- DeepSeek V4 Flash, Claude Haiku 4.5, GPT-5.6 Luna — adaptés aux appels haute fréquence, aux réponses rapides et aux tâches sensibles au coût.
- Claude Fable 5 — adapté aux flux de travail d'agent longs et multi-étapes.
Ces regroupements ne sont qu'un point de départ pour choisir un modèle. Les résultats réels dépendent de la tâche spécifique, du contexte et de la manière dont les outils sont utilisés.
Prise en main
- Connectez-vous à Harogo et finalisez votre abonnement.
- Créez et copiez une clé API dans la console.
- Définissez l'URL de base sur https://api.harogo.ai.
- Collez la clé API.
- Commencez à l'utiliser.
Remarque
Gardez votre clé API en sécurité. Ne la publiez pas dans un dépôt public et ne la partagez avec personne.
Modèles pris en charge
Modèles actuellement pris en charge :
| Modèle | Identifiant du modèle | Idéal pour |
|---|---|---|
| GLM-5.2 | glm-5.2 | Tâches de longue durée, grandes bases de code et codage d'agent |
| Qwen3.8 Max | qwen3.8-max-preview | Raisonnement complexe, compréhension visuelle et appels d'outils intégrés |
| Kimi K3 | kimi-k3 | Codage complexe, contexte long, tâches d'agent |
| MiniMax M3 | minimax-m3 | Codage haute fréquence, appels d'outils, contexte long |
| DeepSeek V4 Pro | deepseek-v4-pro | Raisonnement et génération de code complexe |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | Complétions rapides, appels haute fréquence et tâches par lots |
| Claude Opus 5 | claude-opus-5 | Codage d'agent complexe et tâches d'ingénierie de haute difficulté |
| Claude Sonnet 5 | claude-sonnet-5 | Codage quotidien et tâches de développement général |
| Claude Fable 5 | claude-fable-5 | Tâches d'agent complexes et de longue durée |
| Claude Haiku 4.5 | claude-haiku-4-5 | Réponses rapides, tâches légères et traitement par lots |
| GPT-5.6 Luna | gpt-5.6-luna | Codage haute fréquence et tâches légères |
| GPT-5.6 Sol | gpt-5.6-sol | Génération de code de haute difficulté, revue et raisonnement |
| GPT-5.6 Terra | gpt-5.6-terra | Codage d'agent quotidien et tâches générales |
Les noms et identifiants de modèles ci-dessus sont les identifiants de routage utilisés par Harogo. La liste des modèles, les versions et la disponibilité peuvent évoluer — référez-vous à ce qui est réellement affiché dans la console.
Utilisation et limites
Harogo applique les limites d'utilisation suivantes :
Les trois limites sont appliquées simultanément. Chaque appel de modèle puise dans le quota d'abonnement partagé, et certains modèles ont un plafond d'utilisation maximal inférieur — voir le tableau tarifaire ci-dessous pour plus de détails.
Les limites sont définies en valeur monétaire, pas en nombre fixe de requêtes. Le nombre réel de requêtes que vous obtenez dépend du modèle utilisé — les modèles moins chers permettent généralement plus de requêtes, et les modèles plus chers en permettent moins.
Vous pouvez consulter votre utilisation actuelle et votre quota restant dans la console Harogo.
Volume de requêtes estimé
Le tableau ci-dessous donne des nombres de requêtes estimés basés sur des schémas d'utilisation typiques de Harogo :
| Modèle | Par jour ($12) | Par semaine ($30) | Par mois ($60) |
|---|---|---|---|
| Kimi K3 | 1,040 | 2,600 | 5,200 |
| Claude Opus 5 | 300 | 750 | 1,500 |
| GPT-5.6 Sol | 1,130 | 2,820 | 5,630 |
| Qwen3.8 Max | 3,960 | 9,900 | 19,800 |
| GLM-5.2 | 7,920 | 19,790 | 39,580 |
| Claude Sonnet 5 | 2,350 | 5,880 | 11,760 |
| GPT-5.6 Terra | 2,640 | 6,600 | 13,200 |
| MiniMax M3 | 27,460 | 68,650 | 137,300 |
| DeepSeek V4 Pro | 34,250 | 85,640 | 171,270 |
| DeepSeek V4 Flash | 316,290 | 790,720 | 1,581,440 |
| Claude Haiku 4.5 | 18,050 | 45,110 | 90,230 |
| GPT-5.6 Luna | 2,060 | 5,150 | 10,300 |
| Claude Fable 5 | 220 | 560 | 1,110 |
Chaque ligne suppose que le quota de cette période est utilisé principalement sur le modèle correspondant. En combinant plusieurs modèles, ils puisent ensemble dans le même quota partagé, donc les nombres de requêtes entre modèles ne peuvent pas simplement s'additionner.
Les nombres de requêtes réels varient selon la longueur du contexte, le taux de succès du cache, l'effort de raisonnement et la longueur de sortie. Un agent de codage peut également émettre plusieurs requêtes de modèle pour une seule tâche, donc une requête n'équivaut pas à une tâche de codage complète.
Méthodologie d'estimation
Les estimations sont basées sur les schémas de requêtes typiques suivants :
- GLM-5.2 — environ 700 jetons d'entrée, 52,000 jetons de lecture de cache et 150 jetons de sortie par requête.
- Qwen3.8 Max — environ 8,731 jetons d'entrée, 31,831 jetons de lecture de cache et 2,029 jetons de sortie par requête.
- Kimi K3 — environ 1,050 jetons d'entrée, 76,500 jetons de lecture de cache et 300 jetons de sortie par requête.
- MiniMax M3 — environ 4,381 jetons d'entrée, 28,768 jetons de lecture de cache et 1,108 jetons de sortie par requête.
- DeepSeek V4 Pro — environ 750 jetons d'entrée, 82,000 jetons de lecture de cache et 290 jetons de sortie par requête.
- DeepSeek V4 Flash — environ 790 jetons d'entrée, 68,000 jetons de lecture de cache et 280 jetons de sortie par requête.
- Claude Opus 5 — environ 580 jetons d'entrée, 386,230 jetons de lecture de cache, 19,476 jetons d'écriture de cache et 2,025 jetons de sortie par requête.
- Claude Sonnet 5 — environ 159 jetons d'entrée, 129,804 jetons de lecture de cache, 6,260 jetons d'écriture de cache et 850 jetons de sortie par requête.
- Claude Fable 5 — environ 399 jetons d'entrée, 315,393 jetons de lecture de cache, 12,907 jetons d'écriture de cache et 1,016 jetons de sortie par requête.
- Claude Haiku 4.5 — environ 700 jetons d'entrée, 52,000 jetons de lecture de cache et 150 jetons de sortie par requête.
- GPT-5.6 Luna — environ 45,726 jetons d'entrée, 10,720 jetons de lecture de cache et 1,905 jetons de sortie par requête.
- GPT-5.6 Sol — environ 6,032 jetons d'entrée, 112,138 jetons de lecture de cache et 678 jetons de sortie par requête.
- GPT-5.6 Terra — environ 6,825 jetons d'entrée, 69,476 jetons de lecture de cache et 734 jetons de sortie par requête.
Qwen3.8 Max, MiniMax M3, ainsi que les familles Claude et GPT-5.6, utilisent des structures de requêtes moyennes observées. Les autres modèles utilisent une structure de requête de codage typique. Claude Opus 5 s'appuie actuellement sur des données d'utilisation réelles de modèles de niveau Opus au même positionnement tarifaire.
Ces chiffres servent à estimer une utilisation typique et ne constituent pas un engagement sur un nombre fixe de requêtes.
Tarification des modèles et plafonds d'utilisation
Le tableau ci-dessous répertorie le prix de référence de l'API de chaque modèle par million de jetons, ainsi que le plafond d'utilisation que Harogo applique à ce modèle.
| Modèle | Identifiant du modèle | Entrée / 1M | Sortie / 1M | Lecture cache / 1M | Plafond d'utilisation |
|---|---|---|---|---|---|
| Kimi K3 | kimi-k3 | $3.00 | $15.00 | $0.30 | $15 |
| Claude Opus 5 | claude-opus-5 | $5.00 | $25.00 | $0.50 | $60 |
| GPT-5.6 Sol | gpt-5.6-sol | $5.00 | $30.00 | $0.50 | $60 |
| Qwen3.8 Max | qwen3.8-max-preview | $1.69 | $5.03 | $0.17 | $60 |
| GLM-5.2 | glm-5.2 | $1.40 | $4.40 | $0.26 | $60 |
| Claude Sonnet 5 | claude-sonnet-5 | $2.00 | $10.00 | $0.20 | $60 |
| GPT-5.6 Terra | gpt-5.6-terra | $2.50 | $15.00 | $0.25 | $60 |
| MiniMax M3 | minimax-m3 | $0.30 | $1.20 | $0.06 | $60 |
| DeepSeek V4 Pro | deepseek-v4-pro | $0.44 | $0.87 | — | $15 |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | $0.14 | $0.28 | — | $60 |
| Claude Haiku 4.5 | claude-haiku-4-5 | $1.00 | $5.00 | $0.10 | $60 |
| GPT-5.6 Luna | gpt-5.6-luna | $1.00 | $6.00 | $0.10 | $60 |
| Claude Fable 5 | claude-fable-5 | $10.00 | $50.00 | $1.00 | $60 |
« — » signifie que cet élément n'est pas facturé séparément pour le moment, ou ne s'applique pas à ce modèle.
Les nombres de requêtes estimés sont calculés à partir d'une combinaison de la tarification des modèles, de la structure de requête typique, de données d'utilisation réelles et du plafond d'utilisation de chaque modèle. La tarification et la disponibilité des modèles en preview peuvent évoluer.
La tarification des modèles, les plafonds d'utilisation et les nombres de requêtes estimés peuvent évoluer avec le service — consultez la console Harogo et la version actuelle de cette page pour les informations les plus récentes.