Aller au contenu
Harogo
Modèles Tarifs FAQ Docs
English 日本語 한국어 Deutsch Español Português Русский Türkçe Polski Nederlands Italiano Tiếng Việt Українська Български 简体中文
Se connecter Obtenir Harogo
Documentation

Documentation Harogo

Harogo est un service d'abonnement multi-modèles pour les agents de codage. Cette page couvre ce qui est inclus, comment démarrer, quels modèles sont pris en charge et comment fonctionnent les limites d'utilisation.

Introduction

Harogo est un service d'abonnement multi-modèles pour les agents de codage.

Le prix d'abonnement à tarif réduit est de $4.90/mois pendant une durée limitée, puis $9.90/mois une fois l'offre terminée. 100 places d'abonnement à tarif réduit sont actuellement disponibles — le nombre de places restantes et le prix de règlement exact indiqués sur la page d'abonnement font foi.

Après votre abonnement, vous pouvez accéder à plusieurs modèles de codage via un seul point d'accès. Tous les modèles partagent le même compte Harogo, la même clé API et le même quota d'abonnement — inutile de vous inscrire ou de recharger séparément plusieurs plateformes de modèles.

Pourquoi Harogo

Chaque modèle excelle dans des tâches de codage différentes. Utiliser directement plusieurs fournisseurs de modèles signifie généralement gérer plusieurs comptes, clés API, soldes, limites de débit et factures.

Harogo réunit un ensemble de modèles adaptés aux agents de codage derrière un seul service. Vous pouvez changer de modèle selon la tâche, et chaque appel est facturé sur le même quota partagé.

Les modèles actuels se répartissent globalement dans les groupes suivants :

  • Kimi K3, Claude Opus 5, GPT-5.6 Sol — adaptés aux grandes bases de code, aux tâches à contexte long et au raisonnement de haute difficulté.
  • Qwen3.8 Max, GLM-5.2, Claude Sonnet 5, GPT-5.6 Terra, MiniMax M3, DeepSeek V4 Pro — adaptés au codage d'agent quotidien, à la génération de code et au débogage.
  • DeepSeek V4 Flash, Claude Haiku 4.5, GPT-5.6 Luna — adaptés aux appels haute fréquence, aux réponses rapides et aux tâches sensibles au coût.
  • Claude Fable 5 — adapté aux flux de travail d'agent longs et multi-étapes.

Ces regroupements ne sont qu'un point de départ pour choisir un modèle. Les résultats réels dépendent de la tâche spécifique, du contexte et de la manière dont les outils sont utilisés.

Prise en main

  1. Connectez-vous à Harogo et finalisez votre abonnement.
  2. Créez et copiez une clé API dans la console.
  3. Définissez l'URL de base sur https://api.harogo.ai.
  4. Collez la clé API.
  5. Commencez à l'utiliser.

Remarque

Gardez votre clé API en sécurité. Ne la publiez pas dans un dépôt public et ne la partagez avec personne.

Modèles pris en charge

Modèles actuellement pris en charge :

ModèleIdentifiant du modèleIdéal pour
GLM-5.2glm-5.2Tâches de longue durée, grandes bases de code et codage d'agent
Qwen3.8 Maxqwen3.8-max-previewRaisonnement complexe, compréhension visuelle et appels d'outils intégrés
Kimi K3kimi-k3Codage complexe, contexte long, tâches d'agent
MiniMax M3minimax-m3Codage haute fréquence, appels d'outils, contexte long
DeepSeek V4 Prodeepseek-v4-proRaisonnement et génération de code complexe
DeepSeek V4 Flashdeepseek-v4-flash-0731Complétions rapides, appels haute fréquence et tâches par lots
Claude Opus 5claude-opus-5Codage d'agent complexe et tâches d'ingénierie de haute difficulté
Claude Sonnet 5claude-sonnet-5Codage quotidien et tâches de développement général
Claude Fable 5claude-fable-5Tâches d'agent complexes et de longue durée
Claude Haiku 4.5claude-haiku-4-5Réponses rapides, tâches légères et traitement par lots
GPT-5.6 Lunagpt-5.6-lunaCodage haute fréquence et tâches légères
GPT-5.6 Solgpt-5.6-solGénération de code de haute difficulté, revue et raisonnement
GPT-5.6 Terragpt-5.6-terraCodage d'agent quotidien et tâches générales

Les noms et identifiants de modèles ci-dessus sont les identifiants de routage utilisés par Harogo. La liste des modèles, les versions et la disponibilité peuvent évoluer — référez-vous à ce qui est réellement affiché dans la console.

Utilisation et limites

Harogo applique les limites d'utilisation suivantes :

Limite quotidienne
$12
Limite hebdomadaire
$30
Limite mensuelle
$60

Les trois limites sont appliquées simultanément. Chaque appel de modèle puise dans le quota d'abonnement partagé, et certains modèles ont un plafond d'utilisation maximal inférieur — voir le tableau tarifaire ci-dessous pour plus de détails.

Les limites sont définies en valeur monétaire, pas en nombre fixe de requêtes. Le nombre réel de requêtes que vous obtenez dépend du modèle utilisé — les modèles moins chers permettent généralement plus de requêtes, et les modèles plus chers en permettent moins.

Vous pouvez consulter votre utilisation actuelle et votre quota restant dans la console Harogo.

Volume de requêtes estimé

Le tableau ci-dessous donne des nombres de requêtes estimés basés sur des schémas d'utilisation typiques de Harogo :

ModèlePar jour ($12)Par semaine ($30)Par mois ($60)
Kimi K31,0402,6005,200
Claude Opus 53007501,500
GPT-5.6 Sol1,1302,8205,630
Qwen3.8 Max3,9609,90019,800
GLM-5.27,92019,79039,580
Claude Sonnet 52,3505,88011,760
GPT-5.6 Terra2,6406,60013,200
MiniMax M327,46068,650137,300
DeepSeek V4 Pro34,25085,640171,270
DeepSeek V4 Flash316,290790,7201,581,440
Claude Haiku 4.518,05045,11090,230
GPT-5.6 Luna2,0605,15010,300
Claude Fable 52205601,110

Chaque ligne suppose que le quota de cette période est utilisé principalement sur le modèle correspondant. En combinant plusieurs modèles, ils puisent ensemble dans le même quota partagé, donc les nombres de requêtes entre modèles ne peuvent pas simplement s'additionner.

Les nombres de requêtes réels varient selon la longueur du contexte, le taux de succès du cache, l'effort de raisonnement et la longueur de sortie. Un agent de codage peut également émettre plusieurs requêtes de modèle pour une seule tâche, donc une requête n'équivaut pas à une tâche de codage complète.

Méthodologie d'estimation

Les estimations sont basées sur les schémas de requêtes typiques suivants :

  • GLM-5.2 — environ 700 jetons d'entrée, 52,000 jetons de lecture de cache et 150 jetons de sortie par requête.
  • Qwen3.8 Max — environ 8,731 jetons d'entrée, 31,831 jetons de lecture de cache et 2,029 jetons de sortie par requête.
  • Kimi K3 — environ 1,050 jetons d'entrée, 76,500 jetons de lecture de cache et 300 jetons de sortie par requête.
  • MiniMax M3 — environ 4,381 jetons d'entrée, 28,768 jetons de lecture de cache et 1,108 jetons de sortie par requête.
  • DeepSeek V4 Pro — environ 750 jetons d'entrée, 82,000 jetons de lecture de cache et 290 jetons de sortie par requête.
  • DeepSeek V4 Flash — environ 790 jetons d'entrée, 68,000 jetons de lecture de cache et 280 jetons de sortie par requête.
  • Claude Opus 5 — environ 580 jetons d'entrée, 386,230 jetons de lecture de cache, 19,476 jetons d'écriture de cache et 2,025 jetons de sortie par requête.
  • Claude Sonnet 5 — environ 159 jetons d'entrée, 129,804 jetons de lecture de cache, 6,260 jetons d'écriture de cache et 850 jetons de sortie par requête.
  • Claude Fable 5 — environ 399 jetons d'entrée, 315,393 jetons de lecture de cache, 12,907 jetons d'écriture de cache et 1,016 jetons de sortie par requête.
  • Claude Haiku 4.5 — environ 700 jetons d'entrée, 52,000 jetons de lecture de cache et 150 jetons de sortie par requête.
  • GPT-5.6 Luna — environ 45,726 jetons d'entrée, 10,720 jetons de lecture de cache et 1,905 jetons de sortie par requête.
  • GPT-5.6 Sol — environ 6,032 jetons d'entrée, 112,138 jetons de lecture de cache et 678 jetons de sortie par requête.
  • GPT-5.6 Terra — environ 6,825 jetons d'entrée, 69,476 jetons de lecture de cache et 734 jetons de sortie par requête.

Qwen3.8 Max, MiniMax M3, ainsi que les familles Claude et GPT-5.6, utilisent des structures de requêtes moyennes observées. Les autres modèles utilisent une structure de requête de codage typique. Claude Opus 5 s'appuie actuellement sur des données d'utilisation réelles de modèles de niveau Opus au même positionnement tarifaire.

Ces chiffres servent à estimer une utilisation typique et ne constituent pas un engagement sur un nombre fixe de requêtes.

Tarification des modèles et plafonds d'utilisation

Le tableau ci-dessous répertorie le prix de référence de l'API de chaque modèle par million de jetons, ainsi que le plafond d'utilisation que Harogo applique à ce modèle.

ModèleIdentifiant du modèleEntrée / 1MSortie / 1MLecture cache / 1MPlafond d'utilisation
Kimi K3kimi-k3$3.00$15.00$0.30$15
Claude Opus 5claude-opus-5$5.00$25.00$0.50$60
GPT-5.6 Solgpt-5.6-sol$5.00$30.00$0.50$60
Qwen3.8 Maxqwen3.8-max-preview$1.69$5.03$0.17$60
GLM-5.2glm-5.2$1.40$4.40$0.26$60
Claude Sonnet 5claude-sonnet-5$2.00$10.00$0.20$60
GPT-5.6 Terragpt-5.6-terra$2.50$15.00$0.25$60
MiniMax M3minimax-m3$0.30$1.20$0.06$60
DeepSeek V4 Prodeepseek-v4-pro$0.44$0.87$15
DeepSeek V4 Flashdeepseek-v4-flash-0731$0.14$0.28$60
Claude Haiku 4.5claude-haiku-4-5$1.00$5.00$0.10$60
GPT-5.6 Lunagpt-5.6-luna$1.00$6.00$0.10$60
Claude Fable 5claude-fable-5$10.00$50.00$1.00$60

« — » signifie que cet élément n'est pas facturé séparément pour le moment, ou ne s'applique pas à ce modèle.

Les nombres de requêtes estimés sont calculés à partir d'une combinaison de la tarification des modèles, de la structure de requête typique, de données d'utilisation réelles et du plafond d'utilisation de chaque modèle. La tarification et la disponibilité des modèles en preview peuvent évoluer.

La tarification des modèles, les plafonds d'utilisation et les nombres de requêtes estimés peuvent évoluer avec le service — consultez la console Harogo et la version actuelle de cette page pour les informations les plus récentes.