Documentación de Harogo
Harogo es un servicio de suscripción multimodelo para agentes de programación. Esta página explica qué incluye, cómo configurarlo, qué modelos son compatibles y cómo funcionan los límites de uso.
Introducción
Harogo es un servicio de suscripción multimodelo para agentes de programación.
El precio de suscripción con descuento es de $4.90/mes por tiempo limitado; después será de $9.90/mes una vez que termine la oferta. Actualmente hay 100 cupos de suscripción con descuento disponibles — los cupos restantes y el precio final exacto que se muestra en la página de suscripción son los datos oficiales.
Después de suscribirte, puedes acceder a varios modelos de programación a través de un único punto de entrada. Todos los modelos comparten la misma cuenta de Harogo, la misma clave de API y la misma cuota de suscripción — no necesitas registrarte ni recargar saldo por separado en varias plataformas de modelos.
Por qué Harogo
Distintos modelos destacan en distintas tareas de programación. Usar varios proveedores de modelos directamente suele implicar gestionar múltiples cuentas, claves de API, saldos, límites de velocidad y facturas.
Harogo conecta un conjunto de modelos adecuados para agentes de programación detrás de un único servicio. Puedes cambiar de modelo según la tarea, y cada llamada se factura contra la misma cuota compartida.
Los modelos actuales se agrupan aproximadamente así:
- Kimi K3, Claude Opus 5, GPT-5.6 Sol — indicados para bases de código grandes, tareas de contexto extenso y razonamiento de alta dificultad.
- Qwen3.8 Max, GLM-5.2, Claude Sonnet 5, GPT-5.6 Terra, MiniMax M3, DeepSeek V4 Pro — indicados para programación de agentes del día a día, generación de código y depuración.
- DeepSeek V4 Flash, Claude Haiku 4.5, GPT-5.6 Luna — indicados para llamadas de alta frecuencia, respuestas rápidas y tareas sensibles al costo.
- Claude Fable 5 — indicado para flujos de trabajo de agentes de varios pasos y larga duración.
Estas agrupaciones son solo un punto de partida para elegir un modelo. Los resultados reales dependen de la tarea específica, el contexto y cómo se usen las herramientas.
Primeros pasos
- Inicia sesión en Harogo y completa tu suscripción.
- Crea y copia una clave de API en la consola.
- Configura la URL base como https://api.harogo.ai.
- Pega la clave de API.
- Empieza a usarlo.
Nota
Mantén tu clave de API en un lugar seguro. No la subas a un repositorio público ni la compartas con nadie.
Modelos compatibles
Modelos compatibles actualmente:
| Modelo | ID del modelo | Ideal para |
|---|---|---|
| GLM-5.2 | glm-5.2 | Tareas de larga duración, bases de código grandes y programación de agentes |
| Qwen3.8 Max | qwen3.8-max-preview | Razonamiento complejo, comprensión visual y llamada a herramientas integrada |
| Kimi K3 | kimi-k3 | Programación compleja, contexto extenso, tareas de agentes |
| MiniMax M3 | minimax-m3 | Programación de alta frecuencia, llamada a herramientas, contexto extenso |
| DeepSeek V4 Pro | deepseek-v4-pro | Razonamiento y generación de código complejo |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | Finalizaciones rápidas, llamadas de alta frecuencia y tareas por lotes |
| Claude Opus 5 | claude-opus-5 | Programación de agentes compleja y tareas de ingeniería de alta dificultad |
| Claude Sonnet 5 | claude-sonnet-5 | Programación diaria y tareas generales de desarrollo |
| Claude Fable 5 | claude-fable-5 | Tareas de agentes complejas y de larga duración |
| Claude Haiku 4.5 | claude-haiku-4-5 | Respuestas rápidas, tareas ligeras y procesamiento por lotes |
| GPT-5.6 Luna | gpt-5.6-luna | Programación de alta frecuencia y tareas ligeras |
| GPT-5.6 Sol | gpt-5.6-sol | Generación de código de alta dificultad, revisión y razonamiento |
| GPT-5.6 Terra | gpt-5.6-terra | Programación de agentes diaria y tareas generales |
Los nombres e IDs de los modelos anteriores son los identificadores de enrutamiento que usa Harogo. La lista de modelos, las versiones y la disponibilidad pueden cambiar — consulta lo que se muestra realmente en la consola.
Uso y límites
Harogo aplica los siguientes límites de uso:
Los tres límites se aplican al mismo tiempo. Cada llamada a un modelo consume de la cuota de suscripción compartida, y algunos modelos tienen un tope de uso máximo más bajo — consulta la tabla de precios más abajo para más detalles.
Los límites se definen por valor en dólares, no por un número fijo de solicitudes. El número real de solicitudes que obtienes depende del modelo que uses — los modelos más económicos suelen permitir más solicitudes, y los modelos más caros permiten menos.
Puedes consultar tu uso actual y tu cuota restante en la consola de Harogo.
Volumen estimado de solicitudes
La siguiente tabla muestra los recuentos estimados de solicitudes según los patrones de uso típicos de Harogo:
| Modelo | Por día ($12) | Por semana ($30) | Por mes ($60) |
|---|---|---|---|
| Kimi K3 | 1,040 | 2,600 | 5,200 |
| Claude Opus 5 | 300 | 750 | 1,500 |
| GPT-5.6 Sol | 1,130 | 2,820 | 5,630 |
| Qwen3.8 Max | 3,960 | 9,900 | 19,800 |
| GLM-5.2 | 7,920 | 19,790 | 39,580 |
| Claude Sonnet 5 | 2,350 | 5,880 | 11,760 |
| GPT-5.6 Terra | 2,640 | 6,600 | 13,200 |
| MiniMax M3 | 27,460 | 68,650 | 137,300 |
| DeepSeek V4 Pro | 34,250 | 85,640 | 171,270 |
| DeepSeek V4 Flash | 316,290 | 790,720 | 1,581,440 |
| Claude Haiku 4.5 | 18,050 | 45,110 | 90,230 |
| GPT-5.6 Luna | 2,060 | 5,150 | 10,300 |
| Claude Fable 5 | 220 | 560 | 1,110 |
Cada fila asume que la cuota de ese período se usa principalmente en el modelo correspondiente. Al combinar varios modelos, todos consumen la misma cuota compartida, por lo que los recuentos de solicitudes entre modelos no se pueden simplemente sumar.
Los recuentos reales de solicitudes varían según la longitud del contexto, la tasa de aciertos de caché, el esfuerzo de razonamiento y la longitud de la salida. Un agente de programación también puede emitir varias solicitudes al modelo para una sola tarea, por lo que una solicitud no equivale a una tarea de programación completa.
Metodología de estimación
Las estimaciones se basan en los siguientes patrones de solicitud típicos:
- GLM-5.2 — aproximadamente 700 tokens de entrada, 52,000 tokens de lectura de caché y 150 tokens de salida por solicitud.
- Qwen3.8 Max — aproximadamente 8,731 tokens de entrada, 31,831 tokens de lectura de caché y 2,029 tokens de salida por solicitud.
- Kimi K3 — aproximadamente 1,050 tokens de entrada, 76,500 tokens de lectura de caché y 300 tokens de salida por solicitud.
- MiniMax M3 — aproximadamente 4,381 tokens de entrada, 28,768 tokens de lectura de caché y 1,108 tokens de salida por solicitud.
- DeepSeek V4 Pro — aproximadamente 750 tokens de entrada, 82,000 tokens de lectura de caché y 290 tokens de salida por solicitud.
- DeepSeek V4 Flash — aproximadamente 790 tokens de entrada, 68,000 tokens de lectura de caché y 280 tokens de salida por solicitud.
- Claude Opus 5 — aproximadamente 580 tokens de entrada, 386,230 tokens de lectura de caché, 19,476 tokens de escritura de caché y 2,025 tokens de salida por solicitud.
- Claude Sonnet 5 — aproximadamente 159 tokens de entrada, 129,804 tokens de lectura de caché, 6,260 tokens de escritura de caché y 850 tokens de salida por solicitud.
- Claude Fable 5 — aproximadamente 399 tokens de entrada, 315,393 tokens de lectura de caché, 12,907 tokens de escritura de caché y 1,016 tokens de salida por solicitud.
- Claude Haiku 4.5 — aproximadamente 700 tokens de entrada, 52,000 tokens de lectura de caché y 150 tokens de salida por solicitud.
- GPT-5.6 Luna — aproximadamente 45,726 tokens de entrada, 10,720 tokens de lectura de caché y 1,905 tokens de salida por solicitud.
- GPT-5.6 Sol — aproximadamente 6,032 tokens de entrada, 112,138 tokens de lectura de caché y 678 tokens de salida por solicitud.
- GPT-5.6 Terra — aproximadamente 6,825 tokens de entrada, 69,476 tokens de lectura de caché y 734 tokens de salida por solicitud.
Qwen3.8 Max, MiniMax M3 y las familias Claude y GPT-5.6 usan estructuras de solicitud promedio observadas. Los demás modelos usan una estructura de solicitud de programación típica. Claude Opus 5 actualmente toma como referencia datos de uso reales de modelos de nivel Opus con el mismo precio.
Estas cifras se usan para estimar el uso típico y no constituyen un compromiso de un número fijo de solicitudes.
Precios de los modelos y topes de uso
La siguiente tabla muestra el precio de referencia de la API de cada modelo por 1 millón de tokens, junto con el tope de uso que Harogo aplica a ese modelo.
| Modelo | ID del modelo | Entrada / 1M | Salida / 1M | Lectura de caché / 1M | Tope de uso |
|---|---|---|---|---|---|
| Kimi K3 | kimi-k3 | $3.00 | $15.00 | $0.30 | $15 |
| Claude Opus 5 | claude-opus-5 | $5.00 | $25.00 | $0.50 | $60 |
| GPT-5.6 Sol | gpt-5.6-sol | $5.00 | $30.00 | $0.50 | $60 |
| Qwen3.8 Max | qwen3.8-max-preview | $1.69 | $5.03 | $0.17 | $60 |
| GLM-5.2 | glm-5.2 | $1.40 | $4.40 | $0.26 | $60 |
| Claude Sonnet 5 | claude-sonnet-5 | $2.00 | $10.00 | $0.20 | $60 |
| GPT-5.6 Terra | gpt-5.6-terra | $2.50 | $15.00 | $0.25 | $60 |
| MiniMax M3 | minimax-m3 | $0.30 | $1.20 | $0.06 | $60 |
| DeepSeek V4 Pro | deepseek-v4-pro | $0.44 | $0.87 | — | $15 |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | $0.14 | $0.28 | — | $60 |
| Claude Haiku 4.5 | claude-haiku-4-5 | $1.00 | $5.00 | $0.10 | $60 |
| GPT-5.6 Luna | gpt-5.6-luna | $1.00 | $6.00 | $0.10 | $60 |
| Claude Fable 5 | claude-fable-5 | $10.00 | $50.00 | $1.00 | $60 |
"—" significa que el elemento no se factura por separado en este momento, o que no aplica a ese modelo.
Los recuentos estimados de solicitudes se calculan combinando el precio del modelo, la estructura de solicitud típica, datos reales de uso y el tope de uso de cada modelo. Los precios y la disponibilidad de los modelos en vista previa pueden cambiar.
Los precios de los modelos, los topes de uso y los recuentos estimados de solicitudes pueden cambiar a medida que el servicio evoluciona — consulta la consola de Harogo y la versión actual de esta página para conocer los últimos detalles.