Ir al contenido
Harogo
Modelos Precios Preguntas frecuentes Documentación
English 日本語 한국어 Deutsch Français Português Русский Türkçe Polski Nederlands Italiano Tiếng Việt Українська Български 简体中文
Iniciar sesión Obtener Harogo
Documentación

Documentación de Harogo

Harogo es un servicio de suscripción multimodelo para agentes de programación. Esta página explica qué incluye, cómo configurarlo, qué modelos son compatibles y cómo funcionan los límites de uso.

Introducción

Harogo es un servicio de suscripción multimodelo para agentes de programación.

El precio de suscripción con descuento es de $4.90/mes por tiempo limitado; después será de $9.90/mes una vez que termine la oferta. Actualmente hay 100 cupos de suscripción con descuento disponibles — los cupos restantes y el precio final exacto que se muestra en la página de suscripción son los datos oficiales.

Después de suscribirte, puedes acceder a varios modelos de programación a través de un único punto de entrada. Todos los modelos comparten la misma cuenta de Harogo, la misma clave de API y la misma cuota de suscripción — no necesitas registrarte ni recargar saldo por separado en varias plataformas de modelos.

Por qué Harogo

Distintos modelos destacan en distintas tareas de programación. Usar varios proveedores de modelos directamente suele implicar gestionar múltiples cuentas, claves de API, saldos, límites de velocidad y facturas.

Harogo conecta un conjunto de modelos adecuados para agentes de programación detrás de un único servicio. Puedes cambiar de modelo según la tarea, y cada llamada se factura contra la misma cuota compartida.

Los modelos actuales se agrupan aproximadamente así:

  • Kimi K3, Claude Opus 5, GPT-5.6 Sol — indicados para bases de código grandes, tareas de contexto extenso y razonamiento de alta dificultad.
  • Qwen3.8 Max, GLM-5.2, Claude Sonnet 5, GPT-5.6 Terra, MiniMax M3, DeepSeek V4 Pro — indicados para programación de agentes del día a día, generación de código y depuración.
  • DeepSeek V4 Flash, Claude Haiku 4.5, GPT-5.6 Luna — indicados para llamadas de alta frecuencia, respuestas rápidas y tareas sensibles al costo.
  • Claude Fable 5 — indicado para flujos de trabajo de agentes de varios pasos y larga duración.

Estas agrupaciones son solo un punto de partida para elegir un modelo. Los resultados reales dependen de la tarea específica, el contexto y cómo se usen las herramientas.

Primeros pasos

  1. Inicia sesión en Harogo y completa tu suscripción.
  2. Crea y copia una clave de API en la consola.
  3. Configura la URL base como https://api.harogo.ai.
  4. Pega la clave de API.
  5. Empieza a usarlo.

Nota

Mantén tu clave de API en un lugar seguro. No la subas a un repositorio público ni la compartas con nadie.

Modelos compatibles

Modelos compatibles actualmente:

ModeloID del modeloIdeal para
GLM-5.2glm-5.2Tareas de larga duración, bases de código grandes y programación de agentes
Qwen3.8 Maxqwen3.8-max-previewRazonamiento complejo, comprensión visual y llamada a herramientas integrada
Kimi K3kimi-k3Programación compleja, contexto extenso, tareas de agentes
MiniMax M3minimax-m3Programación de alta frecuencia, llamada a herramientas, contexto extenso
DeepSeek V4 Prodeepseek-v4-proRazonamiento y generación de código complejo
DeepSeek V4 Flashdeepseek-v4-flash-0731Finalizaciones rápidas, llamadas de alta frecuencia y tareas por lotes
Claude Opus 5claude-opus-5Programación de agentes compleja y tareas de ingeniería de alta dificultad
Claude Sonnet 5claude-sonnet-5Programación diaria y tareas generales de desarrollo
Claude Fable 5claude-fable-5Tareas de agentes complejas y de larga duración
Claude Haiku 4.5claude-haiku-4-5Respuestas rápidas, tareas ligeras y procesamiento por lotes
GPT-5.6 Lunagpt-5.6-lunaProgramación de alta frecuencia y tareas ligeras
GPT-5.6 Solgpt-5.6-solGeneración de código de alta dificultad, revisión y razonamiento
GPT-5.6 Terragpt-5.6-terraProgramación de agentes diaria y tareas generales

Los nombres e IDs de los modelos anteriores son los identificadores de enrutamiento que usa Harogo. La lista de modelos, las versiones y la disponibilidad pueden cambiar — consulta lo que se muestra realmente en la consola.

Uso y límites

Harogo aplica los siguientes límites de uso:

Límite diario
$12
Límite semanal
$30
Límite mensual
$60

Los tres límites se aplican al mismo tiempo. Cada llamada a un modelo consume de la cuota de suscripción compartida, y algunos modelos tienen un tope de uso máximo más bajo — consulta la tabla de precios más abajo para más detalles.

Los límites se definen por valor en dólares, no por un número fijo de solicitudes. El número real de solicitudes que obtienes depende del modelo que uses — los modelos más económicos suelen permitir más solicitudes, y los modelos más caros permiten menos.

Puedes consultar tu uso actual y tu cuota restante en la consola de Harogo.

Volumen estimado de solicitudes

La siguiente tabla muestra los recuentos estimados de solicitudes según los patrones de uso típicos de Harogo:

ModeloPor día ($12)Por semana ($30)Por mes ($60)
Kimi K31,0402,6005,200
Claude Opus 53007501,500
GPT-5.6 Sol1,1302,8205,630
Qwen3.8 Max3,9609,90019,800
GLM-5.27,92019,79039,580
Claude Sonnet 52,3505,88011,760
GPT-5.6 Terra2,6406,60013,200
MiniMax M327,46068,650137,300
DeepSeek V4 Pro34,25085,640171,270
DeepSeek V4 Flash316,290790,7201,581,440
Claude Haiku 4.518,05045,11090,230
GPT-5.6 Luna2,0605,15010,300
Claude Fable 52205601,110

Cada fila asume que la cuota de ese período se usa principalmente en el modelo correspondiente. Al combinar varios modelos, todos consumen la misma cuota compartida, por lo que los recuentos de solicitudes entre modelos no se pueden simplemente sumar.

Los recuentos reales de solicitudes varían según la longitud del contexto, la tasa de aciertos de caché, el esfuerzo de razonamiento y la longitud de la salida. Un agente de programación también puede emitir varias solicitudes al modelo para una sola tarea, por lo que una solicitud no equivale a una tarea de programación completa.

Metodología de estimación

Las estimaciones se basan en los siguientes patrones de solicitud típicos:

  • GLM-5.2 — aproximadamente 700 tokens de entrada, 52,000 tokens de lectura de caché y 150 tokens de salida por solicitud.
  • Qwen3.8 Max — aproximadamente 8,731 tokens de entrada, 31,831 tokens de lectura de caché y 2,029 tokens de salida por solicitud.
  • Kimi K3 — aproximadamente 1,050 tokens de entrada, 76,500 tokens de lectura de caché y 300 tokens de salida por solicitud.
  • MiniMax M3 — aproximadamente 4,381 tokens de entrada, 28,768 tokens de lectura de caché y 1,108 tokens de salida por solicitud.
  • DeepSeek V4 Pro — aproximadamente 750 tokens de entrada, 82,000 tokens de lectura de caché y 290 tokens de salida por solicitud.
  • DeepSeek V4 Flash — aproximadamente 790 tokens de entrada, 68,000 tokens de lectura de caché y 280 tokens de salida por solicitud.
  • Claude Opus 5 — aproximadamente 580 tokens de entrada, 386,230 tokens de lectura de caché, 19,476 tokens de escritura de caché y 2,025 tokens de salida por solicitud.
  • Claude Sonnet 5 — aproximadamente 159 tokens de entrada, 129,804 tokens de lectura de caché, 6,260 tokens de escritura de caché y 850 tokens de salida por solicitud.
  • Claude Fable 5 — aproximadamente 399 tokens de entrada, 315,393 tokens de lectura de caché, 12,907 tokens de escritura de caché y 1,016 tokens de salida por solicitud.
  • Claude Haiku 4.5 — aproximadamente 700 tokens de entrada, 52,000 tokens de lectura de caché y 150 tokens de salida por solicitud.
  • GPT-5.6 Luna — aproximadamente 45,726 tokens de entrada, 10,720 tokens de lectura de caché y 1,905 tokens de salida por solicitud.
  • GPT-5.6 Sol — aproximadamente 6,032 tokens de entrada, 112,138 tokens de lectura de caché y 678 tokens de salida por solicitud.
  • GPT-5.6 Terra — aproximadamente 6,825 tokens de entrada, 69,476 tokens de lectura de caché y 734 tokens de salida por solicitud.

Qwen3.8 Max, MiniMax M3 y las familias Claude y GPT-5.6 usan estructuras de solicitud promedio observadas. Los demás modelos usan una estructura de solicitud de programación típica. Claude Opus 5 actualmente toma como referencia datos de uso reales de modelos de nivel Opus con el mismo precio.

Estas cifras se usan para estimar el uso típico y no constituyen un compromiso de un número fijo de solicitudes.

Precios de los modelos y topes de uso

La siguiente tabla muestra el precio de referencia de la API de cada modelo por 1 millón de tokens, junto con el tope de uso que Harogo aplica a ese modelo.

ModeloID del modeloEntrada / 1MSalida / 1MLectura de caché / 1MTope de uso
Kimi K3kimi-k3$3.00$15.00$0.30$15
Claude Opus 5claude-opus-5$5.00$25.00$0.50$60
GPT-5.6 Solgpt-5.6-sol$5.00$30.00$0.50$60
Qwen3.8 Maxqwen3.8-max-preview$1.69$5.03$0.17$60
GLM-5.2glm-5.2$1.40$4.40$0.26$60
Claude Sonnet 5claude-sonnet-5$2.00$10.00$0.20$60
GPT-5.6 Terragpt-5.6-terra$2.50$15.00$0.25$60
MiniMax M3minimax-m3$0.30$1.20$0.06$60
DeepSeek V4 Prodeepseek-v4-pro$0.44$0.87$15
DeepSeek V4 Flashdeepseek-v4-flash-0731$0.14$0.28$60
Claude Haiku 4.5claude-haiku-4-5$1.00$5.00$0.10$60
GPT-5.6 Lunagpt-5.6-luna$1.00$6.00$0.10$60
Claude Fable 5claude-fable-5$10.00$50.00$1.00$60

"—" significa que el elemento no se factura por separado en este momento, o que no aplica a ese modelo.

Los recuentos estimados de solicitudes se calculan combinando el precio del modelo, la estructura de solicitud típica, datos reales de uso y el tope de uso de cada modelo. Los precios y la disponibilidad de los modelos en vista previa pueden cambiar.

Los precios de los modelos, los topes de uso y los recuentos estimados de solicitudes pueden cambiar a medida que el servicio evoluciona — consulta la consola de Harogo y la versión actual de esta página para conocer los últimos detalles.