Ir para o conteúdo
Harogo
Modelos Preços Perguntas frequentes Documentação
English 日本語 한국어 Deutsch Español Français Русский Türkçe Polski Nederlands Italiano Tiếng Việt Українська Български 简体中文
Entrar Obter Harogo
Documentação

Documentação da Harogo

A Harogo é um serviço de assinatura multimodelo para agentes de programação. Esta página cobre o que está incluído, como configurar, quais modelos são suportados e como funcionam os limites de uso.

Introdução

A Harogo é um serviço de assinatura multimodelo para agentes de programação.

O preço promocional da assinatura é de $4.90/mês por tempo limitado, depois $9.90/mês quando a oferta terminar. Há 100 vagas de assinatura com desconto disponíveis no momento — as vagas restantes e o preço final exato exibidos na página de assinatura são a referência oficial.

Depois de assinar, você acessa vários modelos de programação por meio de um único ponto de entrada. Todos os modelos compartilham a mesma conta Harogo, chave de API e cota de assinatura — não é preciso se cadastrar ou recarregar saldo em várias plataformas de modelos separadamente.

Por que Harogo

Modelos diferentes se destacam em tarefas de programação diferentes. Usar vários provedores de modelos diretamente costuma significar gerenciar várias contas, chaves de API, saldos, limites de taxa e faturas.

A Harogo reúne um conjunto de modelos adequados para agentes de programação por trás de um único serviço. Você pode trocar de modelo conforme a tarefa, e cada chamada é cobrada da mesma cota compartilhada.

Atualmente, os modelos se dividem aproximadamente nestes grupos:

  • Kimi K3, Claude Opus 5, GPT-5.6 Sol — adequados para bases de código grandes, tarefas de contexto longo e raciocínio de alta dificuldade.
  • Qwen3.8 Max, GLM-5.2, Claude Sonnet 5, GPT-5.6 Terra, MiniMax M3, DeepSeek V4 Pro — adequados para programação de agentes do dia a dia, geração de código e depuração.
  • DeepSeek V4 Flash, Claude Haiku 4.5, GPT-5.6 Luna — adequados para chamadas de alta frequência, respostas rápidas e tarefas sensíveis a custo.
  • Claude Fable 5 — adequado para fluxos de trabalho de agentes de várias etapas e longa duração.

Esses agrupamentos são apenas um ponto de partida para escolher um modelo. Os resultados reais dependem da tarefa específica, do contexto e de como as ferramentas são usadas.

Primeiros passos

  1. Faça login na Harogo e conclua sua assinatura.
  2. Crie e copie uma chave de API no console.
  3. Defina a Base URL como https://api.harogo.ai.
  4. Cole a chave de API.
  5. Comece a usar.

Observação

Mantenha sua chave de API segura. Não a envie para um repositório público nem a compartilhe com mais ninguém.

Modelos suportados

Modelos atualmente suportados:

ModeloID do modeloIdeal para
GLM-5.2glm-5.2Tarefas longas, bases de código grandes e programação de agentes
Qwen3.8 Maxqwen3.8-max-previewRaciocínio complexo, compreensão visual e chamadas de ferramentas integradas
Kimi K3kimi-k3Programação complexa, contexto longo, tarefas de agente
MiniMax M3minimax-m3Programação de alta frequência, chamadas de ferramentas, contexto longo
DeepSeek V4 Prodeepseek-v4-proRaciocínio e geração de código complexa
DeepSeek V4 Flashdeepseek-v4-flash-0731Conclusões rápidas, chamadas de alta frequência e tarefas em lote
Claude Opus 5claude-opus-5Programação complexa de agentes e tarefas de engenharia de alta dificuldade
Claude Sonnet 5claude-sonnet-5Programação do dia a dia e tarefas gerais de desenvolvimento
Claude Fable 5claude-fable-5Tarefas de agente complexas e de longa duração
Claude Haiku 4.5claude-haiku-4-5Respostas rápidas, tarefas leves e processamento em lote
GPT-5.6 Lunagpt-5.6-lunaProgramação de alta frequência e tarefas leves
GPT-5.6 Solgpt-5.6-solGeração de código de alta dificuldade, revisão e raciocínio
GPT-5.6 Terragpt-5.6-terraProgramação de agentes do dia a dia e tarefas gerais

Os nomes e IDs de modelo acima são os identificadores de roteamento que a Harogo usa. A lista de modelos, versões e disponibilidade podem mudar — consulte o que é realmente exibido no console.

Uso e limites

A Harogo aplica os seguintes limites de uso:

Limite diário
$12
Limite semanal
$30
Limite mensal
$60

Os três limites são aplicados ao mesmo tempo. Cada chamada de modelo consome a cota de assinatura compartilhada, e alguns modelos têm um limite máximo de uso mais baixo — veja a tabela de preços abaixo para detalhes.

Os limites são definidos por valor em dólares, não por um número fixo de solicitações. O número real de solicitações que você obtém depende do modelo usado — modelos mais baratos geralmente permitem mais solicitações, e modelos mais caros permitem menos.

Você pode consultar seu uso atual e a cota restante no console da Harogo.

Volume estimado de solicitações

A tabela abaixo apresenta contagens estimadas de solicitações com base em padrões típicos de uso da Harogo:

ModeloPor dia ($12)Por semana ($30)Por mês ($60)
Kimi K31,0402,6005,200
Claude Opus 53007501,500
GPT-5.6 Sol1,1302,8205,630
Qwen3.8 Max3,9609,90019,800
GLM-5.27,92019,79039,580
Claude Sonnet 52,3505,88011,760
GPT-5.6 Terra2,6406,60013,200
MiniMax M327,46068,650137,300
DeepSeek V4 Pro34,25085,640171,270
DeepSeek V4 Flash316,290790,7201,581,440
Claude Haiku 4.518,05045,11090,230
GPT-5.6 Luna2,0605,15010,300
Claude Fable 52205601,110

Cada linha parte do princípio de que a cota daquele período é usada principalmente no modelo correspondente. Ao misturar vários modelos, eles consomem juntos a mesma cota compartilhada, então as contagens de solicitações entre modelos não podem simplesmente ser somadas.

As contagens reais de solicitações variam conforme o tamanho do contexto, a taxa de acerto de cache, o esforço de raciocínio e o tamanho da saída. Um agente de programação também pode fazer várias solicitações de modelo para uma única tarefa, então uma solicitação não equivale a uma tarefa de programação completa.

Metodologia de estimativa

As estimativas se baseiam nos seguintes padrões típicos de solicitação:

  • GLM-5.2 — cerca de 700 tokens de entrada, 52,000 tokens de leitura de cache e 150 tokens de saída por solicitação.
  • Qwen3.8 Max — cerca de 8,731 tokens de entrada, 31,831 tokens de leitura de cache e 2,029 tokens de saída por solicitação.
  • Kimi K3 — cerca de 1,050 tokens de entrada, 76,500 tokens de leitura de cache e 300 tokens de saída por solicitação.
  • MiniMax M3 — cerca de 4,381 tokens de entrada, 28,768 tokens de leitura de cache e 1,108 tokens de saída por solicitação.
  • DeepSeek V4 Pro — cerca de 750 tokens de entrada, 82,000 tokens de leitura de cache e 290 tokens de saída por solicitação.
  • DeepSeek V4 Flash — cerca de 790 tokens de entrada, 68,000 tokens de leitura de cache e 280 tokens de saída por solicitação.
  • Claude Opus 5 — cerca de 580 tokens de entrada, 386,230 tokens de leitura de cache, 19,476 tokens de escrita de cache e 2,025 tokens de saída por solicitação.
  • Claude Sonnet 5 — cerca de 159 tokens de entrada, 129,804 tokens de leitura de cache, 6,260 tokens de escrita de cache e 850 tokens de saída por solicitação.
  • Claude Fable 5 — cerca de 399 tokens de entrada, 315,393 tokens de leitura de cache, 12,907 tokens de escrita de cache e 1,016 tokens de saída por solicitação.
  • Claude Haiku 4.5 — cerca de 700 tokens de entrada, 52,000 tokens de leitura de cache e 150 tokens de saída por solicitação.
  • GPT-5.6 Luna — cerca de 45,726 tokens de entrada, 10,720 tokens de leitura de cache e 1,905 tokens de saída por solicitação.
  • GPT-5.6 Sol — cerca de 6,032 tokens de entrada, 112,138 tokens de leitura de cache e 678 tokens de saída por solicitação.
  • GPT-5.6 Terra — cerca de 6,825 tokens de entrada, 69,476 tokens de leitura de cache e 734 tokens de saída por solicitação.

Qwen3.8 Max, MiniMax M3 e as famílias Claude e GPT-5.6 usam estruturas médias de solicitação observadas. Os demais modelos usam uma estrutura de solicitação de programação típica. O Claude Opus 5 atualmente faz referência a dados reais de uso de modelos da categoria Opus na mesma faixa de preço.

Esses números são usados para estimar o uso típico e não constituem um compromisso com um número fixo de solicitações.

Preços e limites de uso por modelo

A tabela abaixo lista o preço de referência da API de cada modelo por 1 milhão de tokens, junto com o limite de uso que a Harogo aplica a esse modelo.

ModeloID do modeloEntrada / 1MSaída / 1MLeitura de cache / 1MLimite de uso
Kimi K3kimi-k3$3.00$15.00$0.30$15
Claude Opus 5claude-opus-5$5.00$25.00$0.50$60
GPT-5.6 Solgpt-5.6-sol$5.00$30.00$0.50$60
Qwen3.8 Maxqwen3.8-max-preview$1.69$5.03$0.17$60
GLM-5.2glm-5.2$1.40$4.40$0.26$60
Claude Sonnet 5claude-sonnet-5$2.00$10.00$0.20$60
GPT-5.6 Terragpt-5.6-terra$2.50$15.00$0.25$60
MiniMax M3minimax-m3$0.30$1.20$0.06$60
DeepSeek V4 Prodeepseek-v4-pro$0.44$0.87$15
DeepSeek V4 Flashdeepseek-v4-flash-0731$0.14$0.28$60
Claude Haiku 4.5claude-haiku-4-5$1.00$5.00$0.10$60
GPT-5.6 Lunagpt-5.6-luna$1.00$6.00$0.10$60
Claude Fable 5claude-fable-5$10.00$50.00$1.00$60

"—" significa que o item não é cobrado separadamente no momento, ou não se aplica a esse modelo.

As contagens estimadas de solicitações são calculadas a partir de uma combinação de preços de modelo, estrutura típica de solicitação, dados reais de uso e o limite de uso de cada modelo. Os preços e a disponibilidade dos modelos em pré-lançamento podem mudar.

Os preços dos modelos, os limites de uso e as contagens estimadas de solicitações podem mudar conforme o serviço evolui — consulte o console da Harogo e a versão atual desta página para os detalhes mais recentes.