Documentazione Harogo
Harogo è un servizio in abbonamento multi-modello per agenti di coding. Questa pagina illustra cosa è incluso, come configurarlo, quali modelli sono supportati e come funzionano i limiti di utilizzo.
Introduzione
Harogo è un servizio in abbonamento multi-modello per agenti di coding.
Il prezzo scontato dell'abbonamento è $4.90/mese per un periodo limitato, poi $9.90/mese una volta terminata l'offerta. Sono attualmente disponibili 100 posti in abbonamento scontati — i posti rimanenti e il prezzo di liquidazione esatto mostrati nella pagina di abbonamento sono quelli ufficiali.
Dopo l'abbonamento, puoi accedere a più modelli di coding attraverso un unico punto di accesso. Tutti i modelli condividono lo stesso account Harogo, la stessa chiave API e la stessa quota di abbonamento — non è necessario registrarsi o ricaricare più piattaforme di modelli separatamente.
Perché Harogo
Modelli diversi eccellono in compiti di coding diversi. Usare più provider di modelli direttamente di solito significa gestire più account, chiavi API, saldi, limiti di frequenza e fatture.
Harogo riunisce un insieme di modelli adatti agli agenti di coding dietro un unico servizio. Puoi cambiare modello in base al task, e ogni chiamata viene fatturata sulla stessa quota condivisa.
Attualmente i modelli si dividono all'incirca in questi gruppi:
- Kimi K3, Claude Opus 5, GPT-5.6 Sol — adatti a codebase estese, task con contesto lungo e ragionamento ad alta difficoltà.
- Qwen3.8 Max, GLM-5.2, Claude Sonnet 5, GPT-5.6 Terra, MiniMax M3, DeepSeek V4 Pro — adatti al coding quotidiano per agenti, alla generazione di codice e al debug.
- DeepSeek V4 Flash, Claude Haiku 4.5, GPT-5.6 Luna — adatti a chiamate ad alta frequenza, risposte rapide e task sensibili ai costi.
- Claude Fable 5 — adatto a flussi di lavoro per agenti multi-step e di lunga durata.
Questi raggruppamenti sono solo un punto di partenza per la scelta del modello. I risultati effettivi dipendono dal task specifico, dal contesto e da come vengono usati gli strumenti.
Primi passi
- Accedi a Harogo e completa l'abbonamento.
- Crea e copia una chiave API nella console.
- Imposta il Base URL su https://api.harogo.ai.
- Incolla la chiave API.
- Inizia a usarla.
Nota
Mantieni al sicuro la tua chiave API. Non includerla in un repository pubblico né condividerla con nessun altro.
Modelli supportati
Modelli attualmente supportati:
| Modello | ID modello | Ideale per |
|---|---|---|
| GLM-5.2 | glm-5.2 | Task di lunga durata, codebase estese e coding per agenti |
| Qwen3.8 Max | qwen3.8-max-preview | Ragionamento complesso, comprensione visiva e chiamate a strumenti integrate |
| Kimi K3 | kimi-k3 | Coding complesso, contesto lungo, task per agenti |
| MiniMax M3 | minimax-m3 | Coding ad alta frequenza, chiamate a strumenti, contesto lungo |
| DeepSeek V4 Pro | deepseek-v4-pro | Ragionamento e generazione di codice complessa |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | Completamenti rapidi, chiamate ad alta frequenza e task in batch |
| Claude Opus 5 | claude-opus-5 | Coding complesso per agenti e task di ingegneria ad alta difficoltà |
| Claude Sonnet 5 | claude-sonnet-5 | Coding quotidiano e task di sviluppo generale |
| Claude Fable 5 | claude-fable-5 | Task complessi per agenti, di lunga durata |
| Claude Haiku 4.5 | claude-haiku-4-5 | Risposte rapide, task leggeri ed elaborazione in batch |
| GPT-5.6 Luna | gpt-5.6-luna | Coding ad alta frequenza e task leggeri |
| GPT-5.6 Sol | gpt-5.6-sol | Generazione di codice ad alta difficoltà, revisione e ragionamento |
| GPT-5.6 Terra | gpt-5.6-terra | Coding quotidiano per agenti e task generali |
I nomi e gli ID dei modelli sopra riportati sono gli identificatori di instradamento usati da Harogo. L'elenco dei modelli, le versioni e la disponibilità possono cambiare — fai riferimento a quanto effettivamente mostrato nella console.
Utilizzo e limiti
Harogo applica i seguenti limiti di utilizzo:
Tutti e tre i limiti vengono applicati contemporaneamente. Ogni chiamata al modello attinge dalla quota di abbonamento condivisa, e alcuni modelli hanno un limite massimo di utilizzo inferiore — vedi la tabella dei prezzi qui sotto per i dettagli.
I limiti sono definiti in valore in dollari, non in un numero fisso di richieste. Il numero effettivo di richieste che ottieni dipende dal modello che usi — i modelli meno costosi generalmente consentono più richieste, mentre quelli più costosi ne consentono meno.
Puoi verificare l'utilizzo attuale e la quota residua nella console di Harogo.
Volume di richieste stimato
La tabella seguente riporta i conteggi di richieste stimati in base a pattern di utilizzo tipici di Harogo:
| Modello | Al giorno ($12) | Alla settimana ($30) | Al mese ($60) |
|---|---|---|---|
| Kimi K3 | 1,040 | 2,600 | 5,200 |
| Claude Opus 5 | 300 | 750 | 1,500 |
| GPT-5.6 Sol | 1,130 | 2,820 | 5,630 |
| Qwen3.8 Max | 3,960 | 9,900 | 19,800 |
| GLM-5.2 | 7,920 | 19,790 | 39,580 |
| Claude Sonnet 5 | 2,350 | 5,880 | 11,760 |
| GPT-5.6 Terra | 2,640 | 6,600 | 13,200 |
| MiniMax M3 | 27,460 | 68,650 | 137,300 |
| DeepSeek V4 Pro | 34,250 | 85,640 | 171,270 |
| DeepSeek V4 Flash | 316,290 | 790,720 | 1,581,440 |
| Claude Haiku 4.5 | 18,050 | 45,110 | 90,230 |
| GPT-5.6 Luna | 2,060 | 5,150 | 10,300 |
| Claude Fable 5 | 220 | 560 | 1,110 |
Ogni riga presuppone che la quota per quel periodo venga usata principalmente sul modello corrispondente. Quando si usano più modelli insieme, questi attingono dalla stessa quota condivisa, quindi i conteggi di richieste tra modelli diversi non possono semplicemente essere sommati.
I conteggi effettivi delle richieste variano in base alla lunghezza del contesto, al tasso di cache hit, allo sforzo di ragionamento e alla lunghezza dell'output. Un agente di coding può inoltre effettuare più richieste al modello per un singolo task, quindi una richiesta non corrisponde a un task di coding completo.
Metodologia di stima
Le stime si basano sui seguenti pattern di richiesta tipici:
- GLM-5.2 — circa 700 token di input, 52,000 token di cache-read e 150 token di output per richiesta.
- Qwen3.8 Max — circa 8,731 token di input, 31,831 token di cache-read e 2,029 token di output per richiesta.
- Kimi K3 — circa 1,050 token di input, 76,500 token di cache-read e 300 token di output per richiesta.
- MiniMax M3 — circa 4,381 token di input, 28,768 token di cache-read e 1,108 token di output per richiesta.
- DeepSeek V4 Pro — circa 750 token di input, 82,000 token di cache-read e 290 token di output per richiesta.
- DeepSeek V4 Flash — circa 790 token di input, 68,000 token di cache-read e 280 token di output per richiesta.
- Claude Opus 5 — circa 580 token di input, 386,230 token di cache-read, 19,476 token di cache-write e 2,025 token di output per richiesta.
- Claude Sonnet 5 — circa 159 token di input, 129,804 token di cache-read, 6,260 token di cache-write e 850 token di output per richiesta.
- Claude Fable 5 — circa 399 token di input, 315,393 token di cache-read, 12,907 token di cache-write e 1,016 token di output per richiesta.
- Claude Haiku 4.5 — circa 700 token di input, 52,000 token di cache-read e 150 token di output per richiesta.
- GPT-5.6 Luna — circa 45,726 token di input, 10,720 token di cache-read e 1,905 token di output per richiesta.
- GPT-5.6 Sol — circa 6,032 token di input, 112,138 token di cache-read e 678 token di output per richiesta.
- GPT-5.6 Terra — circa 6,825 token di input, 69,476 token di cache-read e 734 token di output per richiesta.
Qwen3.8 Max, MiniMax M3 e le famiglie Claude e GPT-5.6 utilizzano strutture di richiesta medie osservate. Gli altri modelli utilizzano una struttura di richiesta tipica per il coding. Claude Opus 5 fa attualmente riferimento a dati di utilizzo reali dei modelli di fascia Opus allo stesso livello di prezzo.
Questi dati vengono usati per stimare l'utilizzo tipico e non costituiscono un impegno relativo a un numero fisso di richieste.
Prezzi dei modelli e limiti di utilizzo
La tabella seguente riporta il prezzo di riferimento API di ciascun modello per 1 milione di token, insieme al limite di utilizzo che Harogo applica a quel modello.
| Modello | ID modello | Input / 1M | Output / 1M | Cache read / 1M | Limite di utilizzo |
|---|---|---|---|---|---|
| Kimi K3 | kimi-k3 | $3.00 | $15.00 | $0.30 | $15 |
| Claude Opus 5 | claude-opus-5 | $5.00 | $25.00 | $0.50 | $60 |
| GPT-5.6 Sol | gpt-5.6-sol | $5.00 | $30.00 | $0.50 | $60 |
| Qwen3.8 Max | qwen3.8-max-preview | $1.69 | $5.03 | $0.17 | $60 |
| GLM-5.2 | glm-5.2 | $1.40 | $4.40 | $0.26 | $60 |
| Claude Sonnet 5 | claude-sonnet-5 | $2.00 | $10.00 | $0.20 | $60 |
| GPT-5.6 Terra | gpt-5.6-terra | $2.50 | $15.00 | $0.25 | $60 |
| MiniMax M3 | minimax-m3 | $0.30 | $1.20 | $0.06 | $60 |
| DeepSeek V4 Pro | deepseek-v4-pro | $0.44 | $0.87 | — | $15 |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | $0.14 | $0.28 | — | $60 |
| Claude Haiku 4.5 | claude-haiku-4-5 | $1.00 | $5.00 | $0.10 | $60 |
| GPT-5.6 Luna | gpt-5.6-luna | $1.00 | $6.00 | $0.10 | $60 |
| Claude Fable 5 | claude-fable-5 | $10.00 | $50.00 | $1.00 | $60 |
"—" indica che al momento la voce non viene fatturata separatamente, oppure che non si applica a quel modello.
I conteggi di richieste stimati sono calcolati combinando i prezzi dei modelli, la struttura di richiesta tipica, dati di utilizzo reali e il limite di utilizzo di ciascun modello. I prezzi e la disponibilità dei modelli in anteprima possono cambiare.
I prezzi dei modelli, i limiti di utilizzo e i conteggi di richieste stimati possono cambiare con l'evoluzione del servizio — fai riferimento alla console di Harogo e alla versione attuale di questa pagina per i dettagli più aggiornati.