Dokumentacja Harogo
Harogo to wielomodelowa usługa subskrypcyjna dla agentów kodujących. Ta strona opisuje, co obejmuje subskrypcja, jak skonfigurować dostęp, które modele są obsługiwane i jak działają limity wykorzystania.
Wprowadzenie
Harogo to wielomodelowa usługa subskrypcyjna dla agentów kodujących.
Zniżkowa cena subskrypcji wynosi $4.90/miesiąc przez ograniczony czas, a następnie $9.90/miesiąc po zakończeniu oferty. Obecnie dostępnych jest 100 zniżkowych miejsc subskrypcji — wiążące są liczba pozostałych miejsc i dokładna cena rozliczeniowa pokazane na stronie subskrypcji.
Po subskrypcji uzyskujesz dostęp do wielu modeli do kodowania przez jeden punkt dostępu. Wszystkie modele współdzielą to samo konto Harogo, klucz API i limit subskrypcji — nie ma potrzeby osobnej rejestracji ani doładowywania wielu platform modeli.
Dlaczego Harogo
Różne modele sprawdzają się w różnych zadaniach programistycznych. Korzystanie bezpośrednio z kilku dostawców modeli zwykle oznacza zarządzanie wieloma kontami, kluczami API, saldami, limitami zapytań i rachunkami.
Harogo łączy zestaw modeli dostosowanych do agentów kodujących za jedną usługą. Możesz przełączać modele w zależności od zadania, a każde wywołanie jest rozliczane z tego samego wspólnego limitu.
Obecne modele dzielą się w przybliżeniu na następujące grupy:
- Kimi K3, Claude Opus 5, GPT-5.6 Sol — odpowiednie do dużych baz kodu, zadań z długim kontekstem i wymagających zadań rozumowania.
- Qwen3.8 Max, GLM-5.2, Claude Sonnet 5, GPT-5.6 Terra, MiniMax M3, DeepSeek V4 Pro — odpowiednie do codziennego kodowania agentowego, generowania kodu i debugowania.
- DeepSeek V4 Flash, Claude Haiku 4.5, GPT-5.6 Luna — odpowiednie do wywołań o wysokiej częstotliwości, szybkich odpowiedzi i zadań wrażliwych na koszty.
- Claude Fable 5 — odpowiedni do dłuższych, wieloetapowych przepływów pracy agentów.
Te podziały to jedynie punkt wyjścia przy wyborze modelu. Rzeczywiste wyniki zależą od konkretnego zadania, kontekstu i sposobu korzystania z narzędzi.
Pierwsze kroki
- Zaloguj się do Harogo i dokończ subskrypcję.
- Utwórz i skopiuj klucz API w konsoli.
- Ustaw Base URL na https://api.harogo.ai.
- Wklej klucz API.
- Zacznij korzystać.
Uwaga
Zachowaj klucz API w bezpiecznym miejscu. Nie umieszczaj go w publicznym repozytorium ani nie udostępniaj go nikomu innemu.
Obsługiwane modele
Obecnie obsługiwane modele:
| Model | Identyfikator modelu | Najlepszy do |
|---|---|---|
| GLM-5.2 | glm-5.2 | Długich zadań, dużych baz kodu i kodowania agentowego |
| Qwen3.8 Max | qwen3.8-max-preview | Złożonego rozumowania, rozumienia obrazów i wbudowanych wywołań narzędzi |
| Kimi K3 | kimi-k3 | Złożonego kodowania, długiego kontekstu, zadań agentowych |
| MiniMax M3 | minimax-m3 | Kodowania o wysokiej częstotliwości, wywołań narzędzi, długiego kontekstu |
| DeepSeek V4 Pro | deepseek-v4-pro | Rozumowania i złożonego generowania kodu |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | Szybkich odpowiedzi, wywołań o wysokiej częstotliwości i zadań wsadowych |
| Claude Opus 5 | claude-opus-5 | Złożonego kodowania agentowego i trudnych zadań inżynierskich |
| Claude Sonnet 5 | claude-sonnet-5 | Codziennego kodowania i ogólnych zadań deweloperskich |
| Claude Fable 5 | claude-fable-5 | Dłuższych, złożonych zadań agentowych |
| Claude Haiku 4.5 | claude-haiku-4-5 | Szybkich odpowiedzi, lekkich zadań i przetwarzania wsadowego |
| GPT-5.6 Luna | gpt-5.6-luna | Kodowania o wysokiej częstotliwości i lekkich zadań |
| GPT-5.6 Sol | gpt-5.6-sol | Trudnego generowania kodu, przeglądu i rozumowania |
| GPT-5.6 Terra | gpt-5.6-terra | Codziennego kodowania agentowego i zadań ogólnych |
Nazwy i identyfikatory modeli powyżej to identyfikatory routingu używane przez Harogo. Lista modeli, wersje i dostępność mogą się zmieniać — odnoś się do tego, co faktycznie widać w konsoli.
Wykorzystanie i limity
Harogo egzekwuje następujące limity wykorzystania:
Wszystkie trzy limity są egzekwowane jednocześnie. Każde wywołanie modelu korzysta ze wspólnego limitu subskrypcji, a niektóre modele mają niższy maksymalny limit wykorzystania — szczegóły znajdziesz w tabeli cennika poniżej.
Limity są określone wartością w dolarach, a nie stałą liczbą zapytań. Rzeczywista liczba otrzymanych zapytań zależy od używanego modelu — tańsze modele zazwyczaj pozwalają na więcej zapytań, a droższe modele — na mniej.
Bieżące wykorzystanie i pozostały limit możesz sprawdzić w konsoli Harogo.
Szacowany wolumen zapytań
Poniższa tabela podaje szacowaną liczbę zapytań opartą na typowych wzorcach wykorzystania Harogo:
| Model | Dziennie ($12) | Tygodniowo ($30) | Miesięcznie ($60) |
|---|---|---|---|
| Kimi K3 | 1,040 | 2,600 | 5,200 |
| Claude Opus 5 | 300 | 750 | 1,500 |
| GPT-5.6 Sol | 1,130 | 2,820 | 5,630 |
| Qwen3.8 Max | 3,960 | 9,900 | 19,800 |
| GLM-5.2 | 7,920 | 19,790 | 39,580 |
| Claude Sonnet 5 | 2,350 | 5,880 | 11,760 |
| GPT-5.6 Terra | 2,640 | 6,600 | 13,200 |
| MiniMax M3 | 27,460 | 68,650 | 137,300 |
| DeepSeek V4 Pro | 34,250 | 85,640 | 171,270 |
| DeepSeek V4 Flash | 316,290 | 790,720 | 1,581,440 |
| Claude Haiku 4.5 | 18,050 | 45,110 | 90,230 |
| GPT-5.6 Luna | 2,060 | 5,150 | 10,300 |
| Claude Fable 5 | 220 | 560 | 1,110 |
Każdy wiersz zakłada, że limit na dany okres jest wykorzystywany głównie na odpowiadający mu model. Przy korzystaniu z wielu modeli naraz, korzystają one wspólnie z tego samego limitu, więc liczby zapytań poszczególnych modeli nie można po prostu zsumować.
Rzeczywista liczba zapytań zależy od długości kontekstu, współczynnika trafień w pamięć podręczną, wysiłku rozumowania i długości odpowiedzi. Agent kodujący może też wykonywać wiele wywołań modelu w ramach jednego zadania, więc jedno zapytanie nie jest równoznaczne z jednym ukończonym zadaniem programistycznym.
Metodologia szacowania
Szacunki opierają się na następujących typowych wzorcach zapytań:
- GLM-5.2 — około 700 tokenów wejściowych, 52,000 tokenów odczytu z pamięci podręcznej i 150 tokenów wyjściowych na zapytanie.
- Qwen3.8 Max — około 8,731 tokenów wejściowych, 31,831 tokenów odczytu z pamięci podręcznej i 2,029 tokenów wyjściowych na zapytanie.
- Kimi K3 — około 1,050 tokenów wejściowych, 76,500 tokenów odczytu z pamięci podręcznej i 300 tokenów wyjściowych na zapytanie.
- MiniMax M3 — około 4,381 tokenów wejściowych, 28,768 tokenów odczytu z pamięci podręcznej i 1,108 tokenów wyjściowych na zapytanie.
- DeepSeek V4 Pro — około 750 tokenów wejściowych, 82,000 tokenów odczytu z pamięci podręcznej i 290 tokenów wyjściowych na zapytanie.
- DeepSeek V4 Flash — około 790 tokenów wejściowych, 68,000 tokenów odczytu z pamięci podręcznej i 280 tokenów wyjściowych na zapytanie.
- Claude Opus 5 — około 580 tokenów wejściowych, 386,230 tokenów odczytu z pamięci podręcznej, 19,476 tokenów zapisu do pamięci podręcznej i 2,025 tokenów wyjściowych na zapytanie.
- Claude Sonnet 5 — około 159 tokenów wejściowych, 129,804 tokenów odczytu z pamięci podręcznej, 6,260 tokenów zapisu do pamięci podręcznej i 850 tokenów wyjściowych na zapytanie.
- Claude Fable 5 — około 399 tokenów wejściowych, 315,393 tokenów odczytu z pamięci podręcznej, 12,907 tokenów zapisu do pamięci podręcznej i 1,016 tokenów wyjściowych na zapytanie.
- Claude Haiku 4.5 — około 700 tokenów wejściowych, 52,000 tokenów odczytu z pamięci podręcznej i 150 tokenów wyjściowych na zapytanie.
- GPT-5.6 Luna — około 45,726 tokenów wejściowych, 10,720 tokenów odczytu z pamięci podręcznej i 1,905 tokenów wyjściowych na zapytanie.
- GPT-5.6 Sol — około 6,032 tokenów wejściowych, 112,138 tokenów odczytu z pamięci podręcznej i 678 tokenów wyjściowych na zapytanie.
- GPT-5.6 Terra — około 6,825 tokenów wejściowych, 69,476 tokenów odczytu z pamięci podręcznej i 734 tokenów wyjściowych na zapytanie.
Qwen3.8 Max, MiniMax M3 oraz rodziny modeli Claude i GPT-5.6 wykorzystują obserwowane średnie struktury zapytań. Pozostałe modele wykorzystują typową strukturę zapytania kodującego. Claude Opus 5 obecnie odwołuje się do rzeczywistych danych o wykorzystaniu modeli klasy Opus w tym samym punkcie cenowym.
Te dane służą do szacowania typowego wykorzystania i nie stanowią zobowiązania do stałej liczby zapytań.
Cennik modeli i limity wykorzystania
Poniższa tabela zawiera referencyjną cenę API każdego modelu za 1 milion tokenów wraz z limitem wykorzystania stosowanym przez Harogo dla danego modelu.
| Model | Identyfikator modelu | Wejście / 1M | Wyjście / 1M | Odczyt z cache / 1M | Limit wykorzystania |
|---|---|---|---|---|---|
| Kimi K3 | kimi-k3 | $3.00 | $15.00 | $0.30 | $15 |
| Claude Opus 5 | claude-opus-5 | $5.00 | $25.00 | $0.50 | $60 |
| GPT-5.6 Sol | gpt-5.6-sol | $5.00 | $30.00 | $0.50 | $60 |
| Qwen3.8 Max | qwen3.8-max-preview | $1.69 | $5.03 | $0.17 | $60 |
| GLM-5.2 | glm-5.2 | $1.40 | $4.40 | $0.26 | $60 |
| Claude Sonnet 5 | claude-sonnet-5 | $2.00 | $10.00 | $0.20 | $60 |
| GPT-5.6 Terra | gpt-5.6-terra | $2.50 | $15.00 | $0.25 | $60 |
| MiniMax M3 | minimax-m3 | $0.30 | $1.20 | $0.06 | $60 |
| DeepSeek V4 Pro | deepseek-v4-pro | $0.44 | $0.87 | — | $15 |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | $0.14 | $0.28 | — | $60 |
| Claude Haiku 4.5 | claude-haiku-4-5 | $1.00 | $5.00 | $0.10 | $60 |
| GPT-5.6 Luna | gpt-5.6-luna | $1.00 | $6.00 | $0.10 | $60 |
| Claude Fable 5 | claude-fable-5 | $10.00 | $50.00 | $1.00 | $60 |
Znak „—" oznacza, że dana pozycja nie jest obecnie rozliczana osobno lub nie dotyczy danego modelu.
Szacowana liczba zapytań jest obliczana na podstawie połączenia cennika modelu, typowej struktury zapytania, rzeczywistych danych o wykorzystaniu oraz limitu wykorzystania danego modelu. Cennik i dostępność modeli w wersji preview mogą się zmieniać.
Cennik modeli, limity wykorzystania i szacowana liczba zapytań mogą się zmieniać wraz z rozwojem usługi — najnowsze informacje znajdziesz w konsoli Harogo i w aktualnej wersji tej strony.