Przejdź do treści
Harogo
Modele Cennik FAQ Dokumentacja
English 日本語 한국어 Deutsch Español Français Português Русский Türkçe Nederlands Italiano Tiếng Việt Українська Български 简体中文
Zaloguj się Wybierz Harogo
Dokumentacja

Dokumentacja Harogo

Harogo to wielomodelowa usługa subskrypcyjna dla agentów kodujących. Ta strona opisuje, co obejmuje subskrypcja, jak skonfigurować dostęp, które modele są obsługiwane i jak działają limity wykorzystania.

Wprowadzenie

Harogo to wielomodelowa usługa subskrypcyjna dla agentów kodujących.

Zniżkowa cena subskrypcji wynosi $4.90/miesiąc przez ograniczony czas, a następnie $9.90/miesiąc po zakończeniu oferty. Obecnie dostępnych jest 100 zniżkowych miejsc subskrypcji — wiążące są liczba pozostałych miejsc i dokładna cena rozliczeniowa pokazane na stronie subskrypcji.

Po subskrypcji uzyskujesz dostęp do wielu modeli do kodowania przez jeden punkt dostępu. Wszystkie modele współdzielą to samo konto Harogo, klucz API i limit subskrypcji — nie ma potrzeby osobnej rejestracji ani doładowywania wielu platform modeli.

Dlaczego Harogo

Różne modele sprawdzają się w różnych zadaniach programistycznych. Korzystanie bezpośrednio z kilku dostawców modeli zwykle oznacza zarządzanie wieloma kontami, kluczami API, saldami, limitami zapytań i rachunkami.

Harogo łączy zestaw modeli dostosowanych do agentów kodujących za jedną usługą. Możesz przełączać modele w zależności od zadania, a każde wywołanie jest rozliczane z tego samego wspólnego limitu.

Obecne modele dzielą się w przybliżeniu na następujące grupy:

  • Kimi K3, Claude Opus 5, GPT-5.6 Sol — odpowiednie do dużych baz kodu, zadań z długim kontekstem i wymagających zadań rozumowania.
  • Qwen3.8 Max, GLM-5.2, Claude Sonnet 5, GPT-5.6 Terra, MiniMax M3, DeepSeek V4 Pro — odpowiednie do codziennego kodowania agentowego, generowania kodu i debugowania.
  • DeepSeek V4 Flash, Claude Haiku 4.5, GPT-5.6 Luna — odpowiednie do wywołań o wysokiej częstotliwości, szybkich odpowiedzi i zadań wrażliwych na koszty.
  • Claude Fable 5 — odpowiedni do dłuższych, wieloetapowych przepływów pracy agentów.

Te podziały to jedynie punkt wyjścia przy wyborze modelu. Rzeczywiste wyniki zależą od konkretnego zadania, kontekstu i sposobu korzystania z narzędzi.

Pierwsze kroki

  1. Zaloguj się do Harogo i dokończ subskrypcję.
  2. Utwórz i skopiuj klucz API w konsoli.
  3. Ustaw Base URL na https://api.harogo.ai.
  4. Wklej klucz API.
  5. Zacznij korzystać.

Uwaga

Zachowaj klucz API w bezpiecznym miejscu. Nie umieszczaj go w publicznym repozytorium ani nie udostępniaj go nikomu innemu.

Obsługiwane modele

Obecnie obsługiwane modele:

ModelIdentyfikator modeluNajlepszy do
GLM-5.2glm-5.2Długich zadań, dużych baz kodu i kodowania agentowego
Qwen3.8 Maxqwen3.8-max-previewZłożonego rozumowania, rozumienia obrazów i wbudowanych wywołań narzędzi
Kimi K3kimi-k3Złożonego kodowania, długiego kontekstu, zadań agentowych
MiniMax M3minimax-m3Kodowania o wysokiej częstotliwości, wywołań narzędzi, długiego kontekstu
DeepSeek V4 Prodeepseek-v4-proRozumowania i złożonego generowania kodu
DeepSeek V4 Flashdeepseek-v4-flash-0731Szybkich odpowiedzi, wywołań o wysokiej częstotliwości i zadań wsadowych
Claude Opus 5claude-opus-5Złożonego kodowania agentowego i trudnych zadań inżynierskich
Claude Sonnet 5claude-sonnet-5Codziennego kodowania i ogólnych zadań deweloperskich
Claude Fable 5claude-fable-5Dłuższych, złożonych zadań agentowych
Claude Haiku 4.5claude-haiku-4-5Szybkich odpowiedzi, lekkich zadań i przetwarzania wsadowego
GPT-5.6 Lunagpt-5.6-lunaKodowania o wysokiej częstotliwości i lekkich zadań
GPT-5.6 Solgpt-5.6-solTrudnego generowania kodu, przeglądu i rozumowania
GPT-5.6 Terragpt-5.6-terraCodziennego kodowania agentowego i zadań ogólnych

Nazwy i identyfikatory modeli powyżej to identyfikatory routingu używane przez Harogo. Lista modeli, wersje i dostępność mogą się zmieniać — odnoś się do tego, co faktycznie widać w konsoli.

Wykorzystanie i limity

Harogo egzekwuje następujące limity wykorzystania:

Limit dzienny
$12
Limit tygodniowy
$30
Limit miesięczny
$60

Wszystkie trzy limity są egzekwowane jednocześnie. Każde wywołanie modelu korzysta ze wspólnego limitu subskrypcji, a niektóre modele mają niższy maksymalny limit wykorzystania — szczegóły znajdziesz w tabeli cennika poniżej.

Limity są określone wartością w dolarach, a nie stałą liczbą zapytań. Rzeczywista liczba otrzymanych zapytań zależy od używanego modelu — tańsze modele zazwyczaj pozwalają na więcej zapytań, a droższe modele — na mniej.

Bieżące wykorzystanie i pozostały limit możesz sprawdzić w konsoli Harogo.

Szacowany wolumen zapytań

Poniższa tabela podaje szacowaną liczbę zapytań opartą na typowych wzorcach wykorzystania Harogo:

ModelDziennie ($12)Tygodniowo ($30)Miesięcznie ($60)
Kimi K31,0402,6005,200
Claude Opus 53007501,500
GPT-5.6 Sol1,1302,8205,630
Qwen3.8 Max3,9609,90019,800
GLM-5.27,92019,79039,580
Claude Sonnet 52,3505,88011,760
GPT-5.6 Terra2,6406,60013,200
MiniMax M327,46068,650137,300
DeepSeek V4 Pro34,25085,640171,270
DeepSeek V4 Flash316,290790,7201,581,440
Claude Haiku 4.518,05045,11090,230
GPT-5.6 Luna2,0605,15010,300
Claude Fable 52205601,110

Każdy wiersz zakłada, że limit na dany okres jest wykorzystywany głównie na odpowiadający mu model. Przy korzystaniu z wielu modeli naraz, korzystają one wspólnie z tego samego limitu, więc liczby zapytań poszczególnych modeli nie można po prostu zsumować.

Rzeczywista liczba zapytań zależy od długości kontekstu, współczynnika trafień w pamięć podręczną, wysiłku rozumowania i długości odpowiedzi. Agent kodujący może też wykonywać wiele wywołań modelu w ramach jednego zadania, więc jedno zapytanie nie jest równoznaczne z jednym ukończonym zadaniem programistycznym.

Metodologia szacowania

Szacunki opierają się na następujących typowych wzorcach zapytań:

  • GLM-5.2 — około 700 tokenów wejściowych, 52,000 tokenów odczytu z pamięci podręcznej i 150 tokenów wyjściowych na zapytanie.
  • Qwen3.8 Max — około 8,731 tokenów wejściowych, 31,831 tokenów odczytu z pamięci podręcznej i 2,029 tokenów wyjściowych na zapytanie.
  • Kimi K3 — około 1,050 tokenów wejściowych, 76,500 tokenów odczytu z pamięci podręcznej i 300 tokenów wyjściowych na zapytanie.
  • MiniMax M3 — około 4,381 tokenów wejściowych, 28,768 tokenów odczytu z pamięci podręcznej i 1,108 tokenów wyjściowych na zapytanie.
  • DeepSeek V4 Pro — około 750 tokenów wejściowych, 82,000 tokenów odczytu z pamięci podręcznej i 290 tokenów wyjściowych na zapytanie.
  • DeepSeek V4 Flash — około 790 tokenów wejściowych, 68,000 tokenów odczytu z pamięci podręcznej i 280 tokenów wyjściowych na zapytanie.
  • Claude Opus 5 — około 580 tokenów wejściowych, 386,230 tokenów odczytu z pamięci podręcznej, 19,476 tokenów zapisu do pamięci podręcznej i 2,025 tokenów wyjściowych na zapytanie.
  • Claude Sonnet 5 — około 159 tokenów wejściowych, 129,804 tokenów odczytu z pamięci podręcznej, 6,260 tokenów zapisu do pamięci podręcznej i 850 tokenów wyjściowych na zapytanie.
  • Claude Fable 5 — około 399 tokenów wejściowych, 315,393 tokenów odczytu z pamięci podręcznej, 12,907 tokenów zapisu do pamięci podręcznej i 1,016 tokenów wyjściowych na zapytanie.
  • Claude Haiku 4.5 — około 700 tokenów wejściowych, 52,000 tokenów odczytu z pamięci podręcznej i 150 tokenów wyjściowych na zapytanie.
  • GPT-5.6 Luna — około 45,726 tokenów wejściowych, 10,720 tokenów odczytu z pamięci podręcznej i 1,905 tokenów wyjściowych na zapytanie.
  • GPT-5.6 Sol — około 6,032 tokenów wejściowych, 112,138 tokenów odczytu z pamięci podręcznej i 678 tokenów wyjściowych na zapytanie.
  • GPT-5.6 Terra — około 6,825 tokenów wejściowych, 69,476 tokenów odczytu z pamięci podręcznej i 734 tokenów wyjściowych na zapytanie.

Qwen3.8 Max, MiniMax M3 oraz rodziny modeli Claude i GPT-5.6 wykorzystują obserwowane średnie struktury zapytań. Pozostałe modele wykorzystują typową strukturę zapytania kodującego. Claude Opus 5 obecnie odwołuje się do rzeczywistych danych o wykorzystaniu modeli klasy Opus w tym samym punkcie cenowym.

Te dane służą do szacowania typowego wykorzystania i nie stanowią zobowiązania do stałej liczby zapytań.

Cennik modeli i limity wykorzystania

Poniższa tabela zawiera referencyjną cenę API każdego modelu za 1 milion tokenów wraz z limitem wykorzystania stosowanym przez Harogo dla danego modelu.

ModelIdentyfikator modeluWejście / 1MWyjście / 1MOdczyt z cache / 1MLimit wykorzystania
Kimi K3kimi-k3$3.00$15.00$0.30$15
Claude Opus 5claude-opus-5$5.00$25.00$0.50$60
GPT-5.6 Solgpt-5.6-sol$5.00$30.00$0.50$60
Qwen3.8 Maxqwen3.8-max-preview$1.69$5.03$0.17$60
GLM-5.2glm-5.2$1.40$4.40$0.26$60
Claude Sonnet 5claude-sonnet-5$2.00$10.00$0.20$60
GPT-5.6 Terragpt-5.6-terra$2.50$15.00$0.25$60
MiniMax M3minimax-m3$0.30$1.20$0.06$60
DeepSeek V4 Prodeepseek-v4-pro$0.44$0.87$15
DeepSeek V4 Flashdeepseek-v4-flash-0731$0.14$0.28$60
Claude Haiku 4.5claude-haiku-4-5$1.00$5.00$0.10$60
GPT-5.6 Lunagpt-5.6-luna$1.00$6.00$0.10$60
Claude Fable 5claude-fable-5$10.00$50.00$1.00$60

Znak „—" oznacza, że dana pozycja nie jest obecnie rozliczana osobno lub nie dotyczy danego modelu.

Szacowana liczba zapytań jest obliczana na podstawie połączenia cennika modelu, typowej struktury zapytania, rzeczywistych danych o wykorzystaniu oraz limitu wykorzystania danego modelu. Cennik i dostępność modeli w wersji preview mogą się zmieniać.

Cennik modeli, limity wykorzystania i szacowana liczba zapytań mogą się zmieniać wraz z rozwojem usługi — najnowsze informacje znajdziesz w konsoli Harogo i w aktualnej wersji tej strony.