Harogo ドキュメント
Harogoはコーディングエージェント向けのマルチモデルサブスクリプションサービスです。このページでは、含まれる内容、セットアップ方法、サポートするモデル、利用上限の仕組みについて説明します。
はじめに
Harogoはコーディングエージェント向けのマルチモデルサブスクリプションサービスです。
割引価格は期間限定で$4.90/月、オファー終了後は$9.90/月になります。現在、割引サブスクリプション枠を100枠ご用意しています — 残り枠数と正確な確定価格は、サブスクリプションページの表示が正式なものとなります。
サブスクリプション後は、1つの入口を通じて複数のコーディングモデルにアクセスできます。すべてのモデルは同じHarogoアカウント、APIキー、サブスクリプションクォータを共有するため、複数のモデルプラットフォームに個別に登録したりチャージしたりする必要はありません。
Harogoを選ぶ理由
モデルによって得意なコーディングタスクは異なります。複数のモデルプロバイダーを直接使うと、通常は複数のアカウント、APIキー、残高、レート制限、請求を管理することになります。
Harogoは、コーディングエージェントに適したモデル群を1つのサービスの背後にまとめて提供します。タスクに応じてモデルを切り替えられ、すべての呼び出しは同じ共有クォータに対して課金されます。
現在のモデルは、おおよそ次のグループに分類されます。
- Kimi K3、Claude Opus 5、GPT-5.6 Sol — 大規模なコードベース、長いコンテキストのタスク、高難度の推論に適しています。
- Qwen3.8 Max、GLM-5.2、Claude Sonnet 5、GPT-5.6 Terra、MiniMax M3、DeepSeek V4 Pro — 日常のエージェントコーディング、コード生成、デバッグに適しています。
- DeepSeek V4 Flash、Claude Haiku 4.5、GPT-5.6 Luna — 高頻度の呼び出し、高速な応答、コストを重視するタスクに適しています。
- Claude Fable 5 — より長時間にわたる、複数ステップのエージェントワークフローに適しています。
これらの分類はモデル選択の出発点にすぎません。実際の結果は具体的なタスク、コンテキスト、ツールの使い方によって異なります。
はじめ方
- Harogoにログインし、サブスクリプションを完了します。
- コンソールでAPIキーを作成し、コピーします。
- Base URLを https://api.harogo.ai に設定します。
- APIキーを貼り付けます。
- 利用を開始します。
注意
APIキーは安全に保管してください。公開リポジトリにコミットしたり、他人と共有したりしないでください。
サポートするモデル
現在サポートしているモデル:
| モデル | モデルID | 得意分野 |
|---|---|---|
| GLM-5.2 | glm-5.2 | 長時間タスク、大規模コードベース、エージェントコーディング |
| Qwen3.8 Max | qwen3.8-max-preview | 複雑な推論、視覚理解、組み込みツール呼び出し |
| Kimi K3 | kimi-k3 | 複雑なコーディング、長いコンテキスト、エージェントタスク |
| MiniMax M3 | minimax-m3 | 高頻度のコーディング、ツール呼び出し、長いコンテキスト |
| DeepSeek V4 Pro | deepseek-v4-pro | 推論と複雑なコード生成 |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | 高速な補完、高頻度の呼び出し、バッチ処理 |
| Claude Opus 5 | claude-opus-5 | 複雑なエージェントコーディングと高難度のエンジニアリングタスク |
| Claude Sonnet 5 | claude-sonnet-5 | 日常的なコーディングと一般的な開発タスク |
| Claude Fable 5 | claude-fable-5 | より長時間にわたる、複雑なエージェントタスク |
| Claude Haiku 4.5 | claude-haiku-4-5 | 高速な応答、軽量タスク、バッチ処理 |
| GPT-5.6 Luna | gpt-5.6-luna | 高頻度のコーディングと軽量タスク |
| GPT-5.6 Sol | gpt-5.6-sol | 高難度のコード生成、レビュー、推論 |
| GPT-5.6 Terra | gpt-5.6-terra | 日常のエージェントコーディングと一般的なタスク |
上記の名称とモデルIDは、Harogoが使用するルーティング用の識別子です。モデルリスト、バージョン、提供状況は変更される場合があります — 実際の内容はコンソールでご確認ください。
利用状況と上限
Harogoは以下の利用上限を適用します。
3つの上限はすべて同時に適用されます。すべてのモデル呼び出しは共有サブスクリプションクォータから消費され、一部のモデルにはより低い最大利用上限が設定されています — 詳細は以下の料金表をご覧ください。
上限は固定のリクエスト数ではなく、ドル建ての金額で定義されています。実際に得られるリクエスト数は使用するモデルによって異なり、一般に低価格のモデルほど多くのリクエストが可能で、高価格のモデルほど少なくなります。
現在の利用状況と残クォータはHarogoコンソールで確認できます。
推定リクエスト量
以下の表は、Harogoの典型的な利用パターンに基づく推定リクエスト数です。
| モデル | 1日あたり($12) | 1週間あたり($30) | 1か月あたり($60) |
|---|---|---|---|
| Kimi K3 | 1,040 | 2,600 | 5,200 |
| Claude Opus 5 | 300 | 750 | 1,500 |
| GPT-5.6 Sol | 1,130 | 2,820 | 5,630 |
| Qwen3.8 Max | 3,960 | 9,900 | 19,800 |
| GLM-5.2 | 7,920 | 19,790 | 39,580 |
| Claude Sonnet 5 | 2,350 | 5,880 | 11,760 |
| GPT-5.6 Terra | 2,640 | 6,600 | 13,200 |
| MiniMax M3 | 27,460 | 68,650 | 137,300 |
| DeepSeek V4 Pro | 34,250 | 85,640 | 171,270 |
| DeepSeek V4 Flash | 316,290 | 790,720 | 1,581,440 |
| Claude Haiku 4.5 | 18,050 | 45,110 | 90,230 |
| GPT-5.6 Luna | 2,060 | 5,150 | 10,300 |
| Claude Fable 5 | 220 | 560 | 1,110 |
各行は、その期間のクォータを主に該当モデルに使用した場合を想定しています。複数のモデルを併用する場合は同じ共有クォータを一緒に消費するため、モデルごとのリクエスト数を単純に合算することはできません。
実際のリクエスト数はコンテキスト長、キャッシュヒット率、推論負荷、出力長によって変動します。また、コーディングエージェントは1つのタスクに対して複数のモデルリクエストを発行することがあるため、1リクエストが1つの完全なコーディングタスクに相当するとは限りません。
推定方法
推定値は以下の典型的なリクエストパターンに基づいています。
- GLM-5.2 — 1リクエストあたり入力トークン約700、キャッシュ読み取りトークン約52,000、出力トークン約150。
- Qwen3.8 Max — 1リクエストあたり入力トークン約8,731、キャッシュ読み取りトークン約31,831、出力トークン約2,029。
- Kimi K3 — 1リクエストあたり入力トークン約1,050、キャッシュ読み取りトークン約76,500、出力トークン約300。
- MiniMax M3 — 1リクエストあたり入力トークン約4,381、キャッシュ読み取りトークン約28,768、出力トークン約1,108。
- DeepSeek V4 Pro — 1リクエストあたり入力トークン約750、キャッシュ読み取りトークン約82,000、出力トークン約290。
- DeepSeek V4 Flash — 1リクエストあたり入力トークン約790、キャッシュ読み取りトークン約68,000、出力トークン約280。
- Claude Opus 5 — 1リクエストあたり入力トークン約580、キャッシュ読み取りトークン約386,230、キャッシュ書き込みトークン約19,476、出力トークン約2,025。
- Claude Sonnet 5 — 1リクエストあたり入力トークン約159、キャッシュ読み取りトークン約129,804、キャッシュ書き込みトークン約6,260、出力トークン約850。
- Claude Fable 5 — 1リクエストあたり入力トークン約399、キャッシュ読み取りトークン約315,393、キャッシュ書き込みトークン約12,907、出力トークン約1,016。
- Claude Haiku 4.5 — 1リクエストあたり入力トークン約700、キャッシュ読み取りトークン約52,000、出力トークン約150。
- GPT-5.6 Luna — 1リクエストあたり入力トークン約45,726、キャッシュ読み取りトークン約10,720、出力トークン約1,905。
- GPT-5.6 Sol — 1リクエストあたり入力トークン約6,032、キャッシュ読み取りトークン約112,138、出力トークン約678。
- GPT-5.6 Terra — 1リクエストあたり入力トークン約6,825、キャッシュ読み取りトークン約69,476、出力トークン約734。
Qwen3.8 Max、MiniMax M3、およびClaudeとGPT-5.6のファミリーは、観測された平均的なリクエスト構造を使用しています。それ以外のモデルは典型的なコーディングリクエストの構造を使用しています。Claude Opus 5は現在、同価格帯のOpusクラスモデルの実際の利用データを参照しています。
これらの数値は典型的な利用状況を推定するためのものであり、固定のリクエスト数を約束するものではありません。
モデルの料金と利用上限
以下の表は、各モデルの100万トークンあたりのAPI参考価格と、Harogoがそのモデルに適用する利用上限をまとめたものです。
| モデル | モデルID | 入力 / 100万 | 出力 / 100万 | キャッシュ読み取り / 100万 | 利用上限 |
|---|---|---|---|---|---|
| Kimi K3 | kimi-k3 | $3.00 | $15.00 | $0.30 | $15 |
| Claude Opus 5 | claude-opus-5 | $5.00 | $25.00 | $0.50 | $60 |
| GPT-5.6 Sol | gpt-5.6-sol | $5.00 | $30.00 | $0.50 | $60 |
| Qwen3.8 Max | qwen3.8-max-preview | $1.69 | $5.03 | $0.17 | $60 |
| GLM-5.2 | glm-5.2 | $1.40 | $4.40 | $0.26 | $60 |
| Claude Sonnet 5 | claude-sonnet-5 | $2.00 | $10.00 | $0.20 | $60 |
| GPT-5.6 Terra | gpt-5.6-terra | $2.50 | $15.00 | $0.25 | $60 |
| MiniMax M3 | minimax-m3 | $0.30 | $1.20 | $0.06 | $60 |
| DeepSeek V4 Pro | deepseek-v4-pro | $0.44 | $0.87 | — | $15 |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | $0.14 | $0.28 | — | $60 |
| Claude Haiku 4.5 | claude-haiku-4-5 | $1.00 | $5.00 | $0.10 | $60 |
| GPT-5.6 Luna | gpt-5.6-luna | $1.00 | $6.00 | $0.10 | $60 |
| Claude Fable 5 | claude-fable-5 | $10.00 | $50.00 | $1.00 | $60 |
「—」は、現時点でその項目が個別に課金されない、またはそのモデルに該当しないことを示します。
推定リクエスト数は、モデルの料金、典型的なリクエスト構造、実際の利用データ、各モデルの利用上限を組み合わせて算出しています。プレビューモデルの料金と提供状況は変更される場合があります。
モデルの料金、利用上限、推定リクエスト数は、サービスの発展に伴い変更される場合があります — 最新情報はHarogoコンソールおよびこのページの最新版をご確認ください。