Harogo 文档
Harogo 是面向编程 Agent 的多模型订阅服务。本页面介绍订阅包含的内容、如何完成配置、支持哪些模型,以及用量限制的运作方式。
简介
Harogo 是面向编程 Agent 的多模型订阅服务。
限时优惠订阅价格为 $4.90/月,优惠结束后恢复为 $9.90/月。目前开放 100 个优惠订阅名额 —— 以订阅页面显示的剩余名额和确切结算价格为准。
订阅后,你可以通过单一入口访问多款编程模型。所有模型共用同一个 Harogo 账户、API Key 和订阅配额 —— 无需分别注册或为多个模型平台单独充值。
为什么选择 Harogo
不同模型擅长不同的编程任务。直接使用多个模型提供商,通常意味着要管理多个账户、API Key、余额、速率限制和账单。
Harogo 将一组适合编程 Agent 使用的模型整合到一个服务背后。你可以根据任务切换模型,每一次调用都按同一份共享配额计费。
当前模型大致可分为以下几组:
- Kimi K3、Claude Opus 5、GPT-5.6 Sol —— 适合大型代码库、长上下文任务和高难度推理。
- Qwen3.8 Max、GLM-5.2、Claude Sonnet 5、GPT-5.6 Terra、MiniMax M3、DeepSeek V4 Pro —— 适合日常 Agent 编程、代码生成与调试。
- DeepSeek V4 Flash、Claude Haiku 4.5、GPT-5.6 Luna —— 适合高频调用、快速响应和成本敏感型任务。
- Claude Fable 5 —— 适合长时间运行的多步骤 Agent 工作流。
以上分组仅作为选择模型的起点。实际效果取决于具体任务、上下文以及工具的使用方式。
快速上手
- 登录 Harogo 并完成订阅。
- 在控制台创建并复制一个 API Key。
- 将 Base URL 设置为 https://api.harogo.ai。
- 粘贴 API Key。
- 开始使用。
提示
请妥善保管你的 API Key。不要将其提交到公开仓库,也不要与他人共享。
支持的模型
当前支持的模型:
| 模型 | 模型 ID | 适用场景 |
|---|---|---|
| GLM-5.2 | glm-5.2 | 长时任务、大型代码库与 Agent 编程 |
| Qwen3.8 Max | qwen3.8-max-preview | 复杂推理、视觉理解与内置工具调用 |
| Kimi K3 | kimi-k3 | 复杂编程、长上下文、Agent 任务 |
| MiniMax M3 | minimax-m3 | 高频编程、工具调用、长上下文 |
| DeepSeek V4 Pro | deepseek-v4-pro | 推理与复杂代码生成 |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | 快速补全、高频调用与批量任务 |
| Claude Opus 5 | claude-opus-5 | 复杂 Agent 编程与高难度工程任务 |
| Claude Sonnet 5 | claude-sonnet-5 | 日常编程与通用开发任务 |
| Claude Fable 5 | claude-fable-5 | 长时间运行的复杂 Agent 任务 |
| Claude Haiku 4.5 | claude-haiku-4-5 | 快速响应、轻量任务与批处理 |
| GPT-5.6 Luna | gpt-5.6-luna | 高频编程与轻量任务 |
| GPT-5.6 Sol | gpt-5.6-sol | 高难度代码生成、审查与推理 |
| GPT-5.6 Terra | gpt-5.6-terra | 日常 Agent 编程与通用任务 |
以上名称和模型 ID 是 Harogo 使用的路由标识符。模型列表、版本和可用性可能会变化 —— 请以控制台实际显示为准。
用量与限制
Harogo 实施以下用量限制:
三项限制同时生效。每一次模型调用都从共享订阅配额中扣除,部分模型还设有更低的最高用量上限 —— 详见下方的定价表。
限制以美元金额定义,而非固定请求数。你实际能获得的请求数取决于所使用的模型 —— 通常价格更低的模型能支持更多请求,价格更高的模型则较少。
你可以在 Harogo 控制台查看当前用量和剩余配额。
预估请求量
下表基于典型的 Harogo 使用模式,给出预估的请求数:
| 模型 | 每日($12) | 每周($30) | 每月($60) |
|---|---|---|---|
| Kimi K3 | 1,040 | 2,600 | 5,200 |
| Claude Opus 5 | 300 | 750 | 1,500 |
| GPT-5.6 Sol | 1,130 | 2,820 | 5,630 |
| Qwen3.8 Max | 3,960 | 9,900 | 19,800 |
| GLM-5.2 | 7,920 | 19,790 | 39,580 |
| Claude Sonnet 5 | 2,350 | 5,880 | 11,760 |
| GPT-5.6 Terra | 2,640 | 6,600 | 13,200 |
| MiniMax M3 | 27,460 | 68,650 | 137,300 |
| DeepSeek V4 Pro | 34,250 | 85,640 | 171,270 |
| DeepSeek V4 Flash | 316,290 | 790,720 | 1,581,440 |
| Claude Haiku 4.5 | 18,050 | 45,110 | 90,230 |
| GPT-5.6 Luna | 2,060 | 5,150 | 10,300 |
| Claude Fable 5 | 220 | 560 | 1,110 |
每一行都假设该时间窗口的配额主要用于对应的模型。如果混合使用多个模型,它们会共同消耗同一份共享配额,因此不同模型的请求数不能简单相加。
实际请求数会随上下文长度、缓存命中率、推理强度和输出长度而变化。一个编程 Agent 可能会为单个任务发出多次模型请求,因此一次请求并不等于一个完整的编程任务。
预估方法
预估基于以下典型请求模式:
- GLM-5.2 —— 每次请求约 700 个输入 Token、52,000 个缓存读取 Token 和 150 个输出 Token。
- Qwen3.8 Max —— 每次请求约 8,731 个输入 Token、31,831 个缓存读取 Token 和 2,029 个输出 Token。
- Kimi K3 —— 每次请求约 1,050 个输入 Token、76,500 个缓存读取 Token 和 300 个输出 Token。
- MiniMax M3 —— 每次请求约 4,381 个输入 Token、28,768 个缓存读取 Token 和 1,108 个输出 Token。
- DeepSeek V4 Pro —— 每次请求约 750 个输入 Token、82,000 个缓存读取 Token 和 290 个输出 Token。
- DeepSeek V4 Flash —— 每次请求约 790 个输入 Token、68,000 个缓存读取 Token 和 280 个输出 Token。
- Claude Opus 5 —— 每次请求约 580 个输入 Token、386,230 个缓存读取 Token、19,476 个缓存写入 Token 和 2,025 个输出 Token。
- Claude Sonnet 5 —— 每次请求约 159 个输入 Token、129,804 个缓存读取 Token、6,260 个缓存写入 Token 和 850 个输出 Token。
- Claude Fable 5 —— 每次请求约 399 个输入 Token、315,393 个缓存读取 Token、12,907 个缓存写入 Token 和 1,016 个输出 Token。
- Claude Haiku 4.5 —— 每次请求约 700 个输入 Token、52,000 个缓存读取 Token 和 150 个输出 Token。
- GPT-5.6 Luna —— 每次请求约 45,726 个输入 Token、10,720 个缓存读取 Token 和 1,905 个输出 Token。
- GPT-5.6 Sol —— 每次请求约 6,032 个输入 Token、112,138 个缓存读取 Token 和 678 个输出 Token。
- GPT-5.6 Terra —— 每次请求约 6,825 个输入 Token、69,476 个缓存读取 Token 和 734 个输出 Token。
Qwen3.8 Max、MiniMax M3 以及 Claude 和 GPT-5.6 系列使用的是实际观测到的平均请求结构。其余模型使用典型的编程请求结构。Claude Opus 5 当前参考的是同价位 Opus 级模型的实际用量数据。
以上数字用于估算典型用量,并不构成对固定请求数量的承诺。
模型定价与用量上限
下表列出每个模型每百万 Token 的 API 参考价格,以及 Harogo 为该模型设置的用量上限。
| 模型 | 模型 ID | 输入 / 百万 | 输出 / 百万 | 缓存读取 / 百万 | 用量上限 |
|---|---|---|---|---|---|
| Kimi K3 | kimi-k3 | $3.00 | $15.00 | $0.30 | $15 |
| Claude Opus 5 | claude-opus-5 | $5.00 | $25.00 | $0.50 | $60 |
| GPT-5.6 Sol | gpt-5.6-sol | $5.00 | $30.00 | $0.50 | $60 |
| Qwen3.8 Max | qwen3.8-max-preview | $1.69 | $5.03 | $0.17 | $60 |
| GLM-5.2 | glm-5.2 | $1.40 | $4.40 | $0.26 | $60 |
| Claude Sonnet 5 | claude-sonnet-5 | $2.00 | $10.00 | $0.20 | $60 |
| GPT-5.6 Terra | gpt-5.6-terra | $2.50 | $15.00 | $0.25 | $60 |
| MiniMax M3 | minimax-m3 | $0.30 | $1.20 | $0.06 | $60 |
| DeepSeek V4 Pro | deepseek-v4-pro | $0.44 | $0.87 | — | $15 |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | $0.14 | $0.28 | — | $60 |
| Claude Haiku 4.5 | claude-haiku-4-5 | $1.00 | $5.00 | $0.10 | $60 |
| GPT-5.6 Luna | gpt-5.6-luna | $1.00 | $6.00 | $0.10 | $60 |
| Claude Fable 5 | claude-fable-5 | $10.00 | $50.00 | $1.00 | $60 |
"—" 表示该项目当前不单独计费,或不适用于该模型。
预估请求数综合了模型定价、典型请求结构、实际用量数据以及每个模型的用量上限计算得出。预览版模型的定价和可用性可能会变化。
模型定价、用量上限和预估请求数可能随服务演进而变化 —— 请以 Harogo 控制台以及本页面的最新版本为准。