跳转到主内容
Harogo
模型 价格 常见问题 文档
English 日本語 한국어 Deutsch Español Français Português Русский Türkçe Polski Nederlands Italiano Tiếng Việt Українська Български
登录 获取 Harogo
文档

Harogo 文档

Harogo 是面向编程 Agent 的多模型订阅服务。本页面介绍订阅包含的内容、如何完成配置、支持哪些模型,以及用量限制的运作方式。

简介

Harogo 是面向编程 Agent 的多模型订阅服务。

限时优惠订阅价格为 $4.90/月,优惠结束后恢复为 $9.90/月。目前开放 100 个优惠订阅名额 —— 以订阅页面显示的剩余名额和确切结算价格为准。

订阅后,你可以通过单一入口访问多款编程模型。所有模型共用同一个 Harogo 账户、API Key 和订阅配额 —— 无需分别注册或为多个模型平台单独充值。

为什么选择 Harogo

不同模型擅长不同的编程任务。直接使用多个模型提供商,通常意味着要管理多个账户、API Key、余额、速率限制和账单。

Harogo 将一组适合编程 Agent 使用的模型整合到一个服务背后。你可以根据任务切换模型,每一次调用都按同一份共享配额计费。

当前模型大致可分为以下几组:

  • Kimi K3、Claude Opus 5、GPT-5.6 Sol —— 适合大型代码库、长上下文任务和高难度推理。
  • Qwen3.8 Max、GLM-5.2、Claude Sonnet 5、GPT-5.6 Terra、MiniMax M3、DeepSeek V4 Pro —— 适合日常 Agent 编程、代码生成与调试。
  • DeepSeek V4 Flash、Claude Haiku 4.5、GPT-5.6 Luna —— 适合高频调用、快速响应和成本敏感型任务。
  • Claude Fable 5 —— 适合长时间运行的多步骤 Agent 工作流。

以上分组仅作为选择模型的起点。实际效果取决于具体任务、上下文以及工具的使用方式。

快速上手

  1. 登录 Harogo 并完成订阅。
  2. 在控制台创建并复制一个 API Key。
  3. 将 Base URL 设置为 https://api.harogo.ai
  4. 粘贴 API Key。
  5. 开始使用。

提示

请妥善保管你的 API Key。不要将其提交到公开仓库,也不要与他人共享。

支持的模型

当前支持的模型:

模型模型 ID适用场景
GLM-5.2glm-5.2长时任务、大型代码库与 Agent 编程
Qwen3.8 Maxqwen3.8-max-preview复杂推理、视觉理解与内置工具调用
Kimi K3kimi-k3复杂编程、长上下文、Agent 任务
MiniMax M3minimax-m3高频编程、工具调用、长上下文
DeepSeek V4 Prodeepseek-v4-pro推理与复杂代码生成
DeepSeek V4 Flashdeepseek-v4-flash-0731快速补全、高频调用与批量任务
Claude Opus 5claude-opus-5复杂 Agent 编程与高难度工程任务
Claude Sonnet 5claude-sonnet-5日常编程与通用开发任务
Claude Fable 5claude-fable-5长时间运行的复杂 Agent 任务
Claude Haiku 4.5claude-haiku-4-5快速响应、轻量任务与批处理
GPT-5.6 Lunagpt-5.6-luna高频编程与轻量任务
GPT-5.6 Solgpt-5.6-sol高难度代码生成、审查与推理
GPT-5.6 Terragpt-5.6-terra日常 Agent 编程与通用任务

以上名称和模型 ID 是 Harogo 使用的路由标识符。模型列表、版本和可用性可能会变化 —— 请以控制台实际显示为准。

用量与限制

Harogo 实施以下用量限制:

每日限额
$12
每周限额
$30
每月限额
$60

三项限制同时生效。每一次模型调用都从共享订阅配额中扣除,部分模型还设有更低的最高用量上限 —— 详见下方的定价表。

限制以美元金额定义,而非固定请求数。你实际能获得的请求数取决于所使用的模型 —— 通常价格更低的模型能支持更多请求,价格更高的模型则较少。

你可以在 Harogo 控制台查看当前用量和剩余配额。

预估请求量

下表基于典型的 Harogo 使用模式,给出预估的请求数:

模型每日($12)每周($30)每月($60)
Kimi K31,0402,6005,200
Claude Opus 53007501,500
GPT-5.6 Sol1,1302,8205,630
Qwen3.8 Max3,9609,90019,800
GLM-5.27,92019,79039,580
Claude Sonnet 52,3505,88011,760
GPT-5.6 Terra2,6406,60013,200
MiniMax M327,46068,650137,300
DeepSeek V4 Pro34,25085,640171,270
DeepSeek V4 Flash316,290790,7201,581,440
Claude Haiku 4.518,05045,11090,230
GPT-5.6 Luna2,0605,15010,300
Claude Fable 52205601,110

每一行都假设该时间窗口的配额主要用于对应的模型。如果混合使用多个模型,它们会共同消耗同一份共享配额,因此不同模型的请求数不能简单相加。

实际请求数会随上下文长度、缓存命中率、推理强度和输出长度而变化。一个编程 Agent 可能会为单个任务发出多次模型请求,因此一次请求并不等于一个完整的编程任务。

预估方法

预估基于以下典型请求模式:

  • GLM-5.2 —— 每次请求约 700 个输入 Token、52,000 个缓存读取 Token 和 150 个输出 Token。
  • Qwen3.8 Max —— 每次请求约 8,731 个输入 Token、31,831 个缓存读取 Token 和 2,029 个输出 Token。
  • Kimi K3 —— 每次请求约 1,050 个输入 Token、76,500 个缓存读取 Token 和 300 个输出 Token。
  • MiniMax M3 —— 每次请求约 4,381 个输入 Token、28,768 个缓存读取 Token 和 1,108 个输出 Token。
  • DeepSeek V4 Pro —— 每次请求约 750 个输入 Token、82,000 个缓存读取 Token 和 290 个输出 Token。
  • DeepSeek V4 Flash —— 每次请求约 790 个输入 Token、68,000 个缓存读取 Token 和 280 个输出 Token。
  • Claude Opus 5 —— 每次请求约 580 个输入 Token、386,230 个缓存读取 Token、19,476 个缓存写入 Token 和 2,025 个输出 Token。
  • Claude Sonnet 5 —— 每次请求约 159 个输入 Token、129,804 个缓存读取 Token、6,260 个缓存写入 Token 和 850 个输出 Token。
  • Claude Fable 5 —— 每次请求约 399 个输入 Token、315,393 个缓存读取 Token、12,907 个缓存写入 Token 和 1,016 个输出 Token。
  • Claude Haiku 4.5 —— 每次请求约 700 个输入 Token、52,000 个缓存读取 Token 和 150 个输出 Token。
  • GPT-5.6 Luna —— 每次请求约 45,726 个输入 Token、10,720 个缓存读取 Token 和 1,905 个输出 Token。
  • GPT-5.6 Sol —— 每次请求约 6,032 个输入 Token、112,138 个缓存读取 Token 和 678 个输出 Token。
  • GPT-5.6 Terra —— 每次请求约 6,825 个输入 Token、69,476 个缓存读取 Token 和 734 个输出 Token。

Qwen3.8 Max、MiniMax M3 以及 Claude 和 GPT-5.6 系列使用的是实际观测到的平均请求结构。其余模型使用典型的编程请求结构。Claude Opus 5 当前参考的是同价位 Opus 级模型的实际用量数据。

以上数字用于估算典型用量,并不构成对固定请求数量的承诺。

模型定价与用量上限

下表列出每个模型每百万 Token 的 API 参考价格,以及 Harogo 为该模型设置的用量上限。

模型模型 ID输入 / 百万输出 / 百万缓存读取 / 百万用量上限
Kimi K3kimi-k3$3.00$15.00$0.30$15
Claude Opus 5claude-opus-5$5.00$25.00$0.50$60
GPT-5.6 Solgpt-5.6-sol$5.00$30.00$0.50$60
Qwen3.8 Maxqwen3.8-max-preview$1.69$5.03$0.17$60
GLM-5.2glm-5.2$1.40$4.40$0.26$60
Claude Sonnet 5claude-sonnet-5$2.00$10.00$0.20$60
GPT-5.6 Terragpt-5.6-terra$2.50$15.00$0.25$60
MiniMax M3minimax-m3$0.30$1.20$0.06$60
DeepSeek V4 Prodeepseek-v4-pro$0.44$0.87$15
DeepSeek V4 Flashdeepseek-v4-flash-0731$0.14$0.28$60
Claude Haiku 4.5claude-haiku-4-5$1.00$5.00$0.10$60
GPT-5.6 Lunagpt-5.6-luna$1.00$6.00$0.10$60
Claude Fable 5claude-fable-5$10.00$50.00$1.00$60

"—" 表示该项目当前不单独计费,或不适用于该模型。

预估请求数综合了模型定价、典型请求结构、实际用量数据以及每个模型的用量上限计算得出。预览版模型的定价和可用性可能会变化。

模型定价、用量上限和预估请求数可能随服务演进而变化 —— 请以 Harogo 控制台以及本页面的最新版本为准。