简介
Harogo 是面向编程 Agent 的多模型订阅服务。 优惠订阅价格为 $4.9/月,目前开放 100 个优惠订阅名额。剩余名额和实际结算价格以订阅页面显示为准。 订阅后,你可以通过一个 Harogo 账户和 API Key 使用多款编程模型,所有模型共享同一份订阅配额,无需分别注册、充值或管理多个模型平台。为什么选择 Harogo
不同模型擅长不同的编程任务。直接使用多个模型提供商,通常需要同时管理多个账户、API Key、余额、速率限制和账单。 Harogo 将多款适合编程 Agent 的模型整合到一个服务中。你可以根据任务自由切换模型,并通过同一份订阅配额统一结算。支持的模型
当前支持的模型:
以上名称和模型 ID 是 Harogo 使用的路由标识符。模型列表、版本和可用性可能会变化 —— 请以控制台实际显示为准。
用量与限制
Harogo 实施以下用量限制:- 每日限额:$12
- 每周限额:$30
- 每月限额:$60
预估请求量
下表根据典型 Harogo 使用模式估算不同模型对应的请求数量:
每一行均假设该时间窗口内的配额主要用于对应模型。混合使用多个模型时,它们会共同消耗同一份共享配额,因此表中的请求数不能相加。
实际请求量会受到上下文长度、缓存命中率、推理强度和输出长度等因素影响。编程 Agent 完成一个任务通常也会发起多次模型请求。
预估方法
预估采用以下典型请求结构:- GLM-5.2 —— 每次请求约 700 个输入 Token、52,000 个缓存读取 Token 和 150 个输出 Token。
- Qwen3.8 Max —— 每次请求约 8,731 个输入 Token、31,831 个缓存读取 Token 和 2,029 个输出 Token。
- Kimi K3 —— 每次请求约 1,050 个输入 Token、76,500 个缓存读取 Token 和 300 个输出 Token。
- MiniMax M3 —— 每次请求约 4,381 个输入 Token、28,768 个缓存读取 Token 和 1,108 个输出 Token。
- DeepSeek V4 Pro —— 每次请求约 750 个输入 Token、82,000 个缓存读取 Token 和 290 个输出 Token。
- DeepSeek V4 Flash —— 每次请求约 790 个输入 Token、68,000 个缓存读取 Token 和 280 个输出 Token。
- Claude Opus 5 —— 每次请求约 580 个输入 Token、386,230 个缓存读取 Token、19,476 个缓存写入 Token 和 2,025 个输出 Token。
- Claude Sonnet 5 —— 每次请求约 159 个输入 Token、129,804 个缓存读取 Token、6,260 个缓存写入 Token 和 850 个输出 Token。
- Claude Fable 5 —— 每次请求约 399 个输入 Token、315,393 个缓存读取 Token、12,907 个缓存写入 Token 和 1,016 个输出 Token。
- Claude Haiku 4.5 —— 每次请求约 700 个输入 Token、52,000 个缓存读取 Token 和 150 个输出 Token。
- GPT-5.6 Luna —— 每次请求约 45,726 个输入 Token、10,720 个缓存读取 Token 和 1,905 个输出 Token。
- GPT-5.6 Sol —— 每次请求约 6,032 个输入 Token、112,138 个缓存读取 Token 和 678 个输出 Token。
- GPT-5.6 Terra —— 每次请求约 6,825 个输入 Token、69,476 个缓存读取 Token 和 734 个输出 Token。
模型定价与用量上限
下表列出各模型每百万 Token 的 API 参考价格,以及 Harogo 设置的单模型用量上限:
“—” 表示该项目当前不单独计费或不适用于该模型。
模型定价、用量上限和预估请求量可能随服务调整,请以 Harogo 控制台及本页面最新信息为准。