> ## Documentation Index
> Fetch the complete documentation index at: https://docs.harogo.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# 产品介绍

> Harogo 是面向编程 Agent 的多模型订阅服务。本页面介绍订阅包含的内容、如何完成配置、支持哪些模型，以及用量限制的运作方式。

# 简介

Harogo 是面向编程 Agent 的多模型订阅服务。

优惠订阅价格为 \$4.9/月，目前开放 100 个优惠订阅名额。剩余名额和实际结算价格以订阅页面显示为准。

订阅后，你可以通过一个 Harogo 账户和 API Key 使用多款编程模型，所有模型共享同一份订阅配额，无需分别注册、充值或管理多个模型平台。

# 为什么选择 Harogo

不同模型擅长不同的编程任务。直接使用多个模型提供商，通常需要同时管理多个账户、API Key、余额、速率限制和账单。

Harogo 将多款适合编程 Agent 的模型整合到一个服务中。你可以根据任务自由切换模型，并通过同一份订阅配额统一结算。

# 支持的模型

当前支持的模型：

| 模型                | 模型 ID                    | 适用场景                 |
| ----------------- | ------------------------ | -------------------- |
| GLM-5.2           | `glm-5.2`                | 长时任务、大型代码库与 Agent 编程 |
| Qwen3.8 Max       | `qwen3.8-max-preview`    | 复杂推理、视觉理解与内置工具调用     |
| Kimi K3           | `kimi-k3`                | 复杂编程、长上下文、Agent 任务   |
| MiniMax M3        | `minimax-m3`             | 高频编程、工具调用、长上下文       |
| DeepSeek V4 Pro   | `deepseek-v4-pro`        | 推理与复杂代码生成            |
| DeepSeek V4 Flash | `deepseek-v4-flash-0731` | 快速补全、高频调用与批量任务       |
| Claude Opus 5     | `claude-opus-5`          | 复杂 Agent 编程与高难度工程任务  |
| Claude Sonnet 5   | `claude-sonnet-5`        | 日常编程与通用开发任务          |
| Claude Fable 5    | `claude-fable-5`         | 长时间运行的复杂 Agent 任务    |
| Claude Haiku 4.5  | `claude-haiku-4-5`       | 快速响应、轻量任务与批处理        |
| GPT-5.6 Luna      | `gpt-5.6-luna`           | 高频编程与轻量任务            |
| GPT-5.6 Sol       | `gpt-5.6-sol`            | 高难度代码生成、审查与推理        |
| GPT-5.6 Terra     | `gpt-5.6-terra`          | 日常 Agent 编程与通用任务     |

以上名称和模型 ID 是 Harogo 使用的路由标识符。模型列表、版本和可用性可能会变化 —— 请以控制台实际显示为准。

## 用量与限制

Harogo 实施以下用量限制：

* 每日限额：\$12
* 每周限额：\$30
* 每月限额：\$60

三项限制同时生效。每一次模型调用都从共享订阅配额中扣除，部分模型还设有更低的最高用量上限 ,详见下方的定价表。

限制以美元金额定义，而非固定请求数。你实际能获得的请求数取决于所使用的模型 —— 通常价格更低的模型能支持更多请求，价格更高的模型则较少。

你可以在 [Harogo 控制台](https://console.harogo.ai/plan)查看当前用量和剩余配额。

### 预估请求量

下表根据典型 Harogo 使用模式估算不同模型对应的请求数量：

| 模型                | 每日（\$12） | 每周（\$30） |  每月（\$60） |
| ----------------- | -------: | -------: | --------: |
| Kimi K3           |    1,040 |    2,600 |     5,200 |
| Claude Opus 5     |      300 |      750 |     1,500 |
| GPT-5.6 Sol       |    1,130 |    2,820 |     5,630 |
| Qwen3.8 Max       |    3,960 |    9,900 |    19,800 |
| GLM-5.2           |    7,920 |   19,790 |    39,580 |
| Claude Sonnet 5   |    2,350 |    5,880 |    11,760 |
| GPT-5.6 Terra     |    2,640 |    6,600 |    13,200 |
| MiniMax M3        |   27,460 |   68,650 |   137,300 |
| DeepSeek V4 Pro   |   34,250 |   85,640 |   171,270 |
| DeepSeek V4 Flash |  316,290 |  790,720 | 1,581,440 |
| Claude Haiku 4.5  |   18,050 |   45,110 |    90,230 |
| GPT-5.6 Luna      |    2,060 |    5,150 |    10,300 |
| Claude Fable 5    |      220 |      560 |     1,110 |

每一行均假设该时间窗口内的配额主要用于对应模型。混合使用多个模型时，它们会共同消耗同一份共享配额，因此表中的请求数不能相加。

实际请求量会受到上下文长度、缓存命中率、推理强度和输出长度等因素影响。编程 Agent 完成一个任务通常也会发起多次模型请求。

### 预估方法

预估采用以下典型请求结构：

* **GLM-5.2** —— 每次请求约 700 个输入 Token、52,000 个缓存读取 Token 和 150 个输出 Token。
* **Qwen3.8 Max** —— 每次请求约 8,731 个输入 Token、31,831 个缓存读取 Token 和 2,029 个输出 Token。
* **Kimi K3** —— 每次请求约 1,050 个输入 Token、76,500 个缓存读取 Token 和 300 个输出 Token。
* **MiniMax M3** —— 每次请求约 4,381 个输入 Token、28,768 个缓存读取 Token 和 1,108 个输出 Token。
* **DeepSeek V4 Pro** —— 每次请求约 750 个输入 Token、82,000 个缓存读取 Token 和 290 个输出 Token。
* **DeepSeek V4 Flash** —— 每次请求约 790 个输入 Token、68,000 个缓存读取 Token 和 280 个输出 Token。
* **Claude Opus 5** —— 每次请求约 580 个输入 Token、386,230 个缓存读取 Token、19,476 个缓存写入 Token 和 2,025 个输出 Token。
* **Claude Sonnet 5** —— 每次请求约 159 个输入 Token、129,804 个缓存读取 Token、6,260 个缓存写入 Token 和 850 个输出 Token。
* **Claude Fable 5** —— 每次请求约 399 个输入 Token、315,393 个缓存读取 Token、12,907 个缓存写入 Token 和 1,016 个输出 Token。
* **Claude Haiku 4.5** —— 每次请求约 700 个输入 Token、52,000 个缓存读取 Token 和 150 个输出 Token。
* **GPT-5.6 Luna** —— 每次请求约 45,726 个输入 Token、10,720 个缓存读取 Token 和 1,905 个输出 Token。
* **GPT-5.6 Sol** —— 每次请求约 6,032 个输入 Token、112,138 个缓存读取 Token 和 678 个输出 Token。
* **GPT-5.6 Terra** —— 每次请求约 6,825 个输入 Token、69,476 个缓存读取 Token 和 734 个输出 Token。

以上数字用于估算典型用量，并不构成对固定请求数量的承诺。

### 模型定价与用量上限

下表列出各模型每百万 Token 的 API 参考价格，以及 Harogo 设置的单模型用量上限：

| 模型                | 模型 ID                    | 输入 / 百万 | 输出 / 百万 | 缓存读取 / 百万 | 用量上限 |
| ----------------- | ------------------------ | ------: | ------: | --------: | ---: |
| Kimi K3           | `kimi-k3`                |  \$3.00 | \$15.00 |    \$0.30 | \$15 |
| Claude Opus 5     | `claude-opus-5`          |  \$5.00 | \$25.00 |    \$0.50 | \$60 |
| GPT-5.6 Sol       | `gpt-5.6-sol`            |  \$5.00 | \$30.00 |    \$0.50 | \$60 |
| Qwen3.8 Max       | `qwen3.8-max-preview`    |  \$1.69 |  \$5.03 |    \$0.17 | \$60 |
| GLM-5.2           | `glm-5.2`                |  \$1.40 |  \$4.40 |    \$0.26 | \$60 |
| Claude Sonnet 5   | `claude-sonnet-5`        |  \$2.00 | \$10.00 |    \$0.20 | \$60 |
| GPT-5.6 Terra     | `gpt-5.6-terra`          |  \$2.50 | \$15.00 |    \$0.25 | \$60 |
| MiniMax M3        | `minimax-m3`             |  \$0.30 |  \$1.20 |    \$0.06 | \$60 |
| DeepSeek V4 Pro   | `deepseek-v4-pro`        |  \$0.44 |  \$0.87 |         — | \$15 |
| DeepSeek V4 Flash | `deepseek-v4-flash-0731` |  \$0.14 |  \$0.28 |         — | \$60 |
| Claude Haiku 4.5  | `claude-haiku-4-5`       |  \$1.00 |  \$5.00 |    \$0.10 | \$60 |
| GPT-5.6 Luna      | `gpt-5.6-luna`           |  \$1.00 |  \$6.00 |    \$0.10 | \$60 |
| Claude Fable 5    | `claude-fable-5`         | \$10.00 | \$50.00 |    \$1.00 | \$60 |

“—” 表示该项目当前不单独计费或不适用于该模型。

模型定价、用量上限和预估请求量可能随服务调整，请以 Harogo 控制台及本页面最新信息为准。
