聊天与文字模型定价
每个聊天模型对每条助理消息收取固定点数 — 轻量模型从 0.5 点数到旗舰模型的 12 点数。
最后更新 2026年9月6日
Chat 与 Tutor 对话计费 chat credits。成本取决于哪个
模型回复您的消息 — 而非您输入多少 tokens,
不过较长的对话会在每个请求中带入更多历史记录。
点数范围(0.5 – 12)
所有文字模型定价于 压缩的 0.5–12 刻度:
| 层级 | 每条消息点数 | 示例模型 |
|---|---|---|
| Budget | 0.5 | GPT-5 Nano、Gemini 2.5 Flash Lite、DeepSeek V3/V3.1/V3.2/V4 Flash、Qwen3 32B、Qwen3.5 Flash、Tencent Hy3、Mistral Nemo、Llama 4 Scout/Maverick |
| Low | 1.5 | GPT-5 Mini、Gemini 2.5 Flash、Gemini 3 Flash、DeepSeek R1/V4 Pro/Flash、Mistral Medium 3.1 |
| Mid-low | 2 – 2.5 | Claude 3.5 Haiku(2)、Qwen3 Max(2)、Zack(auto)2.5、Grok 4.3、GPT-5.6 Luna、GLM 5.2 |
| Mid | 3 – 3.5 | GPT-5、GPT-5.1、Gemini 2.5 Pro、Gemini 3.5 Flash |
| Mid-high | 4.5 – 5.5 | Grok 4.5、Claude Sonnet 5、GPT-5.2、GPT-5.3 Chat、Gemini 3.1 Pro |
| High | 7 – 9 | GPT-5.4、GPT-5.6 Terra、Kimi K3、Claude Sonnet 4 / 4.5 / 4.6 |
| Flagship | 12 | GPT-5.5、GPT-5.6 Sol、Claude Opus 4.8、Fugu Ultra |
推理深度 — 许多模型提供推理层级选择器(None → Max)。较高深度可改善困难问题,但 不会改变每条消息的点数 — 你始终支付选择器中显示的固定模型费率。旧版独立的「Medium」模型行(例如 GPT-5.2 Medium)已合并为单一模型 + 推理选择器。
Zack(自动路由)定价为每条消息 2.5 点数。
已退役模型
旧版密钥(GPT-4.x、o3、o4-mini、Grok 4)已不在选择器中。旧对话可能解析至后继模型,例如 GPT-5.6 Terra 或 Grok 4.3 — 收到提示时请切换至现行模型。
默认与具名模型
| 选择 | 最适用于 | 典型成本 |
|---|---|---|
| Zack | 日常使用 — 自动模型选择 + tools | 2.5 点数 |
| Named model | 特定供应商/能力 | 选择器中显示的固定费率 |
| + Reasoning | 支持模型上的较难问题 | 相同固定费率(不加点数) |
没有独立的 Chat-Thinking/Chat-Fast/Chat-Chinese 模式——请使用 Zack、具名中文能力模型(例如 DeepSeek/Qwen),或在需要更深思考时提高 Reasoning。
代理工具(亦使用 chat credits)
代理工具在聊天消息期间执行,加入 该消息的 chat credit
总计。它们在交易记录中分开追踪,但从同一
chat 池扣除。
| 工具 | 点数 | 备注 |
|---|---|---|
| Web search | 每次搜索 10 | 每次搜索调用计费 |
| Website crawl | 每个 URL 2 | 每个爬取页面计费 |
| YouTube transcript | 每支视频 2.5 | 每次获取逐字稿 |
| Image generation (in chat) | 每张图片 10 | 使用 chat credits,非 Image Studio 池 |
| Image edit (in chat) | 每张图片 10 | 与聊天内生成相同 |
其他代理工具(闪卡、笔记、思维导图、幻灯片等)在生成步骤遵循
底层模型的每条消息费率。
每条消息成本如何计算(技术说明)
对每个模型,Zense AI:
- 读取 OpenRouter 每百万输入/输出 tokens 价格。
- 应用代表性配置文件(每条消息 12k 输入 / 1k 输出)。
- 以 Pro 方案点数价值(0.0495 HKD/credit)为目标,约 25% 利润率。
- 将原始成本 压缩 至 0.5–12 表,使日常模型保持
可负担,旗舰模型由较便宜层级补贴。
您计费的是 最终压缩后的点数,而非原始 token 计算。
您在 UI 中会看到的 tokens
虽然计费以消息为单位,每轮仍会记录 token 用量以供调试
与分析:
- promptTokens — 发送至模型的系统提示 + 历史记录 + 附件 + 工具语境。
- completionTokens — 助理的回复。
- reasoningTokens — 推理模型的额外 tokens(GPT-5.6、thinking 模式等)。
较长的串会增加后续消息的 promptTokens,这就是定价公式假设输入较重的原因 — 但您的 点数费用仍为固定的模型费率,除非您也调用付费代理工具。
管理聊天支出的技巧
- 简单问题使用 Zack 或 0.5 点数模型。
- 将 旗舰模型(9–12 点数)保留给需要最高品质的工作。
- Web search(10 点数)累积很快 — 仅在需要时请 Chat 搜索。
- 学校管理员:设置每用户的 chat caps,并在 School
Management → Users 监控共用池。
完整逐模型表见工程文档(
chat-pricing.md)。OpenRouter 价格变动时费率
可能调整 — 请以模型选择器中的即时成本为准。



