模型怎么选
悠然 AI 当前提供 GPT 5.6 系列的三个模型:gpt-5.6-sol、gpt-5.6-terra、gpt-5.6-luna——同属 5.6,按后缀分为三个档位:越聪明的模型,回答越慢、价格也越高。本页帮你用大白话搞懂三件事——它们谁更聪明、谁更快、谁更省钱,以及你该怎么选。
先搞懂:Token 是什么,钱怎么算
Section titled “先搞懂:Token 是什么,钱怎么算”模型不是按“次”收费的,而是按 Token 计费。Token 可以理解为“模型计量内容的单位”:你发出去的内容和模型回复的内容,都会被换算成 Token 计数。
一次对话的花费 =(输入 Token + 输出 Token)× 模型单价。所以内容越长,花得越多;模型单价越高,同样的内容花得越多。
三档模型对比
Section titled “三档模型对比”| 档位 | 模型 ID | 聪明程度 | 回答速度 | 参考价格(每 100 万 Token) |
|---|---|---|---|---|
| 最强档 | gpt-5.6-sol |
★★★ 最聪明 | 最慢,复杂问题会想更久 | 输入 $5 / 输出 $30 |
| 中间档 | gpt-5.6-terra |
★★ 够用 | 中等 | 输入 $2.5 / 输出 $15 |
| 轻量档 | gpt-5.6-luna |
★ 基础 | 最快 | 输入 $1 / 输出 $6 |
价格为 OpenAI 官方标准价,仅用于感受档位差距。悠然 AI 的实际扣费 = 官方价 × 计费倍率——管理员会统一设置一个倍率,通常远低于 1,所以实际花费一般比表中官方便宜很多。当前倍率和你应付的单价,以控制台“用量概览”页显示为准。
三句话记住它们:
- gpt-5.6-luna(轻量档):最快、最便宜,但最容易“说错话”。适合不重要的小事。
- gpt-5.6-terra(中间档):聪明程度、速度、价格都居中。大多数人的默认选择。
- gpt-5.6-sol(最强档):最聪明也最贵,回答前会“想更久”。适合答错代价高的事。
按场景选模型
Section titled “按场景选模型”| 你在做什么 | 推荐 | 为什么 |
|---|---|---|
| 随便聊天、问简单问题、查常识 | gpt-5.6-luna |
答错无所谓,省钱又秒回 |
| 翻译、总结、改文案、写邮件 | gpt-5.6-terra |
质量好,价格能接受 |
| 日常写代码、改 bug、看报错 | gpt-5.6-terra |
大部分编程问题它能搞定 |
| 复杂系统设计、难调的 bug、数学推理 | gpt-5.6-sol |
需要最强的推理能力,值得多花钱 |
| 让 AI 长时间自动改整个项目 | gpt-5.6-sol |
错一步会浪费更多 Token,不如一步到位 |
关于“推理强度”
Section titled “关于“推理强度””在 Codex 等工具里,你可能会看到 reasoning_effort(推理强度)设置,一般有低、中、高三档:
- 强度越高:模型“想得越久”,答案更可靠,但回复更慢、消耗的 Token 更多。
- 强度越低:回复更快更便宜,但复杂问题更容易出错。
新手建议保持默认(中或高)。如果你在配置 Codex,文档中的示例配置使用 high,这是为了保证编码质量。
两个重要提醒
Section titled “两个重要提醒”- 模型 ID 以实时查询为准。可用模型可能随时间调整,配置工具前请先按快速开始中的方法查询
/v1/models,复制返回结果里的真实模型 ID,不要照抄过期截图。 - 实际价格和余量看控制台。本文价格只用于理解档位差距;你的实际单价(官方价 × 当前倍率)、总额度、每日限额和已用额度,都以控制台显示为准。
选好模型后,去配置你的工具: