2.4 根据任务选择合适的模型
刚才直接提问时,我们没有特意选择模型,Codex照样给出了结果。第一章说过,模型可以理解为Codex负责理解、推理和生成内容的“大脑”。当任务变复杂以后,选哪个模型、让它思考到什么程度,会影响结果质量和等待时间。
在输入框下方点击当前模型名称旁的下拉箭头,可以选择模型和推理强度。以 图 1 为例,当前选择的是“5.6 Sol”和“高”。
这张截图主要用来说明模型和推理强度的入口。正式开始下面的练习时,我们会把滑杆从“高”调到“中等”;调好后,模型名称旁会显示“中”。
先把两个容易混淆的选项分开:模型决定这个“大脑”更擅长处理什么任务,推理强度决定同一个模型愿意为这次任务花多少功夫。
下面的说明根据OpenAI关于Codex模型的官方说明核实于2026年8月24日。模型名称、可选档位和账号可用范围以后可能变化,使用时以你在界面中实际看到的选项为准。
先选模型:Sol、Terra还是Luna
| 模型 | 主要特点 | 适合处理的工作 |
|---|---|---|
| 5.6 Sol | 三者中能力最强,更重视分析、判断和成品质量 | 材料互相矛盾、要求不够明确、结果价值较高,或者需要深度调研和精细打磨的任务 |
| 5.6 Terra | 能力和速度比较均衡,适合作为日常主力 | 整理常规材料、制作办公文件、分析表格,以及需要调用工具的多步骤任务 |
| 5.6 Luna | 速度更快,适合要求清楚、可以重复执行的任务 | 提取固定字段、分类、格式转换、批量生成结构统一的摘要 |
如果暂时拿不准,可以从Sol开始。任务要求已经非常清楚,而且同类工作要批量处理时,再考虑Terra或Luna。模型选得更强也不能代替验收,重要数字、来源和外部承诺仍然要由人检查。
再选推理强度:轻度、中等、高还是极高
Sol、Terra和Luna都可以再选下面四档。这里不是换一个模型,而是在调整同一个模型分析这次任务的深度。
| 推理强度 | 适合的任务 | 使用感受 |
|---|---|---|
| 轻度 | 问题明确、步骤少,例如提取一列数据、调整一段文字或转换格式 | 回答更快,适合先试一次 |
| 中等 | 目标、材料范围、判断规则和验收标准都比较清楚的日常办公任务,即使需要整理多份材料 | 速度和思考深度比较均衡,可以作为日常起点 |
| 高 | 任务规则不够清楚,需要在多种方案之间取舍,或者第一次结果出现了明显遗漏 | 会多花一些时间分析和核对 |
| 极高 | 任务很难、限制很多、出错代价较高,例如复杂调研、重要方案复核或多种取舍同时存在 | 等待时间通常更长,不需要每次都开到这一档 |
这次练习选择“5.6 Sol+中等”。虽然要读取16份材料,还要分辨前后冲突和不同统计口径,但下一节会把材料范围、冲突处理规则、输出格式和验收标准全部写清楚。Sol本身擅长处理需要分析和判断的复杂任务,中等强度已经能够给它足够的思考空间,等待时间也更合适。
文件数量多,不等于一定要把推理强度调高。先用“中等”完成任务并验收;如果第一次结果遗漏了重要来源、错误合并了不同口径,或者没有按照要求留下判断依据,再保持Sol不变,把推理强度提高到“高”重新处理。如果你的界面没有完全相同的选项,就选择当前可用的通用模型和中等强度,不必因为名称不同停下练习。
回到顶部