我怎么选模型
类型:
[决策]· 偶尔改「常用」列,不追周榜。厂商全表见 主流大模型厂商一览。
不是选型百科,只记我当前默认怎么选。换常用模型时改这一页。
| 场景 | 我优先 | 备选 | 备注 |
|---|---|---|---|
| 日常写代码 / AI Coding | Claude 系或 Cursor 内默认强模型 | GPT 旗舰 · 国产高性价比 | 要稳、要改多文件 |
| 长文 / 方案 / 文档 | Claude 系 | GPT · Gemini | 长上下文、少跑题 |
| 便宜量产(摘要、分类、简单抽取) | DeepSeek / Qwen / 国内 Flash 档 | Gemini Flash | 先比单价和稳定性 |
| 必须本地 / 隐私 | Qwen / Llama / DeepSeek 开源权重 | — | 先跑通再谈旗舰 |
| 看图理解 | GPT / Gemini / Claude(多模态) | 通义 / 智谱 | 「看图」≠「生图」 |
| 生图 / 生视频 | 专用模型(按项目) | — | 别用纯文本模型硬扛 |
三条原则
- 先定约束:隐私、预算、延迟、要不要工具调用——不定这四个,选型一定乱。
- 同一梯队可替换:锁的是能力档,不是某个营销名;厂商一览表只负责认路。
- Agent / Coding 看产品,不只看底座:Cursor / Claude Code / Codex 的体验差,经常大于换一个同档模型。
什么时候升级旗舰
- 多步工具调用老失败、格式老跑偏
- 复杂重构、跨模块推理不够用
- 客户场景明确要求最强推理
否则优先:够用 + 可复现 + 成本可解释。