10个典型场景选型指南
1. 智能客服机器人
📌 首选:GLM-4 或通义千问 — 中文流畅、延迟低、国内合规、多轮对话上下文连贯
2. 代码审查/代码生成
📌 首选:Claude Sonnet 4,备选 DeepSeek-Coder — 指令遵循最严格,代码质量高,边界case考虑全面
3. 文档总结/长文阅读
📌 首选:Kimi 或 Gemini 1.5 Pro — 超长上下文,可以一次性读入整本书或完整报告
4. 结构化数据提取
📌 首选:GPT-4o 或 Claude Sonnet 4 — JSON输出最稳定,函数调用生态成熟,格式错误率最低
5. 图像理解/OCR
📌 首选:GPT-4o;中文票据/证件场景用 GLM-4V
6. 大批量翻译
📌 首选:DeepSeek-V3 — 价格极低(¥0.002/1M),中英互译质量不差,适合高量任务
7. 实时对话/低延迟场景
📌 首选:GPT-4o mini 或 GLM-4 — 响应速度最快,适合语音助手、即时问答
8. 离线私有部署
📌 首选:Qwen2-72B(Ollama本地) — 数据不出境,中文能力在开源模型中最强
9. 低成本高并发
📌 首选:DeepSeek-V3 或 GPT-4o mini — 单次请求成本接近零,支撑百万级日请求
10. 创意写作/营销文案
📌 首选:Claude Sonnet 4(文风多样,创意质量高);中文营销场景用 通义千问
选型决策树
数据能出境?
├── 否(国内合规要求)
│ ├── 极致性价比 → DeepSeek-V3
│ ├── 中文质量优先 → 通义千问-Max
│ ├── 代码任务 → GLM-4
│ └── 超长文档 → Kimi
└── 是(可用国际API)
├── 代码/Agent构建 → Claude Sonnet 4
├── 多模态任务 → GPT-4o
├── 超长文档处理 → Gemini 1.5 Pro
└── 预算有限 → GPT-4o mini一句话总结
没有最好的模型,只有最适合场景的模型。从需求出发,先用便宜方案验证可行性,再决定是否升级。