10个典型场景选型指南

1. 智能客服机器人

📌 首选:GLM-4 或通义千问 — 中文流畅、延迟低、国内合规、多轮对话上下文连贯

2. 代码审查/代码生成

📌 首选:Claude Sonnet 4,备选 DeepSeek-Coder — 指令遵循最严格,代码质量高,边界case考虑全面

3. 文档总结/长文阅读

📌 首选:Kimi 或 Gemini 1.5 Pro — 超长上下文,可以一次性读入整本书或完整报告

4. 结构化数据提取

📌 首选:GPT-4o 或 Claude Sonnet 4 — JSON输出最稳定,函数调用生态成熟,格式错误率最低

5. 图像理解/OCR

📌 首选:GPT-4o;中文票据/证件场景用 GLM-4V

6. 大批量翻译

📌 首选:DeepSeek-V3 — 价格极低(¥0.002/1M),中英互译质量不差,适合高量任务

7. 实时对话/低延迟场景

📌 首选:GPT-4o mini 或 GLM-4 — 响应速度最快,适合语音助手、即时问答

8. 离线私有部署

📌 首选:Qwen2-72B(Ollama本地) — 数据不出境,中文能力在开源模型中最强

9. 低成本高并发

📌 首选:DeepSeek-V3 或 GPT-4o mini — 单次请求成本接近零,支撑百万级日请求

10. 创意写作/营销文案

📌 首选:Claude Sonnet 4(文风多样,创意质量高);中文营销场景用 通义千问

选型决策树

数据能出境?
├── 否(国内合规要求)
│   ├── 极致性价比   → DeepSeek-V3
│   ├── 中文质量优先 → 通义千问-Max
│   ├── 代码任务     → GLM-4
│   └── 超长文档     → Kimi
└── 是(可用国际API)
    ├── 代码/Agent构建 → Claude Sonnet 4
    ├── 多模态任务     → GPT-4o
    ├── 超长文档处理   → Gemini 1.5 Pro
    └── 预算有限       → GPT-4o mini

一句话总结

没有最好的模型,只有最适合场景的模型。从需求出发,先用便宜方案验证可行性,再决定是否升级。