客户经常问我们:你们用的是哪家的大模型?我们的回答通常是:看情况。
为什么不绑定
不同的模型擅长的事不一样。有的长文本读得好,有的中文写得更自然,有的又便宜又快,适合大批量的简单任务。把一个项目绑死在一家模型上,等于提前放弃了这些选择。而且模型更新得很快,今天最好的那一个,几个月后未必还是。
我们怎么选
同一个任务,我们会拿几家模型用同一批真实的例子去测,再比四件事:效果、成本、速度和合规要求。国内项目常用 DeepSeek、通义千问、Kimi、智谱 GLM 和豆包,海外项目常用 OpenAI、Claude、Gemini 和 Llama。一个系统里让两三个模型分工,也很常见。
数据怎么处理
- 优先选用不会拿客户数据训练模型的企业级接口
- 数据敏感的场景,把开源模型部署在客户的私有服务器或本地设备上
- 接入数据只开必要的权限,数据怎么用写进合同
- 能在本地处理的数据,不上传
给以后留余地
换模型的成本,我们在设计系统的时候就会考虑进去。以后出了更好的模型,换上去,用同一批例子测一遍,没问题就能用。
