为什么嵌入模型更需要开放权重

Simon Willison3 天前

嵌入模型不宜只依赖封闭托管服务

EmbeddingGemma 2 采用 Apache 2.0 许可证,这一点值得关注。对于嵌入模型而言,使用封闭、专有、且只能通过托管服务访问的模型,存在明显的长期风险。

嵌入模型的常见用法,是为大量内容计算向量表示,并将这些向量保存下来,供后续检索、相似度比较或其他应用使用。实际项目中,这类向量的数量可能达到成千上万,甚至数百万。

问题在于:如果所使用的模型是专有模型,服务商未来可能会停止提供该模型。即便他们推出了更好的替代模型,已有系统中保存的大量旧向量仍然可能需要重新计算。

这会带来额外成本:

  • 需要重新处理已有内容;
  • 需要重新生成并存储向量;
  • 可能影响检索结果的一致性;
  • 迁移过程依赖服务商的政策和定价。

2024 年 4 月,OpenAI 曾提出为用户迁移到新嵌入模型承担重新嵌入内容的财务成本。但这类安排并不能假设所有模型提供商都会提供。

开放权重并不等于必须自托管

一个重要观点是:选择开放权重模型,并不意味着用户一定想要自己部署模型。

更理想的方式可能是:平时付费使用托管服务,以获得便利和稳定性;同时确认该模型存在开放权重版本。这样,一旦原服务商停止托管,用户仍有退路:

  • 可以自行运行该模型;
  • 也可以寻找其他能够托管同一开放权重模型的服务商。

对于嵌入模型来说,这种可替代性尤其重要,因为历史向量数据往往是系统资产的一部分。开放许可证和开放权重并不只是“开源友好”的象征,也能直接影响长期维护成本和供应商锁定风险。

评论

请登录后发表观点

暂无数据