EmbeddingGemma 2用Apache 2.0,评论:嵌入模型就该有开放权重
评论:EmbeddingGemma 2
2026年10月6日
我非常赞赏 EmbeddingGemma 2 采用 Apache 2.0 许可证。
特别是对于嵌入模型,我认为使用封闭、专有、仅托管的模型是没有意义的。
嵌入模型的大多数应用涉及计算数千甚至数百万个嵌入向量,并将其存储以供后续比较。
如果你的模型是专有的,供应商很可能有一天会决定停止提供该模型。他们会有更好的模型来替代它,但你仍然需要付费重新计算那些已存储的数百万现有向量。
(2024年4月,OpenAI 提出“承担用户使用这些新模型重新嵌入内容的财务成本”——https://openai.com/index/gpt-4-api-general-availability/ ——但我认为我们不能依赖每个提供商都这样做。)
值得注意的是,我不想自己托管模型。我更愿意向提供商支付托管模型的费用,同时知道如果他们停止托管,我可以自己运行开放权重版本——或者找到其他能为我做这件事的供应商。