personal_asset
配额是免费的,数据主权不是
自建知识库时官方递来一条能省钱的近道——用托管账号的配额,代价是数据要再绕道回对方服务器,这是我8月6日配置时没接的一个近道。

8月6日晚上,我在给自己那套知识库系统WeKnora配环境变量。这东西说白了就是给自己搭一个只装自己资料的"AI大脑"——公众号收藏、平时的决策记录、技术踩坑笔记,统统扔进去,写稿选题时能直接问它"我之前是怎么判断的"。
它原来挂在官方托管版上,今年8月托管版出了故障,我把整套数据搬到自己的服务器,重新搭了一套v0.7.1版本的自建实例。自建之后有个变化:以前调一次AI模型(聊天、把文字转成向量、给检索结果排序)都是托管账号包着的,现在每次调用都得自己掏钱订阅接口。
翻官方配置模板.env.example的时候,我看到一个开关:把托管版的API Key填进去,chat、embedding、rerank这些模型照样能用,账单走托管账号那边,等于蹭一次已经买过的配额,自建这部分的调用费直接省了。填进去、重启,五分钟能省一笔月账单,说实话挺心动的。

但我最后没填。
这条近道换来的不只是免费配额,还搭着两笔账没算。第一笔是数据要再走一趟:填了托管Key,意味着每次调用又得把内容发回对方服务器过一遍。自建的起点本来就是不想让资料再经手别人,这条近道直接把起点否了。
第二笔账藏得更深:如果真用托管版换掉自己接的embedding模型,已经入库的内容得全部重新跑一遍向量化。这不是说说而已——向量化说白了是把每篇内容按语义压成一串数字坐标,换了模型,新旧两套坐标系根本不是一回事,旧坐标在新模型眼里等于乱码,检索照样能跑,结果却全乱。相当于图书馆换了一套分类法,旧书的索引卡全部作废,得把每本书重新编一遍号。省的是这个月的接口费,还的是把全部资料重新入库一遍的工时。

这条近道不是不能走,只是要看清楚省的是哪一段。以后要是处理大量图片、VLM(能看图的模型)费用涨到肉疼的程度,这笔账可能就划算了,到时候值得重新算一遍。但眼下,省下的那点接口费,换不回多花的那笔迁移工时,更换不回资料不再经手别人这件事。
现在配任何工具,只要看到"用某个账号登录能省一步"这类选项,我都会先想两件事:这一步图的是什么,以后要花多大力气拿回来。想不清楚,就先不点。