这两天Hacker News上有个开源项目火了,上线一天205个赞,评论区直接吵成一锅粥。
两个工程师干的,6月24号提交第一行代码,8月27号把产品挂上网,前后就俩月。
产品叫Experiential,一句话介绍:开源的OpenRouter。
先补个背景,OpenRouter是啥?模型界的"携程"。自己不训练模型,但把OpenAI、Anthropic、Google、DeepSeek几百个模型全接到同一个API后面,开发者一把钥匙调所有模型,一个账单结清,它赚差价和订阅费,估值一度传出超10亿美元。
Experiential就是冲着这个生意来的开源版,口号就仨词:开源、免费、不加价。
那它到底靠啥赚钱?这是评论区问得最多的问题,创始人就回了一句话:靠企业版许可,和自己搭的托管平台。
先别急,得先搞懂它怎么帮你省钱,这部分才是全文重点。
第一层,简单活便宜干,难活贵干。写代码的AI,八成请求是"这个报错啥意思"这种简单问题,两成才是"给整个项目出架构方案"这种难题。旗舰模型输入大概15美元/百万token,DeepSeek这类便宜模型只要0.2到0.3美元,差几十倍。路由器就干一件事:给每个请求判难度,简单的走便宜模型,难题才动用旗舰。注意,这不是多模型并发付多份钱,而是每个请求只付一个模型的钱,只是挑得更准。光这一层,通常就能省掉一半以上账单。
第二层,缓存经济学,最容易忽略也最要命。模型厂商对缓存命中的输入token大幅降价,有的直接打一折,15美元变1.5美元。但缓存是按模型分的!你今天用GPT、明天用Claude,每个模型的缓存都是冷的,次次全价。创始人回答得很实在:诀窍就是很少切换,只在任务边界切换,认准一个主力模型把它的缓存喂热,池子里永远只留两三个模型,多一个都是给缓存添乱。
第三层,把流量变成你自己的模型。通用大模型是给所有人训练的,你的业务却有固定套路。Experiential拿你真实的调用记录离线模拟路由,还能用你的数据微调一个开源模型,变成"你拥有的模型"。它在你自己的活儿上越用越准,越来越多请求就从15美元/百万token的旗舰降级到它身上,等于把API账单里最贵的那块肉,慢慢换成自己养的鸡。
第四层,同一个模型,挑供应商。演示里有个例子:fable-5走Anthropic直连15美元、延迟310毫秒,走Bedrock只要14.2美元、延迟240毫秒。网关给你一个质量、速度、成本三档拨盘,换条路就省钱。
最后还有兜底:默认给每条命令设50美元预算,在网关层强制执行,AI再能折腾,也花不超你设的线。
那钱到底从哪来?三笔。
第一笔,企业版许可,主要收入。免费层没有的智能层全在企业版:逐请求的模型优化、缓存、用你流量训出来的专属模型,再加SSO、审计日志、数据不出境这些合规全家桶。价格不公开,走"联系我们"的定制路线。
第二笔,托管平台。不想自己搭的用现成的,免费层就能用,但企业规模的使用、专属支持、安全审查要付费。
第三笔最反常识:免费层0加价,你带自己的密钥直连,平台一分钱不加,官网原话是"平台这一行永远是0美元"。图啥?图把企业客户的流量先圈进来,你的agent、你的账单都长在它上面,换企业版就是水到渠成。你的数据是训练"你的模型"的燃料,而"你的模型"恰恰是企业版最贵的卖点。免费引流、企业收割,和Redis、GitLab一个路子。
为啥客户愿意掏钱?账很好算:一家公司月API账单3600美元,路由优化加专属模型省一半,每月省1800美元,企业版软件费远低于这个数。省钱工具的钱,最好赚。
这项目也有翻车的地方:创始人说遥测默认关闭,结果自己README里写着默认开启,被网友当场抓包,场面一度尴尬。开源社区的信任是玻璃做的,写清楚、说一致,比功能本身更重要。
普通人创业别一上来就做"更好的模型",要做"帮人省模型钱"的生意。模型越贵越多,路由、网关、缓存这些省钱中间层的机会就越大。而客户的使用数据,就是别人抢不走的护城河。
ai创业 github openai网关

