Architect Financial Technologies 推出了 Liquid Inference,这是一个为每个请求运行实时拍卖的 LLM 路由器。Liquid Inference 是 Architect 推出的一个 LLM 推理市场,由供应商竞标服务每个提示词。买方支付符合其规则的最低报价。 对开发者来说,信息非常简单:换一个 base URL,保留你的代码,让供应商在价格上竞争。
什么是 Liquid Inference?
Liquid Inference 是一个交易所式的 LLM 推理路由器。 根据 Architect 的说法,供应商发布服务特定模型的报价。每个请求会在所有对指定模型报价的供应商之间进行拍卖。符合买方规则的最低价报价获胜。
该产品来自一家交易公司,而非 AI 实验室。Architect 运营着 AX 永续期货交易所。2026年5月,它 收购了一家美国指定合约市场 ,以待监管审查后上市 GPU 算力期货。该团队利用其构建金融交易所的经验,为推理创建了双边价格发现机制。
推理拍卖是如何运作的?
该流程分为 4 个步骤:
- 请求: 客户端发送标准的 OpenAI 或 Anthropic API 调用。
- 规则: 买方的约束条件筛选符合条件的报价。
- 拍卖: 对该模型报价的供应商展开竞争。符合条件的最低报价获胜。
- 回执: 最高价格在生成前被锁定。计费仅覆盖按量计费的使用量。
买方可以设置 每个任务的成本上限、首 token 时间限制和最低吞吐量。他们还可以要求批准的地区、零数据保留以及供应商或模型允许列表。Auto 模式可以为给定的工作单元选择模型。Harrison 的 LinkedIn 帖子 还增加了路由规则预设和完整的多模态支持。
账户持有者可以查看实时订单簿、按供应商和按模型的报价以及已结算的交易。这种级别的市场数据在 LLM API 中并不多见。
买方能得到什么?
- 与智能体编码工具的即插即用兼容性。该 帖子 列出了 Claude Code、Codex、OpenCode、Cursor、Pi 和 Cline。
- 免费邮箱注册。据 Harrison 称,前 500 名用户可获得 20 美元的免费推理额度。
- 推荐计划:被推荐费用的 20% 作为免费推理额度,二级推荐另有 10%。
推理提供商能得到什么?
提供商通过 Liquid Inference 应用入驻。Harrison 表示,新提供商的验证“只需几分钟,而非几周”。所有提示均使用 OpenAI API 标准。一个 REST 和 WebSocket API 用于注册模型和报价。
提供商可以根据自身成本更新报价。这让他们可以只在想要的时候出售闲置的 GPU 算力。付款通过 Stripe 进行,每个任务都有逐项记录。
Liquid Inference 与 OpenRouter 和 Hugging Face 相比如何?
| 功能 | Liquid Inference | OpenRouter | Hugging Face Inference Providers |
|---|---|---|---|
| 路由模型 | 跨报价提供商的每请求拍卖 | 价格加权负载均衡,与价格的平方成反比 | 默认选择最快的提供商; :cheapest 后缀可选 |
| 模型 / 提供商数量 | “数百个”模型;供应商未披露 | 500+ 个模型,80+ 家提供商 | 18家列名合作伙伴 |
| API 兼容性 | 兼容 OpenAI 和 Anthropic 的接口 | 兼容 OpenAI | 兼容 OpenAI,仅支持聊天 |
| 价格上限 | 首个代币前锁定最高价格 | max_price 参数 | 未披露 |
| 数据控制 | ZDR、区域(region)、允许列表 | zdr, data_collection, only/ignore | 提供商优先顺序 |
| 平台费用 | 未披露 | 5.5%刷卡返现费用,最低0.80美元 | 无加价 |
| 免费额度 | 前500名用户获20美元 | 未披露 | 每月免费0.10美元,PRO为2.00美元 |
| 公开市场数据 | 实时订单簿和已成交交易 | 未披露 | 未披露 |
要点总结
- Liquid Inference将每一个LLM请求在相互竞争的提供商之间进行拍卖。
- 最高价格在生成第一个token之前锁定,并附带每项任务的小票。
- 兼容OpenAI和Anthropic客户端,包括Claude Code和Cursor。
- 前500名用户获得20美元免费额度;推荐可赚取20%的费用。
- 费用、提供商列表和延迟数据尚未公开。
查看 技术细节。所有功劳归于该项目的研究员。另外,欢迎在 Twitter 上关注我们,别忘了加入我们的 150k+ML SubReddit 并订阅 我们的新闻通讯。等等!你用Telegram吗? 现在你也可以在Telegram上加入我们。
文章 Architect推出Liquid Inference:面向LLM推理的实时拍卖 首发于 MarkTechPost.