Architect Financial Technologiesは Liquid Inferenceをローンチしました。これは、すべてのリクエストに対してライブオークションを実行するLLMルーターです。Liquid Inferenceは、Architectが提供するLLM推論マーケットプレイスで、プロバイダーが各プロンプトの処理に入札します。買い手は、そのルールを満たす最低価格のオファーを支払います。 開発者にとっては非常にシンプルなメッセージです。ベースURLを差し替え、コードはそのままに、プロバイダーに価格で競争させます。
Liquid Inferenceとは何か?
Liquid Inferenceは、LLM推論向けの取引所スタイルのルーターです。 Architectによると、プロバイダーは特定のモデルを処理するためのオファーを提示します。各リクエストは、指定されたモデルの見積もりを提示するすべてのプロバイダーにわたってオークションにかけられます。買い手のルールを満たす最低価格のオファーが落札します。
この製品は、AIラボではなくトレーディング企業によるものです。Architectは AX永続先物取引所を運営しており、2026年5月にGPUコンピュート先物を上場するための 米国指定契約市場(DCM)を買収 しました(規制審査中)。チームは金融取引所の構築経験を活かし、推論における双方向の価格発見を生み出しました。
推論オークションはどのように機能するのか?
フローは4つのステップで構成されます:
- リクエスト: クライアントが標準のOpenAIまたはAnthropic APIコールを送信します。
- ルール: 買い手の制約条件が適格なオファーをフィルタリングします。
- オークション: そのモデルの見積もりを提示するプロバイダーが競争します。条件を満たす最低価格のオファーが落札します。
- レシート: 最大価格は生成前に固定されます。課金は計測された使用量のみを対象とします。
買い手は、 ジョブごとのコスト上限、最初のトークンまでの時間制限、最低スループットを設定できます。また、承認されたリージョンの要求、データ保持ゼロ、プロバイダーまたはモデルの許可リストも指定できます。Autoモードでは、特定の作業単位に対してモデルを自動選択できます。Harrisonの LinkedIn投稿 によると、ルーティングルールのプリセットと完全なマルチモーダル対応も追加されています。
アカウント保有者は、ライブの注文板、プロバイダー別・モデル別の見積もり、および約定済み取引を閲覧できます。このレベルの市場データは、LLM APIとしては珍しいものです。
買い手は何を得られるのか?
- エージェント型コーディングツールとのドロップイン互換性。この 投稿 には、Claude Code、Codex、OpenCode、Cursor、Pi、Clineが挙げられている。
- 無料のメールサインアップ。Harrisonによれば、最初の500人のユーザーは20ドル分の無料推論を受け取れる。
- 紹介プログラム:紹介された利用料の20%を無料推論として還元、さらに二次紹介には10%。
推論プロバイダーは何を得られるのか?
プロバイダーはLiquid Inferenceアプリを通じてオンボードする。Harrisonは、新しいプロバイダーの検証が「数週間ではなく数分」で行われると述べている。すべてのプロンプトはOpenAI API標準を使用する。RESTおよびWebSocket APIでモデルと見積もりを登録する。
プロバイダーは自社のコストに基づいて見積もりを更新できる。これにより、希望する時だけ余剰のGPUキャパシティを販売できる。支払いはStripeを通じて処理され、すべてのジョブの項目別記録が残る。
Liquid InferenceはOpenRouterやHugging Faceとどう比べられるのか?
| 機能 | Liquid Inference | OpenRouter | Hugging Face Inference Providers |
|---|---|---|---|
| ルーティングモデル | 見積もりを提示するプロバイダー間のリクエスト単位のオークション | 価格による重み付きロードバランシング、価格の逆2乗 | デフォルトで最速のプロバイダー; :cheapest サフィックスは任意 |
| モデル / プロバイダー数 | 「数百」規模のモデル。プロバイダーは非公開 | 500以上のモデル、80以上のプロバイダー | 18のパートナーを公開 |
| API互換性 | OpenAIおよびAnthropic互換 | OpenAI互換 | OpenAI互換、チャットのみ |
| 価格上限 | 最初のトークンの前に最大価格を固定 | max_price パラメータ | 非公開 |
| データ管理 | ZDR、リージョン、許可リスト | zdr, data_collection, only/ignore | プロバイダーの優先順位 |
| プラットフォーム手数料 | 非公開 | クレジットカード手数料5.5%、最低0.80ドル | マークアップなし |
| 無料クレジット | 最初の500ユーザーに20ドル | 非公開 | 毎月0.10ドル無料、PROは2.00ドル |
| 公開マーケットデータ | ライブ注文板と約定済み取引 | 非公開 | 非公開 |
主なポイント
- Liquid InferenceはすべてのLLMリクエストを競合プロバイダー間でオークションにかけます。
- 最初のトークンの前に最大価格が固定され、ジョブごとのレシートが発行されます。
- Claude CodeやCursorを含むOpenAIおよびAnthropicクライアントで動作します。
- 最初の500ユーザーは20ドルの無料クレジットを獲得。紹介により手数料の20%を獲得できます。
- 料金、プロバイダーリスト、レイテンシデータはまだ公開されていません。
「Check out the」をチェックしてみてください。 技術的詳細. 本プロジェクトの研究者に全ての功績があります。また、ぜひ私たちをフォローしてください Twitter そして、私たちの 150k以上のMLサブレディット および登録する 当社のニュースレター. 待って!Telegram(テレグラム)は使っていますか? Telegramでもご一緒にご参加いただけるようになりました。
当該投稿 ArchitectがLiquid Inferenceを開始、LLM推論向けのリアルタイムオークション 最初に掲載されたのは MarkTechPost.