MarkTechPost

Architect、LLM推論のリアルタイムオークション「Liquid Inference」をローンチ

Architect Financial Technologiesは、すべてのリクエストに対してライブオークションを実行するLLMルーター「Liquid Inference」をローンチしました。Liquid…

Architect Financial Technologiesは Liquid Inferenceをローンチしました。これは、すべてのリクエストに対してライブオークションを実行するLLMルーターです。Liquid Inferenceは、Architectが提供するLLM推論マーケットプレイスで、プロバイダーが各プロンプトの処理に入札します。買い手は、そのルールを満たす最低価格のオファーを支払います。 開発者にとっては非常にシンプルなメッセージです。ベースURLを差し替え、コードはそのままに、プロバイダーに価格で競争させます。

Liquid Inferenceとは何か?

Liquid Inferenceは、LLM推論向けの取引所スタイルのルーターです。 Architectによると、プロバイダーは特定のモデルを処理するためのオファーを提示します。各リクエストは、指定されたモデルの見積もりを提示するすべてのプロバイダーにわたってオークションにかけられます。買い手のルールを満たす最低価格のオファーが落札します。

この製品は、AIラボではなくトレーディング企業によるものです。Architectは AX永続先物取引所を運営しており、2026年5月にGPUコンピュート先物を上場するための 米国指定契約市場(DCM)を買収 しました(規制審査中)。チームは金融取引所の構築経験を活かし、推論における双方向の価格発見を生み出しました。

推論オークションはどのように機能するのか?

フローは4つのステップで構成されます:

  1. リクエスト: クライアントが標準のOpenAIまたはAnthropic APIコールを送信します。
  2. ルール: 買い手の制約条件が適格なオファーをフィルタリングします。
  3. オークション: そのモデルの見積もりを提示するプロバイダーが競争します。条件を満たす最低価格のオファーが落札します。
  4. レシート: 最大価格は生成前に固定されます。課金は計測された使用量のみを対象とします。

買い手は、 ジョブごとのコスト上限、最初のトークンまでの時間制限、最低スループットを設定できます。また、承認されたリージョンの要求、データ保持ゼロ、プロバイダーまたはモデルの許可リストも指定できます。Autoモードでは、特定の作業単位に対してモデルを自動選択できます。Harrisonの LinkedIn投稿 によると、ルーティングルールのプリセットと完全なマルチモーダル対応も追加されています。

アカウント保有者は、ライブの注文板、プロバイダー別・モデル別の見積もり、および約定済み取引を閲覧できます。このレベルの市場データは、LLM APIとしては珍しいものです。

買い手は何を得られるのか?

  • エージェント型コーディングツールとのドロップイン互換性。この 投稿 には、Claude Code、Codex、OpenCode、Cursor、Pi、Clineが挙げられている。
  • 無料のメールサインアップ。Harrisonによれば、最初の500人のユーザーは20ドル分の無料推論を受け取れる。
  • 紹介プログラム:紹介された利用料の20%を無料推論として還元、さらに二次紹介には10%。

推論プロバイダーは何を得られるのか?

プロバイダーはLiquid Inferenceアプリを通じてオンボードする。Harrisonは、新しいプロバイダーの検証が「数週間ではなく数分」で行われると述べている。すべてのプロンプトはOpenAI API標準を使用する。RESTおよびWebSocket APIでモデルと見積もりを登録する。

プロバイダーは自社のコストに基づいて見積もりを更新できる。これにより、希望する時だけ余剰のGPUキャパシティを販売できる。支払いはStripeを通じて処理され、すべてのジョブの項目別記録が残る。

Liquid InferenceはOpenRouterやHugging Faceとどう比べられるのか?

機能Liquid InferenceOpenRouterHugging Face Inference Providers
ルーティングモデル見積もりを提示するプロバイダー間のリクエスト単位のオークション価格による重み付きロードバランシング、価格の逆2乗デフォルトで最速のプロバイダー; :cheapest サフィックスは任意
モデル / プロバイダー数「数百」規模のモデル。プロバイダーは非公開500以上のモデル、80以上のプロバイダー18のパートナーを公開
API互換性OpenAIおよびAnthropic互換OpenAI互換OpenAI互換、チャットのみ
価格上限最初のトークンの前に最大価格を固定max_price パラメータ 非公開
データ管理ZDR、リージョン、許可リストzdr, data_collection, only/ignore プロバイダーの優先順位
プラットフォーム手数料非公開クレジットカード手数料5.5%、最低0.80ドルマークアップなし
無料クレジット最初の500ユーザーに20ドル非公開毎月0.10ドル無料、PROは2.00ドル
公開マーケットデータライブ注文板と約定済み取引非公開非公開

主なポイント

  • Liquid InferenceはすべてのLLMリクエストを競合プロバイダー間でオークションにかけます。
  • 最初のトークンの前に最大価格が固定され、ジョブごとのレシートが発行されます。
  • Claude CodeやCursorを含むOpenAIおよびAnthropicクライアントで動作します。
  • 最初の500ユーザーは20ドルの無料クレジットを獲得。紹介により手数料の20%を獲得できます。
  • 料金、プロバイダーリスト、レイテンシデータはまだ公開されていません。


「Check out the」をチェックしてみてください。 技術的詳細. 本プロジェクトの研究者に全ての功績があります。また、ぜひ私たちをフォローしてください Twitter そして、私たちの 150k以上のMLサブレディット および登録する 当社のニュースレター. 待って!Telegram(テレグラム)は使っていますか? Telegramでもご一緒にご参加いただけるようになりました。

当該投稿 ArchitectがLiquid Inferenceを開始、LLM推論向けのリアルタイムオークション 最初に掲載されたのは MarkTechPost.

原文の出典

MarkTechPost

内容について

原文の公開と権利は出典元に帰属します。

機械翻訳 · 原文をご参照ください