MarkTechPost

Architect startet Liquid Inference, eine Echtzeit-Auktion für LLM-Inference

Architect Financial Technologies hat Liquid Inference veröffentlicht, einen LLM-Router, der für jede Anfrage eine Live-Auktion durchführt. Liquid Inference ist ein LLM-Inference-Marktplatz von Architect, auf dem Anbieter…

Architect Financial Technologies hat Liquid Inference veröffentlicht, ein LLM-Router, der für jede Anfrage eine Live-Auktion durchführt. Liquid Inference ist ein LLM-Inference-Marktplatz von Architect, auf dem Anbieter um Aufträge bemühen, um jeden Prompt zu bedienen. Der Käufer zahlt den niedrigsten Angebot, der seinen Regeln entspricht. Für Entwickler ist die Botschaft sehr einfach: Sie wechseln eine Grund-URL, behalten ihren Code bei und lassen die Anbieter um Preis konkurrieren.

Was ist Liquid Inference?

Liquid Inference ist ein Router im Austauschstil für LLM-Inferne. Laut Architect posten Anbieter Angebote für bestimmte Modelle. Jede Anfrage wird bei allen Anbietern versteigert, wobei das genannte Modell angegeben wird. Der niedrigste Preis, der den Kriterien des Käufers entspricht, gewinnt.

Das Produkt stammt von einem Handelsunternehmen, nicht von einem KI-Labor. Architect leitet die AX-perpetuelle-Futuresbörse. Im Mai 2026 hat es einen US-Designated-Contract-Markt erworben, um GPU-Computing-Futures aufzulisten – vorbehaltlich einer regulatorischen Überprüfung. Das Team nutzte seine Erfahrung mit der Errichtung von Finanzbörsen, um eine zweigeteilte Preisfindung für Inference zu schaffen.

Wie funktioniert die Inferenz-Auktion?

Der Prozess hat 4 Schritte:

  1. Anfrage: Ein Client sendet eine Standard-OpenAI- oder Anthropic-API-Anfrage.
  2. Regeln: Die Einschränkungen des Käufers filtern die geeigneten Angebote aus.
  3. Auktion: Die Anbieter, die das Modell anpreisen, konkurrieren miteinander. Der niedrigste qualifizierte Angebot gewinnt.
  4. Rechnung: Der maximale Preis ist vor der Generierung festgelegt. Die Abrechnung umfasst nur die gemessene Nutzung.

Käufer können die Kosten pro Auftrag, die Grenzen für die Zeit bis zum Erreichen des ersten Tokens und den Mindestdurchsatz festlegen. Sie können außerdem genehmigte Regionen, keine Datenspeicherung und Listen mit zulässigen Anbietern oder Modellen verlangen. Der Automatische Modus kann das Modell für eine bestimmte Arbeitsstufe auswählen. Harrisons LinkedIn-Post bietet Vordefinierungen von Routenregeln und vollständige multi-mode-Unterstützung.

Kontoinhaber können die aktuellen Orderbücher, die Quoten pro Anbieter und pro Modell sowie die abgewickelten Transaktionen sehen. Dieser Grad an Marktdaten ist für eine LLM-API ungewöhnlich.

Was erhalten die Käufer?

  • Einfache Kompatibilität mit agentischen Coding-Tools. Die Post listet Claude Code, Codex, OpenCode, Cursor, Pi und Cline auf.
  • Kostenlose E-Mail-Anmeldung. Die ersten 500 Nutzer erhalten $20 kostenlosen Inferns, laut Harrison.
  • Ein Referenzprogramm: 20 % der vermittelten Gebühren sind kostenlos, zusätzlich 10 % für Referenzen auf zweiter Ebene.

Was erhalten die Inferenzdienstanbieter?

Anbieter werden über die Liquid Inference-App hinzugefügt. Harrison sagt, dass neue Anbieter in „Minuten, nicht in Wochen“ verifiziert werden. Alle Anfragen nutzen den Standard der OpenAI API. Eine REST- und WebSocket-API registriert Modelle und Quoten.

Anbieter können die Quoten anhand ihrer eigenen Kosten aktualisieren. Dadurch können sie die verfügbare GPU-Leistung nur dann verkaufen, wenn sie es wollen. Die Zahlungen werden über Stripe abgewickelt, mit detaillierten Aufzeichnungen für jeden Auftrag.

Wie vergleicht Liquid Inference mit OpenRouter und Hugging Face?

FeatureLiquid InferenceOpenRouterHugging Face Inference Providers
Routing-ModellAuktion nach Anfrage über verschiedene OfferiererPreiskonformes Lastbalancing, umgekehrter Quadrat des PreisesSchnellster Anbieter standardmäßig; optional verfügbar mitSuffix :cheapest
Anzahl der Modelle / Anbieter„Hunderte“ von Modellen; Anbieter werden nicht genannt500+ Modelle, 80+ Anbieter18 aufgelistete Partner
API-KompatibilitätOpenAI und mit Anthropic kompatibelOpenAI-kompatibelMit OpenAI kompatibel, nur Chat
PreisgrenzeMaximalpreis gesichert vor dem ersten Tokenmax_price ParameterNicht offenlegt
DatensteuerungZDR, Regionen, Erlaubniserlistezdr, data_collection, only/ignoreAnordnung der Anbietervorlieben
PlattformgebührNicht offenlegt5,5 % Kartenkreditgebühr, Mindestbetrag von $0,80Keine Markierung
Kostenlose Kredite$20 für die ersten 500 BenutzerNicht offenlegt$0,10/Monat kostenlos, $2,00 PRO
Öffentliche MarktdatenLaufende Orderbücher und ausgeführte TransaktionenNicht offenlegtNicht offenlegt

Wichtigste Erkenntnisse

  • Liquid Inference versteigert jede LLM-Anfrage bei konkurrierenden Anbietern.
  • Der maximale Preis ist vor dem ersten Token festgelegt und wird mit einer Rechnung pro Job ausgezahlt.
  • Kommuniziert mit OpenAI- und Anthropic-Klienten, einschließlich Claude Code und Cursor.
  • Die ersten 500 Benutzer erhalten $20 kostenlos; Referenzen erhalten 20% der Gebühren.
  • Die Gebühren, die Liste der Anbieter und die Latenzdaten sind noch nicht öffentlich.


Schauen Sie sich die technischen Details an. Der gesamte Dank gilt dem Forscher dieses Projekts. Folgen Sie uns auch gerne auf Twitter, und vergessen Sie nicht, sich bei unserem 150k+ML SubReddit anzumelden sowie unseren Newsletter zu abonnieren. Warte! Sind Sie auf Telegram? Jetzt können Sie uns auch auf Telegram beitreten.

Die Nachricht Architect Launches Liquid Inference, a Real-Time Auction for LLM Inference erschien zunächst in MarkTechPost.

Originalquelle

MarkTechPost

Hinweise zum Inhalt

Originalveröffentlichung und Rechte liegen bei der Quelle.

Maschinelle Übersetzung · Original beachten