MarkTechPost

Architect lanza Liquid Inference, una subasta en tiempo real para la inferencia de LLM

Architect Financial Technologies ha lanzado Liquid Inference, un router de LLM que realiza una subasta en tiempo real para cada solicitud. Liquid Inference es un mercado de inferencia de LLM de Architect, donde los…

Architect Financial Technologies ha lanzado Liquid Inference, un router de LLM que realiza una subasta en tiempo real para cada solicitud. Liquid Inference es un mercado de inferencia de LLM desarrollado por Architect, donde los proveedores compiten por atender cada prompt. El comprador paga la oferta más baja que cumpla con sus reglas. Para los desarrolladores, es muy sencillo: cambia una URL base, mantiene su código y deja que los proveedores compitan por el precio.

¿Qué es Liquid Inference?

Liquid Inference es un enrutador de estilo intercambio para la inferencia de LLM. Según Architect, los proveedores publican ofertas para servir modelos específicos. Cada solicitud se subasta entre todos los proveedores, con la indicación del modelo correspondiente. La oferta más barata que cumple con las reglas del comprador gana.

El producto proviene de una empresa comercial, no de un laboratorio de IA. Architect gestiona la bolsa perpétua de futuros AX. En mayo de 2026, adquirió un mercado de contratos designado en EE. UU. para listar futuros de cálculo de GPU, en espera de la revisión regulatoria. El equipo utilizó su experiencia en la creación de bolsas financieras para generar descubrimiento de precios bidireccional para la inferencia.

¿Cómo funciona la subasta de inferencia?

El flujo tiene 4 etapas:

  1. Petición: Un cliente envía una llamada estándar a la API de OpenAI o Anthropic.
  2. Reglas: Las restricciones del comprador filtran las ofertas aptas.
  3. Subasta: Los proveedores que ofrecen el modelo compiten entre sí. La oferta más baja que cumpla con los requisitos gana.
  4. Recibo: El precio máximo está fijado antes de la generación. La facturación cubre únicamente el uso medido.

Los compradores pueden establecer límites de costo por trabajo, límites de tiempo para obtener el primer token y el caudal mínimo. También pueden requerir regiones aprobadas, no retención de datos y listas de permisos para proveedores o modelos. El modo Auto puede elegir el modelo para una unidad específica de trabajo. La publicación de LinkedIn de Harrison incluye ajustes predefinidos de reglas de enrutamiento y soporte multimodal completo.

Los titulares de cuenta pueden ver los libros de órdenes en tiempo real, las cotizaciones por proveedor y por modelo, y las transacciones liquidadas. Ese nivel de datos de mercado es inusual para una API de LLM.

¿Qué reciben los compradores?

  • Compatibilidad rápida con herramientas de codificación agente. Las publicaciones incluyen Claude Code, Codex, OpenCode, Cursor, Pi y Cline.
  • Registro gratuito de correo electrónico. Los primeros 500 usuarios reciben $20 de inferencia gratis, según Harrison.
  • Programa de referencia: el 20% de las tarifas asignadas por referencias son gratuitas, además del 10% por referencias de segundo nivel.

¿Qué reciben los proveedores de inferencia?

Proveedores que se integran a través de la aplicación Liquid Inference. Harrison dice que los nuevos proveedores son verificados “en minutos, no en semanas”. Todos los prompts utilizan el estándar de la API OpenAI. Una API REST y WebSocket registra modelos y cotizaciones.

Los proveedores pueden actualizar las cotizaciones basándose en sus propios costos. Eso les permite vender la capacidad de GPU sobrante solo cuando deseen. Los pagos se realizan a través de Stripe, con registros detallados de cada trabajo.

¿Cómo se compara Liquid Inference con OpenRouter y Hugging Face?

CaracterísticaLíquido InferenceOpenRouterProveedores de inferencia de Hugging Face
Modelo de enrutamientoSubasta por solicitud entre proveedores de cotizacionesBalanceo de carga ponderado por precio, inverso cuadrado del precioProveedor más rápido por defecto; sufijo :cheapest opcional
Cantidad de modelos / proveedores“Cientos” de modelos; los proveedores no se divulgan500+ modelos, 80+ proveedores18 socios listados
Compatibilidad de APIOpenAI y compatible con AnthropicCompatible con OpenAICompatible con OpenAI, solo chat
Límite de precioPrecio máximo bloqueado antes del primer tokenmax_price parámetroNo divulgado
Controles de datosZDR, regiones, listas de permisoszdr, data_collection, only/ignore Orden de preferencia del proveedor
Tarifa de plataformaNo divulgadoTasa de crédito de la tarjeta del 5.5%, mínimo de $0.80No marcado
Créditos gratis$20 para los primeros 500 usuariosNo divulgado$0.10/mes gratis, $2.00 PRO
Datos del mercado públicoLibros de órdenes en tiempo real y transacciones liquidadasNo divulgadoNo divulgado

Conclusiones Clave

  • Liquid Inference subasta cada solicitud de LLM entre proveedores competitivos.
  • El precio máximo está bloqueado antes del primer token, con un recibo por trabajo.
  • Funciona con clientes de OpenAI y Anthropic, incluyendo Claude Code y Cursor.
  • Los primeros 500 usuarios reciben $20 gratis; las referencias obtienen el 20% de las tarifas.
  • Las tarifas, la lista de proveedores y los datos de latencia aún no están públicos.


Echa un vistazo a los detalles técnicos. Todo el crédito pertenece al investigador de este proyecto. También, no dudes en seguirnos en Twitter y, no olvides, unirte a nuestro subreddit de 150k+ ML y suscribirte a nuestro boletín. ¡Espera! ¿Estás en Telegram? Ahora puedes unirte a nosotros en Telegram también.

El artículo Architect Launches Liquid Inference, a Real-Time Auction for LLM Inference apareció primero en MarkTechPost.

Fuente original

MarkTechPost

Notas sobre el contenido

La publicación original y los derechos pertenecen a la fuente.

Traducción automática · Consulte el original