inferencia_B2B

API de inferencia LLM lista para produccion

Integra un modelo de lenguaje a tu producto con un endpoint compatible con el formato OpenAI. Fallback automatico, uso medido por token y facturacion en pesos.

Ya tenes cuenta? Entra aca.

curl https://uat-api.hernan-abeldano.com/v1/chat/completions \
  -H "Authorization: Bearer $INFERENCIA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "default",
    "messages": [{"role": "user", "content": "Hola!"}]
  }'

Todo lo que necesita tu integracion

Pensado para producto en produccion, no para un demo de fin de semana.

Compatible con OpenAI

Mismo formato de request/response que la API de OpenAI. Cambia la base URL y la key, el resto de tu codigo no cambia.

Fallback automatico

Si el modelo principal falla o esta saturado, la request se re-enruta automaticamente a un modelo de respaldo. Sin downtime para tu producto.

API key propia

Cada cuenta tiene su API key con limite de tokens del plan. La generamos automaticamente al activar tu cuenta.

Consumo medido

Ve tokens usados y costo del periodo actual desde tu panel, sin sorpresas en la factura.

Facturacion en pesos

Pagas en ARS via MercadoPago. Sin tarjetas internacionales, sin conversion de moneda.

Alta disponibilidad

Infraestructura pensada para produccion: monitoreo, reintentos y balanceo entre proveedores de inferencia.

Como funciona

Te integras en minutos con el SDK de OpenAI que ya conoces.

1

Crea tu cuenta

Registrate con tu email y contrasena. Te generamos una API key al activar el plan.

2

Apunta tu app al endpoint

Usa la base URL y la key en cualquier cliente compatible con OpenAI (SDKs oficiales, LangChain, curl, etc).

3

Hace las requests que necesites

El servicio balancea entre modelos y aplica fallback automatico si hace falta.

4

Monitorea el consumo

Desde tu panel ves tokens y costo del periodo, y gestionas el pago del plan.

Un plan simple

Sin sorpresas. Podes cancelar cuando quieras.

Preguntas frecuentes

Que formato tiene la API?

Es compatible con el formato de la API de OpenAI (chat completions). Podes usar los SDKs oficiales de OpenAI apuntando la base URL a nuestro endpoint.

Que pasa si el modelo principal falla?

El servicio hace fallback automatico a un modelo de respaldo, de forma transparente para tu aplicacion.

Como se mide el consumo?

Por tokens de entrada y salida, segun el plan contratado. Podes ver el detalle del periodo actual en tu panel.

Como pago?

Via MercadoPago, en pesos argentinos. Desde tu panel encontras el boton de pago del plan.

Puedo cancelar cuando quiera?

Si. No hay permanencia minima.

Integra inferencia LLM en minutos

Crea tu cuenta y obtene tu API key ahora.

Crear cuenta