Modelos

Catálogo, papeles, costo estimado y latencia

Modelos en catálogo
Papeles cubiertos
Gasto estimado · 30 d

sin gasto en la ventana

Costo por decisión

sin trazas aún

Catálogo

Los modelos vigentes con su precio por millón de tokens, su ventana y si la credencial está puesta.

Papeles

Qué modelo atiende cada papel del sistema, qué hace y por qué le toca ese nivel. Los modelos proponen; quien autoriza sigue siendo el motor de riesgo.

Gasto real

Lo que costó pensar, tomado de las trazas del agente. Cada llamada de modelo deja su consumo en su paso.

estimado

Latencia por modelo

Junto al costo, es lo que decide si un papel debe bajar de nivel: un modelo de frontera que tarda 40 segundos no sirve para una señal de 5 minutos.

Comparativa de niveles

Los tres niveles de cada proveedor, lado a lado. Elegir nivel es una decisión de costo, no una corazonada.

El costo de esta página es una estimación.

Se calcula multiplicando los tokens que reportó cada SDK por los precios del catálogo (backend/core/models_registry.py), no leyendo la factura del proveedor. Dos motivos para no confundirlos: los precios cambian y el catálogo se actualiza a mano, y el conteo de tokens del SDK puede diferir del que factura el proveedor — el almacenamiento en caché, los tokens de razonamiento y el redondeo por petición no siempre se reportan igual.

Úsala para comparar modelos y decidir niveles. Para saber cuánto se debe, la fuente es el panel de facturación de cada proveedor.