inference-net

Inference.net: Schematron V2 Turbo

inference-net/schematron-v2-turbo

Schematron V2 Turbo is a 3B-parameter HTML-to-JSON extraction model from Inference.net. It prioritizes throughput for high-volume extraction workloads. Extraction instructions must be supplied through a JSON schema in response_format rather...

Precios actualizados: 7/10/2026

Input
3.3
créditos / 1M tokens
Output
17
créditos / 1M tokens
Contexto
128k
tokens
Mensajes por $1 USD
≈ 8,700
mensaje típico: 1k tokens in + 500 out

Precios en créditos por millón de tokens. 1 crédito = $0.01 USD. Precio final, se factura en MXN al tipo de cambio del día del pago + IVA (CFDI). Sujetos a cambio sin previo aviso.

Precios adicionales

Caché (lectura): 3.3 /1M

Ficha técnica

Entradas
text
Salidas
text
Máx. tokens de salida
8,192
Conocimiento hasta
—
Tokenizer
Other
Capacidades
Texto / LLM
JSON

Úsalo en tu código

Un solo endpoint compatible con OpenAI. Cambia de modelo cambiando una línea.

curl https://api.deployalo.com/ai/gateway/v1/chat/completions \
  -H "Authorization: Bearer $DEPLOYALO_AI_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"inference-net/schematron-v2-turbo","messages":[{"role":"user","content":"Hola"}]}'

¿Listo para usarlo?

Recarga una bolsa de créditos, crea tu API key con tope de gasto y empieza en minutos.