Inference.net: Schematron V2 Turbo

Schematron V2 Turbo ist ein 3B-Parameter HTML-zu-JSON-Extraktionsmodell von Inference.net. Es priorisiert den Durchsatz für hochvolumige Extraktions-Workloads. Extraktionsanweisungen müssen eher über ein JSON-Schema im response_format geliefert werden...

Inference.net: Schematron V2 Turbo — Inference.net. Kontextfenster 128,000 Tokens. API-Preis (pro 1 Mio. Tokens): Eingabe $0.03, Ausgabe $0.15. Lizenz: Proprietary.

Benchmarks · API-Preis (pro 1 Mio. Tokens)

AnbieterInference.net
API-Modell-IDinference-net/schematron-v2-turbo
StufeMid
Kontextfenster128,000 Tokens
Max. Ausgabe8,192 Tokens
LizenzProprietary
API-Preis (pro 1 Mio. Tokens) · Eingabe$0.03
API-Preis (pro 1 Mio. Tokens) · Ausgabe$0.15
Im vollständigen Katalog vergleichen