Schematron V2 Turbo ist ein 3B-Parameter HTML-zu-JSON-Extraktionsmodell von Inference.net. Es priorisiert den Durchsatz für hochvolumige Extraktions-Workloads. Extraktionsanweisungen müssen eher über ein JSON-Schema im response_format geliefert werden...
Inference.net: Schematron V2 Turbo — Inference.net. Kontextfenster 128,000 Tokens. API-Preis (pro 1 Mio. Tokens): Eingabe $0.03, Ausgabe $0.15. Lizenz: Proprietary.
| Anbieter | Inference.net |
|---|---|
| API-Modell-ID | inference-net/schematron-v2-turbo |
| Stufe | Mid |
| Kontextfenster | 128,000 Tokens |
| Max. Ausgabe | 8,192 Tokens |
| Lizenz | Proprietary |
| API-Preis (pro 1 Mio. Tokens) · Eingabe | $0.03 |
| API-Preis (pro 1 Mio. Tokens) · Ausgabe | $0.15 |