{"data":{"id":"inference-net/schematron-v2-turbo","name":"Inference.net: Schematron V2 Turbo","created":1789176949,"description":"Schematron V2 Turbo is a 3B-parameter HTML-to-JSON extraction model from Inference.net. It prioritizes throughput for high-volume extraction workloads. Extraction instructions must be supplied through a JSON schema in response_format rather...","architecture":{"tokenizer":"Other","instruct_type":null,"modality":"text->text","input_modalities":["text"],"output_modalities":["text"]},"endpoints":[{"name":"InferenceNet | inference-net/schematron-v2-turbo-20260902","model_id":"inference-net/schematron-v2-turbo","model_name":"Inference.net: Schematron V2 Turbo","context_length":128000,"pricing":{"prompt":"0.00000003","completion":"0.00000015","input_cache_read":"0.00000003","discount":0},"provider_name":"InferenceNet","tag":"inference-net","quantization":"unknown","max_completion_tokens":8192,"max_prompt_tokens":null,"supported_parameters":["max_tokens","temperature","top_p","stop","frequency_penalty","presence_penalty","seed","top_k","min_p","logit_bias","response_format","structured_outputs"],"supports_tool_choice":{"none":true,"auto":true,"required":true,"function":true},"status":0,"uptime_last_30m":100,"uptime_last_5m":100,"uptime_last_1d":99.8779495524817,"supports_implicit_caching":false,"supports_voice_cloning":false,"latency_last_30m":null,"throughput_last_30m":null}]}}