inferious

Open-weight inference, routed through OpenRouter. Self-hosted on rented GPUs, batched for low cost and low latency.

Live status

Models

ModelContextInOutInput priceOutput price
Example 8B (placeholder โ€” replaced at GPU provisioning)example-model-8b32,768texttext$50000.00/M$150000.00/M
API: /v1/chat/completions ยท /v1/models