Inference Endpoints
Catalog
Deploy
F
Log In
Model Catalog
Inference Task
Any-to-Any
Price
$ 0 - 40 / hour
0
0.1
0.5
1
5
40
Deploy On
ALL
CPU
GPU
INF2
Inference Engine
All
Llama.cpp
TEI
vLLM
SGLang
License
All Licenses
Hub Models
Browse All Models
2 items
Order by:
Most Recent
thinkingmachines
Inkling-Small-NVFP4
Any-to-Any
SGLang Engine
Apache 2.0 License
GPU
1x Nvidia RTX PRO 6000 Blackwell
$
2.75
google
gemma-4-12B-it
Any-to-Any
vLLM Engine
Apache 2.0 License
GPU
1x Nvidia L40S
$
1.8