Host
Nebius
0 models created · 6 host offerings
Active Models
0
Host Offerings
6
Cheapest Input
—
Largest Context
—
Models Hosted
Page 1 of 1 · 6 offerings
| Model | Creator | In / M | Out / M | Context | Quant | Uptime 30m | Latency | TPS |
|---|---|---|---|---|---|---|---|---|
| Z.ai: GLM 5.1 Nebius | z-ai/glm-5.1-20260406 | Z Ai | $1.40 | $4.40 | 203K | fp8 | 100.00% | 897ms | 34.0 |
| Qwen: Qwen3 32B Nebius | qwen/qwen3-32b-04-28 | — | $0.100 | $0.300 | 41K | fp8 | 98.28% | 431ms | 17.0 |
| Qwen: Qwen3 235B A22B Instruct 2507 Nebius | qwen/qwen3-235b-a22b-07-25 | Alibaba | $0.200 | $0.600 | 262K | fp8 | 97.31% | 444ms | 46.0 |
| Qwen: Qwen3 30B A3B Instruct 2507 Nebius | qwen/qwen3-30b-a3b-instruct-2507 | Alibaba | $0.100 | $0.300 | 262K | fp8 | 97.03% | 293ms | 48.0 |
| MiniMax: MiniMax M2.5 Nebius | minimax/minimax-m2.5-20260211 | Minimax | $0.300 | $1.20 | 8K | fp4 | — | 729ms | 79.0 |
| Qwen: Qwen3 Next 80B A3B Thinking Nebius | qwen/qwen3-next-80b-a3b-thinking-2509 | Alibaba | $0.150 | $1.20 | 8K | fp8 | — | 237ms | 87.0 |
- Z.ai: GLM 5.1Z Ai · fp8$1.40 in$4.40 out203K ctx100.00% up
- Qwen: Qwen3 32B· fp8$0.100 in$0.300 out41K ctx98.28% up
- Qwen: Qwen3 235B A22B Instruct 2507Alibaba · fp8$0.200 in$0.600 out262K ctx97.31% up
- Qwen: Qwen3 30B A3B Instruct 2507Alibaba · fp8$0.100 in$0.300 out262K ctx97.03% up
- MiniMax: MiniMax M2.5Minimax · fp4$0.300 in$1.20 out8K ctx
- Qwen: Qwen3 Next 80B A3B ThinkingAlibaba · fp8$0.150 in$1.20 out8K ctx
