GLM 5.3 Flash vs Nemotron 3 Ultra
Обе модели доступны по одному OpenAI-совместимому ключу Gdevse, поэтому разница — только в цене за токен и в характеристиках. Цены в ₽ за 100 тыс. токенов розничные; скорость, задержка и недельный объём — публичные замеры провайдера.
z-ai
GLM 5.3 FlashGLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она подходит для эффективного кодирования и задач агента с долгим горизонтом. Его гибридный разреже…
nvidia
Nemotron 3 UltraNVIDIA Nemotron 3 Ultra — модель открытого фронтир-рассуждения и оркестрации от NVIDIA, с 55 B активных параметров из 550 B всего (MoE). Построена на гибридной …
| Показатель | GLM 5.3 Flash | Nemotron 3 Ultra |
|---|---|---|
| Вход, ₽/100K | 1,5 ₽ | 6 ₽ |
| Выход, ₽/100K | 5 ₽ | 24 ₽ |
| Контекст | 1.31M | 262K |
| TPS | 85 ток/с | 135 ток/с |
| Задержка p50 | 287 мс | 292 мс |
| Токенов за неделю | 16.9T | 4.8T |
- Вход: GLM 5.3 Flash — дешевле на 75%
- Выход: GLM 5.3 Flash — дешевле на 79%
- Контекст: GLM 5.3 Flash — 1 310 720 токенов
- TPS: Nemotron 3 Ultra — 135 ток/с
- Задержка: GLM 5.3 Flash — 287 мс до первого токена