GLM 5.3 Flash vs Hy4 preview
Обе модели доступны по одному OpenAI-совместимому ключу Gdevse, поэтому разница — только в цене за токен и в характеристиках. Цены в ₽ за 100 тыс. токенов розничные; скорость, задержка и недельный объём — публичные замеры провайдера.
z-ai
GLM 5.3 FlashGLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она подходит для эффективного кодирования и задач агента с долгим горизонтом. Его гибридный разреже…
tencent
Hy4 previewTencent: Hy4 preview — это модель смешения экспертов от Tencent, с 49B активных параметров из 770B всего. Она предназначена для кодирующих агентов, сложных рабо…
| Показатель | GLM 5.3 Flash | Hy4 preview |
|---|---|---|
| Вход, ₽/100K | 1,5 ₽ | 8,3 ₽ |
| Выход, ₽/100K | 5 ₽ | 25 ₽ |
| Контекст | 1.31M | 1.05M |
| TPS | 85 ток/с | 40 ток/с |
| Задержка p50 | 287 мс | 4291 мс |
| Токенов за неделю | 16.9T | 12.7T |
- Вход: GLM 5.3 Flash — дешевле на 82%
- Выход: GLM 5.3 Flash — дешевле на 80%
- Контекст: GLM 5.3 Flash — 1 310 720 токенов
- TPS: GLM 5.3 Flash — 85 ток/с
- Задержка: GLM 5.3 Flash — 287 мс до первого токена