GLM 5.3 Flash vs MiMo-V2.5
Обе модели доступны по одному OpenAI-совместимому ключу Gdevse, поэтому разница — только в цене за токен и в характеристиках. Цены в ₽ за 100 тыс. токенов розничные; скорость, задержка и недельный объём — публичные замеры провайдера.
z-ai
GLM 5.3 FlashGLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она подходит для эффективного кодирования и задач агента с долгим горизонтом. Его гибридный разреже…
xiaomi
MiMo-V2.5MiMo-V2.5 — нативная омнимодальная модель от Xiaomi. Она обеспечивает производительность уровня Pro при примерно вдвое меньших затратах инференса, при этом прев…
| Показатель | GLM 5.3 Flash | MiMo-V2.5 |
|---|---|---|
| Вход, ₽/100K | 1,5 ₽ | 1,4 ₽ |
| Выход, ₽/100K | 5 ₽ | 2,8 ₽ |
| Контекст | 1.31M | 1.05M |
| TPS | 85 ток/с | 32 ток/с |
| Задержка p50 | 287 мс | 1055 мс |
| Токенов за неделю | 16.9T | 6.9T |
- Вход: MiMo-V2.5 — дешевле на 7%
- Выход: MiMo-V2.5 — дешевле на 44%
- Контекст: GLM 5.3 Flash — 1 310 720 токенов
- TPS: GLM 5.3 Flash — 85 ток/с
- Задержка: GLM 5.3 Flash — 287 мс до первого токена