GLM 5.3 Flash vs GPT-5.6 Luna
Обе модели доступны по одному OpenAI-совместимому ключу Gdevse, поэтому разница — только в цене за токен и в характеристиках. Цены в ₽ за 100 тыс. токенов розничные; скорость, задержка и недельный объём — публичные замеры провайдера.
z-ai
GLM 5.3 FlashGLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она подходит для эффективного кодирования и задач агента с долгим горизонтом. Его гибридный разреже…
openai
GPT-5.6 LunaGPT-5.6 Luna — быстрый, экономичный модель в серии GPT-5.6 от OpenAI. Она подходит для задач с высоким объёмом и чувствительностью к задержкам, таких как чат, к…
| Показатель | GLM 5.3 Flash | GPT-5.6 Luna |
|---|---|---|
| Вход, ₽/100K | 1,5 ₽ | 2 ₽ |
| Выход, ₽/100K | 5 ₽ | 12 ₽ |
| Контекст | 1.31M | 1.05M |
| TPS | 85 ток/с | 80 ток/с |
| Задержка p50 | 287 мс | 795 мс |
| Токенов за неделю | 16.9T | 8.5T |
- Вход: GLM 5.3 Flash — дешевле на 25%
- Выход: GLM 5.3 Flash — дешевле на 58%
- Контекст: GLM 5.3 Flash — 1 310 720 токенов
- TPS: GLM 5.3 Flash — 85 ток/с
- Задержка: GLM 5.3 Flash — 287 мс до первого токена