GPT-5.6 Luna vs Nemotron 3 Ultra
Обе модели доступны по одному OpenAI-совместимому ключу Gdevse, поэтому разница — только в цене за токен и в характеристиках. Цены в ₽ за 100 тыс. токенов розничные; скорость, задержка и недельный объём — публичные замеры провайдера.
openai
GPT-5.6 LunaGPT-5.6 Luna — быстрый, экономичный модель в серии GPT-5.6 от OpenAI. Она подходит для задач с высоким объёмом и чувствительностью к задержкам, таких как чат, к…
nvidia
Nemotron 3 UltraNVIDIA Nemotron 3 Ultra — модель открытого фронтир-рассуждения и оркестрации от NVIDIA, с 55 B активных параметров из 550 B всего (MoE). Построена на гибридной …
| Показатель | GPT-5.6 Luna | Nemotron 3 Ultra |
|---|---|---|
| Вход, ₽/100K | 2 ₽ | 6 ₽ |
| Выход, ₽/100K | 12 ₽ | 24 ₽ |
| Контекст | 1.05M | 262K |
| TPS | 80 ток/с | 135 ток/с |
| Задержка p50 | 795 мс | 292 мс |
| Токенов за неделю | 8.5T | 4.8T |
- Вход: GPT-5.6 Luna — дешевле на 67%
- Выход: GPT-5.6 Luna — дешевле на 50%
- Контекст: GPT-5.6 Luna — 1 050 000 токенов
- TPS: Nemotron 3 Ultra — 135 ток/с
- Задержка: Nemotron 3 Ultra — 292 мс до первого токена