Описание
Для коротких и частых запросов: классификация, саммари, правки текста, шаблонные ответы и высокий поток простых задач, где полный глубокий разбор не нужен.
Спецификация
- Контекст
- 400Kток.
- Max output
- 64 000ток.
- Множитель
- I/O×1.8
- Статус
- online
- ID модели
gpt-5.6-luna- Провайдер
- OpenAI
- Линейка
- Luna
- API
- OpenAI Chat Completions
- Reasoning
- не поддерживается
- Temperature
- поддерживается (если включён на ключе)
Когда брать эту модель
Классификация и маршрутизация
Разнести обращения по очередям, проставить метки, отфильтровать шум — короткий цикл, высокий поток.
Правки и саммари
Сократить текст, вычистить тон, сделать краткое резюме письма или тикета без глубокого исследования темы.
Шаблонные ответы
FAQ, автоответы, простые диалоговые ветки — когда полный разбор Sol/Terra избыточен по цене и задержке.
Расчёт списания
I/O ×1.8Input и output умножаются на множитель модели; context (кэш) добавляется как есть. Reasoning / thinking входит в output.
- Input × 1.8
- 4 000 → 7 200
- Output × 1.8
- 800 → 1 440
- Context
- 0 → 0
К списанию с квоты
8 640
токенов
Другие модели
Частые вопросы о GPT-5.6 Luna
Чем Luna отличается от Sol и Terra?+
Luna рассчитана на короткий цикл: классификация, правки, саммари, шаблонные ответы — меньше глубины рассуждения, быстрее и дешевле по характеру нагрузки. Terra — основной рабочий разбор. Sol — когда нужна максимальная глубина анализа и длинные цепочки выводов. Для сложных задач обычно берут Terra или Sol.
Можно ли переключаться между Luna и Sol на одном ключе?+
Да, если обе модели в allowlist. Меняется только поле model.
Влияет ли prompt caching на квоту?+
Кэш биллится отдельно как Context. Input — только uncached; на него и на output идёт множитель I/O.