Все модели

Google: Gemini 2.5 Flash Lite

Context 1.0M

google/gemini-2.5-flash-lite

Gemini 2.5 Flash-Lite — это облегченная модель рассуждения в семействе Gemini 2.5, оптимизированная для сверхнизкой задержки и экономической эффективности. Модель обеспечивает улучшенную пропускную способность, более быструю генерацию токенов и лучшую производительность в общих тестах по сравнению с более ранними моделями Flash. По умолчанию «мышление» (т. е. многопроходное рассуждение) отключено, чтобы отдать приоритет скорости, но разработчики могут включить модель с помощью параметра API рассуждения, чтобы выборочно компенсировать затраты в пользу интеллекта.

Возможности

Chat Completions
Streaming
Vision
Files
Вход

Аудио · Файлы · Изображения · Текст · Видео

Выход

Текст

include_reasoningmax_tokensreasoningresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p

Лимиты

Maximum output65.5K

Параметры по умолчанию

{
  "top_p": null,
  "temperature": null,
  "frequency_penalty": null
}