Google: Gemini 2.5 Flash Lite
Context 1.0Mgoogle/gemini-2.5-flash-lite
Gemini 2.5 Flash-Lite — это облегченная модель рассуждения в семействе Gemini 2.5, оптимизированная для сверхнизкой задержки и экономической эффективности. Модель обеспечивает улучшенную пропускную способность, более быструю генерацию токенов и лучшую производительность в общих тестах по сравнению с более ранними моделями Flash. По умолчанию «мышление» (т. е. многопроходное рассуждение) отключено, чтобы отдать приоритет скорости, но разработчики могут включить модель с помощью параметра API рассуждения, чтобы выборочно компенсировать затраты в пользу интеллекта.
Возможности
Chat Completions
Streaming
Vision
Files
Вход
Аудио · Файлы · Изображения · Текст · Видео
Выход
Текст
Поддерживаемые параметры API
include_reasoningmax_tokensreasoningresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p
Лимиты
Maximum output65.5K
Параметры по умолчанию
{
"top_p": null,
"temperature": null,
"frequency_penalty": null
}