Qwen: Qwen3.5-Flash
Context 1Mqwen/qwen3.5-flash-02-23
Модели Qwen3.5 native vision-language Flash построены на гибридной архитектуре, которая объединяет механизм линейного внимания (linear attention) и разреженную смесь экспертов (sparse mixture-of-experts). Это позволяет добиться более высокой эффективности инференса. По сравнению с серией 3, эти модели обеспечивают значительный скачок производительности как в чисто текстовых задачах, так и в мультимодальных. Они предлагают более быстрый отклик, одновременно балансируя скорость инференса и общую производительность.
Возможности
Chat Completions
Streaming
Vision
Files
Вход
Изображения · Текст · Видео
Выход
Текст
Поддерживаемые параметры API
frequency_penaltyinclude_reasoningmax_tokenspresence_penaltyreasoningresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p
Лимиты
Maximum output65.5K
Параметры по умолчанию
{
"top_p": null,
"temperature": null,
"frequency_penalty": null
}