Все модели

Qwen: Qwen3.5-Flash

Context 1M

qwen/qwen3.5-flash-02-23

Модели Qwen3.5 native vision-language Flash построены на гибридной архитектуре, которая объединяет механизм линейного внимания (linear attention) и разреженную смесь экспертов (sparse mixture-of-experts). Это позволяет добиться более высокой эффективности инференса. По сравнению с серией 3, эти модели обеспечивают значительный скачок производительности как в чисто текстовых задачах, так и в мультимодальных. Они предлагают более быстрый отклик, одновременно балансируя скорость инференса и общую производительность.

Возможности

Chat Completions
Streaming
Vision
Files
Вход

Изображения · Текст · Видео

Выход

Текст

frequency_penaltyinclude_reasoningmax_tokenspresence_penaltyreasoningresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p

Лимиты

Maximum output65.5K

Параметры по умолчанию

{
  "top_p": null,
  "temperature": null,
  "frequency_penalty": null
}