Все модели

Google: Gemma 3n 4B

Context 32.8K

google/gemma-3n-e4b-it

Gemma 3n E4B — Модель оптимизирована для эффективной работы на мобильных и малоресурсных устройствах, таких как телефоны, ноутбуки и планшеты. Модель поддерживает мультимодальные входные данные, включая текст, визуальные данные и аудио, что позволяет решать разнообразные задачи, такие как генерация текста, распознавание речи, перевод и анализ изображений. Используя такие инновации, как кэширование Per-Layer Embedding (PLE) и архитектуру MatFormer, Gemma 3n динамически управляет использованием памяти и вычислительной нагрузкой путем выборочной активации параметров модели, что значительно снижает требования к ресурсам во время выполнения. Эта модель поддерживает широкий лингвистический диапазон (обучена на более чем 140 языках) и имеет гибкое контекстное окно на 32 000 токенов. Gemma 3n может выборочно загружать параметры, оптимизируя память и эффективность вычислений в зависимости от задачи или возможностей устройства, что делает модель хорошо подходящей для ориентированных на конфиденциальность, автономных приложений и решений искусственного интеллекта на устройствах. Подробнее читайте в сообщении в блоге.

Возможности

Chat Completions
Streaming
Vision
Files
Вход

Текст

Выход

Текст

frequency_penaltylogit_biasmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatstopstructured_outputstemperaturetop_ktop_p

Лимиты

Maximum output29.5K