Google: Gemma 3n 4B
Context 32.8Kgoogle/gemma-3n-e4b-it
Gemma 3n E4B — Модель оптимизирована для эффективной работы на мобильных и малоресурсных устройствах, таких как телефоны, ноутбуки и планшеты. Модель поддерживает мультимодальные входные данные, включая текст, визуальные данные и аудио, что позволяет решать разнообразные задачи, такие как генерация текста, распознавание речи, перевод и анализ изображений. Используя такие инновации, как кэширование Per-Layer Embedding (PLE) и архитектуру MatFormer, Gemma 3n динамически управляет использованием памяти и вычислительной нагрузкой путем выборочной активации параметров модели, что значительно снижает требования к ресурсам во время выполнения. Эта модель поддерживает широкий лингвистический диапазон (обучена на более чем 140 языках) и имеет гибкое контекстное окно на 32 000 токенов. Gemma 3n может выборочно загружать параметры, оптимизируя память и эффективность вычислений в зависимости от задачи или возможностей устройства, что делает модель хорошо подходящей для ориентированных на конфиденциальность, автономных приложений и решений искусственного интеллекта на устройствах. Подробнее читайте в сообщении в блоге.
Возможности
Текст
Текст
Поддерживаемые параметры API