Компания Google DeepMind анонсировала Gemma 4 — новое поколение открытых моделей, созданное на основе технологий Gemini 3. Это первое поколение, в котором используется архитектура «смесь экспертов» (Mixture of Experts). При наличии 26 миллиардов параметров, во время инференса активируются только 3,8 миллиарда, что обеспечивает высокую скорость работы без ущерба для глубины анализа. В линейку вошли четыре модели: E2B, E4B, 26B MoE и 31B Dense, доступные на платформе Hugging Face. Модель 31B Dense уже заняла третье место среди открытых моделей в рейтинге Arena AI Text. Исследователи подчеркивают, что данный экземпляр конкурирует с боее крупными моделями, благодаря оптимизации «интеллекта на параметр». Компактные E2B и E4B ориентированы на устройства, такие как смартфоны и Raspberry Pi, и могут работать офлайн. Все модели мультимодальны и поддерживают ввод изображений и видео, а младшие версии также обрабатывают аудио. Контекстное окно достигает 256 тысяч токенов для старших моделей. Gemma 4 поддерживает более 140 языков и доступна под лицензией Apache 2.0, что делает ее привлекательной для коммерческого использования. Этот релиз укрепляет позиции Google в области локального ИИ, позволяя запускать старшие модели на одном GPU для низкой задержки и обеспечения цифрового суверенитета.