☝🏻Google выпустила Gemma 4 — семейство открытых моделей, которые обходят конкурентов в 20 раз крупнее себя Gemma 4 —
Gemma 4 — это четыре модели разного размера (2B/4B/26B/31B) предназначенные для запуска на собственном железе.
Флагманская 31B Dense сейчас занимает 3-е место среди всех открытых моделей мира в рейтинге Arena AI, а 26B MoE — 6-е, при том что они обгоняют модели с числом параметров в 20 раз больше.🏆
☝🏻☝🏻Главная идея релиза — максимум интеллекта на параметр.
Неквантованные веса 31B помещаются на одну NVIDIA H100 (80 ГБ), а квантованные версии работают даже на потребительских видеокартах.
Две младшие модели — 2B и 4B — созданы совместно с командой Pixel, Qualcomm и MediaTek, и запускаются полностью офлайн с околонулевой задержкой на смартфонах, Raspberry Pi и Jetson Orin Nano.
Все модели мультимодальны: обрабатывают видео и изображения, а 2B и 4B дополнительно понимают аудиовход и распознают речь.
Контекстное окно — до 256K токенов у старших и 128K у младших моделей, нативная поддержка более 140 языков, включая русский.🌍
☝🏻☝🏻Ключевой стратегический ход — переход на лицензию Apache 2.0.
Предыдущие Gemma выходили под ограничительной собственной лицензией Google, теперь же модели можно свободно использовать в коммерческих продуктах, дообучать и перепродавать без отчислений.
По данным Artificial Analysis, на бенчмарке GPQA Diamond (198 вопросов написанных экспертами в области биологии, физики и химии) модель Gemma 4 31B в режиме рассуждений набирает 85.7% — второй результат среди открытых моделей до 40B параметров, уступая лишь Qwen3.5 27B (85.8%), и при этом расходуя меньше токенов на вывод.📊
На Android новая модель работает до 4x быстрее предыдущих поколений и потребляет на 60% меньше батареи.