Gemma 4: что известно о новой открытой модели Google
Google анонсировала следующее поколение открытых моделей Gemma. Разбираем, что подтверждено официально, что пока остаётся слухом и на что смотреть, если вы запускаете модели локально.

Что вообще происходит с Gemma
Gemma — это линейка открытых моделей Google, которую компания позиционирует как более лёгкую и доступную альтернативу закрытым Gemini. Первое поколение вышло в феврале 2024 года в вариантах на 2 и 7 миллиардов параметров, затем появилась Gemma 2 (2B, 9B, 27B), а весной 2025 года — Gemma 3 с мультимодальностью и версиями вплоть до 27B. Каждый релиз двигал одну и ту же идею: модель, которую можно скачать, дообучить и запустить на своём железе, а не только через чужой API.
Вокруг названия Gemma 4 сейчас много ожиданий, но здесь важна честность. На момент подготовки материала Google официально не опубликовала полную спецификацию Gemma 4: точные размеры версий, длину контекста, бенчмарки и лицензионные условия нужно смотреть в первоисточнике на день, когда вы это читаете. Всё, что подано в интернете как «финальные цифры Gemma 4», без ссылки на блог Google или карточку модели — стоит перепроверять.
Открытая модель ценна не рекордом в таблице бенчмарков, а тем, что вы можете запустить её у себя, не отдавая данные наружу и не завися от чужого прайса.
Почему «byte for byte» — не просто слоган
Формулировка «byte for byte, the most capable open models» бьёт в конкретную боль: соотношение веса модели к её реальной пользе. Модель на 27B параметров в 4-битной квантизации занимает примерно 15–17 ГБ и помещается в память одной потребительской видеокарты уровня 24 ГБ. Модель на 70B в том же режиме требует уже двух карт или сервера. Разница в удобстве и стоимости запуска — колоссальная, поэтому производители соревнуются не только в абсолютном качестве, но и в том, сколько пользы приходится на каждый гигабайт весов.
Что реально проверять при выходе новой версии
Когда Google выкладывает новое поколение, маркетинговый пост читается за минуту, а решение о запуске зависит от деталей, которых в посте часто нет. Вот что смотреть в карточке модели и лицензии, а не в пересказах.
- Размеры версий. Сколько вариантов, какие по параметрам, есть ли совсем лёгкая на 1–4B для телефонов и слабого железа.
- Длина контекста. У Gemma 3 старшие версии заявляли контекст в 128 тысяч токенов — проверьте, что обещано в новом поколении и как это работает на практике.
- Мультимодальность. Понимает ли модель изображения, только текст, что-то ещё.
- Лицензия. Gemma распространяется по собственной лицензии Google с условиями использования, а не под классической Apache 2.0 или MIT. Это не «полностью свободно» в строгом смысле — читайте ограничения, особенно если продукт коммерческий.
- Форматы весов. Есть ли официальные квантизации (GGUF, форматы для vLLM), поддержка в Ollama, llama.cpp, LM Studio на день релиза.
Открытая не значит бесплатная во всех смыслах
Скачать веса можно бесплатно, но «стоимость» модели складывается из другого: железо для инференса, электричество, время инженера на дообучение и поддержку. Для многих команд запуск открытой модели на своём сервере дороже, чем оплата API закрытой Gemini или GPT, — до тех пор, пока объём запросов не станет большим или пока данные нельзя передавать наружу по требованиям безопасности. Это и есть настоящая цена вопроса, а не строчка «$0» напротив загрузки.
Где открытые модели Google выигрывают, а где нет
| Сценарий | Открытая модель (Gemma) | Закрытый API (Gemini, GPT) |
|---|---|---|
| Чувствительные данные, нельзя наружу | Подходит: всё крутится локально | Требует разрешений и договора об обработке |
| Быстрый старт без своего железа | Нужно поднять инфраструктуру | Работает сразу через ключ |
| Максимальное качество на сложных задачах | Обычно уступает флагманам | Как правило, впереди |
| Дообучение под свою задачу | Полный контроль над весами | Только fine-tuning в рамках, что дают |
| Предсказуемая стоимость при больших объёмах | Фиксируется железом | Растёт линейно с числом запросов |
Вывод простой: линейка Gemma интересна не тем, что она «обгоняет всех», а тем, что закрывает сценарии, где закрытый API неприемлем или невыгоден. Сравнивать её нужно не с флагманским Gemini, а с другими открытыми моделями сопоставимого размера — Llama, Qwen, Mistral.
Как не обжечься на бенчмарках
Цифры MMLU, GSM8K и прочих тестов в пресс-релизе полезны для грубого ориентира, но не для решения. Модель может отлично показывать себя на академических задачах и разваливаться на вашем конкретном формате данных. Единственный надёжный способ — прогнать кандидатов на своём наборе примеров, сравнить ответы вслепую и посмотреть на скорость инференса на вашем железе. День такой проверки экономит недели переписывания на неподходящей модели.
Что делать прямо сейчас
- Откройте официальный анонс Google и карточку модели, зафиксируйте реальные размеры версий и лицензию.
- Прикиньте, какой вариант влезает в вашу видеопамять с учётом квантизации.
- Соберите 20–30 своих типовых задач и прогоните их через новую модель и через ту, что используете сейчас.
- Сравните не только качество ответов, но и скорость и стоимость запуска в вашем сценарии.
- Проверьте лицензионные ограничения, если модель пойдёт в коммерческий продукт.
Пока полные официальные данные по Gemma 4 не подтверждены первоисточником, относитесь к любым «точным» цифрам осторожно. Хорошая новость в том, что порог входа в открытые модели за два года резко упал: то, что раньше требовало кластера, сегодня запускается на одной карте.
Prompt-инженер: Идеальные запросы для Midjourney, ChatGPT и других моделей.
Спросить за 15 ₽Источники: Google Developers Blog — Gemma, Gemma — официальная страница моделей и документация
Частые вопросы
Уже можно скачать Gemma 4?
Чем Gemma отличается от Gemini?
Какая видеокарта нужна для запуска?
Можно ли использовать Gemma в коммерческом продукте?
Открытая модель точно дешевле, чем платный API?
Стоит ли верить бенчмаркам из анонса?
Материал носит информационный характер и подготовлен редакцией «Агентуры». Он не является офертой, рекламой или индивидуальной консультацией. Упомянутые продукты, компании и торговые знаки принадлежат их правообладателям. Перед принятием решений, влекущих юридические или финансовые последствия, обратитесь к профильному специалисту.