AI-инструменты 11.04.2026 8 мин чтения

Gemma 4 на телефоне без интернета: как запустить в Google AI Edge Gallery

Пошаговая инструкция: как поставить Google AI Edge Gallery, скачать Gemma 4 E2B и проверить, что модель отвечает на телефоне без интернета. Нужен интернет только для установки приложения и загрузки модели; дальше можно включить авиарежим. Ниже разберём и частые вопросы: какую версию Gemma 4 выбрать — E2B или E4B — и есть ли приложение в App Store для iPhone.

Ссылка на приложение

Google AI Edge Gallery

Это официальное экспериментальное приложение Google для запуска моделей прямо на устройстве. На iPhone ставьте из App Store, на Android — из Google Play. Если Google Play недоступен, ниже есть ссылка на APK-релизы GitHub.

Что понадобится

  • iPhone с iOS 17 или новее. На практике комфортнее брать iPhone 12 и новее, потому что локальная модель заметно грузит память и батарею.
  • Около 3 ГБ свободного места: сама Gemma-4 E2B-it весит примерно 2.54 ГБ.
  • Wi-Fi для первого скачивания. После загрузки модели интернет для обычного чата уже не нужен.

На Android приложение тоже доступно, но интерфейс и список моделей могут отличаться. Если у вас Android, начинайте с официального Google Play или последнего APK-релиза на GitHub.

Шаг 1. Скачайте и откройте Edge Gallery

Установите Google AI Edge Gallery и откройте приложение. На главном экране будут сценарии: Ask Image, Audio Scribe, AI Chat, Agent Skills, Prompt Lab и другие.

Главный экран Google AI Edge Gallery с разделами Ask Image, Audio Scribe и AI Chat
Главный экран Edge Gallery: отсюда можно открыть чат, работу с изображениями и другие режимы.

Шаг 2. Перейдите в Models

Нажмите на меню слева и выберите Models. Это каталог моделей, которые можно скачать на телефон и запускать локально.

Боковое меню Google AI Edge Gallery с выделенным разделом Models
Раздел Models находится в левом меню приложения.

Шаг 3. Выберите Gemma-4 E2B-it

В списке моделей найдите Gemma-4 E2B-it. Это компактная версия Gemma 4, оптимизированная для запуска на телефоне. В нашем тесте она занимала 2.54 ГБ и была доступна для запуска на iPhone.

Список моделей в Google AI Edge Gallery с карточкой Gemma-4 E2B-it весом 2.54 ГБ
Нужная модель в списке: Gemma-4 E2B-it.

Шаг 4. Скачайте модель и нажмите Try it

Если модель ещё не загружена, нажмите Download и дождитесь окончания загрузки. Лучше делать это по Wi-Fi: файл большой, а мобильный интернет быстро сгорит.

Когда загрузка закончится, на карточке появятся кнопки Benchmark и Try it. Для первого запуска нажмите Try it.

Карточка Gemma-4 E2B-it в Edge Gallery с кнопками Benchmark и Try it
После скачивания жмите Try it.

Шаг 5. Запустите AI Chat

После нажатия Try it приложение предложит выбрать сценарий. Для обычного общения выбирайте AI Chat. После этого можно задать простой вопрос: например, попросить перевести фразу, объяснить текст или кратко пересказать заметку.

Выбор режима AI Chat для Gemma-4 E2B-it в Google AI Edge Gallery
Для первого теста выбирайте AI Chat.

Как проверить, что Gemma 4 работает офлайн

  1. Дождитесь, пока модель полностью скачается.
  2. Откройте AI Chat и отправьте один простой вопрос.
  3. Включите авиарежим.
  4. Отправьте ещё один вопрос.

Если ответ пришёл в авиарежиме, значит инференс идёт локально на устройстве. Это главный смысл Edge Gallery: ваши запросы, изображения и голосовые данные не обязаны уходить в облако для обработки.

Что спросить для первого теста

Попробуйте: «Переведи на английский: я запускаю локальную модель на телефоне», «Объясни в двух предложениях, что такое локальная нейросеть», «Составь короткий список дел на вечер». На таких задачах маленькая локальная модель показывает себя лучше всего.

Что умеет Gemma 4 на телефоне

  • Отвечать в чате на простые вопросы на русском и английском.
  • Переводить короткие тексты без отправки запроса в облако.
  • Работать с изображениями через режим Ask Image: можно сфотографировать документ, меню или вывеску и спросить, что там написано.
  • Транскрибировать и переводить аудио через Audio Scribe.
  • Запускать экспериментальные сценарии вроде Agent Skills и Prompt Lab, если они доступны для выбранной модели и версии приложения.

Какую версию Gemma 4 выбрать для телефона: E2B или E4B

Для телефона у Gemma 4 есть два «краевых» варианта — E2B и E4B. Буква E значит «effective», эффективные параметры: E2B работает примерно как модель на 2 млрд активных параметров, E4B — на 4 млрд. Обе понимают текст, изображения и звук, умеют вызывать функции и держат контекст до 128K токенов. Отдельной версии «nano» у Gemma 4 нет: если вы искали «Gemma 4 nano», скорее всего имелась в виду E2B или другая модель — Gemini Nano, это не одно и то же.

Что сравниваем Gemma-4 E2B Gemma-4 E4B
Активные параметры около 2 млрд около 4 млрд
Размер загрузки ≈ 2.54 ГБ (E2B-it в Edge Gallery) Заметно больше — смотрите размер в карточке модели в приложении
Нагрузка на телефон Легче и быстрее, меньше памяти Тяжелее и медленнее, нужен телефон помощнее
Качество ответов Хватает для перевода, коротких вопросов и работы с фото Точнее на длинных и более сложных запросах
Кому подходит Бюджетные и старые телефоны, когда важна скорость Флагманы и новые устройства с запасом памяти

Практический выбор простой: если телефон не самый новый или вам важна скорость — берите E2B, вся инструкция выше именно про неё. Если у вас флагман и хочется ответы поточнее — попробуйте E4B и сравните скорость через кнопку Benchmark в карточке модели. Обе версии скачиваются внутри Edge Gallery одинаково, поэтому проще начать с E2B, а на E4B перейти позже.

Честно про ограничения

Gemma-4 E2B-it — маленькая локальная модель. Она не заменяет ChatGPT, Claude или Gemini на сложных задачах: длинный анализ, большой код, архитектура продукта и точные рассуждения всё ещё лучше делать через сильные облачные модели.

Зато для быстрых вопросов, перевода, распознавания текста с фото и приватных заметок это рабочий инструмент. Плюс у него сильная сторона, которой нет у обычного облачного чата: после скачивания модели можно работать без интернета.

Минусы тоже есть: телефон может греться, батарея уходит быстрее, ответы иногда медленнее и проще, чем у больших моделей. Если модель не скачалась до конца, офлайн-режим не сработает.

Если хотите не только запускать модели, а собирать продукты

Локальные модели — отличный способ понять, как AI работает на устройстве. А если хочется собрать свой первый веб-сервис с AI и выложить его в интернет, посмотрите наш мини-курс «Вайбкодинг с нуля»: там идём от установки инструментов до рабочего продукта без лишней теории.

Частые проблемы

Модель не появляется в списке

Проверьте, что приложение обновлено. Google активно меняет Edge Gallery, поэтому список моделей может отличаться по версии приложения, региону, устройству и платформе.

Кнопка Download есть, но загрузка не идёт

Проверьте Wi-Fi, свободное место и не закрывайте приложение во время скачивания. Если загрузка зависла, перезапустите Edge Gallery и попробуйте снова.

В авиарежиме модель не отвечает

Скорее всего, модель не успела полностью скачаться или вы открыли сценарий, который требует сетевой компонент. Для проверки используйте загруженную Gemma-4 E2B-it и режим AI Chat.

Телефон греется

Это нормально для локального инференса: вычисления идут на устройстве. Не гоняйте модель часами без зарядки и не запускайте тяжёлые задачи, если телефон уже горячий.

Что такое Google AI Edge Gallery

Google AI Edge Gallery — экспериментальное приложение Google AI Edge для запуска open-source LLM на мобильном устройстве. По описанию в официальном GitHub-репозитории, приложение позволяет запускать модели локально, полностью офлайн и приватно: инференс происходит на железе телефона.

В свежем релизе Google отдельно выделяет поддержку семейства Gemma 4. В Edge Gallery можно тестировать модели, смотреть производительность через benchmark, работать с чат-сценариями и пробовать мультимодальные режимы: изображения, аудио и agent skills.

Gemma 4 на телефоне или Gemma 4 на компьютере

Телефонный сценарий хорош, когда нужна приватность и быстрый офлайн-доступ: спросить, перевести, распознать текст на фото, проверить идею в дороге. Но если хочется больше скорости, больше контекста и удобную работу с кодом, лучше запускать локальную модель на компьютере.

Для этого у нас есть отдельная инструкция: как запустить Gemma 4 локально через Ollama. Там логика другая: ставите Ollama, выбираете модель под своё железо и при желании подключаете её к Claude Code.

Есть ли Gemma 4 в App Store и как поставить на iPhone

Да, запустить можно. Саму Gemma 4 в App Store не публикуют — это модель, а не приложение. В App Store лежит Google AI Edge Gallery, а Gemma 4 скачивается уже внутри него. Раньше приложение было только на Android, поэтому в старых инструкциях встречается «на iPhone никак» — сейчас это неверно, iOS-версия доступна.

Порядок для iPhone такой:

  1. Откройте Google AI Edge Gallery в App Store и установите приложение (нужен iOS 17 или новее).
  2. Внутри приложения зайдите в Models и выберите Gemma-4 E2B-it — или E4B, если телефон помощнее.
  3. Нажмите Download, дождитесь загрузки по Wi-Fi и откройте AI Chat — дальше всё как в инструкции выше.

Если в App Store вашего региона приложение не находится, оно может быть недоступно локально. Тогда остаётся запуск Gemma 4 на Android через Google Play или APK, либо на компьютере через Ollama.

iPhone и Android: что выбрать

Если у вас iPhone, самый прямой путь — App Store и инструкция выше. Если Android — начните с Google Play. Если Google Play недоступен, официальный репозиторий предлагает APK из latest release.

Системные требования из README на 11 апреля 2026 года: Android 12+ и iOS 17+. Но производительность зависит не только от версии ОС, а ещё от памяти, процессора, свободного места и конкретной модели.

Первоисточники

Google AI Edge Gallery на GitHub · Google Developers Blog про Gemma 4 и Edge Gallery · Google AI Edge docs · App Store · Google Play

Мини-курс NeuroDNK

Вайбкодинг с нуля

Собери свой первый продукт с помощью AI — за один вечер, без навыков программирования. Для практики в рабочем AI-кодинг агенте можно посмотреть RUFP.

Начать за 1 990 ₽ Есть вопрос? Напиши в поддержку
← Claude Managed Agents: что это и как запустить через API
Установка скиллов в Codex: 3 рабочих способа в 2026 →