Instalar y ejecutar Gemma 4 en Android: guía completa de inicio

Instala Google AI Edge Gallery en Android 12+, descarga Gemma 4, valida la inferencia offline y mide el dispositivo con el benchmark integrado.

Si quieres probar Gemma 4 sin conexión en el teléfono, este artículo te lleva paso a paso desde la instalación hasta las funciones prácticas.

Paso 1: obtener la aplicación

Google AI Edge Gallery ya está disponible en Google Play y requiere Android 12 o posterior. Utiliza primero la ficha oficial:

Solo si Google Play no está disponible, instala el APK desde GitHub Releases oficial. No uses mirrors de terceros y desactiva después «Permitir desde esta fuente».

En el dispositivo Android, entra en:

Ajustes -> Aplicaciones -> Acceso especial de apps -> Instalar apps desconocidas

Después:

  1. Busca el navegador que usas (por ejemplo Chrome o Firefox) y activa “Permitir desde esta fuente”.
  2. Abre en el navegador del teléfono la página GitHub Releases de Google AI Edge Gallery.
  1. Descarga el paquete .apk más reciente.
  2. Cuando termine la descarga, abre el instalador desde la barra de notificaciones o el gestor de archivos y completa la instalación siguiendo las indicaciones.

El tiempo de instalación y descarga depende de la conexión, la versión y el tamaño del modelo; no existe una estimación fija fiable de dos minutos.

Paso 2: primer inicio y permisos

Al abrir AI Edge Gallery por primera vez, la aplicación solicitará permiso de almacenamiento para guardar los archivos de modelos. Se recomienda permitirlo directamente; de lo contrario, la aplicación no podrá descargar ni cargar modelos.

En la página principal suelen aparecer estas entradas:

  • Ask Image: tareas de comprensión de imágenes (describir imágenes o responder preguntas relacionadas con ellas)
  • AI Chat: conversación de texto general
  • Summarize: pegar texto y generar un resumen
  • Smart Reply: generar sugerencias de respuesta

La opción más usada por la mayoría de usuarios es AI Chat.

Paso 3: descargar el modelo Gemma 4

  1. Entra en AI Chat.
  2. Haz clic en Get Models cuando aparezca la indicación.
  3. Selecciona una versión de Gemma 4 en la lista de modelos (se mostrará su tamaño).
  4. Elige el modelo según el rendimiento del dispositivo; si tu teléfono tiene 8GB RAM, puedes empezar por Gemma 4 4B.
  5. Pulsa Download y la descarga comenzará en segundo plano.

Nota: cuanto más grande sea el modelo, más tardará la descarga. También puedes descargar varios modelos y cambiarlos después cuando lo necesites. Los modelos descargados se guardan localmente y no hace falta volver a descargarlos.

Paso 4: empezar a conversar

Cuando termine la descarga del modelo:

  1. Pulsa el nombre del modelo para cargarlo (la primera carga suele tardar entre 10 y 30 segundos, según el tamaño del modelo y el rendimiento del dispositivo).
  2. Escribe una pregunta en el cuadro de chat y envíala.
  3. El modelo generará la respuesta localmente; los datos no se subirán a la nube.

Normalmente la primera respuesta será algo más lenta. Es un fenómeno normal de calentamiento del modelo; las respuestas siguientes dentro de la misma conversación suelen ser más rápidas.

Paso 5: probar capacidades visuales (Gemma 4 multimodal)

Si descargaste una versión multimodal de Gemma 4:

  1. Vuelve al menú principal y entra en Ask Image.
  2. Selecciona una imagen o toma una foto directamente.
  3. Escribe la pregunta que quieres hacer, por ejemplo “¿Qué hay en esta imagen?” o “¿Qué texto importante aparece en la imagen?”.
  4. Espera a que el modelo analice la imagen localmente y devuelva el resultado.

La inferencia puede ejecutarse en el dispositivo; cualquier Skill externo debe verificarse por separado para saber si usa la red.

Benchmark y validación offline

Registra el teléfono, SoC, versiones de Android y la aplicación, modelo y cuantización exactos, memoria disponible, tiempo hasta el primer token, token/s sostenidos y cualquier cierre o thermal throttling. Ejecuta el mismo benchmark dos veces: la primera incluye carga y calentamiento; la segunda refleja mejor el rendimiento sostenido.

Tras descargar el modelo, activa el modo avión y usa un prompt fijo. Si genera, la ruta principal de inferencia es local. Los Agent Skills externos pueden seguir necesitando red.

Si el modelo no carga, libera memoria y prueba una variante menor. Si se cierra o el teléfono se calienta, reduce el contexto y detén la prueba. Si falla el APK, comprueba Android 12+, el origen oficial y si existe una versión antigua con otra firma.