App de LLM local para Android con LiteRT in Tavern Studio

Una app de LLM local para Android debe ser honesta sobre sus limitaciones. La IA en el dispositivo es útil para la privacidad y la disponibilidad, pero el rendimiento en teléfonos depende en gran medida del tamaño del modelo, la memoria del dispositivo, el soporte de aceleración de hardware y las restricciones de la batería.

La dirección de Tavern Studio en Android utiliza inferencia local orientada a LiteRT, manteniendo el mismo flujo de trabajo de tarjetas de personaje, World Info (libro de lore), presets y chat disponibles en dispositivos móviles.

A quién está dirigido

  • Usuarios de Android que desean un chat IA privado en su dispositivo.
  • Usuarios que quieren importar tarjetas de personaje directamente desde el móvil.
  • Escritores que continúan sus sesiones de chat fuera de la computadora de escritorio.
  • Personas que comparan el rendimiento de modelos locales frente a las API en la nube en dispositivos móviles.

Contenido principal

Google posiciona LiteRT como un framework para IA en el dispositivo de alto rendimiento. Para Tavern Studio, el valor práctico es sencillo: Android puede tener una ruta de modelo local en lugar de ser únicamente un cliente para una API remota.

Esto no significa que todos los modelos de clase de escritorio funcionen bien en cualquier teléfono. Elige modelos más pequeños, mantén un tamaño de contexto razonable y ten en cuenta que las API en la nube seguirán siendo útiles para tareas más pesadas.

Cómo lo maneja Tavern Studio

Tavern Studio mantiene los flujos de trabajo de Android alineados con el modelo de escritorio: los datos locales, las tarjetas de personaje, los presets (o preajustes), los libros de lore y los chats se organizan en la misma aplicación. La importación móvil puede utilizar los flujos de compartir del sistema operativo donde sea compatible.

La ruta local es parte de la configuración del modelo, en lugar de ser un producto independiente.

Pasos para la operación

  1. Instala Tavern Studio on Android.
  2. Importa o selecciona una ruta de modelo local compatible.
  3. Elige un preset o preajuste liviano.
  4. Abre o importa una tarjeta de personaje.
  5. Comienza con respuestas cortas y un contexto moderado.
  6. Aumenta los parámetros de configuración solo si el dispositivo sigue respondiendo con fluidez.
  7. Utiliza las API en la nube cuando la tarea requiera un modelo más grande.

Preguntas frecuentes

¿Admite Tavern Studio LLMs locales en Android?

Sí. El soporte de modelos locales en Android forma parte del producto mediante la inferencia en el dispositivo orientada a LiteRT.

¿Funcionarán todos los modelos GGUF en Android?

No. Las limitaciones de hardware móvil y el formato del entorno de ejecución son factores importantes. Utiliza modelos adecuados para tu dispositivo y runtime.

¿Es privado el chat local en Android?

La inferencia local mantiene el procesamiento del modelo en el dispositivo. Sin embargo, los datos importados, las copias de seguridad y cualquier ruta de API en la nube siguen dependiendo de tu configuración.

¿Se pueden utilizar tarjetas de personaje en Android?

Sí. Tavern Studio admite flujos de trabajo de tarjeta de personaje en Android.

¿El soporte de API en la nube sigue siendo útil en Android?

Sí. Los modelos en la nube (como las API compatibles con OpenAI) son útiles cuando el rendimiento del dispositivo local no es suficiente.

Siguientes pasos

Descargar Tavern Studio
Windows