La IA se muda a tu navegador: LiteRT.js y por qué te importa
Google ha lanzado LiteRT.js, un runtime que ejecuta modelos de IA directamente en el navegador sin servidores. Hasta 3x más rápido que TensorFlow.js. Esto cambia las reglas del juego para cualquier SaaS o web con funcionalidades inteligentes.

El 9 de julio de 2026, Google lanzó LiteRT.js, un runtime JavaScript que permite ejecutar modelos de inteligencia artificial directamente en el navegador, sin necesidad de enviar datos a un servidor. La cifra que lo resume: hasta 3 veces más rápido que TensorFlow.js, su predecesor.
No es una noticia técnica más. Es un cambio de paradigma para cualquiera que tenga un negocio online o una SaaS.
¿Qué ha pasado exactamente
LiteRT.js es la versión web de LiteRT (el motor de inferencia que Google lleva años usando en Android). Coge cualquier modelo en formato .tflite y lo ejecuta en el navegador usando tres rutas:
- CPU a través de WebAssembly con XNNPACK (aceleración matemática).
- GPU mediante WebGPU, que aprovecha la tarjeta gráfica del dispositivo.
- NPU experimental a través de WebNN, para chips de IA dedicados.
Los benchmarks de Google, realizados en un MacBook Pro M4, muestran entre 1.1x y 3.3x de mejora frente a ONNX Runtime, y entre 5x y 60x al comparar WebGPU con CPU sola.
Y lo mejor: los modelos creados con PyTorch se pueden convertir con LiteRT Torch, y los de JAX o TensorFlow también. Es decir, no tienes que reescribir nada.
¿Y esto por qué importa
Porque hasta ahora, si querías IA en tu web, tenías dos opciones y ambas apestaban:
- Llamar a una API externa (OpenAI, Claude, etc.) — pagas por petición, introduces latencia de red, y tus usuarios dependen de que su conexión no falle. Además, mandas sus datos a un servidor de terceros.
- Usar TensorFlow.js — funcionaba, pero era lento. Los modelos grandes se comían el CPU del usuario y la experiencia era mediocre.
LiteRT.js rompe ese dilema: la IA corre en el dispositivo del usuario. Sin llamadas a servidores, sin coste por API, sin latencia, sin enviar datos fuera.
Para una SaaS, esto significa que puedes añadir funcionalidades inteligentes con coste marginal cero. No pagas por cada inferencia. El hardware del usuario hace el trabajo.
Casos prácticos
Pongamos pies a la noticia. Aquí tienes usos reales que LiteRT.js permite sin disparar costes de servidor:
- Búsqueda visual en catálogos — el usuario sube una foto y un modelo de visión encuentra productos similares en tu base de datos. Sin enviar la imagen a ningún servidor externo.
- Clasificación de imágenes en cliente — al subir imágenes, el navegador las etiqueta y organiza al instante sin backend. Ideal para paneles de administración, galerías o sistemas de gestión de contenido.
- Moderación de contenido en tiempo real — un modelo ejecutado en el navegador detecta texto o imágenes inapropiados antes de que lleguen al servidor. Perfecto para foros, comentarios o UGC.
- Asistente de formularios inteligente — un pequeño modelo de lenguaje local sugiere respuestas, completa campos o valida datos mientras el usuario rellena un formulario, sin llamadas a APIs externas.
Todo esto sin coste de servidor, sin latencia de red, y con privacidad total para los datos del usuario.
Lo que necesitas saber (limitaciones)
LiteRT.js no es magia. Tiene limitaciones que conviene conocer:
- Solo tensores int32 y float32 por ahora. Si tu modelo necesita tipos más exóticos, tocará esperar.
- WebGPU no está en todos los navegadores. Chrome y Edge 113+, Safari 17.4+, y Firefox 121+ con soporte parcial. El 90% de los usuarios de escritorio están cubiertos, pero en móvil la cobertura es menor.
- Modelos grandes, no. Hablamos de modelos ligeros (Megabytes, no Gigabytes). Para ejecutar un GPT en el navegador no sirve — pero para clasificar imágenes, detectar objetos, transcribir audio corto o recomendar contenido, va sobrado.
- La primera carga. El navegador descarga el modelo Wasm y los pesos del modelo. La primera visita puede ser más lenta, pero luego el navegador lo cachea.
Conclusión
LiteRT.js no es la herramienta que va a reemplazar a ChatGPT. Es la herramienta que va a democratizar las funcionalidades de IA que no necesitan un modelo gigante detrás.
Cualquier web con un formulario, un buscador o un sistema de subida de fotos puede beneficiarse de tener un modelo de IA corriendo localmente. Y para una SaaS, el ahorro en costes de API es inmediato.
Si tienes una idea de producto y te has frenado por el coste de la IA en servidor, este es el momento de darle otra vuelta.