L’esecuzione di modelli di Intelligenza Artificiale direttamente nel browser sta diventando una componente sempre più strategica per chi sviluppa applicazioni veloci, riservate e indipendenti dal cloud.

In questa direzione si inserisce LiteRT.js, la nuova libreria open source di Google che porta il runtime LiteRT sul Web e consente l’inferenza locale tramite WebGPU, WebNN e WebAssembly.

Il progetto amplia l’eredità di TensorFlow Lite, oggi LiteRT, con l’obiettivo di offrire un runtime unificato per mobile, desktop e browser. La scelta risponde a esigenze molto attuali: ridurre la latenza, limitare la circolazione dei dati sensibili e garantire continuità d’uso anche senza connessione Internet.

Che cos’è LiteRT.js

LiteRT.js è il runtime Web della piattaforma LiteRT e permette di caricare ed eseguire nel browser modelli nel formato .tflite. Google lo distribuisce come pacchetto NPM e ne prevede anche l’uso via CDN, con componenti Wasm e un’integrazione pensata per sfruttare l’accelerazione hardware quando disponibile.