On-Device AI
Also called: edge AI, local AI
Running a model on a phone or laptop instead of sending data to a server.
La inferencia en el dispositivo mantiene los datos locales, funciona sin conexión y no tiene costo por token — algo genuinamente atractivo para la privacidad y los contextos regulados. El intercambio es la capacidad: los modelos locales son más pequeños y lentos que las API frontera. La cuantización y la destilación son lo que la vuelven viable siquiera.
En la práctica: Transcribir una reunión confidencial sin que el audio salga de la laptop.