Prompteo

Unidad 8 · 2 min

Privado, barato, o ninguno de los dos

La pregunta real no es local contra nube, sino si el contenido sale de tu máquina, y qué cuesta cada opción de verdad.

Privado, barato, o ninguno de los dos

La pregunta de fondo no es «¿local o nube?». Es: ¿el contenido de lo que escribí sale de esta máquina? Son tres situaciones distintas:

  • Un modelo local: el contenido no sale.
  • Una app local: el contenido no sale, pero puede salir información de uso. La política de privacidad de Ollama dice que no recolecta ni almacena tus prompts procesados localmente y, a la vez, que puede recolectar metadatos limitados del dispositivo y de uso. LM Studio: con un modelo local el contenido no sale; salen las verificaciones de actualización, las búsquedas anonimizadas de modelos y los pedidos a su nube. Y la nube está a un clic.
  • Un servicio alojado: el contenido sale. Anthropic dice que borra entradas y salidas de su backend dentro de los 30 días, con excepciones. Con retención cero, ni esos días.

La cuenta

Un ejemplo con fecha (octubre de 2026): una PC de 350 W a 30 tokens por segundo gasta 0,35 kWh por hora y produce unos 108.000 tokens. Con la luz a 0,17 dólares el kWh, son unos 6 centavos. Alquilar gpt-oss:20b en la nube de Ollama salía unos 3 centavos, y un nivel gratuito de un servicio alojado, cero. Alquilar el mismo modelo abierto suele costar menos que la electricidad.

Local gana cuando ya tenés la computadora, cuando el volumen es enorme y cada tarea vale poco, o cuando los datos legalmente no pueden salir. No es IA gratis.