Ejecución localLocal LLM
Ejecutar el modelo de IA directamente en tu propia computadora
- La ejecución local es correr el archivo del modelo dentro de tu propia computadora.
- Lo que escribes y recibes no sale de tu máquina. Es el motivo que más se menciona.
- No hace falta internet, y no se cobra cada vez que preguntas.
- A cambio, tienes que aportar espacio de almacenamiento y memoria de video, y cuanto más grande el modelo, más pesa.
- Con la misma pregunta, la respuesta puede ser más floja que la de un modelo grande de afuera, así que conviene elegir bien qué tareas encargarle.
Contenido
1La analogía
Alquilar un auto cuando lo necesitas es cómodo. Siempre sale con lo último y el mantenimiento lo hace la agencia. A cambio, pagas cada vez que lo usas, tienes que ir dentro del horario de atención y queda registrado adónde fuiste y cuándo. Un día puede subir el precio o dejar de haber el modelo que siempre usabas.
Tener tu propio auto estacionado en la puerta cambia las cosas. Puedes salir a las tres de la madrugada sin pedirle permiso a nadie, y no queda registro de adónde fuiste. A cambio necesitas un lugar donde guardarlo, un buen desembolso inicial y el mantenimiento corre por tu cuenta. Puede que no sea tan bueno como el auto último modelo de la agencia.
La ejecución local es ese auto propio estacionado en la puerta.
2En detalle
Que corra en tu propio lugar
La IA que se usa habitualmente corre casi siempre en la computadora de otro. Lo que escribes cruza internet y del otro lado se calcula la respuesta, que después vuelve. Solo la pantalla está frente a ti; todo el esfuerzo pesado ocurre allá.
La ejecución local traslada todo ese recorrido a tu propia computadora. Una vez que descargas el archivo del modelo, el texto ya no sale hacia afuera. El cálculo también lo hace el hardware de tu máquina. Hoy en día hay modelos que corren directo en el navegador, así que hasta se puede probar sin instalar nada.
Para que esto sea posible, el archivo del modelo tiene que estar en tus manos. Por eso la ejecución local va de la mano con los modelos que liberan sus archivos: uno que no comparte su archivo no se puede traer a tu propio lugar de entrada.
El texto no sale hacia afuera
El motivo que más se menciona es la privacidad. Hay textos que sería un problema que salieran: historiales médicos, contratos, material que todavía no se anunció. Cuando usas una ventanilla prestada, ese texto pasa al menos una vez por la computadora de otro.
Al correr el modelo en tu propio lugar, esa preocupación desaparece porque el texto no sale del cuarto. Se usa mucho cuando las políticas de una empresa impiden servicios externos, o cuando la información que se maneja en una escuela o un hospital es sensible.
También viene incluido que nadie guarda un registro de lo que se preguntó.
Internet y el costo
Que funcione sin conexión también es una razón práctica. Sirve en un avión, bajo tierra, o en un lugar con señal débil. Si la ventanilla externa se detiene o está saturada, tu lado no se ve afectado.
El costo también cambia de forma. Con una ventanilla prestada se paga un poco cada vez que se pregunta, pero corriendo en tu propia computadora no hay más gasto que la electricidad. Cuanto más se usa, mayor es esa diferencia. A cambio, el gasto de tener una computadora capaz va todo por delante.
Otra cosa que no cambia es el archivo mismo: el que descargaste hoy es igual al de ayer. No hay un ajuste silencioso del otro lado que haga que la respuesta cambie sin avisar.
Lo que tienes que asumir tú
Así como un auto necesita un lugar donde estacionar, el modelo también necesita su espacio. El archivo en sí es grande, y mientras corre tiene que quedar cargado entero en la memoria de video. Si el espacio no alcanza, o no corre en absoluto o corre muy despacio.
Por eso en lo local se termina eligiendo un modelo pequeño. Uno pequeño es rápido y liviano, pero se desmorona en preguntas difíciles. Alcanza de sobra para tareas fijas —acortar un texto, pulir el tono, separar en categorías— pero se queda corto cuando hace falta razonar en profundidad.
El mantenimiento también corre por tu cuenta. Las nuevas versiones no se actualizan solas, y una mala configuración lo vuelve más lento. Es elegir entre lo cómodo pero dependiente de manos ajenas, y lo trabajoso pero en tu propio control.
3Con más precisión
La ejecución local es un asunto de dónde vive el modelo, no cambia la naturaleza del modelo en sí. Con el mismo archivo, correrlo en tu computadora o en el servidor de otro da respuestas de carácter parecido. Eso sí, para meterlo en un equipo local suele pasar por un ajuste que le reduce el tamaño, así que un modelo con el mismo nombre puede dar respuestas algo menos afinadas.
La analogía del auto propio también tiene sus límites. Un auto es uno solo y se maneja siempre ese, pero se pueden descargar varios archivos de modelo distintos e ir cambiando según la tarea, mientras el espacio alcance. Un auto pierde valor con solo estar estacionado, pero el archivo se mantiene igual. En cambio, afuera siguen apareciendo modelos mejores, así que con el tiempo el archivo que tienes en mano empieza a quedar relativamente atrás.
Tampoco hace falta elegir uno solo. Es común mezclar los dos: los datos que no pueden salir se procesan en tu propio lugar, y las preguntas difíciles se mandan a la ventanilla externa. Decidir de antemano qué va para cada lado termina siendo la decisión más importante.
4Pruébalo
5Malentendidos comunes
Es fácil pensar que correrlo en lo local significa que no hace falta internet para nada, pero en realidad se necesita conexión al menos para descargar el archivo del modelo al principio.
Es fácil pensar que correr en tu propia computadora es siempre más rápido, pero en realidad depende mucho del equipo, y la ventanilla externa suele ser más veloz.
Es fácil pensar que un modelo local da respuestas parecidas a uno grande, pero en realidad la diferencia se nota clara en preguntas largas y difíciles.
7Resumen en una línea
En resumenLa ejecución local trae el archivo del modelo a tu propia computadora, así que el texto no sale hacia afuera, pero a cambio el espacio y el mantenimiento pasan a ser tu responsabilidad.
¿Has visto un error o tienes una analogía mejor? Sugerir una corrección · Última actualización2026-09-02