{"id":3820,"date":"2026-08-24T08:00:13","date_gmt":"2026-08-24T06:00:13","guid":{"rendered":"https:\/\/www.nicalia.com\/blog\/?p=3820"},"modified":"2026-08-21T10:14:33","modified_gmt":"2026-08-21T08:14:33","slug":"ia-autoalojada-en-tu-vps-ahorro-y-control-reales","status":"publish","type":"post","link":"https:\/\/www.nicalia.com\/blog\/ia-autoalojada-en-tu-vps-ahorro-y-control-reales\/","title":{"rendered":"IA autoalojada en tu VPS: ahorro y control reales"},"content":{"rendered":"<p>Si tu agencia ha cruzado el umbral en el que la factura de automatizaci\u00f3n crece al mismo ritmo que los clientes, ya conoces el problema: en un modelo de pago por tarea, <em><strong>cada mejora t\u00e9cnica que introduces \u2014un log, un paso de verificaci\u00f3n, un reintento\u2014 tiene precio<\/strong><\/em>. El proceso no se vuelve m\u00e1s valioso. Solo m\u00e1s caro.<\/p>\n<p>Llevar ese trabajo a un VPS propio es una respuesta razonable, pero circula demasiada literatura que promete ahorros del 90 % sin contar la letra peque\u00f1a. Este post intenta lo contrario: precios reales verificados, el ahorro que sale de verdad seg\u00fan volumen, las restricciones de licencia que casi nadie menciona (y que afectan de lleno a las agencias), y c\u00f3mo dimensionar el servidor sin quedarte corto.<\/p>\n<blockquote><p><em>Un flujo de captaci\u00f3n con seis pasos \u2014entra un lead, se verifica el correo, se punt\u00faa, se actualiza el CRM, se avisa por Slack y se registra en una hoja\u2014 gasta cinco tareas por ejecuci\u00f3n. Cien ejecuciones diarias durante un mes son 15.000 tareas para un \u00fanico workflow<\/em><\/p><\/blockquote>\n<h2>El problema no es el precio de Zapier: es la unidad de facturaci\u00f3n<\/h2>\n<p>La confusi\u00f3n m\u00e1s cara del sector es creer que una ejecuci\u00f3n de workflow equivale a una tarea. No es as\u00ed. En Zapier, cada paso de acci\u00f3n que se completa con \u00e9xito consume una tarea. El disparador no cuenta; los filtros, las rutas y el formateador tampoco. Todo lo que escribe o lee en una aplicaci\u00f3n externa, s\u00ed.<\/p>\n<p>La aritm\u00e9tica se vuelve inc\u00f3moda enseguida. Un flujo de captaci\u00f3n con seis pasos \u2014entra un lead, se verifica el correo, se punt\u00faa, se actualiza el CRM, se avisa por Slack y se registra en una hoja\u2014 gasta cinco tareas por ejecuci\u00f3n. Cien ejecuciones diarias durante un mes son 15.000 tareas para un \u00fanico workflow. Y en 2026 los pasos de IA, los pasos de c\u00f3digo y las llamadas MCP salen de esa misma bolsa.<\/p>\n<h3>Precios reales por tramo<\/h3>\n<p>Estos son los tramos publicados del plan Professional con facturaci\u00f3n anual. La facturaci\u00f3n mensual sale aproximadamente un 50 % m\u00e1s cara, porque el descuento anual ronda el 33 %.<\/p>\n<table style=\"width: 100%; border-collapse: collapse; margin: 1.5em 0; font-size: 0.95em;\">\n<thead>\n<tr style=\"background: #f4f6f8;\">\n<th style=\"border: 1px solid #dde3e8; padding: 10px; text-align: left;\">Tareas\/mes<\/th>\n<th style=\"border: 1px solid #dde3e8; padding: 10px; text-align: left;\">Zapier Professional (anual)<\/th>\n<th style=\"border: 1px solid #dde3e8; padding: 10px; text-align: left;\">Coste aproximado por tarea<\/th>\n<\/tr>\n<\/thead>\n<tbody>\n<tr>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">750<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">19,99 $<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">0,027 $<\/td>\n<\/tr>\n<tr style=\"background: #fafbfc;\">\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">10.000<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">129 $<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">0,013 $<\/td>\n<\/tr>\n<tr>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">50.000<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">289 $<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">0,006 $<\/td>\n<\/tr>\n<tr style=\"background: #fafbfc;\">\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">100.000<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">489 $<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">0,005 $<\/td>\n<\/tr>\n<tr>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">500.000<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">1.499 $<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">0,003 $<\/td>\n<\/tr>\n<\/tbody>\n<\/table>\n<p>Conviene fijarse en algo que juega en contra del argumento f\u00e1cil: el coste unitario baja al escalar. Quien m\u00e1s consume, menos paga por tarea. El problema no es que Zapier sea caro por unidad a volumen alto, sino que el importe absoluto se vuelve una partida fija considerable y, sobre todo, imposible de acotar. Si superas el l\u00edmite, las tareas extra se facturan a aproximadamente 1,25 veces la tarifa de tu plan hasta un tope de tres veces tu volumen contratado.<\/p>\n<h2>Cu\u00e1nto se ahorra de verdad al migrar a un VPS<\/h2>\n<p>Aqu\u00ed es donde la mayor\u00eda de comparativas hace trampa: ponen el precio del VPS frente al precio del SaaS y declaran un 90 % de ahorro. Falta la mitad de la ecuaci\u00f3n. Un stack self-hosted requiere actualizaciones, copias de seguridad, monitorizaci\u00f3n y resoluci\u00f3n de incidencias, y esas horas tienen coste aunque las ponga alguien de plantilla.<\/p>\n<p>La comparaci\u00f3n honesta, con horas de mantenimiento incluidas, queda as\u00ed:<\/p>\n<table style=\"width: 100%; border-collapse: collapse; margin: 1.5em 0; font-size: 0.95em;\">\n<thead>\n<tr style=\"background: #f4f6f8;\">\n<th style=\"border: 1px solid #dde3e8; padding: 10px; text-align: left;\">Escenario<\/th>\n<th style=\"border: 1px solid #dde3e8; padding: 10px; text-align: left;\">Zapier<\/th>\n<th style=\"border: 1px solid #dde3e8; padding: 10px; text-align: left;\">VPS + mantenimiento<\/th>\n<th style=\"border: 1px solid #dde3e8; padding: 10px; text-align: left;\">Ahorro<\/th>\n<\/tr>\n<\/thead>\n<tbody>\n<tr>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\"><strong>Volumen bajo<\/strong><br \/>\n10.000 tareas<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">~129 $\/mes<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">70\u2013130 \u20ac\/mes<br \/>\n<span style=\"font-size: 0.88em; color: #5a6672;\">VPS 4 GB + ~1 h\/mes<\/span><\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\"><strong>0\u201345 %<\/strong><\/td>\n<\/tr>\n<tr style=\"background: #fafbfc;\">\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\"><strong>Volumen medio<\/strong><br \/>\n50.000 tareas<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">~289 $\/mes<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">90\u2013260 \u20ac\/mes<br \/>\n<span style=\"font-size: 0.88em; color: #5a6672;\">VPS 8\u201316 GB + 1\u20132 h\/mes<\/span><\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\"><strong>10\u201370 %<\/strong><\/td>\n<\/tr>\n<tr>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\"><strong>Operaci\u00f3n intensiva<\/strong><br \/>\n500.000 tareas<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">~1.499 $\/mes<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">180\u2013600 \u20ac\/mes<br \/>\n<span style=\"font-size: 0.88em; color: #5a6672;\">VPS 8 vCPU \/ 24 GB + 2\u20133 h\/mes<\/span><\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\"><strong>60\u201388 %<\/strong><\/td>\n<\/tr>\n<\/tbody>\n<\/table>\n<p style=\"font-size: 0.9em; color: #5a6672;\">*Precios de Zapier en d\u00f3lares con facturaci\u00f3n anual; costes de infraestructura en euros sin IVA. La comparaci\u00f3n es orientativa y no incorpora el tipo de cambio. Las horas de mantenimiento se valoran a tarifa de mercado para perfil t\u00e9cnico.<\/p>\n<p>La lectura es inc\u00f3moda pero \u00fatil: <strong>por debajo de unas 20.000 tareas al mes, el self-hosting rara vez compensa en dinero<\/strong>. Compensa por otras razones \u2014soberan\u00eda del dato, control, ausencia de l\u00edmites\u2014 pero no por coste. El punto de inflexi\u00f3n llega cuando el volumen crece lo suficiente como para que las horas de mantenimiento se diluyan sobre una factura SaaS de tres o cuatro cifras.<\/p>\n<div style=\"background: #fff8e1; border-left: 4px solid #f0b429; padding: 16px 20px; margin: 1.8em 0; border-radius: 0 4px 4px 0;\">\n<p style=\"margin: 0 0 8px 0;\"><strong>El coste que nadie presupuesta<\/strong><\/p>\n<p style=\"margin: 0;\">Las horas de mantenimiento no son te\u00f3ricas. n8n 2.0 elimin\u00f3 por completo el soporte de MySQL y MariaDB: quien tuviera su instancia sobre esos motores ha tenido que migrar a PostgreSQL o SQLite. A\u00f1ade a eso un ritmo de versiones semanal, cambios de sintaxis en expresiones y nodos de la comunidad que dejan de aparecer tras una actualizaci\u00f3n. <strong>Un stack self-hosted sin pol\u00edtica de versiones fijadas y entorno de pruebas no es m\u00e1s barato: es m\u00e1s fr\u00e1gil.<\/strong><\/p>\n<\/div>\n<h2><a href=\"https:\/\/www.nicalia.com\/blog\/wp-content\/uploads\/2026\/04\/nicalia-hosting-ia-02.jpg\"><img decoding=\"async\" loading=\"lazy\" class=\"aligncenter size-large wp-image-3826\" src=\"https:\/\/www.nicalia.com\/blog\/wp-content\/uploads\/2026\/04\/nicalia-hosting-ia-02-1024x572.jpg\" alt=\"\u00bfEst\u00e1 tu hosting preparado para la IA? Te lo explicamos en este post - Nicalia Hosting\" width=\"1024\" height=\"572\" srcset=\"https:\/\/www.nicalia.com\/blog\/wp-content\/uploads\/2026\/04\/nicalia-hosting-ia-02-1024x572.jpg 1024w, https:\/\/www.nicalia.com\/blog\/wp-content\/uploads\/2026\/04\/nicalia-hosting-ia-02-300x168.jpg 300w, https:\/\/www.nicalia.com\/blog\/wp-content\/uploads\/2026\/04\/nicalia-hosting-ia-02-768x429.jpg 768w, https:\/\/www.nicalia.com\/blog\/wp-content\/uploads\/2026\/04\/nicalia-hosting-ia-02.jpg 1200w\" sizes=\"(max-width: 1024px) 100vw, 1024px\" title=\"\"><\/a><\/h2>\n<h2><\/h2>\n<h2>Antes de migrar: el ecosistema no es tan libre como parece<\/h2>\n<p>Esta es la secci\u00f3n que suele faltar en las gu\u00edas de migraci\u00f3n, y es la que m\u00e1s importa si eres una agencia. Ni n8n ni Dify son software libre en el sentido cl\u00e1sico. Ambos publican su c\u00f3digo, ambos permiten el autoalojamiento gratuito, y ambos restringen exactamente el escenario que muchas agencias tienen en mente.<\/p>\n<h3>n8n: Sustainable Use License<\/h3>\n<p>n8n abandon\u00f3 el modelo Apache 2.0 con Commons Clause en 2022 y adopt\u00f3 su propia licencia fair-code, la Sustainable Use License. Permite usar, modificar y redistribuir el software, con tres limitaciones. La relevante aqu\u00ed es la primera: el uso queda circunscrito a fines internos de tu propio negocio, a usos no comerciales o personales.<\/p>\n<p>La propia documentaci\u00f3n de n8n es expl\u00edcita sobre d\u00f3nde est\u00e1 la frontera:<\/p>\n<table style=\"width: 100%; border-collapse: collapse; margin: 1.5em 0; font-size: 0.95em;\">\n<thead>\n<tr style=\"background: #f4f6f8;\">\n<th style=\"border: 1px solid #dde3e8; padding: 10px; text-align: left;\">Permitido<\/th>\n<th style=\"border: 1px solid #dde3e8; padding: 10px; text-align: left;\">No permitido sin licencia comercial<\/th>\n<\/tr>\n<\/thead>\n<tbody>\n<tr>\n<td style=\"border: 1px solid #dde3e8; padding: 10px; vertical-align: top;\">Sincronizar datos que controla tu empresa, por ejemplo del CRM a una base interna.<\/p>\n<p>Prestar servicios de consultor\u00eda sobre n8n: construir workflows, desarrollar funcionalidades pr\u00f3ximas al producto o c\u00f3digo que n8n ejecuta.<\/p>\n<p>Instalar y mantener n8n en el servidor interno de una empresa.<\/p>\n<p>Crear nodos propios o integraciones entre tu producto y n8n.<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px; vertical-align: top;\">Alojar n8n y cobrar a terceros por acceder a \u00e9l.<\/p>\n<p>Hacer white-label de n8n y ofrecerlo a clientes como producto de pago.<\/p>\n<p>Flujos que recogen las credenciales del propio usuario final para acceder a sus datos en su nombre.<\/td>\n<\/tr>\n<\/tbody>\n<\/table>\n<p><em><strong>Traducido a la pr\u00e1ctica de una agencia:<\/strong><\/em> montar n8n en el servidor de tu cliente, cobrarle por la implantaci\u00f3n y por el mantenimiento, est\u00e1 dentro. Montar una instancia tuya, dar acceso a diez clientes y facturarles una cuota mensual por ese acceso, est\u00e1 fuera. La diferencia entre ambos modelos de negocio es una decisi\u00f3n que conviene tomar antes de escribir el primer workflow, no despu\u00e9s de la primera ronda de financiaci\u00f3n o de la primera auditor\u00eda legal de un cliente grande.<\/p>\n<h3>Dify: Apache 2.0 con condiciones a\u00f1adidas<\/h3>\n<p>Dify aparece etiquetada como Apache 2.0, lo que induce a error. Su licencia a\u00f1ade dos condiciones sobre la base Apache. La primera proh\u00edbe operar un entorno multi-tenant con el c\u00f3digo de Dify sin autorizaci\u00f3n escrita, definiendo tenant como espacio de trabajo. La segunda impide retirar o modificar el logotipo y la informaci\u00f3n de copyright de la consola cuando se usan sus componentes de frontend, restricci\u00f3n que no aplica si tu uso no los involucra.<\/p>\n<p>El uso comercial s\u00ed est\u00e1 expresamente contemplado: puedes emplear Dify como backend de tus propias aplicaciones o como plataforma interna de desarrollo. Lo que <em><strong>no puedes es revenderlo como servicio alojado multi-inquilino.<\/strong><\/em><\/p>\n<h3>Alternativas sin esas restricciones<\/h3>\n<p>Si tu modelo pasa por vender acceso multi-inquilino, hay opciones con licencias permisivas cl\u00e1sicas que evitan por completo la conversaci\u00f3n: Flowise se distribuye bajo Apache 2.0 sin condiciones a\u00f1adidas, y Langflow bajo MIT. Qdrant, Caddy y Ollama tampoco imponen restricciones de este tipo. La elecci\u00f3n de orquestador, en un proyecto comercial, no es solo t\u00e9cnica.<\/p>\n<p>&nbsp;<\/p>\n<h2>Soberan\u00eda del dato, RGPD y Reglamento de IA<\/h2>\n<h3>Qu\u00e9 cambia \u2014y qu\u00e9 no\u2014 en tus obligaciones RGPD<\/h3>\n<p>Existe una idea extendida de que autoalojar elimina obligaciones. No las elimina; redistribuye el riesgo, que es distinto y sigue siendo valioso.<\/p>\n<p><strong>El art\u00edculo 28 sigue aplicando.<\/strong> Cuando alquilas un VPS a un proveedor, ese proveedor trata datos personales por cuenta tuya. La condici\u00f3n de encargado del tratamiento nace de la realidad funcional, no de c\u00f3mo se llame el contrato: si un proveedor recibe datos y los trata conforme a tus instrucciones, es encargado. Necesitas contrato de encargo con tu proveedor de hosting igual que lo necesitabas con tu proveedor SaaS. La AEPD ha sancionado precisamente la ausencia de ese contrato y la autorizaci\u00f3n irregular de subencargados.<\/p>\n<p><strong>Lo que s\u00ed ganas es longitud de cadena.<\/strong> Al ejecutar la orquestaci\u00f3n en tu propia infraestructura, los prompts, los registros de ejecuci\u00f3n y el contenido de los \u00edndices vectoriales dejan de pasar por la plataforma de automatizaci\u00f3n y por sus subencargados. Pasas de una cadena con varios eslabones \u2014plataforma SaaS, su nube subyacente, su proveedor de LLM, los subencargados de todos ellos\u2014 a una con uno solo: tu proveedor de VPS. Si adem\u00e1s usas modelos locales, la cadena se detiene ah\u00ed.<\/p>\n<p><strong>El art\u00edculo 30 tampoco desaparece.<\/strong> El registro de actividades de tratamiento sigue siendo obligaci\u00f3n tuya. Lo que mejora es la capacidad de documentarlo con precisi\u00f3n, porque conoces exactamente d\u00f3nde reside cada dato y qui\u00e9n accede.<\/p>\n<p><strong>Transferencias internacionales.<\/strong> Ejecutar el stack en un centro de datos de la UE elimina el escenario de transferencia a tercer pa\u00eds regulado en los art\u00edculos 44 a 49, siempre que ning\u00fan componente del flujo llame a una API fuera del EEE. Ese matiz importa: un workflow autoalojado en Madrid que invoca un modelo alojado en Estados Unidos sigue generando una transferencia internacional.<\/p>\n<h3>El calendario del Reglamento de IA a agosto de 2026<\/h3>\n<p>Cualquier proyecto de IA que arranque ahora necesita ubicarse en el calendario del Reglamento (UE) 2024\/1689, que acaba de cambiar. El Reglamento (UE) 2026\/1744, conocido como \u00d3mnibus Digital sobre IA y publicado en el DOUE el 24 de julio de 2026, ha reajustado los plazos:<\/p>\n<ul>\n<li><strong>Desde el 2 de agosto de 2026<\/strong> son exigibles las obligaciones de transparencia del art\u00edculo 50 \u2014informar cuando se interact\u00faa con un sistema de IA y etiquetar el contenido sint\u00e9tico\u2014 y las reglas de vigilancia del mercado.<\/li>\n<li><strong>Diciembre de 2027<\/strong>: obligaciones de los sistemas de alto riesgo del Anexo III, aplazadas desde agosto de 2026.<\/li>\n<li><strong>Agosto de 2028<\/strong>: sistemas de alto riesgo del Anexo I.<\/li>\n<li><strong>Ya vigentes<\/strong>: las ocho prohibiciones originales desde febrero de 2025, la obligaci\u00f3n de alfabetizaci\u00f3n en IA y el r\u00e9gimen aplicable a los modelos de uso general desde agosto de 2025.<\/li>\n<\/ul>\n<p>Interpretar el aplazamiento como una moratoria general ser\u00eda un error de lectura. Si tu automatizaci\u00f3n incluye un chatbot que atiende a clientes o genera contenido sint\u00e9tico, las obligaciones de transparencia te aplican desde este mes. Y la clasificaci\u00f3n de un sistema como de alto riesgo no ha desaparecido: solo se ha movido su fecha de exigibilidad, lo que afecta a contratos que se firman ahora y seguir\u00e1n vigentes en 2027.<\/p>\n<h2>Gu\u00eda t\u00e9cnica: c\u00f3mo dimensionar el VPS<\/h2>\n<h3>Perfiles seg\u00fan el stack<\/h3>\n<p>El almacenamiento NVMe deja de ser un lujo en cuanto entra una base vectorial: el rendimiento de recuperaci\u00f3n en Qdrant depende directamente de la latencia de disco cuando el \u00edndice no cabe entero en memoria.<\/p>\n<table style=\"width: 100%; border-collapse: collapse; margin: 1.5em 0; font-size: 0.95em;\">\n<thead>\n<tr style=\"background: #f4f6f8;\">\n<th style=\"border: 1px solid #dde3e8; padding: 10px; text-align: left;\">Perfil<\/th>\n<th style=\"border: 1px solid #dde3e8; padding: 10px; text-align: left;\">vCPU<\/th>\n<th style=\"border: 1px solid #dde3e8; padding: 10px; text-align: left;\">RAM<\/th>\n<th style=\"border: 1px solid #dde3e8; padding: 10px; text-align: left;\">Stack<\/th>\n<\/tr>\n<\/thead>\n<tbody>\n<tr>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">B\u00e1sico<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">2<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">4 GB<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">n8n + PostgreSQL + Caddy. Orquestaci\u00f3n simple con modelos v\u00eda API.<\/td>\n<\/tr>\n<tr style=\"background: #fafbfc;\">\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">Intermedio<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">4<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">8\u201316 GB<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">n8n en modo cola con Redis + Dify + Qdrant. RAG corporativo.<\/td>\n<\/tr>\n<tr>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">Avanzado<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">8<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">24+ GB<\/td>\n<td style=\"border: 1px solid #dde3e8; padding: 10px;\">Stack completo + inferencia local de modelos peque\u00f1os en CPU.<\/td>\n<\/tr>\n<\/tbody>\n<\/table>\n<p>Como referencia m\u00ednima verificable, los instaladores comunitarios documentan 4 GB de memoria, 2 n\u00facleos y 30 GB de disco para un despliegue reducido con n8n y Flowise. Es un suelo, no un objetivo.<\/p>\n<h3>Inferencia local: la regla de dimensionado<\/h3>\n<p>Para modelos cuantizados en Q4_K_M, que es el est\u00e1ndar pr\u00e1ctico de inferencia local, la aproximaci\u00f3n de memoria es directa:<\/p>\n<p style=\"background: #f4f6f8; padding: 14px 18px; border-radius: 4px; font-family: monospace; font-size: 0.95em;\">RAM \u2248 0,6 GB \u00d7 (miles de millones de par\u00e1metros) + cach\u00e9 KV + margen del sistema<\/p>\n<p>De ah\u00ed salen las cifras habituales: un modelo de 7B necesita entre 4 y 6 GB, uno de 13B entre 8 y 10 GB, y uno de la clase 70B entre 38 y 48 GB seg\u00fan la longitud de contexto. La cach\u00e9 KV es la variable que se suele olvidar y la que m\u00e1s crece: un modelo de 8B pasa de unos 0,3 GB con 2K de contexto a unos 5 GB con 32K y en torno a 20 GB con 128K. <em><strong>Si necesitas contextos largos, la cach\u00e9 puede pesar m\u00e1s que el propio modelo.<\/strong><\/em><\/p>\n<h3>Qu\u00e9 modelos tienen sentido en 2026<\/h3>\n<p>El cat\u00e1logo se ha renovado por completo respecto al de hace a\u00f1o y medio. Las referencias actuales para autoalojamiento son <em><strong>Qwen 3, Gemma 3 y 4, Llama 4, gpt-oss y Phi-4 Mini<\/strong><\/em>. Buena parte de los modelos punteros de 2026 son arquitecturas de mezcla de expertos: activan solo una fracci\u00f3n de sus par\u00e1metros por token, as\u00ed que corren m\u00e1s r\u00e1pido que un modelo denso equivalente, pero siguen necesitando memoria suficiente para mantener todos los pesos residentes. La cifra de par\u00e1metros totales sigue mandando en el dimensionado.<\/p>\n<div style=\"background: #fff8e1; border-left: 4px solid #f0b429; padding: 16px 20px; margin: 1.8em 0; border-radius: 0 4px 4px 0;\">\n<p style=\"margin: 0 0 8px 0;\"><strong>Expectativas realistas sin GPU<\/strong><\/p>\n<p style=\"margin: 0;\">Un VPS sin GPU ejecuta modelos locales, pero conviene saber a qu\u00e9 velocidad. En CPU, un modelo de 7B en Q4 rinde aproximadamente entre 2 y 15 tokens por segundo seg\u00fan el procesador; la misma carga sobre una GPU dedicada de 8 GB ronda los 40. Eso hace que la inferencia en CPU sea perfectamente v\u00e1lida para clasificaci\u00f3n, extracci\u00f3n de entidades, triaje y procesamiento por lotes en segundo plano, y claramente insuficiente para chat interactivo con usuarios finales. Para un entorno solo CPU con memoria ajustada, un modelo de 3B a 4B ofrece una experiencia mucho m\u00e1s razonable que forzar un 7B.<\/p>\n<\/div>\n<h3>Separar orquestaci\u00f3n de inferencia<\/h3>\n<p>La recomendaci\u00f3n m\u00e1s rentable de este art\u00edculo: no ejecutes el motor de inferencia en la misma m\u00e1quina que la orquestaci\u00f3n. Cuando un modelo local satura la CPU durante veinte segundos, todos los workflows que compartan ese servidor se degradan a la vez, incluidos los que env\u00edan correo o escriben en el CRM y no tienen nada que ver con la IA.<\/p>\n<p>El patr\u00f3n sano es un VPS para n8n en modo cola con sus workers, PostgreSQL y Redis, y un segundo VPS \u2014o un servicio externo\u2014 para la inferencia. Cuestan m\u00e1s que una sola m\u00e1quina grande, pero a\u00edslan el fallo. Y permiten escalar cada mitad seg\u00fan su propio cuello de botella, que rara vez es el mismo.<\/p>\n<h2>Qu\u00e9 instala realmente cada kit de despliegue<\/h2>\n<p>Aqu\u00ed conviene distinguir entre lo oficial y lo comunitario, porque las expectativas de producci\u00f3n son muy distintas.<\/p>\n<p><strong>El Self-hosted AI Starter Kit de n8n<\/strong> es una plantilla de Docker Compose que incluye cuatro piezas: n8n autoalojado, Ollama, Qdrant y PostgreSQL. Es la v\u00eda m\u00e1s r\u00e1pida para tener un entorno funcionando, y la propia n8n advierte que no est\u00e1 optimizado para producci\u00f3n: lo plantea como base para pruebas de concepto.<\/p>\n<p><strong>Los instaladores comunitarios<\/strong> \u2014n8n-installer y sus derivados, a su vez forks de proyectos previos\u2014 van bastante m\u00e1s all\u00e1: un \u00fanico comando prepara el sistema, instala Docker, configura cortafuegos y protecci\u00f3n contra fuerza bruta, genera secretos y lanza los servicios, con un asistente que permite elegir qu\u00e9 desplegar sobre un n\u00facleo fijo de Caddy, PostgreSQL y Redis. n8n arranca en modo cola con el n\u00famero de workers que indiques. Son excelentes para acortar la puesta en marcha de d\u00edas a una tarde.<\/p>\n<p>Lo que ninguno de los dos resuelve es lo que viene despu\u00e9s. El instalador te deja el stack en pie; la pol\u00edtica de copias de seguridad, el entorno de preproducci\u00f3n, el fijado de versiones y la rotaci\u00f3n de credenciales siguen siendo tuyos. Un despliegue profesional se distingue por eso, no por el n\u00famero de contenedores.<\/p>\n<h3>Componentes que no deber\u00edan faltar<\/h3>\n<ul>\n<li><strong>Docker y Docker Compose<\/strong>: aislamiento y reproducibilidad del entorno.<\/li>\n<li><strong>Caddy<\/strong>: proxy inverso con emisi\u00f3n y renovaci\u00f3n autom\u00e1tica de certificados TLS.<\/li>\n<li><strong>PostgreSQL<\/strong>: base de datos de n8n en producci\u00f3n. SQLite solo para instalaciones peque\u00f1as.<\/li>\n<li><strong>Redis<\/strong>: cola de ejecuciones cuando n8n corre con workers.<\/li>\n<li><strong>Portainer<\/strong>: gesti\u00f3n visual de contenedores para el d\u00eda a d\u00eda sin terminal.<\/li>\n<li><strong>Un gestor de secretos externo<\/strong>: n8n admite HashiCorp Vault, AWS Secrets Manager, Azure Key Vault, GCP Secret Manager y 1Password Connect. Las credenciales no deber\u00edan vivir dentro de la instancia.<\/li>\n<\/ul>\n<h2>Casos de uso donde el modelo propio gana con claridad<\/h2>\n<h3>Operaciones recurrentes, no tareas sueltas<\/h3>\n<p>La diferencia entre usar IA y tener una operaci\u00f3n de IA est\u00e1 en la estructura. Una tarea es un encargo aislado; una habilidad es una tarea que has estabilizado lo suficiente como para reutilizarla; una rutina es una habilidad que se ejecuta sola seg\u00fan un calendario o un disparador. En un modelo de pago por tarea, las rutinas son precisamente lo que resulta prohibitivo: son las que m\u00e1s veces se ejecutan. En infraestructura propia, son gratis en el margen.<\/p>\n<h3>Agente de investigaci\u00f3n y briefing editorial<\/h3>\n<p>Un flujo de investigaci\u00f3n que convierta una pauta suelta en un briefing estructurado \u2014resumen ejecutivo breve, separaci\u00f3n expl\u00edcita entre hechos verificables e hip\u00f3tesis, listado de afirmaciones que exigen comprobaci\u00f3n contra fuente primaria, varios \u00e1ngulos posibles y un esqueleto narrativo\u2014 consume muchas llamadas por documento procesado. Con cien pautas diarias, el coste por tarea decide si el proceso existe o no. Es el ejemplo can\u00f3nico de trabajo que solo es viable cuando el l\u00edmite lo pone el hardware y no la cuota.<\/p>\n<h3>Documentaci\u00f3n con datos personales o confidenciales<\/h3>\n<p>An\u00e1lisis de contratos, expedientes, historiales o n\u00f3minas. En estos casos la motivaci\u00f3n rara vez es el ahorro: es que el flujo con procesamiento externo directamente no se aprueba en el comit\u00e9 de riesgos del cliente.<\/p>\n<h2>Cu\u00e1ndo no merece la pena autoalojar<\/h2>\n<p>Un consultor honesto tambi\u00e9n se\u00f1ala los contraindicados:<\/p>\n<ul>\n<li><strong>Volumen bajo y estable.<\/strong> Por debajo de las 20.000 ejecuciones mensuales, el ahorro se lo come el mantenimiento.<\/li>\n<li><strong>Sin nadie que administre.<\/strong> Si no hay una persona con responsabilidad clara sobre actualizaciones y copias, el riesgo operativo supera al beneficio econ\u00f3mico.<\/li>\n<li><strong>Modelo de negocio multi-inquilino.<\/strong> Como se ha visto, las licencias de n8n y Dify lo impiden sin acuerdo comercial.<\/li>\n<li><strong>Prototipado.<\/strong> Para validar si una automatizaci\u00f3n aporta valor, el SaaS es m\u00e1s r\u00e1pido. La migraci\u00f3n tiene sentido cuando el flujo ya est\u00e1 probado y el volumen justifica el traslado.<\/li>\n<\/ul>\n<h2>La infraestructura: qu\u00e9 pedirle a tu proveedor<\/h2>\n<p>Hay cuatro cosas que conviene exigir para este tipo de despliegue:<\/p>\n<ul>\n<li><strong><a href=\"https:\/\/www.nicalia.com\/hosting\/nvme\">Almacenamiento NVMe<\/a>.<\/strong> No es marketing cuando hay una base vectorial de por medio: es la diferencia entre una consulta RAG de 200 ms y una de dos segundos.<\/li>\n<li><strong>Recursos garantizados y escalado en caliente.<\/strong> Poder subir CPU o RAM sin reinstalar cuando un cliente nuevo dispara la carga.<\/li>\n<li><strong>Ubicaci\u00f3n en la UE y contrato de encargo del tratamiento.<\/strong> Sin ambas cosas, el argumento de soberan\u00eda no se sostiene ante una auditor\u00eda.<\/li>\n<li><strong>Soporte t\u00e9cnico que entienda el stack.<\/strong> Cuando un contenedor no levanta a las tres de la madrugada, la diferencia entre un proveedor y otro es si el ticket lo lee alguien que sabe qu\u00e9 es Docker.<\/li>\n<\/ul>\n<div style=\"background: #eaf7ee; border-left: 4px solid #34a853; padding: 16px 20px; margin: 1.8em 0; border-radius: 0 4px 4px 0;\">\n<p style=\"margin: 0 0 8px 0;\"><strong>Infraestructura para tu stack de automatizaci\u00f3n con Nicalia<\/strong><\/p>\n<p style=\"margin: 0 0 10px 0;\">En Nicalia trabajamos con <em><strong>infraestructura alojada en Espa\u00f1a, almacenamiento NVMe y soporte t\u00e9cnico en espa\u00f1ol<\/strong><\/em> que entiende de servidores, no solo de tickets. Si est\u00e1s valorando llevar tu automatizaci\u00f3n a servidor propio, podemos ayudarte a dimensionar la m\u00e1quina antes de que contrates nada de m\u00e1s \u2014o de menos.<\/p>\n<p style=\"margin: 0;\"><a href=\"https:\/\/www.nicalia.com\/servidores\/dedicados\">Consulta nuestros servidores VPS<\/a> \u00b7 <a style=\"color: #1a7a3c; font-weight: 600;\" href=\"mailto:ventas@nicalia.com\">Habla con nuestro equipo<\/a><\/p>\n<\/div>\n<h2>Preguntas frecuentes<\/h2>\n<h3>\u00bfPuedo montar n8n en un VPS y cobrar a mis clientes por usarlo?<\/h3>\n<p>No sin licencia comercial. La Sustainable Use License permite el uso interno de tu propio negocio y los servicios de consultor\u00eda alrededor de n8n, pero no alojar la herramienta y cobrar a terceros por acceder a ella ni ofrecerla con marca propia. S\u00ed puedes implantar y mantener n8n en la infraestructura de tu cliente y facturar ese trabajo.<\/p>\n<h3>\u00bfA partir de cu\u00e1ntas ejecuciones compensa autoalojar?<\/h3>\n<p>Como orden de magnitud, alrededor de 20.000 ejecuciones mensuales. Por debajo, el coste del mantenimiento suele igualar o superar el ahorro en licencias. Por encima, la diferencia se ampl\u00eda r\u00e1pidamente porque el coste de infraestructura crece mucho m\u00e1s despacio que la factura por tarea.<\/p>\n<h3>\u00bfNecesito GPU para usar modelos locales?<\/h3>\n<p>Depende del uso. Para clasificaci\u00f3n, extracci\u00f3n de datos y procesamiento por lotes, un VPS con CPU y memoria suficiente cumple. Para chat interactivo con usuarios finales, la velocidad en CPU \u2014del orden de unos pocos tokens por segundo\u2014 resulta insuficiente y necesitar\u00e1s GPU o un modelo servido por API.<\/p>\n<h3>\u00bfAutoalojar me exime de firmar un contrato de encargo del tratamiento?<\/h3>\n<p>No. Tu proveedor de VPS trata datos personales por cuenta tuya y por tanto es encargado del tratamiento, con las obligaciones del art\u00edculo 28 del RGPD. Lo que consigues es acortar la cadena de subencargados, que es donde est\u00e1 el riesgo real de exposici\u00f3n.<\/p>\n<h3>\u00bfQu\u00e9 pasa si mezclo un stack autoalojado en Espa\u00f1a con una API de modelo estadounidense?<\/h3>\n<p>Sigues realizando una transferencia internacional de datos y te aplican los art\u00edculos 44 a 49 del RGPD. La soberan\u00eda es una propiedad del flujo completo, no solo del servidor donde vive el orquestador.<\/p>\n<h2>Fuentes<\/h2>\n<ul style=\"font-size: 0.92em;\">\n<li>n8n Docs \u2014 <a href=\"https:\/\/docs.n8n.io\/sustainable-use-license\/\" target=\"_blank\" rel=\"nofollow noopener\">Sustainable Use License<\/a>: alcance, limitaciones y ejemplos de uso permitido y no permitido.<\/li>\n<li>n8n \u2014 <a href=\"https:\/\/github.com\/n8n-io\/n8n\/blob\/master\/LICENSE.md\" target=\"_blank\" rel=\"nofollow noopener\">Texto de la licencia en GitHub<\/a> y excepciones para archivos con sufijo .ee.<\/li>\n<li>n8n Docs \u2014 <a href=\"https:\/\/docs.n8n.io\/hosting\/starter-kits\/ai-starter-kit\/\" target=\"_blank\" rel=\"nofollow noopener\">Self-hosted AI Starter Kit<\/a>: componentes incluidos y advertencia sobre entornos de producci\u00f3n.<\/li>\n<li>n8n Docs \u2014 <a href=\"https:\/\/docs.n8n.io\/changelog\/release-notes-2.x\" target=\"_blank\" rel=\"nofollow noopener\">Notas de versi\u00f3n de la rama 2.x<\/a>: proveedores de secretos externos y retenci\u00f3n de datos en instancias autoalojadas.<\/li>\n<li>LangGenius \u2014 <a href=\"https:\/\/github.com\/langgenius\/dify\/blob\/main\/LICENSE\" target=\"_blank\" rel=\"nofollow noopener\">Licencia de Dify<\/a>: Apache 2.0 con condiciones sobre multi-tenant y marca.<\/li>\n<li>kossakovsky \u2014 <a href=\"https:\/\/github.com\/kossakovsky\/n8n-installer\" target=\"_blank\" rel=\"nofollow noopener\">n8n-installer<\/a>: requisitos m\u00ednimos y asistente de selecci\u00f3n de servicios.<\/li>\n<li>AEPD \u2014 <a href=\"https:\/\/www.aepd.es\/preguntas-frecuentes\/2-tus-obligaciones-como-responsable-del-tratamiento\/8-responsable-y-encargado-del-tratamiento\" target=\"_blank\" rel=\"nofollow noopener\">Responsable y encargado del tratamiento<\/a>.<\/li>\n<li>CEPD \u2014 <a href=\"https:\/\/www.edpb.europa.eu\/system\/files\/documents\/2023-10\/edpb_guidelines_202007_controllerprocessor_final_es.pdf\" target=\"_blank\" rel=\"nofollow noopener\">Directrices 07\/2020 sobre los conceptos de responsable y encargado<\/a>.<\/li>\n<li>Reglamento (UE) 2024\/1689 de Inteligencia Artificial, texto consolidado tras el \u00d3mnibus Digital, y Reglamento (UE) 2026\/1744 (DOUE, 24 de julio de 2026). Disponibles en EUR-Lex.<\/li>\n<li>Documentaci\u00f3n de Ollama y gu\u00edas de dimensionado de memoria para modelos cuantizados Q4_K_M.<\/li>\n<li>P\u00e1gina oficial de precios de Zapier para los tramos del plan Professional (consultada en agosto de 2026).<\/li>\n<\/ul>\n<p style=\"font-size: 0.88em; color: #5a6672; margin-top: 2em;\">Los precios de terceros citados corresponden a las tarifas publicadas en agosto de 2026 y pueden variar. Este art\u00edculo tiene finalidad informativa y no constituye asesoramiento jur\u00eddico; para decisiones de cumplimiento normativo, consulta con tu asesor legal o con tu delegado de protecci\u00f3n de datos.<\/p>\n","protected":false},"excerpt":{"rendered":"<p>Si tu agencia ha cruzado el umbral en el que la factura de automatizaci\u00f3n crece al mismo ritmo que los clientes, ya conoces el problema: [&hellip;]<\/p>\n","protected":false},"author":11,"featured_media":3825,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[97,95],"tags":[],"_links":{"self":[{"href":"https:\/\/www.nicalia.com\/blog\/wp-json\/wp\/v2\/posts\/3820"}],"collection":[{"href":"https:\/\/www.nicalia.com\/blog\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.nicalia.com\/blog\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.nicalia.com\/blog\/wp-json\/wp\/v2\/users\/11"}],"replies":[{"embeddable":true,"href":"https:\/\/www.nicalia.com\/blog\/wp-json\/wp\/v2\/comments?post=3820"}],"version-history":[{"count":6,"href":"https:\/\/www.nicalia.com\/blog\/wp-json\/wp\/v2\/posts\/3820\/revisions"}],"predecessor-version":[{"id":3829,"href":"https:\/\/www.nicalia.com\/blog\/wp-json\/wp\/v2\/posts\/3820\/revisions\/3829"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/www.nicalia.com\/blog\/wp-json\/wp\/v2\/media\/3825"}],"wp:attachment":[{"href":"https:\/\/www.nicalia.com\/blog\/wp-json\/wp\/v2\/media?parent=3820"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.nicalia.com\/blog\/wp-json\/wp\/v2\/categories?post=3820"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.nicalia.com\/blog\/wp-json\/wp\/v2\/tags?post=3820"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}