El servidor barato que necesita un técnico caro.
Cuando alguien te vende un SLM local instalado por 3 000 € de hardware, el coste anual real empieza en otro sitio. Esta es la lista completa de las líneas que se olvidan al presupuestar.
El hardware es la línea visible. Las otras cinco son las que decidien si el proyecto sale a cuenta.
- 01
Hardware (GPU + servidor + almacenamiento)
La cifra visible. Un servidor con GPU capaz de correr un SLM útil sale entre 2 500 € y 15 000 €. Se amortiza en 3-5 años.
- 02
MLOps y despliegue
Configurar el runtime, los pesos, la cuantización, el servidor de inferencia, la observabilidad. Es un rol técnico, no se resuelve con un tutorial.
- 03
Personal dedicado o subcontratado
Un MLOps con soltura cuesta entre 55 000 € y 80 000 € brutos anuales en España. Externalizarlo sale entre 60 y 120 € por hora. Sin este rol, el sistema se degrada.
- 04
Actualizaciones de modelo
Los modelos nuevos aparecen cada pocos meses. Migrar pesos, revalidar prompts y ajustar prompts a la nueva versión es trabajo periódico, no evento único.
- 05
Seguridad y cumplimiento
Aislamiento de red, backups cifrados, logging, auditoría, patches, hardening. Lo que ya haces con cualquier servidor corporativo, ahora también aquí.
- 06
Continuidad y sustitución
Cuando la persona MLOps se va o el hardware se rompe. Debe existir un plan documentado antes de que ocurra.
El coste total anual de operar un SLM local en producción suele quedar entre 3 y 5 veces el precio del hardware inicial, dependiendo de si tienes la operación en casa o subcontratada. Ese factor rara vez aparece en el presupuesto que te llega de fábrica.
Preguntas frecuentes
¿Cuánto cuesta operar un SLM local en la empresa?
El coste total anual suele quedar entre 3 y 5 veces el precio del hardware inicial, dependiendo de si la operación se lleva en casa o subcontratada. El hardware es la línea visible; el resto son MLOps, personal, actualizaciones, seguridad y continuidad.
¿Se necesita personal MLOps propio?
Sí, dedicado o subcontratado. Un MLOps con soltura cuesta entre 55 000 € y 80 000 € brutos anuales en España. Externalizarlo sale entre 60 y 120 € por hora. Sin este rol, el sistema se degrada en pocos meses.
¿Con qué frecuencia hay que actualizar el modelo?
Los modelos nuevos aparecen cada pocos meses. Migrar pesos, revalidar prompts y ajustar la nueva versión es trabajo periódico, no evento único. Sin este esfuerzo el sistema se queda anclado a un modelo que envejece rápido.
¿Es el hardware el mayor coste?
No. El hardware es solo la línea visible (2 500 a 15 000 € por servidor con GPU). Personal, MLOps, seguridad y continuidad suman típicamente 3 a 5 veces esa cifra al año.
¿Cuándo compensa un SLM local frente a un modelo por API?
Cuando la privacidad es un requisito duro, cuando el volumen es masivo y estable, o cuando hay que operar offline. En el resto de casos, un modelo por API sale más barato de operar y más rápido de evolucionar.
SLM local sí, cuando el ahorro real compensa las líneas ocultas
En SVP el sistema se diseña para poder correr en cloud dedicado o server local del cliente. La decisión no es dogmática: sale del cálculo real de coste total y de los requisitos de privacidad de tu operación.