Dónde alojar inferencia LLM con residencia de datos en la UE
Dónde ejecutar inferencia LLM con residencia de datos en la UE: proveedores nativos, regiones de hiperscalers y GPU dedicada para RGPD y Ley de IA.
Dónde alojar inferencia LLM con residencia de datos en la UE
Para alojar inferencia LLM con residencia de datos en la UE puedes usar un servicio gestionado nativo europeo como Tessera AI, que sirve modelos de código abierto en infraestructura dedicada en la UE y LATAM a través de una API compatible con OpenAI, o las regiones europeas de hiperscalers como AWS, Google Cloud y Azure. Ambas opciones mantienen los datos personales dentro del EEE y se alinean con los Artículos 44-49 del RGPD y la Ley de IA de la UE; los proveedores nativos añaden el control jurisdiccional que una etiqueta de región por sí sola no garantiza.
Requisitos de residencia de datos en la UE para inferencia LLM
Los Artículos 44-49 del RGPD bloquean las transferencias fuera del EEE salvo que uses Cláusulas Contractuales Tipo o decisiones de adecuación. Tras Schrems II, debes evaluar individualmente las leyes del país de destino para confirmar que los niveles de protección coinciden con los estándares de la UE. El Marco de Privacidad de Datos es uno de los mecanismos válidos disponibles.
La Ley de IA de la UE entró en vigor el 1 de agosto de 2024 y será plenamente aplicable el 2 de agosto de 2026. Añade obligaciones para los desplegadores de sistemas de alto riesgo: registro obligatorio y supervisión humana. Si usas una API de terceros, esas obligaciones siguen aplicándose a tu caso de uso; nuestra guía de cumplimiento de la Ley de IA para inferencia LLM las explica en detalle.
La residencia de datos en la UE no equivale al cumplimiento del RGPD. Una infraestructura alojada en EE. UU. puede seguir siendo lícita si el mecanismo de transferencia es válido, pero Schrems II exige evaluar si la legislación estadounidense socava las protecciones prometidas por las CCT. La Ley de IA añade obligaciones de gobernanza y trazabilidad sobre el RGPD, pero no sustituye las normas de transferencia.
Mapeo de los mecanismos de transferencia del RGPD a los flujos de trabajo LLM
La verdadera residencia depende de algo más que la ubicación del servidor. Los prompts, las respuestas, las instrucciones del sistema y los vectores de embeddings se consideran datos personales si identifican a individuos. Los registros y trazas de depuración suelen capturar prompts en bruto y deben estar aislados regionalmente para evitar transferencias transfronterizas accidentales.
Trata la ubicación de procesamiento del proveedor, el acceso de soporte remoto, la infraestructura de registro y las copias de seguridad como parte del análisis de transferencia. No te bases únicamente en una etiqueta visible de «región UE». Verifica que la entidad jurídica, la infraestructura y el motor de inferencia del proveedor estén anclados en Europa.
El personal de soporte remoto fuera del EEE constituye una transferencia que requiere sus propias CCT o evaluación de adecuación.
Proveedores de inferencia gestionada en la UE
Los servicios de inferencia gestionada cumplen los requisitos de residencia ejecutando endpoints regionales dedicados y aplicando políticas de retención estrictas, sin que tengas que gestionar clústeres de GPU. Los proveedores nativos europeos operan bajo legislación europea y fuera del alcance jurisdiccional de EE. UU., lo que los convierte en la opción más sólida para una verdadera soberanía de datos.
Tessera AI sirve modelos de código abierto como Qwen3.6-35B-A3B en infraestructura dedicada en la UE y LATAM a través de una API compatible con OpenAI. La tenencia dedicada mantiene las cargas de inferencia en hardware aislado, los precios mensuales fijos sustituyen la facturación variable por token y un Acuerdo de Procesamiento de Datos estándar cubre los requisitos del Artículo 28 del RGPD.
Otras opciones nativas europeas son Apertus, que aloja modelos de código abierto exclusivamente en la UE tras una API compatible con OpenAI, y Regolo, que ejecuta la inferencia en Italia en centros de datos de energía renovable sin retener datos de usuarios para entrenamiento. Sea cual sea el proveedor que preselecciones, verifica sus subencargados, sus divulgaciones operativas y la madurez del servicio.
Evaluación de cadenas de subencargados y controles de registro
Documenta la ubicación exacta de cada subencargado, incluidas las bases de datos vectoriales, las herramientas de monitorización y los servicios de seguimiento de errores. Si algún componente procesa datos fuera del EEE, implementa medidas técnicas complementarias como cifrado con claves gestionadas exclusivamente en la región.
La Ley de IA de la UE exige que los sistemas de alto riesgo incluyan evaluación y mitigación de riesgos, registro, documentación detallada, supervisión humana y medidas de robustez. Al usar una API de terceros, sigues siendo responsable de las obligaciones aplicables al desplegador. Verifica que el sistema de registro del proveedor conserve las pistas de auditoría dentro de la UE y que puedas exportarlas para revisión regulatoria; nuestra guía de DPA y subencargados para LLM recoge la lista de comprobación cláusula a cláusula.
Regiones UE de hiperscalers y sus limitaciones
Los hiperscalers ofrecen endpoints en la UE para inferencia LLM, pero el procesamiento en región UE no equivale a soberanía plena. La exposición a la CLOUD Act y los subencargados controlados por el proveedor siguen siendo relevantes aunque los datos permanezcan en la región. La disponibilidad de modelos suele ser la restricción real: no todas las variantes están disponibles en todas las regiones de la UE y la paridad regional puede ir por detrás del mercado estadounidense.
OpenAI admite residencia de datos para clientes de ChatGPT Enterprise y Edu en Europa, ejecutando la inferencia GPU en la región para el contenido elegible cuando la configuración está activada. Google Vertex AI lista regiones de la UE en Bélgica, los Países Bajos y Finlandia, aunque la disponibilidad de Gemini depende de la región específica. Azure OpenAI despliega en Sweden Central y France Central; AWS Bedrock ofrece endpoints en la UE, aunque la cobertura regional varía según el modelo.
Revisa las ubicaciones de los subencargados y los controles de registro antes de confiar en cualquier hiperscaler para el cumplimiento normativo. Si necesitas que ningún dato salga de la UE, elige un endpoint con inferencia explícita en región UE en lugar de una API global con configuraciones de residencia únicamente.
Disponibilidad de modelos y paridad regional
Los proveedores suelen lanzar nuevas arquitecturas primero en regiones de EE. UU., dejando a los equipos europeos a la espera de la paridad regional. Este retraso puede forzar compromisos arquitectónicos: enrutar cargas de trabajo no sensibles a endpoints de EE. UU. mientras se mantienen los datos sensibles en la región, o quedarse con versiones de modelos más antiguas.
Consulta la documentación del proveedor para conocer los calendarios de lanzamiento específicos por región. Revisa la lista de modelos disponibles para verificar qué arquitecturas admiten despliegue en región UE. Planifica tu estrategia para gestionar las brechas regionales, ya sea manteniendo múltiples versiones de modelos o construyendo una capa de enrutamiento que dirija el tráfico según la disponibilidad del modelo y la sensibilidad de los datos.
Consideraciones de latencia y coste entre la UE y EE. UU.
La inferencia alojada en la UE elimina un viaje de ida y vuelta transatlántico de cada solicitud, reduciendo el tiempo hasta el primer token para los usuarios europeos. Para cargas de trabajo interactivas como chat y automatización de soporte, esa sobrecarga se repite en cada llamada.
El enrutamiento entre regiones europeas cuesta mucho menos que cruzar el Atlántico. La guía de inferencia entre regiones de AWS describe perfiles de geografía UE que mantienen las solicitudes dentro de las regiones europeas, con precios calculados sobre la región de la solicitud de origen y sin cargo adicional por el enrutamiento entre regiones. La mayor parte del retraso visible para el usuario proviene del tiempo de inferencia del modelo, por lo que el alojamiento en la región elimina la parte de red evitable sin afectar a la calidad del modelo.
Las comparativas directas de precios UE frente a EE. UU. para modelos de código abierto como Qwen, Llama o Mistral no están bien documentadas en fuentes públicas; una tabla de precios comparable requiere presupuestos directos de proveedores o pruebas independientes.
Modelado de costes para inferencia de alto volumen
Predecir los costes de inferencia requiere ir más allá del precio por token. Los modelos de código abierto autoalojados trasladan los costes de las tarifas variables por token a infraestructura GPU fija, despliegue, registro, control de acceso y reversión. Ten en cuenta las tasas de utilización de GPU, el tiempo de inactividad durante los períodos de bajo tráfico y la carga de ingeniería de mantener la infraestructura de servicio.
Las pasarelas de inferencia gestionada aplican enrutamiento consciente de la jurisdicción para que el tráfico de la UE vaya a backends en región UE sin salir del continente. La propia pasarela añade otro proveedor a la cadena, por lo que la exposición depende del diseño de la pasarela y de los proveedores que hay detrás. Calcula el coste total de propiedad combinando las tarifas de la pasarela, los costes de la API del backend y la carga operativa de gestionar políticas de enrutamiento, observabilidad y conmutación por error entre proveedores.
Consideraciones sobre transferencia de datos en América Latina
El alojamiento en la UE ofrece a los responsables del tratamiento latinoamericanos una base de adecuación reconocida, reduciendo la fricción de cumplimiento al enviar datos a infraestructura europea. La inferencia alojada en EE. UU. plantea interrogantes sobre el acceso posterior que el alojamiento en la UE evita.
La LGPD de Brasil exige cláusulas contractuales tipo aprobadas por la ANPD para las transferencias internacionales en virtud de la Resolución CD/ANPD n.º 19/2024. La infraestructura de la UE simplifica la documentación al proporcionar salvaguardias establecidas, lo que facilita presentarla como destino de transferencia controlada frente a un entorno de EE. UU.
Argentina cuenta con una decisión de adecuación de la Comisión Europea, por lo que la inferencia alojada en la UE elimina el riesgo de transferencia para las entidades argentinas. Colombia permite las transferencias a países adecuados o bajo excepciones específicas, por lo que el alojamiento en la UE encaja directamente en ese modelo. La LFPDPPP de México aplica normas estrictas de consentimiento y restricciones transfronterizas independientemente de la ubicación del alojamiento, pero el alojamiento en la UE se alinea con un régimen de privacidad más sólido y simplifica las evaluaciones del destino.
Alineación de los marcos de privacidad de LATAM con el alojamiento en la UE
Documentar las transferencias transfronterizas para las operaciones en LATAM requiere ajustar el mecanismo específico de cada país a tu arquitectura de alojamiento. Para Brasil, prepara cláusulas contractuales tipo aprobadas por la ANPD y verifica que tu proveedor de la UE pueda suministrar las salvaguardias técnicas y organizativas requeridas. Para Colombia, asegúrate de que tu transferencia se acoge al consentimiento expreso o a las excepciones de ejecución contractual si no puedes basarte en la adecuación.
La legislación mexicana impone requisitos de consentimiento, avisos de privacidad y restricciones de transferencia transfronteriza para los responsables del tratamiento. Adapta tus avisos de privacidad para divulgar explícitamente la ubicación de alojamiento en la UE y la base jurídica de la transferencia. El marco argentino está reconocido como que proporciona protección adecuada, por lo que el alojamiento en la UE satisface sus requisitos básicos sin capas contractuales adicionales.
Elección de una infraestructura de inferencia conforme con la residencia
Una infraestructura conforme con la residencia necesita hardware dedicado en la UE, controles claros sobre los subencargados y precios que gestionen cargas de trabajo de alto volumen sin penalizaciones. La compensación central es un equilibrio entre tres factores: garantías de residencia, exposición jurisdiccional de los subencargados y carga operativa.
Tessera AI cubre los tres factores para equipos que quieren infraestructura gestionada: modelos de código abierto como Qwen3.6-35B-A3B se ejecutan en infraestructura dedicada en la UE y LATAM, la API compatible con OpenAI permite seguir los patrones estándar de migración desde OpenAI sin reescribir código, y los precios mensuales fijos mantienen predecible la presupuestación de alto volumen. Para el panorama completo de cumplimiento, incluidos los contratos del Artículo 28 y el registro de auditoría, consulta la guía sobre alojamiento LLM conforme con el RGPD.
Las pasarelas de inferencia gestionada pueden aplicar enrutamiento consciente de la jurisdicción para que el tráfico de la UE vaya a backends en región UE y nunca salga del continente, si la selección del backend está correctamente configurada. La propia pasarela añade otro subencargado a la cadena, por lo que la exposición depende del diseño de la pasarela y de los proveedores que hay detrás. El autoalojamiento de modelos de código abierto en tu propio hardware ofrece la menor exposición a subencargados externos, pero conlleva la mayor carga: la infraestructura GPU, el despliegue, el registro, el control de acceso, el servicio del modelo y la reversión son responsabilidad del cliente.
Preguntas frecuentes
¿La residencia de datos en la UE equivale al cumplimiento del RGPD?
No. El RGPD permite las transferencias fuera del EEE si se cumplen los Artículos 44-49. La residencia significa mantener el procesamiento dentro de la UE; el cumplimiento abarca todo el marco jurídico. Debes seguir implementando mecanismos de transferencia válidos y medidas complementarias cuando sea necesario.
¿El alojamiento en una región de la UE elimina los riesgos de la CLOUD Act de EE. UU.?
No del todo. Las regiones de la UE en la nube pública pueden seguir exponiendo datos a la jurisdicción de EE. UU. a través de los subencargados del proveedor. Los proveedores nativos de la UE o la infraestructura dedicada reducen esa exposición al operar estrictamente bajo legislación europea. Verifica los subencargados y las divulgaciones operativas de cada proveedor independientemente del modelo de alojamiento.
¿Cómo afecta el alojamiento en la UE a la latencia para los usuarios europeos?
Elimina un viaje de ida y vuelta transatlántico de cada solicitud, reduciendo la sobrecarga de red antes de que el modelo comience a generar. El enrutamiento entre regiones europeas añade solo una pequeña fracción de ese coste. La mayor parte del retraso visible para el usuario proviene del tiempo de inferencia del modelo, por lo que el alojamiento en la región elimina la parte de red evitable.
¿Puedo usar modelos de código abierto con residencia de datos en la UE?
Sí. El autoalojamiento de modelos de código abierto en infraestructura de la UE te da control total sobre la ruta de inferencia. Proveedores gestionados nativos europeos como Tessera AI sirven modelos de código abierto como Qwen3.6-35B-A3B en infraestructura de la UE, y las pasarelas de inferencia gestionada pueden enrutar cargas de trabajo de código abierto a backends en región UE manteniendo políticas conscientes de la jurisdicción.