Microsoft ha presentado recientemente Foundry Managed Compute, una solución diseñada para simplificar la implementación y gestión de modelos de inteligencia artificial de código abierto en entornos empresariales. Esta plataforma, que se integra directamente con el ecosistema de Hugging Face, permite a las organizaciones desplegar modelos con un solo clic, eliminando gran parte de la complejidad operativa que tradicionalmente ha frenado la adopción de modelos abiertos en sectores corporativos. La propuesta busca unificar la experiencia de uso, ofreciendo seguridad, gobernanza y observabilidad consistentes para cualquier modelo, independientemente de su origen.

El núcleo de esta iniciativa es la curación y validación de modelos. A través de una colaboración estrecha, Microsoft selecciona modelos populares de Hugging Face y los somete a un riguroso proceso de revisión. Esto incluye la verificación de licencias, inspecciones de seguridad para evitar la ejecución de código no confiable y la validación técnica mediante el uso exclusivo del formato SafeTensors. Al pre-alojar los pesos de los modelos en Azure y gestionar las imágenes de los contenedores, la plataforma permite que las empresas operen dentro de redes privadas sin necesidad de conexiones externas hacia el repositorio público, garantizando así la soberanía y seguridad de los datos.

La infraestructura subyacente de Foundry Managed Compute utiliza diversos motores de inferencia optimizados, como vLLM, SGLang, TensorRT-LLM y llama.cpp, seleccionados específicamente según la arquitectura de cada modelo. Esta capa de ejecución es mantenida automáticamente por Microsoft, lo que significa que las actualizaciones de seguridad, parches y mejoras de rendimiento se aplican sin que el usuario deba realizar procesos de despliegue adicionales. De esta forma, los desarrolladores pueden centrarse en la lógica de sus aplicaciones de IA, delegando la gestión de la topología de hardware y el mantenimiento del software a la plataforma.

Para facilitar la puesta en marcha, el sistema introduce el concepto de plantillas de despliegue. Estas configuraciones predefinidas permiten a los usuarios elegir parámetros críticos como la longitud de contexto, el tipo de acelerador y la optimización entre latencia o rendimiento. Al seleccionar una plantilla, el sistema configura automáticamente los parámetros de ejecución, los analizadores de razonamiento y las sondas de salud. Este enfoque estandarizado permite que un modelo de código abierto se comporte de manera idéntica a los modelos propietarios dentro del catálogo de Foundry, utilizando los mismos SDKs y puntos de conexión.

Finalmente, la integración busca resolver el dilema entre la flexibilidad del código abierto y la fiabilidad de los servicios gestionados. Al proporcionar un entorno donde conviven modelos de frontera y modelos abiertos bajo un mismo modelo de facturación y observabilidad, Microsoft facilita la creación de aplicaciones de agentes inteligentes. La capacidad de escalar recursos, ajustar el tamaño de las GPUs y mantener un control estricto sobre el ciclo de vida del modelo posiciona a esta plataforma como una herramienta clave para las empresas que buscan aprovechar la innovación abierta sin comprometer sus estándares de seguridad corporativa.