El panorama de la inteligencia artificial generativa de código abierto acaba de recibir una actualización significativa con el lanzamiento de Hy3, un nuevo modelo desarrollado por el equipo especializado de Tencent. Este sistema se presenta bajo una licencia Apache 2.0, lo que facilita su adopción y experimentación dentro de la comunidad tecnológica global. La arquitectura elegida para este desarrollo es la de Mezcla de Expertos (MoE), una configuración que permite optimizar el rendimiento computacional al activar solo una fracción de los parámetros totales durante cada proceso de inferencia, logrando así un equilibrio entre potencia y eficiencia operativa.

En términos de especificaciones técnicas, Hy3 destaca por contar con un total de 295 mil millones de parámetros. De esta cifra masiva, el modelo mantiene 21 mil millones de parámetros activos en cada ejecución, complementados por una capa de predicción de tokens múltiples (MTP) de 3.8 mil millones de parámetros. Esta estructura permite que el modelo supere a otras alternativas de tamaño similar y compita directamente con los principales exponentes de código abierto que poseen entre dos y cinco veces más parámetros, demostrando una eficiencia notable en el procesamiento de información compleja.

El proceso de creación de este modelo no fue repentino, sino que siguió una fase de pruebas previa iniciada a finales de abril. Durante este periodo, el equipo de desarrollo recopiló retroalimentación directa de más de cincuenta productos distintos, lo que permitió ajustar y escalar el entrenamiento posterior utilizando conjuntos de datos de mayor calidad. Este enfoque iterativo ha resultado en mejoras sustanciales en la utilidad práctica del modelo, especialmente en tareas orientadas a la productividad y en su integración dentro de diversos entornos de software.

Para los desarrolladores interesados en implementar esta tecnología, el modelo se encuentra disponible en la plataforma Hugging Face. El archivo correspondiente al modelo completo ocupa 598 gigabytes, mientras que una versión cuantizada en formato FP8 reduce su tamaño a 300 gigabytes, facilitando su despliegue en infraestructuras que requieran optimización de memoria. Además, Hy3 destaca por su capacidad de manejar una ventana de contexto de 256 mil tokens, lo que le permite procesar documentos extensos o secuencias de datos complejas con gran coherencia.

Como parte de su estrategia de lanzamiento y adopción, Tencent ha habilitado el acceso gratuito a Hy3 a través de OpenRouter hasta el 21 de julio. Esta iniciativa busca fomentar la experimentación directa por parte de los usuarios, permitiendo probar las capacidades del modelo en diversas tareas, desde la generación de código y texto hasta la creación de gráficos vectoriales complejos. La llegada de Hy3 refuerza la tendencia actual de las grandes empresas tecnológicas por ofrecer modelos de alto rendimiento bajo licencias permisivas, impulsando así el ecosistema de IA abierta y desafiando los estándares establecidos por los modelos propietarios de mayor escala.