

En un anuncio desde Seúl el 10 de diciembre de 2025, Red Hat y la empresa surcoreana Rebellions han revelado una nueva plataforma que esgrime revolucionar la manera en que la inteligencia artificial (IA) se despliega en el ámbito empresarial. Bajo el nombre de «Red Hat OpenShift AI powered by Rebellions NPUs», esta solución asegura una mayor eficiencia energética al integrarse con unidades de procesamiento neuronal (NPUs), ofreciendo así una alternativa a los tradicionales entornos basados en GPU.
La iniciativa se enmarca dentro de la estrategia de Red Hat de ofrecer flexibilidad máxima con el lema «cualquier modelo, cualquier acelerador, cualquier nube». Esta nueva plataforma pretende solucionar problemas prácticos que enfrentan las empresas al intentar llevar sus proyectos de IA del laboratorio a aplicaciones comerciales. En muchos casos, el proceso de «servir modelos», es decir, poner en uso los sistemas de IA, no solo se manifiesta costoso, sino que introduce una serie de complejidades operativas y regulatorias.
El énfasis está en solucionar estos desafíos mediante la «industrialización» de la inferencia, una etapa crítica en el uso de la IA que requiere estabilidad y eficiencia. Red Hat y Rebellions argumentan que los entornos basados únicamente en GPU no siempre resultan suficientes para alcanzar el equilibrio óptimo entre rendimiento y eficiencia necesario para escalar operaciones sin comprometer los costes.
Las NPUs, aunque no son una novedad conceptual, se presentan ahora como una solución robusta para mejorar la eficiencia energética específicamente durante la inferencia. Rebellions sostiene que su arquitectura está optimizada para esta tarea, lo que reduce los costos de despliegue y operación, un factor crucial en centros de datos donde la potencia y la refrigeración son prioridades logísticas.
Este paquete «valida» la integración de hardware y «model serving», ya que incluye no solo OpenShift AI como plataforma base para desplegar cargas de IA, sino una pila de software de Rebellions adaptada para minimizar fricciones. Además, el Rebellions NPU Operator, certificado para Red Hat OpenShift, facilita la gestión de NPUs, permitiendo una operación más fluida en comparación con GPUs.
En el ámbito técnico, la inclusión de vLLM, un motor de inferencia conocido en el ecosistema de modelos de lenguaje, deja claras las intenciones de la propuesta de adaptarse a escenarios que requieren inferencia distribuida. Aquí, la capacidad de escalar horizontalmente resulta imperativa para atender demandas fluctuantes y servir múltiples modelos simultáneamente sin comprometer la latencia y manteniendo altos niveles de rendimiento.
Al abordar aspectos de seguridad y cumplimiento, Red Hat destaca que su plataforma es ideal para entornos donde la soberanía del dato es esencial, como en sectores de banca, salud o administración pública. Ofrece, por ende, la posibilidad de despliegue en entornos on-premise y multicloud, protegiendo la información sensible bajo estándares regulatorios estrictos.
Con esta colaboración, Red Hat y Rebellions pretenden ofrecer una alternativa al enfoque «todo GPU», promoviendo una heterogeneidad arquitectónica que proporcione a las empresas diversas opciones tecnológicas adaptadas a sus necesidades específicas. Las declaraciones de los principales ejecutivos de ambas compañías reafirman este compromiso: una IA empresarial con más elecciones y una menor dependencia de soluciones monolíticas o propietarias.
Rebellions, con sede en Corea del Sur, es reconocida por su enfoque en chips de IA para inferencia y busca, junto a Red Hat, redefinir el diálogo sobre eficiencia en el despliegue de IA empresarial. A través de esta alianza, ambas firmas intentan encaminarse hacia un paradigma en el cual rendimiento, eficiencia de costes y soberanía del dato no solo son compatibles, sino que se convierten en el estándar de operación.
Más información y referencias en Noticias Cloud.
