Red Hat lanza Red Hat AI Enterprise para proporcionar una plataforma de IA unificada desde metales hasta agentes

Red Hat anunció Red Hat AI Enterprise, una plataforma de IA integrada para implementar y gestionar modelos, agentes y aplicaciones de IA en la nube híbrida. Esta versión complementa el portafolio de IA de Red Hat, que incluye Red Hat AI Inference Server, Red Hat OpenShift AI y Red Hat Enterprise Linux AI. Además, Red Hat presenta Red Hat AI 3.3, que trae importantes actualizaciones y mejoras al portafolio de IA de la compañía. Juntas, estas soluciones proporcionan una pila completa de «agente metálico», que integra la infraestructura subyacente de Linux y Kubernetes con capacidades avanzadas de agente e inferencia para ayudar a las organizaciones a pasar de la experimentación fragmentada a operaciones autónomas y controladas. El entorno de IA empresarial está evolucionando rápidamente, pasando de simples interfaces de chat a flujos de trabajo autónomos de alta densidad que requieren una integración más profunda en toda la pila tecnológica. Sin embargo, muchas organizaciones permanecen en la “fase experimental” debido a herramientas fragmentadas y una infraestructura inconsistente. Red Hat AI Enterprise aborda este desafío unificando los ciclos de vida de modelos y aplicaciones, permitiendo a los equipos de TI tratar la IA como un sistema empresarial estándar en lugar de un proyecto aislado, haciendo que la entrega de IA sea tan confiable y repetible como el software empresarial tradicional. Red Hat AI Enterprise ofrece capacidades básicas que incluyen inferencia de IA de alto rendimiento, ajuste y personalización de modelos, e implementación y administración de agentes, soportando de manera flexible cualquier modelo y hardware en cualquier entorno. Impulsado por Red Hat OpenShift, la plataforma de aplicaciones de nube híbrida basada en Kubernetes líder en la industria, Red Hat AI Enterprise en esencia ofrece una experiencia altamente escalable y consistente con un perfil de seguridad mejorado, en cualquier lugar, utilizando herramientas y marcos familiares. Para la infraestructura de IA de NVIDIA, NVIDIA y Red Hat, junto con NVIDIA, diseñaron la nueva Red Hat AI Factory, que combina Red Hat AI Enterprise y NVIDIA AI Enterprise para acelerar y escalar la producción de inteligencia artificial para empresas. Los principales beneficios de Red Hat AI Enterprise son:

  • Inferencia de IA más rápida, rentable y escalable utilizando el motor de inferencia vLLM y el marco de inferencia distribuida llm-d para una implementación optimizada de modelos de IA generativa en entornos de hardware híbridos.

  • Gestión integrada del ciclo de vida y observabilidad para gestionar la gobernanza y mitigar el riesgo mediante una pila de IA empresarial integrada, probada e interoperable.

  • Una nube híbrida flexible que permite a las organizaciones implementar y administrar modelos, agentes y aplicaciones de IA con mayor coherencia cuando el negocio lo exige, respaldada por plataformas confiables de Red Hat.

La estrategia de Red Hat se centra en cerrar la brecha entre la estabilidad crítica para el negocio y la innovación de vanguardia a través de una plataforma unificada. La última versión del software amplía la gama de modelos, profundiza la optimización completa para la próxima generación de silicio y fortalece la coherencia operativa para los modelos de vanguardia.

Las nuevas características y mejoras incluyen:

  • Ampliar el ecosistema de modelos con versiones comprimidas, validadas y listas para producción de Mistral-Large-3, Nemotron-Nano y Apertus-8B-Instruct disponibles a través del catálogo OpenShift AI. Además, el lanzamiento permite implementar modelos de próxima generación como Ministral 3 y DeepSeek-V3.2 con poca atención, al tiempo que ofrece mejoras multimodales como aceleración 3x Whisper, compatibilidad con GIS, decodificación especulativa EAGLE mejorada y herramientas mejoradas para los flujos de trabajo de los agentes.
  • Acceso de autoservicio a modelos de IA con una vista previa de la tecnología de modelos como servicio (MaaS). Los equipos de TI pueden ofrecer acceso de autoservicio a modelos propietarios a través de una puerta de enlace API. Este enfoque centralizado garantiza que la IA esté disponible para los usuarios internos a pedido, fomentando una base de IA lista para usar que impulsa la adopción privada y escalable dentro de la empresa.

  • Soporte de hardware ampliado, incluida una vista previa de la tecnología de soporte de IA generativa en CPU, comenzando con CPU Intel para una inferencia de modelo de lenguaje pequeño (SLM) más rentable. Además, la plataforma ha ampliado su certificación de hardware para incluir NVIDIA Blackwell Ultra y soporte para aceleradores AMD MI325X.

  • Ciclo de vida del modelo de datos unificado impulsado por el nuevo Python Index de Red Hat AI. Este repositorio confiable ofrece versiones sólidas de nivel empresarial de herramientas críticas, incluidas Docling, SDG Hub y Training Hub, lo que permite a los equipos pasar de la experimentación fragmentada a procesos de producción repetibles y centrados en la seguridad.

  • Observabilidad y seguridad integrales de la IA con mayor visibilidad del estado, el rendimiento y el comportamiento del modelo. Esto proporciona telemetría en tiempo real para cargas de trabajo de IA, implementaciones de llm-d y uso de clústeres y modelos de modelos como servicio (MaaS), así como una vista previa de la tecnología de NeMo Guardrails integrado, que permite a los desarrolladores imponer la seguridad operativa y la alineación en las interacciones de IA.

  • Proporcionar acceso bajo demanda a los recursos de GPU, lo que permite a las organizaciones implementar capacidades internas de GPU como servicio a través de una orquestación inteligente y acceso a hardware en clúster, con puntos de control automáticos para preservar el estado de los trabajos de capacitación de larga duración, evitar la pérdida de trabajo y mantener costos de computación más predecibles, incluso en entornos empresariales o altamente dinámicos.

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *