Cisco Unified Edge lleva la inferencia de IA a sucursales, fábricas y otros sitios distribuidos
Cisco combina CPU, GPU, red, almacenamiento y seguridad en una plataforma modular para ejecutar inferencia de IA cerca de donde se generan los datos.
Cisco Unified Edge lleva capacidad de cómputo para inteligencia artificial directamente a sucursales, fábricas, comercios, centros sanitarios y otros emplazamientos alejados del centro de datos. La plataforma integra procesamiento, redes, almacenamiento y seguridad para ejecutar inferencia y cargas de IA agéntica cerca del lugar donde se generan los datos, reduciendo la necesidad de enviarlos continuamente a una nube o infraestructura central.
Una plataforma modular para ejecutar IA en el edge
Unified Edge se basa en el chasis Cisco UCS XE9305, un sistema de 3U y 18 pulgadas de profundidad con cinco ranuras frontales para nodos intercambiables de computación y red. La arquitectura incluye dos controladores de gestión con switches de 25 Gb integrados y está diseñada para instalaciones donde el espacio, la refrigeración y el mantenimiento son más limitados que en un centro de datos convencional.
Cisco plantea el sistema como una infraestructura completa y no simplemente como un servidor. El mismo chasis puede combinar diferentes nodos y aceleradores según las necesidades de cada ubicación, permitiendo desde cargas tradicionales hasta inferencia acelerada mediante GPU.
Intel Xeon 6 puede ejecutar inferencia sin una GPU dedicada
Los nodos de computación utilizan procesadores Intel Xeon 6 SoC con aceleración de IA integrada. Cisco destaca el uso de Intel Advanced Matrix Extensions para ejecutar determinadas tareas de inferencia directamente sobre la CPU, evitando la necesidad de instalar un acelerador dedicado cuando la carga no lo requiere.
El nodo UCS XE130c M8 ofrece configuraciones de 12, 20 o 32 núcleos, hasta 768 GB de memoria y una ranura para una GPU de hasta 75 W. También admite hasta cuatro SSD NVMe E3.S con una capacidad combinada máxima de 120 TB.
Para cargas más exigentes, el UCS XE150c M8 eleva la memoria hasta 1.024 GB y admite GPU de formato completo, incluidas las NVIDIA RTX PRO 4500 Blackwell Server Edition, RTX PRO 6000 Blackwell Server Edition y L40S.
La inferencia se ejecuta donde se generan los datos
El objetivo de esta arquitectura es reducir la distancia entre los modelos de IA y las fuentes de información que necesitan procesar. Una fábrica puede analizar imágenes de cámaras para detectar defectos, una tienda puede ejecutar sistemas de análisis o recomendación localmente y una sucursal financiera puede procesar determinados servicios sin enviar cada operación a un centro de datos remoto.
Esto puede reducir latencia y tráfico de red en aplicaciones que necesitan respuestas inmediatas. El entrenamiento de grandes modelos seguirá concentrándose principalmente en centros de datos, pero Cisco considera que una parte creciente de la inferencia se trasladará hacia entornos distribuidos.
Gestión centralizada para instalaciones con miles de ubicaciones
Uno de los principales problemas del edge es administrar grandes cantidades de sistemas repartidos geográficamente. Cisco utiliza Intersight como plataforma de gestión centralizada y añade aprovisionamiento sin intervención local, plantillas de configuración y automatización para desplegar infraestructuras similares en múltiples emplazamientos.
La compañía también integra observabilidad de extremo a extremo y herramientas para detectar errores y cambios de configuración. El planteamiento busca que los equipos de TI puedan administrar una flota de sistemas edge sin necesitar personal especializado físicamente en cada sucursal o instalación.
Red, almacenamiento y seguridad forman parte del mismo sistema
El chasis incorpora conectividad interna de 25 Gb para las comunicaciones entre nodos. Cisco también ofrece el 8255 G2 Secure Router Node, que puede integrarse en el sistema y proporciona puertos Ethernet, conectividad multigigabit, PoE y enlaces SFP de 10 Gb.
La seguridad incluye mecanismos físicos contra manipulaciones, firmware firmado, un módulo de confianza de hardware, políticas centralizadas y controles basados en zero trust. Cisco pretende así proteger no solo el hardware y los datos, sino también las aplicaciones y modelos de IA desplegados en ubicaciones remotas.
Compatible con Red Hat, Nutanix, VMware y SUSE
Cisco no limita Unified Edge a una única plataforma de software. La documentación contempla integraciones con tecnologías de Red Hat, Nutanix, VMware y SUSE, además de diferentes configuraciones con sistemas operativos y entornos en clúster o independientes.
La colaboración con Red Hat permite, por ejemplo, desplegar Red Hat AI Inference Server sobre Unified Edge utilizando OpenShift para instalaciones medianas y grandes o configuraciones más ligeras basadas en Red Hat Enterprise Linux para ubicaciones pequeñas.
De la IA centralizada a la inferencia distribuida
Cisco presentó originalmente Unified Edge en noviembre de 2025 y durante 2026 ha ampliado su propuesta de IA distribuida y sus integraciones. La plataforma refleja un cambio de arquitectura en el que determinados modelos y agentes se ejecutan más cerca de usuarios, sensores, cámaras y sistemas industriales en lugar de depender exclusivamente de grandes centros de datos.
La utilidad de ejecutar localmente dependerá del modelo, los requisitos de aceleración, el volumen de datos y las necesidades de cada aplicación. Unified Edge permite adaptar la configuración desde inferencia basada únicamente en CPU hasta nodos con GPU dedicadas, manteniendo una misma infraestructura de gestión, red y seguridad.