F5 (NASDAQ: FFIV), el líder mundial en la entrega y la obtención de todas las aplicaciones y API, anunció hoy nuevas capacidades paraF5 Big-IP Siguiente para Kubernetesacelerado conNvidia Bluefield-3 DPUSy elMarco de software NVIDIA DOCAsubrayado por la implementación de validación del cliente Sesterce.Sestercioes un operador europeo líder especializado en infraestructuras de próxima generación e IA soberana, diseñada para satisfacer las necesidades de informática acelerada e inteligencia artificial.
Extendiendo elPlataforma de entrega y seguridad de aplicaciones F5Big-IP a continuación para Kubernetes que se ejecuta de forma nativa en NVIDIA Bluefield-3 DPUS ofrece gestión y seguridad del tráfico de alto rendimiento para la infraestructura de IA a gran escala, desbloqueando una mayor eficiencia, control y rendimiento para aplicaciones de IA. En conjunto con las convincentes ventajas de rendimiento anunciadas junto condisponibilidad generalA principios de este año, Sesterce ha completado con éxito la validación de la solución F5 y NVIDIA en una serie de capacidades clave, incluidas las siguientes áreas:
- Rendimiento mejorado, múltiples tenientes y seguridadPara cumplir con las expectativas de grado en la nube, inicialmente mostrando una mejora del 20% en la utilización de GPU.
- Integración conNvidia dinamoy KV Cache ManagerPara reducir la latencia para el razonamiento de los sistemas de inferencia del modelo de lenguaje grande (LLM) y la optimización de las GPU y los recursos de memoria.
- Enrutamiento Smart LLMen Bluefield DPUS, corriendo efectivamente conNvidia nimMicroservicios para cargas de trabajo que requieren múltiples modelos, que proporcionan a los clientes lo mejor de todos los modelos disponibles.
- Escala y asegurando el protocolo de contexto del modelo (MCP)incluyendo capacidades de proxy inversa y protecciones para LLM más escalables y seguros, lo que permite a los clientes utilizar rápidamente y de manera segura el poder de los servidores MCP.
- Programabilidad de datos potentecon robustoF5 irulesCapacidades, lo que permite la personalización rápida para admitir aplicaciones de IA y los requisitos de seguridad en evolución.
“La integración entre F5 y Nvidia fue atractiva incluso antes de realizar cualquier prueba”, dijo Youssef El Mansouri, CEO y cofundador de Sesterce. “Our results underline the benefits of F5’s dynamic load balancing with high-volume Kubernetes ingress and egress in AI environments. This approach empowers us to more efficiently distribute traffic and optimize the use of our GPUs while allowing us to bring additional and unique value to our customers. We are pleased to see F5’s support for a growing number of NVIDIA use cases, including enhanced multi-tenancy, and we look forward to additional innovation between Las empresas que apoyan la infraestructura de IA de próxima generación “.
Los aspectos más destacados de las nuevas capacidades de solución incluyen:
Enrutamiento LLM y equilibrio de carga dinámica con Big-IP Siguiente para Kubernetes
Con esta solución colaborativa, las tareas simples relacionadas con la IA se pueden enrutar a LLM menos costosas y livianas para soportar la IA generativa mientras reservan modelos avanzados para consultas complejas. Este nivel de inteligencia personalizable también permite que las funciones de enrutamiento aprovechen las LLM específicas del dominio, mejoren la calidad del resultado y mejoren significativamente las experiencias de los clientes. La gestión de tráfico avanzada de F5 asegura que las consultas se envíen a la LLM más adecuada, bajando la latencia y mejorando el tiempo hasta el primer token.
“Las empresas están implementando cada vez más múltiples LLM para impulsar las experiencias avanzadas de IA, pero enrutar y clasificar el tráfico de LLM puede ser de rendimiento y experiencia del usuario degradante y degradante”, dijo Kunal Anand, director de innovación de F5. “Al programar la lógica de enrutamiento directamente en NVIDIA Bluefield-3 DPU, F5 Big-IP Siguiente para Kubernetes es el enfoque más eficiente para entregar y asegurar el tráfico de LLM. Esto es solo el comienzo. Nuestra plataforma desbloquea nuevas posibilidades para la infraestructura de IA, y estamos entusiasmados a profundizar la co-innovación con NVIDIA AS ANTRISE AS AI ENTERPRISE continúa a la escala”. “.”. “
Optimización de las GPU para la inferencia de IA distribuida a escala con NVIDIA Dynamo y KV Cache Integration
A principios de este año,Nvidia Dynamo fue introducidoproporcionando un marco complementario para implementar modelos generativos de IA y razonamiento en entornos distribuidos a gran escala. Nvidia Dynamo optimiza la complejidad de ejecutar la inferencia de IA en entornos distribuidos mediante la orquestación de tareas como la programación, el enrutamiento y la gestión de la memoria para garantizar una operación perfecta en cargas de trabajo dinámicas. La descarga de operaciones específicas de CPU a Bluefield DPUS es uno de los beneficios centrales de la solución combinada de F5 y NVIDIA. Con F5, la función Dynamo KV Cache Manager puede enrutar las solicitudes de manera inteligente en función de la capacidad, utilizando el almacenamiento en caché del valor clave (KV) para acelerar los casos generativos de uso de IA generativos al acelerar los procesos basados en la información de retención de operaciones anteriores (en lugar de requerir una recomputación intensiva intensiva en recursos). Desde una perspectiva de infraestructura, las organizaciones que almacenan y reutilizan los datos de caché de KV pueden hacerlo a una fracción del costo de usar la memoria GPU para este propósito.
“BIG-IP Next for Kubernetes accelerated with NVIDIA BlueField-3 DPUs gives enterprises and service providers a single point of control for efficiently routing traffic to AI factories to optimize GPU efficiency and to accelerate AI traffic for data ingestion, model training, inference, RAG, and agentic AI,” said Ash Bhalgat, Senior Director of AI Networking and Security Solutions, Ecosystem and Marketing en Nvidia. “Además, el soporte de F5 para la tenencia múltiple y la programabilidad mejorada con Irules continúan proporcionando una plataforma que es adecuada para la integración continua y las adiciones de características, como el soporte para el administrador de caché KV distribuido Nvidia Dynamo”.
Protección mejorada para servidores MCP con F5 y NVIDIA
El Protocolo de contexto del modelo (MCP) es un protocolo abierto desarrollado por Anthrope que estandariza cómo las aplicaciones proporcionan contexto a LLM. La implementación de la solución combinada de F5 y Nvidia frente a los servidores MCP permite que la tecnología F5 sirva como un proxy inverso, reforzando las capacidades de seguridad para las soluciones MCP y los LLM que admiten. Además, la programabilidad de datos completa habilitada por F5 Irules promueve una rápida adaptación y resiliencia para los requisitos de protocolo de IA de rápida evolución, así como una protección adicional contra los riesgos emergentes de seguridad cibernética.
“Las organizaciones que implementan la IA agente dependen cada vez más de las implementaciones de MCP para mejorar la seguridad y el rendimiento de las LLM”, dijo Greg Schoeny, SVP, proveedor de servicios globales de World Wide Technology. “Al llevar la gestión y la seguridad avanzadas del tráfico a los extensos entornos de Kubernetes, F5 y Nvidia están entregando conjuntos integrados de características de IA, junto con capacidades de programabilidad y automatización, que no estamos viendo en otra parte de la industria en este momento”.
F5 Big-IP Siguiente para Kubernetes desplegados en NVIDIA Bluefield-3 DPUS generalmente está disponible ahora. Para obtener detalles de tecnología adicionales y beneficios de implementación, vaya awww.f5.comy visite las empresas de Nvidia GTC Paris, parte de esta semanaVivatech 2025evento. También se pueden encontrar más detalles en unBlog acompañante de F5.