Impulsionando o futuro da IA: os avanços da Cisco em redes seguras de IA com a NVIDIA


A IA exige uma reformulação elementary de como projetamos, construímos e protegemos os knowledge facilities. As organizações estão ultrapassando a fase de experimentação e implantando clusters massivos de IA que exigem largura de banda de rede, energia e controles de segurança sem precedentes. Construir esses ambientes em escala giga não envolve apenas adicionar mais GPUs. Requer uma arquitetura holística e profundamente integrada que garanta que todos os componentes – do silício aos sistemas, ao software program e ao modelo operacional – funcionem em perfeita harmonia.

A Cisco está fornecendo a infraestrutura básica necessária para tornar isso realidade. Ao combinar nossa experiência em rede com silício avançado, sistemas, óptica, software program, modelos operacionais e inovações de segurança, estamos fornecendo às empresas, neoclouds e provedores de nuvem soberana as ferramentas necessárias para implantar IA com segurança em escala. A Cisco se destaca como o único fornecedor capaz de fornecer uma solução verdadeiramente pronta para uso, perfeitamente adaptada para atender às demandas dos clientes em todas as escalas.

Impulsionando o futuro da IA: os avanços da Cisco em redes seguras de IA com a NVIDIAImpulsionando o futuro da IA: os avanços da Cisco em redes seguras de IA com a NVIDIA
Figura 1: Plano de gerenciamento unificado com Cisco Nexus One

Através da nossa parceria com a NVIDIA, estamos ampliando os limites do que as redes de IA podem alcançar, concentrando-nos em três pilares críticos: infraestrutura, rede e segurança.

Construído para fábricas de IA

A transição para a IA em escala giga requer {hardware} capaz de lidar com uma grande transferência de dados com latência mínima. Com base na expansão dos recentemente anunciados sistemas escalonáveis ​​N9300 Silicon One G300 e escalonáveis ​​51.2T P200, a Cisco está elevando o nível para atender a essas demandas intensas.

Temos o prazer de apresentar o novo swap Cisco N9100 Sequence, N9164F-NS6, equipado com silício NVIDIA Spectrum-6. Este swap 102.4T oferece um grande salto na capacidade do knowledge middle para dar suporte às fábricas seguras de IA da próxima geração. Também estamos disponibilizando os switches N9100 com silício NVIDIA Spectrum-4, oferecendo às empresas, neoclouds e provedores de nuvem soberana opções de implantação flexíveis e de alto desempenho.

Acreditamos no poder da diversidade do silício. Essa estratégia permite que você escolha a tecnologia exata que se adapta às suas necessidades operacionais e de desempenho específicas. Para manter a implementação simples, garantimos conformidade whole com a arquitetura de referência. Isso agiliza sua implantação e garante integração tranquila em ambientes complexos de knowledge middle.

A Cisco continua aumentando o limite de desempenho, tornando a infraestrutura avançada de IA mais rápida e fácil de implantar. Apresentamos os switches N9100, equipados com silício Ethernet NVIDIA Spectrum-6, para atender à imensa escala exigida pelas fábricas seguras de IA da próxima geração. Este swap 102.4T 100% refrigerado a líquido representa um grande avanço na capacidade do knowledge middle de IA.

Além disso, o swap N9100, equipado com silício NVIDIA Spectrum-4, também está disponível, expandindo ainda mais as opções de implantação para empresas, neoclouds e provedores de nuvem soberana.

102.4T Cisco N9100 Scale Out Fabric, alimentado por NVIDIA Spectrum-6 Ethernet. Apresenta N9164F-NS6, refrigeração 100% líquida e Cisco Secure AI Factory. 102.4T Cisco N9100 Scale Out Fabric, alimentado por NVIDIA Spectrum-6 Ethernet. Apresenta N9164F-NS6, refrigeração 100% líquida e Cisco Secure AI Factory.
Figura 1: Cisco N9164F-NS6

Para facilitar a implantação desses sistemas complexos, integramos o suporte ao Nexus One com o Cisco Nexus Hyperfabric gerenciado na nuvem. Isso cria uma solução de IA completa e pronta para uso. Os construtores de IA não precisam mais reunir componentes díspares e esperar que funcionem de forma eficiente. O Nexus Hyperfabric agora também gerencia o recém-disponível Cisco N9164E-NS4-O, equipado com silício NVIDIA Spectrum-4 Ethernet. Ele oferece conjuntos de malhas de knowledge middle plug-and-play, gerenciados inteiramente por meio da nuvem, reduzindo drasticamente o tempo necessário para passar da aquisição à operação completa. O Nexus One inclui um painel Nexus robusto e gerenciado no native que é uma solução comprovada de operações, knowledge middle de automação e rede de IA.

A flexibilidade continua sendo essential ao projetar esses ambientes. As organizações têm necessidades diferentes com base no seu tamanho, requisitos de segurança e infraestrutura existente. Para acomodar isso, oferecemos arquiteturas de referência robustas, adaptadas a tipos de implantação específicos:

  • Arquitetura de referência em nuvem da Cisco (CRA): Para empresas e neoclouds que implantam servidores de IA especializados com mais de 1.000 GPUs e até 32.000 GPUs, o Cisco CRA fornece um caminho altamente otimizado e escalável usando os switches Cisco Silicon One e Cisco N9300 Sequence líderes do setor. Para implantações com menos de 1.000 GPUs, temos a Cisco Enterprise Reference Structure (ERA) pronta para consumo.
  • Compatível com o design de referência do NVIDIA Cloud Associate: Para infraestruturas de IA em grande escala, variando de 1.000 a 32.000 GPUs, os switches Cisco N9100 Sequence estão em whole conformidade com a arquitetura de referência NVIDIA Cloud Associate (NCP). Isso garante o melhor desempenho para implantações soberanas e de neonuvem, utilizando malhas escaláveis ​​alimentadas por silício de swap Ethernet Spectrum-X.
Comparação da Cisco Enterprise Reference Structure (ERA) para servidores GPU AI <1K e Cloud Reference Architecture (CRA) para servidores GPU AI de 1K-32K. O gráfico detalha o uso do switch Cisco Silicon One, da série N9300/N9100 e os requisitos de silício Ethernet NVIDIA Spectrum-X para cada arquitetura.Comparação da Cisco Enterprise Reference Structure (ERA) para servidores GPU AI <1K e Cloud Reference Architecture (CRA) para servidores GPU AI de 1K-32K. O gráfico detalha o uso do switch Cisco Silicon One, da série N9300/N9100 e os requisitos de silício Ethernet NVIDIA Spectrum-X para cada arquitetura.
Figura 3: Arquiteturas de Referência Cisco

Ao oferecer uma escolha entre as arquiteturas NCP Reference Design e Cisco CRA, garantimos que cada cliente tenha um plano comprovado e validado para o sucesso, esteja ele construindo uma enorme nuvem soberana ou um cluster de IA empresarial altamente direcionado.

Protegendo a carga de trabalho de IA na borda

À medida que os clusters de IA crescem em poder e complexidade, tornam-se alvos altamente atraentes para agentes maliciosos. Os modelos tradicionais de segurança perimetral falham nesses ambientes. O tráfego leste-oeste desprotegido dentro da estrutura de IA permite que ameaças laterais se espalhem rapidamente. Uma carga de trabalho de IA comprometida pode levar ao sequestro de recursos da GPU ou à exfiltração massiva de dados, resultando em um raio de explosão lateral completo. No entanto, a execução de agentes de segurança tradicionais diretamente nos servidores de IA sobrecarrega a CPU e a GPU, esgotando os próprios recursos de computação que você está tentando maximizar.

Para resolver isso, estamos mudando fundamentalmente onde e como a segurança é aplicada. Estendemos o suporte do Cisco Hybrid Mesh Firewall diretamente para DPUs NVIDIA BlueField.

Diagrama de rede: Nexus One e Hybrid Mesh Firewall protegem cargas de trabalho de IA (VPC 1, VPC 2) em um servidor de IA. As políticas de segurança NVIDIA BlueField bloqueiam um ataque lateral.Diagrama de rede: Nexus One e Hybrid Mesh Firewall protegem cargas de trabalho de IA (VPC 1, VPC 2) em um servidor de IA. As políticas de segurança NVIDIA BlueField bloqueiam um ataque lateral.
Figura 4: Proteção de carga de trabalho de IA para servidores de malha front-end

Esta inovação aproxima a segurança da carga de trabalho o máximo possível, sem comprometer o desempenho. Ao incorporar o firewall na DPU, oferecemos segurança em linha integrada com escalabilidade de alto desempenho. Os administradores podem definir políticas de segurança uma vez e aplicá-las em qualquer lugar, isolando nuvens públicas virtuais (VPCs) e bloqueando ataques laterais em tempo actual. Isso fornece aplicação sem pontos de estrangulamento, protegendo servidores de malha front-end e deixando a CPU e GPU do host inteiramente dedicadas ao processamento de cargas de trabalho de IA.

Para saber mais sobre como estamos protegendo os ambientes de IA contra ameaças laterais sem sacrificar o desempenho, leia nosso detalhamento técnico detalhado: Cisco protege infraestrutura de IA com DPUs NVIDIA BlueField.

Avanço da rede de IA para desempenho máximo

Mesmo as GPUs mais poderosas ficarão ociosas se a rede não conseguir alimentá-las com dados com rapidez suficiente. Maximizar a utilização da GPU e otimizar o desempenho do cache de valor-chave (KV) requer conectividade inteligente e de alta velocidade em toda a estrutura. É aqui que o Cisco Nexus One muda fundamentalmente o jogo das redes de IA.

O Nexus One fornece um plano de gerenciamento unificado em ambientes NX-OS e SONiC com um Nexus Dashboard gerenciado no native e um Nexus Hyperfabric gerenciado na nuvem como modelos operacionais.

O Nexus Dashboard oferece visibilidade sem precedentes do ambiente de IA full-stack com switches Cisco N9000 Sequence. Os administradores obtêm acesso a recursos profundos de monitoramento de tarefas de IA com o Nexus Dashboard 4.2. Acompanhe exatamente como os dados se movem pela estrutura, identificando gargalos antes que eles afetem os tempos de treinamento. O sistema apresenta balanceamento de carga inteligente e autoajustável e controle de congestionamento baseado em telemetria. Em vez de depender de protocolos de roteamento estático que se decompõem nos padrões de tráfego exclusivos e de fluxo elefante das cargas de trabalho de IA, a rede se ajusta dinamicamente para garantir a entrega ultimate de dados.

Além disso, o Nexus Dashboard permite o rastreamento da integridade da GPU em tempo actual. Os operadores de rede podem ver diretamente as métricas de desempenho da camada de computação, garantindo que cada recurso caro da GPU opere com eficiência máxima. Esteja você construindo uma rede escalável em um único knowledge middle ou uma rede escalável conectando diversas instalações com hyperlinks de alto desempenho e baixa latência, o Nexus Dashboard garante que a rede atue como um acelerador poderoso, em vez de um gargalo.

Capacitando a próxima geração de inovação

A revolução da IA ​​requer mais do que apenas poder de processamento bruto. Exige um ecossistema totalmente integrado onde a infraestrutura, a rede e a segurança sejam projetadas para operar como uma unidade única e coesa.

Por meio de nossas inovações contínuas com os switches Cisco N9100 Sequence equipados com Spectrum-X, o gerenciamento inteligente do Nexus One e a segurança reforçada na borda do Cisco Hybrid Mesh Firewall em DPUs BlueField, a Cisco fornece a base que empresas, neoclouds e nuvens soberanas precisam para dimensionar suas ambições de IA. Estamos construindo as redes que impulsionarão a próxima década de descobertas, garantindo que sejam rápidas, confiáveis ​​e fundamentalmente seguras.

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *