Lar
De MIPS a exaflops em poucas décadas: O poder de computação está explodindo e transformará a IA
Na recente conferência Nvidia GTC, a gigante da tecnologia revelou uma conquista revolucionária: o primeiro sistema de servidores em rack único capaz de atingir um exaflop. Isso é um impressionante um bilhão de bilhões de operações de ponto flutuante (FLOPS) por segundo. Esse feito é impulsionado pelo mais recente sistema GB200 NVL72 da Nvidia, equipado com as unidades de processamento gráfico (GPUs) Blackwell de ponta. Para colocar em perspectiva, esse sistema cabe em um rack de computador padrão que tem cerca de 1,8 metros de altura, pouco mais de 1 metro de profundidade e menos de 60 centímetros de largura.
Reduzindo um Exaflop: De Frontier a Blackwell
O anúncio me fez refletir sobre o quanto avançamos em apenas alguns anos. O primeiro computador capaz de atingir um exaflop no mundo, "Frontier", foi instalado no Oak Ridge National Laboratory em 2022. Construído pela HPE e equipado com GPUs e CPUs AMD, ele ocupava impressionantes 74 racks. Em contraste, o novo sistema da Nvidia concentra 73 vezes mais desempenho em um único rack. Isso é como triplicar o desempenho a cada ano por três anos consecutivos! É um testemunho dos incríveis avanços em densidade computacional, eficiência energética e design arquitetônico.
Também vale notar que, embora ambos os sistemas alcancem o marco do exascale, eles são projetados para propósitos diferentes. A classificação de exaflop da Nvidia é baseada em matemática de baixa precisão—operações de ponto flutuante de 4 bits e 8 bits—ideal para cargas de trabalho de AI, como treinamento e execução de grandes modelos de linguagem (LLMs). Esses cálculos priorizam velocidade em vez de precisão. Por outro lado, a classificação de exaflop do Frontier vem de matemática de dupla precisão de 64 bits, o padrão ouro para simulações científicas onde a precisão é fundamental.
Avançamos Muito (Muito Rápido)
O ritmo desse progresso é quase difícil de acreditar, especialmente quando penso nos primeiros dias da minha carreira em computação. Meu primeiro emprego foi como programador no DEC KL 1090, parte da série PDP-10 de mainframes de compartilhamento de tempo da DEC. Aquela máquina operava a modestos 1,8 milhão de instruções por segundo (MIPS). Ela se conectava a displays de tubo de raios catódicos (CRT) por meio de cabos fixos, sem gráficos propriamente ditos—apenas texto na tela. E, claro, não havia Internet. Usuários remotos tinham que se conectar por linhas telefônicas com modems que atingiam no máximo 1.200 bits por segundo.

500 Bilhões de Vezes Mais Poder Computacional
Embora comparar MIPS com FLOPS não seja uma comparação direta, isso nos dá uma ideia do salto incrível no poder computacional. MIPS mede a velocidade de processamento de inteiros, ótimo para computação de propósito geral e aplicações empresariais. FLOPS, por outro lado, mede o desempenho em ponto flutuante, crucial para cargas de trabalho científicas e o trabalho pesado por trás da AI moderna, como a matemática matricial e álgebra linear necessárias para treinar e executar modelos de aprendizado de máquina (ML).
Usando isso como um guia aproximado, o novo sistema da Nvidia é cerca de 500 bilhões de vezes mais poderoso que a antiga máquina DEC. É um exemplo impressionante do crescimento exponencial no poder computacional ao longo de uma única carreira. Isso faz você se perguntar: se alcançamos tanto em 40 anos, o que os próximos cinco anos podem trazer?
A Nvidia nos deu algumas pistas. No GTC, eles compartilharam um roteiro prevendo que seu sistema de rack completo de próxima geração, baseado na arquitetura Ultra "Vera Rubin", entregará 14 vezes o desempenho do atual rack Blackwell Ultra. Estamos falando de algo entre 14 e 15 exaflops em trabalho otimizado para AI nos próximos um ou dois anos.
Não se trata apenas de potência bruta. Comprimir esse desempenho em um único rack significa menos espaço físico, menos materiais e, potencialmente, menor uso de energia por operação. Embora não possamos esquecer, as demandas absolutas de energia desses sistemas ainda são enormes.
A AI Realmente Precisa de Todo Esse Poder Computacional?
Embora esses ganhos de desempenho sejam impressionantes, a indústria de AI agora enfrenta uma grande questão: de quanto poder computacional realmente precisamos, e a que custo? A corrida para construir novos data centers massivos de AI é impulsionada pelas demandas da computação em escala exa e modelos de AI cada vez mais capazes.
O projeto mais ambicioso é o Projeto Stargate de US$ 500 bilhões, planejando 20 data centers nos EUA, cada um com meio milhão de pés quadrados. Há uma onda de outros projetos hiperescala em andamento ou planejados ao redor do mundo, enquanto empresas e países correm para construir a infraestrutura para futuras cargas de trabalho de AI.
Alguns analistas estão preocupados com a possibilidade de estarmos construindo demais. As preocupações cresceram após o lançamento do R1, um modelo de raciocínio da DeepSeek da China que usa significativamente menos computação que seus pares. O recente cancelamento de arrendamentos pela Microsoft com vários provedores de data centers alimentou especulações de que eles podem estar repensando suas necessidades de infraestrutura de AI.
No entanto, The Register sugeriu que essa retirada pode estar mais relacionada aos data centers planejados não conseguirem atender às necessidades de energia e resfriamento dos sistemas de AI de próxima geração. Modelos de AI já estão pressionando os limites da infraestrutura atual. A MIT Technology Review relatou que muitos data centers na China estão enfrentando dificuldades e falhando porque foram construídos com especificações desatualizadas.
A Inferência de AI Demanda Mais FLOPs
Modelos de raciocínio fazem a maior parte de seu trabalho pesado em tempo de execução por meio de um processo chamado inferência. Esses modelos alimentam algumas das aplicações mais avançadas e intensivas em recursos, como assistentes de pesquisa profunda e a onda emergente de sistemas de AI agentic.
Embora o DeepSeek-R1 inicialmente tenha levado a indústria a pensar que a AI futura poderia precisar de menos poder computacional, o CEO da Nvidia, Jensen Huang, rebateu fortemente. Em uma entrevista à CNBC, ele argumentou o contrário: "Foi exatamente a conclusão oposta que todos tinham." Ele acrescentou que a AI de raciocínio consome 100 vezes mais computação que a AI não raciocinante.
À medida que a AI evolui de modelos de raciocínio para agentes autônomos e além, a demanda por poder computacional provavelmente aumentará novamente. Os próximos avanços podem vir em áreas como coordenação de agentes de AI, simulações de fusão ou gêmeos digitais em grande escala—tudo isso possibilitado pelo tipo de salto computacional que acabamos de ver.
Como se fosse uma deixa, a OpenAI anunciou US$ 40 bilhões em novo financiamento, a maior rodada de financiamento de tecnologia privada registrada. Em um post de blog, eles disseram que o financiamento "nos permite avançar ainda mais as fronteiras da pesquisa em AI, escalar nossa infraestrutura computacional e entregar ferramentas cada vez mais poderosas para as 500 milhões de pessoas que usam o ChatGPT toda semana."
Por que tanto capital está fluindo para a AI? As razões variam de competitividade a segurança nacional, mas um fator se destaca: a AI poderia aumentar os lucros corporativos em US$ 4,4 trilhões por ano, segundo a McKinsey.
O Que Vem a Seguir? É Impossível Prever
No fundo, os sistemas de informação são sobre simplificar a complexidade, seja um sistema de roteamento de veículos de emergência que escrevi em Fortran, uma ferramenta de relatórios de desempenho estudantil construída em COBOL, ou sistemas de AI modernos acelerando a descoberta de medicamentos. O objetivo sempre foi o mesmo: dar sentido ao mundo.
Agora, com uma AI poderosa no horizonte, estamos cruzando um limiar. Pela primeira vez, podemos ter o poder computacional e a inteligência para enfrentar problemas que antes estavam fora do alcance humano.
O colunista do New York Times, Kevin Roose, capturou bem este momento: "Toda semana, encontro engenheiros e empreendedores trabalhando em AI que me dizem que a mudança—uma grande mudança, uma mudança que abala o mundo, o tipo de transformação que nunca vimos antes—está logo ali." E isso sem contar os avanços que chegam a cada semana.
Nos últimos dias, vimos o GPT-4o da OpenAI gerar imagens quase perfeitas a partir de texto, o Google lançar o que pode ser o modelo de raciocínio mais avançado até agora com o Gemini 2.5 Pro, e a Runway revelar um modelo de vídeo com consistência de personagem e cena de plano a plano, algo que a VentureBeat observa que escapou à maioria dos geradores de vídeo de AI até agora.
O que vem a seguir é realmente impossível de prever. Não sabemos se a AI poderosa será um avanço ou uma falha, se ajudará a resolver a energia de fusão ou liberará novos riscos biológicos. Mas com cada vez mais FLOPS entrando em operação nos próximos cinco anos, uma coisa parece certa: a inovação virá rápido—e com força. À medida que os FLOPS escalam, também devem escalar nossas conversas sobre responsabilidade, regulamentação e contenção.
Gary Grossman é EVP da prática de tecnologia na Edelman e líder global do Edelman AI Center of Excellence.
Artigo relacionado
A OneRail utiliza a IA da Nvidia para otimizar entregas em tempo real na “última milha”
A OneRail lançou uma plataforma de entregas baseada em inteligência artificial que utiliza a tecnologia da Nvidia para auxiliar varejistas, atacadistas e distribuidores a determinar os métodos de entr
O novo diretor de hardware da Apple, John Ternus, direciona a visão para os produtos futuros
Carregando o player…A era Ternus na Apple começou oficialmente.Tim Cook renunciou ao cargo de CEO nesta semana, passando a liderança ao ex-chefe de hardware, John Ternus. O primeiro memorando de Ternus prometeu um “grande lançamento na próxima sema
A Groq capta US$ 350 milhões para financiar sua transição de chips de IA para neocloud
A empresa de infraestrutura de IA Groq garantiu US$ 350 milhões em novo financiamento, marcando sua contínua transição de desenvolvedora especializada de chips para provedora de neocloud, oferecendo serviços robustos de infraestrutura de GPU e IA.Co
Recomendações de tópicos especiais relacionados
Comentários (7)
One exaflop in a single rack? That's insane 🤯. But honestly, I'm more worried about the power consumption—those GB200 chips must drink electricity like it's happy hour. Still, if this means better AI reasoning without hallucinations, sign me up. Just hope we don't end up with Skynet running on Nvidia hardware.
Uau, um exaflop em um único rack?! 🤯 Lembro que há alguns anos discutíamos petaflops como algo futurista. Agora a NVIDIA já alcançou esse marco. É incrível ver como a computação avança exponencialmente, mas também me pergunto: quem, além de grandes corporações e governos, terá acesso real a esse poder? A democratização da IA ainda parece distante quando o hardware requer investimentos astronômicos. Será que vamos ver aplicações práticas disso no dia a dia ou ficará restrito a pesquisa de ponta?
와, 단일 랙에서 익사플롭 성능이라니... 엔비디아는 정말 멈출 줄 모르네요. 🤯 AI 학습에 이 속도라면 곧 개인 맞춤형 AI 보조자가 현실화되겠어요. 근데 이런 연산력이 기후변화에 미치는 영향도 함께 생각해 봐야 할 것 같아요. GPU 클러스터 전력 소비량이 벌써 걱정되네요.
Mind-blowing speed! Nvidia's exaflop system is a game-changer for AI. Can't wait to see what crazy innovations come next! 🚀
Mind-blowing speed! Nvidia’s exaflop system is a game-changer for AI. Can’t wait to see what crazy applications come out of this! 🚀
Na recente conferência Nvidia GTC, a gigante da tecnologia revelou uma conquista revolucionária: o primeiro sistema de servidores em rack único capaz de atingir um exaflop. Isso é um impressionante um bilhão de bilhões de operações de ponto flutuante (FLOPS) por segundo. Esse feito é impulsionado pelo mais recente sistema GB200 NVL72 da Nvidia, equipado com as unidades de processamento gráfico (GPUs) Blackwell de ponta. Para colocar em perspectiva, esse sistema cabe em um rack de computador padrão que tem cerca de 1,8 metros de altura, pouco mais de 1 metro de profundidade e menos de 60 centímetros de largura.
Reduzindo um Exaflop: De Frontier a Blackwell
O anúncio me fez refletir sobre o quanto avançamos em apenas alguns anos. O primeiro computador capaz de atingir um exaflop no mundo, "Frontier", foi instalado no Oak Ridge National Laboratory em 2022. Construído pela HPE e equipado com GPUs e CPUs AMD, ele ocupava impressionantes 74 racks. Em contraste, o novo sistema da Nvidia concentra 73 vezes mais desempenho em um único rack. Isso é como triplicar o desempenho a cada ano por três anos consecutivos! É um testemunho dos incríveis avanços em densidade computacional, eficiência energética e design arquitetônico.
Também vale notar que, embora ambos os sistemas alcancem o marco do exascale, eles são projetados para propósitos diferentes. A classificação de exaflop da Nvidia é baseada em matemática de baixa precisão—operações de ponto flutuante de 4 bits e 8 bits—ideal para cargas de trabalho de AI, como treinamento e execução de grandes modelos de linguagem (LLMs). Esses cálculos priorizam velocidade em vez de precisão. Por outro lado, a classificação de exaflop do Frontier vem de matemática de dupla precisão de 64 bits, o padrão ouro para simulações científicas onde a precisão é fundamental.
Avançamos Muito (Muito Rápido)
O ritmo desse progresso é quase difícil de acreditar, especialmente quando penso nos primeiros dias da minha carreira em computação. Meu primeiro emprego foi como programador no DEC KL 1090, parte da série PDP-10 de mainframes de compartilhamento de tempo da DEC. Aquela máquina operava a modestos 1,8 milhão de instruções por segundo (MIPS). Ela se conectava a displays de tubo de raios catódicos (CRT) por meio de cabos fixos, sem gráficos propriamente ditos—apenas texto na tela. E, claro, não havia Internet. Usuários remotos tinham que se conectar por linhas telefônicas com modems que atingiam no máximo 1.200 bits por segundo.

500 Bilhões de Vezes Mais Poder Computacional
Embora comparar MIPS com FLOPS não seja uma comparação direta, isso nos dá uma ideia do salto incrível no poder computacional. MIPS mede a velocidade de processamento de inteiros, ótimo para computação de propósito geral e aplicações empresariais. FLOPS, por outro lado, mede o desempenho em ponto flutuante, crucial para cargas de trabalho científicas e o trabalho pesado por trás da AI moderna, como a matemática matricial e álgebra linear necessárias para treinar e executar modelos de aprendizado de máquina (ML).
Usando isso como um guia aproximado, o novo sistema da Nvidia é cerca de 500 bilhões de vezes mais poderoso que a antiga máquina DEC. É um exemplo impressionante do crescimento exponencial no poder computacional ao longo de uma única carreira. Isso faz você se perguntar: se alcançamos tanto em 40 anos, o que os próximos cinco anos podem trazer?
A Nvidia nos deu algumas pistas. No GTC, eles compartilharam um roteiro prevendo que seu sistema de rack completo de próxima geração, baseado na arquitetura Ultra "Vera Rubin", entregará 14 vezes o desempenho do atual rack Blackwell Ultra. Estamos falando de algo entre 14 e 15 exaflops em trabalho otimizado para AI nos próximos um ou dois anos.
Não se trata apenas de potência bruta. Comprimir esse desempenho em um único rack significa menos espaço físico, menos materiais e, potencialmente, menor uso de energia por operação. Embora não possamos esquecer, as demandas absolutas de energia desses sistemas ainda são enormes.
A AI Realmente Precisa de Todo Esse Poder Computacional?
Embora esses ganhos de desempenho sejam impressionantes, a indústria de AI agora enfrenta uma grande questão: de quanto poder computacional realmente precisamos, e a que custo? A corrida para construir novos data centers massivos de AI é impulsionada pelas demandas da computação em escala exa e modelos de AI cada vez mais capazes.
O projeto mais ambicioso é o Projeto Stargate de US$ 500 bilhões, planejando 20 data centers nos EUA, cada um com meio milhão de pés quadrados. Há uma onda de outros projetos hiperescala em andamento ou planejados ao redor do mundo, enquanto empresas e países correm para construir a infraestrutura para futuras cargas de trabalho de AI.
Alguns analistas estão preocupados com a possibilidade de estarmos construindo demais. As preocupações cresceram após o lançamento do R1, um modelo de raciocínio da DeepSeek da China que usa significativamente menos computação que seus pares. O recente cancelamento de arrendamentos pela Microsoft com vários provedores de data centers alimentou especulações de que eles podem estar repensando suas necessidades de infraestrutura de AI.
No entanto, The Register sugeriu que essa retirada pode estar mais relacionada aos data centers planejados não conseguirem atender às necessidades de energia e resfriamento dos sistemas de AI de próxima geração. Modelos de AI já estão pressionando os limites da infraestrutura atual. A MIT Technology Review relatou que muitos data centers na China estão enfrentando dificuldades e falhando porque foram construídos com especificações desatualizadas.
A Inferência de AI Demanda Mais FLOPs
Modelos de raciocínio fazem a maior parte de seu trabalho pesado em tempo de execução por meio de um processo chamado inferência. Esses modelos alimentam algumas das aplicações mais avançadas e intensivas em recursos, como assistentes de pesquisa profunda e a onda emergente de sistemas de AI agentic.
Embora o DeepSeek-R1 inicialmente tenha levado a indústria a pensar que a AI futura poderia precisar de menos poder computacional, o CEO da Nvidia, Jensen Huang, rebateu fortemente. Em uma entrevista à CNBC, ele argumentou o contrário: "Foi exatamente a conclusão oposta que todos tinham." Ele acrescentou que a AI de raciocínio consome 100 vezes mais computação que a AI não raciocinante.
À medida que a AI evolui de modelos de raciocínio para agentes autônomos e além, a demanda por poder computacional provavelmente aumentará novamente. Os próximos avanços podem vir em áreas como coordenação de agentes de AI, simulações de fusão ou gêmeos digitais em grande escala—tudo isso possibilitado pelo tipo de salto computacional que acabamos de ver.
Como se fosse uma deixa, a OpenAI anunciou US$ 40 bilhões em novo financiamento, a maior rodada de financiamento de tecnologia privada registrada. Em um post de blog, eles disseram que o financiamento "nos permite avançar ainda mais as fronteiras da pesquisa em AI, escalar nossa infraestrutura computacional e entregar ferramentas cada vez mais poderosas para as 500 milhões de pessoas que usam o ChatGPT toda semana."
Por que tanto capital está fluindo para a AI? As razões variam de competitividade a segurança nacional, mas um fator se destaca: a AI poderia aumentar os lucros corporativos em US$ 4,4 trilhões por ano, segundo a McKinsey.
O Que Vem a Seguir? É Impossível Prever
No fundo, os sistemas de informação são sobre simplificar a complexidade, seja um sistema de roteamento de veículos de emergência que escrevi em Fortran, uma ferramenta de relatórios de desempenho estudantil construída em COBOL, ou sistemas de AI modernos acelerando a descoberta de medicamentos. O objetivo sempre foi o mesmo: dar sentido ao mundo.
Agora, com uma AI poderosa no horizonte, estamos cruzando um limiar. Pela primeira vez, podemos ter o poder computacional e a inteligência para enfrentar problemas que antes estavam fora do alcance humano.
O colunista do New York Times, Kevin Roose, capturou bem este momento: "Toda semana, encontro engenheiros e empreendedores trabalhando em AI que me dizem que a mudança—uma grande mudança, uma mudança que abala o mundo, o tipo de transformação que nunca vimos antes—está logo ali." E isso sem contar os avanços que chegam a cada semana.
Nos últimos dias, vimos o GPT-4o da OpenAI gerar imagens quase perfeitas a partir de texto, o Google lançar o que pode ser o modelo de raciocínio mais avançado até agora com o Gemini 2.5 Pro, e a Runway revelar um modelo de vídeo com consistência de personagem e cena de plano a plano, algo que a VentureBeat observa que escapou à maioria dos geradores de vídeo de AI até agora.
O que vem a seguir é realmente impossível de prever. Não sabemos se a AI poderosa será um avanço ou uma falha, se ajudará a resolver a energia de fusão ou liberará novos riscos biológicos. Mas com cada vez mais FLOPS entrando em operação nos próximos cinco anos, uma coisa parece certa: a inovação virá rápido—e com força. À medida que os FLOPS escalam, também devem escalar nossas conversas sobre responsabilidade, regulamentação e contenção.
Gary Grossman é EVP da prática de tecnologia na Edelman e líder global do Edelman AI Center of Excellence.
A OneRail utiliza a IA da Nvidia para otimizar entregas em tempo real na “última milha”
A OneRail lançou uma plataforma de entregas baseada em inteligência artificial que utiliza a tecnologia da Nvidia para auxiliar varejistas, atacadistas e distribuidores a determinar os métodos de entr
O novo diretor de hardware da Apple, John Ternus, direciona a visão para os produtos futuros
Carregando o player…A era Ternus na Apple começou oficialmente.Tim Cook renunciou ao cargo de CEO nesta semana, passando a liderança ao ex-chefe de hardware, John Ternus. O primeiro memorando de Ternus prometeu um “grande lançamento na próxima sema
A Groq capta US$ 350 milhões para financiar sua transição de chips de IA para neocloud
A empresa de infraestrutura de IA Groq garantiu US$ 350 milhões em novo financiamento, marcando sua contínua transição de desenvolvedora especializada de chips para provedora de neocloud, oferecendo serviços robustos de infraestrutura de GPU e IA.Co
One exaflop in a single rack? That's insane 🤯. But honestly, I'm more worried about the power consumption—those GB200 chips must drink electricity like it's happy hour. Still, if this means better AI reasoning without hallucinations, sign me up. Just hope we don't end up with Skynet running on Nvidia hardware.
Uau, um exaflop em um único rack?! 🤯 Lembro que há alguns anos discutíamos petaflops como algo futurista. Agora a NVIDIA já alcançou esse marco. É incrível ver como a computação avança exponencialmente, mas também me pergunto: quem, além de grandes corporações e governos, terá acesso real a esse poder? A democratização da IA ainda parece distante quando o hardware requer investimentos astronômicos. Será que vamos ver aplicações práticas disso no dia a dia ou ficará restrito a pesquisa de ponta?
와, 단일 랙에서 익사플롭 성능이라니... 엔비디아는 정말 멈출 줄 모르네요. 🤯 AI 학습에 이 속도라면 곧 개인 맞춤형 AI 보조자가 현실화되겠어요. 근데 이런 연산력이 기후변화에 미치는 영향도 함께 생각해 봐야 할 것 같아요. GPU 클러스터 전력 소비량이 벌써 걱정되네요.
Mind-blowing speed! Nvidia's exaflop system is a game-changer for AI. Can't wait to see what crazy innovations come next! 🚀
Mind-blowing speed! Nvidia’s exaflop system is a game-changer for AI. Can’t wait to see what crazy applications come out of this! 🚀











