Lar
A arquitetura PHOTON da Fujitsu aumenta o desempenho da IA em 475 vezes e resolve gargalos de computação
À medida que os modelos de grande porte continuam a evoluir rapidamente, os custos de computação e a eficiência de processamento permanecem como principais preocupações do setor. A Fujitsu apresentou recentemente uma arquitetura inovadora chamada PHOTON (Top-down Network Parallel Hierarchical Computing), projetada para superar as limitações de desempenho dos modelos Transformer tradicionais em cenários complexos.
A arquitetura Transformer, hoje dominante na IA, lida bem com textos longos ou tarefas de múltiplas consultas com alta simultaneidade, mas frequentemente fica lenta devido aos acessos frequentes à memória para recuperar informações históricas, aumentando a carga de trabalho da GPU. A equipe de pesquisa da Fujitsu abordou esse ponto crítico repensando o projeto da arquitetura PHOTON.

O principal ponto forte do PHOTON reside em sua abordagem de processamento hierárquico. Em vez da segmentação no nível de tokens usada pelos Transformers tradicionais, o PHOTON introduz camadas semânticas, o que reduz a complexidade computacional ao mesmo tempo em que potencializa a computação paralela. Além disso, para tarefas com múltiplas consultas, a arquitetura agiliza a tomada de decisão: ela precisa de apenas uma única inferência para chegar a uma conclusão, utilizando estratégias de “votação por maioria” ou “melhor escolha”.
Os resultados dos testes mostram que, em modelos menores com 600 milhões, 900 milhões e 1,2 bilhão de parâmetros, o PHOTON oferece um rendimento muito alto e um uso de memória extremamente baixo. No modelo de 1,2 bilhão de parâmetros, seu desempenho em consultas múltiplas atinge 475 vezes o das arquiteturas Transformer convencionais, melhorando significativamente a eficiência do agendamento de recursos.
Como essa arquitetura requer menos cache KV por iteração, o sistema pode lidar com mais iterações. Trata-se de um grande aumento de desempenho para sistemas de agentes inteligentes que gerenciam muitos processos de E/S. Embora algumas métricas de qualidade apresentem uma ligeira perda, o salto do PHOTON em eficiência computacional o torna uma solução técnica promissora para reduzir os custos operacionais da IA.
A Fujitsu está agora promovendo ativamente a aplicação da arquitetura, com o objetivo de fornecer um suporte subjacente mais leve e eficiente para futuros cenários inteligentes por meio de inovações nos algoritmos centrais.
Artigo relacionado
A Inteligência Artificial da Cognition nas negociações de financiamento, com a avaliação subindo para US$ 40 bilhões
A Cognition, criadora do aclamado assistente de codificação por IA Devin, tem capturado um interesse substancial de investidores. Fontes do setor indicam que a empresa está atualmente negociando uma nova rodada de financiamento, com projeções sugerin
A OpenAI revela o modelo base grande sob o novo projeto de pré-treinamento Doug
As a tecnologia de inteligência artificial continua a evoluir, o foco da indústria na arquitetura subjacente dos grandes modelos fundamentais nunca diminuiu. Recentemente, um usuário do X que acompanha há muito tempo os desenvolvimentos em grandes mo
Estudo da Deltek: 91% das empresas consideram a IA essencial para o sucesso
Uma pesquisa da Deltek revela que, embora as empresas de projetos prevejam lucros maiores, as lacunas na execução limitam, atualmente, o impacto mensurável da IA. Crédito: Nitat Termmee/Getty ImagesDe
Recomendações de tópicos especiais relacionados
Comentários (0)
À medida que os modelos de grande porte continuam a evoluir rapidamente, os custos de computação e a eficiência de processamento permanecem como principais preocupações do setor. A Fujitsu apresentou recentemente uma arquitetura inovadora chamada PHOTON (Top-down Network Parallel Hierarchical Computing), projetada para superar as limitações de desempenho dos modelos Transformer tradicionais em cenários complexos.
A arquitetura Transformer, hoje dominante na IA, lida bem com textos longos ou tarefas de múltiplas consultas com alta simultaneidade, mas frequentemente fica lenta devido aos acessos frequentes à memória para recuperar informações históricas, aumentando a carga de trabalho da GPU. A equipe de pesquisa da Fujitsu abordou esse ponto crítico repensando o projeto da arquitetura PHOTON.

O principal ponto forte do PHOTON reside em sua abordagem de processamento hierárquico. Em vez da segmentação no nível de tokens usada pelos Transformers tradicionais, o PHOTON introduz camadas semânticas, o que reduz a complexidade computacional ao mesmo tempo em que potencializa a computação paralela. Além disso, para tarefas com múltiplas consultas, a arquitetura agiliza a tomada de decisão: ela precisa de apenas uma única inferência para chegar a uma conclusão, utilizando estratégias de “votação por maioria” ou “melhor escolha”.
Os resultados dos testes mostram que, em modelos menores com 600 milhões, 900 milhões e 1,2 bilhão de parâmetros, o PHOTON oferece um rendimento muito alto e um uso de memória extremamente baixo. No modelo de 1,2 bilhão de parâmetros, seu desempenho em consultas múltiplas atinge 475 vezes o das arquiteturas Transformer convencionais, melhorando significativamente a eficiência do agendamento de recursos.
Como essa arquitetura requer menos cache KV por iteração, o sistema pode lidar com mais iterações. Trata-se de um grande aumento de desempenho para sistemas de agentes inteligentes que gerenciam muitos processos de E/S. Embora algumas métricas de qualidade apresentem uma ligeira perda, o salto do PHOTON em eficiência computacional o torna uma solução técnica promissora para reduzir os custos operacionais da IA.
A Fujitsu está agora promovendo ativamente a aplicação da arquitetura, com o objetivo de fornecer um suporte subjacente mais leve e eficiente para futuros cenários inteligentes por meio de inovações nos algoritmos centrais.
A Inteligência Artificial da Cognition nas negociações de financiamento, com a avaliação subindo para US$ 40 bilhões
A Cognition, criadora do aclamado assistente de codificação por IA Devin, tem capturado um interesse substancial de investidores. Fontes do setor indicam que a empresa está atualmente negociando uma nova rodada de financiamento, com projeções sugerin
A OpenAI revela o modelo base grande sob o novo projeto de pré-treinamento Doug
As a tecnologia de inteligência artificial continua a evoluir, o foco da indústria na arquitetura subjacente dos grandes modelos fundamentais nunca diminuiu. Recentemente, um usuário do X que acompanha há muito tempo os desenvolvimentos em grandes mo
Estudo da Deltek: 91% das empresas consideram a IA essencial para o sucesso
Uma pesquisa da Deltek revela que, embora as empresas de projetos prevejam lucros maiores, as lacunas na execução limitam, atualmente, o impacto mensurável da IA. Crédito: Nitat Termmee/Getty ImagesDe











