Lar
A DeepSeek lança um modo abrangente de reconhecimento de imagens com compreensão multimodal em testes internos
A DeepSeek iniciou os testes internos de seu modo de reconhecimento de imagens em grande escala, marcando a transição completa para a era multimodal de texto e imagem desse grande modelo nacional. Após uma versão beta em pequena escala no final de abril, a empresa ampliou significativamente o acesso ao “Modo de Reconhecimento de Imagens” em 9 de maio, e a maioria das contas de teste agora pode usar esse recurso por meio de um ponto de acesso dedicado na interface de chat. Embora ainda seja rotulado como “testes internos”, o fato de ele aparecer ao lado do “Modo Rápido” e do “Modo Especialista” acima da barra de entrada mostra que a compreensão multimodal é agora uma parte essencial da linha de produtos.

Diferentemente da extração básica de texto por OCR, a mais recente atualização do DeepSeek se concentra no reconhecimento profundo de imagens e na compreensão semântica. Em testes práticos, esse modo é capaz de analisar logicamente informações visuais, permitindo que os usuários realizem interações complexas entre mídias simplesmente enviando imagens. Essa iniciativa preenche uma lacuna nas capacidades multimodais do DeepSeek e o aproxima significativamente dos principais modelos internacionais, como o GPT-4o.
Artigo relacionado
Musk afirma que 99% do valor da SpaceX virá dos foguetes com IA; a exploração espacial passa a ser um negócio secundário
A SpaceX divulgou um vídeo do recente discurso de Elon Musk aos funcionários. Ao traçar o progresso da empresa, ele apresentou pela primeira vez os três pilares fundamentais: Starship, Starlink e IA,
A Universal Robots apresenta a 7ª geração para a implantação de IA física
Will Healy, diretor de marketing de produto e do setor da Universal Robots, é o autor da imagemWill Healy, diretor de marketing de produtos e do setor da Universal Robots, enfatiza que, após o lançame
A Polícia Federal confirma que a imagem gerada por IA de um pedestre com vassouras foi retirada de circulação
Um anúncio de serviço público incomum em um quadro de avisos em Linfen, Shanxi, chamou a atenção do público devido à sua imagem bizarra. Os pedestres aparecem posicionados de maneira estranha, e uma vassoura parece emergir da sacola de lixo de um tra
Recomendações de tópicos especiais relacionados
Comentários (0)
A DeepSeek iniciou os testes internos de seu modo de reconhecimento de imagens em grande escala, marcando a transição completa para a era multimodal de texto e imagem desse grande modelo nacional. Após uma versão beta em pequena escala no final de abril, a empresa ampliou significativamente o acesso ao “Modo de Reconhecimento de Imagens” em 9 de maio, e a maioria das contas de teste agora pode usar esse recurso por meio de um ponto de acesso dedicado na interface de chat. Embora ainda seja rotulado como “testes internos”, o fato de ele aparecer ao lado do “Modo Rápido” e do “Modo Especialista” acima da barra de entrada mostra que a compreensão multimodal é agora uma parte essencial da linha de produtos.

Diferentemente da extração básica de texto por OCR, a mais recente atualização do DeepSeek se concentra no reconhecimento profundo de imagens e na compreensão semântica. Em testes práticos, esse modo é capaz de analisar logicamente informações visuais, permitindo que os usuários realizem interações complexas entre mídias simplesmente enviando imagens. Essa iniciativa preenche uma lacuna nas capacidades multimodais do DeepSeek e o aproxima significativamente dos principais modelos internacionais, como o GPT-4o.
Musk afirma que 99% do valor da SpaceX virá dos foguetes com IA; a exploração espacial passa a ser um negócio secundário
A SpaceX divulgou um vídeo do recente discurso de Elon Musk aos funcionários. Ao traçar o progresso da empresa, ele apresentou pela primeira vez os três pilares fundamentais: Starship, Starlink e IA,
A Universal Robots apresenta a 7ª geração para a implantação de IA física
Will Healy, diretor de marketing de produto e do setor da Universal Robots, é o autor da imagemWill Healy, diretor de marketing de produtos e do setor da Universal Robots, enfatiza que, após o lançame
A Polícia Federal confirma que a imagem gerada por IA de um pedestre com vassouras foi retirada de circulação
Um anúncio de serviço público incomum em um quadro de avisos em Linfen, Shanxi, chamou a atenção do público devido à sua imagem bizarra. Os pedestres aparecem posicionados de maneira estranha, e uma vassoura parece emergir da sacola de lixo de um tra











