Maison
DeepSeek lance un mode de reconnaissance d'images étendu avec compréhension multimodale dans le cadre de tests internes
DeepSeek a lancé les tests internes de son mode de reconnaissance d'images à grande échelle, marquant ainsi le passage définitif de ce grand modèle national à l'ère multimodale alliant texte et image. Après une version bêta à petite échelle fin avril, l’entreprise a considérablement élargi l’accès au « mode de reconnaissance d’images » le 9 mai, et la plupart des comptes test peuvent désormais utiliser cette fonctionnalité via un point d’accès dédié dans l’interface de chat. Bien qu’il soit toujours qualifié de « test interne », le fait qu’il apparaisse aux côtés des modes « Rapide » et « Expert » au-dessus de la barre de saisie montre que la compréhension multimodale fait désormais partie intégrante de la gamme de produits.

Contrairement à l’extraction de texte par OCR classique, la dernière mise à jour de DeepSeek se concentre sur la reconnaissance d’images approfondie et la compréhension sémantique. Lors de tests pratiques, ce mode est capable d’analyser logiquement les informations visuelles, permettant ainsi aux utilisateurs d’effectuer des interactions cross-média complexes simplement en téléchargeant des images. Cette avancée comble une lacune dans les capacités multimodales de DeepSeek et le rapproche considérablement des meilleurs modèles internationaux tels que GPT-4o.
Article connexe
Musk affirme que 99 % de la valeur de SpaceX proviendra des fusées dotées d'IA, l'exploration spatiale devenant une activité secondaire
SpaceX a publié une vidéo du récent discours d’Elon Musk devant ses collaborateurs. Tout en retraçant les progrès de l’entreprise, il a présenté pour la première fois les trois piliers fondamentaux qu
Universal Robots dévoile la 7e génération pour le déploiement de l'IA physique
Will Healy, directeur du marketing produit et sectoriel chez Universal Robots, à qui l'on doit cette imageWill Healy, directeur du marketing produit et sectoriel chez Universal Robots, souligne q
Official Confirms AI-Generated Image of Pedestrian with Brooms Was Pulled From Circulation
Une publicité pour un service public inhabituelle, affichée sur un panneau d’affichage à Linfen, dans la province du Shanxi, a attiré l’attention du public en raison de son imagerie étrange. Les piétons apparaissent dans des positions étranges, et un
Recommandations de sujets spéciaux liés
commentaires (0)
DeepSeek a lancé les tests internes de son mode de reconnaissance d'images à grande échelle, marquant ainsi le passage définitif de ce grand modèle national à l'ère multimodale alliant texte et image. Après une version bêta à petite échelle fin avril, l’entreprise a considérablement élargi l’accès au « mode de reconnaissance d’images » le 9 mai, et la plupart des comptes test peuvent désormais utiliser cette fonctionnalité via un point d’accès dédié dans l’interface de chat. Bien qu’il soit toujours qualifié de « test interne », le fait qu’il apparaisse aux côtés des modes « Rapide » et « Expert » au-dessus de la barre de saisie montre que la compréhension multimodale fait désormais partie intégrante de la gamme de produits.

Contrairement à l’extraction de texte par OCR classique, la dernière mise à jour de DeepSeek se concentre sur la reconnaissance d’images approfondie et la compréhension sémantique. Lors de tests pratiques, ce mode est capable d’analyser logiquement les informations visuelles, permettant ainsi aux utilisateurs d’effectuer des interactions cross-média complexes simplement en téléchargeant des images. Cette avancée comble une lacune dans les capacités multimodales de DeepSeek et le rapproche considérablement des meilleurs modèles internationaux tels que GPT-4o.
Musk affirme que 99 % de la valeur de SpaceX proviendra des fusées dotées d'IA, l'exploration spatiale devenant une activité secondaire
SpaceX a publié une vidéo du récent discours d’Elon Musk devant ses collaborateurs. Tout en retraçant les progrès de l’entreprise, il a présenté pour la première fois les trois piliers fondamentaux qu
Universal Robots dévoile la 7e génération pour le déploiement de l'IA physique
Will Healy, directeur du marketing produit et sectoriel chez Universal Robots, à qui l'on doit cette imageWill Healy, directeur du marketing produit et sectoriel chez Universal Robots, souligne q
Official Confirms AI-Generated Image of Pedestrian with Brooms Was Pulled From Circulation
Une publicité pour un service public inhabituelle, affichée sur un panneau d’affichage à Linfen, dans la province du Shanxi, a attiré l’attention du public en raison de son imagerie étrange. Les piétons apparaissent dans des positions étranges, et un











