Découvrez des outils AI de qualité
Rassemblez les principaux outils d'intelligence artificielle du monde pour aider à améliorer l'efficacité du travail
Articles publiés par JamesLopez
Prime Intellect, une start-up qui propose des ressources informatiques et des outils de développement d’IA, a levé 130 millions de dollars dans le cadre de son financement de série A, mené par Radical Ventures, avec la participation de Nvidia Ventures et Intel Capital. Fondée en 2024, cette entreprise aide les entreprises à créer leurs propres agents d’IA sur mesure sans avoir recours à des laboratoires externes. Sa plateforme modulaire a généré 100 millions de dollars de revenus annuels auprès de clients tels que Ramp et Zapier. Cette start-up, évaluée à la valeur d’une « unicorn », vise à démocratiser le développement d’IA au sein des entreprises.
Prime Intellect, une start-up qui propose des ressources informatiques et des outils de développement d’IA, a levé 130 millions de dollars dans le cadre de son financement de série A, mené par Radical Ventures, avec la participation de Nvidia Ventures et Intel Capital. Fondée en 2024, cette entreprise aide les entreprises à créer leurs propres agents d’IA sur mesure sans avoir recours à des laboratoires externes. Sa plateforme modulaire a généré 100 millions de dollars de revenus annuels auprès de clients tels que Ramp et Zapier. Cette start-up, évaluée à la valeur d’une « unicorn », vise à démocratiser le développement d’IA au sein des entreprises.
La communauté openJiuwen a mis en ligne Skill-Omni, le premier paradigme de compétences multimodales validé par des experts du secteur. Il permet d’élever les agents IA, qui ne fonctionnaient jusqu’alors qu’avec du texte, au niveau de la perception visuelle, ce qui leur donne la capacité d’exécuter avec précision des tâches telles que l’édition photo ou les opérations sur interfaces graphiques, en convertissant des captures d’écran, des états d’interface et des séquences vidéo en ressources visuelles réutilisables. Des outils de génération automatique intégrés permettent de créer des compétences multimodales à partir de contenus en ligne, tandis qu’un mécanisme de lecture sur demande ne charge les éléments visuels que lorsque c’est nécessaire. Cet événement marque un tournant vers une ingénierie d’expérience pour agents basée sur des données multimodales plutôt que sur des documents seuls, et cette fonctionnalité est désormais disponible dans JiuwenSwarm.
La communauté openJiuwen a mis en ligne Skill-Omni, le premier paradigme de compétences multimodales validé par des experts du secteur. Il permet d’élever les agents IA, qui ne fonctionnaient jusqu’alors qu’avec du texte, au niveau de la perception visuelle, ce qui leur donne la capacité d’exécuter avec précision des tâches telles que l’édition photo ou les opérations sur interfaces graphiques, en convertissant des captures d’écran, des états d’interface et des séquences vidéo en ressources visuelles réutilisables. Des outils de génération automatique intégrés permettent de créer des compétences multimodales à partir de contenus en ligne, tandis qu’un mécanisme de lecture sur demande ne charge les éléments visuels que lorsque c’est nécessaire. Cet événement marque un tournant vers une ingénierie d’expérience pour agents basée sur des données multimodales plutôt que sur des documents seuls, et cette fonctionnalité est désormais disponible dans JiuwenSwarm.
ByteDance a open-sourcé Bernini, un framework de génération et d’édition vidéo qui utilise un mécanisme de « compréhension préalable, puis génération » pour résoudre les problèmes d’instabilité des images et de flou des cadres. Ce framework sépare la planification sémantique de la rendue visuelle, et prend en charge le traitement de références textuelles, imageuses et vidéo afin de permettre une édition contrôlée. Le code d’inférence ainsi que le modèle Bernini-R ont été publiés ; la version complète suivra bientôt.
ByteDance a open-sourcé Bernini, un framework de génération et d’édition vidéo qui utilise un mécanisme de « compréhension préalable, puis génération » pour résoudre les problèmes d’instabilité des images et de flou des cadres. Ce framework sépare la planification sémantique de la rendue visuelle, et prend en charge le traitement de références textuelles, imageuses et vidéo afin de permettre une édition contrôlée. Le code d’inférence ainsi que le modèle Bernini-R ont été publiés ; la version complète suivra bientôt.
Une action collective accuse Ring, filiale d'Amazon, de collecter secrètement des données biométriques faciales auprès de passants sans leur consentement, via sa fonctionnalité « Familiar Faces ». La plainte a été déposée à Seattle par un résident de Virginie. Ring crypte les données et supprime les visages non identifiés au bout de 30 jours, mais fait l'objet d'une surveillance constante en matière de protection de la vie privée depuis qu'elle s'est vu infliger une amende de 5,8 millions de dollars par la FTC en 2023.
Une action collective accuse Ring, filiale d'Amazon, de collecter secrètement des données biométriques faciales auprès de passants sans leur consentement, via sa fonctionnalité « Familiar Faces ». La plainte a été déposée à Seattle par un résident de Virginie. Ring crypte les données et supprime les visages non identifiés au bout de 30 jours, mais fait l'objet d'une surveillance constante en matière de protection de la vie privée depuis qu'elle s'est vu infliger une amende de 5,8 millions de dollars par la FTC en 2023.
Google lance Googlebook, un ordinateur portable doté d'IA qui fait évoluer l'informatique personnelle vers une logique centrée sur les modèles. Il intègre profondément Gemini au niveau du système, offrant un environnement informatique dynamique alimenté par l'IA. Une innovation clé consiste à intégrer Gemini au curseur, permettant ainsi l'analyse de l'écran en temps réel et la prédiction proactive des intentions. Cela permet d'effectuer des actions telles que la planification à partir de dates ou la synthèse de texte via des gestes du pointeur. La plateforme introduit également un bureau dynamique générant des tableaux de bord personnalisés grâce au langage naturel, une technologie baptisée « Vibe Computing ». Cela positionne l'IA comme le cerveau central du système, remodelant l'interface utilisateur et automatisant les tâches, établissant ainsi un nouveau paradigme pour les PC IA
Google lance Googlebook, un ordinateur portable doté d'IA qui fait évoluer l'informatique personnelle vers une logique centrée sur les modèles. Il intègre profondément Gemini au niveau du système, offrant un environnement informatique dynamique alimenté par l'IA. Une innovation clé consiste à intégrer Gemini au curseur, permettant ainsi l'analyse de l'écran en temps réel et la prédiction proactive des intentions. Cela permet d'effectuer des actions telles que la planification à partir de dates ou la synthèse de texte via des gestes du pointeur. La plateforme introduit également un bureau dynamique générant des tableaux de bord personnalisés grâce au langage naturel, une technologie baptisée « Vibe Computing ». Cela positionne l'IA comme le cerveau central du système, remodelant l'interface utilisateur et automatisant les tâches, établissant ainsi un nouveau paradigme pour les PC IA
Nvidia dévoile Cosmos Reason, un modèle d'IA de 7 milliards de paramètres pour la robotique, ainsi que de nouveaux modèles Cosmos, des bibliothèques neuronales et le serveur RTX Pro Blackwell pour améliorer les données synthétiques et la planification des robots à SIGGRAPH 2025.
Nvidia dévoile Cosmos Reason, un modèle d'IA de 7 milliards de paramètres pour la robotique, ainsi que de nouveaux modèles Cosmos, des bibliothèques neuronales et le serveur RTX Pro Blackwell pour améliorer les données synthétiques et la planification des robots à SIGGRAPH 2025.





