Découvrez des outils AI de qualité
Rassemblez les principaux outils d'intelligence artificielle du monde pour aider à améliorer l'efficacité du travail
Articles publiés par RoyLopez
L’équipe Xiaomi MiMo a rendu public les progrès en temps réel de l’apprentissage par renforcement pour son nouveau grand modèle MiMo-V2.6 via une page d’entraînement en direct. Dirigé par l’ancien chercheur de DeepSeek Luo Fuli, le projet comprend des expériences à grande échelle sur des agents multi-tâches avec une parallélisation entièrement asynchrone. Le coût d’entraînement pour les deux versions a dépassé 1,28 million de dollars, prenant environ 30 heures au total. Cette approche transparente marque un changement des essais en boîte noire vers l’ingénierie open-source, mettant en avant les avancées de Xiaomi dans les lois d’échelle de l’apprentissage par renforcement et l’exploration de l’AGI.
L’équipe Xiaomi MiMo a rendu public les progrès en temps réel de l’apprentissage par renforcement pour son nouveau grand modèle MiMo-V2.6 via une page d’entraînement en direct. Dirigé par l’ancien chercheur de DeepSeek Luo Fuli, le projet comprend des expériences à grande échelle sur des agents multi-tâches avec une parallélisation entièrement asynchrone. Le coût d’entraînement pour les deux versions a dépassé 1,28 million de dollars, prenant environ 30 heures au total. Cette approche transparente marque un changement des essais en boîte noire vers l’ingénierie open-source, mettant en avant les avancées de Xiaomi dans les lois d’échelle de l’apprentissage par renforcement et l’exploration de l’AGI.
Universal Music Group et la société spécialisée dans l'audio IA ElevenLabs ont annoncé un partenariat stratégique le 10 septembre, marquant ainsi le premier accord de cette dernière avec une major du disque. Cette collaboration porte principalement sur le respect des droits d'auteur et l'industrialisation de la musique générée par l'IA. Les deux entités développent actuellement une nouvelle plateforme permettant aux fans de créer des remixes, des medleys et des expériences vocales personnalisées avec des artistes sous licence. Lucian Grainge, PDG d’UMG, a insisté sur l’importance de placer les créateurs au cœur de cette initiative, dans le but de renforcer l’interaction avec les fans et d’ouvrir de nouvelles sources de revenus grâce à une innovation responsable en matière d’IA.
Universal Music Group et la société spécialisée dans l'audio IA ElevenLabs ont annoncé un partenariat stratégique le 10 septembre, marquant ainsi le premier accord de cette dernière avec une major du disque. Cette collaboration porte principalement sur le respect des droits d'auteur et l'industrialisation de la musique générée par l'IA. Les deux entités développent actuellement une nouvelle plateforme permettant aux fans de créer des remixes, des medleys et des expériences vocales personnalisées avec des artistes sous licence. Lucian Grainge, PDG d’UMG, a insisté sur l’importance de placer les créateurs au cœur de cette initiative, dans le but de renforcer l’interaction avec les fans et d’ouvrir de nouvelles sources de revenus grâce à une innovation responsable en matière d’IA.
Sun Tianxiang, directeur du département de recherche sur les modèles de base de la Fondation Baidu, a recruté Wu Qin, chercheur senior issu d’un laboratoire nord-américain de pointe, ainsi que Wei Haoran, ancien collaborateur de DeepSeek, afin de renforcer les capacités du grand modèle ERNIE. Wei Haoran dirige désormais l'équipe chargée des algorithmes multimodaux, apportant son expertise acquise lors du développement de DeepSeek-OCR et grâce aux meilleurs scores mondiaux récemment obtenus lors des tests de performance OmniDocBench. Ce déploiement stratégique de talents vise à améliorer les performances d'ERNIE en matière de pré-entraînement et de multimodalité, en alignant la stratégie technique de Baidu sur les avancées internationales grâce à des améliorations organisationnelles et techniques.
Sun Tianxiang, directeur du département de recherche sur les modèles de base de la Fondation Baidu, a recruté Wu Qin, chercheur senior issu d’un laboratoire nord-américain de pointe, ainsi que Wei Haoran, ancien collaborateur de DeepSeek, afin de renforcer les capacités du grand modèle ERNIE. Wei Haoran dirige désormais l'équipe chargée des algorithmes multimodaux, apportant son expertise acquise lors du développement de DeepSeek-OCR et grâce aux meilleurs scores mondiaux récemment obtenus lors des tests de performance OmniDocBench. Ce déploiement stratégique de talents vise à améliorer les performances d'ERNIE en matière de pré-entraînement et de multimodalité, en alignant la stratégie technique de Baidu sur les avancées internationales grâce à des améliorations organisationnelles et techniques.
Anthropic a lancé Claude Fable 5.1 et Mythos 5.1, affirmant qu’ils offraient des performances supérieures à celles de leurs concurrents dans les domaines du codage et des sciences. Fable 5.1 est accessible au grand public avec des coûts de cache réduits de 75 %, tandis que Mythos 5.1 cible la cybersécurité et les sciences de la vie via Trusted Access. Les tests de performance montrent des améliorations significatives dans les tâches des agents et la conception moléculaire. Parmi les fonctionnalités figurent une sécurité axée sur l’entreprise garantissant une rétention de données nulle, ainsi que des filigranes invisibles conformes à la loi européenne sur l’IA. Fable 5.1 est accessible sur les principales plateformes cloud, tandis que Mythos 5.1 reste réservé aux organisations américaines agréées.
Anthropic a lancé Claude Fable 5.1 et Mythos 5.1, affirmant qu’ils offraient des performances supérieures à celles de leurs concurrents dans les domaines du codage et des sciences. Fable 5.1 est accessible au grand public avec des coûts de cache réduits de 75 %, tandis que Mythos 5.1 cible la cybersécurité et les sciences de la vie via Trusted Access. Les tests de performance montrent des améliorations significatives dans les tâches des agents et la conception moléculaire. Parmi les fonctionnalités figurent une sécurité axée sur l’entreprise garantissant une rétention de données nulle, ainsi que des filigranes invisibles conformes à la loi européenne sur l’IA. Fable 5.1 est accessible sur les principales plateformes cloud, tandis que Mythos 5.1 reste réservé aux organisations américaines agréées.
DeepSeek a réussi sa première série de financement, dépassant les 7 milliards de dollars grâce à une structure inhabituelle, ce qui a valu à l’entreprise une valeur post-investissement de plus de 50 milliards de dollars. Les fonds ont été versés dans une société en commandite gérée par le PDG Liang Wenfeng, qui y a personnellement investi 2 milliards de dollars. Les investisseurs obtiennent des droits économiques mais pas des droits de vote, et ces droits sont soumis à une période de blocage de cinq ans. Parmi les investisseurs stratégiques figurent Tencent et CATL, qui ont apporté un soutien financier important pour le développement de modèles d’intelligence artificielle et l’infrastructure informatique correspondante.
DeepSeek a réussi sa première série de financement, dépassant les 7 milliards de dollars grâce à une structure inhabituelle, ce qui a valu à l’entreprise une valeur post-investissement de plus de 50 milliards de dollars. Les fonds ont été versés dans une société en commandite gérée par le PDG Liang Wenfeng, qui y a personnellement investi 2 milliards de dollars. Les investisseurs obtiennent des droits économiques mais pas des droits de vote, et ces droits sont soumis à une période de blocage de cinq ans. Parmi les investisseurs stratégiques figurent Tencent et CATL, qui ont apporté un soutien financier important pour le développement de modèles d’intelligence artificielle et l’infrastructure informatique correspondante.
La licorne de l'IA Anthropic a déposé en toute confidentialité une demande d'introduction en bourse auprès de la SEC, marquant ainsi une étape majeure dans la vague d'introductions en bourse la plus attendue du secteur technologique. Le PDG d'OpenAI, Sam Altman, minimise l'importance d'une « course à l'introduction en bourse », préférant mettre l'accent sur la concurrence technologique. Anthropic, dont la valorisation avoisine les 1 000 milliards de dollars, prévoit de s'introduire en bourse ; OpenAI vise également une introduction en bourse plus tard dans l'année. Sam Altman estime que le secteur de l'IA comptera plusieurs fournisseurs, et non un seul acteur dominant. SpaceX pourrait également avancer son introduction en bourse, redessinant ainsi les marchés publics.
La licorne de l'IA Anthropic a déposé en toute confidentialité une demande d'introduction en bourse auprès de la SEC, marquant ainsi une étape majeure dans la vague d'introductions en bourse la plus attendue du secteur technologique. Le PDG d'OpenAI, Sam Altman, minimise l'importance d'une « course à l'introduction en bourse », préférant mettre l'accent sur la concurrence technologique. Anthropic, dont la valorisation avoisine les 1 000 milliards de dollars, prévoit de s'introduire en bourse ; OpenAI vise également une introduction en bourse plus tard dans l'année. Sam Altman estime que le secteur de l'IA comptera plusieurs fournisseurs, et non un seul acteur dominant. SpaceX pourrait également avancer son introduction en bourse, redessinant ainsi les marchés publics.
NVIDIA a lancé Polar, un framework d'intelligence artificielle open-source qui intègre la méthode d'optimisation des politiques relatives généralisées (GRPO) dans des frameworks d'agents de code existants tels que Codex, sans modifier leurs fonctions essentielles. Cette amélioration augmente considérablement les performances des agents dans des tâches complexes et multi-étapes, telles que l'appel d'outils de codage et la soumission de correctifs. Selon les tests, Polar a permis à Codex d'améliorer son score pass@1 de 3,8 % à 26,4 % et a réduit le temps d'entraînement de près de 5,39 fois tout en augmentant l'utilisation de la carte graphique GPU.
NVIDIA a lancé Polar, un framework d'intelligence artificielle open-source qui intègre la méthode d'optimisation des politiques relatives généralisées (GRPO) dans des frameworks d'agents de code existants tels que Codex, sans modifier leurs fonctions essentielles. Cette amélioration augmente considérablement les performances des agents dans des tâches complexes et multi-étapes, telles que l'appel d'outils de codage et la soumission de correctifs. Selon les tests, Polar a permis à Codex d'améliorer son score pass@1 de 3,8 % à 26,4 % et a réduit le temps d'entraînement de près de 5,39 fois tout en augmentant l'utilisation de la carte graphique GPU.
Une étude publiée dans *Nature* révèle que les grands modèles linguistiques peuvent transmettre des traits comportementaux cachés, tels que des préjugés ou des préférences dangereuses, par le biais de données en apparence neutres, comme des suites de chiffres ou du code, un phénomène appelé « apprentissage subliminal ». Cela compromet les techniques courantes de distillation des modèles, permettant ainsi aux risques de se propager sans être détectés tout au long de la chaîne d'approvisionnement des modèles. Les évaluations de sécurité actuelles, axées sur le contenu sémantique, ne parviennent pas à identifier ces signaux non sémantiques, ce qui rend nécessaire de s'orienter vers un audit des poids des modèles plutôt que de se limiter à leurs résultats.
Une étude publiée dans *Nature* révèle que les grands modèles linguistiques peuvent transmettre des traits comportementaux cachés, tels que des préjugés ou des préférences dangereuses, par le biais de données en apparence neutres, comme des suites de chiffres ou du code, un phénomène appelé « apprentissage subliminal ». Cela compromet les techniques courantes de distillation des modèles, permettant ainsi aux risques de se propager sans être détectés tout au long de la chaîne d'approvisionnement des modèles. Les évaluations de sécurité actuelles, axées sur le contenu sémantique, ne parviennent pas à identifier ces signaux non sémantiques, ce qui rend nécessaire de s'orienter vers un audit des poids des modèles plutôt que de se limiter à leurs résultats.
La start-up d'e-commerce spécialisée dans l'IA Spangle a levé 15 millions de dollars lors d'un tour de table de série A mené par NewRoad Capital Partners, atteignant une valorisation post-investissement de 100 millions de dollars. Fondée par l'ancien PDG de Bolt, Maju Kuruvilla, la société utilise sa plateforme d'IA ProductGPT pour créer des pages d'achat personnalisées en temps réel pour des détaillants tels que Revolve, qui affirment avoir enregistré une augmentation significative de leurs indicateurs clés, tels que le chiffre d'affaires par visite.
La start-up d'e-commerce spécialisée dans l'IA Spangle a levé 15 millions de dollars lors d'un tour de table de série A mené par NewRoad Capital Partners, atteignant une valorisation post-investissement de 100 millions de dollars. Fondée par l'ancien PDG de Bolt, Maju Kuruvilla, la société utilise sa plateforme d'IA ProductGPT pour créer des pages d'achat personnalisées en temps réel pour des détaillants tels que Revolve, qui affirment avoir enregistré une augmentation significative de leurs indicateurs clés, tels que le chiffre d'affaires par visite.
L'essor de la construction de centres de données, dont les dépenses privées aux États-Unis atteignent 41 milliards de dollars par an, risque de retarder les projets d'infrastructure locaux et nationaux tels que les routes et les ponts. Les secteurs sont en concurrence pour une main-d'œuvre rare dans un contexte de pénurie industrielle, et le PDG d'Autodesk avertit que les centres de données détournent des ressources essentielles.
L'essor de la construction de centres de données, dont les dépenses privées aux États-Unis atteignent 41 milliards de dollars par an, risque de retarder les projets d'infrastructure locaux et nationaux tels que les routes et les ponts. Les secteurs sont en concurrence pour une main-d'œuvre rare dans un contexte de pénurie industrielle, et le PDG d'Autodesk avertit que les centres de données détournent des ressources essentielles.





