Maison
Zhiyuan WITA met fin à son projet d'interaction avec des robots « nus » en déposant sa première demande d'agrément
Le secteur de l'intelligence incarnée a franchi une étape importante. Selon la dernière annonce de l'Administration du cyberespace de Shanghai, le grand modèle WITA développé par Zhiyuan a mené à bien la procédure d'enregistrement, devenant ainsi le premier grand modèle d'interaction d'intelligence incarnée déployé en toute conformité dans le pays.
Cette réussite va au-delà de la simple obtention d'une licence. L'objectif principal de WITA est de permettre aux robots humanoïdes de véritablement converser, de percevoir les émotions et de développer des personnalités distinctes. Conçu spécifiquement pour les scénarios d'interaction robotique, il utilise une communication naturelle et expressive sur le plan émotionnel pour transformer des corps mécaniques froids en compagnons de silicium dotés d'une mémoire continue et de traits de caractère individuels. En tant que moteur central du déploiement intelligent interactif, ce modèle est déjà utilisé dans des contextes commerciaux tels que les visites guidées, l'assistance à l'achat et la vente au détail de services, répondant ainsi au défi de longue date de l'industrie où les robots peuvent travailler mais peinent à communiquer efficacement.

Plus important encore, Zhiyuan a révélé que WITA Omni 1.0, le premier grand modèle d'interaction multimodale de bout en bout pour les robots, sera lancé au troisième trimestre de cette année. Ses avancées sont tangibles : la latence d'interaction a été réduite à moins de 500 millisecondes, ce qui correspond étroitement au rythme d'une conversation humaine naturelle. Il prend en charge une communication continue à une vitesse de parole normale, permet les interruptions et les corrections, et ajuste les émotions et le ton en temps réel, donnant véritablement l'impression de parler à une personne.
Sur le plan technique, ce nouveau modèle assure une coordination multimodale fluide entre le langage, la voix, les expressions faciales et les mouvements, éliminant ainsi le sentiment de disjonction qui prévalait auparavant, lorsque la bouche du robot bougeait mais que son corps restait immobile. Plus important encore, grâce à un mécanisme de « volant d'inertie » des données d'interaction multimodale, le modèle apprend et s'améliore en continu dans des scénarios réels, créant ainsi un cycle positif d'auto-optimisation.
Les implications stratégiques sont tout aussi importantes. Lors du premier Sommet de l'industrie de l'intelligence incarnée de Hong Kong, Peng Zhihui, cofondateur, président et directeur technique de Zhiyuan, a officiellement annoncé le plan Zhiyuan 358 Vision : viser un chiffre d'affaires de 10 milliards de yuans d'ici 2027 et de 100 milliards de yuans d'ici 2030. Cette feuille de route ambitieuse démontre non seulement la confiance de Zhiyuan dans la commercialisation de l'intelligence incarnée, mais signale également que l'ensemble du secteur passe de la validation technologique à la monétisation à grande échelle, marquant ainsi un tournant décisif.
Article connexe
Meta supprime la fonction de retouche photo par IA suite aux critiques des utilisateurs
Meta, le géant des réseaux sociaux, est une fois de plus au cœur d’un débat public concernant l’équilibre délicat entre l’intelligence artificielle et la vie privée des utilisateurs. Selon TechCrunch, les Superintelligence Labs de Meta ont présenté u
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes
Bien que des informations récentes laissent entendre qu’OpenAI n’aurait pas atteint ses objectifs de chiffre d’affaires, ce qui a pesé sur les valeurs technologiques ce mardi, les investisseurs privés
Recommandations de sujets spéciaux liés
commentaires (0)
Le secteur de l'intelligence incarnée a franchi une étape importante. Selon la dernière annonce de l'Administration du cyberespace de Shanghai, le grand modèle WITA développé par Zhiyuan a mené à bien la procédure d'enregistrement, devenant ainsi le premier grand modèle d'interaction d'intelligence incarnée déployé en toute conformité dans le pays.
Cette réussite va au-delà de la simple obtention d'une licence. L'objectif principal de WITA est de permettre aux robots humanoïdes de véritablement converser, de percevoir les émotions et de développer des personnalités distinctes. Conçu spécifiquement pour les scénarios d'interaction robotique, il utilise une communication naturelle et expressive sur le plan émotionnel pour transformer des corps mécaniques froids en compagnons de silicium dotés d'une mémoire continue et de traits de caractère individuels. En tant que moteur central du déploiement intelligent interactif, ce modèle est déjà utilisé dans des contextes commerciaux tels que les visites guidées, l'assistance à l'achat et la vente au détail de services, répondant ainsi au défi de longue date de l'industrie où les robots peuvent travailler mais peinent à communiquer efficacement.

Plus important encore, Zhiyuan a révélé que WITA Omni 1.0, le premier grand modèle d'interaction multimodale de bout en bout pour les robots, sera lancé au troisième trimestre de cette année. Ses avancées sont tangibles : la latence d'interaction a été réduite à moins de 500 millisecondes, ce qui correspond étroitement au rythme d'une conversation humaine naturelle. Il prend en charge une communication continue à une vitesse de parole normale, permet les interruptions et les corrections, et ajuste les émotions et le ton en temps réel, donnant véritablement l'impression de parler à une personne.
Sur le plan technique, ce nouveau modèle assure une coordination multimodale fluide entre le langage, la voix, les expressions faciales et les mouvements, éliminant ainsi le sentiment de disjonction qui prévalait auparavant, lorsque la bouche du robot bougeait mais que son corps restait immobile. Plus important encore, grâce à un mécanisme de « volant d'inertie » des données d'interaction multimodale, le modèle apprend et s'améliore en continu dans des scénarios réels, créant ainsi un cycle positif d'auto-optimisation.
Les implications stratégiques sont tout aussi importantes. Lors du premier Sommet de l'industrie de l'intelligence incarnée de Hong Kong, Peng Zhihui, cofondateur, président et directeur technique de Zhiyuan, a officiellement annoncé le plan Zhiyuan 358 Vision : viser un chiffre d'affaires de 10 milliards de yuans d'ici 2027 et de 100 milliards de yuans d'ici 2030. Cette feuille de route ambitieuse démontre non seulement la confiance de Zhiyuan dans la commercialisation de l'intelligence incarnée, mais signale également que l'ensemble du secteur passe de la validation technologique à la monétisation à grande échelle, marquant ainsi un tournant décisif.
Meta supprime la fonction de retouche photo par IA suite aux critiques des utilisateurs
Meta, le géant des réseaux sociaux, est une fois de plus au cœur d’un débat public concernant l’équilibre délicat entre l’intelligence artificielle et la vie privée des utilisateurs. Selon TechCrunch, les Superintelligence Labs de Meta ont présenté u
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes
Bien que des informations récentes laissent entendre qu’OpenAI n’aurait pas atteint ses objectifs de chiffre d’affaires, ce qui a pesé sur les valeurs technologiques ce mardi, les investisseurs privés











