Hogar
Zhiyuan WITA pone fin a la interacción «desnuda» con robots con la presentación de su primera declaración de cumplimiento
El sector de la inteligencia incorporada ha alcanzado un hito significativo. Según el último comunicado de la Administración del Ciberespacio de Shanghái, el modelo a gran escala WITA, desarrollado por Zhiyuan, ha completado con éxito el proceso de registro, convirtiéndose en el primer modelo a gran escala de interacción de inteligencia incorporada implantado de conformidad con la normativa en el país.
Este logro va más allá de la simple obtención de una licencia. El objetivo principal de WITA es permitir que los robots humanoides conversen de verdad, perciban emociones y desarrollen personalidades distintas. Diseñado específicamente para escenarios de interacción robótica, utiliza una comunicación natural y emocionalmente expresiva para transformar fríos cuerpos mecánicos en compañeros de silicio con memoria continua y rasgos individuales. Como motor central para el despliegue inteligente interactivo, este modelo ya se está aplicando en entornos comerciales como visitas guiadas, asistencia en compras y servicios minoristas, abordando el desafío de larga data del sector en el que los robots pueden trabajar pero tienen dificultades para comunicarse de manera efectiva.

Y lo que es más importante, Zhiyuan ha revelado que WITA Omni 1.0, el primer gran modelo de interacción multimodal de extremo a extremo para robots, se lanzará en el tercer trimestre de este año. Sus avances son tangibles: la latencia de la interacción se ha reducido a menos de 500 milisegundos, lo que se aproxima mucho al ritmo de una conversación humana natural. Admite la comunicación continua a velocidades normales del habla, permite interrupciones y correcciones, y ajusta las emociones y el tono en tiempo real, haciendo que las interacciones se sientan realmente como si se estuviera hablando con una persona.
Desde el punto de vista técnico, el nuevo modelo logra una coordinación multimodal fluida entre el lenguaje, la voz, la expresión facial y el movimiento, eliminando la sensación de desconexión que se producía anteriormente, en la que la boca del robot se movía pero su cuerpo permanecía inmóvil. Y lo que es más importante, a través de un mecanismo de «flywheel» de datos de interacción multimodal, el modelo aprende y mejora continuamente en escenarios del mundo real, creando un ciclo positivo de autooptimización.
Las implicaciones estratégicas son igualmente significativas. En la primera Cumbre de la Industria de la Inteligencia Encarnada de Hong Kong, Peng Zhihui, cofundador, presidente y director técnico de Zhiyuan, anunció oficialmente el Plan de Visión Zhiyuan 358: con el objetivo de alcanzar unos ingresos de 10 000 millones de yuanes para 2027 y 100 000 millones de yuanes para 2030. Esta ambiciosa hoja de ruta no solo demuestra la confianza de Zhiyuan en la comercialización de la inteligencia incorporada, sino que también indica que todo el sector está pasando de la validación tecnológica a la monetización a gran escala, lo que marca un punto de inflexión crucial.
Artículo relacionado
CEO de DeepMind, Hassabis: Duermo seis horas al día y generalmente me siento con energía alrededor de la 1 a. m.
Fortune ha presentado recientemente una entrevista con Demis Hassabis, director ejecutivo de Google DeepMind, en la que revela su enfoque poco convencional para el descanso y la productividad. Hassabis ha revelado que duerme muy poco, estructurando s
OpenAI y Anthropic compiten por la cuota de mercado a pesar de la caída de los ingresos
A pesar de los recientes informes que sugieren que OpenAI no ha alcanzado sus objetivos de ingresos —lo que ha generado presión sobre las acciones tecnológicas este martes—, los inversores privados en
Cumplimiento de la normativa sobre vehículos autónomos en California: una nueva era de multas, geovallas y 1 millón de millas
Guident opera un servicio de transporte de AuveTech en el sur de Florida, gestionando una ruta de cuatro millas en West Palm Beach y otra de una milla en Boca Ratón mediante su tecnología de monitoriz
Recomendaciones de temas especiales relacionados
comentario (0)
0/500
El sector de la inteligencia incorporada ha alcanzado un hito significativo. Según el último comunicado de la Administración del Ciberespacio de Shanghái, el modelo a gran escala WITA, desarrollado por Zhiyuan, ha completado con éxito el proceso de registro, convirtiéndose en el primer modelo a gran escala de interacción de inteligencia incorporada implantado de conformidad con la normativa en el país.
Este logro va más allá de la simple obtención de una licencia. El objetivo principal de WITA es permitir que los robots humanoides conversen de verdad, perciban emociones y desarrollen personalidades distintas. Diseñado específicamente para escenarios de interacción robótica, utiliza una comunicación natural y emocionalmente expresiva para transformar fríos cuerpos mecánicos en compañeros de silicio con memoria continua y rasgos individuales. Como motor central para el despliegue inteligente interactivo, este modelo ya se está aplicando en entornos comerciales como visitas guiadas, asistencia en compras y servicios minoristas, abordando el desafío de larga data del sector en el que los robots pueden trabajar pero tienen dificultades para comunicarse de manera efectiva.

Y lo que es más importante, Zhiyuan ha revelado que WITA Omni 1.0, el primer gran modelo de interacción multimodal de extremo a extremo para robots, se lanzará en el tercer trimestre de este año. Sus avances son tangibles: la latencia de la interacción se ha reducido a menos de 500 milisegundos, lo que se aproxima mucho al ritmo de una conversación humana natural. Admite la comunicación continua a velocidades normales del habla, permite interrupciones y correcciones, y ajusta las emociones y el tono en tiempo real, haciendo que las interacciones se sientan realmente como si se estuviera hablando con una persona.
Desde el punto de vista técnico, el nuevo modelo logra una coordinación multimodal fluida entre el lenguaje, la voz, la expresión facial y el movimiento, eliminando la sensación de desconexión que se producía anteriormente, en la que la boca del robot se movía pero su cuerpo permanecía inmóvil. Y lo que es más importante, a través de un mecanismo de «flywheel» de datos de interacción multimodal, el modelo aprende y mejora continuamente en escenarios del mundo real, creando un ciclo positivo de autooptimización.
Las implicaciones estratégicas son igualmente significativas. En la primera Cumbre de la Industria de la Inteligencia Encarnada de Hong Kong, Peng Zhihui, cofundador, presidente y director técnico de Zhiyuan, anunció oficialmente el Plan de Visión Zhiyuan 358: con el objetivo de alcanzar unos ingresos de 10 000 millones de yuanes para 2027 y 100 000 millones de yuanes para 2030. Esta ambiciosa hoja de ruta no solo demuestra la confianza de Zhiyuan en la comercialización de la inteligencia incorporada, sino que también indica que todo el sector está pasando de la validación tecnológica a la monetización a gran escala, lo que marca un punto de inflexión crucial.
CEO de DeepMind, Hassabis: Duermo seis horas al día y generalmente me siento con energía alrededor de la 1 a. m.
Fortune ha presentado recientemente una entrevista con Demis Hassabis, director ejecutivo de Google DeepMind, en la que revela su enfoque poco convencional para el descanso y la productividad. Hassabis ha revelado que duerme muy poco, estructurando s
OpenAI y Anthropic compiten por la cuota de mercado a pesar de la caída de los ingresos
A pesar de los recientes informes que sugieren que OpenAI no ha alcanzado sus objetivos de ingresos —lo que ha generado presión sobre las acciones tecnológicas este martes—, los inversores privados en











