Hogar
Wanxiang Shengsheng desvela una herramienta de audiolibros de IA a bajo costo por menos de 8 yuanes por cada 10 mil caracteres
Dos meses después de su beta pública, Wanzhuang Yousheng lanzó oficialmente su sistema de producción automatizada, "Creación de Audiolibros Multi-voz con IA Totalmente Automática", una función que ya había conquistado a los titulares de derechos durante las pruebas internas.
Lanzado por el equipo central detrás de Lazy Listen, esta plataforma de contenido de audio con IA completó su prueba pública de esta función estratégica a principios de junio. En el núcleo se encuentra una combinación de capacidades de IA probadas: división inteligente de capítulos, análisis de personajes, generación de guiones, actuación de voz multi-personaje y síntesis de postproducción, orquestadas por un motor de tareas para crear una línea de producción de audio digital automatizada capaz de funcionar "sin tripulación".
No se trata de un producto independiente, sino de una aplicación práctica de la estrategia del "motor de producción de doble vía" de la plataforma. Comparte la misma infraestructura técnica que el existing professional creation workbench de Wanzhuang Yousheng, pero opera en modo totalmente automático, abordando el desafío más crítico de la industria: cómo lograr un salto en la capacidad y una reducción de costos sin comprometer la calidad.

De "Manual" a "Piloto Automático": Un Motor, Dos Vías
La producción de audiolibros de alta calidad tradicional es un proceso manual largo y costoso que implica clasificación de manuscritos, división de capítulos, creación de guiones, casting, actuación de voz, alineación, mezcla de postproducción, controles de calidad y exportación. Producir un audiolibro multi-personaje de alta calidad puede llevar más de 30 días y costar desde miles hasta decenas de miles de yuanes.
La primera línea de productos de Wanzhuang Yousheng, "Vía Uno: Mejora de la Calidad", fue diseñada para resolver el problema de "hacerlo mejor".
Ofrece una herramienta de creación con IA de ciclo completo para estudios profesionales y equipos de actuación de voz. Módulos como la creación inteligente de guiones, la alineación inteligente y la escucha inteligente liberan a los creadores de tareas tediosas y repetitivas, permitiéndoles centrarse en la expresión artística. La lógica central sigue siendo la colaboración profunda entre humanos y máquinas.

La recién lanzada estación de trabajo de audiolibros multi-voz con IA totalmente automática pertenece a la "Vía Dos: Salto de Capacidad".
Su objetivo es completamente diferente: no está dirigido a creadores meticulosos, sino a clientes B-end como plataformas de literatura en línea e instituciones editoriales que poseen grandes cantidades de derechos de autor y necesitan convertir su inventario rápidamente. Su lógica es sencilla: utilizar una solución totalmente automatizada para resolver el desafío de escalabilidad de contenido masivo, de larga cola y sensible al ROI.
Después de que los usuarios suben los manuscritos, el sistema funciona como una fábrica digital súper eficiente: divide automáticamente los capítulos, analiza inteligentemente los personajes y empareja la mejor voz de IA, genera guiones con anotaciones emocionales y pronunciación precisa, utiliza casi mil tonos de voz optimizados para la narración multi-personaje y, finalmente, sintetiza el producto final con efectos de sonido. Después de la generación, el trabajo se transfiere a una interfaz de edición estándar, donde los usuarios pueden utilizar las nuevas funciones como "pronunciación personalizada" y "anotación masiva" para realizar ajustes locales, logrando un modelo de producción flexible de "producir borradores en masa primero y luego hacer ajustes locales".

7 Yuan por 10.000 Caracteres: Liquidando una Cuenta Disruptiva
Wanzhuang Yousheng ha establecido un precio altamente competitivo: 7,9 yuanes por cada 10.000 caracteres para la actuación de voz con IA, 0,2 yuanes por cada 10.000 caracteres para la creación inteligente de guiones y tan solo 6,58 yuanes por cada 10.000 caracteres en compras al por mayor. Esto significa que el costo total para producir un audiolibro multi-voz de 10.000 caracteres es de solo 7-8 yuanes.
En comparación, los métodos tradicionales requieren entre 5.000 y 50.000 yuanes por un audiolibro; otras herramientas de IA en el mercado generalmente oscilan entre 10 y 15 yuanes por cada 10.000 caracteres. Para las plataformas de derechos de autor que posean miles de obras de IP de longitud media, el método tradicional requeriría una inversión de decenas o incluso cientos de millones de yuanes para la conversión completa a audiolibros. Incluso si solo se convirtiera el 10%, sería una carga pesada. Sin embargo, según los precios de Wanzhuang Yousheng, el costo de conversión a audiolibros de una novela de 500.000 caracteres sería de solo 350-400 yuanes. Una editorial de tamaño medio podría convertir toda una categoría de inventario en activos de audio por solo unas decenas de miles de yuanes.
Li Ji, fundador de Yuemei Culture, un destacado titular de derechos de autor en el campo de Xiangguan Xiaoshuo, comentó una vez cuando Wanzhuang Yousheng comenzó su prueba pública: "La actuación de voz con IA de Wanzhuang Yousheng ya se ha acercado al nivel de actuación humana real en la entrega emocional. Combinada con la creación inteligente de guiones y la alineación automática, puede producir audiolibros de nivel B+ o superior de manera estable".
Este estándar de calidad se transfirió a la línea de producción totalmente automática, convirtiendo la "calidad aceptable por línea de producción" en un requisito previo. El problema central restante se convierte entonces puramente en un cálculo económico.
Enfoque en el Sector B: Implicaciones Estratégicas del Motor de Doble Vía
Esta estación de trabajo totalmente automática se utilizó inicialmente internamente para demostrar la "supremacía técnica" a los titulares de derechos e inversores. Ahora, se ha comercializado, enviando una señal clara.
Esto marca la expansión del alcance de Wanzhuang Yousheng de "servir a creadores" a "servir a titulares de derechos", siendo estos últimos el grupo de clientes principal con una capacidad de pago significativa y una demanda urgente. El "motor de producción de doble vía" único de la plataforma no es simplemente una colección de funciones, sino que se basa en una profunda intuición de la industria: el mercado de audiolibros enfrenta simultáneamente dos necesidades aparentemente contradictorias: calidad premium y producción en masa. El verdadero cuello de botella radica en la falta de un sistema de producción estandarizado que pueda adaptarse dinámicamente a diferentes valores de contenido y demandas de producción.
· Para individuos o pequeños equipos, sirve como un "validador de contenido" eficiente, permitiendo que las novelas se transformen rápidamente en demos compartibles sin necesidad de un equipo profesional, lo que permite pruebas de mercado de bajo costo.
· Para plataformas de literatura en línea o instituciones de derechos de autor, aborda directamente el dilema de las obras de IP de longitud media "sin sabor pero difíciles de abandonar", despertando el inventario inactivo a un costo marginal mínimo y llenando rápidamente los vacíos de contenido.
· Para estudios de audio profesionales, abre un nuevo modelo "híbrido humano-máquina". Los personajes principales complejos y emocionales pueden dejarse a actores de voz reales, mientras que las narraciones y un gran número de roles de NPC pueden ser manejados por IA de alta calidad, garantizando la experiencia auditiva mientras se expande significativamente la capacidad de producción.
Las barreras de ingeniería detrás de ello, como un diccionario de corrección de errores de pronunciación de un millón de palabras, algoritmos de consistencia de personajes y tecnología de redibujado inteligente (que puede reducir el consumo de potencia de cálculo en un 90% para modificaciones locales), son el resultado de integrar profundamente la experiencia de producción de la industria de audiolibros. Esto no es solo una victoria tecnológica, sino también una definición clara de la ruta de industrialización de la producción de audio.
Habiendo probado con éxito la línea de producción interna, el equipo se atreve a entregar a clientes externos. Su alcance se ha expandido de "servir a creadores" a "servir a titulares de derechos", los verdaderos clientes con capacidades de pago al por mayor.
Para plataformas como Yewen y Qimao, o grupos editoriales tradicionales, la verdadera preocupación no es "si podemos crear un audiolibro de alta calidad", sino "con miles de obras en nuestra biblioteca, ¿cómo podemos convertirlas de manera rentable y a gran escala en contenido de audio?". Esta estación de trabajo totalmente automática les ofrece una línea de producción que pueden activar bajo demanda. No está destinada a creadores individuales.
Las instituciones de derechos de autor tienen ciclos de toma de decisiones largos, y se necesita tiempo desde el contacto inicial hasta la producción en volumen. Los editores tradicionales están acostumbrados a modelos de externalización, y cambiar a la automatización con IA requiere cambios en los procesos internos y el control de calidad. Sin embargo, el costo de producción de audiolibros está disminuyendo rápidamente. Cuando el costo de producir un audiolibro de 10.000 caracteres baja de miles de yuanes a solo unos pocos yuanes, la lógica de suministro de la industria cambiará inevitablemente.
Acerca de Wanzhuang Yousheng
Wanzhuang Yousheng (Audimind) fue fundada en 2024 por el antiguo equipo de gestión central de Lazy Listen. Es una plataforma integral de creación de contenido de audiolibros impulsada por IA. A través de su motor de producción de doble vía, la plataforma proporciona soluciones integrales que cubren todo el proceso de creación de audiolibros para creadores profesionales e instituciones de derechos de autor.
Sitio web: https://www.audimind.com/
Artículo relacionado
ZTE y Tencent forjan una alianza en la nube de IA con Work Buddy nativo
ZTE organizó un Día de Experiencia de Computadoras en la Nube de IA en Pekín, anunciando una asociación estratégica con Tencent para lanzar una nueva computadora en la nube de IA que cuenta con Work Buddy de Tencent. El mercado respondió rápidamente:
Cómo corregir las Core Web Vitals para mejorar el posicionamiento SEO
Cómo crear sitios web hermosos utilizando IA y Google SitesTabla de contenidos:IntroducciónDominio del diseño y creación web con Google SitesEl papel de la inteligencia artificial en el diseño web modernoConstrucción de un sitio con plantillas d
Anthropic apuesta fuerte por la capacidad de computación y planea un centro de datos de gigavatios en Australia
Los informes de la industria indican que Anthropic, un proveedor líder de grandes modelos de inteligencia artificial, tiene la intención de adquirir al menos 1,4 GW de capacidad de computación en centros de datos en Australia. Esta importante inversi
Recomendaciones de temas especiales relacionados
comentario (0)
0/500
Dos meses después de su beta pública, Wanzhuang Yousheng lanzó oficialmente su sistema de producción automatizada, "Creación de Audiolibros Multi-voz con IA Totalmente Automática", una función que ya había conquistado a los titulares de derechos durante las pruebas internas.
Lanzado por el equipo central detrás de Lazy Listen, esta plataforma de contenido de audio con IA completó su prueba pública de esta función estratégica a principios de junio. En el núcleo se encuentra una combinación de capacidades de IA probadas: división inteligente de capítulos, análisis de personajes, generación de guiones, actuación de voz multi-personaje y síntesis de postproducción, orquestadas por un motor de tareas para crear una línea de producción de audio digital automatizada capaz de funcionar "sin tripulación".
No se trata de un producto independiente, sino de una aplicación práctica de la estrategia del "motor de producción de doble vía" de la plataforma. Comparte la misma infraestructura técnica que el existing professional creation workbench de Wanzhuang Yousheng, pero opera en modo totalmente automático, abordando el desafío más crítico de la industria: cómo lograr un salto en la capacidad y una reducción de costos sin comprometer la calidad.

De "Manual" a "Piloto Automático": Un Motor, Dos Vías
La producción de audiolibros de alta calidad tradicional es un proceso manual largo y costoso que implica clasificación de manuscritos, división de capítulos, creación de guiones, casting, actuación de voz, alineación, mezcla de postproducción, controles de calidad y exportación. Producir un audiolibro multi-personaje de alta calidad puede llevar más de 30 días y costar desde miles hasta decenas de miles de yuanes.
La primera línea de productos de Wanzhuang Yousheng, "Vía Uno: Mejora de la Calidad", fue diseñada para resolver el problema de "hacerlo mejor".
Ofrece una herramienta de creación con IA de ciclo completo para estudios profesionales y equipos de actuación de voz. Módulos como la creación inteligente de guiones, la alineación inteligente y la escucha inteligente liberan a los creadores de tareas tediosas y repetitivas, permitiéndoles centrarse en la expresión artística. La lógica central sigue siendo la colaboración profunda entre humanos y máquinas.

La recién lanzada estación de trabajo de audiolibros multi-voz con IA totalmente automática pertenece a la "Vía Dos: Salto de Capacidad".
Su objetivo es completamente diferente: no está dirigido a creadores meticulosos, sino a clientes B-end como plataformas de literatura en línea e instituciones editoriales que poseen grandes cantidades de derechos de autor y necesitan convertir su inventario rápidamente. Su lógica es sencilla: utilizar una solución totalmente automatizada para resolver el desafío de escalabilidad de contenido masivo, de larga cola y sensible al ROI.
Después de que los usuarios suben los manuscritos, el sistema funciona como una fábrica digital súper eficiente: divide automáticamente los capítulos, analiza inteligentemente los personajes y empareja la mejor voz de IA, genera guiones con anotaciones emocionales y pronunciación precisa, utiliza casi mil tonos de voz optimizados para la narración multi-personaje y, finalmente, sintetiza el producto final con efectos de sonido. Después de la generación, el trabajo se transfiere a una interfaz de edición estándar, donde los usuarios pueden utilizar las nuevas funciones como "pronunciación personalizada" y "anotación masiva" para realizar ajustes locales, logrando un modelo de producción flexible de "producir borradores en masa primero y luego hacer ajustes locales".

7 Yuan por 10.000 Caracteres: Liquidando una Cuenta Disruptiva
Wanzhuang Yousheng ha establecido un precio altamente competitivo: 7,9 yuanes por cada 10.000 caracteres para la actuación de voz con IA, 0,2 yuanes por cada 10.000 caracteres para la creación inteligente de guiones y tan solo 6,58 yuanes por cada 10.000 caracteres en compras al por mayor. Esto significa que el costo total para producir un audiolibro multi-voz de 10.000 caracteres es de solo 7-8 yuanes.
En comparación, los métodos tradicionales requieren entre 5.000 y 50.000 yuanes por un audiolibro; otras herramientas de IA en el mercado generalmente oscilan entre 10 y 15 yuanes por cada 10.000 caracteres. Para las plataformas de derechos de autor que posean miles de obras de IP de longitud media, el método tradicional requeriría una inversión de decenas o incluso cientos de millones de yuanes para la conversión completa a audiolibros. Incluso si solo se convirtiera el 10%, sería una carga pesada. Sin embargo, según los precios de Wanzhuang Yousheng, el costo de conversión a audiolibros de una novela de 500.000 caracteres sería de solo 350-400 yuanes. Una editorial de tamaño medio podría convertir toda una categoría de inventario en activos de audio por solo unas decenas de miles de yuanes.
Li Ji, fundador de Yuemei Culture, un destacado titular de derechos de autor en el campo de Xiangguan Xiaoshuo, comentó una vez cuando Wanzhuang Yousheng comenzó su prueba pública: "La actuación de voz con IA de Wanzhuang Yousheng ya se ha acercado al nivel de actuación humana real en la entrega emocional. Combinada con la creación inteligente de guiones y la alineación automática, puede producir audiolibros de nivel B+ o superior de manera estable".
Este estándar de calidad se transfirió a la línea de producción totalmente automática, convirtiendo la "calidad aceptable por línea de producción" en un requisito previo. El problema central restante se convierte entonces puramente en un cálculo económico.
Enfoque en el Sector B: Implicaciones Estratégicas del Motor de Doble Vía
Esta estación de trabajo totalmente automática se utilizó inicialmente internamente para demostrar la "supremacía técnica" a los titulares de derechos e inversores. Ahora, se ha comercializado, enviando una señal clara.
Esto marca la expansión del alcance de Wanzhuang Yousheng de "servir a creadores" a "servir a titulares de derechos", siendo estos últimos el grupo de clientes principal con una capacidad de pago significativa y una demanda urgente. El "motor de producción de doble vía" único de la plataforma no es simplemente una colección de funciones, sino que se basa en una profunda intuición de la industria: el mercado de audiolibros enfrenta simultáneamente dos necesidades aparentemente contradictorias: calidad premium y producción en masa. El verdadero cuello de botella radica en la falta de un sistema de producción estandarizado que pueda adaptarse dinámicamente a diferentes valores de contenido y demandas de producción.
· Para individuos o pequeños equipos, sirve como un "validador de contenido" eficiente, permitiendo que las novelas se transformen rápidamente en demos compartibles sin necesidad de un equipo profesional, lo que permite pruebas de mercado de bajo costo.
· Para plataformas de literatura en línea o instituciones de derechos de autor, aborda directamente el dilema de las obras de IP de longitud media "sin sabor pero difíciles de abandonar", despertando el inventario inactivo a un costo marginal mínimo y llenando rápidamente los vacíos de contenido.
· Para estudios de audio profesionales, abre un nuevo modelo "híbrido humano-máquina". Los personajes principales complejos y emocionales pueden dejarse a actores de voz reales, mientras que las narraciones y un gran número de roles de NPC pueden ser manejados por IA de alta calidad, garantizando la experiencia auditiva mientras se expande significativamente la capacidad de producción.
Las barreras de ingeniería detrás de ello, como un diccionario de corrección de errores de pronunciación de un millón de palabras, algoritmos de consistencia de personajes y tecnología de redibujado inteligente (que puede reducir el consumo de potencia de cálculo en un 90% para modificaciones locales), son el resultado de integrar profundamente la experiencia de producción de la industria de audiolibros. Esto no es solo una victoria tecnológica, sino también una definición clara de la ruta de industrialización de la producción de audio.
Habiendo probado con éxito la línea de producción interna, el equipo se atreve a entregar a clientes externos. Su alcance se ha expandido de "servir a creadores" a "servir a titulares de derechos", los verdaderos clientes con capacidades de pago al por mayor.
Para plataformas como Yewen y Qimao, o grupos editoriales tradicionales, la verdadera preocupación no es "si podemos crear un audiolibro de alta calidad", sino "con miles de obras en nuestra biblioteca, ¿cómo podemos convertirlas de manera rentable y a gran escala en contenido de audio?". Esta estación de trabajo totalmente automática les ofrece una línea de producción que pueden activar bajo demanda. No está destinada a creadores individuales.
Las instituciones de derechos de autor tienen ciclos de toma de decisiones largos, y se necesita tiempo desde el contacto inicial hasta la producción en volumen. Los editores tradicionales están acostumbrados a modelos de externalización, y cambiar a la automatización con IA requiere cambios en los procesos internos y el control de calidad. Sin embargo, el costo de producción de audiolibros está disminuyendo rápidamente. Cuando el costo de producir un audiolibro de 10.000 caracteres baja de miles de yuanes a solo unos pocos yuanes, la lógica de suministro de la industria cambiará inevitablemente.
Acerca de Wanzhuang Yousheng
Wanzhuang Yousheng (Audimind) fue fundada en 2024 por el antiguo equipo de gestión central de Lazy Listen. Es una plataforma integral de creación de contenido de audiolibros impulsada por IA. A través de su motor de producción de doble vía, la plataforma proporciona soluciones integrales que cubren todo el proceso de creación de audiolibros para creadores profesionales e instituciones de derechos de autor.
Sitio web: https://www.audimind.com/
ZTE y Tencent forjan una alianza en la nube de IA con Work Buddy nativo
ZTE organizó un Día de Experiencia de Computadoras en la Nube de IA en Pekín, anunciando una asociación estratégica con Tencent para lanzar una nueva computadora en la nube de IA que cuenta con Work Buddy de Tencent. El mercado respondió rápidamente:
Cómo corregir las Core Web Vitals para mejorar el posicionamiento SEO
Cómo crear sitios web hermosos utilizando IA y Google SitesTabla de contenidos:IntroducciónDominio del diseño y creación web con Google SitesEl papel de la inteligencia artificial en el diseño web modernoConstrucción de un sitio con plantillas d
Anthropic apuesta fuerte por la capacidad de computación y planea un centro de datos de gigavatios en Australia
Los informes de la industria indican que Anthropic, un proveedor líder de grandes modelos de inteligencia artificial, tiene la intención de adquirir al menos 1,4 GW de capacidad de computación en centros de datos en Australia. Esta importante inversi











