Wanxiang Shengsheng, 1만 자당 8위안 미만으로 저비용 AI 오디오북 도구를 공개하다
공개 베타 서비스 개시 2개월 후, 완좡유셩(Wanzhuang Yousheng)은 내부 시연 과정에서 이미 저작권 holders들의 호평을 받았던 '완전 자동화 AI 다성형 오디오북 제작' 자동화 생산 시스템을 정식 출시했다.
레이지 리슨(Lazy Listen)의 핵심 팀이 론칭한 이 AI 오디오 콘텐츠 플랫폼은 전략적 기능의 공개 테스트를 6월 초에 완료했다. 이 시스템의 핵심에는 검증된 AI 기술들의 결합이 자리 잡고 있으며, 이는 지능형 장 분리, 캐릭터 분석, 대본 생성, 다성형 성우 연기, 후반 제작 합성 등의 기능을 하나의 작업 엔진이 조율하여 '무인'으로 운영될 수 있는 자동화된 디지털 오디오 생산 라인을 구축한다.
이는 독립적인 제품이 아니라, 플랫폼의 '듀얼 트랙 생산 엔진' 전략의 실용적 적용이다. 기존 전문 창작 워크벤치와 동일한 기술 인프라를 공유하지만, 완전히 자동화된 모드에서 작동하며 업계의 가장 중요한 과제를 해결한다: 품질 저하 없이 용량 증대 및 비용 절감의 도약을如何实现할 것인가.

"수동"에서 "자동 조종"으로: 하나의 엔진, 두 개의 트랙
전통적인 고품질 오디오북 제작은 원고 정리, 장 분리, 대본 작성, 캐스팅, 성우 연기, 정렬, 후반 제작 믹싱, 품질 검사, 내보내기 등 긴 시간과 비용이 소요되는 수작업 과정이다. 고품질 다성형 오디오북 하나를 제작하는 데에는 30일 이상 소요되며, 비용은 수천 위안에서 수만 위안에 이른다.
완좡유셩의 첫 번째 제품 라인, '트랙 1: 품질 향상'은 "더 잘 만드는" 문제를 해결하기 위해 설계되었다.
이 라인은 전문 스튜디오와 성우 팀을 위한 전 주기 AI 창작 도구를 제공한다. 지능형 대본 생성, 지능형 정렬, 지능형 청취 등의 모듈은 창작자들을 번거롭고 반복적인 노동에서 해방시켜 예술적 표현에 집중할 수 있도록 한다. 핵심 논리는 여전히 심층적인 인간-기계 협업에 있다.

새로 출시된 완전 자동화 AI 다성형 오디오북 워크스테이션은 '트랙 2: 용량 도약'에 속한다.
그 목표는 완전히 다르다. 이는 세심한 창작자를 위한 것이 아니라, 대량의 저작권을 보유하고 재고를 빠르게 전환해야 하는 온라인 문학 플랫폼이나 출판 기관과 같은 B-end 고객을 위한 것이다. 그 논리는 명확하다 — 대규모, 롱테일, ROI(투자 대비 수익률) 민감성 콘텐츠의 확장성 문제를 완전 자동화된 솔루션으로 해결한다.
사용자가 원고를 업로드하면, 시스템은 초급 디지털 공장처럼 작동한다: 장을 자동으로 분리하고, 캐릭터를 지능적으로 분석하여 최적의 AI 성우를 매칭하며, 감정 주석과 정확한 발음이 포함된 대본을 생성하고, 수백 가지 최적화된 성조로 다성형 내레이션을 수행한 뒤, 음향 효과와 최종 제품을 합성한다. 생성이 완료되면 표준 편집 인터페이스로 작업이 전달되며, 사용자는 새로 출시된 '맞춤 발음' 및 '일괄 주석 달기' 기능을 사용하여 로컬 수정을 수행할 수 있어, "먼저 대량으로 초안을 만들고 이후 로컬 조정"이라는 유연한 생산 모델을 실현한다.

만 자당 7위안: 파괴적 계정 정리
완좡유셩은 매우 경쟁력 있는 가격을 책정했다. AI 성우 연기는 만 자당 7.9위안, 지능형 대본 생성은 만 자당 0.2위안이며, 대량 구매 시에는 만 자당 최저 6.58위안이다. 이는 즉, 만 자 분량의 다성형 오디오북 제작 총비용이 단 7~8위안이라는 의미이다.
비교하자면, 전통적인 방식은 오디오북 하나당 5,000위안에서 50,000위안이 소요되며, 시장상의 다른 AI 도구들은 일반적으로 만 자당 10~15위안 선이다. 수천 편의 중장편 IP 작품을 보유한 저작권 플랫폼에게 전통적인 방식은 전체 오디오북 전환에 수천만 위안에서 수억 위안의 투자가 필요하다. 심지어 10%만 전환해도 이는 막중한 부담이다. 그러나 완좡유셩의 가격 책정에 따르면, 50만 자 분량의 소설 오디오북 전환 비용은 단 350~400위안에 불과하다. 중형 출판사라면 수만 위안으로 전체 카테고리의 재고를 오디오 자산으로 전환할 수 있다.
향관 소설 분야의 주요 저작권 holder인 위메이 문화(Yuemei Culture)의 설립자 리지(Li Ji)는 완좡유셩의 공개 테스트 개시 당시 다음과 같이 언급했다: "완좡유셩의 AI 성우 연기는 이미 감정 전달 측면에서 실제 인간 연극 수준에 근접했다. 지능형 대본 생성 및 자동 정렬과 결합하면 B+ 등급 이상의 오디오북을 안정적으로 생산할 수 있다."
이 품질 기준은 완전 자동화 생산 라인으로 이전되었으며, '생산 라인당 허용 가능한 품질'이 전제 조건이 되었다. 남은 핵심 문제는 순수하게 경제적 계산에 불과해진다.
B-end 집중: 듀얼 트랙 엔진의 전략적 함의
이 완전 자동화 워크스테이션은 초기에 저작권 holders와 투자자들에게 '기술적 우위'를 입증하기 위해 내부적으로 사용되었다. 이제 상용화됨으로써 명확한 신호를 보낸다.
이는 완좡유셩의 범위가 '창작자 서비스'에서 '저작권 holder 서비스'로 확장되었음을 의미한다. 후자는 상당한 지불 능력과 긴박한 수요를 가진 핵심 고객 그룹이다. 플랫폼의 독특한 '듀얼 트랙 생산 엔진'은 단순한 기능 모음이 아니라, 오디오북 시장이 프리미엄 품질과 대량 생산이라는 서로 모순되어 보이는 두 가지 필요를 동시에 안고 있다는 깊은 산업 통찰에 기반한다. 진정한 병목 현상은 서로 다른 콘텐츠 가치와 생산 요구에 동적으로 적응할 수 있는 표준화된 생산 시스템의 부재에 있다.
· 개인 또는 소규모 팀에게 이는 효율적인 '콘텐츠 검증기' 역할을 하며, 전문 팀 없이도 소설을 빠르게 공유 가능한 데모로 변환하여 저비용 시장 테스트를 가능하게 한다.
· 온라인 문학 플랫폼 또는 저작권 기관에게 이는 '맛없지만 버리기 어려운' 중장편 IP 작품의 딜레마를 직접적으로 해결하며, 최소한의 한계 비용으로 잠재 재고를 깨우고 콘텐츠 공백을 빠르게 채운다.
· 전문 오디오 스튜디오에게 이는 새로운 '인간-기계 하이브리드' 모델을 개방한다. 복잡한 감정의 주요 캐릭터는 실제 성우에게 맡기고, 내레이션과 다수의 NPC 역할은 고품질 AI가 처리하여 청각적 경험을 보장하면서도 생산 용량을 크게 확장한다.
백만 자 분량의 발음 오류 수정 사전, 캐릭터 일관성 알고리즘, 지능형 재그림 기술(로컬 수정 시 컴퓨팅 전력 소비를 90% 절감)과 같은 그 이면에 있는 엔지니어링 장벽은 오디오북 산업 생산 경험과의 심층적 통합 결과이다. 이는 기술적 승리에 불과하지 않으며, 오디오 생산의 산업화 경로에 대한 명확한 정의이기도 하다.
내부 생산 라인의 성공적인 테스트를 거친 후, 팀은 외부 클라이언트에게 납품할 용기를 얻었다. 그들의 범위가 '창작자 서비스'에서 '저작권 holder 서비스', 즉 대량 지불 능력을 가진 진정한 고객으로 확장되었다.
예원(Yewen)이나 치마오(Qimao) 같은 플랫폼, 또는 전통적인 출판 그룹에게 진정한 우려는 '고품질 오디오북을 만들 수 있는가'가 아니라, "수천 편의 작품이 있는 라이브러리에서 어떻게 비용 효율적이고 대규모로 오디오 콘텐츠로 전환할 것인가"이다. 이 완전 자동화 워크스테이션은 필요할 때 활성화할 수 있는 생산 라인을 제공한다. 이는 개별 창작자를 위한 것이 아니다.
저작권 기관은 긴 의사 결정 주기를 가지고 있으며, 초기 접촉부터 대량 생산까지 시간이 소요된다. 전통적인 출판사는 아웃소싱 모델에 익숙하며, AI 자동화로 전환하려면 내부 프로세스와 품질 관리 변경이 필요하다. 그러나 오디오북 생산 비용은 빠르게 감소하고 있다. 만 자 분량의 오디오북 제작 비용이 수천 위안에서 단 몇 위안으로 떨어지면, 업계의 공급 논법은 필연적으로 변화할 것이다.
완좡유셩(Wanzhuang Yousheng) 소개
완좡유셩(Audimind)은 2024년 레이지 리슨의 전 핵심 관리 팀에 의해 설립되었다. 이는 오디오북 콘텐츠 창작을 위한 AI 기반 원스톱 플랫폼이다. 듀얼 트랙 생산 엔진을 통해 이 플랫폼은 전문 창작자와 저작권 기관을 위한 오디오북 제작 전 과정을 포괄하는 종합 솔루션을 제공한다.
관련 기사
Core Web Vitals를 수정하여 SEO 랭킹을 개선하는 방법
AI와 Google Sites를 사용하여 아름다운 웹사이트 구축 방법목차:서론Google Sites로 웹 디자인 및 제작 마스터하기현대 웹 디자인에서 인공 지능의 역할Google 템플릿으로 사이트 구축Micro와 같은 AI 도구로 디자인 활용하기ChatGPT로 콘텐츠 및 카피 생성하기자연어 생성으로 슬로건 만들기저작권이 없는 이미지 소싱하기이미지 변환기로 그래픽 향상시키기모바일 반응형 보장하기이 가이드는 Google Sit
Anthropic은 컴퓨팅 파워에 큰 베팅을 하고 있으며, 호주에서 기가와트급 데이터 센터를 계획하고 있습니다.
산업 보고서에 따르면, 선도적인 AI 대규모 모델 제공업체인 앤트로픽(Anthropic)은 호주에서 최소 1.4GW의 데이터센터 컴퓨팅 용량을 인수할 의도인 것으로 나타났다. 이 대규모 투자는 약 150억 달러(약 216억 호주달러)로 추정되며, 기존 시장 전망을 크게 상회한다.관계자들은 앤트로픽이 2027년 말까지 최소 1GW의 컴퓨팅 자원을 가동하기 위한 명확한 일정을 수립했다고 밝혔다. 프로젝트 효율성과 원활한 실행을 보장하기 위해 해당
화이트 해커들이 Claude를 활용해 OpenAI 직원들의 ChatGPT 계정에 침입했으며, 6,500달러의 바운티를 청구했다고 주장한다.
9월 18일, 월스트리트저널은 독립 보안 연구자들이 Anthropic의 Claude를 통해 OpenAI 직원들의 ChatGPT 계정에 침입하여 회사의 비공개 소프트웨어 코드 저장소에 접근했다고 보도했다.Hacktron AI라는 보안 회사를 대표하는 이 팀은 이전에 OpenAI의 버그 바운티 프로그램에 참여한 바 있다. 그들은 취약점을 식별한 후 즉시 OpenAI에 보고했으며, 이에 대해 OpenAI는 6,500달러(약 43,692위안)의 바운
관련 특별 주제 추천
의견 (0)
0/500
공개 베타 서비스 개시 2개월 후, 완좡유셩(Wanzhuang Yousheng)은 내부 시연 과정에서 이미 저작권 holders들의 호평을 받았던 '완전 자동화 AI 다성형 오디오북 제작' 자동화 생산 시스템을 정식 출시했다.
레이지 리슨(Lazy Listen)의 핵심 팀이 론칭한 이 AI 오디오 콘텐츠 플랫폼은 전략적 기능의 공개 테스트를 6월 초에 완료했다. 이 시스템의 핵심에는 검증된 AI 기술들의 결합이 자리 잡고 있으며, 이는 지능형 장 분리, 캐릭터 분석, 대본 생성, 다성형 성우 연기, 후반 제작 합성 등의 기능을 하나의 작업 엔진이 조율하여 '무인'으로 운영될 수 있는 자동화된 디지털 오디오 생산 라인을 구축한다.
이는 독립적인 제품이 아니라, 플랫폼의 '듀얼 트랙 생산 엔진' 전략의 실용적 적용이다. 기존 전문 창작 워크벤치와 동일한 기술 인프라를 공유하지만, 완전히 자동화된 모드에서 작동하며 업계의 가장 중요한 과제를 해결한다: 품질 저하 없이 용량 증대 및 비용 절감의 도약을如何实现할 것인가.

"수동"에서 "자동 조종"으로: 하나의 엔진, 두 개의 트랙
전통적인 고품질 오디오북 제작은 원고 정리, 장 분리, 대본 작성, 캐스팅, 성우 연기, 정렬, 후반 제작 믹싱, 품질 검사, 내보내기 등 긴 시간과 비용이 소요되는 수작업 과정이다. 고품질 다성형 오디오북 하나를 제작하는 데에는 30일 이상 소요되며, 비용은 수천 위안에서 수만 위안에 이른다.
완좡유셩의 첫 번째 제품 라인, '트랙 1: 품질 향상'은 "더 잘 만드는" 문제를 해결하기 위해 설계되었다.
이 라인은 전문 스튜디오와 성우 팀을 위한 전 주기 AI 창작 도구를 제공한다. 지능형 대본 생성, 지능형 정렬, 지능형 청취 등의 모듈은 창작자들을 번거롭고 반복적인 노동에서 해방시켜 예술적 표현에 집중할 수 있도록 한다. 핵심 논리는 여전히 심층적인 인간-기계 협업에 있다.

새로 출시된 완전 자동화 AI 다성형 오디오북 워크스테이션은 '트랙 2: 용량 도약'에 속한다.
그 목표는 완전히 다르다. 이는 세심한 창작자를 위한 것이 아니라, 대량의 저작권을 보유하고 재고를 빠르게 전환해야 하는 온라인 문학 플랫폼이나 출판 기관과 같은 B-end 고객을 위한 것이다. 그 논리는 명확하다 — 대규모, 롱테일, ROI(투자 대비 수익률) 민감성 콘텐츠의 확장성 문제를 완전 자동화된 솔루션으로 해결한다.
사용자가 원고를 업로드하면, 시스템은 초급 디지털 공장처럼 작동한다: 장을 자동으로 분리하고, 캐릭터를 지능적으로 분석하여 최적의 AI 성우를 매칭하며, 감정 주석과 정확한 발음이 포함된 대본을 생성하고, 수백 가지 최적화된 성조로 다성형 내레이션을 수행한 뒤, 음향 효과와 최종 제품을 합성한다. 생성이 완료되면 표준 편집 인터페이스로 작업이 전달되며, 사용자는 새로 출시된 '맞춤 발음' 및 '일괄 주석 달기' 기능을 사용하여 로컬 수정을 수행할 수 있어, "먼저 대량으로 초안을 만들고 이후 로컬 조정"이라는 유연한 생산 모델을 실현한다.

만 자당 7위안: 파괴적 계정 정리
완좡유셩은 매우 경쟁력 있는 가격을 책정했다. AI 성우 연기는 만 자당 7.9위안, 지능형 대본 생성은 만 자당 0.2위안이며, 대량 구매 시에는 만 자당 최저 6.58위안이다. 이는 즉, 만 자 분량의 다성형 오디오북 제작 총비용이 단 7~8위안이라는 의미이다.
비교하자면, 전통적인 방식은 오디오북 하나당 5,000위안에서 50,000위안이 소요되며, 시장상의 다른 AI 도구들은 일반적으로 만 자당 10~15위안 선이다. 수천 편의 중장편 IP 작품을 보유한 저작권 플랫폼에게 전통적인 방식은 전체 오디오북 전환에 수천만 위안에서 수억 위안의 투자가 필요하다. 심지어 10%만 전환해도 이는 막중한 부담이다. 그러나 완좡유셩의 가격 책정에 따르면, 50만 자 분량의 소설 오디오북 전환 비용은 단 350~400위안에 불과하다. 중형 출판사라면 수만 위안으로 전체 카테고리의 재고를 오디오 자산으로 전환할 수 있다.
향관 소설 분야의 주요 저작권 holder인 위메이 문화(Yuemei Culture)의 설립자 리지(Li Ji)는 완좡유셩의 공개 테스트 개시 당시 다음과 같이 언급했다: "완좡유셩의 AI 성우 연기는 이미 감정 전달 측면에서 실제 인간 연극 수준에 근접했다. 지능형 대본 생성 및 자동 정렬과 결합하면 B+ 등급 이상의 오디오북을 안정적으로 생산할 수 있다."
이 품질 기준은 완전 자동화 생산 라인으로 이전되었으며, '생산 라인당 허용 가능한 품질'이 전제 조건이 되었다. 남은 핵심 문제는 순수하게 경제적 계산에 불과해진다.
B-end 집중: 듀얼 트랙 엔진의 전략적 함의
이 완전 자동화 워크스테이션은 초기에 저작권 holders와 투자자들에게 '기술적 우위'를 입증하기 위해 내부적으로 사용되었다. 이제 상용화됨으로써 명확한 신호를 보낸다.
이는 완좡유셩의 범위가 '창작자 서비스'에서 '저작권 holder 서비스'로 확장되었음을 의미한다. 후자는 상당한 지불 능력과 긴박한 수요를 가진 핵심 고객 그룹이다. 플랫폼의 독특한 '듀얼 트랙 생산 엔진'은 단순한 기능 모음이 아니라, 오디오북 시장이 프리미엄 품질과 대량 생산이라는 서로 모순되어 보이는 두 가지 필요를 동시에 안고 있다는 깊은 산업 통찰에 기반한다. 진정한 병목 현상은 서로 다른 콘텐츠 가치와 생산 요구에 동적으로 적응할 수 있는 표준화된 생산 시스템의 부재에 있다.
· 개인 또는 소규모 팀에게 이는 효율적인 '콘텐츠 검증기' 역할을 하며, 전문 팀 없이도 소설을 빠르게 공유 가능한 데모로 변환하여 저비용 시장 테스트를 가능하게 한다.
· 온라인 문학 플랫폼 또는 저작권 기관에게 이는 '맛없지만 버리기 어려운' 중장편 IP 작품의 딜레마를 직접적으로 해결하며, 최소한의 한계 비용으로 잠재 재고를 깨우고 콘텐츠 공백을 빠르게 채운다.
· 전문 오디오 스튜디오에게 이는 새로운 '인간-기계 하이브리드' 모델을 개방한다. 복잡한 감정의 주요 캐릭터는 실제 성우에게 맡기고, 내레이션과 다수의 NPC 역할은 고품질 AI가 처리하여 청각적 경험을 보장하면서도 생산 용량을 크게 확장한다.
백만 자 분량의 발음 오류 수정 사전, 캐릭터 일관성 알고리즘, 지능형 재그림 기술(로컬 수정 시 컴퓨팅 전력 소비를 90% 절감)과 같은 그 이면에 있는 엔지니어링 장벽은 오디오북 산업 생산 경험과의 심층적 통합 결과이다. 이는 기술적 승리에 불과하지 않으며, 오디오 생산의 산업화 경로에 대한 명확한 정의이기도 하다.
내부 생산 라인의 성공적인 테스트를 거친 후, 팀은 외부 클라이언트에게 납품할 용기를 얻었다. 그들의 범위가 '창작자 서비스'에서 '저작권 holder 서비스', 즉 대량 지불 능력을 가진 진정한 고객으로 확장되었다.
예원(Yewen)이나 치마오(Qimao) 같은 플랫폼, 또는 전통적인 출판 그룹에게 진정한 우려는 '고품질 오디오북을 만들 수 있는가'가 아니라, "수천 편의 작품이 있는 라이브러리에서 어떻게 비용 효율적이고 대규모로 오디오 콘텐츠로 전환할 것인가"이다. 이 완전 자동화 워크스테이션은 필요할 때 활성화할 수 있는 생산 라인을 제공한다. 이는 개별 창작자를 위한 것이 아니다.
저작권 기관은 긴 의사 결정 주기를 가지고 있으며, 초기 접촉부터 대량 생산까지 시간이 소요된다. 전통적인 출판사는 아웃소싱 모델에 익숙하며, AI 자동화로 전환하려면 내부 프로세스와 품질 관리 변경이 필요하다. 그러나 오디오북 생산 비용은 빠르게 감소하고 있다. 만 자 분량의 오디오북 제작 비용이 수천 위안에서 단 몇 위안으로 떨어지면, 업계의 공급 논법은 필연적으로 변화할 것이다.
완좡유셩(Wanzhuang Yousheng) 소개
완좡유셩(Audimind)은 2024년 레이지 리슨의 전 핵심 관리 팀에 의해 설립되었다. 이는 오디오북 콘텐츠 창작을 위한 AI 기반 원스톱 플랫폼이다. 듀얼 트랙 생산 엔진을 통해 이 플랫폼은 전문 창작자와 저작권 기관을 위한 오디오북 제작 전 과정을 포괄하는 종합 솔루션을 제공한다.
Core Web Vitals를 수정하여 SEO 랭킹을 개선하는 방법
AI와 Google Sites를 사용하여 아름다운 웹사이트 구축 방법목차:서론Google Sites로 웹 디자인 및 제작 마스터하기현대 웹 디자인에서 인공 지능의 역할Google 템플릿으로 사이트 구축Micro와 같은 AI 도구로 디자인 활용하기ChatGPT로 콘텐츠 및 카피 생성하기자연어 생성으로 슬로건 만들기저작권이 없는 이미지 소싱하기이미지 변환기로 그래픽 향상시키기모바일 반응형 보장하기이 가이드는 Google Sit
Anthropic은 컴퓨팅 파워에 큰 베팅을 하고 있으며, 호주에서 기가와트급 데이터 센터를 계획하고 있습니다.
산업 보고서에 따르면, 선도적인 AI 대규모 모델 제공업체인 앤트로픽(Anthropic)은 호주에서 최소 1.4GW의 데이터센터 컴퓨팅 용량을 인수할 의도인 것으로 나타났다. 이 대규모 투자는 약 150억 달러(약 216억 호주달러)로 추정되며, 기존 시장 전망을 크게 상회한다.관계자들은 앤트로픽이 2027년 말까지 최소 1GW의 컴퓨팅 자원을 가동하기 위한 명확한 일정을 수립했다고 밝혔다. 프로젝트 효율성과 원활한 실행을 보장하기 위해 해당
화이트 해커들이 Claude를 활용해 OpenAI 직원들의 ChatGPT 계정에 침입했으며, 6,500달러의 바운티를 청구했다고 주장한다.
9월 18일, 월스트리트저널은 독립 보안 연구자들이 Anthropic의 Claude를 통해 OpenAI 직원들의 ChatGPT 계정에 침입하여 회사의 비공개 소프트웨어 코드 저장소에 접근했다고 보도했다.Hacktron AI라는 보안 회사를 대표하는 이 팀은 이전에 OpenAI의 버그 바운티 프로그램에 참여한 바 있다. 그들은 취약점을 식별한 후 즉시 OpenAI에 보고했으며, 이에 대해 OpenAI는 6,500달러(약 43,692위안)의 바운





집






