Podcastle은 450+ AI 음성으로 텍스트 음성 연설을 공개합니다
Podcastle, 팟캐스트 녹음 및 편집으로 유명한 플랫폼, AI 텍스트-음성 변환 게임에 Asyncflow v1.0 모델로 뛰어들었다. 여기서 멈추지 않고 개발자를 위한 API도 출시, 이 기술을 앱에 쉽게 통합할 수 있게 했다.
Asyncflow v1.0으로 Podcastle은 450개 이상의 AI 음성을 제공, 텍스트를 소리 내어 읽는다. 멋진 점? 훈련 및 추론 비용을 낮춰 경쟁에서 우위를 점했다.
Podcastle은 ElevenLabs, Speechify, WellSaid 같은 스타트업과 같은 리그에 합류, 모두 AI를 활용해 텍스트를 음성으로 변환한다. 이 기술은 마케팅, 광고, 콘텐츠 제작, 교육, 직장 내 훈련 등 다양한 분야에 적용된다.
Podcastle의 창립자 Arto Yeritsyan은 TechCrunch에 텍스트-음성 변환에 오랫동안 뛰어들고 싶었다고 밝혔다. 문제는 비용과 데이터 요구량이 너무 컸다는 것. 하지만 최근 대형 언어 모델의 돌파구 덕분에 작년에 마침내 성공했다. "우리는 처음부터 탄탄한 텍스트-음성 모델을 구축하려 했다," Yeritsyan은 말했다. "하지만 비용이 엄청났다. 최신 기술로 우리는 많은 데이터 없이도 최고 수준의 음성 모델을 만들 방법을 찾았다."
작년 1,350만 달러의 시리즈 A 펀딩도 이 프로젝트를 뒷받침했다.
가격 면에서 Podcastle은 경쟁력 있다. 500분 텍스트-음성 변환에 약 40달러를 부과, ElevenLabs는 같은 양에 99달러를 요구한다.
Podcastle의 음성 복제 기능도 개선, 훈련 과정을 훨씬 빠르게 했다. 이전에는 시스템 훈련을 위해 약 70문장을 읽어야 했다. 이제는 몇 초의 음성만으로 충분하다. 작년에 출시한 Magic Dust AI를 사용해 이 새로운 과정에서 오디오 품질을 향상시켰다.

우리가 테스트했을 때 음성은 약간 로봇 같았지만, 톤은 꽤 잘 잡아냈다. Podcastle은 더 나아지도록 노력 중이라고 밝혔다. 다양한 음성 샘플로 시스템을 훈련해 다양한 결과를 얻을 수도 있다.
Podcastle은 비용 절감 외에도 오디오, 비디오 도구, 팟캐스트, AI 내레이션을 한 곳에서 제공하는 것이 경쟁에서 차별화될 것이라고 본다. Yeritsyan은 대부분의 사용자가 오디오 콘텐츠에 집중하지만, 비디오도 점차 주목받고 있다고 언급했다.
관련 기사
워너 뮤직이 AI 귀속 스타트업 서룰 AI를 인수하다
워너 뮤직 그룹(WMG)은 수요일 Sureel AI라는 인공지능 속성 추적 스타트업을 인수한다고 확인했다. Sureel의 독점 기술은 음악 트랙에 대한 ‘AI DNA’를 생성하며, 이를 구성 요소로 분해하여 AI 모델이 이러한 요소를 어떻게 활용하는지 추적한다.이번 인수를 통해 WMG는 아티스트와 작곡가의 작품이 AI 생성 콘텐츠에서 어떻게 활용되거나 AI 모델 학습에 사용되는지를 모니터링하는 능력을 강화할 계획이다.“Sureel을 WMG에
아마존은 쇼핑용 알렉사를 출시하면서 루푸스를 후순위로 밀어붙이고 있다
아마존은 Alexa for Shopping을 출시하며, Rufus 쇼핑 챗봇과 Alexa+를 앱, 웹사이트 및 Echo Show 기기 전반에 걸쳐 통합했습니다.이 도우미는 제품 문의에 답변하고, 상품을 비교하며, 가격을 추적하고, 쇼핑 알림을 지원합니다. 또한 예약된 쇼핑 작업과 자격이 있는 자동 구매도 처리합니다.회사에 따르면, Alexa for Shopping은 Rufus의 제품 전문성과 Alexa+의 개인화된 도우미 컨텍스트를 결합합니
마이크로소프트, 애저, AI 기술이 캘리포니아 산불 위험에 맞서다
마이크로소프트는 AI 기반 산불 탐지 기술에 투자하고 있으며, CVP 겸 수석 데이터 과학자인 후안 라비스타 페레스가 환경 피해 완화 전략을 논의하고 있다.NASA에 따르면, 기후 변화는 지구상의 모든 사람에게 영향을 미치며, 기온 상승, 강수 패턴의 변화, 해수면 상승 등의 형태로 나타납니다.NASA는 인간 활동이 주된 원인으로 작용하여 지구가 전례 없는
관련 특별 주제 추천
의견 (31)
0/500
¡Vaya sorpresa con Podcastle! 450+ voces de IA suena a ciencia ficción. Me pregunto cómo afectará esto a los narradores humanos, ¿serán reemplazados o se abrirán nuevas oportunidades creativas? 😮
Podcastle's new text-to-speech with 450+ AI voices is mind-blowing! The variety is insane, but some voices sound a bit robotic. Still, it's a game-changer for podcast creators. Can't wait to see how it evolves! 🚀
¡El nuevo texto a voz de Podcastle con más de 450 voces de IA es impresionante! La variedad es increíble, pero algunas voces suenan un poco robóticas. Aún así, es un cambio de juego para los creadores de podcasts. ¡No puedo esperar para ver cómo evoluciona esto! 🚀
Tính năng chuyển văn bản thành giọng nói mới của Podcastle với hơn 450 giọng nói AI thật tuyệt vời! Giọng nói nghe rất tự nhiên, giống như có một người dẫn chuyên nghiệp cho podcast của bạn. Điểm trừ duy nhất là một số giọng nói có thể hơi cứng nhắc, nhưng nhìn chung, đây là công cụ không thể thiếu cho bất kỳ podcaster nào muốn nâng cao trò chơi của mình! 😎
Podcastles neue Text-zu-Sprache-Funktion mit über 450 KI-Stimmen ist der Wahnsinn! Die Stimmen klingen so natürlich, als hätte man einen professionellen Sprecher für sein Podcast. Das einzige Manko sind einige Stimmen, die ein bisschen roboterhaft klingen, aber insgesamt ist es ein Muss für jeden Podcaster, der sein Spiel auf die nächste Stufe heben möchte! 😎
¡El nuevo texto a voz de Podcastle con más de 450 voces de IA es increíble! Las voces suenan tan naturales, es como tener un narrador profesional para tu podcast. Lo único malo es que algunas voces pueden sonar un poco robóticas, pero en general, es una herramienta imprescindible para cualquier podcaster que quiera mejorar su juego. ¡Genial! 😎
Podcastle, 팟캐스트 녹음 및 편집으로 유명한 플랫폼, AI 텍스트-음성 변환 게임에 Asyncflow v1.0 모델로 뛰어들었다. 여기서 멈추지 않고 개발자를 위한 API도 출시, 이 기술을 앱에 쉽게 통합할 수 있게 했다.
Asyncflow v1.0으로 Podcastle은 450개 이상의 AI 음성을 제공, 텍스트를 소리 내어 읽는다. 멋진 점? 훈련 및 추론 비용을 낮춰 경쟁에서 우위를 점했다.
Podcastle은 ElevenLabs, Speechify, WellSaid 같은 스타트업과 같은 리그에 합류, 모두 AI를 활용해 텍스트를 음성으로 변환한다. 이 기술은 마케팅, 광고, 콘텐츠 제작, 교육, 직장 내 훈련 등 다양한 분야에 적용된다.
Podcastle의 창립자 Arto Yeritsyan은 TechCrunch에 텍스트-음성 변환에 오랫동안 뛰어들고 싶었다고 밝혔다. 문제는 비용과 데이터 요구량이 너무 컸다는 것. 하지만 최근 대형 언어 모델의 돌파구 덕분에 작년에 마침내 성공했다. "우리는 처음부터 탄탄한 텍스트-음성 모델을 구축하려 했다," Yeritsyan은 말했다. "하지만 비용이 엄청났다. 최신 기술로 우리는 많은 데이터 없이도 최고 수준의 음성 모델을 만들 방법을 찾았다."
작년 1,350만 달러의 시리즈 A 펀딩도 이 프로젝트를 뒷받침했다.
가격 면에서 Podcastle은 경쟁력 있다. 500분 텍스트-음성 변환에 약 40달러를 부과, ElevenLabs는 같은 양에 99달러를 요구한다.
Podcastle의 음성 복제 기능도 개선, 훈련 과정을 훨씬 빠르게 했다. 이전에는 시스템 훈련을 위해 약 70문장을 읽어야 했다. 이제는 몇 초의 음성만으로 충분하다. 작년에 출시한 Magic Dust AI를 사용해 이 새로운 과정에서 오디오 품질을 향상시켰다.

우리가 테스트했을 때 음성은 약간 로봇 같았지만, 톤은 꽤 잘 잡아냈다. Podcastle은 더 나아지도록 노력 중이라고 밝혔다. 다양한 음성 샘플로 시스템을 훈련해 다양한 결과를 얻을 수도 있다.
Podcastle은 비용 절감 외에도 오디오, 비디오 도구, 팟캐스트, AI 내레이션을 한 곳에서 제공하는 것이 경쟁에서 차별화될 것이라고 본다. Yeritsyan은 대부분의 사용자가 오디오 콘텐츠에 집중하지만, 비디오도 점차 주목받고 있다고 언급했다.
워너 뮤직이 AI 귀속 스타트업 서룰 AI를 인수하다
워너 뮤직 그룹(WMG)은 수요일 Sureel AI라는 인공지능 속성 추적 스타트업을 인수한다고 확인했다. Sureel의 독점 기술은 음악 트랙에 대한 ‘AI DNA’를 생성하며, 이를 구성 요소로 분해하여 AI 모델이 이러한 요소를 어떻게 활용하는지 추적한다.이번 인수를 통해 WMG는 아티스트와 작곡가의 작품이 AI 생성 콘텐츠에서 어떻게 활용되거나 AI 모델 학습에 사용되는지를 모니터링하는 능력을 강화할 계획이다.“Sureel을 WMG에
마이크로소프트, 애저, AI 기술이 캘리포니아 산불 위험에 맞서다
마이크로소프트는 AI 기반 산불 탐지 기술에 투자하고 있으며, CVP 겸 수석 데이터 과학자인 후안 라비스타 페레스가 환경 피해 완화 전략을 논의하고 있다.NASA에 따르면, 기후 변화는 지구상의 모든 사람에게 영향을 미치며, 기온 상승, 강수 패턴의 변화, 해수면 상승 등의 형태로 나타납니다.NASA는 인간 활동이 주된 원인으로 작용하여 지구가 전례 없는
¡Vaya sorpresa con Podcastle! 450+ voces de IA suena a ciencia ficción. Me pregunto cómo afectará esto a los narradores humanos, ¿serán reemplazados o se abrirán nuevas oportunidades creativas? 😮
Podcastle's new text-to-speech with 450+ AI voices is mind-blowing! The variety is insane, but some voices sound a bit robotic. Still, it's a game-changer for podcast creators. Can't wait to see how it evolves! 🚀
¡El nuevo texto a voz de Podcastle con más de 450 voces de IA es impresionante! La variedad es increíble, pero algunas voces suenan un poco robóticas. Aún así, es un cambio de juego para los creadores de podcasts. ¡No puedo esperar para ver cómo evoluciona esto! 🚀
Tính năng chuyển văn bản thành giọng nói mới của Podcastle với hơn 450 giọng nói AI thật tuyệt vời! Giọng nói nghe rất tự nhiên, giống như có một người dẫn chuyên nghiệp cho podcast của bạn. Điểm trừ duy nhất là một số giọng nói có thể hơi cứng nhắc, nhưng nhìn chung, đây là công cụ không thể thiếu cho bất kỳ podcaster nào muốn nâng cao trò chơi của mình! 😎
Podcastles neue Text-zu-Sprache-Funktion mit über 450 KI-Stimmen ist der Wahnsinn! Die Stimmen klingen so natürlich, als hätte man einen professionellen Sprecher für sein Podcast. Das einzige Manko sind einige Stimmen, die ein bisschen roboterhaft klingen, aber insgesamt ist es ein Muss für jeden Podcaster, der sein Spiel auf die nächste Stufe heben möchte! 😎
¡El nuevo texto a voz de Podcastle con más de 450 voces de IA es increíble! Las voces suenan tan naturales, es como tener un narrador profesional para tu podcast. Lo único malo es que algunas voces pueden sonar un poco robóticas, pero en general, es una herramienta imprescindible para cualquier podcaster que quiera mejorar su juego. ¡Genial! 😎





집






