음성 AI 플랫폼 인 Phonic은 Lux로부터 투자를 확보합니다

AI로 생성된 음성은 꽤 훌륭해졌어요, 아시죠? 오디오북, 팟캐스트, 기사 낭독, 심지어 기본적인 고객 지원 같은 것들에 충분히 사용할 만한 수준이에요. 하지만 많은 기업들은 여전히 AI 음성 기술의 신뢰성에 대해 완전히 납득하지 못하고 있죠.
여기서 MIT 졸업생인 모인 나딤과 니킬 머티가 등장합니다. 그들은 합성 음성의 신뢰성을 높이고 지연 시간을 줄이는 데 초점을 맞춘 회사, Phonic을 시작했어요. 이 둘은 MIT에서 만난 이후 7년 넘게 친구로 지내왔죠. 작년에 Phonic을 시작했을 때, 그들은 시장에 완전한 음성 기술 솔루션을 제공하는 곳이 없다는 점을 발견했어요.
"음성 AI는 자동 음성 인식과 텍스트-음성 변환 같은 다양한 요소들을 엮는 단계에 있어요. 여기에 약간의 지능을 추가하는 거죠," 머티가 TechCrunch에 설명했어요. "하지만 실제 고객들과 이야기를 나눠보니, 대규모로 안정적으로 처리할 수 있는 솔루션이 부족하다는 걸 깨달았어요."
2023년 Databricks가 13억 달러에 인수한 MosaicML에서 일했던 나딤은 Vapi나 Rounded 같은 음성 AI 분야의 많은 회사들이 서로 다른 AI 모델을 대충 조합하고 있다고 지적했어요. 반면 Phonic은 다르게 접근해요. 그들은 모델을 처음부터 끝까지 자체적으로 훈련시키죠. 머티는 이 방식이 큰 장점을 가지고 있다고 생각해요.
"모델을 직접 소유하면, 모델 자체에 견고한 신뢰성 기능을 정말로 심을 수 있어요," 그가 말했어요. "그 층을 제어하지 않으면, 잘 맞지 않는 조각들을 억지로 붙이려는 거나 다름없죠."
게다가 머티는 Phonic의 방식이 모델을 호스팅하고 실행하는 데 비용 효율적이라고 언급했어요. 그들은 억양이 있거나 불분명한 음성을 포함한 다양한 녹음으로 모델을 훈련시켜 매우 견고하게 만들어요.
현재 Phonic은 보험과 의료 산업의 선별된 파트너들과 협력하고 있지만, 몇 달 안에 더 넓은 출시를 준비하고 있어요. 나딤은 곧 누구나 Phonic의 웹사이트에서 그들의 기술을 체험해볼 수 있을 거라고 말했어요.
Phonic은 Lux가 주도한 시드 펀딩으로 400만 달러를 유치했으며, Replit 공동창립자 암자드 마사드, Hugging Face 공동창립자 클렘 델랑그, Applied Intuition 공동창립자 카사르 유니스, Modal Labs 창립자 에릭 베른하드슨 같은 큰 이름들이 투자에 참여했어요.
Lux Capital의 그레이스 이스포드는 Phonic의 자체 모델 훈련 방식에 매력을 느꼈다고 말했어요. "우리는 모인과 니킬이 뛰어난 기술자라고 생각해요," 그녀가 말했어요. "그들은 MIT에서 머신러닝 클럽을 시작했고, 오랫동안 모델 훈련에 매진해왔죠. 음성 AI 분야에서 확산 모델과 독점 모델을 혼합하는 그들의 방식은 꽤 혁신적이에요."
관련 기사
구글, ‘도큐먼트’와 ‘킵’에 음성 기반 안내 기능 도입
구글은 ‘구글 I/O’ 개발자 컨퍼런스에서 ‘문서’, ‘킵’, ‘지메일’과 같은 워크스페이스 앱에 음성 기반 프롬프트 기능을 도입한다고 발표했습니다. 이 기능을 통해 사용자는 음성으로 문서 초안을 작성하고, 메모를 남기며, 이메일을 검색할 수 있습니다.Docs에서는 음성만으로 문서 초안을 작성할 수 있습니다. TechCrunch가 시연한 데모에서 한 사용자
골드만삭스 출신과 메타 공동 창업자들이 소외된 시장을 겨냥한 음성 AI를 개발 중
고객 지원 및 서비스는 오늘날 음성 AI 분야에서 가장 주목받는 분야 중 하나입니다. 하지만 사람처럼 자연스러운 음성을 내고 지연 시간을 최소화하며 응답하는 제품을 개발하는 일은 일부 시장에서 다른 시장보다 훨씬 더 어려운 과제이며, 대부분의 주요 기업들은 아프리카와 중동 시장을 염두에 두고 제품을 설계하지 않았습니다.이러한 격차를 해소하기 위해 작년에 설
구글, iOS용 ‘오프라인 우선’ AI 음성 입력 앱을 조용히 출시했다
구글은 이번 월요일, iOS용 ‘오프라인 우선’ 음성 입력 앱인 ‘Google AI Edge Eloquent’를 조용히 출시하며, Wispr Flow, SuperWhisper, Willow 등 유사한 앱들과 경쟁에 나섰다.이 앱은 무료로 다운로드할 수 있습니다. Gemma 기반의 자동 음성 인식(ASR) 모델을 다운로드한 후에는 휴대폰에서 바로 음성 입력을
관련 특별 주제 추천
의견 (51)
0/500
It's about time investors took notice! I've been using AI voice for my podcast intros and it's surprisingly natural now. But reliability for business? Still skeptical. 😅
AI音声がここまで自然になったのはすごい進歩だね😲 でもまだ多くの企業が信用に足るかどうか躊躇しているって紹介されてた通り、私も大事な顧客対応を全て任せるのはちょっと…と感じる。Phonicへの投資が実用性の向上につながるといいな。
AI voices are getting wild! Phonic’s tech sounds super promising for podcasts and support. Wonder how it stacks up against human voices in real-world chaos? 🤔
AI voices are getting wild! Phonic’s tech sounds super promising for podcasts and support. Excited to see where this investment takes them! 🎙️
Whoa, AI voices are getting so real! Phonic's tech sounds like it could make audiobooks way more immersive. Curious if they’ll tackle accents next—imagine a perfect British narrator for my favorite novels! 😄

AI로 생성된 음성은 꽤 훌륭해졌어요, 아시죠? 오디오북, 팟캐스트, 기사 낭독, 심지어 기본적인 고객 지원 같은 것들에 충분히 사용할 만한 수준이에요. 하지만 많은 기업들은 여전히 AI 음성 기술의 신뢰성에 대해 완전히 납득하지 못하고 있죠.
여기서 MIT 졸업생인 모인 나딤과 니킬 머티가 등장합니다. 그들은 합성 음성의 신뢰성을 높이고 지연 시간을 줄이는 데 초점을 맞춘 회사, Phonic을 시작했어요. 이 둘은 MIT에서 만난 이후 7년 넘게 친구로 지내왔죠. 작년에 Phonic을 시작했을 때, 그들은 시장에 완전한 음성 기술 솔루션을 제공하는 곳이 없다는 점을 발견했어요.
"음성 AI는 자동 음성 인식과 텍스트-음성 변환 같은 다양한 요소들을 엮는 단계에 있어요. 여기에 약간의 지능을 추가하는 거죠," 머티가 TechCrunch에 설명했어요. "하지만 실제 고객들과 이야기를 나눠보니, 대규모로 안정적으로 처리할 수 있는 솔루션이 부족하다는 걸 깨달았어요."
2023년 Databricks가 13억 달러에 인수한 MosaicML에서 일했던 나딤은 Vapi나 Rounded 같은 음성 AI 분야의 많은 회사들이 서로 다른 AI 모델을 대충 조합하고 있다고 지적했어요. 반면 Phonic은 다르게 접근해요. 그들은 모델을 처음부터 끝까지 자체적으로 훈련시키죠. 머티는 이 방식이 큰 장점을 가지고 있다고 생각해요.
"모델을 직접 소유하면, 모델 자체에 견고한 신뢰성 기능을 정말로 심을 수 있어요," 그가 말했어요. "그 층을 제어하지 않으면, 잘 맞지 않는 조각들을 억지로 붙이려는 거나 다름없죠."
게다가 머티는 Phonic의 방식이 모델을 호스팅하고 실행하는 데 비용 효율적이라고 언급했어요. 그들은 억양이 있거나 불분명한 음성을 포함한 다양한 녹음으로 모델을 훈련시켜 매우 견고하게 만들어요.
현재 Phonic은 보험과 의료 산업의 선별된 파트너들과 협력하고 있지만, 몇 달 안에 더 넓은 출시를 준비하고 있어요. 나딤은 곧 누구나 Phonic의 웹사이트에서 그들의 기술을 체험해볼 수 있을 거라고 말했어요.
Phonic은 Lux가 주도한 시드 펀딩으로 400만 달러를 유치했으며, Replit 공동창립자 암자드 마사드, Hugging Face 공동창립자 클렘 델랑그, Applied Intuition 공동창립자 카사르 유니스, Modal Labs 창립자 에릭 베른하드슨 같은 큰 이름들이 투자에 참여했어요.
Lux Capital의 그레이스 이스포드는 Phonic의 자체 모델 훈련 방식에 매력을 느꼈다고 말했어요. "우리는 모인과 니킬이 뛰어난 기술자라고 생각해요," 그녀가 말했어요. "그들은 MIT에서 머신러닝 클럽을 시작했고, 오랫동안 모델 훈련에 매진해왔죠. 음성 AI 분야에서 확산 모델과 독점 모델을 혼합하는 그들의 방식은 꽤 혁신적이에요."
구글, ‘도큐먼트’와 ‘킵’에 음성 기반 안내 기능 도입
구글은 ‘구글 I/O’ 개발자 컨퍼런스에서 ‘문서’, ‘킵’, ‘지메일’과 같은 워크스페이스 앱에 음성 기반 프롬프트 기능을 도입한다고 발표했습니다. 이 기능을 통해 사용자는 음성으로 문서 초안을 작성하고, 메모를 남기며, 이메일을 검색할 수 있습니다.Docs에서는 음성만으로 문서 초안을 작성할 수 있습니다. TechCrunch가 시연한 데모에서 한 사용자
골드만삭스 출신과 메타 공동 창업자들이 소외된 시장을 겨냥한 음성 AI를 개발 중
고객 지원 및 서비스는 오늘날 음성 AI 분야에서 가장 주목받는 분야 중 하나입니다. 하지만 사람처럼 자연스러운 음성을 내고 지연 시간을 최소화하며 응답하는 제품을 개발하는 일은 일부 시장에서 다른 시장보다 훨씬 더 어려운 과제이며, 대부분의 주요 기업들은 아프리카와 중동 시장을 염두에 두고 제품을 설계하지 않았습니다.이러한 격차를 해소하기 위해 작년에 설
구글, iOS용 ‘오프라인 우선’ AI 음성 입력 앱을 조용히 출시했다
구글은 이번 월요일, iOS용 ‘오프라인 우선’ 음성 입력 앱인 ‘Google AI Edge Eloquent’를 조용히 출시하며, Wispr Flow, SuperWhisper, Willow 등 유사한 앱들과 경쟁에 나섰다.이 앱은 무료로 다운로드할 수 있습니다. Gemma 기반의 자동 음성 인식(ASR) 모델을 다운로드한 후에는 휴대폰에서 바로 음성 입력을
It's about time investors took notice! I've been using AI voice for my podcast intros and it's surprisingly natural now. But reliability for business? Still skeptical. 😅
AI音声がここまで自然になったのはすごい進歩だね😲 でもまだ多くの企業が信用に足るかどうか躊躇しているって紹介されてた通り、私も大事な顧客対応を全て任せるのはちょっと…と感じる。Phonicへの投資が実用性の向上につながるといいな。
AI voices are getting wild! Phonic’s tech sounds super promising for podcasts and support. Wonder how it stacks up against human voices in real-world chaos? 🤔
AI voices are getting wild! Phonic’s tech sounds super promising for podcasts and support. Excited to see where this investment takes them! 🎙️
Whoa, AI voices are getting so real! Phonic's tech sounds like it could make audiobooks way more immersive. Curious if they’ll tackle accents next—imagine a perfect British narrator for my favorite novels! 😄





집






