옵션
속보
콘텐츠
JoseGonzalez
JoseGonzalez
2026년 9월 16일

iFLYTEK은 로컬 컴퓨팅 환경에서 학습된 완전한 국산 음성 기반 모델인 Spark-Audio-1.0-Preview를 출시했습니다. 이 모델은 텍스트 및 음성 입력을 받아 텍스트로 출력하며, 99개 언어와 202개 방언에 대한 전사, 번역 및 방언 인식을 지원합니다. 이 모델은 단순한 변환을 넘어 심층 오디오 이해로 발전했으며, 화자 식별, 감정 분석 및 환경음 인식 기능을 갖추고 있습니다. 현재 공개 체험이 가능하며, 곧 iFLYTEK 오픈 플랫폼을 통해 API 접근이 제공될 예정입니다.

의견 (0)
0/300
OR