옵션
뉴스
인공지능이 인간 고객 서비스 담당자로의 경로를 간소화합니다

인공지능이 인간 고객 서비스 담당자로의 경로를 간소화합니다

2026년 1월 15일
87

새로운 연구에 따르면 오픈소스 기반의 ChatGPT 스타일 인공지능 시스템이 자연어 처리 기술을 활용해 콜센터에서 발신자를 적절한 담당자와 연결할 수 있는 잠재력을 지닌 것으로 나타났다. 이로써 의도적으로 방해하는 듯한 느낌을 주는 복잡하고 자주 변경되는 메뉴 시스템을 거칠 필요가 없어진다.

 

실제 상담원 연결은 좌절스러운 과정일 수 있습니다. 통화자는 자신의 특정 문제에 맞는 선택지가 무엇인지 종종 확신하지 못한 채 다중 선택 옵션을 하나씩 확인해야 하기 때문입니다. 적합한 옵션이 없을 경우, 노련한 사용자들은 종종 인간 상담원에게 연결되고 '옵션 지옥'에서 벗어나기 위한 요령과 우회 방법을 개발합니다. 많은 이들에게 이 경험은 적대적이고 사용자 친화적이지 않게 느껴집니다.

콜센터가 AI 보강 또는 대체의 주요 대상이 된 것은 놀라운 일이 아닙니다. 일부 전문가들이 신중을 촉구함에도 불구하고, 콜센터 자동화는 기술 헤드라인을 장식하기 쉬운 쉬운 과제가 되며, 비정상적으로 빠른 투자 수익을 제공할 수 있는 AI 주도 혁신의 유망한 분야로 남아 있습니다.

폐쇄된 시장

그러나 이 분야에서는 오픈소스 원칙과 공개 데이터가 거의 적용되지 않는데, 그럴 만한 이유가 있습니다. 고객 대응 시스템을 자동화하는 기업들은 경쟁 우위를 뒷받침하는 데이터, 방법론 또는 기업 지적 재산을 공유할 유인이 거의 없습니다.

이러한 자원을 공유하면 시장 우위가 약화될 수 있다. 더 중요한 것은 AI 시스템이 민감한 정보를 유출할 가능성이 있어 상당한 법적 위험을 수반한다는 점이다.

이로 인해 여러 자금력 있는 기업들이 AI 기반 콜센터 시스템을 독자적으로 개발하게 되었으며, 일부 노력은 불가피하게 중복되었습니다. 또한 AI 기반 고객 서비스 역량에 대한 수요 증가를 충족시키려는 B2B 스타트업과 기존 업체들의 급증도 촉발했습니다.

가상의 회사에 대한 고객 서비스 통화를 폴리아이 음성 어시스턴트가 시작합니다.

가상의 '오거스타 잔디 관리'를 위한 고객 서비스 통화를 시작하는 PolyAI 음성 어시스턴트는 기존 콜센터 인프라 내에서 응답을 자동화하기 위해 방대한 훈련 대화를 활용합니다. 출처

또한 복잡한 콜센터 메뉴로 인한 불편함을 해소하려는 노력도 연구를 촉진했습니다. 그러나 대부분의 연구 결과는 Arxiv나 기타 공개 플랫폼에 게재되지 않는데, 이는 대화형 음성 응답(IVR) 개발이 일반적으로 독점적 성격을 띠기 때문입니다.

결과적으로 고객 서비스 AI 자동화와 관련된 연구, 데이터, 비즈니스 인텔리전스는 엄격히 보호됩니다. 법적으로 안전한 데이터를 사용하는 것이 가능하다고 해도(의문스럽지만) 오픈소스 대안은 극히 드뭅니다.

로컬 콜

이러한 배경 속에서 콜롬비아에서 나온 새로운 논문은 IVR 개발을 기업 금고에서 조금이라도 끌어내려는 환영할 만한 시도입니다. 'IVR 터치톤을 넘어서: 대규모 언어 모델(LLM)을 활용한 고객 의도 라우팅'이라는 제목의 이 간결한 연구는 보고타 소재 프란시스코 호세 데 칼다스 디스트리탈 대학교(Universidad Distrital Francisco José de Caldas) 연구원이 수행했습니다. 이 연구는 대규모 언어 모델(LLM)을 활용해 고객 의도 라우팅(CIR) 시스템의 기능적 스키마를 구축한 최초의 비독점적 프로젝트라고 주장합니다.

실제 통화 데이터나 독점 메뉴 구조를 사용하기보다는, 이 프로젝트는 세 가지 AI 모델을 활용해 모든 구성 요소를 처음부터 생성한다: 하나는 현실적인 콜센터 메뉴를 설계하고, 다른 하나는 수백 건의 발신자 불만을 시뮬레이션하며, 세 번째는 챗봇 역할을 수행해 이러한 질의를 올바른 목적지로 라우팅한다.

그 결과 가상의 통신사와 920개의 서로 다른 사용자 문의로 구성된 완전히 합성되었지만 설득력 있는 테스트 환경이 구축되었습니다. 이 설정은 현재 AI가 모호하고 구조화되지 않은 음성을 얼마나 잘 해석하고 발신자를 적절히 안내하는지 탐구할 수 있게 해주며, 동시에 법적 위험을 피할 수 있습니다.

테스트 결과, 특히 상세한 설명 대신 '평탄화된' 메뉴 옵션을 제공할 때 시스템이 자유형 불만 사항을 최대 89.13% 정확도로 올바른 처리처에 매핑할 수 있음이 확인되었습니다.

또한 연구 결과, 발신자가 비공식적이거나 다양한 언어를 사용할 때 AI 오류가 더 많이 발생하는 것으로 나타났습니다. 다만 일부 오류는 AI의 오해가 아닌 전화 메뉴 자체가 혼란스러웠기 때문이었습니다.

새로운 프로젝트의 일환으로 공유된 고객 상호작용 사례. [출처] https://figshare.com/articles/dataset/Beyond_IVR_Touch-Tones_Customer_Intent_Routing_using_LLMs/30118690

새로운 프로젝트의 일환으로 공유된 고객 상호작용 사례. 출처

이 프로젝트의 데이터는 공개적으로 이용 가능하게 되었습니다.

방법

3단계 접근법은 가상의 통신사를 위한 상세한 전화 메뉴를 생성하는 모델로 시작되었습니다. 두 번째 모델은 현실적인 발화 패턴을 시뮬레이션하기 위해 일부는 직설적이고, 일부는 재구성되거나 더 비공식적인 독특한 발신자 메시지를 생성했습니다. 총 920개의 예시가 생성되었습니다.

세 번째 모델은 메시지와 메뉴 버전만을 기반으로 각 발신자를 올바른 부서로 연결하는 임무를 맡았습니다. 이 프레임워크는 실제 통화 데이터나 고객 정보 노출 없이도 실험을 완전히 재현 가능하게 했습니다.

삼분법적 접근을 위해 선택된 세 가지 체계. [출처] https://arxiv.org/pdf/2510.21715

삼분법적 접근법에 선정된 세 시스템. 출처

사용된 모델은 각각 gpt-3.5-turbo, gpt-4o-mini, gpt-4.1-mini입니다.

진정한 고객 서비스 환경을 시뮬레이션하기 위해 복잡한 전화 메뉴를 처음부터 합성해야 했습니다. 관련 데이터셋이 부족하여 gpt-3.5-turbo 모델에 가상의 통신사용 완전한 다중 분기 구조를 생성하도록 프롬프트했습니다.

각 분기는 청구, 기술 지원, 계정 관리, 신규 서비스와 같은 서비스 영역을 나타내며, 현실적인 하위 옵션과 다양한 깊이를 갖추고 있습니다. 테스트를 위해 두 가지 메뉴 버전이 생성되었습니다: 사람이 읽을 수 있는 형식을 모방한 일반 텍스트 계층 구조와 해당 버튼 시퀀스가 있는 엔드포인트 목록입니다.

이를 통해 라우팅 문제의 상세 버전과 단순화된 버전 모두에 대한 테스트가 가능해졌습니다:

AI에는 전화 메뉴의 두 가지 버전이 제공되었습니다: 상세한 텍스트 계층 구조와 간소화된 직접 메뉴 옵션 목록으로, 각 형식이 발신자를 올바른 곳으로 안내하는 데 얼마나 효과적인지 비교하기 위함이었습니다.

AI에 두 가지 버전의 전화 메뉴가 제공되었습니다: 상세한 텍스트 계층 구조와 간소화된 직접 메뉴 옵션 목록으로, 각 형식이 발신자를 올바른 곳으로 안내하는 데 얼마나 효과적인지 비교하기 위함이었습니다.

테스트 발신자 메시지를 생성하기 위해, 두 번째 언어 모델이 각 메뉴 종착점당 10개의 고유한 예시를 포함한 원본 불만 또는 요청 세트를 생성했습니다.

그런 다음 각 메시지는 실제 사람들이 문제를 표현하는 다양한 방식을 반영하기 위해 길이와 어조, 사소한 오류나 불필요한 단어까지 포함하여 여러 가지 변형으로 재구성되었습니다.

920개의 초기 메시지는 시스템의 정확성을 테스트하고 자연스러운 대화의 예측 불가능성을 시뮬레이션하기 위해 제작되었습니다.

세 번째 단계에서는 두 가지 다른 IVR 표시 형식을 사용하여 각 메시지를 올바른 메뉴 목적지로 매핑하는 최종 모델의 능력을 테스트했습니다.

첫 번째 버전에서는 AI가 전화 트리의 전체 설명 개요를 받았습니다. 두 번째 버전에서는 최종 목적지와 해당 버튼 순서 목록만 제공되었습니다.

목표는 단순화된 메뉴가 모델의 통화 라우팅 효율성을 높일 수 있는지 확인하는 것이었습니다. 두 경우 모두 시스템은 한 번에 하나의 메시지만 처리했으며, 자동화된 점수 산정을 위해 추가 텍스트 없이 경로만 반환하도록 지시받았습니다.

격리

테스트 결과 오염을 방지하기 위해 각 모델은 격리 상태로 유지되었습니다. 첫 번째 모델이 전화 메뉴 초안을 작성했지만, 다른 시스템에 노출되지 않도록 수동으로 최종 확정되었습니다.

발신자 메시지는 gpt-4o-mini가 메뉴 구조에 대한 접근 없이 엔드포인트 이름만 사용하여 별도로 생성했습니다. 마지막으로, 라우팅을 수행한 gpt-4.1-mini는 메뉴 텍스트와 수신 메시지에만 접근할 수 있었으며, 이를 생성하는 역할은 없었습니다.

지표

라우팅 시스템 성능은 두 가지 표준 지표로 평가되었습니다: 정확도(모델이 정확한 경로(예: 1-2-3)를 제공한 사례의 비율)와 오류 위치를 특정하기 위한 혼동 행렬 생성*. 평가는 pandas 및 scikit-learn 라이브러리를 사용한 Python으로 수행되었습니다.

결과

테스트 결과 모델의 정확도는 메뉴 표시 방식에 크게 좌우되는 것으로 나타났다. 단순화된 메뉴 경로 목록을 사용했을 때 시스템은 단순한 데이터셋에서 89.13%의 정확도를 달성한 반면, 완전한 설명형 메뉴에서는 81.30%의 정확도를 보였다.

세 번째 모델(LLM3)의 라우팅 정확도는 다양한 프롬프트 형식과 데이터셋 유형에 걸쳐 측정되었으며, 평면화된 메뉴 경로가 계층적 설명보다 일관되게 우수한 성능을 보였고, 입력에 의역된 표현이나 비공식적 언어가 추가될 경우 정확도가 소폭 하락하는 것으로 나타났다.

세 번째 모델(LLM3)의 경로 정확도는 다양한 프롬프트 형식과 데이터셋 유형에서 일관되게 평탄화된 메뉴 경로가 계층적 설명보다 우수한 성능을 보였으며, 의역된 표현이나 비공식적 언어 입력 시 정확도가 소폭 하락하는 경향을 나타냈다.

이 추세는 더 크고 언어적으로 다양한 데이터셋에서도 지속되었으며, 평탄화된 버전이 다시 한 번 더 나은 성능을 보였습니다(설명 형식 대비 86.52% 대 77.07%).

이 논문은 이러한 결과가 긴 계층적 설명보다 단순한 목록 기반 프롬프트가 모델이 쿼리를 더 안정적으로 매칭하는 데 도움이 된다는 것을 시사한다고 지적합니다.

또한 의역된 비공식 발신자 메시지가 도입되면 정확도가 약간 하락했는데, 이는 다양성 증대가 현실감을 높이는 동시에 분류를 더 어렵게 만들었음을 시사한다.

본 논문은 다음과 같이 결론지었습니다:

'우리의 결과는 LLM이 평탄화된 IVR 경로(최대 89.13%)를 제공받을 때 장황한 메뉴 설명(최저 77.07%)에 비해 고객 의도를 더 정확하게 라우팅함을 보여줍니다. 이는 간결하고 구조화된 프롬프트가 노이즈를 줄이고 라우팅 작업에 더 적합함을 시사합니다.

이는 명확성과 간결성이 분류 시나리오에서 LLM 성능을 향상시킨다는 관점을 뒷받침합니다.

‘또한 메뉴를 평탄화된 경로로 변환하는 것은 실제 적용을 위한 간단하고 자동화 가능한 과정입니다.’

결론

비밀과 배타성으로 특징지어지는 분야에서 공개 연구가 등장하는 것은 고무적인 일입니다. 핵심 질문은 남아 있습니다: 향후 시스템은 LLM에 맥락을 부여하기 위한 '프레임워크' 아키텍처가 필요할까요, 아니면 모델이 단순히 현지에서 이용 가능한 비즈니스 인텔리전스에 접근할 수 있게 되어 기업이 제3자와 데이터를 공유할 필요가 없어질까요?

궁극적으로 여기서 탐구한 핵심 설계 원칙들은 고객 서비스 용도를 위한 특별한 적응 없이도, 향후 AI 시스템에 자연스럽게 채택될 가능성이 높아 보인다.

 

* 자세한 내용은 원본 논문을 참조하십시오.

최초 게시일: 2025년 10월 29일 수요일

관련 기사
딥마인드 CEO 하사비스: 하루 6시간 수면, 보통 오후 1시경에 활력을 느낍니다 딥마인드 CEO 하사비스: 하루 6시간 수면, 보통 오후 1시경에 활력을 느낍니다 Fortune는 최근 Google DeepMind의 CEO인 데미스 하사비스와의 인터뷰를 소개하며, 그의 비전통적인 휴식 및 생산성 접근 방식을 공개했다. 하사비스는 자신이 매우 적게 잠을 자며, 깨어 있는 시간을 두 개의 명확한 업무 블록으로 구조화한다고 밝혔다.그의 수면 습관에 대해 하사비스는 "6시간을 목표로 하지만, 제 습관은 비정형적입니다. 하루 종일 효과적으로 기능할 수 있습니다."라고 언급했다. 그는 6시간 미만의 수면이 뇌 건강
OpenAI와 Anthropic, 매출 부진 속에서도 시장 점유율 확보 경쟁 OpenAI와 Anthropic, 매출 부진 속에서도 시장 점유율 확보 경쟁 최근 OpenAI가 매출 목표를 달성하지 못했다는 보도가 나오면서 이번 주 화요일 기술주에 압박이 가해졌음에도 불구하고, 민간 AI 연구소 투자자들은 여전히 탄탄한 모습을 보이고 있다. 노련한 투자자들은 부정적인 언론 보도에도 불구하고 투자 규모를 줄이지 않을 것이라고 밝혔다.분석가들은 현재의 AI 경쟁이 초기 단계에 불과하다고 보고, “승자 독식” 식의
캘리포니아 자율주행차 규정 준수: 과태료, 지오펜스, 100만 마일의 새로운 시대 캘리포니아 자율주행차 규정 준수: 과태료, 지오펜스, 100만 마일의 새로운 시대 Guident는 남부 플로리다에서 AuveTech 셔틀을 운영하며, 자사의 원격 모니터링 기술을 활용해 웨스트 팜비치에서 4마일 구간과 보카 라톤에서 1마일 구간의 노선을 관리하고 있다. | 출처: Guident캘리포니아주는 자율주행차에 대한 규제 환경을 재정의하며, 기술 업계의 “빠르게 움직이고 실패를 감수하라(move fast and break thin
관련 특별 주제 추천
챗봇 언어 연습, 면접 준비 및 일상 유창성을 위한 최고의 AI 역할극 채팅 앱
언어 연습, 면접 준비 및 일상 유창성을 위한 최고의 AI 역할극 채팅 앱

2026년 최신 최고 인기 AI 역할극 채팅 앱: 언어 연습, 면접 준비 및 일상 유창성을 위한 최고의 선택! XIX.AI는 무료와 유료 비교, 실제 테스트, 매주 업데이트되는 순위 등을 제공하는 강력한 혁신적인 컬렉션을 엄선합니다. 이 필수 도구들은 글쓰기 실력을 향상시키고, 유창성 관련 어려움을 극복하며, 모든 일상 상황에서 의사소통 효율성을 높이는 데 도움을 줍니다. 지금 바로 탐색하여 언어 성장을 위한 완벽한 도구를 발견하세요!

10 도구
xix.ai
음악 작곡 리믹스 제작, 샘플링 준비, 카라오케 마스터 파일 제작을 위한 AI 스템 분리 도구
리믹스 제작, 샘플링 준비, 카라오케 마스터 파일 제작을 위한 AI 스템 분리 도구

2026년 최신형으로 선정된 최고 평점의 AI 스템 분리 도구들은 리믹스 제작, 샘플링 준비, 카라오케 녹음에 특화되어 있습니다. 이 강력하고 혁신적인 도구들은 실제 환경에서의 테스트를 거쳐 정밀한 오디오 분리 기능을 제공함으로써 작업 효율성을 크게 향상시켜 줍니다. XIX.AI는 매주 업데이트되는 무료 버전과 유료 버전의 비교 가이드를 제공하여 사용자의 니즈에 가장 적합한 도구를 찾는 데 도움을 줍니다. 지금 바로 확인하여 AI 기술의 잠재력을 최대한 활용해 보세요.

8 도구
xix.ai
데이터 분석 수익 대시보드, 퍼널 분석, 그리고 제품 지표를 위한 AI SQL 코파일럿
수익 대시보드, 퍼널 분석, 그리고 제품 지표를 위한 AI SQL 코파일럿

2026년 최신 최고의 AI SQL 코파일럿들이 최상위 순위에 올랐습니다! XIX.AI는 매주 업데이트되는 실제 환경 테스트를 위해 강력하고 혁신적인 도구들을 선별하여 제공합니다. 반드시 사용해 보아야 할 이 도구들은 정확한 수익 대시보드를 생성하고, 판매 과정을 분석하며, 제품 관련 지표를 신속하게 추적할 수 있도록 도와 생산성을 크게 향상시켜 줍니다. 데이터 기반 의사결정을 위한 완벽한 도구를 찾아보세요! 238자

9 도구
xix.ai
음악 작곡 노래 초안을 위한 최고의 AI 멜로디 작곡 도구
노래 초안을 위한 최고의 AI 멜로디 작곡 도구

2026년 최신 최고 인기 AI 멜로디 작곡 도구! XIX.AI는 엄격한 실전 테스트를 거쳐 최고의 작곡 경험을 제공하는 강력한 게임 체인저 컬렉션을 엄선했습니다. 무료와 유료 버전의 상세 비교, 정확한 순위, 그리고 놀라운 노래 초안을 손쉽게 만들고 창의적 생산성을 크게 높일 수 있는 필수 추천 옵션들을 확인할 수 있습니다. 지금 바로 탐색하여 완벽한 도구를 발견하세요!

8 도구
xix.ai
챗봇 면접 연습을 위한 최고의 AI 대화 트레이너 도구
면접 연습을 위한 최고의 AI 대화 트레이너 도구

2026년 최신 최고의 평점 높은 AI 대화 트레이너 도구들이 XIX.AI에서 만나보세요! 면접 연습을 위한 이 엄선된 컬렉션은 강력한, 게임 체인저 도구들을 포함하고 있으며, 엄격한 실제 세계 테스트를 거쳐 정확한 피드백을 제공합니다. 무료 대 유료 비교와 상세한 순위표를 찾을 수 있어 자신감과 기술을 향상시킬 수 있는 꼭 시도해봐야 할 옵션을 선택하는 데 도움이 됩니다. 지금 탐색하여 면접 성공을 위한 완벽한 도구를 발견하세요!

12 도구
xix.ai
디자인과 예술 창의적인 실험을 위한 최고의 AI 스타일 변환 도구
창의적인 실험을 위한 최고의 AI 스타일 변환 도구

2026년 최신, 최고 평점을 받은 창의적 실험을 위한 AI 스타일 변환 도구! XIX.AI는 실제 테스트와 엄격한 평가를 통해 탁월한 결과를 보여주는, 강력하고 판도를 바꿀 만한 ‘꼭 사용해 봐야 할’ 도구들을 엄선했습니다. 이 최고의 솔루션들은 콘텐츠 제작 속도를 높이고 무한한 창의적 가능성을 열어줌으로써 크리에이터들의 생산성을 크게 높여줍니다. 지금 바로 탐색하여 나에게 딱 맞는 도구를 찾아보고, 오늘 바로 창작을 시작해 보세요!

9 도구
xix.ai
의견 (0)
0/500
OR