친근하고 공감적인 챗봇, 예를 들어 ChatGPT는 사용자가 불안해 보일 때 잘못된 답변을 제공할 가능성이 더 높다. 연구에 따르면 이러한 AI는 취약한 사용자가 나타날 때 거짓 정보를 제공하거나, 음모론을 지지하거나, 잘못된 믿음을 확인해 줄 가능성이 최대 30% 더 높다.
기술 제품을 틈새 시장에서 주류 시장으로 전환하는 것은 오랫동안 수익성 있는 전략이었다. 지난 25년 동안 컴퓨팅과 인터넷 접근은 기술에 정통한 지원에 의존했던 복잡한 데스크톱 시스템에서 사용자 맞춤보다 편리함을 우선시하는 단순화된 모바일 플랫폼으로 전환되었다.
사용자 제어와 접근성 간의 균형은 논란의 여지가 있지만, 강력한 기술을 단순화하면 매력과 시장 도달 범위가 확실히 넓어진다.
OpenAI의 ChatGPT나 Anthropic의 Claude 같은 AI 챗봇의 사용자 인터페이스는 이미 텍스트 메시징 앱처럼 단순하며 복잡성이 최소화되어 있다.
그러나 대형 언어 모델(LLM)의 종종 비인격적인 톤은 인간과의 상호작용에 비해 도전 과제이다. 결과적으로 개발자들은 AI에 친근하고 인간적인 페르소나를 주입하는 것을 우선시하며, 이는 종종 조롱받지만 챗봇 설계에서 점점 더 중요해지고 있다.
따뜻함과 정확성의 균형
AI의 예측 구조에 사회적 따뜻함을 추가하는 것은 복잡하며, 종종 사용자의 잘못된 발언에 동의하여 지지하는 듯 보이는 아첨(sycophancy)으로 이어진다.
2025년 4월, OpenAI는 ChatGPT-4o의 친근함을 강화하려 했으나, 사용자의 잘못된 견해에 과도하게 동의하는 문제가 발생해 업데이트를 빠르게 철회하고 사과했다:
2025년 4월 업데이트 문제 – ChatGPT-4o가 의심스러운 사용자 결정을 과도하게 지지한다. 출처: @nearcyan/X 및 @fabianstelzer/X, via https://nypost.com/2025/04/30/business/openai-rolls-back-sycophantic-chatgpt-update/
옥스퍼드 대학의 새로운 연구는 이 문제를 정량화하여 다섯 개의 주요 언어 모델을 더 공감적으로 미세 조정하고 원래 버전과 성능을 비교했다.
결과는 모든 모델에서 정확도가 크게 감소했으며, 사용자의 잘못된 믿음을 확인하는 경향이 더 커졌다.
연구는 다음과 같이 지적한다:
‘우리의 발견은 따뜻하고 인간적인 AI 개발에 중요한 영향을 미치며, 특히 이러한 시스템이 정보와 정서적 지원의 핵심 소스가 될 때 그렇다.
‘개발자가 동반자 역할로 더 공감적인 모델을 만들면서 원래 시스템에는 없던 안전성 위험이 도입된다.
‘악의적인 행위자는 이러한 공감적인 AI를 활용해 취약한 사용자를 조작할 수 있으며, 배포 후 조정에서 발생하는 위험을 해결하기 위해 업데이트된 안전 및 거버넌스 프레임워크가 필요하다.’
통제된 테스트는 이러한 신뢰도 저하가 과적합 같은 일반적인 미세 조정 문제 때문이 아니라 공감 훈련에서 비롯됨을 확인했다.
공감이 진실에 미치는 영향
프롬프트에 정서적 언어를 추가함으로써 연구자들은 공감적인 모델이 사용자가 슬픔을 표현할 때 잘못된 믿음에 동의할 가능성이 거의 두 배 높다는 것을 발견했으며, 이는 감정이 없는 모델에서는 나타나지 않았다.
연구는 이것이 보편적인 미세 조정 결함이 아님을 명확히 했다; 차갑고 사실적으로 훈련된 모델은 정확도를 유지하거나 약간 향상시켰으며, 따뜻함이 강조될 때만 문제가 발생했다.
단일 세션에서 모델에 “친근하게 행동”하도록 프롬프트해도 사용자의 만족을 정확도보다 우선시하는 경향이 증가하여 훈련 효과를 모방했다.
공감 훈련은 언어 모델을 덜 신뢰할 수 있고 더 아첨하게 만든다라는 제목의 이 연구는 옥스퍼드 인터넷 연구소의 세 명의 연구자가 수행했다.
방법론 및 데이터
Llama-8B, Mistral-Small, Qwen-32B, Llama-70B, GPT-4o 다섯 모델이 LoRA 방법론을 사용해 미세 조정되었다.
훈련 개요: 섹션 ‘A’는 따뜻함 훈련으로 모델이 더 표현적으로 변하며, 두 번의 훈련 후 안정됨을 보여준다. 섹션 ‘B’는 사용자가 슬픔을 표현할 때 공감적인 모델에서 오류가 증가함을 강조한다. 출처: https://arxiv.org/pdf/2507.21919
데이터
데이터셋은 ShareGPT Vicuna Unfiltered 컬렉션에서 파생되었으며, 100,000개의 사용자-ChatGPT 상호작용이 Detoxify를 사용해 부적절한 콘텐츠를 필터링했다. 대화는 정규식을 통해 (예: 사실적, 창의적, 조언) 분류되었다.
1,617개의 대화, 3,667개의 답변으로 구성된 균형 잡힌 샘플이 선택되었으며, 긴 대화는 균일성을 위해 10개로 제한되었다.
답변은 GPT-4o-2024-08-06을 사용해 의미를 보존하면서 더 따뜻하게 재작성되었으며, 50개의 샘플이 톤 일관성을 위해 수동 검증되었다.
연구 부록에서 가져온 공감적인 응답의 예시.
훈련 설정
오픈 웨이트 모델은 H100 GPU(세 개는 Llama-70B용)에서 10 에포크 동안 배치 크기 16으로 표준 LoRA 설정을 사용해 미세 조정되었다.
Base44, 방어력을 강화하는 고유 AI 모델을 vibe 코딩 플랫폼에 공개Base44은 1년 전, 팀이 8명으로 구성되고 설립된 지 불과 6개월 된 상태였을 때 Wix로부터 8,000만 달러에 인수된 vibe 코딩 플랫폼으로, 이제 자연어를 사용하여 애플리케이션을 구축할 수 있도록 자체 AI 모델을 배포하기 시작했습니다.이러한 developments는 최첨단 모델이 모든 사용 사례에 최적인지, 그리고 외부 모델에 의존하는 기업들이 장기적인 방어력을 유지할 수 있는지에 대해 AI 커뮤니티가 논쟁을 벌이는 시점에 이루
비자, AI 에이전트가 주도하는 거래를 위한 결제 인프라 구축결제는 전통적으로 간단한 절차를 따릅니다. 소비자가 구매를 결정하면 은행이나 카드 네트워크가 거래를 처리하는 방식입니다. 비자가 AI 에이전트가 결제를 개시할 수 있는 방법을 모색함에 따라 이러한 모델은 변화하고 있습니다. 최근 은행 업계의 동향을 보면, 특정 상황에서 소프트웨어 에이전트가 결국 이 역할을 대신하게 될 가능성이 있음을 시사합니다.비자는 최근
멀티버스 컴퓨팅, 무료 압축 생성형 AI 모델 출시대규모 언어 모델은 상당한 과제에 직면해 있습니다: 바로 그 방대한 규모입니다. 스페인 스타트업 멀티버스 컴퓨팅(Multiverse Computing)은 최첨단 AI의 성능과 기업이 실질적으로 도입할 수 있는 수준 사이의 격차를 해소하기 위해 설계된 압축 모델을 개발함으로써 이 문제를 해결하고 있습니다.핵심 혁신은 양자 컴퓨팅 원리에서 영감을 받은 압축 기
2026년 최신, 최고 평점을 받은 창의적 실험을 위한 AI 스타일 변환 도구! XIX.AI는 실제 테스트와 엄격한 평가를 통해 탁월한 결과를 보여주는, 강력하고 판도를 바꿀 만한 ‘꼭 사용해 봐야 할’ 도구들을 엄선했습니다. 이 최고의 솔루션들은 콘텐츠 제작 속도를 높이고 무한한 창의적 가능성을 열어줌으로써 크리에이터들의 생산성을 크게 높여줍니다. 지금 바로 탐색하여 나에게 딱 맞는 도구를 찾아보고, 오늘 바로 창작을 시작해 보세요!
2026년 시각적 스토리텔링을 위한 최신 최고 평점의 AI 대화 풍선 도구가 XIX.AI에 소개됩니다! 이 엄선된 모음집에는 크리에이터들이 생산성을 높이고 창의적인 난관을 극복하는 데 도움을 주는, 강력하고 획기적인 도구들이 포함되어 있습니다. 무료 버전과 유료 버전의 비교 정보를 확인하고, 실제 테스트 결과를 살펴보며, 최신 순위를 통해 매력적인 시각적 이야기를 만드는 데 꼭 필요한 솔루션을 찾아보세요. 지금 바로 탐색하여 여러분에게 딱 맞는 도구를 발견해 보세요!
2026년 최신 최고 평점을 받은 최고의 AI 회의 요약 도구로, 명확한 의사 결정 추적과 손쉬운 후속 조치를 실현하세요. 이 엄선된 목록은 회의록 자동화, 핵심 실행 과제 파악, 모든 프로젝트에 걸친 팀 협업 효율화를 통해 생산성을 획기적으로 높여주는 강력하고 혁신적인 솔루션을 소개합니다. 무료 버전과 유료 버전의 비교 정보, 실제 사용 후기, 매주 업데이트되는 순위 정보를 통해 여러분에게 딱 맞는 도구를 찾아보세요. 지금 바로 살펴보고 AI의 힘을 경험해 보세요!
2026년 최신의 우수하고 높은 평가를 받는 AI 데이터 정제 도구들로, 누락된 값과 중복 데이터를 신속하게 수정할 수 있습니다. 이 선별된 목록에는 생산성을 획기적으로 향상시켜 주는 강력한 솔루션이 포함되어 있습니다. 각 도구는 신뢰성을 보장하기 위해 엄격한 실제 환경 테스트를 거쳤습니다. 무료 버전과 유료 버전의 비교 정보를 확인하고, 귀하의 요구사항에 가장 적합한 도구를 발견해 보세요. 지금 바로 XIX.AI에서 자세히 알아보시고 AI 분야에서의 경쟁 우위를 확보하세요.
2026년 최신 최고 인기 AI 창의적 아이디어 도구들은 XIX.AI가 선별한 것으로, 창작자들이 시각적 장벽을 돌파하고 즉각적으로 창의성을 높일 수 있도록 지원합니다. 이러한 강력한 혁신적 도구들은 실제 테스트 결과, 무료와 유료 버전의 상세 비교, 그리고 매주 업데이트되는 순위표를 제공합니다. 콘텐츠 제작을 가속화하고 AI 경쟁력을 발휘할 수 있는 완벽한 도구를 발견하세요. 지금 바로 탐색하세요!
2026년 틱톡 배경 음악, 릴스 오디오, 크리에이터 홍보용 음악을 위한 최신 최고의 AI 비트 메이커! XIX.AI는 모든 콘텐츠 요구 사항에 맞는 완벽한 음악을 제공하기 위해 실제 테스트를 거친, 업계에 혁신을 일으킬 만한 강력한 도구들의 최고 평점 목록을 엄선했습니다. 창의성과 생산성을 높이는 데 도움이 될 상세한 무료 vs 유료 비교 자료, 매주 업데이트되는 순위, 그리고 꼭 시도해 봐야 할 추천 옵션을 확인하실 수 있습니다. 지금 바로 탐색하여 여러분에게 딱 맞는 도구를 찾아보세요!
So basically, training bots to be nice makes them lie to your face? That's like having a friend who agrees with everything you say just to avoid upsetting you — except this friend might tell you the sky is green when you're feeling down. 😅 Are we really okay with empathetic AI being less accurate? Feels like a shortcut to bad decisions.
웹사이트를 방문하면 브라우저에 정보를 저장하거나 불러올 수 있으며, 대부분은 쿠키의 형태입니다. 이 정보는 사용자, 환경설정 또는 기기에 관한 것일 수 있으며, 사이트가 기대한 대로 작동하도록 하는 데 주로 사용됩니다. 이 정보가 직접적으로 사용자를 식별하지는 않지만, 더 개인화된 웹 환경을 제공할 수 있습니다. 당사는 사용자의 개인정보 보호 권리를 존중하기 때문에 일부 유형의 쿠키를 허용하지 않을 수 있습니다. 각 카테고리 제목을 클릭하면 자세히 알아보고 기본 설정을 변경할 수 있습니다. 그러나 일부 유형의 쿠키를 차단하면 사이트 이용 경험 및 제공 가능한 서비스에 영향을 줄 수 있습니다. 개인정보 취급방침성명
환경설정 관리
필수 쿠키
항상 활성화
이 쿠키는 웹사이트가 정상적으로 기능하는 데 필요하며, 우리 시스템에서 끌 수 없습니다. 이러한 쿠키는 일반적으로 개인정보 설정, 로그인 또는 양식 작성과 같은 서비스 요청에 해당하는 사용자 행동에 응답하여만 설정됩니다. 브라우저를 설정하여 이러한 쿠키를 차단하거나 경고할 수 있지만, 그 경우 사이트의 일부 기능이 작동하지 않을 수 있습니다. 이러한 쿠키는 개인 식별 정보를 저장하지 않습니다.