서울대학교 공과대학은 컴퓨터공학부 김건희 교수팀이 말버릇, 추임새, 끼어들기 등 사람의 대화 행동을 인공지능(AI)이 이해하고 재현하는 음성 대화 생성 기술을 개발했다고 밝혔다.
김 교수팀은 이번 연구에서 세계 최대 규모의 대화 행동 기반 음성 데이터셋인 ‘Behavior-SD’를 구축하고, 이를 바탕으로 자연스럽게 음성 대화를 나누는 AI 모델 ‘BeDLM’을 제안했다.
연구팀은 지난 4월 29일부터 5월 4일까지 미국 뉴멕시코주 앨버커키에서 열린 ‘NAACL 2025(북미 전산언어학회)’에서 해당 연구 논문을 구두 발표했으며, 음성 처리 및 음성 언어 이해(Speech Processing and Spoken Language Understanding) 분야에서 최고 논문상(Senior Area Chair Award)을 수상했다. NAACL은 컴퓨터가 인간의 언어를 이해, 생성할 수 있도록 해주는 AI의 한 분야인 자연어 처리(NLP) 관련 세계 최고 권위 학회 중 하나다.
◇ 연구 배경
연구팀은 사람들이 음성 대화를 나눌 때 텍스트 대화에서는 잘 나타나지 않는 대화 행동을 보이는 점에 주목했다. 예컨대 우리는 대화할 때 ‘음…’, ‘그니까…’ 같은 말버릇을 쓰고, 적절한 순간에 ‘맞아’, ‘응’ 같은 추임새를 넣거나 때로는 상대의 말을 끊기도 한다. 하지만 이런 미묘한 특징들을 반영하지 못한 기존 AI 대화 시스템의 말투는 부자연스럽고 기계적으로 느껴질 수밖에 없었다. 따라서 김 교수팀은 실제 사람처럼 자연스러운 대화를 나누는 AI를 구현하려면 대화 행동의 반영이 반드시 이뤄져야 한다고 봤다.
◇ 연구 성과
이 문제의 해결에 나선 연구팀은 말버릇과 추임새(backchannel), 끼어들기(interruption), 감정 표현 등 사람 개개인의 대화 행동을 정밀하게 반영한 음성 데이터셋과 대화 생성 기술을 함께 제시하는 성과를 거뒀다.
먼저 김 교수팀은 실제 대화 환경을 최대한 비슷하게 재현하기 위해 10만 개의 대화 패턴과 총 2000시간 분량의 음성 대화를 모아 ‘Behavior-SD (Spoken Dialogue)’ 데이터셋을 구축했다. 이 대규모의 데이터는 사람 간의 자연스러운 대화를 정밀하게 구현하도록 설계됐다. 각 화자가 주고받는 단순한 문장에 더해 세밀하게 구분된 다양한 대화 행동을 주석 처리한 방식 덕분이다.
이렇게 구축한 데이터를 바탕으로 연구팀은 행동 기반 대화 생성 모델인 ‘BeDLM (Behaviorally Aware Spoken Dialogue Generation with Large Language Models)’을 개발했다. 거대 언어 모델(Large Language Model, LLM)에 기반한 BeDLM은 대화 상황과 두 화자의 행동 패턴이 입력되면 실제 사람 간 대화에 가까운 음성 대화를 손쉽게 만들어내는 AI 기술이다. 추임새를 넣거나 말을 끊는 습관, 말버릇 등의 대화 행동을 자연스럽게 조절해 반영하기 때문에 기존 AI 대화 시스템의 한계를 극복하고 한층 더 사람다운 음성 대화를 생성할 수 있다.
◇ 기대 효과
BeDLM은 향후 팟캐스트 콘텐츠 제작, 상담 AI, 개인 맞춤형 음성 비서 등 사람과 AI 간의 상호작용과 정서적 반응이 필요한 여러 분야에서 널리 활용될 것으로 예상된다. 나아가 이 기술은 앞으로 상담, 교육, 돌봄 서비스 등 다양한 영역에서 사람과 AI가 더욱 원활하게 소통할 수 있도록 돕는 데에도 이용될 전망이다. 아울러 이번 연구에서 개발된 Behavior-SD 데이터셋과 코드는 모두 오픈소스로 공개돼 국내외 연구자 누구나 자유롭게 활용할 수 있다. 따라서 관련 기술의 확산과 후속 연구 또한 촉진될 것으로 기대된다.
◇ 연구진 의견
김건희 교수는 “대화하는 사람은 보통 말하는 중에도 귀를 열고 상대방의 음성적 반응과 시각적 반응에 적응하고 맞춰가며 대화를 이끄는데, 지금까지 개발된 AI 대화 생성 모델은 이를 반영하지 못했기 때문에 그 한계를 넘고자 했다”면서 “AI가 사람처럼 자연스럽게 대화하는 기술을 한 단계 더 발전시켰다는 점에서 금번 연구의 의미가 크다”고 밝혔다.
논문의 제1저자인 이세훈 연구원은 “이번 연구는 음성 대화에서만 나타나는 다양한 행동 패턴을 데이터와 모델에 반영함으로써 한층 더 사람다운 대화를 AI로 구현하는 작업이 가능해졌다는 데 그 의의가 있다”고 밝혔다. 이어 “물론 데이터를 구축하고, AI가 사람의 대화 행동을 이해하도록 하는 모델링 방법을 찾는 과정이 쉽지 않았다”고 연구과정을 돌아보며 “BeDLM이 실제 음성 대화 서비스에 적용돼 자연스럽고 몰입감 높은 대화를 제공하는 AI 기술로 자리매김하길 기대한다”고 말했다.
◇ 연구진 진로
서울대 컴퓨터공학부에서 박사과정을 밟고 있는 이세훈 연구원은 AI가 사람의 더 다양한 행동 패턴을 모델링하고 세밀하게 조절할 수 있도록 행동 기반 음성 대화 생성 모델의 고도화를 연구하고 있다. 앞으로 음성 기반 대화형 AI의 심화 기술을 계속 연구할 예정이며, 기업 인턴십 등 실무 경험을 통해 실제 서비스 적용과 기술 확산에도 기여할 계획이다.
최신기사
서울공대 컴퓨터공학부 김건희 교수팀, 말버릇·추임새도 사람처럼 따라 하는 AI 대화 생성 모델 개발
- 최정은
- 2025-05-30 16:21
자연어처리 최우수학회 ‘NAACL 2025’ 음성 인식 부문 최고 논문상 수상
팟캐스트 제작, 상담 AI, 음성 비서, 돌봄 서비스 분야 상용화 기대
‘언어를 배우다, 커리어가 되다’ 사이버한국외국어대학교, 2025학년도 2학기 신·편입생 모집
2025-05-30 16:21최신기사
라이프
경남도, 과기부 공모 선정, 인공지능이 하동·산청 산불 감시
경상남도는 과학기술정보통신부(전담기관: 정보통신산업진흥원) 주관 ‘온디바이스 AI 서비스 실증‧확산’ 공모사업에 경남도 컨소시엄이 선정돼 국비 57억 원을 확보했다고 밝혔다.도는 하동군·산청군, 경남테크노파크, 인텔리빅스 등 기업 4곳과 경남 컨소시엄...
전다희 기자 2025-06-24
경남도, 마창대교 국제중재 판정 일부 승소
경남도가 ㈜마창대교(대주주 맥쿼리한국인프라투융자㈜)와 벌인 국제중재에서 18일 일부 승소함에 따라 ㈜마창대교가 부당하게 취득한 22억 원 상당의 재정지원금을 지급 보류한 것은 타당하다고 판정받았다.이번 판정 결과는 도에서 시행한 민자사업 중 국제중재를...
차효정 기자 2025-06-23
“빨래방 맹글어줘 고맙소”…전남도, 마을 공동빨래방 인기
전라남도가 고향사랑기금 일환으로 운영 중인 마을 공동빨래방이 큰 호응을 얻고 있다.전남도는 고향사랑기금으로 조성된 ‘마을 공동 빨래방 공식 1호점’ 현판식을 지난 19일 완도 청산면 청산국민체육센터에서 개최했다.사업 시행 이후 처음으로 열린 이날 현판...
홍정훈 기자 2025-06-20
경기연구원, “로컬상권 육성사업, 법제적 근거와 사업모델 재정립 필요”
민간 주도로 창출된 로컬(지역)상권, 여기에 정부 예산지원이 더해진 육성정책의 실태를 진단하고 발전방안을 모색한 보고서가 나왔다.경기연구원이 발간한 ‘로컬상권 육성정책의 현황과 발전과제’ 연구보고서는 기존의 공공주도형 전통시장 활성화 지원사업과는 본질...
조이진 기자 2025-06-19
교육 인기기사
중요기사
현대건설, 북유럽 대형원전 사업 진출 본격 시동
현대건설이 동유럽에 이어 북유럽 대형원전 시장 진출에 본격 드라이브를 걸고 유럽 원전 영토 확장에 속도를 더한다.현대건설은 19일(현지시간), 핀란드 국영 에너지 기업 포툼(For...
전다희 기자 2025-06-24
삼성전자 ‘갤럭시 언팩 2025’ 개최
삼성전자가 현지시간 7월 9일 오전 10시(한국시간 7월 9일 오후 11시) 미국 뉴욕 브루클린에서 ‘갤럭시 언팩 2025(Galaxy Unpacked July 2025: The ...
전다희 기자 2025-06-24
‘나노코리아 2025’ 국가 전략산업 초격차 달성 나노융합기술 트렌드 제시
반도체, 이차전지, 미래차, 우주항공, 방산 등 국가 전략산업의 초격차 달성에 필수적인 나노융합기술의 이슈와 트렌드를 제시하는 다양한 주제의 세미나가 ‘나노코리아 2025(NANO...
전다희 기자 2025-06-24
슈프리마, 유연한 보안 시스템 구축을 위한 출입통제 제품군 확장
AI 통합 보안 솔루션 전문기업 슈프리마가 새로운 2-도어 컨트롤러인 ‘코어스테이션 20(CoreStation 20, CS-20)’과 2-도어, 4-리더를 지원하는 ‘도어 인터페이...
전다희 기자 2025-06-24
웹케시, SI 철수 9년 만에 AI기반 차세대 금융 SI 재진출 선언
웹케시그룹 석창규 회장이 2016년 그룹 내 모든 시스템 통합(SI) 사업을 전면 중단하고 ‘SaaS 및 수수료 기반 비즈니스’에 전념하겠다고 선언한 이후 9년 만에 SI 사업 재...
전다희 기자 2025-06-24
안랩 그룹, 정보보호 국제표준 ‘ISO/IEC 27001:2022’ 인증 획득으로 그룹 보안관리체계 강화
안랩( www.ahnlab.com)이 최근 국제표준 정보보호 인증인 ‘ISO/IEC 27001:2022(이하, ISO 27001)’을 자회사 3사와 동시 획득하며 그룹 내 정보보호...
전다희 기자 2025-06-24
LG유플러스 R&D 인재 모인 마곡에서 타운홀미팅 개최
LG유플러스(www.lguplus.com)는 23일 서울 마곡사옥에서 2분기 전사 타운홀미팅을 열고, 구성원이 주도적으로 회사의 변화와 전략 방향을 공유하는 자리를 마련했다고 밝혔...
전다희 기자 2025-06-24