쌓인 기록에서 찾기
무엇을 찾으세요?
날짜를 몰라도 됩니다. 제목·Key Point·요약·태그를 한꺼번에 뒤집니다.
검색 범위부터 2026년 9월 24일 (목)까지985건
3건 · "대화 AI"조건 지우기 ×
001▲ 10 · 댓글 2대화 AI 연구 재현 문제 푸는 오픈 플랫폼 Gricea기존 대화형 AI 연구는 시스템과 실험 설정이 제각각 보고되어 재현과 확장이 어려운 문제가 있다.AI · 머신러닝 · Gricea: An Open Science Platform for Conversational AI Research
대화 AI 연구 재현 문제 푸는 오픈 플랫폼 Gricea

Key Point대화 AI 연구의 재현 위기가 심각한데, Gricea가 표준화된 플랫폼으로 이를 해결하려는 구체적인 접근을 보여준다.
핵심 요약
- 기존 대화형 AI 연구는 시스템과 실험 설정이 제각각 보고되어 재현과 확장이 어려운 문제가 있다.
- Gricea는 연구 절차, 사용자 인터페이스, 대화 작업을 하나로 묶어 실행·검사·공유·재사용 가능한 조정 가능한 연구 산출물로 표현한다.
- 기존 CUI 2026 논문 중 93%의 설정을 재현할 수 있었지만, 동시에 96%의 논문에서 정확한 재현을 방해하는 정보 부족을 발견했다.
- 사용자 연구 결과 다양한 배경의 연구자와 실무자들이 Gricea로 다양한 연구 질문에 답하는 실행 가능한 연구를 성공적으로 구성했다.
- 공유 가능한 연구 산출물을 통해 대화 AI 연구의 누적적 지식 축적과 오픈 사이언스를 가능하게 한다.
002▲ 207 · 댓글 4실시간 음성·영상 대화 AI, 풀듀플렉스 상호작용 시스템 공개Hugging Face가 실시간 쌍방향 대화가 가능한 Realtime-Venus 시스템을 발표했다.AI · 머신러닝 · Realtime-Venus: A full-duplex interaction system with asynchronous delegation
실시간 음성·영상 대화 AI, 풀듀플렉스 상호작용 시스템 공개

Key Point자연스러운 실시간 음성·영상 대화를 처리하는 시스템이 대규모 벤치마크에서 경쟁 모델을 앞선 성과를 보이고 있으며, 음성 중단과 배경음 같은 현실적 상황에서의 응답 능력이 실용성을 높입니다.
핵심 요약
- Hugging Face가 실시간 쌍방향 대화가 가능한 Realtime-Venus 시스템을 발표했다.
- 영상 상호작용용 Realtime-Venus-Omni과 음성 상호작용용 Realtime-Venus-Audio 두 개의 9B 모델로 구성되며, 각각 연속적 인지, 대화 제어, 음성 생성을 통합한다.
- 사용자 입력·모델 출력·작업 위임을 공유 타임라인으로 관리하며, 별도의 런타임이 백그라운드 작업을 비동기로 처리하면서 전면 상호작용을 이어간다.
- Realtime-Venus-Omni은 StreamingBench(70.2%), OVO-Bench(64.7%), Daily-Omni(81.3%) 등 6개 영상 벤치마크에서 최고 점수를 기록했다.
- 음성 벤치마크에서 MMAU(78.0%), Llama Questions(83.8%), Speech CMMLU(67.8%) 등에서 1위를 차지했으며, 사용자 중단의 75%에 응답하고 백채널·타인 발화·배경음 상황에서 각각 97%, 88%, 86% 지속율을 달성했다.
003▲ 15 · 댓글 2심리학 기반 역할극 AI, 인간다운 상호작용 구현기존 LLM 페르소나는 단순한 설명에 의존해 장기 상호작용에서 캐릭터 일관성을 잃는 문제를 겪고 있다.AI · 머신러닝 · Deep Persona: A Psychologically Grounded Architecture and Evaluation Framework for Role-Playing Agents and Simulations
심리학 기반 역할극 AI, 인간다운 상호작용 구현

Key Point역할극 AI의 인간성을 심리학으로 설계하고 평가하는 새로운 방법론을 제시하며, LLM의 구체적 한계를 규명해 향후 대화형 AI 개선 방향을 제시한다.
핵심 요약
- 기존 LLM 페르소나는 단순한 설명에 의존해 장기 상호작용에서 캐릭터 일관성을 잃는 문제를 겪고 있다.
- 심리학 원리 기반 3계층 구조인 '딥 페르소나'를 제안했으며, 겉으로 드러나는 표현·내재적 신념·핵심 동기의 위계로 조직된다.
- 내부 스크립트로 모델 동작을 제약하는 스크립트 결정론과 한정된 자율성 원칙을 적용했다.
- 심리 임상 도구와 적대적 스트레스 테스트로 자동 평가하는 참조 불필요 평가 프레임워크를 개발했다.
- LLM은 실용적 유창성은 높지만 감정 표현과 공동 주의에서 체계적 한계를 보였다.
- 구조화된 페르소나가 인간 대화 행동과 더 잘 맞는 상호작용을 만들 수 있음을 사례 연구로 입증했다.