IT
OpenAI, 더 자연스러운 실시간 대화를 위한 새로운 음성 모델 출시
AI 심화 요약
오픈AI가 더 자연스럽고 즉각적인 대화가 가능한 GPT-Live-1과 GPT-Live-1 mini 모델을 공개했습니다. 이 모델들은 음성 인식과 답변 생성이 동시에 이루어지는 풀 듀플렉스 방식을 채택해 사용자의 말을 끊거나 대화 흐름을 매끄럽게 유지할 수 있습니다. 기존의 3단계 처리 방식에서 벗어나 GPT-5.5와 같은 최신 모델과 연동해 복잡한 추론과 시각 정보 제공까지 가능해졌습니다. 오픈AI는 이번 변화를 통해 음성이 향후 복잡한 업무를 처리하는 주요 인터페이스가 될 것으로 기대하며, 사용자가 장시간 핸즈프리로 대화하며 다양한 작업을 수행하는 환경을 구축하려 합니다. 경쟁사들이 음성 비서의 표현력을 강화하는 가운데, 오픈AI 역시 더 긴 대화와 지능형 에이전트 역할을 강조하며 시장 선점에 나섰습니다.
핵심 요약 (3줄)
• OpenAI가 실시간 대화 기능을 강화한 GPT-Live-1 및 GPT-Live-1 mini 모델을 출시함. • 풀 듀플렉스 기술을 통해 사용자의 말을 중간에 끊거나 동시에 듣고 말하는 자연스러운 상호작용이 가능해짐. • 향후 음성을 컴퓨팅의 주요 인터페이스로 활용하여 복잡한 업무를 처리하는 AI 에이전트 환경을 구축할 계획임.