풀듀플렉스
full duplex · 전이중
듣기와 말하기를 동시에 처리하는 음성 모델 구조입니다. 한쪽이 말을 끝내야 다음이 말하는 턴제와 달리 말이 겹쳐도 되고, 말할지 들을지를 1초에 수십 번 판단합니다.
‘풀듀플렉스’ 이 나오는 글1
소식AI
맞장구치며 듣는 챗GPT, 오픈AI가 음성 모델 GPT-Live를 공개했습니다
오픈AI가 7월 8일(미국 시각) 챗GPT 음성 모드를 새 모델 GPT-Live로 바꿨습니다. 대학원 수준 과학 문제 평가 GPQA에서 기존 음성 모드는 45.3점, 추론 강도를 하이로 둔 GPT-Live-1은 84.2점을 받았습니다.

9분
함께 나오는 용어4
- 지식 벤치마크객관식과 단답으로 모델의 지식과 계산 실력을 재는 시험지 계열입니다. MMLU와 GPQA, AIME가 대표인데 상위 모델이 몰려 변별력이 떨어졌고, 최근 점수 도약은 명령을 실행하고 결과를 받는 에이전트 과제 쪽에서 나옵니다.
- 추론 강도모델이 과제에 얼마나 많은 계산과 검증을 쓰도록 할지 조절하는 설정입니다. 높은 값은 토큰 사용량과 실행 시간을 늘릴 수 있지만 정답을 보장하지 않습니다. 지원 단계와 적용 범위는 모델·제품별로 다릅니다.
- 음성 모델말을 알아듣는 인식과 소리를 만드는 합성을 맡는 모델입니다. 받아쓰기가 운영체제 기본 기능으로 들어갔고, 20명이 동시에 말해도 화자를 가려내는 서비스가 시간당 0.18달러 선에서 나왔습니다.
- 추론학습이 끝난 모델을 실제로 돌려 답을 만드는 단계입니다. 비용·속도·지연 시간 이야기는 대부분 여기서 나옵니다.
