Podcast Cover

[Thinking Machines의 새로운 AI 모델: 인간과 같은 실시간 대화의 혁명]-[Critical Look at AI Interaction Models]

Hard Fork AI · B2 · 2026-05-27

Technology
또는 웹버전으로 공부하세요

📋 Summary

Thinking Machines의 혁신적인 AI 음성 모델: 'Full Duplex' 기술의 등장

최근 AI 업계에서는 Thinking Machines가 발표한 새로운 AI 모델이 큰 주목을 받고 있습니다. 이 모델의 핵심은 기존 AI 음성 에이전트들이 겪던 고질적인 문제인 '지연 시간(latency)'을 획기적으로 해결했다는 점입니다. 인간처럼 말을 하면서 동시에 상대방의 말을 듣고 처리할 수 있는 이 기술은 AI 커뮤니케이션의 수준을 한 단계 끌어올릴 것으로 기대됩니다.

기존 AI 음성 에이전트의 한계: 순차적 루프의 문제

현재 대부분의 AI 음성 서비스는 '순차적 루프(sequential loop)' 방식을 사용합니다. 사용자가 말을 마치면 AI가 이를 텍스트로 변환하고, 문맥을 파악한 뒤 응답을 생성하여 다시 음성으로 출력하는 구조입니다. 이 과정에서 필연적으로 발생하는 지연 시간은 대화의 흐름을 끊고 부자연스러운 느낌을 줍니다. 특히 사용자가 말을 하는 도중에 AI가 끼어들거나, 반대로 AI가 응답하는 도중 사용자가 말을 끊었을 때 AI가 제대로 대응하지 못하고 멈춰버리는 현상은 사용자로 하여금 '로봇과 대화하고 있다'는 거부감을 느끼게 합니다.

'Full Duplex' 기술을 통한 실시간 소통

Thinking Machines가 제시한 솔루션은 기술적으로 'Full Duplex(전이중 통신)'라고 불립니다. 이는 인간이 대화할 때처럼 상대방의 말을 듣는 동시에 자신의 응답을 구성하고, 필요하다면 대화 도중에도 실시간으로 정보를 처리하여 반응하는 방식입니다. 팟캐스트 진행자들은 이를 두고 "마치 클로드(Claude)가 대규모 프로젝트를 수행하며 중간에 새로운 지시를 받아 답변을 동적으로 수정하는 것과 같은 개념"이라고 설명합니다. 이 기술은 밀리초(millisecond) 단위의 빠른 응답 속도를 구현하여, 기존 AI와는 차원이 다른 자연스러운 대화 경험을 제공합니다.

비즈니스적 가치와 시장의 수용성

많은 기업이 AI 리셉셔니스트 도입을 고민하지만, 과거의 딱딱한 자동 응답 시스템에 대한 부정적인 기억 때문에 망설이는 경우가 많습니다. 그러나 Thinking Machines의 기술이 적용된다면, AI는 단순히 질문에 답하는 수준을 넘어 실제 업무를 처리하는 권한을 갖춘 능동적인 에이전트로 진화할 것입니다.

진행자들은 AI 도입의 핵심을 '사람을 대체하는 것'이 아니라 '기존에 처리하지 못했던 영역을 해결하는 것'으로 프레임을 전환해야 한다고 강조합니다. 예를 들어, 고객 응대 지연 문제를 해결하거나 24시간 즉각적인 지원을 제공함으로써 기업의 생산성을 극대화하는 방향입니다. "사람들은 AI가 완벽하게 작동하여 자신의 문제를 해결해 준다면, 그것이 사람이든 기계든 상관하지 않을 것"이라는 점이 이 기술의 상업적 성공 가능성을 뒷받침합니다.

향후 전망: 기술 경쟁과 파트너십

Thinking Machines의 설립자인 Miri Mirati의 신뢰도와 OpenAI 초기 투자자로서의 배경은 이 프로젝트에 강력한 힘을 실어주고 있습니다. 하지만 일각에서는 OpenAI나 구글과 같은 거대 기업들이 이 기술을 빠르게 복제(clone)하거나 독자적인 버전을 출시할 가능성도 제기합니다.

결국 이 기술이 시장을 지배할지 여부는 '타이밍'에 달려 있습니다. Thinking Machines가 곧 공개할 제한적인 연구 프리뷰와 연내 예정된 광범위한 출시가 시장의 판도를 바꿀 수 있을지, 혹은 11 Labs와 같은 다른 음성 전문 기업과의 파트너십을 통해 생태계를 확장할지가 향후 AI 음성 시장의 핵심 관전 포인트가 될 것입니다.

🎯Key Sentences

1
I mean, I think this is a great idea.
제 생각에는 정말 좋은 아이디어인 것 같아요.
2
there's still a little bit of unnatural lag that happens
여전히 약간의 부자연스러운 끊김 현상이 남아 있네요.
3
Anyways, I think it's a great idea.
어쨌든, 아주 좋은 생각인 것 같아요.
4
I want to get into some of the technical stuff here
이제 좀 기술적인 부분으로 들어가 보려고 합니다.
5
that is just pure kind of clout and credibility.
그건 순전히 영향력과 신뢰도에 관한 문제일 뿐이야.
모두 펼치기

📝Key Phrases

1
latency issue
지연 현상
2
take in all the data
모든 데이터를 수집하세요.
3
deep dive
심층 분석
4
lock in this price
이 가격으로 확정해 주세요.
5
nitty-gritty details
핵심적인 세부 사항
모두 펼치기

📖 Transcript

Welcome to the ai hustle podcast.
Today on the show we're talking about a brand new um product that is coming out of thinking machines.
It is a ai model that essentially listens while it talks, so similar to a human.
A lot of times we've had this latency issue with things like 11 labs or other of these kind of AI voice receptionists.
There's so many different industries that this applies to, but there's a latency where you speak and it has to try to take in all the data, compute it, think of its response and spit it out to as fast as possible.
And there's kind of a little latency gap.

ListenLeap이 실제 문맥에서 학습하도록 이끌어줌

🎨 흥미로운 콘텐츠
🌍 실제 자료
📱 언제든 듣고 보기