INTUNELABS 음성 파이프라인

한국어 대화의 호흡에 맞춘 실시간 파이프라인.

말을 듣고 목소리로 답하는 한국어 우선 파이프라인입니다. 맞장구는 기다리고, 끼어들기는 구분하며, 통화를 끊는 대신 기능을 낮춥니다. 음성·언어 모델은 벤더를 오케스트레이션하고, 대화 계층은 직접 만듭니다.

데모 문의하기
심청이 앱 대화 탭의 ‘함께할 친구’: 음성 대화 상대 심청이와 철수

턴 처리

맞장구와 쉼을, 말이 끝난 신호로 치지 않습니다.

“네”, “음” 같은 짧은 호응과 말 사이의 쉼을 새 턴으로 처리하지 않습니다. 에이전트가 언제 듣고 답하는지는 데모 통화에서 확인합니다. 지연 시간 벤치마크는 공개하지 않습니다.

심청이에서 통화 흐름 보기
심청이 앱에서 대화 상대 심청이와 음성으로 대화하는 화면

서비스에 맞는 설정

목소리와 역할은 콘솔에서 정합니다.

Console에서 에이전트의 목소리, 역할, 첫 인사를 정합니다. 파이프라인은 그 구성을 브라우저와 모바일에서 동일하게 실행합니다.

Console 살펴보기
AI 음성의 역할과 목소리를 설정하는 제품 콘셉트 이미지

중단 대신 저하

상황이 불확실하면, 통화를 끊지 않습니다.

위험한 경로는 기본적으로 꺼져 있습니다. 기능이 불확실하면 파이프라인이 한 단계 낮춰 동작하고, 음성 합성에는 고정형 페일오버가 있습니다. 무음이 길어지면 감지합니다. 지연 시간 벤치마크는 공개하지 않습니다.

통화를 끊는 대신 기능을 낮추는 음성 파이프라인을 표현한 제품 콘셉트 이미지

도입 전에 정하는 것

통화의 목적과, 사람이 개입하는 지점.

누구와, 어떤 경로로 말할까요?

언어, 이용 환경, 대화의 목적을 먼저 정합니다. 브라우저와 모바일 음성은 지금 동작하고, 전화망은 구축되어 있으나 키로 잠겨 있습니다.

팀이 확인할 범위는 어디까지인가요?

응답의 범위, 담당자 확인이 필요한 상황, 기록과 데이터 처리(보관 기간 포함)를 배포 단위로 정합니다. 위험한 경로는 기본적으로 꺼져 있습니다.

파이프라인을 데모 통화로 살펴보세요.

턴 처리, 안정성, 배포할 트랜스포트를 함께 확인합니다. 음성·언어 모델은 직접 학습시키지 않으며, 통화별 측정값은 운영을 위한 계측이지 공개 벤치마크가 아닙니다.