본문 바로가기

보이스 스튜디오

사람처럼 듣고, 사람처럼 말하는 생성형 AI

당신의 음성, 잘 알아듣고 진짜 사람 같은 다양한 목소리로 말할 수 있습니다.
VOICE STUDIO는 다양한 음성 비즈니스에 활용 가능한 고품질 음성인식, 음성합성의 생성형AI 제품입니다.
정확한 음성인식과 사람같이 자연스러운 음성 합성 기술로 사람과 AI의 원활한 커뮤니케이션이 가능해집니다.

#인공지능상담확장 #자동자막생성 #음성기반가상비서 #음성검색 #AI음성녹음 #AI휴먼
Core Features

VOICE STUDIO의 주요기능

  • 95.6% 음성 인식률

    약 10,000시간 분량의 탄탄한 8kHz/16kHz 데이터로 학습된 고성능 베이스라인 모델을 제공으로 적은 데이터로도 도메인에 충분한 퍼포먼스를 보장합니다

  • 실시간 스트리밍 음성 인식

    스트리밍 트랜스포머 음성인식 기술을 적용하여 음성 인식을 실시간으로 처리함으로써
    자연스러운 대화 처리가 가능합니다.

  • 초당 5분 음성데이터 화자 분리

    i-Vector 기반 화자 분리 엔진을 탑재하여, 일괄처리 방식으로 동작 시 1초당 5분의 음성데이터 화자 분리가 가능합니다.

Detailed functions

VOICE STUDIO 세부기능

  • Real-Time STT

    95.6% 높은 정확도의
    실시간 음성인식

    VOICE STUDIO의 음성인식 엔진은 음성 인터페이스 기반의 다양한 실시간 음성 서비스에 활용될 수 있으며 기존 언어 모델, 음향 모델, 발음 사전 등 각각 별도로 학습하는 방식에서 벗어나 종단형 통합 학습을 통해 더 빠르고 정확한 음성인식이 가능합니다.

  • Realistic TTS

    진짜 사람 같은 음성 합성

    VOICE STUDIO의 음성 합성 엔진은 Text를 학습한 목소리 모델을 통해 사람의 음성을 인공적으로 만들어 주며 특히, 딥러닝 기반 End-to-End 전이 학습을 통해 적은 양의 데이터로도 고품질의 음성 합성이 가능합니다.

TOOL INTRODUCTION

도구 소개

음성인식 관리

실시간 스트리밍
지원 음성 인식 엔진

  • 스트리밍 트랜스포머 기반 실시간 음성인식 모델 지원
  • 도메인 데이터를 통한 연결학습 지원
  • 실시간 사용자 어휘 등록 기능
  • 관리도구를 통한 음성인식 이력조회 관리 기능
  • 음성인식 학습 데이터 및 음성인식 모델 관리
  • 음성인식 모델 검증 기능
  • 음성인식 서버 모니터링 및 자원관리 기능
음성합성

음성합성 모델 생성과
소규모 데이터를 기존 모델과
병합하는 전이학습 기능 제공

  • 질의응답세트 관리 기능
  • JSON파일 내보내기/가져오기 기능
  • 질의응답 재교육 기능
  • 질문 추천 기능
  • 유사질문 수동 등록 기능
  • 질의문장 자동 등록 기능
음성전사

도메인별 특화된 음성인식/합성
모델 구현을 위한 학습데이터 구축

  • 작업 단계 통합 모니터링 기능
  • 오디오 음성 파일 업로드 및 Pre-Text 생성 기능
  • 도메인별 전사작업 세트 관리 기능
  • 작업 담당자별 내 작업 관리 기능
  • 작업 결과물 검수 및 결재처리 기능
  • 사용자 권한관리를 통한 따른 작업자 권한 부여 기능
대화이력 관리

대화기록 확인 및 대화 중미 응답 질문에 대한 답변 등록가능

  • 사용자별 대화 기록 확인 기능
  • 일별 대화 기록 내보내기 기능
  • 미응답 문장에 대해 답변 등록 기능
SYSTEM ARCHITECTURE

시스템 구성도

USE CASES

유즈케이스

  • AI 메타휴먼(METAHUMAN)

    LGU+ ‘TV 아이들나라’ AI프로젝트 디지털 휴먼 ‘AI가람이’

    디지털휴먼 가람이를 어린이용 정제된 컨텐츠를 학습시킨 AI와 연령 구분 없이 무분별한 영상 콘텐츠로 학습한 AI로 구분하여 두명의 AI아이를 구현 자연어처리(NLP), 음성합성, 음성인식 등 기술집약 도입효과

    • AI실험이라는 형식의 독창성, 공익적, 교육적 성과로 ‘2020 대한민국광고대상 수상’
  • AI 음성인식

    국회 인터넷 의사중계 사업 실시간 회의 AI 자막시스템 구축

    국회법 개정(2020. 12.22)에 따른 장애인 의정활동 접근성 강화를 위한 의회의사중계에 Al 음성인식 생중계 자막 시스템 시범 구축

    • 기능형 국회 구현 및 의정활동에 대한 국민의 정보 접근성 강화
  • 아웃바운드 AI음성봇

    콜센터 아웃바운드 AI음성봇 활용 업무 자동화

    아웃바운드 콜봇 구축을 통해 고객의 연체 자동 알림, 필수 고지안내, 수익증권 해피콜 등의 상담사 업무 자동화

    • 문의 상담의 질적 제고와 검증이 완료된 지식 정보 안내로 상담 품질 향상
  • AI음성봇

    1세대 고객응대 챗봇 고도화 딥러닝 기술 접목한 AI챗봇

    기존 운영중인 챗봇에서 미답변된 질문에 대해 MRC기술을 활용하여 답변 응대 고도화 및 콜센터 안내 멘트에 대해 음성합성을 이용한 자연스러운 발화 서비스 제공

    • 기존 답변이 어려웠던 질문에 대해 최적의 답변을 제공하여 고객에게 챗봇 활용도와 만족도를 동시에 높이고 이질감 없는 음성 서비스 제공
Reference

현장에서 결과로 이어진 VOICE STUDIO

솔트룩스 실제 사례를 확인해보세요

  • 인공지능 기반 상담부스

    AI상담사 채무조정 민원상담
    시스템 구축

  • 고객 상담 AI 음성봇

    국내 금융권 컨택센터 최초, 실시간
    비대면 AI 콜봇 서비스

  • 아웃바운드 AI 음성봇

    콜센터 아웃바운드 AI음성봇
    활용 업무 자동화

  • 아웃바운드 AI 콜봇

    인공지능(AI)기반 상담 콜봇
    및 직원용 업무 챗봇 시스템 구축

  • 인터넷의사 중계시스템

    AI음성인식 국회 의사
    생중계 자막시스템 구축

  • AI 음성 민원 안내 시스템

    스마트 미러 AI음성인식 민원
    안내 시스템 구축

  • AI 휴먼 평양친구

    북한정보 및 주민들의 말투, 억양 등 음
    성을 학습한 가상 평양사람

  • 비대면 민원처리 디지털 휴먼

    광주시장 디지털 휴먼 구현 민원상담시
    스템 구축

  • 퇴행성 뇌질환자 음성

    퇴행성 뇌질환 음성 데이터 수집을
    위한 AI학습데이터 구축 도구 공급

  • 주제별 음성데이터

    방송데이터 10,000시간 이상 회의 관
    련 음성 7,000시간 이상

  • 방송콘텐츠 대화체 AI 데이터

    방송 콘텐츠 총 17,000 시간
    음성전사 학습데이터 구축

  • 한국어 방언 AI 데이터 구축

    총 15,000시간, 총 250만 문장
    지역별 방언 전사 학습데이터 구축

사람처럼 듣고 말할수 있는 생성형 AI, Voice Studio

정확한 음성인식과 사람같이 자연스러운 음성 합성 기술로
사람과 AI의 원활한 커뮤니케이션이 가능해집니다.