본문으로 건너뛰기

Introduction

Overview

TextToSpeech SDK는 텍스트를 음성으로 합성하고 재생하기 위한 API를 제공합니다. 3rd party 앱은 TextToSpeech SDK를 통해 Pleos Connect의 Speech Service와 연동됩니다. 3rd party 앱이 텍스트의 음성 합성을 요청하면 Speech Service가 이를 처리하고, 합성된 음성을 차량의 오디오 시스템으로 재생합니다.

Entry point

ai.pleos.playground.tts.TextToSpeech 클래스는 TextToSpeech SDK 기능에 접근하기 위한 entry point입니다. 생성자에 애플리케이션 Context와 실행 Mode를 전달하여 객체를 생성합니다. Mode를 생략하면 HYBRID가 적용됩니다.

  • SERVER: 서버 기반 streaming TextToSpeech만 사용합니다. 네트워크 연결과 앱 등록이 필요하며, 네트워크 연결에 실패하면 On-device 엔진으로 전환하지 않고 오류 이벤트를 전달합니다. 서버 기반 합성을 사용하려면 Pleos Playground의 My Project 자격 증명을 사용한 앱 등록이 필요합니다.
  • ON_DEVICE: 차량의 On-device 엔진에서 Streaming TextToSpeech를 실행합니다. 네트워크 연결이 필요하지 않으며, 서버 기반 합성을 사용하지 않으므로 앱 등록이 필요하지 않습니다.
  • HYBRID: 기본 모드입니다. 서버 기반 streaming TextToSpeech를 우선 사용하고, 네트워크 연결에 실패하면 SDK가 On-device 엔진으로 자동 전환합니다. Pleos Playground의 My Project 자격 증명을 사용한 앱 등록이 필요합니다.
import ai.pleos.playground.tts.TextToSpeech
import ai.pleos.playground.tts.constant.Mode

val textToSpeech = TextToSpeech(applicationContext, Mode.HYBRID)

다음 단계에서는 TextToSpeech SDK 가져오기권한 선언을 완료한 후 SDK를 초기화합니다.

Emulator setup

TextToSpeech SDK를 사용하려면 Android Studio에 Pleos Connect Emulator를 설치하고 AVD를 설정합니다.

  1. 개발 환경 요구사항 확인
  2. Pleos Connect Emulator 설치
  3. AVD 생성 및 실행
  4. 마이크 접근 설정
  5. Cold boot 설정
  6. AVD에서 Bluetooth 동글 연동