Introduction
Overview
SpeechToText SDK는 음성을 텍스트로 변환하기 위한 API를 제공합니다. 3rd party 앱은 SpeechToText SDK를 통해 Pleos Connect의 Speech Service와 연동됩니다. 3rd party 앱이 음성 인식을 요청하면 Speech Service는 인식된 음성을 텍스트로 변환하고, 인식 결과를 앱에 전달합니다.
팁
SpeechToText는 사용자 발화를 "음악 틀어줘"와 같은 텍스트로 변환하여 반환하며, 음악 재생과 같은 실제 동작은 실행하지 않습니다. 인식한 명령에 따라 앱의 기능을 실행하려면 Gleo Interface를 참고하세요.
Entry point
ai.pleos.playground.stt.SpeechToText 클래스는 SpeechToText SDK 기능에 접근하기 위한 entry point입니다. 생성자에 애플리케이션 Context와 인식 Mode를 전달하여 객체를 생성합니다. Mode를 생략하면 HYBRID가 적용됩니다.
SERVER: 서버 기반 streaming TextToSpeech만 사용합니다. 네트워크 연결과 앱 등록이 필요하며, 네트워크 연결에 실패하면 On-device 엔진으로 전환하지 않고 오류 이벤트를 전달합니다. 서버 기반 합성을 사용하려면 Pleos Playground의 My Project 자격 증명을 사용한 앱 등록이 필요합니다.ON_DEVICE: 차량의 On-device 엔진에서 Streaming TextToSpeech를 실행합니다. 네트워크 연결이 필요하지 않으며, 서버 기반 합성을 사용하지 않으므로 앱 등록이 필요하지 않습니다.HYBRID: 기본 모드입니다. 서버 기반 streaming TextToSpeech를 우선 사용하고, 네트워크 연결에 실패하면 SDK가 On-device 엔진으로 자동 전환합니다. Pleos Playground의 My Project 자격 증명을 사용한 앱 등록이 필요합니다.
- Kotlin
- Java
import ai.pleos.playground.stt.SpeechToText
import ai.pleos.playground.stt.constant.Mode
val speechToText = SpeechToText(applicationContext, Mode.HYBRID)
import ai.pleos.playground.stt.SpeechToText;
import ai.pleos.playground.stt.constant.Mode;
SpeechToText speechToText =
new SpeechToText(getApplicationContext(), Mode.HYBRID);
다음 단계에서는 SpeechToText SDK 가져오기와 권한 선언을 완료한 후 SDK를 초기화합니다.
Emulator setup
SpeechToText SDK를 사용하려면 Android Studio에 Pleos Connect Emulator를 설치하고 AVD를 설정합니다.