Skip to main content

CartesiaSTT

Cartesia speech-to-text provider. Creates a configured Cartesia STT provider for use in a voice agent.

Constructor

apiKey
string | null
Cartesia API key. Falls back to the CARTESIA_API_KEY env var, then null.
model
CartesiaSTTModel | string
Transcription model. Default: 'ink-whisper'.
language
string
Transcription language code. Default: 'en'.
sampleRate
number
Audio sample rate in Hz. Default: 48000.

close

Release any resources held by the provider.

closeEmitter

Close the emitter: drop all handlers and stop emitting. Waits up to 2 seconds for in-flight async handlers to settle before returning.

emit

event
string
required

getRuntimeConfig

returns
Record<string, any>

listenerCount

event
string
required
returns
number

off

event
string
required
handler
EventHandler
required

on

event
string
required
handler
EventHandler
required
returns
EventHandler

once

event
string
required
handler
EventHandler
required
returns
EventHandler

onSttTranscript

Register a callback to receive transcripts as they are produced.
callback
SttTranscriptCallback
required

processAudio

Process a buffer of audio frames. Override in a custom provider.

removeAllListeners

event
string

streamTranscribe

Transcribe a streaming audio source, yielding STTResponses. Override in a custom provider.
returns
AsyncIterator<STTResponse>

CartesiaSTTModel

Supported Cartesia speech-to-text model names.