Áudio
ElevenLabs V3 TTS audio
ElevenLabs V3 text-to-speech — narração multilíngue de alta fidelidade com 21 vozes.
Categoria: Texto em voz · elevenlabs-v3-tts
Como usar & limites
- Texto→fala (TTS) multilíngue de alta fidelidade, com 21 vozes.
- text: 1 a 5.000 caracteres.
- stability de 0 a 1 (padrão 0,5) controla a consistência da voz.
- language_code opcional em ISO 639-1 força um idioma; timestamps opcional retorna um JSON separado.
Capacidades
O que este modelo suporta, direto do schema — sem preços, sem detalhes de infraestrutura.
| Capacidade | Valor |
|---|---|
tts Texto em voz | Sim |
voice Seleção de voz | Sim |
voices Vozes disponíveis | 21 |
max_prompt_length Tamanho máx. do prompt | 5000 |
Parâmetros
Campos aceitos em params (ou de primeira classe, quando aplicável) para POST /generations.
| Nome | Rótulo | Tipo | Obrigatório | Padrão | Opções | Mín / Máx | Descrição |
|---|---|---|---|---|---|---|---|
timestamps | Timestamps | boolean | Opcional | false | — | — | Se ligado, retorna timestamps por palavra em um JSON separado. |
stability | Estabilidade | number | Opcional | 0.5 | — | 0 – 1 | Estabilidade da voz de 0 a 1; padrão 0,5. |
language_code | Idioma (ISO 639-1) | text | Opcional | — | — | — | Código de idioma ISO 639-1 opcional para forçar o idioma. |
apply_text_normalization | Normalização de texto | select | Opcional | auto | auto · on · off | — | Normalização de texto: auto (padrão), on ou off. |
voice | Voz | select | Opcional | Rachel | Aria · Roger · Sarah · Laura · Charlie · George · Callum · River · Liam · Charlotte · Alice · Matilda · Will · Jessica · Eric · Chris · Brian · Daniel · Lily · Bill · Rachel | — | Voz da narração (uma das 21 disponíveis); padrão Rachel. |
text | Texto | textarea | Obrigatório | — | — | — | Texto a converter em fala, 1 a 5.000 caracteres. |
Exemplo de requisição
curl -X POST https://caranguejo.art/api/v1/dev/generations \
-H "Authorization: Bearer $CK" \
-H "Content-Type: application/json" \
-d '{
"model": "elevenlabs-v3-tts",
"text": "Olá! Este é um teste do sistema de conversão de texto em fala.",
"params": {
"voice": "Rachel",
"stability": 0.5,
"apply_text_normalization": "auto",
"language_code": "en",
"timestamps": false
}
}'
const res = await fetch("https://caranguejo.art/api/v1/dev/generations", {
method: "POST",
headers: {
"Authorization": "Bearer " + process.env.CK,
"Content-Type": "application/json",
},
body: JSON.stringify({
"model": "elevenlabs-v3-tts",
"text": "Olá! Este é um teste do sistema de conversão de texto em fala.",
"params": {
"voice": "Rachel",
"stability": 0.5,
"apply_text_normalization": "auto",
"language_code": "en",
"timestamps": false
}
}),
});
const { data } = await res.json();
Exemplo de resposta
{
"id": "9f0c1a7e-…",
"object": "generation",
"model": "elevenlabs-v3-tts",
"type": "audio",
"status": "completed",
"output": {
"assets": [
{
"url": "https://media.caranguejo.art/outputs/example.mp3",
"type": "audio"
}
]
}
}
O custo real do job é retornado em credits_charged na resposta concluída — consulte GET /balance para o saldo da conta.
Erros comuns deste tipo de job:
insufficient_credits | Saldo insuficiente para cobrir o job. |
content_policy_violation | Prompt ou mídia recusados por política de conteúdo. |
generation_timeout | O job excedeu o tempo máximo de processamento. |
rate_limited | Limite de requisições por minuto excedido. |
invalid_input | Parâmetro obrigatório ausente ou fora do schema do modelo. |
generation_failed | Falha genérica no processamento do job. |