← Voltar às integrações

Dify · text-to-speech pt-BR

Voz brasileira em WAV dentro de workflows Dify.

O que o provider faz

O modelo brainiall-tts-pt-br envia somente o texto escolhido à API Brainiall e retorna um arquivo RIFF/WAVE completo. A invocação aceita até 4.000 caracteres e usa velocidade fixa 1.0. O plugin rejeita uma resposta que não contenha um contêiner WAV plausível com dados de áudio.

Vozes permitidas

A release oferece três IDs pt-BR: pf_dora (Dora), pm_alex (Alex) e pm_santa (Santa). Um valor vazio ou não suportado cai em pf_dora; o provider não encaminha IDs arbitrários ao serviço.

Como avaliar

Baixe o .difypkg na release candidata, instale pelo Plugin Center, cadastre uma chave Brainiall dedicada e escolha brainiall-tts-pt-br no workflow. Comece com uma frase curta, escute o WAV inteiro e confira pronúncia, direitos do texto e custo antes de aumentar o volume.

Dados, custo e idempotência

O texto necessário à síntese é processado pela Brainiall. A validação da credencial usa a lista de vozes e não gera áudio. A integração não segue redirects nem faz retry automático, reduzindo o risco de repetir uma chamada cobrável. O plugin é aberto; o uso da API pode ser cobrado depois dos créditos incluídos na conta.

Limite de evidência

O pacote passou 41 testes com transporte simulado, CLI Dify e verificação do arquivo. Isso não prova qualidade de voz no seu caso, instalação externa, comprador ou receita. Faça um teste reproduzível e envie problemas sem incluir chaves ou texto confidencial no repositório.