← Voltar ao Transcreve BR

API e integrações · Brainiall

Leve voz e documentos para o fluxo que você já usa.

API Brainiall

A API canônica em api.brainiall.com oferece transcrição, síntese de voz e PDF para Markdown. A chave fica sob controle do cliente, e o consumo é medido pela conta Brainiall. Consulte a documentação e exemplos antes de integrar em produção.

Se o fluxo atual usa a API de áudio da OpenAI, gere uma alteração de código auditável no nosso construtor de migração explícita para TTS. Ele não alega compatibilidade drop-in e deixa campos, chave e processamento hospedado visíveis.

MCP remoto para TTS

O servidor MCP público conecta clientes compatíveis à síntese de voz da Brainiall. Ele exige uma chave do próprio cliente e não incorpora credenciais no pacote. Veja o código e a configuração.

Para instalar o mesmo servidor no Cline, siga o guia de TTS pt-BR com chave própria. O guia deixa explícito o teste E2E ainda pendente e usa somente o endpoint canônico.

Para outros clientes Streamable HTTP, use os connection kits locais do Msty Studio ou do Hugging Face Chat UI. Os dois entregam somente endpoint e marcador de chave; nenhuma conexão ao vivo é iniciada pela página.

Provider de fala para Dify · beta

O provider reúne STT pt-BR com diarização e TTS pt-BR em um pacote instalável pelo GitHub. A versão atual é candidata: os testes automatizados passaram, mas o smoke completo dentro de uma instância Dify com chave válida ainda está pendente. Avalie o repositório público com essa limitação explícita. Consulte também os guias separados de STT com diarização e TTS com vozes pt-BR.

Actors no Apify

Há actors públicos para transcrição com diarização e para converter PDF em Markdown. Eles cobram por evento na plataforma e podem ser acionados por API, schedule ou workflow Apify. Confira catálogo, preço e exemplos no perfil da Brainiall no Apify.

Antes de enviar um documento longo, use a calculadora local de orçamento de tokens para PDF e Markdown. Ela não recebe o arquivo e separa uma heurística transparente de um relato público, sem tratá-lo como benchmark da Brainiall.

Se você usa AnythingLLM Desktop ou Docker, instale os pacotes abertos com aprovação e teto de custo. Eles cobrem transcrição, PDF para Markdown e pesquisa pública de empresas sem embutir credenciais.

Voice-agent builders

Para Vapi, Retell, Bland e Ultravox, o caminho testado é um handoff estreito de webhook ou HTTP Tool: validar o evento, revisar transcript e speakers e só depois exportar. Estas páginas não alegam integração nativa, listing ou parceria aprovada.

Para outras stacks, há rotas separadas para revisar observabilidade de Hume EVI, SessionReport do LiveKit, lifecycle do Pipecat Cloud e post-call webhooks da ElevenLabs. São handoffs provider-neutral, sem alegar integração nativa, listing, endorsement ou parceria aprovada.

Para quem já recebe saída de speech-to-text, o Lab também oferece preflights provider-neutral de batch, diarização, webhooks e captions para Google Cloud, Amazon Transcribe, Azure Speech, Deepgram e AssemblyAI. Não são integrações nativas nem benchmarks de accuracy.

Comece pelo menor teste

Para uso direto no navegador, envie um arquivo real no Transcreve BR. Para automação, valide primeiro um arquivo curto ou uma página de PDF, confira o resultado e só então amplie o volume. Suporte técnico: support@brainiall.com.