Separe falantes sem perder os timestamps.
Transcreva um áudio ou vídeo autorizado em português brasileiro e receba JSON com texto, timestamps por palavra e rótulos anônimos de falante. O contrato público descreve somente o endpoint verificado.
Diarização
Rótulos como SPEAKER_00 marcam turnos de fala; não identificam pessoas.
Timestamps
Cada palavra retorna início e fim para revisão, legendas e busca interna.
Integração
Uma operação multipart em OpenAPI 3.1, com exemplos curl, Python e Node.
Quando usar
Times de produto, pesquisa, suporte ou conteúdo que já têm uma gravação permitida e precisam distinguir falantes, revisar trechos ou gerar SRT e WebVTT. Não use para identificar voz, vigiar pessoas ou processar uma gravação sem direitos, aviso ou consentimento aplicável.
Como funciona
- Confirme direitos, aviso ou consentimento antes de selecionar o arquivo.
- Crie uma chave dedicada e confira preço e saldo atuais.
- Envie uma única requisição com idioma
ptediarize=true. - Revise texto, tempos e turnos humanos antes do uso.
A API é metered. Os clientes seguros não repetem automaticamente uma requisição ambígua, pois um reenvio pode gerar nova cobrança.
Perguntas frequentes
Quais arquivos? Os exemplos aceitam arquivos locais regulares .mp3, .wav, .m4a, .mp4, .mpeg, .mpga, .webm e .ogg, limitados a 25 MB.
A página envia meu áudio? Não. Esta landing e a referência são somente leitura. O envio ocorre apenas quando você executa conscientemente um cliente com sua chave.
Há retry automático? Não nos clientes publicados. Verifique o uso da conta antes de decidir um reenvio manual.