API de transcrição PT-BR

Separe falantes sem perder os timestamps.

Transcreva um áudio ou vídeo autorizado em português brasileiro e receba JSON com texto, timestamps por palavra e rótulos anônimos de falante. O contrato público descreve somente o endpoint verificado.

Diarização

Rótulos como SPEAKER_00 marcam turnos de fala; não identificam pessoas.

Timestamps

Cada palavra retorna início e fim para revisão, legendas e busca interna.

Integração

Uma operação multipart em OpenAPI 3.1, com exemplos curl, Python e Node.

Quando usar

Times de produto, pesquisa, suporte ou conteúdo que já têm uma gravação permitida e precisam distinguir falantes, revisar trechos ou gerar SRT e WebVTT. Não use para identificar voz, vigiar pessoas ou processar uma gravação sem direitos, aviso ou consentimento aplicável.

Como funciona

  1. Confirme direitos, aviso ou consentimento antes de selecionar o arquivo.
  2. Crie uma chave dedicada e confira preço e saldo atuais.
  3. Envie uma única requisição com idioma pt e diarize=true.
  4. Revise texto, tempos e turnos humanos antes do uso.

A API é metered. Os clientes seguros não repetem automaticamente uma requisição ambígua, pois um reenvio pode gerar nova cobrança.

Perguntas frequentes

Quais arquivos? Os exemplos aceitam arquivos locais regulares .mp3, .wav, .m4a, .mp4, .mpeg, .mpga, .webm e .ogg, limitados a 25 MB.

A página envia meu áudio? Não. Esta landing e a referência são somente leitura. O envio ocorre apenas quando você executa conscientemente um cliente com sua chave.

Há retry automático? Não nos clientes publicados. Verifique o uso da conta antes de decidir um reenvio manual.