Codificação de áudio. Feita para desenvolvedores.
Codifique, mescle, repita em loop, extraia artes e gere formas de onda — tudo automatizado em uma API simples.




Crie arquivos de áudio menores com controle sobre qualidade e bitrate.
Automatize o processamento de áudio com um único fluxo de trabalho reutilizável.
Crie transcrições, formas de onda e formatos de reprodução a partir de um único upload.
Ganhe tração com áudio
Alcance mais ouvintes. Publique áudio mais rápido.
Dê aos seus engenheiros tempo para construir. Nós cuidamos da infraestrutura de áudio.
Alcance mais ouvintes
Entregue áudio em MP3, AAC, FLAC, ALAC, Opus e outros formatos para os dispositivos que seus ouvintes usam.
Publique áudio mais cedo
Automatize a codificação, as formas de onda, as transcrições e as exportações em um único upload.
Facilite a descoberta de áudio
Transforme fala em texto pesquisável. Traduza transcrições para alcançar mais ouvintes.
Receba mais colaboradores
Permita que os usuários retomem uploads de áudio mesmo em conexões lentas e instáveis.
Lide com picos de tráfego de todos os tamanhos
Compre slots de prioridade extras com antecedência. Colocamos os jobs na fila quando seus slots estiverem ocupados.
Preços por volume para áudio em escala
A Transloadit é mais barata do que a AWS MediaConvert, a Filestack, a Cloudinary e a Uploadcare em grande escala.
Transforme o seu áudio
Na Transloadit, um Robot é um worker automatizado que executa uma única tarefa no seu fluxo de trabalho de áudio — como extrair a arte de capa, codificar áudio ou concatenar arquivos de áudio.
Codifique arquivos de áudio
Converta arquivos de áudio para todo tipo de formato. Como MP3, AAC e mais.
/audio/encodeExtrair ou adicionar arte de capa
Extraia a arte de capa incorporada ou adicione-a aos seus arquivos de áudio.
/audio/artworkConcatenar arquivos de áudio
Concatene vários arquivos de áudio em um único arquivo de áudio.
/audio/concatCriar loops de arquivos de áudio
Repita um arquivo de áudio em loop quantas vezes forem necessárias para atingir uma duração determinada.
/audio/loopMesclar arquivos de áudio
Sobreponha vários arquivos de áudio uns aos outros.
/audio/mergeDividir arquivos de áudio
Transforme gravações longas em clipes ou capítulos com intervalos de tempo precisos.
/audio/splitGerar formas de onda
Gere imagens de forma de onda para seus arquivos de áudio. Estilo totalmente personalizável.
/audio/waveformTranscreva fala em arquivos de áudio
Transforme palavras faladas em texto pesquisável.
/speech/transcribeConverter texto em fala
Escreva texto em um documento e ouça a narração em voz alta.
/text/speak
Crie pipelines de áudio encadeando Robots
Encadeie Robots para criar pipelines automatizados de ponta a ponta para processamento de áudio. Nosso assistente de IA escreve o Template para você.
{"steps": {":original": {"robot": "/upload/handle"},"encode_mp3": {"use": ":original","robot": "/audio/encode","preset": "mp3","ffmpeg": {"ab": "320k","ar": "44100"}},"artwork": {"use": "encode_mp3","robot": "/audio/artwork"},"waveform": {"use": "encode_mp3","robot": "/audio/waveform","style": "v1","width": 640,"height": 160,"waveform_style": "bars","bar_style": "rounded","bar_width": 6,"bar_gap": 4,"pixels_per_second": 54,"amplitude_scale": 0.7,"center_color": "f97316ff","border_color": "00000000"}}}
Seu workflow. Seus controles.
Fluxos de trabalho de áudio sem dor de cabeça
Reduza o custo e a complexidade do processamento de áudio interno. Uma API, seu workflow.
Você mantém o controle total
Personalize os parâmetros do FFmpeg diretamente. Vá além dos presets com controle total sobre codecs, taxas de bits, taxas de amostragem, canais, filtros e muito mais.
Mantenha os ouvintes imersos
Normalize a sonoridade para que os ouvintes gastem menos tempo ajustando o volume entre faixas.
Webhooks e atualizações em tempo real
Use callbacks por arquivo e requisições de webhook quando o processamento terminar.
Uploads e entrega seguros
Controle o acesso a uploads com assinaturas geradas pelo servidor e com expiração. Proteja a entrega de áudio com URLs assinadas.
Bloqueie arquivos de áudio maliciosos
Adicione verificação de vírus para rejeitar arquivos de áudio infectados por malware antes de continuar o processamento.
Controle os custos de processamento
Escolha o uso incluso e pague pelos excedentes. Defina um limite de fatura flexível para alertas ou um limite rígido para interromper o processamento.
Transforme fala em transcrições
Transcreva podcasts, entrevistas e gravações de voz no mesmo workflow que prepara seu áudio para reprodução.
Use seu próprio armazenamento
Envie o áudio finalizado diretamente para Amazon S3, Cloudflare R2, Google Cloud Storage, Azure e muito mais.
Múltiplas saídas. Uma chamada de API.
Codifique, transcreva, gere formas de onda e exporte, tudo em uma única chamada de API.
Prepare seu áudio para publicação
Perguntas frequentes
Como codifico meu primeiro arquivo de áudio?
Escolha um preset de áudio, salve um Template e experimente um upload de amostra no Template editor. Quando o resultado soar bem, reutilize esse Template pelo Uppy ou por um SDK. Conheça as opções de codificação de áudio.
Quais formatos e configurações de áudio posso usar?
Trabalhando com MP3, WAV, AAC, FLAC, Ogg ou Opus? Damos suporte a esses formatos de áudio populares e muitos outros. Comece com um preset ou personalize parâmetros do FFmpeg para codecs, taxa de bits, taxa de amostragem, canais e filtros. Veja os formatos de áudio compatíveis.
Posso normalizar a intensidade sonora e extrair áudio de vídeo?
Sim. O Robot audio encode aceita entradas de áudio e vídeo. Escolha um preset de áudio para extrair a faixa de áudio de um vídeo, ou use filtros FFmpeg para normalizar a sonoridade. Teste suas configurações em gravações representativas. Veja os controles de codificação de áudio.
Posso criar formas de onda e transcrições no mesmo workflow?
Sim. Conecte etapas de codificação de áudio, geração de forma de onda e transcrição de fala em uma única Assembly. Exporte os resultados juntos para que seu app possa exibir um player, forma de onda e transcrição. Explore a geração de forma de onda.
Os ouvintes podem ler ou pesquisar uma transcrição?
Use o Robot de transcrição de fala para criar texto a partir de podcasts, entrevistas e gravações. Seu app pode exibir ou indexar esse texto, ou repassá-lo para uma etapa separada de tradução de texto para alcançar mais idiomas. As opções de idioma e saída dependem do provedor, e as transcrições podem precisar de revisão. Veja as opções de transcrição de fala.
Os usuários podem enviar gravações grandes em conexões instáveis?
Sim. Os uploads retomáveis permitem que os usuários continuem depois de uma queda de conexão, em vez de recomeçar a gravação inteira. O tamanho máximo de arquivo depende do seu plano; entre em contato conosco para requisitos maiores. Confira os limites de upload atuais.
Posso manter o áudio no meu próprio armazenamento e receber atualizações de conclusão?
Sim. Exporte áudio para Amazon S3, Cloudflare R2, Google Cloud Storage, Azure e muito mais. Use as Assembly Notifications quando o processamento terminar, ou o Robot de requisição HTTP (atualmente em alfa) para callbacks durante o processamento. Defina payload como metadata para identificar cada arquivo. Seu endpoint precisa retornar 2xx antes do tempo limite da requisição, ou o step falha. Explore os callbacks HTTP (English) ou saiba como salvar seus resultados.
Como posso estimar e controlar custos?
As taxas variam de acordo com a operação e o uso. Defina um limite de fatura flexível para receber alertas ou um limite rígido para interromper o processamento. Para workloads maiores, pergunte sobre preços por volume e slots de prioridade extras. Estime os custos do seu workflow.
