Pular para o conteúdo

Ferramentas de áudio que nunca ouvem a sua gravação

Dez ferramentas de áudio, grátis e sem cadastro. Nada fica armazenado — e quando o formato permite, nada é recodificado também, então um MP3 cortado aqui volta bit a bit o MP3 que era.

10 ferramentas, sem cadastro, sem marca d'água

A maioria destas faz uma coisa com um arquivo. Para deixar uma gravação pequena o bastante para enviar, comece por Comprimir áudio; para ter um arquivo que outro programa aceite, use o conversor com o nome do que você tem — WAV para MP3, M4A para MP3, FLAC para MP3; para tirar o silêncio morto de uma entrevista, Cortar áudio. As notas abaixo da lista tratam do que costuma surpreender — o que uma conversão consegue e não consegue devolver, e onde o navegador é a ferramenta errada.

O que um arquivo de som armazena de fato

Três números descrevem uma gravação, e só dois deles se aplicam a cada arquivo. Taxa de amostragem é a frequência com que o som foi medido: 44,1 kHz nos CDs, 48 kHz em tudo o que veio de vídeo. Profundidade de bits é a precisão com que cada medição é anotada, e só faz sentido em um formato sem compressão — 16 bits é o padrão do CD, 24 bits deixa folga para mais processamento, 32 bits de ponto flutuante é para mixagem. Taxa de bits só faz sentido em um formato comprimido: é quantos bits por segundo o codificador pôde gastar.

É por isso que os tamanhos se comportam de forma tão diferente. O tamanho de um WAV é aritmética — taxa vezes profundidade vezes canais —, então um minuto em 16 bits estéreo a 44,1 kHz tem cerca de 10 MB, seja qual for o conteúdo, silêncio incluído. O tamanho de um MP3 é a taxa de bits que você escolheu: cerca de 1,4 MB por minuto a 192 kbps, e metade disso a 96. WAV é um formato de trabalho, não de audição, e essa distinção é o motivo para converter em qualquer um dos sentidos.

Converter um MP3 em WAV não restaura nada, e nada nunca vai restaurar. O codificador jogou detalhes fora quando o MP3 foi feito; um WAV criado a partir dele guarda esse estrago em resolução total. A conversão serve para impedir que a perda vá além — a partir de um WAV, editar, cortar e salvar de novo não custam nada. O mesmo vale para o FLAC, que é compressão sem perdas: um jeito menor de guardar exatamente as amostras que recebeu, não um jeito de melhorá-las. Um MP3 transformado em FLAC é um arquivo grande contendo um MP3.

Cada passagem por um codificador com perdas joga mais coisa fora, e isso nunca volta. Converter AAC em MP3, OGG em MP3, ou um MP3 em outro é uma dessas passagens. Codificar com a mesma taxa de bits da origem ou acima — que cada página daqui mostra quando você solta o arquivo — mantém essa perda pequena; ir muito acima só gasta bits guardando os erros do primeiro codificador. Se você vai fazer várias coisas com uma gravação, converta para WAV primeiro, faça o trabalho e codifique uma vez só no final.

Cortar e juntar não precisam recodificar. O som comprimido é guardado em quadros pequenos — cerca de 26 milissegundos em um MP3 —, e Cortar áudio copia esses quadros em vez de decodificá-los, então um MP3 cortado é bit a bit o MP3 que era, e uma gravação longa é cortada tão rápido quanto pode ser lida. O preço é que um corte copiado começa no limite de quadro mais próximo, alguns centésimos de segundo antes ou depois do ponto que você escolheu; marcar o Corte exato recodifica para cair na amostra que você pediu. Juntar áudios funciona do mesmo jeito — arquivos com o mesmo codec, taxa de amostragem e número de canais são unidos por cópia, e arquivos diferentes são decodificados e recodificados para combinar com o primeiro.

Nivelar não é normalização de loudness, e compressão também não é. Ajustar volume mede o momento mais alto do arquivo e sobe tudo nessa mesma quantidade, para que o pico fique logo abaixo do teto. Isso é normalização de pico, e é a correção certa para uma gravação que está simplesmente baixa do começo ao fim. Não é a medição em LUFS que plataformas de podcast e streaming exigem, que pondera a intensidade percebida ao longo de um programa inteiro — dois arquivos normalizados para o mesmo pico ainda podem ter volumes percebidos claramente diferentes. E subir o arquivo inteiro move as partes baixas e as altas juntas, então não consegue equilibrar uma gravação que oscila entre as duas. Isso é compressão de faixa dinâmica: outro trabalho, e não um que estas ferramentas fazem.

Onde o navegador é mesmo a ferramenta errada

Manter a sua gravação privada é o motivo de estas ferramentas existirem, e isso não traz vantagem nenhuma em termos de processamento. Estas ferramentas convertem, cortam, juntam e ajustam o nível. Elas não editam som.

Sem reparo e sem modelagem. Não há redução de ruído, remoção de zumbido ou de cliques, equalização, de-esser, compressão de faixa dinâmica, fades nem mixagem multipista. Também não há crossfade entre os trechos unidos, e é por isso que um corte no meio de uma música alta pode estalar. O Audacity é gratuito, roda em qualquer computador e faz tudo isso direito — uma entrevista com chiado, ou uma gravação com uma geladeira zumbindo ao fundo, pede o Audacity, não isto.

Picos são medidos; loudness, não. Ajustar volume informa o pico antes e depois e segura qualquer coisa que passaria do teto, mas não há limitador de true peak nem alvo em LUFS. Se você precisa entregar seguindo uma especificação — −16 LUFS para um podcast, −14 para uma plataforma de streaming —, precisa de uma ferramenta que meça loudness, não picos.

As tags não vão junto. Títulos, artistas, capas de álbum e capítulos ainda não são levados em uma conversão aqui: o som passa e os metadados da biblioteca não. Para converter uma biblioteca de músicas, um gerenciador de desktop que reescreve as tags durante o processo vai poupar horas de retrabalho.

Um arquivo, um clique. Converter oitocentas mensagens de voz é um loop de shell em volta do ffmpeg, que é gratuito e faz em um minuto o que uma pessoa clicando levaria uma tarde inteira.

E algumas coisas nenhum navegador consegue fazer. Compras protegidas — arquivos .m4p antigos, downloads do Apple Music, qualquer coisa de uma assinatura — não podem ser abertas aqui, e remover essa proteção não é algo com que ajudamos. O próprio MP3 comporta no máximo dois canais e até 48 kHz, então uma origem surround ou com taxa alta é reduzida no caminho.

Como escolher entre ferramentas de nome parecido

Comprimir áudio ou WAV para MP3. As duas podem gerar o mesmo arquivo, e só uma delas é o caminho certo. WAV para MP3 é uma primeira codificação a partir de uma origem sem compressão, a codificação mais barata que existe. Comprimir áudio pega qualquer coisa e recodifica na taxa de bits que você escolher — a partir de um WAV é o mesmo trabalho, mas a partir de um MP3 é uma segunda passagem com perdas. Ela avisa quando a taxa de bits pedida não consegue deixar o arquivo menor, que é o que acontece quando você comprime um MP3 de 128 kbps a 192.

“Comprimir” tem dois sentidos em áudio, e só um deles está aqui. Comprimir áudio deixa o arquivo menor baixando a taxa de bits. Compressão de faixa dinâmica deixa as partes baixas mais altas em relação às altas, que é o que um produtor de podcast quer dizer com a palavra. Nem Comprimir áudio nem Ajustar volume fazem a segunda coisa — Ajustar volume move o arquivo inteiro em uma única quantidade.

AAC para MP3 ou M4A para MP3. Praticamente a mesma página. Um arquivo .aac é um fluxo AAC puro, e um .m4a é AAC dentro de uma caixa MP4 que também pode guardar capa e capítulos; as duas páginas leem os dois, e o som lá dentro é idêntico. A página de M4A foi pensada para as mensagens de voz do iPhone, que já são AAC mono em taxa de bits baixa e pedem 128 kbps mono na saída.

MP3 para WAV ou FLAC para MP3. Sentidos opostos, e os dois são de mão única. MP3 para WAV cria uma cópia de trabalho que você pode editar sem perder mais nada; não melhora o som, e o arquivo fica cerca de dez vezes maior. FLAC para MP3 cria uma cópia portátil de um original que você deve guardar, porque um MP3 nunca pode voltar a ser o FLAC de onde veio.

Cortar áudio ou Juntar áudios. Cortar tira pedaços de um arquivo — inclusive do meio — e junta o que sobra. Juntar coloca arquivos separados um depois do outro, na ordem que você define arrastando. Uma entrevista gravada em três partes com uma tosse na segunda são os dois trabalhos: corte a tosse e depois junte as três.

A base destas ferramentas

Os motores de código aberto que fazem o trabalho de fato e as especificações que eles implementam.

  • MediabunnyMPL-2.0 — lê e grava os contêineres de áudio.
  • LAMELGPL-2.1 — codifica MP3 — o codificador de referência, compilado para WebAssembly.
  • WebCodecsSpecification — dá ao navegador acesso ao codificador AAC que já existe no seu dispositivo.

Perguntas frequentes

Minhas gravações ficam armazenadas em algum lugar?

Não. Cada ferramenta de áudio daqui decodifica, edita e codifica dentro desta aba, então o arquivo é lido pelo seu próprio navegador e nunca é enviado para nós. Isso importa mais que o normal no caso de áudio, porque muito dele é privado — mensagens de voz, entrevistas, aulas, anotações de terapia, ligações. Depois que a página carrega, as ferramentas funcionam com o Wi-Fi desligado.

Converter para WAV ou FLAC melhora a qualidade?

Não. Os dois são formatos sem perdas, o que significa que guardam fielmente o que receberem — incluindo todo o detalhe que uma codificação anterior em MP3 ou AAC já jogou fora. Converter para cima impede novas perdas e deixa a edição sem custo; não desfaz a primeira perda, e nenhuma ferramenta em lugar nenhum consegue.

Qual taxa de bits devo escolher?

192 kbps é o padrão sensato para música, com cerca de 1,4 MB por minuto. Para fala, 128 kbps soa igual, e mono corta isso pela metade de novo — uma voz sozinha não tem nada no segundo canal que valha a pena guardar. A partir de uma origem sem perdas, 320 kbps se houver espaço. Quando a origem já tem perdas, codifique com a taxa de bits dela ou acima, que a página mostra quando você solta o arquivo.

Títulos, artistas e capas vão ser mantidos?

Ainda não. Tags, capas e capítulos são descartados em uma conversão aqui; o que passa é o som. Se a sua biblioteca depende das tags, use um gerenciador de biblioteca de desktop para conversões em massa e estas ferramentas para arquivos avulsos.

Existe limite de duração ou de tamanho de arquivo?

Não há conta nem cota, porque não há servidor fazendo a contagem. A saída é gravada no armazenamento do próprio navegador à medida que é codificada, em vez de ficar na memória, então uma gravação de várias horas é convertida sem derrubar a aba. O limite prático é o seu espaço livre em disco.

Vai ter marca d'água ou uma vinheta falada?

Não. Nada aqui adiciona marca d'água, locução ou bipe ao seu áudio, de qualquer duração, em nenhuma ferramenta. São os anúncios na página que mantêm tudo gratuito.