Aprenda · Mixagem de voz

Como conseguir uma voz valvulada quente de graça

"Quente" é a palavra mais pedida e menos definida na mixagem de voz. Veja o que ela quer dizer de verdade, e uma cadeia de cinco passos que chega lá sem gastar nada.

Kalu Audio · 10 de outubro de 2026 · 7 min de leitura

O que "quente" quer dizer de verdade

Quando os engenheiros dizem que uma voz está quente, normalmente estão falando de três coisas ao mesmo tempo:

  • Agudos suaves. Nada de "S" ásperos ou de um topo quebradiço que faz o ouvinte procurar o volume.
  • Médios-graves cheios. O corpo da voz (mais ou menos de 150 a 400 Hz) aparece sem embolar.
  • Densidade harmônica suave. Harmônicos de ordem baixa, principalmente o 2º, encorpam o timbre e ajudam a voz a ficar na frente da mix, mesmo no mesmo volume.

Esse último ponto é a fama dos equipamentos valvulados. Um estágio de triodo single-ended, o circuito clássico de pré valvulado, distorce de forma assimétrica, o que gera principalmente 2º harmônico: uma oitava acima da nota, consonante, percebido como riqueza e não como distorção. Cada passo abaixo serve a um desses três objetivos.

A cadeia, na ordem

A ordem importa mais que qualquer ajuste isolado. Esta é a sequência a que a maioria dos engenheiros de voz chega, e a que montamos no Triodia:

  1. De-esser: domar a sibilância primeiro.
  2. Compressor valvulado: controlar a dinâmica e acrescentar harmônicos.
  3. Echo: uma sensação de espaço que mantém a voz na frente.
  4. Plate reverb: profundidade e acabamento.
  5. Saída: igualar o volume antes de julgar.

Antes de começar, confira o ganho de entrada. Plugins que modelam equipamentos analógicos reagem ao nível de entrada como o hardware. Mande para eles uma voz com média em torno de −18 dBFS e picos bem abaixo de 0. Quente demais e tudo satura; baixo demais e nada satura.

Passo 1: De-esser antes de comprimir

A compressão abaixa as partes fortes da voz, o que significa que todo o resto, inclusive a sibilância, sobe em relação ao corpo da voz. Com o de-esser primeiro, o compressor recebe um sinal mais suave.

  • A maior parte da sibilância fica entre 5 e 9 kHz. Comece em uns 6,5 kHz e varra até achar onde os "S" reagem mais.
  • Use só a redução necessária para os "S" pararem de saltar. Exagere e o cantor começa a falar "chiado".
  • Ouça no contexto, não em solo. Uma voz um pouco brilhante costuma soar certa na mix completa.

Passo 2: Compressão valvulada (é daqui que vem o calor)

Um compressor valvulado faz dois trabalhos: nivela a interpretação e passa a voz por um estágio que satura. Bons pontos de partida:

  • Ratio de 3:1 a 4:1 para a maioria das vozes de pop e rock.
  • Attack de 10 a 30 ms. Mais rápido pega as consoantes e achata a interpretação; mais lento deixa os transientes passarem, com mais punch.
  • Release de 100 a 200 ms, ou um release adaptativo, estilo óptico, que acompanha o fraseado.
  • Abaixe o threshold até ver 3 a 6 dB de redução de ganho nas frases mais fortes.
  • Drive define o quanto o estágio valvulado é empurrado. Suba até a voz encorpar e depois volte um pouco. Se dá para ouvir claramente "distorção", passou do ponto para uma voz principal.

O tipo de válvula muda muito o caráter. Uma 12AX7, de ganho alto, satura cedo e soa claramente quente; uma 12AU7, de ganho baixo, fica limpa, com cor sutil. Comparamos nove válvulas, com números medidos, em 12AX7 vs 12AU7 na voz.

Passo 3: Um echo que não atrapalha

Um delay dá tamanho à voz sem empurrá-la para trás, como faz um reverb grande. O segredo é deixar as repetições mais escuras que a voz seca:

  • Acerte o tempo com a música: semínima ou colcheia, ou um slapback curto de 80 a 150 ms para um clima vintage.
  • Corte os agudos das repetições (por volta de 4 a 6 kHz) para que nunca disputem com as consoantes.
  • Mantenha o feedback baixo (duas ou três repetições audíveis) e o mix entre 10 e 25%.
  • O modo ping-pong espalha as repetições no estéreo e deixa o centro livre para a voz principal.

Passo 4: Plate reverb para dar profundidade

O plate é o reverb preferido para voz desde os anos 1950: denso, brilhante e suave, sem as reflexões óbvias de uma sala. Três ajustes fazem a maior parte do trabalho:

  • Pre-delay de 20 a 80 ms. Esse intervalo mantém a voz seca inteligível antes de o reverb abrir.
  • Low cut entre 200 e 400 Hz. Reverb nos graves é o caminho mais rápido para embolar.
  • Mix baixo. Suba até ouvir e depois volte um pouco. Você deve sentir falta dele quando desligado, não reparar nele quando ligado.

Passo 5: Iguale o volume antes de julgar

Mais alto sempre parece melhor, então uma voz processada 2 dB mais alta vai ganhar qualquer comparação. Ajuste a saída para que a versão processada e a desligada tenham o mesmo volume, e só então decida se a cadeia está ajudando de verdade.

Fazendo tudo com um plugin grátis

O Triodia é o nosso VST3 grátis para Windows que roda exatamente esta cadeia numa janela só. Um jeito rápido de começar:

  1. Coloque-o na faixa de voz e escolha o preset mais próximo do seu estilo: Pop, Rock, Ballad, Soul, Rap, Podcast, Voice-Over e outros. Todos os presets têm o mesmo volume, então você compara timbre, não volume.
  2. Abaixe o THRESH até o VU, no modo de redução de ganho, andar algumas divisões nas frases fortes.
  3. Escolha uma válvula: ROCK (12AX7) para um calor evidente, SMOOTH (12AU7) para uma cor sutil, GLUE ou SILK para uma compressão suave, estilo vari-mu. Suba o DRIVE para ouvir a diferença.
  4. Ajuste o MIX do echo e do plate a gosto, e veja a válvula do painel acender conforme a voz a empurra.
Download grátis

Experimente a cadeia completa no Triodia

De-esser, compressor valvulado com 9 válvulas modeladas, echo e plate reverb. VST3 + Standalone para Windows.