What Seston does

All of it, in the order somebody meets it.

The Seston multitrack window
Clips, uma linha de volume por clip, um medidor em cada canal e a faixa master em baixo.

Melhoria de fala

Uma passagem que mede a gravação e a corrige

A maioria das gravações de voz tem os mesmos poucos defeitos: um ruído de fundo, uma sala, um microfone com a sua própria inclinação e um nível que anda a passear. O Seston mede tudo isso no próprio ficheiro e corrige cada um — por uma ordem que importa.

A sala sai antes de o timbre ser medido, porque a reverberação tem espectro próprio e de outro modo seria corrigida como se fosse o microfone. O volume fica para o fim, depois de tudo o que o altera.

Um modelo treinado, não uma predefinição

O ruído e a reverberação são retirados por um modelo de fala a quem foi mostrada muitíssima voz limpa, por isso sabe o que pertence a uma voz. Corre no seu próprio computador.

Volume de emissão

Medido segundo a ITU-R BS.1770 e definido em −16 LUFS para podcast, −14 para streaming, −23 para radiodifusão. O limitador olha em frente, por isso os picos são limitados e não cortados.

Diz-lhe o que fez

Cada medição e cada passo são relatados: o tempo de decaimento da sala, quanto o timbre estava desviado, onde as pausas foram fechadas, o ganho aplicado.

The Enhance Speech dialog
Cada etapa desliga-se sozinha, e desfazer devolve o clip exactamente como estava.
O que não vai fazer. Retira o que não devia lá estar e corrige o que está comprovadamente errado. Não consegue devolver detalhe que o microfone nunca captou. Uma gravação feita ao telemóvel do outro lado da sala fica claramente melhor; não fica como se tivesse sido feita de perto com um bom microfone.

Gerar voz

Escreva uma frase e tenha-a lida na linha de tempo

Carregue com o botão direito numa pista, escreva ou cole o texto, escolha uma voz e o áudio falado chega como um clipe normal na cabeça de leitura — corte-o, limpe-o, junte-o como qualquer outro. O texto fica no clipe, por isso uma correção é uma releitura e não uma redigitação.

Corre no ElevenLabs com a sua própria chave e a sua própria conta; o Seston não tem lá conta nem parte na faturação. As vozes oferecidas são as da sua conta, descritas como o serviço as descreve: sotaque, idade, para que servem. Os modelos e os idiomas também são obtidos, por isso um acrescentado no mês que vem está lá sem esperar por uma atualização.

Para que serve na prática

A frase que falta às duas da manhã, quando o locutor saiu às seis. O nome mal pronunciado, corrigido sem chamar ninguém de volta. Uma vinheta, uma promoção, uma correção, um boletim lido numa língua que ninguém na casa fala. Nada disso justifica marcar um estúdio, e tudo fica na linha de tempo no tempo de escrever.

Choosing a voice
As vozes são as da conta, com as descrições do próprio serviço. Turco, inglês, o que lá estiver.
O que sai da máquina. O Seston funciona inteiramente no seu próprio computador. Esta única funcionalidade é a exceção: enquanto é usada, o texto e a sua chave vão para o ElevenLabs e para mais lado nenhum. Nada mais sai alguma vez — nem o seu áudio, nem as suas sessões, nem o que faz com elas. A chave é cifrada sob a sua conta do Windows, nunca mais é mostrada e nunca é escrita num ficheiro de sessão.

Edição

Encurte uma hora sem o fazer à mão

O Smart Edit encontra os silêncios de uma gravação longa, tira-os e põe o que resta em duas pistas, ponta a ponta e alternando — cada junta a sobrepor-se à vizinha o que dura um crossfade.

A alternância existe por isso mesmo: cortes encostados numa única pista não têm para onde desvanecer. Quando a edição está certa, o Merge Clips junta as peças num só clip — com os crossfades incluídos.

A take checkerboarded across two tracks
O Smart Edit diz o que encontrou antes de mexer em alguma coisa: quanto encurtou, quantas frases há.

Não destrutivo

Aparar muda a janela do clip sobre a origem, nunca o áudio. No ficheiro que importou nunca se escreve.

Uma linha de volume em cada clip

Desenhada por omissão sobre cada clip. Acrescente pontos e arraste-os para moldar o nível. A linha pertence ao clip e viaja com ele.

Um íman que sabe largar

Agarra a grelha, as pontas dos clips e o cursor — com uma tolerância limitada em milissegundos, para que afastar o zoom não transforme o íman em adivinha.

Um editor de forma de onda lá dentro

Faça duplo clique num clip para trabalhar só nele: escolha um troço e puxe o seu nível, desvaneça a partir das pontas, meça o ruído da sala numa pausa.

Gravação de chamadas

Grave qualquer chamada, com toda a qualidade, sem tocar na chamada

Ponha a fonte em System playback. O Seston grava o que a máquina estiver a reproduzir — o seu convidado no WhatsApp, um ministro no Zoom, um repórter no Teams — enquanto a aplicação da chamada continua intocada. Sem extensão, sem um bot a entrar na reunião, sem link para enviar e sem nada que a outra pessoa tenha de instalar ou registar.

O loopback só ouve o que a máquina reproduz, que durante uma chamada são eles e não você. O seu próprio microfone é captado no mesmo momento para uma pista própria, por isso os dois lados chegam separados e editam-se em separado: corte a sua pergunta, fique com a resposta e passe o Enhance por cada voz isoladamente.

Funciona com tudo o que faça som WhatsApp Zoom Microsoft Teams Google Meet Skype Telegram Signal Discord

Nada do outro lado

A pessoa a quem liga não faz nada de diferente. Não instala nada, não carrega em nada e nem precisa de saber o que é o Seston — o que é precisamente o que conta quando do outro lado está uma fonte a ligar de volta de um corredor.

Um método, todas as aplicações

O Seston não se integra com o WhatsApp nem com o Zoom: grava a própria saída da máquina. Funciona com tudo o que faça som, incluindo aquilo para que a redação mudar no ano que vem.

Directo para a edição

A gravação é desenhada na linha de tempo enquanto ainda decorre. Corte, limpe, ajuste à sonoridade de emissão e exporte — sem mover um ficheiro para lado nenhum nem esperar por um carregamento.

Para uma redação

Uma entrevista telefónica às duas pode ser gravada, limpa, montada e ficar pronta para o noticiário das quatro numa só máquina, por uma só pessoa, sem nada ser enviado para o servidor de ninguém. As duas vozes ficam em pistas separadas do princípio ao fim, por isso uma citação sai limpa e a pergunta do repórter pode ficar ou sair.

Choosing a recording source
Microfones e fontes de reprodução estão numa só lista, porque do seu lado são a mesma escolha.
Use auscultadores. Em altifalantes o outro lado volta a entrar pelo seu microfone: ouvem-se a si próprios, e a mesma voz acaba nas duas pistas com alguns milissegundos de diferença.
Diga que está a gravar. O consentimento que a lei exige varia consoante o país e, nalguns sítios, consoante o estado. Dizê-lo no início da chamada é boa prática em toda a parte e obrigatório em muitíssimos lugares.

Mistura e efeitos

Efeitos que continuam editáveis

Passa-alto, passa-baixo, EQ, gate, compressor, de-esser e limitador — num clip, numa pista ou no master, numa janela que pode deixar aberta enquanto ouve.

Vêm onze cadeias para voz, e tudo o que montar pode ser guardado ao lado delas. The signal path is fixed and worth knowing: clip source, clip gain and fades, clip effects, summed into the track, track effects, pan and fader, summed into the master, master effects, master gain, safety limiter.

The effects rack
Uma pista a mostrar FX 3 tem três efeitos a correr: um canal processado di-lo por si.