Transcrições
1. Boas-vindas: Bem-vindo ao ElevenLabs
AI Master Class. As vozes geradas por IA se tornaram incrivelmente populares e capazes, mas a ElevenLabs pode fazer muito mais Você pode criar e clonar vozes, criar efeitos sonoros na música, produzir audiolivros e podcasts, dublar conteúdo em outros idiomas, gerar
conteúdo visual e até mesmo criar agentes de IA que possam Neste curso, mostrarei
como usar essas ferramentas por meio exemplos
práticos e mostrarei exatamente do que o ElevenLabs
é capaz Você pode entender não
apenas como o ElevenLabs funciona, mas como você pode aplicá-lo e usá-lo para seu próprio trabalho
profissional Meu nome é Jose
Kuchii e sou designer visual com mais de cinco anos de experiência
trabalhando com ferramentas de IA, conteúdo
criativo e fluxos de trabalho
digitais Passei muito tempo
trabalhando com essas ferramentas de IA para descobrir a melhor maneira de
integrá-las em projetos
reais. Ao longo deste curso,
compartilharei com você as técnicas, fluxos de trabalho e as ferramentas que me
ajudaram ao longo do caminho Começaremos com
os fundamentos. Você se familiarizará
com a interface, as contas, os preços, como
configurá-la da melhor maneira
e, em seguida, passaremos à solicitação, que é essencialmente a forma como você
se comunica com essa ferramenta Assim que as tivermos
em nosso currículo, abordaremos
todas as ferramentas que a
ElevenLabs tem para Você aprenderá como encontrar
e criar suas próprias vozes, como transformar as
existentes, como dublar áudio para
podcasts ou audiolivros, como criar
efeitos sonoros e músicas
e também como criar conteúdo visual com o ElevenLabs Ao longo do caminho, também
exploraremos estúdio e outras
ferramentas de produção para projetos maiores. Quando você estiver familiarizado
com as ferramentas, passaremos para
alguns projetos práticos. Você trabalhará com
ativos e modelos, geração de
imagens e vídeos, sincronização labial, aumento de escala e fluxos para
ver como essas ferramentas podem ser integradas a um processo criativo muito
maior E, finalmente, vamos
explorar 11 agentes. Lá, você
aprenderá
o que são, como
você pode usá-los, e também
vamos criar um juntos, onde os
testaremos e implantaremos. Ao final deste curso, você terá uma
compreensão mais ampla de 11 laboratórios, mas, o mais importante,
terá experiência prática na
criação desses projetos. Então, vamos
começar.
2. O que é o ElevenLabs: Antes de falarmos sobre como
usar o ElevenLabs, vamos primeiro falar sobre o que
é e quais são os casos de uso Então, a ElevenLabs é na verdade uma empresa de IA
especializada em áudio generativo Áudio generativo basicamente
significa que quando você gera áudio
e, como essa
é uma ferramenta de IA, você está fazendo áudio com IA Agora, anteriormente,
havia muitas tecnologias relacionadas ao áudio
generativo,
como conversão
de texto em fala, fala em texto No entanto, aqueles que raramente envolveram IA recentemente com
essa implementação, o fluxo
de trabalho se tornou muito mais fácil e preciso. Quando você digita algo
e usa pontuação, em vez de parecer um
superrobô, agora com a IA, parece muito mais realista e,
ao contrário da conversão de fala em texto,
consegue captar suas
palavras muito melhor em
comparação com a tecnologia consegue captar suas
palavras muito melhor em comparação com a Neste momento, esta é a
página inicial da ElevenLabs. Falaremos sobre contas
e preços daqui a pouco. Mas só para explicar o que você
pode fazer com essa ferramenta, obviamente,
você pode criar muitas coisas
instantâneas, como conversão de texto em fala e, em
seguida, conversão de fala em texto,
mas você pode gerar áudios para mas você pode gerar Você pode fazer podcast com ele. Talvez você possa simplesmente
falar com uma IA para vídeo
do YouTube ou
até mesmo gerar seus
próprios efeitos sonoros. Há muita coisa que você
pode fazer aqui e essa é uma
ferramenta muito popular se você gosta criar conteúdo ou tem
algum canal onde gostaria de postar esses conteúdos ou
talvez até mesmo monetizar Com muito espaço para
experimentar essa ferramenta, você pode gerar
muitas coisas, ver qual funciona
melhor e depois
se comprometer totalmente com um clipe de áudio mais longo Funciona assim:
você tem sua conta, recebe uma certa quantidade de
créditos e, por geração, usa alguns créditos dependendo da
duração do áudio. Se você já usou ferramentas de IA antes, o fluxo de trabalho é
relativamente o mesmo. Você envia um prompt,
fornece uma entrada, escolhe seu modelo e, em
seguida, obtém uma saída. Como sabemos
o que é a plataforma, resumidamente, apenas uma visão
geral, falaremos sobre a conta e os preços
na próxima lição.
3. Contas e preços: Antes de falarmos sobre como
usar o ElevenLabs, vamos primeiro falar sobre o que
é e quais são os casos de uso Então, a ElevenLabs é na verdade uma empresa de IA
especializada em áudio generativo Áudio generativo basicamente
significa que quando você gera áudio
e, como essa
é uma ferramenta de IA, você está fazendo áudio com IA Agora, anteriormente,
havia muitas tecnologias relacionadas ao áudio
generativo,
como conversão
de texto em fala, fala em texto No entanto, aqueles que
raramente envolveram IA.
Recentemente, com essa
implementação, o fluxo
de trabalho se tornou muito mais fácil e preciso. Quando você digita algo
e usa pontuação, em vez de parecer
super robótico, agora com a IA,
parece muito mais realista
e, parece muito mais realista ao contrário da conversão de fala em texto,
ela capta suas
palavras muito melhor em
comparação com a tecnologia ela capta suas
palavras muito melhor em comparação com a Neste momento, esta é a
página inicial da ElevenLabs. Falaremos sobre contas
e preços daqui a pouco. Mas só para explicar o que você
pode fazer com essa ferramenta, obviamente,
você pode criar muitas coisas
instantâneas, como conversão de texto em fala e, em
seguida, conversão de fala em texto,
mas você pode gerar áudios para mas você pode gerar Você pode fazer podcast com ele. Talvez você possa simplesmente
falar com uma IA para vídeo
do YouTube ou
até mesmo gerar seus
próprios efeitos sonoros. Há muita coisa que você
pode fazer aqui e essa é uma
ferramenta muito popular se você gosta criar conteúdo ou tem
algum canal onde gostaria de postar esses conteúdos ou
talvez até mesmo monetizar Com muito espaço para
experimentar essa ferramenta, você pode gerar
muitas coisas, ver qual funciona
melhor e depois
se comprometer totalmente com um clipe de áudio mais longo A forma como funciona é que
você tem sua conta, recebe uma certa
quantidade de créditos
e, por geração,
usa alguns créditos,
dependendo da duração do áudio. Se você já usou ferramentas de IA antes, o fluxo de trabalho é
relativamente o mesmo. Você envia um prompt,
fornece uma entrada, escolhe seu modelo e, em
seguida, obtém uma saída. Como sabemos
o que é a plataforma, resumidamente, apenas uma visão
geral, falaremos sobre a conta e os preços
na próxima lição.
4. Visão geral da ética da IA: Com todas essas novas ferramentas de IA sendo
lançadas quase
todos os meses, é muito importante
que você atualize a ética
do uso da IA caso ainda não esteja
familiarizado com elas. Se você é iniciante usando 11
laboratórios ou qualquer outra ferramenta de IA, pode estar se perguntando por que
às vezes isso é
considerado antiético Mesmo que você saiba e
ainda não esteja convencido, é importante
que você perceba o risco e por que ele pode
prejudicar outras pessoas. Nesta lição,
falaremos um pouco
sobre a ética do uso
de ferramentas de IA,
seja Chau BT, Runway, M Journey
ou até mesmo 11 Atualmente, há um boom nas ferramentas de
IA, e é importante que você,
como usuário, saiba sobre o risco e por que
precisa usar essa ferramenta, essas ferramentas muito legais, de
uma forma mais responsável. Muitas vezes você usa
essas ferramentas de IA para
facilitar seu trabalho, ajudá-lo em um projeto
ou apenas se divertir. Tudo bem
, desde que você não o use para prejudicar ninguém. Agora, o que eu quero dizer com dano? Muitas vezes, essas ferramentas de IA estão sendo usadas para se
passar por pessoas. As entradas usadas
para treinar esses modelos
geralmente são obtidas de pessoas
que não concordaram com isso Por exemplo, com
muitas ferramentas de arte, muitos artistas
alegam que suas obras
foram usadas para treinar esses modelos quando não consentiram. O que acontece quando aquele artista que trabalhou
muito dá sua arte , ela está sendo usada para
treinar esses modelos e então você faz algo
com ela e depois a vende. Você, consciente ou
inconscientemente contribuiu
para esse ciclo ruim que está prejudicando Agora, com 11 laboratórios, embora seja uma ótima ferramenta, é importante que
você reserve um tempo
para ler sobre como
esses modelos estão sendo treinados e como você pode usá-los para algo
que não prejudique as pessoas. Dê alguns exemplos com
11 laboratórios em particular, mas isso se aplica a qualquer outra ferramenta de
IA disponível. Você nunca deve usar esses áudios para se passar por seres humanos
reais existem muitas
regras
e regulamentos dias, existem muitas
regras
e regulamentos sobre como criar regras básicas
para evitar danos
a outras pessoas. Se você gerar um
podcast totalmente usando IA, precisará rotulá-lo como IA. Se você usa o script da Internet que também foi
feito com IA, talvez o Chat GBD, é sua responsabilidade
como usuário
informar ao seu público
que você não está forma alguma tentando se passar por outra
pessoa ou fazer com que
as pessoas
pensem que o que você acabou de gerar é Você usará 11 laboratórios para seu trabalho ou para sua escola Lembre-se de que cada
empresa e instituição tem seu próprio conjunto de regras e
regulamentos a respeito. Portanto, certifique-se de fazer sua
pesquisa e não se arriscar
ao usar essas ferramentas. Agora, para os propósitos
deste curso, estou apenas mostrando
como usá-lo. Use-o para criar podcasts, audiolivros e
coisas do tipo Eles são feitos apenas para
você explorar e aprender. Se você quiser
comercializar qualquer um dos trabalhos que fizer até o
final desta lição, leia as regras e os regulamentos de
todas
as plataformas nas
quais você também faria o upload desses produtos
e, novamente, rotule
seu trabalho como Porque o que acontece é que,
ao enviar seu trabalho no mesmo espaço que
outros criadores humanos,
você será sinalizado e dependendo da
plataforma em que estiver fazendo isso, haverá consequências Portanto, seja responsável com
suas gerações. Não o use para
prejudicar ou se passar por alguém,
rotule todo o seu trabalho E se você optar por ganhar dinheiro, monetizar seu trabalho com
11 laboratórios ou qualquer outro , faça isso
da maneira correta Vá até a plataforma, veja
qual é o guia deles. Quase todas as plataformas têm isso, seja no
Instagram, no Bhand, na Adobe, onde
quer que você queira, navegue no site deles, leia sobre isso e
siga os passos deles Agora você sabe um pouco
mais sobre o risco e o dano potencial
que você poderia estar causando se usasse a
IA da maneira errada. Agora podemos seguir em frente
e continuar com nosso curso, onde aprendemos mais sobre essa ferramenta específica. Portanto, tenha cuidado
lá fora e vamos embora. Ah
5. Noções básicas de propostas: Nesta lição,
veremos como solicitar informações com
o ElevenLabs Portanto, um aviso são as instruções que você fornece a uma ferramenta de
IA para seguir. E, nesse caso, essas são
as palavras que você deseja que
11 voltas sejam executadas Seja uma narração, conversão de texto em fala, trocador de
voz ou qualquer outra ferramenta que veremos mais tarde,
há um estilo geral
que você precisa seguir
e, na verdade, é muito fácil
em comparação com as
outras ferramentas de
IA há um estilo geral
que você precisa seguir
e, na verdade, é muito fácil
em comparação com as
outras ferramentas de lançadas Vá até a
conversão de texto em fala, onde
praticaremos com
as diferentes instruções Agora, não se preocupe com as
ferramentas do lado direito. Vou abordar o que
é isso em uma lição diferente. Mas primeiro, vamos seguir em frente
e fazer uma prática simples. Vamos começar a
digitar alguma coisa. Vou fazer com que o ChatPT nos conte uma
história muito simples e depois vamos
convertê-la em um áudio decente Conte-me uma história de quatro frases sobre um cachorro. Simplesmente muito simples. Para melhorar isso, vamos
fazer algo assim. Faça um episódio de podcast baseado nisso com apenas quatro
frases para diálogo. Tudo bem, então vamos
copiar a parte do podcast. A razão pela qual
escolhi o podcast é porque dessa forma podemos brincar com as
diferentes emoções. Eu só vou
colar isso aqui. Sinta-se à vontade para escrever
seu próprio texto. Mas vamos nos livrar de todas essas tags e colocar
o texto que elas dizem. Hum, vou colocar uma
quebra de parágrafo após cada frase. Então, vamos começar
escolhendo uma voz. Para mim, por padrão, é George. A voz é o modelo
que está lendo seu texto. Então, se eu bater no George, não vou mudar
nada aqui. Na verdade, vamos redefinir os
valores apenas para ter certeza que estamos todos usando
as mesmas configurações. Vamos clicar em Gerar fala. Todas as manhãs, um cachorrinho
desalinhado chamado Max vagava pelas ruas
tranquilas em busca de restos uma tarde chuvosa, Max se
aconchegou embaixo do toldo de um café,
tremendo até que um barista gentil o Em uma tarde chuvosa, Max se
aconchegou embaixo do toldo de um café,
tremendo até que um barista gentil o viu e saiu. Olá, amigo. Você está com fome. Daquele dia em diante, Max
voltou até que uma manhã, o barista abriu a porta com um sorriso e disse, quero ficar Essa é apenas a modelo
lendo nosso texto. É muito monótono, não é
exatamente excitante ou monótono, é apenas Então, aqui estão algumas coisas
que já estão incluídas neste texto que fazem parte do estilo sobre o qual eu
estava falando anteriormente Toda vez que você adiciona um ponto, isso indica que
o modelo deve pausar Então, quando tivermos um, houver três pontos, será uma pausa mais longa Se você fizer isso, esse
será um corte diferente. Vamos
incorporá-los em nosso
prompt daqui para frente. Mas agora temos traços,
temos os três pontos,
apenas um ponto, temos uma Essas coisas
já estão incluídas. E quando eu toquei o áudio, você viu como ele pausou Quando a frase terminou, ela novamente parou aqui entre
as duas palavras e a
leu perfeitamente Agora vamos falar
sobre como podemos adicionar emoções porque temos uma Brista aqui e depois
temos apenas um narrador Quando você usa adjetivos
diferentes, ElevenLabs entenderá isso
como
a emoção que ela Podemos dizer, vamos ver. Aqui mesmo, quando
há um diálogo, podemos dizer que defina a
animada Brista, vamos ver Defina o Brista de uma forma animada. Estou usando a palavra
empolgado aqui e depois vamos ver o que
mais podemos acrescentar? Em vez disso, vou fazer um ponto de exclamação e
talvez dois pontos de interrogação Então, apenas essa pequena mudança fará
uma grande diferença. Vamos gerar esse
discurso mais uma vez. Todas as manhãs, um
cachorrinho desalinhado chamado Max vagava pelas ruas
tranquilas em busca de restos uma tarde chuvosa, Max se
aconchegou embaixo do toldo de um café,
tremendo até que um barista gentil o Em uma tarde chuvosa, Max se
aconchegou embaixo do toldo de um café,
tremendo até que um barista gentil o viu e saiu. Olá, amigo. Você está com fome? Disse o barista de
forma animada a partir daquele dia. Então você viu como
o George aqui disse que,
Ei, eles são amigos, você está com fome Então essa foi a
diferença entre adicionar dois sinais diferentes
versus apenas ter um. Agora, se você quiser
dar um passo adiante, você também pode adicionar pausas
e tudo mais, o que abordaremos mais tarde, porque
há uma ferramenta no
estúdio
em
que há uma ferramenta no você
simplesmente clica em um botão, mas você pode adicionar Pausa aqui, como três pontos, e
talvez outra Agora vamos ver como isso funciona. Uma coisa que você
pode fazer é combinar as duas frases, colocá-las uma após a outra
, sem pausar por muito tempo Todas as manhãs, um
cachorrinho desalinhado chamado Max vagava pelas ruas
tranquilas em busca de restos uma tarde chuvosa, Max se
aconchegou embaixo do toldo de um café,
tremendo até que um barista gentil o Em uma tarde chuvosa, Max se
aconchegou embaixo do toldo de um café,
tremendo até que um barista gentil o viu e saiu. Olá, amigo. Você está com fome? Disse o barista de forma animada? Daquele dia em diante, Max. Então essas são as mudanças
que estamos vendo. E daqui para frente, a
única dica que você daria é dar a 11 laboratórios um
enredo como este Vamos ver como
podemos adicionar efeitos sonoros, pausas
mais longas e
diferentes tipos de áudio com as outras ferramentas
avançadas A forma tradicional de
solicitação de IA , na qual você descreve ou comanda algo, por exemplo, faz de
mim um efeito sonoro de chuva forte na floresta Esse é um exemplo. Isso só
acontecerá quando você estiver fazendo
efeitos sonoros com 11 voltas. Mas para o resto das outras
ferramentas, e há muitas, essa é a solicitação
que você está fazendo Você mesmo pode gerar
essas linhas de história, digitá-las aqui e, como você
viu, é muito fácil. Ou você pode fazer com que
outra ferramenta como ChagPT faça algo para
você em questão de segundos Esta é apenas uma lição para você saber o que queremos dizer
quando dizemos pronto. Não é seu aviso
tradicional, onde há
fórmulas específicas a serem seguidas Basta ter em mente
a pontuação. Cada um deles significa coisas
diferentes, como vimos com vírgulas,
traços, três pontos, coisas assim,
e seja muito generoso
com seus adjetivos,
pois eles podem
significar que e seja muito generoso seu modelo de voz de IA vai de
monótono a animado,
irritado, triste, qualquer irritado, triste, E veremos
muito isso nas próximas aulas. Sem mais delongas, vamos
entrar no próximo capítulo onde examinaremos as
mini ferramentas da ElevenLabs
6. Biblioteca de vozes: Vamos dar uma
olhada rápida nessa plataforma e ver como podemos começar imediatamente fazer vozes com a ElevenLabs Esta é a página em que você verá a página inicial depois de fazer
login na sua conta Então, imediatamente, há algumas vozes
mais recentes da biblioteca. Essencialmente, temos uma biblioteca onde as pessoas podem
adicionar novas vozes. Obviamente, há um
procedimento pelo qual eles precisam passar e não são vozes de
baixa qualidade. Mas essa é uma biblioteca
que a ElevenLabs gerencia e eles lançam
novas vozes Vamos
ouvir este, por exemplo. AubukieraOsk Terra. Isso é em hindi,
e então temos, por exemplo, uma
jovem Silas R Então, essa voz agora você pode ver que está sendo chamada de voz feminina madura, e com certeza soou
assim, calma e profunda. Então, eu apenas atualizo minha página para mostrar que
toda vez que você fizer isso, você receberá
um novo conjunto de vozes Então, por exemplo,
vamos continuar com isso. O mal é mal, menor, maior. Em marcha lenta. É tudo a mesma coisa. Então, isso é sério e sombrio, e você pode ver que definitivamente
atingiu essa marca Agora, aqui embaixo, você notará
que diz uma prévia em inglês. Se você clicar aqui, poderá
alternar entre os idiomas. Esses são os
idiomas atuais que estão disponíveis. Será a mesma voz, o mesmo tom e tudo mais, mas em um idioma
diferente. Então, vamos tentar o
russo, por exemplo. Chive Katorn D Ciba
Nemo trocando Devi Camibe. City er SchimaFantasia,
solitaria, transformador
Poggi completa
Menchi Hmunogunkab Hari Hunaja, transformador
Poggi completa
Menchi Hmunogunkab Hari Hunaja JonikotMafatra e 40s Helps Dantwsen O homem labial. Você pode ver como
ele alterna perfeitamente entre esses idiomas, mantendo
a voz e o tom Se você fala algum
desses idiomas, pode ver se parece
realista ou não,
mas, pelo que a
comunidade diz, acerta muito bem. Ok, então se você
quiser explorar mais, você pode ir até aqui ou
simplesmente ir até as vozes. Isso levará você
à biblioteca de voz, e temos muitas
opções para escolher. imediato, você verá que há marcas de verificação em alguns deles e isso apenas
indica que eles são alta qualidade e
foram muito usados Você pode ver o nome
dessa pessoa e,
se passar o mouse sobre ela, verá um
pouco mais de informações A descrição
das vozes pode realmente ajudá-lo
a escolher aquela que você quer. Por exemplo, David aqui
é um leitor de notícias e tem uma voz clara
e nítida Ele é americano de meia idade,
profissional, e então você pode simplesmente avaliar
se isso vai se
encaixar ou não no seu projeto Vamos dar uma
prévia dessa voz. Basta clicar nele. Mais tarde, naquela mesma noite, detetive Carlson
recebeu uma denúncia anônima direcionando-a para uma O que a princípio
parecia um evento aleatório. E, mais uma vez, você pode alternar entre os idiomas. Agora, você pode ver aqui que a seleção de idioma é
diferente da primeira voz, e isso porque cada voz tem sua própria seleção de idioma. Então, aqui estamos realmente
recebendo árabes, poloneses, estrangeiros, acho que esses são os
únicos que são diferentes. Estamos aprendendo hindi, inglês e francês, como fazíamos antes E aqui embaixo, você
pode ver as bandeiras. Então, ele vem nesses dois
idiomas e depois em mais cinco. Esses dois, mais dois, e isso vai
mudar à medida que você avança. Na página Explorar, você pode pesquisar
o nome dessa voz ou
a forma como ela soa. Por exemplo, estou
procurando uma voz calma e estou
ouvindo
muita narrativa e história, informativa e educacional, para ouvir isso Aqui, temos um narrador calmo e
bem falado, cheio de intrigas e
maravilhas pela natureza,
ciência, mistério
e história, com um tom
suave e aveludado Você pode ver que definitivamente
soou calmo e , na verdade, é um
dos adjetivos listados aqui Imediatamente, sem precisar clicar nela ou passar o mouse sobre ela, sei exatamente qual
voz vou ouvir Agora, você pode dar uma
olhada no lado direito, quais são as categorias em
que eles se enquadram. Se você abri-las em uma nova
guia, vamos abrir uma. Vamos comprar uma biblioteca apenas para fins informativos
e educacionais Você pode ver que essa é a
categoria em que eu entrei. Feche aquele cara.
Ao lado dela, você pode ver dois Y ou
zero D.
Isso significa apenas quanto tempo essa
voz vai ficar se for removida. Se o proprietário dessa voz remover
da biblioteca de voz, ela ficará indisponível
para você após dois anos Mas aqui, por exemplo, ele será removido imediatamente. Se você quiser usar
isso a longo prazo, definitivamente opte por
aqueles que têm uma retenção mais longa em
comparação com algo assim. A seguir, podemos ver quantos
usuários usaram essa voz. O primeiro, de Adam Stone, você pode ver que é bem popular. 438.000 pessoas
usaram essa voz, que
significa que você provavelmente já a
ouviu em algum momento As pessoas que são loucas
o suficiente para pensar que
podem mudar o mundo
são aquelas que o fazem. Lá vamos nós. Depois,
há um botão de adição, o que significa que você pode preferir
essa voz para uso posterior. Clique em uma vez e, em seguida, ele
basicamente vai para essa guia, que abordaremos mais tarde. Agora você pode ver que passou
de um ponto positivo para esse ícone. Eu posso usar essa voz para gerar um áudio para texto
para fala,
fala para texto, qualquer coisa que
eu A seguir, mais ações. Você pode copiar o link de voz para o ID de voz e, em
seguida, ver algo semelhante. Se você já usou outras ferramentas de IA, pense no
ID de voz como o número ST. Quando você tem o ID e está tentando
gerar sua voz, ele o manterá
muito mais consistente. Não funcionará quando você colocar
adjetivos diferentes Eu continuarei parecido. Mas geralmente, se você usa uma
dessas vozes pré-fabricadas, você realmente não precisa usá-la. O link é apenas um link para
essa voz, se você quiser
compartilhá-la com alguém e, em
seguida, temos uma similar, que oferece mais vozes
que soam como Adam Stone. Agora vamos explorar
as coisas aqui em cima. Essa foi a nossa barra de busca. Conseguimos procurar um adjetivo, talvez o nome de
alguém Vamos procurar alguém
chamado John Doe. Lá vamos nós.
Temos três opções. Você também pode
pesquisar por idade ou sexo, talvez o idoso possa fazer sexo masculino ou
talvez adolescente do sexo masculino ou algo assim. Tudo o que quisermos. Então, por exemplo, jovens adolescentes ingleses. Olá. Sou Archie. Se você está procurando uma voz
adolescente britânica
jovem, enérgica e autêntica, então Ei, eu sou Ethan, e eu
seria uma ótima opção se você estiver procurando por
um dublador adolescente Você pode ver como essas barras
de pesquisa afetam. Você pode ver como pesquisar uma determinada coisa fornece a seleção de voz correta. Algumas dessas vozes
serão carregadas um pouco
mais do que outras. Com o plano que eu tenho, você pode ver que esses
são bons para eu usar. Eles são os mais populares, e não há nenhum
cifrão aqui. Mas para elas, você pode ver que são $0,02 e isso é apenas para
algumas dessas vozes Você pode ver que a maioria
deles não tem isso. Vamos voltar até aqui. Essa foi a nossa barra de busca. Logo ao lado, você
notará esse ícone. Basicamente,
quando você faz o upload de uma amostra, feche isso. Você faz o upload de
uma amostra e, em seguida, 11 laboratórios encontrarão uma
semelhante a essa. Digamos que você tenha essa voz que deseja
replicar com a IA, é
claro, esteja muito
atento aos direitos autorais, mas você pode colocá-la aqui Por exemplo, se você quiser uma boa
voz confiante, por exemplo, Michel Obama e quiser
obter algo relativamente próximo, pode enviar um trecho dos discursos
dela aqui
para obter algo mais Por exemplo, se você está fazendo
alguma animação e tem um personagem depois de Michel
Obama, você pode fazer isso Novamente, você realmente quer estar atento à forma como
está fazendo isso Falaremos sobre a
ética da IA em uma lição posterior. Mas você não pode simplesmente descartar
qualquer voz e tentar exatamente
a mesma coisa,
pois isso pode causar grandes problemas Ao lado disso,
temos uma tendência. Se você clicar nele,
há muitas vozes
populares e
vozes únicas. O que quero dizer com isso é que os mais populares
têm sido muito usados Esses são os que
vemos aqui. Vou
clicar nesse triângulo só para entrar na lista novamente. Você pode ver que um grande número
de pessoas o usou. Se você quer ser único aqui, provavelmente não deveria
optar por algo
assim e é aí que
essa guia é útil. Se eu mudar para o mais recente,
você verá que este, por exemplo, não foi verificado, mas apenas 14 pessoas o usaram. Dessa forma, estou sendo
mais exclusivo quando tenho minhas vozes em meus vídeos e também há
opções mais baixas, sete pessoas, cinco pessoas, e a lista
só tem duas pessoas. Ficar para trás com a IA
parece que você não consegue acompanhar. Sua empresa precisa de um
engenheiro rápido que seja importante. Então você pode ver que,
apesar de serem novos, alguns deles
não são tão de alta qualidade quanto os mais populares. Portanto, é uma boa ideia
visualizá-los, verificar se é algo
que funciona para você e depois continuar a usá-los. Temos o Latest,
temos a maioria dos usuários. Então você pode ver que
este é muito alto. Eu acho que essa é uma maneira
muito boa conversar naturalmente juntos, você sabe, claramente.
Vamos tentar. Você pode ver que é coloquial, parece muito
natural e isso é perfeito se você quiser
fazer um podcast ou se quiser usar sua própria voz e
convertê-la para esse tom Isso é algo muito
legal que 11 laboratórios têm, e abordaremos isso
em uma lição separada. Mas é isso que a maioria dos
usuários comprará para você. uso de caracteres significa basicamente quantos caracteres você pode converter em áudio
dentro de sua faixa de crédito. Isso é algo sobre o qual
falaremos mais tarde, quando eu mostrar como transformar
texto Você verá exatamente quantos
caracteres está usando. Para algumas vozes, serão necessários mais créditos, enquanto outras não, é a
que se refere. Não se importe com isso por enquanto.
Falaremos sobre isso mais tarde. Ao mesmo tempo,
temos a guia de filtros, que permite que você se aprofunde e
encontre o que realmente precisa. Temos idiomas, em primeiro lugar, uma grande variedade de idiomas. É como o galês, por exemplo. Você pode até escolher um
sotaque, se aplicável. Por exemplo,
não é para galês, mas vamos ver o que
teria um sotaque Vamos ver se o inglês
tem um. Lá vamos nós. Se você está escolhendo o inglês, há muitos sotaques
que você pode explorar Digamos que eu queira alguém de
Chicago, vamos escolher isso. seguir está a categoria, que é o tom em que as
vozes soam e falam. Pense no motivo
pelo qual
você quer essa voz e simplesmente escolha
sua categoria. Vou usar um
tom muito natural, coloquial. Clique nisso. Você também pode
clicar em mais de uma categoria. Talvez eu faça
algo assim. Qualidade, qualquer ou alta qualidade. Lembre-se de que os de alta qualidade são
aqueles com a marca de verificação. Eles podem pedir mais créditos, mas você pode simplesmente clicar em qualquer um
para ter várias
opções para ver. O próximo é o gênero. Acho que vou fazer uma idade feminina. Vamos fazer uma pessoa idosa. Período de aviso prévio. Esses eram
os números ao lado, quanto tempo você consegue
mantê-los depois que
o proprietário exclui a voz Digamos que dois anos. Tarifas personalizadas,
incluem ou excluem. Isso é para o
uso do personagem que vimos. Em seguida, a moderação ao vivo foi ativada. Isso
moderará o tipo de texto que você está
enviando para essa voz. Vou clicar em
Incluir por enquanto. Vamos aplicar os filtros. Agora, você pode ver que eu não tenho nenhuma e isso vai acontecer, mas você pode criar
suas próprias vozes. Então, isso é algo
que exploraremos mais tarde. Vou remover
alguns deles só para conseguir algo
para mostrar a vocês. Ok, então só um sotaque americano de
Chicago. O exercício torna nosso coração mais forte e nossos
sorrisos mais brilhantes Esse foi um exemplo.
Você pode ver que é um áudio muito recente. Apenas 32 pessoas o usaram. Não foi verificada, mas
ainda é uma voz que você pode usar. Vamos tentar outra coisa. Podemos fazer, novamente, inglês, talvez tentar o canadense. Então, aqui está um áudio de alta qualidade. Conheci Gram, esse lindo
gato em nosso abrigo. Esse garoto é adorável. Com suas listras malhadas
e seu rosto fofo, ele com certeza roubará seu
coração em Então esse foi um exemplo. Vamos tentar encontrar outro. Senhoras e senhores,
bem-vindos ao jogo de hoje. Temos uma
partida emocionante pela frente entre EFC United e o Team Impact A atmosfera é elétrica. Todos esses são sotaques canadenses
em diferentes categorias. Em seguida, criamos
ou clonamos uma voz. Esse é
aquele recurso interessante sobre o qual falei,
onde você
pode criar uma
voz totalmente nova a partir de um prompt de texto. Você diria que talvez um senhor mais velho
com um sotaque forte, talvez uma voz profunda,
calma, enérgica, o que
você quiser colocar E vai para a ElevenLabs. Nós lhe daremos várias
opções, amostras. Você pode se
basear nisso e depois criar seu próprio áudio original. Agora, as coisas que você cria, você também pode fazer com que
outras pessoas as usem. É daí que vêm todas essas
novas vozes. Menos de um minuto, e abordaremos isso em
uma lição diferente. Temos uma opção de clonagem de voz, para que você possa clonar sua própria
voz em apenas 10 segundos Vou falar
ao microfone por 10 segundos e depois 11
laboratórios estudarão minha voz. Então eu posso usar minha voz
com diferentes instruções de texto. Por exemplo, se eu não quiser
gravar um audiolivro
com 3 horas de duração, vou falar no microfone por 10 segundos
e colar
o enredo ou
apenas a história na caixa e, em
seguida, 11 laboratórios gerarão esse áudio de
três horas para mim. O próximo é o clone
de voz profissional. Isso não está incluído
no plano que eu tenho, mas é apenas
o mais realista. Mas para a maioria de vocês, já que estão usando essa ferramenta
pela primeira vez, essas duas devem ser suficientes. Aqui em cima, temos uma caixa de feedback, na qual você pode simplesmente
escrever seu feedback. Temos outras
coisas aqui em cima. Essa era a guia Explorar. Minhas vozes terão as vozes que você adicionou aos favoritos
ou criou Temos vozes padrão. Essas são vozes da ElevenLabs, então não são geradas pelo usuário Apenas confie em si mesmo, então
você saberá como viver. Você pode pegar isso, usá-lo
como todas as outras vozes e dar uma
olhada nas muitas opções. Também temos coleções, que você pode criar quando está tentando
organizar suas vozes. Por exemplo, eu poderia criar uma coleção para meu canal
no YouTube, uma para meu podcast, outra para meus audiolivros
e, assim, tudo
ficará muito mais organizado. Você está visualizando uma voz,
temos o nome aqui, os diferentes idiomas em que ela está
disponível no botão Play, você pode pular para frente e para trás, ver quanto tempo ela está Você pode baixar a voz e simplesmente ocultar o player se não precisar dele. Esse é o painel de vozes. Se você clicar
nesse botão Mais, ele
exibirá o mesmo menu que apareceu quando
clicamos aqui Agora, na próxima lição, examinaremos as ferramentas do
playground que estão localizadas logo abaixo e veremos o que mais podemos
fazer com essa
7. Texto para fala: Com a conversão de texto em fala,
você pode facilmente transformar texto
escrito em áudio genuíno de
boa qualidade E essa é a interface
em que você vai fazer isso. Então, essa aqui é a
primeira ferramenta disponível. Depois de clicar nisso, você
terá essa área, que é essencialmente o
seu playground, e então você tem
todas as propriedades, diferentes bibliotecas de voz ,
qualquer tipo de configuração que
você precise, estará à direita. E aqui embaixo, temos
alguns modelos rápidos para você começar. Mas é claro que você não precisa usá-los, a menos que queira. É aqui
que você escreve o texto e basicamente
finge ser a voz Então, agora, eu tenho
Liam da biblioteca, mas você pode escolher
qualquer outra pessoa aqui. Já examinamos
a biblioteca de voz. Há muitas opções para escolher. E você também pode usar as
vozes que você salvou. Novamente, você pode
filtrar qualquer uma dessas categorias e
encontrar a voz perfeita. Mas mesmo que você tenha uma voz
que considere perfeita, você ainda tem mais
capacidade de ajustá-la. Por exemplo, se eu
escolher Adam aqui, ainda
posso
mudar a estabilidade,
a panorâmica, o idioma
que ele falará, o formato de saída e
tudo mais que for necessário Então, vamos ver como
isso funciona exatamente porque há algumas
coisas legais que você pode fazer com o ElevenLabs na conversão de texto em
fala Então, aqui você pode digitar o texto que
deseja que Adam diga,
mas, ao mesmo tempo, o ElevenLabs tem algo chamado tags de áudio E esse é um
exemplo aqui. Então, por exemplo,
risos, choros, gritos, qualquer tipo de etiqueta de áudio que
você queira implementar, você pode adicioná-la
usando Também pode usar
a pontuação para trabalhar com as pausas, os pontos finais e E, ao mesmo tempo,
podemos ter vários alto-falantes. Então, o que vamos
fazer é criar uma conversa muito simples entre Adam e
outro palestrante, digitar algumas frases e usar parte do texto de áudio sobre
o qual falamos. Dessa forma, você terá
uma ideia melhor sobre como conversão de texto em fala
realmente funciona e como você pode usá-la em todo
o seu potencial Então, vamos começar com Adam. Vou fazer com que
ele diga: Ei, usando o ponto de exclamação, vai ficar um
pouco mais animado Então Adam ficará meio
enérgico quando disser isso. E só para mostrar como
isso soa, vou colocar outra
frase depois disso. Então, ei, como está indo? Então, agora, usei
dois sinais de pontuação e vamos ver como
isso soa Não vou
mudar nada aqui, e vamos simplesmente
clicar em Gerar fala. Ei, como vai? Então você pode ver que
ele meio que esticou o feno e então ele
fez uma pergunta Agora, se eu remover esses caras e simplesmente não usar
nada, isso vai soar
um pouco diferente. Ei, como vai? Então, ele não fez uma pausa, e agora é menos uma pergunta Então, uma maneira de controlar a voz é usando essas marcas. Então, vamos adicionar
esses pontos de interrogação. E então vamos
adicionar nosso segundo alto-falante. Então, vamos fazer disso outra pessoa. Eu vou com a Ellen. E agora Ellen vai
fazer outra coisa. Então, talvez ela se assuste
quando Adam fizer essa pergunta. Então, talvez grite. Oh, meu Deus. Você me assustou. Ei, como foi?
Sim. Oh, meu Deus. Você me assustou. Então você pode ver
o quão bem isso funcionou. E para mostrar a vocês o
poder das etiquetas de áudio, vou removê-las agora. Então agora é só, Oh, meu Deus, você me assustou com os pontos de
exclamação. Ei, como vai? Meu Deus, você me assustou. Então você pode ver, mesmo que
eu não tenha colocado a etiqueta de áudio, a voz ainda é
bastante natural, e é aí que eu quero
apontar os modelos que estamos usando. Então, agora estamos no 113. Se você clicar aqui, poderá
ver todos os modelos diferentes. Mas, essencialmente, 11 V três
é o mais expressivo. Então, do jeito que, você sabe, ele entra, eu falo alto e, tipo, uma voz profunda, e então ela entra um pouco assustada Isso é por causa do nosso modelo. Também temos
modelos multilíngues aqui,
mas, no momento, estou apenas me
limitando ao inglês Portanto, se você quiser fazer isso
em um idioma diferente, recomendo mudar para este. Há pelo menos 26 outros
idiomas que ele suporta. Então, se você encontrar o
idioma que você gosta, você pode colocá-lo aqui. E temos ainda mais modelos. Então você pode ver como
agora está dizendo que recomenda
esse modelo para Ellen Às vezes, isso acontece
dependendo da voz que você escolher. Também há flash turbo
e diferentes modelos de turbo. Então, realmente depende de
quanta estabilidade você quer com as vozes e quanta expressão
você quer com elas. Então, esses caras aqui, geralmente
são bons
para conversões rápidas exemplo, você não quer que muitos detalhes entrem na geração de
voz. Portanto, você pode ver que ele menciona casos de uso de
conversação. Então, talvez se você tiver
um vídeo do YouTube em que a pessoa
esteja apenas falando, não
haja muita coisa acontecendo. Você pode usar um modelo como esse. E também temos outros modelos que ele recomenda que usemos
para,
como, casos de uso de desenvolvedores. Por exemplo, se houver chatbot de
IA no site, você pode usar um desses modelos Mas se você vai
criar uma história muitas tags de áudio, muitas
pausas e movimentos, opte
pelo primeiro Então, vou
ficar com esse cara e vou colocar de
volta aquela etiqueta de áudio. Basta dizer o que é e
depois colocá-lo entre colchetes. Deve ficar rosa. Caso contrário,
porque não reconhece
aquela etiqueta de áudio, por exemplo, ela não suporta
essa expressão, ou você pode ter colocado
um espaço extra,
uma vírgula, ortografia incorreta Mas uma vez rosa, com
certeza é uma etiqueta de áudio. Você pode adicionar Adam de volta. Você pode ver que ele foi
captado imediatamente, mas você pode adicionar um terceiro
alto-falante, se quiser. Então, eu vou rir. Você é tão fácil de assustar. Você terminou o dever de casa? Vamos adicionar Alan. Novamente, você pode ver que há uma conversa. Nós faremos desse tamanho. Não, pai e eu não. Eu estava tão ocupado ontem. Você também pode usar as tags de
áudio entre as palavras, então nem sempre
precisa estar
no início
ou no final de uma frase. Então, aqui, poderíamos
fazer a tag de áudio Snifs. Eles acham que eu estou
sofrendo de alguma coisa. E agora vamos gerar. Ei, como vai? Oh, meu Deus. Você me assustou. Você é
tão fácil de assustar Você terminou o dever de casa? Não. Eu estava muito ocupado ontem, mas acho que estou pensando
em alguma coisa. Então, aqui está nossa conversa muito
simples. Mas agora poderíamos
entrar em cada voz e definir
melhor a forma como as
expressões estão sendo feitas. Então, por exemplo, Adam
agora é um pouco intenso demais. Não é realmente uma voz
coloquial. Então, vou clicar em Adam, mas depois voltar para
a página aqui e torná-la um
pouco mais criativa. Então, vamos ver como
isso soa. Ei, como vai? Hein. Oh, meu Deus. Você me assustou. Você é tão fácil de assustar. Você terminou o dever de casa? Não. Eu estava muito ocupado ontem, mas acho que estou pensando
em alguma coisa. Então, agora a voz dele está
um pouco mais leve. Isso porque eu o puxei
para o lado criativo. Apenas tenha cuidado com isso,
porque quando você diz à
ElevenLabs que não seja tão consistente
na geração de voz,
a voz pode meio que falhar se você estiver escrevendo um parágrafo muito
longo ou,
tipo, tipo, Mas para uma situação como
essa, em que é, tipo, uma frase ou duas,
funciona muito bem. Agora, ao alterar os modelos, você obtém
coisas adicionais que podem ser ajustadas. Então, isso aqui
é para 11 V três, mas eu vou até
Ellen agora e mudar isso para o segundo modelo Você pode ver
que é recomendado aqui. Vou
clicar nele. E agora você pode ver que
há muito mais opções. O único problema é que
agora não temos esse
layout de conversação com B três Não temos esse modo de alto-falante
diferente. No momento, tudo o
que está escrito aqui é apenas para Ellen Então essa é a desvantagem. Assim, você pode se movimentar em cada modelo, dependendo do
que você precisa. Mas podemos usar a Ellen aqui. Vou apenas deletar
as linhas que Adam tinha. E eu vou, você sabe, brincar com alguns
desses controles deslizantes aqui embaixo Então, a primeira coisa é a velocidade. Ela está falando muito
rápido, muito devagar? Você pode ajustá-lo aqui. Então, para mim,
vou diminuir um pouco. E com esses controles deslizantes, você deve ter
cuidado novamente para não exagerar, porque se você voltar ou
avançar
totalmente,
a voz pode não conseguir
manter a consistência em,
você sabe, frases diferentes Portanto, seja qual for o ajuste que você fizer, tente mantê-lo mínimo. Então eu era um aqui. Acabei de chegar a
96, então não é como aqui. A próxima coisa é estabilidade. Então, você quer que ela tenha volumes
diferentes em alguns pontos ou quer que ela
seja apenas monótona Você sabe, isso é
algo que você
decide com esse controle deslizante Então, se eu for até aqui, ela vai soar
como um, você sabe, robô. Mas se eu for até aqui, ela pode estar muito hiperativa Então, novamente, podemos fazer
pequenos ajustes. O próximo passo é a clareza da voz. Vou manter isso como está. Eu acho que é, você
sabe, muito claro. Em seguida, temos o
exagero de estilo. Então você quer que seja
, você sabe, do jeito que ela soa agora, ou você quer que ela
fique mais animada? Você quer que ele exagere todos os diferentes sinais de
pontuação, etiquetas de
áudio e Mais uma vez, vou
deixar a minha como está. E então, por fim,
temos o planejamento. Então, é apenas sobre,
tipo, o campo estéreo. Você pode pensar em
dois alto-falantes. Você quer que
seja mais para a direita ou mais
para a esquerda? Então, só para mostrar
como isso soa, vou trazer
isso até a direita. E dessa forma, ele
só sairá de um
lado do alto-falante. Também temos a substituição de linguagem. Se você quiser selecionar manualmente o idioma que a ElevenLabs
produz para você, você pode ativá-lo Então, você pode escolher
um idioma aqui. Caso contrário, ele
detectará o que você tem
aqui e, em seguida, tomará
essa decisão sozinho. Em seguida, estão os efeitos de áudio. Esses são
arquivos adicionais que você pode adicionar aqui apenas para tornar a voz
talvez mais realista, mais adequada para um
determinado ambiente. Tudo isso também é
fácil de adicionar. Por exemplo, eu poderia
adicionar um pouco de ruído, digamos que ela esteja em um café. Eu também poderia filtrar
algo. Talvez ela esteja no telefone. Você pode trabalhar com o espaço. Este é o eco, e então
temos a distância. Então, a que distância ela está
do microfone? Então, vou fazer
os dois primeiros primeiros, e você pode fazer uma pequena prévia antes de desperdiçar qualquer crédito. Aqui está uma prévia da sua
voz com efeitos aplicados. Aqui está uma prévia da sua
voz com efeitos. Então você pode ver que ele só
saiu do lado direito
por causa disso. Então, deixe-me colocar isso de volta. Aqui está uma prévia da sua
voz com efeitos aplicados. Aqui está uma prévia da sua voz. E é
isso que parece. Por fim, é o formato de saída. Esses são formatos diferentes
que você pode escolher. Depende do motivo pelo qual você
precisa dessa voz. Então, você pode ver que alguns
deles estão completamente desatualizados porque são para um plano
mais profissional. Atualmente, estou no 11 Creative, então esses dois devem
ser suficientes para mim. Vou apenas
mantê-lo como padrão e, é
claro, queremos que o
discurso seja impulsionado Se você sempre quis voltar
ao que era inicialmente, você pode clicar em Redefinir valores. Vamos gerar o discurso. Meu Deus, você me assustou. Não, eu estava muito ocupado ontem, mas acho que estou pensando
em alguma coisa. Agora você pode ver que a
voz é muito diferente
do primeiro modelo porque nos livramos completamente
das tags de áudio, bem
como
de grande parte da expressão que estava disponível
no primeiro modelo. Mas vou deixar
isso mais alto, só para que vocês possam
ouvir aquela coisa do café, e eu vou tirar o telefone. Acho que isso está
dificultando a audição. Então, vamos fazer isso mais uma vez. Aqui está uma prévia da sua
voz com os efeitos aplicados. Agora podemos ouvir melhor o ruído de fundo do
café. Se você optar por um modelo
diferente, poderá obter controles deslizantes adicionais Mas, novamente, só faça isso
se quiser que algo
específico seja feito. Então, esse aqui
é o 11 turbo. São praticamente
os mesmos controles deslizantes. Então, na verdade, tudo se
resume
às linguagens que você deseja usar ou à velocidade
da geração. Mas V três é, você sabe, o melhor para conversas
e, honestamente, parece
o mais natural Você tem um áudio,
pode vir até aqui, pode reproduzi-lo,
avançar,
retroceder, dar feedback se quiser,
compartilhá-lo com as pessoas, baixá-lo para você mesmo e até
ocultar o player Então, se você
baixá-lo, ele
vai direto
para o seu computador. Será o mesmo formato que você escolheu aqui. Agora, se você estiver usando o V três, poderá aprimorar ainda mais o
áudio com tags de áudio, e isso é algo
específico apenas para este modelo. É assim que o recurso de conversão de texto em fala
funciona. É muito útil, e quanto mais você
brincar com isso, mais você
conseguirá
encontrar a voz perfeita para seu projeto e
manter essa
consistência em todos eles.
8. Modificador de voz: Agora, embora o trocador de voz pareça uma ferramenta muito
simples, há muitas
coisas que você precisa considerar
para
obter uma conversão de considerar
para
obter uma conversão voz decente e precisa Essa é a interface
quando eu clico nela pela primeira vez. Ainda estamos no grupo de
parquinho. Acabei de clicar no trocador de voz e é isso que você deve ver Essencialmente, você insere um áudio, quer você o grave agora ou
tenha um áudio pré-gravado, e então você escolhe a
voz e as configurações, ele o converte da sua voz
para a voz que O que vamos fazer é
gravar nosso áudio
diretamente no computador e
depois partir daí. Então, clique em gravar
áudio e, ao fazer isso, você
terá a opção de qual microfone
gostaria de usar para isso. Quando estiver pronto, você
pode clicar em Iniciar e ver que temos
no máximo 5 minutos. eu só vou
ler um trecho de Talvez eu só vou
ler um trecho de
um conto e então
poderemos ver o quão bem ele
funciona lá. Este é meu áudio original. Todo mundo olha para cima. Algumas pessoas começam a pular para cima e para baixo, balançando os braços no ar Jake olha
para as torres ao redor complexo e percebe que
os
guardas estão em alerta total,
direcionando seus rifles para o complexo onde homens e mulheres estão Então, aqui eu leio
as coisas em um ritmo mais lento, mas depois vou mostrar o que
você obteria se
falasse muito rápido ou se sua
voz não estivesse clara Agora que tenho meu áudio, posso
excluí-lo para obter
outro ou simplesmente continuar
com a conversão. Primeiro, você precisa
escolher seu áudio. Vou experimentar uma mulher
e
um homem para que você possa
ver a diferença. Vamos tentar uma voz
feminina que não seja parecida com a minha.
Procure mulheres. Apenas confie em si mesmo.
Então você saberá como viver. Ela rasgou o olhar Oi Governo do povo. Não há maior dano. As ideias são o
ponto de partida de todas as fortunas. Então aqui temos Dorothy
com sotaque britânico,
que é um sotaque que eu não tenho Então, vamos continuar
e clicar nisso. Esse é o modelo
que ele escolheu para nós, e vou
deixá-lo com a configuração padrão. Agora, uma coisa que eu
quero destacar aqui são essas duas opções que
você pode ativar ou desativar. O primeiro é remover o ruído
de fundo. Se você não estiver gravando isso
diretamente em um microfone, precisará ativá-lo. Dessa forma, você
não se concentrará tanto
nos carros que passam ou em
alguém batendo na mesa E concentre-se apenas na
sua voz. Agora, o alto-falante acende por
padrão, ele liga, mas descobri que,
quando está ligado, distorce um pouco sua
voz Vou apenas executar isso
com as configurações padrão, que é o que você vê
na tela agora. Depois, vou
desligá-lo e
mostrar a diferença. Todo mundo olha para cima. Algumas pessoas começam a pular para cima e para baixo, balançando os braços no ar Jake olha para
a torre ao redor do complexo e avisa
o guarda em alerta total,
direcionando seus rifles para o complexo onde homens e mulheres estão
fazendo Você pode ver que ele
lutou com algumas palavras e usou muitos s, o que
acredito ser causado pelo aumento
do alto-falante Como eu tenho acesso a
um microfone profissional, eu realmente não preciso desse. Então, o que eu vou
fazer é desligá-lo. E depois reduza a
semelhança para que eu pudesse ter mais
voz britânica,
eu acho, algo mais próximo do som de
Dorothy Se você aumentar
isso até alto, ele realmente tentará
imitar seu tom e tom exatos, que pode levar a uma
maior distorção Vamos reduzir isso para 40%. Vou deixar a estabilidade e o
exagero como estão. Agora vamos ver a diferença. Todo mundo olha para cima. Algumas pessoas começam a pular para cima e para baixo, balançando os braços no ar Hake olha
para as torres ao redor do complexo e percebe que
os guardas estão em alerta total, enfiando seus rifles
no complexo onde homens
e mulheres estão fazendo e mulheres Então, isso ainda é um pouco melhor, mas podemos ir ainda mais baixo. Podemos tentar obter mais estabilidade.
Experimente novamente. Todo mundo olha para cima. Algumas pessoas começam a pular para cima e para baixo, balançando os braços no ar Jake olha
para as torres ao redor do complexo e percebe que
o guarda está em alerta total,
direcionando seus rifles para o complexo onde homens e mulheres estão É muito melhor do que
o que tínhamos inicialmente. Ainda está lutando
com a parte do sotaque. Palavras como comoção, ele
comercializa um RN lá. Mas isso é algo que podemos corrigir com uma voz
diferente. Mas em vez de ouvir todas as vozes, vou mudar para uma voz masculina e tentar
um sotaque diferente. Vamos tentar algo sem sotaque, como
um homem americano Com o amanhecer, novas
soluções iluminam o caminho. Subir colinas íngremes requer
um ritmo lento no início. Ei, venha aqui. Olá, você ligou para a Acme Corp. Chega um momento em o caminho familiar não parece
mais suficiente Um pôr do sol é uma forma diária
de dizer adeus, Grace. Ok, então eu
vou com o Liam aqui. Vamos clicar na voz dele. Então, temos um novo
áudio agora. Repetidamente, ele ouve
o som das portas
sendo batidas e trancadas, trancadas e trancadas Então, agora vamos
tentar uma voz masculina. Deus lhe deu um rosto
e você se torna outro. Então, tem George lá embaixo. Temos a opção
de idiomas diferentes, mas vamos começar com o inglês. Repetidamente, ele ouve
o som das portas
sendo batidas e trancadas,
batidas e trancadas Então, é interessante que eu tenha dito
essas duas palavras duas vezes. Na primeira rodada, eu
não falei bem, mas na segunda rodada, sim. Portanto, há algumas inconsistências como sempre há com Mas, na maioria das vezes, você pode ver que isso acompanhou os lugares em que mudei meu tom e a maneira como
disse as palavras. Portanto, é bem idêntico , exceto pelo
fato de ser George. Vou fazer isso
mais uma vez sem o aumento do alto-falante e ver se
isso é diferente. Repetidamente, ele ouve
o som das portas
sendo batidas e trancadas,
batidas e trancadas Na verdade, vamos reduzir
a semelhança para 20%. Repetidamente, ele ouve
o som das portas
sendo batidas e trancadas,
batidas e trancadas Foi muito melhor.
Eu disse as palavras certas e
provavelmente foi porque reduzi a semelhança para 20% e removi
essas duas opções O que você pode fazer com esse
áudio é baixá-lo. Você também pode baixá-lo
com o nome original, excluí-lo e
compartilhá-lo, se quiser. É basicamente assim que
o trocador de voz funciona. Você também pode experimentá-lo
com vozes externas, talvez fazer algo
na conversão de texto em fala e depois mudar de ideia, basta acessar o Voicehanger,
carregar o que obteve
daqui
para aqui e mudar para talvez fazer algo
na conversão de texto em fala
e depois mudar de ideia,
basta acessar o Voicehanger,
carregar o que obteve
daqui
para aqui e mudar para uma voz diferente. Lembre-se de que a
conversão de texto em fala é muito
mais precisa do que
a conversão de voz em voz Portanto, tenha isso em mente se estiver fazendo isso para um projeto mais
sério. Na próxima lição,
abordaremos os efeitos sonoros, que são pequenos trechos
sonoros que você pode colocar em seu
vídeo para enfatizar uma determinada ação ou criar algo
mais dramático Vamos passar para essa lição.
9. Efeitos de som: Agora, vamos passar
aos efeitos sonoros, que é quando você consegue
gerar um efeito sonoro
com apenas algumas palavras. E imediatamente, você
pode ver que
há alguns exemplos
para você explorar. Esses são exemplos de prompts. Quando você clica neles,
eles aparecem nessa caixa, que é onde seu
prompt vai entrar e,
em seguida,
basta clicar em gerar. Vamos fazer um carro passar zunindo. Também podemos tentar
outra coisa, como um gato, talvez. Aqui embaixo, é a duração. Então, por quanto tempo queremos que
esse efeito sonoro dure? Você pode pegar um controle deslizante
e, se não certeza de quantos minutos ou
segundos
deseja, basta pressionar Auto Então, temos nossa influência
imediata. Quão rigorosamente queremos que o
módulo de IA siga nossas instruções? Se você quiser ter um
pouco de criatividade, pode mantê-la
na parte inferior. Mas se você quiser que seja
exatamente o que você pediu, basta colocar o
controle deslizante no alto O padrão é 30, e é assim que
vou deixar. Aqui, temos o histórico, para que você possa obter amostras diferentes com base em uma solicitação
que você fornece. Anteriormente, usei essa arma
semiautomática e recebi quatro amostras Aqui você pode pressionar play
para ouvir a diferença. Você pode ver que todas
elas são armas, mas elas começam de forma diferente e até
soam de forma diferente. Com base no
que estou tentando fazer, posso escolher qualquer uma
dessas amostras e simplesmente clicar em Baixar O que você pode fazer é
clicar em D plus para reutilizar o prompt
e talvez você possa adicionar um novo detalhe aqui Eles são organizados por data. Você pode simplesmente dar uma
olhada no que você fez
até agora e acompanhar
o que está construindo. É a duração
e a influência. Ok, então isso é tudo
com o que você pode fazer imediatamente no painel de efeitos
sonoros. Temos uma guia Explorar, assim como a
biblioteca de vozes, onde você pode
ver alguns desses
efeitos sonoros que já existem. Por exemplo, vamos
fazer, vamos ver. Um leão. até fazer efeitos cinematográficos Esta é uma
transmissão urgente de emergência. A atenção ressoa uma violação de contentamento, você pode ver que todos os tipos de efeitos
sonoros podem ser encontrados aqui, se você
quiser ajustá-los Por exemplo, essa coisa de
basquete é ótima, mas talvez você queira
começar com um apito Tudo o que você precisa fazer
é clicar em usar e ele aparecerá
na sua caixa de aviso
e, em seguida, você poderá
adicionar esse detalhe. Talvez assobios
soprando nas costas. Eu adicionei mais um detalhe. Vamos clicar em gerar
e ver o que obtemos. Enquanto isso está acontecendo, eu
vou lá. Deixe-me repetir o original
para que você possa comparar. E então temos quatro amostras. Todos eles parecem uma partida de basquete muito
intensa. Também poderíamos, de
forma semelhante, remover uma condição. Vamos tirar o
apito e os
aplausos da multidão e fazer uma partida
silenciosa Vamos clicar em Gerar e eu poderia simplesmente alternar isso para
que fique organizado Se você tem muitas
coisas em seu histórico, também
há uma barra de pesquisa, que é muito útil
se você planeja gerar muitos efeitos
sonoros aqui Então, podemos ouvir aquela bola de basquete driblando e lá está o
tênis rangendo na parte Mas, como você viu, não
há mais multidão, não
há mais assobios E isso porque removemos essas duas partes do
prompt. É isso aí X. Você pode baixar qualquer um
deles, se quiser Se você clicar neles, você
também pode simplesmente copiar o prompt. Assim como a biblioteca de vozes,
há uma barra de pesquisa. Você pode clicar em Mais para ver
também os áudios
mais baixados, mais recentes
para algo exclusivo
e, em seguida, os áudios mais populares Aqui em cima, há várias categorias para facilitar a
pesquisa. Vamos tentar algo
como elementos de interface do usuário. Se você quiser adicionar
um efeito sonoro ao seu site, por exemplo. Bem-vindo ao VCStom Graphics. Vamos voltar ao Explore. Há mais uma
coisa muito
legal no painel de efeitos sonoros, que é
a mesa de som Se você clicar nele,
você será direcionado para uma página totalmente
diferente. Se você já trabalhou
com mesas de som, isso deve parecer bastante
familiar para você, mas se não, não
se preocupe Uma mesa de som é basicamente
uma placa na qual você pode adicionar vozes diferentes
sempre que clicar nela Pense nessas caixas
como botões e diga que você está tendo um podcast em
que está reagindo a alguma coisa Sempre que você quiser que
haja uma bateria, clique no botão
da bateria e isso será
gravado em seu podcast Já temos vários
sons aqui. Vamos experimentar alguns. Acabei de entrar na categoria de
bateria. Podemos fazer alguns ruídos da natureza. Você pode ver como eu também posso
empilhá-los e criar aquele efeito
sonoro cinematográfico perfeito para o meu vídeo Também há filmes slash TV. Essas eram suas categorias. Você também pode adicionar uma nova linha e nem todas elas
têm algo nelas. Por exemplo, o Movie Slash TV
não tem nada aqui. O que você pode fazer é
clicar neles e gerar um. Digamos que eu queira criar
um em que as pessoas digam vaia. Digamos que uma multidão diga “
boom” na satisfação. Depois de fazer isso, eu
poderia dar um nome a ele. Vamos chamar isso de boo. Recebemos várias amostras. Então eu poderia adicionar
qualquer um desses que eu goste para preencher
esse espaço vazio. Vamos fazer o número três. Agora você pode ver que está
Bo, esse botão vazio. Você pode salvar a predefinição,
compartilhá-la com alguém também
pode atribuir um dispositivo
aqui se tiver um teclado ou algo em que possa
pressionar as teclas essencialmente Você pode conceder a permissão e depois
conectá-la ao seu computador. Em vez de pressioná-los com o
mouse ou o cursor, você pode clicar
nas teclas de um teclado ou dispositivo
diferente. Você também pode
criar predefinições. No momento, esses
são os padrões. Mas você pode gerar
suas próprias predefinições se houver certos ruídos necessários todas
as vezes Por exemplo,
digamos que eu queira trabalhar com muitos ruídos singulares como alguém dizendo alguma coisa Eu poderia começar a fazer isso. Basta ir até minha
predefinição, nova predefinição, vamos chamá-la de singular
ou apenas singular, salvar a predefinição
e você
receberá todas receberá Clique em qualquer um deles e
comece a preenchê-los. Um homem dizendo, Ei, Oi. Oi. Oi. Oi. Oi. Temos quatro gerações. Escolha o que
é mais preciso. Se não encontrou o que
você estava procurando, basta clicar
em Gerar novamente. Acho que vou adicionar Ei. Oi. Oi. Essa. Você pode ver que
há três versões,
e tudo bem, porque eu
poderia simplesmente reduzi-las. Talvez aqui
façamos uma mulher ofegante. Então aqui eu vou fazer
talvez um acidente de carro. Chame isso de acidente. Vamos adicionar esse
acidente de carro e o trânsito, talvez. Ainda estou no número três, então posso substituí-lo se
encontrar algo melhor. Parece mais uma
explosão, mas está tudo bem. E então, número quatro,
podemos tocar sirenes. Talvez carro da polícia, sirenes. Então aí está o carro da polícia. Vamos fazer uma última para buzinas de
trânsito ou buzinas. Buzina de trânsito. Então, talvez o primeiro. Então, temos todos esses sons, e digamos que eu queira
gerar uma cena de acidente de carro. Tudo o que preciso fazer é
pressionar os botões em determinados momentos e criar
aquele áudio perfeito. Então, talvez comecemos com trânsito, acidente de
carro, suspiro de mulher,
isso e depois olá. Oi. Oi. Então esse foi um exemplo, mas você pode simplesmente
brincar com isso. Você pode fazer. É
assim que funciona. Então, quando você tiver
algo com o qual esteja satisfeito, você pode até mesmo
repeti-lo. Ativar o loop É assim que funciona. Esse era o volume,
se você quiser
brincar com ele. Também temos o modo de
edição se você
quiser editar seu som. Estou apenas clicando
no homem dizendo:
Ei, e eu poderia mudar meu
prompt e substituí-lo. Se precisar, você pode adicionar
mais linhas aqui embaixo e preenchê-las com o
que for necessário para o seu projeto. Então aqui em cima temos
o botão play. Temos o botão de parar ou simplesmente limpamos o
que está aqui. No momento, isso não está salvo, então você pode simplesmente
salvá-lo em sua predefinição Se você rolar para baixo,
há
muitas explicações sobre
como isso funciona. Também temos várias
mesas de som para você experimentar. Vamos experimentar o Goofy of, por exemplo, e agora temos várias
vozes para Vá para apertar o loop e, em seguida, abaixe o áudio e comece a
preenchê-lo. O que foi esse barulho? Foi bom, então é
assim que funciona. Você está apenas pressionando vários botões para criar
seu efeito sonoro. Vamos voltar aqui e fechar isso e depois
voltar para gerar. Esse era o painel de
efeitos sonoros. É muito
trabalhoso e você realmente tem muita flexibilidade na forma como seus efeitos sonoros soam. Agora, se você não está familiarizado com
o uso desses
efeitos, basicamente, se você tem um vídeo
e quer
enfatizar uma determinada
ação ou determinado diálogo, você pode adicionar os efeitos sonoros. Por exemplo, se houver um
carro passando em seu vídeo, você pode pedir 11 voltas para fazer som desejado,
para não precisar ficar muito perto um carro e gravar esse som
com seu próprio microfone Também é muito útil
se você fizer algum jogo ou esboço, pois economiza tempo por não ter que gravar efeitos
sonoros do zero, o que pode levar muito tempo Na maioria das vezes, é
bastante preciso se você perceber que não está obtendo
o som que deseja. Experimente acessar a guia Explorar, pesquisar algo semelhante e simplesmente
alterá-lo de acordo com sua preferência Agora vamos passar
para o isolador de voz, que é a última ferramenta
na categoria playground
10. Isolador de voz: O isolador de voz é outra
ferramenta simples em 11 laboratórios
e, essencialmente, o que ele
faz é remover o ruído de fundo do áudio e
isolar
sua Então, para testar isso, vamos
fazer um diretamente no microfone, e eu já gravei um áudio em que estou falando
ao lado do AC. Portanto, há algum ruído
no fundo e veremos o
quão bem ele funciona. Essa é a interface quando você acessa essa
ferramenta pela primeira vez aqui. A única coisa que você pode fazer
aqui é enviar um áudio ou gravar ao vivo no seu
computador. Então, vamos fazer um que eu esteja apenas gravando
meu áudio com vocês. Eu tenho um microfone comigo, mas vou manter uma
distância do próprio microfone
e depois compararemos. Primeiro, na verdade, vamos
fazer uma
em que eu esteja falando diretamente a uma boa distância e depois
voltaremos e compararemos. Esse é o meu áudio de 17 segundos. Acabei de ler algo em um
pedaço de papel e vamos ouvir
como soa sem nenhum
tipo de isolamento. Encontre uma irmã que ainda mora em seu pequeno apartamento
acima de uma mercearia. O apartamento está cheio de pessoas, amigos que fugiram da cidade
e agora estão muito cansados Ninguém tem apetite por comida. OK. O que você pode fazer é
excluir esse registro novamente ou simplesmente clicar
em Isolar voz Eles encontram uma irmã que
ainda mora em seu pequeno apartamento
acima de uma mercearia. O apartamento está cheio de pessoas, amigos que fugiram da cidade
e agora estão muito cansados Então isso foi comigo falando em um microfone a uma boa distância. Vamos escolher seu cenário de
gravação ideal. Mas e se eu estivesse
ao lado de um ambiente barulhento? Talvez haja um ventilador ligado e haja muito ruído
branco ao meu redor. Então é isso que
vou fazer a seguir, e então podemos comparar o
quão bem isso funciona. Acabei de gravar
um áudio em que tenho um ventilador em segundo plano. Eles encontram uma irmã que
ainda mora em seu pequeno apartamento
acima de uma mercearia. O apartamento está cheio de pessoas, amigos que fugiram da cidade
e agora estão muito cansados Ninguém tem apetite
por nenhum alimento. Então, é muito sutil
em segundo plano, mas se eu quiser fazer
isso profissionalmente,
essa sutileza também é do que
eu quero me livrar Eu só quero minha voz isolada, então vamos ver
como isso funciona. Eles encontram uma irmã que
ainda mora em seu pequeno apartamento
acima de uma mercearia. O apartamento está cheio de pessoas, amigos que fugiram da cidade e agora estão muito cansados Então, observe como ele removeu
completamente
o ruído de fundo. Vou jogar o original
apenas para referência. Eles encontram uma irmã
e depois essa. Eles descobrem que uma irmã ainda
durou apenas 15 segundos, mas você também pode fazer isso
para áudios mais longos e é muito útil quando você não tem um microfone
profissional, talvez esteja gravando
em seu Há algumas coisas na parte de trás e você pode
baixá-las aqui. Isso é tudo que você pode fazer
com o isolador de voz. Você pode isolar sua voz. Na próxima lição,
vamos passar para a seção de produtos
da ElevenLabs Também há muitas
coisas legais lá, e há muito mais em profundidade em comparação com
o que estamos aqui. Espero que vocês estejam
acompanhando e tentando imitar as demonstrações
que eu estava fazendo
nas aulas, porque nos
próximos meses, as coisas ficarão um
pouco mais avançadas
. Fique à vontade para pausar ou consultar aulas mais antigas, porque essencialmente, o que
esses
produtos fazem é combinar várias dessas ferramentas de
playground e oferecer uma as demonstrações
que eu estava fazendo
nas aulas, porque nos
próximos meses,
as coisas ficarão um
pouco mais avançadas
. Fique à vontade para pausar ou consultar
as
aulas mais antigas, porque,
essencialmente, o que
esses
produtos fazem é combinar várias dessas ferramentas de
playground e oferecer uma
opção para
criar áudios mais complexos Vamos começar com nosso primeiro estúdio de produtos.
11. Estúdio parte 1: Então, o estúdio permite que você crie
algo do zero. E imediatamente, você
pode ver aqui em cima que
temos algumas predefinições a seguir, como começar do zero, ou seja, você iniciando
um áudio que poderia funcionar qualquer forma, audiolivro Portanto, ele terá ferramentas
projetadas para áudio de audiolivros. Temos podcasts e, em seguida,
podemos simplesmente importar do URL. Pode acessar o estúdio
a partir da categoria
de produto aqui. Essas são as opções que podem ajudar você
a começar imediatamente. Você pode pesquisar seus
projetos aqui. No momento, eu não
tenho nada, então não há resultados. Mas você pode ver que existem
alguns guias aqui se
quiser aprender mais sobre efeitos sonoros
no desenvolvimento de jogos, dublagem de trocadores de
voz
e todas Primeiro, vamos começar
pela primeira opção. Comece do zero.
Eu clico nisso, acho que você viu que ele
fez um projeto sem título Deixe-me
voltar e te mostrar. Este é meu primeiro projeto e eles vão se
alinhar aqui. Você pode abrir o projeto, duplicá-lo ou excluí-lo
e, ao clicar nele,
você entra no projeto É assim que você pode
criar áudios do zero e decidir se
deseja adicionar efeitos sonoros,
transformá-lo em um audiolivro,
em um podcast, uma narração, o que
quiser, Primeiro, vamos
dar um nome ao nosso projeto. Vou chamar isso de minha história assustadora. Pode começar a digitar
aqui mesmo. Então, se não quisermos
digitar aqui, há algumas coisas
que podemos adicionar como fazer o upload de um PDF Se você tem um ensaio
que deseja narrar, você tem um conto
escrito na forma de um PDF É aqui que você os carrega. Podemos adicionar um vídeo fazer upload de um vídeo para adicionar também
as dublagens Você pode adicionar um URL. Essas são algumas predefinições
para você começar,
e pronto Vamos experimentar as
coisas aqui e depois veremos outras formas
de adicionar uma entrada para isso. Aqui, você pode transformar seu texto em títulos
diferentes
ou apenas em seu corpo de texto normal Se você tiver um parágrafo,
poderá usá-lo e mostrar um histórico
do que você fez. Você tem alguns botões de desfazer. Temos uma pausa. Então, quando você adiciona uma pausa, o alto-falante não
vai falar. Por exemplo, se você
tiver dois parágrafos, você deseja quebrar
entre os parágrafos Você pode adicionar efeitos sonoros. Pode até mesmo alterar a
pronúncia da nossa voz, que agora é George. Podemos dirigir a fala
com nossa própria voz, depois bloqueá-la
e, finalmente, obter
algumas informações sobre o que estamos fazendo aqui. No lado direito,
escolheremos nossas vozes. Se você clicar em Selecionar voz, essa é a mesma biblioteca que
vimos nas lições anteriores.
Você pode procurá-lo. Acesse seus áudios salvos, use vozes profissionais
apenas as padrão, as que você usou recentemente e até mesmo suas próprias vozes Vamos escolher
alguém que talvez sussurre. A luz da lua dança
pela sala. Estou aqui para ajudá-lo
a mergulhar em um sono profundo e suave. Você está seguro. Então, eu quero fazer uma história assustadora. Então, eu quero uma voz que
possa sussurrar. Então, os títulos ASMR
são ótimos para isso. Vou apenas
clicar no microfone ASMR. Vamos adicioná-lo às nossas vozes para que possamos acessá-lo facilmente mais tarde
e, em seguida, basta clicar em Aplicar. Portanto, há essa
barra de ferramentas ao lado dela, que é o que vimos anteriormente em Eu acredito que uma
das outras ferramentas Portanto, você ainda tem
muito controle sobre como
as vozes
se aplicam ao seu texto. Primeiro, vamos escrever
algo muito básico para nossa história de terror e ver como
podemos fazer com que Mike a
dê vida a ela Você pode ver que,
logo que começo a escrever
, estou atribuindo Mike ao
que estou escrevendo aqui Então eu poderia alternar
entre George, talvez outras sete pessoas ou apenas uma pessoa
dizendo tudo isso. Então, aqui está um pequeno texto
que acabei de escrever. Tem apenas três frases. Aqui mesmo, eu posso
mudar o layout do texto. Por exemplo, eu poderia
fazer um deles maior, e talvez se eu tivesse
dois parágrafos, então vamos escrever mais um Seguindo-o estava uma figura longa e
esbelta que permanecia
nas sombras que buscavam
sua alma, que ele
amou uma vez estava uma figura longa e
esbelta que permanecia
nas sombras sua alma, que ele Então, outro parágrafo,
e então você pode ver como eu posso mudar
a aparência dos parágrafos, e isso pode mostrar que essa é uma
abertura muito importante e então talvez eu atribua um comando a ela e faça
um monte de outras coisas Essa é uma das coisas. Se você pressionar Inter e pressionar
uma barra para frente, poderá realmente
adicionar os comandos Em vez de partir daqui, você também pode usar a
barra para frente. Vamos fazer uma pausa. Por 1 segundo, Mike
vai parar de ler. Você também pode clicar nele
e torná-lo mais. Eu faço 1 segundo. Pode fazer a mesma coisa entre as palavras, barra
para frente Vamos fazer outra
pausa e eu vou fazer essa de 3 segundos,
talvez 1 segundo. 0,1 é muito pouco. Vamos tentar 1.6. Então, também podemos fazer outras coisas, como
barra frontal, efeito sonoro Vamos ver onde podemos
adicionar um efeito sonoro aqui. Podemos fazer logo antes, em
um dia chuvoso, o efeito sonoro, pressionar Enter e
clicar em pré-visualizar Chuva vamos fazer com que a duração 1,4 segundos gere
a É a mesma coisa que
fizemos no gerador de
efeitos sonoros. Você obtém suas visualizações, clica em
Auto se não tiver certeza e vê qual
delas você mais gosta Então, nada disso está chovendo. Ainda está chovendo em uma estrada de pedra com trovões ao
fundo Algo mais para 11 laboratórios
trabalharem. Eu me regenero Vamos descrever o som, e vou aumentar um pouco a
duração de, tipo, uma frase. Então, eu gosto mais da prévia 2, aperte um flive e pronto Então, para toda essa frase, haverá
esse efeito sonoro de chuva. Se você mudar de ideia sobre o efeito sonoro
ser muito longo, basta clicar nele e
você poderá silenciá-lo depois de um tempo. Então, vou abaixá-lo um
pouco e rasgá-lo. Sim. Então, isso é muito melhor. Eu quero que seja um ruído de
fundo, não tanto como o foco principal. Então esse é o nosso efeito sonoro. Também podemos adicionar o
editor de pronúncia se quisermos adicionar talvez uma palavra estrangeira ou algo que queiramos
garantir que seja pronunciado corretamente. Vou
encontrar um nome exclusivo que precisa ser pronunciado. Nome exclusivo com
pronúncia correta, algo aleatório. Eu quero testar a
precisão do ElevenLabs. Vamos pegar esse nome. Talvez N fosse bom. Talvez 11 laboratórios
leiam isso como CN, mas é aí que podemos
resolver o problema com esse cara. Can olha para trás e
segura a respiração. Ele sabe o que vem a seguir. OK. Então essa é a minha
história. Muito curto. Vamos fazer com que
Mike comece a lê-los. Então, ele precisa ler tudo. 39 segundos. Podemos mudar a voz mais tarde. final da estrada, em um dia chuvoso, havia um homem solitário
voltando do trabalho Seus olhos estavam vermelhos por não dormir, sua pele afundada pela falta
de comida Ele entra e sai do sono, mas continua andando
com seu corpo pesado, pois sabe o que
acontecerá quando parar Seguindo-o estava uma figura
longa e esbelta permanecia nas sombras que buscavam sua alma, que ele Kian olha para trás e
segura a respiração. Ele sabe o que vem a seguir. Então, para mim, ele lê a
chave e escreve, mas se, no seu caso, não
funcionou, você tem uma
palavra específica ou um nome diferente, e a ElevenLabs simplesmente
não está entendendo Você pode usar o editor de pronúncias.
Isso é o que parece. Você pode conectar um dicionário que você
enviou ou criou. E então você atribui regras
a esse dicionário. Por exemplo, toda vez
que você vê essa letra, ela precisa ser
pronunciada dessa maneira. Você pode encontrar seus
dicionários aqui, você pode adicionar regras Adicione uma nova regra, insira a palavra, o Alias e, em seguida, a saída Então, se você não quiser usar esse dicionário nunca mais,
basta desconectá-lo Você cria uma nova
aqui e essas são
as vozes padrão com as quais você pode
obter uma prévia. Se você realmente gosta de usar isso para palavras estrangeiras ou palavras
difíceis de pronunciar, eu recomendo
conferir o tutorial do ElevenLabs sobre como
fazer isso corretamente Você pode gerenciar dicionários de
pronúncia
com programação Você precisa instalar o SDK por meio do seu terminal
usando a linguagem Linux Se você planeja fazer
isso da maneira certa, definitivamente dê uma olhada. Pode encontrá-lo nos
documentos do ElevenLabs. Normalmente, ele capta as
pronúncias. Por exemplo, aqui não
dizia Pode ler Ken, deveria
funcionar
na maior parte do tempo. Vamos continuar e regenerar novamente agora que
adicionamos mais
efeitos sonoros e esse nome Mais uma vez, está nos dando regeneração
gratuita para que tenhamos
certeza de nosso texto antes de realmente usar nossos
créditos com Mike final da estrada, em um dia chuvoso, era um homem solitário
voltando do trabalho Seus olhos estavam vermelhos por não dormir, sua pele afundada pela falta
de comida Ele entra e sai do sono, mas continua andando
com seu corpo pesado, pois sabe o que
acontecerá quando parar Então essa foi a minha regeneração. Aqui em cima, também temos
fala direta com sua voz. Por exemplo, se estiver lendo
uma frase de uma forma
realmente monótona, essa ferramenta ajudará
você a usar o recurso de voz para
voz no ElevenLabs, algo que
examinamos anteriormente, e eu posso orientar 11 laboratórios sobre como ler essa frase
da maneira que eu queria Foi assim que
podemos usar as ferramentas, maioria delas para essa história assustadora
em particular Na próxima parte desta lição, continuaremos com
as ferramentas aqui e veremos como podemos aplicar
isso a um documento, vídeo, URL e expandir nossos aplicativos. Nos vemos na
próxima parte desta lição.
12. Estúdio parte 2: Agora vamos continuar
examinando as ferramentas aqui em cima. Então, anteriormente, fizemos
esse pequeno conto. Fizemos com que os mouses ASMR o lessem, adicionamos alguns efeitos sonoros
e algumas pausas Mas você pode realmente levar
isso um passo adiante. Então, digamos que você tenha essa frase
e simplesmente não goste quão monótona ou exagerada a
voz a O que você pode fazer é
lê-lo da maneira que quiser e depois fazer com que a voz
copie exatamente o estilo. Você pode fazer isso
aqui com fala
direta com sua voz. Agora, acabei de destacar esta
frase para referência, mas você pode fazer a coisa toda ou apenas uma palavra,
o que quiser Depois de selecionar isso, basta clicar nele e
você pode vê-lo aqui. O que você pode fazer é enviar um áudio ou gravar
sua voz diretamente. Basicamente, vamos primeiro ouvir
como Mike está lendo isso e depois faremos nossa versão. Vamos regenerar a seleção caso haja
algo que tenhamos perdido final da estrada, em um dia chuvoso, era um homem solitário
voltando do trabalho Seus olhos estavam vermelhos por não dormir, sua pele afundada pela falta
de comida Ele entra e sai do sono
, mas continua andando com seu corpo pesado, pois
sabe o que
acontecerá quando parar Era uma figura longa e esbelta permanecia nas sombras que buscavam sua alma, que ele Can olha para trás e
segura a respiração. Ele sabe o que vem a seguir. Isso é o que temos
até agora e, curiosamente, você leu isso como SN, mas podemos simplesmente
direcioná-lo de uma maneira diferente Por exemplo, aqui, eu queria fazer uma pausa entre
dizer persistente O que vou fazer é
cobrir toda essa seção, ir até aqui e começar a ler isso da
maneira que eu quiser. Escolha seu microfone
e comece a clicar em Iniciar. Seguindo-o estava uma figura
longa e esbelta permanecia nas sombras que buscavam sua alma, que ele Kian olha para trás e
segura a respiração. Ele sabe o que vem a seguir. Quando terminar, ele
vai aparecer assim, e você pode gerá-lo ou simplesmente começar de novo para
uma gravação diferente. Vou clicar em Gerar e agora podemos comparar
o que estamos recebendo aqui. Então, se você continuar a segui-lo, havia
uma figura longa e esbelta
persistindo nas sombras
que buscavam sua alma,
que ele amou uma
vez uma figura longa e esbelta persistindo nas sombras
que buscavam sua alma, que ele Ken olha para trás e
segura a respiração. Ele sabe o que vem a seguir. Agora que ela foi aplicada, vamos ouvir como essa nova
versão soa. Você pode ver ao lado aqui, temos essa conversão, e você pode simplesmente clicar nela para ver qual parte você converteu. Seguindo-o estava uma figura
longa e esbelta permanecia nas sombras que buscavam sua alma, que ele Ken olha para trás e
segura a respiração. Ele sabe o que vem a seguir. E lá vamos nós.
Conseguimos, em primeiro lugar, fazer que essa frase fosse lida muito lentamente com a
pausa que queríamos Além disso, fizemos Mike ler isso
como Kan e não vendo, que é o que ele
estava lendo antes. Você pode realmente
expandir isso com algumas pronúncias, se preferir usar isso e isso, especialmente para idiomas
estrangeiros, será útil A próxima ferramenta permite
bloquear parágrafos para
evitar alterações Por exemplo, eu não
quero que nada seja feito neste parágrafo principal por
acidente, porque fazer
isso vai ser um
pouco chato Tudo o que você realmente
precisa fazer é destacar esse texto e clicar no cadeado. Agora você pode ver um ícone de cadeado no lado esquerdo, só
isso. Você pode desbloqueá-lo pegando-o novamente e
clicando no mesmo ícone Este aqui
envia um relatório. Não há nada demais que você
possa fazer lá. Você tem suas vozes,
altere suas configurações se precisar sempre que
fizer uma alteração, mas não se esqueça
de clicar em Gerar. Você também pode gerar uma seção apenas agarrando-a e batendo Use a barra aqui embaixo
para reproduzir uma seleção, alterar a velocidade, pular, clicar em reproduzir sua
pausa e ver quantos minutos ou
segundos está seu áudio Também pode aumentar e diminuir o zoom. Na verdade, há uma linha do tempo que pressionará um pouco o
Zoom. Neste
botão, primeiro clique em Expandir Você pode ver que, quando começa, é aqui que o
alcance começa a tocar, mas eu poderia simplesmente
pegar isso e fazer com que tocasse em um horário diferente. Você pode ampliar e reduzir a linha
do tempo desta forma. Eu acredito nisso
, então aí está a pausa. Este é o som para. Eu poderia simplesmente
pegá-lo em algum lugar
assim e fazer minhas
alterações dessa forma. Isso foi com seu recurso clássico de conversão de
texto em fala. Mas e se você quisesse
fazer isso a partir de um documento? O que vou fazer agora
é copiar isso e abrir um documento de texto,
nada muito sofisticado Basta colar aqui, remover as diferentes palavras e
deixar o script. Depois de ter isso,
vou salvá-lo como um ponto TxD. Chame isso de meu roteiro. Depois, vou excluir tudo isso para começar
com um documento. Clique aqui e faça o upload do
seu documento e veja como a ElevenLabs lida com Podemos ver que podemos carregar um PDF, um EPAP, THD, HDL
ou até mesmo Há muitas
opções. Lá vamos nós. Agora eu tenho meu script
trazido de um documento. Se você estiver fazendo um audiolivro, isso será muito útil porque você não precisa
copiar e colar Então, quando tivermos, vamos
tentar uma voz diferente aqui. Peça para Dorth lê-lo.
Agora o nome mudou, clique em gerar, e
podemos vê-lo aqui embaixo final da estrada, em um dia chuvoso, havia um homem solitário
voltando do trabalho Seus olhos estavam vermelhos por não dormir, sua pele afundada pela falta
de comida Ele entra e sai do sono , mas continua andando
com seu corpo pesado Seguindo-o estava uma figura longa e
esbelta que permanecia
nas sombras que buscavam sua
alma, que ele Kian olha para trás e
segura a respiração. OK. Então, desse jeito, eu importei o texto e ele
começou a lê-lo. Mas e se você quisesse
adicionar algo a um vídeo? Eu tenho esse vídeo que
fiz com o Runway, que é outra ferramenta de IA na
qual você pode
gerar vídeos, e há uma narração
atualmente disponível, mas eu quero
experimentá-lo Há muitas
paisagens lá dentro. Há muitas cenas e é uma oportunidade perfeita para combinarmos
efeitos sonoros,
pausas, vozes e tudo isso em
um único Então, o que vou
fazer é enviar esse vídeo e
voltarei para que possamos continuar. Aí está meu vídeo enviado. Você pode visualizá-lo. Tem um
minuto e 10 segundos de duração. Mais uma vez, temos
um layout semelhante em termos de vozes
e ferramentas aqui. Se eu tocar isso, você não vai ouvir nada porque não
há áudio. Mas o que podemos fazer é
ir até o começo. Vamos abrir esse cara aqui e trazer o vídeo
no começo. Acho que deveria ser mais curto. Sim, na verdade tem
53 segundos de duração. Então, o que eu vou
fazer é ter essa peça e escrever
um roteiro para ela. Vamos começar com uma frase. Então essa é a nossa primeira frase e com base no tempo que
levaria para se tornar um áudio, você pode ver a
estimativa aqui. Isso vai levar
cerca de 5 segundos. Se eu tivesse jogado, isso
geraria. Lá estava ela, a única sobrevivente
caminhando pelas ruínas. Isso é só um exemplo.
Obviamente, temos que mudar a voz e fazer alguns
outros ajustes. Então, vamos
para nossa próxima cena, talvez em algum lugar por aqui. Eu escrevi meu roteiro aqui. Vou adicionar algumas pausas entre
cada uma apenas para garantir que cada frase seja
dedicada a uma cena Isso aqui vai ser
para a primeira cena. Então, aqui,
precisamos de uma pausa. Adicione uma pausa de 1 segundo. Em seguida, adicionarei uma pausa
após cada frase. OK. E então podemos adicionar
alguns efeitos sonoros. Então aqui eu acho que alguns corvos
na parte de trás, um pouco de
vento seria bom Vamos clicar aqui e depois ir para a prévia. Então, profissionais em segundo plano. Vamos tentar mantê-lo durante toda
a parte em que
ela está neste local. Então, esses dois clipes,
quando terminarmos, podemos gerar uma prévia e decidir qual deles
funcionaria para essa cena OK. Agora você pode ver que
ele abrange os dois. A próxima parte ainda é sobre
ela estar nesta floresta, então podemos passar
para a próxima onde ela ou ela está
fora da floresta. É quando ela
realmente entra. Então, o que podemos fazer com
os dois, na verdade,
é destacar toda essa seção e adicionar outro efeito sonoro. Então, vamos tocar
sons da floresta de Erie com “não quero
fazer corvos novamente”, talvez com vento Vou fazer mais dez segundos
completos, e acho que o
primeiro é o melhor. Eu adicionei as pausas e os efeitos
sonoros que eu queria. Só para explicar, tivemos o primeiro com os
corvos ao fundo Há uma pausa de 1 segundo, a frase, outro segundo Eu adicionei um efeito
sonoro de passos lentos aqui porque estamos vendo
que algo a
segue e pronto Agora, em termos de voz, eu quero escolher algo
um pouco diferente. Vamos tentar
pesquisar um thriller, talvez. Seja tão sujo. Sem Atmos Segun Mom Ignorovch. Deus lhe deu
Vamos fazer uma refeição profunda, algo que
combinaria com esse visual de terror. Ei, venha aqui.
Eu vejo esse olhar. Nossa desconfiança em mudar
todas as coisas é doce. Mudar todas as coisas é fofo. Ok, acho que gosto do
Josh agora. Então, o que vamos fazer é
pegar tudo isso e escolher Josh Agora você pode ver o
nome aparecendo. Então ela foi para a floresta em
busca de sinais de vida. Ela encontrou apenas lembranças disso. Ok, então eu não vou jogar com
você a coisa toda. Mas, essencialmente,
é assim que funcionaria. Você tem seu vídeo aqui. A linha do tempo
abaixo realmente ajuda
você a descobrir que tipo
de efeitos sonoros você deseja, que tipo de pausas e
quanto tempo as pausas devem durar E, no geral, você pode criar efeitos
muito bons
com essa tecnologia. Então, uma coisa que as pessoas gostam de
fazer quando têm
um vídeo como
esse, esse vídeo estará disponível para vocês usarem, a propósito. Você também pode colocar, tipo,
um vlog ou algo assim. Apenas se concentre em obter os efeitos
sonoros corretos e, em
seguida, adicione um pouco de música,
talvez ou uma narração Isso é só porque dessa forma você pode brincar
com os volumes. Ouça sem nenhuma narração e apenas ouça os efeitos sonoros Eles aparecem
nos momentos certos? Caso contrário, você pode
voltar e talvez selecionar um horário diferente ou simplesmente
movê-los como fizemos antes. O que você também pode
fazer é fazer isso com a exportação de efeitos sonoros,
trazê-los novamente para a narração ou adicionar
outro conjunto de efeitos sonoros Como essa é uma ferramenta on-line quando você adiciona muitas camadas
sobrepostas, ela pode falhar, o que é
muito normal Se isso acontecer com
você, não entre em pânico. Mas uma forma de mitigar isso é exportá-lo e
depois trazê-lo de volta Dessa forma, as primeiras alterações feitas
serão seguras e permanentes porque você
exportou o vídeo e , em seguida, poderá criá-lo em
quantas camadas quiser Isso é tudo para
a ferramenta de estúdio, bem simples Há muita coisa que
você pode fazer com isso
e, quando voltarmos,
como
mencionamos, podemos ver nosso projeto, voltar a ele e fazer alterações
adicionais. Na próxima lição,
aprenderemos como
gerar um audiolivro
usando o ElevenLabs Essa é outra
ferramenta simples. Basicamente,
basta clicar em carregar, escolher sua voz
e pronto. O próximo será um podcast, que se aprofunda um
pouco mais, mas veremos
tudo isso nas
próximas aulas.
13. Atualizações do estúdio: Agora, já vimos como
o recurso de estúdio funciona no ElevenLabs, mas desde então, houve
algumas atualizações e
alguns novos recursos
que podem realmente transformar a maneira como
você usa o Então, ainda estamos no estúdio, e normalmente seria apenas uma caixa onde você digita
algo para voz. Mas o ElevenLabs agora permite que
você crie vídeos, músicas e crie legendas automáticas, como você pode ver, esses são apenas alguns exemplos
do que você Então, um vídeo sem rosto com
legendas, dublagem,
narração, conversão de vídeo em música e geração de Seus projetos estão
aqui embaixo. Se você já fez um,
eles
serão listados abaixo, e você pode até mesmo
filtrá-los usando essas tags. Ao subir até aqui, você
pode entrar imediatamente e dizer o que deseja criar. Você pode pensar no estúdio como
uma plataforma multifuncional. Então, em vez de
passar por cada uma delas, talvez combinando duas coisas, você pode simplesmente
ir ao Studio e obter uma combinação de todos esses recursos. Você pode anexar algo como referência do
seu computador
clicando aqui ou fazer upload de
uma pasta inteira usando isso. Em vez de criar
um vídeo aqui, vou criar um novo projeto em branco e
temos duas opções aqui. O primeiro é um projeto de vídeo e
o segundo é um projeto de áudio. O projeto de áudio é o que
vimos nas duas lições
anteriores. Mas o projeto de vídeo
é mais uma coisa. Então, só para revisar o projeto de
áudio, vou clicar nele. E a ideia é
praticamente a mesma. Então, estamos no Audio Project, e os principais recursos são
praticamente os mesmos. Então você tem seu pequeno
espaço de trabalho no centro. Podemos dividi-lo em capítulos. Você pode pensar nisso como guias. Temos nossa biblioteca de voz, alguns efeitos sonoros que incorporamos aqui, música. Esse é outro novo recurso
que o ElevenLabs tem
e, é claro, coisas que você enviou para o seu projeto Pode ser uma referência
para um personagem. Pode ser uma amostra de áudio,
qualquer coisa que você quiser. Eles serão listados
aqui para você. Agora, você pode fazer o upload para
o projeto desta forma. Você pode gravar
diretamente no projeto ou importar arquivos. Então, você pode usar
todas as três opções. E então, é claro,
temos a guia de edição onde todos os
controles deslizantes familiares estarão aqui Podemos digitar coisas descrevendo basicamente o projeto
final que queremos. Então, pode ser uma
história curta sobre XYZ, e você simplesmente digita aqui, e então todos esses
elementos se juntam Pode ser uma narração
para um vídeo do YouTube. Você pode enviar o vídeo
do YouTube como referência e obter a
ajuda da ElevenLabs para criar uma voz de IA para você que
corresponda à atmosfera desse vídeo Vamos fazer um exercício
muito simples aqui, onde
vou digitar, tipo, um
instante de um vídeo de terror em que nosso personagem está um
pouco assustado. Haverá
alguns efeitos sonoros. Podemos ouvir algumas músicas aqui, obter uma boa voz adequada e, é
claro, adicionar pausas
e etiquetas de áudio. Agora, aqui
temos nossos modelos. Também temos três. Então, vou usar isso
por causa das tags de áudio, e então podemos
contornar o tipo. Vou deixar o meu como texto, e então você também pode adicionar
um pouco de voz. Então, vamos
explorar a biblioteca, algo que
funcionará bem com,
tipo, um personagem assustado. No teatro da vida, somos todos atores compartilhando o
mesmo. Apenas confie em si mesmo. Então você.
Sempre acontece que estamos liberados,
vamos usar as vozes padrão
e procurar as que estão assustadas A vida não é sobre
encontrar a si mesmo. Os anos ensinam
muito, qual é o dia? Não é tão importante
saber tudo quanto
apreciar que nunca me machuquei com nada
que eu não disse. Nós fazemos nossas próprias fortunas
e as chamamos de gordas. Deus te deu um rosto,
e você faz a si mesmo. A gratidão é
tão rica quanto a reclamação. Então, eu vou com
Eric para este caso. Vamos apenas
clicar nesse nome. Haverá uma marca de seleção e poderíamos simplesmente
voltar para Editar Então, agora podemos ver
Eric como nossa voz. Temos o texto da versão três
e, você sabe, todo o
resto está bom até agora. Agora vou começar a
digitar algo muito simples. Então, talvez eu ache que
ouvi alguma coisa. Parece que
algo está chegando. Podemos adicionar algum texto
de áudio aqui. Então, mas respiração pesada. Oh, não, não há tempo. Agora, aqui estou usando
os três pontos, mas se você estiver usando outro
modelo como o V two, você pode usar o áudio
ou as quebras de fala, na verdade Mas se você quiser usar o V três para algo
mais natural, você pode simplesmente, você sabe,
fazer a mesma coisa aqui. Então essa é a nossa primeira linha, e aqui vou
colocar algumas músicas de Erie. Então, temos algumas músicas aqui, mas também podemos
gerar nossa música. Então, vou explicar isso mais detalhadamente nos capítulos posteriores Mas, por enquanto, basta descrever
a música que você deseja. Então, talvez a música de
fundo de suspense de Erie. E vou deixar
com as configurações atuais. Estamos recebendo três
versões, o que é muito, mas talvez você possa
alterá-la para uma, que ela se
concentre mais na primeira. Escolha seu modelo aqui mesmo. E depois a duração, talvez você possa fazer cerca de 5
segundos ou algo assim. Se você quiser um zinger lá, pode
haver, você sabe, alguém falando, e então
podemos ajustá-lo ainda mais Então, agora, quando eu termino minha pesquisa, podemos ver as três
gerações que foram feitas. Vou apenas adicionar
o primeiro. Está importando a música. Só temos algo
para o plano de fundo e temos esse pequeno cronograma Então, talvez eu
comece aqui, estenda, mude minha música se necessário e construa esse
áudio do zero. Acho que ouvi alguma coisa. Parece que
algo está chegando. Por aqui, quero que ele
diga outra coisa. Então, vamos, tipo, ir
para a próxima linha. Nós pensamos, Oh, o que é isso? Em seguida, adicionaremos um efeito
sonoro aqui, que é outro recurso. Eu vou fazer, tipo,
sussurrar no mato Eu vou fazer
algo muito curto. Talvez uns 5 segundos. Então, vou adicionar isso aqui. Importando, temos
outro elemento agora, e você pode simplesmente
construir sobre isso Acho que ouvi alguma coisa.
Parece que algo está chegando. Oh, o que é isso? Talvez um pouco mais cedo. Oh, o que é isso? Adicionando mais texto. E então digamos que é
como um gato que sai, então podemos fazer algo
como Tudo bem E então, enquanto eu estiver aqui, vou fazer gato. Podemos ver se
há alguma coisa. Vamos fazer miado de gato. Tudo bem. E aí está
nosso efeito sonoro final. Agora, eu só tenho
que limpar isso, e temos nosso primeiro projeto de estúdio
atualizado. Agora, antes de gerar isso, há algumas
coisas que você pode fazer com cada uma dessas camadas. A primeira coisa é cortar algo se houver
muito. Por exemplo, aqui, eu
não preciso de todo esse áudio, então eu poderia simplesmente diminuir
o zoom aqui e tirar o final de todo
esse áudio. Você poderia contrariar isso gerando
algo mais curto. Mas essa também é outra maneira
de cortar coisas. E outra maneira mais rápida é
pegar , você
sabe, seu segmento. Outra coisa que você pode
fazer é clicar nesse segmento de áudio e
pressionar S no teclado, e ele o dividirá. Você pode simplesmente excluir essa parte
extra com o backspace. próximo passo é
trabalhar com o volume e os efeitos de desvanecimento de
cada um desses segmentos Então, por exemplo,
tivemos o miado. Simplesmente começa do nada. Então, talvez eu pudesse fazer com que esse áudio
diminuísse e o áudio aqui também
desaparecesse Então, basicamente, ele reduzirá
o volume para zero por um longo
período de tempo. Acho que ouvi alguma coisa. Parece que
algo está chegando. Oh, o que é isso? Oh,
não, eu não posso lidar com isso. Oh, era só um gato. Eu sou boba. E por alguma razão, temos uma voz feminina aqui, então deixe-me mudar isso de volta. Você pode alterar o
áudio desse jeito. O miado do gato está um
pouco alto demais, então vamos
baixar isso e estamos prontos para Acho que ouvi alguma coisa. Parece que
algo está chegando. Oh, o que é isso? Oh,
não, eu não posso lidar com isso. Oh, era só um gato. Eu sou boba. E essa é a interface atualizada do
estúdio. Novamente, não é muito diferente
do que vimos, mas há algumas coisas
adicionais, como música e essa linha do tempo,
que temos aqui, e você pode importar
diferentes partes do ElevenLabs
para seu próximo arquivo de Aqui embaixo, temos várias
outras ferramentas de IA que
você pode utilizar. Então, talvez aprimorando o texto. Se quiser escrever
algo um pouco melhor, você pode usar o recurso de texto
aprimorado. Então, vou apenas destacar
isso. Clique aqui. Poderia fazer isso. Se
você estiver importando áudio e houver música de
fundo, você pode usar essa
opção aqui Você pode mudar a voz
com o trocador de voz. Então, talvez mude
o tom, a velocidade e tudo mais. E você também pode direcionar o
discurso com sua voz. Então, basicamente, se ele estiver
falando de uma forma estranha, eu poderia gravar minha voz
da maneira que eu quero que ele
fale, e então 11 laboratórios
continuarão Novamente, você pode exportar
facilmente com esse botão. Você pode compartilhar,
nomear seu projeto
e criar
capítulos diferentes, se necessário
14. Ferramenta de audiolivro: A próxima ferramenta que
vamos dar uma
olhada é como podemos
criar um audiolivro. Ao clicar nele, você pode enviar
imediatamente
seu conto Eu tenho um pequeno PDF para
vocês em um pacote de recursos. É um
livro infantil da Monkey Pen. Eles disponibilizam
livros infantis gratuitos para você. Você pode fazer upload de qualquer coisa com esses formatos ou até mesmo
escrever sua própria história. Então,
deixe-me mostrar de antemão a
aparência do PDF e, a partir daí, podemos entender como ElevenLabs converte
texto Então, isso aqui é
uma pequena história que eu
vou enviar.
Isso é caneta de macaco Você pode ver que
há muitos logotipos, um pequeno texto de prefácio, temos ilustrações
e tudo Então, como o ElevenLabs transforma
isso em um audiolivro? Em vez de copiar tudo isso, tudo o que você precisa fazer
é enviá-lo aqui. Depois de fazer isso, você
pode remover o documento para fazer o upload de outra coisa e escolher
imediatamente sua voz. Vá até lá. Você pode visualizá-los e ver as
diferentes categorias. Não há grandes
anos em que nossa desconfiança. Amor. A vida sem amor é
como confiar em si mesmo. Então, eu vou escolher Alice
para este, clique nele. Então, temos essa opção
para vozes atribuídas automaticamente. Essencialmente, isso vai
alternar entre os personagens. Essa história realmente não tem diálogo, então eu
não preciso fazer isso. Mas se você
quiser apenas
ligá-lo veja que
vai demorar um pouco mais. Basta clicar em Criar e você será direcionado
para esta página, que é bastante
semelhante ao estúdio. Recebemos todo o nosso texto aqui, e então você escolhe sua voz e adiciona os efeitos sonoros
conforme aprendemos antes. Essas são as coisas do prefácio, e eu poderia simplesmente
excluí-las para que a história do livro de histórias
comece imediatamente Vamos continuar e clicar em Gerar. Comande ou controle A, para que você selecione tudo, sua voz, confirme e comece a geração. Então eu gerei o áudio. A primeira coisa que você
pode fazer é,
novamente , mudar o nome e depois clicar play e ver
como soa. Olá, sou o Professor Moisture e
falarei sobre a água. Você pode chamar isso de chuva.
Você pode chamar isso de neve. Você pode chamar isso de granizo. Você pode chamar isso de granizo, mas
é água do mesmo jeito. Você já se perguntou quantos anos tem a
água ou de onde ela vem? As respostas podem te surpreender. Na próxima vez que você ver um lago
ou até mesmo um copo d'água, pense em quantos anos
essa água pode ter. Você realmente quer
saber? Eu pensei que você sabia. Você escovou
os dentes esta manhã? Bem, parte da água que você usou pode ter
caído do céu ontem. Então, como você pode ver, faz um ótimo trabalho com
a capitalização Eu não fiz isso. Veio
direto do PDF. E até mesmo a forma como a voz pronuncia essa frase,
é muito boa E a voz dela, em geral, funciona perfeitamente com
o livro infantil. Mas, novamente, assim
como na última lição, você pode adicionar pausas ou até mesmo acessar as configurações aqui para adicionar mais exagero a 37% e diminuir a Diminuímos
um pouco a fala dela e, ao
mesmo tempo, vou adicionar algumas
pausas entre essas frases Vamos fazer uma pausa aqui
e pronto. Vamos fazer outro Commander
Control A e clicar em gerar. Deixe-me realmente salvar
isso e gerar isso. Olá, sou o professor Mois Tui e
falarei sobre Você pode chamar isso de chuva.
Você pode chamar isso de neve. Você pode chamar isso de granizo.
Você pode chamar isso de granizo, mas é água do mesmo jeito Você já se perguntou
quantos anos tem
a água ou de onde ela vem? As respostas podem te surpreender. Na próxima vez que você ver um lago
ou até mesmo um copo d'água, pense em quantos anos
essa água pode ter. Você realmente quer
saber? Eu pensei que você sabia. Portanto, é bem simples, funciona da mesma forma que
as ferramentas básicas que já
aprendemos Quando terminar, você pode clicar Exportar e
publicá-lo em uma
das plataformas que você vê
aqui ou simplesmente
exportá-lo como um único arquivo ou
parágrafo separadamente, o formato de áudio
e pronto. É aqui que ele informa a quantidade de
créditos que será usada. Então, todos os seus créditos
estão aqui e sim. Novamente, você tem essa
linha do tempo aqui embaixo, aumenta e diminui o zoom, exclui partes ,
adiciona coisas a ela e pode simplesmente dar
vida às suas histórias usando essa ferramenta Vamos passar para a próxima
lição, onde veremos como
podemos criar podcasts
com o ElevenLabs
15. Podcasts: Nossa próxima ferramenta é criar
um podcast com IA. Quando você clica nele, novamente, é como o audiolivro Imediatamente, você pode
carregar seu conteúdo, importá-lo de um URL ou até mesmo usar um Se for esse o caso,
você pode selecioná-lo dessa forma e depois
colocar suas vozes. Mas vamos começar por aqui, que é onde você pode
fazer o upload do seu documento. Agora, uma coisa que
vou fazer
para os propósitos desta lição é usar o HGPT para criar
um podcast de amostra No seu caso, você
teria seu próprio arquivo. Se você escreveu um
script para seu podcast, basta salvá-lo como um
dos formatos aqui embaixo
e simplesmente fazer o upload. Mas vou
entrar no HGPT e pedir uma amostra de podcast com um apresentador e
um convidado,
onde eles discutem o clima e
como o verão é divertido Faça isso com 5 minutos de duração. Então, até temos um nome,
o que é muito legal. Nosso primeiro, o anfitrião se chama
Alex e a convidada é Maya. Vou deixar isso
gerar e
basicamente vamos copiá-lo e colá-lo
em um documento do Word
e, dessa forma, podemos
salvá-lo em um dos formatos. Vou abrir um aqui,
um novo documento, e
copiar o podcast em si. Talvez tudo isso porque,
idealmente, em sua amostra, você também tenha um monte de
informações. Aí está meu podcast. Vamos salvá-lo.
Chame-o de meu podcast, salve-o como um dotxem É salvar e
carregar. Aí está. Você pode removê-lo para
colocar em outro. A próxima coisa
que você pode fazer é escolher o formato
do seu podcast. Podcast focado com atualizações importantes, conversa
casual entre
um anfitrião e um convidado. Pedimos duas
pessoas no podcast. É isso que eu
vou fazer. Em seguida, podemos
escolher a duração. Vou usar o padrão e pressionar X quando terminar. Essas são as vozes do
nosso povo, o anfitrião. Uma única rosa pode ser meu jardim. E depois o presente. Se você passa a vida inteira
esperando a tempestade, se você entrar em alguma dessas, então deixe-me procurar
por Jessica bem rápido, você pode ver que uma de suas
tags é conversacional, e eu pedi um podcast em que duas pessoas estivessem
conversando Você também pode procurar outras pessoas que conversam e depois fazer sua
escolha a partir daí Olá e bem-vindo.
Não ao Dao Os padrões
são da ElevenLabs. Normalmente são muito bons. A natureza como uma nuvem mutável. Nós fazemos nossa própria fortuna. Mas vou ficar com os que a ElevenLabs
escolheu para Aqui embaixo, você
tem algumas configurações. Então, qual é o foco do podcast? Acho que dissemos que
estava quente. Vamos adicionar outro destaque
no verão. É seguro. Então, o que ele vai
fazer é enfatizar essas palavras
em seu podcast, e eu vou mostrar como isso
se parece. Por fim, temos o idioma. Vou continuar com o inglês, mas voltaremos
para tentar um diferente. Vamos gerar e ver como é o
nosso podcast. Ok, então aí está meu áudio. E temos 6 minutos
e 26 segundos. Isso porque
tem pausas. Mas se você perceber que é
muito longo ou muito curto, você sempre pode
voltar ao Cha HbT e pedir que ele
dure 3 minutos, 20 minutos, por quanto tempo quiser Vamos ouvir. Você sabia que as ondas de
calor agora matam mais americanos a cada
ano do que furacões,
inundações e inundações A forma como vivenciamos o verão
está mudando fundamentalmente, e hoje estamos
mergulhando em como as comunidades estão se adaptando a essas temperaturas
crescentes Essas estatísticas são
realmente reveladoras. Estive lendo sobre
como diferentes cidades estão desenvolvendo soluções inovadoras para lidar com o calor extremo. Bem, o que é fascinante
é como isso
se tornou um grande público,
como você pode ver, ele alterna entre as
pessoas, e aqui embaixo, estamos realmente vendo as cores atribuídas a Chris e Jessica Uma coisa que você
deve ter notado é que, por padrão, ElevenLabs removeu
a primeira parte do nosso script, onde apenas fala sobre a descrição do
podcast Então, isso se resume imediatamente ao
que essas pessoas estão dizendo. Não estou vendo parênteses de adivinhação Maya ou o título do podcast
ou Isso é muito impressionante.
E o que você pode fazer é alterar as vozes
ao mesmo tempo e fazer com que elas regenerem
tudo Para Chris, acho
que ele poderia falar um pouco mais devagar e ser um
pouco mais estável, na verdade um pouco menos estável Ele parecia um pouco
robótico demais e um pouco Vamos fazer algo
parecido com Jessica. Acho que ela definitivamente poderia
diminuir a velocidade com sua voz. Acho que não
economizamos. Chris, na verdade reduz isso e torna isso um
pouco menos estável. É seguro. Mais uma coisa que
eu quero fazer é adicionar algumas palavras de, tipo,
pausas, erros humanos para
tornar esse podcast um pouco mais realista e isso é algo com o qual o ChatBT
pode ajudá-lo Vou só colar meu texto. Pegue esse texto e adicione e faça
uma pausa para que soe. Mais humano. Além disso, vamos
reduzir isso para 3 minutos. Marque aspas,
cole e aspas
e, em seguida, pressione Enter Apenas um aviso,
isso é da IA, as informações aqui
podem não ser Então, considere tudo isso
com um grão de sal. Se você quiser criar um podcast
estatisticamente correto, certifique-se de escolher fontes
confiáveis, mas isso é apenas para fins de
demonstração. Esses números, esses lugares, programas,
provavelmente não são reais. Remova os títulos
de anfitrião e convidado. Eu só quero o diálogo
separado por quebras de parágrafo. Tudo bem, então isso
vai funcionar muito bem. Você poderia fazer isso para remover os títulos
de apresentador e convidado, mas
teria que atribuir Chris e Jessica a cada uma
dessas frases O que vou
fazer é copiar a resposta anterior e
reenviá-la para o nosso projeto. Comando ou Controle S, vamos em frente e, antes de tudo, exclua tudo e
escolha um documento. Deixe-me realmente voltar aqui, começar um novo para que eu não
precise editar nada. As mesmas configurações de antes. Vou apenas adicionar os destaques
aqui, talvez no verão. Aqui, o que você quer
fazer é realmente examinar seus scripts e encontrar algo que você
gostaria de enfatizar. Eu vejo crianças aqui talvez,
talvez temperatura. Se ficar verde,
isso funciona para esse foco
porque está no script. Acho que
vou escolher uma, pois há muitas
informações diferentes sendo
passadas por aqui, mas a temperatura é definitivamente algo sobre o qual estamos falando. Salve as alterações. Vamos
colocar isso em inglês. As vozes estão boas
e começam a ser geradas. Ok, vamos jogar e ver
o que temos dessa vez. Aqui está algo que me
impediu. Ondas de calor agora estão matando mais americanos do que furacões, inundações e tornados juntos, e estão mudando completamente a
forma como vivemos Essa é uma estatística
impressionante. E o que realmente me
impressiona é que isso não é uma ameaça
distante. Isso está afetando
as comunidades no momento. Ok, então eu tenho meus
prêmios aqui. Meio que trouxe
o último roteiro, mas eu poderia simplesmente
trocá-lo como acabei de fazer. Ei, você sabia
que as ondas de calor agora matam mais americanos a cada ano do que furacões, inundações e tornados juntos Sim, é selvagem. A forma como vivenciamos os verões, então, se isso acontecer com você, basta voltar ao seu roteiro
e copiar o que quiser E aqui, vou adicioná-lo ao que
estava lá antes, colá-lo. E o que você precisa fazer é
destacar toda essa seção e aplicar apenas Jessica ou
qualquer voz que você quiser E dessa forma você
pode trocá-lo. Mas agora que há
ms e pausas, parece muito mais humano É exatamente por isso que
fomos ao ChachiPit. Mais uma vez, vou
diminuir um pouco a velocidade dele, adicionar mais exagero e salvá-la Para Jessica, acho que ela está bem. Talvez o torne um
pouco menos estável. A velocidade dela é perfeita
para um podcast. Mas quando terminarmos, podemos
regenerar apenas um pouco para
não usarmos muitos
créditos gerados Ei, você sabia que as ondas de
calor agora matam mais americanos a cada ano do que furacões, inundações e tornados juntos Sim, é selvagem. Honestamente, essa estatística é
meio assustadora. Estive lendo sobre como algumas cidades estão criando essas formas realmente criativas de
lidar com o calor extremo. A forma como vivenciamos o
verão está mudando fundamentalmente E hoje estamos apenas
mergulhando em como as comunidades estão
realmente se adaptando a essas temperaturas crescentes Essa é uma estatística
impressionante. E o que realmente me
impressiona é que isso não é uma ameaça
distante. Isso está afetando
as comunidades no momento. Tudo bem, então aqui está nosso exemplo
simples de podcast. Vamos voltar
ao primeiro menu e dar uma
olhada no que são. Portanto, a entrada do URL pode
ser como uma postagem de blog, algo
no site, em sua
mídia social ou algo assim, e ele usará essa tecnologia para criar um
podcast que você possa ouvir. Talvez eu tente isso com uma postagem no blog e depois veja como ele
usa essa tecnologia para isso. Vou encontrar uma URL e
depois voltarei imediatamente. Vamos para a Wikipedia e
obter um artigo muito simples. Vou pesquisar talvez
maçãs e simplesmente colar esse URL na barra aqui. Então, novamente, você pode escolher
qual tipo de podcast. Desta vez, vou publicar
um boletim porque são
fatos sobre uma maçã Vamos fazer com que seja bem curto. Uma única rosa pode ser minha escolha uma voz diferente desta vez. Deus lhe deu uma fama. Só uma voz britânica. Idioma. Nós podemos fazer inglês. E então podemos ver como
isso soa. Ok, aqui está nosso
podcast da Apple. Vamos ouvir isso. notável
jornada da Apple começou com seus ancestrais selvagens shoppings
ciersi na Ásia Central, evoluindo para os atuais
shoppings domésticos ao longo de milênios de cultivo A notável
jornada da Apple começou com
seus ancestrais selvagens shoppings
ciersi na Ásia Central,
evoluindo para os atuais
shoppings domésticos ao longo de milênios de cultivo. Os pomares comerciais dependem enxertia
clonal em
vez da propagação de sementes,
pois as sementes podem produzir resultados imprevisíveis pois as sementes podem produzir resultados imprevisíveis Esse
cultivo cuidadoso resultou em mais de 7.500 cultivares distintas, cada uma desenvolvida para usos
específicos a partir Então, como você pode ver, eu não
vou jogar a coisa toda. Basicamente, resume
toda a página da Wikipédia e oferece um discurso mais
coloquial Então, a forma como isso começou
é que falou sobre, você sabe, a jornada
notável, que é, eu acredito, da seção de cultivo
da seção de história
, na verdade. Comecei a partir daqui
porque sabia que você
precisaria de algum contexto. Depois entrou na ancestralidade, quando foi sequenciada,
até mesmo no genoma, que é uma seção totalmente
diferente Na verdade, é muito
impressionante como ele pega pequenas informações
de uma página da web inteira, como a Wikipedia, bem grande, e as transforma em um podcast. Isso é muito bom. Você sempre pode alterar a voz,
adicionar intervalos, efeitos sonoros ou qualquer outra coisa que quiser. Mas a última coisa que
queremos experimentar com o podcast é um projeto existente. No momento, tenho quatro
em segundo plano. Tudo que você precisa fazer é escolher
um. Escolha o formato. Vou transformar isso em
uma conversa
curta, escolher meu anfitrião e convidado. Ela desviou o olhar de
suas ruínas para Arabella Pessoas que são loucas. Vamos torná-lo japonês e ver como os diferentes
idiomas funcionam. Então, como você se lembra, minha história assustadora era só eu escrevendo um
monte de frases Adicionamos alguns efeitos sonoros,
mas não havia muitos. Deixe-me mostrar
rapidamente o que tínhamos. Não há muitas frases acontecendo. Vou fazer um podcast
sobre isso. Então, vamos escolher nossa conversa de
projeto, curta, e eu vou escolher minhas
vozes novamente em japonês. Então aqui está nossa
história em japonês. Vou dar uma prévia e depois
voltaremos para o inglês para que possamos ver que tipo de
mudanças a ElevenLabs fez Você mostra sakaka dee tomo Koa
Nova Mirena, kommen Kiowa, Tata tore Umacho Então pronto. Oi, Shotunaako jo também. Então, acho
que foi uma ótima conversa. Vamos voltar
aqui e fazer a mesma
coisa, mas em inglês. Dessa forma, saberemos
como isso se comporta. Vou usar a versão
japonesa como meu projeto. Mesmas configurações. Bem, vamos realmente
voltar aos nossos escolhidos, torná-los em inglês desta vez, e então podemos comparar. Aqui está o meu primeiro texto convertido. Você pode ver no nosso
conto que eu escrevi, ele o transformou em
uma conversa. Vamos clicar em
Play e ver o que temos. Você já se perguntou por que os momentos
mais assustadores terror não são os monstros, mas aqueles segundos silenciosos em que
você está completamente sozinho Há algo profundamente
inquietante no verdadeiro isolamento. É exatamente isso que torna
essa história tão eficaz, o cenário abandonado de uma fábrica onde literalmente
ninguém está respirando. Então, pegamos nossa história
muito simples. Vou abri-lo
por um segundo para mostrar a vocês. Então, essas duas frases, estou apenas descrevendo este vídeo, são basicamente um
podcast baseado nessa história. Então, essas duas pessoas estão falando sobre nosso personagem
perdido na floresta, mas você pode ver que
uma ótima conversa foi criada usando IA, e podemos alternar entre
as diferentes frases. O recurso de podcast é realmente poderoso e há muita coisa
que você pode fazer com ele. Nos próximos capítulos, faremos um
podcast do zero Não se preocupe se você não praticou muito
com isso agora. Estamos apenas examinando os recursos
básicos de cada uma
dessas ferramentas para estarmos prontos para esses projetos
interativos. Agora, isso conclui
a seção de estúdio. Importar do URL só permite que você insira uma
página da Wikipédia e, por exemplo, pode ser uma postagem de blog,
Wikipedia, qualquer coisa, e isso só vai
simplificar para você. Seja um podcast, um audiolivro, uma narração, não
importa ElevenLabs
decidirá o que funciona melhor e, em vez disso,
fornecerá um áudio Isso é bem simples. Basta colar sua URL, escolher sua voz
e pronto. Se houver uma conversa envolvida,
basta ativá-la. Mas é uma combinação das ferramentas que
já analisamos. Eu não vou falar sobre
isso agora. Isso é tudo para estúdio. Na próxima lição,
abordaremos a dublagem, que é basicamente
onde você coloca um áudio em cima de um áudio
existente para,
como diz, localizar Atualmente, existem 29 idiomas e tenho certeza de que ,
nos próximos meses,
haverá mais. Vamos passar para a dublagem.
16. Dublagem: Com a dublagem, você pode traduzir seu clipe original usando um
dos 29 idiomas
disponíveis
e basicamente decidir para
onde vão as dublagens Então essa é a
interface agora. Há alguns tutoriais para você dar uma olhada para começar Mas a primeira coisa que
você precisa fazer é simplesmente clicar em
Criar uma nova dublagem. Quando você fizer isso, estará fazendo um projeto de dublagem Então, vou chamar isso de
minha dublagem de filme de terror. O idioma de origem é o idioma que seu vídeo
original tem, para mim, ou seja, em inglês, e então você escolhe
seu idioma de destino. Acho que vou tentar
alguma coisa, vamos ver. Vamos fazer espanhol, por exemplo, clicar e
inserir sua fonte de áudio
ou vídeo. Além do botão de upload
clássico, temos links do YouTube, links do Tik Tok, outro
URL e manual Então, se você quiser fazer o manual, apenas para orientá-lo,
este é o arquivo de vídeo. Um arquivo CSV será
seu arquivo de transcrição. arquivo de áudio em primeiro plano será o discurso, o que
quer que esteja lá, que
quer que esteja lá, e o plano de fundo pode ser
um pouco de música ou algo assim Então você só
viria aqui se tivesse os arquivos separados
para cada um deles. Caso contrário, é
a mesma coisa que fazer tudo isso
em um arquivo aqui. Então, vou enviar este vídeo, que mostrarei a
vocês daqui a pouco. Dizem que ela acordou
com sangue nos olhos, envolta em metal e silêncio O avião tinha sumido.
Todos os outros se foram. Então, este é um vídeo que
eu fiz com o Runway AI, que é outra ferramenta, como
mencionei na lição
anterior Mas desta vez
vem com áudio. E como você ouviu
, está em inglês. Então, eu quero transformar
esse áudio em inglês e ter uma dublagem em espanhol no topo E esse vídeo está disponível para vocês baixarem
no pacote de recursos. Então, vamos continuar e
fazer o upload aqui. Você pode visualizá-lo novamente. Eles dizem que ela. Então, ao rolar para baixo, você pode excluí-lo para colocá-lo em outro ou simplesmente continuar. Se você criar o projeto
de dublagem, poderá obter
uma linha do tempo para ajustar
os diferentes áudios Definitivamente, ative isso a menos que você tenha um projeto muito
simples, e seja como um
plug-and-play em que você
não precisa editar Número de alto-falantes, ele
pode detectá-lo para você, mas você pode ter certeza que o faz corretamente
escolhendo um dos números. Eu só tenho um alto-falante,
então estou escolhendo um
e, em seguida, o
intervalo de tempo para dublar para mim, será o tempo completo
. 02 53 segundos Clonagem de voz
desativada, ative-a para que não crie uma
voz idêntica. É isso mesmo. Basta clicar em Create Dup, ele vai fazer o upload e agora vai
convertê-lo para o espanhol Está usando as ferramentas do playground e um pouco mais de
áudio em espanhol, mantendo o tom natural, o clima e todas essas coisas. Vou deixar isso
funcionar e depois
voltarei para que possamos
ver o que temos. Como você pode ver, está pronto, posso simplesmente clicar nele
e entrar no meu projeto. Como você lembra, habilitamos o projeto de dublagem e é
por isso que temos essa Se você não habilitar isso, não
verá essa interface. Então, aqui está o
áudio transcrito. Você pode ver o
texto e ele
corresponde ao que ouvimos
no próprio vídeo. Então, eu não tenho
muita informação, muito áudio neste vídeo. Foram cerca de 53
segundos, eu acho. Mas imediatamente, podemos ver que ele separou a música de
fundo,
a música de primeiro plano
e depois o Então, agora, eu
não vou fazer nada e simplesmente
jogar para vocês. Dizem que ela
acordou com sangue nos olhos envolto em metal Então você pode ver que ainda é
o vídeo original, e o que você pode fazer aqui é
brincar com os diferentes
áudios que ele extraiu, adicionar algo, removê-lo e fazer um monte de Mas antes de entrar
nisso, vamos primeiro dar uma
olhada nessa interface e
ver o que está acontecendo. No canto superior esquerdo, temos a transcrição
do áudio, como você pode ver, também
podemos clicar nele que ele
o refaça para Isso é tudo nesta
seção aqui. À direita está a prévia
do vídeo real. Se eu mover meu indicador de reprodução, você verá que estou
indo e voltando,
e isso está sincronizado com
a Falando da linha do tempo,
temos camadas. Essas são três
camadas no momento, mas se não há nada lá, isso significa que não há música em
primeiro plano aqui Esta é apenas a
música de fundo, e este é o
orador falando. Você pode ver aqui que o alto-falante
não diz nada, mas a música ainda está tocando. Vamos ouvir o que isso soa. Não está vazio. Cada passo. Você vê que diz
alguma coisa, faz uma pausa, diz de novo, mas ainda
havia música
tocando na parte de trás Aqui estão os
nomes das camadas, e você pode alterar o nome, não para plano de fundo e primeiro plano,
mas para seus Se você tiver vários palestrantes, pode dar um
nome a eles e isso
manterá as coisas muito
mais organizadas. Eu posso chamar isso de Jake. É rotulado como original porque ainda
estamos em nosso vídeo
original Tudo o que você fizer será salvo automaticamente, então não se preocupe se
não houver nenhuma alteração segura. À direita, você
só pode ativar essa camada. Se eu clicar no plano de fundo, você pode ver que ele avalia
o primeiro plano e Quando clico em Play,
mesmo estando nessa parte, não
estou ouvindo nenhum discurso. Vamos fazer a mesma coisa
com o áudio do Jake. E as árvores. Ela
andou por horas. É só nosso alto-falante. Você pode ver o quão limpo
isso separou os dois. Eu só dei um vídeo. Na lateral,
você pode excluir o alto-falante e adicionar um novo. Você pode usar isso para
percorrer sua linha do tempo. No canto superior direito, temos quantos segundos você passou Temos o select, que
permite selecionar coisas. Nós temos o acabamento se você
quiser cortar alguma coisa. Vou selecionar
o plano de fundo, clicar no ícone da tesoura
e, em seguida, você verá que
agora tenho duas seções
do mesmo áudio Clique em Comando ou
Controle Z para desfazer isso. Essa é apenas uma delas Adicionamos um clipe para que você possa adicionar
vídeos diferentes, se quiser. Eu não vou fazer isso,
mas se você quiser,
você pode decidir para onde vai, talvez aqui e depois
talvez transformar isso em
um Saffx ou algo assim Falaremos sobre isso mais tarde. Para excluir, basta
selecioná-lo e pressionar Backspace
no teclado Agora, com cada
um dos áudios, você tem a opção de
alterar o volume Isso é o que
parece agora. Vamos destacar apenas
a música de fundo. Agora vamos voltar e
reduzir o volume. Nós mal podemos ouvir isso. Se você ver que algo
está muito alto, você tem a opção de ajustar. Tudo bem. Essa é
a interface básica. Aqui, você pode alterar o nome
do seu projeto de
dublagem. Abaixo, você pode ver
quantos créditos você tem, e é aqui que toda
a dublagem acontece. Você tem o original,
que é o clipe original. Se você for para a versão em
espanhol, teremos
Jake em espanhol Veja como está traduzindo o áudio original para
a versão em espanhol Vamos ver como isso soa. Inches Esperto consangre
L o Sojos e well t. Vamos realmente
aumentar o áudio da música de DenchesEsperto, consangren Los Sojos e
Welt metal são IlensioEabon,
Able Zaparsdo, Todos
Los mas, desaparzidos, solo Aga, Ilosarbos, caminodor
teoras, Talves dilas, lb, então eu não falo espanhol, mas se você souber, você pode ver como isso é traduzido palavra por palavra consangren Los Sojos e
Welt metal são IlensioEabon,
Able Zaparsdo, Todos
Los mas, desaparzidos,
solo Aga, Ilosarbos, caminodor
teoras, Talves dilas, lb, então eu não falo espanhol, mas se você souber, você pode ver como isso é traduzido palavra por palavra. consangren Los Sojos e
Welt metal são IlensioEabon,
Able Zaparsdo, Todos
Los mas, desaparzidos,
solo Aga, Ilosarbos, caminodor
teoras, Talves dilas, lb, então eu não falo espanhol, mas se você souber, você pode ver como isso é traduzido palavra por palavra. consangren Los Sojos e
Welt metal são IlensioEabon,
Able Zaparsdo, Todos
Los mas, desaparzidos,
solo Aga, Ilosarbos, caminodor
teoras, Talves dilas, lb, então eu não falo espanhol, mas se você souber, você pode ver como isso é traduzido palavra por palavra. Se por algum motivo
você viu que está faltando alguma coisa ou
não foi traduzida corretamente, você tem a opção de
mudar as coisas aqui. Eu poderia simplesmente deletar essa palavra, por exemplo, e
citar outra coisa. Quando faço isso, posso clicar em
Gerar áudio novamente. Se você for até Jake Spanish, há esse ícone de engrenagem, e é aqui que você pode escolher
a voz e as configurações familiares com as quais
trabalhamos até agora Primeiro, se você for para a voz, poderá escolher alguém aqui. Vamos ver. Não é um clone Eu cruzei as esperanças. Na verdade, vamos procurar o espanhol. Seja ambicioso em seus objetivos e
diligente na voz amadora. Vamos, hum, tentar
fazer, tipo, um homem. Deixe minha voz ficar bem,
isso é muito bom. Vamos adicioná-lo às nossas vozes
para que possamos acessá-lo facilmente. Escolha nosso modelo. Vou usar o
recomendado e, se quisermos,
podemos alterar esses controles deslizantes Vou apenas mantê-lo como
padrão e depois fechá-lo. Esse é o controle que você
tem sobre a voz
e, em seguida, você pode
adicionar ainda mais idiomas. Se você quiser fazer uma dublagem em espanhol, uma dublagem japonesa, você
pode fazer isso facilmente Vamos fazer uma dublagem japonesa. Ele vai
processar tudo. Imediatamente, podemos ver
a versão japonesa. Isso está parecendo muito bom. Metals lensoabon Able
Então, isso está em espanhol. Vamos ficar quietos e pegar o
áudio, você sabe, gerado para japonês. Gabe, Kinsoctoks em seu metato marite
de Mesa, Yareto. Ele sabe Então eu uso essa nova voz. Acredito que escolhemos Christopher. É por isso que ele está soando
um pouco diferente. Agora, você pode criar uma voz a partir da seleção
ou gerar áudio. Essas são as configurações familiares. Vou ver se consigo
estender isso um pouco. Esse é um volume do
seu clipe original. Se você pegar algo assim, o idioma em que
está atualmente, poderá criar uma voz somente
a partir dessa seleção. Então, se eu fizer isso,
vamos agir como Paul. Como nome, crie. Agora, quaisquer ajustes que eu fiz nesse clipe em particular se tornam um modelo de voz que eu poderia usar com outras ferramentas
da ElevenLabs Assim como
temos essas vozes, acabei de criar uma chamada Paul, para ver se consigo
acessá-la daqui. Lá vamos nós. Aí está o meu Paul que
acabei de criar e você pode criar
quantos quiser. Agora, para configurações de voz, você pode herdar as configurações da
faixa, seja, tudo
o
que você fizer na faixa será
aplicado Se você desativar isso,
poderá fazer o que
estávamos fazendo neste
ícone de distorção, mas aqui Escolhendo sua voz, seu modelo
e, em seguida, configurando a
voz com esses controles deslizantes Agora, você também pode
ditar isso sozinho e ele seguirá a
maneira como você está lendo para ajustar essa voz Mas você também pode
ter sua própria voz reproduzindo isso, se quiser, e tudo isso é feito
com esse botão. Esse clipe tem apenas 20 segundos. É por isso que vemos isso aqui. Já o clipe
do filme inteiro, digamos assim, é
um pouco mais longo. OK. Então, aqui embaixo, temos um monte de outras coisas. O primeiro é adicionar o alto-falante
dublado Track. Eu poderia adicionar um alto-falante diferente. Você pode ver que temos outro. Adicione uma faixa de narração, que você pode fazer com
a conversão de texto em fala,
por exemplo, assim,
vamos aumentá-la Eu não tenho nenhum áudio no
momento, a fonte, então eu poderia colocar
algo, algo assim,
vamos gerar. Agora, porque eu estou em
japonês, é em japonês. Opa. Vamos apenas destacar isso. Oi, estou perdido. Esse é o original, mas
podemos fazer a versão japonesa. Eu o estiquei, mas é muito curto Vou clicar em Gerar
áudio novamente. Myota. Aqui está nosso curta, Oh, eu estou perdido em japonês. Pode fazer com que os dois
joguem ao mesmo tempo. Se você quiser, vamos
movê-los de um lugar para outro. Não, estou perdido. Myota. Eu poderia simplesmente alternar entre os idiomas
e partir daí. Você pode estender assim para
torná-lo um pouco mais lento. Parece um
monstro agora, mas quanto mais apertadas forem
essas barras, mais natural
ela soará. L. Então eu o faço bem pequeno, vai ser super rápido. Liota. Em seguida,
adicionamos o SFX Track, que são seus efeitos sonoros, que já
sabemos como usar Ao clicar em Plus, você
obterá uma nova camada, e tudo o que você realmente precisa
fazer é, antes de
tudo , ativar o
efeito sonoro e descer. Vamos primeiro
criar um espaço para isso e descrever nosso som. Vamos fazer um papagaio. Gere o áudio. Está mostrando o SFX em inglês e japonês,
mas é a mesma coisa Esse é o nosso papagaio.
Nós podemos alterá-lo. Não obtemos
amostras diferentes, como
costumamos fazer com o painel de efeitos
sonoros, mas se você não gostar disso, pode clicar em regenerar logo na parte superior ou excluí-la com o
backspace e começar Você também pode fazer um mais longo,
um efeito sonoro mais longo. Vamos chover ou
apenas chover forte, talvez. Gere áudio. A
razão pela qual você vê inglês
e japonês é porque isso será
copiado para todos esses caras Não sei como isso
soa como chuva forte, mas você entendeu. Você só precisa
ser muito específico. Vamos tentar fazer
chover forte
na Stone Road com trovões ao
fundo na Stone Road com trovões ao Algo mais específico.
E lá vamos nós. Às vezes, você precisa
prolongar um pouco mais a solicitação. Então eu poderia ajustar o volume como fizemos
com os outros. E quando eu tenho tudo funcionando, isso se torna muito importante. Então, deixe-me
examinar, você sabe, esta seção em que estamos
recebendo um monte de coisas. Mechintakega, NoKotta
Kano JawananjiKamo, Aukiso, Ariwa Nanihim . Então você vê como isso
precisa ser muito menor porque temos
nosso alto-falante negativo 27. Amo, Arakio. Na verdade, temos que
alterar o japonês. Amo Aukisok Ariwa
NanihimKamo Shini Agora podemos Você pode ir para a versão
em espanhol ou ficar com a original. A última coisa que você pode
fazer é carregar o áudio. Você pode enviar seus
próprios efeitos sonoros, suas próprias dublagens ou
qualquer outra coisa que desejar Se você fez um áudio
com uma ferramenta diferente, pode exportá-lo e
importá-lo aqui. Músicas, efeitos sonoros, planos de
fundo e
todas essas coisas existentes de
fundo e
todas essas coisas Agora, lembre-se de que os
alto-falantes não serão detectados. A única maneira de
trazer alto-falantes é através da
forma original que fizemos
e, dessa forma, a
ElevenLabs está usando a tecnologia correta para fazer todo
esse processo de dublagem Ok, quando terminar, digamos que este é meu projeto
finalizado, você pode clicar em
Exportar aqui embaixo, exportá-lo em qualquer
idioma que quiser, aqueles que você criou aqui como a saída Você pode fazer o vídeo e
o áudio, apenas o áudio, apenas a legenda, a transcrição,
um arquivo zip, qualquer coisa
que funcione melhor Então, vamos clicar em X, e pronto com
a ferramenta de dublagem. Pode parecer complicado quando
você vem aqui pela primeira vez, mas é bastante intuitivo
quando você olha para ele. Você tem sons diferentes
em camadas diferentes, idiomas
diferentes
bem
organizados aqui. Tenho uma prévia. Você pode alterar o texto, e é uma ferramenta muito útil. Agora que aprendemos
sobre essa nova ferramenta, podemos passar para a
próxima e ver quais outros recursos a
ElevenLabs tem a oferecer
17. Fala para texto: Speech-to-Text é
outra ótima ferramenta que você pode utilizar quando se
trata Agora, é muito preciso e está ficando melhor à medida que avançamos, mas isso pode ser usado para reuniões que você deseja transcrever ou
para um arquivo de áudio
separado que
deseja apenas
converter em um formato diferente Agora, a forma como funciona
é que você tem transcrições
diferentes
aqui e alto-falantes diferentes Digamos que você esteja sempre usando o ElevenLabs para transcrever
reuniões em sua empresa Sempre há um certo
número de pessoas e você conhece todo mundo pelo nome. Você pode adicionar esses palestrantes, os
membros participantes como palestrantes aqui, e o ElevenLabs
marcará isso para Então, quando você insere um arquivo de reunião
gravado, ele identifica
os palestrantes e marca
isso para você
no arquivo de transcrição Então, isso é uma
coisa muito legal, e você pode começar
clicando em transcrever arquivo Isso pode ser algo diferente. Pode ser algo que você
carrega do seu computador. Você pode gravar algo
sozinho agora. Você pode inserir um
URL do YouTube ou qualquer outro URL. Você pode
dizer o idioma aqui, muitas opções, role para
baixo e escolha o
idioma de sua escolha. E você também pode fazer com que
11 laboratórios anotem os eventos de áudio. E a forma como está
descrevendo isso é que, se alguém está
rindo nesse áudio, vai acabar rindo Se alguém estiver chorando,
colocará choro, e isso será
incluído no arquivo final Se você quiser
ignorar essas coisas, você pode simplesmente desligar isso. Mas é um
recurso muito legal que ele tem. Agora, o arquivo que
você
receberá também pode incluir uma legenda Digamos que você queira transcrever um áudio e
depois usá-lo em seu Em vez de colocar isso de volta em um arquivo de
legenda diferente, você
pode fazer tudo de uma só vez Isso é uma coisa separada
que você pode ativar. E esse recurso
removerá tudo o que é um som de preenchimento Então, se alguém estiver tossindo, se houver uma pausa,
algum zumbido, você sabe, essas vozes serão removidas, e 11 laboratórios podem
ignorá-las e não incluí-las no arquivo final Agora, também temos os
palestrantes designados da biblioteca. Esses são esses alto-falantes
que
aparecerão na guia que
vimos anteriormente. Então, se eu ativar isso,
atualmente não tenho ninguém salvo, mas
veremos
como fica quando adicionarmos alguns alto-falantes. Temos alguns termos-chave. Finalmente, temos os termos-chave. Digamos que você esteja trabalhando em um projeto muito importante e
queira 11 laboratórios para
garantir que não
perca nada com a palavra projeto
ou algo específico. Você pode adicionar esses
termos-chave aqui, e 11 laboratórios
tomarão cuidado extra para colocar esses itens em negrito
e não perdê-los. Então, se você não os colocar aqui
, pode perder algumas coisas quando eles falam sobre
esse termo aprimorado Mas isso é somente se você
tiver um prazo aprimorado. Se você não precisa
colocar nada aqui. Vamos sair disso e dar uma olhada na aparência do
alto-falante. Vamos
até o alto-falante,
dar a eles um nome, ID do alto-falante e uma amostra de áudio. Então, esse exemplo mostra como o ElevenLabs
detectará quem está falando e o
marcará com seu nome
no arquivo transcrito O que vamos fazer
é primeiro obter um áudio. Para isso, vou
usar esse vídeo. Dessa forma, todos nós podemos
pegar o mesmo clipe, mas fique à vontade para inserir seus
próprios arquivos de áudio. Como podemos
inserir links do YouTube, podemos facilmente pegar
o URL aqui, copiá-lo e
colá-lo aqui. Então, basta mudar para o YouTube. Pare com isso, e vamos
mudar algumas coisas. Então, isso está em inglês, mas se você
deixá-lo detectar, ele fará isso, você
sabe, sozinho. Eu poderia ligar
ou desligar isso, como dissemos. Eu só vou desligá-lo. Digamos, eu só quero
obter um resumo rápido do que aconteceu
durante esta reunião, e eu só quero remover
qualquer coisa que seja desnecessária. Agora, podemos adicionar os
termos-chave aqui. Eu só vou dar uma olhada. Acho que vamos
falar sobre reuniões aqui. Já ouvi algumas das minhas
mentes falando sobre como é muito difícil
sair da cama às sextas-feiras Então, vamos
nos concentrar apenas no lance principal. Diga, isso é, tipo, algo
muito importante para mim. Vou
colocar isso aqui. E se você clicar em Inter,
poderá adicionar mais termos-chave. Eu vou pular todo
o caminho até o fim. Vamos pegar outro termo-chave.
Você vai se encontrar com ele. É muito difícil lidar com um aluno
do ensino médio , portanto,
do ensino médio Eu vou colocar
isso também. Tudo bem, então vamos
começar a transcrever isso. Dura apenas um minuto
sem nenhum alto-falante designado. E então eu vou te
mostrar como
fazer o final do alto-falante também. Então, vamos clicar nisso e
fazer com que funcione nesse arquivo. Agora, se você quiser e tiver algumas pessoas em mente
que deseja salvar, você pode usar o
recurso de alto-falante aqui. Adicione essas pessoas
e elas ficarão
meio que em negrito em todo
o arquivo transcrito Dessa forma, você sabe, quando você tem uma reunião com 20 pessoas, você pode facilmente
filtrar e
descobrir o que John Smith disse
durante aquela reunião. A única coisa que
você precisará
é de uma amostra apenas da voz
deles. Agora, como essa
é uma URL do YouTube, eu realmente não posso, você sabe,
colocar a coisa toda. Mas se você tem essa
pessoa em mente, pode simplesmente inserir
o áudio dela sozinho. Então é isso. Vamos
dar uma olhada na aparência do arquivo transcrito.
Então vamos lá. Temos nossos palestrantes
listados como palestrantes, mas agora podemos trocar
seus nomes e depois
salvá-los na biblioteca. Assim, você pode começar
com os alto-falantes salvos ou salvá-los de
um vídeo como este. A primeira que
descobrimos que o nome deles é Mara. Acabei de rolar para baixo
neste vídeo e alguém
transcreveu tudo Então, vou
copiar isso e, você sabe, mudar as coisas
padrão aqui. Então, temos nosso primeiro alto-falante, e acho que esse
é o mesmo ,
então vou clicar nele e imediatamente ele o
atualizou para mim. O primeiro palestrante é
o próximo, presumo que seja essa pessoa Oh, na verdade estamos
recebendo algumas dicas, então óculos é f.
Vou
trocar esses nomes para que possamos
salvá-los na biblioteca Então, orador dois, quem é esse cara? Basta pular um
pouco aqui para descobrir. Então é ela.
Presumo que seja essa pessoa Vamos colocar
isso como alto-falante dois. Tudo bem, clique em
Alto-falante três. Então essa pessoa deve ser Thomas, e então temos Matthew. E podemos ver que 11 laboratórios
detectaram cinco pessoas. Está bem preciso no momento,
e agora tenho esses
alto-falantes salvos. Agora, eu poderia adicionar um alto-falante, dizer que ele esqueceu de adicionar alguém, mas geralmente quando
o áudio está claro, ele não faz isso, mas apenas
no caso de você entrar E se por algum motivo os
alto-falantes estiverem misturados, você pode pegar as bordas
aqui e decidir ou talvez fixar a duração
da fala de cada pessoa. Então é isso. Vou
apenas desfazer o que fiz clicando nesse
botão Agora, em cada um desses caras, podemos alterar seu pedido, mas esses pedidos são
baseados no fluxo normal do vídeo. Então, a menos que esteja errado, você realmente não
precisa alterá-los. Também podemos mudar a
cor do ícone. Se você quiser, apenas
para diferenciá-los. E é aqui que podemos adicioná-los à biblioteca de alto-falantes. Para que eu pudesse dar um nome a eles. E agora que ele tem a
amostra do vídeo, eu só
preciso dar um ID e um nome. Então, vou
copiar o nome dessa pessoa e colocá-lo aqui. Então, da próxima vez que eu tiver outro arquivo de reunião com
essa pessoa falando, ela reconhecerá
que é Maha e o armazenará
em uma interface como Tudo bem, então vamos
verificar todo o texto. Há também um recurso de
verificação ortográfica aqui, se
você não quiser, sabe,
ler tudo Mas vamos dar uma
olhada no que está desse lado. Então, primeiro de tudo, é
o nome desse arquivo, esse arquivo de áudio, que
é apenas o nome UT BRL. Vou deixar assim. O idioma é inglês. Eu não adicionei nenhuma legenda, mas se eu
quisesse, eu poderia simplesmente, você sabe, isso e eu vou
pegar um arquivo de legenda separado Então, isso é algo que você pode
explorar se precisar. Temos um corretor ortográfico. Eu clico nele, ele passa
por todas as palavras em inglês e avisa
se há algum erro. Felizmente, não
temos nenhum desses, então eu poderia simplesmente ignorar isso. Em seguida, temos as propriedades do
segmento. Então, aqui
está o segmento, a duração, a hora
e hora de início, e isso é mais ou menos. Então, se tudo estiver bem, tudo o que você precisa fazer
é exportar ou copiar para a área de transferência, se estiver apenas
colando em um Mas clicar em Exportar
geralmente é a melhor opção. Vou clicar no
PDF apenas para que seja, você sabe, preciso
e fácil de compartilhar. Aqui, você pode
adicionar carimbos de data/hora. Então, neste segundo,
essa pessoa disse isso, e agora também podemos incluir os nomes dos oradores porque
mudamos cada um. Clique em Baixar e agora temos um arquivo transcrito
. Lá vamos nós. Primeiro palestrante, segundo
palestrante, terceiro, e está
me dizendo a duração, o final desse segmento, o início desse segmento
e, claro, o que
eles estão dizendo. Se houver uma pausa, ela será dividida
em vários segmentos Então, tecnicamente,
nos primeiros segundos do vídeo, só Mo está falando Mas como ela fez uma pausa
durante o discurso, agora
há dois segmentos Aqui, você pode simplesmente compartilhá-lo diretamente no ElevenLabs
e não fazer o upload de um arquivo Assim, você pode pesquisar pessoas
em sua equipe ElevenLabs e,
você sabe, criar um Digamos que você esteja trabalhando com editores
diferentes
e queira, você sabe, garantir que
tudo esteja pronto Esse é um recurso interessante para isso. Voltando à página, eu deveria ter um alto-falante salvo na minha biblioteca,
e pronto. Assim, posso usar o
alto-falante para uso posterior
e, se eu quiser excluí-lo, basta clicar aqui. Agora, além do recurso clássico de
conversão de fala em texto, também
temos um modelo em tempo real que ainda está no modo de demonstração, mas ainda podemos experimentá-lo Basicamente, você pode fazer com que
11 laboratórios detectem o idioma e falem com
ele em tempo real. Então, isso pode estar entre um monte de pessoas
que estão falando. Tudo será uma transcrição em tempo
real. Então, quando eu clico em transcrever, vamos dar uma permissão, e vamos dar 11
voltas para dar uma olhada no que estou dizendo e
anotar aqui na
frente, você pode ver que
isso é bem frente, você pode ver que
isso é E só para conferir
toda a afirmação multilíngue, podemos alternar entre os Agora eu poderia mudar
para, digamos, turco e dizer, Mava, ele também vai escrever assim. Mas quando
terminar de transcrever, você pode clicar
neste botão e eu
posso copiá-lo
para onde eu quiser Talvez eu não queira passar
muito tempo digitando. Vou apenas dizer no
meu microfone, copiar,
colocar no Slack ou em
qualquer outra plataforma Esse é o recurso de escriba. Então vá em frente e experimente. É um recurso muito divertido
que o ElevenLabs tem. Esse também é muito legal, especialmente se você puder mudar
para idiomas diferentes. Embora atualmente não ofereça
suporte a todos os idiomas. Se a pessoa que você fala
estiver nessa lista, sinta-se à vontade para experimentá-la
e ver como funciona.
18. Ferramentas de produção: Agora, vamos examinar as
produções com a ElevenLabs. Imediatamente, no lado esquerdo, você pode ver que ele está
rotulado com Alpha, que significa que você precisará
atualizar ou obter esse plano específico para
poder usar as produções Então, como eu disse antes, não vou
me
aprofundar muito em como usar isso porque essas são ferramentas editadas por
humanos. E neste curso,
estamos tentando nos concentrar no aspecto de IA
da ElevenLabs Então, imediatamente, você pode ver os serviços que eles fornecem. Temos transcrições, legendas,
legendas e dublagem. Esses caras estão chegando em breve, mas basicamente o que
fazemos e fizemos com IA agora está sendo feito
por profissionais. Então, pense se você fosse ao Fiber
para obter um arquivo
transcrito, agora
você pode fazer isso
em 11 Como dissemos antes, se você perceber que as
ferramentas de IA simplesmente não estão funcionando bem para você e que este é um projeto de altíssima qualidade, você pode mudar para os serviços de produção para obter algo muito
mais profissional. Como você pode ver, você
recebe uma cobrança adicional $2 por minuto e
os preços mudam Mas vamos continuar com a transcrição e eu vou te
mostrar um pouco Quando você clica nela, é a
mesma interface da IA. Você carrega seu arquivo. Ele é revisado
pelos falantes nativos. Escolha seu idioma aqui, dê um nome a ele e, em seguida, você
pode até adicionar um estilo personalizado. Qualquer instrução, por exemplo, realmente enfatiza a
palavra temperatura
nessa transcrição ou adiciona emoções nela,
algo assim Também podemos adicionar
sons que não sejam palavras, como tossir
ou latir de cachorro Se você quiser se livrar
dessa instrução, basta clicar em remover. É bem simples. O resto das três
coisas aqui não estão disponíveis
no momento em que estou
fazendo este curso. Mas o que eles têm é
que você pode dizer quais serviços você deseja legendas e eles o
notificarão quando estiverem prontos Basta preencher isso e
falar sobre seu caso de uso. Agora, aqui embaixo,
você pode fazer uma nova produção e criar pastas para manter as coisas organizadas se planeja
usar essa ferramenta com muita frequência. Quando você clica em
Nova produção, ele só permite que você faça
a transcrição humana porque essa é a única
coisa disponível Mas mais tarde, espero que em breve você possa
fazer as outras coisas. Legendas, um humano
escreverá suas legendas,
legendas, outro humano
fará legendas para você em diferentes idiomas Eles seriam os falantes ideais nesse idioma de destino. Depois da dublagem, eles
traduzirão seu trabalho e gravarão
a versão dublada Essas são as
guias de produção aqui. Se você acessar Ferramentas de áudio, há mais algumas
coisas que você pode fazer. Por exemplo, áudio nativo. Este está novamente com uma assinatura
diferente. Se você, por exemplo,
tem um blog ou um site de notícias em que
publica muitos textos, gostaria de tornar seu
site mais acessível com uma
versão em áudio desse texto. É aqui que você viria e, se clicar em Reproduzir vídeo, eles mostrarão um exemplo. Por exemplo, essa
é uma notícia e é assim que o
áudio nativo funcionaria. Você não está apenas permitindo que as pessoas leiam seu trabalho
em forma de podcast, mas para pessoas
com deficiências, elas têm a opção de acessar
seu site e ser um
de seus usuários frequentes. É muito legal,
e é assim que a barra ficaria se
você a implementasse. Isso é áudio nativo. Também temos o Voiceover Studio, que basicamente
combinará várias ferramentas Já vimos como fazer efeitos
sonoros e fazer dublagens com dublagem. Este estúdio basicamente
combina os dois. Se você rolar para baixo,
temos uma demonstração aqui. Então, temos uma faixa de voz e
, em seguida, podemos inserir nosso texto. É como o
estúdio de dublagem, mas para dublagens. A próxima coisa é o classificador de
fala AI. Agora, esse é muito legal porque você pode
ver se esse áudio que você está prestes a enviar foi feito
usando ElevenLabs Portanto, se você suspeitar e
quiser apenas ter certeza que a pessoa que enviou áudio é realmente
uma pessoa real, deixe a ElevenLabs
descobrir isso para
você Você acabou de fazer o upload aqui. Não há muito que você possa fazer. A próxima coisa é que
a mesa de som, que já vimos anteriormente,
mas vou
examiná-la mais uma vez, leva você a essa URL
totalmente diferente, e é basicamente
o que fizemos quando
combinamos sons diferentes aqui, criamos pastas e predefinições, examinamos alguns dos valores padrão
disponíveis O Soundboard é gratuito. Você não precisa
atualizar seu plano. Acessando as
assinaturas rapidamente, você pode ver as diferenças Provavelmente é aqui
que você usa muitas dessas ferramentas de
produção. Se você fosse uma empresa maior, aumentaria a escala. É isso que estou usando atualmente, que é o pacote mais
popular. Mas se você
quiser usar os outros, basta clicar em Atualizar
e ele
cobrará mais no cartão
anexado à sua conta. OK. Então, essas foram algumas das ferramentas de produção que eu
só queria mostrar que elas estão disponíveis
e que você pode atualizar seu plano para
usá-las sempre que quiser. Isso conclui nosso
segundo capítulo,
que analisa as
diferentes ferramentas da ElevenLabs No próximo capítulo,
vamos
começar a construir coisas
com a ElevenLabs, começando com projetos básicos e depois passando para projetos
mais avançados Este é um ótimo momento
para vocês acompanharem e desenvolverem
comigo . Dessa forma, vocês saberão exatamente como usar essa ferramenta
para casos específicos, solucionar problemas usando o
conhecimento adquirido
neste capítulo e,
após este curso,
espero que neste capítulo e,
após este curso, consigam criar seus próprios áudios para seus
vídeos, sites, etc Agora vamos para
o próximo capítulo.
19. ElevenLabs Music: Um recurso recente que o ElevenLabs agora oferece é
o recurso de música Agora você pode descrever
a música que deseja e ela a gerará para você usando referências diferentes, e você tem muito controle do que apenas obter
uma música aleatória. Então é aqui que você pode
acessá-lo e, imediatamente, temos esse chatbot para que você
possa descrever a música Você pode ver os modelos
que estão chegando. Mas é muito semelhante a qualquer outra plataforma de geração de IA no sentido de que poderíamos
obter versões diferentes, escolher nosso modelo,
definir a duração e, claro, usar alguns créditos. Aqui embaixo, se você rolar para baixo, poderá ver algumas amostras
da música que foi
feita no ElevenLabs Podemos dar uma olhada em
suas batidas por minuto, baixá-las se quiser,
adicioná-las à sua lista de favoritos e até adaptá-las
ao seu projeto Então, quando diz adapte-se ao
seu projeto, basicamente, você está meio que remixando essa música para suas
dublagens,
vídeos, imagens e tudo isso no ElevenLabs vídeos, imagens e tudo Vamos ouvir algumas
dessas amostras. Então, temos alguns exemplos
instrumentais, mas você também pode pedir a
alguém que cante nessas músicas Então isso é algo que eu
vou te mostrar também. Mas se você quiser navegar
rapidamente por essas músicas e encontrar
algo para o seu podcast, clique aqui e ele listará
as mais adequadas. Então, o que eu poderia
fazer com este, digamos que meu podcast
tenha 30 minutos, não 2 minutos, é
adaptá-lo ao meu projeto. Eu teria que usar créditos para isso porque
outra pessoa fez essa música, e então eu poderia
estendê-la para 30 minutos. Mas eu também poderia
fazer minhas próprias músicas, então não preciso usar muito mais créditos, basicamente. Também pode
procurar músicas semelhantes. Ele vai
listá-los para você com base nos textos que a música
tem e na duração. Temos várias
coisas diferentes para analisar, e tudo isso está dentro
do mercado. Agora, se você não quiser
baixar nada, acesse Generations e simplesmente
descreva a música. Agora você pode achar isso um pouco
intimidante porque, você sabe, precisa inserir
as palavras-chave certas Mas o bom
disso é que ele fornece um pequeno ajudante aqui embaixo onde gerará
o prompt para você Portanto, você pode começar com um prompt
descrevendo a música. Você também pode colocar a
letra de que falei, adicionar alguma referência, se quiser. E se você não tiver certeza de como
escrever o que precisa, pode usar esta
seção aqui embaixo. Nós os fizemos nas
aulas anteriores com efeitos sonoros, mas eles ainda usam
o modelo musical. Eu poderia
editá-los ainda mais se quisesse, mas primeiro vamos fazer
algo aqui. Então, eu vou simplesmente
colocá-lo aqui. Quero uma música que seja adequada para um tronco em que
estou explorando a floresta. Eu quero que alguém
cante ao fundo. Então, vamos enviar isso
e pronto. Agora tenho um aviso baseado no
que você sabe, descrito. Então, é uma música para Travel
Flogs, que é verdade, apresenta violão
acústico escolhido a dedo Temos alguns pássaros na parte de trás. E aqui está a letra. Então temos algumas, você
sabe, aberturas, e então esses são os versos, um refrão e
um Se eu estiver feliz com
isso, posso deixar pra lá e pressionar
o botão gerar, mas também posso entrar
aqui e fazer alterações. Você pode digitar diretamente,
adicionar algo aqui ou fazer com que ele regenere
a letra para você E, como mencionei, você
pode adicionar uma referência aqui. Então essa pode ser outra
música que você realmente gostou, mas vou
deixar que seja assim. E aqui embaixo, podemos escolher
a duração da música. Porque eu tenho algumas
letras aqui, eu realmente não posso fazer isso
porque é predeterminado Então, são alguns
segundos para cada parte. Vou apenas
configurá-lo para Automático, que é o tempo determinado por
11 voltas. Aqui embaixo, você pode escolher
o número de variantes. Quando você adiciona mais variantes
, são necessários mais créditos. Eu só vou fazer um
por enquanto e você pode ver que ele se torna 900/minuto Também temos alguns ajustes finos
que você pode adicionar, você
possa escolher para que você
possa escolher um estilo diferente
de cantar, se quiser. Temos homens e mulheres. Você também pode visualizá-los. Tenha homens ou mulheres, e você também pode adicioná-los. Vou deixar a
minha como está, nada adicionado porque essa
é uma música de risco muito baixo, e vou
clicar em Gerar. Então, uma vez que você o gera, ele fica de lado e
podemos vê-los sendo construídos. Enquanto falamos, são um
minuto e 48 segundos. Vamos ouvir o que parece. Passos em Marte. Suave, suavemente, um dossel verde bem
acima dos rios M. I. Então essa é a nossa música.
Se for, você sabe, muito otimista, eu poderia
voltar e talvez fazer
alguns ajustes Mas, no geral, você pode
ver que ele
se encaixa muito bem no
estilo de cadeado de viagem. Agora, se você gostar
da música e quiser fazer mais
ajustes, basta acessar Editar música e ela carregará
o projeto para você. Então, o nome da minha música
está perdido no vento. Você pode ver o
histórico do bate-papo. No lado direito, temos essa pequena linha do tempo em que eu
posso brincar
com os versos Temos um botão play. Podemos trabalhar com letras
e tags diferentes, adicionar mais coisas se quisermos, talvez queiramos
adicionar mais dois
minutos dessa música. Então, basta colocá-lo neste chat aqui, torná-lo mais longo e talvez adicionar um segundo cantor lá, o que
você quiser fazer. Como há um chatbot aqui, você não precisa fazer
uma solicitação perfeita Como vimos, inicialmente, ElevenLabs simplesmente pegou minha ideia e a transformou em
um aviso decente Depois de ter sua música
e ficar feliz com ela, você pode baixá-la
no lado direito ou publicá-la
na própria plataforma. Então é aqui que as pessoas podem usar sua música e então
você ganha alguma coisa. Acho que as taxas variam dependendo de
quantas você fez, quantas músicas você fez e quantas pessoas
baixaram sua música. Mas é uma opção bem legal. Você pode simplesmente
brincar com eles, criar uma música decente e disponibilizá-la para
outras pessoas baixarem. Também podemos compartilhar isso, compartilhá-lo como um vídeo,
dar feedback. E esses são, tipo, segmentos
diferentes da música, então podemos encurtá-la ou torná-la mais longa,
o que funcionar. Como acabei de fazer um ajuste, teríamos que basicamente
atualizar essa música. Portanto, é bem simples. Eu só vou fazer uma
pequena mudança na música. Diga, eu não quero que
seja, você sabe, esse frio, eu quero fazer algo
com afinação fina, talvez como um estilo de rock. Eu poderia fazer isso aqui mesmo. Então, deixe-me desfazer
essa extensão e vamos
adicionar um ajuste fino Vamos para o campo. Já que o rock
realmente não se encaixaria nesse estilo, vou dizer que apresente uma cantora
após o curso. Então essa é a nossa
primeira versão. Agora vamos com a versão dois, e posso ver que
há algumas sugestões aqui, então vou clicar na guia, e ela também será adicionada. Então, vamos colocar isso de novo, uma variação para que
não demore muito, e vou
enviá-la por
11 voltas para atualizar minha música O que ele precisa fazer é adicionar mais letras. Então aqui está meu solo vocal feminino, logo após o refrão, como eu perguntei, e aqui
está a seção Então, vamos ouvir como
isso soa. Eu vou pular para essa parte. Então, agora, acabamos de
adicionar essas coisas, mas vou copiar essa parte só
para mostrar que
você pode mudar a
letra sozinho. Então, voltando ao início, vamos fazer esse ajuste.
E vamos ver o que temos. Para o s, de
volta à estrela. E lá vamos nós.
Conseguimos fazer uma música a partir de um prompt
ou devo dizer uma ideia? Adicionamos outro cantor. Adicionamos nossas próprias letras e tivemos essa música em
estilo country no final. Então vá em frente e experimente isso, faça um monte de músicas, e seria uma boa ideia publicá-las
no mercado. Você nunca sabe quando alguém pode simplesmente baixar
sua música e você também ganhará alguns
créditos no caminho. Então, se você quiser
explorar isso, basta clicar em Começar, criar um bom perfil
e, em seguida, suas músicas
entrarão no mercado. Esse é um ótimo recurso, pois ElevenLabs também introduziu
vídeos e imagens Agora você pode fazer
dublagens, música de
fundo, conteúdo, conteúdo visual, legendas e basicamente tudo que precisar com a geração de
conteúdo
20. Design de voz: A biblioteca de voz oferece
muitas vozes diferentes, todas muito diversas. Há diferentes idiomas, tons e estilos
diferentes. Mas às vezes simplesmente
não é o que
você está procurando. Mas, felizmente, o ElevenLabs
permite que você
crie sua própria voz usando o design de voz Então, agora estamos
na guia de vozes em D, mas já podemos ver todas as vozes diferentes
nos diferentes idiomas. Então, agora,
posso facilmente entrar, escolher uma tag relacionada ao
que eu preciso e
baixar essa música, usá-la, alterar a velocidade, o tom e, você sabe,
criar meu conteúdo. Vamos explorar
esse recurso aqui, que é quando você cria
sua própria voz personalizada. E o legal disso é que, depois de ter
sua própria voz, você pode realmente enviá-la para o mercado, onde outras pessoas podem usar sua voz e você
ganhar algum dinheiro ao longo do caminho. Então, vamos clicar
nisso e criar nossa primeira voz. Portanto, com o design de voz, você pode criar
algo completamente do zero ou fornecer
sua própria voz para um clone Essa é a maneira mais rápida, mas você tem a opção de
clonar sua própria voz,
remixar com uma
voz existente ou tentar,
você sabe, fazer um clone remixar com uma
voz existente ou tentar,
você sabe, mais
profissional Então, aqui, ele realmente precisa 30 minutos do seu
áudio
para criar um clone de áudio muito limpo e
profissional Mas você realmente não precisa
fazer isso se quiser algo rápido
para seu próprio uso. Então, vamos explorar o
primeiro. Design de voz. E temos essa caixa onde descrevemos a voz. Então, basicamente, você pode me deixar
estender isso um pouco. Fale sobre o sexo, a idade, o tom da voz, para
que você precisa da voz. Às vezes isso ajuda. se você disser
que quer uma voz ASMR, isso vai
torná-la meio sussurrante Então você também pode explorar isso. E aqui embaixo, podemos obter algumas instruções aleatórias
para começar Então, se eu clicar
aqui,
teremos uma voz feminina aguda Clique novamente, uma mulher mais velha
com sotaque sulista, e você verá como
as instruções diferem no comprimento Não precisa necessariamente
seguir um modelo. Você pode simplesmente colocar
o que quiser e obter uma boa voz
para começar. Se você clicar nas configurações, podemos contornar
o volume da voz
e a escala de orientação Portanto, a
escala de orientação é o quão de perto essa nova voz seguirá
as instruções. Se você quer que algo
seja basicamente muito controlado com
base em sua solicitação, você aumentará isso para um máximo. Mas se você quiser que 11
laboratórios sejam um pouco criativos na forma como
interpretam sua solicitação,
você pode mantê-la discreta . Eu recomendaria mantê-lo em
algum lugar no meio
apenas para começar. E depois de ter essa voz, você pode editá-la em qualquer um dos lados. Então, em vez
de usar um desses modelos, vamos apenas
descrever nossa solicitação, que vocês
possam acompanhar e todos nós possamos fazer uma só
voz para começar. Então, o que vou fazer é tentar dar voz a um apresentador
de notícias E eu prefiro uma voz
feminina, talvez de meia idade, confiante, séria
e adequada para o noticiário. E eu vou
descrever isso aqui. Portanto,
podemos dizer que uma voz
feminina confiante de meia idade para fins de
apresentadora de notícias fala com muita clareza Então, aqui está meu aviso.
Muito simples Eu basicamente
escrevi o que eu preciso. Agora, no lado direito,
podemos trabalhar com o volume. Não queremos que ela fique
muito quieta ou muito barulhenta, então podemos usar talvez 60%. E quanto à escala de orientação, quero que ela tenha
esses termos-chave em mente. Então, eu também vou simplesmente aumentar
a escala de orientação para 60, porque eu não
quero, tipo, uma âncora de notícias muito animada Quero alguém que seja sênior
confiante e que possa relatar
as notícias muito bem. Então, um confiante para um sênior? Vamos colocar isso. E também
podemos mencionar o
sotaque, se você quiser Então, sotaque americano,
inglês. Isso é opcional. Você pode deixar isso de fora e depois ver o que a ElevenLabs
faz para Então, quando
terminarmos, podemos ver que isso nos
custará 350 créditos. Podemos gerar a
voz e depois fazer ajustes depois que ela
for gerada. Boa noite a todos.
Esta noite, apresentaremos os últimos desenvolvimentos
sobre as perspectivas econômicas, após o recente anúncio do Federal
Reserve. Nossa equipe tem acompanhado de perto a reação do
mercado. Essa é a primeira variante. Como você pode ver,
é muito bom, adequado para transmitir notícias Vamos dar uma olhada nas
outras duas variantes. Boa noite a todos.
Esta noite, apresentaremos os
últimos desenvolvimentos sobre as perspectivas econômicas. Boa noite a todos.
Esta noite, apresentaremos os últimos desenvolvimentos
sobre as perspectivas econômicas. Então, eu vou com o primeiro. Boa noite a
todos. Só porque é um pouco mais alto e
um pouco mais claro Agora, a parte de limpar a
garganta é, na verdade uma adição interessante porque os apresentadores de
notícias geralmente estão ao vivo, e isso pode acontecer, então eu pude até ver como
isso soa E quando eu estiver feliz com isso, eu poderia selecionar a voz. Mas se você achar
que é, você sabe, muito rápido, muito alto, você pode fazer um ajuste aqui e depois gerar
a voz novamente Então, vou
selecionar a voz um. Agora vamos
dar um nome a ele. Então, vamos chamá-la de Maria, usar Anchor, e então
poderíamos rotulá-la Então, o idioma é o inglês. Dessa forma, ele pode ser usado
para organizar suas vozes, mas também pode ser usado quando as pessoas tentam
baixar sua voz. Portanto, quanto mais rótulos você tiver, mais fácil será para eles
encontrarem sua voz e baixá-la. Então, sotaque, podemos
colocar o que temos gênero feminino. E lá vamos nós. Tenho quatro rótulos que
ajudarão as pessoas a encontrar a
voz e para meu próprio uso. Eu poderia mudar isso se eu quiser, mas acho que o prompt
é um bom indicador. Então, vamos salvar essa voz. E agora ele será
adicionado à minha biblioteca. Então, com essa nova voz, podemos
gerar essa fala. Então, vou
digitar algo. Essa será a voz
que será usada. Eu poderia criar um
agente com essa voz, ou eu poderia fazer com que ele
narrasse uma história Então, audiolivros são algo que veremos
nas próximas aulas, mas é assim que
você usa sua voz Esses são apenas alguns exemplos. Claro, há estúdio
e outras coisas aqui embaixo, até mesmo dublagem agora,
quando eu vou para vozes, minhas vozes, Maria está aqui Então, eu poderia usar isso
para conversão de texto em fala, fazer com que narre um livro para mim, mudar a voz se eu quiser
e usá-la para diferentes propósitos Então, o que podemos fazer
é clicar em usar voz e fazer um pequeno
script aqui. Deixe-me escolher Maria primeiro. Vou fazer V three para
um estilo muito natural. Vou pegar um
exemplo de segmento de notícias para
que ela possa usar o
texto certo e o estilo certo, e vamos
colar isso aqui Então, vou
colar isso. Temos algo muito simples. Não vou usar tags de áudio
só porque a voz que geramos deveria
seguir esse estilo de âncora de notícias de qualquer maneira Mas se você quiser, você pode colocar
etiquetas de áudio
diferentes, como rir,
tossir, você sabe,
o que quiser Mas agora vamos apenas
gerar esse discurso. Se quiser, você
pode aprimorar ainda mais o parágrafo com tags de áudio, mas vou ver isso se parece sozinho. Na sexta-feira passada, alunos da Sunshine Elementary
School plantaram Oh, então temos o efeito
de áudio do
café da aula anterior Vamos cortar isso
e regenerar isso. Na última sexta-feira, estudantes da Sunshine Elementary
School plantaram 20 árvores jovens
na horta da escola para manter o ambiente
limpo, verde e fresco Na última sexta-feira, estudantes da Sunshine Elementary
School plantaram 20 árvores jovens na horta
da escola Então, como você pode ver,
isso é muito bom para o meu aplicativo.
Ela está confiante. Ela é muito clara
com o que diz, e você pode
usar facilmente as
vozes geradas usando esta seção. Outras coisas que você pode
fazer é clonar sua própria voz, e isso será algo que veremos
na próxima lição Mas agora vamos dar uma
olhada na remixagem de voz. Mas vamos falar sobre esse cara, e poderíamos primeiro adicionar
uma referência de voz. Então, vou
adicionar Maria aqui e vamos
transformá-la em um estilo diferente. Então, digamos que eu
queira torná-la britânica, e vamos realmente mudar
o gênero também, então duas coisas ao mesmo tempo. Então transforme essa voz em um homem britânico de
meia idade. Aqui podemos ver
a força imediata. Então, o quanto o prompt
altera a voz original. Vou ser moderado porque é exatamente isso
que estou fazendo, o sotaque e o gênero Poderia obter alguma inspiração. Também há um guia se
você não tiver certeza do que fazer, e você pode até mesmo
fornecer um script para ver o aplicativo
completo. Então, vou colar o mesmo segmento de
notícias que
vimos anteriormente. Vou guardar isso aqui, e vamos enviar isso. Na última sexta-feira, estudantes da Sunshine Elementary
School plantaram 20 árvores jovens
na horta da escola para manter o ambiente
limpo, verde e fresco Na última sexta-feira, alunos da Sunshine Elementary
School plantaram 20 árvores jovens Na última sexta-feira, alunos da Sunshine
Elementary School plantaram 20 árvores jovens na horta
da escola para manter
o ambiente limpo Então, essas foram três amostras. Eu sinto que ele parecia
um pouco mais jovem. Eu estava perguntando por um britânico de
meia idade. Então, digamos que gere mais, e eu vou aumentar
a força imediata. Então, vamos realmente fazer isso aqui. Gere, você também pode
usá-los como referência, combiná-los com Maria, mas primeiro vou trabalhar com
a era da nova voz. Sunshine Elementary
School plantou 20 árvores jovens no jardim
da escola Sexta-feira passada, alunos da
Sunshine Elementary School. Na sexta-feira passada, alunos da Sunshine Elementary
School plantaram 20 árvores jovens
na horta da escola, então
isso é muito bom Agora posso salvar isso como uma
voz, a mesma coisa. Basta colocar um nome, dar alguns rótulos e uma descrição. Em seguida, isso será adicionado
à sua biblioteca de voz. Dessa forma, você pode ter diferentes variações
de sua primeira voz, e é muito bom para
diferentes tipos de conteúdo. Então, digamos que eu tenha uma notícia, quero experimentar uma âncora
feminina e
uma âncora masculina e,
finalmente, tomar minha decisão Então, isso é uma
coisa muito fácil que você pode fazer. Você poderia fazer outro
remix aqui mesmo, dar um roteiro diferente, talvez escolher uma
das vozes principais e
ver o que sai Experimente
e veja que tipo de vozes
você pode gerar.
21. Clonagem de voz: A próxima coisa que vamos
fazer é clonar nossa voz. Então, assim como estou
falando neste microfone agora e todas essas
vozes estão disponíveis, podemos realmente fazer com que nossa voz, a mesma voz que você está ouvindo,
seja uma dessas opções. Então, quando eu faço conversão de texto em fala, posso fazer com que ele leia o texto Como eu mesma. Imediatamente em vozes, há duas maneiras de acessar isso. número um é apertar
o sinal positivo
aqui e depois clonar a voz
instantânea, ou você pode ir
até essa coisa azul Se você clicar nele, é exatamente
a mesma coisa. Não importa para
onde você vá. E nós já
vimos este, agora vamos
descer para este. Essa é uma maneira muito simples
de criar sua própria voz. Se você
não quiser gravar
um trecho de áudio completo, considere
clonar sua voz Agora, direi que
esse não é exatamente o substituto perfeito para sua própria gravação de voz
porque, como sabemos, com a IA, ela é inconsistente e, se você planeja fazer
isso profissionalmente, talvez queira encontrar
uma alternativa melhor Mesmo assim, é uma coisa legal
de se fazer. E tudo o que ele pede de você
é um áudio de dez segundos. Você precisa falar por dez
segundos em um microfone, garantir que não haja ruído ao redor e que sua voz
seja nítida. Diga tudo com uma voz lenta e clara,
não apresse nada. E dessa forma, as 11 voltas podem estudar sua voz e
depois replicá-la. Tudo o que você precisa fazer
é clicar em gravar áudio. Escolha o microfone e ele fará uma contagem regressiva de três segundos e
você poderá começar a ler Vou dizer uma frase muito
aleatória. Não precisa ser
os 10 segundos completos, essa é apenas a quantidade ideal. Vou começar a falar
sobre o clima. Ultimamente, tem estado muito quente e planejei não
sair de casa com tanta frequência Prefiro ficar em casa
e relaxar o dia todo. Então, 10 segundos de áudio. Eu fiz 11, mas está tudo bem.
Aqui está sua gravação. Se você quiser fazer outro, basta
clicar em
excluir e substituí-lo. Aqui você pode ouvir como
você soa. Ultimamente, tem estado muito quente e planejei não
sair de casa com tanta frequência Prefiro ficar em casa
e relaxar o dia todo. Então aí está.
Existe uma opção para o ElevenLabs remover
o ruído de fundo Vou desativar isso
porque eu não tinha nenhum, mas se você achar que seu
áudio tem, basta ligá-lo. Agora está pronto e eu só
tenho que clicar em Avançar. Agora eu posso colocar algumas
informações sobre minha voz. Você pode pré-visualizar a
voz aqui. Os aviões voam pelo céu
enquanto as folhas de outono caem. Foi assim que 11 laboratórios interpretaram minha voz.
Vamos dar um nome a ele. Chame isso de Minha voz.
Então, mais uma vez, temos que adicionar rótulos. Estou falando inglês. E então podemos
dar uma descrição. Minha voz casual. Em seguida, basta confirmar
que essa é a sua voz. Falamos sobre isso
na aula de ética. Não reproduza a voz de
outras pessoas, especialmente sem o consentimento por escrito
delas Mas essa é minha voz,
então eu tenho todos os direitos sobre ela e
vou clicar nela salvar a voz. E lá vamos nós. Agora temos a opção
de testar nossa voz. Geramos fala
com conversão de texto em fala, falamos com seu próprio clone, onde podemos criar um agente de IA
conversacional
e, em seguida, temos esse Vou
clicar em Skip por enquanto porque já sabemos
onde estão as ferramentas Aí está minha voz. Você também pode
ouvir minhas vozes, e deve ser a
primeira coisa, zero dias. Eu poderia começar a usar
a voz clicando nesse ícone e começar a
digitar algo O modelo que ele recomenda, você pode simplesmente usar isso e depois vou deixar
tudo como padrão. Vamos desligar isso e
gerar a voz. Que dia maravilhoso. Podemos torná-lo mais lento,
menos instável. E acrescente um pouco de exagero. Que dia maravilhoso. Essa é a minha voz ali mesmo. Eu não disse, soe exatamente como minha voz enquanto
estou falando agora. É apenas uma
coisa divertida que você pode fazer. Eu não veria vocês usando isso profissionalmente de
forma alguma, mas acredito que quanto mais eles
trabalharem com seus modelos, melhor será esse recurso É assim que você pode
clonar sua voz. É muito simples. Se você quiser alterar ou excluir sua voz,
basta acessar vozes, minhas vozes e depois
excluir. E lá vamos nós. Agora, não
temos mais clones. Agora que sabemos como clonar
e criar nossos próprios áudios, vamos começar
um projeto do início ao fim, onde pegamos uma página da web e a
transformamos em um podcast Eu vou ver vocês lá.
22. Podcast assustador parte 1: Agora vamos começar
nosso primeiro projeto. Sabemos como usar as ferramentas. Agora é hora de colocá-lo
em um áudio massivo. Com esse primeiro projeto,
vamos fazer um podcast de histórias assustadoras em
que pegamos uma página da web, transformamos em um podcast e, em seguida, temos três pessoas
nesse podcast Temos um anfitrião e dois convidados. O que
vamos fazer primeiro é encontrar página da web
que tem a
história que estamos procurando. Vou acessar a Internet e
acessar a Wikipedia. Normalmente, eles têm páginas muito
longas e detalhadas sobre um determinado incidente, um determinado objeto ou qualquer outra coisa. Vou procurar um
desastre natural , porque eles podem ser muito bem
convertidos em diferentes emoções, medo e todas essas coisas. Vamos para a Wikipedia. Você pode usar qualquer outro site, apenas certifique-se de
ter os direitos de usá-lo. Vou procurar um tornado. Então, imediatamente,
temos alguns exemplos. Este em 2007. Podemos procurar
outros, até mesmo este. Acho que vou usar
isso extremamente poderoso. Só vou me
certificar de que
haja muitas
informações sobre isso. Temos uma comparação com outros
tornados que é boa,
as consequências, a importância,
os danos, então é perfeita Vou apenas copiar esse URL e vamos até o
Go Studio e importaremos do URL. Vamos colar nosso
podcast assustador e escolher uma voz conversacional natural já que vamos fazer
um Lovell, confie em alguns,
não faça mal a ninguém. Nós fazemos nossa própria fortuna
e a chamamos de destino. Não devido à daraufina como. Olá e bem-vindo.
Pegue um café, acomode-se e relaxe. E
vamos conversar sobre isso. Gratidão é reclamação de riquezas. Uma única rosa pode ser meu jardim, um único amigo meu mundo. Fazemos nossa própria fortuna
e nivelamos, confiamos em alguns. Acho que estou gostando do
Charlie por enquanto, então vou
clicar no nome dele No momento, nem temos
várias vozes no URL, então isso não
será útil para nós. Eu vou fazer com que Charlie seja a voz
desse podcast primeiro. Quando estivermos satisfeitos com
a forma como ele
soa e com a forma como o podcast
é extraído, você pode ver
imediatamente que são 17 minutos. Se você tiver um texto mais longo,
ele será mais longo. aqui, ele está
tentando converter essa tabela em algo
coloquial Vou fazer com que
Chad GBT
retire os números e omita
os detalhes Como você pode ver, ele removeu
todos esses números e manteve apenas
algo mais natural. Ele manteve as datas, o número de milhas
e todas essas coisas. Você pode fazer isso e refinar
ainda mais se não quiser nenhum número nesta seção ou se quiser
retirar certas palavras Vou copiar
isso e colocá-lo em 11 laboratórios por aqui. Aqui ele fala sobre esse tornado e depois fala
sobre os outros quatro. Ok. Você pode ver
que ele também tem os títulos da página da
Wikipedia, mas queremos que pareça
um pouco mais normal. Vamos adicionar algumas palavras. A razão pela qual
estamos mudando do texto
normal para um título
é porque ele vai enfatizá-lo e lê-lo uma forma que nos moverá
para uma nova seção. Haverá
pausas e, normalmente, será um pouco
mais lento do que a forma como lê o
outro texto normal Agora, assim como
aprendemos anteriormente, você pode adicionar as pausas
e os efeitos sonoros,
mas, por enquanto, concentre-se apenas
em finalizar seu texto Se quiser, você
pode voltar ao Chat JBT e
pedir mais informações, talvez reações diferentes
ao que Charlie está dizendo Por enquanto,
vou finalizar o que Charlie diz e isso gera Enquanto isso está gerando,
vamos dar um nome a isso. Eu comando A e depois
gero mais uma vez. Vamos falar sobre o El
tornado de 2007 e suas consequências. O tornado El de 2007 foi um tornado pequeno, mas extremamente
poderoso e irregular que ocorreu no Canadá durante a
noite de sexta-feira, 22 de junho de 2007. O
poderoso
tornado Five que atingiu
a cidade de Eli, poderoso
tornado Five que atingiu na província
canadense de Manitoba,
40 quilômetros a oeste de Winnipeg, era conhecido por sua trajetória incomum, como foi durante sua trajetória, sua corda para como um tornado pequeno, mas extremamente
poderoso e irregular,
que ocorreu no Canadá
durante a
noite de sexta-feira, 22 de
junho de 2007. O
poderoso
tornado Five que atingiu
a cidade de Eli, na província
canadense de Manitoba,
40 quilômetros a oeste de Winnipeg,
era conhecido por sua trajetória incomum,
como foi durante sua trajetória, sua corda para
estrutura cônica, em
oposição a uma estrutura em cunha,
e como ela é única Mas qual foi a sinopse
meteorológica? Ok. Observe como ele pausou entre o
texto normal e os títulos Eu fiz o título dois, mas você também
pode fazer o título um. Qualquer um desses títulos significa
que a voz precisa fazer uma pausa
e enfatizar a mudança para um segmento diferente
do podcast Vamos começar por aqui,
já que foi aqui que o
pegamos do Taji BT e
vemos como soa normal Havia mais?
Sim, havia. Além do tornado
Eli F Five, mais
quatro tornados
também afetaram Canadá de 22 a 23 de junho Depois que o histórico
tornado F five atingiu Eli, Manitoba, outro poderoso
tornado atingiu apenas 10 milhas a oeste
perto de Oakville Classificado como F três, esse tornado
danificou árvores, dependências e algumas caixas de
armazenamento de grãos.
Agora que as informações
básicas estão ao meu gosto, agora
posso devolvê-las ao TPT para torná-las um
pouco mais humanas Isso adicionará ms, pausas, talvez um pouco de gagueira, qualquer coisa que o torne um podcast
real Porque, no momento, ele apenas
pegou as informações
desta página da web e as
converteu em voz Mas como
vamos fazer um podcast, queremos começar
com uma base sólida
e, assim que tivermos
as partes de Charlie colocadas corretamente, podemos adicionar os outros dois convidados. Vamos pegar tudo isso, depois voltar ao nosso bate-papo e
primeiro descrever o cenário depois colar um texto. Ok, vou deixar isso
rodar e, como você pode ver, presume-se que você queira que
esse seja o script, mas nós realmente não precisamos
desse recurso no momento Quando terminar de criar isso, vou remover esses segmentos para que sejam
apenas o texto por si só. Mas não
parece que isso vai
gerar mais. Vamos ver. Mas imediatamente, você pode
ver que ele está adicionando as palavras, os três pontos, traços e
enfatiza certas palavras, assim como um podcast normal Isso foi feito com a conversão
e, como você pode ver, não adicionamos mais
desses segmentos, então não precisamos
regenerar nada Vamos copiar esse corpo de texto. E substitua-o pelo
que temos aqui. Agora vamos usar os diferentes cabeçalhos
nos lugares em que queremos
que Charlie faça uma pausa Este é
definitivamente um começo assim. Aqui está outro segmento. Ok, então temos dois segmentos aqui sem contar o início. Vamos seguir em frente e
pressionar Comando ou Controle A e clicar em regenerar Ok, então vamos falar sobre o tornado Eli de 2007 e
o que aconteceu depois? Não foi um tornado qualquer. Quero dizer, este foi o primeiro tornado
oficial de F5 do
Canadá. E sim, pode
ter sido pequeno, mas era
ridiculamente poderoso. E, honestamente, simplesmente
estranho. Ele atingiu Ely Manitoba,
uma pequena cidade tranquila a cerca de
40 quilômetros a oeste de Winnipeg, na noite de 22 de junho
de 2007 Agora, aqui está a parte assustadora. Esse tornado não
seguiu as regras usuais. Tinha essa forma estranha de
corda, não a cunha enorme que
você esperaria de
algo tão forte,
e se movia lentamente, e se movia lentamente, estranhamente devagar. Foi torcido Vamos passar para
esta última frase. O dano total era estimado em cerca de $39 milhões naquela época, o que seria superior a
$56 milhões hoje Então, o que tornou aquele
dia tão volátil? Bem, meteorologicamente falando, configuração era como um
caos nos
livros didáticos Um sistema de baixa pressão veio
de Saskatchewan e uma frente quente estacionou ao norte de Eli
. E sim, as coisas explodiram. Agora, aqui está o que
aconteceu no chão. O tornado
pousou logo ao norte
do que é realmente importante
usar essas palavras de título, e essa é a
oportunidade perfeita para você adicionar pouco de música com uma
pausa ou alguns efeitos sonoros Mas, além disso,
você pode ver como o uso HGBT foi capaz de adicionar
aquele toque humano a Ele faz uma pausa em determinados momentos, mas fique à vontade para mover essas palavras para outros lugares ou simplesmente removê-las completamente. Mas, como este é
um podcast e estamos
tentando fazer parecer que tentando fazer parecer Charlie é apenas
um cara normal, isso funciona perfeitamente
para o nosso caso. Então, agora que terminamos a parte de
Charlie, vamos
adicionar nossos outros dois convidados. Então, isso é algo que
teríamos que
fazer com uma ferramenta diferente. E isso será para
a próxima lição.
23. Podcast assustador parte 2: Agora temos algo em nosso estúdio que chamamos de
retratar nosso podcast nativo Anteriormente, pegamos uma página
da Wikipedia e convertemos em um
podcast usando o JAGPT Agora, você pode
confiar totalmente em apenas 11 laboratórios para transformar aquela página
da Wikipédia em um podcast. No entanto, no meu caso, eu queria que eles
tivessem nosso anfitrião, que é Charlie Charlie,
para fazer mais pausas, algumas ms, outras para fazer com
que
soasse mais humano Mas você está totalmente
livre de nem mesmo usar o JAGPT e confiar apenas em 11 Então, agora vamos
partir daqui para criar um podcast. Imediatamente, você pode ver que podemos usar o projeto existente. Agora, você também
tinha a opção colocar sua página da Wikipédia aqui. No entanto, eu queria começar
do zero para que você pudesse ver a progressão e como fazer seus próprios
ajustes à medida que avançamos Vamos usar o Existing Project e escolher nosso podcast sobre tornados. Queremos manter isso
coloquial. Vamos esperar um pouco mais
porque foram 17 minutos. Nosso anfitrião ainda é Chris, mas temos um
convidado no momento. Então, vamos decidir
quem é nosso convidado. Ela desviou o olhar
do calçado arruinado, ainda lamentando muito Vamos pesquisar uma conversa.
Está acontecendo um Nadal. Se você passar toda a sua vida. Então eu vou com a Jessica. Você pode ver que ela tem
aquela etiqueta de conversação nela, então é perfeita E então o idioma
está em inglês. Se você quiser ter
algum tipo de foco, você pode colocar as palavras. Então, vamos colocar a palavra
tornado. Deixe-me ver. Vamos destacar os perigos de uma pausa
no tornado nos números,
eu acho, nos números de danos Acabei de dar ao ElevenLabs
duas instruções a seguir. Você pode ver começar
com alguma ordem de classificação, destacar, pausar e
dizer exatamente o que fazer Você pode adicionar quantos quiser, como
vimos anteriormente, ou excluir
os que não são mais necessários. Salve as alterações e
deixe-as gerar. Vou deixar isso funcionar,
pois é um pouco mais longo. Você pode ver que ele gerou
outro projeto aqui. Então, quando estiver pronto,
voltarei para que possamos ouvir
o que soa. Ok, nosso podcast está pronto. São 10 minutos e 24 segundos. Foi reduzido
dos 17 minutos, principalmente porque
encurtou os parágrafos Como você pode ver, não
há nenhum
desses parágrafos volumosos
que tínhamos Isso só mostra o quão incrível é
essa conversão de podcast em 11 voltas. E
olhe aqui. Eu até nos dei um título legal, o inesperado F five, um poder surpreendente de tornado, mesmo que
o chamássemos de podcast do tornado
ou algo assim. Quando eu passo o mouse sobre eles, eu posso ver quem está
dizendo o que verde é Chris e azul é Jessica Então, sem mudar nada, vamos ouvir o que esses
dois têm a dizer. Os tornados geralmente são medidos
em quilômetros de destruição. Mas em 2007, o tornado
mais poderoso
já registrado no Canadá era pouco
mais largo do que uma estrada de uma pista e reescreveu tudo o que pensávamos que sabíamos
sobre essas Bem, isso é
fascinante. algo tão
estreito tem tanto poder? Você sabe o que é realmente
alucinante sobre isso? Esse tornado F five
que atingiu Eli, Manitoba, tinha apenas 35 metros de
diâmetro em seu ponto mais forte, mas literalmente pegou casas
inteiras e as jogou no
ar como brinquedos Espere um pouco. F cinco. Essa é a
classificação mais alta possível, certo? Então essa foi uma pequena espiada. Eu não vou deixar você
ouvir a coisa toda. Mas se você
quiser pular, lembre-se de que há
um cronograma aqui embaixo que você pode simplesmente
colocar a
cabeça do prato e depois pular para talvez Chris ou Jessica
sempre que quiser Aqui, tudo está
no texto normal. Você pode ver o
atributo aqui, mas poderíamos mudar
a forma como eles o lêem mudando algumas coisas para
cabeçalhos. Então, vamos ver. Então, aqui está nossa transição
que tivemos inicialmente. Você pode ver que isso
meio que mudou isso. Inicialmente, foi como, mas
e os danos? Agora eles o transformaram, então de que tipo de
dano estamos
falando aqui com esse tipo
de destruição concentrada? Então, vamos mudar isso para o título um e depois
procurar outro. Isso é sobre os danos. Tudo bem, vou
manter esses dois como nossas principais transições e depois
simplesmente regenerar essa parte Bem, você não está
errado. A certa altura, ele simplesmente estacionou sobre
o moinho de farinha da cidade por
quatro minutos seguidos. Imagine ver um
tornado pairar no local, destruindo
metodicamente tudo abaixo dele Então, de que tipo de dano
estamos falando aqui? Com esse tipo de destruição
concentrada? Deixe-me pintar um quadro para você, e é aqui que os números
ficam realmente surpreendentes O dano total foi estimado
em $39 milhões em $2.007, que seria superior Mas aqui está a parte mais
incrível. Nem uma única pessoa morreu. Espere, o que? Como isso é
possível com um F cinco? Então, fizemos uma pausa com
o cabeçalho da mesma forma que fizemos com a
primeira ferramenta que usamos E eu esqueci de mencionar que pedimos
à ElevenLabs que
destacasse os danos Assim, você pode ver como ele
tem várias frases. Tivemos um aqui. Tem
outro aqui. Danos. Vamos ver. Mais danos. Está reiterando a parte danificada do podcast várias vezes. Você poderia voltar e
transformar isso em
outra coisa e realmente tornar
este podcast seu. Eu tenho todas essas palavras. O que eu quero fazer é talvez adicionar ainda mais pausas entre esses dois títulos, para
que seja realmente uma transição
completa Vamos adicionar uma pausa
aqui, 1 segundo, e depois mais um
ou mais um segundo E então outra coisa que
eu quero fazer é fazer uma introdução para Chris e Jessica e depois
trazer nossa terceira Mencionamos ter um
anfitrião e dois convidados. Então, vamos pegar o Inter
aqui mesmo. Olá, pessoal. Sou seu anfitrião. Chris. E isso é,
vou usar o título aqui. OK. Então, vamos mencionar Jessica e depois
encontrar outra voz Ondas caíram. Eu acho que Alexis é boa, então vamos dizer Jessica e
Alexis e depois fazer com que cada uma
delas se apresente Tudo bem. Então, devo dizer que tenho
quatro novas frases
ou linhas, que
torna tudo muito mais natural, considerando que
temos três pessoas
neste podcast. Agora, tudo o que você precisa
fazer é atribuir cada uma
dessas frases às suas linhas. Alexis é essa linha, na verdade. Quando eu li isso, pude
ver que não é Alexis, então vou
clicar uma vez sobre isso Nossas vozes estão aqui. Nós acidentalmente trouxemos
Archer, mas tudo bem. Vamos transformar isso em Chris. Aplique este à Jessica. Essa já é Alexis, e isso volta para
Chris. O resto é Chris. Aqui está Jessica reagindo. Vamos passar isso para Alexis. Basta ir e voltar até que tenhamos uma
conversa em andamento. Vendo como Chris é o anfitrião, todas essas linhas em que há muitas informações
sobre os tornados, estou atribuindo isso Jessica e Alexis estão apenas reagindo ao que ele diz
porque são as Vamos dois deles,
Alexis desta vez, e não fazer uma transição rotineira Ok, então temos boas idas e
vindas
entre nossos assuntos, e agora estamos prontos para
adicionar alguns efeitos sonoros. Quando ele está apresentando
o podcast, queremos que um áudio
seja reproduzido antes dele
e, talvez, nos títulos, coloque algum tipo de efeito sonoro, talvez um
intervalo comercial no meio Algo que fará com que
isso funcione como um podcast. Nós vamos fazer isso
na próxima lição. Apenas certifique-se de que,
ao final desta lição, você esteja satisfeito com as palavras que cada um dos convidados tem. Você pode até adicionar mais
pessoas a este podcast. Eu só vou
mantê-lo às três. Mas revise cada uma das palavras, verifique se elas pertencem
à pessoa que você deseja. E você não tem uma
pessoa aleatória em seu podcast. Quando eu removi Archer, você pode ver que ele não está mais aqui e eu só
tenho três pessoas Se você ver outra voz aqui, significa que
em algum lugar do seu podcast, você atribuiu essa
voz a um determinado texto. Aqui embaixo, novamente, você pode
ver uma transição colorida. Se você viu que há
muitos verdes consecutivos, isso é atribuído para
substituí-los com
uma voz diferente. Vamos para a
próxima lição, onde adicionamos nosso áudio e
terminamos esse podcast assustador.
24. Podcast assustador parte 3: Vou finalizar
nosso podcast assustador e adicionar alguns efeitos sonoros Anteriormente, pegamos
uma página da Wikipédia, convertemos em um podcast
conversacional
e a trouxemos aqui, onde
adicionamos outras duas vozes Tudo o que fiz agora foi colocar as pausas após os títulos, mas você pode adicionar mais
pausas onde quiser Mesmo entre as frases,
você está livre para fazer isso. Agora, o que vou fazer é fazer uma introdução para este podcast Então, logo antes de olá pessoal, vou colocar
o efeito sonoro. Vamos fazer um tornado ok. Gosto mais
do primeiro em termos de
duração, vamos fazer um mais curto. Olá a todos. Clique em aplicar. Depois de todos,
vou adicionar uma pausa, é essencialmente a introdução Então, aqui, podemos adicionar, vamos ver, um toque de bateria
ou um efeito sonoro de próxima página. Vamos fazer isso.
Para virar a página. Ok. E em termos
de duração , mais
uma vez, vou
fazer um pouco e não a frase
inteira. Gosto
mais do número três e não se esqueça de manter isso em
segredo, pois não
queremos que ele supere basicamente não
queremos que ele supere
nosso Cris. Tudo bem E então o que
vamos fazer é ajustar um pouco as vozes. A de Jessica é um
pouco exagerada, então vou
diminuir a estabilidade Desculpe, aumente
a estabilidade e deixe o tom dela
um pouco mais lento É seguro. Alexis estava bem, então não há necessidade de
fazer nada com ela Chris, eu também quero que a voz dele
seja um pouco mais lenta. Então salve e eu vou encontrar
outros lugares para adicionar uma pausa. Ok, então adicionamos
nosso efeito sonoro. O que vou
fazer agora é uma pequena seção disso gerar
uma pequena seção disso para que vocês não precisem ouvir
a coisa toda. Vamos fazer essa parte em
que tivemos o efeito sonoro, a pausa
e, claro, podemos ver como as vozes soam depois de
fazermos nossos ajustes Olá, pessoal. Sou
seu apresentador Chris, e este é o
inesperado F five, o podcast que relata os tornados
F cinco mais perigosos do mundo Estou aqui com nossos dois
convidados, Jessica e Alexis. Ei, pessoal, eu sou Jessica, e estou tão feliz de estar
aqui, e eu sou Alexis Estou muito animado para falar com vocês
sobre esses eventos assustadores. Tudo bem, vamos falar
sobre isso, então, pessoal. Começando com o que sabemos sobre os tornados.
Os tornados são frequentes Tudo bem, então isso
soa muito melhor. Eu sinto que quero mudar
a Alexis. Parece um
pouco robótico demais. Então, o que vou fazer
é ir até essa parte ou parte e encontrar outra
voz, basicamente. Vamos procurar uma
conversa e encontrar uma voz feminina que soe, você sabe, muito mais normal No oceano da competição,
seja um peixe veloz. O tesouro de Ocean Heights. Ele comprou o seu. Apenas
confie em si mesmo. Não há maior. Acho que Area soa bem aqui, então vamos trocar Alexis
por Area. Então vamos ver. Tudo o que precisamos fazer é pegar essa parte e clicar
em Aplicar com área. E depois repita para
o resto da coisa. Vou tentar
outra geração
para vocês, já que
adicionamos uma virada de página aqui. Tudo começa com Chris. Vamos
aplicar a Área aqui. Mais uma vez, quero uma voz
lenta e estável. Vamos fazer isso, é seguro, e depois fazer isso aqui. Acho que vou mudar isso para Jessica para que haja
alguma variedade Tudo bem, vamos pegar
essa parte inteira, gerar e
ouvir outro segmento. De que tipo de dano
estamos falando aqui? Com esse tipo de destruição
concentrada, deixe-me pintar um quadro para você. E é aí que os números
ficam realmente surpreendentes. O dano total foi estimado
em $39 milhões em $2.007, que seria superior Mas aqui está a parte mais
incrível. Nem uma única pessoa morreu. Espere. O que? Como isso é
possível com um F cinco? Você sabe, essa é a
verdadeira história aqui. É sobre a reunião de preparação. Mas antes de entrarmos
nisso, deixe-me explicar exatamente o que
tornou esse dia tão perfeito para a
formação de tornados, porque é fascinante do ponto de vista
meteorológico Hmm. Acho que
vários fatores precisavam se unir da maneira certa Oh, é melhor acreditar nisso. Tínhamos esse
sistema de baixa pressão saindo de temperaturas de Saskatchewan
na casa dos Isso é cerca de 80 Fahrenheit. E níveis de umidade que
fariam com que a floresta tropical parecesse seca Ok, e isso está
soando muito melhor. Acho
que a página virada precisa ser
movida um pouco, então eu poderia simplesmente
pegá-la aqui e
movê-la até o fim, talvez aqui Depois que ela disser a palavra
destruição, vire a página. Depois, eu continuaria alterando o resto do meu podcast, certificando-me de adicionar as
pausas onde fosse necessário
e, em seguida, ajustando
ainda mais minhas vozes se elas não estivessem
lendo Mas no meu caso, eles
leram tudo bem. Não precisei fazer
muitos ajustes no meu podcast assustador. E agora estamos basicamente prontos. Pegamos uma página da Wikipédia e a
transformamos em um podcast. O que eu poderia fazer é
exportá-lo como um único arquivo, p três, e depois
ouvi-lo quando eu quiser. Essa também é uma boa maneira pegar artigos
muito longos e transformá-los em um podcast para que você
possa ouvi-los quando estiver andando
ou em transporte. Isso conclui nosso
primeiro projeto. No próximo projeto,
vamos tentar fazer um tipo diferente de geração de voz
usando as mesmas ferramentas, mas em termos de aplicação,
será para algo diferente de um podcast. Eu
vou ver vocês lá.
25. Audiobook parte 1: Agora vamos passar
para um projeto diferente, que será criar um
audiolivro do zero. O que
vamos fazer primeiro é pegar aquele livro que estamos
tentando transformar em um audiolivro Estou começando aqui no ChachPT, mas isso
pressupõe que você já tenha um
livro que tenha o direito de transformar em um audiolivro ou que
tenha Só para praticar e para que vocês tenham alguma experiência
prática, vamos usar essa ferramenta para criar um livro com certas
palavras e instruções. Abra o Chat GPT e primeiro decida sobre o assunto do seu livro Você tem que saber o assunto, que tipo de livro é, quanto tempo tem e quem
é como os personagens. Uma coisa que você pode fazer
se não souber por onde
começar é fazer com que o Chat JBT forneça algumas ideias sobre o que você deve transformar em
um livro no começo Por exemplo, se você tem um canal no YouTube em que
fala muito sobre imóveis, pode acessar o Chat GPT e
dar uma solicitação como essa Eu entro e depois vamos
receber algumas sugestões. A partir daí, podemos
continuar. O interessante
é que Chat Tu But lhe dará o
título e depois nos dirá por que funciona e alguns
detalhes desse livro. Temos o que eles não ensinam na escola,
de aluguel a riquezas, civilizado, diário imobiliário e todas essas coisas O que você também pode fazer é
combinar essas ideias em um grande livro ou talvez apenas pegar alguns desses pontos
e substituí-los
por outra coisa Vamos ver. Acho que gosto do guia de sobrevivência do House
Hunter. Esse nome é muito bom para mim. Eu vou dizer que gosto do número um. No entanto, remova a parte do questionário. E substitua-o por, vamos
ver o que podemos substituí-lo
pelo jargão
imobiliário de cotação Aqui eu acabei de fazer uma pequena troca e agora está
me dando mais detalhes. Quem é o público? Para alguns compradores, locatários, navegadores
imobiliários. Se você já
tem seu canal, verifique
se esse
é realmente o seu público. Se não estiver, você
pode trocá-lo. Por exemplo,
direi que meu público inclui adultos de meia idade
a jovens. Faixa etária, posso colocar 50, talvez 25 a 40, vamos ver. Então, essa é apenas uma faixa etária
aleatória. Aqueles que moram na Califórnia, Los Angeles, Califórnia,
aqueles que não têm filhos e cachorros. Estou ficando mais específico
em relação a este livro. Esse é o nosso público
e vamos ver. Talvez possamos acrescentar mais uma coisa. E trabalhe na indústria
da moda. Aqui está um trecho interessante do que
ele faz, o tom e a vibração. Pense em um amigo estiloso
que já comprou um lugar e está te
guiando até Macha Linguagem nítida, mas casual conversas
reais sobre dinheiro, referências ao design de moda
e peculiaridades específicas de LA Então esse é o capítulo. Há dez capítulos,
o que é bom. E agora que
parece que esse vai
ser um bom livro, vou especificar
de que ponto de vista isso foi escrito ou se não há nenhum
personagem. Então, por fim, quanto
tempo dura esse livro? Digamos que, do ponto de vista de
quem é
este livro, acho que essa pessoa, uma linguagem casual
afiada é boa. Mas podemos fazer com que o
narrador use esse. Mas faça deles um agente imobiliário bem
informado que saiba muito sobre
esse público em particular. Então me dê apenas
três capítulos, totalizando 50 páginas Faça desta uma
leitura rápida e divertida para o meu público. Então, esta será uma página
totalmente diferente e aqui os capítulos de Armour Como você pode ver, está me
dando pontos principais e você
pode manter essa ideia Você pode ver que está nos dando um trecho, resumo ou O que eu quero fazer é converter esses marcadores
em parágrafos Vamos fechar isso bem rápido, volte aqui e peça uma versão
completa. Isso é bom. Dê-me a
versão completa em parágrafos. Então eu vou reduzi-lo ainda mais. Então, vou deixar isso
funcionar e depois voltarei para mostrar a aparência do nosso
script. Então, se precisarmos
fazer alguma alteração, podemos fazer isso antes de
mudarmos para a ElevenLabs Ok. Então, aqui está
meu livro agora. Não é muito longo,
o que é perfeito. Mas, como você pode ver, passou de marcadores para parágrafos
reais Agora, lembre-se de
que você deseja seja um audiolivro,
portanto, certifique-se de que o seu
tenha as indicações para os capítulos e qualquer
outra coisa que você queira incluir. Você poderia ter marcadores, mas eu recomendaria
colocá-los entre os parágrafos para que seja um audiolivro
mais natural E esse é o
nome do nosso livro. Na próxima lição,
vamos colocar isso no ElevenLabs e começar a
combinar esse ElevenLabs e começar áudio para que se encaixe perfeitamente nesse tom e para nosso público, que é
gente que está procurando um cara nobs
para
comprar Vamos passar para
a próxima lição.
26. Audiobook parte 2: Tudo bem. Agora que
temos nosso livro, vou simplesmente copiar
tudo daqui. Acho que
tudo isso é o livro, então você pode clicar em
copiar aqui. Vá para o estúdio e
crie um audiolivro. Portanto, o upload de um
documento é opcional. Também podemos copiar e colar. Então, não vamos fazer nada aqui, mas verificar qual
voz queremos usar. Então, vamos procurar narrativas
e ver o que temos. Ela desviou o olhar de
seu Deus arruinado que
lhe deu um fato Deixe minha voz se tornar sua voz. As pessoas que eu
cruzei. Deixe minha voz ser. Então, acho que, para mim,
o principal é não entender por que
as pessoas ficam chateadas. É como se Theresa
tivesse rasgado a marcha. Rede. Sou Sophie Lang. Olá e bem-vindo.
Pegue um café e acomode-se. Vou escolher esse cara
que não usamos
no último projeto só
para dar uma chance a ele, e então podemos clicar em Criar. Então, chegamos a esta página para que você também possa
entrar com o estúdio, mas simplesmente
colaremos o que obtivemos do Chat
GPT nesta caixa Então observe que aqui
temos mais um capítulo. Temos três capítulos. Então, vamos acessar o capítulo
Plus aqui e copiar o capítulo
dois e posteriores. Exclua-o deste, vá
para o Capítulo dois, cole-o e copie o Capítulo
três para outro
capítulo. Lá vamos nós. Temos os capítulos um, dois, três, e vou
combinar os nomes
aqui com o que
temos aqui. Vá até os três
pequenos pontos, renomeie, cole com Command
ou Control V, clique e
repita esse processo Concluímos todos os nossos capítulos. Vou remover algumas das coisas que
eu não preciso desse cara,
em vez disso, vou chamá-las de
prefácio. Tudo bem Esse é o título do nosso livro. Vou transformar esse
título em um para que ele faça pausa e registre isso
como uma coisa separada Em termos de voz, vamos diminuir a velocidade e mantê-la mais estável
e profissional. Vou diminuir um pouco o
áudio. É seguro e vamos gerar. Vamos começar
gerando pequenos bits e depois
fazer nossas alterações. Vou pegar todos esses
caras e depois gerar. Guia de sobrevivência do House Hunters, edição LA. Um guia OBS para comprar
sua primeira casa em Los Angeles sem perder a calma,
o cachorro ou a sanidade Prefácio. Ei, eu não sou sua mãe, sua consultora financeira
ou aquele cara no YouTube que acha que toda
casa deveria entrar em pânico Ok, então imediatamente, percebi que quero que essa
linha venha logo depois disso. Então, vamos
excluí-lo e abri-lo. Colin, coloque aqui. E acho que vou manter e mudar isso para
talvez
um aviso legal Então, já que é um
homem, vamos fazer Tad. Então, o que vou fazer
é fazer mais uma mudança, aumentar o exagero de estilo e o áudio ficar
um pouco baixo demais. Vamos trazer o indicador de reprodução de
volta e refazer essa parte. Guia de sobrevivência do House Hunters, edição de LA, guia da
ANBS para comprar
sua primeira casa em Los Angeles sem perder
seu cachorro legal ou Isenção de responsabilidade. Ei,
eu não sou seu pai, seu consultor financeiro
ou aquele cara no YouTube, que acha que toda casa
deveria ter uma sala de pânico. Sou uma corretora imobiliária que
ajudou pessoas como você, criativas estilosas,
donas de cães, conciliar um sonho e um prazo, comprar sua primeira casa em LA sem sofrer Estou aqui para fazer com que todo
esse processo pareça menos opressor, um pouco mais empoderador E, honestamente, meio divertido. Certo, então isso é muito melhor. E agora podemos passar para a forma como ele lê os
diferentes capítulos. Então, vou continuar
pressionando play, para que possamos ver como isso soa. Capítulo um, bem-vindo ao circo de
LA, também conhecido como The Market. Então, para o título, deve
haver uma pausa aqui. Isso é o que eu vou fazer. Uma pausa de cinco segundos,
meio segundo. E então, aqui, eu vou
fazer a mesma coisa. Ok, vamos ouvir
isso mais uma vez. Capítulo um, bem-vindo
ao circo de LA, também conhecido como o mercado. Vamos esclarecer
uma coisa. Comprar uma casa em Los Angeles não é para
quem tem coração fraco Esta é a cidade onde
um artesão de dois quartos pode custar mais do que
toda a sua educação universitária, e você ainda precisará pedir a
alguém para estacionar A competição é selvagem. Os compradores em dinheiro estão em toda parte, e o mercado muda
mais rápido do que sua cafeteria
pop-up favorita fechando
para reformas. Certo, e isso é muito bom. Então, o que você vai fazer é continuar construindo seus
capítulos, se quiser Mas, honestamente, como o ElevenLabs tem uma ferramenta de áudio integrada, não
há muito o que fazer Então, basta declarar
seus capítulos, adicionar uma pausa sempre que quiser e
ajustar Agora, para o título nos títulos
dos capítulos, farei a mesma
coisa em que adicionamos uma pausa Deixe-me ir até aqui. Este é o título
três. Mantenha as coisas consistentes para que sua
voz possa lê-las da mesma forma. Vamos adicionar outra pausa aqui. Eu vou fazer talvez 0,4 segundos,
e depois o último. Mais uma vez, cabeçalho
três, outra pausa. Agora que tenho todas as minhas
pausas e todo o meu texto, posso
exportar isso e talvez em um
software diferente emparelhá-lo com uma música, se quiser ou
adicionar efeitos sonoros, como
já aprendemos a fazer No entanto, vou
deixar isso claro, porque é assim
que eu
prefiro meus audiolivros, mas você é livre para fazer
o que quiser. Porque você sabe como usar cada uma
dessas ferramentas. É assim que podemos
criar um audiolivro. Você começou no HAGPT
encontrando ideias para livros. Adaptamos essas ideias a um
nicho de público muito específico. Uma vez que tivemos isso,
recebemos alguns pontos principais. Transformamos esses pontos
em parágrafos, limitamos isso a 25 páginas, e depois os trouxemos
para 11 laboratórios, onde
declaramos os capítulos e
iniciamos Agora Archer está lendo nosso
livro para o público. Espero que vocês gostem
desse pequeno projeto. Vamos passar para
a próxima lição.
27. ElevenReader: Depois de ter um arquivo de história, você pode transformá-lo facilmente em um audiolivro usando o ElevenLabs Vimos como fazer isso, mas houve uma atualização, que é o ElevenReader Então, basicamente, você pode
enviar seu eBook, e ele começará a narrá-lo para você e você poderá
aprender com essa Então, anteriormente,
foi para aqui que fomos. Carregaríamos nosso arquivo PDF ou EPAP para o modelo de escolha de
estilo de narração Mas agora, quando você desce até aqui, pode fazer o upload da mesma história e enviá-la
para esta plataforma. Então, eu tenho um exemplo de história em dot txDFmat Vou fazer o upload disso aqui. Acabei
de fazer o upload do meu computador e vamos clicar em
criar e pré-visualizar o livro.
Então, aqui está minha história. É, você sabe,
escrito linha por linha, e estamos recebendo nossos
diferentes personagens. A primeira é, eu poderia, dar um nome a ela, já
que temos dois personagens, podemos fazer com que
sejam vários personagens, narradores ou apenas um Então, isso depende de você. Mas se
você clicar em qualquer um deles, poderá atribuir quem está falando. Aqui eu tenho algumas tags
sobre os personagens. Eu realmente não preciso que isso
seja definido em nenhum lugar. Então, vamos excluir isso
usando
a tecla backspace Assim, você pode facilmente fazer
ajustes nesta página. E a mesma coisa aqui. Esse é o nome da nossa história. Role para baixo. Todo o
resto parece bom. Agora, o que poderíamos fazer depois
disso é brincar
com o volume. Isso é muito parecido
com o layout do estúdio, mas estamos apenas adquirindo
esse recurso de e-book Então, se quiser, você pode adicionar
algumas músicas daqui, criar a sua própria ou arrastar uma para dentro. Você pode criar personagens
diferentes. Então esse é o
narrador atual de uma história. A lanterna na
beira do mar. Mara encontrou a lanterna
em uma terça-feira chuvosa. Então, isso aqui
não é algo que eu quero. Eu quero algo
um pouco mais profundo. Então, eu vou aqui
e mudo a voz. Então, vamos para o Explore. Vamos usar o inglês, ver se há uma opção de
audiolivro Quero ver uma prévia primeiro. Ne iguodaTokeViacos, OEtoato Mega Air. Vamos apenas
ter certeza de que é inglês. Os ventos das terras entre o
sussurro de suas ações. Não tenha medo de perguntar em grande parte. Então, o que vou fazer
é clicar em Marcus. Essa é a voz que eu quero,
e basicamente vai
transferir a narração
de Eric para Então, vamos lá.
Agora tudo está azul, e poderíamos fazer uma
pequena prévia aqui. Mara encontrou a lanterna
em uma terça-feira chuvosa, meio enterrada sob
os degraus de madeira do de Old Harbor Ela chegou lá
procurando abrigo
contra a tempestade, não um tesouro. Mas a pequena lâmpada de latão
chamou sua atenção. Então, quando estiver satisfeito
com a história, o discurso, o tipo de voz, agora
posso clicar em Exportar. Posso exportá-lo como vimos
como um áudio ou uma estrutura de arquivo
diferente, mas quero apontar
para o ElevenReader agora Então, o legal disso é que você pode ganhar
com esse recurso. Você ganha 0,25/hora, que é transmitido e 60 Agora, esta é uma história de exemplo, mas vamos
experimentá-la de qualquer maneira. Você pode fazer uma narração dinâmica, para que
as pessoas que baixam sua história possam escolher
suas próprias vozes
e, dessa forma, há mais
flexibilidade do lado delas, mas você também pode simplesmente
publicar o que você tem e não dar a
elas essa opção Então, vou fazer um áudio
original para isso. Podemos clicar em
Publicar. Tudo bem. Então, quando chegarmos
aqui, podemos
dar mais informações
sobre o livro de histórias Podemos criar nosso
perfil de autor que somos nós. Faça upload de sua foto,
dê
a si mesmo um nome , o idioma do seu perfil e, se
você tiver um portfólio, poderá colocar
o URL e uma biografia. Eu só vou fazer algumas coisas
aleatórias agora. Diga que meu nome é Megan. Você não precisa
preencher o resto. Passando para o próximo, podemos falar sobre o
livro em si, a história. Esses serão os metadados. Sobre a categoria, o
gênero e tudo isso. E no lado direito, podemos ver a história sendo enviada. Então, enquanto isso estiver carregando, vou até aqui
e você pode compartilhar esse código QR com as pessoas ou
baixar o aplicativo você mesmo Mas, voltando atrás, agora podemos
colocar um nome, uma imagem de capa, legendas, nossa descrição do
perfil de autor do livro, e é praticamente como
qualquer outra plataforma de e-books A única diferença
é que você fez a voz completamente
com o ElevenLabs Essa é outra saída que você pode fazer com
suas criações aqui Não vou ler tudo
porque vai
ser como detalhes de pagamento, detalhes de
distribuição, e isso,
como eu disse, é um exemplo de história Mas se você estiver
interessado, você pode levar seus audiolivros um passo adiante e
enviá-los para o ElevenReader Também há outras opções se você quiser publicar no Spotify Há em Audio, o
vídeo e o Audio Native. Então, essas são coisas muito legais e você pode
explorá-las ainda mais.
28. Anúncio parte 1: nosso último projeto, incluiremos algumas
coisas que estão fora do ElevenLabs e veremos como
podemos combiná-las em um único vídeo O que vamos fazer é obter algumas imagens
da Internet Isso pode ser feito
com outra ferramenta de IA como runway ou Mid Journey,
ou você pode usar vídeos
livres de direitos autorais da Pexels,
combiná-los e, em seguida, criar uma filmagem dublada, um áudio dubb para sua filmagem ,
como runway ou Mid Journey,
ou você pode usar vídeos
livres de direitos autorais da Pexels,
combiná-los e, em seguida,
criar uma filmagem dublada, um áudio dubb para sua filmagem. Primeiro, vamos
decidir sobre o que é o
vídeo. Vou ver o vídeo do
Pexels. Aqui mesmo. E enquanto estamos aqui, vamos
pegar uma guia de áudio também. Estou pressionando o Command para abrir uma nova guia, para que também
possamos ouvir música
lá. Então eu quis dizer Pixabe para áudio
e depois pixels para vídeo. Então, acho que o que vou fazer é um anúncio em que primeiro o
façamos em inglês Talvez tenhamos algumas
fotos da natureza e depois temos uma
música animada ao fundo Assim que tivermos nosso áudio em inglês, vamos traduzi-lo para
um idioma diferente para que seja como um comercial
multilíngue Vamos tirar algumas
fotos da natureza ou talvez fazer turismo. Este será um anúncio turístico, e há muitos vídeos gratuitos
aqui para você usar Apenas certifique-se de que, se você
planeja publicá-lo em qualquer lugar, dê crédito ao criador. Todas as pessoas que
fizeram esses vídeos estão no canto inferior esquerdo. Vamos baixar alguns deles. Vou entrar e
pegar um arquivo menos pesado. Aí está o nosso primeiro.
Esse é o nosso segundo. Vamos fazer uma
foto de uma ilha e tentar obter ângulos
diferentes, porque é
isso que os comerciais geralmente fazem Alguns pássaros aqui, ok. Eu tenho um monte de vídeos. Vou até o Chat
GPT para obter um script bem rápido Sinta-se à vontade para fazer seu próprio roteiro. Estou fazendo isso apenas para os
propósitos deste curso. Digamos que eu queira
fazer um anúncio
de hoops 60, digamos 30/32 Ajude-me a escrever um roteiro. E então vamos dizer para quem
é isso e qual deve ser o roteiro que eu quero
enfatizar : quem você é
em qualquer lugar e ser livre. Use um tom inspirador e
profissional que motive o público a começar
a viajar Dê uma mensagem no
final do exemplo de canal. Vamos supor que um exemplo de canal
seja meu canal do YouTube. Muito curto e temos
algumas frases. Vou fazer com que o
ChachBT remova esses trechos e
me dê Muito curto, muito
simples, e isso funciona bem
com nossas fotos de turismo Isso é exatamente o que
eu vou fazer. Vamos copiar isso e
depois começar a dublagem, criar um canal de exemplo de dublagem, idioma de
origem em inglês e digamos que o
outro seja Francês ou espanhol, qualquer
outro idioma que você quiser. Agora, a fonte do vídeo, é
aqui que
teremos que combinar nossos vídeos e depois
colocá-los em um arquivo. Você pode usar qualquer software
que quiser para isso. Você está basicamente pegando os vídeos que baixou, juntando-os e depois exportando-os
para esta Seja qual for a fonte escolhida, você ainda precisará desse arquivo O que vou fazer é acessar Premiere Pro e juntar esses
quatro clipes, e depois voltarei
para que possamos carregá-los aqui Junte os clipes. Eu aguentei 35 segundos, mas fiz isso para o
caso de querer
estender uma das dublagens ou
adicionar alguma música dramática Como você pode ver, é apenas uma
compilação muito simples desses vídeos, sem transições nem Mas uma coisa a ter em mente é manter os
clipes de origem semelhantes Todos são destinos
turísticos lentos e, como estou falando sobre liberdade individual
e ser quem você é, tenho pessoas andando
em lugares diferentes Então, a última parte em que me
inscrevo em nosso canal, é uma foto remota dessa profundidade. Mais tarde, eu poderia colocar
texto e outras coisas. Agora que tenho meu clipe base, antes de começar a dublagem, vou
pegar uma música de fundo Eu esqueci de fazer isso.
Você pode usar o Pixaba Tem música gratuita e sem direitos autorais. Novamente, se você planeja
publicar isso em qualquer lugar, não
se esqueça de atribuir os artistas que você
pode ver aqui. Vamos procurar um comercial
ou vamos dar uma olhada aqui. Vou usar piano. Esse áudio funciona para mim. Você também pode procurar outras
coisas, como música de viagem, música de
registro, qualquer
outra coisa que quiser. E agora que tenho
minhas coisas básicas, vou começar a dublar
e começar a preenchê-las Você pode colocar a música de
fundo no próprio arquivo de vídeo, então você só está
enviando uma coisa, mas vou usar o manual
para que eu possa ter
a opção
sobre as camadas Agora que tenho meus arquivos de origem, o arquivo de vídeo e
o arquivo de áudio, podemos prosseguir e
começar a fazer a dublagem Nos vemos na
próxima lição, onde faremos
exatamente isso e finalizaremos nosso
exemplo de anúncio de canal
29. Publicidade parte 2: Bem vindo de volta.
Na última lição, criamos um anúncio e agora é hora de
realmente criar o texto,
o texto em voz, o texto em voz, e depois fazer um esboço de espanhol
ou outro
esboço de idioma em cima dele Agora, antes de entrar nisso, quero tentar fazer
uma música para esse anúncio. Nós baixamos aquela música
suave
de piano do Pixabe na lição
anterior, mas você também tem a opção gerar música aqui Então, vamos abrir isso em uma nova guia. Então você tem variação, nós simplesmente gostamos das
diferentes versões que
você pode criar. Essa
é a duração. Vou configurá-lo para 30 segundos
porque esse é o meu anúncio, mas você pode colocá-lo no modo
automático ou em qualquer outro valor. Esses são seus projetos recentes, mas tudo que você precisa fazer
é descrever sua música. Vamos fazer uma coisa inspiradora vamos tentar algo
assim e também
podemos mudá-la,
se não for do nosso agrado Eu o configurei para uma variante e você pode ver que estou
comprando apenas uma no momento e, essencialmente,
estamos fazendo as diferentes peças feitas para nós. 30 segundos, como pedimos. E esses são os estilos
que excluem estilos, você sabe, coisas que não
pedimos Pedimos um filme de
piano inspirador, mas obviamente não pedimos
uma guitarra de rock ou
algo parecido Em seguida, temos as
diferentes seções. Vamos ouvir nossa primeira variante e ver com o que estamos lidando. Na verdade, foi muito bom. Observe aqui que é interessante. Eu adicionei um texto de amostra para que pudéssemos imaginar
melhor aquela
narração nesta introdução Para mim, isso é perfeito, mas se você quiser
mudar isso, você pode continuar
essa conversa, que significa adicionar
uma nova seção, talvez você queira outra coisa, clicamos em mais e você
adiciona uma nova seção, uma seção remix
otimista
ou algo assim, então podemos mais uma vez
incluir e excluir Então é assim que você muda
a composição da sua música. Quando terminar,
vou
deletar essa seção extra. Você pode clicar em Baixar ou
compartilhar com outras pessoas. Então, quando eu clico em Compartilhar,
é como
uma biblioteca de áudio da ElevenLabs Você pode colocar o título da música, dar um pouco de cor
e, em seguida, podemos gerar
o link para essa música, pré-visualizá-la e exportar. Então, quando você clica em Exportar, ela realmente exporta essa
animação. Acabei de baixá-lo. Vamos ver o que temos. Então, isso é muito legal.
Acabei de fazer tudo isso com IA. Ok, essa é a minha
música para o anúncio. Sinta-se à vontade para continuar usando as músicas que você baixou
do Pixabay, combine-as Mas eu só
queria mostrar a vocês que esse produto existe. Agora podemos acessar a conversão de texto em fala e colar Ok, então eu voltei para Chachi
BT e recebi nosso roteiro. Vamos
escolher uma voz
um pouco profunda, de tom
muito lento, confiante e igual aos clássicos comerciais de
viagens comerciais que você vê na TV Então, vamos procurar e-mails
diretos, eu acho. A vida é como a água. Esta é a sua profundidade. Foi um daqueles raros sorrisos com uma qualidade de garantia
eterna com uma qualidade de garantia
eterna.
Bem-vindo à minha demonstração. Uma voz que não fala apenas. Olá. Esse é o Dante Com um tom profundo e descontraído. O mundo do artificial. Ok, eu acho que eu realmente
gosto. Olá. Isso é com um Angelo profundo. E então tivemos Ei, pessoal. A vida é assim. Então era
um desses Seko, eu acho, é assim que
você diz o nome dele Vamos experimentar os dois e
ver qual funciona melhor. Vamos clicar em adicionar
às Minhas vozes e gerar primeiro para
ver como ele lida com isso. Vou tornar isso um pouco mais lento porque ele
falou um pouco rápido quando eu fiz a prévia,
e então podemos decidir Há uma versão sua que está esperando para ser
desbloqueada lá fora Quando você viaja, você
não escapa de quem você é. Você se torna mais disso. Ok, então esse não é o
som que eu estou procurando. Ok, então este é um exemplo de quando você pode
realmente criar sua própria voz
em vez de
pesquisar entre as milhares
de vozes disponíveis. Então, o que eu vou fazer
é ir para casa, que eu
abri aqui e ir para o design de voz. Então, vamos ver se temos algo para começar,
será a voz do trailer. Digamos que uma voz masculina dramática. E então aqui está o que temos. Em um mundo à
beira do caos, um herói surgirá Prepare-se para uma história épica em um mundo
à beira do caos Em um mundo à beira do abismo. Ok, então isso é dar
um pouco mais, você sabe, de suspense e ação Então, na verdade, vou
copiar nosso script e
colocá-lo na pré-visualização da textura e
dar a isso uma coisa diferente. Então, uma voz masculina dramática
diz uma voz masculina profunda. Inspiração e
anúncios de viagens. Vamos tentar isso. Há uma versão sua que está esperando para ser
desbloqueada lá fora Quando você viaja, você não escapa de quem existe Há uma versão de você que vamos tentar outra coisa. Digamos, voz masculina lenta e
confiante. Então, vamos ao Chat GBT
e fazer com que ele
descreva basicamente aquela voz clássica de anúncio
de viagem Aqueles que são,
tipo, você sabe,
lentos, são inspiradores,
profundos, confiantes Mas eu só tenho
que colocar esse som em palavras. Então, digamos que eu esteja tentando
criar uma voz com 11 voltas,
ElevenLabs, para este Isso é o que eu tenho agora. Ajude-me a me aproximar dos comerciais de viagens
clássicos. Então isso é perfeito,
National Geographic. É exatamente isso que
estou tentando fazer. Agora você pode ver que pegou essa frase e
a transformou em mais. Voz masculina,
ritmo lento e confiante, tom
caloroso e rico, e
eu vou copiar isso. Se percebermos que ele não está
fornecendo exatamente o que
precisamos, podemos simplesmente seguir
o aviso aos poucos. Mas, por enquanto, vamos ver qual o resultado direto
do uso do HachPT E lembre-se de que temos as configurações para
você sentar, trabalhar com o volume
e todas essas coisas Vou apenas manter
tudo no padrão. Há uma versão sua que está esperando para ser
desbloqueada lá fora Quando você viaja, há uma versão sua que está
esperando para ser desbloqueada Há uma versão de você. Ok, então é definitivamente
muito melhor, mas é um pouco lento demais. Então, vamos tentar corrigir
isso aqui, e na verdade vou
adicionar uma voz britânica aqui. Voz masculina britânica,
ritmo lento, tom enriquecido com os braços. Remova essa linha. Então, vamos
remover a parte da articulação E veja o que temos. Há uma versão sua que
está esperando para ser desbloqueada lá fora.
Quando você viaja. Há uma versão sua
que está esperando para ser divertida Há uma versão que está esperando para
ser desbloqueada lá fora Ok, então esse
é muito bom, mas eu só quero aprofundar um pouco mais. Então, voz masculina profunda britânica. Apenas em termos de tom, vou tentar
gerar esse primeiro, e depois criaremos outro. Então, digamos que viaje
no Voice One. O idioma é inglês, o
sotaque é britânico. Salve essa voz. Eu vou para uma janela diferente
enquanto isso acontece. Então, vamos substituir
esse prompt nossa voz masculina profunda e
depois inserir nosso roteiro. Há uma versão sua que
está esperando para ser desbloqueada lá fora Há uma versão de você que está esperando Há uma
versão de você que está esperando Há uma
versão de você Ok, esses três são muito bons. Vou voltar
e ouvir nossa música
para poder
comparar e decidir. Vamos abri-lo
aqui mesmo. Esse é o vídeo. Há uma versão sua
que está esperando para ser desbloqueada. Há uma versão de
você que está esperando. Há uma versão de
você que está esperando. Há uma versão sua
que está esperando para ser desbloqueada. Ok, acho que
vou usar a voz. Há uma versão sua, vamos selecioná-la e chamá-la de
Travel ad voice two, British. E aí está. Então agora temos nossa música
e nossa própria voz. Anteriormente, fizemos nosso vídeo e agora é hora de juntar
tudo e depois fazer nossa tradução para o espanhol ou qualquer outro
idioma que você escolher. Então, vou ver se é
na próxima lição que
faremos exatamente isso.
30. Publicidade parte 3: Ok, vamos
traduzir nosso vídeo. Antes desta aula,
eu apenas combinei meu clipe base e o áudio
em si, não a música. E isso é essencialmente
o que eu tenho. Há uma versão sua
que está esperando para ser desbloqueada. Lá fora. Você desaprende, você os respira também. Então, a razão pela qual fiz
isso primeiro é porque ElevenLabs terá
mais facilidade em traduzir, e isso evitará o
trabalho de enviar o vídeo
e tentar combinar a palavra
que você deseja naquele exato minuto Você pode
pular isso e simplesmente enviar seu áudio
primeiro na dublagem Então, quando você acessa aqui, quando
quiser criar uma dublagem, poderá fazer o upload da fonte
de áudio ou vídeo Então, estou criando uma fonte de vídeo porque ela tem o
áudio anexado a ela, mas você pode simplesmente fazer o áudio e adicionar o vídeo mais tarde. Eu sugiro sempre começar
com uma fonte de vídeo. Vamos chamar esse exemplo
de canal do inglês para o
idioma que você preferir, e eu vou enviar esse mesmo
vídeo. Aí está. Tem a ideia mais uma vez. Vamos criar um projeto de dublagem. E se você quiser economizar o uso, pode ter a marca d'água
ElevenLabs, mas vou
deixar como está. Se você
quiser experimentar e não tiver certeza
sobre seu vídeo, basta verificar isso e você
economizará muitos créditos Número de alto-falantes, só temos um e, em seguida, queremos que
toda a gama seja dublada, e pronto. Vamos clicar em Criar. Ele fará o upload
deste vídeo e iniciará a tradução
do inglês para o francês. Tudo bem. Então, vou
esperar que isso aconteça. Não deve demorar muito, e então eu
volto logo para que possamos continuar. O processamento está concluído. Vou apenas abri-lo
e ver nossas traduções. No momento, estamos familiarizados
com essa interface. Você tem o original,
que é inglês, e depois você tem o francês. Então, quando você vai para o francês,
você pode ver como ele traduziu a
versão em inglês para aqui. Novamente, você pode editar isso se souber francês e estiver
errado ou se tiver transcrito as palavras
em inglês da maneira errada Eu só vou
verificar isso novamente. Ok, então não há muitos
textos para lidar, mas está tudo correto, pelo menos. Então, vamos ao original
e tentemos adicionar nossa música. Então, tudo que você precisa fazer é colocá-lo
aqui em primeiro plano Você pode fazer o upload
de um áudio aqui, então traga a música. Aí está. Você pode ver que está até mesmo nos dizendo para importar algo sem um alto-falante, porque não transcreverá isso.
Aí está minha música. Eu poderia renomear isso, clicar no nome,
chamar isso de Música Esse é um áudio importado. Se esse
vídeo original tivesse alguma música
, teria
aparecido aqui em primeiro plano Mas como a nossa não
tinha nenhum tipo de música, é por isso
que está vazia. Vamos jogar isso
e ver se queremos
mover alguma coisa. Há uma versão sua que
está esperando para ser
desbloqueada quando você viaja. Fuja. imediato, percebi
que a música está
muito alta e, apenas olhando
visualmente, o vídeo de fundo
termina nesse momento, mas o alto-falante e o
áudio terminam muito mais cedo. Agora, com a parte do alto-falante, não
é grande coisa,
porque você quer algumas pausas naturais e, quando
eles pedem que você
se inscreva
em um canal de exemplo, você quer que não haja
um pouco de nada até
o final do vídeo, para que ele termine de forma suave Mas para a música,
poderíamos desacelerar isso
pegando a vantagem aqui e
combinando-a com nosso vídeo Ao fazer isso,
também diminuirá
o tom de qualquer áudio que você fizer, então tenha isso em mente. Mas porque eu tenho um pouco de
piano e violino, isso não vai
ser um problema para mim. Claro, eu não
quero exagerar. Deixe-me mostrar
como
isso soa aqui sem o alto-falante. Você pode ver que a música
ainda é praticamente a mesma. Só que o
tom é diferente. Mas se eu exagerar ou
se eu for para o outro lado, eu aperto, ainda é música É simplesmente muito diferente. Portanto, tenha isso em mente. Quando você fizer isso,
vou pressionar Command ou Control Z para desfazer Agora, a música também está
um pouco alta demais. Viaje, você não escapa. Queremos que a
voz do palestrante seja a parte principal. Então, basta clicar nesse áudio
e reduzir o volume. Você brinca com
ele até ficar perfeito. Torne-se mais disso. Você aprende, você desaprende, você respira mais facilmente Seja quem você é em qualquer lugar. Isso é muito melhor. Agora eu tenho meu falante de inglês e minha música. É hora de adicionar
algum efeito sonoro. Com os comerciais,
você quer que
os espectadores
se imaginem nesse cenário Já que estamos
falando de viagens, temos um cenário
de balões,
que podem ser marinhos, todas essas coisas, podemos adicionar e gerar efeitos
sonoros para colocar
entre esses clipes Então, vamos rolar para baixo aqui. Você pode ver em Sex track. Quando você clica nele uma vez,
ele apenas cria a faixa e essa barra de tela permite gerar
esses efeitos sonoros. Deixe-me primeiro ver onde eu quero que
os efeitos sonoros estejam. Para a primeira parte, não
consigo pensar um efeito sonoro que eu queira aqui. Poderíamos fazer com que as pessoas
conversassem na parte de trás, mas como elas
não estão no quadro, isso vai ser
um pouco estranho Mas para o segundo
clipe, temos o C, e você pode inserir
alguns SGLs sem problemas ou as ondas quebrando, Aqui, novamente, não
temos muito o que fazer, mas poderíamos fazer algo
como uma área lotada, então essa pessoa está tomando
essa liberdade e caminhando
por algo bizarro ou algo assim,
e aqui podemos fazer
uma queda de onda Talvez façamos Segal para
este e acene para este. Vamos levar
nosso indicador de reprodução exatamente onde
queremos que o áudio comece Também poderíamos mover o SFX
depois de construí-lo. Clique uma vez, e eu decidirei a
duração bem longa, essa longa, estenda-a. Sem áudio no momento. Não colocamos nada aqui.
Não se preocupe com isso. Vamos pular para
a outra parte em que queríamos um áudio,
comece um aqui Estou tentando sobrepor os clipes porque isso os torna
muito mais naturais Agora, aqui, quando há
dois efeitos sonoros consecutivos,
então leve a bagagem, sonhe Então, temos uma pessoa caminhando e depois temos
uma com a praia. Então, em vez de
colocá-los um após o outro, você também pode colocá-los em camadas. Essencialmente, rolamos para
baixo e adicionamos outra faixa do Saffx e
fazemos nossa segunda aqui embaixo A razão pela qual
estamos fazendo isso é porque quando esse
cara está desaparecendo, esse cara pode desaparecer
e isso cria
uma transição perfeita muito natural Vamos garantir que eles se sobreponham por alguns segundos, e eu tenho três
Aafcs com os quais trabalhar Vamos para a primeira
, e eu farei gaivotas voando perto de uma praia Você estará voando à distância. Aparece e depois desaparece. Vamos tentar algo
muito simples. Avon, você não
escapa de quem você é. Você se torna mais
disso. Você aprende. Lá vamos nós. Muito bom. Siegel está voando na parte de trás. Vou silenciar,
basta destacar essa faixa então clique no ícone do fone para que possamos ouvir o Observe como foi bom esse
fade em Fade Out. Se eu remover isso, vou apenas copiar isso. Basta se livrar dessa parte,
gerá-la mais uma vez. Você pode ver que isso não é tão bom. Começa de repente, mas ao adicionar esse
fade in fade out
, será mais natural Fade in, áudio e
depois fade out. Apenas deixe isso de fora. Gaivotas
voando à distância Não acho que precisemos colocar o som do oceano
porque ele está muito longe. Vamos reservar isso para
este áudio. Tudo bem. Este, vou deixá-lo como
o volume que tem agora. Posteriormente, podemos ouvir
a coisa toda e depois decidir o quão alto
queremos que o áudio seja. Vamos passar para o segundo onde temos essa
pessoa andando,
vamos supor que seja bizarro,
lotado Clique aqui para fazer um bizarro
lotado de pessoas. Falando à distância, vendedores gritando seus
preços, eu acho Podemos fazer experiências com isso. Eu vou fazer um sem
desaparecer e desaparecer. Agora, a razão pela qual continuo fazendo à distância
é porque quero um áudio desbotado e às vezes, o volume por si só não ajuda muito para você Se você fizer um sem o
aviso à distância, ficará muito
claro e muito alto, mas esse não é o ponto aqui. Não queremos que o SFX seja o personagem principal
deste anúncio, então é por isso que estou adicionando distância
a
todos esses Se você ouviu o som bem de
perto, por exemplo, foto
super próxima de um pássaro, talvez
não queira usar à distância. Basta medir a
distância que existe entre nós, como espectadores,
e o som
que está no vídeo Isso nos deu um áudio mais curto. Se você alterar o prompt, poderá regenerar esse áudio ou clicar nesse ícone de atualização
para obter um diferente Podemos simplesmente clicar nele agora,
clicar botão
direito do mouse e fazer um de duração
fixa. Eu pretendia fazer isso
assim primeiro. Duração fixa. Agora ele atende aos
requisitos que queríamos. As palavras que as pessoas estão dizendo não fazem nenhum sentido, mas tudo bem porque
é um ruído de fundo. Agora, por padrão, quando
você gera aqui, ele está fazendo a duração dinâmica. Se você fez o que fizemos aqui e viu que ele continua oferecendo
uma versão mais curta, não tente
esticá-la, pois isso apenas retarda o clipe Mas, em vez disso, basta clicar com o botão direito do mouse
e fazer uma duração fixa. Agora, nossa última cena é, deixe-me ver se isso
aparece e desaparece Ok, não. Então,
vamos lá. Vamos aqui. Entra e
desaparece tudo aqui. Gerado mais uma vez.
Pretendia fazer isso de outra maneira. Então, este é um exemplo, duração
fixa. Ele usará o mesmo prompt, mas manterá o mesmo
tamanho que você deseja. R Ok, então isso é bom. Na verdade, não apareceu e
desapareceu como o de Segel, mas acho que vai ficar bem Para o último, vamos fazer
o som das ondas. Entre nesta aqui embaixo
e faça as ondas caírem. Nós apenas fazemos ondas na costa. Ficou lento no começo. Ok, clique com o botão direito. Áudio de duração fixa. Oi. Ligue-o assim. OK. Eu acho que isso vai ficar
bem. Não quero dois
efeitos sonoros de Segel em um clique Então, quando eu jogo
tudo junto, eu simplesmente desmarco isso para que tudo esteja
sendo considerado Onde essa é a alusão. Você pode ver que
não há equilíbrio entre
os diferentes áudios Então, vamos ao
primeiro efeito sonoro. Quando você viaja, você
não escapa de quem você é. Clique no primeiro efeito sonoro e abaixe o áudio. Você viaja, não
escapa de quem você é. Você se torna mais
disso. Você aprende, você é um pouco
menor do que isso. Vamos experimentar o que está aqui. A mais bizarra, vou
descer um pouco só porque é a do laboratório
e depois a da praia, podemos ir 16 decibéis, Seja quem você é em qualquer lugar.
Essa é a verdadeira liberdade. Portanto, leve as malas, sonhe alto e comece sua jornada hoje. Inscreva-se em um exemplo de canal. Então, observe como a
transição foi muito suave daquele bazar
para, hum, a praia E isso é por causa dessa
sobreposição que fizemos. Agora, para tornar isso
um pouco mais suave, porque você pode dizer claramente quando começa e quando termina Você viaja, você não escapa de quem você é. Você se torna mais disso. Acho que vou apenas
estendê-lo até talvez aqui. Portanto, é menos perceptível. Clique com o botão direito, duração fixa. E como estamos tão
focados nesse final de áudio, poderíamos prestar menos
atenção ao SFX Você não escapa de quem você é. Você se torna mais disso.
Você aprende, você desaprende É um pouco baixo demais. Então, vamos aumentar isso. Torne-se mais disso. Você aprende, você desaprende. Você respira mais fácil. Lá. Quando você viaja, é. Você aprende, você desaprende,
você respira mais facilmente. Ok, isso é muito bom. Acho que vou fazer outra coisa que se
sobreponha. Então, vamos mover isso para sua
própria camada como uma faixa vex, e vou colocar meu indicador de reprodução para obter
uma direção aqui, colocá-lo assim e
agora ouvir Faça um pouco mais alto. Você se torna mais
disso. Você aprende, você desaprende, você respira mais facilmente Seja quem você é em qualquer lugar. OK. Então, isso é muito bom. Vamos estender os
SQLs até o início, talvez um pouco mais para trás, algo assim,
gerado novamente. Então é como se isso
acabasse, isso começasse, então isso começasse como uma situação
de trânsito. Quando você viaja,
você não escapa quem você é. Você
se torna mais disso. Você aprende, você desaprende,
você respira mais facilmente. Seja quem você é em qualquer lugar.
Isso é real. Ok, então estou muito feliz
com esse clipe original, e vou reproduzi-lo para
vocês como está, possam saber
com o que estamos lidando antes e depois qual será a versão em
francês. Para a versão francesa, não
há muito que você possa fazer. Você pode ver que
ele apenas duplica
a mesma faixa de áudio e
simplesmente a traduz Então você não está fazendo
muita edição aqui. Vamos começar de novo e
ver o que temos. Há uma versão sua que
está esperando para ser desbloqueada lá fora Quando você viaja,
você não escapa quem você é. Você
se torna mais disso. Você aprende, você desaprende. Você respira mais fácil. Seja quem você é em qualquer lugar. Essa é a verdadeira liberdade.
Então, leve as malas, sonhe alto e comece sua jornada hoje, inscreva-se no canal de exemplo e veja aonde o
mundo leva você. Então essa é a
versão original. Está tudo bem. Como soa a
versão em francês? Agora, quando eu toco
isso, você pode ouvir, como uma voz duplicada Iliana. Então, se isso
acontecer com você, não entre em pânico. No momento, estou
na versão francesa, mas podemos ouvir algo parecido a versão
em inglês ao fundo. Agora, neste momento, tenho
meu falante de francês, meu original e o plano de fundo. Então, há três alto-falantes
neste clipe agora, e quando o ouvimos,
soa um pouco estranho Temos o falante de francês e alguém está abafado ao
fundo Não entre em pânico se isso
estiver acontecendo com você. Isso só aconteceu
porque tínhamos o alto-falante como parte
do clipe original. Mesmo que o alto-falante
original esteja acinzentado, ele ainda está lendo de forma estranha porque temos a música de
fundo Se eu apenas destacar isso,
você não sabe quem você é. Você pode ver que é daí que vem o som
abafado. Tudo o que você realmente
precisa fazer é excluí-lo
e, em seguida, ele deve voltar ao normal. Essa é uma solução simples. Agora, para exportar isso, você pode simplesmente ir até
aqui e clicar em Exportar. Essas são as coisas
que você já fez antes, mas aqui embaixo, você pode decidir em quais idiomas deseja
exportar e, em seguida, como quê. vídeo anterior terá o vídeo, os efeitos sonoros, o alto-falante
e todas essas coisas. Você pode até mesmo exportar
isso como um arquivo zip cada camada é seu próprio áudio ou
você pode fazer os dados da linha do tempo Se você tiver alguma legenda, não
gravamos áudio neste formato, neste formato ou neste Então, quando terminar,
você pode clicar em Exportar. Ele vai carregá-lo aqui. Você recebe carimbos de data
e hora e em qual idioma, então você tem a opção de fazer uma prévia e
baixá-la quando estiver pronto Vantagem Boye Kivu disse, segunda parte, :
Boye Kivu
disse, segunda parte,
Seliberte. Olá, Voyage grand. Ele veio e salvou um show de viagem. Acredito que, por exemplo, canal, voto que valerá salmão É assim que você pode fazer um anúncio muito simples
com o ElevenLabs Começamos tudo do
zero, desde o roteiro,
a voz, o áudio, os
alto-falantes, os efeitos sonoros
e todas essas coisas. A única coisa que não
fizemos foram
os vídeos que
recebemos do pexels.com Mas se você quiser que essa
seja uma experiência completa de IA, existem algumas ferramentas
que podem criar vídeos de IA para você. Isso conclui nosso terceiro
e último projeto. Espero que vocês tenham conseguido
obter o mesmo resultado, se não semelhante ao que
temos aqui. Com certeza experimentaremos ainda mais projetos e praticaremos as ferramentas
que conhecemos. Agora vamos para
o próximo capítulo.
31. Introdução às ferramentas para criadores: Agora você pode gerar imagens
e vídeos em 11 laboratórios. Além de gerar
esses ativos, você também pode aprimorá-los, criar seus avatares
e realmente ter uma produção completa
em uma Esta é uma nova edição, imagem e vídeo,
e, essencialmente, é
assim que a
página se parece. Primeiro, somos recebidos
com avatares, que é uma forma de
manter personagens consistentes Então, digamos que você tenha um rosto, você quer que seja a mesma coisa em diferentes gerações de
vídeo. Em vez de tentar aperfeiçoar
isso com seu prompt, você pode simplesmente gerar
um avatar e, dessa forma, tudo ficará
muito consistente. Aqui, estamos vendo vários
exemplos do que
outras pessoas fizeram, como você pode ver, eles são
de alta qualidade. Eu poderia entrar em cada
vídeo, remixá-lo,
ou seja combinar
minha própria opinião sobre esse vídeo ou simplesmente
baixá-lo ou compartilhá-lo como está Temos a opção de vídeo
e imagem. E com a imagem, você pode
realmente ver o prompt completo. Então, basicamente, a instrução
que essa pessoa forneceu à ElevenLabs para
obter esse resultado E o mesmo vale
para o vídeo. Então, aqui temos uma animação. Também temos um longo aviso. Agora, o legal do
ElevenLabs quando se trata de
geração de imagem e vídeo é que ele combina todos os seus modelos de IA
favoritos Então, só para mostrar uma prévia, ao descer até aqui, você pode estar familiarizado com a
maioria desses modelos. Então, temos o GPT, temos o craft, temos o SDream,
temos o nano Banana
e muitos outros, basta E é isso que torna essa
plataforma um pouco mais exclusiva, pois além de seus próprios
modelos poderosos de música, voz e efeitos sonoros, ela também combina todos
os outros modelos nos quais você pode ter confiado e os
reuniu em um só lugar Além dos modelos
que geram conteúdo, também
temos modelos de edição. Então, aumentar a escala, essa é
outra ferramenta famosa. Foi trazido
para a ElevenLabs. Também temos a
remoção do plano de fundo aqui, e há algumas guias para você
explorar Portanto, se você quiser
aprimorar a edição, podemos usar esses modelos, e eles também recebem crédito, então você pode se basear
no custo aqui A mesma coisa se aplica a
vídeos que eram imagens. Temos vídeo e
depois temos sincronização labial. Então, a sincronização labial é onde você fez o áudio ou
acabou de enviá-lo, e você queria
basicamente gerar um vídeo onde você
combinasse o áudio. Então, se você fez uma voz
aqui ou fez uma conversão de texto em fala, agora
você pode ter essa fala definida por um avatar
na Então, esse é outro recurso interessante. Então, vamos nos aprofundar nesse novo recurso nas
próximas aulas, explorar como eles funcionam, como você pode criar seu primeiro ativo e como
organizá-lo no futuro.
32. recursos e modelos: Então, tudo o que você
fizer será salvo na sua pasta de ativos. Então, se você clicar nisso, já
temos coisas diferentes porque estamos usando o
ElevenLabs há um tempo Qualquer avatar que você criar
será salvo aqui. Seus fluxos para os agentes
de IA serão salvos aqui. Tudo o que você enviar para o ElevenLabs também será
salvo aqui Então, eu tenho duas imagens aqui. Pode fazer upload de ativos para
que você possa
arrastá-los facilmente para a geração de imagens
ou vídeos. Você pode criar uma nova pasta onde você coloca certas coisas dentro
e, dessa forma, você pode
ter uma área de armazenamento on-line para seu conteúdo. Então eu acabei de criar uma pasta. Poderíamos dar
um nome diferente. Então, vou dizer meu vídeo
e imagens apenas para que
possamos salvar as
coisas que vamos fazer nas
próximas aulas. Isso com outras pessoas,
exclua se precisarmos. Quando entramos na pasta, podemos fazer o upload
de coisas do nosso computador. E uma vez que criamos algo
em imagem e vídeo, também
podemos colocá-lo
nessa área. Então, eu poderia simplesmente ir até
aqui, baixar isso
e, em seguida,
enviá-lo
para aquela pasta para usar como referência
para outro projeto. Se você não tiver certeza de como criar um conteúdo completo usando
esse novo recurso, ElevenLabs também tem
a guia de modelos, logo
acima dos E quando você clica neles, temos algumas opções fáceis de
arrastar e soltar para você criar diferentes
tipos de produção. Então, alguns exemplos aqui, vamos dar uma
olhada nas categorias. Digamos que queremos fazer maquetes. Eu tenho esse gerador de
maquete de embalagem. Eu poderia clicar nele, fazer o upload meu produto em branco e do design da embalagem em
dois D, e ele
será transformado em algo muito bem polido Portanto, os modelos basicamente fazem algo por você
do início ao fim. Este é
um exemplo de gerador de maquete, mas temos várias
outras Então, vamos fechar isso. Aqui temos um modelo de
vídeo UGC. Então, se você quiser criar
esse tipo de conteúdo, você pode fazer o upload das entradas
para esse modelo Então, o retrato do influenciador, que é um exemplo Mas nas
próximas aulas, mostrarei como você pode gerador de imagens de IA
no ElevenLabs
e, dessa forma, também pode usar
suas próprias gerações Em seguida, temos o produto. Portanto, qualquer produto que você
queira mostrar, você o
colocará aqui. Escolha sua voz.
Isso pode ser da sua própria biblioteca de voz ou das muitas vozes
disponíveis para você. E, basicamente, os benefícios que você deseja que esse
modelo destaque agora. Então, aqui está um exemplo. Então temos o local da filmagem. Então, agora, é como
uma penteadeira rosa,
mas você pode colocar na floresta, em um escritório ou em qualquer outra coisa. Pronto,
basta clicar em Gerar e obter
um bom vídeo UGC Agora, é claro, o que quer que
você faça, você ainda tem
a chance de editá-lo ainda mais, fazer refinamentos e
torná-lo realmente seu Aqui embaixo, podemos ver
quantos créditos isso
vai custar. Mas só para observar o fluxo, basicamente como isso vai gerar o produto
final,
você está usando as seguintes entradas que vimos ao lado Então, se você estiver curioso,
você sempre pode entrar na seção de fluxo. Então, influencie um retrato. Essa é uma entrada, o
produto, a voz, a combinação
perfeita, os benefícios do produto e o local da filmagem. Então, esses caras
vão escrever um script primeiro, decidir o tamanho e
depois fazer com que os modelos sejam executados. Em seguida, ele cria
algumas versões. Aqui embaixo, ele trabalha
com a narração e depois junta as duas
para o produto final E então isso é como
o produto final. Você pode usar o fluxo para
descobrir basicamente como ele
aborda esse problema .
Também é meio divertido ver isso. Assim, você também pode editar
esse fluxo, digamos que queira, em algum momento, inserir outra entrada
para um segundo caractere. Você pode adicionar isso aqui. Mais tarde, aprenderemos
sobre fluxos. Mas, por enquanto, isso é algo
que você pode explorar. Agora, esses foram os
exemplos que
analisamos e também coisas que
outras pessoas fizeram. Assim, você pode ver o produto de
imagem. Tudo isso está muito
bem feito, na verdade. Você pode simplesmente ver a
qualidade do trabalho. Se você for para Generations, essas são as coisas
que você fez preenchendo-as e
clicando em Gerar Então, agora
não há nada lá. Pense nos modelos
como pequenas ferramentas que você pode usar em cima
de todas as outras, e é muito
legal trabalhar com eles. A única coisa sobre
eles é
que eles recebem muitos
créditos para garantir que você esteja alocando créditos
suficientes para isso e esteja ciente de quanto
será usado Então, aqui estão
os efeitos de vídeo para dublagem, faça o upload do vídeo de entrada e
depois retire a dublagem Além disso, crie seu próprio modelo, se essas ferramentas não forem
realmente adequadas às suas necessidades, você pode clicar em
mais Novo modelo. E aqui você pode
conversar com a ElevenLabs para
criar seu próprio fluxo Agora, novamente, vou
mergulhar nos fluxos um pouco mais tarde. Mas, basicamente, se você tem algo que
precisa fazer repetidamente, como tarefas que precisa
fazer todos os dias em que carrega um vídeo e ele
precisa ser
dividido em uma bobina vertical, uma bobina horizontal e
talvez uma quadrada,
você pode criar um fluxo com
base nisso e automatizar
esse Então, basicamente, a entrada seria a música e
talvez algumas legendas. Você teria 11 laboratórios, dividiria em três
versões do vídeo e depois o refinaria com
talvez mais conteúdo de IA, música de
IA, narração e entregaria o
produto final Esse é um exemplo de fluxo. Se você quiser, pode simplesmente deixar até 11
laboratórios completos. É muito fácil de usar. Você não precisa usar palavras
específicas. Você apenas diz o que quer e isso o
ajudará ao longo do caminho. Então, voltando, agora
podemos ver
como começar a gerar
coisas com o ElevenLabs Vamos começar primeiro com imagens. Então, aqui mesmo. E vamos ver como toda
essa interface funciona. Então, vamos direto ao assunto.
33. Gerador de imagens: Então, a primeira opção aqui é
usar isso como referência. Então, novamente, este é um
modelo que eu poderia dar a 11 laboratórios para gerar novos. Talvez dessa vez eu pudesse ter um pinguim
exatamente na mesma pose Mas, para melhor
descrever a pose, eu poderia simplesmente fazer o upload
dessa imagem como referência para a
ferramenta a seguir. Isso é uma referência, e então
temos uma imagem sofisticada que
vai aumentar o tamanho e a resolução
da imagem atual, tornando-a de alta qualidade Por exemplo, se for
uma imagem de 500 por 500, eu poderia
aumentá-la para um tamanho maior ou até maior e usá-la
para diferentes propósitos Você pode recriar algo,
então, basicamente, insira esse prompt, mas veja o que sai dele Então, vai parecer um
pouco diferente. Podemos usar isso para lábios. Então, se eu já tenho um áudio, eu poderia fazer com que esse sujeito
basicamente falasse esse áudio. Então, essa opção
vai funcionar nos lábios, nos movimentos, nas
expressões faciais e tudo mais. E, por fim,
criamos um vídeo, então isso pode ser apenas emoção Pode ser o sujeito fazendo alguma coisa ou
simplesmente parado, coisas que podemos definir
usando essa opção. Então, muitas coisas legais
estão sendo feitas aqui. Temos maquetes. Temos arte. Temos algumas técnicas fotográficas
semelhantes aqui. Temos alguns designs, pôsteres, ilustrações
e assim por diante Então, vamos fazer um exercício muito simples
agora, em que
tentaremos nossa primeira solicitação e veremos como
podemos desenvolver a partir dela. Então, o que vou
fazer é digitar meu assunto. Eu quero uma mulher, e vou
mandar isso. Então, estou tentando mostrar a vocês o poder de um
prompt e o quão boa será
a saída se vocês descreverem melhor as coisas e
seguirem um determinado formato. Agora preciso ver
o que essa mulher está fazendo. Ela está sentada? Ela está de pé,
deitada, o que está acontecendo? Preciso mencionar
isso. Então, uma mulher sentada em uma cadeira. Então, isso aqui
basicamente define uma cena. Detalhes insuficientes,
mas vamos enviá-los com
um de nossos modelos. Então, novamente, podemos ir para a imagem, e há muitos modelos
que vocês podem explorar. Para começar, você pode experimentar
um dos modelos mais populares. No momento, o GPT é muito
famoso pela imagem. Nano Banana também é muito
bom para personagens, realismo e tudo Vou ficar
com o modelo mais novo aqui e clicar apenas
nele Então, temos nosso conjunto de modelos. Agora podemos descrever basicamente como definir a
proporção do produto final. Eu vou com a foto da paisagem. Em seguida, temos a resolução, apenas para obter uma geração rápida. Vou
reduzi-lo ao mínimo. Qualidade, vou usar
alta em algum lugar intermediário, e então teremos gerações. Então, quantas versões você quer que 11 laboratórios criem com base
nesse prompt? Vou fazer quatro só para que
possamos ver como elas diferem. E, por fim, temos essa ferramenta de edição que
ajuda a melhorar sua solicitação Mas como estou tentando mostrar
a diferença entre os prompts, vou desativá-los Então, certifique-se de que você está na
imagem, insira seu prompt, esse prompt exato ou qualquer outra
coisa que você prefira nessas configurações,
e vamos enviá-la. Aqui estão minhas diferentes versões. Temos um quarto similar. Temos um assunto semelhante. Eles estão apenas em
camisas e poses diferentes. Mas parece que
é o mesmo sofá. Há uma pequena
diferença entre eles. Então, agora, isso me deu
uma mulher sentada em uma cadeira, mas na verdade não tem
nada exclusivo. Parece uma
imagem de estoque, basicamente. Mas agora, o que quer que
eu tenha em mente, o que eu esteja imaginando
para essa mulher, agora
posso descrevê-lo com
base nessa Então, clique aqui
ou digite o prompt novamente. Agora vamos adicionar mais
alguns detalhes. Como eu posso ver as
diferentes versões, eu poderia simplesmente reduzir
isso para duas, que ele gere mais rápido, e possamos fazer
isso um pouco mais rápido Então, uma mulher
sentada em uma cadeira, antes mesmo de
mencionarmos a mulher, podemos ver como ela é. Então, em termos de idade, talvez
em termos de etnia, e depois disso, como é
o cabelo dela? Qual é a cor do cabelo, coisas que podemos
descrever melhor a pessoa. Assim, podemos ver uma jovem
neste caso com, digamos, cabelos
loiros, desta vez,
faremos o oposto de cabelo loiro e olhos azuis
sentados em uma Então, agora, apenas
a mulher sozinha, estamos adicionando mais
detalhes que podem fazer com que ela basicamente se destaque
a partir dos resultados a seguir, e podemos até adicionar mais alguns. Então ela está
sentada em uma cadeira, talvez, o que é a cadeira? Exatamente, como é? Existe uma determinada cor?
Podemos mencionar isso aqui. Sentada em uma cadeira aveludada, podemos mencionar
mais sobre sua pose Você pode dizer com uma pose
inclinada para frente e um rosto confiante Algo parecido. Então, mais
detalhes, podemos colocar isso. E também podemos mencionar
coisas sobre o plano de fundo. Então, agora, vou enviar
isso
apenas com a mulher, sem mencionar
o plano de fundo, e podemos ver como
o novo resultado será um pouco
diferente do primeiro. Isso acabou sendo
bloqueado porque
provavelmente por causa da pose inclinada para frente, às vezes
com palavras, ela pode emitir alguns sinais,
mas eu acabei de remover
a coisa inclinada mas eu acabei de remover para frente e fiz uma pose
confiante Portanto, se você se deparar com esse problema, basta alterar um pouco o
prompt. Então essa é a pose que eu tenho. Não é exatamente o que
eu estava procurando, mas você pode ver a diferença entre essa imagem
e essa imagem. A cadeira é realmente aveludada. Ela é loira e
tem olhos azuis. Agora, se eu quiser, eu poderia colocar o mesmo caractere
nessa posição, digamos, eu realmente gosto
desse plano de fundo. Agora eu poderia usar essa
pose como referência, digamos, isso é o que
eu estava procurando. Em vez de tentar alterar isso, eu poderia referenciar essa imagem. Então, vou apenas referenciar
a primeira imagem e
ter meu prompt como está. E, basicamente, a ferramenta
precisa substituir o cabelo dela e a cadeira e me
dar uma nova foto. Então aí está meu novo modelo. Ela está exatamente nessa pose, mas é loira e a
cadeira parece diferente Então é isso que
temos agora. Está parecendo muito bom. E como finalizei meu
modelo, agora
posso usar isso como referência para que
ela faça outras coisas Por exemplo, ela usa óculos
e está no telefone. Essa poderia ser uma
pose diferente nessa configuração exata. Mas, ao fornecer a referência, eu poderia colocar menos pressão
no prompt e mais
pressão no visual. Se você não tem certeza da
melhor forma de escrever uma solicitação ou está tendo dificuldades para refiná-la de acordo com o que precisa, ative esse recurso Então, basicamente, isso
funcionará por meio do prompt atual, o
melhorará e fornecerá
algo mais adequado. Então, agora eu podia clicar em Aprimorar, e isso basicamente transformou meu prompt muito simples em
algo mais detalhado. Então, cabelos loiros esvoaçantes, usando palavras que descreveriam
melhor textura, luz, contraste e tudo Em vez de apenas olhos azuis
, são olhos azuis penetrantes Então, mais detalhes.
E então a cor da cadeira, que
tipo de cadeira? E depois a iluminação, nem
mencionamos a iluminação, mas está fazendo isso por nós agora. Algo sobre a
textura da cadeira e, claro, a
postura que ela tem Coisas diferentes que você também
pode fazer aqui, em vez de apenas melhorar, você pode
refinar ainda mais a pose Então, um
sorriso sutil e conhecedor enfeitando seus lábios. Então, isso é mais sobre ela,
a maneira como ela está sentada. E então, você sabe,
você poderia continuar adicionando
mais detalhes. Então, vamos gerar isso com o mesmo modelo e tudo mais
e ver o que obtemos. Eu removi a imagem
de referência. Às vezes, você pode ter
problemas com determinados modelos. Por exemplo, esta é minha solicitação, mas está dizendo que talvez eu tenha violado seus
termos de serviço Portanto, certos modelos impedem que você use certas
combinações de palavras, e isso é apenas para
manter a comunidade segura. Mas se eu simplesmente mudar
para um modelo diferente, ele pode interpretar minha solicitação uma
maneira diferente que não seja, você sabe, considerada prejudicial. Então, poderíamos experimentar
talvez a banana nano em vez disso e
experimentá-la. Então vamos lá. Você pode ver que não
tivemos esse problema. Mas aqui podemos ver a grande diferença
entre os modelos. Então essa é a nano banana. Sabe, parece que
ela está em um estúdio, enquanto o outro
parecia muito natural. Portanto, mudar os modelos realmente
ajuda quando
se trata da entrega visual dessa solicitação. Então esse é um exemplo. Poderíamos ir até a Runway AI. Esse é outro modelo e
veja como é. Temos a quarta geração de imagens. Esse é um dos modelos de IA de
passarela. E até agora, estamos apenas
seguindo nossas instruções. Começamos com uma mulher
sentada em uma cadeira. É aqui que acabamos. E, você sabe, com modelos
diferentes alternando entre referências, estamos ajustando a
imagem que queremos. Então aí está minha nova imagem. É muito
diferente dos anteriores, mas é assim que esse modelo
está interpretando meu prompt Então, em muitos modelos,
cada modelo de IA é
construído de forma diferente, treinado de forma diferente,
então espere ver algumas grandes diferenças ao
alternar entre os modelos. É basicamente assim que o gerador de imagens
funciona no ElevenLabs O objetivo de criar
um é que você possa
transformá-lo em um vídeo mais tarde, combinado com os áudios
que você já criou Pode ser para criar algo com os
modelos que
analisamos e você pode
mantê-lo nessa plataforma, usá-lo para
resultados diferentes ou
exportá-lo para
outra coisa externamente Então, talvez o use em outra ferramenta de IA ou simplesmente o
publique em algum lugar. Você pode explorar essa ferramenta. É novo, está melhorando. Mas como há muitas ferramentas
externas combinadas aqui, é realmente
conveniente
criar todo o seu
conteúdo em um só lugar. Então esse é o gerador de imagens. Vamos passar para o gerador de
vídeo, que é a próxima opção.
34. Gerador de vídeo: Da mesma forma que você criou imagens, agora
você pode criar vídeos. Então essa é a próxima
guia aqui. Depois de mudar,
há algumas coisas
diferentes, mas o conceito central ainda
é o mesmo, no sentido de que você
ainda escolhe seu modelo, a proporção, a
qualidade e suas referências. A única diferença entre imagem e vídeo é
que agora você tem quadros e quadros
iniciais e referências de vídeo e áudio. E, claro, a duração porque agora estamos
trabalhando com movimento. maneira como isso funciona é que você
pode simplesmente digitar
o que quiser e fazer com que 11 laboratórios gerem um vídeo para você apenas com
base na solicitação, ou você pode gerar uma imagem e
usá-la como referência Então, nesta lição,
vamos
fazer um exercício muito simples em que geramos a imagem e a usamos
como referência. Vamos simplesmente
mudar para cá e escrever
algo sobre nosso personagem. Então, eu quero um vídeo em o sujeito esteja
fugindo da câmera, e eu quero que ele use, tipo, um casaco de inverno e
talvez corra na neve. Então essa é minha ideia. Eu só tenho que dar vida a isso. E tudo começa com a aparência do
meu personagem. Mude para a imagem. Vou
digitar um homem vestindo um casaco
de inverno que parece
muito sério. E então eu quero que isso seja de corpo
inteiro e hiperrealista. Então aí está meu aviso. Vou mudar
para o nano Banana, e então vou manter isso em 41k, e vamos fazer uma proporção
vertical Então, sem referências,
basta digitar isso, e vamos
gerar isso Então, aqui estão os personagens. Temos nosso primeiro, segundo, terceiro e quarto. Agora eu poderia escolher o
que eu gosto e depois usar isso como referência para
definir melhor meu personagem. Então, eu
vou com esse cara. Eu acho que, você sabe, ele
tem a configuração completa, e agora eu quero que ele
segure uma bolsa. Então, vamos usar esse
cara como nossa referência de imagem
e, em seguida, vamos
digitar um novo prompt. Então, um homem segurando uma
mochila na mão, você pode dizer qual mão, qual a cor da mochila, mas eu vou
mantê-la assim Mesmo modelo, mesmas configurações. Agora vamos enviar isso. Aqui estão os modelos. Eles agora estão segurando uma mochila. Novamente, eu realmente não disse de
que cor ou de qual mão, mas acho que essa
fica melhor porque combina com a roupa dele
e ele está usando luvas Agora, essa pode ser minha
referência de imagem para o vídeo, e eu também poderia adicionar outras referências, conforme
vimos anteriormente. Agora podemos passar para o vídeo. E tenha essa imagem como
nosso ponto de partida. Portanto, não vou usar nenhuma
referência para este exemplo, mas apenas o quadro inicial porque isso é tecnicamente
uma referência própria Mas, na verdade, se
tentarmos fazer as duas coisas, você pode ver que
não temos permissão para fazer isso. Portanto, você não pode ter
um quadro final inicial ao lado de referências de imagem ou
vídeo. Então, agora só temos
que descrever o que esse homem está fazendo. Então, poderíamos dizer homem
fugindo da câmera perseguindo. Eu quero que ele corra
muito rápido. Configurações de nome. Vou mudar
isso para 10 segundos. E vou manter isso em 1720 e vou usar o
modelo S dance 2.5. Vamos enviar isso. Então, isso vai demorar
um pouco para ser gerado. Então, ao mesmo tempo,
vou ter outro exemplo que removemos o quadro inicial
e usamos três referências. Então, na mesma solicitação, vamos usar nossa referência de imagem, que é nosso personagem.
Deixe isso aí. Referência de vídeo, pude
encontrar um vídeo on-line em que quero que meu personagem
funcione dessa maneira. Se simplesmente acessarmos a página principal, explorarmos o vídeo e pesquisarmos
por Running Away, eu poderia usar algo
assim como minha referência de vídeo. Assim. E para áudio,
na verdade, fiz uma anterior em
que escrevi que o homem está fugindo, então som de corrida,
respiração pesada, esse tipo de coisa. Se você não quiser
criar seu próprio áudio, você também pode procurar
algo na
guia de efeitos sonoros baixada e
simplesmente fazer o upload aqui. Aí está meu áudio.
Novamente, as mesmas configurações. Agora vou clicar em Enviado. Então, meus vídeos estão prontos. Este é o nosso primeiro,
onde o fizemos fugir. Então, podemos ver que isso fazia barulho de passos, você sabe, música de
suspense
e, claro, ele respirava um
pouco no início Agora, eu poderia guiar o áudio, talvez descrever
o som dos passos, que
correrão na neve Isso aqui soou como um som de botas de borracha,
o que não era adequado Mas você pode ver
como ele implementou o áudio da cena de perseguição
usando apenas duas palavras. Então esse é o nosso primeiro vídeo. Vamos dar uma
olhada em nosso segundo vídeo onde fornecemos três
tipos de referência. Então esse era o nosso assunto. Você pode ver que ele está usando a mesma roupa, praticamente Então tivemos nossa referência em vídeo, que é bem idêntica. Por fim, tivemos nosso áudio de
referência, que era apenas a respiração
pesada Então, tudo isso combinado nos
deu esse vídeo. E você pode ver que, em algum
momento, ele volta para a câmera e se parece
exatamente com o meu objeto. Então esse é o gerador de vídeo que a ElevenLabs
lançou recentemente É muito poderoso.
Está ficando cada vez melhor. Você pode tentar isso com modelos
diferentes, mas tenha em mente a quantidade
de créditos que ele
usará , pois isso é o lado
mais pesado da produção Você pode ver que esse clipe de
cinco segundos usou 15.000 créditos, e eu combinei três
referências para fazer esse vídeo Aqui embaixo, você pode
ver o tamanho, bem
como a dimensão,
a resolução. Assim, você pode usar essas
informações para planejar melhor sua produção sem
ficar sem créditos todas as vezes. Agora, vamos dar uma olhada no recurso
de sincronização labial
no ElevenLabs
35. Sincronização labial: Vimos como criar imagens de vídeo
e agora vamos fazer com que nossos personagens digam
algo com sincronização labial. Então essa é a terceira guia, e tudo o que você realmente faz
é enviar
um avatar e um discurso que você fez
nesta plataforma ou
obteve de outro lugar. Você pode guiar a
geração aqui, talvez falar sobre a forma como as expressões faciais são feitas ou a velocidade com que
a pessoa está falando. Então, vamos
clicar em Avatar. Você pode
fazer upload de uma imagem para o seu avatar ou selecionar
uma que já exista. Se você quiser criar
seu próprio avatar, você pode fazer isso com a guia do gerador de
imagens. A única coisa que você
precisa ter em mente é que você deseja que a
imagem fique próxima o suficiente do
rosto do objeto, porque grande parte
do foco e da geração estarão ao redor do
rosto e da boca. Então, nessa imagem aqui, o personagem está um pouco
mais longe da câmera, então podemos acabar com
alguns defeitos no rosto
quando a ElevenLabs está tentando
fazer os personagens falarem Mas quando você acessa a página inicial, pode ver que
temos alguns avatares Então, quando clicamos em Exibir tudo, percebemos o quão perto o
objeto está da câmera, e isso vai
realmente ajudar a fazer gestos
naturais, movimentos
labiais naturais
e tudo
mais , movimentos
labiais naturais
e tudo Basicamente, você vai
clicar em Avatar, selecionar Avatar e
escolher o que quiser Depois de clicar
neles, você realmente tem mais opções sobre o
posicionamento do objeto,
as roupas que ele está
vestindo, a localização. E você pode ver que eu
tenho muitas opções. Então, se eu escolher este, eu poderia clicar no seu estilo
e depois ir para o discurso. Pode ser conversão de texto em fala ou algo que
eu tenha enviado Então, se você converte texto em fala, este é nosso parágrafo salvo
de algumas aulas atrás, e eu poderia
usar o discurso que
fiz naquela lição ou gerar um novo com
uma Vou clicar
no mais recente, e você pode simplesmente clicar em
conversão de texto em fala ou
enviar Se você quiser criar
seu próprio Avatar, basta clicar
em Novo e criar o rosto a partir de um prompt
ou fazer upload de imagens de referência. Então, basicamente, se eu
entrar em qualquer um desses, você pode ver que há muitos ângulos diferentes
desse personagem. E isso é basicamente o que
você quer com seu avatar. Então, se eu for
fazer upload de imagens, precisarei de
ângulos diferentes do meu assunto. E isso é algo que, novamente, eu poderia fazer no ElevenLabs ou algo que eu poderia fazer
com minha própria câmera Então, faça o upload das imagens. Dez é recomendado. Você pode usá-las como referência se quiser tirar
suas próprias imagens ou deixar 11 laboratórios
criarem cada uma para você
e simplesmente enviá-las aqui. Você pode dar ao Avatar um nome e uma voz,
e pronto. Basta clicar em Criar Avatar. Se você quiser começar a
partir de um prompt, não precisará fazer upload nenhuma imagem ou
referência. Você acabou de
descrever sua aparência,
a maneira como se movem, e pronto. único problema com isso é que talvez
você precise fazer muitas edições para que 11 laboratórios
entendam seu avatar ideal. Então, se você tem as imagens ou
as fez aqui, é melhor escolher
essa opção. Então, acabei de escolher meu avatar
e vou fazer uma conversão de texto em fala,
algo muito Você só precisa mudar
a voz para, você sabe, a voz do avatar porque
esse é um modelo. Então, vou cortar
a maior parte desse
parágrafo e fazer com que ele diga essa
frase muito informativa, gere fala Na última sexta-feira, estudantes da Sunshine Elementary
School plantaram 20 árvores jovens
na horta da escola para manter o ambiente
limpo, verde e fresco Quando eu estiver feliz com isso, eu poderia usar o discurso
e depois enviá-lo. Aqui embaixo,
temos algumas opções. Nós já sabemos
o que esses dois são, mas esse cara é basicamente
o modelo para sincronização labial Portanto, é a mesma ideia dos modelos de
imagem e vídeo. Somente eles são feitos para
um propósito diferente. Você pode escolher qualquer um desses, mas eu escolhi
o mais popular Agora, enquanto isso está carregando, poderíamos passar algum
tempo gerando nosso avatar para ver
se isso funciona bem. Nosso avatar agora está
fazendo nosso discurso. Na última sexta-feira, estudantes da Sunshine Elementary
School plantaram 20 árvores jovens
na horta da escola para manter o ambiente
limpo, verde e fresco Você podia ver o movimento dos lábios. De acordo com as palavras
que estão sendo ditas, ele tem algum
movimento em seu corpo. Ele olha para a câmera, e
tem aquele podcast
tipo “limpar”. Na última sexta-feira, estudantes da
Sunshine Elementary School, então, claro, o movimento não
é tão natural Isso é sincronização labial com IA, mas pode ser útil para
certos tipos de conteúdo E você pode explorar isso
com outros avatares, até mesmo criar seu próprio Você pode ver como combinar seu áudio com um avatar como esse ou com um conteúdo de vídeo que criamos na lição
anterior. Portanto, essas são duas opções para tornar seus clipes mais envolventes e,
ao mesmo tempo, mostrar
a qualidade das vozes geradas por IA.
Mãe, ele
36. Aprimoramento com o ElevenLabs: Se você acabou com
uma imagem que não é da melhor qualidade ou apenas deseja alterar o tamanho dela, agora
você pode usar
o upscaling no Então, fui até minha pasta de
ativos e fiz upload de uma imagem
que fiz com IA. Então, atualmente,
parece assim. É um closeup dos olhos de um homem, mas quero acrescentar mais detalhes Eu quero torná-lo maior. E em vez de usar
outra ferramenta para pagar por ela, eu poderia simplesmente, você sabe,
vir aqui com a mesma assinatura
e alto nível Clique em Upscale e você será levado para a guia de
imagem e vídeo No momento, essa é a imagem
que vamos aprimorar e ela
escolheu automaticamente esse modelo Portanto, esse é o único modelo no momento que faz o upscaling E então, no lado direito, podemos decidir o tamanho dela. Então, vou até
o máximo para que
possamos ver a diferença,
e é mais ou menos isso. Portanto, você não precisa digitar nada nem fornecer
outras referências. Basta enviá-lo e ele aprimorará sua imagem Foi feito o upscaling. Aumentou quatro vezes. Essa é a
imagem original que eu fiz. Parece assim, já está
bem detalhado. Mas preste atenção
ao tamanho aqui. Esse é o tamanho e a dimensão atual em
pixels dessa imagem. Em seguida, aumentei a escala
usando o modelo e agora podemos ver o tamanho e a dimensão
novamente em pixels Então, isso é uma melhoria
de quatro vezes, e agora posso usar isso para projetos
maiores sem
perder qualidade. É basicamente assim que
você pode se aprimorar. Você poderia
aprimorar ainda mais a imagem ampliada. Então, vou escolher aquele que acabei de aprimorar. Eu ainda tenho a opção
de torná-lo maior. Então eu poderia ir para esse tamanho
agora e enviá-lo. Mas isso só vai se basear na imagem
anteriormente aprimorada. É uma
ferramenta bastante simples se você acha que, sabe, a imagem que
você
cortou está apenas sem detalhes Poderia ser mais nítido. Você pode usar esse recurso para, você sabe, torná-lo
altamente detalhado, muito maior, mas
lembre-se de que o tamanho também aumentará
. Então você pode experimentar isso com as
imagens que estamos fazendo e comparar
os diferentes tamanhos.
37. Fluxos: Todas as novas ferramentas
aqui realmente oferecem a possibilidade de expandir
seus resultados criativos Então, isso pode ser música, efeitos
sonoros, vídeo, imagem e as ferramentas clássicas de fala para texto
ou texto para Mas os fluxos levam tudo isso para o próximo nível e
permitem que você
tenha basicamente uma tela para gerar o conteúdo
com todas essas ferramentas. Portanto, é um tipo de
layout muito diferente do que estamos
acostumados esse tempo todo. Vamos
explorá-lo nesta lição. Sabemos que o studio pode ser
usado para produções maiores, mas os fluxos oferecem um layout totalmente novo, onde você pode arrastar e
soltar ferramentas diferentes, conectá-las
e trabalhar com elas como
se fossem nós Então, se você está
familiarizado com os nós, é praticamente a mesma ideia. Você cria um, conecta e cria um fluxo. Então, aqui estão alguns exemplos em que você pode pensar em um produto final, mas depois voltar atrás e ver quais eram os diferentes
componentes Então esse cara aqui,
se clicarmos nele, podemos ver os fluxos que
estão por trás dessa produção. Parece muito. E essas são
coisas às quais podemos não prestar atenção porque estamos vendo
apenas o produto final. Então, basicamente, se aumentarmos o zoom, você pode ver como
tudo aconteceu e onde estavam os pontos de
partida. Portanto, temos os designs iniciais. Nós temos o texto. Você pode usar a barra de espaço
para mover a tela. Em seguida, temos um texto diferente, novamente, um pouco mais de texto porque
este é um vídeo explicativo. Hum, e então eu vou
encontrar o visual. Então, esses são os visuais
que não foram gerados, e então eu poderia mover
cada uma dessas notas Então, agora, se você
olhar para isso, é muito, mas vou
mostrar como você pode criar seu próprio fluxo, e então
tudo isso fará sentido. Então, isso é apenas um exemplo
de sua aparência. Se voltarmos e passarmos o
mouse sobre isso, isso é o segundo
fluxograma Então, vamos clicar em Novo fluxo e nos
depararemos com uma tela em branco. Então, só para revisar a
interface rapidamente, temos o menu
no lado esquerdo. Assim, você pode criar um novo fluxo, ações
rápidas,
dar um novo nome, duplicar o compartilhamento,
criar um modelo com base nesse fluxo que
vamos criar Veja até mesmo seu histórico de versões. Assim, você pode voltar
para uma versão mais antiga. Primeiro, vamos dar um nome ao
nosso fluxo. Vamos chamar isso de
meu vídeo de flores, talvez. E o conceito que
tenho em mente é como um vaso de flores onde uma nova
planta está crescendo dentro. Então esse é o meu conceito, e eu vou fazer
um fluxo com base nisso. Portanto, antes de clicar
ou escrever qualquer coisa, você precisará de alguns componentes
diferentes que levarão
ao produto final. Sei que meu produto
final terá um visual,
um vídeo, e um vídeo precisará de algumas referências de
imagem. Então, isso já são duas coisas. Vai precisar de um áudio. Talvez isso possa ser uma narração, bem
como uma música de
fundo, e eu também quero adicionar alguns efeitos
sonoros Para ajudar a escrever o conteúdo da
narração, também
vou
usar a IA para Então, se você contar todos
eles, eles serão
vários componentes. Mas de agora em diante, chamarei
esses componentes de nós. Então, basta
clicar com o botão direito do mouse nessa tela você terá a
opção de adicionar um novo nó. Você também pode pressionar N no
teclado para uma ação rápida. Portanto, as notas podem ser diferentes. Pode ser uma imagem, vídeo, conversão de texto em fala,
sincronização labial e Então, essas são todas as coisas que analisamos
até agora. Não é nada novo. A única diferença
é que agora existem peças
menores que desempenham um
papel em uma produção maior. Então, todos eles são como atores em um filme maior, basicamente. Então, como eu disse, vou
precisar de uma imagem para começar. Então, vamos clicar nisso e
vamos pegar essa caixa. Agora, a interface aqui é o que estivemos
fazendo esse tempo todo. Você escolhe seu
modelo, a proporção, resolução, a qualidade
e, em seguida, escreve sua
solicitação e clica em Executar. A única diferença aqui é que temos essas
coisas ao lado. Então, esses são os conectores. Então, o que será feito com essa imagem
depois que ela estiver pronta? Será vinculado a
uma produção de vídeo ou será o
resultado de uma caixa de texto? Então é aqui que a ideia
do nó vai fazer mais sentido. Então, em vez de escrever
algo aqui, vou fazer um texto forma que eu possa
ter modelos diferentes, fazer o mesmo prompt
e, em seguida,
escolher o que é melhor para mim. Essa é a minha imagem aqui. Vamos clicar com o botão direito do mouse
novamente, adicionar um nó e vamos até ou simplesmente acessar aqui o
texto e escolher o texto. Essa é minha caixa de texto. Eu poderia começar a escrever ou usar a ajuda de um
grande modelo de linguagem. Então, digamos que eu não saiba como escrever minha solicitação para aquele vaso de flores, eu poderia criar outro nó. Preciso da ajuda de um LLM. Vamos colocar isso aqui. Vamos descer. E agora
eu tenho três coisas. E só para dizer como está
o fluxo até agora, teremos
um prompt gerado pelo Gemini ou por qualquer outro
modelo que desejarmos Isso levará a
essa caixa de texto onde eu poderia
ver minha solicitação finalizada Esse prompt de texto levará à geração da imagem. Então, a imagem
será feita com base nesse cara, e esse será
o resultado desse cara. Portanto, há um conector,
0,10 0,2 0,3. Então, vamos começar
aqui com nosso LLM. Você pode ver que ainda temos
alguns pontos de referência, mas quero que
esse seja o ponto de partida. Então, digamos que me dê
uma mensagem de imagem para um belo vaso de plantas que não tenha nenhuma planta e
seja apenas solo. Faça isso em ambientes fechados
com boa iluminação. Então esse é o meu aviso. Eu basicamente tenho uma ideia até agora. Não vou ter
o aviso final aqui e vou
escolher meu modelo agora. Então isso pode ser qualquer coisa. Digamos que você queira
fazer Gemini está bem aqui. Depois, você pode escolher o
modo para esse modelo. Então, se você for, cada um
desses modelos terá seu próprio modo. Então, por exemplo,
se eu escolher Claude, terei opções
diferentes para raciocinar e pensar,
e tudo isso resultará em coisas
diferentes porque estamos lidando com modelos diferentes E então temos
mais aqui também. Então, vamos
usar o Gemini 3.5. Vou fazer o mínimo. Não
é necessário pensar muito. Aqui podemos
decidir o comprimento. Isso pode ser automatizado. Vou deixar que
o Gemini decida
a duração
do meu prompt final, e então poderemos
começar a executá-lo Mas antes de fazer isso,
vou apontar a saída, que está no
lado direito da minha caixa de texto. Então, essas são entradas.
Essas são saídas Use a barra de espaço para
mover a tela. Então, eu também poderia usar isso
como minha ideia de entrada. Então, vamos detalhar isso
ainda mais. vamos copiar o que eu
escrevi e colocar aqui Em vez disso, vamos copiar o que eu
escrevi e colocar aqui e usar
isso como entrada. Então, basta conectá-lo a. Essa é nossa primeira conexão. Você pode ver que
o contorno ficou mais escuro e estamos
vendo uma linha real Eu sempre poderia cortar essa conexão para que eles
não fossem mais relacionados, ou eu poderia simplesmente fazer
uma nova como essa. Então, agora está fazendo uma mensagem de texto. Esse é o nome dessa caixa. Se eu mudar o nome, vamos chamar isso de minha ideia. Isso também vai
mudar aqui. Então, está dizendo a
essa caixa que olhe para esse cara para começar
com esse prompt. Então, de acordo com a minha ideia, vamos clicar em Run agora. Usando nosso Gemini 3.5. Então, isso vai gerar um
bom aviso para que agora eu
possa me conectar ao meu
nó de imagem. Então eu vou chamar isso. Então, esse nome está bom.
Agora vou gerar isso como uma entrada de texto
para o meu nó de imagem. Se quiser, você
também pode fazer suas alterações, executá-lo novamente e depois fazer isso, mas vou usar
esse prompt como está. Agora, observe que está escrito
no LLM aqui, e vou fazer com que esse nó de imagem seja gerado
com meu modelo favorito Então eu vou fazer nano Banana, escolher a proporção Aspec Por enquanto, vou fazer um quadrado, a qualidade e tudo mais, coisas que usamos até agora, e vou clicar em Run. Então, isso vai funcionar. Mas digamos que eu queira
fazer vários modelos. Então isso não é suficiente para mim. Eu também quero experimentar o JAGBT. Quero experimentar basicamente
vários outros modelos para determinar qual
é o melhor para o meu projeto. Vamos clicar com o botão direito
novamente ou simplesmente clicar e arrastar. E uma vez que você
se solte, ele perguntará, bem, a que isso
vai levar? Então, vou fazer a
geração de imagens novamente. E desta vez podemos
escolher outra coisa. Então, vamos usar o Cream
e depois clicar em Run. Agora, meu texto está levando
a duas coisas. Tivemos nossa primeira
imagem, segunda imagem. Eu poderia fazer
um terceiro, um quarto. Enquanto eles estiverem
conectados a isso, esse
será o aviso deles. É claro que você poderia escrever
o prompt diretamente aqui, mas criar um fluxo
como esse oferece muito mais flexibilidade quando se
trata de editar e, você sabe, refinar seu projeto Então, vamos fazer com que
esse cara faça seu trabalho. Você pode ver que
cerca de 30% está pronto agora, e eu poderia continuar
construindo com base nisso. Agora, você também pode adicionar uma referência de imagem clicando com
o botão direito do mouse,
adicionando outra imagem. Então, vamos ver a imagem aqui. Clique em Geração de imagens.
Agora, aqui, eu poderia simplesmente escrever alguma coisa. Podemos dizer basicamente essa ideia, mas sem contar o pote. Eu quero falar sobre o quarto. Então, vou dizer uma
aconchegante sala com janelas abertas
e móveis azuis, algo que poderia ser um pouco
diferente do que temos. Portanto, você pode usar novamente um modelo de linguagem grande para
ajudá-lo a escrever o prompt, mas vou fazer
algo muito simples e usarei o nano
Banana para executá-lo Então, aqui está nossa segunda imagem. Você pode ver como eles são
diferentes. E agora eu poderia conectar
isso a outra coisa. Mas primeiro, quero usar essa sala e fazer com que seja uma referência de
imagem para esse cara. Diga, isso é mais ideal
para mim do que isso. Agora eu poderia conectar
essa saída de imagem como uma entrada de imagem para este pote. Então, vamos mover isso aqui. Vamos dar um nome a ele, na verdade. Então, eu vou dizer que isso é uma referência de
imagem. Esta é a Imagem 1. Digamos que. Essa é a imagem dois, só para você saber a que estou me
referindo. Tudo bem. Depois de rotular nossa imagem, agora
podemos usar isso como
uma entrada para um vídeo Então, aprendemos sobre vídeos. Aprendemos que envolvemos
quadros iniciais e
referências de imagens. Então, isso agora pode
levar ao meu vídeo. Então clique e arraste, solte e vamos escolher Geração de
vídeo. Aí está. Aqui você pode ver que
temos várias entradas, assim como vimos
nas lições anteriores,
temos
quadro inicial, quadro final, referência de
imagem, referência de vídeo e
referência de áudio Também temos a entrada imediata. Isso pode ser o que
você digitar aqui, ou pode ser uma caixa de
texto como esta. Vou fazer com que
isso seja uma referência de imagem. Então, vamos pressionar X e
conectá-lo novamente usando isso. Então é isso que vai ser. Dessa forma, eu poderia
reconectá-lo a qualquer entrada que eu quisesse. Mas, na verdade, percebi que
queríamos refazer o plano de fundo. Então, agora que tenho
duas coisas conectadas. prompt original e
esse novo plano de fundo, vamos clicar em executar novamente. Então isso vai refazer todo
o trabalho e
me dar o mesmo vaso de flores. Então aí está meu vaso de flores. Pudemos ver que ele
integrava o azul, não tanto o sofá, mas tudo bem para mim Já que eu só
queria mostrar a vocês como uma referência de entrada
mudará o resultado. Agora que tenho
um vaso de flores azul, vou usá-lo como referência de
imagem
ou moldura inicial. Ing sobre o que você precisa.
E eu vou ter um desses modelos. Eu vou fazer seed dance. Faça com que basicamente uma semente brote em uma farinha desta mesma panela Então, a semente brota na panela
se transformando em um belo vermelho. Flor. Escolha as configurações. Vou fazer quadrados, já que é isso
que estamos fazendo até agora, a resolução, e então você
pode escolher a duração Vou silenciá-lo aqui
porque quero criar outro nó para o
áudio. Então, vamos executar isso. Se você quiser, você pode ter
outro modelo de linguagem grande. Node, esteja aqui para criar
um prompt melhor para você. Mas vamos
fazer o que temos agora e ver o
que vem como vimos. Também
podemos fazer
várias anotações
para vídeo, Também
podemos fazer
várias anotações experimentando modelos diferentes
e, em seguida, podemos escolher
o que preferimos. Agora, enquanto isso estiver em execução, vamos
trabalhar no áudio. Então, em algum lugar ao longo da tela,
vou escrever clique. Adicione um nó, mas desta vez, vamos usar o áudio. Isso pode ser conversão de texto em fala, efeito
sonoro, música ou qualquer outra coisa que
você queira começar Vamos clicar com o
botão direito do mouse aqui e fazer uma simples nota de áudio. Farei conversão de texto em fala e faremos uma frase muito simples Então, podemos dizer que novos começos e novas flores
vieram para ficar Algo assim,
escolha sua voz, e você também pode trabalhar
com a estabilidade, escolher seu modelo e
clicar em Executar. Então, são 3 segundos. Novos começos e novas flores vieram para ficar. Muito bom E eu poderia então
combinar isso em, você sabe, meu vídeo aqui
e obter meu resultado final. Então, basta arrastar essa saída de áudio e colocá-la como
entrada de áudio. Mova isso para o lado. E até agora, temos
esse mapa, você sabe, misto que leva à
nossa filmagem final exportada Lembre-se de que cada um
deles recebe seus próprios créditos. Portanto, certifique-se de que você tenha créditos suficientes para isso Vou deixar o
meu assim, mas se você clicar em reexecutar, ele também aplicará esse áudio
na filmagem Depois de terminar
o vídeo, embora ainda não tenha terminado
, você tem a opção de
copiá-lo, duplicá-lo,
talvez conectá-lo a outro que alguém pegue o
pote ou em uma cena diferente Você pode criar um modelo com tudo isso com esse botão. Você pode
baixá-lo quando estiver pronto. E como isso é uma tela, você também pode convidar outros membros da equipe
para virem aqui e, você sabe, ajudá-lo nesse projeto. Existem algumas ferramentas para isso. Temos nossa ferramenta Move,
nossa ferramenta de seleção. Temos nossa ferramenta Move, que é o que estamos usando
com uma barra de espaço. Tenha a ferramenta de comentários. Talvez um amigo entre aqui e ache
que o
sofá deveria ser lido Eles poderiam deixar um comentário, e ele aparecerá aqui. Então, faça vermelho, salve o comentário e agora ele vai aqui. Eu poderia resolver o comentário, discordar ou concordar, ou
deixar outro comentário Você também pode excluir o
comentário das pessoas, se quiser. Agora, se você não tiver certeza de como
começar com
todas essas notas, você também pode simplesmente começar
a conversar nesta caixa. Então, digamos que você possa escrever sobre a cena
final que deseja, um vaso de flores onde uma
nova planta está crescendo. Você pode escrevê-lo aqui e, em seguida ElevenLabs guiará
essa produção para Se você tiver referências
salvas em seu dispositivo local, poderá anexá-las aqui e enviar
essa solicitação. Agora, digamos que esse seja um
fluxo de trabalho que eu faço com
frequência para outros projetos
para minhas mídias sociais, talvez. Em vez de criar todo
esse layout de nó, eu poderia criar um modelo. Eu clico aqui, só preciso
identificar as entradas,
saídas e o formato de publicação Então, as coisas que só
têm algo saindo do
lado direito são as entradas Então esse cara não tinha entradas, portanto, é sua própria entrada Então, é só uma frase como
essa. Esta é minha opinião. Eu posso selecioná-lo e ele
será marcado como laranja. E então eu poderia fazer a
mesma coisa com a saída, dar um nome a ela e depois publicar meu modelo. Então, isso é algo
que você também pode fazer. Aqui está meu vídeo. Nós temos, você sabe, uma semente brotando Parece meio mágico, mas é uma flor vermelha. Poderíamos então estender isso
para um nó diferente. Então, uma nota extensora de vídeo, se quisermos transformá-la de
4 segundos para 20 segundos, podemos fazer a dublagem, mixá-la com um áudio e
usá-la como referência E muito mais pode ser feito. Então vá em frente e
experimente os fluxos. É uma ferramenta nova
e, na verdade, é muito legal. E você pode realmente trabalhar
em uma produção maior, combinar diferentes
ferramentas como notas e criar um
produto final onde você usa coisas
diferentes no
ElevenLabs para contar uma história, promover um produto, fazer um podcast ou qualquer
outra coisa que você queira fazer
38. O que é o ElevenAgents: Então, analisamos o
lado criativo do ElevenLabs. Nós olhamos para a voz. Examinamos a imagem, vimos o vídeo e muitas outras ferramentas
no lado esquerdo. Mas eles também introduzem
algo chamado ElevenAgents, e isso é algo para o qual
você pode
mudar acessando aqui. Então, basta clicar nele
e
vamos para a próxima
interface, basicamente. Então, ElevenAgents são
basicamente agentes de IA que você pode usar para
automatizar uma determinada tarefa, seja integrando as ferramentas
que a ElevenLabs possui ou,
você sabe, apenas
mantendo-as você sabe, apenas
mantendo-as Portanto, um dos
modelos que você pode ver é o suporte ao cliente. Esse é apenas um exemplo
de um agente 11. disso, ele realmente diz muito sobre o
fluxo de trabalho por trás dele, como está funcionando, e você também
pode visualizá-lo aqui. Então, agora,
vou fingir que, você sabe, eu preciso de suporte, e isso atualmente
envolve duas integrações Então, Saleforce e Zendas temos muitas opções diferentes
aqui Mas o principal recurso
é basicamente as ferramentas que você
já sabe
usar estejam integradas
nesses fluxos de trabalho Então, uma vez que vejamos um exemplo, ele vai fazer mais sentido. Ei, aqui é Jamie do suporte. Com o que posso ajudá-lo hoje? Preciso de ajuda com um problema
técnico. Eu ficaria feliz em ajudá-lo
com esse problema técnico. Você poderia me contar um pouco mais sobre o que está vivenciando e talvez compartilhar seu nome para que eu possa examinar sua conta? Meu nome é Alice e
meu computador quebrou. Lamento saber que seu
computador quebrou, Alice, mas como eu ofereço suporte às APIs e integrações de nossas
plataformas de IA , só
posso ajudar com
problemas como erros de API, integração ou
problemas Então, isso é só um exemplo. Você pode ver que,
embora eu realmente não perguntado para que serve o suporte, ele ainda entendeu minha preocupação e recebeu todas essas informações. Então, o início foi eu
pressionando o botão de chamada. A primeira coisa foi
identificar o problema. Abriu calorosamente,
o que aconteceu. E então eu acabei de dizer que
tinha um problema técnico. Em seguida, viemos aqui para propor
uma primeira etapa concreta, e então você poderia
resolver ou escalar. Digamos, diz: Ok, você
precisa nos fornecer
um número de série, e então eu concordo com eles. Eles vão
resolver isso agora, e depois acaba. Se eu disser que tenho um problema de conta e não tanto um problema técnico, o caminho
será diferente. Então, ele
examinará o faturamento com
meu nome e, em seguida, verá
se chegou a uma solução, ou escolherá a solução
que tem ou procurará mais detalhes
e, em seguida, encerrará a ligação Então, todo esse mapa
é basicamente como esse agente de IA está trabalhando
como suporte ao cliente. Também temos coisas diferentes, algo um pouco menos técnico é um professor de
prática de idiomas Assim, você pode começar de novo, e a primeira coisa que
ele fará é acessar seu nível
para esse idioma. Se eu sou iniciante,
é assim. Se eu for avançado,
é assim. Iniciantes, ele vai
ter um certo modo. Então, talvez usando certos dialetos, evitando vocabulários
extensos, falando mais devagar, essas coisas E então a sessão termina. Isso nos dá um resumo. Então, muitos modelos você pode
ver, mas, é claro, sempre
podemos criar nossos
próprios criando um agente. Assim, você pode navegar pelos modelos, fazer ajustes ou
criar um do zero. Então, vamos
aprender tudo sobre isso. Mas só para dar
uma olhada,
temos as diferentes categorias no lado esquerdo para nos
ajudar a começar. Temos agentes de criação, que é onde
estávamos configurando, as bases de conhecimento que ela possui Eu poderia criar e fazer upload alguns documentos aqui que
seriam usados pelos agentes. Por exemplo, se eu
tenho um agente que deveria ajudar clientes
com laptops quebrados, esse agente precisa saber
muito sobre laptops. Então, em vez de digitar
tudo, eu poderia simplesmente fazer o upload de um
documento aqui e depois conectar essa
base ao agente Então, ele pode voltar a isso, aprender um pouco mais sobre laptops e depois
voltar para aquela coleira Pode ser um URL, você pode confiar em um site. Você
pode colocá-lo aqui. Você pode fazer upload de um arquivo,
digitar algo, criar uma pasta
com vários arquivos ou sincronizar documentos
de outras plataformas. Temos 21 megabytes
de armazenamento aqui, o que é perfeito para
documentos, e você também pode classificar
e pesquisar Das nossas diferentes ferramentas aqui
que você pode adicionar. Então, qualquer tipo de integração
que você queira fazer. Então, eu teria que adicionar
uma conexão primeiro. temos muitas coisas que Atualmente, temos muitas coisas que funcionam com a ElevenLabs, e tudo o que você precisa fazer é
entrar, fazer essa conexão e ela estará
disponível para você usar no processo de
criação de agentes Então, essas são as
diferentes categorias, mas temos todas
elas listadas aqui. Você pode pesquisar e,
quando fizer login novamente, eles serão listados
aqui e você apenas os selecionará. Então, essa é uma ferramenta de integração. Temos ferramentas para clientes. As ferramentas do cliente são coisas
que exigem uma entrada. Então, por exemplo, o modelo
que analisamos, em o agente estava perguntando sobre o tipo de problema
que eu estava tendo, é uma ferramenta do cliente. Portanto, é como um problema técnico
ou apenas um tipo de problema, aguarde a resposta do usuário e faça certas coisas. Podemos adicionar parâmetros, variáveis
diferentes. Até mesmo edite isso como um arquivo JSoD. Também temos o webhook
e, em seguida, uma lista de outras
integrações que você pode adicionar Claro, temos nossas vozes. Afinal, são 11 laboratórios. Eles podem ser integrados como
as vozes de seus agentes. Para monitorar, você pode observar as conversas que estão acontecendo à medida que você implanta agentes, os usuários e, em seguida, os
diferentes testes que você faz. Então, quando você cria um agente, você quer testá-lo, ver se funciona bem, e
todos eles serão registrados aqui Implante, você
terá o seguinte. Portanto, ele pode ser implantado
com números de telefone Whatsapps ou até mesmo Portanto, temos todos os
níveis necessários para implantar um agente de IA bem-sucedido. Agora, vamos
começar primeiro com nosso agente. Vamos criar
uma na próxima lição, integrar algumas ferramentas, testá-la e depois implantá-la. Então, vocês podem
acompanhar esse agente simples que
vamos criar e que
entenderemos melhor
como isso funciona e
como você pode
aplicá-lo ao seu trabalho diário.
39. Crie o primeiro agente: Então, vamos criar nosso primeiro agente. Esse será
um agente muito simples, apenas para mostrar como funciona
e, com base nisso, você poderá criar agentes
mais complexos e integrar coisas diferentes. Então, para criar um agente, você clica nesse
botão aqui. E em vez de
escolher modelos, vamos
criar um em branco. Agora, nos modelos, que
já vimos, você pode escolher um que
seja semelhante ao que você precisa e simplesmente trocar as coisas que
são irrelevantes Vamos começar
com um agente em branco. Então, primeiro, vamos dar um nome ao
nosso agente. Vou dizer provedor de
informações, e vamos chamá-lo de Ben. Portanto, você pode escolher
aqui que seja um agente somente de bate-papo
ou um agente de áudio. Então, por padrão, é áudio
porque é ElevenLabs, mas se você quiser excluir isso, basta mantê-lo apenas no chat Então, basicamente,
seria semelhante
aos chatbots que aparecem
na lateral do site Mas, de certa forma, o áudio será algo parecido com uma chamada,
em que aguardará entrada de
uma fala
do usuário para operar. Vou deixar isso de e vamos criar Ben. Então aqui está o novo agente. Podemos ver que
há muitas coisas por aí que agora
podemos mudar. Então, à direita, está a
prévia do nosso agente. E porque
dissemos que queríamos áudio, você pode ver que tem, tipo, um pequeno símbolo de chamada telefônica, e eu poderia falar com Ben
agora e pedir que ele
me ajudasse com alguma coisa. Agora precisamos configurar Ben porque, no momento, ele é
apenas um evitador, basicamente. A primeira coisa que precisamos fazer
é dizer ao Ben o que eles são. Então, pode ser que você seja
um agente de suporte ao cliente. Você é assistente pessoal
ou algo parecido. Tudo o que você quiser fazer,
você pode colocá-lo aqui. Também temos nossa opção gerada com IA se você não tiver certeza como escrever
o prompt do sistema. Mas, basicamente, se você
clicar no pequeno livro, ele mostrará
o guia oficial. Portanto, você precisa
configurar o ambiente, a personalidade e
os diferentes aspectos desse agente. Então você pode ver que o tom
é um deles. O objetivo é um deles e a forma como esse agente deve interagir e
processar as entradas Portanto, você pode ler o guia
se quiser saber mais. Mas, para começar, vou fazer com que Ben atue como
um agente de voz automatizado
sempre que alguém
ligar para um agente de voz automatizado a empresa,
e nosso negócio imaginário
é um salão de cabeleireiro Então eu fiz um documento
baseado em conhecimento, que está disponível para
vocês baixarem. E eu vou te mostrar onde
você pode fazer o upload disso. Mas, por enquanto,
vamos contar a Ben Act. Então, digamos que você seja
um assistente útil para um salão de cabeleireiro e
as pessoas liguem para perguntar sobre as operações e horários
comerciais. Então, muito simples, o
trabalho dele não é tão difícil. Agora eu poderia usar a ferramenta aqui
para aprimorar isso ainda mais. Então, gere a IA. Na verdade, vamos copiar
isso e colocá-lo e ver qual prompt a ElevenLabs nos
dará que
é mais adequado Então você pode ver que seguiu o mesmo guia de ter
personalidade, o meio ambiente. Então, com quem eles estão
interagindo, o tom de voz aqui, o objetivo, todo o propósito
desse agente e os guarda-corpos Então, a única coisa que eu
preciso mudar é, você
sabe, o nome. Então você é Ben. E eu esqueço como se chama o nome do
nosso salão de cabeleireiro. Aqui está o documento sobre o qual eu
estava falando para vocês. Isso é o que acabei
chamando de salão de cabeleireiro, então vou
copiar isso. O salão de cabeleireiro Locke ou
o Hair Studio, pare com isso. E vamos verificar o resto. Ele sabe tudo, e então você está interagindo com as cores, e eu vou substituir
o nome o máximo que puder Então esse é o nome do nosso salão
de cabeleireiro. Vou fazer o Control F,
procurar o nome antigo e simplesmente trocá-lo. Esse é Ben, não Stella. Então, basta fazer uma pequena limpeza. Tudo bem, então não há mais glamour. E vou verificar se há Stella, caso haja
mais e não haja Tudo bem, então temos
tudo configurado para nós. Não precisei fazer
muita coisa, como você viu. Em seguida, vamos decidir
sobre a primeira mensagem. Então, quando a pessoa liga para Ben, qual deve ser a resposta? Então, olá, como
posso ajudá-lo hoje? Eu poderia dizer olá, eu sou Ben. Como posso te ajudar hoje? Agora, essa opção permite que o usuário meio que o
interrompa e, você sabe, diga sua mensagem
urgente. Mas se você quiser que ele
continue e diga o que quer, você pode simplesmente desligar isso. Então, está tudo bem.
Em seguida, vem a voz. Portanto, temos muitas
vozes para escolher. Eu vou escolher Eric porque é um
dos padrões e é muito fácil
para esse propósito Temos algo
chamado modo expressivo, que será mais,
como eles chamam, emocionalmente inteligente Então, quando se trata de
pausas para, tipo, emitir sons diferentes, será menos robótico Então, se o usuário disser “Eu caí da escada”, ele não vai
dizer: “Ah, isso é ótimo”. Vamos fazer isso. Eles serão mais
expressivos e soarão mais humanos. Então, isso é algo que você
pode adicionar, se quiser, ou pode
descartá-lo completamente. Depende de você. Então, vou
habilitá-lo para o meu propósito, e vou
encerrá-lo agora. Você pode ver que está
ligado e é Eric. Em seguida, temos o idioma. Só podemos fazer com que as pessoas
falem em inglês com Ben ou adicionem outros idiomas.
Isso depende de você. E então temos
nosso modelo de linguagem. Portanto, há algumas
coisas para começar, vou manter o padrão. Mas se você quiser
construir seu próprio modelo, oh, isso é algo que
você pode fazer aqui. É um pouco
mais intenso, então vou deixar isso de
fora por enquanto, apenas que
possamos acionar nosso agente
simples. Então esse é o comportamento padrão
e depois o do agente. Basicamente, você pode
configurar um comportamento onde ele funciona
com outra ferramenta, e há uma rotina que
esse agente precisa seguir. Por exemplo,
todos nós conhecemos o WhatsApp. É como uma plataforma de mensagens de texto. Então, se alguém enviar uma mensagem de texto para
eles, eles devem primeiro
ler o texto e depois responder ao texto e também ligar. Então, essas são coisas que o
WhatsApp permite que as pessoas façam. E, portanto, esse agente
precisa seguir esse comportamento. Isso vai ser
diferente para o Fresh Desk, então ele
responderá apenas aos tíquetes Então, cada um desses caras
é um pouco diferente. E se você
os escolher, haverá opções adicionais para eles. Mas, novamente, vou
manter tudo como padrão apenas para
que possamos começar. Então, desligue isso e agora nos
tornamos nosso agente. Vamos
adicionar uma base de conhecimento, que é onde criamos um espaço cheio de informações
sobre nossa marca. Então, no meu caso, esse é
o estúdio de cabeleireiro, e eu preciso fornecer a
Ben
o horário comercial, o tipo de serviço
para que, quando alguém ligar para nosso
número e
ele atender, ele saiba exatamente como
responder às perguntas. Mmm.
40. Integre: Então, criamos nosso agente
na lição anterior. Vamos continuar e dar a
Ben algum conhecimento. Vamos apenas acessar
a base de conhecimento e
fazer o upload do documento que mencionei que está
disponível para vocês. Isso também pode ser um URL
ou um arquivo diferente. O meu será um arquivo, então vamos fazer o upload agora. Então aí está o arquivo. Podemos mantê-lo em
nossa pasta atual. Vamos apenas
adicionar o arquivo. Então, agora, tudo o que
você adicionar aqui vai para
a base de conhecimento de Ben porque esse é o
espaço de trabalho em que estamos Então, se você quiser
remover algo, basta clicar em
desanexar do agente, e isso ficará
fora do alcance de Ben Mas eu quero manter isso, então agora vamos usar essa integração para ajudar Ben
em seu trabalho, basicamente. Além do documento como base, você pode integrar diferentes
ferramentas para seus agentes. Portanto, há várias coisas
que você pode conectar. Vou examinar as ferramentas
para adicionar uma ferramenta Você precisará de
algo chamado chaves de API, que é a
chave exclusiva que você obtém,
e você traz para essa
plataforma para ajudar na conexão
entre o ElevenLabs e qualquer ferramenta que esteja
tentando Então, por exemplo, se eu for até Ad Tool Integrations e
adicionar uma nova conexão, vamos encontrar algo bem
fácil. Eu vou com Exa Eu poderia dar um
nome a isso, pesquisa na web. Eu preciso de uma chave de API. Então, vamos até a EA
e compraremos isso para nós mesmos. Você acabou de pesquisar uma chave de API, você será
direcionado para este link. Crie o APIKey e vamos apenas
criar uma conta. Esse será o caso de
qualquer ferramenta que você escolher. Então é isso que eu
vou fazer bem rápido e depois vamos pegar
a chave para a cama. Então, acabei
de entrar usando um e-mail e vamos
criar nossa conta. Vou pular isso por enquanto. E eu vou até
ApiKeys e criar uma. Então eu vou chamar isso de
ElevenLabs. Crie a chave. Certifique-se de copiá-lo, volte aqui e
vamos colá-lo nesta área. Depois de terminar, você
pode clicar em Conectar e agora está tudo pronto. Então, uma vez que
tenhamos essa conexão, podemos decidir sobre a ferramenta e o serviço que
queremos que a EA nos forneça. E para o meu caso,
isso é uma busca. Então, clique em pesquisar
e clique em Criar. Então, quando terminarmos de usar as ferramentas, podemos simplesmente clicar na EA e dizer
basicamente como Ben
deve usar essa ferramenta. Portanto, o aviso de condição é o seguinte.
Esse é o padrão. Então, podemos dizer que escolha o tipo de conteúdo, use
destaques, recomendado. Acho que está tudo bem
por enquanto, porque o usuário pode perguntar
qualquer coisa ao Ben, e eu não quero
restringir isso aqui. Então, eu vou
deixar isso ser como está. E agora transformamos nosso
agente em uma ferramenta integrada. Na próxima lição,
vamos testar Ben e ver que
tipo de mudanças
podemos fazer e, em seguida,
como podemos
publicá-las em outro lugar onde
outras pessoas possam usá-las.
41. Teste: M Então Ben está pronto e agora temos que
testar para ver se ele se sai
bem. Então, na mesma página para agentes, você pode basicamente
começar a falar com Ben. Você pode ver no lado direito que
temos
basicamente uma pequena
interface de chamada, que
temos
basicamente uma pequena na qual eu posso
simplesmente falar no microfone e ver como Ben responde a Então, vamos começar uma ligação. Olá, sou Ben. Como posso te ajudar hoje? Olá. Quando a
empresa está aberta? Estamos fechados às segundas-feiras, mas abrimos das 9h às 18h. Às terças e quartas-feiras, das 9h às 20h às quintas e sextas-feiras . 8:00 da manhã às
17:00 aos sábados e das 10:00 às 15:00 aos domingos. Isso ajuda você a
planejar sua visita ou há mais alguma coisa em
que eu possa ajudá-lo? Sim. Você pode me contar
um pouco sobre as últimas tendências de cabelo que eu poderia contar ao meu estilista
na empresa Não tenho
informações específicas sobre as últimas tendências de cabelo
em meus recursos atuais, mas nossos estilistas são muito
experientes e podem definitivamente discutir os
estilos mais novos com você quando você chegar Você gostaria de
marcar uma consulta para
poder conversar com ele sobre o
que é popular no momento? Não. Você pode fazer uma
pesquisa na web sobre isso? Não consigo realizar pesquisas
na web, mas ficaria feliz em
conectar você a um de nossos estilistas, que pode
compartilhar as últimas tendências Você gostaria que eu o
transferisse para alguém que
possa ajudar com isso? Acabei de terminar a
ligação, mas até agora, quando se tratava de falar
sobre o negócio, Ben conseguiu nos ajudar. Mas quando
se tratava da pesquisa na web, ele ainda não tinha
permissão para fazer isso. Então, o que vamos
fazer é voltar ao prompt
do sistema e incluir
o aspecto de pesquisa na web. Então, eu vou até aqui
e descobrir o objetivo. Então, bem-vindo. Está tudo bem. Ok, então temos compromissos,
localização, direções, perguntas
gerais e, em seguida,
poderíamos adicionar outra Vou copiar a
mesma linha para que o
formato seja o mesmo. Vamos dizer que, para consultas de pesquisa
na web, responderemos perguntas usando A para pesquisas na web e forneceremos aos
usuários os destaques Então, vamos tentar isso de novo
e ver o que acontece. Vou fechar isso agora e depois começar
outra conversa. Na verdade, também vamos alterar sua primeira mensagem para
que possamos ver a atualização. Então, como posso ajudá-lo hoje? Você quer modelar seu cabelo? Tudo bem? Vamos experimentar isso. Olá, sou Ben. Como
posso te ajudar hoje? Você quer modelar seu cabelo? Sim, conte-me mais sobre os serviços comerciais e quando eu poderia entrar
para arrumar meu cabelo. Oferecemos uma variedade maravilhosa de serviços, incluindo cortes de cabelo
femininos, masculinos e infantis. Não quero filhos, apenas para mulheres adultas Ah, com certeza. Temos serviços fantásticos
especificamente para mulheres adultas, como nosso corte de cabelo
feminino exclusivo,
blowouts e várias opções de
cores, como Baliage como Baliage Você pode nos visitar de terça a
quarta-feira, das
9h às 18h,
quinta e sexta-feira até 20h. Sábado,
das 8h às 17h
, ou domingo, das 10h às 15h, pois fechamos às
segundas-feiras. 10h às 15h, pois fechamos às
segundas-feiras. Parece uma boa
hora para você entrar? Sim, mas faça uma pesquisa na web sobre as últimas tendências de cabelo para que eu
possa entrar e contar aos
meus estilistas sobre isso Essa é uma ideia fantástica. As últimas tendências para o final de
2026 dizem respeito a cabelos polidos, com aparência
saudável e um toque natural Os estilos populares incluem
blusões elegantes, chignons
modernos e
o namorado Bob,
enquanto as cores estão
mudando para morenas ricas e
brilhantes, conhaque chignons
modernos e
o namorado Bob, enquanto as cores estão
mudando para morenas ricas e
brilhantes, morenas ricas e
brilhantes Você gostaria de marcar uma
consulta para discutir a experimentação de um desses looks
com um de nossos estilistas Sim, marque uma consulta para mim. Eu ficaria feliz em
ajudá-lo a agendar isso. Para encontrar o horário perfeito, você
poderia me
dizer seu nome, qual serviço você está
interessado e qual dia ou horário
funciona melhor para você. Além disso, você prefere
um estilista específico ou gostaria de ver
quem está disponível Na verdade, mudei de ideia e não quero uma consulta. Não tem problema nenhum. Eu entendo perfeitamente que
os planos podem mudar. Se você decidir marcar uma consulta mais tarde ou tiver alguma outra
dúvida sobre nossos serviços, sinta-se
à vontade para nos ligar de volta. Há mais alguma coisa em que eu
possa ajudá-lo hoje? Não, isso é tudo. Você é muito bem-vindo. Tenha um dia maravilhoso e esperamos vê-lo no Lux Hair Studio sempre que
estiver pronto. Adeus Então, como você pode ver, essa era uma maneira muito natural
de falar por Ben, e agora ele era capaz de
acessar a web por meio
da ferramenta que conectamos e me fornecer algumas informações. E eu interrompi
Ben no início, e isso é porque
temos isso ligado Novamente, você pode
desativá-lo se quiser que seu agente diga
as frases na íntegra. E as
idas e vindas entre mim e o agente também mostram
o poder de 11 agentes. Você pode ver que fui
marcar uma consulta, mas depois mudei de ideia e consegui usar as tags corretas para
responder a mim como usuário. Então, compreensiva, amigável e pronta para se despedir,
foi se aquecer E então, quando eu finalmente aceitei a consulta,
foi alegre Então, todos esses são sinais de que essa conversa
correu muito bem e configuramos Ben corretamente. Então testamos Ben e fizemos alguns ajustes. Também faça testes mais intensivos. Então é aí que você
configura um modelo, e você tem que repetir até que um problema seja encontrado. Por exemplo, eu poderia
configurar um teste em que Ben fosse chamado cinco vezes em um minuto e pudesse ver o
quão bem ele pula para frente e para
trás com
os cinco chamadores Mas isso é algo um
pouco mais intenso
e, por enquanto, quero mudar o foco para a
publicação desse novo agente.
42. Editoração: M Então Ben está pronto e agora temos que
testar para ver se ele se sai
bem. Então, na mesma página para agentes, você pode basicamente
começar a falar com Ben. Você pode ver no lado direito que
temos
basicamente uma pequena
interface de chamada, que
temos
basicamente uma pequena na qual eu posso
simplesmente falar no microfone e ver como Ben responde a Então, vamos começar uma ligação. Olá, eu sou Ben. Como posso te ajudar hoje? Olá. Quando a
empresa está aberta? Estamos fechados às segundas-feiras, mas abrimos das 9h às 18h. Às terças e quartas-feiras, das 9h às 20h às quintas e sextas-feiras . 8:00 da manhã às
17:00 aos sábados e das 10:00 às 15:00 aos domingos. Isso ajuda você a
planejar sua visita ou há mais alguma coisa em
que eu possa ajudá-lo? Sim Você pode me contar
um pouco sobre as últimas tendências de cabelo que eu poderia contar ao meu estilista
na empresa Não tenho
informações específicas sobre as últimas tendências de cabelo
em meus recursos atuais, mas nossos estilistas são muito
experientes e podem definitivamente discutir os
estilos mais novos com você quando você chegar Você gostaria de
marcar uma consulta para
poder conversar com ele sobre o
que é popular no momento? Não. Você pode fazer uma
pesquisa na web sobre isso? Não consigo realizar pesquisas
na web, mas ficaria feliz em
conectar você a um de nossos estilistas, que pode
compartilhar as últimas tendências Você gostaria que eu o
transferisse para alguém que
possa ajudar com isso? Acabei de terminar a
ligação, mas até agora, quando se tratava de falar
sobre o negócio, Ben conseguiu nos ajudar. Mas quando
se tratava da pesquisa na web, ele ainda não tinha
permissão para fazer isso. Então, o que vamos
fazer é voltar ao prompt
do sistema e incluir
o aspecto de pesquisa na web. Então, eu vou até aqui
e descobrir o objetivo. Então, bem-vindo. Está tudo bem. Ok, então temos compromissos, localização, direções, perguntas
gerais E então poderíamos
adicionar outro. Vou copiar a
mesma linha para que o
formato seja o mesmo. Vamos dizer que, para consultas de pesquisa
na web, responderemos perguntas usando A para pesquisas
na web e forneceremos aos
usuários os destaques Então, vamos tentar isso de novo
e ver o que acontece. Vou fechar isso agora e depois começar
outra conversa. Na verdade, também vamos alterar sua primeira mensagem para
que possamos ver a atualização. Então, como posso ajudá-lo hoje? Você quer modelar seu cabelo? Tudo bem? Vamos experimentar isso. Olá, eu sou Ben. Como
posso te ajudar hoje? Você quer modelar seu cabelo? Sim, conte-me mais sobre os serviços comerciais e quando eu poderia entrar
para arrumar meu cabelo. Oferecemos uma variedade maravilhosa de serviços, incluindo cortes de cabelo
femininos, masculinos e infantis. Não quero filhos, apenas para mulheres adultas Ah, com certeza. Temos serviços fantásticos
especificamente para mulheres adultas, como nosso corte de cabelo
feminino exclusivo,
blowouts e várias opções de
cores, como Baliage como Baliage Você pode nos visitar de terça a
quarta-feira, das
9h às 18h,
quinta e sexta-feira até 20h. Sábado,
das 8h às 17h
, ou domingo, das 10h às 15h, pois fechamos às
segundas-feiras. 10h às 15h, pois fechamos às
segundas-feiras. Parece uma boa
hora para você entrar? Sim, mas faça uma pesquisa na web sobre as últimas tendências de cabelo para que eu
possa entrar e contar aos
meus estilistas sobre isso Essa é uma ideia fantástica. As últimas tendências para o final de
2026 dizem respeito a cabelos polidos, com aparência
saudável e um toque natural Os estilos populares incluem
blusões elegantes, chignons
modernos e
o namorado Bob,
enquanto as cores estão
mudando para morenas ricas e
brilhantes, conhaque chignons
modernos e
o namorado Bob, enquanto as cores estão
mudando para morenas ricas e
brilhantes, morenas ricas e
brilhantes Você gostaria de marcar uma
consulta para discutir a experimentação de um desses looks
com um de nossos estilistas Sim, marque uma consulta para mim. Eu ficaria feliz em
ajudá-lo a agendar isso. Para encontrar o horário perfeito, você
poderia me
dizer seu nome, qual serviço você está
interessado e qual dia ou horário
funciona melhor para você. Além disso, você prefere
um estilista específico ou gostaria de ver
quem está disponível Na verdade, mudei de ideia e não quero uma consulta. Não tem problema nenhum. Eu entendo perfeitamente que
os planos podem mudar. Se você decidir marcar uma consulta mais tarde ou tiver alguma outra
dúvida sobre nossos serviços, sinta-se
à vontade para nos ligar de volta. Há mais alguma coisa em que eu
possa ajudá-lo hoje? Não, isso é tudo. Você é muito bem-vindo. Tenha um dia maravilhoso e esperamos vê-lo no Lux Hair Studio sempre que
estiver pronto. Adeus Então, como você pode ver, essa era uma maneira muito natural
de falar por Ben, e agora ele podia
acessar a web por meio
da ferramenta que conectamos e me fornecer algumas informações. E eu interrompi
Ben no início, e isso é porque
temos isso ligado Novamente, você pode
desativá-lo se quiser que seu agente diga
as frases na íntegra. E as
idas e vindas entre mim e o agente também mostram
o poder de 11 agentes. Você pode ver que fui
marcar uma consulta, mas depois mudei de ideia e consegui usar as tags corretas para
responder a mim como usuário. Então, compreensiva, amigável e pronta para se despedir,
foi se aquecer E então, quando eu finalmente aceitei a consulta,
foi alegre Então, todos esses são sinais de que essa conversa
correu muito bem, e configuramos Ben corretamente. Então testamos Ben e fizemos alguns ajustes. Também pode fazer testes mais
intensivos. Então é aí que você
configura um modelo e repete
até
que um problema seja encontrado. Por exemplo, eu poderia
configurar um teste em que Ben fosse chamado cinco vezes em um minuto e pudesse ver o
quão bem ele pula para frente e para
trás com
os cinco chamadores Mas isso é algo
um pouco mais intenso e, por enquanto, quero mudar o foco para publicar
esse novo agente.
43. Outras ferramentas de IA para usar com o ElevenLabs
: Agora que sabemos
como usar totalmente ElevenLabs para criar
diferentes tipos de áudio, desde uma narração até um audiolivro, agora
estamos prontos
para criar áudios Mas você também pode aprimorar
suas habilidades
combinando diferentes
ferramentas de IA com o ElevenLabs Portanto, o ElevenLabs é
conhecido principalmente pelo áudio. Como vimos, é muito bom e está melhorando constantemente. Mas como você pode combinar outras ferramentas de IA muito boas para criar alguns projetos incríveis? Então, vou recomendar algumas ferramentas que você
talvez
já conheça ou não e explicarei
como combiná-las com o ElevenLabs A primeira ferramenta que já
vimos como usar foi o Chat GPT Tenho certeza que você está mais
familiarizado com isso. Mas o que você pode fazer com
isso é, antes de tudo, transformar um URL em uma versão resumida para que você possa usá-lo em um
podcast ou audiolivro Como também vimos,
você pode alterar um idioma e adicionar alguns elementos que podem aprimorar a fala criada pelo 11 Lab. No GPT, você também pode
começar do zero, como escrever um
livro sobre maçãs ou escrever um roteiro para
um podcast falando
sobre tornados Em termos de scripts
e brainstorming, essa plataforma é um
ótimo lugar para *** não só de graça, mas também é muito bom
no Agora, você tem seu roteiro, você tem seu áudio.
E quanto às filmagens Um lugar onde você pode obter
imagens é Mid Journey. Essa é outra plataforma de IA. Hoje em dia, eles também fazem
pequenos trechos de vídeos. Falarei sobre
vídeos daqui a pouco, mas se você quiser fazer
dublagem sobre imagens, esse é o lugar certo Essa não é uma ferramenta gratuita. Acredito que mesmo que você
queira usar a versão gratuita, há muitas limitações. Mas, como você pode ver, esses são alguns exemplos que você pode
fazer com essa ferramenta y. Depois de
fazê-los aqui,
você pode exportá-los para o ElevenLabs, fazer suas dublagens e criar Agora, e se você
quiser fazer vídeos? O Runway AI é uma ótima
plataforma para vídeos. Existem outros por
aí, mas esse
é provavelmente o mais
fácil de usar. A forma como isso funciona é que assim como qualquer outra plataforma de IA, você dá um aviso,
como você pode ver aqui. Você pode brincar com
os ângulos, com o humor, os personagens, manter
os personagens estáveis e fazer várias
coisas diferentes. Isso, mais uma vez, se você estiver
usando a versão gratuita, existem alguns limites. Você poderia atualizar para
uma versão melhor, mas se você não planeja
fazer isso com tanta frequência, você realmente não
precisa comprar uma conta completa. O ChagPT também
gera imagens para você. Se você não quiser pagar
por Mid Journey ou DaVinci, basta voltar
para a equipe do Chat GIP Dessa forma, você está combinando recursos
de script, imagem e vídeo com
seus áudios já criados Dessa forma, você tem a opção de
gerar
conteúdo diferente e não
depender totalmente de conteúdo somente de áudio. Agora que temos todas
essas ferramentas à nossa disposição, vamos falar sobre como você pode monetizar esse conteúdo,
se quiser Te vejo
na próxima aula.
44. Monetização e próximos passos: Há várias maneiras
de monetizar com a
ElevenLabs, assim como com outras ferramentas de
IA Portanto, além de poder
criar seu canal no YouTube e monetizar por meio dessa plataforma criando conteúdo
com a ElevenLabs, você também pode participar do próprio programa de criadores da
ElevenLabs Então, quando vamos
à Biblioteca de Vozes, há algumas que
cobram por minuto. E você pode ver que não
existem muitos, mas eles existem. Essencialmente, o que você
pode fazer ao criar sua própria voz é
receber o pagamento passivamente
depois enviar um
áudio de alta qualidade em 11 laboratórios Por exemplo, esse
áudio é eu reviso,
$0,02 para eu usar Cara, se surfar ondas
é minha religião, então tacos são pura comunhão,
mano Então esse é um exemplo. Você pode
ver que é de altíssima qualidade ,
muito nítida e tem a voz perfeita
para essa categoria. Então, essa é uma maneira monetizar as
criações da
ElevenLabs disso, eles também têm
uma página de operadoras, onde você se torna um daqueles especialistas
dos quais pode usar seus
serviços na produção Lembre-se de que, quando fomos até
aqui, cobrávamos,
se fôssemos usá-lo, uma cobrança $2 por minuto e
todos esses preços Eles seriam então feitos por humanos
reais, conforme discutimos. Você poderia se qualificar para
ser uma dessas pessoas. Simplesmente acessando
a página inicial de carreiras e abrindo as vagas, você pode ver quantas coisas
elas têm disponíveis Agora, esses são empregos em tempo integral, mas se você usar a barra de
transcrição para legendar,
verá que isso
é Portanto, sempre que houver uma
demanda por seu serviço, você será
contatado e gravará um áudio com
sua voz para outra pessoa. Você pode ver que é até remoto, e tudo isso está
dentro dessa plataforma. Você definitivamente deveria dar uma
olhada se planeja ganhar dinheiro
com a ElevenLabs Outra maneira de fazer
isso é criar conteúdo on-line,
como vídeos do YouTube, vídeos do
Instagram, Tik Tok ou qualquer outra coisa,
usando o ElevenLabs Isso economizará
tempo para você gravar tudo com sua
própria voz e
usar essas gerações de áudio realmente rápidas e
precisas para criar seu conteúdo. Por exemplo, você pode cobrir desastres naturais
assustadores, como fizemos com um de nossos projetos Você pode fazer uma visão geral
da biografia contando a
história de pessoas famosas. Há tantas coisas lá
fora que você pode fazer. Mas o papel da ElevenLabs nisso é
que é
apenas o áudio Você ainda precisa
trabalhar muito para anunciar seu conteúdo, divulgá-lo, fazer com que
as pessoas assistam, se engajem e
todas essas coisas Outra coisa que você pode fazer é trabalhar como freelancer na ElevenLabs Basicamente, você poderia usar
plataformas como Fiber, Upwork e existem tantas hoje em dia e oferecer o serviço de criar áudios de
IA para um Se alguém não quiser
usar seu próprio áudio, pode ir até você para que você
possa criar o áudio e o áudio
com precisão. Da mesma forma que alteramos as
vozes de um podcast assustador, um anúncio, um podcast
normal, você estaria fazendo
a mesma coisa, mas com base na necessidade do cliente Essas são apenas algumas maneiras
muito rápidas de monetizar
com 11 Assim como qualquer outra ferramenta de IA, haverá muita demanda por esse tipo de
conteúdo e trabalho. Fique de olho e
verifique se você está
nas comunidades certas
para estar ciente de todas as atualizações e de
todos os truques legais que você
pode fazer com essa plataforma. Redit tem muitos deles, e então você pode
acessar talvez o Facebook, Discord e
continuar praticando criação de áudios e aprendendo novas
maneiras de melhorá-los Espero que vocês gostem desse
curso e que continuem usando esse
programa muito legal para seu próprio conteúdo. Espero ver vocês em breve.
45. Projeto do curso: criar seu próprio conteúdo audiovisual.: Agora é sua vez de pegar
o que você aprendeu e criar seu próprio projeto
usando o ElevenLabs Para o seu projeto de classe, gostaria que vocês
criassem um conteúdo de áudio ou visual usando todas as ferramentas
que aprendemos. Você também pode
combiná-lo com o local em que
os recursos visuais foram criados e depois combinados com o áudio
que você criou. tem muita liberdade aqui. Você pode criar um
vídeo curto, um audiolivro, um podcast, um vídeo com sincronização labial e qualquer outra coisa
que você queira fazer Comece decidindo o que você
quer fazer e para quem se destina. Em seguida, pense em quais
das muitas ferramentas você pode usar
para criar esse projeto. Você pode escolher ou criar
uma voz apropriada para seu projeto e ver como ela pode se
encaixar na sua ideia. Pode ser apenas um projeto de áudio. Mas se você quiser dar
um passo adiante, você pode adicionar algum conteúdo visual feito a partir das ferramentas criativas. Aprendemos como
gerar imagens, vídeos e como podemos fazer uma
produção completa usando fluxos. Portanto, escolha as ferramentas que
realmente ajudam com sua ideia. Ao terminar,
você pode fazer
o upload do projeto para a biblioteca de projetos da
classe. Dependendo do que você fez, você pode incluir
o conteúdo completo, capturas de tela
e, além disso, fornecer uma explicação falando sobre seu processo,
sua ideia, alguns
desafios que você enfrenta e sobre o que você estava curioso E lembre-se de que, ao usar a
IA para gerar vozes, você quer fazer isso com responsabilidade Especialmente se você estiver clonando outras vozes ou criando conteúdo
baseado em pessoas reais Estou ansioso para ver
o que vocês criam.
46. Parabéns! E depois?: Mãe, ele. Parabéns por terminar a master class de
IA da ElevenLabs Já abordamos muita coisa
neste curso, mas até agora, você sabe que 11 laboratórios são muito mais do que
apenas conversão de texto O importante agora é
continuar experimentando
as ferramentas Você não precisa usar
todas as ferramentas do seu projeto, mas pode ver quais
ferramentas ajudariam a melhorar seu fluxo de trabalho ou a
criar um conteúdo melhor. Ou fluxos de trabalho ainda maiores, você pode combinar 11 laboratórios com
outras ferramentas de IA disponíveis Isso pode ser para
trabalhar para uma empresa com um único cliente ou para
seu próprio projeto pessoal. Se ainda não o fez,
certifique-se de fazer o upload do
seu projeto para a biblioteca de projetos da
classe. Eu adoraria ver como
vocês usam as ferramentas e como as combinam
para gerar suas ideias. E se você gostar do curso, fique à vontade para nos deixar
uma avaliação, pois isso realmente nos
ajuda a melhorar nosso conteúdo.
Obrigado por se juntar a mim. Espero que este curso tenha deixado muitas ideias
sobre como
você pode usar o ElevenLabs
para seus próprios projetos Continue criando, e vejo
vocês na próxima aula.