Transcripciones
1. ¡Hola!: Bienvenido a la Clase Master de
IA de ElevenLabs. Las voces generadas por IA se han vuelto increíblemente populares y capaces, pero ElevenLabs puede hacer mucho más
que solo texto Puedes diseñar y clonar voces, crear efectos de sonido en la música, producir audiolibros y podcasts, copiar contenido en otros idiomas, generar
contenido visual e incluso crear agentes de IA que puedan
interactuar con En este curso, te mostraré cómo usar estas herramientas a través ejemplos
prácticos y te mostraré exactamente de qué
es capaz ElevenLabs Puedes entender no
solo cómo funciona ElevenLabs, sino cómo podrías aplicarlo y usarlo para tu propio trabajo
profesional Mi nombre es Jose
Kuchii y soy diseñador visual con más de cinco años de experiencia
trabajando con herramientas de IA, contenido
creativo y flujos de trabajo
digitales He pasado mucho tiempo
trabajando con estas herramientas de IA para encontrar la mejor manera de
integrarlas en proyectos
reales. A lo largo de este curso,
compartiré contigo las técnicas, flujos de trabajo y herramientas que me
han ayudado en el camino. Empezaremos con
los fundamentos. Te familiarizarás
con la interfaz, las cuentas, los precios, cómo puedes
configurarlo de la mejor manera, y luego vamos a
pasar a las indicaciones,
que es esencialmente cómo te
comunicas con esta herramienta Una vez que los
tengamos en nuestro haber, vamos a pasar a todas las herramientas que
ElevenLabs tiene para Aprenderás a encontrar
y crear tus propias voces, cómo puedes transformar las
existentes, cómo puedes doblar audio para
podcasts o audiolibros, cómo puedes crear
efectos de sonido y música,
y también cómo hacer
contenido visual con En el camino, también
exploraremos estudio y otras
herramientas de producción para proyectos más grandes. Una vez que se sienta cómodo
con las herramientas, vamos a pasar a
algunos proyectos prácticos. Trabajarás con
activos y plantillas, generación de
imágenes y videos, sincronización de labios, escalado y flujos para
ver cómo estas herramientas se
pueden integrar en un proceso creativo mucho
mayor Y finalmente, vamos
a explorar 11 agentes. Allá,
vas a aprender qué son, cómo
puedes usarlos, y también
vamos a crear uno juntos donde los
probemos e implementemos. Al final de este curso, tendrás una
comprensión más amplia de 11 laboratorios, pero lo que es más importante,
vas a haber tenido experiencia práctica en la
creación de esos proyectos. Así que sigamos adelante
y comencemos.
2. ¿Qué es ElevenLabs?: Antes de entrar en cómo
usar ElevenLabs, primero
hablemos de qué
es y cuáles son los casos de uso Entonces ElevenLabs es en realidad una compañía de IA y se
especializan en audio generativo audio generativo básicamente
significa cuando generas audio, y dado que esta
es una herramienta de IA, estás haciendo audio con IA Ahora, anteriormente, ha
habido muchas tecnologías con respecto al audio
generativo, como texto a voz,
voz a texto Sin embargo, aquellos que rara vez involucraron IA recientemente con
esta implementación, el flujo de trabajo se ha vuelto mucho más fácil y
mucho más preciso. Cuando tecleas algo
y usas puntuación, en lugar de que suene
súper robot, ahora con IA, suena mucho más realista y al
revés de voz a texto, puede captar tus
palabras mucho mejor en comparación con la
tecnología anterior que estaba Esta en estos momentos es la
página de inicio de ElevenLabs. Hablaremos de cuenta
y precios en un poco. Pero solo para guiarte
a través de lo que puedes hacer con esta herramienta, obviamente, puedes hacer muchas cosas
instantáneas
como texto a voz y
luego voz a texto,
pero puedes generar audios pero puedes generar Puedes hacer podcast con él. Tal vez solo puedas
hablar con una IA para video de
YouTube o
incluso puedes generar tus
propios efectos de sonido. Hay mucho que
puedes hacer aquí y esta es una
herramienta muy popular si te gusta hacer contenido o tener
algún canal donde
quieras publicar estos contenidos o
tal vez incluso monetizar Mucho espacio para
experimentar con esta herramienta, puedes generar
un montón de cosas, ver cuál funciona
mejor y luego
comprometerte completamente con un clip de audio más largo La forma en que funciona es que
tienes tu cuenta, obtienes cierta cantidad de
créditos y por generación, vas a
usar algunos créditos dependiendo de la
duración de tu audio. Si ya has usado herramientas de IA antes, el flujo de trabajo es
relativamente el mismo. Le das un prompt,
le das una entrada, eliges tu modelo y
luego obtienes una salida. Que sepamos lo que es
la plataforma, brevemente, solo una visión
general, vamos a hablar la cuenta y los precios
en la siguiente lección.
3. Cuenta y precios: Antes de entrar en cómo
usar ElevenLabs, primero
hablemos de qué
es y cuáles son los casos de uso Entonces ElevenLabs es en realidad una compañía de IA y se
especializan en audio generativo audio generativo básicamente
significa cuando generas audio, y dado que esta
es una herramienta de IA, estás haciendo audio con IA Ahora, anteriormente, ha
habido muchas tecnologías con respecto al audio
generativo, como texto a voz,
voz a texto Sin embargo, los que
rara vez involucraban la IA, recientemente con esta
implementación, el flujo de trabajo se ha vuelto mucho más fácil y
mucho más preciso. Cuando tecleas algo
y usas puntuación, en lugar de que suene
súper robótico, ahora con IA, suena mucho más realista y al
revés de voz a texto, puede captar tus
palabras mucho mejor en comparación con la
tecnología anterior que estaba Esta en estos momentos es la
página de inicio de ElevenLabs. Hablaremos de cuenta
y precios en un poco. Pero solo para guiarte
a través de lo que puedes hacer con esta herramienta, obviamente, puedes hacer muchas cosas
instantáneas
como texto a voz y
luego voz a texto,
pero puedes generar audios pero puedes generar Puedes hacer podcast con él. Tal vez solo puedas
hablar con una IA para video de
YouTube o
incluso puedes generar tus
propios efectos de sonido. Hay mucho que
puedes hacer aquí y esta es una
herramienta muy popular si te gusta hacer contenido o tener
algún canal donde
quieras publicar estos contenidos o
tal vez incluso monetizar Mucho espacio para
experimentar con esta herramienta, puedes generar
un montón de cosas, ver cuál funciona
mejor y luego
comprometerte completamente con un clip de audio más largo La forma en que funciona es que
tienes tu cuenta, obtienes cierta
cantidad de créditos, y por generación,
vas a usar algunos créditos
dependiendo de la duración de tu audio. Si ya has usado herramientas de IA antes, el flujo de trabajo es
relativamente el mismo. Le das un prompt,
le das una entrada, eliges tu modelo y
luego obtienes una salida. Que sepamos lo que es
la plataforma, brevemente, solo una visión
general, vamos a hablar la cuenta y los precios
en la siguiente lección.
4. Descripción general de la ética de la IA: Con todas estas nuevas herramientas de IA que salen casi
todos los meses, es muy importante
que repases
la ética del uso de la IA si aún no estás
familiarizado con ellas. Si eres un principiante usando 11
laboratorios o cualquier otra herramienta de IA, tal vez
te preguntes por qué a veces se
considera poco ético Incluso si lo sabes y
aún no estás convencido, es importante que
te des cuenta
del riesgo y por qué
potencialmente podría dañar a otras personas. Para esta lección,
vamos a hablar un poco sobre la ética del uso
de herramientas de IA, ya sea Chau BT, pasarela, M journey
o incluso 11 laboratorios Hoy en día hay un auge en las herramientas de
IA, y es importante para ti
como usuario conocer el riesgo y por qué necesitas
estar usando esta herramienta, estas herramientas realmente geniales de
una manera más responsable. Muchas veces acudes a
estas herramientas de IA para
hacer tu trabajo más fácil, ayudarte con un proyecto,
o simplemente divertirte un poco. Todo eso está bien
siempre y cuando
no lo estés usando para dañar a nadie. Ahora bien, ¿a qué me refiero con daño? Muchas veces estas herramientas de IA se están utilizando para
hacerse pasar por personas. Los insumos que se utilizan
para capacitar a estos modelos
suelen ser tomados de
personas que no lo dieron su consentimiento. Por ejemplo, con
muchas herramientas de arte, son
muchos los artistas que
afirman que sus obras han sido utilizadas para entrenar a estos modelos cuando no dieron su consentimiento. Qué pasa cuando ese artista que trabajó muy
duro da su arte se está utilizando para
entrenar a estos modelos y luego haces algo
con él y luego lo vendes. Tú ahí mismo has contribuido
a sabiendas o sin saberlo a este mal ciclo que está dañando Ahora con 11 laboratorios, aunque es una gran herramienta, es importante que
te tomes un tiempo
para leer sobre cómo se están
entrenando
estos modelos y cómo podrías simplemente usarlos para algo
que no dañe a las personas. Darle algunos ejemplos con
11 laboratorios en particular, pero esto se aplica a cualquier otra herramienta de
IA que esté ahí fuera. Nunca deberías estar usando estos audios para hacerse pasar por seres humanos
reales Hay muchas
reglas y regulaciones que salen todos los días sobre cómo básicamente reglas que previenen el daño
de otras personas. Si generas un
podcast completamente usando IA, necesitas etiquetarlo como IA. Si usas el script de Internet que también se
hizo con IA, tal vez Chat GBD, es tu responsabilidad
como usuario
informar a tu audiencia
que de
ninguna manera estás tratando de hacerse pasar por otra
persona o engañar a gente para que piense que lo que acabas de generar es una Vas a estar usando 11 laboratorios para tu trabajo o para tu escuela, ten en cuenta que cada
empresa e institución tiene su propio conjunto de reglas y
regulaciones al respecto. Así que asegúrate de hacer tu
investigación y no te pongas en riesgo
al usar estas herramientas. Ahora bien, para los efectos
de este curso, sólo
te
estoy enseñando cómo usarlo. Úsalo para hacer podcasts, audiolibros y
cosas así. Estos son solo para
que los explores y aprendas. Si quieres
comercializar alguno de tus trabajos que realices al final de esta lección,
por favor tómate el tiempo para leer
las reglas y regulaciones de todas las plataformas
donde también estarías subiendo estos productos,
y nuevamente, etiquetar
tu trabajo como IA Porque lo que sucede es que
cuando envíes tu trabajo en el mismo espacio que lo hacen
otros creadores humanos, serás marcado y según en qué
plataforma lo estés haciendo, habrá consecuencias Así que sean responsables con
sus generaciones. No lo uses para hacer daño o suplantar a nadie,
etiqueta todo tu trabajo Y si eliges ganar dinero, monetiza tu trabajo
ya sea con 11 laboratorios o cualquier otro por ahí, hazlo de
la manera adecuada Vaya a la plataforma, vea
cuál es su guía. Casi todas las plataformas lo tienen, ya sea en
Instagram, Bhand, Adobe, donde quiera
hacerlo, vaya y navegue en su sitio web, lea sobre ello y
siga sus pasos Ahora sabes un poco
más sobre el riesgo y el daño potencial
que podrías estar haciendo si usaras la
IA de manera incorrecta. Ahora podemos seguir adelante
y continuar con nuestro curso donde aprendemos más sobre esta herramienta en particular. Así que ten cuidado
ahí fuera y vámonos. Oh
5. Conceptos básicos de las indicaciones: En esta lección,
vamos a
repasar cómo solicitar
con ElevenLabs Entonces, un prompt son las instrucciones que le das a una herramienta de
IA a seguir. Y en este caso, estas son las palabras que quieres que ejecuten
11 vueltas Ya sea una voz en
off, un texto a voz, cambiador de
voz o cualquiera de las otras herramientas que
vamos a echar un vistazo más adelante, hay un estilo general
que debes seguir,
y en realidad es bastante fácil comparación con las
otras Dirígete a
texto a voz donde
vamos a practicar con
las Ahora, no te importen las
herramientas del lado derecho. Voy a entrar en lo que
es esto en una lección diferente. Pero primero, sigamos adelante
y hagamos una práctica sencilla. Vamos a empezar a
escribir algo. Voy a hacer que ChatPT nos
dé una
historia muy sencilla y luego vamos a convertir
en un audio decente Dame una historia de cuatro frases sobre un perro. Simplemente muy sencillo. Para que esto sea mejor,
hagamos algo como esto. Haz un episodio de podcast basado en esto con solo cuatro
frases para dialogar. Muy bien, así que
copiemos la parte del podcast. La razón por la que
elegí podcast es porque de esta manera podemos jugar con las
diferentes emociones. Yo sólo voy a
pegar esto aquí. Siéntase libre de escribir
su propio texto. Pero deshagámonos de todas estas etiquetas y solo pongamos en
el texto que dicen. Um, voy a poner un
salto de párrafo después de cada oración. Entonces comencemos primero
eligiendo una voz. Para mí, por defecto, es George. La voz es el modelo
que está leyendo tu texto. Entonces, si le pego a George, aquí no
voy a cambiar
nada. De hecho, restablecemos los
valores solo para asegurarnos que todos estamos usando
la misma configuración. Vamos a golpear Generar discurso. Todas las mañanas, un perrito
desaliñado llamado Max deambulaba por
las tranquilas calles, buscando sobras
y Una tarde lluviosa, Max se
acurrucó bajo el toldo de un café, escalofriando hasta que un amable barista Hola, amigo. Tienes hambre. A partir de ese día, Max
regresó hasta que una mañana, el barista abrió la puerta con una sonrisa y dijo, quiero quedarse Ese es solo el modelo que
lee nuestro texto. Es muy monótona, no es
exactamente emocionante ni aburrida, simplemente
es muy plana. Entonces aquí hay algunas cosas
que ya están incluidas en este texto que participan en ese estilo del que
estaba hablando antes Cada vez que agregas un periodo, eso es una indicación
para que el modelo se detenga. Entonces cuando tenemos un, hay tres puntos,
va a ser una pausa más larga. Si haces esto, este
va a ser un corte diferente. Vamos a incorporar estos dentro de nuestro
prompt en el futuro. Pero ahora mismo tenemos guiones, tenemos los tres puntos, solo un punto, tenemos una coma Esas cosas
ya están incluidas. Y cuando toqué el audio, viste cómo se detenía Cuando terminó la oración, nuevamente
se hizo una pausa aquí entre las dos palabras y la
leyó muy bien Ahora vamos a
hablar de cómo podemos sumar emociones porque aquí tenemos a una Brista y luego solo
tenemos un narrador Cuando usas
diferentes adjetivos, ElevenLabs va
a entender que
como la emoción que necesita Podemos decir, vamos a ver. Justo aquí cuando
hay diálogo, podemos decir establecer la
emocionada Brista veamos Establecer a la Brista de una manera emocionada. Estoy usando la palabra
excitado aquí y luego veamos ¿
qué más podemos agregar? En lugar de esto, voy a hacer un signo de exclamación y luego
tal vez dos signos de interrogación Entonces solo este pequeño cambio va a hacer
una gran diferencia. Generemos este
discurso una vez más. Todas las mañanas, un
perrito desaliñado llamado Max deambulaba por las tranquilas calles en
busca de sobras y Una tarde lluviosa, Max se
acurrucó bajo el toldo de un café, escalofriando hasta que un amable barista Oye, ahí amigo. ¿Tienes hambre? Dijo el barista de
manera emocionada a partir de ese día. Entonces viste como dice como
el George de aquí dijo eso, oye, son amigo, tienes hambre. Entonces esa fue la
diferencia entre agregar dos signos diferentes
versus solo tener uno. Ahora bien, si vas a si quiero
llevar esto un paso más allá, puedes agregar pausas
y todo eso, también, lo que
entraremos más adelante porque hay una herramienta dentro estudio donde
solo haces clic en un botón, pero puedes agregar Pausa está aquí, como tres puntos, y luego
tal vez otro aquí Ahora veamos cómo funciona eso. Una cosa que
puedes hacer es cuando
combinas las dos frases, las
pones justo después de la otra, no
va a hacer una pausa tanto tiempo. Todas las mañanas, un
perrito desaliñado llamado Max deambulaba por las tranquilas calles en
busca de sobras y Una tarde lluviosa, Max se
acurrucó bajo el toldo de un café, escalofriando hasta que un amable barista Hola, amigo. ¿Tienes hambre? Dijo el barista de manera emocionada? A partir de ese día, Max. Entonces esos son los cambios
que estamos viendo. Y en el futuro, la
única incitación que estarías haciendo es darle a 11 laboratorios una
historia como esta Vamos a ver cómo
podemos agregar efectos de sonido, pausas
más largas y
diferentes tipos de audios con las otras herramientas
avanzadas La forma tradicional de
incitación de IA donde describas o mandas para algo, por ejemplo,
me hacen un efecto sonoro de fuertes lluvias dentro del bosque Ese es un ejemplo. Eso sólo
se llevará a cabo cuando estés haciendo
efectos de sonido con 11 vueltas Pero para el resto de las otras
herramientas y hay tantas, esta es la incitación
que estás haciendo O bien puedes generar
estas historias tú mismo, escribirla aquí y como
viste, es realmente fácil. O puedes hacer que
otra herramienta como ChagPT haga algo para
ti en cuestión de segundos Esto es solo una lección para que sepas
a qué nos referimos
cuando decimos rápido. No es tu prompt
tradicional, donde hay
fórmulas específicas a seguir. Solo ten en cuenta
la puntuación. Cada uno de ellos significa cosas
diferentes, como vimos con las comas,
guiones, tres puntos,
cosas así,
y sé muy generoso
con tus adjetivos
porque esos pueden
significar que y sé muy generoso tu modelo de voz IA va de monótono
a ya sea excitado,
enojado, SAD, sea cual sea el
adjetivo que quieras Y vamos a
estar viendo eso
mucho en las lecciones posteriores. Sin más preámbulos,
saltemos a nuestro siguiente capítulo donde miramos las
mini herramientas ElevenLabs
6. Biblioteca de voces: Echemos un
vistazo rápido a esta plataforma y veamos cómo podemos comenzar a
hacer voces de inmediato con ElevenLabs Esta es la página en la que verás la página de inicio después de haber
iniciado sesión en tu cuenta. Entonces de inmediato, hay algunas voces
más recientes de la biblioteca. Esencialmente, tenemos una biblioteca donde la gente puede
agregar nuevas voces. Por supuesto, hay un
procedimiento por el que tienen que
pasar y no son voces de
baja calidad en absoluto. Pero esta es una biblioteca
que ElevenLabs administra y están lanzando
nuevas voces todos los días Vamos a darle una
escucha a este, por ejemplo. AubukieraOSK Terra. Eso es en hindi,
y luego tenemos, por ejemplo, a una
joven Silas A Entonces esta voz momento puedes ver que se llama voz femenina madura, y seguro
que sí sonó así, tranquila y profunda. Entonces solo refresco mi página para mostrarte que
cada vez que lo hagas, vas a conseguir
un nuevo conjunto de voces. Entonces, por ejemplo,
sigamos con esto. El mal es el mal, Menor, mayor. Al ralentí. Es todo lo mismo. Entonces esto es serio y sombrío, y se puede ver que definitivamente
sí dio en esa marca Ahora, aquí abajo, notarás
que dice avance en inglés. Si haces clic en esto, puedes cambiar entre idiomas. Estos son los
idiomas actuales que están disponibles. Va a ser la misma voz, el mismo tono, y todo, pero será en un idioma
diferente. Entonces, sigamos adelante y probemos el
ruso, por ejemplo. cebolleta Katorn D Ciba Nemo
conmutación Devi Camibe. City er Schimafantasia,
solitaria, transformador
Poggi completa
Menchi HmunoGunkab Hari Hunaja, transformador
Poggi completa
Menchi HmunoGunkab Hari Hunaja Poggi completa
Menchi HmunoGunkab JonikotmaFatra y 40s Ayuda a Dantwsen El hombre labió. Se puede ver cómo sin problemas cambia entre estos idiomas mientras mantiene
la voz y el tono. Si hablas alguno de
estos idiomas, puedes ver si suena
realista o no, pero por lo que dice la
comunidad, da bastante bien
en el blanco. Bien, así que si
quisieras explorar más, puedes ir por aquí o
simplemente bajar a voces. Esto te llevará a
la biblioteca de voz, y tenemos muchas
opciones para elegir. De inmediato, verás que hay marcas de verificación en algunas de ellas y eso solo
indica que son alta calidad y
se han usado mucho Puedes ver el nombre de esta persona y si
solo pasas el cursor sobre ella, vas a ver un
poco más de información La descripción
de las voces
realmente puede ayudarte a elegir
la que tú. Ejemplo, David aquí
es un lector de noticias, y tiene una voz clara
y nítida. Es de mediana edad, americano
profesional, y luego puedes medir
si eso va
a encajar o no en tu proyecto. Sigamos adelante y
previsualicemos esta voz. Simplemente haga clic en él. Más tarde esa misma noche, la detective Carlson
recibió una denuncia anónima dirigía a una
segunda escena del crimen Lo que al principio había
parecido un evento aleatorio. Y luego una vez más, se puede cambiar entre los idiomas. Ahora, puedes ver aquí que la selección de idioma es
diferente a la primera voz, y eso es porque cada voz tiene su propia selección de idioma. Entonces aquí en realidad estamos
consiguiendo árabe, polaco, Alien, creo que esos son los
únicos que son diferentes. Estamos recibiendo hindi, inglés y francés como lo hacíamos antes. Y aquí abajo, se
pueden ver las banderas. Entonces viene en estos dos
idiomas, y luego cinco más. Estos dos, dos más, y solo va a
cambiar a medida que avanzas. En la página Explorar, puedes buscar
el nombre de esa voz o
la forma en que suena. Por ejemplo, estoy
buscando una voz tranquila, y estoy recibiendo
mucha narrativa e historia,
informativa, educativa
voy a darle una escucha a esto. Aquí, tenemos un narrador tranquilo,
bien hablado, lleno de intriga y
maravilla por la naturaleza, la
ciencia, el misterio historia con un tono
suave
y aterciopelado Se puede ver que definitivamente
sonó tranquilo y en realidad
es uno
de los adjetivos que se enumeran aquí Enseguida sin tener que hacer click sobre él o pasar el cursor sobre él, sé exactamente qué
voz voy a conseguir Ahora, puedes echarle un
vistazo por el lado derecho, que son las categorías en las
que entran. Si abres estos en una nueva
pestaña, solo abramos uno. Vamos a conseguir una biblioteca solo por carácter informativo
y educativo. Se puede ver que esa es la
categoría en la que entré. Cierra a ese tipo.
Justo al lado, se pueden
ver dos Y o
cero D. Eso solo significa que cuánto tiempo va
a quedarse esta
voz si fuera
a ser quitada. Si el dueño de esta voz elimina de
la biblioteca de voz, dejará de estar disponible
para usted después de dos años. Pero aquí, por ejemplo, se eliminará de inmediato. Si quieres usar
este largo plazo,
definitivamente opta por
los que tengan una retención más larga en
comparación con algo así. A continuación, podemos ver cuántos
usuarios han utilizado esta voz. El primero de Adam Stone, puedes ver que es bastante popular. 438 mil personas han
usado esta voz, lo que significa que probablemente la hayas
escuchado en algún momento Las personas que están
lo suficientemente locas como para pensar que pueden cambiar el mundo
son las que sí lo hacen. Ahí vamos. Después
hay un botón más, lo que significa que puedes favorecer
esta voz para su uso posterior. Da click a la vez, y luego
básicamente va en esta pestaña, que entraremos más adelante. Ahora puedes ver que pasó
de un plus a este icono. Puedo usar esta voz para generar un audio a texto
a voz, voz a
texto, lo que sea que
tenga A continuación hay más acciones. Puede copiar el enlace de voz el ID de voz, y
luego ver similares. Si has usado otras herramientas de IA, piensa en el
ID de voz como el número ST. Cuando tengas la identificación y estés tratando de
generar tu voz, mantendrá
mucho más consistente. No va a funcionar ya que estás poniendo diferentes
adjetivos, diferentes Voy a seguir siendo similar. Pero por lo general, si usas una
de estas voces pre hechas, realmente no
tienes que usarla. El link es solo un link a
esa voz si quieres
compartirlo con alguien y
luego tenemos similares, lo que te da más voces
que suenan como Adam Stone. Ahora vamos a explorar
las cosas aquí arriba. Esta fue nuestra barra de búsqueda. Pudimos buscar un adjetivo, tal vez el nombre de
alguien Busquemos a alguien
llamado John Doe. Ahí vamos.
Tenemos tres opciones. También puedes buscar con
búsqueda con edad o género, tal vez mayor pueda hacer masculino o
tal vez adolescente masculino o algo así. Cualquier cosa que queramos. Entonces, por ejemplo, jóvenes adolescentes ingleses. Hola ahí. Yo soy Archie Si buscas una voz
adolescente británica
joven, enérgica y auténtica, entonces Hey, soy Ethan, y
sería una gran elección si buscas
un vocador adolescente Se puede ver cómo afectan esas barras de
búsqueda. Puedes ver cómo buscar una determinada cosa sí te da la selección de voz correcta. Algunas de estas voces se cargarán un poco
más que las otras. Con el plan que tengo, puedes ver que estos
están bien para que los use. Ellos son los populares, y aquí no hay
signo de dólar. Pero para estos, se puede ver que es $0.02 y eso es sólo para
algunas de estas voces Se puede ver que la mayoría de
ellos no tienen eso. Volvamos aquí arriba. Esta fue nuestra barra de búsqueda. Justo al lado,
notarás este ícono. Que es básicamente
cuando llegas a subir una muestra, cierra eso. Se llega a subir
una muestra y luego 11 laboratorios encontrarán una
que sea similar a esa. Digamos que tienes esta voz que quieres
replicar con IA, claro, ten muy
atentos a los derechos de autor, pero puedes ponerla aquí Por ejemplo, si quieres una voz
agradable y segura, por ejemplo, Michel Obama y quieres
conseguir algo relativamente cercano, puedes subir un fragmento de sus discursos por aquí
para acercarte algo Por ejemplo, si estás haciendo
alguna animación y
tienes un personaje después de Michel
Obama, puedes hacerlo. De nuevo, realmente quieres ser consciente de cómo
estás haciendo esto Hablaremos sobre la
ética de la IA en una lección posterior. Pero no puedes simplemente desechar
cualquier voz e intentar conseguir exactamente lo mismo
porque eso podría llevar a algunos grandes problemas. Justo al lado de eso,
tenemos una tendencia. Si haces clic en él,
hay muchas voces
populares así
como voces únicas. Lo que quiero decir con eso es que los trending unos se
han usado mucho. Estos son los que
vemos aquí mismo. Voy a dar click
en este triángulo solo para entrar de nuevo en la lista. Se puede ver que una gran cantidad
de personas la han usado. Si quieres ser único aquí, probablemente no
deberías
ir por algo como esto y ahí es donde
esta pestaña te resulta útil. Si cambio a último, se
puede ver éste, por
ejemplo, no está verificado, pero sólo 14 personas lo han usado. De esta manera, estoy siendo
más único cuando tengo mis voces en mis videos y también hay
opciones que son más bajas, siete personas, cinco personas, y la lista solo
va en dos personas. Quedarse atrás con la IA
siente que no puedes seguir el ritmo. Tu negocio necesita un
ingeniero rápido que importe. Entonces puedes ver,
aunque sean nuevas, algunas de ellas
no son tan de alta calidad como las más populares. Entonces es una buena idea
previsualizarlos, asegurarse de que sea algo
que funcione para usted, y luego proceder a usarlo. Tenemos lo último,
tenemos la mayoría de los usuarios. Para que veas
que esta es muy alta. Creo que esta es una manera
muy agradable hablar juntos de forma natural, ya
sabes, T claramente.
Vamos a darle una oportunidad. Puedes ver que es conversacional, suena realmente
natural y eso es perfecto si quieres
hacer un podcast o si quieres usar tu propia voz y
convertirla a este tono Eso es algo realmente
genial que tienen 11 laboratorios, y nos meteremos en eso
en una lección separada. Pero eso es lo que la mayoría de
los usuarios te conseguirán. El uso de personajes básicamente significa cuántos caracteres obtienes para convertir a audio
dentro de tu rango de crédito. Esto es algo de lo que
hablaremos más adelante cuando les muestre cómo
hacer texto a Verás exactamente cuántos
personajes estás usando. Para algunas de las voces, tomará más créditos mientras que las otras no es a
lo que se refiere. No te importa esto por ahora.
Nos meteremos en esto más tarde. Al mismo tiempo,
tenemos la pestaña de filtros, que te permite profundizar y
encontrar lo que realmente necesitas. Tenemos idiomas, en primer lugar, una amplia gama de idiomas. Es como el galés, por ejemplo. Incluso puedes elegir un
acento si aplica. Por ejemplo,
no es para galés, pero veamos qué
tendría acento. A ver si el inglés
tiene uno. Ahí vamos. Si eliges inglés, hay muchos acentos
que puedes explorar. Digamos que quiero a alguien de
Chicago, escojamos eso. A continuación está la categoría, que es el tono que suenan y hablan
las voces. Piensa en lo
que quieres esta voz y simplemente elige
tu categoría. Va a hacer un
tono muy natural, conversacional. Haga clic en eso. También puede
hacer clic en más de una categoría. Voy a hacer tal vez
algo como esto. Calidad, cualquiera o alta calidad. Recuerda, la alta calidad son
las que tienen la marca de verificación. Esos pueden pedir más créditos, pero puedes simplemente hacer clic en cualquiera para llegar a tener un montón
de opciones para mirar. Lo siguiente es el género. Creo que voy a hacer una edad femenina. Hagamos una persona mayor. Periodo de aviso. Estos eran
los números del lado, cuánto tiempo se llega
a guardarlos una vez el dueño borra esa voz Digamos que dos años. Tarifas personalizadas,
incluyen o excluyen. Esto es para ese
uso de personajes que vimos. Después se habilitó la moderación en vivo. Esto va a
moderar el tipo de texto que le estás
dando a esta voz. Voy a golpear
Include por ahora. Apliquemos los filtros. Ahora mismo, se puede ver que no
tengo ninguno y esto va a pasar, pero se llega a crear
sus propias voces. Entonces eso es algo que
exploraremos más adelante. Voy a quitar
algunos de estos solo para poder conseguir algo
para mostrarles chicos. Bien, entonces solo un acento estadounidense de
Chicago. El ejercicio hace que nuestro corazón más fuerte y nuestras
sonrisas sean más brillantes. Ese fue un ejemplo.
Se puede ver que es un audio muy reciente. Sólo 32 personas lo han usado. No está verificado, pero sigue siendo una voz que puedes usar. Intentemos otra cosa. Podemos hacer, de nuevo, inglés, probar canadiense tal vez. Entonces aquí hay un audio de alta calidad. Conocí a Gram, este
gato guapo en nuestro refugio. Este chico es adorable. Con sus rayas atigrado
y su cara linda, seguro
que te robará
el corazón en un instante Entonces ese fue un ejemplo. Tratemos de encontrar otro. Señoras y señores,
bienvenidos al partido de hoy. Tenemos un emocionante
partido por delante entre EFC United y Team Impact El ambiente es eléctrico. Todos estos son acentos canadienses
en diferentes categorías. A continuación, tenemos crear
o clonar una voz. Esta es esa característica genial que hablé
donde se llega a diseñar
una
voz completamente nueva a partir de un mensaje de texto. Dirías que tal vez un caballero mayor
con un acento espeso, tal vez una voz profunda, tranquila, enérgica, lo que
quieras poner. Y va a ElevenLabs. Te daremos un montón
de opciones, muestras. Tienes la oportunidad de construir
sobre eso y luego hacer tu propio audio original. Ahora, las cosas que creas, también
puedes hacer que
otras personas lo usen. De ahí vienen todas esas
nuevas voces. A menos de un minuto, y nos meteremos en esto en
una lección diferente. Tenemos una opción de clon de voz, para que puedas clonar tu propia
voz con solo 10 segundos. Hablaré
al micrófono durante 10 segundos y luego 11
laboratorios estudiarán mi voz. Entonces llego a usar mi voz
con diferentes indicaciones de texto. Por ejemplo, si no quiero
grabar un audiolibro
que dure 3 horas, solo
hablaré al
micrófono durante 10 segundos y luego pegaré la historia o simplemente la historia en
la caja y luego 11 laboratorios generarán ese audio de
tres horas para mí. A continuación se encuentra el clon
de voz profesional. Esto no está incluido en
el plan que tengo, pero esto es sólo para
el más realista. Pero para la mayoría de ustedes, ya que están usando esta herramienta
por primera vez, estos dos deberían ser suficientes. Aquí arriba, tenemos un cuadro de comentarios, que podrías
escribir tus comentarios. Tenemos algunas otras
cosas aquí arriba. Esta fue la pestaña Explorar. Mis voces tendrán las voces que tú favoreciste
o te hiciste tú mismo Tenemos voces por defecto. Estas son voces de ElevenLabs, por lo que estas no son generadas por el usuario Solo confía en ti mismo, entonces
sabrás vivir. Puedes tomar esto, usarlo
como todas las demás voces, y simplemente echar un
vistazo a las muchas opciones. También tenemos colecciones, que puedes crear cuando intentas
organizar tus voces. Por ejemplo, podría crear una colección para mi canal de
YouTube, una para mi podcast, otra para mis audiolibros, y de esa manera, todo
estará mucho más organizado. Estás previsualizando una voz,
tenemos el nombre aquí, los diferentes idiomas que está
disponible en el botón Reproducir, puedes saltar de un lado a otro, ver cuánto tiempo está por aquí Puedes descargar la voz, y luego simplemente puedes ocultar el reproductor si no lo necesitas. Ese es el panel de voces. Si haces clic en
este botón Plus, te
va a traer el mismo menú que surgió cuando
hicimos clic aquí Ahora, en la siguiente lección, vamos a repasar las herramientas del
patio de recreo que se encuentran justo debajo y ver qué más podemos
hacer con esta herramienta.
7. Texto a voz: Con texto a voz,
puede convertir fácilmente texto
escrito en un audio genuino de
buena calidad Y esta es la interfaz
donde vas a hacer eso. Entonces esta de aquí es la
primera herramienta disponible. Una vez que hagas clic en esto,
vas a tener esta área, que es esencialmente
tu patio de recreo, y luego tienes
todas las propiedades, diferentes bibliotecas de voz, cualquier tipo de configuración que
vayas a necesitar, va a estar a la derecha. Y aquí abajo, tenemos
algunas plantillas rápidas para que comiences. Pero claro, no necesitas
usar estos a menos que quieras. Aquí mismo es donde
puedes escribir el texto, y básicamente vas a
fingir que eres la voz. Entonces ahora mismo, tengo a
Liam de la biblioteca, pero puedes elegir
a cualquiera más aquí. Ya pasamos por
la biblioteca de voces. Hay tantos para elegir. Y también puedes usar las
voces que hayas guardado. Nuevamente, puedes filtrar
a través de cualquiera de estas categorías y
encontrar la voz perfecta. Pero aunque tengas una voz
que creas que es perfecta, aún
tienes más
capacidad para ajustar esa voz. Por ejemplo, si
elijo a Adam aquí mismo, todavía
puedo venir a
cambiar la estabilidad, el panning, el lenguaje
que va a hablar, el formato de salida, y
todo lo demás que se necesite Entonces, sigamos adelante y veamos cómo funciona
esto exactamente porque hay algunas
cosas interesantes que podrías hacer con ElevenLabs en Entonces aquí puedes escribir
el texto que
quieras que diga Adam,
pero al mismo tiempo, ElevenLabs tiene algo llamado etiquetas de audio Y este es un
ejemplo aquí mismo. Entonces, por ejemplo,
se ríe, llora, grita, cualquier tipo de etiqueta de audio que
quieras que se implemente,
puedes agregar eso al usar También puede usar la puntuación
para trabajar con las pausas, los topes completos y todo eso Y al mismo tiempo,
podemos tener múltiples altavoces. Entonces lo que vamos
a hacer es hacer una conversación muy sencilla entre Adam y
otro orador, y vamos a escribir algunas oraciones y usar algo de ese texto de audio del
que hablamos. De esta manera, tendrás
una mejor idea de cómo funciona
realmente el
texto a voz y cómo puedes usarlo
al máximo potencial Entonces comencemos con Adam. Voy a
tenerlo tú dices, Oye, usando el signo de exclamación, va a estar un
poco más emocionado Entonces Adam va a ser un poco
enérgico cuando esté diciendo eso. Y sólo para mostrarte
cómo suena eso, voy a poner otra
frase después de esto. Entonces, oye, ¿cómo te va? Entonces, ahora mismo, he usado
dos signos de puntuación, y vamos a ver
cómo suena esto Aquí no voy a
cambiar nada, y simplemente vamos a dar
click en Generar discurso. Oye, ¿cómo te va? Para que veas que
él tipo de estiró el heno y luego
le hizo una pregunta. Ahora bien, si les quito a estos tipos y simplemente no uso
nada en absoluto, eso va a sonar
un poco diferente. Oye, ¿cómo te va? Entonces no hizo una pausa, y ahora es menos una pregunta. Entonces, una forma en la que puedes controlar la voz es usando esas marcas. Entonces agreguemos
esos signos de interrogación. Y luego vamos a
agregar nuestro segundo orador. Entonces hagamos de esto alguien más. Voy a ir con Ellen. Y ahora Ellen va
a hacer otra cosa. Entonces tal vez se sobresalta
cuando Adam hace esta pregunta. Entonces tal vez grita. Oh, Dios mío. Me asustaste. Oye, ¿cómo te fue?
Sí. Oh, Dios mío. Me asustaste. Para que veas
lo bien que jugó eso. Y para mostrarte el
poder de las etiquetas de audio, voy a quitar esto ahora. Entonces ahora es solo, Oh, Dios mío, me
asustaste con los signos de
exclamación. Oye, ¿cómo te va? Oh, Dios mío, me asustaste. Así pueden ver, aunque no
puse la etiqueta de audio, la voz sigue siendo
bastante natural, y ahí es donde
quiero señalar los modelos que estamos usando. Entonces ahora mismo estamos en el 113. Si das click en esto, podrás
ver todos los diferentes modelos. Pero esencialmente, 11 V tres
es el más expresivo. Entonces la forma en que, ya sabes, él entra, voy a carbón y, como, una voz profunda, y luego ella entra un poco sobresaltada Eso es por nuestro modelo. Aquí también tenemos
modelos multilingües, pero ahora mismo, solo me estoy
apegando al inglés. Entonces, si quieres hacer esto
en un idioma diferente, te
recomiendo pasar a este. Hay al menos otros 26
idiomas que soporta. Entonces, si ves el
idioma que te gusta, puedes ponerlo aquí mismo. Y tenemos aún más modelos. Entonces puedes ver cómo en estos
momentos está diciendo que recomienda
este modelo para Ellen. A veces lo hace
dependiendo de la voz que elijas. También hay flash turbo
y diferentes modelos de turbo. Entonces realmente depende de
cuánta estabilidad
quieras con las voces y cuánta expresión
quieras con ellas. Entonces estos tipos de aquí abajo, suelen ser buenos
para conversiones rápidas. Al igual que, no quieres que muchos detalles entren en la generación de
voz. Entonces puedes ver que menciona casos de uso
conversacionales. Entonces tal vez si tienes
un video de YouTube donde la persona solo
está hablando, no está pasando mucho. Puedes usar un modelo como este. Y también tenemos otros modelos que nos recomienda
para usarlo para,
como, casos de uso de desarrolladores. Por ejemplo, si hay, como, chatbot de
IA en el sitio web, puedes usar uno de estos modelos Pero si vas
a construir una historia donde haya
muchas etiquetas de audio, hay muchas
pausas, y movimientos, quieres ir por
el primer modelo Así que me voy a
apegar a este tipo, y voy a
volver a poner esa etiqueta de audio. Sólo di lo que es y
luego ponlo entre paréntesis. Debería ponerse rosa. Si tampoco lo hizo porque no reconoce
esa etiqueta de audio, como, no soporta
esa expresión,
o
es posible que hayas puesto
en un espacio extra, una coma, mal escrita
u Pero una vez que es rosa, es
seguro y etiqueta de audio. Puedes agregar Adam de nuevo. Puedes verlo
recogido de inmediato, pero puedes agregar un tercer
orador si quieres. Entonces voy a hacer risas. Eres tan fácil de asustar. ¿Terminaste la tarea? Agreguemos a Alan. De nuevo, se puede ver
recogido que hay una conversación. Haremos este tamaño. No, da da dt. Estaba tan ocupado ayer. También puedes usar las etiquetas de
audio entre palabras, por lo que no siempre
tiene que ser
al inicio de una oración
o al final. Así que aquí mismo, podríamos
hacer la etiqueta de audio Snifs. Piensan que me estoy
bajando con algo. Y ahora vamos a generar. Oye, ¿cómo te va? Oh, Dios mío. Me asustaste. Eres
tan fácil de asustar. ¿Terminaste la tarea? No. Ayer estaba muy ocupado, pero creo que me estoy
bajando con algo. Entonces ahí está nuestra conversación muy
sencilla. Pero ahora podríamos
entrar en cada voz y definir
aún más la forma en que se están haciendo
las expresiones. Entonces, por ejemplo, Adam en
estos momentos es un poco demasiado intenso. No es realmente una voz
conversacional. Así que solo voy a hacer clic en Adam, pero luego volver a
la página aquí mismo y hacerla un
poco más creativa. Entonces veamos cómo suena
eso. Oye, ¿cómo te va? Eh. Oh, Dios mío. Me asustaste. Eres tan fácil de asustar. ¿Terminaste la tarea? No. Ayer estaba muy ocupado, pero creo que me estoy
bajando con algo. Entonces ahora su voz es
un poco más ligera. Eso es porque la tiré
hacia el lado creativo. Solo ten cuidado con esto
porque cuando le estás diciendo ElevenLabs que no sea tan
consistente a través de
la generación de voz, la voz puede tener una especie de falla si estás haciendo un párrafo muy
largo o,
como, una Pero para una situación como
esta donde es, como, una oración o dos,
funciona bastante bien. Ahora cuando cambias los modelos, obtienes
cosas adicionales que puedes ajustar. Entonces esto de aquí
es para 11 V tres, pero voy a ir a
Ellen ahora mismo y cambiar esto al segundo modelo. Se puede ver que
se recomienda aquí mismo. Va
a dar click sobre él. Y ahora se puede ver que
hay muchas más opciones. El único problema es
ahora que no tenemos ese
diseño conversacional con B tres No tenemos ese modo de altavoz
diferente. Ahora mismo, todo lo
que está escrito aquí es sólo para Ellen. Entonces esa es la desventaja. Así que puedes moverte por cada modelo dependiendo de para
qué lo necesites. Pero podemos usar a Ellen aquí mismo. Sólo voy a borrar
las líneas que tenía Adam. Y voy a, ya sabes, jugar con algunos de
estos deslizadores de aquí abajo Entonces lo primero es la velocidad. ¿Está hablando muy
rápido, muy lento? Puedes ajustarlo aquí mismo. Entonces, para mí, sólo
voy a bajarlo un poco. Y con estos deslizadores, sí
quieres volver
a tener cuidado no exagerar,
porque si vas porque si vas regreso o
todo el camino hacia adelante, la voz no pueda
mantener su consistencia a través de, ya
sabes, diferentes frases Entonces, sea cual sea el ajuste que
hagas , intenta mantenerlo muy mínimo. Entonces yo fui uno aquí. Yo sólo bajé al
96, así que no como aquí. Lo siguiente es la estabilidad. Entonces, ¿quieres que tenga diferentes volúmenes en puntos o quieres que
sea solo monótona? Ya sabes, eso es
algo que puedes
decidir con este deslizador. Entonces, si voy hasta aquí, ella va a sonar
como un, ya sabes, robot. Pero si voy hasta aquí, puede
que simplemente esté muy hiper. Entonces nuevamente, podemos hacer ajustes
muy leves. Lo siguiente es la claridad de voz. Voy a mantener esto como está. Creo que es,
ya sabes, bastante claro. A continuación, tenemos
exageración de estilo. Entonces, ¿
quieres que sea, ya sabes, la forma en que suena ahora mismo, o quieres que
esté más emocionada? ¿Quieres que exagere
todos los diferentes
signos de puntuación, etiquetas
de audio y todo eso todos los diferentes
signos de puntuación, etiquetas
de audio y todo De nuevo, voy a
dejar el mío como está. Y luego, por último,
tenemos panning. Entonces se trata de,
como, el campo estéreo. Se puede pensar
como dos oradores. ¿Quieres que
sea más hacia la derecha o más
hacia la izquierda? Entonces solo para mostrarte
cómo suena esto, voy a llevar esto
todo el camino a la derecha. Y de esa manera,
sólo saldrá de un
lado del altavoz. También tenemos sobrescritura de idioma. Si quieres seleccionar manualmente el idioma que ElevenLabs
produce para ti, puedes activarlo Entonces, puedes elegir
un idioma aquí. Si no lo haces, va a detectar lo que tienes
aquí arriba y luego tomar
esa decisión por sí misma. Siguiente son los efectos de audio. Estos son
archivos adicionales que puedes agregar aquí solo para hacer que la voz
tal vez sea más realista, más adecuada para un
determinado entorno. Estos son todos
fáciles de agregar también. Por ejemplo, podría
agregar algo de ruido, decir que está en una cafetería. Yo también podría filtrar
algo. A lo mejor ella está al teléfono. Se puede trabajar con el espacio. Este es el eco, y luego
tenemos la distancia. Entonces, ¿a qué distancia está ella
del micrófono? Entonces yo solo voy a hacer
los dos primeros primero, y puedes hacer un pequeño adelanto antes de desperdiciar algún crédito. Aquí tienes una vista previa de tu
voz con efectos aplicados. Aquí tienes una vista previa de tu
voz con efectos. Entonces se puede ver que sólo
salió del lado derecho
por esto. Así que déjame poner esto de nuevo. Aquí tienes una vista previa de tu
voz con efectos aplicados. Aquí tienes un adelanto de tu voz. Y así
es como suena. Por último, es el formato de salida. Estos son diferentes formatos entre los que
puedes elegir. Depende de para qué
necesites esta voz. Así se puede ver que algunos de
ellos están completamente
de grado porque es para un plan
más profesional. Actualmente estoy en 11 Creative, así que estos dos deberían
ser suficientes para mí. Sólo voy a
mantenerlo en el default, y, por
supuesto, queremos que se
impulse el discurso. Si alguna vez quisiste volver
a lo que era inicialmente, puedes hacer clic en Restablecer valores. Vamos a generar el discurso. Oh, Dios mío, me asustaste. No, ayer estaba muy ocupado, pero creo que me estoy
bajando con algo. Entonces ahora se puede ver que la
voz es muy diferente al primer modelo porque nos deshicimos por completo
de las etiquetas de audio, así
como mucha
de la expresión que estaba disponible
en ese primer modelo. Pero voy a hacer esto
fuerte, solo para que ustedes puedan
escuchar esa cosa del café, y voy a quitar el teléfono. Creo que eso hace que
sea más difícil escuchar. Entonces hagamos esto una vez más. Aquí tienes una vista previa de tu
voz con Efectos aplicados. Ahora podemos escuchar mejor ese ruido de fondo del
café. Si vas a un modelo
diferente, es posible que obtengas deslizadores adicionales Pero de nuevo, solo
baje a estos si quieres que se haga algo
específico. Entonces este de aquí mismo
es el 11 turbo. Es más o menos
los mismos deslizadores. Entonces realmente se
reduce a, como, los lenguajes que quieres
usar o la velocidad
de la generación. Pero V tres es, ya sabes,
lo mejor para las conversaciones, y honestamente, suena
lo más natural. Tienes un audio,
puedes bajar aquí, puedes reproducirlo,
avanzar, retroceder, dar retroalimentación si quieres,
compartirlo con la gente, descargarlo por ti mismo, e incluso puedes
ocultar el reproductor. Entonces, si
lo descargas,
solo va a ir directo
a tu computadora. Va a ser el mismo formato que elegiste aquí mismo. Ahora, si estás usando V tres, puedes mejorar aún más el
audio con etiquetas de audio, y eso es algo
específico solo para este modelo. Así es como funciona la función de texto a voz
. Es realmente útil, y cuanto más
juegues con él, más
vas a poder encontrar la voz perfecta para tu proyecto y poder
mantener esa consistencia
en todos ellos.
8. Cambiador de voz: Ahora bien, si bien el cambiador de voz parece una herramienta muy
sencilla, hay muchas
cosas que hay que considerar
para
obtener una conversión de
voz decente y precisa Esta es la interfaz
cuando hago clic por primera vez en ella. Seguimos en el grupo de
juegos infantiles. Simplemente hago clic en cambiador de voz y esto es lo que deberías ver Esencialmente ingresas un audio, ya sea que lo grabes ahora o
tengas un audio pregrabado, y luego eliges la
voz y la configuración, lo convierte de tu voz a la que elijas Lo que vamos a hacer es
grabar nuestro audio directamente en la computadora y
luego simplemente ir de ahí. Así que haz clic en grabar
audio y cuando lo
hagas, vas a
tener la opción de qué micrófono te
gustaría usar para esto. Cuando estés listo,
puedes presionar Inicio y
podrás ver que tenemos un
máximo de 5 minutos. Sólo voy a
leer una pieza de
un cuento tal vez y luego ya
podemos ver lo bien que le
va por allá. Este es mi audio original. Todo el mundo mira hacia arriba. Algunas personas empiezan a saltar arriba y abajo, agitando los brazos en el aire Jake mira
las torres que rodean
el complejo y nota a los guardias en plena alerta, entrenando sus fusiles hacia abajo en el recinto donde los hombres y mujeres están
haciendo una conmoción Entonces aquí leo las cosas
con un ritmo más lento, pero después te mostraré lo
que obtendrías si
hablaras demasiado rápido o si tu
voz simplemente no estuviera clara. Ahora que tengo mi audio, puedo
borrarlo para obtener
otro o simplemente proceder
con la conversión. Primero, tienes que
elegir tu audio. Voy a probar
tanto una hembra una masculina para que
veas la diferencia. Sigamos adelante y probemos voz
femenina que no es similar a la mía.
Búsqueda de mujeres. Solo confía en ti mismo.
Entonces sabrás vivir. Ella le arrancó la mirada. Hola. Gobierno del pueblo. No hay mayor daño. Las ideas son los
puntos de partida de todas las fortunas. Entonces aquí tenemos a Dorothy
con acento británico, que es un acento que no tengo Así que sigamos adelante
y hagamos clic en esto. Este es el modelo
que eligió para nosotros, y solo
lo voy a dejar con la configuración predeterminada. Ahora, una cosa que sí
quiero señalar aquí son estas dos opciones que
puedes activar o desactivar. El primero es eliminar el ruido
de fondo. Si no estás grabando esto
directamente en un micrófono, tendrás que encenderlo. De esa manera
no te concentrarás tanto en los autos que pasan o en
alguien golpeando la mesa. Y solo concéntrate solo en
tu voz. Ahora, abucheos de altavoz por
defecto, se enciende, pero descubrí que
cuando está encendido, sí distorsiona un poco tu
voz Solo voy a ejecutar esto
con la configuración predeterminada, que es lo que ves en
la pantalla ahora mismo. Después después lo
apagaré y después
te mostraré la diferencia. Todo el mundo mira hacia arriba. Algunas personas empiezan a saltar arriba y abajo, agitando los brazos en el aire Jake mira a
la torre que rodea el complejo y hace ruido
al guardia en plena alerta, entrenando sus fusiles hacia abajo en el recinto donde los hombres y mujeres están
haciendo conmoción Se ve que
luchó con algunas de las palabras y usa muchas s, que es algo que
creo que es causado por
el impulso del altavoz Debido a que sí tengo acceso a
un micrófono profesional, realmente no
necesito este. Entonces lo que voy a
hacer es apagarlo. Y luego reducir la
similitud para que
pudiera tener más
voz británica,
supongo, algo más cercano a
lo que sonaba Dorothy Si aumentas
esto hasta llegar a alto, realmente
va a intentar
imitar tu tono y tono exactos,
y eso podría conducir a una
mayor distorsión Reduzcamos esto al 40%. Dejaré la estabilidad y
la exageración como están. Ahora veamos la diferencia. Todo el mundo mira hacia arriba. Algunas personas empiezan a saltar arriba y abajo, agitando los brazos en el aire Merluza mira a las
torres que rodean el complejo y hace ruido a
los guardias en plena alerta,
recortando sus fusiles hasta el recinto donde los hombres y mujeres están haciendo Entonces eso sigue siendo un poco mejor, pero podemos ir aún más bajo. Podemos intentar más estabilidad.
Dale otra oportunidad a eso. Todo el mundo mira hacia arriba. Algunas personas empiezan a saltar arriba y abajo, agitando los brazos en el aire Jake mira
las torres que rodean
el complejo y hace ruido
al guardia en plena alerta, entrenando sus fusiles hacia abajo en el recinto donde los hombres y mujeres están haciendo
una commercion Es mucho mejor que
lo que teníamos inicialmente. Sigue luchando
con la parte de acento. Palabras como conmoción,
hace commercion un RN ahí. Pero eso es algo que podemos arreglar con una voz
diferente. Pero en lugar de
pasar por todas las voces, solo
voy a cambiar a una voz masculina y probar
un acento diferente. Intentemos algo sin acento, como el masculino americano. Con el amanecer,
las soluciones frescas iluminan el camino. Para escalar colinas empinadas se requiere
un ritmo lento al principio. Oye, ven aquí. Hola, has llegado a Acme Corp. Llega un momento en que el camino familiar
ya no se siente suficiente Una puesta de sol es la manera de despedirse
de un día, Grace. Bien, entonces voy a
ir con Liam por aquí. Vamos a hacer clic en su voz. Entonces ya tenemos un nuevo
audio. Una y otra vez, escucha
el sonido de las puertas
siendo golpeadas y atornilladas de golpe y atornillado. Entonces ahora vamos a
probar una voz masculina. Dios te ha dado una cara, y te haces otra. Entonces ahí abajo está George. Tenemos la opción
de diferentes idiomas, pero comencemos con el inglés. Una y otra vez, escucha
el sonido de las puertas siendo golpeadas y atornilladas, cerradas de golpe y atornilladas Entonces es interesante que dije
esas dos palabras dos veces. El primer asalto,
no lo dije bien, pero el segundo asalto lo hizo. Entonces hay algunas inconsistencias como siempre hay con Pero en su mayor parte, se puede ver que se sigue por
los lugares donde cambié mi tono y la forma en
que dije las palabras. Entonces es bastante idéntico excepto por el hecho de
que es George. Voy a hacerlo una vez
más sin el refuerzo de
altavoz y ver si
eso es diferente. Una y otra vez, escucha
el sonido de las puertas siendo golpeadas y atornilladas, cerradas de golpe y atornilladas De hecho, reduzcamos
la similitud al 20%. Una y otra vez, escucha
el sonido de las puertas siendo golpeadas y atornilladas, cerradas de golpe y atornilladas Estuvo mucho mejor.
Dije bien las palabras y eso es
probablemente porque reduje la similitud al
20% y eliminé estas dos opciones. Lo que puedes hacer con este
audio es descargarlo. También puedes descargarlo
con el nombre original, eliminarlo y
compartirlo si lo deseas. Así es más o menos como funciona
el cambiador de voz. También podrías probarlo
con voces externas, tal vez hacer algo
en texto a voz, y luego cambias de opinión, puedes simplemente venir
a Voicehanger subir lo que conseguiste de aquí a aquí,
cambiar
a una cambiar Solo ten en cuenta que
texto-a-voz es mucho
más preciso que voz a voz Así que tenlo en cuenta si estás haciendo esto por un proyecto más
serio. En la siguiente lección,
vamos a
repasar a los efectos de sonido, que son pequeños bocados de
sonido que puedes poner en tu
video para enfatizar una determinada acción o para hacer algo
más dramático. Pasemos a esa lección.
9. Efectos de sonido: Ahora, pasemos
a los efectos de sonido, que es cuando se llega a generar un efecto de sonido
con solo unas pocas palabras. Y enseguida,
puedes ver que
hay algunos ejemplos
para que los explores. Estas son indicaciones de muestra. Cuando hagas clic en ellos,
ellos van a aparecer en este cuadro, que es donde va a
entrar tu
prompt y luego
simplemente presionas generar. Vamos a hacer un carro zumbando por. También podemos probar
algo más como un gato tal vez. Aquí abajo, es la duración. Entonces, ¿cuánto tiempo queremos que sea
este efecto de sonido? Puedes agarrar un control deslizante
y si no estás seguro de cuántos minutos o
segundos quieres que sea, simplemente
puedes presionar Auto. Entonces tenemos nuestra
pronta influencia. ¿Qué tan estricto queremos que el
módulo de IA siga nuestro prompt? Si quisieras tener
algo de creatividad, puedes
mantenerla en la parte inferior. Pero si quieres que sea
exactamente lo que pediste, solo lleva el
deslizador hacia lo alto. El valor por defecto es 30, y eso es lo que
voy a dejarlo como. Por aquí, tenemos el historial, para que puedas obtener diferentes muestras en
base a un prompt
que le des. Anteriormente hice esta arma
semiautomática, y obtuve cuatro muestras Aquí puedes presionar play
para escuchar la diferencia. Se puede ver que
todas son armas, pero empiezan de manera diferente e
incluso suenan diferentes. En función de
lo que esté tratando de hacer, puedo elegir cualquiera
de estas muestras y simplemente hacer clic en Descargar Lo que puedes hacer es hacer
clic en D plus para reutilizar el prompt
y tal vez puedas agregar un nuevo detalle por aquí. Estos están organizados por fecha. Solo puedes echar un
vistazo a lo que has hecho
hasta ahora y simplemente hacer un seguimiento
de lo que estás construyendo. Es la duración
y la influencia. Bien, así que eso es
todo con lo que puedes hacer de inmediato en el panel de efectos de
sonido. Tenemos una pestaña Explorar, al
igual que la
biblioteca de voces donde puedes
ver algunos de estos
efectos de sonido que ya existen. Por ejemplo,
hagámoslo, veamos. Un León. Incluso podemos hacer efectos cinematográficos Se trata de una
emisión urgente de emergencia. La atención resuena. Una brecha de contentment tiene
puedes ver todo tipo de efectos de
sonido se pueden encontrar aquí si
quisieras afinarlo Por ejemplo, esta cosa del
basquetbol es genial, pero tal vez quieras que
empiece con un silbato Todo lo que tienes que hacer
es hacer clic en usar y va a
entrar en tu cuadro de aviso, y luego puedes
agregar ese detalle. A lo mejor silbatos
soplando en la parte de atrás. Yo agregué un detalle más. Vamos a golpear generar
y ver qué obtenemos. Mientras eso está pasando,
voy a justo ahí vamos. Déjame reproducir el original
por ti para que puedas comparar. Y luego tenemos cuatro muestras. Todos ellos suenan como un partido de basquetbol muy
intenso. También podríamos de
manera similar, eliminar una condición. Quitemos el
silbato y los
vítores de la multitud y solo hagamos un partido de basquetbol en
silencio Vamos a presionar Generar y podría simplemente alternar
eso para que esté organizado. Si tienes muchas
cosas en tu historia, también
hay una barra de búsqueda, eso es muy útil
si planeas generar muchos efectos de
sonido aquí. Entonces podemos escuchar ese
regate de baloncesto y ahí está la
zapatilla chirriando en la parte Pero como viste, no
hay muchedumbre, ya no
hay silbidos. Y eso es porque eliminamos esas dos partes del
prompt. Eso es X. Puedes descargar cualquiera de
estos si lo deseas. Si haces clic en ellos,
también puedes simplemente copiar el prompt. Al igual que la biblioteca de voces,
hay una barra de búsqueda. Puedes hacer click en Más para verlo
también de esta manera, la
más descargada, la más reciente
para algo único, y luego los audios de tendencia Aquí arriba, hay un montón de categorías para facilitar la
búsqueda. Intentemos algo así
como elementos de interfaz de usuario. Si quieres agregar
un efecto de sonido a tu sitio web, por ejemplo. Bienvenido a vCstom Graphics. Volvamos a Explorar. Hay una
cosa más que es
genial en el panel de efectos de sonido, y esa es la caja de resonancia Si haces clic en él,
te llevará a esta página completamente
diferente. Si has trabajado
con cajas de resonancia, esto debería parecerte bastante
familiar, pero si no, no
te preocupes por ello Una caja de resonancia es básicamente
una placa donde puedes agregar diferentes voces
cada vez que haces clic en ella. Piensa en estas cajas
como botones y di que
estás teniendo un podcast donde
estás reaccionando a algo. Cada vez que quieras que
haya una batería, harías clic en
el botón de batería, y eso va a ser
grabado en tu podcast. Aquí ya tenemos un montón de
sonidos. Sigamos adelante y probemos algunos. Acabo de entrar en la categoría de
batería. Podemos hacer algunos ruidos de la naturaleza. Puedes ver cómo puedo
apilarlos también y crear ese efecto de
sonido cinematográfico perfecto para mi video También hay película slash TV. Estas fueron tus categorías. También puedes agregar una nueva fila y no todos
tienen algo en ellos. Por ejemplo, movie slash TV
no tiene nada aquí. Lo que puedes hacer es dar click
sobre ellos y generar uno. Digamos que quiero crear
uno donde la gente diga abucheo. Digamos que una multitud dice
boom en la satisfacción. Una vez que lo haga,
podría darle un nombre. Vamos a llamarlo abucheo. Obtenemos un montón de muestras. Entonces podría agregar
cualquiera de estos que me gusten para llenar
este lugar vacío. Hagamos el número tres. Ahora se puede ver que hay
Bo este botón vacío. Puedes guardar el preset,
compartirlo con alguien, también
puedes asignar un dispositivo
aquí si tienes un teclado o algo en lo que puedas
presionar teclas esencialmente. Puedes otorgar el permiso y luego tenerlo
conectado a tu computadora. En lugar de presionar estos con el
mouse o el cursor, puede hacer clic en las teclas un teclado o un dispositivo
diferente. También puedes hacer es
crear presets. Ahora mismo, estos
son los impagos. Pero puedes generar
tus propios presets si hay ciertos ruidos
que necesitas cada vez Por ejemplo,
digamos que quiero trabajar con muchos ruidos singulares como si alguien dijera algo Podría empezar a hacer eso. Solo ve a mi
preset, nuevo preset, llamémoslo singular
o simplemente singulares, guarda el preset,
y luego
obtendrás todas estas cajas vacías Da clic en cualquiera de ellos y
empieza a llenarlos. Un hombre diciendo: Oye, hola. Oye. Oye. Oye. Oye. Tenemos cuatro generaciones. Escoge el que
sea más preciso. Si no te dio
algo que estabas buscando, simplemente
puedes hacer clic
en Generar de nuevo. Creo que voy a añadir Hey. Oye. Oye. Éste. Se puede ver que
hay tres versiones, y eso está bien porque sólo
podría cortarlo. A lo mejor aquí vamos a
hacer a una mujer jadeando. Entonces aquí voy a hacer
tal vez un accidente automovilístico. Llámenlo crash. Agreguemos este
accidente automovilístico y tráfico, tal vez. Todavía estoy en el número tres, así que puedo reemplazarlo si
encuentro algo mejor. Suena más como una
explosión, pero está bien. Y luego número cuatro,
podemos hacer sirenas. A lo mejor coche de policía, sirenas. Entonces ahí está el carro de la policía. Hagamos una última para bocinas de
tránsito o bocinazos. Toca la bocinada de tráfico. Entonces tal vez el primero. Entonces tenemos todos estos sonidos, y digamos que quiero
generar una escena de accidente automovilístico. Todo lo que tengo que hacer es
presionar los botones en ciertos momentos y hacer
ese audio perfecto. Entonces tal vez empezamos con el tráfico, accidente
automovilístico, jadeo de mujer,
esto, y luego oye Oye. Oye. Entonces ese fue un ejemplo, pero solo puedes
jugar con él. Puedes hacer
Así es como funciona. Entonces una vez
que tienes algo con lo que estás contento, incluso
puedes
darle un bucle. Enciende el bucle Así es como funciona. Este era el volumen, si alguna vez quieres
jugar con él. También tenemos el modo de
edición si quisieras editar tu sonido. Solo estoy haciendo clic
en el hombre que dice, Oye, y podría cambiar mi
prompt y reemplazar esto. Si lo necesitas, puedes agregar
más filas aquí abajo y simplemente llenarlo con lo que necesites para tu proyecto. Entonces aquí arriba tenemos
el botón de reproducción. Tenemos el botón de parada o simplemente despejar lo
que sea que esté aquí. Esto actualmente no se guarda, por lo que solo puedes
guardarlo en tu preset. Si te desplazas hacia abajo,
hay
mucha explicación sobre
cómo funciona esto. También tenemos un montón de cajas de
resonancia para que las pruebes. Vamos a probar Goofy de, por ejemplo, y ahora tenemos un montón
de voces que probar G para golpear loop y luego bajar el audio y comenzar a
llenarlo. ¿Qué fue ese ruido? Eso fue bueno así es
como funciona. Solo estás presionando un montón de botones para hacer
tu efecto de sonido. Volvamos por aquí y cerremos eso y luego
volvamos a generar. Ese fue el panel de
efectos de sonido. Es mucho
con lo que trabajar y realmente
tienes mucha flexibilidad sobre cómo suenan tus efectos de sonido. Ahora bien, si no estás familiarizado sobre cómo usar estos
efectos, básicamente, si tienes un video
y quieres
enfatizar una determinada
acción o cierto diálogo, puedes agregar los efectos de sonido. Por ejemplo, si hay un
auto pasando en tu video, puedes pedir 11 vueltas para hacer un sonido de deseo para
que en realidad no tengas
que acercarte súper a un auto y grabar ese sonido
con tu propio micrófono También es muy útil
si haces algún juego o bocetos ya que te ahorra tiempo al no tener que grabar efectos de
sonido desde cero, lo que puede llevar mucho tiempo En su mayor parte, es
bastante exacto si viste que no estás obteniendo
el sonido que deseas. Intenta ir en la pestaña Explorar, buscando algo similar, y simplemente
cámbialo a tu gusto. Ahora pasemos
al aislador de voz, que es la última herramienta dentro
de la categoría de juegos infantiles
10. Aislador de voz: El aislador de voz es otra
herramienta sencilla dentro de 11 laboratorios, y esencialmente lo que
hace es que elimina el ruido de fondo de tu audio y
aísla tu Entonces para probar esto, vamos a hacer uno directamente en el micrófono, y ya grabé un audio donde estoy hablando al
lado del AC. Entonces hay algo de ruido
en el fondo, y vamos a ver
qué tan bien se desempeña. Esta es la interfaz cuando llegas por primera vez a esta
herramienta de aquí. Lo único que puedes hacer
aquí es subir un audio o grabar a tu
computadora en vivo. Así que sigamos adelante y hagamos uno donde solo estoy grabando
mi audio con ustedes chicos. Tengo un micrófono conmigo, pero voy a mantener una
distancia del micrófono en sí,
y luego compararemos. Primero, en realidad,
hagamos uno donde esté hablando directamente
a buena distancia, y luego
retrocederemos y compararemos. Ese es mi audio 17 segundos. Acabo de leer algo de un
trozo de papel, y vamos a escuchar cómo
suena sin ningún
tipo de aislamiento. Encuentra a una hermana que aún vive en su pequeño departamento
encima de una tienda de comestibles. El piso está lleno de gente, amigos que habían huido de la ciudad
y ahora están muy cansados. Nadie tiene apetito por la comida. Bien. Lo que puedes hacer es
eliminar de nuevo este registro, o simplemente hacer clic
en Aislar Voz. Encuentran a una hermana que
aún vive en su pequeño departamento
encima de una tienda de abarrotes. El piso está lleno de gente, amigos que habían huido de la ciudad
y ahora están muy cansados. Así que eso fue conmigo hablando un micrófono a buena distancia. Vamos a tu escenario de
grabación ideal. Pero, ¿y si estuviera parado
junto a un ambiente ruidoso? A lo mejor hay un ventilador encendido, y solo hay mucho ruido
blanco a mi alrededor. Entonces eso es lo que
voy a hacer a continuación, y luego podemos comparar
lo bien que le va a hacer esto. Así que acabo de grabar
un audio donde tengo un ventilador en el fondo. Encuentran a una hermana que
aún vive en su pequeño departamento
encima de una tienda de abarrotes. El piso está lleno de gente, amigos que habían huido de la ciudad
y ahora están muy cansados. Nadie tiene apetito
por ningún alimento. Entonces es realmente sutil
en el fondo, pero si quiero hacer
esto profesionalmente, esa sutileza es también de lo que
quiero deshacerme Yo sólo quiero mi voz aislada así que veamos
cómo funciona esto. Encuentran a una hermana que
aún vive en su pequeño departamento
encima de una tienda de abarrotes. El piso está lleno de gente, amigos que habían huido de la ciudad, y ahora están muy cansados. Así que fíjate cómo eliminó
por completo
ese ruido de fondo. Voy a tocar el original
solo como referencia. Encuentran a una hermana
y luego a ésta. Encuentran a una hermana todavía
esto solo fueron 15 segundos, pero también puedes hacer esto
para audios más largos y es muy útil cuando no tienes un micrófono
profesional, lo
mejor estás grabando
en tu teléfono Hay algunas cosas en la parte de atrás y luego puedes
descargarlas aquí mismo. Eso es todo lo que puedes hacer
con el aislador de voz. Puedes aislar tu voz. En la siguiente lección,
vamos a pasar a
la sección de productos
de ElevenLabs También hay muchas
cosas geniales ahí, y hay mucho más en profundidad en comparación con lo
que estamos aquí. Espero que ustedes estuvieran
siguiendo y tratando de imitar las demostraciones
que estaba haciendo en las lecciones porque en los
próximos meses, las cosas se van a poner un
poco más avanzadas y siéntete libre de hacer una pausa o referirte
a las lecciones más antiguas porque esencialmente lo que hacen estos
productos es que combinan un montón de estas herramientas de patio de
recreo y te
dan una opción para
hacer audios más complejos Sigamos adelante y comencemos con nuestro primer estudio de productos.
11. Estudio, parte 1: Entonces studio te permite crear
algo desde cero. Y enseguida,
puedes ver aquí arriba tenemos algunos presets a seguir, como empezar desde cero, que es tú iniciando
un audio que podría ir de cualquier manera, audiolibro Por lo que contará con herramientas
diseñadas para audio de audiolibros. Tenemos podcasts y luego solo
podemos importar desde URL. Puede acceder a estudio desde la categoría de producto
justo por aquí. Estas son las opciones que podrían ayudarte
a empezar de inmediato. Puedes buscar tus
proyectos aquí mismo. Ahora mismo, no
tengo nada, así que no hay resultados. Pero puedes ver que hay
algunas guías aquí abajo si
quisieras aprender más sobre los efectos de sonido
en el desarrollo de juegos, doblaje de cambiador de
voz
y todas esas cosas Primero, comencemos
desde la primera opción. Empezar desde cero.
Yo hago clic en eso, creo que viste que
hizo proyecto sin título Déjame
regresar y mostrarte. Este es mi primer proyecto y van a hacer
fila justo por aquí. Puedes abrir el proyecto, duplicarlo o eliminarlo, y al hacer clic en él,
entras en el proyecto. Así es como puedes
hacer audios desde cero y decidir si
quieres agregar efectos de sonido, convertirlo en un audiolibro, convertirlo en un podcast,
convertirlo en una narración, lo que
quieras, Primero, sigamos adelante y
demos un nombre a nuestro proyecto. Voy a llamar a esto mi historia aterradora. Puede comenzar a escribir
justo aquí. Entonces si no queremos
escribir aquí mismo, hay algunas cosas
que podemos agregar como subir un PDF Si tienes ensayo
que quieres narrar, tienes un cuento
escrito en forma de PDF Aquí es donde los subes. Podemos agregar un video subir un video para agregar
las voces en off también Puedes agregar una URL. Estos son algunos presets
para que comiences,
y eso es todo. adelante y probemos las
cosas aquí arriba y luego
bajaremos por las otras formas de
agregar una entrada para esto. Justo aquí, puedes cambiar tu texto en
diferentes encabezados o simplemente en tu texto corporal normal Si tienes un párrafo,
puedes usar este y mostrar una historia
de lo que has hecho. Tienes algunos botones para deshacer. Tenemos un descanso. Entonces cuando añades un descanso, el orador no
va a hablar. Por ejemplo, si
tienes dos párrafos, quieres romper
entre los párrafos. Se pueden añadir efectos de sonido. Incluso puede alterar la
pronunciación de nuestra voz, que en estos momentos es George. Podemos dirigir el discurso
con nuestra propia voz, y luego podemos cerrarlos, luego finalmente obtener
alguna información sobre lo que estamos haciendo aquí. Del lado derecho,
elegiremos nuestras voces. Si presionas Seleccionar voz, esta es la misma biblioteca que
vimos en las lecciones anteriores.
Puedes buscarlo. Ve a tus audios guardados, usa voces profesionales
solo las predeterminadas, las que usaste recientemente, e incluso tus propias voces Sigamos adelante y elegimos
a alguien que susurre tal vez. La luz de la luna baila al
otro lado de la habitación. Estoy aquí para ayudarte
a caer en un sueño profundo y suave. Estás a salvo. Entonces quiero hacer una historia aterradora. Entonces quiero una voz que
pueda susurrar. Entonces los títulos de ASMR son un poco
geniales para esto. Sólo voy a
hacer click en el micrófono ASMR. Vamos a agregarlo a nuestras voces para que podamos acceder fácilmente a él más tarde, y luego simplemente podemos presionar Aplicar. Entonces está esta
barra de herramientas junto a ella, que es lo que vimos anteriormente en Creo que una de
las otras herramientas. Entonces todavía tienes
mucho control en cuanto a cómo se
aplican las voces a tu texto. Primero sigamos adelante y escribamos
algo muy básico para nuestra aterradora historia y veamos cómo
podemos conseguir que Mike le dé vida. Se puede ver de inmediato
cuando empiezo a escribir, es asignar a Mike a
lo que estoy escribiendo aquí Entonces podría cambiar
entre George, tal vez otras siete personas o simplemente tener a una persona
diciendo todo esto. Entonces aquí hay un pequeño texto
que acabo de escribir. Tiene sólo tres frases de largo. Justo por aquí, puedo
cambiar el diseño del texto. Por ejemplo, podría
hacer uno de ellos más grande, y tal vez si tuviera
dos párrafos, así que vamos a escribir uno más. Siguiéndolo como una figura larga y
esbelta que perdura en las sombras que venían por su alma que alguna vez
atesoró. Entonces otro párrafo,
y luego puedes ver cómo puedo cambiar la forma en que se ven
los párrafos, y esto podría demostrar que esta es una
apertura realmente importante y entonces tal vez le asignaría un comando y haría
un montón de otras cosas. Esa es una de las cosas. Si presionas Inter y presionas
una barra diagonal hacia adelante, puedes
agregar los comandos En lugar de ir a partir de aquí, también se
puede hacer
slash hacia adelante. Hagamos un descanso. Por 1 segundo, Mike
va a dejar de leer. También puedes hacer click sobre
esto y hacerlo más. Hago 1 segundo. Se puede hacer lo mismo
entre las palabras, slash
hacia adelante Hagamos otro
descanso y voy a hacer éste 3 segundos
tal vez 1 segundo. El 0.1 es muy poco. Probemos 1.6. Entonces también podemos hacer otras cosas como
slash hacia adelante, efecto de sonido Veamos dónde podemos
agregar un efecto de sonido aquí. Podemos hacer justo antes en
un día lluvioso, efecto de sonido, presionar Enter y luego dar clic
en la vista previa Lloviendo
vamos a hacer que la duración como 1.4 segundos genere
la vista previa Es lo mismo que
hicimos en el generador de
efectos de sonido. Obtienes tus vistas previas, presionas
Auto si no estás seguro, y luego ves
cuál te gusta más. Entonces ninguno de estos está lloviendo. Sigue lloviendo en un camino de piedra con truenos
al fondo Algo más para
trabajar con 11 laboratorios. Yo me regenero. Vamos a describir el sonido, y haré que la
duración sea un poco más larga para, como, una frase. Entonces me gusta previsualizar dos mejor, pegarle un flive y ahí tienes Entonces, para toda esta frase, va a
haber
este efecto de sonido de lluvia. Si cambias de opinión acerca de
que el efecto de sonido es demasiado largo, simplemente haz clic en él y podrás
silenciarlo después de un poco. Entonces voy a hacerlo un
poco más bajo y desgarrarlo. Sí. Entonces eso es mucho mejor. Quiero que sea un ruido de
fondo, no tanto como el foco principal. Entonces ese es nuestro efecto de sonido. También podemos agregar el
editor de pronunciación si quisiéramos agregar tal vez una palabra extranjera o algo que queremos
asegurarnos de que se pronuncia correctamente. Sólo voy a
encontrar un nombre único que tenga que ser pronunciado. Nombre único con
pronunciación correcta, algo aleatorio. Sí quiero probar la
precisión de ElevenLabs. Vamos a recoger este nombre. A lo mejor N estaría bien. A lo mejor 11 laboratorios
leerán esto como CN, pero ahí es donde llegamos
a arreglarlo con este tipo. Can mira hacia atrás y
contiene la respiración. Sabe lo que viene después. Bien. Entonces esta es mi
historia. Muy corto. Sigamos adelante y que
Mike empiece a leerlas. Entonces necesita leer todo. 39 segundos. Podemos cambiar la voz después. la carretera en un día lluvioso, había un hombre solitario
caminando de regreso del trabajo. Sus ojos estaban rojos de no dormir, su piel hundida por la falta
de comida Entra y sale del sueño pero sigue caminando
con su pesado cuerpo, sabe lo que
sucederá una vez que se detenga Siguiéndole había una figura
larga y esbelta demoraba en las sombras que
venían por su alma,
que alguna vez atesoró. Kían mira hacia atrás y
contiene la respiración. Sabe lo que viene después. Entonces para mí, leía
clave y escribía, pero si por tu caso, no
funcionó, tienes una
palabra específica o un nombre diferente, y ElevenLabs simplemente
no lo está captando Puedes seguir adelante y usar el editor de pronunciaciones.
Así es como se ve. O puedes conectar un diccionario que
subiste o hiciste. Y luego le asignas reglas
a este diccionario. Por ejemplo, cada vez
que vea esta carta, necesita ser pronunciada de esta
manera. Puedes encontrar tus
diccionarios aquí, puedes agregar reglas. Agrega nueva regla, ingresa la palabra, el Alias y luego la salida. Entonces si no quieres volver a usar este diccionario,
simplemente desconectarlo. Haces uno nuevo
aquí mismo y estas son
las voces predeterminadas con las que
obtienes para obtener una vista previa. Si realmente te gusta usar esto para palabras extranjeras o palabras
que son difíciles de pronunciar, te
recomiendo encarecidamente que
consultes ElevenLabs
en un tutorial sobre
cómo hacerlo correctamente Se llega a administrar los diccionarios de
pronunciación
con la programación. Tienes que instalar el SDK a través de tu terminal
usando el lenguaje Linux. Si planeas hacer
esto de la manera correcta, definitivamente échale un vistazo a esto. La puedes encontrar en los
docs de ElevenLabs. Normalmente recoge
las pronunciaciones. Por ejemplo, aquí no
leyó ¿Puede leer Ken, debería funcionar en su
mayor parte Sigamos adelante y dale a esto otro regenerado ahora que
agregamos más
efectos de sonido y este nombre Una vez más, nos está dando regeneración
gratuita para que estemos seguros con nuestro texto antes usar
realmente nuestros
créditos con Mike. la carretera, en un día lluvioso, era un hombre solitario
que regresaba del trabajo. Sus ojos estaban rojos de no dormir, su piel hundida por la falta
de comida Entra y sale del sueño pero sigue caminando
con su pesado cuerpo, sabe lo que
sucederá una vez que se detenga Entonces esa fue mi regeneración. Aquí arriba, también tenemos
discurso directo con su voz. Por ejemplo, si se trata de leer una oración de una manera
realmente monótona, esta herramienta
te ayudará a usar la capacidad de
voz a voz
dentro de ElevenLabs, algo que vimos
anteriormente, y puedo guiar 11 laboratorios sobre cómo leer esta oración de
la manera que quería Así es como
podemos usar las herramientas, la mayoría de ellas para esta historia aterradora
en particular. En la siguiente parte de esta lección, vamos a continuar con
las herramientas aquí arriba y luego ver cómo podemos aplicar
esto a un documento, un video, una URL y expandir nuestras aplicaciones. Los voy a ver en la
siguiente parte de esta lección.
12. Estudio, parte 2: Ahora vamos a seguir
revisando las herramientas aquí arriba. Entonces anteriormente, hicimos
esta pequeña historia corta. Tuvimos ratones ASMR leerlo, agregamos algunos efectos de sonido
y algunas pausas Pero en realidad puedes llevar
esto un paso más allá. Entonces di que tienes esta frase
y simplemente no te gusta
lo monótona o exagerada que la
voz la está leyendo Lo que puedes hacer es
leerlo de la manera que quieras y luego tener la
copia de voz ese estilo exacto. Puedes hacerlo por aquí
mismo con discurso
directo con
tu voz, ahora mismo, acabo de destacar esta
frase como referencia, pero puedes hacer todo o solo una palabra,
lo que quieras Una vez que lo hayas seleccionado, simplemente
hacemos clic en eso y
puedes verlo aquí mismo. Lo que puedes hacer es subir un audio o grabar
tu voz directamente. Básicamente, primero escuchemos
cómo Mike está leyendo esto, y luego haremos nuestra versión. Vamos a regenerar la selección si hay
algo que nos perdimos la carretera en un día lluvioso, era un hombre solitario
que regresaba del trabajo. Sus ojos estaban rojos de no dormir, su piel hundida por la falta
de comida Entra y sale del sueño
pero sigue caminando con su pesado cuerpo porque
sabe lo que sucederá una vez que se detenga Era una figura larga y esbelta demoraba en las sombras que
venían por su alma,
que alguna vez atesoró. Can mira hacia atrás y
contiene la respiración. Sabe lo que viene después. Eso es lo que tenemos
hasta ahora y curiosamente, lees esto como SN, pero solo podemos
dirigirlo de una manera diferente Por ejemplo, aquí, quería hacer una pausa entre
decir persistente. Lo que voy a hacer es simplemente
cubrir toda esta sección, ir por aquí y empezar a leer esto de la
manera que yo quiera. Elige tu micrófono
y apenas empieza a golpear Inicio. Siguiéndole había una figura
larga y esbelta demoraba en las sombras que
venían por su alma,
que alguna vez atesoró. Kian mira hacia atrás y
contiene la respiración. Sabe lo que viene después. Una vez que hayas terminado,
va a aparecer así, y puedes generarlo o simplemente empezar de nuevo para
una grabación diferente. Voy a golpear Generar, y ahora podemos comparar
lo que estamos obteniendo aquí. Entonces, si vas enseguida siguiéndolo era
una figura larga y esbelta que se
demoraba en las sombras que
venían por su alma,
que alguna
vez una figura larga y esbelta demoraba en las sombras que
venían por su alma, apreció Ken mira hacia atrás y
contiene la respiración. Sabe lo que viene después. Entonces ahora que se aplicó, escuchemos cómo suena esta nueva
versión. Puedes ver en el lateral aquí, tenemos esa conversión, y simplemente puedes hacer click sobre ella para ver qué parte convertiste. Siguiéndole había una figura
larga y esbelta demoraba en las sombras que
venían por su alma,
que alguna vez atesoró. Ken mira hacia atrás y
contiene la respiración. Sabe lo que viene después. Y ahí vamos.
Pudimos antes que nada, que esta frase se leyera muy despacio con la
pausa que queríamos. También hicimos que Mike leyera esto
como Kan y no veía, que es lo que
estaba leyendo antes. Realmente puedes
ampliar esto con algunas pronunciaciones si
prefieres usar esto y esto,
especialmente para idiomas
extranjeros, especialmente para idiomas
extranjeros, esto te va a ser útil La siguiente herramienta permite
bloquear párrafos para
evitar cambios. Por ejemplo, no
quiero que se le haga nada a este párrafo superior por
accidente porque
hacerlo, va a ser un
poco molesto. Todo lo que realmente tienes que
hacer es resaltar ese texto y hacer clic en el candado. Ahora puedes ver un icono de candado en el lado izquierdo,
eso es todo. Puedes desbloquearlo
agarrándolo de nuevo y simplemente
haciendo clic en el mismo icono Este de aquí mismo
envía un reporte. Nada demasiado que
puedas hacer por allá. Tienes tus voces,
cambia tu configuración
si es necesario cada vez que
hagas un cambio, solo no olvides
presionar Generar. También puedes generar una sección solo agarrándola y golpeándola Usa la barra de aquí abajo
para reproducir una selección, cambiar la velocidad, saltar, presionar reproducir tu
pausa y solo ver cuántos minutos o
segundos es tu audio. También puede acercar y alejar. Hay una línea de tiempo
que realmente va a presionar Zoom un poco en este
botón primero haga clic en Expandir. Se puede ver que cuando empieza, aquí es donde empieza a tocar el
rango, pero podría simplemente
agarrar esto y hacer
que juegue en otro momento. Puedes acercar y alejar
la línea de tiempo así. Yo lo creo a través
así que ahí está la pausa. Este es el para el sonido. Podría simplemente
agarrarlo en algún lugar
así y hacer mis
cambios de esa manera. Esto fue con su función clásica de
texto a voz. Pero, ¿y si quisieras
hacer esto a partir de un documento? Lo que voy a hacer ahora
es simplemente copiar esto y abrir un documento de texto,
nada demasiado elegante. Simplemente pégalo aquí, quita las diferentes palabras y
simplemente deja el guión. Una vez que tenga esto, sólo
voy a guardarlo como un punto TxD. Llama a esto mi guión. Entonces solo eliminaré todo esto para comenzar
con un documento. Da click en esto y sube
tu documento y ve cómo lo maneja ElevenLabs. Podemos ver podemos subir un PDF,
un EPAP, THD, HDL,
o Hay muchas
opciones. Ahí vamos. Ahora tengo mi guión
traído de un documento. Si estás haciendo un audiolibro, esto va a ser muy útil porque no tienes que
copiar y pegar nada Entonces cuando tengamos
probemos otra voz aquí. Que Dorth lo lea.
Ahora el nombre cambió, vamos a golpear generar, y
llegamos a verlo aquí abajo. la carretera, en un día lluvioso, había un hombre solitario
caminando de regreso del trabajo. Sus ojos estaban rojos de no dormir, su piel hundida por la falta
de comida Entra y sale del sueño pero sigue caminando
con su pesado cuerpo Siguiéndole había una figura larga y
esbelta que se demoraba en las sombras que venían por su
alma, que alguna vez atesoró. Kian mira hacia atrás y
contiene la respiración. Bien. Así que así, importé texto,
empieza a leerlo. Pero, ¿y si quisieras
agregar algo a un video? Tengo este video que
hice con pasarela, que es otra herramienta de IA donde se llega a
generar videos, y
actualmente hay una voz en off ahí, pero sí quiero
probarlo con ElevenLabs Hay muchos
paisajes ahí dentro. Hay muchas
vibraciones y es una oportunidad perfecta para que combinemos
efectos de sonido,
breaks, voces y todo eso en
un solo Entonces lo que voy
a hacer es subir ese video y
volveré para que podamos continuar. Ahí está mi video subido. Puedes previsualizarlo. Tiene un
minuto y 10 segundos de duración. Una vez más, tenemos
un diseño similar en cuanto a las voces
y las herramientas aquí arriba. Yo toco esto, no vas a escuchar nada porque no
hay audio. Pero lo que podemos hacer es
ir al principio. Abramos a este tipo de aquí mismo y llevemos
el video al principio. Creo que debería ser más corto. Sí, en realidad tiene
53 segundos de duración. Entonces lo que voy
a hacer es simplemente tener esta obra y escribir
un guión para ella. Empecemos con una frase. Entonces esa es nuestra primera oración y en
base a cuánto tiempo
tardaría en convertirse en un audio, puedes ver la
estimación aquí abajo. Esto va a tardar
unos 5 segundos. Si tuviera juego,
va a generar. Ahí estaba ella la única sobreviviente
caminando por las ruinas. Eso es sólo un ejemplo.
Obviamente, tenemos que cambiar la voz y hacer algunos
otros ajustes. Así que pasemos
a nuestra siguiente escena, tal vez en algún lugar por aquí. Yo escribí mi guión aquí mismo. Voy a agregar algunas pausas entre
cada una solo para asegurarme que cada oración esté
dedicada a una escena Esto de aquí mismo va
a ser para la primera escena. Entonces justo por aquí, sí
necesitamos un descanso. Agrega una pausa, 1 segundo. Después agregaré una pausa
después de cada oración. Bien. Y luego podemos agregar
algunos efectos de sonido. Entonces aquí creo que algunos cuervos en la parte de atrás un poco de
viento estaría bien Vamos a hacer clic en esto aquí mismo y luego ir a la vista previa. Entonces pros en el fondo. Tratemos de mantenerlo para toda
la parte
donde se encuentra en esta ubicación. Así que ambos clips,
una vez que
terminemos, podemos generar una vista previa y decidir cuál
funcionaría para esta escena. Bien. Ahora se puede ver
que pasa por encima de ambos. La siguiente parte aún se trata de que
ella esté en este bosque, así que podemos pasar
a la siguiente donde ella o ella se encuentre
fuera del bosque. Aquí es cuando ella
realmente entra. Entonces, qué podemos hacer
por ambos,
en realidad, resaltar toda
esta sección y agregar otro efecto de sonido. Entonces hagamos
sonidos de bosque de Erie con no quiero volver a
hacer cuervos, tal vez viento Voy a hacer otros diez segundos
completos, y creo que el
primero es el mejor. Agregué las pausas y los efectos de
sonido que quería. Solo para pasarte, tuvimos el primero con los
cuervos de fondo Hay una pausa de 1 segundo, la oración, otro segundo. Agregué un efecto de
sonido de paso lento aquí porque estamos viendo que
hay algo siguiéndola y
eso es todo Ahora en cuanto a la voz, sí
quiero ir por algo
un poco diferente. Intentemos
buscar el thriller tal vez. Sea tan sucio. No Atmos Segun Mosm Ignorovch. Dios te ha dado
Hagamos comida profunda, algo que se
adapte a esta mirada de horror. Eso Hey, ven aquí.
Veo esa mirada. Nuestra desconfianza Cambiar
todas las cosas es dulce. Cambiar todas las cosas es dulce. Bien, creo que ahora mismo me gusta
Josh. Entonces lo que vamos a hacer es simplemente agarrar todo esto, elegir a Josh. Ahora puedes ver el
nombre apareciendo. Entonces se fue al bosque
buscando cualquier señal de vida. Ella sólo encontró recuerdos de ello. Bien, entonces no voy a jugar
contigo todo el asunto. Pero esencialmente, así
es como funcionaría. Tienes tu video aquí. La línea de tiempo
abajo realmente
te ayuda a descubrir qué tipo
de efectos de sonido quieres, qué tipo de pausas, cuánto tiempo deberían ser las pausas Y en general, puedes crear efectos
realmente buenos
con esta tecnología. Entonces una cosa que a la gente le gusta hacer cuando tiene
un video como
este, este video estará disponible para que ustedes lo usen, por cierto. También puedes poner, como,
un vlog o algo así. Solo concéntrese en obtener los efectos de
sonido correctos y luego continúe y agregue algo de música
tal vez o una voz en off Eso sólo porque de esa manera
se puede jugar
con los volúmenes. Escucha sin ninguna voz en off y solo escucha los efectos de sonido ¿Aparecen en
los momentos adecuados? Si no, puedes
regresar y tal vez seleccionar una hora diferente o simplemente
moverlas como lo hicimos antes. Lo que también puedes
hacer es hacerlo con la exportación de efectos de sonido
traerlo de nuevo
para la voz en off o agregar
otro conjunto de efectos de sonido Debido a que esta es una herramienta en línea cuando agregas muchas capas
superpuestas, puede fallar,
lo cual es
algo muy normal. Si
te pasa, no entres en pánico. Pero una forma de mitigarlo
es exportarlo y
luego traerlo de vuelta. De esa manera, los primeros cambios
que realices serán seguros y permanentes porque
exportaste el video y luego podrás construirlo hasta
tantas capas como quieras. Eso es todo para
la herramienta de estudio, bastante sencillo. Hay mucho que
puedes hacer con él, y cuando volvamos,
como mencionamos, podemos ver nuestro proyecto, volver a él, hacer cambios
adicionales. En la siguiente lección,
vamos a aprender a generar un audiolibro
usando ElevenLabs Esta es otra herramienta
sencilla. Esencialmente,
solo tienes que hacer clic en subir, elegir tu voz,
y eso es todo. El siguiente
va a ser podcast, que se pone un
poco más en profundidad, pero vamos
a ver todos esos en el próximo
par de lecciones.
13. Actualizaciones del estudio: Ahora, ya vimos cómo funciona
la función de estudio en
ElevenLabs, pero desde entonces, ha
habido
algunas actualizaciones y
algunas características nuevas que realmente pueden
transformar la forma en
que usas Así que seguimos en el estudio, y normalmente solo sería una caja donde escribes
algo para voz. Pero ElevenLabs ahora
te permite hacer videos, música y crear auto leyendas, como puedes ver así que estos son solo un montón de ejemplos
de lo que puedes hacer Así que un video sin rostro
subtitulado, doblaje, voz en
off, video a música Tus proyectos están
hasta aquí abajo. Si alguna vez hiciste uno,
van a ser listados abajo, e incluso puedes filtrar
a través de ellos usando estas etiquetas. Cuando subas aquí,
puedes saltar de inmediato, decir lo que quieras crear. Se puede pensar en el estudio como
la plataforma multipropósito. Entonces, en lugar de
pasar por cada una, tal vez combinando dos cosas, solo
puedes ir
a Studio y obtener una mezcla de todas estas características. Puedes adjuntar algo como referencia desde
tu computadora haciendo clic en este o subir
una carpeta completa usando esto. En lugar de crear
un video aquí mismo, solo
voy a crear un nuevo proyecto en blanco y aquí
tenemos dos opciones. Primero es un proyecto de video y
el segundo es Proyecto de Audio. El proyecto de audio es lo que
vimos en las dos lecciones
anteriores. Pero el proyecto de video es
esa cosa adicional. Así que sólo para repasar proyecto de
audio, voy a hacer click en eso. Y la idea es más
o menos la misma. Entonces estamos en Audio Project, y las características principales son
prácticamente las mismas. Así consigues tu pequeño
espacio de trabajo en el centro. Podemos dividerlo en capítulos. Se puede pensar en esto como tabuladores. Tenemos nuestra biblioteca de voz, algunos efectos de sonido que
conseguimos incorporar aquí, la música. Esta es otra nueva característica
que tiene ElevenLabs, y, por supuesto, cosas que
has subido para tu proyecto Podría ser una referencia
para un personaje. Podría ser una muestra de audio,
cualquier cosa que quieras. Ellos van a ser listados aquí
mismo para ti. Ahora, puedes subir
al proyecto así. Puedes grabar directamente
en el proyecto, o puedes importar archivos. Entonces, puedes usar
las tres opciones. Y luego, claro,
tenemos la pestaña de edición donde todos los
deslizadores familiares van a estar aquí Llegamos a escribir cosas describiendo básicamente ese proyecto
final que queremos. Entonces podría ser una
historia corta sobre XYZ, y solo la tecleas aquí, y luego todos esos
elementos se juntan. Podría ser una voz en off
para video de YouTube. Puedes subir el video de
YouTube como referencia y obtener la
ayuda de ElevenLabs para crear una voz de IA para ti que coincida con
la vibra de ese Vamos a hacer un ejercicio
muy sencillo aquí
mismo donde
voy a escribir, como, instante de un video de terror donde nuestro personaje está un
poco asustado. Va a haber
algunos efectos de sonido. Podemos sacar algo de música aquí, obtener una buena voz adecuada y, por
supuesto, agregar breaks
y etiquetas de audio. Ahora, por aquí
tenemos nuestros modelos. También tenemos tres. Entonces voy a usar eso
por las etiquetas de audio, y luego podemos trabajar
con el tipo. Voy a dejar el mío para como texto, y luego puedes agregar
algo de voz, también. Así que vamos a
explorar la biblioteca, algo que va a
funcionar bien con, como, un personaje asustado. En el teatro de la vida,
todos somos actores compartiendo
lo mismo Solo confía en ti mismo. Entonces tú La cosa
siempre pasa que tú como nosotros estamos liberados así que
vamos por voces por defecto
y busquemos asustado La vida no se trata de
encontrarte a ti mismo. Los años enseñan
mucho, ¿cuál es el día? No es tan importante
saber todo como para apreciar nunca me
ha lastimado nada de
lo que no dije. Hacemos nuestras propias fortunas
y las llamamos gordas. Dios te ha dado una cara,
y te haces a ti mismo. La gratitud es rica
como lo es la queja. Entonces iré con
Eric para este caso. Sólo vamos a dar
click sobre ese nombre. Va a haber una marca de verificación, y podríamos
volver a Editar Entonces ahora podemos ver a
Eric como nuestra voz. Tenemos texto versión tres,
y, ya sabes, todo lo
demás está bien hasta el momento. Ahora sólo voy a empezar a
escribir algo muy sencillo. Entonces tal vez, como,
creo que escuché algo. Parece que
parece que algo viene. Podemos agregar en algún texto
de audio aquí. Entonces pero respiración pesada. Oh, no, no hay tiempo. Ahora, aquí estoy usando
los tres puntos, pero si estás usando otro
modelo como el V dos, eres capaz de usar el audio
o los saltos de voz, en realidad. Pero si quieres usar V tres para algo
más natural, podrías simplemente, ya sabes,
hacer lo mismo aquí. Entonces esa es nuestra primera línea, y aquí voy a
poner algo de música de Erie. Entonces tenemos algunas canciones aquí, pero también podríamos
generar nuestra música. Entonces voy a explicar esto
más a fondo en los capítulos posteriores. Pero por ahora, solo describe
la música que quieres. Entonces tal vez Erie suspense música
de fondo. Y solo lo dejaré
con los ajustes actuales. Estamos consiguiendo tres
versiones, lo cual es mucho, pero quizá puedas
cambiarlo por uno, así que se
centra más en la primera. Elige tu modelo aquí mismo. Y luego la duración, tal vez puedas hacer como 5
segundos o algo así. Si quieres un zinger ahí dentro, podría
haber, ya sabes, alguien hablando, y luego
podemos afinarlo más Entonces ahora, cuando aclaro mi búsqueda, podemos ver las tres
generaciones que se hicieron. Sólo voy a agregar
el primero en. Es importar la música. Solo tenemos algo
para el fondo, y obtenemos esta pequeña línea de tiempo. Así que a lo mejor puedo hacer que
empiece aquí, lo extienda, cambie mi música si es necesario, y construya este
audio desde cero. Creo que oí algo. Parece que
algo viene. Por aquí, quiero
que diga otra cosa. Entonces vamos, como,
a la siguiente línea. Estamos como, Oh, ¿qué es eso? Y luego agregaremos aquí un efecto de
sonido, que es otra característica. Voy a hacer, como, crujir en el monte Voy a hacer
algo muy corto. Tal vez como 5 segundos. Entonces solo voy a agregar esto aquí. Importando, ahora tenemos
otro elemento, y solo tienes que
construir sobre esto. Creo que oí algo.
Parece que algo viene. Oh, ¿qué es eso? Quizá un poco antes. Oh, ¿qué es eso? Añadiendo más texto. Y luego digamos que es
como un gato que sale, así podemos hacer algo
como Bien Y luego mientras estoy aquí, solo
voy a hacer gato. Podemos ver si
hay algo. Hagamos maullido de gato. Muy bien. Y ahí está
nuestro efecto de sonido final. Ahora, solo tengo que
limpiar esto, y tenemos nuestro primer proyecto de estudio
actualizado. Ahora, antes de generar esto, hay algunas
cosas que podrías hacer con cada una de estas capas. Lo primero es cortar algo si hay
demasiado de él. Por ejemplo, aquí mismo,
no necesito todo este audio, así que podría simplemente
alejarme aquí mismo y sacar el final de todo
este audio. Podrías contrarrestar esto generando
algo más corto. Pero esta es también otra forma
de cortar las cosas. Y otra forma más rápida es simplemente agarrar,
ya sabes, tu segmento. Otra cosa que podrías
hacer es simplemente hacer clic en ese segmento de Audio y
presionar S en tu teclado, y va a dividirlo. Simplemente puedes eliminar ese bit
extra con el retroceso. Lo siguiente es
trabajar con el volumen y los efectos de fundido para
cada uno de estos segmentos. Entonces, por ejemplo,
tuvimos el maullido. Simplemente comienza de la nada. Entonces tal vez podría hacer
que este audio se
desvanezca y el audio aquí también
se desvanezca. Entonces, básicamente, va
a bajar el volumen a cero en un
periodo de tiempo más largo. Creo que oí algo. Parece que
algo viene. Oh, ¿qué es eso? Oh,
no, no puedo manejar esto. Oh, sólo era un gato. Tonto de mí. Y por alguna razón, aquí
tenemos una voz femenina, así que déjame cambiarla de nuevo. Se puede cambiar el
audio así como así. El maullido gato es un
poco demasiado
ruidoso, así que vamos a
bajar eso, y ya estamos bien para irnos Creo que oí algo. Parece que
algo viene. Oh, ¿qué es eso? Oh,
no, no puedo manejar esto. Oh, sólo era un gato. Tonto de mí. Y esa es la interfaz de
estudio actualizada. Nuevamente, no es tan diferente
de lo que vimos, pero hay algunas cosas
adicionales como música y esta línea de tiempo
que tenemos aquí mismo, y puedes importar
diferentes partes de ElevenLabs
a tu próximo archivo de audio Aquí abajo, tenemos un montón de otras herramientas de IA que
podrías utilizar. Entonces tal vez mejorando el texto. Si quieres escribir
algo un poco mejor, puedes usar la función de texto
mejorado. Así que sólo voy a destacar
eso. Haga clic en esto. Podría hacer eso. Si
estás importando audio y hay música de
fondo, puedes usar esta
opción aquí mismo. Puedes cambiar la voz
con cambiador de voz. Entonces tal vez cambiar el tono, la velocidad, y todo eso. Y también puedes dirigir el
discurso con tu voz. Entonces, básicamente, si él está
hablando de una manera rara, podría grabar mi voz con
la forma en que quiero que hable, y luego
solo seguirán 11 laboratorios. Nuevamente, puedes exportar muy
fácilmente con este botón. Puedes compartir,
nombrar tu proyecto y crear diferentes
capítulos si es necesario.
14. Herramienta de audiolibro: La siguiente herramienta que
vamos a echar un
vistazo es cómo podemos
hacer un audiolibro. Cuando haces clic en él, puedes subir de
inmediato
tu cuento corto Tengo un PDF corto para
ustedes en un paquete de recursos. Es un
libro infantil de Monkey Pen. Ponen a
tu disposición libro infantil gratuito. Puedes subir cualquier cosa con estos formatos o incluso
escribir tu propia historia. Entonces déjame
mostrarte cómo es el PDF antemano,
y a partir de ahí, podemos entender cómo ElevenLabs convierte el
texto en audio Entonces este justo aquí es
un cuento corto que
voy a subir.
Esta es la pluma de mono. Se puede ver que
hay muchos logotipos,
un poco de texto prefacio, obtenemos ilustraciones
y todo eso. Entonces, ¿cómo convierte ElevenLabs
esto en un audiolibro? En lugar de copiar todos estos, todo lo que tienes que hacer
es subirlo aquí. Una vez que hayas hecho eso,
puedes quitar el documento para subir otra cosa e
inmediatamente elegir tu voz. Ve por allá. Puedes previsualizarlos y ver las
diferentes categorías. No hay grandes los
años Nuestra desconfianza. El amor. La vida sin amor es
como un Solo confía en ti mismo. Entonces voy a ir con Alice
para éste, da click en él. Entonces tenemos esta opción
para voces autoasignadas. Esencialmente, eso va a
cambiar entre personajes. Esta historia realmente no tiene diálogo, así que
no necesito hacer eso. Pero si solo
querías encenderlo y puedes ver que
va a tardar un poco más. Simplemente presiona Crear y vas a entrar en
esta página, que es bastante
similar a studio. Aquí obtenemos todo nuestro texto, y luego eliges tu voz y agregas los efectos de sonido
como aprendimos antes. Estas son las cosas del prefacio, y simplemente podría
eliminarlas para que la historia del libro de cuentos
comience de inmediato Sigamos adelante y golpeemos Generar. Comando o Control A, así seleccionas todo, tu voz, confirmarla, luego comienzas la generación. Entonces generé el audio. Lo primero que
puedes hacer es, de nuevo, puedes cambiar el nombre, y luego podemos simplemente darle play y ver cómo
suena. Hola, soy el profesor Humedad, y
te estaré contando sobre el agua. Se le puede llamar lluvia.
Se le puede llamar nieve. Se le puede llamar aguanieve. Se le puede llamar granizo, pero
es agua de todos modos. ¿Alguna vez te has preguntado qué edad tiene el
agua o de dónde viene? Las respuestas pueden sorprenderte. La próxima vez que veas un estanque
o incluso un vaso de agua, piensa en la edad
que podría tener esa agua. ¿De verdad quieres
saber? Pensé que sí. ¿Te cepillaste
los dientes esta mañana? Bueno, parte del agua que
usaste podría haber caído
del cielo ayer. Entonces como pueden ver, hace un trabajo bastante bueno con
la capitalización Yo no hice eso. Vino
directamente del PDF. E incluso la forma en que la voz pronuncia esta frase,
es bastante buena Y su voz en general, funciona perfectamente con
el libro infantil. Pero nuevamente, al
igual
que la última lección, se llega a agregar pausas o incluso ir a la configuración aquí para agregar más exageración al 37%,
bajar la similitud Disminuimos
un poco su discurso y
al mismo tiempo, voy a agregar algunas pausas
entre estas frases Hagamos una pausa aquí
y eso es todo. Hagamos otro Commander
Control A y golpear generar. Permítanme realmente guardar
esto, luego generar esto. Hola, soy el profesor Mois Tui, y
te estaré contando sobre Se le puede llamar lluvia.
Se le puede llamar nieve. Se le puede llamar aguanieve.
Se le puede llamar granizo, pero es agua de todos modos. ¿Alguna vez te has preguntado
qué edad
tiene el agua o de dónde viene? Las respuestas pueden sorprenderte. La próxima vez que veas un estanque
o incluso un vaso de agua, piensa en la edad
que podría tener esa agua. ¿De verdad quieres
saber? Pensé que sí. Entonces es bastante sencillo, funciona igual que las herramientas básicas de las que ya
aprendimos. Cuando termines, puedes golpear Exportar y
publicarlo en una de las plataformas que veas aquí
mismo o simplemente
exportarlo como el archivo único o
el párrafo por separado, el formato de audio,
y ahí vas. Aquí es donde te indica la cantidad de
créditos que utilizará. Así que todos tus créditos
están por aquí y sí. De nuevo tienes esa
línea de tiempo aquí abajo, acercar y alejar, eliminar partes agregarle, y simplemente puedes dar
vida a tus historias usando esta herramienta. Pasemos a la siguiente
lección donde veremos cómo
podemos crear podcasts
con ElevenLabs
15. Podcasts: Nuestra siguiente herramienta es crear
un podcast con IA. Al hacer clic en él, de nuevo, es como el audiolibro Inmediatamente, puedes
subir tu contenido, importarlo desde una URL
o incluso usar un o incluso usar un Si ese es el caso,
puedes seleccionarlo así y luego
poner tus voces. Pero comencemos de nuevo aquí, que es donde llegas
a subir tu documento. Ahora, una cosa que
voy a hacer
a los efectos de esta lección es usar HGPT para
hacernos un podcast de muestra En tu caso,
estarías teniendo tu propio expediente. Si has escrito un
guión para tu podcast, simplemente
lo guardas como uno de los formatos aquí abajo
y simplemente lo subes. Pero solo voy a
entrar en HGPT y pedir un podcast de muestra con un anfitrión y
un invitado
donde discutan
el clima y
lo divertido que es el verano Haz esto de 5 minutos de duración. Así que hasta conseguimos un nombre,
que es bastante genial. Nuestro primero el anfitrión se llama
Alex y el invitado es Maya. Sólo voy a dejar que esto genere y
básicamente vamos a copiarlo y
pegarlo en un documento de Word, y de esa manera podemos
guardarlo en uno de los formatos. Sólo voy a abrir uno aquí, un nuevo documento, y simplemente
copiar el podcast en sí. Quizás todas estas cosas porque
idealmente en tu muestra, también
tienes mucha
información. Ahí está mi podcast. Vamos a guardarlo.
Denle mi podcast, guárdalo como un dotxem Es guardar y
subir. Ahí está. Se puede quitar para
poner en otra. Lo siguiente
que puedes hacer es elegir el formato
de tu podcast. Enfoque podcast con actualizaciones clave, conversación
casual entre
un anfitrión y un invitado. Sí pedimos dos
personas en el podcast. Esto es a lo que
voy a ir. Entonces llegamos a
elegir la duración. Yo solo voy a
ir con default, luego golpeo X cuando termine. Estas son las voces para
nuestro pueblo, el anfitrión. Una sola rosa puede ser mi jardín. Y luego el regalo. Si te pasas toda tu vida
esperando la tormenta, Si vas en alguno de estos, así que déjame
buscar a Jessica muy rápido, puedes ver que una de sus
etiquetas es conversacional, y sí le pido un podcast donde dos personas están
conversando También puedes buscar otras personas conversadoras y luego hacer tu
elección a partir de ahí Hola y bienvenidos.
No al Dao Los predeterminados
son por ElevenLabs. Por lo general son bastante buenos. La naturaleza como nube mutable. Hacemos nuestra propia fortuna. Pero solo me voy a quedar los que ElevenLabs
eligió para Aquí abajo, sí
tienes algunos ajustes. Entonces, ¿cuál es el enfoque del podcast? Creo que dijimos que
hacía calor. Agreguemos otro
verano destacado. Es seguro. Entonces lo que va
a hacer es que enfatizará esas palabras
dentro de tu podcast, y solo te mostraré cómo
es eso. Por último, tenemos el idioma. Me voy a quedar con el inglés, pero volveremos
a probar uno diferente. Generemos y veamos cómo es
nuestro podcast. Bien, entonces ahí está mi audio. Y tenemos 6 minutos
y 26 segundos. Eso es porque
tiene las pausas adentro. Pero si viste que es demasiado largo o
demasiado corto, siempre
puedes
volver a Cha HbT y pedirla para que
sea 3 minutos, 20 minutos, por
mucho tiempo que quieras Sigamos adelante y escuchemos. ¿Sabías que las olas de
calor ahora matan a más estadounidenses cada
año que huracanes, inundaciones y tornados combinados La forma en que experimentamos el verano
está cambiando fundamentalmente, y hoy nos
sumergimos en cómo las comunidades se están adaptando a estas
crecientes temperaturas. Esas estadísticas son
realmente abridor de ojos. He estado leyendo sobre
cómo diferentes ciudades están desarrollando soluciones innovadoras para lidiar con el calor extremo. Bueno, lo fascinante
es cómo esto
se ha convertido en un gran público
como puedes ver, sí cambia entre la
gente, y aquí abajo, en realidad
estamos viendo los colores asignados a Chris y Jessica. Una cosa que quizás hayas
notado es que por defecto, ElevenLabs eliminó
la primera parte de nuestro guión donde solo
habla de la descripción del
podcast Por lo que corta de inmediato a
lo que estas personas están diciendo. No estoy viendo conjeturas paréntesis Maya o el título del podcast
ni nada por el estilo Eso es bastante impresionante.
Y lo que puedes hacer es alterar las voces
al mismo tiempo y hacer que se regenere
todo. Para Chris, creo
que podría hablar un poco más lento y ser un
poco más estable, en realidad un poco menos estable. Sonaba un poco demasiado robótico y un poco
exagerado Hagamos algo
similar con Jessica. Creo que definitivamente podría ir
más despacio con su voz. Creo que no
salvamos. Chris en realidad baja esto y hace que esto sea un
poco menos estable. Es seguro. Una cosa más que sí
quiero hacer es agregar en pocas palabras de, como,
pausas, errores humanos para
hacer este poadcast un poco más realista y eso es algo con lo que ChatBT
podría ayudarte Sólo voy a pegar mi texto. Toma este texto y agrega y hace una
pausa para que suene. Más humano. Además, vamos a
reducir esto a 3 minutos. Cita marcada,
pega y comillas, y luego pulsa Enter. Solo un descargo de responsabilidad,
esto es por AI, la información aquí
puede no ser cierta. Así que solo toma todo esto
con un grano de sal. Si quieres hacer un podcast
estadísticamente correcto, asegúrate de elegir fuentes
confiables, pero esto es solo para fines de
demostración. Estos números, estos lugares, programas,
probablemente no sean reales. Eliminar los títulos
para anfitrión e invitado. Yo sólo quiero que el diálogo
se separe por saltos de párrafo. Bien así que esto
va a funcionar bien. Podrías tener que hacer eso para eliminar los títulos
para anfitrión e invitado, pero luego
tendrías que asignar a Chris y Jessica a cada una
de estas frases. Lo que voy a
hacer es simplemente copiar la respuesta anterior y luego volver a subirla
a nuestro proyecto. Comando o Control S, sigamos adelante y antes que nada, eliminemos todo y
escoja un documento. Déjame realmente volver aquí, comenzar uno nuevo para no
tener que editar nada. Los mismos ajustes que antes. Solo voy a agregar los aspectos más destacados
aquí, tal vez verano. Aquí, lo que quieres
hacer es mirar tus guiones y encontrar algo que te
gustaría enfatizar. Veo chicos aquí tal vez,
tal vez temperatura. Si se vuelve verde,
eso funciona para este enfoque
porque está en el guión. Creo que voy a
ir con uno ya que hay mucha
información diferente que se está
pasando por aquí, pero la temperatura es definitivamente algo de lo que estamos hablando. Guarde los cambios.
Pongamos esto en inglés. Las voces están bien,
y empiezan a generar. Bien, juguemos y veamos
qué tenemos esta vez. Aquí hay algo que me
detuvo en seco. Las olas de calor están matando ahora a más estadounidenses que huracanes, inundaciones y tornados combinados, y está cambiando completamente la
forma en que vivimos en Esa es una estadística
muy llamativa. Y lo que realmente me pone es que esto no es una amenaza
lejana. Está afectando a
las comunidades en estos momentos. Bien, entonces tengo mis
premios aquí mismo. que trajo
el último guión, pero podría simplemente
cambiarlo como acabo de hacerlo. Oye, um, ¿sabías
que las olas de calor ahora matan a más estadounidenses cada año que las inundaciones de huracanes y
tornados combinados Sí, es salvaje. La forma en que experimentamos Summers, así que si eso te pasa, solo tienes que volver a tu guión
y copiar lo que quieras Y aquí, lo voy a añadir a lo que
había antes, pégalo. Y lo que debes hacer es
resaltar toda esta sección y aplicar solo Jessica o
la voz que quieras Y de esta manera
puedes cambiarlo. Pero ahora que hay
ms y pausas, suena mucho más humano Por eso exactamente
fuimos a ChachiPit. Una vez más,
bajaré un poco su velocidad,
agregaré más exageración, guárdala. Para Jessica, creo que está bien. A lo mejor hacerlo un
poco menos estable. Su velocidad es perfecta
para un podcast. Pero una vez que hayamos terminado, podemos
regenerar solo un poco de ella para que no utilicemos muchos
créditos generados. Oye, ¿sabías que las olas de
calor ahora matan a más estadounidenses cada año que huracanes, inundaciones y
tornados combinados Sí, es salvaje. Esa estadística es honestamente
un poco aterradora. He estado leyendo sobre cómo algunas ciudades están ideando estas formas realmente creativas de
lidiar con el calor extremo. La forma en que experimentamos el verano está, como, fundamentalmente cambiando. Y hoy solo nos estamos
sumergiendo en cómo las comunidades se están adaptando
realmente a estas temperaturas crecientes. Esa es una estadística
muy llamativa. Y lo que realmente me pone es que esto no es una amenaza
lejana. Está afectando a
las comunidades en estos momentos. Bien, así que ahí está nuestro
sencillo ejemplo de podcast. Volvamos
al primer menú y echemos un
vistazo a cuáles son estos. Entonces, la entrada desde URL podría
ser como una entrada de blog, algo
en el sitio web , en tus
redes sociales o algo así, y va a usar esta tecnología para hacer un
podcast que puedas escuchar. Intentaré esto con una entrada de blog tal vez y luego veré cómo
usa esa tecnología para ello. Encontraré una URL y
luego volveré enseguida. Vayamos a Wikipedia y
obtengamos un artículo muy sencillo. Buscaré tal vez
manzanas y simplemente pegaré esta URL en la barra de aquí. Entonces otra vez, puedes elegir
qué tipo de podcast. Esta vez iré con un boletín porque son
hechos sobre una manzana. Hagámoslo realmente corto. Una sola rosa puede ser mi elegir una voz diferente esta vez. Dios te ha dado una fama. Sólo una voz británica. Lenguaje. Podemos hacer inglés. Y entonces podemos ver
cómo suena eso. Bien, aquí está nuestro
podcast de Apple. Vamos a escucharlo. El extraordinario
viaje de Apple comenzó con sus ancestros salvajes centros comerciales
ciersi en Asia Central, evolucionando hacia los
centros comerciales domésticos actuales
a través de milenios Los huertos comerciales se basan en el injerto
clonal en lugar de la propagación de semillas, ya que las semillas pueden producir Este
cultivo cuidadoso ha dado lugar a más de 7,500 cultivares distintos, cada uno desarrollado para usos
específicos Entonces como pueden ver, no
voy a jugar todo el asunto. Básicamente resume
toda la página de Wikipedia y le dio un discurso más
conversacional Entonces, la forma en que esto comenzó
es que hablaba, ya
sabes, del
notable viaje, que es desde, creo, la sección de cultivo de
la sección de historia
, en realidad. Empezó desde aquí
porque sabía que vas a
necesitar algo de contexto. Entonces entró en la ascendencia, cuando fue secuenciada,
incluso el genoma, que es una sección completamente
diferente De hecho, es bastante
impresionante cómo toma pequeños fragmentos de información
de una página web completa, como Wikipedia, bastante grande, y la convierte en un podcast. Eso es bastante bueno.
Siempre hay que cambiar la voz,
agregar break, efectos de sonido, o cualquier otra cosa que quieras. Pero lo último que
queremos probar con el podcast es proyecto existente. Ahora mismo tengo cuatro
en el fondo. Todo lo que tienes que hacer es elegir
uno. Elige el formato. Voy a convertirlo en
una conversación, breve, elegir a mi anfitrión e invitado. Ella apartó su mirada de sus ruinas a Arabella y Adam Gente que está loca. Hagámoslo japonés y veamos cómo funciona el
idioma diferente. Entonces, como recuerdas, mi historia aterradora era solo yo escribiendo un
montón de frases. Agregamos algunos efectos de sonido,
pero no hubo mucho. Déjame mostrarte
muy rápido lo que teníamos. No pasan muchas frases. Voy a hacer que
se haga un podcast a partir de esto. Así que escojamos nuestra conversación de
proyecto, breve, y volveré a elegir mis
voces en japonés. Entonces aquí está nuestra
historia en japonés. Te voy a dar un adelanto, y luego lo
volveremos al inglés para que podamos ver qué tipo de
cambios hizo ElevenLabs Te muestran sakaka dee tomo Koa
Nova Mirena, kommen Kiowa,
Tata rasgó Uacho Así Tata Hola, ShotUnaako jo también. Tan buena conversación
ahí mismo, estoy asumiendo. Volvamos por aquí y hagamos
lo mismo, pero en inglés. De esa manera, sabremos
cómo es brujas. Voy a usar la versión
japonesa como mi proyecto. Mismos ajustes. Bueno, en realidad
volvamos a nuestros elegidos, hagámoslo inglés esta vez, y luego podemos comparar. Aquí está mi primero de
todo, el texto convertido. Se puede ver por nuestro
cuento que escribí, lo convirtió en
una conversación. Sigamos adelante y golpeemos
Play y veamos qué tenemos. Alguna vez te preguntaste por qué los momentos
más
aterradores del horror no son los monstruos, sino esos segundos tranquilos en los
que estás completamente solo Hay algo profundamente
inquietante en el verdadero aislamiento. Eso es exactamente lo que hace que
esta historia sea tan efectiva, el entorno de fábrica abandonado donde literalmente
nadie respira. Así que tomamos nuestra historia
muy sencilla. Voy a abrirlo
por un segundo para
mostrarte así este par de frases, solo
estoy describiendo este video, básicamente
es que hizo un
podcast basado en esta historia. Entonces estas dos personas están
hablando de nuestro personaje
perdido en el Bosque, pero puedes ver qué
gran conversación se planteó todo usando IA, y podemos cambiar entre
las diferentes frases. La función de podcast es realmente poderosa y hay mucho
que puedes hacer con ella. En los capítulos posteriores, vamos a hacer un
podcast desde cero. No te preocupes si no obtuviste mucha práctica
con esto ahora mismo. Estamos repasando las capacidades
básicas de cada una de estas herramientas para que estemos listos para esos proyectos
interactivos. Ahora, con eso concluye
la sección de estudio. Importar desde URL solo te permite poner en una
página de Wikipedia y por ejemplo, podría ser una entrada de blog,
Wikipedia, cualquier cosa, y solo va a
simplificarla para ti. Ya sea un podcast, un audiolibro, una narración, no
importa ElevenLabs
decidirá qué funciona mejor y en su lugar
te dará un audio Esto es bastante sencillo. Simplemente pega tu URL, elige tu voz,
y eso es todo. Si hubo una conversación involucrada, puedes
simplemente encender esto. Pero es una combinación de las herramientas que
ya vimos. No voy a repasar
esto ahora mismo. Eso es todo por estudio. En la siguiente lección,
vamos a repasar el doblaje, que es básicamente
donde se llega a poner un audio encima de un audio
existente para, como dice, localizar
el contenido Actualmente, hay 29 idiomas, y estoy bastante seguro en los meses siguientes, va a
haber más. Pasemos al doblaje.
16. Doblaje: Con el doblaje, puedes traducir tu clip original usando uno de los 29 idiomas
que están disponibles y básicamente decidir a
dónde van las voces en off Entonces esta es la
interfaz en estos momentos. Hay algunos tutoriales para que los veas para comenzar. Pero lo primero que
tienes que hacer es simplemente hacer clic en
Crear un nuevo doblaje Cuando hagas eso,
vas a estar haciendo un proyecto de doblaje Entonces llamaré a esto
mi doblaje de película de miedo. El idioma de origen es el idioma que tiene tu video
original, para mí, es decir, en inglés, y luego eliges
tu idioma de destino. Creo que voy a probar
algo, veamos. Hagamos español, por ejemplo, haga clic de distancia, y luego podrá poner en su fuente de audio
o video. Aparte de tu
clásico botón de subida, tenemos enlaces de YouTube, enlaces Tik Tok, otra
URL y manual. Entonces si quieres hacer manual, solo para guiarte a través de esto, este es el archivo de video. Un archivo CSV va a ser
tu archivo de transcripción. El archivo de audio de primer plano
va a ser el discurso, sea lo que sea que esté ahí dentro, y luego el fondo podría ser
un poco de música o Entonces solo
vendrías aquí si
tienes los archivos separados
para cada uno de estos. Si no lo haces, es lo
mismo que hacer todo eso
en un solo archivo aquí. Entonces subiré este video, que les
mostraré chicos en un rato. Dicen que se despertó
con sangre en los ojos, envuelta en metal y silencio. El avión se había ido.
Todos los demás se fueron. Entonces este es un video que
hice con Runway AI, que es otra herramienta, como
mencioné en la lección
anterior Pero esta vez
viene con audio. Y como escuchaste,
está en inglés. Entonces quiero convertir
este audio en inglés y tener un doblaje en español en la parte superior Y este video está disponible para que ustedes los descarguen
en el paquete de recursos. Así que vamos a seguir adelante y
subirlo aquí mismo. Puedes previsualizarlo una vez más. Dicen que ella. Entonces cuando te desplazas hacia abajo, puedes eliminarlo para ponerlo en otro o simplemente continuar. Si creas el proyecto de
doblaje, vas a poder obtener una línea de tiempo donde ajustes
los diferentes audios Definitivamente enciende esto a menos que tengas un proyecto muy
sencillo, y es como una cosa plug and play donde
no necesitas editar ninguno. Número de altavoces,
puede detectarlo por ti, pero puedes asegurarte de que lo hace correctamente
eligiendo uno de los números. Solo tengo un altavoz,
así que estoy eligiendo uno, y luego el
rango de tiempo para
doblarlo por mí, va a ser
lo completo. 02 53 segundos deshabilitó la clonación de voz,
enciéndalo para que
no haga una
voz idéntica. Eso es. Acabas de presionar Crear Dup, va a subirlo, y ahora lo va a
convertir al español. Es usar las herramientas del patio de recreo y algo de más
audio al español, manteniendo el tono natural, el estado de ánimo y todas esas cosas. Voy a dejar
correr esto y luego
volveré para que podamos
ver lo que tenemos. Como pueden ver, ya está hecho, simplemente
puedo hacer clic en él
y pasar a mi proyecto. Como recordarás, habilitamos el proyecto de doblaje y
por eso tenemos esta opción Si no lo habilita, no
verá esta interfaz. Entonces aquí está el audio
transcrito. Se puede ver el
texto, y sí coincide con lo que escuchamos
en el propio video. Entonces no tengo
mucha información, mucho audio en este video. Fueron como 53
segundos, creo. Pero enseguida, podemos ver que separaba la música de
fondo,
la música de primer plano,
y luego el orador Entonces ahora mismo,
no voy a hacer nada y simplemente
jugarlo para ustedes chicos. Dicen que se
despertó con sangre en los
ojos envuelta en metal. Entonces puedes ver que sigue siendo
el video original, y lo que puedes hacer aquí es
jugar con los diferentes
audios que extrajo, agregar algo, eliminarlo y hacer un montón de cosas Pero antes de meterme en
eso, primero echemos un
vistazo a esta interfaz y
veamos qué está pasando. En la parte superior izquierda, tenemos la transcripción
del audio, como puedes ver, también
puedes hacer click sobre este para que lo
rehaga por ti Eso es todo para esta
sección aquí mismo. A la derecha está la vista previa
del video real. Si muevo mi cabeza lectora, se
puede ver que
voy de ida y vuelta, y eso está sincronizado con
la transcripción Hablando de la línea de tiempo,
tenemos capas. Estas son tres
capas ahora mismo, pero si no hay nada ahí, eso significa que aquí no hay música de
primer plano Esta es la
música de fondo sola, y este es el
orador que habla. Se puede ver aquí el orador
no dice nada, pero la música sigue sonando. Escuchemos lo que suena. No vacío. Cada paso. Ya ves que dice
algo, hace una pausa, lo vuelve a decir, pero todavía
había música
reproduciendo en la parte de atrás Por aquí están los
nombres de las capas, y puedes cambiar el nombre, no por fondo y primer plano,
sino por tus ponentes Si tienes varios oradores, puedes darles un
nombre y esto
mantendrá las cosas mucho
más organizadas. A esto le puedo llamar Jake. Está etiquetado como original porque todavía
estamos en nuestro video
original. Todo lo que hagas se va
a guardar automáticamente, así que no te preocupes por que
no haya cambios seguros. A la derecha,
solo puedes habilitar esa capa. Si hago clic en fondo, se
puede ver que
califica el primer plano y Jake Cuando le pego a Play, a
pesar de que estoy en esta parte, no
estoy recibiendo ningún discurso. Hagamos lo mismo
con el audio de Jake. Y los árboles. Ella
caminó durante horas. Es sólo nuestro orador. Se puede ver
lo limpio que separaba a los dos. Yo sólo le di un video. Por un lado, puedes
eliminar el altavoz y agregar uno nuevo. Puedes usar esto para
recorrer tu línea de tiempo. En la parte superior derecha, tenemos cuántos segundos has transcurrido. Tenemos el selecto, que
le permite seleccionar cosas. Tenemos el ribete si
quisieras recortar algo. Voy a seleccionar
el fondo, golpear el icono de tijera, y luego se puede ver que
ahora tengo dos secciones
del mismo audio Ve a pulsar Comando o
Control Z para deshacer eso. Ese es solo uno en este extremo, tenemos agregar clip para que puedas sumar diferentes
videos si quieres. No voy a hacer eso,
pero si quisieras,
puedes decidir a dónde va, puedes decidir a dónde va, tal vez aquí y luego
tal vez convertir esto en
un Saffx o algo así Nos meteremos en eso más tarde. Para eliminar, solo
selecciónala y pulsa Retroceso
en tu teclado Ahora, con cada
uno de los audios, tienes la opción de
cambiar el volumen Así es
como suena ahora mismo. Solo resaltemos
la música de fondo. Ahora volvamos y
reduzcamos el volumen. Apenas podemos oírlo. Si ves que algo
es demasiado alto, tienes la opción de ajustar. Todo bien. Esa es
la interfaz básica. Por aquí, puedes cambiar
el nombre de tu proyecto de
doblaje Abajo, puedes ver
cuántos créditos tienes, y aquí es donde ocurre todo
el doblaje Tienes el original,
que es el clip original. Si vas a la versión
en español, vamos a conseguir a
Jake en español. Así es como está traduciendo el audio original a
la versión en español Veamos cómo suena eso. Pulgadas Esperto consangre
L o Sojos y bueno t. vamos a
aumentar en realidad el audio
para la música de fondo DenchesEsperto, consangren Los Sojos y
Welt metal es IlensioEabon,
Able Zaparsdo, Todos
Los mas, desaparzidos,
solo Aga, Ilosarbos, caminodor
teoras, Talves dilas, lb así que no hablo español, pero si lo haces, puedes ver cómo tradujo estas consangren Los Sojos y
Welt metal es IlensioEabon,
Able Zaparsdo, Todos
Los mas, desaparzidos,
solo Aga, Ilosarbos, caminodor
teoras, Talves dilas, lb así que no hablo español, pero si lo haces, puedes ver cómo tradujo estas palabra por palabra. consangren Los Sojos y
Welt metal es IlensioEabon,
Able Zaparsdo, Todos
Los mas, desaparzidos,
solo Aga, Ilosarbos, caminodor
teoras, Talves dilas, lb así que no hablo español, pero si lo haces, puedes ver cómo tradujo estas palabra por palabra. consangren Los Sojos y
Welt metal es IlensioEabon,
Able Zaparsdo, Todos
Los mas, desaparzidos,
solo Aga, Ilosarbos, caminodor
teoras, Talves dilas, lb así que no hablo español, pero si lo haces, puedes ver cómo tradujo estas palabra por palabra. Si por alguna razón
viste que le
falta algo o
no se tradujo bien, tienes la opción de
cambiar las cosas aquí arriba. Yo podría simplemente borrar esa palabra, por ejemplo, y
citar otra cosa. Cuando hago eso, puedo volver a pulsar
Generar audio. Si vas a Jake Spanish, ahí está este ícono de engranaje, y aquí es donde puedes
elegir la voz y los ajustes familiares con los que hemos estado trabajando hasta ahora. Primero, si vas a la voz, puedes elegir a alguien aquí. A ver. No es un clon. He cruzado la esperanza. De hecho, busquemos español. Sé ambicioso en tus metas y
diligente en la voz amateur. Vamos a, um, tratar de
hacer, como, un macho. Que mi voz esté bien,
esto es bastante bueno. Vamos a agregarlo a nuestras voces para
que podamos acceder fácilmente a él. Elige nuestro modelo. Voy a ir con lo
recomendado y luego si queremos, podemos cambiar estos deslizadores Sólo voy a mantenerlo
por defecto y luego cerrar esto. Ese es el control
que tienes sobre la voz, y luego puedes
agregar aún más idiomas. Si quieres hacer un doblaje en español, un doblaje japonés, puedes hacerlo
fácilmente Hagamos un doblaje japonés. Va a
procesarlo todo. De inmediato, podemos ver
la versión japonesa. Eso se ve bastante bien. Metales lensoabon Able
Así que eso es en español. Sentémonos quietos y obtengamos el, ya
sabes,
audio generado para japonés. Gabe, KinsoCtoks en su marite Mesa metato, Yareto
. Él co Así que yo uso esa nueva voz. Creo que elegimos a Christopher. Por eso suena
un poco diferente. Ahora, eres capaz de crear
una voz a partir de la selección
o generar audio. Estos son los entornos familiares. Voy a ver si puedo
extender esto un poco. Ese es un volumen de
tu clip original. Si agarras algo como esto, el idioma en el que
estás actualmente, solo
puedes crear una voz
a partir de esta selección. Entonces si hago eso, vamos
a darle como Paul. Como nombre, crear. Ahora, cualquier ajuste que hice a este clip en particular se convierte en un modelo de voz que podría usar con otras herramientas
dentro de ElevenLabs Al igual que como
tenemos estas voces, acabo de hacer una llamada Paul, voy a ver si puedo acceder a
ella desde aquí. Ahí vamos. Ahí está mi Paul que acabo hacer y puedes crear tantos
como quieras. Ahora, para los ajustes de voz, puedes heredar los ajustes de
pista, que es lo que hagas en la pista se va
a aplicar Si deshabilitas esto,
puedes hacer lo que
estábamos haciendo en este
ícono de skeer pero por aquí Escogiendo tu voz, tu modelo, y luego configurando la
voz con estos deslizadores. Ahora, también eres capaz de
dictarlo tú mismo y seguirá la
forma en que
lo estás leyendo para ajustar esa voz Pero también puedes
tener tu propia voz reproduciendo sobre esto si quieres, y eso se hace
con este botón. Este clip es de tan solo 20 segundos. Por eso lo vemos aquí mismo. Mientras que
el clip toda la película, llamémosla, es
un poco más larga. Bien. Entonces aquí abajo, tenemos un montón de otras cosas. El primero es agregar la pista de altavoz
doblada. Podría agregar un orador diferente. Se puede ver que tenemos otro. Agrega la pista de voz en off, que puedes hacer con
el texto a voz, por
ejemplo, así, vamos No tengo ningún audio en
este momento, la fuente, así que podría poner algo, algo así,
vamos a generar. Ahora porque estoy en
japonés es en japonés. Uy. Solo resaltemos esto. H, estoy perdido. Este es el original, pero
podemos hacer la versión japonesa. Lo estiré, pero es muy corto. Va a golpear Generar
audio otra vez. Myota. Ahí está nuestro corto, Oh, estoy perdido en japonés. Puede hacer que ambos
jueguen al mismo tiempo. Si quisieras, vamos a
moverlas. Ho, estoy perdido. Myota. Podría simplemente cambiar entre idiomas
e ir a partir de ahí. Se puede extender así para
que sea un poco más lento. Suena como un
monstruo en este momento, pero cuanto más apretadas sean
estas barras, más natural
va a sonar. L. Así que lo hago muy pequeño, va a ser súper rápido. Lyota. Después hemos
agregado SFX Track, que son tus efectos de sonido, que ya
sabemos usar Cuando golpeas Plus,
vas a obtener una nueva capa, y todo lo que realmente tienes que
hacer es antes
que nada es habilitar el
efecto de sonido, bajar. Primero
hagamos un espacio para ello y describamos nuestro sonido. Hagamos un loro. Generar el audio. Está mostrando el SFX en inglés y japonés,
pero es lo mismo Ese es nuestro loro.
Podemos alterarlo. No obtenemos diferentes
samples como
solemos hacer con el panel de efectos de
sonido, pero si no te gusta esto, puedes presionar regenerar justo en parte superior o eliminarlo con
retroceso y empezar También puedes hacer uno más largo, un efecto de sonido más largo. Hagamos llover o
simplemente lluvias fuertes tal vez. Generar audio. La
razón por la que ves tanto inglés como japonés es porque eso va a ser
copiado en todos estos tipos. No sé cómo
suena eso a lluvia fuerte, pero entiendes el punto. Sólo hay que
ser muy específico. Tratemos de hacer fuertes
lluvias cayendo sobre Stone Road con truenos
al fondo. Algo más específico.
Y ahí vamos. A veces, tienes que hacer
el prompt un poco más largo. Entonces podría ajustar el volumen como hicimos
con los otros. Y cuando tengo todo en juego, esto se vuelve realmente importante. Así que déjame
repasar, ya sabes, esta sección donde estamos
obteniendo un montón de cosas. Mechintakega, Nokotta
Kano JawanAnjiKamo, Aukiso, Ariwa Nanihim. Entonces ya ves como esto
tiene que ser mucho menor porque tenemos a
nuestro hablante negativo 27. Amo, Arakio. En realidad tenemos que
alterar el japonés. Amo Aukisok Ariwa
NanihimKamo Shini ahora podemos Puedes ir a la versión
en español o pegarte al original. Lo último que puedes
hacer es subir audio. Puedes subir tus
propios efectos de sonido, tus propias voces en off o
cualquier otra cosa que quieras Si hiciste un audio
con una herramienta diferente, puedes exportarlo e
importarlo aquí mismo. Música existente, efectos de sonido, fondos y
todo eso. Ahora, ten en cuenta que no se detectarán los
altavoces. La única manera de
traer altavoces
es a través de la
forma original que hicimos, y de esa manera,
ElevenLabs está utilizando la tecnología correcta para hacer todo
este proceso de doblaje Bien, una vez que hayas terminado, digamos que este es mi proyecto
finalizado, puedes golpear
Exportar aquí abajo, exportarlo en el
idioma que quieras, los que hiciste
aquí abajo como la salida
que quieras Puedes hacer el video y
el audio, solo el audio,
solo el pie de foto, transcribir, un archivo zip, cualquier cosa
que funcione mejor para ti Entonces vamos a darle a X, y
eso es todo con la herramienta de doblaje Puede parecer complicado cuando
entras aquí por primera vez, pero es bastante intuitivo
cuando lo miras. Tienes diferentes sonidos
en diferentes capas, diferentes idiomas
bien organizados aquí
abajo. Conseguí un avance. Puedes alterar el texto, y es una herramienta bastante práctica. Ahora que nos
enteramos de esta nueva herramienta, podemos pasar a la
siguiente y ver qué otras características tiene para
ofrecer ElevenLabs
17. Habla a texto: Speech-to-Text es
otra gran herramienta que puedes utilizar cuando se
trata Ahora, es muy preciso y va mejorando a medida que avanzamos, pero esto podría usarse para reuniones que quieras
transcribir o un archivo de audio
separado que solo
quieras convertir a un formato diferente Ahora bien, la forma en que funciona
es que tienes diferentes transcripciones por
aquí y diferentes hablantes Digamos que siempre estás usando ElevenLabs para transcribir
reuniones en Siempre hay cierto
número de personas, y conoces a todos por su nombre. Puedes agregar a esos ponentes, a esos
miembros participantes como oradores aquí, y ElevenLabs lo
marcará por Entonces, cuando pones un archivo de reunión
grabado, va a identificar a
los oradores y luego marcarlo por ti en
el archivo de transcripción. Entonces eso es
algo realmente genial que haga, y puedes comenzar haciendo
clic en transcribir archivo Esto podría ser cosas diferentes. Podría ser algo que
subas desde tu computadora. Podrías grabar algo
tú mismo ahora mismo. Puedes poner una
URL de YouTube o cualquier otra URL. Puedes tener el idioma
dicho aquí mismo,
tantas opciones, desplázate hacia abajo y elige el
idioma de tu elección. Y también puedes hacer que 11 laboratorios escriban
los eventos de audio. Y la forma en que lo está
describiendo es que si alguien se
ríe en ese audio, se va a poner risas. Si alguien está llorando, se
va a poner llorando, y eso va a ser
incluido en el expediente final. Si quisieras
ignorar esas cosas, puedes simplemente apagar esto. Pero es una
característica bastante genial que tiene. Ahora, el archivo que
vas a obtener también puede incluir un subtítulo Digamos que quieres
transcribir un audio y
luego usarlo para tu video En lugar de volver a
poner eso para un archivo de
subtítulos diferente, puedes hacer que todo
se haga de una sola Eso es algo aparte
que puedes encender. Y esta característica va a eliminar todo lo
que sea un sonido de relleno. Entonces, si alguien está tosiendo, si hay una pausa, cualquier ums, ya sabes, estas voces
van a ser eliminadas, y 11 laboratorios pueden
ignorarlas y no incluirlas en el expediente final Ahora, también tenemos los
ponentes asignados de biblioteca. Estos son estos ponentes
que van a
aparecer desde la pestaña que
vimos antes. Entonces, si enciendo esto,
actualmente no tengo a nadie guardado, pero vamos a
ver cómo se ve
eso una vez que agreguemos algunos oradores. Tenemos algunos términos clave. Por último, tenemos términos clave. Digamos que estás trabajando en un proyecto muy importante y
quieres 11 laboratorios para
asegurarte de que no
falte nada con la palabra proyecto
o algo específico. Puede agregar esos
términos clave aquí mismo, y 11 laboratorios
tomarán especial precaución para poner en negrita esos artículos
y no los perderán. Entonces, si no pones estos aquí, puede
que falten un par de cosas cuando hablen de
ese término potenciado Pero eso es sólo si
tienes un término potenciado. Si no necesitas
poner nada aquí. Salgamos de esto y echemos un vistazo a cómo se ve el
orador. Vamos a ir
allí en el altavoz, darles un nombre, ID de altavoz y una muestra de audio. Entonces esta muestra es cómo ElevenLabs
va a detectar quién está hablando y
lo etiquetará con su nombre en
el archivo transcrito Lo que vamos a hacer
es primero conseguir un audio. Para ello, voy
a usar este video. De esta manera todos podemos
tomar el mismo clip, pero siéntete libre de poner tus
propios archivos de audio también. Debido a que somos capaces de
poner enlaces de YouTube, podemos fácilmente simplemente tomar
la URL aquí mismo, copiarla y pegarla aquí mismo. Así que solo cámbiate a YouTube. Pasado, y sólo vamos
a cambiar algunas cosas. Entonces esto es en inglés, pero si lo dejas detectar, lo hará,
ya sabes, por sí solo. Podría encender
o apagar esto como dijimos. Sólo voy a apagarlo. Digamos, solo quiero
obtener un resumen rápido de lo que sucedió
durante esta reunión, y solo quiero eliminar
cualquier cosa que sea innecesaria. Ahora, podemos agregar los términos
clave aquí mismo. Sólo voy a echar un vistazo. Creo que aquí vamos a
hablar de reuniones. He escuchado a algunas de mis
mentes hablar lo difícil que es
levantarse de la cama los viernes Así que sólo vamos a
centrarnos en el término clave de la oferta. Digamos, eso es algo
muy importante para mí. Sólo voy a
poner esto justo aquí. Y si le das al Inter,
puedes agregar más términos clave. Voy a saltar todo
el camino hasta el final. Consigamos otro término clave.
¿Te encuentras con él? Es mucho con lo que lidiar para la secundaria así que la
secundaria Voy a poner
eso también. Bien, entonces vamos a
empezar a transcribir esto. Solo dura un minuto
sin ningún orador asignado. Y luego te voy
a enseñar como
hacer el final del orador también. Entonces, hagamos clic en esto y hagamos
que funcione en este archivo. Ahora, si quieres y tienes ciertas personas en mente
que quieres guardar, puedes usar la
función de altavoz aquí mismo. Agregue esas personas en,
y esas estarán poco en negrita a lo largo
del archivo transcrito Y de esa manera, ya sabes, cuando
tienes una reunión con 20 personas, puedes
filtrar fácilmente y
averiguar lo que dijo John Smith
durante esa reunión. Lo único que
vas a necesitar es una muestra de
su voz sola. Ahora, porque esta
es una URL de YouTube, realmente no
puedo, ya sabes,
poner todo el asunto. Pero si tienes en mente a esa
persona, solo
puedes poner en
su audio solo. Entonces eso es todo. Echemos un
vistazo a cómo se
ve el archivo transcrito. Entonces ahí vamos. Tenemos a nuestros oradores
listados como oradores, pero ahora podemos cambiar
sus nombres y luego
guardarlos en la biblioteca. Entonces puedes comenzar
con los altavoces guardados o guardarlos de
un video como este. El primero que
descubrimos su nombre es Mara. Acabo de desplazarme hacia abajo en este video y alguien lo
tiene todo transcrito Así que sólo voy a
copiar eso una vez y, ya
sabes, cambiar las cosas
por defecto aquí mismo. Entonces tenemos nuestro primer orador, y creo que este
es el mismo, así que solo voy a, ya
sabes, dar clic en él, e inmediatamente
sí lo actualizo por mi. El primer orador es
el siguiente orador, estoy asumiendo que es esta persona. Oh, en realidad estamos
recibiendo algunas señales, así que las gafas son f.
Sólo voy a cambiar estos nombres para que podamos
guardarlos en la biblioteca Entonces orador dos, ¿quién es este tipo? Solo salta un
poco aquí para averiguarlo. Entonces esa es ella. Estoy
asumiendo que es esta persona. Sólo vamos a poner
eso como orador dos. Bien, haga clic de distancia
Ponente tres. Entonces esta persona debe ser Thomas, y luego tenemos a Matthew. Y podemos ver que 11 laboratorios
sí detectaron a cinco personas. Es bastante exacto en este momento, y ahora tengo estos
altavoces guardados. Ahora, podría agregar un altavoz, decir que se olvidó de agregar a alguien, pero normalmente cuando
el audio es
claro, no hace eso, pero por si acaso puedes entrar. Y si por alguna razón los
oradores se mezclaron, puedes agarrar los bordes aquí
mismo y decidir o tal vez fijar la duración
del discurso de cada persona. Entonces eso es todo.
Sólo voy a deshacer lo que hice haciendo clic
en ese botón. Ahora, en cada uno de estos tipos, podemos cambiar su orden, pero estas órdenes se
basan en el flujo normal del video. Entonces, a menos que esté mal, realmente no
necesitas cambiarlos. También podemos cambiar el
color del icono. Si quieres, sólo
para diferenciarlos. Y aquí es donde llegamos a agregarlos a la biblioteca de oradores. Así podría darles un nombre. Y ahora que tiene la
muestra del video, solo
necesito
darle una identificación y un nombre. Entonces solo voy a
copiar el nombre de esta persona y luego ponerlo aquí mismo. Entonces la próxima vez que tenga otro archivo de reunión con
esta persona hablando, va a reconocer
que es Maha, y lo sostendrá
en una interfaz como. Bien, así que vamos
a revisar todo el texto. También hay una función de revisión
ortográfica aquí si no
quieres, ya
sabes,
leer todo. Pero echemos un
vistazo a lo que hay de este lado. Entonces antes que nada, es
el nombre de este archivo, este archivo de audio, que
es sólo el nombre UT BRL. Voy a dejarlo así. El idioma es el inglés. No agregué ningún subtítulo, pero si
quisiera, podría simplemente, ya
sabes, eso y voy a conseguir un archivo de subtítulos por separado Entonces eso es algo que puedes
explorar si es necesario. Tenemos un corrector ortográfico. Yo hago clic en él, va
a pasar por cada palabra en inglés y hacerte saber
si hay algún error. Agradecidamente, no
tenemos ninguno de esos, así que podría simplemente colapsar esto A continuación, tenemos las propiedades
del segmento. Entonces esto de aquí mismo
es el segmento, la duración, la hora
y hora de inicio, y eso es sobre. Entonces, si todo se ve bien, todo lo que tienes que hacer es
pasar a
exportarlo o copiarlo al portapapeles si solo lo estás
pegando en un Google Pero hacer clic en Exportar
suele ser el camino a seguir. Voy a hacer click en
PDF solo para que sea, ya
sabes, preciso
y fácil de compartir. Por aquí, puedes
agregar timestamps. Entonces en este segundo,
esta persona dijo esto, y ahora también podemos incluir los nombres de los oradores porque sí
cambiamos cada uno. Haga clic en Descargar, y ahora tenemos nosotros mismos un
archivo transcrito. Ahí vamos. Primer orador, segundo
orador, tercero, y
me está diciendo la duración, el final de ese segmento, el inicio de ese segmento
y, por supuesto, lo
que están diciendo. Si hay una pausa, la
va a descomponer
en múltiples segmentos. Entonces técnicamente, los
primeros segundos del video, solo Mo está hablando. Pero debido a que hizo una pausa
durante su discurso, ahora
hay dos segmentos De vuelta aquí, puedes simplemente compartirlo directamente en ElevenLabs
y no ancargar que puedas buscar personas
en tu equipo de ElevenLabs y, ya
sabes, crear un Digamos que estás trabajando con diferentes editores
y quieres, ya
sabes, asegurarte de que
todo esté bien para salir. Esta es una característica genial para eso. Volviendo a la página, debería tener un orador guardado en mi biblioteca,
y ahí vamos. que pueda tener el
altavoz para su uso posterior, y si quisiera eliminarlo, simplemente podría hacer click sobre esto aquí. Ahora, aparte de la característica clásica de
voz a texto, también
tenemos un modelo en tiempo real que todavía está en el modo demo, pero aún podemos darle Básicamente, puedes tener 11 laboratorios que detecten el idioma y solo hablen con
él en tiempo real. Entonces esto podría estar entre un montón de gente
que está hablando. Va a ser todo transcripción
en tiempo real. Entonces cuando haga clic en transcribir, vamos a darle algún permiso, y vamos a tener 11
vueltas echarle un vistazo a lo que me
refiero y
anotarlo justo aquí en frente se puede ver que
esto es bastante exacto Y solo para verificar
todo el reclamo multilingüe, podemos cambiar entre idiomas. Ahora podría cambiar
a, digamos, turco y decir, Mava, también
lo va a escribir así Pero una vez que hayas
terminado de transcribir, puedes hacer clic en
este botón y yo podría copiarlo
a donde quiera A lo mejor no quiero pasar
mucho tiempo escribiendo. Solo lo diré en
mi micrófono, lo copiaré, lo pondré en Slack o en
cualquier otra plataforma. Esa es la característica del escriba. Así que adelante y pruébalo con esto. Es una característica muy divertida
que tiene ElevenLabs. Este también es realmente genial, sobre todo si puedes cambiar
a diferentes idiomas. Aunque actualmente no
soporta todos los idiomas. Si el que hablas
está dentro de esta lista, siéntete libre de probarlo
y ver cómo funciona.
18. Herramientas de producción: Ahora, repasemos
producciones con ElevenLabs. De inmediato, en el lado izquierdo, puedes ver que está
etiquetado con Alpha, lo que significa que vas
a necesitar actualizar u obtener ese plan específico para
poder usar producciones. Entonces, como dije antes, no
voy a
profundizar demasiado en cómo usar esto porque se trata de herramientas editadas por
humanos. Y en este curso,
estamos tratando de enfocarnos en el aspecto de IA de ElevenLabs Por lo que de inmediato, se pueden ver los servicios que brindan. Tenemos transcripciones, subtítulos,
subtítulos y doblaje. Estos chicos están llegando pronto, pero básicamente lo
que hacemos e hicimos con IA ahora lo están
haciendo profesionales. Así que piensa si fueras
a Fiber para obtener un archivo
transcripto, ahora
puedes hacerlo
dentro de 11 laboratorios Como dijimos antes, si
ves que las
herramientas de IA simplemente no están funcionando bien para ti y este es un proyecto de muy alta calidad, puedes cambiar a los servicios de producción para conseguir algo mucho
más profesional. Como puedes ver, sí
te cobran adicionalmente, $2 por minuto y
los precios cambian. Pero vamos a seguir adelante en la transcripción y te voy a
mostrar un poco Cuando haces clic en él, es la
misma interfaz que la de IA. Subes tu archivo. Es revisado por
los hablantes nativos. Elige tu idioma aquí mismo, dale un nombre, y luego incluso
puedes agregar un estilo personalizado. Cualquier instrucción, por ejemplo, realmente enfatiza la
palabra temperatura dentro esta transcripción o agrega emociones ahí dentro,
algo así. También podemos agregar los
sonidos que no son palabras como tos
o ladridos de perros Si quieres deshacerte
de esa instrucción, sólo
tienes que hacer clic en eliminar. Es bastante sencillo. El resto de las tres
cosas aquí arriba no están disponibles ahora mismo en el momento en que estoy
haciendo este curso. Pero lo que tienen es
que puedes decirles qué servicios quieres para subtítulos y te
avisarán cuando esté listo Simplemente llene esto y
luego hable de su caso de uso. Ahora, aquí abajo,
puedes hacer una nueva producción y crear carpetas para mantener las cosas organizadas si planeas
usar esta herramienta muy a menudo. Cuando haces clic en
Nueva Producción, solo te permite hacer
la transcripción humana porque eso es
lo único que está disponible Pero más adelante, ojalá pronto puedas
hacer las otras cosas. Subtítulos, un humano estará
escribiendo tus subtítulos,
subtítulos, otro humano te
estará haciendo subtítulos
para diferentes idiomas Serían los hablantes ideales dentro de ese idioma objetivo. Después doblando,
traducirán tu trabajo y luego grabarán
la versión doblada por ti Esas son las
pestañas de producción justo por aquí. Si vas a Herramientas de audio, hay algunas
cosas más que puedes hacer. Por ejemplo, Audio nativo. Este es de nuevo con una suscripción
diferente. Si, por ejemplo,
tienes un blog o un sitio web de noticias donde
publicas muchos textos, te gustaría que tu
sitio web sea más accesible
al tener una
versión en audio de ese texto. Aquí es donde vendrías y si haces clic en Reproducir video, te
mostrarán un ejemplo. Por ejemplo, esta
es una noticia, y así es como funcionaría el nativo de
audio. No solo estás dejando que gente lea tu trabajo de
manera podcast, sino que para las personas
con discapacidad, tienen la opción de venir a
tu sitio web y ser uno
de tus usuarios frecuentes. Es bastante genial,
y así es como se vería la barra
si la implementaras. Eso es Audio nativo. También tenemos Voiceover Studio, que básicamente va a
combinar un montón de la herramienta Ya miramos cómo hacer efectos de
sonido y hacer voces en
off Este estudio básicamente
combina los dos. Si te desplazas hacia abajo,
tenemos una demo aquí mismo. Entonces tenemos una pista de voz y
luego podemos poner en nuestro texto. Es igual que el
estudio de doblaje pero para voces en off. Lo siguiente es el clasificador de
voz AI. Ahora bien, este es realmente genial porque puedes
ver si
este audio que estás a punto de
subir se hizo o no este audio que estás a punto usando ElevenLabs Entonces, si sospechas y solo
quieres asegurarte que la persona que te envió ese audio sea en realidad
una persona real, puedes dejar que ElevenLabs se entere
de eso por Sólo tienes que subirlo aquí. No hay mucho que puedas hacer. Lo siguiente es
la caja de resonancia, que ya
vimos anteriormente,
pero voy a entrar una vez más, te
lleva a esta URL
completamente diferente, y es básicamente
lo que hicimos donde
combinamos diferentes
sonidos por aquí, hicimos carpetas y presets, miramos algunos de los valores predeterminados
disponibles La caja de resonancia es gratuita. No es necesario que
actualice su plan. Al ir a las
suscripciones muy rápido, puedes ver las diferencias. Esta es probablemente
aquella en la que se llega a utilizar muchas de estas herramientas de
producción. Si fueras una empresa más grande, subirías a escala. Esto es en lo que estoy actualmente, que es el paquete más
popular. Pero si sentiste que
quieres usar las otras, simplemente haz clic en Actualizar
y
te va a cobrar más a la tarjeta que está
adjunta a tu cuenta. Bien. Entonces esas fueron algunas de las herramientas de producción que
solo quería mostrarte que están disponibles
y eres capaz actualizar tu plan para
usarlas cuando lo quieras. Esto concluye nuestro
segundo capítulo, que está analizando
diferentes herramientas de ElevenLabs En el siguiente capítulo, en realidad
vamos a
empezar a construir cosas
con ElevenLabs, comenzando desde proyectos básicos y luego pasando a proyectos
más avanzados Este es un buen momento
para que ustedes sigan y construyan
conmigo y de esa manera sepan exactamente cómo usar esta herramienta
para casos específicos, solucionar problemas utilizando los
conocimientos que han ganado en este capítulo y
después de este curso, ojalá puedan crear sus propios audios para sus
videos, sitios web, etcétera Ahora pasemos
al siguiente capítulo.
19. Música de ElevenLabs: Una característica reciente que
ahora ofrece ElevenLabs es
la función de música Ahora puedes describir
la canción que quieras, y la generará para ti usando diferentes referencias, y tienes tanto control que solo conseguir
una música aleatoria. Entonces aquí es donde puedes
acceder a él, e inmediatamente, tenemos este chatbot que
podríamos describir la canción Se pueden ver las plantillas
que apenas se acercan. Pero es muy similar a cualquier otra plataforma de generación de IA en el sentido de que podríamos
obtener diferentes versiones, elegir nuestro modelo,
establecer la duración, y luego por supuesto,
estamos usando algunos créditos. Aquí abajo, si te desplazas hacia abajo, puedes ver algunas muestras de la música que se
hizo en ElevenLabs Podemos echar un vistazo a
sus ritmos por minuto, descargarlos si quieres,
agregarlos a tu lista de favoritos, e incluso adaptarlo
a tu proyecto. Entonces, cuando dice adaptarse a
tu proyecto, básicamente, estás remezclando esa música para tus voces en off
,
videos, imágenes y todo eso dentro de Escuchemos algunas
de estas muestras. Entonces tenemos algunos ejemplos
instrumentales, pero también podrías tener
a alguien que cante en estas canciones. Entonces eso es algo que
te voy a mostrar también. Pero si quieres navegar
rápidamente por estas canciones y encontrar
algo para tu podcast, puedes hacer click en este, y en él se enumerarán las que más te
resulten adecuadas. Entonces lo que podría
hacer con este, digamos que mi podcast
es de 30 minutos, no de 2 minutos, es
adaptarlo a mi proyecto. Tendría que usar créditos para esto porque
alguien más hace esta canción, y luego
podría extenderla a 30 minutos. Pero también podría
hacer mis propias canciones, así que no tengo que usar, muchos más créditos, básicamente. También puede
buscar canciones similares. Los va a
enumerar para ti en función los textos que
tiene la canción y la duración. Tenemos un montón de
cosas diferentes para mirar, y todo esto está dentro
del mercado. Ahora, si no
quieres descargar nada, puedes ir a Generaciones y simplemente
describir la canción. Ahora te puede resultar un poco
intimidante porque, ya sabes, tienes que poner
las palabras clave adecuadas Pero lo bueno de
esto es que te da un pequeño ayudante aquí abajo donde generará
el prompt para ti. Entonces puedes comenzar con un prompt donde
describas la canción. También puedes poner esa
letra de la que te hablé, agrega alguna referencia si quieres. Y si no estás seguro de
cómo siquiera escribir lo que necesitas, puedes usar esta
sección aquí abajo. Los hicimos en las
lecciones anteriores con efectos de sonido, pero siguen usando
el modelo musical. Podría
editarlos aún más si quisiera, pero primero hagamos
algo aquí. Así que voy a
ponerla aquí. Quiero una canción que sea adecuada para un tronco donde
estoy explorando el bosque. Quiero que alguien cante
de fondo. Entonces vamos a mandar esto
y ahí vamos. Ahora tengo un prompt basado en
lo que ya sabe, describí. Así que es una canción para Travel
Flogs que es cierto, cuenta con guitarra
acústica con dedo escogido Tenemos algunas aves en la parte de atrás. Y aquí está la letra. Entonces obtenemos algunas,
ya sabes, aperturas, y luego estos son los versos
algunos coro y un outro Si estoy contento con
esto, podría
dejarlo ir y presionar
el botón generar, pero también podría entrar
aquí y hacer cambios. Puedes escribir directamente,
agregar algo aquí, o hacer que regenere
la letra por ti Y como ya mencioné,
podría agregar una referencia aquí. Entonces esta podría ser otra
canción que realmente te gustó, pero sólo voy a
dejar que sea así. Y aquí abajo, podemos elegir
la duración de la canción. Porque tengo algunas
letras por aquí, realmente no
puedo hacer eso
porque está predeterminada. Entonces esto es de unos
segundos para cada parte. Sólo voy a
configurarlo en Auto, que sin embargo es largo
11 vueltas determina Aquí abajo, puedes elegir
el número de variantes. Cuando añades más variantes, va a tomar más créditos. Yo sólo voy a hacer uno
por ahora y se puede ver que sólo se convierte en 900/minuto También tenemos algunas afinaciones
finas que podrías agregar, así que puedes optar por un estilo diferente
de canto si quieres. Tenemos masculino, femenino. También puedes previsualizarlos. Tener macho o hembra, y puedes agregarlos también. Voy a dejar el
mío como está, nada agregado porque esta
es una canción de muy baja estaca, y solo voy a dar
click en Generar. Entonces una vez que lo generas, viene a un lado, y
podemos verlas siendo construidas. Mientras hablamos, es un
minuto y 48 segundos. Escuchemos cómo suena. Pasos en el marte. Suavemente, suavemente, dosel verde muy por
encima de los ríos M I. Entonces esa es nuestra canción.
Si es, ya sabes, demasiado animado, podría
regresar y tal vez hacer
algunos ajustes Pero en general, se puede
ver que se
ajusta muy bien al
estilo de candado de viaje. Ahora, si te gusta
la canción y
quieres hacer más
ajustes, simplemente
puedes ir a Editar canción, y va a cargar
el proyecto por ti. Entonces el nombre de mi canción
se pierde en el viento. Se puede ver el
historial del chat. Del lado derecho, tenemos esta pequeña línea de tiempo donde
puedo jugar
con los versos. Tenemos un botón de reproducción. Podemos trabajar con las diferentes letras
y las diferentes etiquetas, agregar más cosas si queremos, tal vez queremos agregar algunos tal vez dos
minutos más de esta canción. Entonces solo lo pones en este chat aquí
mismo, hazlo más largo, y a lo mejor le agregas un segundo cantante ahí, lo que
quieras hacer. Como aquí hay un chatbot, no
necesitas hacer
un prompt perfecto Como vimos, inicialmente, ElevenLabs solo tomó mi idea y la convirtió en
un prompt decente Una vez que tengas tu canción
y estés contento con ella, puedes descargarla
en el lado derecho, o podrías publicarla
en la propia plataforma. Entonces aquí es donde la gente puede usar tu canción y luego
ganas algo. Creo que las tarifas difieren dependiendo de
cuántas hayas hecho, cuántas canciones has hecho y cuántas personas
descargan tu canción. Pero es una opción bastante genial. Simplemente puedes
jugar con estos, hacer algo de música decente y tenerla disponible para que
otras personas la descarguen. También podemos compartir esto, compartirlo como un video,
dar comentarios. Y estos son, como, diferentes segmentos de la canción, así que podríamos cortarla o hacerla más larga, lo
que sea que funcione. Como acabo de hacer un ajuste, tendríamos que
actualizar básicamente esta canción. Entonces es bastante sencillo. Sólo voy a hacer un
ligero cambio a la canción. Digamos, no quiero que
sea, ya sabes, este escalofrío, quiero hacer algo
con afinación fina, tal vez como una especie de estilo rock. Yo podría hacer eso aquí mismo. Entonces déjame deshacer
esta extensión, y vamos a
agregar una melodía fina. Vamos por el país. Ya que el rock no encajaría
realmente en este estilo, y voy a decir introducir una cantante femenina
después del curso. Entonces esa es nuestra versión
uno. Ahora vamos con una versión dos, y puedo ver que aquí
hay algunas sugerencias, así que solo voy a golpear pestaña, y eso se agregará, también. Así que vamos a poner esto de nuevo, una variación para que
no tarde demasiado, y voy a
mandar eso por
11 vueltas para actualizar mi canción Lo que tiene que hacer es
que necesita agregar más letras. Entonces aquí está mi solo vocal femenino, justo después del coro, como le pedí, y aquí
está la sección Entonces, vamos a escuchar cómo
suena. Voy a saltar a esta parte. Entonces ahora mismo, acabamos de
agregar estas cosas, pero yo solo, como,
copiaré esta parte solo
para mostrarte que puedes cambiar la
letra tú mismo. Así que volvamos al inicio, hagamos ese ajuste.
Y veamos qué tenemos. A la s vuelta a la estrella. Y ahí vamos.
Pudimos hacer una canción a partir de un prompt
o debería decir una idea? Agregamos otro cantante. Agregamos nuestras propias letras, y tuvimos esta
música country al final. Así que adelante y prueba esto, haz un montón de canciones, y sería una buena idea publicarlas en
el marketplace. Nunca se sabe cuándo alguien podría simplemente descargar
tu canción y también
ganarás algunos
créditos en el camino. Entonces, si quieres
explorar esto, simplemente haz clic en Comenzar, consigue un buen perfil, y luego tus canciones
irán al mercado. Esta es una gran característica ya que ElevenLabs también introdujo
videos e imágenes Así que ahora puedes hacer
tus locuciones, música de
fondo, el contenido, el contenido visual, leyendas y básicamente cualquier otra cosa que necesites con la generación de
contenido
20. Diseño de voz: La biblioteca de voces ofrece
tantas voces diferentes, todas muy diversas. Hay diferentes idiomas,
diferentes tonos, estilos. Pero a veces simplemente
no es el que
estás buscando. Pero, afortunadamente, ElevenLabs te
permite
crear tu propia voz
usando el diseño de voz Entonces ahora mismo estamos
en la pestaña de voces D, pero ya podemos ver todas las diferentes voces en
los diferentes idiomas. Entonces ahora mismo,
puedo entrar fácilmente, elegir una etiqueta que esté relacionada con lo que necesito y
descargar esa canción, usarla, cambiar la velocidad, el tono y, ya sabes,
hacer mi contenido. Vamos a explorar
esta función aquí mismo, que es cuando creas
tu propia voz personalizada. Y lo genial de esto es que una vez que tienes
tu propia voz, en realidad
puedes subirla al mercado donde otros pueden usar tu voz y
ganas algunas ganancias en el camino. Así que vamos a seguir adelante y hacer clic en esto y crear nuestra primera voz. Entonces, con el diseño de voz, puedes diseñar
algo completamente desde cero o podrías proporcionar
tu propia voz para un clon. Esta es la forma más rápida, pero sí tienes la opción de
clonar tu propia voz, remezclar con una
voz existente o intentar, sabes, hacer un clon más
profesional Entonces aquí, en realidad necesita 30 minutos de tu
audio
para poder hacer un clon de audio muy limpio y
profesional. Pero realmente no necesitas
hacer esto si quieres algo rápido
para tu propio uso. Entonces, exploremos el
primero. Diseño de voz. Y obtenemos esta caja donde
llegamos a describir la voz. Entonces básicamente, puedes dejarme
extender esto un poco. Habla sobre el género, la edad, el tono de la voz, para
qué necesitas la voz. A veces eso ayuda. Como si dices que
quieres voz ASMR, va a hacer
que
sea un poco susurrante Para que también puedas explorar eso. Y aquí abajo, podemos obtener algunas indicaciones aleatorias
para comenzar Entonces, si hago clic en
esto, vamos a conseguir una voz femenina aguda Haga clic de nuevo, una mujer mayor
con acento sureño, y podrá ver cómo
las indicaciones difieren en la longitud No necesariamente tiene que
seguir una plantilla. Simplemente puedes poner
lo que quieras y conseguir una buena voz
para empezar. Si haces clic en la configuración, podemos trabajar con la sonoridad de la voz
y la escala de orientación Entonces, la
escala de orientación es lo cerca esta nueva voz va
a seguir el prompt. Quieres que algo
sea básicamente muy controlado
en base a tu prompt, lo aumentarás a alto. Pero si quieres que 11
laboratorios sean un poco creativos con la forma en que
interpreta tu prompt, puedes mantenerlo en el lado bajo Yo recomendaría mantenerlo en
algún lugar en el medio
solo para comenzar. Y una vez que tengas esa voz, puedes editarla a cualquiera de los lados. Entonces, en lugar
de usar una de estas plantillas, solo
vamos a
describir nuestro prompt, que
así ustedes
puedan seguir adelante, y todos podamos hacer una sola
voz para comenzar. Entonces lo que voy a hacer es tratar de hacer voz
para un presentador de noticias. Y voy por una voz
femenina, tal vez de mediana edad, confiada,
voz seria apta para las noticias. Y sólo voy a
describirlo aquí mismo. Entonces una voz
femenina de mediana edad confiada para propósitos de
presentadora de noticias, podemos decir que habla muy claro. Entonces aquí está mi aviso.
Muy sencillo. Yo solo
escribí básicamente lo que necesito. Ahora, del lado derecho,
podemos trabajar con el sonoridad. No queremos que esté
demasiado callada o demasiado ruidosa, así que podemos ir por tal vez 60%. Y en cuanto a la escala de orientación, sí
quiero que tenga en cuenta
estos términos clave. Entonces simplemente voy a aumentar
la escala de orientación a 60, también, porque no
quiero, como, un presentador de noticias muy emocionado. Quiero a alguien que
tenga confianza mayor y alguien que pueda relacionar muy bien
la noticia. Entonces, ¿un confiado para un senior? Pongamos eso. Y también
podemos mencionar el
acento, si quieres. Entonces acento americano,
inglés. Esto es opcional. Puedes dejar eso fuera y luego ver qué
hace ElevenLabs para Entonces, una vez que
terminemos, podemos ver que nos
va a costar 350 créditos. Podemos generar la
voz y luego hacer ajustes después de que se
haya generado. Buenas noches a todos.
Esta noche, les traemos los últimos avances
sobre las perspectivas económicas, tras el reciente anuncio de la
Reserva Federal. Nuestro equipo ha estado siguiendo de cerca la reacción del
mercado. Esa es la primera variante. Como puedes ver,
es realmente bueno, apto para retransmitir noticias Veamos las
otras dos variantes. Buenas noches a todos.
Esta noche, les traemos los
últimos desarrollos sobre las perspectivas económicas. Buenas noches a todos.
Esta noche, les traemos los últimos desarrollos
sobre las perspectivas económicas. Entonces iré con el primero. Buenas noches a
todos. Sólo porque es un poco más fuerte y
un poco más claro Ahora bien, la parte de aclarar la
garganta es en realidad una adición interesante porque los presentadores de
noticias suelen estar en vivo, y eso puede suceder, así que incluso pude ver
cómo suena eso Y una vez que esté contento con ello, podría seleccionar la voz. Pero si sentías
que es, ya sabes, demasiado rápido, demasiado alto, puedes hacer un ajuste aquí y luego volver a generar
la voz Entonces sólo voy a
seleccionar la voz uno. Ahora vamos a
darle un nombre. Entonces llamémosla María, usemos Anchor, y luego
podríamos etiquetarla. Entonces el idioma es el inglés. De esta manera, podría usarse
para organizar tus voces, pero también podría usarse cuando gente intenta
descargar tu voz. Entonces, cuantas más etiquetas tengas, más fácil será para ellos encontrar tu voz y descargarla. Entonces acento podemos
poner lo que tenemos género femenino. Y ahí vamos. Tengo cuatro etiquetas que
ayudarán a la gente a encontrar la
voz y para mi propio uso. Podría cambiar esto si quiero, pero creo que el prompt
es un buen indicador. Entonces, vamos a guardar esta voz. Y ahora se
agregará a mi biblioteca. Entonces con esta nueva voz, podemos o
generar este discurso. Así que voy a
escribir algo. Esta será la voz
que se utilizará. Podría crear un
agente con esta voz, o podría tenerla,
narrar una historia Entonces, los audiolibros son algo que vamos a ver
en las lecciones posteriores, pero así es como
puedes usar tu voz Estos son solo algunos ejemplos. Por supuesto, hay estudio
y otras cosas aquí abajo, incluso doblando ahora
cuando voy a voces, a mis voces, María está justo aquí Entonces podría usar esto
para texto a voz, que me narre un libro, cambie la voz si quiero
y usarlo para diferentes propósitos Entonces lo que podemos hacer
es simplemente hacer clic en usar voz y hacer un pequeño
guión aquí mismo. Déjame elegir primero a María. Va a hacer V tres para
un estilo muy natural. Voy a agarrar un segmento de noticias de
muestra solo para que ella pueda usar la
redacción correcta y el estilo correcto, y solo vamos a
pegar esto aquí mismo. Así que sólo voy
a pegar eso en. Tenemos algo muy sencillo. No voy a usar etiquetas de audio
solo porque la voz que generamos debería
seguir ese estilo de presentador de noticias de todos modos. Pero si quieres, puedes poner
diferentes
etiquetas de audio como risas, toser, ya sabes,
lo que quieras Pero ahora sólo vamos
a generar ese discurso. Si quieres,
puedes mejorar aún más el párrafo con etiquetas de audio, pero solo voy a ver cómo se ve
esto por sí solo. El viernes pasado, alumnos de Escuela Primaria
Sunshine plantaron Oh, así que sí tenemos el efecto
de audio del
café de la lección anterior. Cortemos eso
y regeneremos eso. El viernes pasado, alumnos de la Escuela Primaria
Sunshine plantaron 20 árboles jóvenes en
el huerto escolar para mantener el ambiente
limpio, verde y fresco. El viernes pasado, alumnos de Escuela Primaria
Sunshine plantaron 20 árboles jóvenes en
el huerto escolar. Entonces, como pueden ver,
eso es realmente bueno para mi aplicación.
Ella tiene confianza. Ella es muy clara
con lo que dice, y puedes
usar fácilmente las voces que generes usando esta sección. Otras cosas que podrías
hacer es clonar tu propia voz, y eso va a ser algo que veremos
en la siguiente lección. Pero ahora echemos un
vistazo a la remezcla de voz. Pero vamos a entrar en este tipo, y primero podríamos agregar
una referencia de voz. Entonces solo voy a
agregar a María aquí mismo, y vamos a
transformarla en un estilo diferente. Entonces digamos que quiero
hacerla británica, y de hecho cambiemos también
el género,
así que dos cosas al mismo tiempo. Entonces convierte esta voz en macho británico de
mediana edad. Aquí podemos mirar en
la pronta fuerza. Entonces, cuánto
altera el prompt la voz original. Lo voy a mantener medio porque eso es exactamente
lo que estoy haciendo, el acento y el género. Podría conseguir algo de inspiración. También hay una guía si no
estás seguro de qué hacer, e incluso podrías
darle un script para que puedas ver la aplicación
completa. Entonces voy a pegar el mismo segmento de
noticias que
vimos antes. Voy a guardar eso aquí mismo, y vamos a mandar esto. El viernes pasado, alumnos de la Escuela Primaria
Sunshine plantaron 20 árboles jóvenes en
el huerto escolar para mantener el ambiente
limpio, verde y fresco. El viernes pasado, alumnos de Escuela Primaria
Sunshine plantaron 20 árboles jóvenes El viernes pasado, alumnos de la Escuela
Primaria Sunshine plantaron 20 árboles jóvenes en el huerto escolar para mantener limpio
el ambiente. Entonces, estas fueron tres muestras. Siento que parecía
un poco más joven. Estaba pidiendo un británico de
mediana edad. Entonces digamos generar más, y voy a aumentar
la fuerza pronta. Entonces, en realidad hagámoslo aquí. Generar también puedes
usar estos como referencia, combinarlo con María, pero primero voy a trabajar con
la era de la nueva voz. Escuela Primaria Sunshine plantó 20 árboles jóvenes en
el huerto escolar. El viernes pasado, alumnos de la Escuela Primaria
Sunshine. El viernes pasado, alumnos de Escuela Primaria
Sunshine plantaron 20 árboles jóvenes en el huerto de la escuela para así que
esto es bastante bueno. Ahora puedo guardar esto como una
voz, lo mismo. Simplemente le pones un nombre, le das algunas etiquetas y una descripción. Entonces esto se agregará
a tu biblioteca de voz. Y de esta manera, podrías tener diferentes variaciones
de tu primera voz, y es realmente buena para
diferentes tipos de contenido. Entonces digamos que tengo una noticia, quiero probar con una presentadora
femenina y una presentadora masculina y luego
finalmente tomar mi decisión. Entonces esto es
algo bastante fácil que podrías hacer. Podrías hacer otro
remix aquí mismo, darle un guión diferente, tal vez elegir una de las voces principales y
ver qué sale. Adelante, pruébalo y ve qué tipo de voces
puedes generar.
21. Clonación de voz: Lo siguiente que vamos
a hacer es clonar nuestra voz. Así que así como estoy
hablando en este micrófono momento y todas estas
voces están disponibles, en realidad
podemos tener nuestra voz, la misma voz que estás escuchando
sea una de estas opciones. Entonces, cuando hago texto-a-voz, puedo hacer que lea Como yo. Enseguida en voces, hay dos formas de acceder a esto. número uno está golpeando
el plus
aquí mismo y luego clon de voz
instantáneo, o podrías pasar
a esta cosa azul. Si haces clic en él, es
exactamente lo mismo. No importa en
qué dirección vayas. Y ya
miramos a éste, ahora vamos a
bajar a esto. Esta es una manera realmente sencilla de
crear tu propia voz. Si pieza de audio para
la que
no quieres grabar todo, puedes considerar
clonar tu voz. Ahora, diré que
este no es exactamente el reemplazo perfecto para tu propia grabación de voz
porque como sabemos con la IA, es inconsistente y
si planeas
hacerlo profesionalmente, posible
que quieras encontrar
una mejor alternativa. Pero no obstante,
es algo genial de hacer. Y todo lo que te pide
es un audio de diez segundos. Necesitas hablar durante diez
segundos en un micrófono, asegurarte de que no haya ruido alrededor y que tu voz
sea cristalina. Di todo con voz lenta y clara,
no apresures nada. Y de esa manera las 11 vueltas podrán estudiar tu voz y
luego replicarla. Todo lo que tienes que hacer
es golpear grabar audio. Elige el micrófono y hará una cuenta regresiva de tres segundos y
podrás empezar a leer Diré una frase realmente
aleatoria. No tiene que ser
los 10 segundos completos, esa es solo la cantidad ideal. Voy a empezar a
hablar del clima. Últimamente, ha estado muy caliente y he planeado no
salir con tanta frecuencia. Prefiero sentarme en casa
y relajarme todo el día. Entonces 10 segundos de audio. Yo hice 11, pero está bien.
Aquí está tu grabación. Si quieres hacer otro, puedes simplemente presionar
eliminar y reemplazarlo. Aquí puedes escuchar
cómo suenas. Últimamente, ha estado muy caliente y he planeado no
salir con tanta frecuencia. Prefiero sentarme en casa
y relajarme todo el día. Entonces ahí lo tenemos.
Hay una opción para que ElevenLabs elimine
el ruido de fondo Voy a desactivar eso
porque no tenía ninguno, pero si sientes que tu
audio sí, solo enciéndalo. Ahora está listo y sólo
tengo que dar click en siguiente. Ahora llego a poner alguna
información respecto a mi voz. Puedes previsualizar la
voz aquí mismo. Los aviones se elevan por el cielo a
medida que las hojas de otoño bajan a la deriva Así
interpretaron mi voz 11 laboratorios .
Vamos a darle un nombre. Llámalo Mi voz.
Entonces una vez más, tenemos que agregar etiquetas. Estoy hablando inglés. Y entonces podemos
darle una descripción. Mi voz casual. A continuación, solo tienes que confirmar
que esta es tu voz. Hablamos de esto
en la lección de ética. No replicar la voz
ajena, sobre todo no sin
su consentimiento por escrito Pero esta es mi voz,
así que tengo todos los derechos sobre ella y sólo
voy a darle click, guardar la voz. Y ahí vamos. Ahora tenemos la opción de
probar nuestra voz. Hemos generado voz
con texto a voz, hablamos con tu propio clon, donde podemos crear un agente de IA
conversacional, y luego tenemos esa función de doblaje Yo sólo voy a
golpear Skip por ahora porque ya sabemos
dónde están las herramientas. Ahí está mi voz. También puedes
ir a mis voces,
y debería ser lo
primero, cero días. Podría comenzar a usar
la voz haciendo clic en ese icono y comenzar a
escribir algo. El modelo que recomienda, solo
puedes usar eso y luego voy a dejar
todo por defecto. Apaguemos esto y
generemos la voz. Qué día tan maravilloso. Podemos hacerlo más lento,
menos inestable. Y agrega algo de exageración. Qué día tan maravilloso. Esa es mi voz ahí mismo. No lo dije, suena exactamente como mi voz ya
que estoy hablando ahora mismo. Es sólo una
cosa divertida que puedes hacer. No los vería
usando esto profesionalmente de ninguna
manera, pero creo que cuanto más
trabajen con sus modelos, mejor
va a ser esta característica. Así es como puedes
clonar tu voz. Es realmente sencillo. Si querías cambiar o borrar tu voz,
sólo tienes que ir a voces, mis voces, y luego
borrar. Y ahí vamos. Ahora, ya no
tenemos más clones. Ahora que sabemos clonar
y diseñar nuestros propios audios, sigamos adelante y
comencemos
un proyecto de principio a fin donde tomamos una página web y la
convertimos en un podcast Los veré ahí, chicos.
22. Podcast de miedo Parte 1: Ahora vamos a iniciar
nuestro primer proyecto. Sabemos usar las herramientas. Ahora es el momento de ponerlo
en un audio masivo. Con este primer proyecto,
vamos a hacer un podcast de historia aterradora
donde tomamos una página web, convertimos en un podcast y luego tenemos a tres personas
en ese podcast. Tenemos un anfitrión y dos invitados. Lo que primero
vamos a hacer es encontrar esa página web que tiene esa
historia que estamos buscando. Yo sólo voy a ir a
Internet y solo
ir a Wikipedia. Por lo general, tienen páginas muy
largas y detalladas respecto a un determinado incidente, cierto objeto o lo que sea. Voy a buscar uno de
desastre natural porque esos
se pueden convertir muy bien en diferentes emociones, miedo y todas esas cosas. Vayamos a Wikipedia. Puedes usar cualquier otro sitio web, solo asegúrate de
tener los derechos para usarlo. Buscaré un tornado. Entonces enseguida,
tenemos algunos ejemplos. Éste en 2007. Podemos buscar otros
, incluso éste. Creo que voy a ir con
esto sumamente poderoso. Sólo voy a
asegurarme de que
haya mucha
información al respecto. Tenemos comparación con otros
tornados que es bueno, las secuelas, la significación,
el daño, así que es perfecto Solo voy a copiar esta URL, y vamos a ir a
Go Studio e importar desde URL. Pegemos nuestro
podcast aterrador y escojamos una voz conversacional natural ya que vamos
por un podcast Lovell, confíe en unos pocos,
haga mal a ninguno. Hacemos nuestras propias fortunas
y las llamamos destino. Nicht Debido a daraufin como. Hola, y bienvenidos.
Toma un café, acomódate y relájate. Y
platiquemos sobre esto. La gratitud es queja de riquezas. Una sola rosa puede ser mi jardín, una sola amiga mi mundo. Hacemos nuestras propias fortunas
y nivelamos, confiamos en unos pocos. Creo que me está gustando
Charlie por ahora, así que sólo voy a dar
click sobre su nombre. este momento, ni siquiera tenemos
múltiples voces en la URL, así que esto no nos va a
ser útil. Sólo voy a hacer que Charlie sea primero la voz de
este podcast. Una vez que estemos contentos con
la forma en que suena y la forma en que
se extrae el podcast, se puede ver de
inmediato, son 17 minutos. Si tienes un texto más largo,
va a ser más largo. Por aquí, se
trata de convertir esta mesa en algo
conversacional Voy a hacer que
Chad GBT solo
saque los números y deje
fuera los detalles para esto Como puedes ver, quitó
todos estos números y solo conservó algo
que es más natural. Guardaba las fechas, el número de las millas
y todas esas cosas. Puedes hacer esto y refinar
más si no quieres ningún número en esta sección o quieres
sacar ciertas palabras. Sólo voy a copiar
esto y ponerlo en 11 laboratorios por aquí. Aquí habla este tornado y luego
habla de los otros cuatro. Bien. Se puede ver
que también tiene los títulos de la página de
Wikipedia, pero sí queremos que suene
un poco más normal. Agreguemos en pocas palabras. La razón por la que
estamos cambiando de texto
normal a un encabezado
es porque va a enfatizarlo y leerlo de
una manera en la que nos estamos moviendo
a una nueva sección. Va a haber
pausas, y normalmente, va a ser un poco
más lento que como lee el
otro texto normal Ahora, tal como
aprendimos antes, podrías agregar las pausas
y los efectos de sonido, pero por ahora solo concéntrate
en finalizar tu texto Si quieres,
podrías volver a Chat JBT y
pedir más insumos, tal vez diferentes reacciones
a lo que Charlie está diciendo Por ahora, sólo
voy a finalizar lo que dice
Charlie y se genere. Si bien eso está generando,
vamos a darle un nombre a esto. Yo mando A y luego
genero una vez más. Hablemos del
tornado de El 2007 y sus secuelas. El tornado de 2007 fue
un tornado pequeño pero extremadamente
poderoso y errático que ocurrió en Canadá durante las
horas de la tarde del viernes 22 de junio de 2007, poderoso
tornado Cinco que azotó el pueblo de Eli en la provincia
canadiense de Manitoba, 40 kilómetros al oeste de Winnipeg, fue conocido por su inusual trayectoria, cómo fue durante su trayectoria,
su cuerda que ocurrió en Canadá
durante las
horas de la tarde del viernes 22 de
junio de 2007, el
poderoso
tornado Cinco que azotó
el pueblo de Eli en la provincia
canadiense de Manitoba, a
40 kilómetros al oeste de Winnipeg,
fue conocido por su inusual trayectoria,
cómo fue durante su trayectoria,
su cuerda a estructura de cono, a diferencia de una estructura de cuña,
y cómo es única. Pero, ¿cuáles fueron las sinopsis
meteorológicas? Bien. Observe cómo hizo una pausa entre el
texto normal y los encabezados. Yo hice la partida dos, pero tú también
puedes hacer encabezamiento uno. Cualquiera de estos encabezamientos sí significa
que la voz tiene que hacer una pausa y enfatizar el movimiento a un segmento diferente
del podcast Empecemos desde aquí
ya que aquí es donde lo
tomamos de Taji BT y
veamos lo normal que suena ¿Había más?
Sí, los hubo. Además del tornado cinco de
Eli F, cuatro tornados más
también afectaron Canadá del 22 al 23 de junio Después de que el histórico
tornado F five golpeara a Eli, Manitoba, otro poderoso
tornado tocó solo 10 millas al oeste
cerca de Oakville el 22 de junio Calificado F tres, este tornado
dañó árboles, dependencias y un par de contenedores de
almacenamiento de granos a lo largo ahora que la información base
está a mi gusto, ahora
puedo llevar esto de vuelta al sombrero TPT para que sea un
poco más humano Se va a agregar en ms, pausas, tal vez algo de tartamudeo, cualquier cosa que haga de esto
como un Porque ahora mismo solo
tomó la información de esta página web y la
convirtió en voz. Pero como
vamos por un podcast, queremos comenzar
con una base fuerte, y una vez que tengamos
las partes de Charlie puestas correctamente, podemos agregar los otros dos invitados. Tomemos todo esto, luego volvamos a nuestro chat y
primero describamos el escenario, luego peguemos un texto. Bien, voy a dejar que esto
corra y como puedes ver, es asumiendo que quieres que
este sea el guión, pero en realidad no necesitamos
esa capacidad en este momento. Cuando termine de construir esto, voy a tener que quitar estos segmentos para que sea
solo el texto por sí solo. Pero no
parece que vaya a generar más. A ver. Pero de inmediato, puedes
ver que está agregando las palabras,
los tres puntos,
guiones, y sí
enfatiza en ciertas palabras, igual que un podcast normal Se hace con la conversión,
y como se puede ver, no se agregaron más
de estos segmentos, así que no necesitamos
regenerar nada. Vamos a copiar este texto corporal. Y reemplazarlo con
lo que tenemos aquí. Ahora vamos a usar los diferentes encabezados
sobre los lugares donde queremos que Charlie haga una pausa Este es un comienzo
definitivamente así. Aquí hay otro segmento. Bien, entonces tenemos dos segmentos aquí sin contar el comienzo. Sigamos adelante y
golpeemos Comando o Control A, y golpeemos regenerar. Bien, entonces hablemos del tornado
de Eli 2007 y
¿qué pasó después? Esto no fue un tornado cualquiera. Quiero decir, este fue el primer tornado
oficial de
Canadá en la historia del F five. Y sí, podría
haber sido pequeño, pero era
ridículamente poderoso Y, honestamente, simplemente
hacia arriba raro. Golpeó a Ely Manitoba, un pequeño pueblo tranquilo a unos
40 kilómetros al oeste de Winnipeg en la noche
del 22 de junio de Ahora, aquí está la parte espeluznante. Este tornado no
siguió las reglas habituales. Tenía esta extraña forma de
cuerda, no la enorme cuña que
esperarías de
algo tan fuerte, y se movía lentamente, como extrañamente lento. Se retorció. Pasemos a
esta última frase. El daño total estimado en alrededor de 39 millones de dólares en ese entonces, que hoy superarían los
56 millones de dólares Entonces, ¿qué hizo que ese
día fuera tan volátil? Bueno, meteorológicamente hablando, la configuración era como un caos de
libros de texto Un sistema de baja presión se trasladó
desde Saskatchewan, y un frente cálido
se estacionó al norte de Y si, las cosas explotaron. Ahora bien, esto es lo
que pasó en el suelo. El tornado
tocó justo al norte de lo realmente importante para
usar esas palabras del encabezado, y esa es la
oportunidad perfecta para que agregues algo de música ahí con una
pausa o algunos efectos de sonido. Pero aparte de eso, se
puede ver cómo usar HGBT fue capaz de agregarle
ese toque humano Hace una pausa en ciertos momentos, pero siéntete libre de mover estas palabras a otros lugares o simplemente eliminarlas por completo. Pero dado que esto es
un podcast y estamos tratando de que esto suene como Charlie es solo
tu tipo promedio, esto funciona perfectamente
para nuestro caso. Entonces ahora que tenemos la parte de
Charlie hecha, vamos a pasar a
sumar a nuestros otros dos invitados. Entonces eso es algo que
tendríamos que ver con una herramienta diferente. Y eso será para
la siguiente lección.
23. Podcast de miedo Parte 2: Entonces ahora tenemos algo en nuestro estudio que llamamos
representar nuestro podcast Nativo. Anteriormente tomamos una página de
Wikipedia y convertimos en un
podcast usando JAGPT Ahora, podrías
confiar plenamente en solo 11 laboratorios para esto para convertir esa página de
Wikipedia en un podcast. No obstante, para mi caso, sí
quería que tuvieran
a nuestro anfitrión, que es Charlie Charlie
para tener más pausas, algunas ms, algunas s ahí solo para que
suene más humano Pero eres totalmente
libre de ni siquiera usar JAGPT y solo confiar en 11 vueltas Entonces ahora vamos a pasar
de aquí para crear un podcast. inmediato, se puede ver que podemos utilizar proyecto existente. Ahora, también
tuviste la opción poner aquí tu página de Wikipedia. No obstante, quería empezar
de cero para que veas la progresión y cómo puedes poner tus propios
ajustes a medida que avanzamos. Vayamos a usar Proyecto Existente y elegimos nuestro podcast tornado. Queremos mantenerlo
conversacional. Vamos a guardarlo un poco más
porque fueron 17 minutos. Nuestro anfitrión sigue siendo Chris, pero tenemos un
invitado en este momento. Entonces decidamos
quién es nuestro invitado. Ella apartó la mirada
de su calzado arruinado, todavía muy
afligido por la pérdida Busquemos conversacional
Hay un Nadal encendido. Si pasas toda tu vida. Entonces iré con Jessica. Se puede ver
que tiene esa etiqueta conversacional en ella, así que es perfecta Y entonces el idioma
está en inglés. Si quieres tener
algún tipo de enfoque, puedes poner en las palabras. Entonces pongamos la palabra
tornado. Déjame ver. Destacemos los peligros de una pausa tornado
en los números, supongo, números de daño. Acabo de darle a ElevenLabs
dos instrucciones a seguir. Puedes ver comenzar
con algún orden de clasificación, resaltar, pausar y luego
decirle qué hacer exactamente. Puedes agregar tantos de
estos como quieras como
vimos anteriormente o eliminar
los que ya no necesites. Guarda los cambios y
deja que se genere. Voy a dejar correr esto
ya que es un poco más largo. Se puede ver que generó
otro proyecto aquí. Así que una vez que esté hecho,
volveré para que podamos escuchar
lo que suena. Bien, nuestro podcast está listo. Son 10 minutos, 24 segundos. recortó a partir de
los 17 minutos, y eso es principalmente porque
acortó los párrafos. Como pueden ver, no
hay ninguno de esos párrafos voluminosos
que teníamos antes Eso solo demuestra lo increíble es
esta conversión de podcast dentro de 11 vueltas. Y
mira por aquí. Incluso nos di un título genial, el inesperado F five, un tornado sorprendente poder, pesar de que lo teníamos llamado podcast tornado
o algo así. Cuando pongo el cursor sobre ellos, puedo ver quién
dice qué verde es Chris y el azul es Jessica Entonces, sin cambiar nada, escuchemos lo que estos
dos tienen que decir. Los tornados a menudo se miden
en millas de destrucción. Pero en 2007, el tornado
más poderoso de Canadá jamás registrado era apenas
más ancho que una carretera de un carril, y reescribió todo lo que
creíamos saber
sobre estas tormentas Bueno, eso es
fascinante. ¿Cómo hace algo tan estrecho
empaca tanta potencia? ¿Sabes qué es lo que realmente
me molesta de esto? Este tornado F five
que golpeó a Eli, Manitoba tenía apenas 35 yardas de
ancho en su punto más fuerte, pero literalmente recogió casas
enteras y las hizo girar
por el aire como juguetes Agárrate. F cinco. Esa es la
calificación más alta posible, ¿verdad? Entonces eso fue un pequeño adelantamiento. No voy a hacer que
escuches todo el asunto. Pero si quisieras
saltarte, recuerda que hay
una línea de tiempo aquí abajo que podrías simplemente
poner la
cabeza de tu plato y luego saltar a tal vez Chris o Jessica
cuando quisieras. Aquí, todo está
en el texto regular. Puedes ver el
atributo aquí mismo, pero podríamos cambiar
la forma en que lo leen cambiando algunas cosas a
encabezados. Entonces vamos a ver. Entonces aquí está nuestra transición
que tuvimos inicialmente. Se puede ver que como
que lo cambió. Al principio, fue como, pero
¿qué pasa con los daños? Ahora lo convirtieron en,
entonces, ¿de qué tipo de
daño estamos
hablando aquí con ese tipo
de destrucción enfocada? Entonces cambiemos esto a encabezado uno y luego
busquemos otro. Esto es sobre el daño. Bien, solo voy
a mantener estos dos como nuestras transiciones clave y luego
simplemente regenerar esta parte Bueno, no te
equivocas. En un momento, simplemente
se estacionó sobre el molino harinero del pueblo durante
cuatro minutos seguidos. Solo imagínese ver un
tornado rondando en su lugar, destruyendo
metódicamente
todo lo Entonces, ¿de qué tipo de daño
estamos hablando aquí? ¿Con ese tipo de destrucción
enfocada? Déjame pintarte un cuadro, y aquí es donde los números se
vuelven realmente asombrosos El daño total se estimó
en 39 millones de dólares en 2.007 dólares,
que hoy superarían los
56 millones de dólares Pero aquí está la parte más
increíble. Ni una sola persona murió. Espera, ¿qué? ¿Cómo es eso incluso
posible con un F cinco? Entonces hicimos una pausa con
el encabezado tal como lo hizo con la
primera herramienta que usamos. Y solo olvidé
mencionar que sí le pedimos a ElevenLabs que
resaltara los daños Para que puedas ver cómo
tiene múltiples oraciones. Teníamos uno aquí. Aquí hay
otro. Daños. A ver. Más daños. Se trata de reiterar la parte
de daño del podcast en numerosas ocasiones Podrías volver atrás y
convertirlo en
otra cosa y realmente hacer tuyo
este podcast. Yo sí tengo todas estas palabras. Lo que sí quiero hacer es quizás agregar aún más pausas entre estos dos encabezados solo para que sea realmente una transición
completa Agreguemos una pausa
aquí mismo, 1 segundo, y luego otra
o un segundo más. Y luego otra cosa que
quiero hacer es hacer una intro para Chris y Jessica y luego
traer a nuestra tercera persona Mencionamos tener un
anfitrión y dos invitados. Así que vamos a golpear al Inter
aquí mismo. Hola a todos. Yo soy tu anfitrión. Chris. Y esto es que
voy a usar el título aquí. Bien. Entonces mencionemos a Jessica y luego
busquemos otra voz. Las olas se estrellaron. Creo que Alexis es buena, así que digamos Jessica y
Alexis y después hagamos que cada uno de
ellos se presente. Todo bien. Entonces tengo
cuatro nuevas frases o líneas, debería decir, y esto simplemente
lo hace mucho más natural considerando que sí
tenemos tres personas
en este podcast. Ahora todo lo que tienes que
hacer es asignar cada una de estas frases a sus líneas. Alexis es esta línea en realidad. Cuando lo repaso, pude
ver que no es Alexis, así que sólo voy a
hacer click una vez sobre esto. Nuestras voces están justo aquí. Accidentalmente trajimos a
Archer, pero eso está bien. Convirtamos esto en Chris. Aplica este a Jessica. Ese ya es Alexis, y esto es de vuelta para
Chris. El resto es Chris. Aquí está Jessica reaccionando. Pasemos esto a Alexis. Tan solo vamos y venimos hasta que tengamos una
conversación en curso. Al ver como Chris es el anfitrión, todas estas líneas donde hay mucha información
sobre los tornados, lo estoy asignando a Jessica y Alexis apenas están reaccionando a lo que dice
porque ellos son los invitados. Vamos dos de ellos,
Alexis esta vez y no tener una transición rutinaria. Bien, entonces tenemos un buen ida y
vuelta
entre nuestros sujetos, y ahora estamos listos para
agregar algún efecto de sonido. Cuando está presentando
el podcast, sí
queremos que se reproduzca un audio
antes que él, y tal vez en los encabezados, poner algún tipo de efecto de sonido, tal vez una
pausa comercial en el medio Algo que hará que
esto funcione como un podcast. Eso lo vamos a hacer
en la siguiente lección. Solo asegúrate de que
al final de esta lección, estés contento con las palabras que tiene cada uno de los invitados. Incluso podrías agregar más
gente a este podcast. Sólo voy a
guardarlo a las tres. Pero repasa cada una de las palabras, asegúrate de que sí pertenezcan
a esa persona que quieres. Y no tienes a una
persona al azar en tu podcast. Cuando le quité a Archer, se
puede ver que ya no está aquí y yo sólo
tengo tres personas Si ves otra voz aquí, significa
que
en algún lugar de tu podcast, sí
asignaste esa
voz a cierto texto. Aquí abajo, de nuevo, se puede
ver una transición colorida. Si viste que hay
demasiados greens espalda con espalda, entonces eso está asignado para apagarlo con
una voz diferente. Pasemos a la
siguiente lección donde agregamos nuestro audio y solo
terminemos este podcast aterrador.
24. Podcast de miedo Parte 3: Finalicemos
nuestro podcast de miedo y agreguemos algunos efectos de sonido Anteriormente, tomamos
una página de Wikipedia, convertimos en un podcast
conversacional, luego la trajimos aquí donde
agregamos otras dos voces Todo lo que hice ahora mismo fue poner las pausas después de los encabezamientos, pero puedes agregar más
pausas donde quieras Incluso entre las oraciones,
eres libre de hacer eso. Ahora, lo que voy a hacer es hacer una intro para este podcast. Entonces justo antes hola a todos, voy a poner en
el efecto de sonido. Hagamos un tornado Bien. A mí me gusta la primera
duración más sabia, vamos a hacer una más corta. Hola a todos. Golpear aplicar. Entonces después de todos,
voy a agregar una pausa, es la intro esencialmente Entonces por aquí, podemos agregar,
veamos, ya sea un rollo de batería o un efecto de sonido de página siguiente. Vamos a hacer eso.
Al voltear la página. Bien. Y en cuanto a
la duración, una vez más, voy
a hacer un poco de ella y no
toda la oración. Me gusta el número tres
más y solo
asegúrate de mantener esto en
el lado bajo ya que no
queremos que vaya por encima nuestro Cris básicamente. Todo bien. Y entonces lo que
vamos a hacer es ajustar un poco las voces. El de Jessica es un
poco exagerado, así que voy a
bajar la estabilidad Lo siento, aumenta
la estabilidad y solo haz que su tono sea
un poco más lento. Es seguro. Alexis estaba bien, así que no hay necesidad de
hacer nada con ella. Chris, sí quiero que su voz
sea un poco más lenta también. S guardar y voy a buscar
otros lugares para agregar una pausa. Bien, entonces agregamos
nuestro efecto de sonido. Lo que voy a
hacer ahora es tener una pequeña sección de esto generada para que ustedes no tengan que
escuchar todo el asunto. Hagamos esta una parte donde
tuvimos el efecto de sonido, la pausa, y por supuesto, podemos ver cómo suenan
las voces después de
que hicimos nuestros ajustes. Hola a todos. Soy
tu presentador Chris, y este es el
inesperado F five, el podcast que informa sobre
los tornados
F five más peligrosos del mundo Estoy aquí con nuestros dos
invitados, Jessica y Alexis. Oigan, chicos, soy Jessica, y estoy muy feliz de estar
aquí, y soy Alexis. Tan emocionado de platicar con ustedes
sobre estos eventos espeluznantes. Bien, vamos a
meternos en ello, entonces, chicos. Empezando por lo que sabemos de los tornados.
Los tornados suelen ser Bien, entonces eso
suena mucho mejor. Siento que quiero cambiar
a Alexis. Parece un
poco demasiado robótico. Entonces lo que voy a hacer
es ir a esta parte o parte y encontrar otra
voz, básicamente. Busquemos
conversacional y encontremos una voz femenina que suene, ya
sabes, mucho más normal En el océano de la competencia,
sé un pez veloz. El tesoro de las alturas del océano. Él arriba el tuyo. Solo
confía en ti mismo. No hay mayor. Creo que Area suena bien aquí, así que cambiemos a Alexis
por Area. Entonces veamos. Todo lo que tenemos que hacer es simplemente agarrar esta parte y hacer clic
en Aplicar con Área. Y luego repita por
el resto de la cosa. Voy a probar
otra generación para ustedes ya que
agregamos un flip de página aquí. Comienza con Chris.
Apliquemos Área por aquí. Una vez más, sí quiero una voz
lenta y firme. Hagamos eso, es seguro, y luego hazlo aquí. Creo que voy a cambiar esto a Jessica así que hay
algo de variedad. Bien, vamos a agarrar toda
esta parte, generar, y
escuchar otro segmento. ¿De qué tipo de daño
estamos hablando aquí? Con ese tipo de destrucción
enfocada, déjame pintarte un cuadro. Y aquí es donde los números se
vuelven realmente asombrosos. El daño total se estimó
en 39 millones de dólares en 2.007 dólares,
que hoy superarían los
56 millones de dólares Pero aquí está la parte más
increíble. Ni una sola persona murió. Espera. ¿Qué? ¿Cómo es eso incluso
posible con un F cinco? Ya sabes, esa es la
verdadera historia aquí. Se trata de reunión de preparación. Pero antes de entrar en
eso, permítanme
desglosar exactamente lo que
hizo que este día fuera tan perfecto para
la formación de tornados porque es fascinante desde el punto de vista
meteorológico Hmm. Me imagino que
múltiples factores tuvieron que unirse de la manera correcta. Oh, mejor que lo creas. Teníamos este
sistema de baja presión moviéndose desde las temperaturas de Saskatchewan
en los altos 20 grados centígrados. Eso es alrededor de 80 Fahrenheit. Y niveles de humedad que
harían que una selva tropical se sintiera seca. Bien, y eso está
sonando mucho mejor. El volteo de página que
siento que tiene que ser
movido un poco, así que podría
agarrarlo aquí abajo y
moverlo hasta el final, tal vez aquí. Después de que ella dice la palabra
destrucción, volteo de página. Entonces solo seguiría alterando el resto de mi podcast, asegurándome de agregar las
pausas donde lo necesite, y luego ajustando
más mis voces si no están
leyendo algo bien Pero para mi caso, lo
leyeron todo bien. No necesitaba hacer
muchos ajustes sobre mi aterrador podcast. Y ahora básicamente terminamos. Tomamos una página de Wikipedia y la
convertimos en un podcast. Lo que podría hacer es simplemente
exportarlo como un solo archivo, p tres, y luego solo
escucharlo cuando quiera. Esta también es una buena manera de
tomar artículos que son
demasiado largos y luego simplemente convertirlos en un podcast para
que puedas
escucharlo cuando estés caminando
o estés en transporte. Con eso concluye nuestro
primer proyecto. El siguiente proyecto,
vamos a tratar de hacer un tipo diferente de generación de voz
usando las mismas herramientas, pero en cuanto a la aplicación,
será para algo que no
sea un podcast.
Los veré ahí, chicos.
25. Audiolibro parte 1: Ahora vamos a pasar
a un proyecto diferente, que será hacer un
audiolibro desde cero. Lo que primero
vamos a hacer es conseguir ese libro que estamos tratando de
convertir en un audiolibro Estoy empezando aquí en ChachPT, pero esto sería
suponer si
ya tienes un
libro que tienes derecho a convertir en audiolibro o que
tienes tus Solo por el bien de la práctica y para ustedes
tengan algo de experiencia práctica, vamos a utilizar esta herramienta para hacer un libro con ciertas
palabras e indicaciones Abre Chat GPT y primero decide de qué
va a ser tu libro Hay que conocer el tema, qué tipo de libro es, cuánto tiempo es y quién
es como los personajes. Una cosa que podrías hacer
si no sabes por dónde
empezar es que Chat JBT te
dé algunas ideas sobre
lo que debes convertir en
un libro al principio Por ejemplo, si tienes un canal de YouTube donde
hablas mucho de bienes raíces, puedes venir a Chat GPT y
dar un prompt como este Entro, y luego vamos
a recibir algunas sugerencias. A partir de ahí, llegamos
a continuar. Lo interesante
es que Chat Tu
But te dará el
título y luego nos
dice por qué funciona y algunos
detalles dentro de ese libro. Tenemos lo que no te
enseñan en la escuela
desde renta hasta riquezas,
civilizado, diario de bienes raíces, y todas esas cosas Lo que también podrías hacer es
combinar estas ideas en un libro grande o tal vez simplemente
sacar algunas de estas viñetas y
reemplazarlas por otra cosa. A ver. Creo que me gusta la guía de supervivencia de House
hunter. Ese nombre es bastante bueno para mí. Diré que me gusta el número uno. Sin embargo, elimine la parte del cuestionario. Y reemplazarlo con vamos a
ver qué podemos reemplazarlo con la cotización jerga
inmobiliaria Aquí acabo de hacer un pequeño cambio y ahora
me está dando más detalles. ¿Quiénes son los asistentes? Para algunos compradores, inquilinos, navegadores
inmobiliarios. Si ya
tienes tu canal, solo verifica dos veces que esta
sea efectivamente tu audiencia. Si no lo es,
puedes cambiarlo. Por ejemplo,
diré que mi audiencia incluye a adultos de mediana edad
a jóvenes. Rango de edad, puedo poner 50, tal vez 25 a 40, veamos. Entonces este es solo un rango de edad
aleatorio. Los que viven en California, Los Ángeles, California, los
que no tienen hijos y perros. Me estoy volviendo más específico
con respecto a este libro. Este es nuestro público
y veamos. A lo mejor podemos agregar una cosa más. Y trabajar en la industria
de la moda. Aquí hay un fragmento genial que
hace, el tono y la vibra. Piensa en un amigo con estilo
que ya compró un lugar y te está guiando
a través de él sobre Macha Lenguaje agudo pero casual, charla
real sobre dinero, referencias al diseño de moda
y peculiaridades específicas de Los Ángeles Entonces este es el capítulo. Hay diez capítulos,
lo cual es bueno. Y ahora que
parece que este va
a ser un buen libro, voy a especificar
desde qué punto de vista se escribe este o si no hay ningún
carácter en absoluto. Entonces, por último, ¿
cuánto dura este libro? Digamos, en términos de
quién de quién es el punto de vista de
este libro, creo que esta persona, agudo un lenguaje casual es bueno. Pero podemos hacer que el
narrador use éste. Pero conviértelos en un agente inmobiliario bien
informado que sepa mucho de
esta audiencia en particular. Entonces dame sólo
tres capítulos, por un total de 50 páginas Haz de esta una
lectura rápida y divertida para mi audiencia. Entonces esta será una página
completamente diferente y aquí capítulos de Armour. Como puedes ver, me está dando viñetas y
podrías quedarte con esa idea. Puedes ver que nos está dando un fragmento, un resumen o Lo que quiero hacer es convertir estas viñetas
en párrafos. Cerremos esto muy rápido, vuelve aquí y pide una versión
completa. Esto es bueno. Dame la
versión completa en párrafos. Entonces lo cortaré aún más. Así que voy a dejar
correr esto y luego volveré para mostrarte cómo es nuestro
guión. Entonces si necesitamos
hacer algún cambio, podemos hacerlo antes
de pasar a ElevenLabs Bien. Entonces aquí está
mi libro ahora mismo. No es tanto tiempo,
lo cual es perfecto. Pero como puede ver, pasó de viñetas a párrafos
reales. Ahora, ten en cuenta
que sí quieres que este sea un audiolibro, así que asegúrate de que el tuyo
tenga las indicaciones para capítulos y cualquier
otra cosa que quieras poner Podrías tener viñetas, pero yo recomendaría
ponerlo entre párrafos para que sea un audiolibro
más natural. Y ese es el
nombre de nuestro libro. En la siguiente lección,
vamos a poner esto en ElevenLabs y comenzar emparejar ese audio para que encaje perfectamente con este tono y para nuestro público que son
personas que buscan un tipo nobs
para
comprar su primera Pasemos a
la siguiente lección.
26. Audiolibro parte 2: Bien. Ahora que
tenemos nuestro libro, simplemente
voy a copiar
todo desde aquí. Creo que todo
esto es el libro, así que solo puedes presionar
copy aquí mismo. Ve al estudio y
crea un audiolibro. Por lo que subir un
documento es opcional. También podemos copiar y pegar. Entonces no hagamos nada aquí, sino repasemos qué
voz queremos usar. Entonces busquemos narrativas
y veamos qué tenemos. Ella apartó su mirada de su arruinado Dios te ha
dado un hecho. Deja que mi voz se convierta en tu voz. La gente a la que me he
cruzado. Deja que mi voz sea. Entonces, como, supongo, para mí,
lo principal es, como, no
entiendo por qué la
gente tiene que enojarse. Es como Theresa Se
desgarró la marcha. Neto. Soy Sophie Lang. Hola y bienvenidos.
Toma un café, acomódete. Iré con este tipo
que no usamos en el último proyecto solo
para darle una oportunidad, y luego podremos darle a Create. Entonces nos traen a esta página que también podrías entrar con
el estudio, pero simplemente
vamos a pegar lo que obtuvimos de Chat
GPT en esta caja Entonces fíjese aquí
tenemos más capítulo. Tenemos tres capítulos. Entonces vamos a golpear el capítulo
Plus aquí y copiar el Capítulo
dos y más allá. Eliminarlo de éste, ir
al Capítulo dos, pegarlo, y luego copiar el Capítulo tres sobre otro
capítulo. Ahí vamos. Tenemos el capítulo uno, dos, tres, y voy a hacer
coincidir los nombres de
aquí con lo que
tenemos por aquí. Ve a los tres
puntitos, renombra, pégalo con Comando
o Control V, haz click lejos y
repite este proceso. Tenemos todos nuestros capítulos hechos. Voy a quitar algunas de las cosas que no
necesito a este tipo, en cambio lo llamaré
prefacio. Todo bien. Este es el título de nuestro libro. Voy a hacer que ese
encabezado sea uno para que pausa y registre esto
como una cosa separada En cuanto a nuestra voz, bajemos la velocidad y la mantengamos más estable
y más profesional. Bajaré un poco el
audio. Es seguro, y vamos a generar. Empecemos por generar
unos pedacitos y luego
hacer nuestros cambios. Voy a agarrar a todos estos
tipos, luego se genera. La
guía de supervivencia de House Hunters, edición LA. Una guía de OBS para comprar
tu primera casa en Los Ángeles sin perder
la frescura, perro o cordura. Prefacio. Oye, no soy tu mamá, tu asesora financiera
o ese tipo en YouTube que piensa que cada
hogar debería tener pánico. Bien, así que enseguida, me di cuenta de que quiero que esta
línea venga justo después de esto. Así que vamos a
borrarlo y sacarlo a colación. Colin, ponlo aquí. Y creo que me quedaré A y cambiaré esto a
tal vez descargo de responsabilidad. Entonces como es un
varón, vamos a hacer Tad. Entonces lo que voy a hacer
es hacer un cambio más, aumentar la exageración de estilo, y el audio es
un poco demasiado bajo Volvamos a traer el cabezal de reproducción y
rehacer esta parte. La
guía de supervivencia de House Hunters, edición LA, guía de
ANBS para comprar
tu primera casa en Los Ángeles sin perder a
tu perro genial ni la cordura Descargo de responsabilidad. Oye, no
soy tu papá, tu asesor financiero
o ese tipo en YouTube, que piensa que cada hogar
debería tener una habitación de pánico. Soy un agente de bienes raíces que
ha ayudado a gente como
tú con estilo, a
tener perros creativos, hacer malabares con un sueño y una fecha límite, comprar su primer lugar en Ángeles sin tener Estoy aquí para hacer que todo
este proceso se sienta mucho menos abrumador, un poco más empoderador. Y honestamente, un poco divertido. Bien, así que eso es mucho mejor. Y ahora podemos pasar a cómo lee los
diferentes capítulos. Entonces voy a seguir
presionando play, para que podamos ver cómo suena eso. Capítulo uno, bienvenido al circo de Los
Ángeles, también conocido como el Mercado. Entonces, para el título, debería
haber un respiro aquí. Eso es lo que voy a hacer. Un descanso de cinco segundos,
medio segundo. Y luego aquí, voy a
hacer lo mismo. Bien,
escuchémoslo una vez más. Capítulo uno, bienvenido al circo de
Los Ángeles, también conocido como el mercado. Vamos a arreglar
algo. Comprar una casa en Los Ángeles no es para
los débiles de corazón Esta es la ciudad donde
un artesano de dos habitaciones puede costar más que
toda tu educación universitaria, y aún necesitarás rogar a
alguien por estacionamiento en la calle La competencia es salvaje. Los compradores de efectivo están en todas partes y el mercado cambia
más rápido que el cierre de tu cafetería pop
up favorita para renovaciones Bien y eso es bastante bueno. Entonces lo que vas a hacer es seguir construyendo tus
capítulos si quieres. Pero honestamente, debido a que ElevenLabs tiene una herramienta de audio incorporada, no
hay mucho
que hacer Así que solo declaras
tus capítulos, agregas una pausa cuando
quieras y ajustas tu voz. Ahora para el título en
los títulos de los capítulos, voy a hacer
lo mismo donde agregamos una pausa. Déjame ir por aquí. Esta es la partida
tres. Mantén las cosas consistentes para que tu
voz pueda leerla igual. Agreguemos otra pausa aquí. Voy a hacer tal vez 0.4 segundos,
y luego el último. Una vez más, rumbo
tres, otra pausa. Ahora que tengo todas mis
pausas y todo mi texto, puedo seguir adelante y
exportar esto y tal vez en un
software diferente emparejarlo con una música si quieres o
agregar efectos de sonido como
ya aprendimos a hacerlo Sin embargo, voy a
mantenerlo claro porque así es como
prefiero mis audiolibros, pero eres libre de hacer
lo que quieras. Porque sabes usar todas y
cada una
de estas herramientas. Así es como podemos
hacer un audiolibro. Empezaste desde HAGPT
encontrando ideas de libros. Adaptamos esas ideas en un
nicho muy específico de audiencia. Una vez que tuvimos eso, nos
dieron algunas viñetas. Convertimos esos puntos
en párrafos, lo
limitamos a 25 páginas, y luego lo llevamos
a 11 laboratorios donde
declaramos los capítulos e
iniciamos la traducción. Ahora Archer está leyendo nuestro
libro para el público. Espero que ustedes disfruten de
este breve proyecto. Pasemos a
la siguiente lección.
27. ElevenReader: Una vez que tengas un archivo de historia, puedes convertirlo fácilmente en un audiolibro usando ElevenLabs Vimos cómo hacerlo, pero ha habido una actualización, que es el ElevenReader Entonces básicamente, puedes
subir tu eBook, y comenzará a narrarlo por ti y podrás ganar
de esa narración Entonces anteriormente aquí
es donde íbamos. Subiríamos nuestro archivo PDF o EPAP al modelo de selección de
estilo narración Pero ahora cuando bajes por aquí, puedes subir la misma historia y simplemente hacer que vaya
a esta plataforma. Entonces tengo una historia de muestra en punto TxDFMAT con
dos personajes Voy a subir eso aquí mismo. Acabo de subir eso
desde mi computadora, y sólo vamos a dar click en crear y previsualizar libro.
Así que aquí está mi historia. Es, ya sabes,
escrito línea por línea, y estamos consiguiendo nuestros
diferentes personajes. El primero es, podría, darle un nombre ya que
tenemos dos caracteres, podemos tener o que
sean múltiples personajes, narradores, o solo uno Entonces eso depende de ti. Pero si
haces clic en cualquiera de ellos, puedes asignar quién está hablando. Aquí tengo algunas etiquetas
sobre los personajes. Realmente no necesito que esto se
establezca en ningún lado. Así que solo vamos
a eliminar eso usando la tecla de retroceso Para que puedas hacer
ajustes fácilmente en esta página. Y lo mismo aquí. Ese es el nombre de nuestra historia. Desplácese hacia abajo. Todo lo
demás se ve bien. Ahora, lo que podríamos hacer después eso es jugar
con el volumen. Esto es bastante similar
al diseño del estudio, pero solo estamos obteniendo
esa capacidad de libro electrónico. Entonces, si quieres, puedes agregar algo
de música desde aquí, hacer la tuya o arrastrar una dentro. Puedes hacer
diferentes personajes. Entonces este es el
narrador actual de una historia. La linterna al
borde del mar. Mara encontró la linterna
en un martes lluvioso. Entonces esto de aquí
no es algo que yo quiera. Quiero algo
un poco más profundo. Así que sólo voy a ir aquí
y cambiar la voz. Así que vamos a Explorar. Iremos por inglés, ver si hay una opción de
audiolibro Primero quiero obtener una vista previa. Ne IguodatokeViacos, OEtoato Meg ir. Solo
asegurémonos de que sea inglés. Los vientos de las tierras entre
susurro de tus hechos. No tengas miedo de preguntar en gran medida. Entonces lo que voy a hacer
es hacer clic en Marcus. Esa es la voz que quiero,
y básicamente va a reasignar la narración
de Eric a Entonces ahí vamos.
Ahora todo es azul, y podríamos hacer un
pequeño adelanto aquí. Mara encontró la linterna
en un martes lluvioso, medio enterrado bajo
los escalones
de madera del faro Old Harbor. Ella había venido allí
buscando refugio de la tormenta, no tesoro. Pero la pequeña lámpara de latón le
llamó la atención. Entonces una vez que estoy contento
con la historia, el discurso, el tipo de voz, ahora
puedo dar clic en Exportar. Podemos exportarlo como vimos ya sea como un audio o una estructura de archivos
diferente, pero quiero señalar ahora
a ElevenReader Entonces, lo genial de esto es que puedes ganar
con esta función. Obtienes 0.25/hora, es decir, se transmite y 60 por Ahora bien, esta es una historia de muestra, pero vamos a
probarla de todas formas. Puedes hacer una narración dinámica, así que ellos podrían tipo de
personas que descargan tu historia pueden elegir
sus propias voces, y de esta manera, hay más
flexibilidad de su parte, pero también puedes simplemente
publicar lo que
tienes y no
darles esa opción Entonces solo voy a hacer audio
original para esto. Podemos dar click en
Publicar. Todo bien. Entonces, una vez que vengamos
aquí, podemos dar algo más de información
sobre el libro de cuentos Podemos crear nuestro
perfil de autor que somos nosotros. Sube tu foto,
date un nombre, el idioma, de tu perfil, y si tienes un portafolio, puedes poner la URL así
como una biografía. Sólo voy a hacer algunas cosas
al azar ahora mismo. Di mi nombre es Megan. No tienes que
llenar el resto. Pasando al siguiente, podemos hablar del
libro en sí, de la historia. Esos van a ser los metadatos. Sobre la categoría, el
género, y todo eso. Y en el lado derecho, podemos ver que la historia se está subiendo. Entonces mientras esto se está cargando, solo
voy a ir aquí
y puedes compartir este código QR con la gente o
descargar la aplicación tú mismo. Pero volviendo atrás, ahora podemos
poner un nombre, una imagen de portada,
subtítulos, nuestra propia descripción del
perfil de autor del libro, y es más o menos como
cualquier otra plataforma de eBook. La única diferencia
es que hiciste la voz completamente
con ElevenLabs Esta es otra salida que podrías hacer a partir de
tus creaciones aquí. No voy a
pasar por todo el asunto porque va a
ser como detalles de pago, detalles de
distribución, y esto, como dije, es una historia de muestra Pero si te
interesa, puedes llevar tus audiolibros un paso más allá y
subirlos en ElevenReader También hay otras opciones si quieres publicar en Spotify. Hay en Audio, el
video y Audio Native. Entonces estas son cosas bastante geniales, y puedes
explorarlas más a fondo.
28. Anuncio, parte 1: Para nuestro último proyecto, vamos a incluir algunas
cosas que están fuera de ElevenLabs y veremos cómo
podemos combinarlas en un solo video Lo que vamos a hacer es obtener algunas imágenes
de Internet. Esto podría hacerse
con otra herramienta de IA como runway o Mid Journey,
o podrías usar videos
libres de derechos de autor de Pexels, combinarlos y luego
hacer un metraje doblado, audio
adubb para tu metraje adubb Primero, sigamos adelante y decidamos de qué trata el
video. Voy a dirigirme al video de
Pexels. Justo por aquí. Y mientras estamos aquí, vamos a
conseguir una pestaña de audio también. Estoy manteniendo pulsado Comando para abrir una nueva pestaña solo para que
podamos tener algo
de música ahí también. Entonces me refería a Pixabe para audio
y luego píxeles para video. Entonces creo que lo que voy a hacer es un anuncio donde primero lo
hacemos en inglés. Tenemos algunas
tomas de la naturaleza tal vez y luego tenemos una
música optimista de fondo Una vez que tengamos nuestro audio en inglés, lo
traduciremos a
un idioma diferente para que sea como un comercial
multilingüe. Consigamos algunas
tomas de naturaleza o tal vez turismo. Este será un anuncio turístico, y
aquí hay un montón de videos gratis para que los uses Solo asegúrate de que si planeas publicarlo
en cualquier lugar, le des crédito al creador. Todas las personas que
hicieron estos videos están en la parte inferior izquierda. Descarguemos algunos de ellos. Voy a entrar y
conseguir un archivo menos pesado. Ahí está el primero.
Este es nuestro segundo. Hagamos una
toma de isla y tratemos de conseguir diferentes ángulos porque eso es lo que suelen hacer los comerciales Algunas aves por aquí, Bien. Tengo un montón de videos. Voy a dirigirme a Chat GPT para obtener un guión muy rápido Siéntase libre de hacer su propio guión. Sólo estoy haciendo esto para los
fines de este curso. Digamos que quiero
hacer un aros 60, digamos 30/32 anuncio
sobre viajar Ayúdame a escribir un guión. Y luego digamos para quién
es esto y en qué debería el guión que quiero
enfatizar sea quien eres
en cualquier lugar y ser libre. Usa un tono inspirador y
profesional que motiva al público
a comenzar a viajar Dar un grito al
final al canal de ejemplo. Supongamos que el canal de ejemplo
es mi canal de YouTube. Muy corto y nos dieron
un par de frases. Solo voy a hacer
que ChachBT elimine estos fragmentos y solo
me dé Muy corto, muy
sencillo, y esto funciona bien
con nuestras tomas de turismo. Eso es exactamente lo
que voy a hacer. Copiemos esto y
luego vayamos al doblaje, creamos un canal de ejemplo de doblaje, idioma
fuente en inglés, y digamos que el
otro es el Francés o español, cualquier
otro idioma que quieras. Ahora, la fuente de video, aquí es donde
vamos a tener que combinar nuestros videos y luego
ponerlos en un solo archivo. Puedes usar cualquier software
que quieras para eso. Básicamente solo estás tomando los videos que descargaste, pegándolos juntos, y luego exportándolos
para esta parte. Cualquiera que sea la fuente que elija, aún
necesita ese archivo Lo que voy a hacer es ir a Premiere Pro y juntar estos
cuatro clips, y luego volveré enseguida
para que podamos subirlos aquí. Junte los clips. Llegué a 35 segundos, pero lo hice por si
acaso quería
estirar uno de los doblajes o
agregar algo de música dramática Como puedes ver, es solo una
compilación muy sencilla de estos videos, sin transiciones ni nada. Pero una cosa a tener en cuenta es mantener similares los
clips fuente. Todos son sartenes lentos de destinos
turísticos
y porque estoy
hablando de libertad individual
y de ser quien eres, sí
tengo gente caminando por
diferentes lugares Entonces la última parte donde me
suscribo a nuestro canal, es una posibilidad remota de esta profundidad. Después, podría poner
texto y esas cosas. Ahora que tengo mi clip base, antes de entrar en el doblaje, realidad
voy a conseguir
algo de música de fondo Se me olvidó hacer eso.
Puedes usar Pixaba Tiene música gratuita, sin copyright. Nuevamente, si planeas
publicar esto en cualquier lugar, asegúrate de atribuir los artistas que
puedes ver aquí mismo. Busquemos comerciales
o veamos aquí. Va a ir con piano. Este audio me funciona. También puedes buscar otras
cosas como música de viaje, música registro, cualquier
otra cosa que quieras. Y ahora que tengo
mis cosas base, voy a ir al doblaje
y empezar a rellenar estas Podrías poner la música de
fondo en el propio archivo de video, así que solo estás
subiendo una cosa, pero voy a ir al manual
para que
tal vez pueda tener opción
sobre las capas Ahora que tengo mis archivos fuente, el archivo de video y
el archivo de audio, podemos seguir adelante y
comenzar a hacer el doblaje Los veré en la
siguiente lección donde hacemos justamente eso y ultimaremos nuestro anuncio de canal de
ejemplo
29. Anuncio, parte 2: Bienvenido de nuevo. En
la última lección, nos ocurrió un anuncio, y ahora es el momento de crear
realmente el texto, el texto a voz, y luego hacer una tina de español u otro
talón de idioma encima de él Ahora, antes de
meterme en eso, quiero intentar hacer
música para este anuncio. Nosotros sí descargamos esa música
de piano
suave de Pixabe en la lección
anterior, pero también tienes la opción de
generar música aquí mismo Entonces abramos eso en una nueva pestaña. Entonces tienes varianza, apenas
nos gustan las
diferentes versiones que
llegas a crear. Esta
es la duración. Lo pondré a 30 segundos
porque ese es mi anuncio, pero puedes ponerlo en
auto o cualquier otro valor. Estos son tus proyectos recientes, pero todo lo que tienes que hacer
es describir tu canción. Hagamos un inspirador probemos algo
como esto y también
podemos luego cambiarlo
si no es de nuestro agrado Lo configuré en una variante y
se puede ver que solo estoy
consiguiendo una en este momento y esencialmente
estamos consiguiendo las diferentes partes hechas para nosotros. 30 segundos como pedimos. Y estos son los estilos
que excluye estilos, ya
sabes, cosas que no
pedimos Pedimos inspiración, cinematográfica para
piano, pero obviamente no pedimos
una guitarra rock ni
nada por el estilo Entonces nos dieron las
diferentes secciones. Escuchemos nuestra primera variante y veamos a qué nos enfrentamos. Eso en realidad estuvo bastante bueno. Observe aquí, es interesante. Agregué un texto de muestra para que imaginemos mejor esa voz
en off sobre esta introducción Para mí, esto es perfecto, pero si quisieras
cambiarlo, puedes o bien continuar
esta conversación, que significa agregar
una nueva sección, tal vez quieras algo más, golpeamos plus y
agregas una nueva sección, sección remix
optimista
o algo así, entonces podemos volver a hacer las partes de
incluir y excluir Entonces así es como llegas a cambiar
la composición de tu canción. Una vez que hayas terminado, sólo
voy a eliminar esta sección extra. Puedes golpear Descargar o
compartirlo con otras personas. Entonces, cuando golpeo Share,
es como
una audioteca de ElevenLabs Puedes poner el título de la canción, darle un poco de color, y luego podemos generar
el enlace a esta canción, previsualizarla y Exportar. Entonces, cuando golpeas Exportar, en
realidad exporta esta
animación. Acabo de descargarla. Veamos qué tenemos. Entonces eso es bastante genial. Acabo de
hacer todo eso con IA. Bien, esa es mi
música para el anuncio. Siéntete libre de seguir usando la música que descargaste
de Pixabay, combínalas Pero solo
quería mostrarles que este producto existe. Ahora podemos ir a
texto a voz y pegar Bien, entonces volví a Chachi
BT y obtuve nuestro guión. Sigamos adelante y
elegimos una voz que sea algo profunda, de tono
muy lento, segura, y al igual que esos clásicos comerciales de
viajes comerciales que ves en la televisión Entonces busquemos correo
profundo, supongo. La vida es como el agua. Esta es tu profundidad. Era una de esas raras sonrisas con una cualidad de
eterna tranquilidad en ella. Bienvenido a mi demo. Una voz que no sólo habla. Hola, ahí. Este es Dante. Con un tono profundo y fácil de llevar. El mundo de lo artificial. Bien, creo que me
gusta mucho. Hola, ahí. Esto es con un Angelo profundo. Y luego tuvimos Hey, chicos. La vida es como Así que fue
uno de esos Seko, creo, así es como
dices su nombre Probemos los dos y
veamos cuál funciona mejor. Vamos a hacer clic en agregar
a Mis voces y solo generar primero para
ver cómo lo maneja. Voy a hacer esto un poco más lento porque
sí habló un poco rápido cuando hice la previa,
y luego ya podemos decidir. Hay una versión tuya que está esperando ser
desbloqueada ahí fuera. Cuando viajas,
no escapas de quien eres. Te vuelves más de eso. Bien, así que ese no es el
sonido que voy por. Bien, entonces este es un ejemplo de cuándo podrías diseñar
tu propia voz
en lugar de
buscar entre las miles
de voces disponibles. Entonces lo que voy a hacer
es dirigirme a casa, que lo tengo
abierto aquí mismo y solo ir a Diseño de voz. Así que vamos a ver si tenemos
algo que empezar
será tráiler de voz. Digamos voz masculina dramática. Y luego aquí lo que tenemos. En un mundo al
borde del caos, un héroe se levantará Prepárate para una historia de épica En un mundo
al borde del caos En un mundo al borde. Bien, entonces esto está dando
un poco más, ya
sabes, thriller y acción. Así que en realidad voy a
copiar nuestro guión y
ponerlo en vista previa de texturas y
darle a esto algo diferente. Tan dramática voz masculina
dice voz masculina profunda. Anuncios de Inspiración y Viajes. Vamos a probar eso. Hay una versión tuya que está esperando ser
desbloqueada ahí fuera. Cuando viajas, no escapas a quien Hay
una versión tuya que es Hay una versión tuya que intentemos otra cosa. Digamos, voz masculina lenta y
segura. Entonces vayamos a Chat GBT
y hagamos que básicamente describa esa voz clásica de anuncios de
viajes Los que son,
como, ya sabes, lentos, inspiradores,
profundos, confiados Pero sólo tengo
que poner ese sonido en palabras. Entonces digamos que estoy tratando de
diseñar una voz con 11 vueltas, ElevenLabs para este Esto es lo que tengo ahora mismo. Ayúdame a acercarlo a los
clásicos comerciales de viaje. Entonces esto es perfecto, geográfico
nacional. Eso es exactamente a lo
que estoy tratando de llegar. Ahora se puede ver que tomó esta frase y la
construyó en más. Voz masculina,
ritmo lento y tono confiado, cálido y rico, y
sólo voy a copiar esto. Si vimos que no
nos está consiguiendo exactamente lo que necesitamos, podemos simplemente quitarle poco a poco
el prompt. Pero por ahora, veamos cuál el resultado directo
de usar HaChPT Y recuerda que sí tenemos los ajustes para que te
pongas en un asiento,
trabajes con el volumen
y todas esas cosas. Sólo voy a mantener
todo por defecto. Hay una versión tuya que está esperando ser
desbloqueada ahí fuera. Cuando viajas, hay una versión tuya que está
esperando ser desbloqueada. Hay una versión tuya. Bien, entonces definitivamente es
mucho mejor, pero es un poco demasiado lento. Así que intentemos arreglar
eso por aquí, y de hecho voy a
agregar una voz británica aquí. Voz masculina británica,
ritmo lento, tono enriquecer el brazo. Retira esta línea. Así que vamos a
quitar la parte de articulación. Y mira lo que conseguimos. Hay una versión
tuya que está esperando
ser desbloqueada ahí fuera.
Cuando viajas. Hay una versión de
ti que está esperando ser un Hay una versión de ti que está esperando
ser desbloqueada ahí fuera. Bien, entonces esta
es realmente buena, pero solo quiero hacer
esto un poco más profundo. Así que la voz masculina profunda británica. Sólo en términos del terreno de juego, voy a intentar realmente
generar éste primero, y luego haremos otro. Entonces digamos viajar
a la voz uno. El idioma es inglés
acento es británico. Guarde esa voz. Iré a otra ventana
mientras eso sucede. Así que vamos a reemplazar
este prompt con nuestra voz masculina profunda y
luego poner en nuestro guión. Hay una versión
tuya que está esperando ser desbloqueada ahí fuera. Hay una versión de ti que está esperando hay una
versión de ti que está esperando Hay una
versión de ti Bien, estos tres son realmente buenos. Sólo voy a volver
y escuchar nuestra música que pueda
comparar y decidir. Abrámoslo justo por
aquí. Este es el video. Hay una versión tuya
que está esperando ser desbloqueada. Hay una versión de
ti que te está esperando. Hay una versión de
ti que te está esperando. Hay una versión tuya
que está esperando ser desbloqueada. Bien, creo que
iré con voz. Hay una versión tuya, vamos a seleccionarla y llamarla
Travel ad voice two, británica. Y ahí lo tenemos. Entonces ahora tenemos nuestra música
y nuestra propia voz. Anteriormente, hicimos nuestro video, y ahora es el momento de juntarlo
todo y luego hacer nuestra traducción al español
o a cualquier otro
idioma que elijas. Entonces voy a ver si es en la siguiente lección donde
hacemos precisamente eso.
30. Anuncio: Parte 3: Bien, sigamos adelante y
traduzcamos nuestro video. Antes de esta lección,
acabo de combinar mi clip base y el audio
en sí, no la música. Y esto es esencialmente
lo que tengo. Hay una versión tuya
que está esperando ser desbloqueada. Ahí fuera. Desaprendes, respiras estos también. Entonces, la razón por la
que lo hice primero es porque ElevenLabs le resultará
más fácil traducir, y esto le ahorrará la
molestia de subir el video e intentar que coincida con la palabra que desee en
ese minuto exacto Podrías seguir adelante y
saltarte esto y simplemente subir tu audio
primero en doblaje Así que cuando vas aquí, cuando
quieres crear un dub, eres capaz de subir la fuente de
audio o video Entonces estoy haciendo fuente de video porque tiene el
audio adjunto a ella, pero solo podrías hacer audio y luego agregar el video más adelante. Sugiero siempre comenzar
con una fuente de video. Llamemos a este canal
de ejemplo del inglés al
idioma que prefieras, y voy a subir ese mismo
video. Ahí está. Tiene la idea una vez más. Vamos a crear un proyecto de doblaje. Y si quieres ahorrar uso, puedes tener la marca de agua
ElevenLabs, pero solo voy a
dejarla ser si
querías experimentar y no
estás segura
de tu video, solo revisa esto y te
ahorrará muchos créditos Número de oradores, solo tenemos uno y luego queremos que se apodere la gama
completa, y eso es todo. Vamos a golpear Crear. Se va a subir
este video y comenzar la traducción
del inglés al francés. Todo bien. Entonces voy a
esperar a que esto suceda. No debería tomar mucho tiempo, y luego volveré enseguida
para que podamos continuar. Está terminado de procesar. Sólo voy a abrirla
y ver nuestras traducciones. Ahora mismo, estamos familiarizados
con esta interfaz. Tienes el original,
que es inglés, y luego tienes el francés. Entonces cuando vas al francés,
puedes ver cómo tradujo la
versión en inglés aquí. Nuevamente, puedes editar esto si sabes francés y está mal o si
transcribió las palabras
en inglés de manera incorrecta Sólo voy a
verificar esto. Bien, entonces no hay muchos
textos de los que tratar, pero todo es correcto, al menos. Así que vayamos al original
e intentemos sumar nuestra música. Entonces todo lo que tienes que hacer es ponerlo
aquí para primer plano Puedes subir un
audio justo por aquí, así que trae la música. Ahí está. Se puede ver que incluso nos está diciendo que importemos algo sin un orador porque no va transcribir eso.
Ahí está mi música. Podría cambiarle el nombre a esto, hacer clic en el nombre,
llamar a esto Música. Este es un audio importado. Si este
video original tuviera algo de música, habría
aparecido aquí en primer plano Pero como la nuestra no
tenía ningún tipo de música, por
eso está vacía. Sigamos adelante y jueguemos esto y veamos si queremos
mover algo alrededor. Hay una versión
tuya que está esperando ser desbloqueada
ahí afuera cuando viajas. Escapar. inmediato, podría decir
que la música es
demasiado alta y solo mirándola
visualmente, el video de fondo
termina en este momento, pero el altavoz y el
audio terminan mucho antes. Ahora, con la parte de altavoz, no
es gran cosa
porque quieres algunas pausas
naturales ahí dentro y cuando te
dicen que te suscribas
al canal de ejemplo, quieres
que haya
un poco de nada hasta
el final del video, así que termina de una manera suave Pero para la música,
podríamos ralentizar esto
agarrando el borde aquí y
emparejándolo con nuestro video Haciendo esto, va
a bajar el tono de cualquier audio que hagas esto
también, así que tenlo en cuenta. Pero porque tengo algo de
piano y algo de violín, eso no va a
ser un problema para mí. Por supuesto, no
quiero ir por la borda. Déjame mostrarte
cómo
suena eso aquí sin el orador. Se puede ver que la música
sigue siendo prácticamente la misma. Es solo que el
terreno de juego es diferente. Pero si me excedo en esto o
si voy por el otro lado, lo aprieto, sigue siendo música Simplemente es muy diferente. Así que tenlo en mente. Cuando hagas eso,
voy a golpear Comando o Control Z para deshacer. Ahora, la música también es
un poco demasiado fuerte. Viaja, no te escapa. Queremos que la
voz del orador sea la parte principal. Así que simplemente haz clic en ese audio
y reduce el volumen. Tú juegas con
él hasta que esté perfecto. Conviértete en más de ello. Aprendes, desaprendes, respiras más fácil B quien eres en cualquier parte. Eso es mucho mejor. Ahora tengo mi hablante de inglés y mi música. Es hora de añadir
algún efecto de sonido. Con los comerciales,
quieres que los espectadores se imaginen a sí mismos en ese escenario Ya que estamos
hablando de viajes, tenemos algunos escenarios
de globos putter, que podrían mar, todas esas cosas, podríamos agregar y generar efectos de
sonido para poner
entre estos clips Así que vamos a desplazarnos hacia abajo aquí mismo. Se puede ver en Sex track. Cuando haces clic en él una vez, solo
va a hacer la pista y esta barra de pantalla te
permite generar
esos efectos de sonido. Déjame ver primero dónde quiero
que estén los efectos de sonido. Para la primera parte, no
puedo pensar un efecto
de sonido que quiero aquí. Podríamos hacer que la gente
charle en la parte de atrás, pero como
no están en el marco, eso va a ser
un poco raro. Pero para el segundo
clip, tenemos la C, y se puede poner
en algunos SGL bien por o las olas chocando,
algo así Aquí de nuevo, no
tenemos mucho que hacer, pero esto podríamos hacer algo así
como una zona abarrotada, así que esta persona está tomando esa libertad y
caminando por un extraño o algo así, y aquí podemos hacer
algún choque de olas. A lo mejor hacemos Segal para
éste y olas para éste. Sigamos adelante y llevemos nuestro cabezal de reproducción justo donde
queremos que comience este audio Podríamos mover el SFX
después de que lo hayamos construido también. Haga clic una vez, y voy a decidir sobre la
duración bastante larga, esta larga, extenderla. No hay audio en este momento. Aquí no
pusimos nada.
No te preocupes por eso. Pasemos a
la otra parte que queríamos un audio,
iniciemos uno aquí. Estoy tratando de superponer los clips porque eso lo hace
mucho más natural. Ahora aquí, cuando hay
dos SFX espalda con espalda, así que empaca la luz, sueña Entonces tenemos a uno de la persona caminando y luego tenemos
uno con la playa. Entonces, en lugar de
ponerlos uno tras otro, también
podrías ponerlos en capas. Esencialmente, nos desplazamos
hacia abajo y agregamos otra pista de Saffx y
hacemos nuestro segundo aquí abajo La razón por la que
estamos haciendo esto es porque cuando este
tipo se está desvaneciendo, este tipo podría desvanecerse
y eso crea una transición
perfecta muy natural Asegurémonos de que se superpongan por un par de segundos así, y tengo tres
AAFC con los que trabajar Vayamos al
primero, y haré gaviotas volando cerca de una playa Volarás por distancia. Se desvanecen y luego se desvanecen. Intentemos algo
realmente sencillo. Avon, no te
escapa de quien eres. Te vuelves más
de eso. Aprendes. Ahí vamos. Bastante bien. Siegel está volando por la parte de atrás. Yo solo voy a silenciar
solo resalta esta pista así que da clic en este ícono de auriculares para que podamos escuchar el SFX Observe lo bueno que fue ese
fade in Fade Out. Si lo quito, sólo
voy a copiar esto. Simplemente deshazte de esta parte,
genérela una vez más. Se puede ver que eso no es tan bueno. Simplemente comienza de repente, pero al agregar ese
fade in fade out, va a ser más natural. Fade in, audio y
luego fade out. Sólo déjalo fuera. Gaviotas
volando a distancia No creo que tengamos que poner el sonido del océano
porque está muy lejos. reservaremos para
este audio. Todo bien. Éste, lo dejaré como
el volumen que tiene ahora mismo. Posteriormente, podemos escuchar todo
el asunto y luego decidir o qué tan alto
queremos que sea el audio. Pasemos a la segunda donde tenemos a esta
persona caminando, supongamos una extraña,
una abarrotada. Haga clic en esto puede hacer un bizcocho
abarrotado con la gente. Hablando a lo lejos, vendedores gritando sus
precios, supongo Podemos experimentar con esto. Voy a hacer uno sin
desvanecerse y desvanecerse. Ahora bien, la razón por la que sigo haciendo en la distancia
es porque quiero un audio descolorido y a veces el volumen por sí solo no
va a ser
tan útil para ti Si haces uno sin el prompt
en la distancia, será demasiado
claro y demasiado ruidoso, pero ese no es el punto aquí. No queremos que el SFX sea el personaje principal de
este anuncio, así que por eso estoy agregando en la distancia para
todos estos SFC Si tuviste el sonido realmente de
cerca, por ejemplo, súper plano plano de un pájaro, entonces es posible que quieras
no usar en la distancia. Solo mide qué
distancia hay entre nosotros como espectador y ese sonido
que hay en el video. Esto nos dio un audio más corto. Si cambias prompt, puedes regenerar ese audio o hacer clic en este ícono de actualización
para obtener uno diferente Simplemente podemos hacer clic
en esto ahora mismo, clic
derecho y hacer uno de duración
fija. Quise hacer
esto así primero. Duración fija. Ahora cumple con ese
requisito que queríamos. Las palabras que
dice la gente no tienen ningún sentido, pero eso está bien porque
es un ruido de fondo. Ahora, por defecto, cuando
generas aquí, está haciendo la duración dinámica. Si hiciste lo que hicimos aquí y viste que
te sigue dando una versión más corta, no intentes
estirarla porque eso simplemente ralentiza el clip. Pero en su lugar solo haz clic derecho
y haz duración fija. Ahora, nuestra última escena es, déjame ver si esto se
desvanece y se desvanece Bien, no. Entonces
hagámoslo Vamos aquí. Se desvanecen y
se desvanecen todo aquí. Generado una vez más.
Significaba hacerlo de otra manera. Entonces este es un ejemplo, duración
fija. Va a usar el mismo prompt, pero manténgalo con la misma
longitud que tú quieras. A Bien, así que eso es bueno. Realmente no se desvaneció y
se desvaneció como el de Segel, pero creo que va a estar bien Para el último, hagamos
el sonido de las olas. Entra en este de aquí abajo
y haz olas chocando. Simplemente hacemos olas en la orilla. Se puso lento al principio. Bien, clic derecho. Audio de duración fija. Hola. Enciéndalo así. Bien. Creo que esto va a estar
bien. No quiero dos
efectos de sonido Segel en un solo clic Entonces cuando toco
todo junto, solo
desmarco esto para que ahora
todo esté
siendo considerado Donde Eso es lo alusivo. Se puede ver que
no hay equilibrio entre
los diferentes audios Entonces vamos al
primer efecto de sonido. Cuando viajas,
no escapas de quien eres. Haga clic en el primer efecto de sonido y apenas baje ese audio. Viajas, no
escapas de quien eres. Te vuelves más
de eso. Aprendes, eres un poco
más bajo que eso. Vamos a probar el de aquí. El extraño,
iré un poco más bajo solo porque es el de los laboratorios
y luego la playa, podemos ir 16 decibelios,
negativo B quien eres en cualquier parte.
Esa es la verdadera libertad. Así que empaca la luz, sueña en grande y comienza tu viaje hoy mismo. Suscribirse al canal de ejemplo. Así que fíjate en cómo esa
transición fue muy suave de ese bazar
a, um, la playa. Y eso es por esta cosa
superpuesta que hicimos. Ahora bien, para que este sea
un poco más suave, porque se puede decir claramente cuándo empieza y cuándo termina. Viajas, no te escapas de quien eres. Te vuelves más de eso. Creo que sólo voy a
extenderlo a tal vez aquí. Entonces es menos notorio. Clic derecho, duración fija. Y debido a que estamos tan
enfocados en este final de audio, podríamos prestar menos
atención al SFX No se escapa de quien eres. Te vuelves más de eso.
Aprendes, desaprendes Es un poco demasiado bajo. Entonces aumentemos eso. Conviértete en más de ello. Aprendes, desaprendes. Respira más fácil. Ahí. Cuando viajas, eso. Aprendes, desaprendes,
respiras más fácil. Bien, eso es bastante bueno. Creo que voy a hacer otra cosa
superpuesta. Entonces movamos esto a su
propia capa como una pista vex, y solo pondré mi cabeza lectora para obtener
alguna dirección aquí, ponerla así, y
ahora darle una escucha Hazlo un poco más fuerte. Te vuelves más
de eso. Aprendes, desaprendes, respiras más fácil Sé quien eres en cualquier parte. Bien. Entonces eso es bastante bueno. Vamos a extender los
SQL al principio, tal vez un poco más atrás, algo así,
generados de nuevo Entonces es como que esto
termina, esto comienza, luego esto comienza como una situación
de ir. Cuando
viajas, no escapas quien eres. Te
vuelves más de eso. Aprendes, desaprendes,
respiras más fácil. Sé quien eres en cualquier parte.
Eso es lo real. Bien, así que estoy bastante contento
con este clip original, y solo lo jugaré para
ustedes como es para que puedan saber a qué nos
enfrentamos antes y luego cuál va a ser la versión
francesa. Para la versión francesa, no
hay mucho que puedas hacer. Se puede ver que simplemente duplica la misma pista de audio y
simplemente la traduce. Entonces no estás haciendo
mucha edición aquí. Empecemos de nuevo y
veamos qué tenemos. Hay una versión
tuya que está esperando
ser desbloqueada ahí fuera. Cuando
viajas, no escapas quien eres. Te
vuelves más de eso. Aprendes, desaprendes. Respira más fácil. Sé quien eres en cualquier parte. Esa es la verdadera libertad.
Así que empaca la luz, sueña en grande y comienza tu viaje hoy mismo, suscríbete al canal de ejemplo y ve a dónde te lleva el
mundo. Entonces esa es la
versión original. Todo está bien. ¿Cómo suena la
versión francesa? Ahora, cuando toco
esto, puede que oigas, como una voz duplicada. Iliana. Entonces, si esto te pasa
, no entres en pánico. Ahora mismo, estoy en
la versión francesa, pero podemos escuchar algo así como la versión
en inglés de fondo. Ahora, ahora mismo, tengo
mi hablante de francés, mi original, y los antecedentes. Entonces hay tres altavoces
en este clip en este momento, y cuando lo escuchamos, suena un poco raro. Tenemos al francófono y alguien está amortiguado
de fondo No entres en pánico si esto te
está pasando. Esto sólo pasó
porque teníamos al orador como parte
del clip original. A pesar de que el altavoz uno
original está atenuado, sigue leyéndolo raro porque tenemos la música de
fondo Si solo destaco esto
no lo haces quien eres. Se puede ver de ahí viene el sonido
amortiguado. Todo lo que realmente tienes que
hacer es eliminarlo, y luego debería volver a la normalidad. Esa es una solución sencilla. Ahora para exportar esto, solo
puedes bajar
aquí, dar clic en Exportar. Estas son las cosas
que has hecho antes, pero aquí abajo, puedes decidir en cuál de los idiomas quieres
exportar y luego como qué. video de Pfore tendrá el video, los efectos de sonido, el altavoz
y todas esas cosas. Incluso puedes exportar
esto como un archivo zip cada capa es su propia audiora puedes hacer los datos de la línea de tiempo Si tienes alguna leyenda, no
hacemos audio en este formato, en este formato o en este Entonces cuando termines,
puedes presionar Exportar. La va a cargar aquí arriba. Obtienes marcas de tiempo
y en qué idioma, entonces tienes la opción de hacer una vista previa y luego
descargarla cuando estés listo. Tvantage oye Kivu dijo,
segunda parte, Seliberto Hola, Voyage grand. Él viene y guarda un viaje muestra. Creo ejemplo, canal, yo voye va a ascender para salmón Así es como puedes hacer un anuncio muy sencillo
con ElevenLabs Empezamos todo desde
cero, desde el guión, la voz, el audio, altavoces, los efectos de sonido
y todas esas cosas. Lo único que no
hicimos fueron los videos que
obtuvimos de pexels.com Pero si quieres que esta
sea una experiencia de IA completa, existen algunas herramientas
que pueden hacer videos de IA para ti. Esto concluye nuestro tercer
y último proyecto. Espero que ustedes hayan podido
obtener el mismo resultado, si no similar al que
tenemos aquí mismo. Seguro probar aún más proyectos y practicar las herramientas de las
que aprendimos. Ahora pasemos
al siguiente capítulo.
31. Introducción a las herramientas de Creator: Ahora puedes generar imagen
y video dentro de 11 laboratorios. Además de generar
esos activos, también
puedes mejorarlos, crear tus avatares
y realmente tener una producción completa
en una plataforma Esta es una nueva edición, imagen y video,
y esencialmente, así es como se ve la
página. Primero nos reciben
con avatares, que es una forma en la que puedes
mantener personajes consistentes. Entonces digamos que tienes una cara, quieres que sea lo mismo a través de diferentes generaciones de
videos. En lugar de tratar de perfeccionar
eso con tu prompt, solo
puedes generar
un avatar y de esa manera, todo se verá
muy consistente. Aquí, estamos viendo un montón de ejemplos de lo que
otras personas hicieron, como pueden ver, son de
bastante alta calidad. Podría entrar en cada
video, ya sea remezclarlo, es decir que combinen
mi propia versión este video o simplemente
descargarlo o compartirlo tal como es Tenemos la opción
tanto para video como para imagen. Y con la imagen,
en realidad se puede ver el prompt completo. Entonces básicamente la instrucción
que esta persona proporcionó ElevenLabs para
obtener este resultado Y lo mismo va
para el video también. Entonces aquí tenemos una animación. Tenemos un largo prompt, también. Ahora lo genial de
ElevenLabs cuando se trata generación de
imágenes y videos es que combina todos tus modelos de IA
favoritos Entonces solo para mostrarte una vista previa, cuando bajes por aquí, es posible que estés familiarizado con la
mayoría de estos modelos. Entonces tenemos GPT, tenemos artesanía,
tenemos sDream, tenemos nano Banana, y tantos otros si solo
te desplazas Y eso es lo que hace que esta
plataforma sea un poco más única porque además de sus propios
modelos potentes para música, voz y efecto de sonido, también combina todos
los demás modelos en los que
quizás hayas confiado y la
llevaste a un solo lugar Aparte de los modelos
que generan contenido, también
tenemos modelos de edición. Así que escalando, esta es
otra herramienta famosa. Ha sido traído
a ElevenLabs. También tenemos
eliminación de antecedentes aquí también, y hay algunas pestañas para ti
donde podrías explorarlo. Entonces, si quieres
mejorar para editar, podemos usar estos modelos, y ellos también se llevan el crédito,
así podrías ir
en base al costo aquí Lo mismo aplica al
video que era imágenes. Tenemos video, y
luego tenemos sincronización de labios. Entonces la sincronización de labios es donde hiciste el audio o
simplemente lo subiste, y
básicamente querías generar un video donde
coincidieras con el audio. Entonces, si hiciste una voz en off
aquí o hiciste un texto a voz, ahora
puedes tener ese discurso establecido por un avatar
en la Entonces esa es otra característica genial. Así que vamos a sumergirnos en
esta nueva característica en las
próximas lecciones, explorar cómo funcionan, cómo
podrías hacer tu primer activo y cómo podrías
organizarlos en el futuro.
32. Recursos y plantillas: Entonces cualquier cosa que
hagas se va a guardar en tu carpeta de activos. Entonces, si haces clic en eso, ya
tenemos cosas diferentes porque llevamos un poco usando
ElevenLabs Cualquier avatar que hagas
se va a guardar aquí. Aquí se van a guardar
los flujos para los agentes de IA. Todo lo que subas a ElevenLabs también se
guardará aquí Entonces tengo dos imágenes aquí. Puede subir activos para
que pueda
arrastrarlos fácilmente a la generación de imágenes
o videos. Puedes hacer una nueva carpeta donde pongas ciertas cosas dentro, y de esta manera, podrás
tener un área de almacenamiento en línea para tu contenido. Así que acabo de hacer una carpeta. Podríamos darle
un nombre diferente. Entonces diré mi video
e imágenes solo para que podamos guardar las
cosas que vamos a hacer en el próximo
par de lecciones. Esto con otras personas,
elimínelo si es necesario. Cuando entramos en la carpeta, llegamos a subir cosas
desde nuestro ordenador. Y una vez que hacemos algo
en imagen y video, también lo ponemos en
esa zona. Así que podría simplemente ir por
aquí, descargar esto, y luego
subirlo a esa carpeta usarlo como referencia
para otro proyecto. Si no estás seguro de cómo crear un contenido completo usando
esta nueva función, ElevenLabs también tiene
la pestaña de plantillas, por lo que está justo
encima de los activos Y cuando haces clic en ellos, tenemos algunas opciones fáciles de
arrastrar y soltar para que puedas crear diferentes
tipos de producción. Entonces un par de ejemplos aquí, tenemos echemos un
vistazo a las categorías. Digamos que queremos hacer maquetas. Tengo este generador de
maquetas de empaque. Podría hacer clic en él, subir mi producto en blanco y el diseño de empaque de
dos D, y
se va a convertir en esto muy bien pulido. Entonces las plantillas esencialmente hacen algo por ti
de principio a fin. Este es un ejemplo para
un generador de maquetas, pero tenemos un montón
de otras cosas Entonces vamos a cerrar esto. Aquí tenemos una plantilla de
video UGC. Entonces, si quieres crear
ese tipo de contenido, puedes subir las entradas
para esta plantilla. Entonces el retrato del influencer, que este es un ejemplo Pero en el próximo
par de lecciones, te
mostraré cómo podrías hacer el generador de imágenes de IA
en ElevenLabs, y de esa manera puedes usar
tus propias generaciones, A continuación, tenemos el producto. Entonces, sea cual sea el producto
que quieras mostrar, lo
pondrás aquí mismo. Elige tu voz.
Esto podría ser de tu propia biblioteca de voces o las muchas voces
disponibles para ti. Y luego básicamente los beneficios que quieres que este
modelo resalte ahora. Entonces aquí hay un ejemplo. Entonces tenemos la ubicación del rodaje. Entonces ahora mismo, es como
un rincón de tocador rosa, pero podrías poner en el bosque, una oficina o cualquier otra cosa. Ya terminaste,
solo puedes hacer clic en Generar, y te conseguiste
un bonito video UGC Ahora, por supuesto, hagas lo que
hagas, todavía tienes la
oportunidad de editarlo más, hacer refinamientos y
hacerlo realmente tuyo Aquí abajo, podemos ver
cuántos créditos
va a tomar esto. Pero solo para mirar el flujo, básicamente cómo esto va a generar ese producto
final te está tomando los siguientes insumos que miramos al costado. Entonces, si tienes curiosidad, siempre
puedes entrar en la sección de flujo. Así influye en un retrato. Esta es una entrada, el
producto, la voz, combinación
perfecta,
beneficios del producto y ubicación de rodaje. Entonces va a tomar a estos tipos y escribir un guión primero, decidir la longitud y
luego hacer correr los modelos. Entonces crea un
par de versiones. Aquí abajo, está trabajando
con la voz en off y luego junta los dos
para el producto final Y entonces esto es como
el producto final. Podrías usar el flujo para
averiguar básicamente cómo
aborda este tema, también
es un poco divertido de ver. Así que también puedes editar
este flujo, digamos que querías en algún momento, traer otra entrada
para un segundo carácter. Puedes agregarlo aquí mismo. Vamos a aprender
sobre los flujos más adelante. Pero por ahora, esto es algo
que puedes explorar. Ahora bien, estos fueron los
ejemplos que
miramos y también cosas que
otras personas han hecho. Para que puedas ver la
imagen del producto. Todos estos están muy
bien hechos, de verdad. Simplemente se puede ver la
calidad del trabajo. Si vas a Generaciones, estas son las cosas
que has hecho
rellenándolas y
luego golpeando Generar. Entonces ahora mismo
no hay nada ahí. Piensa en las plantillas
como pequeñas herramientas que podrías usar además
de todas las demás, y es
genial trabajar con ellas. Lo único de
ellos es que sí toman muchos
créditos para asegurarse de que estás asignando
suficientes créditos para eso y estás consciente de cuánto
se va a usar Entonces aquí tienes
efectos de video para doblaje, sube tu video de entrada y
luego sacas el doblaje También haz tu propia plantilla si estas herramientas no son
realmente para tu necesidad, puedes hacer click en
más Nueva Plantilla. Y aquí puedes hablar con ElevenLabs para
construir tu propio flujo. Ahora, de nuevo, voy a
sumergirme en los flujos un poco más tarde. Pero básicamente, si tienes algo que
necesitas hacer repetidamente, como tareas que tienes que
hacer todos los días donde subes un video y
necesita ser
desglosado en un carrete vertical, carrete horizontal, y
tal vez uno cuadrado, puedes construir un flujo
basado en eso y automatizar
ese proceso. Entonces básicamente la entrada sería la música y
tal vez algunos títulos. Tendrías 11 laboratorios, lo
dividirías en tres
versiones del video y luego lo refinarías con
tal vez más contenido de IA, música de
IA, voz y entregarte
ese producto final. Ese es un ejemplo de flujo. Si quieres, podrías
dejarlo hasta 11
laboratorios completamente. Es muy fácil de usar. No es necesario usar
una redacción específica. Solo dices lo que quieras, y luego
te ayudará en el camino. Así que volviendo, ahora
podemos pasar a cómo empezar a generar
cosas con ElevenLabs Primero vamos a empezar con imágenes. Así que justo por aquí. Y vamos a ver cómo funciona toda
esta interfaz. Así que vamos a saltar de inmediato.
33. Generador de imágenes: Entonces la primera opción aquí es
usar esto como referencia. Así que de nuevo, esta es una
plantilla que podría dar 11 laboratorios para generar nuevos. mejor esta vez, podría tener un pingüino
exactamente en esta misma pose Pero para poder
describir mejor la pose, solo
podría subir
esta imagen como referencia para la
herramienta a seguir. Eso es una referencia, y luego
tenemos una imagen de lujo que
va a aumentar el tamaño y la resolución de
la imagen actual, hacerla de alta calidad Por ejemplo, si es
una imagen de 500 por 500, podría
escalarla al tamaño o incluso más grande y usarla
para diferentes propósitos Puedes recrear algo, así que básicamente pon en este prompt, pero mira qué sale de él. Entonces va a verse un
poco diferente. Podemos usar esto para los labios. Entonces si ya tengo un audio, podría hacer que este tema
básicamente hable ese audio. Entonces va a esta opción va a trabajar en los labios, el movimiento,
las expresiones faciales, y todo eso. Y por último,
hemos creado video, así que esto podría ser solo emoción. Podría ser el sujeto haciendo algo o
simplemente ahí parado, cosas que podemos definir
usando esta opción. Así que aquí
se están haciendo muchas cosas geniales. Tenemos maquetas. Tenemos arte. Tenemos algunas técnicas
como la fotografía aquí. Tenemos algunos diseños, carteles, ilustraciones,
y así sucesivamente. Entonces vamos a hacer un ejercicio muy sencillo
ahora mismo donde
probamos nuestro primer prompt y luego veremos cómo
podríamos construir sobre eso. Entonces lo que voy a
hacer es escribir mi tema. Quiero una mujer, y sólo voy
a enviar esto. Entonces estoy tratando de mostrarles el poder de un
prompt y lo bien va a ser
la salida si describen mejor las cosas y
siguen cierto formato. Ahora necesito ver
qué
está haciendo esta mujer . ¿Está sentada? ¿Está de pie,
acostada, qué está pasando? Necesito mencionar
eso. Entonces una mujer sentada en una silla. Entonces esto de aquí
básicamente establece una escena. No hay suficientes detalles,
pero sólo vamos a enviar esto con
uno de nuestros modelos. Así que de nuevo, podemos ir a la imagen, y hay un montón de modelos
que ustedes pueden explorar. Para comenzar, puedes probar
uno de los modelos de tendencia. GPT en este momento es muy
famoso por la imagen. Nano Banana también es muy
bueno para los personajes, el realismo, y todo eso. Voy a quedarme
con el modelo más nuevo aquí
mismo y dar clic solo
en eso. Así que tenemos nuestro conjunto de modelos. Ahora podemos describir básicamente establecer la
relación de aspecto para el producto final. Yo iré con el plano de paisaje. A continuación, tenemos la resolución, sólo para conseguir una generación rápida. Voy a
mantenerlo al mínimo. Calidad, solo voy a ir con
alto en algún lugar en el medio, y luego tenemos generaciones. Entonces, ¿cuántas versiones quieres que hagan
11 laboratorios
basados en este prompt? Voy a hacer cuatro solo para que
podamos ver en qué se diferencian. Y por último, tenemos esta herramienta de edición que
ayuda a mejorar su prompt. Pero como estoy tratando de mostrarte la diferencia entre las indicaciones, voy a apagarlo. Así que solo asegúrate de que eres
imagen, pon tu prompt, este prompt exacto o
algo más que
prefieras estos ajustes,
y vamos a enviar esto. Aquí están mis diferentes versiones. Tenemos una habitación similar. Tenemos un tema similar. Solo están en diferentes
playeras y diferentes poses. Pero parece
que es el mismo sofá. Hay una ligera
diferencia entre ellos. Entonces ahora mismo, sí me dio a
una mujer sentada en una silla, pero en realidad no tiene
nada único en ella. Parece una
imagen de stock, básicamente. Pero ahora,
lo que sea que tenga en mi mente, lo que sea que esté imaginando
para esta mujer, ahora
puedo describirlo
construyendo sobre esta pronta Entonces, o haga clic en esto
o escriba nuevamente el prompt. Ahora vamos a agregar
algunos detalles más. Como puedo ver las
diferentes versiones, podría simplemente reducir
esto a dos, que genere más rápido, y podamos pasar por
esto un poco más rápido. Entonces una mujer
sentada en una silla, incluso
antes de que
mencionemos a la mujer, podemos ver cómo se ve. Entonces en términos de edad, en términos de tal vez etnicidad, y luego después de eso,
¿cómo se ve su cabello? Cuál es el color del cabello, cosas que podemos
describir mejor a la persona. Para que podamos ver a una joven
este caso con, digamos, pelo
rubio esta vez, vamos a
hacer el pelo rubio opuesto y ojos azules
sentados en una silla. Entonces ahora mismo, solo
la mujer sola, estamos agregando más
detalles que pueden hacer básicamente
salga de
los siguientes resultados, e incluso podríamos agregar algunos más. Entonces ella está
sentada en una silla, tal vez, ¿cuál es la silla? Exactamente, ¿qué aspecto tiene? ¿Hay cierto color?
Eso lo podemos mencionar aquí. Sentarse en una silla aterciopelada, y luego podemos mencionar
más sobre su pose. Se puede decir con una pose
inclinada hacia adelante y una cara segura Algo así. Entonces más
detalles, podemos poner eso en. Y también podríamos mencionar
cosas sobre los antecedentes. Entonces ahora mismo,
sólo voy a mandar esto con el femenino solamente, sin mencionar
los antecedentes, y podemos ver como
el nuevo resultado
va a ser un poco
diferente al primero. Esto terminó
encerrado porque
probablemente por la pose inclinada hacia adelante, a veces
con redacción, puede mandar algunas bengalas, puede mandar algunas bengalas, pero acabo de quitar
lo de inclinarse hacia adelante y
acabo lo de inclinarse hacia adelante y
acabo Entonces, si te encuentras con este problema, solo altera un poco tu
prompt. Entonces esta es la pose que obtuve. No es exactamente
lo que buscaba, pero puedes ver la diferencia entre esta imagen
y esta imagen. La silla es efectivamente aterciopelada. Ella es rubia, y
sí tiene ojos azules. Ahora si quiero, podría poner el mismo carácter
en esta posición, digamos, me gusta mucho
este fondo. Ahora podría usar esta
pose como referencia, digamos, esto es
lo que buscaba. En lugar de tratar de alterar esto, podría hacer referencia a esta imagen. Entonces solo voy a hacer referencia a esa primera imagen y
tener mi prompt como está. Y básicamente, la herramienta
necesita reemplazar su cabello y la silla y
darme una nueva foto. Entonces ahí está mi nuevo modelo. Ella está exactamente en esta pose, pero es rubia y la
silla se ve diferente. Entonces esto es lo que
tenemos ahora mismo. Se ve bastante bien. Y como tengo mi
modelo finalizado, ahora
puedo usar esto como referencia para que
ella haga otras cosas. Por ejemplo, tiene gafas
puestas y está en su teléfono. Esa podría ser una
pose diferente en este escenario exacto. Pero al proporcionar la referencia, podría poner menos presión en el prompt y más
presión sobre lo visual. Si no está seguro de cómo escribir
mejor un mensaje o tiene dificultades para refinarlo a lo que
necesita, puede activar esta función. Entonces, básicamente, esto va a funcionar a través del prompt actual, mejorarlo, y darte
algo que es más adecuado. Así que ahora podría hacer clic en Enhance, y básicamente transformó mi prompt muy simple en
algo más detalle. Así que fluye el cabello rubio, usando palabras que describirían
mejor la textura, la luz, el contraste y todo eso. En lugar de sólo ojos azules, son penetrantes ojos azules. Entonces más detalle.
Y luego el color de la silla, ¿qué
tipo de silla? Y luego la iluminación, ni siquiera
mencionamos la iluminación, pero ahora está haciendo eso por nosotros. Algo sobre la
textura de la silla y, por
supuesto, la
postura que tiene. Diferentes cosas que
podrías hacer aquí también, en lugar de solo mejorar, podrías
refinar aún más la pose. Entonces una
sonrisa sutil, sabia adornando sus labios. Entonces esto es más sobre ella,
la forma en que está sentada. Y entonces, ya
sabes, podrías seguir y seguir agregando
más detalles. Entonces vamos a generar esto con el mismo modelo y todo
y ver qué obtenemos. Retiré la imagen de
referencia. A veces puede encontrarse con
problemas con ciertos modelos. Por ejemplo, este es mi aviso, pero está diciendo que puede que haya violado sus
términos de servicio. Así que ciertos modelos te
impiden usar cierta
combinación de palabras, y eso es solo para mantener segura a
su comunidad. Pero si solo cambio
a un modelo diferente, puede interpretar mi prompt una
manera diferente que no es, ya
sabes, considerada dañina. Así que podríamos probar
tal vez nano banana en su lugar y
probarlo. Entonces ahí vamos. Se puede ver que no nos
topamos con ese problema. Pero aquí solo podemos ver la gran diferencia
entre los modelos. Entonces este es el nano banana. Sabes, parece que
está en un estudio, mientras que el otro
se veía muy natural. Por lo que cambiar de modelo realmente
ayuda cuando
se trata de la entrega visual
de ese prompt. Entonces ese es un ejemplo. Podríamos bajar a Runway AI. Ese es otro modelo y
mira cómo se ve eso. Tenemos Gen cuatro Imagen. Ese es uno de los modelos de IA de
pista. Y hasta ahora, solo estamos
construyendo sobre nuestra pronta. Empezamos con una mujer
sentada en una silla. Aquí es donde hemos terminado. Y, ya sabes, con
diferentes modelos cambiando entre referencias, estamos afinando bien esa
imagen que queremos. Entonces ahí está mi nueva imagen. Es muy
diferente a los anteriores, pero así es como este modelo
está interpretando mi prompt Entonces, muchos modelos por ahí,
cada modelo de IA está
construido de manera diferente, entrenado de manera diferente,
así que espera ver algunas grandes diferencias cuando
cambies entre los modelos. Así es más o menos como
funciona el generador de imágenes en ElevenLabs El propósito de hacer
uno es para que tal vez
puedas cambiarlo
a un video más adelante, combinado con los audios
que ya has realizado Podría ser para crear algo con las
plantillas que
miramos y podrías mantenerlo
dentro de esta plataforma, usarlo para diferentes
salidas o
exportarlo a
otra cosa externamente. Entonces tal vez usarlo en otra herramienta de IA o simplemente
publicarlo en alguna parte. Podrías explorar esta herramienta. Es nuevo, está mejorando. Pero como aquí hay muchas herramientas
externas combinadas, realmente hace que sea
conveniente para ti hacer todo tu
contenido en un solo lugar. Entonces ese es el generador de imágenes. Pasemos al generador de
video, que es la siguiente opción.
34. Generador de video: Similar a como hiciste las imágenes, ahora
puedes hacer videos. Entonces esa es la siguiente
pestaña aquí mismo. Una vez que cambias,
hay un par de cosas
diferentes, pero el concepto central
sigue siendo el mismo en el sentido de que
aún eliges tu modelo, la relación de aspecto, la
calidad y tus referencias. La única diferencia entre imagen y video es
que ahora tienes fotogramas y fotogramas
iniciales y referencias de video y audio. Y claro, la duración porque ahora estamos
trabajando con el movimiento. forma en que esto funciona es que puedes simplemente escribir
lo que quieras y que 11 laboratorios generen un video para ti puramente
basado en el prompt, o podrías tener una imagen generada y luego usarla
como tu referencia. Entonces en esta lección,
vamos a hacer un ejercicio muy sencillo donde generemos la imagen y luego la usemos
como nuestra referencia. Sólo vamos a
cambiar por aquí, y vamos a escribir
algo sobre nuestro personaje. Entonces quiero un video donde el sujeto esté
huyendo de la cámara, y quiero que use, como, un abrigo de invierno y
tal vez corra en la nieve. Entonces esa es mi idea. Sólo tengo que darle vida. Y todo empieza con cómo se ve
mi personaje. Cambiar a imagen. Sólo voy a
escribir a un hombre que lleva
un abrigo de invierno luciendo
muy serio. Y entonces quiero que esto sea de cuerpo
completo e hiper realista. Entonces ahí está mi pronta. Voy a cambiar
a nano Banana, y luego voy a mantener esto en 41k, y haremos una relación de aspecto
vertical Así que no hay referencias
simplemente escribiendo esto, y vamos
a generar esto. Entonces aquí están los personajes. Tenemos nuestro primero, segundo, tercero y cuarto. Ahora podría elegir el
que me gusta y luego usar eso como referencia para definir
más a fondo mi personaje. Así que sólo voy a
ir con este tipo. Creo, ya sabes, él
tiene la configuración completa, y ahora quiero
que sostenga una bolsa. Entonces vamos a usar a este
tipo como nuestra referencia de imagen, y luego vamos a
escribir un nuevo prompt. Entonces un hombre que sostiene una
mochila en la mano, se
puede decir de
qué mano, de qué color es la mochila, pero me la voy a quedar
así. Mismo modelo, mismos ajustes. Ahora vamos a enviar esto. Aquí están los modelos. Ahora sostienen una mochila. De nuevo, no dije realmente de
qué color ni de qué mano, pero creo que esta
se ve mejor porque combina con su atuendo
y tiene los guantes puestos. Ahora bien, esta puede ser mi
referencia de imagen para el video, y también podría agregar en otras referencias como lo
vimos antes. Ahora podemos cambiar a video. Y tener esta imagen como
nuestro marco de partida. Entonces no voy a usar ninguna
referencia para este ejemplo, sino solo el marco inicial porque eso es técnicamente
una referencia propia. Pero en realidad, si
tratamos de hacer ambas cosas, se
puede ver que
no se nos permite hacer eso. Por lo tanto, no se puede tener
un marco inicial final junto a las referencias de imagen o
video. Entonces ahora solo tenemos que describir
lo que está haciendo este hombre. Entonces podríamos decir hombre
huyendo de la cámara persiguiendo. Quiero que esté corriendo
muy rápido. Configuración del nombre. Sólo voy a cambiar
esto a 10 segundos. Y me quedaré con esto hasta 1720, y usaré el
modelo S dance 2.5. Enviemos esto. Entonces eso va a tomar
un tiempo para generar. Entonces al mismo tiempo,
voy a tener otro ejemplo donde quitamos el marco de inicio
y usamos tres referencias. Así mismo prompt, solo vamos
a usar nuestra referencia de imagen, que es nuestro personaje.
Deja caer eso. Video referencia, podría
encontrar un video en línea donde quiero que mi personaje
corra de esa manera. Si solo vamos a la página principal, exploramos video y
buscamos Running Away, podría usar algo
como esto como mi video de referencia. Así. Y para el audio,
en realidad hice uno antes donde escribí
que ese hombre está huyendo, así que corriendo sonido,
respiración pesada, ese tipo de cosas. Si no quieres
hacer tu propio audio, también
podrías buscar
algo en la
pestaña de efectos de sonido descargada y
simplemente subirlo aquí. Ahí está mi audio.
Nuevamente, mismos ajustes. Ahora sólo voy a golpear a Send. Entonces mis videos están hechos. Este es nuestro primero,
donde lo hicimos huir. Entonces podemos ver que proporcionó el ruido de paso, ya sabes, música de
suspenso,
y, por supuesto, él respirando un
poco al inicio Ahora bien, podría guiar el audio, tal vez haber descrito tal vez
el sonido de los pasos, que va a estar
corriendo en la nieve Esto de aquí sonaba como un sonido de botas de goma,
lo cual no era adecuado Pero se podía ver
cómo implementaba ese audio de escena de persecución
usando solo dos palabras. Entonces ese es nuestro primer video. Echemos un
vistazo a nuestro segundo video donde brindamos tres
tipos de referencia. Entonces ese era nuestro tema. Se ve que lleva
el mismo atuendo, más o menos. Entonces tuvimos nuestra videoreferencia, que es bastante idéntica. Por último, tuvimos nuestro audio de
referencia, que era solo la respiración
pesada. Entonces todo eso combinado nos
dio este video. Y se puede ver, en algún
momento se vuelve hacia la cámara y se ve
exactamente como mi sujeto. Entonces ese es el generador de video que
recientemente introdujo ElevenLabs Es realmente poderosa.
Sólo está mejorando. Puedes probar esto con
diferentes modelos, pero ten en cuenta la cantidad
de créditos que va a utilizar porque esto está en el lado
más pesado de la producción. Se puede ver que este clip de
cinco segundos utilizó 15 mil créditos, e hice combinar tres
referencias para hacer este video. Aquí abajo, se podía
ver el tamaño así
como la dimensión,
la resolución. Así que podrías usar esta
información para planificar mejor tu producción sin
quedarte sin créditos cada vez. Ahora, sigamos adelante y veamos la función de sincronización de labios
dentro de ElevenLabs
35. Sincronización de labios: Vimos cómo hacer imágenes de video, y ahora vamos a hacer que nuestros personajes digan
algo con sincronización de labios. Entonces esa es la tercera pestaña, y todo lo que haces realmente
es subir un avatar y un discurso que o bien hiciste en esta plataforma o
lo tuviste de otro lugar. Puedes guiar a la
generación aquí, tal vez hablar sobre
la forma en que se
hacen las expresiones faciales o la velocidad con
la que habla la persona. Así que vamos a
simplemente hacer clic en Avatar. Puedes
subir una imagen para tu avatar o seleccionar
una que ya exista. Si quieres hacer
tu propio avatar, puedes hacerlo con la pestaña del generador de
imágenes. Lo único que
debes tener en cuenta es que quieres que la
imagen esté
lo suficientemente cerca del
rostro del sujeto porque gran parte del foco y
la generación
va a estar alrededor de la
cara y la boca. Entonces esta imagen de aquí mismo, el personaje está un poco
más lejos de la cámara, así que podemos terminar con
algunos glitching en la cara cuando ElevenLabs está tratando de
hacer que Pero cuando vas a la página de inicio, puedes ver que
tenemos algunos avatares. Entonces, cuando hagamos clic en Ver todo, note lo cerca que está el
sujeto de la cámara, y esto
realmente va a ayudar con más básicamente haciendo gestos
naturales, movimiento
natural de los labios,
y todo eso. Básicamente, vas
a hacer clic en Avatar, seleccionar Avatar y luego
elegir lo que quieras Una vez que haces clic en
ellos, en realidad obtienes más opciones sobre el
posicionamiento del sujeto, la ropa que
lleva, la ubicación. Y se puede ver que
tengo muchas opciones. Entonces, si voy con éste, podría dar click en tu estilo
y luego ir por el discurso. Podría ser texto a voz o algo que haya subido Entonces, si haces de texto a voz, este es nuestro párrafo guardado
de hace un par de lecciones, y podría simplemente
usar el discurso que
hice en esa lección o generar uno nuevo con
una Yo solo voy a hacer clic
en el último, y podrías simplemente hacer clic en texto-a-voz o
subir Si quieres hacer
tu propio Avatar, sólo
tienes que dar click
en Nuevo y ya sea crear la cara a partir de un prompt
o subir imágenes de referencia. Entonces básicamente, si
entro en alguno de estos, puedes ver que hay muchos ángulos diferentes desde
ese personaje. Y eso es básicamente lo
que quieres con tu avatar. Entonces, si me
dirijo a subir imágenes, voy a necesitar diferentes
ángulos de mi tema. Y eso es algo que otra vez, podría hacer en ElevenLabs o algo que pudiera hacer
con mi propia cámara Así que sube las imágenes. Se recomienda diez. Puedes usarlas como referencia si quieres tomar
tus propias imágenes, o podrías dejar que 11 laboratorios creen cada una para ti
y simplemente subirlas aquí. Puedes darle
un nombre y una voz al Avatar ,
y eso es todo. Sólo tienes que hacer clic en Crear Avatar. Si quieres comenzar
desde un prompt, no
necesitas subir ninguna imagen ni ninguna
referencia en absoluto. Simplemente describe
cómo se ven, la forma en que se mueven, y eso es. único problema con esto es que
es posible que tengas que hacer mucha edición para que 11 laboratorios
entiendan tu avatar ideal. Entonces, si tienes las imágenes o
si las has hecho aquí, es mejor optar
por esta opción. Así que solo elegí mi avatar
y voy a hacer un texto-a-voz,
algo Solo hay que cambiar
la voz a, ya sabes, la voz del avatar porque
esta es una plantilla. Entonces sólo voy a recortar la mayoría de este
párrafo y hacer que diga esta
frase muy informativa, genere discurso. El viernes pasado, alumnos de la Escuela Primaria
Sunshine plantaron 20 árboles jóvenes en
el huerto escolar para mantener el ambiente
limpio, verde y fresco. Una vez que esté contento con esto, podría usar el discurso
y luego enviarlo. Aquí abajo, sí
tenemos algunas opciones. Ya sabemos
cuáles son estos dos, pero este tipo es básicamente
el modelo para la sincronización de labios Entonces es la misma idea que la
imagen y los modelos de video. Sólo estos están hechos para
un propósito diferente. Puedes ir con cualquiera de estos, pero yo solo fui con
el más trending. Ahora, mientras esto se está cargando, podríamos dedicar algún
tiempo a generar nuestro avatar para ver
qué tan bien funciona eso. Nuestro avatar ahora está
diciendo nuestro discurso. El viernes pasado, alumnos de la Escuela Primaria
Sunshine plantaron 20 árboles jóvenes en
el huerto escolar para mantener el ambiente
limpio, verde y fresco. Se podía ver el movimiento de los labios. Según las palabras
que se están
diciendo, sí tiene algún
movimiento en su cuerpo. Él mira a la cámara, y
tiene ese podcast
como wipe to it. El viernes pasado, alumnos de la Escuela Primaria
Sunshine así que, por
supuesto, la moción no
es tan natural. Esto es sincronización de labios con IA, pero podría ser útil para
ciertos tipos de contenido Y puedes explorar esto
con otros avatares, incluso hacer tu propio avatar. Puedes ver cómo puedes combinar tu audio ya sea con un avatar como este o con un contenido de video que hicimos en la lección
anterior. Entonces, estas son dos opciones para hacer que tus clips sean más atractivos
mientras muestran la calidad de tus voces generadas por
IA. Mm hm
36. Con ElevenLabs.: Si alguna vez terminaste con
una imagen que no es la mejor calidad o
simplemente quieres cambiar
el tamaño de la misma, ahora
puedes usar
upscaling en ElevenLabs Entonces solo fui a mi carpeta de
activos y
subí una imagen
que hice con IA. Por lo que actualmente,
se ve así. Es un primer plano del ojo de un hombre, pero quiero agregar más detalle Quiero que sea más grande. Y en lugar de ir a
otra herramienta pagando por ello, podría simplemente, ya sabes,
entrar aquí con la misma suscripción
y de lujo Haz clic en Upscale, y te va a llevar a la pestaña de
imagen y video Ahora mismo, esta es la imagen
que vamos a mejorar, y simplemente
eligió automáticamente este modelo Entonces este es el único modelo en este
momento que hace el upscaling Y luego del lado derecho, podemos decidir el tamaño de la misma. Así que voy a ir hasta
el máximo solo para que podamos ver la diferencia,
y eso es más o menos todo. Por lo que no es necesario escribir nada ni dar ninguna
otra referencia. Simplemente lo envías, y
va a mejorar tu imagen Se ha hecho de escalado. Está arriba por cuatro veces. Esta es la
imagen original que hice. Se ve así,
bastante detallado ya. Pero presta atención
al tamaño aquí. Este es el tamaño y la dimensión actual en
píxeles de esta imagen. Luego lo realicé
usando el modelo, y ahora podemos mirar el tamaño así
como la dimensión
nuevamente en píxeles Entonces eso es una mejora
en cuatro veces, y ahora puedo usar esto para proyectos
más grandes sin
perder calidad alguna. Eso es más o menos como
podrías mejorar. Podrías
mejorar aún más la imagen de lujo. Así que sólo voy a ir a
la que acabo de lujo. Todavía tengo la opción de
hacerlo más grande. Así que podría ir a esta talla
ahora y enviarla. Pero eso solo va a construir sobre la
imagen previamente ampliada. Es una
herramienta bastante sencilla si sientes que, ya
sabes, la imagen que
cortas no tiene más detalles. Podría ser más crujiente. Puedes usar esa característica para, ya
sabes, hacerla
muy detallada, mucho más grande, pero
ten en cuenta que también se va
a aumentar
el tamaño. Para que puedas seguir adelante y
probarlo con las
imágenes que hemos estado haciendo y comparar
los diferentes tamaños.
37. Flujos: Todas las nuevas herramientas
aquí realmente te dan la posibilidad de ampliar
tus salidas creativas. Entonces esto podría ser música, efectos de
sonido, video, imagen y las herramientas clásicas de voz a texto
o de texto a voz Pero flujos lleva todo eso
al siguiente nivel y te
permite básicamente
tener un lienzo para generar el contenido
con todas estas herramientas. Entonces es un tipo de
diseño muy diferente a lo que hemos estado
acostumbrados todo este tiempo. Lo vamos a estar
explorando en esta lección. Sabemos que el estudio se puede
usar para producciones más grandes, pero los flujos te dan un diseño completamente nuevo donde puedes arrastrar y
soltar diferentes herramientas, conectarlas
y trabajar con ellas como
si fueran nodos. Entonces, si estás
familiarizado con los nodos, es más o menos esa misma idea. Creas uno, lo conectas y construyes un flujo. Entonces aquí hay algunos ejemplos en los que
se puede pensar en un producto final, pero luego ir hacia atrás y ver cuáles eran los diferentes
componentes. Entonces este tipo de aquí mismo,
si hacemos clic en él, podemos ver los flujos que
hay detrás de esta producción. Parece mucho. Y estas son cosas a las
que quizás no le prestemos atención porque
solo estamos viendo el producto final. Entonces, básicamente, si nos acercamos, se
puede ver cómo
surgió todo y dónde estaban los puntos de
partida. Entonces tenemos los diseños iniciales. Tenemos el texto. usar la barra espaciadora
para mover el lienzo. Entonces tenemos texto diferente,
nuevamente, algo más de texto porque
este es un video explicativo Um, y luego voy
a encontrar las imágenes. Entonces estos son los visuales
que no se generaron, y luego pude mover
cada una de estas notas Entonces ahora mismo si
miras esto, es mucho, pero voy a
mostrarte cómo
podrías hacer tu propio flujo, y entonces todo
esto va a tener sentido. Entonces esto es sólo un ejemplo
de lo que parece. Si volvemos atrás y
flotamos sobre esto,
esto es lo que ese diagrama de
flujo dos Así que vamos a hacer clic en Nuevo flujo, y nos vamos a encontrar
con un Canvas en blanco. Así que solo para repasar la
interfaz muy rápido, tenemos el menú
en el lado izquierdo. Para que puedas hacer un nuevo flujo, acciones
rápidas,
darle un nuevo nombre, duplicar compartir,
crear una plantilla basada en este flujo que
vamos a hacer. Incluso ve tu historial de versiones. Así que podrías volver
a una versión anterior. Primero, vamos a darle un nombre a
nuestro flujo. Vamos a llamar a esto
mi video de flores, tal vez. Y el concepto que
tengo en mi mente es como una maceta donde una nueva
planta está creciendo dentro. Entonces ese es mi concepto, y voy a hacer
un flujo basado en eso. Entonces, antes de hacer clic
o escribir algo, vas a necesitar algunos componentes
diferentes que van a llevar
a ese producto final. Sé que mi producto final
va a tener un visual, un video, y un video
va a necesitar algunas referencias de
imagen. Entonces eso ya son dos cosas. Va a necesitar un audio. Tal vez eso podría ser una voz en off, así
como algo de música de
fondo, y también quiero agregar algunos efectos de
sonido Para ayudar a escribir el contenido de
voz en off, también
voy a
usar IA para Entonces, si cuentas todos esos, van a ser
múltiples componentes. Pero a partir de ahora, voy a llamar a
esos componentes nodos. Así que simplemente haz click derecho
sobre este
Canvas, vas a tener la
opción de agregar un nuevo nodo. También puedes presionar N en tu
teclado para una acción rápida. Así que las notas pueden diferir. Podría ser una imagen, video, texto a voz,
sincronización de labios y Entonces estas son todas las cosas que hemos mirado
hasta ahora. No es nada nuevo. La única diferencia
es que ahora hay partes
más pequeñas que juegan un
papel en una producción más grande. Entonces estos son todos como actores en una película más grande, básicamente. Entonces como dije, voy a necesitar una imagen para comenzar. Así que vamos a hacer clic en esto, y
vamos a conseguir esta caja. Ahora bien, la interfaz aquí es lo que hemos estado
haciendo todo este tiempo. Tú eliges tu
modelo, la relación, resolución, calidad, y luego escribes tu
prompt, pulsas Run. La única diferencia aquí es que tenemos estas
cosas a un lado. Entonces estos son los conectores. Entonces, ¿qué se va a hacer con esta imagen
después de que esté hecha? ¿Va a vincularse a
una producción de video o va a ser el
resultado de un cuadro de texto? Entonces aquí es donde va a tener más sentido la idea
del nodo . Entonces, en vez de escribir
algo aquí, voy a hacer un texto no de esa manera podría
tener diferentes modelos, hacer ese mismo prompt, y luego podría elegir el
que sea mejor para mí. Esa es mi imagen aquí mismo. Volvamos a hacer clic
derecho, agregar nodo, y vamos a bajar o simplemente ir aquí para el
texto y elegir texto. Ese es mi cuadro de texto. Podría empezar a escribir o me
vendría bien la ayuda de un modelo de lenguaje
grande. Entonces digamos que no sé cómo escribir mi prompt para esa maceta, podría crear otro nodo. Necesito la ayuda de un LLM. Pongamos eso aquí. Bajemos. Y ahora
tengo tres cosas. Y sólo para decirte cómo es
el flujo hasta ahora, vamos a tener
un prompt generado por Gemini o cualquier otro
modelo que queramos. Eso va a llevar a este cuadro de texto donde pude
ver mi prompt finalizado. Este prompt de texto va a llevar a la generación de imágenes. Entonces la imagen se va a
hacer en base a este tipo, y este va a ser
el resultado de este tipo. Entonces hay un conector,
0.10 0.2 0.3. Entonces comencemos
aquí mismo con nuestro LLM. Se puede ver que todavía tenemos
algunos puntos de referencia, pero sólo voy a tener
este sea el punto de partida. Entonces digamos que dame
un prompt de imagen para una bonita maceta que no tiene planta en
ella y es solo tierra. Haz esto en interiores
con buena iluminación. Entonces ese es mi aviso. Básicamente tengo una idea hasta ahora. No voy a tener
el prompt final aquí, y ahora solo voy a
elegir mi modelo. Entonces esto podría ser cualquier cosa. Digamos que quieres
hacer Géminis está bien aquí. Entonces puedes elegir el
modo para ese modelo. Entonces, si eres cada uno de estos modelos van
a tener su propio modo. Entonces, por ejemplo,
si elegí a Claude, voy a tener
diferentes opciones para el razonamiento y el pensamiento, y todas estas darán como resultado cosas
diferentes porque estamos tratando con diferentes modelos. Y entonces tenemos
más aquí también. Así que vamos a ir
con el Gemini 3.5. Voy a hacer mínimo. No
es necesario pensar mucho. Aquí podemos decidir
sobre la longitud. Esto podría ser automatizado. Voy a dejar
totalmente a Gemini decidir la duración
de mi prompt final, y entonces podremos
empezar a correr esto. Pero antes de hacer eso,
voy a señalar la salida, que está del
lado derecho a mi cuadro de texto. Entonces estos son insumos.
Estas son salidas. Usa la barra espaciadora para
mover el lienzo. Así que también podría usar esto
realmente como mi idea de entrada. Entonces, vamos a
desglosar esto aún más. Copiemos lo que
escribí y lo pongamos aquí en su lugar y
utilicemos esto como entrada. Así que solo conéctalo a. Esa es nuestra primera conexión. Se puede ver que
el contorno se volvió más oscuro y estamos
viendo una línea real. Siempre podría cortar esta conexión para que ya
no estén relacionados, o simplemente podría hacer
una nueva así. Entonces ahora lo está haciendo en el texto. Ese es el nombre de esta caja. Si cambio el nombre, llamemos a esto mi idea. Eso va a
cambiarse aquí también. Entonces es decirle a
esta caja que mire a este tipo para comenzar
con ese aviso. Entonces, a mi idea, vamos a golpear a Run ahora. Usando nuestro Gemini 3.5. Entonces va a generar un
bonito prompt para nosotros que ahora podría conectarme a mi
nodo de imagen. Entonces voy a llamar a esto. Entonces este nombre está bien.
Ahora voy a generar esto como entrada de texto
para mi nodo de imagen. Si quieres,
también podrías hacer tus cambios, ejecutarlo de nuevo y luego hacer esto, pero voy a estar usando
este prompt tal como está. Entonces ahora fíjate que dice
en LLM aquí mismo, y voy a tener este nodo de imagen generado
con mi modelo favorito Entonces voy a hacer nano Banana, elige la relación Aspec Voy a hacer un cuadrado por ahora, la calidad y todo, las cosas que hemos usado hasta ahora, y voy a golpear a Run. Entonces eso va a hacer lo suyo. Pero digamos que quiero
hacer múltiples modelos. Entonces esto no es suficiente para mí. También quiero probar JAGBT. Quiero probar básicamente
un montón de otros modelos para determinar cuál
es el mejor para mi proyecto. Vamos a hacer clic derecho de
nuevo o simplemente hacer clic y arrastrar. Y una vez que sueltes, te
va a preguntar, bueno, ¿a qué
va a llevar esto? Entonces solo volveré a hacer
generación de imágenes. Y esta vez podemos
elegir otra cosa. Entonces vayamos por Cream
y luego golpeemos a Run. Ahora mi texto lleva
a dos cosas. Tuvimos nuestra primera
imagen, segunda imagen. Podría hacer
una tercera, una cuarta. Mientras estén
conectados a esto, este va a
ser su pronta. Podrías, por supuesto, escribir
el prompt directamente aquí, pero crear un flujo
como este te da mucha más flexibilidad a la hora de editar y, ya
sabes, refinar tu proyecto. Entonces vamos a hacer que
este tipo haga lo suyo. Se puede ver que está
cerca de 30% hecho en este momento, y podría seguir
construyendo con base en esto. Ahora, también podrías agregar una referencia de imagen haciendo clic
derecho,
agregando otra imagen. Así que vamos a la imagen aquí mismo. Haga clic en Generación de imágenes.
Ahora, por aquí, podría escribir algo. Podemos decir básicamente esta idea, pero sin contar el bote. Quiero hablar de la habitación. Entonces voy a decir una
acogedora sala con ventanas abiertas
y muebles azules, algo que podría ser un poco
diferente a lo que tenemos. Entonces podrías volver a usar un modelo de lenguaje grande para
ayudarte a escribir el prompt, pero voy a hacer
algo muy sencillo, y voy a usar nano
Banana para esto ejecutarlo. Entonces aquí está nuestra segunda imagen. Se puede ver lo
diferentes que son. Y ahora podría conectar
esto a otra cosa. Pero primero, quiero usar esta habitación y que sea una referencia de
imagen para este tipo. Di, Esto es más ideal
para mí que para esto. Ahora podría conectar
esta salida de imagen como entrada de imagen para esta olla. Así que vamos a mover esto aquí. Vamos a darle un nombre, en realidad. Entonces voy a decir que esto es referencia
de imagen. Esta es la Imagen uno. Digamos. Esa es la imagen dos, solo para que sepas a lo que me
refiero. Todo bien. Una vez que tenemos nuestra imagen etiquetada, ahora
podemos tomar esto como
entrada para un video. Entonces aprendimos sobre los videos. Aprendimos que tenemos
marcos de partida y
referencias de imagen involucrados. Entonces esto ahora podría llevar
a mi metraje de video. Así que haz clic y arrastra, suelta, y vamos a elegir Generación de
video. Ahí está. Aquí puedes ver que
tenemos múltiples entradas, igual que vimos en
las lecciones anteriores,
tenemos
fotograma inicial, fotograma final, imagen, referencia de video
y referencia de audio. También tenemos la entrada rápida. Esto podría ser lo que
escribas aquí, o podría ser un cuadro de
texto como este. Sólo voy a hacer que
esta sea una referencia de imagen. Entonces vamos a darle a X y luego
conectarlo de nuevo usando esto. Entonces eso es lo que va a ser. De esta manera, podría
reconectarlo a la entrada que quiera. Pero en realidad me di cuenta de que
queríamos rehacer los antecedentes Entonces ahora que tengo
dos cosas conectadas. Original prompt y
este nuevo fondo, vamos a golpear run de nuevo. Entonces eso va a rehacer todo
el trabajo y
darme la misma maceta Entonces ahí está mi maceta. Pudimos ver que
integraba el azul, no tanto el sofá, pero eso está bien para mí. Ya que solo
quería mostrarles cómo una referencia de entrada va
a cambiar el resultado. Entonces ahora que tengo
una maceta azul, voy a usar como referencia de
imagen
o como fotograma inicial. Ing en lo que necesitas.
Y voy a tener uno de estos modelos. Haré baile de semillas. Tener un brote básicamente de semilla en una harina de esta misma olla Así que la semilla brota en la olla
convirtiéndose en un bonito rojo. Flor. Elija la configuración. Voy a hacer cuadrados, ya que eso es
lo que estamos haciendo hasta ahora, la resolución, y luego
puedes elegir la duración. Voy a silenciarlo aquí
porque quiero hacer otro nodo para el
audio. Así que vamos a ejecutar esto. Si quieres, podrías tener
otro modelo de lenguaje grande. Nodo, esté aquí para crear
un mejor prompt para usted. Pero solo vamos
a hacer lo que tenemos ahora mismo y ver
qué viene como vimos, también
podríamos hacer
múltiples notas para video donde
probamos diferentes modelos, y luego podemos elegir
el que preferimos. Ahora, mientras esto está funcionando, vamos a
trabajar en el audio. Entonces en algún lugar a lo largo del lienzo,
voy a escribir click. Agregar nodo, pero esta vez, vamos a ir por el audio. Esto podría ser texto a voz, efecto de
sonido, música o cualquier otra cosa que
quieras comenzar Vamos a hacer
clic derecho aquí y hacer una nota de audio simple. Haré texto-a-voz, y haremos una frase muy sencilla Entonces podemos decir nuevos comienzos y nuevas flores
todos aquí para quedarse Algo así,
elige tu voz, y también podrás trabajar
con la estabilidad, elegir tu modelo, y
luego hacer clic en Ejecutar. Entonces son 3 segundos. Nuevos comienzos y nuevas flores todo aquí para quedarse. Muy bien. Y entonces podría
combinar esto en, ya
sabes, mi video aquí mismo
y obtener mi resultado final. Así que solo arrastra esta salida de audio y ponla como
entrada de audio. Mueve esto a un lado. Y hasta el momento, tenemos
este, ya sabes, mapa
mezclado todo lo que lleva a
nuestro metraje final exportado. Ten en cuenta que cada uno de estos sí toma sus propios créditos. Así que asegúrate de que se te asignen suficientes
créditos para eso. Voy a dejar el
mío así, pero si le pegas a volver a ejecutar, va a aplicar este audio
en el metraje Una vez que hayas terminado
con tu video, aunque esto aún no está
realmente terminado, tienes la opción de
copiarlo, duplicarlo, tal vez conectarlo
a otro donde tengas a alguien agarrando la
olla o una escena diferente. Puedes hacer una plantilla a partir de todo esto
con este botón. Se puede descargar cuando esté listo. Y como esto es un lienzo, también
puedes invitar a otros miembros del equipo
a que entren aquí y, ya
sabes, te ayuden junto
con este proyecto. Hay algunas herramientas para eso. Tenemos nuestra herramienta Mover,
nuestra herramienta de selección. Tenemos nuestra herramienta Mover, que es lo que hemos estado usando
con una barra espaciadora. Tener la herramienta de comentarios. A lo mejor un amigo entra aquí y piensan que el
sofá debería ser leído. Podrían dejar un comentario, y va a ir aquí. Entonces hazte rojo, guarda el comentario, y ahora va aquí. Podría resolver el comentario, estar en desacuerdo o estar de acuerdo, o
dejar otro comentario. También puedes eliminar el
comentario de las personas si quieres. Ahora bien, si no estás seguro de cómo empezar con
todas estas notas, también
puedes empezar a
chatear en este cuadro. Entonces digamos que puedes escribir sobre la escena
final que quieras, una maceta donde está creciendo una
nueva planta. Puedes escribirlo aquí, y luego ElevenLabs guiará
esa producción por Si tienes referencias
guardadas en tu dispositivo local, puedes adjuntarlas aquí, y podrías enviar
esa solicitud en. Ahora bien, digamos que este es un
flujo de trabajo que hago muy a menudo para otros proyectos
para mis redes sociales tal vez. En lugar de crear todo
este diseño de nodo, podría crear una plantilla. Doy click en esto, solo tengo que
identificar las entradas, salidas, y el formato de publicación. Entonces las cosas que solo
tienen algo saliendo del
lado derecho son las entradas. Entonces este tipo no tenía insumos, por lo tanto, es su propio insumo. Entonces es solo un solitario como
este. Este es mi aporte. Puedo seleccionarlo, y
va a ser marcado como naranja. Y entonces podría hacer lo
mismo con output, darle un nombre, y luego
podría publicar mi plantilla. Entonces eso es algo
que también podrías hacer. Aquí está mi video. Tenemos, ya
sabes, una semilla que brota Parece algo mágico, pero es una flor roja. Entonces podríamos extender esto
a un nodo diferente. Entonces un extensor de video nota, si queremos darle la vuelta de
4 segundos a 20 segundos, podríamos hacer doblaje, mezclarlo con un audio,
usarlo como referencia Y se puede hacer mucho más. Así que adelante y
prueba los flujos. Es una herramienta nueva, y es realmente genial, en realidad. Y realmente podrías trabajar
en una producción más grande, combinar diferentes
herramientas como notas y construir un
producto final donde uses diferentes cosas en
ElevenLabs para contar una historia, promocionar un producto, hacer un podcast o cualquier
otra cosa que quieras hacer
38. ¿Qué es ElevenAgents?: Entonces miramos el
lado creativo de ElevenLabs. Miramos la voz. Miramos imagen,
miramos video, y tantas otras herramientas
en el lado izquierdo. Pero también introducen
algo llamado ElevenAgents, y eso es algo a lo que
puedes
cambiar bajando aquí. Así que simplemente haz clic en eso
y vamos a pasar a la siguiente
interfaz, básicamente. Entonces ElevenAgents son
básicamente agentes de IA que puedes usar para
automatizar una determinada tarea, ya sea integrando las herramientas
que tiene ElevenLabs o, ya
sabes, simplemente
manteniéndolo como Entonces una de las
plantillas que puedes mirar es la atención al cliente. Eso es sólo un ejemplo
de un agente 11. Y por otro lado, en
realidad
te dice mucho sobre el
flujo de trabajo detrás de él, cómo está funcionando, y también
puedes previsualizarlo aquí. Entonces ahora mismo,
voy a fingir que, ya sabes, necesito apoyo, y esto actualmente está
tomando en dos integraciones Entonces Saleforce y Zendas tenemos muchas opciones diferentes
aquí Pero la característica principal
son básicamente las herramientas que
ya sabes
usar estando integradas
en estos flujos de trabajo. Entonces, una vez que veamos un ejemplo, va a tener más sentido. Oye, este es Jamie de apoyo. ¿En qué te puedo ayudar hoy? Necesito ayuda con un problema
técnico. Estaría encantado de ayudarle
con ese tema técnico. ¿Podrías decirme un poco más sobre lo que estás experimentando y quizás compartir tu nombre para que pueda investigar tu cuenta? Mi nombre es Alice y
mi computadora se rompió. Lamento escuchar que tu
computadora se rompió, Alice, pero como admito nuestras
plataformas de IA APIs e integraciones, solo
puedo ayudar con
problemas como errores de API, integración o problemas de
rendimiento Entonces eso es sólo un ejemplo. Ya ves,
aunque en realidad no
pregunté para qué sirve el apoyo, todavía entendió mi preocupación, y tomó todos esos insumos. Entonces el inicio fue yo presionando
el botón de llamada. Lo primero fue
identificar el tema. Se abrió calurosamente, lo
que hizo. Y luego acabo de decir que
tenía un problema técnico. Entonces fuimos aquí a proponer
un primer paso concreto, y luego se podría
resolver o escalar. Di, dice, Bien, necesitas proporcionarnos
un número de serie,
y luego yo estoy de acuerdo con ellos. Ahora van a
resolver esto, y luego termina. Si dije que
tengo un problema de cuenta y no tanto un problema técnico, va a tomar
una ruta diferente. Entonces va a
mirar la facturación con mi nombre y luego ver si
llegó a una solución, o ir con la solución
que tiene o buscar más, y luego terminar la llamada. Entonces todo este mapa
es básicamente cómo este agente de IA va a
ser un servicio de atención al cliente. Tenemos cosas diferentes, también, algo un poco menos técnico es un tutor de
práctica de idiomas. Para que puedas empezar de nuevo, y
lo primero que va a hacer es acceder a tu nivel
para ese idioma. Si soy principiante,
va por aquí. Si estoy avanzado,
va por aquí. Principiantes, va
a tener cierto modo. Entonces tal vez usando ciertos dialectos, alejándose de los vocabularios
grandes,
hablando, más lento, esas cosas Y luego termina la sesión. Nos da un resumen. Así que muchas plantillas podrías
mirar, pero, por supuesto, siempre
podríamos hacer las nuestras
propias creando un agente. Para que puedas navegar por las plantillas, hacer ajustes o
crear una desde cero. Entonces vamos a
aprender todo sobre eso. Pero solo para darte un
pequeño recorrido, tenemos las diferentes categorías en el lado izquierdo para
ayudarnos a comenzar. Tenemos agentes creadores, que es donde
estuvimos configurando, las bases de conocimiento que tiene, pude crear y subir aquí
algunos documentos que
serían utilizados para los agentes. Por ejemplo, si
tengo un agente que se supone que debe ayudar a los clientes
con laptops rotas, ese agente necesita saber
mucho sobre laptops. Entonces, en lugar de escribir
todo, podría simplemente tener un
documento cargado aquí y luego conectar esta
base al agente. Así que puede volver a esto, aprender un poco más sobre computadoras portátiles y luego
volver a ese collar. Podría ser una URL, podrías confiar en un sitio web.
Puedes ponerlo aquí. Puedes subir un archivo,
escribir algo, crear una carpeta
con múltiples archivos o sincronizar documentos
desde otras plataformas. Tenemos 21 megabytes
de almacenamiento aquí, lo cual es perfectamente, es
suficiente para documentos, y también podrías ordenar
y buscar De nuestras diferentes herramientas aquí
que podrías agregar. Entonces cualquier tipo de integración
que quieras hacer. Entonces tendría que agregar
una conexión primero. Tenemos muchas cosas que actualmente funcionan con ElevenLabs, y todo lo que tienes que hacer es iniciar sesión
, hacer esa conexión y estará
disponible para que lo
uses en tu proceso de
creación de agentes Entonces estas son las
diferentes categorías, pero las tenemos todas
listadas aquí. Puedes buscar, y
una vez que vuelvas a iniciar sesión, van a aparecer
aquí y solo los seleccionas. Entonces esa es una herramienta de integración. Contamos con herramientas para clientes. Las herramientas del cliente son cosas
que requieren una entrada. Entonces, por ejemplo, la plantilla
que miramos donde el agente preguntaba sobre el tipo de problema
que estaba teniendo, esa es una herramienta cliente. Entonces es como problema técnico
o simplemente tipo de problema, esperar la respuesta del usuario y luego hacer ciertas cosas. Podemos agregar parámetros,
diferentes variables. Incluso edita esto como un archivo JSoD. También tenemos webhook y luego una lista de otras
integraciones que podrías agregar Por supuesto, tenemos nuestras voces. Esto es 11 laboratorios después de todo. Estos se pueden integrar como
las voces de sus agentes. Para monitorear, puede observar
las conversaciones que están sucediendo a medida que implementa agentes, los usuarios y luego las
diferentes pruebas que realiza. Entonces, cuando haces un agente, quieres probarlo, ver si funciona bien, y todos
esos se registrarán aquí. Desplegar, vas
a tener lo siguiente. Por lo que podría implementarse
con números de teléfono a Whatsapps o incluso llamadas por lotes Así que tenemos todos los
niveles que necesitamos para desplegar un agente de IA exitoso. Ahora, primero vamos
a empezar con nuestro agente. Vamos a construir
uno en la siguiente lección, integrar algunas herramientas, probarlo y luego desplegarlo. Para que ustedes puedan
seguir junto con este sencillo agente que
vamos a construir y que vamos a tener
una mejor comprensión de cómo funciona esto y
cómo puede
aplicarlo a su trabajo diario.
39. Crear el primer agente: Así que construyamos nuestro primer agente. Este va a ser
un agente muy simple, solo para mostrarte cómo funciona, y luego a partir de eso, podrías construir agentes
más complejos e integrar cosas diferentes. Entonces, para crear un agente, da clic en este
botón aquí mismo. Y en lugar de
elegir plantillas, vamos a
crear una en blanco. Ahora, las plantillas,
ya las miramos, puedes elegir una que
sea similar a la que
necesitas y simplemente cambiar las
cosas que
son irrelevantes Vamos a empezar
con un agente en blanco. Entonces primero, vamos a darle un nombre a
nuestro agente. Voy a decir proveedor de
información, y lo llamaremos Ben. Entonces puedes elegir
aquí para que esto sea un agente solo de chat
o un agente de audio. Entonces por defecto, es audio
porque esto es ElevenLabs, pero si quieres excluir eso, solo lo
mantienes en el chat Entonces básicamente,
sería similar a los chatbots que aparecen en
el costado del sitio web Pero el audio va a ser algo así como una llamada de alguna manera, donde esperará un usuario ingrese voz
para poder operar. Voy a dejar esto fuera, y vamos a crear a Ben. Entonces aquí está el nuevo agente. Podemos ver que
hay un montón de cosas alrededor que ahora
podemos cambiar. Entonces a la derecha está la
vista previa de nuestro agente. Y porque
dijimos que queremos audio, se
puede ver que tiene, como, un pequeño símbolo de llamada telefónica, y podría hablar con Ben
ahora mismo y que
me ayude con algo. Ahora sí necesitamos tenderle una trampa a Ben porque en este momento
solo es un evitador, básicamente. Lo primero que tenemos que hacer
es decirle a Ben cuáles son. Entonces esto podría ser que eres
un agente de atención al cliente. Eres asistente personal
o algo así. Lo que sea que quieras hacer,
puedes ponerlo aquí mismo. También tenemos nuestra opción generada con IA si no estás seguro cómo escribir
el prompt del sistema. Pero básicamente, si haces
clic en el librito, te
va a mostrar
la guía oficial. Por lo que sí es necesario
configurar el entorno, la personalidad, y diferentes
aspectos de este agente. Para que veas que el tono
es uno de ellos. El objetivo es uno de ellos, y la forma en que este agente debe interactuar y
procesar las entradas. Así que podrías leer la guía
si quieres aprender más. Pero para empezar, solo
voy a hacer que Ben actúe como un agente de voz automatizado cada vez que alguien
llame al negocio, y nuestro
negocio imaginario es una peluquería. Entonces hice un documento
basado en el conocimiento, y eso está disponible para que
ustedes lo descarguen. Y te voy a mostrar donde
puedes subir eso. Pero por ahora, le
vamos a decir a Ben Act. Entonces, digamos que eres
un asistente útil para una peluquería y la gente llamará para preguntar sobre las operaciones
comerciales y los horarios. Tan simple, su
trabajo no es tan duro. Ahora podría usar la herramienta aquí
para mejorar esto aún más. Entonces genera la IA. De hecho, copiemos
esto y lo metamos y veamos qué aviso nos
dará ElevenLabs que
sea más adecuado Así se puede ver que siguió la misma guía tener
personalidad, el entorno. Entonces, con quién están
interactuando, el tono de voz aquí, el objetivo, todo el propósito de este agente, y los rieles de guardia. Entonces lo único que necesito cambiar es,
ya sabes, el nombre. Entonces tú eres Ben. Y olvido cómo se llama el nombre de
nuestra peluquería. Aquí está el documento del que les
estaba hablando chicos. Esto es lo que terminé
llamando a la peluquería, así que sólo voy
a copiar eso en. La peluquería Locke o
Hair Studio, corten eso. Y vamos a revisar el resto. Él lo sabe todo, y luego estás interactuando con los colores, y yo sólo voy a reemplazar
el nombre tanto como pueda. Así que ese es el nombre
de nuestra peluquería. Yo haré Control F,
buscaré el nombre antiguo y solo lo cambiaré. Este es Ben, no Stella. Así que solo haz un poco de limpieza. Bien, así que no más glamour. Y solo voy a verificar por
Stella por si hay
más, y no la hay. Bien, así que tenemos
todo listo para nosotros. No tuve que hacer
mucho, como viste. Entonces vamos a decidir
sobre el primer mensaje. Entonces, cuando la persona llama a Ben, ¿cuál debería ser la respuesta? Entonces, hola, ¿en qué
puedo ayudarte hoy? Podría saludar, soy Ben. ¿Cómo te puedo ayudar hoy? Ahora bien, esta opción permite al usuario
cortarlo y, ya
sabes, decir su mensaje
urgente. Pero si quieres que
continúe y diga lo que quiere, simplemente
puede apagar esto. Entonces todo esto está bien.
Siguiente es la voz. Entonces tenemos muchas
voces para elegir. Voy a ir con Eric porque es uno
de los valores por defecto, y es bastante suave
para este propósito Nosotros sí tenemos algo
llamado modo expresivo, que va a ser más, como ellos lo llaman,
emocionalmente inteligente. Entonces, cuando se trata de
pausas para, como, hacer diferentes sonidos,
va a ser menos robótico Entonces si el usuario dijo, me caí por las escaleras, no
van
a ser como, Oh, eso es genial. Hagamos esto. Van a ser más
expresivos y sonarán más humanos. Entonces eso es algo que
podrías agregar si quieres, o podrías
descartarlo por completo. Hasta usted. Entonces
lo habilitaré para mi propósito, y simplemente cerraré
esto ahora mismo. Se ve que está
encendida, y es Eric. A continuación, tenemos el idioma. Solo podemos hacer que la gente
hable en inglés con Ben o agregue otros idiomas.
Eso depende de ti. Y entonces tenemos
nuestro modelo de lenguaje. Entonces hay un par de
cosas por empezar, me voy a quedar con el valor por defecto. Pero si quieres
construir tu propio modelo, oh, eso es algo que
puedes hacer aquí mismo. Es un poco
más intensivo, así que voy a dejar esto
fuera por ahora solo para que podamos poner en marcha a nuestro
sencillo agente. Entonces ese es el comportamiento predeterminado
y luego del agente. Básicamente se puede
configurar el comportamiento donde funcione
con otra herramienta, y hay una rutina que
este agente necesita seguir. Por ejemplo,
todos conocemos WhatsApp. Eso es como una plataforma de mensajes de texto. Entonces, si alguien les envía un mensaje de texto, primero tiene
que
leer el texto y luego responder al texto y llamar también. Entonces estas son cosas que
WhatsApp permite que la gente haga. Y por lo tanto, ese agente
necesita seguir ese comportamiento. Esto va a ser
diferente para el escritorio fresco, así que eso va a estar
respondiendo solo a los boletos. Entonces cada uno de estos
tipos es un poco diferente. Y si
los eliges, van a
haber opciones adicionales para ellos. Pero de nuevo, voy
a mantener todo por defecto solo para que
podamos empezar. Así que apague eso, y ahora
hemos hecho nuestro agente. Sigamos adelante y
agreguemos una base de conocimiento, que es donde creamos un espacio lleno de información
sobre nuestra marca. Entonces en mi caso, ese es
el estudio de peluquería, y necesito darle a
Ben el horario comercial, el tipo de servicios
para que cuando alguien llame a nuestro
número y conteste, sepa exactamente cómo
responder a las preguntas. Mmm
40. Integrar: Entonces, hicimos nuestro agente
en la lección anterior. Sigamos adelante y le demos algunos conocimientos a
Ben. Sólo vamos a
bajar a la base de conocimientos, y vamos a
subir el documento que mencioné que está
disponible para ustedes chicos. Esto también podría ser una URL
o un archivo diferente. El mío va a ser un archivo, así que vamos a subirlo ahora. Entonces ahí está el archivo. Podemos guardarlo en
nuestra carpeta actual. Sólo vamos
a agregar el archivo. Entonces ahora mismo, lo que sea que
agregues aquí va a la base de conocimientos para Ben porque ese es el
espacio de trabajo en el que estamos. Entonces, si quieres
eliminar algo, podrías simplemente hacer clic en
separar del agente, y eso va a estar
fuera del alcance de Ben Pero sí quiero quedarme con eso, así que ahora vamos a usar esta integración para ayudar a Ben
con su trabajo, básicamente. Aparte del documento como base, puedes integrar diferentes
herramientas para tus agentes. Entonces hay un montón de cosas
que podrías conectar. Solo voy a ir
a herramientas para agregar una herramienta, vas a necesitar
algo llamado claves API, que es la
clave única que obtienes, y traes a esta
plataforma para ayudar a la conexión entre ElevenLabs y cualquier herramienta que estés
tratando de conectar Entonces, por ejemplo, si voy a
Ad Tool Integrations
agrego una nueva conexión,
encontremos algo bastante
fácil. Iré con Exa Podría darle un
nombre a esto, búsqueda en la web. Necesito una clave API. Así que vayamos a EA
y consigamos eso por nosotros mismos. Sólo tienes que buscar una clave API, vas a ser
dirigido a este enlace. Crea ApiKey y solo vamos
a crear una cuenta. Este será el caso de
cualquier herramienta que elijas. Entonces eso es lo que
voy a hacer muy rápido y luego vamos
a conseguir una llave para Bed. Así que acabo de
iniciar sesión usando un correo electrónico, y vamos a
crear nuestra cuenta. Solo me saltaré esto por ahora. Y sólo voy a bajar
a ApiKeys y crear uno. Entonces llamaré a esto
ElevenLabs. Crea la clave. Asegúrate de copiarlo, vuelve aquí, y sólo
vamos a pegarlo en esta zona. Una vez que hayas terminado,
puedes hacer clic en Conectar, y ahora todo está bien para ir. Entonces, una vez que tengamos esta conexión, podremos decidir sobre la herramienta y el servicio que
queremos que EA nos brinde. Y para mi caso,
esa es una búsqueda. Así que haz clic en buscar
y haz clic en Crear. Entonces, una vez que hayamos terminado en las herramientas, podríamos simplemente hacer clic en EA y básicamente decir cómo Ben
debería usar esta herramienta. Por lo que el prompt de condición es el siguiente.
Este es el valor por defecto. Entonces podemos decir elegir tipo de
contenido, usar
destacados, recomendado. Creo que esto está bien
por ahora porque el usuario podría pedirle
cualquier cosa a Ben, y no quiero
restringirlo aquí. Entonces solo voy a
dejar que esto sea como es. Y ahora hemos hecho de nuestro
agente una herramienta integrada. En la siguiente lección,
vamos a probar a Ben y ver qué
tipo de cambios
podemos hacer y luego
cómo podemos
publicarlo en otro lugar donde
otras personas puedan usarlo.
41. Pruebas: M Entonces Ben está todo listo y ahora tenemos que
probar para ver qué tan
bien se desempeña. Entonces en la misma página para los agentes, básicamente
puedes
empezar a hablar con Ben. Se puede ver en el lado derecho, tenemos la pequeña interfaz
básicamente de llamadas donde llego a simplemente hablar por el micrófono y ver como me responde Ben. Entonces comencemos una llamada. Hola, soy Ben. ¿Cómo te puedo ayudar hoy? Hola. ¿Cuándo está abierto el
negocio? Estamos cerrados los lunes, pero abrimos de 9:00 a.m. a 6:00
p.m. Los martes y miércoles, 9:00 a.m. a 8:00 p.m.,
los jueves y viernes. 8:00 A.M. a 5:00
P.M. los sábados y 10:00 A.M. a
3:00 P.M. los domingos. ¿Eso te ayuda a
planificar tu visita, o hay algo más en lo
que pueda asistirte? Sí. ¿Puedes contarme
un poco sobre las últimas tendencias de cabello que podría contarle a mi estilista
en el negocio No tengo
información específica sobre las últimas tendencias de cabello
en mis recursos actuales, pero nuestros estilistas son muy
conocedores y
definitivamente pueden discutir los
estilos más nuevos contigo cuando llegues ¿Te gustaría seguir adelante y
reservar una cita para que
puedas platicar con él sobre
lo que es popular ahora mismo? No. ¿Se puede hacer una
búsqueda en la web al respecto? No puedo realizar búsquedas en la
web, pero estaría encantado de
conectarte con uno de nuestros estilistas que puede
compartir las últimas tendencias ¿Quieres que
te transfiera a alguien que
pueda ayudar con eso? Entonces acabo de terminar la
llamada, pero hasta el momento, a la
hora de
hablar del negocio, Ben pudo ayudarnos. Pero cuando se trataba
de la búsqueda en la web, todavía no tenía el
permiso para hacerlo. Entonces lo que vamos
a hacer es volver al prompt
del sistema e incluir
el aspecto de búsqueda web. Así que sólo voy a ir aquí
y enterarme de la meta. Así que bienvenido. Está bien. Bien, entonces tenemos citas,
ubicación, direcciones, consultas
generales, y luego
podríamos agregar otra. Simplemente voy a copiar la misma línea solo para que el
formato sea el mismo. Vamos a decir para consultas de búsqueda
web, responder preguntas usando A para búsqueda web y proporcionar
al usuario los aspectos más destacados Entonces intentemos esto de nuevo
y veamos qué pasa. Voy a cerrar esto ahora mismo y luego comenzar
otra conversación. De hecho cambiemos también su primer mensaje solo para que
podamos ver la actualización. Entonces, ¿en qué puedo ayudarte hoy? ¿Quieres peinarte el cabello? ¿Bien? Probemos esto. Hola, soy Ben. ¿Cómo te
puedo ayudar hoy? ¿Quieres peinarte el cabello? Sí, cuéntame más sobre los servicios empresariales y cuándo podría entrar
a arreglarme el pelo. Ofrecemos una maravillosa gama de servicios, incluyendo cortes de pelo para mujeres, hombres y niños
soplo No quiero niños, solo para mujer adulta Oh, absolutamente. Contamos con fantásticos servicios
específicamente para mujeres adultas, como nuestro exclusivo corte de pelo
femenino, reventones y diversas opciones de
coloración como Baliage o retoques de raíz Puedes visitarnos de martes a miércoles de 9:00
A.M. a 6:00 P.M. jueves y viernes hasta
las 8:00 P.M. Sábados de 8:00 A.M. a 5:00 P.M. O domingos
de 10:00 A.M. a 3:00 P.M.
ya que estamos cerrados los lunes. ya que estamos cerrados los lunes ¿Eso suena como un buen
momento para que entres? Sí, pero haz una búsqueda en la web sobre las últimas tendencias de cabello para que
pueda entrar y contarle al respecto a
mis estilistas Esa es una idea fantástica. Las últimas tendencias para finales de
2026 tienen que ver con un cabello pulido y de aspecto
saludable
con una sensación natural Los estilos populares incluyen reventones
elegantes,
moños modernos y
el novio Bob,
mientras que los colores están
cambiando hacia morenas ricas y
brillantes, brond coñac cálido y cobres suaves ¿Te gustaría reservar una
cita para discutir probar uno de estos looks
con uno de nuestros estilistas Sí, reservame una cita. Estaría encantado de
ayudarle a conseguir eso programado. Para encontrar el momento perfecto, podrías
decirme tu nombre, qué servicio te
interesa y qué día u hora te
funciona mejor. Además, ¿tienes
preferencia por un estilista específico o te
gustaría ver a
quien esté disponible En realidad, cambié de opinión y no quiero una cita. No hay problema en absoluto. Entiendo completamente que
los planes pueden cambiar. Si alguna vez decide que
desea reservar una cita más tarde o tiene alguna otra
pregunta sobre nuestros servicios, no
dude en
llamarnos. ¿Hay algo más en lo que
pueda ayudarte hoy? No, eso es todo. Eres muy bienvenido. Que tengas un día maravilloso, y esperamos verte en Lux Hair Studio cuando
estés listo. Adiós. Entonces, como pueden ver, esa fue una forma muy natural
de hablar por Ben, y ahora fue capaz de
buscar en la web a través la herramienta que conectamos y proporcionarme alguna información. Y sí interrumpí a
Ben al inicio, y eso es porque
tenemos esto encendido. De nuevo, puedes
apagarlo si quieres que tu agente simplemente diga
sus frases completamente. Y el
ida y vuelta entre yo y el agente también muestra
el poder de 11 agentes. Se puede ver que fui
a concertar una cita, pero luego cambié de opinión, y pude usar las etiquetas correctas para
responderme como usuario. Entonces comprensivo, amable, y aquí para el adiós,
fue por cálido. Y luego cuando por fin
dije que sí a la cita,
fue alegre. Entonces todas estas son señales de que esta conversación
salió muy bien, y configuramos a Ben correctamente. Entonces probamos a Ben, e hicimos algunos ajustes. También hacer pruebas más intensivas. Entonces ahí es donde
configuras una plantilla, y tienes que continuar para repetir hasta que se encuentre un problema. Por ejemplo, podría
montar una prueba donde Ben sea llamado cinco veces en un minuto, y pude ver
lo bien que
salta de un lado a otro con
las cinco personas que llaman Pero eso es algo un
poco más intensivo, y por ahora quiero cambiar el enfoque hacia la
publicación de este nuevo agente.
42. Publicación: M Entonces Ben está todo listo y ahora tenemos que
probar para ver qué tan
bien se desempeña. Entonces en la misma página para los agentes, básicamente
puedes
empezar a hablar con Ben. Se puede ver en el lado derecho, tenemos la pequeña interfaz
básicamente de llamadas donde consigo
simplemente hablar por el micrófono y ver cómo me responde Ben. Entonces comencemos una llamada. Hola, soy Ben. ¿Cómo te puedo ayudar hoy? Hola. ¿Cuándo está abierto el
negocio? Estamos cerrados los lunes, pero abrimos de 9:00 a.m. a 6:00
p.m. Los martes y miércoles, 9:00 a.m. a 8:00 p.m.,
los jueves y viernes. 8:00 A.M. a 5:00
P.M. los sábados y 10:00 A.M. a
3:00 P.M. los domingos. ¿Eso te ayuda a
planificar tu visita, o hay algo más en lo
que pueda asistirte? Sí. ¿Puedes contarme
un poco sobre las últimas tendencias de cabello que podría contarle a mi estilista
en el negocio No tengo
información específica sobre las últimas tendencias de cabello
en mis recursos actuales, pero nuestros estilistas son muy
conocedores y
definitivamente pueden discutir los
estilos más nuevos contigo cuando llegues ¿Te gustaría seguir adelante y
reservar una cita para que
puedas platicar con él sobre
lo que es popular ahora mismo? No. ¿Se puede hacer una
búsqueda en la web al respecto? No puedo realizar búsquedas en la
web, pero estaría encantado de
conectarte con uno de nuestros estilistas que puede
compartir las últimas tendencias ¿Quieres que
te transfiera a alguien que
pueda ayudar con eso? Entonces acabo de terminar la
llamada, pero hasta el momento, a la
hora de
hablar del negocio, Ben pudo ayudarnos. Pero cuando se trataba
de la búsqueda en la web, todavía no tenía el
permiso para hacerlo. Entonces lo que vamos
a hacer es volver al prompt
del sistema e incluir
el aspecto de búsqueda web. Así que sólo voy a ir aquí
y enterarme de la meta. Así que bienvenido. Está bien. Bien, entonces tenemos citas, ubicación, direcciones, consultas
generales. Y luego podríamos
agregar otro. Simplemente voy a copiar la misma línea solo para que el
formato sea el mismo. Vamos a decir para consultas de búsqueda en la
web, responder preguntas usando A para búsqueda en la
web y proporcionar
al usuario los aspectos más destacados. Entonces intentemos esto de nuevo
y veamos qué pasa. Voy a cerrar esto ahora mismo y luego comenzar
otra conversación. De hecho cambiemos también su primer mensaje solo para que
podamos ver la actualización. Entonces, ¿en qué puedo ayudarte hoy? ¿Quieres peinarte el cabello? ¿Bien? Probemos esto. Hola, soy Ben. ¿Cómo te
puedo ayudar hoy? ¿Quieres peinarte el cabello? Sí, cuéntame más sobre los servicios empresariales y cuándo podría entrar
a arreglarme el pelo. Ofrecemos una maravillosa gama de servicios, incluyendo cortes de pelo para mujeres, hombres y niños
soplo No quiero niños, solo para mujer adulta Oh, absolutamente. Contamos con fantásticos servicios
específicamente para mujeres adultas, como nuestro exclusivo corte de pelo
femenino, reventones y diversas opciones de
coloración como Baliage o retoques de raíz Puedes visitarnos de martes a miércoles de 9:00
A.M. a 6:00 P.M. jueves y viernes hasta
las 8:00 P.M. Sábados de 8:00 A.M. a 5:00 P.M. O domingos
de 10:00 A.M. a 3:00 P.M.
ya que estamos cerrados los lunes. ya que estamos cerrados los lunes ¿Eso suena como un buen
momento para que entres? Sí, pero haz una búsqueda en la web sobre las últimas tendencias de cabello para que
pueda entrar y contarle al respecto a
mis estilistas Esa es una idea fantástica. Las últimas tendencias para finales de
2026 tienen que ver con un cabello pulido y de aspecto
saludable
con una sensación natural Los estilos populares incluyen reventones
elegantes,
moños modernos y
el novio Bob,
mientras que los colores están
cambiando hacia morenas ricas y
brillantes, brond coñac cálido y cobres suaves ¿Te gustaría reservar una
cita para discutir probar uno de estos looks
con uno de nuestros estilistas Sí, resérvame una cita. Estaría encantado de
ayudarle a conseguir eso programado. Para encontrar el momento perfecto, podrías
decirme tu nombre, qué servicio te
interesa y qué día u hora te
funciona mejor. Además, ¿tienes
preferencia por un estilista específico o te
gustaría ver a
quien esté disponible En realidad, cambié de opinión y no quiero una cita. No hay problema en absoluto. Entiendo completamente que
los planes pueden cambiar. Si alguna vez decide que
desea reservar una cita más tarde o tiene alguna otra
pregunta sobre nuestros servicios, no
dude en
llamarnos. ¿Hay algo más en lo que
pueda ayudarte hoy? No, eso es todo. Eres muy bienvenido. Que tengas un día maravilloso, y esperamos verte en Lux Hair Studio cuando
estés listo. Adiós. Entonces, como pueden ver, esa fue una forma muy natural
de hablar por Ben, y ahora pudo
buscar en la web a través la herramienta que conectamos y proporcionarme alguna información. Y sí interrumpí a
Ben al inicio, y eso es porque
tenemos esto encendido. De nuevo, puedes
apagarlo si quieres que tu agente simplemente diga
sus frases completamente. Y el
ida y vuelta entre yo y el agente también muestra
el poder de 11 agentes. Se puede ver que fui
a concertar una cita, pero luego cambié de opinión, y pude usar las etiquetas correctas para
responderme como usuario. Entonces comprensivo, amable, y aquí para el adiós,
fue por cálido. Y luego cuando por fin
dije que sí a la cita,
fue alegre. Entonces todas estas son señales de que esta conversación
salió muy bien, y configuramos a Ben correctamente. Entonces probamos a Ben, e hicimos algunos ajustes. También puede hacer pruebas más
intensivas. Entonces ahí es donde
configuras una plantilla y tienes que continuar para repetir
hasta que se encuentre un problema. Por ejemplo, podría
montar una prueba donde Ben sea llamado cinco veces en un minuto, y pude ver
lo bien que
salta de un lado a otro con
las cinco personas que llaman Pero eso es algo
un poco más intensivo, y por ahora, quiero cambiar el enfoque
hacia la publicación de
este nuevo agente.
43. Otras herramientas de IA para utilizar con ElevenLabs.
: Ahora que sabemos
cómo usar completamente ElevenLabs para hacer
diferentes tipos de audios, que van desde una voz en off
hasta un audiolibro, ahora
estamos listos para crear audios Pero también puedes llevar
tus habilidades más allá
combinando diferentes
herramientas de IA con ElevenLabs Por lo que ElevenLabs es principalmente
conocido por el audio. Como vimos, es realmente bueno y está mejorando constantemente. Pero, ¿cómo puedes combinar las otras muy buenas herramientas de IA para hacer algunos proyectos increíbles? Entonces voy a recomendar algunas herramientas que
quizás
ya conozcas o no y
te diré cómo podrías combinarlo con ElevenLabs La primera herramienta que ya
vimos cómo usar fue Chat GPT Estoy seguro de que en su mayoría estás
familiarizado con esto. Pero lo que puedes hacer con
él es antes que nada, convertir A URL en una versión resumida para que
puedas usarla para un
podcast o un audiolibro. Como también vimos,
eres capaz de cambiar un idioma y agregar algunos elementos que puedan potenciar el discurso que crea 11 Lab. Que en GPT, también puedes
empezar las cosas desde cero, como escribir un
libro sobre manzanas o escribirme un guión para
un podcast
hablando de tornados En términos de scripting
y brainstorming, esta plataforma es un
gran lugar para venir
a *** no solo gratis, sino que es bastante buena
en lo que Ahora, tienes tu guión, tienes tu audio.
¿Qué pasa con el metraje? Un lugar del que podrías obtener
imágenes es Mid journey. Esta es otra plataforma de IA. Hoy en día, también hacen fragmentos
cortos de videos. Hablaré de
videos en un poco, pero si querías hacer voz en
off imágenes, entonces este es el lugar para venir Esta no es una herramienta gratuita. Creo que aunque quieras
usar la versión gratuita, hay muchas limitaciones. Pero como puedes ver, estas son algunas muestras que puedes
hacer con esta y herramienta. Una vez que hayas terminado de
hacerlos aquí, puedes exportarlos
a ElevenLabs, hacer tus doblajes y hacer
algo de contenido Ahora, ¿y si
quieres hacer videos? Runway AI es una gran
plataforma para videos. Hay otros por
ahí, pero este
es probablemente el más
fácil de usar. La forma en que esto funciona es que al
igual que cualquier otra plataforma de IA, le das un prompt,
como puedes ver aquí. Puedes jugar con
ángulos, con el estado de ánimo, los personajes, mantener a
los personajes estables y simplemente hacer un montón
de cosas diferentes. Esto, una vez más, si estás
usando la versión gratuita, hay algunos límites. Podrías actualizar a
una mejor versión, pero si no planeas
hacer esto con tanta frecuencia, realmente no
necesitas
comprar una cuenta completa. ChagPT también
genera imágenes para ti. Si no querías pagar
por Mid Journey o DaVinci, simplemente
puedes volver
a Chat GIP Team De esta manera, estás combinando capacidades de
scripting, imagenología y video con
tus audios ya hechos De esta manera, tienes la opción de
generar diferentes contenidos y no
depender completamente del contenido solo de audio. Ahora que tenemos todas
estas herramientas a nuestra disposición, hablemos de cómo puedes monetizar estos contenidos
si así lo deseas Los voy a ver
en la siguiente lección.
44. Monetización y próximos pasos: Hay muchas maneras de monetizar con
ElevenLabs al igual
que con otras herramientas de
IA Así que además de poder
hacer tu canal de YouTube y monetizar a través de esa plataforma haciendo contenido
con ElevenLabs, también
puedes unirte al programa Creator propio de
ElevenLabs Entonces cuando vamos a
la Biblioteca de Voces, hay algunas que te
cobran por minuto. Y se puede ver que no
hay tantos, pero sí existen. Esencialmente, lo que
puedes hacer cuando haces tu propia voz es
que te pagarían pasivamente
después de haber subido un
audio de alta calidad en 11 laboratorios Por ejemplo, este
audio es lo repaso, $0.02 para que lo use Amigo, si montar olas
es mi religión, entonces los tacos son de comunión recta
, bro. Entonces ese es un ejemplo. Se puede
ver que es de muy alta calidad, muy clara, y tiene la voz perfecta
para esta categoría. Entonces esa es una forma en la que
puedes monetizar las creaciones de
ElevenLabs En esa nota, sí tienen
una página de transportistas también, donde llegas a ser uno
de esos especialistas de los
que puedes usar tus
servicios en producción. Recordemos cuando fuimos por
aquí, estábamos recibiendo, si fuéramos a usarlo, cobrar $2 por minuto y
todos estos precios. Estos serían hechos entonces por humanos
reales como discutimos. Podrías calificarte para
ser una de esas personas. Simplemente entrando en
la página de carreras de slash, luego abrir posiciones, puedes ver cuántas cosas
tienen disponibles Ahora bien, esos son trabajos de tiempo completo, pero si vas en el subtitulado de corte de
transcripción, puedes ver que esto
es algo freelance Entonces, siempre que haya una
demanda de tu servicio, te van a
contactar y luego grabar un audio con
tu voz para otra persona. Se puede ver que incluso es remoto, y esto es todo
dentro de esta plataforma. Definitivamente deberías
comprobarlo si
planeas ganar dinero
con ElevenLabs Otra forma en la que podrías
hacerlo es hacer contenido en línea, como videos de YouTube, videos de
Instagram,
Tik Tok, o lo que sea,
usando ElevenLabs como audio Esto te ahorrará
tiempo para que grabes todo con tu
propia voz y puedas
usar estas generaciones de audio realmente rápidas y
precisas para construir tu contenido. Por ejemplo, podrías cubrir desastres naturales
aterradores como lo
hicimos con uno de nuestros proyectos. Puedes hacer un resumen de biografía donde contar la
historia de personajes famosos. Hay tantas cosas por
ahí que puedes hacer. Pero el papel de ElevenLabs en eso es que es
solo el audio Aún tienes que
trabajar muy duro para anunciar tu contenido, sacarlo a la luz, que la
gente lo vea, estar comprometido y
todas esas cosas. Otra cosa que podrías hacer es freelance con ElevenLabs Básicamente, podrías ir a
plataformas como Fiber, Upwork, y hay tantas por
ahí hoy en día y ofrecer el servicio de hacer audios de
IA para un Si alguien no
quiere usar su propio audio, puede
acudir a ti para que
puedas hacerlos
con precisión y audio. la misma manera que alteramos las
voces para un podcast aterrador , un anuncio, un podcast
regular estarías haciendo
lo mismo, pero basado en la necesidad del cliente. Esas son solo algunas formas
realmente rápidas que puedes monetizar
con 11 laboratorios Al igual que cualquier otra herramienta de IA, va a
haber mucha
demanda de este tipo de
contenido y trabajo. Esté atento y
asegúrese de estar en las comunidades adecuadas
para que esté al tanto de todas las actualizaciones y todos
los trucos geniales que
puede hacer con esta plataforma. Redit tiene muchos de ellos, y luego puedes ir
a tal vez Facebook, Discord y simplemente
seguir practicando haciendo audios y aprender nuevas
formas de mejorarlos Espero que ustedes disfruten de este
curso y que sigan usando este
programa realmente genial para su propio contenido. Espero verles pronto chicos.
45. Proyecto de clase: crea tu propio contenido de audio o visual.: Ahora es tu turno de tomar
lo que has aprendido y crear tu propio proyecto
usando ElevenLabs Para su proyecto de clase, me gustaría que ustedes
crearan ya sea un contenido de audio o visual utilizando todas las herramientas
que hemos aprendido. También puedes
combinarlo hasta donde tengas los visuales hechos y luego combinarlo con el audio
que hiciste. Aquí tienes
mucha libertad. Puedes crear un
video corto, un audiolibro, un podcast, un video de sincronización de labios y cualquier otra cosa
que quieras hacer Empieza por decidir qué
quieres hacer y para quién es. Entonces piensa cuál de las muchas herramientas puedes usar
para crear este proyecto. Puedes elegir o diseñar
una voz adecuada para tu proyecto y ver cómo eso podría encajar
con tu idea. Podría ser solo un proyecto de audio. Pero si quieres ir un paso más allá, puedes agregar algún contenido visual hecho a partir de las herramientas creativas. Aprendimos a
generar imágenes, videos y cómo podemos hacer una
producción completa usando flujos. Así que elige las herramientas que
realmente te ayuden con tu idea. Cuando termines,
puedes subir el proyecto a la biblioteca de proyectos de
clase. Dependiendo de lo que hayas hecho, puedes incluir
el contenido completo, capturas de pantalla del mismo,
y junto a eso, puedes dar una explicación hablando sobre tu proceso,
tu idea, algunos
desafíos a los que te enfrentas y qué es lo que te interesa. Y recuerda, al usar
IA para generar voces, quieres hacer esto de manera responsable Especialmente si estás clonando otras voces o estás creando contenido
basado en personas reales. Esperando ver
lo que ustedes crean.
46. ¡Felicidades! ¿Qué sigue?: Mm hm. Enhorabuena por terminar la clase magistral de
IA de ElevenLabs Hemos cubierto mucho en
este curso, pero a estas alturas, ya sabes que 11 laboratorios es mucho más que
solo texto a voz Lo importante ahora es
seguir experimentando
con las herramientas No tienes que usar todas las herramientas
de tu proyecto, pero puedes ver qué
herramientas te ayudarían a mejorar tu flujo de trabajo o a
crear mejor contenido. O incluso flujos de trabajo más grandes, puede combinar 11 laboratorios con
otras herramientas de IA que existen. Esto podría ser para ya sea que estés trabajando para un negocio con un solo cliente o para
tu propio proyecto personal. Si aún no lo has hecho,
asegúrate de subir tu proyecto a la biblioteca de proyectos de
clase. Me encantaría ver cómo
ustedes usan las herramientas y cómo las combinan
para generar sus ideas. Y si disfrutas del curso, no dudes en dejarnos
una reseña ya que realmente nos
ayuda a mejorar nuestro contenido.
Gracias por acompañarme. Espero que este curso
te haya dejado muchas ideas sobre cómo podrías usar ElevenLabs
para tus propios proyectos Sigan creando, y los
veré en nuestra próxima clase.