Transcripciones
1. Introducción: Hola a todos. Mi nombre es Oliver y en este curso te
voy a mostrar el nuevo y emocionante campo
del arte generado por IA, además de darte
toda la información y consejos para que estés creando tu propio impresionante
AIREen pocos minutos. En cuanto a lo que
cubriremos en este curso, habrá una introducción al software AIR
libre y algunos
antecedentes sobre lo que es AIR. También tendremos una
demostración paso a paso para crear tu primer AIR impresionante usando un programa
llamado Meet journey. Y también veremos
cómo construir
un buen prompt para decirle a la
IA lo que quieres crear, así
como modificadores para crear
exactamente de la manera que quieras. Lo bueno es que
crear arte no requiere ningún conocimiento especializado en
programación ni siquiera mucho talento para el diseño. Dicho esto, construir
un buen prompt requiere experiencia práctica
incluyendo el conocimiento de técnicas
especiales y
algunos conocimientos de dominio de su tema demasiado de cerca replicar una imagen
circulando en tu cabeza. Pero nos meteremos en eso
en el siguiente video. Entonces, por ahora,
comencemos con AIR. Hola a todos. Bienvenido de nuevo. En este módulo de video, vamos a ver cómo
construir un buen prompt. Ahora, como es posible que sepa para
crear arte generado por IA, deberás ingresar
lo que se llama un prompt de texto, que son instrucciones para la IA sobre lo
que quieres crear. Y eso podría ser tan sencillo como una persona sentada en
un café, por ejemplo. El motor de IA hará todo
lo posible para generar una imagen basada en
las indicaciones que proporcionaste. Ahora, similar a cómo
las personas tienen su estilo para ingresar palabras clave o
frases en la búsqueda de Google. No hay método fijo o
2. Información sobre IA: Código preciso para
escribir un mensaje de texto. Esto significa que un mensaje
puede ser una lista de palabras separadas por una coma, como árbol desnudo. Podría ser un fragmento
de una oración. Oso debajo de un árbol y
boceto imperativo junto a un árbol, o una oración completa, un boceto de un oso
sentado debajo de un árbol. gramática correcta no es
necesaria
siempre y cuando tus instrucciones puedan
ser entendidas claramente, igual que estás hablando con
un ser humano. Y de hecho, cuanto más fácil sea tu pronta para
entenderlo mejor. Es importante destacar que
también necesitas usar el lenguaje
natural, ya que ese es el lenguaje en el que se entrena la
IA. Lenguaje natural para el
primer lenguaje humano, como el inglés
conversacional cotidiano o lo que podrías escribir en un mensaje de texto en lugar un lenguaje artificial
como el código de programación. Esto significa que debes
comunicarte con el programa de IA más
como si fuera un humano. Y evita usar
lenguajes artificiales como CSS y Python para escribir
tu prompt de texto. Sin embargo, hay que tener en
cuenta que hay excepciones siendo una las
palabras clave especializadas o sintaxis que vienen con el programa de software de
IA, como slash hacia adelante, imagínese en el caso
de viaje de carne, que debe ser la primera
palabra de tus textos prompt, y también palabras clave para
dictar el peso, tamaño y otros
aspectos estructurales de la imagen. Entonces en este ejemplo aquí,
hay dos palabras clave. Uno es optimista y
otro es la devastación. Tienen diferente
ponderación y la espera significa
que optimista, vamos a tener más énfasis que devastación porque es el
doble en términos de espera. Ahora, en general, cuanto más
específico sea tu prompt, más específico será
tu resultado. Al inicio de este video, miramos este
sencillo aviso de una persona sentada en un café. Si bien esta es información más que suficiente para que la
IA genere arte relevante, aquí
hay una oportunidad de
refinar nuestro prompt y generar una salida más deliberada
y matizada. Y aquí es donde
entran en escena los modificadores. Si bien sus indicaciones base probablemente
describirán uno o más objetos y la
relación con esa escena. El modificador aplica instrucciones
adicionales con respecto al diseño estilístico
que desea que tome la IA. Entonces, si tomamos nuestro aviso base
original de una persona sentada en un café, podemos agregar un modificador en forma
de persona
sentada en un café
al estilo de un cartel
Art Deco de los años 20. Esto producirá una salida
muy diferente a la comparada con la salida original usando ese simple
prompt de ingeniería que primero tuvimos. Del mismo modo,
también puedes volver atrás y editar tu prompt original para agregar aún más precisión
a tu solicitud. Así que vamos a actualizarlo
ahora a algo así como un distinguido hombre de
mediana edad sentado en una cafetería
vienesa al estilo de un cartel Art Deco
de la década de 1920. La mayoría de los programas de software de IA también
tienen una función incorporada para aplicar variaciones que te permiten riff en lo que
ya has generado. Y a veces puede tomar quizás diez o más variaciones hasta que aterrice en el aspecto
exacto que desee. A continuación, tenga en cuenta que la
mayoría de los programas de software vienen con un límite de caracteres. Para Delta E, el prompt de textos no puede tener más de
400 caracteres, que es más que
suficiente, sino
casi cualquier cosa que
quieras crear. Sin embargo, si
eres realmente preciso con un prompt y
creas las palabras adecuadas, entonces a veces menos
es en realidad más. Y de hecho, incluso puedes
generar resultados decentes usando solo emojis dependiendo del programa de software de IA
que estés usando. También, un adjetivo sencillo
como cartel Art Deco, ya contiene una serie
de características. Por ejemplo, alcanzar colores, ornamentación
suntuosa, formas
geométricas y el
material o medio real
del arte en
forma de papel, forma
rectangular
que harías de lo contrario necesitará enumerar
y definir por separado. Entonces, ¿dónde están los actores? Los contenedores pueden ser
realmente eficientes en términos de crear
un prompt de texto. Errores artísticos
como el art déco o década como la década de los 90 no
impactarán en el estilo
de la ilustración, sino también en la moda, arquitectura y otros materiales presentes en el ilustración. A menos que se defina otra Sin embargo, si
estás teniendo problemas para capturar el estilo exacto que quieres crear usando términos
amplios como
art deco o grunge. Probablemente necesites
agregar algunos detalles adicionales como la ubicación real. Entonces, por ejemplo, Wall
Street en Nueva York, tal vez
quieras
especificar el clima, la hora del día, el telón de fondo político, económico o social. Entonces por ejemplo,
Occupy Wall Street, 11 de
septiembre, la crisis
financiera global, o quizás COVID 20 a 20. Ahora, para la fotografía,
también puede tomar prestada terminología
específica de dominio para definir todo,
desde la velocidad de obturación hasta la elección de lentes,
iluminación, encuadre, etc. o agrupar todos estos
atributos en un estilo de fotografía
como toma de acción, portada de
National Geographic, libro de fotos
japonés
llamado compañero de trabajo Sophie, o tal vez una sesión de fotos de moda. De igual manera, si quieres crear
un estilo visual específico, entonces necesitas
entender el encuadre, que es el ángulo de
la imagen, el material. ¿ De qué está hecho? Materiales de iluminación para replicar
ese estilo en particular. Entonces esta capacidad de articular y describir el
arte visual en palabras. Definitivamente nos
convertiremos en una habilidad útil que desarrollarás con el
tiempo y tal vez incluso te
enviaremos por una madriguera de conejo
a medida que aprendes los detalles finos y terminología
especializada en muchos diferentes temas. Así que para mí ahora, cada
vez que veo una película, seguía encontrándome
tratando de articular diferentes escenas en mi
cabeza como si estuviera tomando notas
mentales para
pasar a mitad de viaje o un programa de software de IA como un mensaje de texto que
puedo usar más adelante. Además de ser más articulado con
nuestras indicaciones de texto, también
quieres hacer todo lo posible para entender los
detalles en la toma. Entonces esto significa tener
una buena comprensión de tu tema. Si quieres generar una
imagen de un caballero medieval, entonces necesitas
entender la moda, el sistema de clases
sociales y las armas de ese periodo
en particular, incluyendo los nombres de
algunos famosos con
el fin de ser específicos. Entonces, por ejemplo, hay
una diferencia entre un caballero templario vestido
de blanco y una Cruz Roja. Y una especie de noche inglesa más
general de una época anterior, uniéndose a su propio
escudo y moda únicos. Ahora, para la mayor parte de esta sección, hemos hablado de
lo importante
que es ser detallado y específico. También puedes ir por la ruta
opuesta y dejar que a la IA se
le ocurran sus propias ideas. Por lo tanto, en lugar de usar
un prompt detallado, puede contener y usar un prompt
más vagamente definido. Esta técnica podría ser
útil si tú mismo no sabes qué es lo que
realmente estás tratando de crear. O tal vez hay pocas referencias
existentes que se te ocurran, como un estadio construido en
las metáforas, por ejemplo. También debes tener en
cuenta que las mismas indicaciones
saldrán saldrán manera diferente con
diferentes software de IA. Entonces Conoce a Jennie, por ejemplo, inclina hacia un estilo más
artístico. Mientras que la
difusión de Stanford se asienta en el extremo más conservador
y liberal del espectro del diseño, te
daré algo
mucho más realista. En cualquier caso, es
posible que deba proporcionar algunas instrucciones más
a sus mensajes de texto. Si deseas sobrescribir el estilo natural del programa
soft que estás usando. Ahora, mientras que los
programas suaves de IA suelen ser altamente confiables y coinciden con su prompt dentro de
varios intentos. A veces se
necesitarán algunos fracasos para que obtengas el resultado
correcto que
estás buscando. Así
que solo recuerda que puedes hacer variaciones al
arte que creas. A continuación, queremos hablar de
algunas de las
razones comunes por las que tu arte no resulta de
la manera que querías. Entonces hay principalmente
dos razones comunes. Y una es que tu
pronta estaba mal definida. Y la segunda es
que el software de IA no
fue entrenado en imágenes relevantes para su prompt de textos
particulares. Entonces Delta E, por ejemplo, eso fue entrenado en
650 millones de imágenes con descripciones de texto
o leyendas. Y aunque es muy probable que la IA aprenda de
nuevos datos a lo largo del tiempo, puede
haber una brecha de tiempo entre algo que se
generaliza y la IA aprende qué es esa cosa ya que en realidad tiene que
volver a la escuela, por
así decirlo, estudiando ejemplos de
formación. Una forma de pensar en esto es si hay una nueva
película que sale y todos los demás la han visto,
pero tú no la has visto. Por lo que realmente no se puede
hablar de ello ni hacer
chistes o comentarios. Entonces en este caso, esa es la IA. A lo mejor la gente de la calle ha
visto esta película, pero la IA aún no la ha
visto. Por lo que realmente no puede ser una fuente confiable para remezclar
contenido de esa película. De alguna manera, podría
ser posible la IA
replicara fácilmente el estilo de artistas establecidos
como Van Gogh o crear un político
como Barack Obama. Definitivamente podría haber
un retraso antes de que el modelo sea confiable para
recrear nuevas tendencias, temas o palabras como imágenes. Así, el modelo de IA no
lo sabe todo como un
genio que todo lo ve o una figura divina. Sólo sabe en qué
se ha entrenado. Esto significa que no se puede
distinguir a la IA a través revelar de
manera confiable la cara exacta. Entonces Satoshi Nakamoto
o Banksy, claro, todavía se
puede pedir a la IA que haga un intento basado en imágenes
ya en circulación, pero obviamente, el
resultado no será confiable ni aceptado
en un tribunal de derecho. Del mismo modo, si usas la palabra yo y tu
mensaje de texto, la IA realmente no tiene idea a lo
que te refieres exactamente. Eso significa que
no tiene forma de agregar tu propio
parecido físico a la imagen, lo que hace que tu
pronta esté mal definida, incluso si eres famoso y
tu nombre está ahí afuera en el dominio público y esto
imágenesde retrato disponibles, aún
necesitas deletrear el nombre exacto de esa persona, que en este caso
es tu propio nombre. Entonces tal vez ese sea Elvis Presley
o Michael Jackson, etc. y tal vez también
necesites tal vez incluso agregar algunos contactos en caso de que haya otras personas que
tengan el mismo nombre. Entonces tal vez tengas que
decir que soy X persona de esta industria en particular o famosa por este
carpintero musical, etcétera. Para ser más precisos.
3. Encuadre: Hola amigos. En este video rápido, vamos a tener
que mirar el encuadre. Esta es una parte súper
importante de capturar tu visión artística. Y sin embargo aquí no estamos
hablando de marcos para cuadros. encuadre influye en el
ángulo del campo visible, incluyendo la anchura y la altura, y controla cómo
aparece el contenido en términos de perspectiva. Los ejemplos de encuadre
incluyen el punto de vista sobre el hombro, tiro
largo,
planos de primer plano e isométricos. Generar una imagen de una persona haciendo un discurso a
una sala de personas arrojará diferentes
resultados desde un marco de imagen desde el punto de vista de la audiencia, por ejemplo , enmarcando el
vista de una ciudad desde una perspectiva isométrica
proporcionará una
vista dramáticamente diferente que si usa un mensaje de texto sin formato sin información
específica de encuadre. Isométrica, por cierto, es
una técnica divertida de aprender. Básicamente es un método
para representar visualmente objetos
3D en 2D y
a menudo se usa en dibujos técnicos
y de ingeniería como
documentos de urbanismo, encuadre. Yo diría que en realidad es uno de los diferenciadores clave
en términos de un principiante y un
usuario avanzado para el arte generado por IA, mayoría de la gente se enfoca en
el tema y los adjetivos para describir
la escena en su cabeza. Pero a menudo pasan por alto
el campo de visión, el ángulo y la perspectiva
del arte mismo. Si tienes alguna experiencia
en televisión y cine, encuadre probablemente
te será algo natural. Pero si no, es una habilidad relativamente
fácil de aprender. Una vez que te hayas conocido, comenzarás a notar cómo se utilizan
estas técnicas en los medios o en tu
programa
favorito de Netflix para agregar diferentes efectos. Si quieres hacer geek
en el encuadre, tal vez
te interese echar un
vistazo al recurso NFL dot edu, que tiene más de 80 ángulos de
encuadre diferentes que
puedes revisar, como el tiro vaquero, que muestra el sujeto desde
un ángulo medio del muslo y hacia arriba. Y puedes usar
esas técnicas como inspiración para
crear tu propio arte.
4. Opciones de software de arte de IA: Hola, bienvenido de nuevo. En esta sección,
te
voy a dar un rápido resumen de
las opciones de software más populares y
potentes del mercado para crear arte generado por
IA. Ahora, en términos de las
aplicaciones líderes en este campo, definitivamente no
hay
nada más Delta E, pero también hay muchas otras incluyendo viaje hecho
y difusión estable. Pero comencemos con
Delhi comer de todos modos. Delhi eat or data E2, que es la última versión, es un revolucionario
software de IA desarrollado por OpenAI. Se trata de un laboratorio de investigación
con sede en San Francisco. Ahora, a diferencia de algunos de los
otros
algoritmos de generación de imágenes que existen, delta E funciona
tanto con la generación de
imágenes abstractas como realistas. algoritmo también es capaz de comprender oraciones
complejas que involucran múltiples objetos y sus atributos
incluyendo color, forma, tamaño, estilo,
iluminación, ubicación, etc. así, por ejemplo, puedes generar
fácilmente una imagen de un rectángulo rojo junto
a un triángulo azul. También se pueden generar imágenes
más abstractas, como una nube rosada con
dos ojos y una boca. Lo que me gusta de Delhi E2 es la interfaz de usuario web limpia, que es súper fácil de
operar y navegar. Y empezarás a
apreciarlo más después de usar otras
opciones de software en términos de comenzar después registrarte para obtener una nueva
cuenta con ellos. Puedes escribir
tu mensaje de texto, o puedes elegir subir
una imagen y luego editarla directamente o generar
algunas variaciones basadas en la imagen original, imágenes que generes
usando Delta E y luego guardarla en tu cuenta para un acceso
conveniente más adelante. Para mí, una de las
mejores características de Delta E es la carga de imágenes, una herramienta que es útil
para manipular elementos de arte y diseño
existentes para crear combinaciones novedosas. Para ilustrar, podemos tomar una fotografía
existente y agregar elementos únicos como
encuentro cerdo o un robótico. Esto abre enormes
oportunidades para la exploración creativa, permitiendo
también a artistas y
diseñadores explorar fácilmente nuevos conceptos y generar visualizaciones
inspiradoras. A continuación tenemos a
Pete Joni Mitchell, y además realmente destaca entre la primera generación
de software de IA. Sobre todo por el hecho de
que es mucho más caótico y complicado de usar. A diferencia de delta E y la mayoría de los
otros software de IA, Meet Journey no se lanzó como una
aplicación de sitio web independiente. En cambio, necesitarás usar
mid journey through discord, que es una popular aplicación de chat prominente en el espacio de juegos
y cripto. Con el fin de crear
tu arte generado por IA. Además de eso,
hay miles de otros usuarios
creando y modificando el arte de la IA en el
canal de discordia de tono medio en un momento dado. Así que hay una constante inundación de
mensajes de texto dentro de
las salas de chat. Esto puede distraer, pero el
ambiente de trabajo compartido ofrece una valiosa
oportunidad para inspirarse y
observar el flujo de trabajo y resultados de otros usuarios en
términos de comenzar, una vez que te hayas unido al canal MIT
journey en Discord, podrás
crear imágenes usando el comando forward slash
imagine, seguido de tu símbolo de texto, que son las instrucciones sobre lo que quieres que cree la IA. New journey ofrece
a todos una prueba inicial. Voy a 25 consultas, lo que significa que
puedes generar 25 imágenes. Y luego hay
varias opciones para comprar una membresía completa con límites de generación de
imágenes
ilimitados o más generosos, así
como términos comerciales. Para mí, los viajes hechos
la principal fortaleza es que ofrece una gama avanzada de parámetros para personalizar su obra de arte. Esto incluye cosas como
la resolución de la imagen, la complejidad, y también
la calidad de la imagen. También proporciona herramientas para
integrar animación y movimiento en tus imágenes para ayudarles a destacar aún más. Esto me hace un viaje
realmente ideal para usuarios dispuestos a
aprender y experimentar y permitir que cualquiera pueda crear hermosas obras de
arte que se adaptan a su estilo individual en términos de su producción artística. También decía que el
medio tono se inclina hacia una materia de diseño más abstracta y
surrealista. Y es particularmente
bueno para dar salida al arte
futurista o al estilo cyber
punk. El software, sin embargo, es menos adecuado para
generar realista, impar en comparación con
decir, Delhi E, por ejemplo, por lo que para compensar este
sesgo hacia el diseño abstracto, es posible
que deba agregar
los términos realista o fotorrealista o realismo
a sus indicaciones de texto. Y por último,
necesitará que Johnny tenga una curva de aprendizaje más pronunciada y
sus pares basados en el sitio web, Definitivamente
vale la pena la inversión. Bien, A continuación tenemos IA estéreo. Esta es una
aplicación de software y también una aplicación móvil que te
permite generar NF2, que son
tokens no fungibles utilizando mensajes de texto para transformar
tus palabras en obras de arte. La plataforma permite a los usuarios publicar en si T está en
diferentes blockchains, incluyendo un teorema
y se unen y cadena inteligente permitiendo que estos NFT se
distribuyan y
negocien fácilmente en varias redes. En términos de diseñar tu arte, aquí
hay algunas opciones
diferentes, incluida la relación de aspecto. También puedes usar
una imagen inicial para personalizar tus creaciones. Y también hay una variedad de modelos
diferentes para elegir. Es importante destacar la historia. También te doy
plena propiedad de tus creaciones que puedes usar para tu próximo proyecto
creativo. Puedes imprimirlos o
compartirlos en redes sociales, o incluso venderlos como NFT. Por lo que esto le da a los artistas y
vía extra para monetizar
su creatividad. Sin embargo, tenga en cuenta que si bien
sus operaciones
le pertenecen y puede hacer lo que
quiera con ellas, todavía está sujeto
a las leyes de derechos de autor en su jurisdicción, y es posible que necesite un permiso
especial del propietario de los derechos de autor
de cualquier imagen de entrada. Por último, usando estéreo,
puedes generar hasta cinco obras de arte
gratis diariamente y
sin marcas de agua. Sin embargo, necesitarás
comprar créditos para disfrutar por el uso de este servicio. El siguiente no es café. Esto ofrece un diseño similar, dulce y sistema de precios como IA y te permite generar hasta cinco obras de arte gratis diariamente. Ahora estamos iniciando la IA se enfoca
más en la creación de AFT. Night Cafe te permite imprimir tus creaciones y
enviarlas por correo a tu casa. Sin embargo, en lugar de decir, imprime tus diseños en
una camiseta o ropa, artículo III te permite
imprimir tus diseños como un póster en papel metálico grueso y
duradero. En cuanto a elementos de diseño, es muy similar al estéreo I. Aquí
hay algunos escenarios
diferentes,
entre ellos el estilo artístico, entre ellos el estilo artístico relación de
aspecto y el peso rápido, así
como la
resolución de imagen que
puedes jugar con él
por esa razón, creo que
definitivamente vale la pena echarle un ojo a Night Cafe. Bien, moviéndonos el martes
vamos a difundir. Esta es otra herramienta poderosa
para artistas y diseñadores. A diferencia del viaje de delicatessen, carne
y carne, difusión
externa tiene
una política de código abierto que te permite eludir las
restricciones de contenido bloqueado que podrías encontrar en otro software de IA. Esta es definitivamente una
gran diferenciación con el
registro de cuentas neuro también requerido. Y rápido procesamiento de imágenes, aproximadamente 10 s, puede comenzar a generar
imágenes de inmediato. Sin embargo, la desventaja es que
la interfaz de usuario simple, la falta de
opciones de inicio de sesión significa que no puedes
ver fácilmente las imágenes que generaste anteriormente
y en su lugar tienes guardar los resultados en tu
computadora para acceder a ellas. Todavía la difusión también carece
actualmente de los pies a las otras
variables de software como carga de
imágenes y los controles de relación de
aspecto. Sin embargo, los desarrolladores agregaron
recientemente un cuadro de aviso negativo y se dice que
las
nuevas características están en camino. También en el lado positivo, paso de difusión es rápido. Es de uso gratuito y los
resultados son muy superiores a otros software de IA libre
en cuanto a su arte. Por lo tanto, la difusión simple es similar
al viaje del encuentro y favorece una
materia más abstracta y surrealista, la expresión artística. Sin embargo, al igual
que con otros
programas de software, tiende a luchar
un poco con captura de simetría
en rostros humanos. Por último, tenemos crayón. Crayon era Ashley, anteriormente conocida como Delta E mini
porque varios de los miembros del equipo
involucrados este proyecto también
involucraron con Delhi E, lo que significa que hay algún
cruce en términos de desarrollo de
productos
y la historia entre los dos productos. La interfaz de usuario para
crayón está viviendo a través un navegador web al que
puedes acceder en tu PC o dispositivo móvil. También hay una aplicación móvil
disponible para usuarios de Android. El software es actualmente
gratuito y tiene un uso ilimitado. Así que realmente puedes volverte chiflado aquí. Puedes crear
todo lo que quieras. Y de hecho, ni siquiera
tienes que registrarte para obtener una cuenta. Sin embargo, la desventaja
es que los resultados son bastante lentos para generar
alrededor de aproximadamente 2 min. A veces son bastante bajas
en términos de resolución, las imágenes que creas
usando su software, también para uso no comercial, lo que significa que el crayón
es más adecuado para crear imágenes divertidas
para compartir con tus amigos y
jugar en lugar de para escenarios de
diseño comercial. Crown también ofrece un servicio de estampado en camiseta que es
algo genial por como $29, puedes comprar tu diseño de
AIR en una camiseta, sudadera con capucha, camiseta tie-dye
o una camiseta de manga larga. Obviamente, esta es una
de las formas en que crayón monetiza sus servicios artísticos
además de las donaciones y agrega saldo que
domina el sitio web. Entonces creo que corona es un
buen punto de partida ya que comienzas a
dominar las indicaciones de texto. Y tendremos un video tutorial de calambre que viene
en el siguiente video.
5. Cómo empezar con Craiyon: Hola amigos. En este video, vamos
a explorar rápidamente crayón, que es una de las
opciones
más rápidas y fáciles para comenzar tu viaje
con IA generada impar. Crayon se conocía
anteriormente como Delta E, lo que significa que tenemos
algunos miembros del equipo involucrados con ambos productos, lo que significa que hay
algún cruce allí en términos de
desarrollo e historia de productos. Sin embargo, a diferencia de mid journey, la interfaz de usuario para
crown se entrega a través un navegador web que puedes
abrir en tu PC o móvil. Y también hay una aplicación móvil disponible para los usuarios de Android. En términos de comenzar,
hay muchos menos pasos para crear tu primera
pieza de arte que mi viaje, por ejemplo, no
hay registro,
no hay verificación y nada que descargar. De hecho, todo lo que tienes que
hacer es ir directamente a crown.com en
tu mensaje de texto en la barra de búsqueda y hacer clic en
el botón naranja de la
derecha. Entonces es súper fácil. A continuación, debes esperar
aproximadamente de 30 a 90 s para que la modelo genere
tu solicitud de arte. Y una vez hecho
esto, escupirá nueve opciones en una cuadrícula de
tres por tres para que las selecciones. En general, la
calidad del arte no
es mala como puedes ver aquí. Mientras tanto, la calidad de imagen está bien pero no está realmente
optimizada para nivel de
producción y
sin duda es una resolución
menor que la de sus competidores, incluyendo el viaje medio
y la difusión estable Ahora, mirando las otras
opciones aquí en la pantalla, también
podemos tomar una captura de pantalla
que descargará la
cuadrícula de matriz de tres por tres a nuestra computadora. Y a la izquierda hay un estampado
en una camiseta opciones. Entonces, si seguimos adelante y hacemos
clic en ese botón, podemos ver una maqueta de
nuestro diseño en una playera. Ahí está entonces la opción de comprar, que podemos checar. Por 40 a ¥100 o $29. Puedes adquirir tu
diseño en una playera. Al parecer el material de Playeras es orgánico y renovable. Así que es bueno saberlo también. hay otras opciones de ropa Aquí también hay otras opciones de ropa, incluyendo sudaderas con capucha, tie-dye, playeras, playeras de
manga larga, etc. todas formas, la dejaré aquí. Obviamente esta es una de
las formas en que los crayones monetizan ¿son los servicios de arte que
además de las donaciones? Y los obvios banners publicitarios pegados en su sitio web, lo cual es un poco
molesto para ser honesto. En resumen, la ventaja clave
obvia del crayón es que
es rápido y fácil. Viene con un
uso ilimitado y puedes generar arte en minutos y descargar
esas imágenes de forma gratuita, y luego utilizarlas con fines
no comerciales. También debes tener en cuenta que
crayón pidiendo a los usuarios por favor acrediten crayón por
las imágenes siempre que sea posible. Ahora bien, en términos de inconvenientes
para usar este servicio gratuito, si nos fijamos en las
herramientas y características, hay muchas
menos opciones que yo, Jenny, por ejemplo, cuando otras plataformas en
términos de remezclar tu arte, subir tu imagen
como datos de entrada, o controlar los
detalles reales sobre el arte, incluida la relación de aspecto. Además, como se menciona en la calidad de
imagen es un poco menor en términos de resolución que otras opciones
en el mercado, lo que hace del crayón una herramienta divertida para compartir con amigos y
para crear maquetas, pero probablemente no sea adecuado para las necesidades
empresariales y el uso
comercial. Crayon también puede ser un poco impregna en términos de salida. He encontrado, por ejemplo,
que realmente puede
desmoronarse cuando se trata de
renderizar rostros humanos. Como pueden ver en
este ejemplo aquí, he pedido una imagen
fotorrealista de un presentador
de televisión
presentando la noticia. Y de esos nueve resultados de imagen, realmente no
hay nada que
me gustaría usar aquí. Así, para los rostros humanos, definitivamente
estaría
comprando otra opción de servicio. No obstante, para ese perro Chewbacca, en realidad
estaba bastante
contento con él. mí me pareció bastante bueno. Así que definitivamente tienen
una jugada por aquí, un crayón de prueba fuera. Por lo menos,
es algo divertido y fácil de hacer entre hacer tu trabajo real y
una buena manera de
comenzar a generar arte de IA.
6. Cómo desatar el arte de IA con Midjourney: Hola y bienvenidos de
nuevo. En este video, te
guiaré a través de
meet journey, que es una de las mejores opciones de
software en este momento para comenzar a crear AIR en 2022. Usando mi viaje,
podrás crear 25 imágenes antes de necesitar suscribirte
a una membresía
con su servicio. Pero para el propósito de este módulo de video y
del siguiente proyecto, no es necesario
gastar ni un dólar. Bien, entonces se pone en marcha. El primer paso es registrar una cuenta de Discord
en Discord.com. Discord es una popular plataforma social de
mensajería instantánea, que también es gratuita unirse. Después de registrar
una cuenta gratuita, puede optar por descargar discord en su
computadora como una aplicación, o abrir discordia directamente
dentro de su navegador. Ambas opciones están bien. Una vez que hayas terminado de
configurar la discordia, puedes saltar para conocer a
Jennie.com y hacer clic en el botón Unirse a la base
de aquí mismo. Esto te
redirigirá automáticamente a Discord ya sea en tu navegador o
a la aplicación de escritorio. Si ya lo has descargado, que es lo que he hecho. Ahora que estás dentro de la discordia, necesitas confirmar que estás dentro del servidor oficial de
meet journey. Esto significa que deberías
ver una marca verde cuando pasas el mouse sobre
el ícono de mitad del viaje. Una vez que hayas hecho eso, puedes consultar el mensaje de bienvenida, que tiene algunos
datos prácticos clave establecidos para ti. Entonces, por ejemplo, como
mencioné anteriormente, Meet Jennie ofrece a todos una prueba limitada o 25 imágenes, y luego varias opciones para
comprar una membresía completa con límites de
generación
ilimitados o más generosos, así como términos comerciales. Entonces, en cuanto a
empezar, tenemos que ir a uno de estos canales comprados para
novatos, de los cuales hay muchos. Siguiente necesidad de escribir
en barra hacia adelante imagina para iniciar
el prompt y pronto el bot de Discord te enviará cuatro imágenes en unos 60 segundos. Así que sigamos adelante y
hagamos eso haciendo clic en este nuevo canal aquí a través de
la barra lateral izquierda. Si aún no ves el canal de
novatos, comprueba que estás usando el servidor
oficial de meet journey o intenta restablecer la aplicación o página web de
discordia. Además, no importa exactamente
qué canal elijas, siempre y cuando sea un canal para
novatos. Una vez que estés dentro de
una película esta noche, puedes ver lo que otras
personas han estado creando y tomar algunas notas de qué
indicaciones están usando. Luego, cuando esté listo para comenzar
a crear, puede hacer clic aquí
en la pestaña del chatbox en la parte inferior y escribir
barra diagonal hacia adelante. Imagínese. Al comenzar a escribir,
notará una pestaña emergente sobre sus textos, en la
que deberá hacer
clic para confirmar que desea
crear una imagen. Ahora puede ingresar el
mensaje de texto que desea utilizar. Tenga en cuenta que meet journey
también te pidió que respetaras su contenido y
política de moderación manteniendo un PG 13 y evitar que las imágenes
molesten. Como parte de esta demostración, voy a usar Barrack
Obama tocando el bajo. No tenemos un
estilo específico definido. Una vez que estés satisfecho
con tu propio mensaje, puedes presionar Enter en tu teclado o hacer clic en
el botón Enviar, tal como estabas hablando con alguien en una aplicación de chat. Esta acción
viviría o tu solicitud al bot mute journey, que comenzará a
generar tus imágenes en
función de tu prompt de texto. El bot de Meet Jennie
generará cuatro opciones que tardaremos un minuto
o menos en entregarlo. Una vez que el indicador de progreso
haya llegado al 100%, verás una
cuadrícula de dos por dos o imágenes terminadas. Y dos filas de botones abajo. La fila superior es para
escalar tus imágenes. Ampliar una imagen
significa generar una versión
de píxeles más grandes de la imagen seleccionada, que es aproximadamente
1024 por 1024. Esto hará que tus
imágenes se vean mucho más nítidas y además automáticamente
agregará detalles adicionales para darte una imagen esos
toques finales. Esto quiere decir que esas cuatro imágenes
originales se parecen más las maquetas que
el diseñador ha proporcionado como opciones preliminares. Y luego la versión mejorada
como la versión final que está lista para su uso y hasta nivel de
producción en
términos de volumen. Tenga en cuenta que los
botones numerados U1, U2, U3 y U4, comen mapa
entre imagen individual. Entonces aquí tenemos u1, YouTube a la derecha, U3 en la parte inferior izquierda y U4 en la parte inferior derecha. Si quieres mejorar
la primera imagen, por
ejemplo, entonces todo lo que
tienes que hacer es hacer clic en una. La otra opción es
crear variaciones de tu arte usando la segunda
fila de botones a continuación. La creación de variaciones
generará para nuevas imágenes que son
diferentes pero aún similares en estilo general
y composición a la imagen original se
selecciona de las opciones de maqueta. Nuevamente, los V1, V2, V3 y V4. Cada uno mapea a una imagen
individual de la cuadrícula de dos por dos de arriba. adelante ahora
y hagamos clic en V1 y veamos con qué regresa el bot de
viaje de carne. También, tenga en cuenta que escalar
o crear una variación. Esto cuenta para
tu cupo de 25. Te mostraré al final
del video cómo verificar cuántas imágenes gratuitas te
quedan como parte de tu cuota gratuita. Ahora, porque hay
muchas otras personas en el canal creando arte
usando el medio tono comprado. Es posible que tengas que desplazarte hacia arriba para encontrar tu propia solicitud de imagen. El bot de tono medio ha
regresado ahora con una cuadrícula de
variaciones de
dos por dos basada en la imagen
original que seleccionamos. A continuación, probemos un exclusivo
haciendo clic en U4, que es la imagen en
la parte inferior derecha de
la cuadrícula de dos por dos. Nuevamente, tendremos que
desplazarnos por el canal de discordia para
encontrar nuestra nueva salida, entre las muchas otras que se
están generando
cada pocos segundos. Esta es definitivamente una de las
desventajas de hacerlo usando Discord como interfaz
para crear arte. Y puede ser un poco
caótico a veces, encontrar tu propio arte. Así que aquí vamos. Podemos ver que la media que
compró Johnny ha poblado
para versiones escaladas de la imagen
original que elegimos. Además, como puedes ver, hay mucho más detalle y profundidad en la imagen
que seleccionamos. Y en general, se
ve mucho mejor. Después de que superes tus imágenes, también
tendrás algunas
opciones más a continuación. La primera opción son
las variaciones degeneradas de esta imagen
como lo hicimos antes. Así que piensa en esto como decirle al diseñador de IA que lea para remezclar lo
que ya tienes. La segunda opción es
ampliar al máximo las subescalas la imagen a una resolución aún
mayor de aproximadamente 1664. 1664, ligero de lujo,
rehacer, por su parte, esto
vuelve a escalar la imagen sin agregar
tanto detalle. En cuanto a guardar tu imagen,
hay algunas opciones. Una opción es enviarte la
imagen a ti mismo en Discord. Puedes hacer esto pidiendo que conozcan a Joni
traído para enviarte un mensaje directo de discordia que contenga tu producción
final. Para ello, solo
necesitas hacer clic en el ícono Agregar reacción aquí en la parte superior derecha encima de la imagen y buscar el emoji
sobre, que es el primero que
se muestra aquí en pantalla. Esto automáticamente te
enviará la imagen en una ventana de
mensaje separada, que puedes encontrar en la parte superior de la
barra lateral izquierda en Discord. Entonces aquí tenemos nuestra imagen final. También podemos dar click sobre esta
imagen abierta a tamaño completo, y también dar clic en Abrir original para abrir la imagen
y un navegador web. Y para guardar, sólo podemos hacer clic derecho y
elegir guardar imagen. Y lo guardará en
tu computadora local. si estás usando
el viaje en Sin embargo,si estás usando
el viaje enla aplicación móvil de Discord, deberás tocar
la imagen y luego tocar el ícono de descarga
para poder descargar la imagen. Bien, y por último, si
quieres ver
cuántas imágenes te quedan como parte de tu cuota gratuita o de pago. Puede volver al
canal de novatos dentro del servidor de
viaje de carne y
escribir la información de
barra hacia adelante y luego hacer clic en la pestaña emergente de arriba. Aquí podemos ver que
me quedan por trabajos, que se traduce para formar qué salidas de imagen
puedo producir. Así que estoy empezando a bajarme un
poco aquí de mi corredor y estaré buscando
unirme a mi viaje como parte de una suscripción paga. Pero por ahora, espero que esta
demostración haya sido útil y estés inspirado para
darle una oportunidad tú mismo. Si está familiarizado
con el uso de Discord, no
debería tener
problemas para comenzar a usar MC journey. Y si es la primera vez que te registras y usas este código, solo toma en cuenta que te
llevará algún tiempo extra
familiarizarte con esta nueva interfaz y verificar una nueva cuenta.
7. Licencia de imagen de Midjourney + Términos de servicio: Bienvenida de nuevo. En este video,
vamos a ver la necesidad de conocer puntos
de viajes de carne, términos de servicio, así
como responder la importante pregunta sobre licencias
comerciales y
no comerciales. Antes de atacar esa pregunta, permítame destacar que
para usar mi viaje, debes tener al menos
13 años y cumplir con la edad mínima de
ascendencia digital en tu país. Sin embargo, si
no tienes la edad suficiente o tienes familiares
que quieran usar mi viaje, un padre o tutor puede aceptar los términos
en su nombre. Así que eso es fácil
de cuidar si todos sin embargo, siempre ten en cuenta que
Meet Joni intenta hacer su plataforma de servicios PG
13 y sea familiar. Jenny en realidad afirma que
no cree imágenes ni use indicaciones de texto que sean
inherentemente irrespetuosas, agresivas o abusivas de
otra manera, además de que no hay contenido para adultos o gore. Dicen aquí
en realidad por favor evita hacer contenido visualmente impactante
o perturbador. Bloquearemos automáticamente algunas
importaciones de textos. Entonces, si estás produciendo contenido de género para adultos
o de terror, tal vez busques otra plataforma como la difusión estable,
que es de código abierto. Y básicamente puedes
crear lo que quieras. Dicho esto, porque los activos artísticos son
generados por la IA, que es una nueva
tecnología en sí misma. Y el arte se basa
en las consultas de los usuarios. La salida no
siempre funciona como se esperaba, así que espere algún margen de error. Y si quieres crear contenido para adultos o arte no
apto para menores, entonces quizás sea más seguro ir
a una plataforma como difusión
estable. A continuación, de vez en cuando, es posible que encuentres algunas
palabras o frases bloqueadas y no podrías hacer las imágenes
usándolas si ves aparecer el emoji de
cruz
junto a tu trabajo, interpretarlo como una advertencia sobre la idoneidad de su contenido. Nella situaciones, su
contenido puede incluso ser eliminado de la vista o simplemente
no producido en absoluto. También puedes autocontrolar
tu contenido eliminándolo tú mismo usando la reacción
emoji cruzada en discordia. Esto eliminará la imagen
de la vista pública y ayudará a
evitar que se
meta en problemas quizás más tarde. Ahora, pasando a
los derechos de uso, al momento de la grabación
en noviembre de 2022, eres dueño de los activos de contenido que creas utilizando los servicios de
viaje. No obstante, hay excepciones, sólo para tomar nota de ello. La primera excepción es
para los miembros no remunerados. Si es un usuario que no paga, se
le permite
usar las imágenes fines no comerciales junto con la licencia
internacional de atribución cero de
cuatro puntos no comerciales de Creative
Commons . Es decir, puedes consultar los detalles de esa licencia si tienes dudas o si
quieres aclarar algún detalle. Pero esencialmente,
siempre y cuando estés usando tus imágenes con fines
no comerciales, deberías estar claro. Si quieres usar tus imágenes con fines
comerciales, entonces necesitas registrarte
como usuario pago para mí, un viaje que comienza en
alrededor de $10 al mes para membresía
básica. La segunda exención
se refiere a los términos de la licencia de usuario
corporativo. Entonces, para los propietarios o empleados que
trabajan en una gran empresa, generan más de $1 millón
en ingresos brutos anuales y utilizan sus servicios para
beneficiar a tu
empleador o empresa, tendrás que comprar el
plan de membresía corporativa. B
plan de membresía corporativa actualmente cuesta $600. También tenga en cuenta que este plan
implica cualquier depósito por adelantado, no reembolsable por un máximo de 12 meses al
usar el servicio. Así que en algún nuevo viaje te
ofrece mucho kilometraje. Tenemos licencias no comerciales. Y para licencias comerciales, solo asegúrate de que estás
pagando por el servicio. Y si estás
representando a una
compañía grande que tiene
solo $1 millón, necesitas estar pagando el precio de membresía
corporativa. Bien, Ahora veamos la privacidad. Entonces, cuando estés creando
en el viaje, ten en cuenta que esta es una comunidad abierta y
cualquier imagen regenerada en una sala de chat pública de discordia es visible por todos los que están
en la sala de chat, independientemente de si el modo
privado está activado. Esto es bastante diferente de otras plataformas donde
interactúas con
la IA de forma más privada o uno a uno donde solo
tú puedes revisar los resultados. Por otro lado, hemos hecho viaje
, porque estás creando en
un grupo de chat público de discordia, tus resultados están ahí
al aire libre
para que cualquiera pueda ver más de él
usando los servicios de Virginia. No puedes conocer a
Jodie, una
licencia de copyright mundial, no exclusiva, libre de regalías e irrevocable para reproducir obras
derivadas basadas en
indicaciones de imagen o contenido que
ingresas en su plataforma. Esto significa que otros también pueden
volver a mezclar tus imágenes e indicaciones cada vez que se publiquen indicaciones cada vez que se publiquen
en un entorno público. Y en realidad creo que esto puede ser algo bueno
porque te da una oportunidad para que tú también aprendas de los demás y obtengas inspiración. En resumen, ten cuidado con
lo que ingresas a la plataforma, especialmente las imágenes corporativas o información que no querrías filtrar
al público. Entonces, si eres un JK Rowling, por ejemplo, no
quieres estar
creando la portada de tu próximo
libro de Harry Potter en mi viaje en una
sala de chat de discordia pública antes de formar tus fans y los
medios que en realidad el libro
está
saliendo en Navidad. Y así como algo
para pensar, ya que esto podría no ser intuitivo
para los nuevos en la IA. Pero incluso si está utilizando una interfaz privada u otra plataforma de AIR
donde solo usted, como usuario final puede interactuar y ver la salida
que produce. Entiende que la IA
puede estar usando tus entradas, todas tus salidas para
volver a entrenar como algoritmo, lo que significa que parte de
tu ADN, por así decirlo, podría
filtrarse potencialmente en la producción otro arte generado de maneras
que no lo anticipaste. A lo mejor si subes una foto tuya y me dices Jenny, para remezclar esa foto de cierta
manera. Pero si la entrada, que es
la foto original de usted, y la salida que es
la versión remezclada, podría ser utilizada por el
modelo para volver a entrenar conocimiento de
ITS o para crear
algún trabajo derivado. En la mayoría de los casos, es
bastante improbable que esto suceda o que tenga algún efecto real porque a menos que esté
ajustando el algoritmo, cantidades
significativas de datos de
entrada para entrenarse a sí mismo, nada debería ocurrir. Para mí tampoco es
un gran problema de todos modos, pero algunas personas tal
vez no deseen que eso suceda. Por lo tanto, lo mejor es verificar los términos de servicios de la
plataforma o evitar el uso de dichos servicios
si tiene esas preocupaciones.
8. Indicaciones de la imagen: Hola amigos. En este
video, voy a guiarte por
el proceso de agregar imágenes como
datos de entrada usando el viaje. Anteriormente, hemos
mirado puramente un mensaje de
texto como datos de entrada
para el modelo de IA. Pero hemos hecho viaje. También
podemos usar una imagen como entrada agregando una o más URL de
imagen a su mensaje, meet journey utilizará esas
imágenes como inspiración visual. Puede mezclar palabras
con imágenes o simplemente usar una
imagen de carga estándar como su mensaje. Esta técnica es útil
si desea riff en una imagen existente o alinear la salida con un estilo
existente. Para usar una imagen como indicador, primero
necesitarás
navegar a uno de los grupos de novatos
dentro de la discordia. Y luego haga clic en el icono
más aquí en la barra de texto y seleccione la primera opción
que es subir archivo. A continuación, seleccione un archivo de
su computadora o álbum. Para mí, voy a seleccionar el cachorro Chewbacca que creé
anteriormente en crayon.com. Envía presionando Enter
en tu teclado. Y si te desplazas hacia abajo hasta
la parte inferior del feed de chat, deberías encontrar esa
imagen que acabas de enviar. Ahora haga clic en la imagen
en los registros de chat, haga clic derecho sobre ella y
seleccione la tercera opción, que se llama Copiar enlace próxima semana y ponerse a trabajar con creación de un nuevo prompt de texto. Empecemos por usar la barra diagonal
hacia adelante, imagina y pegando el enlace URL de la imagen que acabamos de copiar. Así que asegúrate de dejar
un espacio después de la URL. Porque si usas una coma, por ejemplo, esto hará que esa URL no sea válida. Después de dejar un espacio, entonces
puede comenzar definir lo que
quiere hacer con esta imagen, incluyendo cualquier modificador
y otros parámetros. Voy a insertar coma de perro
Rebecca, tema
navideño y después enviar este mensaje para generar
la solicitud de imagen. Y voilá, aquí están los resultados. Yo diría que la primera
y tercera opción aquí captan correctamente
el tema navideño. El primer resultado en la
parte superior izquierda tampoco se ve bien con el doble
creo que va ahí. Entonces, personalmente, me gustaría ver más
a fondo
el tercer resultado con el tope de Santa haciendo clic en
V3 a continuación después de 30 s más o menos, estos fueron los resultados
que recibí. El gorro navideño está
un poco fuera de aspecto, pero hace el trabajo en general. Sin embargo, no estoy lo suficientemente
contento con una similitud entre
estos resultados. El mensaje de imagen original que
subí como parte del mensaje de texto
original. Y esto nos lleva a
un punto importante. Por defecto, la ponderación de la imagen al prompt de
texto es 0.25, lo que significa que por defecto, el prompt de texto siempre
tendrá un impacto mucho mayor en la salida que la imagen que hizo referencia como
parte del prompt, podemos ajustar la ponderación
y la configuración predeterminada usando el parámetro desk dash IW e insertando el valor
relevante, por ejemplo, si usamos escritorios IW uno, esto hará que la URL de la
imagen sea tan importante para la
generación de imágenes como el prompt de texto, que en este ejemplo donde se
encuentran las palabras clave Chewbacca, perro y tema navideño. Si sin embargo quieres
aumentar la ponderación
de la imagen aún más de lo que puedes
empujar hacia arriba la espera a 1.5 o incluso más. Alternativamente, podría
simplemente eliminar el mensaje de texto por completo y usar la
imagen como entrada. Pero he descubierto que esto
a veces no funciona. Lo que voy a hacer ahora es
empezar de nuevo con la misma URL de imagen y las
mismas palabras clave que antes. Pero esta vez voy a agregar el parámetro desk
dash w v1 para darle a la imagen una mayor ponderación y relación
con el resultado de la imagen. Ahora podemos ver que
el cachorro Chewbacca, se ve mucho
más lindo, tal como lo hizo en el
prompt de imagen que subimos. Y tiene una expresión más pensativa
y reflexiva, lo que definitivamente es una vibra
diferente a los resultados de
esa imagen que
obtuvimos cuando la imagen en
espera se estableció el valor predeterminado de 0.25. Por supuesto, no esperes que la
IA tome su entrada de imagen como nivel base y luego
Photoshop y edite encima de ella. En definitiva, tiene su propia licencia
creativa
y usaremos o
imaginaremos esa inspiración en
lugar de como nivel base. Pero claro, se puede modificar
el parámetro de ponderación para darle
al modelo una mejor oportunidad de capturar la
representación visual de la imagen o imágenes de entrada. Bien, amigos, ahí vamos. En este video,
aprendimos a usar una imagen como parte de
nuestro prompt de textos. Esta es una
técnica muy útil para conocer, pero solo ten cuidado qué
imágenes subes una discordia. Al tratarse de un foro público. Gracias por ver
hasta el final, y te veré
en el siguiente video.
9. Enmascaramiento de imágenes: Bien, en este video,
vamos a explorar una técnica más avanzada
llamada enmascaramiento de imágenes. Si bien puede parecer complejo, enmascaramiento de
imágenes es
sencillo. Una vez que entiendas el proceso. Para esta demostración,
utilizaremos el software Delhi E2 para
mostrar esta técnica. Y eso se debe a que una
de las características destacadas es el cargador de imágenes. Muy pocas herramientas de software de AIR ofrecen
actualmente esta característica. Y en el caso del viaje de la carne, el cargador de imágenes se
utiliza para los prompts de imagen, pero no para la edición y
manipulación directa de
imágenes como vimos
en el video anterior. Delhi e, por otro
lado, Vamos a ver, recrear remixes de
una imagen subida o editar la imagen
directamente usando masking. El enmascaramiento es una técnica utilizada en edición de
imágenes que
permite seleccionar partes de una imagen y luego alterar esa área sin afectar
al resto de la imagen. Esta flexibilidad lo
hace ideal para realizar grandes
alteraciones, daños, sin cambiar drásticamente
la apariencia general. El enmascaramiento se usa comúnmente para eliminar fondos
de las fotos, pero también
se puede usar para crear efectos
especiales o
aislar ciertos elementos. En la siguiente demostración, te
mostraré cómo
tomar una imagen existente, modificarla y agregar
un nuevo fondo. Entonces, después de registrarte
para obtener una cuenta gratuita, puedes usar uno de
tus créditos gratuitos para subir una imagen a través
del botón Subir. Después quieres
seleccionar una imagen de tu computadora y luego recortar
la imagen si es necesario, usando el
editor de imágenes incorporado para esta imagen, voy a saltarme el recorte. Entonces ahora tenemos nuestro espacio de trabajo
aquí en la pantalla. Te darás cuenta de
algunas cosas aquí. El primero es el marco
de generación. Esto limita las modificaciones a
su imagen dentro de esa área, pero puede mover
ese marco para trabajar en diferentes partes
de la imagen a medida que avanza. Aquí abajo tenemos
un deseo de enmascaramiento. Así que ahora pongamos a
trabajar alineando el marco de generación de imagen el área objetivo y
luego usando el enmascaramiento, queremos borrar las áreas
que deseamos personalizar. Ahora, no te
preocupes demasiado por alisar los bordes. La IA reconstruirá la imagen para proteger los bordes
del sujeto o visto. Simplemente se necesita una
idea general de dónde aplicar el mensaje de textos una vez que haya borrado
el error deseado para la
edición, luego
puede ingresar
su mensaje de texto y hacer clic en el botón Generar
aquí a la derecha. Esto aplicará los prompts de
texto
al área borrada que borramos
usando nuestro deseo de enmascaramiento, vez que se toma en cuenta
el resto de la imagen. Ten en cuenta que cada mensaje
que envíes haciendo clic en el botón Generar
y te deduciremos un crédito del saldo de tus
cuentas. Otra cosa importante
para recordar es que el mensaje de texto debe hacer
referencia al nacimiento, el área que estás modificando y el error que estás guardando. Entonces en este ejemplo, necesito hacer referencia tanto
a Mí, que es Guy, como
a
las ediciones que quiero hacer a la
parte superior de mi torso, que son abdominales de seis paquetes y sosteniendo dos helados,
si acabas de escribir, Dame un paquete de seis y
sosteniendo dos helados, la IA no tiene contextos
suficientes. No se sabe si
los abdominales deben ser machos, hembras, animales, etc. así que realmente necesitas incluir
el tema de la imagen,
que es el chico van a los hombres adultos, y hacer referencia a toda la imagen y no solo al área seleccionada. Bien, entonces w e ha generado
la siguiente salida. Si bien no se entregó completamente en el paquete de seis que tenía en mente, la imagen sigue siendo una
mejora con respecto al original. Delhi también hizo un gran trabajo
al recrear mi tono de piel. Ahora, si estás satisfecho
con la salida generada, simplemente
puedes hacer clic en aceptar. Pero quiero tratar de mejorar la definición en mis abdominales
cambiando el prompt de texto. Primero, sin embargo, necesito
usar el enmascaramiento, quiero resaltar el
área que quiero modificar, que es la zona de mi pecho. Y luego necesito volver a ingresar
el prompt de texto completo. Y esta vez voy a intentar escribir
a un tipo con abdominales
altos definidos de seis paquetes
y sosteniendo dos helados. Vamos a hacer clic en Generar y
esperar los resultados. Bien, entonces aquí
tenemos los resultados. Esto realmente no era lo que esperaba en este caso,
está completamente equivocado. Ahora, aquí abajo en la parte inferior, podemos dar click en las flechas para
navegar a través de algunas variaciones
más. Entonces este se ve un
poco mejor. Este quita el
segundo helado, que no es adecuado. Y no tengo idea de
lo que es este. Volvamos a esa segunda
versión y hagamos clic en Aceptar. Después de aceptar la imagen
optimizada, podemos volver
a usar el enmascaramiento para cambiar el fondo. Editor de facilidad de Delhi Dios realmente recomienda
que edites el fondo o escenario perdido
porque se recomienda enfocarte primero en el tema o
personaje principal. En el caso de un sujeto
humano, por ejemplo, esto ayuda a obtener la forma correcta
del cuerpo, que es la parte más difícil antes de rellenar
un nuevo fondo, lo cual es sorprendente, más fácil de realizar
para el modelo. Bien, dado que el fondo
actual
no se encuentra directamente
en la playa, voy a usar la
mezquita y quiere quitar el fondo
por completo y luego pedirle a
Delhi que agregue un nuevo fondo
con una playa detrás de mí. Entonces, actualicemos el prompt de texto para incluir dos modificadores más, los que están parados en
la playa al atardecer. Y luego haz clic en Generar. Bien, La modelo ya ha llenado
el fondo de playa, pero definitivamente no
parece puesta de sol. Si también miramos a través de las
otras versiones, podemos ver que
otras imágenes tampoco logran captar la estética
del atardecer. Entonces tal vez necesito describir el color del cielo
en mi prompt de texto. Pero en realidad voy a dejar caer la puesta de sol y me
enfoqué en mejorar la calidad del fondo
agregando un nuevo modificador, que es un fotorrealista
porque
quiero que la imagen se
vea más realista para poder agregarla a Instagram. La salida de la imagen ahora se ve
más fotorrealista, pero el fondo está un
poco ocupado para mi gusto. Entonces voy a ver las
otras variaciones disponibles. Y si, esta se
ve bastante bien. Entonces, hagamos clic en excepto que
ahora necesitamos arreglar el área por
encima del marco de
generación de imagen reposicionando el fotograma así. Entonces podemos simplemente dar clic
en Generar nuevamente usando exactamente el
mismo prompt de texto. Y voilá, delta E tiene ahora comida de fondo y la
versión final que se ve bastante bien. Entonces, para resumir, WE no es tan
impresionante como el viaje de la carne
en términos de calidad de imagen, pero la mayoría no
tiene la función de
enmascaramiento de imágenes disponible en este momento. Entonces Delta E es definitivamente la primera y realmente la
única opción en este momento. Bien, espero que hayan disfrutado de
esa rápida demostración. El enmascaramiento de imágenes es una herramienta súper poderosa y
abre muchas oportunidades
creativas
para que vuelvas a mezclar
y retocar tus
propias fotos y arte.
10. Parámetros: Hola, bienvenido de nuevo. Ahora que estás familiarizado
con el uso de meet journey, hablemos de comandos
avanzados usando lo que se
llama parámetros, que también a veces
se llaman switches o flags. Sin embargo, en este video,
me referiré a estos comandos especiales
como parámetros. Hasta ahora, hemos
aprendido a crear un prompt de texto básico
usando barra diagonal. Imagínese producir una cuadrícula
de cuatro imágenes, por ejemplo, para slash imaginado que lleno en un
planeta desolado estilo cyber punk. Ahora para personalizar
las indicaciones de texto, puedes agregar parámetros usando dos guiones consecutivos
seguidos del perímetro
que deseas usar. En este ejemplo,
estamos usando
indicaciones negativas usando dos guiones,
no, seguidos de la palabra clave. La gente. Tenga en cuenta que los parámetros
deben agregarse
al final de su mensaje de texto en
lugar de al frente, o tal vez a la
mitad de su mensaje. Ahora, veamos algunos de esos parámetros
más utilizados. El primero es el incitador negativo,
que acabo de mencionar. Y puedes hacer esto
usando doble guión no, y luego tu palabra clave elegida
que puedes usar para evitar agregar ciertos elementos
a tu imagen, guión, guión. Sin costo, por ejemplo,
trataría de
sacar autos de la generación de
imágenes. Aquí tenemos dos ejemplos. la izquierda podemos ver
al menos de tres a cuatro personas en la colección de imágenes. Y en la
colección de la derecha podemos ver que hay una clara
ausencia de personas en al
menos tres de estas imágenes porque hemos usado el
parámetro no people. En la segunda imagen, sí
parece que podría haber una persona ahí va a lo mejor eso es una boca de incendios o
algo más. Es difícil de decir, pero en general, la incitación negativa ha
funcionado de manera muy efectiva aquí. A continuación, hablemos de tamaño y dimensiones usando aspecto o AR, estos parámetros vivos
para generar imágenes con una relación de
aspecto deseada, por ejemplo, escribir guión, guión
ir 16, 19, por ejemplo, le
conseguirá una
relación de aspecto de 16 por 19, que también es 448
veces 256 píxeles. Aquí hay algunos ejemplos
para ilustrar cómo la relación de aspecto impacta
el tamaño de su imagen. Alternativamente,
también se pueden usar los parámetros de ancho y alto usando
w y h respectivamente, y luego definiendo el número de píxeles para el ancho y alto, el valor que usa H y W
debe ser de 256-2034 píxeles. Además, se recomienda mantener esos valores como múltiplos de 64. Si buscas hacer
coincidir tu imagen con una relación de aspecto específica, puedes consultar con el software que estás usando y luego ingresar el ancho y alto en
tus parámetros de prompt de textos, que en mi caso aquí
usando Canva sería 1920 por 1080
respectivamente protector solar. Ahora a dos ejemplos más
que vuelven a mostrar el papel del tamaño y las dimensiones
y crear tu arte. A continuación tenemos números semilla. Veo que los números
se utilizan para reproducir arte usando la misma
aleatorización. Usar generar la imagen, poner simplemente usando el mismo número
semilla
te ayudará a crear una salida similar
usando el mismo prompt. Un número semilla debe ser
un entero positivo. Un entero es un número
entero entre cero y el número
aquí en pantalla. No voy a
intentar leer eso. Si no pones una semilla, se asignará
un traje aleatorio en su lugar para averiguar qué semilla
se usó detrás de escena, puedes reaccionar con el
emoji masculino a una imagen y luego revisar tus DMs en Discord
para obtener detalles como este, oye, podemos ver que
la semilla es 25588. Ahora, sí quiero decir que
el número C no es perfecto. Y basado en mi
experiencia hasta ahora, no
esperaría ver
exactamente la misma salida cada vez, pero esto podría
mejorar en el futuro. Todavía hay mucha
aleatorización involucrada con la producción de imágenes utilizando
el viaje en el que hemos estado. Ahora, hablemos de algo muy diferente a las semillas y eso es la aleatorización
usando tablero de escritorio, caos y luego
insertando un número, este parámetro introduce aleatorios
más variados y resultados aleatorios
más variados y
diferentes a partir de
tus salidas de imagen. El número utilizado con este
parámetro debe ser 0-100. Valores más altos favorecerán generaciones
más interesantes e
inusuales e intercambiarán por composiciones menos
confiables. En este ejemplo, he usado exactamente el mismo prompt de texto antes en los ejemplos anteriores, pero con un alto número de
caos de 70, lo que de hecho ha generado algunos
resultados únicos y diferentes que se ven bastante geniales. Así que siéntete libre de
experimentar con el
parámetro vacas si
tienes suficientes créditos en tu cuenta de ambigüedad
y quieres empujar los límites con
tu AIR a la generación. El siguiente parámetro
es el video de escritorios. Esto guarda el progreso de tu generación de imágenes
como un enlace de video, lo cual es bastante genial. El enlace del video se
le envía después de usar la emergencia de fusión en discordia para activar
un mensaje directo. Así que no olvides agregar que el macho emerge justo después de que se genera la
imagen. Aquí hay un ejemplo del
Osaka Blade Runner visto en el formato de video ya que fue
generado por mid journey. Bien, hablemos de
otro parámetro importante, que son los valores de calidad. La calidad modifica la
cantidad de tiempo que se dedica a generar tu
imagen en la actualidad, hay cinco opciones
disponibles usando el viaje. El primero es la calidad 0.25, que produce
resultados aproximados pero es cuatro veces más rápido y más barato de
producir que tenemos 0.5. De nuevo es menos detallado
en términos de resultados, pero dos veces
más rápido que el valor predeterminado. El valor predeterminado es uno, y no es necesario
especificar realmente este parámetro
porque viene incorporado con su generación de imágenes genéricas
predeterminadas. siguiente es la calidad a, esto es
para obtener resultados más detallados, pero ten en cuenta que es más lento. Y también es
el doble del precio debido
al mayor uso de GPU. Utiliza dos GPU. Y entonces
tenemos calidad cinco. Esto es mucho más experimental. Podría ser más
creativo o de detalle, pero también podría ser peor. Y sí
consume muchas GPU. Utiliza cinco para ser exactos. En general, lo más probable es estés usando el valor predeterminado, que es uno y
no necesita ser especificado en
tus mensajes de texto. Pero si buscas resultados de
mayor o menor calidad, puedes mirar usando
las otras cuatro opciones para ajustar la salida
de tus imágenes. Por último, quiero
mencionar dos cosas más que no son realmente
parámetros per se, pero son otra
opción a tener en cuenta. El primero es el modo privado
y público. Usando para tal privado
y desplegado tal público, puede alternar entre
estos dos modos diferentes. En modo privado,
los trabajos solo son visibles para ti en
modo público, mientras tanto, tus trabajos son visibles para
todos en la galería, aunque los estés creando en un hilo o en un mensaje directo. Sin embargo, tenga en cuenta que el
acceso al modo privado sí causa
$20 US adicionales al mes. En segundo lugar, quiero
compartir contigo la función show usando forward slash show e insertando
el número de trabajo, puedes recuperar el ID de un
trabajo en una galería en Discord produciendo la imagen
resultante y los botones de
variación de lujo plus. Esto, en otras palabras,
te permite revivir cualquier trabajo que hayas generado antes y llevarlo a
cualquier canal bot, incluso si has perdido el acceso
al prompt original. Entonces, por ejemplo, si
escribo barra diagonal hacia adelante, mostrar en discordia y haga
clic en el mensaje se
muestra arriba. Puedo usar esa
función pegando el ID de trabajo de un proyecto anterior que
hice e insertarlo aquí. Esto
proporcionará entonces ese proyecto, incluyendo todas las opciones de lujo
y variación para permitirnos hacer más
ediciones a nuestro arte. Eso nos lleva al final de
este video sobre parámetros y
los dos tips bonus respecto al modo
público-privado
y al comando show. Para obtener más información, no
dude en consultar la documentación de
sitios web de medios tonos en mid journey, dot kit book dot IO
para obtener más información. Y tenga en cuenta que algunos de estos parámetros tal vez tuitean
o se eliminen en el futuro. El
algoritmo Beta y HQ permanente, por ejemplo, han sido descontinuados
como se muestra aquí. De igual manera, se
introducirán nuevos parámetros a lo largo del tiempo. Así que esté atento a las nuevas configuraciones avanzadas a
medida que salgan. Bien, gracias a todos
y nos vemos el siguiente video donde estaremos
creando algunos AIR increíbles.
11. Bote de DSNR para avisos personalizados: Hola y bienvenidos de nuevo. En este video, quiero
compartir con ustedes
unas útiles
herramientas impulsadas por ai que he estado usando recientemente
llamadas dB SNR. Se trata de un bot de Discord para
generar mensajes de imagen. El bot utiliza
técnicas de procesamiento de
lenguaje natural y aprendizaje automático para analizar su entrada y luego generar indicaciones
únicas
basadas en esos requisitos. Esta herramienta, creo que es
particularmente útil para los diseñadores de
productos que deseen generar imágenes de un producto. Tenemos características hechas a medida. Sigamos adelante. Para usar D SNR. Deberá agregar
la herramienta gratuita en Discord yendo primero
a Discord dot GG, barra diagonal
hacia adelante S, k, x x ZAB, WWF. Si no tienes
una cuenta de Discord, sigue
adelante y registra
una cuenta gratuita. Ahora, una vez que esté configurado
y encerrado en la discordia, haga clic en Aceptar, invitar
abierto en discordia. Después de agregar el bot en Discord, echa un vistazo al mensaje de bienvenida aquí podemos ver que
el bombeo primario para D SNR es para el diseño de Slash. Pasemos ahora
al canal general. Y usas el comando de diseño escribiendo eso
en el cuadro de chat. A medida que escribimos, aparecerá
automáticamente una pestaña arriba, en la
que podemos hacer clic. Y luego queremos ingresar al
tema que queremos crear. Esto podría ser un auto, una bicicleta y un animal, cualquier cosa que realmente
quieras crear, pero debes
limitarlo a un tema. Para esta demostración, voy
a seguir adelante con una bicicleta de carretera. A continuación, la herramienta bot
te pedirá que selecciones el estilo. Hay tres opciones. Uno es disfraz,
fotorrealista, y también logo. Para esta demostración, sigamos
adelante con un estilo personalizado. A continuación, la herramienta proporciona una serie de indicaciones
para ayudarlo a generar un mensaje de imagen personalizado que se ajuste a sus preferencias
y requisitos. Entonces la primera pregunta es, ¿de qué color es el cuadro
de la bicicleta de carretera? Y aquí tenemos cinco opciones. Rojo, azul, negro,
blanco y amarillo. Voy a ir con blanco. A continuación, ¿qué tipo de manillares
tiene la bicicleta? De nuevo, hay cinco opciones. Sigamos adelante con Dropbox. Por cierto, si no estás satisfecho con la
elección de las respuestas, siempre
puedes hacer clic en
el otro botón de abajo e insertar
una respuesta personalizada. Volvamos ahora y
aplastamos estas
últimas preguntas. Lista de clips, pétalos, Frenos de disco. Después de completar las indicaciones, dB SNR generará
un mensaje de texto para nosotros. Mientras esperas, también
podrías ver lo
que todos los
demás están creando. Entonces podemos ver que aquí hay un
usuario generando
mensajes de texto para un Honda Accord
y también un Cadillac, que ambos se ven bastante bien. Bien, así que aquí está nuestro aviso. Podemos copiar y pegar eso en mi software AS elegido ahora. Pero primero podríamos
querer editar el medio. Así que baja y
haz clic en el botón aquí para agregar medio de arte. La IA nos preguntará qué
medio queremos elegir. Tenemos cinco opciones. Y para esta demostración, sigamos adelante con el diseño
gráfico. Esta acción actualizará
nuestro prompt de textos existentes, que ahora incluye
un nuevo modificador diseñado en un estilo de
diseño gráfico, que ha escrito un
poco torpe para ser honesto. Pero de todos modos,
vamos a dar clic en Finalizar y luego copiamos
el prompt de texto. A continuación, Gerber a su
software de IA que podría ser estabulado difusión Delhi E o medular
dentro de este código, por ejemplo y pegar ese texto
en un nuevo indicador. Estoy usando Mint Journey.
Entonces necesito navegar hasta el
servidor de meat journey on discord y hacer clic en uno de
estos canales novatos. A continuación, escribiré slash
forward imaginado, y luego pegaré en el prompt. Presiona Enter en tu
teclado o haz clic en Enviar y esperar los resultados. Y listo, tenemos cuatro opciones basadas en
nuestro prompt de texto personalizado. Puedo ver un problema aquí con las líneas de palabras en
la imagen superior derecha, pero creo que
ambas opciones inferiores parecen imágenes
profesionales que
podríamos usar para un sitio web, blog u otro medio de contenido. Entonces lo tienen, ahora tienes
una nueva herramienta en tu kit AIR. Así que adelante y juega con
DSLR inexplorada, donde te lleva la IA.
12. TIEMPO DEL PROYECTO: Tiempo de proyecto. Entonces el
proyecto para este curso es crear tu propio arte y
vamos a usar midterm. Entonces lo primero que
quiero hacer es que quieras descargar, registrarte, abrir la discordia en
tu computadora
navegando a Discord.com,
reenviar descargas de barra diagonal. Entonces quieres que todo
eso esté listo. Una vez hecho esto, has
pasado por la verificación, puedes iniciar sesión en tu cuenta de
Discord. No querías ir
a conocer journey en mutiny.com four
slash home y luego unirte a la versión beta
navegando hasta el enlace de discordia. Una vez que esté todo configurado allí, entonces
podrá
ir con la discordia, buscar el servidor de
viaje de carne. Y luego quieres ir al canal
de novatos que aparece
aquí en el lado izquierdo. Entonces puedes simplemente
saltar al cuadro de texto, escribir para tal imaginado. Y luego puedes comenzar a
escribir tu prompt de texto. Pero una vez que estés listo, entonces
puedes golpear Enter. Entonces inmediatamente
volveremos a ti en 20 segundos con el resultado. Entonces, una vez que hayas hecho todo eso, puedes
revisar tu imagen, tal vez tomar una captura de pantalla, y luego puedes
subirla a Skillshare para obtener algunos comentarios y
compartir tu creación. Entonces, con ganas de ver
lo que todos crean.
13. Antes de irte: Bien hecho por
llegar hasta el final. Ahora, para terminar,
solo quiero decir que si bien la tecnología de IA
puede parecer un
poco aterradora e intimidante el espíritu que se está
filtrando en todos los aspectos de la producción de contenido, desde el
marketing hasta las portadas de libros, realmente subraya que dominar AIR será una habilidad clave para el creador de contenido
moderno. Personalmente inseguro de que en los próximos años
habrá muchas oportunidades en lo que los autores del trabajo humano
más máquina reimaginando en la era de la IA término
el medio faltante, que es el espacio fértil
donde los humanos y las máquinas colaboran para explotar
lo que cada lado hace mejor. Las máquinas de coser,
por ejemplo, realmente sobresalen en la gestión de tareas
repetibles a gran escala, mientras que la experiencia humana
puede ayudar a mantener la calidad y
proporcionar retroalimentación. Entonces, en el caso de la IA, inteligencia
artificial puede ser utilizada para hacer girar una imagen. Y entonces el creador de
contenido humano puede usar esa imagen como base
para la portada de un libro, miniatura de
YouTube u
otro elemento de contenido. Utilizando aplicaciones de software
como Canva o Photoshop. Pueden agregar texto innecesario, editar las dimensiones y realizar otras modificaciones para
producir la versión final. Casi también estamos ahí con software de diseño
tradicional que incluye Canva, Notion y Figma, integrando aplicaciones de texto AI a
imágenes. Estas características proporcionan a los usuarios
un panel todo en uno para crear imágenes en
movimiento de arte visual en el futuro. Probablemente comenzando con memes de
tres segundos y eventualmente
largometrajes. Pero por ahora, tengan
una jugada con el software de AIR que
mencioné en este curso. Y esté atento a las nuevas versiones de software y casos de uso medida que surjan para
mantenerse al día con las nuevas herramientas de IA. También te gustaría ver
que hay una IA para eso.com o
períodos futuros o IO, que cubren una variedad de
categorías que incluyen AIR, textos, video y software de producción de
diseño
que puedes clasificar. Bien, gracias a todos
por ver. Espero
ver lo que diseñas
y puedas seguirme
en aprendizaje automático subrayado principiantes y echa
un vistazo a mis
libros de aprendizaje automático en Amazon. Gracias y que tengas una buena.