Getting the transcript
Reading the captions from YouTube. A video nobody has opened here before takes 10 to 30 seconds; this page fills in on its own.
Getting the transcript
Reading the captions from YouTube. A video nobody has opened here before takes 10 to 30 seconds; this page fills in on its own.

Dot CSV Lab · @DotCSVLab
Words
5,479
Runtime
27:53
Speaking pace
196wpm
Reading time
23min
196 words per minute, between the 181 median and the 201 75th percentile of 349 measured videos. That distribution comes from the 349-video hook study.
Opening (first 30 seconds)
Esta semana hemos tenido no dos ni tres, sino tres modelos nuevos por parte de Antropic y Open AI. Por un lado, con Open AI complementando la saga de modelos de la familia GPT6, incluyendo, ahora sí, la que podríamos llamar la gama intermedia alta GPT6 Sol y la gama de modelos más rápida, eficiente y menos inteligente GPT6 Luna, quedando a partir de ahora la gama media de modelos GPT Terra desterrada, ya no van a existir los modelos Terra. Y por otro lado tenemos el movimiento por parte de Antropic, que ha presentado sus nuevos modelos
98 words, the words spoken in the first 30 seconds at 196 words per minute.
Free, no signup. See how the first 30 seconds hold attention, with rewrites.
Sentence shape
| Measure | This transcript |
|---|---|
| Sentences | 212 |
| Average words per sentence | 25.8 |
| Longest sentence | 122 words |
| Questions asked | 4 |
| Sentences containing a number | 48 |
Most used terms
What this transcript is
Every word below is the caption track YouTube publishes for this video, pulled from the video itself and reproduced unchanged. It is not Prepublish's writing, not a summary, and not a re-transcription: it is the video's own published captions. Spanish captions, generated automatically by YouTube, in the video’s original language. Source: the video on YouTube. A channel that would rather this page did not exist can ask for its removal through the contact page, and it is removed.
No Script X-ray for this video: YouTube shows a Most replayed graph only once a video has enough views.
Esta semana hemos tenido no dos ni tres, sino tres modelos nuevos por parte de Antropic y Open AI. Por un lado, con Open AI complementando la saga de modelos de la familia GPT6, incluyendo, ahora sí, la que podríamos llamar la gama intermedia alta GPT6 Sol y la gama de modelos más rápida, eficiente y menos inteligente GPT6 Luna, quedando a partir de ahora la gama media de modelos GPT Terra desterrada, ya no van a existir los modelos Terra.
Y por otro lado tenemos el movimiento por parte de Antropic, que ha presentado sus nuevos modelos Opus 5. Y trayendo un modelo que muchos sentidos mejora obviamente a lo que Opus 5.0 podía ofrecer, que fue un modelo que salió bastante rana, pero que incluso en determinadas tareas también estaría a la par que Fable 5.1. Eso sí, siendo un modelo más eficiente que va a respetar mucho mejor vuestras cuotas de uso. Y hoy podríamos centrarnos y mirar los benchmarks y los blog post y todos los detalles técnicos y hablar de estos modelos, pero creo que es más interesante que nos entremos en un fenómeno que ha ido ocurriendo con la última remesa de modelos desde GPT6 Astra hasta el reciente Oppus 5.
Que es un modelo espectacular en el uso sobre todo en lo relativo a la creación audiovisual. Hablo de que los últimos modelos han dado un salto en capacidades en materia de modelado 3D, motion graphics, animaciones pixel art, diseño de videojuegos, un montón de funcionalidades donde, como digo, estos últimos modelos han dado un salto en capacidades que creo que debemos de estar prestando atención justamente en este momento. como apasionado que soy del audiovisual y habiéndome dedicado durante tantos años a comunicarme con vosotros y divulgar pues haciendo animaciones, este es un tema que me toca muy directamente, que me apela y del cual tengo muchísimos ejemplos hoy que quiero enseñar y compartiré también cómo los he podido hacer y que además demuestra claramente el liderazgo que ahora mismo tiene OPU 5.5 para todo lo referente a producción audiovisual.
Así que en referente a los nuevos modelos, lo único que voy a indicaros es para qué os podría servir cada uno. Y es que si habéis estado disfrutando durante las últimas semanas de GPT6 Astra, la gama alta de modelos de Open AI, pero habéis notado que las cuotas de uso pues se gastaban bastante bastante rápido al ser un modelo más potente, pues ahora la buena noticia es que se suma a la familia de modelos, pues el modelo Sol, el modelo Luna, que además vienen con unas mejoras de eficiencia que al menos en la API lo vais a notar porque el precio tiene un descuento del 50%.
Y desde la suscripción de Chat GPT, pues notaréis que modelos como GPT6 Sol, que bueno, mi recomendación es que lo uséis para la mayoría de tareas que no requieran de una inteligencia máxima, notaréis también que vuestras cuotas de uso van a sufrir menos y van a durar más, lo cual es una buena noticia porque como podemos ver aquí los nuevos modelos Sol, que sería esta línea amarilla clarita, comparativamente con el modelo GPT 5.6 6 S sobre el benchmark Agent Last Exam, pues vemos que tenemos un modelo un poquito más barato y también que rinde un poco mejor, que al final pues sería el titular general con el que nos tenemos que quedar con este GPT6 Sol.
No es disruptivo, pero es lo que tiene que ser un modelo más eficiente para poder trabajar en nuestro día a día. Pero la sorpresa de esta semana la ha traído Antropic con su modelo OPU 5.5, que no solo trae nuevas capacidades, sino también un modelo más eficiente que va a hacer que de nuevo vuestras cuotas sufran menos. Buenas noticias por ambos lados. Sin embargo, como decía al principio, hoy me quiero centrar especialmente en algo que justamente este modelo OPP 5.
Y digo ilustrado en sentido figurado, pero también literal. Porque si algo ha dejado claro este nuevo modelo OPU 5.5 es que los modelos del lenguaje, que recordemos se comunican únicamente a través de la generación de texto, pues lenguaje escrito, lenguaje de programación. A pesar de ello, en los dos últimos meses su salto en capacidades en todo lo referente a diseño audiovisual ha ganado muchísimas capacidades y también buen gusto y criterio.
A mí esto me gusta pensarlo de la siguiente forma porque parece que con cada salida pues estamos trabajando siempre con la misma tecnología que OPU 5.5 es lo mismo que Oppus 5 pero un poquito mejor y esta es una realidad que sí se cumple, pero que tenemos que aprender a separar según los diferentes dominios que estemos evaluando. A mí me gusta mucho pensar las capacidades de la inteligencia artificial como sigmoides.
Una función como esta donde primero tenemos un crecimiento que empieza a ser exponencial en las que en un periodo de tiempo relativamente rápido tenemos unas ganancias en capacidades que son increíbles y que nos vuelan a todos la cabeza y que luego llegado a un punto pues los sistemas no pueden mejorar hasta el infinito, pues acaba por saturarse con lo que luego serían mejoras marginales. Y lo que ha pasado históricamente con todos estos modelos del lenguaje es que para diferentes dominios estas sigmoides se han recorrido en diferentes tiempos.
Por ejemplo, las capacidades de modelar lenguaje, de poder comunicarse bien, pues lo vivimos claramente en la franja de 2022 a 2024. GPT2 fue el comienzo, el despegue dentro de esta sigmoide en sus capacidades del lenguaje. GPT3 se situó justo en la franja exponencial donde vivimos ese salto que a todos nos dio pues un vértigo y nos explotó la cabeza. Y luego ya con GPT4 y GPT5 sí hemos continuado teniendo mejoras en las capacidades de modelar lenguaje, pero cada vez con ganancias marginales, hasta el punto de que hoy en día no nos planteamos tanto cuánto ha mejorado OPPO 5.5 en su capacidad de verbalizar palabras.
De hecho, sucede incluso que cuando los modelos van mejorando sus capacidades en otros dominios, capacidades como las del lenguaje escrito incluso retroceden un poquito. Es decir, los modelos se vuelven peores, pero porque al final queremos que los modelos sean lo más generales posibles y que aprendan muchas capacidades diferentes. Y eso hace que de repente en otro momento vivamos pues la ascendencia en esta sigmoide en otras capacidades, por ejemplo, programación.
Creo que todos aquí podríamos defender que desde 2024 hasta 2026 también hemos vivido este escalado en la sigmoide. donde en 2024 pues sí, los modelos representaban unas ciertas capacidades de programación y donde durante todo el año 2025 y también a principios de 2026 hemos vivido todo el crecimiento de la franja exponencial en las capacidades de programación y es lo que hace que hoy en día pues si vemos que los modelos sí siguen mejorando en sus capacidades de programación, pues estas ganancias cada vez sean más marginales.
Todo esto lo explico porque quiero que entendáis que ahora mismo, en estos dos últimos meses, es cuando hemos transitado, desde mi punto de vista, toda esta franja exponencial en materia de creación audiovisual. Los modelos de repente han ganado muchas capacidades y muy buen gusto en el uso de herramientas como After Effects Blender, en sus capacidades de representar gráficos o animaciones con programación, con dibujo vectorial, muchas capacidades que de repente han desbloqueado que los modelos de lenguaje hoy, ahora mismo nos estén volando a todos la cabeza con todas las funcionalidades que vamos a pasar a comentar.
Y esto ya es algo que me empezó a quedar claro con este vídeo de aquí compartido por Kevin hace justo pues una semana en el que compartía el siguiente vídeo creado por Opus 5.0, no 5.5 5 y donde por primera vez al menos yo pude experimentar el ver una animación hecha por un modelo del lenguaje a partir de usar no pues un modelo generativo como podríamos estar acostumbrados a lo que la haga, sino a través de programación utilizando JavaScript generando cada fotograma como si fuera una animación dibujada fotograma fotograma, pero en este caso utilizando como digo, código de programación, una animación que se ve y se escucha tal que así.
H [música] barbaridad y esta es una barbaridad porque es de las primeras demostraciones para mí de muy buen gusto por parte de un modelo de lenguaje a la hora de tener ritmo, a la hora de tener criterio audiovisual, a la hora de representar, o sea, cosas como estas que se están dibujando aquí, como es la progresión geométrica de esta bacteria. Es decir, toda la información que se está representando aquí y el buen gusto con el que se hace es una demostración de que algo grande se está cosciendo dentro de estos modelos de lenguaje.
Otro ejemplo es esta animación que para mí es de mis favoritas de las que he podido ver en este caso hecha con Opus 5. [música] Es una barbaridad. O sea, la cantidad de información bien colocada, cómo se hilan las animaciones, cómo es visualmente atractivo. Eso estaría para mí encima de a cualquier animación a la que yo pudiera aspirar, obviamente, a hacer, pero ni siquiera a poder pagar o producir para un proyecto mío.
O sea, una animación de este tipo que yo quisiera tener para Dot CS SV hecha, pues requiere de mucho tiempo y muchos recursos que ahora mismo la inteligencia artificial pues ya nos lo empieza a ofrecer. Y esto ha hecho que la gente pues se anime y se lance a probar diferentes estilos de animaciones para ver hasta cuánto se puede forzar la maquinaria de Opus. Y ojo, no digo que las animaciones sean 100% perfectas o que vayáis a llegar a un buen resultado one shot si no le dais un poco de mimo al input que le facilitéis a Opus.
Porque lo que yo me he dado cuenta es que para poder conseguir diferentes estilos de animaciones que sean medianamente atractivos, gran parte de la clave está en no pedirle directamente hazme una animación sobre este tema y ya está, sino que realmente a través del prompt hay que darle referencias o hay que condicionarle a diferentes estilos de animación que ya estén establecidos y serán esos casos donde Opus entonces sí os ofrezca resultados bastante bastante buenos, resultados como este de aquí, que ha sido una de las primeras cosas que yo he querido ir a probar porque con los diferentes ejemplos que me he ido encontrando hablando, me he dado cuenta de que las capacidades de hacer pixel artus 5.
Entonces, viendo ejemplos como este o ejemplos como este, que me parece una animación superdinámica y muy bien ejecutada, pues yo lo que he hecho ha sido irme aquí donde me pone prompt shared below, pues cojo el prompt que aquí el bueno de Maghid nos comparte y tomando este prompt de aquí pues me lo he llevado a chat GPT para pedirle que me adapte el prompt para la animación que yo quiera hacer. En este caso le he dicho, quiero que me adaptes este prompt se lo pego por aquí.
Pero en este caso para hacer una animación de un diagrama de una red neuronal pixel art que haga con energía el forward warpass hacia delante en colores azules enérgico y hacia detrás en rojo magenta con un fondo negro dinámico e importantísima esta palabra y ahora entenderéis por qué riguroso. Y este pront llevo luego de paseo a cloud para que trabaje en mi animación. El resultado, tras un ratillo trabajando es esta pedazo de animación que vemos aquí, que a mí me vuela la cabeza, pero no entendéis cuánto, o sea, no, para mí esto es mi momento lisedol en lo que respecta a hacer animaciones.
Se dibuja el número con Emenist, se dispara el for Pass, se calcula la clase, aquí ha habido un error, se propaga el error para atrás y se entrena la red neuronal. Está perfectamente ilustrado. Y la locura de esto y es lo que tenemos que entender con la inteligencia artificial es que aquí este dominio que estamos ganando no eclipsa lo que ya anteriormente la inteligencia artificial podía ser, que era, por ejemplo, programar a un nivel de excelencia superior al que cualquier animador pueda ejecutar.
Y eso puede hacer que la inteligencia artificial aquí haga cosas tan locas como que para ser riguroso, que era uno de los detalles que yo le puse, que quería que tuviera la animación, rigor, lo que ha hecho el Cloud ha sido entrenar a una red neuronal real, es decir, la animación que estamos viendo no es una representación cercana del funcionamiento de una red neuronal, no, sino que lo que ha hecho ha sido entrenar su propio modelo, sino que lo que ha hecho ha sido entrenar su propio multilayer perceptron con las diferentes capas, con el datasetist, que ha sido el que que yo le he pedido y con esto ha generado toda la animación.
Las animaciones del forward y del backw pass que estamos viendo son 100% rigurosas, loquísimo. Siendo así, por supuesto, ya he continuado la saga, eh, generando, pues en este caso, modelos convolucionales. También también podemos ver una animación espectacular. Le he pedido un poco de rotación 3D para poder ver las diferentes capas y lo ha ejecutado perfectamente. También con el diseño de sonido, que es perfecto en este caso, el estilo retro.
Y también he querido cerrar pues con la animación de un modelo de difusión también en su proceso de entrenamiento. [risas] Qué locura. Pero oye, ¿qué queréis a lo mejor que os haga una animación con un estilo diferente? Pues fijaos aquí le he pedido, quiero que me hagas la animación más bonita que puedas hacer de 40 segundos de lo que tú sientas que será el futuro de la inteligencia artificial y la ciencia utilizando cualquier herramienta que quieras.
Y aquí, tras un buen rato trabajando, pues yo creo que fue unos 40, 50 minutos, el resultado que he obtenido es una animación como esta. [música] [música] Sin palabras. Esto lo que hace, por supuesto, es solo enriquecer pues las capacidades audiovisuales del modelo para hacer animaciones y ya está, sino que ahora podemos encontrar sinergias muy relevantes entre diferentes dominios, pues audiovisual y programación directamente nos lleva a que estos modelos pues sean más competentes, por ejemplo, en el diseño de videojuegos.
Y aquí quiero empezar a demostraros de paso, pues cómo un modelo como GPT6 Astra se compara con el nuevo OPU 5.5. He de Seis Astra sigue siendo un modelo excelente para muchísimas tareas y quizás aquellas que no sean más visuales, pues sigue siendo un modelo con una inteligencia que seguramente en la mayoría de casos siga excediendo a OPPO 5.5 y también con una mayor eficiencia. Dicho esto, en materia audiovisual no hay comparación porque fijaos, le voy a pasar una referencia a una imagen como esta de aquí de un juego que vi que alguien implementaba en Twitter y le voy a pedir en este caso a GPT6 Astra que me genere un juego de un pangolin surfero con una estética similar a la de este juego pixel art, aunque efectivamente adaptado su temática.
Diseña tanto el juego como sus sonidos para que sea una experiencia pixel art dinámica y de calidad. Y tras 10 minutos de trabajo, GPT6 Astra Medio me acaba implementando un juego tal que así. Bueno, tenemos el pangolín y vemos que hay un pixel art de fondo, pero si os dais cuenta es un pixel art que no se ajusta a la rejilla de un pixel art porque esto realmente es un asset que ha generado el modelo de imágenes y que no ha diseñado programáticamente.
No es no es realmente un pixel art puro, igual que tampoco esto eh lo sería. Está más bien intentando simular la estética más que bueno, hacerlo como debería. Aparte de eso, el juego pues muy normalito, simplemente ir saltando por aquí y mal calibrado, no está bien ejecutado en el sentido de que hay cosas que obstáculos que no se pueden saltar directamente. Por ejemplo, esto es imposible de saltar porque las físicas no están afinadas.
Bueno, un juego que para empezar no está mal, pero habría que ir depurando bastante para llegar a un resultado que podamos decir sea mínimamente divertido. Sin embargo, tras pasando este mismo prompt a, en este caso OPU 5.5, tras un ratito jugando y one shot, el resultado que obtenemos es este pedazo de juego de aquí. Atentos porque los controles se las trae. Hay que mantener justamente el acelerar cuando bajamos la ola.
Hay que soltar para poder saltar y en el aire el pangolín puede hacer una pelotilla. Y entonces aquí el juego. Fijaos que esto sí es un pixel art perfecto. Vale, estoy intentando hacerlo lo mejor que puedo, chicos. Vale, me he chocado con una medusa. Tengo que pillarle el truco. Ayer lo pude hacer bien. Ahí estábamos. Y cuando cogemos muchas de estas hormigas, al parecer son hormiguitas, le puedo dar a la E y activar el modo termita.
Ah, bueno, serán termitas. Claro, está bastante bastante mejor. Fijaos como tenemos diferentes escenarios, diferentes zonas. Ayer pude llegar al nivel 5 y hay muchos niveles diseñados. A ver, fijaos como la música reactiva a cuando estamos jugando mejor o peor. Ah, y de verdad, ayer estuve jugando más de lo que quiero reconocer en este vídeo. Como podéis ver, este resultado frente a este resultado es que no tiene ningún tipo de eh comparación que sea justa.
Otra comparación que os puedo enseñar es la siguiente. Le pido en este caso a Chat GPT Astra muy alto que me cree un diorama pixel art animado muy detallado, que sea un loop largo de una escena relacionada con los laboratorios Open AI y Antropic, como dos edificios con sus trabajadores, sus memes y memes relacionados con el mundo de la IA. llénalo de detalles interesantes y haz una escena rica en contenido. La ejecución, en este caso de Chat GPT no es mala, pero de nuevo vuelve a ser un poco tramposa porque se apoya mucho en el modelo de generación de imágenes que, oye, si consigues ejecutarlo bien, pues puede ser un buen resultado, pero aquí vemos algunas de las deficiencias que tiene el propio modelo de imagen de Chat GPT actualmente, y es esta necesidad de meter textos por todos lados.
No sé si os habéis dado cuenta de esto, pero es un modelo que si no coloca eh 20,000 palabras por imágenes eh se pone muy nervioso. Y de nuevo, queriendo un pixel art, pues nos damos cuenta que aquí como pixel art hay una estética imitada, pero no sería un pixel art propiamente dicho. Aún así me ha sorprendido la ejecución de chat GPT en este caso, porque sobre esta imagen generada, ahora sí ha creado este mundo pseudoactivo donde superponiendo diferentes elementos, pues consigue darle vida a esta imagen y en una ejecución que no es mala.
Fijaos cómo están los ventiladores girando. Tenemos aquí un dron que pone AGI Tomorrow. Vemos diferentes investigadores, los ordenadores ahora tienen pantallas que funcionan. Aquí vemos las bombillitas, la fuente se mueve. Es decir, hay una ejecución que no está nada mal bajo este camino que ha elegido de una imagen y darle vida. Y fijaos que tiene pues sí tiene sus memes y sus cositas, pero entre Open AI y Antropic nos pone, "Oh, la misma curiosidad, un futuro iluminado juntos, está viva el amor y yo quería un poquito más de mala leche y un poco más de sentido del humor." Y ahí es donde yo le voy a conceder el punto de nuevo a Opus 5.
Por un resultado que quizás de partida pues no os parezca tan atractivo, ¿no?, como lo que podría ser la imagen generada por Chat GPT, pero que es un pixel arto. Sí, un pixel art bien hecho, donde además fijaos en la gran cantidad de detalles y de memes que hay que son muy buenos. Rápidamente, desde la pizarra donde se van añadiendo cada vez más nombres a diferentes modelos por la nomenclatura de los modelos de Open AI.
La pizarra con el entrenamiento, attention is all you need, Field ai, los servidores quemándose, nuestra GPU se están derritiendo. ¿Por qué se derrite? Pues por todas las imágenes que están en colas que se están generando, todo lo que estuvieron lanzando las Navidades de 2024, la pizarra contabilizando cuántos días han pasado sin dramas, los centros de procesamiento abajo ocultos, aquí el monstruo de la aquí abajo, la gente manifestándose entre Open AI y Antropic y con el muro aquí en medio representado.
Un muro que, por cierto, al rato aparece aquí como un robotito que que se lo carga y rompe el muro como buena representación. Antropic día sin haber lanzado un paper de seguridad. Bueno, bueno, es que muchísimos detalles. La vending Machine Tropic, la Constitución, AJI 202, Felde a está todo. Si es que por tener, fijaos que tenemos hasta el maldito loro estocástico aquí posado sobre una farola. Es muy bueno. Fijaos, fijaos, fijaos.
Viene, viene, viene el robotito. Viene el robotito, viene el robotito y rompe el muro. No hay muro, señores. Y aquí arriba, no sé si lo habéis visto, un trabajador de Open AI que se va trepando por aquí por la cuerda, que se va antropic y aquí marcando como una nueva eh incorporación. La cantidad de inteligencia, conocimiento y buen gusto que hay que tener para lograr un pixel art detalle es algo que me vuele a mí la cabeza.
Para que tengáis una última comparación entre Astra y OPU 5.5 en creación de contenido audiovisual, quiero enseñaros este ejemplo de aquí, donde el otro día para el vídeo de Jeff, vídeo que podéis ver, que publicamos el lunes, quería producir una serie de animaciones para dejar ilustrado mejor el concepto que quería explicar. Y para eso lo que hice con el modelo fue pasarle una referencia de estilo de animación que más o menos me gustaba, en este caso en chat GPT, y también el audio ya editado y recortado para que la IA pues pudiera tener la referencia y hacer la animación correctamente.
El primer resultado que me consiguió Chat GPT pues no está mal, pues es casi casi lo que podría ser un PowerPoint animado, es un buen punto de partida, pero que sí requería de más trabajo y más iteración. trabajo y tración, que tra varios intentos pues acaba con una animación tal que sí, que es la que pudisteis ver en el vídeo. Y es muy interesante porque fijaos como la animación se adapta perfectamente pues a cómo yo estoy verbalizando cada una de las palabras.
Fijaos, abre corchete, abre comillas, predicción cierra comillas dos puntos positivo. A abre corchete, comillas predicción cierro comillas dos puntos negativos. Cierro corchete, abro corchete, titi, titi, y así hacer que el modelo del lenguaje vaya escupiendo. Vale, aquí os estoy enseñando cómo es la trastienda de DSV ahora mismo. Y esto pues llegó al vídeo final y el resultado, oye, a mí me pareció lo suficientemente bueno como para daros un material ilustrativo de calidad, pero [carraspeo] no he podido evitar irme a Opus 5.
Para sentir pues como ese contenido audiovisual ya queda caduco. Y este resultado aún no lo he visto, pero lo vamos a ver aquí en comunidad. Sobre qué es Jeff. AF podríamos definirlo no como un enorme modelo de lenguaje, sino como un enorme modelo de decisión. Y es que ya sabéis que la gran virtud de los modelos del lenguaje, su forma de funcionar es que no tiene colorer todos los datos que le facilitamos a través del contexto, de la ventana de contexto.
Muy superior estas animaciones, o sea, esto está al nivel y un poquito por encima de lo que yo, por ejemplo, haría para mi canal principal. Voy a quitar el vídeo del lunes y lo voy a volver a subir. [risas] Es muy buena animación, ¿eh? Wow. Estuptura de datos con abre corchete, abre comillas, predicción, cierra comillas, dos puntos positivo. Abre, abre, me huele la cabeza. Comillas, predicción, cierro comillas, dos puntos negativo. ¡Uf!
Qué detalle toda la estructura de predicciones de esta tarea de clasificación. Y de nuevo, riguroso, que es lo que siempre he intentado trasladar en mis animaciones, pero obviamente hay un punto en el que eh el rigor lo tienes que cortar o si no no llegas hacer un Motion Graphics eh para un vídeo de YouTube. El tiempo no te da, tienes que simplificar, pero wow, pero wow, es que aquí la IA entiende exactamente la naturaleza de lo que le estás pidiendo, entiende hasta cómo funciona la red neuronal mejor que yo, con lo cual te puede hacer animaciones pues más rigurosas que ninguno de nosotros.
Y fijaos, muy importante, que esto no me lo hizo bien chat GPT, adaptarse mucho a la referencia que le he pasado. Esto lo ha hecho así porque justamente la referencia que le pasé era esta imagen de aquí. Si hubiera sido otro estilo completamente diferente, hubiera seguido otro estilo. Es que, madre mía, ves esto one shot y te vas luego al resultado este, que era el resultado habiendo estado pulido y y dándole muchas vueltas.
Es que no tiene sentido, chicos. Y fijaos que en todos estos ejemplos estamos trabajando con diseño web, pero nada te impide pues usar el software que habitualmente usas para hacer motion graphics, para hacer 3D. Pues por ejemplo, yo aquí he cogido una referencia, una imagen que he visto en Twitter y que me ha gustado, pues esta escena de aquí, y le he pedido a Cloud que me la intente reconstruir dentro de After Effects, donde luego yo pues podría meter directamente mano y empezar a tocar cosas pues para acercar más a la visión de lo que quiero.
Y si esta es la imagen de referencia, pues fijaos que el resultado tras dejar a Clot trabajar es algo tal que así, que de nuevo es una animación perfectamente ejecutada. Me da esta rabia verla tan bien hecha, pero vamos, es un primer punto de partida donde yo ahora podría, como digo, pues empezar a tocar capas, ajustes, pero me da casi el 90 95% de lo que necesitaría para hacer una animación de este tipo. Y donde digo After Effects podéis meter Unity, podéis meter Blender, podéis meter cualquier software de diseño gráfico, pues con el que trabajéis.
Con todo esto, lo que necesito que entendáis es que estamos en un mundo diferente, de nuevo, a donde estábamos hace un mes y medio, que estas capacidades que ofrecen ahora los modelos no la teníamos a principios de verano y esto desbloquea un montón de casos de uso, un montón de funcionalidades y un montón de cosas que ahora mismo nuestro pequeño cerebro omín solo intenta ajustar a a ser más rápido y más eficiente lo que ya podíamos hacer antes, pero que no estamos viendo las segundas y terceras derivadas de lo que se puede desbloquear con lo que estos modelos pueden hacer y lo que van a seguir mejorando. próximamente, porque como digo, no es solo el hecho de que ahora la IA asume nuevas capacidades, sino que estas capacidades hace sinergia, hace combo con todo lo anterior que la inteligencia artificial podía ser y eso abre caminos nuevos.
Y un ejemplo que lo ilustra muy bien es esto de aquí. Es una tontería. Una demo que quise hacer para probar hasta dónde llegan las capacidades, en este caso de GPT6 Astra hace un par de semanas, donde le dije así sin mucho miedo, eh, tu tarea será crear un GTA realista y con detalles basados en la ciudad de Las Palmas de Gran Canaria, mi ciudad. Buscamos calidad gráfica, usabilidad, fidelidad y con esto pues iterando, iterando, iterando y sin invertir muchísimo tiempo.
Son simplemente 10 versiones que surgen de 10 prompts diferentes. He podido crearme de la nada pues una demo interactiva como esta, que es una barbaridad. Un maldito GTA en mi ciudad, en la ciudad de Las Palmas. Uy, mira, acabo de atropellar a uno, uno menos en Canarias, ¿eh? un GTA, fijaos con las guaguas y todo que, o sea, uy, hay policía, esto sí que no lo sabía, esto es nuevo. Ah, vale, vale. Pues no sé si la policía me va a perseguir, pero que bueno, ilustra muy bien lo que lo que quiero indicaros que es no es solo puedo ahora crear un una demo como esta interactiva, no, no es que sí, el diseño se tendría que trabajar muchísimo más, pero es que aquí GPT6 ha podido hacer toda la labor de investigación de buscar cuál es el mapa de la ciudad.
Fijaos, tengo mapeada gran parte de la ciudad con el callejero real. O sea, yo estoy conduciendo ahora mismo por aquí y sé reconocer perfectamente en qué lugar estoy, porque así es como se ve la ciudad de las palmas de Gran Canaria y y la playa de las canteras que tiene hasta la barra de la recife que tenemos por aquí. O sea, está todo cartografiado porque el propio GPT6 en modo agente se ha descargado la cartografía, se ha descargado a partir de mapas satelitales, pues cuál es la altura de cada zona, se ha descargado cuáles son los edificios en cada zona y ha modelado toda la ciudad al completo sin exigirme a mí ningún tipo de esfuerzo en una demo que, bueno, tratándose de una demo online, que al final tiene que funcionar en un navegador con la tecnología web, pues oye, nos da un apartado gráfico que no es ni de lejos el GTA 6, es el GPT6, pero que al final demuestra una cantidad de horas de trabajo para poder modelar esto.
O sea, esto es la plaza Santa Catalina, se se reconoce perfectamente, o sea, hay como diferentes lugares de la ciudad que están perfectamente eh modelados y esto sí lo hubiéramos querido hacer porque nos apetecía, tendría una cantidad de trabajo tal que es verdaderamente asombroso que esto haya podido salir solamente por 10 prompts. Claro, vosotros que a lo mejor no sois de Las Palmas, esto os parecerá eh la cosa más cutre del juego de la Play 1, pero de nuevo, mi mi cabeza está siendo explotada de nuevo por octava vez en este vídeo.
Y si salimos por aquí, salimos por el otro lado de la ciudad, que nos permitiría llegar al puente del rincón. Estamos por la zona de Guanarteme. Aquí la carretera hacia el norte está un poco destruida. Qué barbaridad, es que está toda la ciudad, hasta la isleta, al fondo. Se ve el auditorio aquí. Qué barbaridad. Es que está toda la ciudad. Está el auditorio. A ver, lo puedo poner de noche. Lo podemos colocar de noche.
Y aquí tenemos la la ciudad iluminada, el auditorio y el puente del rincón para para poder seguir. Algún día modelaré Gran Canaria entera. De verdad, poca broma, que esto hace 5 años te lo cogía un ayuntamiento y le llamaba Metaverso y se sacaban una partida bastante guapa de de fondos [risas] de innovación. Y hoy lo tenemos con 10 prompts en una tarde de trabajo muy tonta. Chicos, chicas, esto es lo que tenemos sobre la mesa.
Los modelos acaban de abrir un mundo novedoso, fantástico, que a mí me apasiona. Como podéis comprobar en este vídeo, que es todo el tema de animaciones motion graphics. Ahora los modelos son mucho más visuales y tenéis un montón de potencial que podéis desbloquear ahora. Si queréis hacerlo con Opus o queréis hacerlo con Astra, pues ya habéis visto las comparaciones. Tenemos modelos cada vez más capaces, más superiores.
Y ahora espero ver vuestros resultados, que me compartáis por Twitter o que me pongáis vuestros casos de uso aquí abajo en comentarios. Si os ha gustado el vídeo, no dejéis de compartirlo. No os quedéis con esta información vosotros. Esta información que yo os he regalado, regaladla al mundo también. Y os dejo por aquí un par de vídeos que también os regalo, que podéis ojear. Vídeo por aquí superinesante, no sé cuál es.
Vídeo por aquí también menos interesante, tampoco sé cuál es. Y nos vemos chicos y chicas con más inteligencia artificial en un próximo vídeo aquí y en el canal principal que dentro de poco sí voy a sacar vídeo. Ya se viene por fin un vídeo nuevo. Adiós.
The words are the caption track's own and nothing is reworded or re-transcribed. Paragraph breaks are placed between sentences so the text reads as prose.
Free tools for your own script. No signup, no login.
Paste your draft and see where viewers are likely to drop off, with a rewrite for each weak line.
Paste the first 30 seconds of your own draft for a hook score and rewrites.
Check your draft against YouTube's advertiser-friendly guidelines before you record it.
Read this channel's public videos and transcripts, and download a writing brief for it.