KEN’S CAT LOG

Noticias de IA para generación de imágenes y vídeo — 2026-09-08

La actividad del lado de código cerrado se concentró en un nuevo género: en lugar de modelos de difusión, agentes LLM (GPT-6 Astra) controlan herramientas con GUI y Blender para crear imágenes y vídeo 3D. El tema surgió de forma independiente en Reddit, X y Bluesky. Por su parte, el movimiento de código abierto se concentró en la comunidad ComfyUI de Lemmy y en canales de verificación de YouTube, con escasa presencia en Bluesky, Pinterest, Reddit y X.

Noticias de IA para generación de imágenes y vídeo — 2026-09-08

En esta investigación transversal de seis plataformas, el tema más destacado fue el surgimiento independiente, en tres plataformas, de un nuevo género del lado de código cerrado: en vez de modelos de difusión, agentes LLM (GPT-6 Astra) operan directamente herramientas con GUI y Blender para crear imágenes y vídeo 3D. Aunque el ecosistema de código abierto fue en general menos visible, a nivel de comunidad de desarrolladores se mantuvo activo: en la comunidad !stable_diffusion de Lemmy se lanzaron de forma consecutiva cinco o seis nodos de aceleración de ComfyUI para modelos de vídeo MiniMax H3 durante la misma semana, y en YouTube continuaron las pruebas comparativas sobre la disputa de liderazgo entre Flux.2/Flux 2 Klein y Qwen-Image. Pinterest y la mayoría de las publicaciones de Reddit y X se inclinaron por nombres de productos cerrados (Midjourney, Sora, Veo, Runway, Kling, Nano Banana, Seedream, etc.), mientras que los nombres propios del código abierto apenas aparecieron. En conjunto, también destacó en Reddit y Pinterest que, más que las tendencias técnicas, los debates sobre si algo era o no IA y el impacto social de agentes de IA que sustituyen roles y tareas humanas atrajeron atención.

Entre plataformas

  • La generación visual mediante agentes de GPT-6 Astra se volvió tema de conversación de forma independiente en tres plataformas: el caso de Astra operando Blender para renderizar fue tratado por separado tanto en Reddit (r/DefendingAIArt) como en Bluesky (@simonwillison.net), mientras que la demostración de crear una ciudad 3D con Astra desencadenó una cadena de imitaciones en X (@synabreu, @GulatiYajat). El principal tema transversal de esta investigación no fue la evolución de los modelos de difusión, sino la nueva idea de que agentes LLM se apoderen de herramientas existentes para crear arte y contenido 3D.
  • Sigue compartiéndose una valoración dividida sobre que la coherencia de personajes y escenas en la generación de vídeo continúa sin resolverse: tanto en Reddit (r/generativeAI, r/aivideomaking) como en X —con @atlas_remake elogiando Seedance 2.5 y @Aiden_Tech_Ai señalando fallos en escenas complejas— se publicaron al mismo tiempo posturas opuestas sobre el mismo problema.
  • La presencia del código abierto se distribuye de forma muy desigual según la plataforma: !stable_diffusion de Lemmy está lo bastante activa como para que se lancen simultáneamente nodos de ComfyUI para MiniMax H3, incluido ComfyUI-Ref2VA-VSA, y YouTube mantiene comparativas de Qwen-Image, FLUX y Wan 2.2. En cambio, en Bluesky, Pinterest, Reddit y X casi no se encontraron publicaciones que incluyeran nombres de modelos abiertos concretos, como nuevas versiones de Stable Diffusion, FLUX, Wan o HunyuanVideo. Varias secciones de limitaciones de las plataformas señalaron la misma debilidad estructural: no está claro si el código abierto no generaba conversación o si se pasó por alto debido a búsquedas sesgadas hacia productos cerrados.
  • Las controversias sobre autenticidad y el impacto social avanzan en paralelo a las tendencias técnicas: publicaciones cuya autenticidad se discute —r/isthisAI de Reddit, y las imágenes de Thor debatidas entre r/pj_explained y r/NewRockstars—, aimod.social de Bluesky que etiqueta automáticamente imágenes generadas por IA, vídeos falsos de las elecciones a gobernador de Nueva York (Bluesky/404media), y miniaturas con sellos “FAKE” en Pinterest muestran que, en varias plataformas, se observó de manera independiente más conversación sobre distinguir y desconfiar que sobre crear.

Plataforma por plataforma

Reddit tuvo mayor interacción, entre 12 hilos, en subreddits de debate sobre IA y verificación de autenticidad (r/antiai, r/aiwars, r/DefendingAIArt, r/isthisAI, r/pj_explained, r/NewRockstars) que en comunidades especializadas en generación de imágenes y vídeo por IA (r/generativeAI, r/aivideomaking, r/GoogleFlow, r/freetoolsAI). Al usarse un único término de búsqueda, casi no fue posible comparar código cerrado y abierto.

X se centró en el anuncio de Sol-H3 de NVIDIA —inferencia de vídeo más rápida que la reproducción en tiempo real—, su reproducción local por usuarios individuales y una cadena de imitaciones de creación de ciudades 3D con GPT-6 Astra. De 40 publicaciones, solo una cantidad limitada estaba directamente relacionada con IA generativa de imagen o vídeo; muchas eran ajenas al tema debido a la mezcla de tendencias regionales, en especial de Explore alrededor de Croacia.

YouTube no permitió obtener visualizaciones ni suscriptores por el renderizado JavaScript de sus páginas, pero confirmó canales comparativos y explicativos que cubren tanto código cerrado (Midjourney V8.2, Grok Imagine, Google Gemini “Omni”) como código abierto (Qwen-Image-2.0, FLUX, Wan 2.2). Entre las seis plataformas, fue la fuente más adecuada para contrastar ambos ecosistemas.

Bluesky devolvió 403 de forma constante en la API de búsqueda (app.bsky.feed.searchPosts), por lo que fue necesario revisar individualmente los feeds de cuentas conocidas como @simonwillison.net y @404media.co. No se alcanzó el criterio de finalización de analizar 20 publicaciones. Solo se encontró una publicación concreta de código abierto: un informe de ejecución local de Qwen 3.7 27B.

Lemmy registró su mayor conversación puntual alrededor de la polémica sobre el supuesto giro de Midjourney hacia escáneres médicos de ultrasonido en !techtakes. Del lado abierto, fue la única de las seis plataformas con información primaria abundante: lanzamientos simultáneos de nodos ComfyUI para MiniMax H3 y competencia de benchmarks en Qwen-Image-Bench, incluidas LLaDA-Image y Boogu-Image-0.1.

Pinterest permitió revisar 30 de 50 pines preseleccionados por un worker, pero la consulta única y sin categorización hizo que dominaran las infografías de comparación de productos cerrados y tutoriales. No se encontró ni un nombre de modelo o proyecto abierto. La falta de fecha y métricas de interacción en el manifiesto también impide juzgar actualidad.

Qué vigilar

  • Inferencia de vídeo más rápida que el tiempo real con MiniMax H3 / Sol-H3 y proliferación de nodos de optimización para ComfyUI — X (@xieenze_jr) / Lemmy (ComfyUI-Ref2VA-VSA, entre otros). Habrá que observar hasta qué punto las reproducciones con pesos abiertos alcanzan los anuncios de infraestructura en la nube.
  • Expansión de la generación visual mediante agentes GPT-6 Astra — Reddit (r/DefendingAIArt) / Bluesky (@simonwillison.net) / X (@synabreu). Queda por ver hasta dónde se extiende la imitación.
  • Disputa por el liderazgo de código abierto entre FLUX.2/Flux 2 Klein y Qwen-Image — YouTube (SECourses, Urban Decoders). Habrá que seguir cómo los resultados de más de 700 pruebas influyen en la adopción.
  • Novedades de la polémica por el supuesto giro de Midjourney hacia dispositivos médicos, Midjourney Medical — Lemmy (vía pivot-to-ai.com). Si el giro de una empresa de generación de imágenes termina siendo una broma o se materializa.
  • Consecuencias del abuso de vídeo con IA en publicidad política, en las elecciones a gobernador de Nueva York — Bluesky (404media.co). Si habrá respuesta regulatoria o de las plataformas.
  • Evolución en la resolución del problema de coherencia de personajes y escenas en vídeo generado — Reddit (r/generativeAI) / X (@Aiden_Tech_Ai). Si las herramientas todo en uno realmente se acercan a resolverlo.

Recomendaciones

  • Mantener la generación visual mediante agentes GPT-6 Astra —operación de Blender y creación de ciudades 3D— como tema de seguimiento específico en próximas ediciones.
  • Para no perder anuncios de código abierto, añadir en la próxima ronda búsquedas transversales por nombres propios como "FLUX", "Stable Diffusion", "Qwen-Image", "Wan" y "ComfyUI".
  • Dado que la API de búsqueda de Bluesky sigue devolviendo 403, ampliar de antemano la lista de cuentas a supervisar.
  • Como Pinterest no ofrece fechas ni métricas de interacción, limitarlo a observación periódica de notoriedad de herramientas y no usarlo para comparativas de noticias urgentes que requieran actualidad.
  • Como la controversia sobre el supuesto giro de Midjourney hacia dispositivos médicos sigue sin confirmarse, evitar citas concluyentes hasta que haya una fuente primaria, como un anuncio oficial de Midjourney.
  • Priorizar !stable_diffusion de Lemmy y los canales de pruebas de YouTube como fuentes principales para seguir tendencias de código abierto.

Calidad de los datos

Bluesky —por el 403 constante de su API de búsqueda, que impidió alcanzar 20 publicaciones— y Pinterest —sin fecha ni métricas de interacción en el manifest, por lo que no se puede determinar actualidad, y sin menciones de código abierto en una consulta única— fueron las fuentes con menor densidad de información. Reddit y X se limitaron a una sola consulta, el propio título del brief, por lo que no recopilaron intencionadamente publicaciones que contrastaran con claridad código cerrado y abierto. Como resultado, la conversación sobre código abierto quedó concentrada en Lemmy y YouTube. YouTube no permitió recuperar visualizaciones ni suscriptores por las restricciones del renderizado JavaScript.

Resumen por plataforma

Reddit

Reddit — Noticias de IA de generación de imágenes y vídeo

Principales espacios de discusión (subreddits)

Los 12 hilos recogidos proceden de 12 subreddits distintos, uno por cada comunidad. Hay pocas comunidades especializadas en generación de imágenes y vídeo por IA; destacan las de verificación de películas/falsificaciones y los debates culturales sobre IA.

Subreddit Miembros Hilos recopilados
r/whenthe 813,975 1
r/isthisAI 406,607 1
r/antiai 317,903 1
r/aiwars 167,158 1
r/generativeAI 151,385 1
r/RemoteWorkers 75,332 1
r/DefendingAIArt 72,770 1
r/pj_explained 96,256 1
r/NewRockstars 15,523 1
r/freetoolsAI 7,887 1
r/aivideomaking 6,517 1
r/GoogleFlow 1,789 1

La única consulta fue "Image and Video Generation AI News". Los resultados se inclinaron menos hacia subreddits especializados —r/generativeAI, r/aivideomaking, r/GoogleFlow y r/freetoolsAI— que hacia comunidades de debate sobre IA —r/antiai, r/aiwars y r/DefendingAIArt— y de verificación de “¿esto es IA?” —r/isthisAI, r/pj_explained, r/NewRockstars y r/whenthe—.

Reacciones de la comunidad
  • GPT-6 dibuja “a mano” mediante control del ratón y también puede falsificar time-lapses (hilo 2, r/antiai, 7,013 puntos y 1,009 comentarios, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/). La publicación afirma que, en vez de un modelo de difusión, un LLM (GPT-6) recibe control de ratón y teclado para dibujar en software de ilustración digital e incluso producir un time-lapse aparentemente auténtico. El comentario principal, de u/Nayutantantan (2,507 puntos), expresa desesperanza: “Ya ni tengo ganas de grabar time-lapses como prueba”.
  • GPT-6 “Astra” crea un render fotorrealista en Blender (hilo 9, r/DefendingAIArt, 143 puntos y 13 comentarios, 2026-09-06, https://www.reddit.com/r/DefendingAIArt/comments/1w970uy/). Se debatió que la IA no generó el vídeo directamente, sino que un agente de IA operó Blender para realizar el render. u/TheMaliciousSquid comentó que GPT-6 parece encaminado a ser el más fuerte en lo visual y se preguntó si superará a Claude en programación.
  • La extensión “AutoFlow” para Google Flow incorpora generación continua de vídeo (hilo 12, r/GoogleFlow, 12 puntos y 6 comentarios, 2026-09-01, https://www.reddit.com/r/GoogleFlow/comments/1w4eeyp/). Añade “Continue from Last Frame”, que transfiere automáticamente el último fotograma del clip anterior al primero del siguiente; también ofrece gestión de colas y de imágenes de referencia. Se anticipa una función para unir clips sin cortes.
  • Una publicación promocional de una herramienta gratuita de generación de imágenes por IA concentra demanda (hilo 3, r/freetoolsAI, 39 puntos y 48 comentarios, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/). Un servicio presentado como gratuito, ilimitado y sin registro atrajo comentarios. u/Puzzleheaded_Lab4757 dijo que le ahorró cientos de dólares y muchas horas, mientras u/thecragmire cuestionó la sostenibilidad de sus costes operativos.
  • En vídeo generado por IA, la duración y la coherencia de personajes siguen siendo la mayor barrera (hilo 10, r/generativeAI, 4 puntos y 15 comentarios, 2026-09-07, https://www.reddit.com/r/generativeAI/comments/1w9klb7/). A quien quería crear un vídeo cinematográfico de ciencia ficción de dos a cuatro minutos, u/Missy_Desu sugirió crear fotogramas con GPT Image 2 y animarlos con Seedance 2.5, advirtiendo de un coste aproximado de 100 dólares por minuto terminado. u/KissinglyPolished señaló que mantener coherencia de personajes al pasar de imagen fija a vídeo es extremadamente difícil y que las herramientas todo en uno aún no lo resuelven.
  • La generación de vídeo gratuita en hardware ligero sigue siendo poco realista (hilo 8, r/aivideomaking, 6 puntos y 15 comentarios, 2026-09-07, https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/). Ante el deseo de producir un vídeo gratuito de 45 segundos solo con un móvil y un iPad, u/NewLifeWares señaló que 45 segundos requieren capacidad de centro de datos; gratis, lo máximo probable son clips de cinco segundos con marca de agua que hay que ensamblar.
  • Las imágenes de comida generadas por IA para publicidad siguen siendo calificadas de apetecibles solo en sentido inverso (hilo 4, r/aiwars, 4 puntos y 177 comentarios, 2026-09-03, https://www.reddit.com/r/aiwars/comments/1w69cdj/). Hubo críticas a que empresas usen imágenes de comida generadas por IA. u/LCI_Jake dijo que parecía gore generado intencionadamente, como un nido de insectos. En cambio, u/Bassed_Hummble mostró un resultado generado localmente en Krea 2 durante 40 segundos y sostuvo que puede mejorar con el prompt adecuado.
  • Una oferta de trabajo remoto para evaluar subtítulos de IA provoca una avalancha de reacciones (hilo 5, r/RemoteWorkers, 152 puntos y 739 comentarios, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/). La oferta consistía en revisar por 30 dólares la hora errores en subtítulos generados por IA —objetos mal identificados, colores y lectura errónea de texto—. La mayoría de los comentarios pedían el enlace para postularse, con poco debate sobre el contenido.
  • Surgen dos debates sobre la autenticidad de un vídeo de IA demasiado realista (hilos 1/6, r/NewRockstars y r/pj_explained, difusión duplicada de la misma publicación, 2026-09-02). Una publicación que afirmaba que una filtración de Thor chocando contra una columna era CGI y no IA recibió una réplica frontal del comentario principal en r/pj_explained, u/ceaserisnothome: la expansión perfectamente circular de la explosión sería prueba de IA. La misma imagen dividió las valoraciones.
  • Vídeo de olas apareciendo dentro de una ventana: ¿IA o metraje real? Comentarios divididos (hilo 7, r/isthisAI, 0 puntos y 79 comentarios, 2026-09-07, https://www.reddit.com/r/isthisAI/comments/1w9cyub/). El autor señaló la extrañeza de que el agua aparezca dentro sin romper la ventana. u/RioReiser85 lo atribuyó a un malentendido de perspectiva y defendió que era real; u/bulbousEd respondió que el movimiento de la espuma en la proa era físicamente imposible y, por ello, generado por IA.
Señales
  • Lo que crece: preocupación ante que la IA deje de parecer IA. La gran respuesta al hilo 2 —7,013 puntos y 1,009 comentarios— muestra fuerte inquietud por el momento en que un LLM puede controlar directamente herramientas GUI y falsificar incluso pruebas de dibujo manual.
  • Lo que se descarta o minimiza: la petición de crear vídeos largos y de alta calidad gratis es repetidamente rechazada por la comunidad (hilos 8 y 10). La restricción de hardware y costes continúa siendo un consenso en Reddit.
  • Lo sorprendente: los subreddits especializados en imagen y vídeo generativos —r/generativeAI, r/aivideomaking y r/GoogleFlow— generaron menos conversación e interacción que los dedicados a verificar autenticidad o debatir si la IA es deseable —r/isthisAI, r/antiai, r/aiwars, r/pj_explained, r/NewRockstars y r/whenthe—. Las “noticias” de imagen y vídeo generados por IA en Reddit se narran ahora más como fricción social en torno a si algo es IA que como evolución de modelos.
  • Señales enfrentadas: respecto al mismo vídeo filtrado del impacto de Thor, las secciones de comentarios de r/NewRockstars y r/pj_explained se dividieron de forma opuesta entre “no es IA” y “es IA” (hilos 1/6). En el hilo 7 también estuvieron equilibrados los defensores de metraje real y de IA, lo que sugiere que la evaluación visual de usuarios generales ya no es fiable.
Limitaciones
  • Solo se buscó "Image and Video Generation AI News"; el worker no realizó consultas alternativas como "Stable Diffusion", "Midjourney", "Sora", "Kling" o "generación de imágenes de código abierto". Por ello apenas se recogieron publicaciones que permitan contrastar claramente código cerrado —Midjourney, DALL-E, Sora, Veo o Runway— y código abierto —Stable Diffusion, Flux o el ecosistema ComfyUI—.
  • Los 12 hilos proceden de 12 subreddits diferentes, uno por comunidad, por lo que no se pudo profundizar comparando múltiples hilos del mismo tema dentro de un subreddit.
  • Los hilos 9 y 11 no tenían texto de publicación, solo título y comentarios, por lo que falta información primaria sobre la intención de quien publicó.
  • Los hilos 1 y 6 son esencialmente republicaciones del mismo contenido en subreddits distintos; tratarlos como dos casos independientes reduce la muestra real a unas 11 publicaciones.
  • Por la naturaleza de la recolección en navegador, esta ejecución no hizo accesos adicionales a Reddit, como nuevas búsquedas con otros términos o despliegue de todos los comentarios de los hilos.

X

X — Noticias de IA de generación de imágenes y vídeo

Cuentas

Las 40 publicaciones recopiladas proceden de 37 cuentas. Casi todas son casos aislados que se hicieron virales o quedaron enterrados con una sola publicación; entre las cuentas relacionadas con generación de imagen o vídeo por IA, solo @yu_ichi_suzuki (Yuichi Suzuki) publicó un hilo con varias entradas.

Cuenta Publicaciones Tendencia
@yu_ichi_suzuki (Yuichi Suzuki) 2 Hilo técnico sobre ejecutar MiniMax H3 localmente en una RTX 5090 (309 me gusta en total). Explicación de procedimiento, no viralidad aislada
@xieenze_jr (Enze Xie) 1 Publicación de anuncio de un nuevo modelo por un investigador de MiniMax (349 me gusta, unas 85.000 visualizaciones)
@voxelphotonics 1 Demostración de visualización volumétrica de Duke Nukem 3D; 6.097 me gusta y unas 297.000 visualizaciones en una publicación
@synabreu 1 Modelo 3D de la ciudad de Seúl creado con GPT-6 Astra; 2.700 me gusta y unas 235.000 visualizaciones
@GulatiYajat (Yajat Gulati) 1 Ciudad 3D de Gurgaon creada con GPT-6 Astra; 574 me gusta
@luccacerf 1 Demostración de Blender MCP + Astra + Tripo; 445 me gusta
@He1s_Sammy 1 Hilo largo sobre la conversión de vídeos infantiles de IA sin mostrar el rostro en negocio; 388 me gusta
@SD_Tutorial (Stable Diffusion Tutorials) 1 Cuenta de explicación técnica de Sol-H3, con respuesta modesta: 22 me gusta
@Strength04_X, @atlas_remake, @Aiden_Tech_Ai, @alphafox 1 cada una Cuentas pequeñas y medianas sobre calidad y límites de Seedance 2.5 y del vídeo por IA

Salvo @xieenze_jr, no se trata de desarrolladores del producto, sino de usuarios que “lo probaron” o “hicieron algo”. La conversación tiene dos capas: unas pocas publicaciones virales grandes —@voxelphotonics y @synabreu— y guías compartidas por particulares técnicos —@yu_ichi_suzuki y @SD_Tutorial—.

Publicaciones
  1. MiniMax anuncia Sol-H3, generación de vídeo más rápida que el tiempo real (#2, @xieenze_jr, 349 me gusta, 62 reposts, 23 respuestas y unas 85.000 visualizaciones, 2026-09-07, https://x.com/xieenze_jr/status/2097000082927399012). Bajo el mensaje “Five seconds of world. 1.653 seconds to infer.” anunció que, con 8× NVIDIA B300 Blackwell, es capaz de generar cinco segundos de vídeo a 1344×768 en 1,653 segundos. Fue el origen de la tendencia número uno de X Explore: “NVIDIA Speeds Up AI Video Generation Past Real-Time Playback”.
  2. Se difunde una explicación técnica del anuncio anterior (#3, @SD_Tutorial, 22 me gusta y unas 2.100 visualizaciones, 2026-09-07, https://x.com/SD_Tutorial/status/2097061880175141224). Describe una pila de inferencia de vídeo de alto rendimiento desarrollada por NVIDIA Research que ejecuta MiniMax-H3 más rápido que el tiempo real, con enlace a Sol-Engine/Sol-H3 de nvlabs.github.io. Las cuentas técnicas siguieron rápidamente la publicación oficial.
  3. Se publica una guía para ejecutar MiniMax H3 localmente en una RTX 5090 (#4–5, @yu_ichi_suzuki, 295+14 me gusta y unas 18.000+1.100 visualizaciones, 2026-09-07, https://x.com/yu_ichi_suzuki/status/2096819288997065192). Comparte un flujo personal con LoRA destilado y escalado: generar una toma acertada a 480p con LoRA de Alibaba y escalarla con RTX Video Super Resolution a 2688×1536; según el autor, un vídeo de más de 2K y 15 segundos tarda unos nueve minutos con una RTX 5090. Es el contrapunto de usuarios que explotan pesos abiertos frente al anuncio de infraestructura en la nube.
  4. Generación de vídeo de moda con Seedance 2.5 (#1, @Strength04_X, 68 me gusta, 2 reposts, 35 respuestas y unas 7.700 visualizaciones, 2026-09-06, https://x.com/Strength04_X/status/2096441159887274302). Publicó el prompt completo para un vídeo musical fotorrealista, cinematográfico y de moda/viaje de 30 segundos, hecho con Seedance 2.5 en Dreamina_ai.
  5. Generación de un mundo al estilo Toy Story con Seedance 2.5 (#14, @atlas_remake, 3 me gusta y unas 133 visualizaciones, 2026-09-07, https://x.com/atlas_remake/status/2096847522602139995). Elogia especialmente cómo Seedance 2.5 gestiona varios personajes y objetos animados.
  6. Señalan que el vídeo por IA sigue siendo una “tragaperras” (#12, @Aiden_Tech_Ai, 1 me gusta, 2 reposts, 4 respuestas y unas 494 visualizaciones, 2026-09-07, https://x.com/Aiden_Tech_Ai/status/2097020441470836791). Critica el ciclo de escribir un prompt, generar, detectar que algo falla y volver a generar, especialmente en escenas con múltiples espacios, movimiento de cámara, bloqueo de personajes y continuidad. La interacción fue pequeña, pero representa la cara opuesta al optimismo de la publicación 5.
  7. Duke Nukem 3D recreado en una pantalla 3D volumétrica (#10, @voxelphotonics, 6.097 me gusta, 921 reposts, 130 respuestas y unas 297.000 visualizaciones, 2026-09-07, https://x.com/voxelphotonics/status/2096833425043005562). Fue una de las publicaciones de mayor interacción de X en el periodo. No trata directamente de IA de generación de imagen o vídeo, sino de una demostración de representación y visualización, pero fue la causa principal de la tendencia número tres de Explore: “Duke Nukem 3D Brought to Life in True 3D Display”.
  8. GPT-6 “Astra” convierte toda Seúl en una ciudad 3D (#20, @synabreu, 2.700 me gusta, 451 reposts, 81 respuestas y unas 235.000 visualizaciones, 2026-09-06, https://x.com/synabreu/status/2096557555086725159). Se difundió ampliamente como aplicación de generación 3D conversacional: el autor afirma haber construido toda la ciudad de Seúl en 3D como su primer proyecto con GPT-6 Astra.
  9. Gurgaon también recreada como ciudad 3D con GPT-6 Astra (#22, @GulatiYajat, 574 me gusta, 28 reposts, 53 respuestas y unas 46.000 visualizaciones, 2026-09-06, https://x.com/GulatiYajat/status/2096659142534676684). El autor explica que vio a todo el mundo creando demostraciones con Astra y decidió probarlo; es un ejemplo directo de seguimiento de la tendencia de la publicación 8. Incluso publicó un sitio dedicado: gurgaon-3d-atlas.cratorlabs-2435.chatgpt.site.
  10. Demostración combinando Blender MCP, Astra y Tripo (#21, @luccacerf, 445 me gusta, 20 reposts, 11 respuestas y unas 31.000 visualizaciones, 2026-09-07, https://x.com/luccacerf/status/2097047098281672782). Un ejemplo de conectar varias herramientas de IA mediante MCP para crear una interfaz con Blender, Astra y Tripo.
  11. Los vídeos infantiles de IA sin mostrar el rostro se convierten en negocio de contenidos (#23, @He1s_Sammy, 388 me gusta, 96 reposts, 17 respuestas y unas 19.000 visualizaciones, 2026-09-06, https://x.com/He1s_Sammy/status/2096492880017736056). Publicación de monetización y actividad paralela que sostiene que basta un teléfono, portátil o iPad para empezar a experimentar con vídeos infantiles generados por IA.
Señales
  • Lo que crece: la creación de mundos 3D mediante agentes conversacionales —ciudades 3D con GPT-6 Astra y conexión mediante Blender MCP— es lo que más imitaciones y seguimientos generó durante el periodo. Tras ver la publicación de synabreu, GulatiYajat declaró explícitamente que quiso hacerlo porque veía a todo el mundo crear demostraciones similares; no fue una noticia aislada sino una cadena de imitación.
  • Lo que crece, parte dos: la inferencia de vídeo más rápida que la reproducción en tiempo real —Sol-H3— y su reproducción local con GPU personal aparecieron prácticamente a la vez. El anuncio del lado cerrado y el uso intensivo de pesos abiertos por particulares avanzaron en paralelo sin apenas desfase temporal.
  • Lo que se minimiza o divide opiniones: la coherencia de vídeo con varios personajes y espacios recibe tanto elogios —“maneja bien varios personajes animados”— como críticas —“problema de tragaperras”— en el mismo periodo, por lo que la valoración sigue sin asentarse.
  • Lo sorprendente: de las nueve tendencias de Explore que originaron las 40 publicaciones recopiladas, solo las tres primeras se relacionaban directamente con IA de imagen o vídeo: NVIDIA/Sol-H3, el regreso animado de la VTuber Veibae y la visualización volumétrica de Duke Nukem 3D. Las otras seis —Croatian, Building, $song, Harvey, Ukrainian y Democrats— eran tendencias regionales ajenas al tema; la tendencia cuatro indicaba explícitamente “Trending in Croatia”. Sin embargo, la búsqueda incidental de “Building” permitió encontrar las demostraciones de ciudad 3D de GPT-6 Astra, de gran calidad.
  • El caso de la VTuber Veibae: al buscar la tendencia número dos, “VTuber Veibae Teases Return with Sunflower Farm Animation”, solo aparecieron grupos de publicaciones duplicadas de cuentas de resúmenes de taquilla norteamericana, como @mediamanint. No se recogió ninguna publicación de Veibae ni información sobre cómo se produjo la animación.
Limitaciones
  • Aunque una de las tres principales tendencias de Explore, “VTuber Veibae Teases Return with Sunflower Farm Animation”, podía estar relacionada con IA de imagen o vídeo, la búsqueda no recogió publicaciones pertinentes. Las entradas #6–#9 eran duplicados ajenos sobre taquilla. No se pudo confirmar si se utilizó IA en la producción de la animación de Veibae.
  • Las otras seis tendencias de Explore —Croatian, Building, $song, Harvey, Ukrainian y Democrats— fueron casi todas temas regionales o de actualidad no relacionados con IA de imagen o vídeo. De las 40 publicaciones recogidas, 29 (#6–#9, #13, #15–#19 y #24–#40) se excluyeron de este informe por ser ajenas al tema.
  • Las búsquedas se limitaron a las cadenas de texto de los títulos de tendencias; no se buscaron nombres directamente relacionados con el tema como "Stable Diffusion", "Midjourney", "Sora", "Kling" o "ComfyUI". Por tanto, apenas se recogieron publicaciones que permitieran contrastar explícitamente productos cerrados —Midjourney, Sora, Runway o Veo— y abiertos —Stable Diffusion, Flux o ComfyUI—.
  • Explore estaba vinculado geográficamente a la ubicación del servidor de esta sesión, aparentemente alrededor de Croacia, por lo que no representa las tendencias globales de X.
  • La recopilación se detuvo en 40 publicaciones; esta ejecución no hizo una profundización adicional mediante otras publicaciones de las mismas cuentas, despliegue de respuestas o búsquedas por hashtags.

YouTube

YouTube — Últimas tendencias de IA para generación de imágenes y vídeo

Canales
  • 動画編集の中の人 (canal) — publica numerosas comparativas prácticas de uso de IA para generación de imágenes.
  • AI大学【AI&ChatGPT最新情報】 (canal) — su principal formato son resúmenes mensuales de herramientas de IA generativa.
  • 【さき】のAIでええやん。 (canal) — explica actualizaciones de Google I/O y Gemini.
  • Qwen (oficial) (canal) — publica anuncios oficiales de la serie Qwen-Image.
  • AIOnTrend (canal) — comparativas lado a lado de modelos de imagen abiertos.
  • Urban Decoders (canal) — explicaciones de arquitectura de modelos Flux.
  • SECourses (canal) — verificaciones a gran escala de generación local de imágenes, incluidas más de 700 pruebas.
  • Woollyfern (canal) — observación periódica de actualizaciones mensuales de Midjourney.
  • 寺田部チャンネル (canal) — reseñas prácticas de generación local de vídeo con ComfyUI.
  • 東京大学 吉田幸 研究室 (canal) — explicaciones periódicas de tendencias en tecnología de IA generativa desde una universidad.

No fue posible recuperar el número de suscriptores porque las páginas de resultados y de vídeos de YouTube se renderizan con JavaScript.

Vídeos
Código cerrado
  1. 【Tras gastar mucho, queda claro】¡Esta es la IA recomendada para generar imágenes en 2026! Comparativa exhaustiva de NanoBananaPro, Seedream4.0, Midjourney y AdobeFirefly — 動画編集の中の人 — https://www.youtube.com/watch?v=vJLDbXaSKW4 — compara, tras pagar y probarlos, Nano Banana Pro, Seedream 4.0, Midjourney y Adobe Firefly, y concluye cuáles recomienda en 2026.
  2. 【Últimas novedades del invierno de 2026】Seis populares herramientas gratuitas de generación de vídeo por IA que más han evolucionado en los últimos meses: Sora 2, Veo 3.1, Kling 2.6 y más — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=T9iIlhittDc — presenta seis herramientas gratuitas de vídeo generado por IA, incluidas Sora 2, Veo 3.1 y Kling 2.6, destacando el gran salto de los últimos meses.
  3. 【Número uno mundial en el ranking de rendimiento】Explicación exhaustiva de “Grok Imagine”, la IA de generación de vídeo de xAI: cómo crear gratis vídeos al nivel de Sora/Veo — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=0cYPwxg8le8 — sostiene que Grok Imagine de xAI alcanzó el primer puesto mundial en rendimiento y explica cómo crear gratis vídeo comparable a Sora y Veo.
  4. 【Últimas noticias】Gran actualización de los modelos Gemini de Google: explicación de Google I/O 2026, que también anunció el modelo de generación de vídeo Omni — 【さき】のAIでええやん。 — https://www.youtube.com/watch?v=vKtwoKCSGyE — explica la gran actualización de Gemini anunciada en Google I/O 2026 y el nuevo modelo de vídeo “Omni”.
  5. Actualización de Midjourney | Julio de 2026: ¡V8.2 ya está aquí! Personalización, NIJI Style Creator y más — Woollyfern — https://www.youtube.com/watch?v=dvfH5HzCARY — informa del lanzamiento de Midjourney V8.2, con personalización y NIJI Style Creator, como la última entrega de una secuencia mensual: V8 Alpha en marzo de 2026, V8.1 en abril, vista previa de V8.2 en junio y versión oficial de V8.2 en julio.
Código abierto
  1. 🚀 Presentamos Qwen-Image-2.0, ¡nuestro modelo de generación de imágenes de nueva generación! — canal oficial de Qwen — https://www.youtube.com/watch?v=1tM7Wd0lEeI — vídeo oficial de anuncio del equipo Alibaba Qwen para Qwen-Image-2.0, presentado como modelo abierto de nueva generación para imágenes.
  2. Qwen Image domina texto a imagen: más de 700 pruebas revelan por qué es mejor que FLUX; presets publicados — SECourses — https://www.youtube.com/watch?v=R6h02YY6gUs — verifica, con más de 700 pruebas, en qué aspectos Qwen Image supera a FLUX y publica presets.
  3. Flux 2 Klein vs Qwen vs Z Image Turbo vs Nano Banana Pro: ¿qué IA de imágenes gana? — AIOnTrend — https://www.youtube.com/watch?v=CkAtP2EVhSM — compara, con el mismo prompt, Flux 2 Klein, Qwen y Z Image Turbo de código abierto frente a Nano Banana Pro de código cerrado.
  4. ¿Flux.2, el nuevo rey de código abierto? Guía completa de arquitectura y comparativas con Nano Banana Pro — Urban Decoders — https://www.youtube.com/watch?v=Iu9Dm7lBeAk — explica la arquitectura de Flux.2, lanzado por Black Forest Labs, y examina si puede ser el nuevo rey abierto en comparación con Nano Banana Pro.
  5. Flux 2 Klein acaba de salir: este modelo de edición de imágenes no trata solo de velocidadhttps://www.youtube.com/watch?v=JXgBe3twxbc — noticia rápida sobre Flux 2 Klein, el modelo ligero de edición de imágenes de Black Forest Labs que puede ejecutarse localmente.
  6. Wan 2.2, FLUX y Qwen Image mejorados: tutorial definitivo de modelos SOTA abiertos para generación de imágenes y vídeohttps://www.youtube.com/watch?v=3BFDcO2Ysu4 — tutorial que resume actualizaciones de modelos abiertos de vanguardia como Wan 2.2 de Alibaba, FLUX y Qwen Image.
  7. 【Gratis y ComfyUI】¿Es fácil crear un largometraje usando IA de vídeo local? Es extremadamente difícil — 寺田部チャンネル — https://www.youtube.com/watch?v=I8_wKOLnSlI — informe práctico sobre crear vídeo de larga duración con ComfyUI y generación local de vídeo por IA, con experiencias y aprendizajes sinceros sobre lo difícil que resulta.
Señales
  • El debate favorable al código cerrado es precio y velocidad frente a calidad: varios contenidos comparativos afirman que Nano Banana Pro gana el 63 % de las pruebas fotorrealistas (vídeos 1 y 9), mientras que las opciones gratis o baratas, como Grok Imagine (vídeo 3), se promocionan provocativamente como vídeo al nivel de Sora/Veo sin coste.
  • Midjourney continúa mejorando la serie V8 con ritmo mensual: el canal Woollyfern registra V8 anunciado en febrero de 2026, Alpha en marzo, V8.1 en abril, vista previa de V8.2 en junio y lanzamiento formal de V8.2 en julio, destacando la rapidez de la cadencia de actualizaciones (vídeo 5).
  • El anuncio de “Omni”, la generación de vídeo de Gemini, en Google I/O 2026 se trató como una gran noticia independiente, con explicación de actualidad también en un canal japonés (vídeo 4).
  • El bando abierto disputa el liderazgo entre Qwen Image y FLUX: canales de análisis profundo siguen publicando pruebas sobre cuál es superior, como las más de 700 pruebas de SECourses (vídeo 7) y la explicación de arquitectura de Urban Decoders (vídeo 9), lo que indica alto interés de la comunidad.
  • “Flux 2 Klein” de Black Forest Labs recibe atención propia como modelo derivado centrado en ligereza y ejecución local (vídeo 10), separado de Flux.2 a tamaño completo.
  • Los modelos de Alibaba Wan y Qwen Image se tratan como los dos pilares abiertos, vídeo e imagen, hasta el punto de reunirse en un solo tutorial (vídeo 11).
  • La generación local de vídeo sigue considerándose difícil en la práctica: la creación de largometrajes con ComfyUI recibe una reseña franca de “extremadamente difícil” (vídeo 12). Además de la calidad, la carga operativa sigue siendo un problema del vídeo abierto.
Limitaciones
  • Las páginas de resultados de YouTube (/results?search_query=...) y las páginas watch renderizan su contenido con JavaScript; WebFetch solo pudo obtener HTML estático con enlaces de pie de página de términos y copyright. Incluso abriendo directamente las páginas no se pudieron leer listados de vídeos, visualizaciones, fechas de publicación, descripciones ni comentarios. Esto contradice el supuesto del playbook de que el HTML de página contiene título, canal, visualizaciones y fecha.
  • Como alternativa se combinaron búsquedas web site:youtube.com —título, URL, resúmenes del buscador y algunas fechas— con el endpoint oembed de YouTube —título formal, nombre y URL del canal en JSON—. Sin embargo, no se pudieron obtener en ningún caso visualizaciones, suscriptores, texto de descripción ni comentarios, por lo que no se incluyeron.
  • Las búsquedas japonesas de noticias de agosto y septiembre de 2026 no devolvieron noticias específicas de generación de imágenes o vídeo por IA; se mezclaron canales de noticias diarias de IA general, resúmenes semanales de empresas tecnológicas y noticias meteorológicas no relacionadas. No se encontraron alertas especializadas de la última semana, del 1 al 8 de septiembre.
  • Reddit, X, Bluesky, Lemmy y Pinterest quedaron fuera de alcance en esta etapa, tal como indicaba brief.md, y se investigaron en etapas distintas.

Bluesky

Bluesky — Noticias de IA de generación de imágenes y vídeo

Cuentas
Identificador Tipo Seguidores y otros datos Nota
@simonwillison.net Persona, reconocido bloguero técnico de IA y creador de Datasette Compara capacidades de generación de imágenes de nuevos modelos con su benchmark propio de pedir una imagen de un pelícano en bicicleta. Fue la fuente más densa de esta recopilación.
@404media.co Medio, cuentas de redacción y periodistas de 404 Media Se centra en vigilancia, pero ocasionalmente publica exclusivas relacionadas con medios generados por IA.
@aimod.social Gestión comunitaria, etiquetador de imágenes sospechosas de IA 2.555 seguidores, 94 publicaciones Servicio oficial de etiquetado de Bluesky para imágenes que se sospecha que fueron generadas por IA. Más infraestructura que fuente de noticias.
@stablediffusion.bsky.social Persona, comparte prompts de SDXL/Stable Diffusion No publica desde enero de 2025.
@bm63ai.bsky.social Persona, publica arte con ComfyUI/Flux/Midjourney Publicó mucho arte de IA hasta abril de 2025; su publicación final de junio de 2026 trataba de programar una aplicación con Codex, y las publicaciones de arte de IA prácticamente terminaron.
@petapixel.bsky.social Medio especializado en fotografía Trata de forma crítica funciones generativas de Adobe, como Firefly y Lightroom, pero sus publicaciones más recientes son de febrero de 2025 y no pertenecen al ciclo actual.
Publicaciones
  • Regresa el benchmark del pelícano en bicicleta con GPT-6 Astra (@simonwillison.net, 2026-09-04, 202 me gusta, 9 reposts, 18 respuestas, https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c). Publicó una cuadrícula comparando ilustraciones SVG de un pelícano en bicicleta realizadas por GPT-6 Astra, GPT-5.6 Sol, Terra y Luna en tres niveles de razonamiento (detalles: static.simonwillison.net/static/2026/gpt-6-and-5.6-pelicans.html). Según el texto alternativo, Astra produce resultados refinados y coherentes; Sol varía en proporciones; Terra muestra anatomía extraña; y Luna ofrece poses más simples y rígidas. Entre las respuestas, alguien comentó que Astra fue el primer modelo que entendió que un cuadrúpedo ficticio necesitaba una bicicleta tándem.
  • GPT-6 Astra opera Blender para generar una escena 3D de un pelícano (@simonwillison.net, 2026-09-05, 400 me gusta y 30 reposts, https://bsky.app/profile/simonwillison.net/post/3murtmdynq22s). Con instrucciones en tres etapas —usar Blender ya instalado para renderizar un pelícano en bicicleta, añadir un fondo y mucho estilo, y mejorarlo mucho— publicó el resultado de hacer que un agente de programación manejara Blender para crear una escena 3D. El mismo tema, GPT-6 Astra produciendo un render fotorrealista con Blender, fue tratado independientemente en r/DefendingAIArt de Reddit, lo que confirma conversación transversal.
  • Qwen 3.7 27B abierto dibuja localmente un pelícano (@simonwillison.net, 2026-08-14, 183 me gusta y 14 reposts, https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z). Informó que el nuevo Qwen 3.7 27B, ejecutándose como GGUF de 17 GB en LM Studio en un MacBook Pro M5 Max, produjo el mejor pelícano en bicicleta que había visto de cualquier modelo ejecutable en su portátil. Es una de las pocas publicaciones concretas que muestran mejora de generación visual en un modelo abierto ejecutable localmente.
  • Un candidato a gobernador de Nueva York ataca a rivales con vídeo falso generado por IA (@404media.co, 2026-09-02, 124 me gusta, 22 reposts, 7 respuestas, https://bsky.app/profile/404media.co/post/3muka24vu4v2q). La noticia trata del candidato republicano a gobernador de Nueva York que hizo un inquietante vídeo generado por IA de Mamdani y Hochul. Una publicación citada del mismo medio ironizó sobre vivir en una época en la que se crean anuncios falsos de Viagra para difamar a oponentes (194 me gusta y 36 reposts, https://bsky.app/profile/404media.co/post/3muk7u6iepk2h). Es un caso de desinformación política mediante IA de vídeo.
  • La empresa detrás de Cocomelon ordena a artistas experimentar con IA (@404media.co, 2026-09-06, 84 me gusta, 23 reposts, 21 respuestas, https://bsky.app/profile/404media.co/post/3musx3wgdvc2n). Moonbug Entertainment, creadora de Cocomelon, Blippi y otros contenidos infantiles populares, anunció que empezará a usar IA pero mantendrá siempre “humanos en el circuito”. Es una declaración de adopción de IA de imagen y vídeo en un caso de uso importante: producción audiovisual infantil.
  • El etiquetador de imágenes sospechosas de IA aimod.social supera los 2.500 seguidores (investigación del perfil, https://bsky.app/profile/aimod.social). Se presenta como un etiquetador para marcar imágenes de posible origen IA y cuenta con manual de criterios y canal de apelaciones. No es un artículo periodístico, pero señala que se ha formado una demanda comunitaria de mecanismos automáticos para sospechar y etiquetar imágenes de IA en Bluesky.
  • Las antiguas cuentas de publicación de arte de IA permanecen en silencio (revisión de feeds de @stablediffusion.bsky.social y @bm63ai.bsky.social). stablediffusion.bsky.social no publica desde el 22 de enero de 2025, cuando compartió un prompt de la Estatua de la Libertad tocando guitarra eléctrica. bm63ai.bsky.social dejó de publicar arte de IA después de “Star Trek: The Muppet Generation”, del 25 de abril de 2025, con etiquetas #comfyui, #midjourney y #flux; su última publicación, el 8 de junio de 2026, cambió a una aplicación musical creada con un agente de programación.
  • Crítica a funciones de IA generativa de Adobe, como referencia de un ciclo anterior (@petapixel.bsky.social, 2025-02-12 y 2025-01-09, 7 y 33 me gusta). Publicaciones que criticaban la herramienta de texto a vídeo recién anunciada por Adobe por no estar lista para tener precio y relataban cómo Generative Remove de Lightroom creó un logo de Bitcoin al intentar eliminar un elemento. Son anteriores al ciclo de noticias de septiembre de 2026, pero quedan como referencia de una línea crítica hacia herramientas comerciales cerradas.
Señales
  • Lo que crece: las tareas visuales de GPT-6 Astra —dibujos SVG del pelícano y operación de Blender para render 3D— fueron tratadas de manera independiente tanto en Reddit, en r/DefendingAIArt y r/antiai, como en Bluesky por @simonwillison.net. Constituyen el mayor tema transversal, aunque conviene precisar que no es generación de imágenes mediante difusión, sino un nuevo género en el que agentes LLM crean visuales a través de código y herramientas 3D.
  • Lo que se minimiza o descarta: la conversación sobre código abierto fue extremadamente escasa. Solo se confirmó un informe de ejecución local de Qwen 3.7 27B; no se encontraron publicaciones sobre FLUX, nuevas versiones de Stable Diffusion, Wan, HunyuanVideo u otros modelos abiertos especializados de imagen y vídeo.
  • Lo sorprendente: mientras las cuentas dedicadas a publicaciones de arte de IA, activas hasta la primera mitad de 2025, permanecen silenciosas, el servicio de etiquetado automático de imágenes sospechosas de IA aimod.social persiste y crece como infraestructura comunitaria independiente. El centro de gravedad en Bluesky puede estar desplazándose de crear hacia distinguir o moderar.
  • Señales enfrentadas: las noticias concretas sobre vídeo por IA se hicieron más visibles como polémicas de aplicación —abuso político en la elección a gobernador de Nueva York— que como competencia de rendimiento entre modelos. En Bluesky, el vídeo generado por IA parece tener mayor visibilidad como problema social que como tendencia técnica.
Limitaciones
  • La API pública de búsqueda de Bluesky (app.bsky.feed.searchPosts) devolvió HTTP 403 de forma consistente para consultas en inglés y japonés, incluidas "image generation AI", "Stable Diffusion", "Midjourney", "Sora", "Veo" y "Kling". En la misma sesión, app.bsky.actor.getProfile y app.bsky.feed.getAuthorFeed respondieron normalmente, por lo que parece que solo el endpoint de búsqueda exige autenticación o está bloqueado.
  • La interfaz web bsky.app/search es una SPA renderizada del lado cliente; el HTML no contiene el texto de las publicaciones y la herramienta de obtención web no pudo leer resultados reales.
  • Por ello no se pudo seguir el procedimiento del playbook de buscar por palabras clave y leer publicaciones. En su lugar se obtuvieron historiales individuales de cuentas conocidas detectadas mediante búsqueda web —simonwillison.net, 404media.co, petapixel.bsky.social, aimod.social, stablediffusion.bsky.social y bm63ai.bsky.social—. La muestra es de cuentas y no sustituye una búsqueda exhaustiva por palabras clave.
  • Las cuentas esperadas de OpenAI, Google DeepMind, Midjourney, Runway, Stability AI, Black Forest Labs, Krea, TechCrunch, The Verge, Ars Technica y Engadget no existían en Bluesky o no tenían publicaciones pertinentes en sus feeds.
  • No se alcanzó el criterio de analizar unas 20 publicaciones por plataforma debido a la indisponibilidad de la API de búsqueda. Solo se analizaron las ocho publicaciones incluidas aquí, más una referencia, y los demás feeds obtenidos no contenían publicaciones relevantes.
  • No se encontró ni una publicación concreta sobre modelos abiertos de generación de imágenes y vídeo como FLUX, nuevas versiones de Stable Diffusion, Wan o HunyuanVideo. El método de esta investigación no permite distinguir si no se habló de ellos o si quedaron sin detectar por la imposibilidad de buscar.

Lemmy

Lemmy — Noticias de IA de generación de imágenes y vídeo

Lemmy es una red social federada cuyo tamaño es una fracción mínima del de Reddit; aquí “viral” no significa cientos de votos positivos, sino a menudo decenas. Aun así, se recogió información sorprendentemente densa. La revisión se centró principalmente en !«メールアドレス», con lanzamientos de ComfyUI y modelos; !ai_reddit, un bot que republica Reddit; y !technology y !techtakes, con mayor tono irónico. Las búsquedas se realizaron repetidamente en lemmy.world/api/v3/search con palabras clave cambiantes.

Comunidades
  • !«メールアドレス» — 5.709 suscriptores, de ellos 893 locales. Centro de información sobre nodos personalizados de ComfyUI y lanzamientos de modelos; hay publicaciones casi a diario.
  • !«メールアドレス» — 2.362 suscriptores. Galería de obras creadas con Stable Diffusion, Flux y Krea2.
  • !«メールアドレス» — dedicada a arte de anime con IA. El número de suscriptores no era público, pero su actividad era similar a la comunidad anterior.
  • !«メールアドレス» — 87.904 suscriptores. Republica artículos de grandes medios tecnológicos y también conversó sobre la polémica de Midjourney.
  • !«メールアドレス» — 2.690 suscriptores. Comunidad irónica y crítica con la industria de IA; trató con dureza los supuestos desvíos de Midjourney.
  • !«メールアドレス» — cuenta de republicación RSS de r/ArtificialIntelligence. No fue posible obtener suscriptores por API, pero concentró la mayor densidad de noticias.
  • !«メールアドレス» — 8.154 suscriptores. Comunidad contraria a IA donde también circularon artículos que critican la cadena de suministro de IA generativa.
Publicaciones
Orientadas a código cerrado
  1. Midjourney supuestamente gira hacia un escáner médico de ultrasonido, “Midjourney Medical” — 2026-06-18 a 19, gran conversación en !techtakes y !hackernews. The Register lo ironizó como un spa de medicina estética con iluminación dorada; pivot-to-ai.com lo comparó burlonamente con un giro hacia Theranos. Puntuación 40–58.
    https://lemmy.world/post/48384985 (artículo original: pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/)
  2. Midjourney exige a estudios de Hollywood que revelen cómo usan IA — artículo de TechCrunch, puntuación 73 en !technology. Seguimiento del contexto de litigios por derechos de autor.
    https://lemmy.world/post/49069400
  3. Google lanza Nano Banana 2 Lite — modelo ligero de generación de imágenes de DeepMind, publicado entre 2026-06-30 y 07-02 mediante !hackernews y el medio tecnológico suizo itmagazine.ch.
    https://lemmy.world/post/48857780 (deepmind.google/models/gemini-image/flash-lite/)
  4. MAI-Image-2.5 de Microsoft alcanza a Nano Banana 2 en benchmarks — vía the-decoder.com, !ai_reddit, 2026-05-28.
    https://the-decoder.com/microsofts-mai-image-2-5-pulls-even-with-googles-nano-banana-2-on-benchmarks/
  5. Comparativa seria de ByteDance Seedream 5.0 Pro — menciona fortalezas de edición y generación iterativa, !ai_reddit, 2026-07-10.
    https://www.reddit.com/gallery/1usc03q
  6. La función Earth AI de Google se desactiva al día siguiente de su lanzamiento — Fortune informó que usuarios la usaron para superponer imágenes falsas en lugares reales y causar problemas; !ai_reddit, 2026-08-07.
    https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature-a-day-after-its-rollout-after-users-made-no-no-images/
  7. El negocio empresarial de Runway se duplica, con NRR superior al 300 % — noticia de que Runway, de vídeo generado por IA, crece en el segmento corporativo; !ai_reddit, 2026-08-30.
    https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/runway_says_enterprise_business_doubled_nrr_over/
  8. Amnesty International critica los principales sistemas de IA por ser ilegales desde el diseño — contexto de presión regulatoria sobre IA generativa en general; !ai_reddit, 2026-06-24.
    https://reddit.com/r/ArtificialInteligence/comments/1ue64s2
  9. Pax Silica: militarización de la cadena de suministro de IA — análisis de la guerra económica entre Estados Unidos y China por chips y recursos de cómputo; apareció en !fuck_ai como riesgo geopolítico de grandes empresas tecnológicas de IA cerrada, puntuación 14, 2026-09-06.
    https://thecradle.co/articles/pax-silica-and-the-weaponization-of-ai-supply-chains-the-new-front-in-us-global-economic-warfare
  10. Se le pide a “Astra 6 max” crear arte que emocione a su autor — generación de arte filosófico y autorreferencial con un modelo comercial cerrado; !ai_reddit, 2026-09-05.
    https://i.redd.it/3h241pocalnh1.png
Orientadas a código abierto
  1. Lanzamiento de LLaDA-Image — nuevo modelo que combina un Diffusion Transformer de 6B con un módulo congelado de comprensión visual-lingüística, basado en LLaDA2.0-Mini. Alcanzó resultados SOTA de 53,53 en inglés y 53,38 en chino en Qwen-Image-Bench. También lanzó LLaDA-Image-Turbo, una versión rápida que genera en dos a cuatro pasos, con pesos, código de entrenamiento y recetas abiertos; !stable_diffusion, 2026-09-04.
    https://lemmy.dbzer0.com/post/74988021 (artículo: arxiv.org/abs/2609.03796; código: github.com/inclusionAI/LLaDA-Image)
  2. Lanzamiento de Boogu-Image-0.1 — familia abierta con variantes Base, Turbo y Edit, bajo licencia Apache-2.0 para uso comercial. Con 10B de parámetros logró la puntuación más alta entre modelos abiertos en Qwen-Image-Bench, 53,58; !stable_diffusion, 2026-06-17.
    https://boogu.org/ (artículo: arxiv.org/abs/2607.13125)
  3. ComfyUI-Ref2VA-VSA: nodo de aceleración de inferencia para MiniMax H3 — mejora sustancialmente la velocidad de inferencia de vídeo; !stable_diffusion, 2026-09-08.
    https://github.com/Kablex/ComfyUI-Ref2VA-VSA
  4. ComfyUI-AetherScale: escalador de vídeo nativo para GPU NVIDIA!stable_diffusion, 2026-09-05.
    https://github.com/vizart-vj/ComfyUI-AetherScale
  5. ComfyUI-VDN-H3: atención híbrida Video Delta Net — nodo para mejorar eficiencia de modelos de generación de vídeo; !stable_diffusion, 2026-09-05.
    https://github.com/Saganaki22/ComfyUI-VDN-H3
  6. ComfyUI-Majoor-OmniCam: herramienta de disposición y animación de cámara — nodo de control de trabajo de cámara para generación de vídeo e imagen; !stable_diffusion, 2026-09-04.
    https://github.com/MajoorWaldi/ComfyUI-Majoor-OmniCam
  7. FastH3-Ref2V-Stream-Controller — herramienta de control de streaming para generación de vídeo de la familia MiniMax H3; !stable_diffusion, 2026-09-04.
    https://github.com/EarthDefenceForces/FastH3-Ref2V-Stream-Controller
  8. ComfyUI-InpaintCanvas: interfaz de inpainting estilo Krita!stable_diffusion, 2026-09-08.
    https://github.com/DenRakEiw/ComfyUI-InpaintCanvas
  9. ComfyUI-MiniMax-H3-MotionCache-FastVAE / ComfyUI-H3VAE_TRT / ComfyUI-MiniMaxH3-CLSS — tres nodos consecutivos para acelerar y aligerar modelos de vídeo MiniMax H3, publicados simultáneamente entre 2026-09-01 y 02. Son evidencia de una actividad muy intensa del ecosistema abierto de generación de vídeo.
    https://github.com/Mozer/ComfyUI-MiniMax-H3-MotionCache-FastVAE
  10. InterleaveThinker: investigación de aprendizaje por refuerzo para generación intercalada mediante agentes — añade a modelos de generación de imágenes existentes la capacidad de generación secuencial texto↔imagen mediante múltiples agentes; !stable_diffusion, 2026-06-12.
    https://arxiv.org/abs/2606.13679
  11. Racha de obras creadas con Flux/Krea2 turbo!stable_diffusion_art y !share_anime_art siguen recibiendo varias obras diarias de arte y anime creadas con Flux y Krea2. No es una noticia aislada, sino una señal continua de uso cotidiano de modelos con pesos abiertos.
    https://lemmy.dbzer0.com/post/75150630 entre muchos otros
Señales
  • 🔥 El mayor tema es el supuesto extravío de Midjourney. La historia de que una empresa de generación de imágenes se metió en escáneres médicos de ultrasonido generó conversación tanto en !techtakes como en !technology, y el tono fue claramente de preocupación, no de aprobación. Fue la noticia con puntuaciones más altas del bloque cerrado, entre 40 y 73.
  • 🛠️ Del lado abierto, aparecieron de golpe cinco o seis nodos ComfyUI para modelos de vídeo MiniMax H3 en la misma semana. Es el patrón típico de una comunidad de desarrolladores concentrándose rápidamente en una base concreta y compitiendo por optimizarla. La presencia de desarrolladores de distintas regiones da una sensación de expansión global.
  • 📊 Los entusiastas de benchmarks usan Qwen-Image-Bench como indicador común. LLaDA-Image, con 53,53, y Boogu-Image-0.1, con 53,58, compiten en el mismo benchmark, haciendo visible con números la carrera de rendimiento entre proyectos abiertos.
  • 😤 Incluso comunidades críticas con IA como !fuck_ai reciben artículos sobre riesgos geopolíticos de empresas cerradas, señal de que el tema de IA generativa se extiende más allá de las comunidades técnicas.
  • 🤖 Lemmy tiene una base mucho menor, por lo que su definición de “viral” es totalmente distinta de Reddit o X: una puntuación en los 70 ya equivale a una gran noticia. Debe leerse por intensidad relativa, no por valores absolutos.
Limitaciones
  • Lemmy es federado y las búsquedas varían por instancia. La API de lemmy.world recuperó principalmente publicaciones de esa instancia o publicaciones federadas visibles allí. Se intentó acceder a las interfaces de búsqueda de lemm.ee y lemmy.ml, pero por tiempo esta revisión se limitó a la API de lemmy.world, sin cubrir todas las instancias.
  • Las búsquedas de “Kling AI”, “Stability AI”, “Wan 2.2” y “Runway Gen” devolvieron cero resultados o resultados irrelevantes, como noticias políticas. En Lemmy casi no hubo conversación sobre Kling, Wan o Stability AI por separado; el vídeo apareció sobre todo a través de MiniMax H3 en la comunidad de desarrollo ComfyUI.
  • !ai_reddit es un bot de republicación automática de r/ArtificialIntelligence, por lo que no representa información primaria original de Lemmy y debe interpretarse con esa salvedad.
  • Se alcanzó el objetivo de analizar unas 20 publicaciones —además de muchos resultados duplicados o irrelevantes—, pero la base total de Lemmy es órdenes de magnitud menor que la de Reddit o X. En el sentido de información primaria de alta calidad, es una fuente más limitada.

Pinterest

Pinterest — Noticias de IA de generación de imágenes y vídeo

De los 50 pines recopilados previamente (output/pinterest.pins.md / images/pinterest/manifest.json) mediante una única consulta sin clasificación por género, se abrieron y revisaron visualmente 30. Lo siguiente se basa en ese material.

Temas visuales
  • Miniaturas de “noticias de IA” de estilo clickbait: abundan composiciones como un hombre barbudo sorprendido con logotipos de herramientas en neón ([11]), una sonrisa similar a Sam Altman sobre fondo explosivo ([19]) o un presentador medio robot con micrófono “B” ([44]). La mayoría de los pines enlazan a vídeos de YouTube, no a artículos originales.
  • Infografías de ranking “best of” de productos cerrados: aparecen repetidamente listas enmarcadas en neón de Runway, Pika, Kling AI, Luma (Dream Machine), Canva, Hailuo AI, HeyGen, Synthesia, InVideo, Sora y Google Veo [9, 27, 33]. Hay un formato equivalente para generación de imágenes con ChatGPT, Nano Banana, Ideogram, GenTube y Z-Image [36].
  • Representaciones de IA como robot o presentador: robots de carcasa blanca en mesas de noticias ([32]), vídeo sintético de una presentadora ([38, 49]) y escenas médicas con robots junto a enfermeras o personas ([50]). Más que capturas de herramientas, domina la metáfora de que IA sustituye roles humanos, como periodista o médico.
  • Imágenes que avivan preocupación por deepfakes y autenticidad: foto de un gato con sello “FAKE” y recuento de me gusta ([3]), un juego “Which is AI?” comparando dos fotos de montaña ([10]) y un detector con forma de onda que dice “97% likely AI generated” ([25, una imagen interior de la misma familia, y 35]). Una parte del contenido se centra en detección y sospecha más que en generación.
  • Visuales genéricos de IA, tipo stock: imágenes con neón morado y azul, siluetas de cerebro, circuitos y partículas, acompañadas de texto de titular ([2, 4, 5, 15, 20, 30]). Funcionan como relleno visual “de aspecto IA” sin nombres de productos ni capturas concretas.
  • Cuadrículas demostrativas de antes y después para image-to-video: comparativas donde una foto o vídeo se transforma en varios estilos —LEGO, origami, una persona cubierta de flores o coches de juguete— ([7]), y explicaciones de una foto que genera una línea temporal de cinco cuadros ([1, 6]).
  • Hay nombres de productos reales, pero casi todos son cerrados: Veo 2/3 ([13, 24]), VASA-1 de Microsoft Research ([41]), Grok ([32]), y Sora, ChatGPT y Nano Banana ([36]). Entre los 30 pines revisados no apareció ni un nombre de modelo o repositorio claramente abierto.
  • Infografías que proponen una cadena de producción con IA: un flujo de cuatro agentes —“Scout→Script→Generate→Animate”— crea automáticamente un vlog a partir de un enlace viral ([47]). Señala una tendencia de pasar de herramientas aisladas a flujos automatizados.
Pines destacados
  • [1] Image to Video AI: How It Works and Why It Matters — el pin técnicamente más concreto: explica cómo una imagen fija pasa, mediante deslizadores de intensidad de movimiento, coherencia temporal y control visual, a una línea temporal de vídeo.
  • [7] Sin título, cuadrícula de transformaciones LEGO/origami/flores — comparativa 3x5 en la que un vídeo original de una persona, un panda de peluche y un Tesla se transforma en bloques de madera, origami, LEGO o flores. Es una de las pocas demostraciones con resultados generados reales.
  • [9] 10 FREE AI VIDEO TOOLS IN 2026 — diez herramientas gratuitas de vídeo por IA: Pictory, Runway ML, Veed.io, Synthesia, InVideo, Kling AI, D-ID, Lumen5, Canva y Hyperwrite. Ofrece una vista general de planes gratuitos de proveedores cerrados.
  • [24] Sin título, image-to-video de un personaje monstruoso morado — muestra tres vídeos de salida que sitúan una misma imagen de entrada en contextos totalmente distintos, como una sala de servidores, ruinas submarinas y una ciudad de dulces. El título está relacionado con Veo 3.
  • [27] 5+ Best AI Video Generation Websites — compara Runway, Pika, Kling AI, Luma, Canva y Hailuo, y especifica que están dirigidos a YouTube Shorts, TikTok, pines de vídeo de Pinterest y vídeos de producto; evidencia que Pinterest se contempla como destino de distribución de vídeo creado con IA.
  • [36] Top AI Image Generation Tools — lista ChatGPT, Nano Banana, GenTube, Ideogram y Z-Image como herramientas de imagen en 2026. Nombres relativamente nuevos como Nano Banana y Z-Image ya se han difundido en contenido SEO de Pinterest.
  • [39] The Latest AI Developments, tríptico de noticias de última hora — el único pin con tres noticias concretas y organizaciones identificadas: IA responde inicialmente al 911 en Nueva Orleans; Meta publica gratis el modelo de agentes offline Muse Glimmer; y Kimsuky de Corea del Norte automatiza documentos de phishing con su propia pila de IA.
  • [41] Microsoft Unveils VASA-1 — diagrama de la demostración técnica de Microsoft Research que genera animación facial en tiempo real y conversación de múltiples personas a partir de una imagen, un clip de audio y, opcionalmente, señales de control de expresión.
  • [16] AI Image Video: Best Quality vs Best Free — guía de decisión que contrapone ChatGPT Plus, Gemini Advanced, Midjourney, Adobe Firefly, Recraft, Runway Gen-3, Luma, Pika Pro, Kaiber y Synthesia frente a Ideogram, Gemini Free, SeaArt, Playground, Krea, Canva, Inkscape y CapCut. Incluye criterios como legibilidad de texto, disponibilidad de GPU y necesidad de editar SVG.
  • [47] AI video creation just got crazy — propuesta de automatización que convierte un enlace de vídeo viral en un vlog terminado mediante cuatro agentes: “Scout→Script→Generate→Animate”. Va más allá de una herramienta individual.
Señales
  • El ámbito de Pinterest para “Image and Video Generation AI” está dominado por infografías comparativas y tutoriales con fines de SEO o afiliación, no por noticias de actualidad. Casi no hay enlaces directos a información primaria, como anuncios oficiales, artículos de investigación o publicaciones sociales; la mayoría conduce a blogs o vídeos de YouTube.
  • Los únicos eventos concretos de noticia fueron los tres de [39] —IA que responde al 911, Meta Muse Glimmer y Kimsuky de Corea del Norte—, además de pines que mencionan anuncios de Veo 2/3, VASA-1 y Grok. La información primaria que podría calificarse de “últimas noticias” es limitada incluso en una muestra de unas 20 piezas.
  • La presencia de productos cerrados es abrumadora: Runway, Pika, Kling AI, Luma, Canva, Hailuo, HeyGen, Synthesia, Sora, Veo, ChatGPT/Nano Banana e Ideogram aparecen repetidamente. En cambio, no apareció ningún nombre de modelo o proyecto abierto entre los revisados: no se mencionaron Stable Diffusion, ComfyUI ni Open-Sora. Pinterest es una fuente pobre para describir movimientos de código abierto.
  • Las imágenes de IA sustituyendo roles humanos —presentadores, enfermeras y operadores del 911— y las de dudar de la autenticidad de los resultados —sellos FAKE, “Which is AI?” y detectores— aparecen con frecuencia como par. Más que la tecnología generativa, una parte significativa de las imágenes trata del impacto social y de la ansiedad sobre confianza.
  • En generación de vídeo se ven especialmente demostraciones de transformación: animar una foto o cambiar el estilo de un vídeo existente, por ejemplo a LEGO u origami. Frente a la generación text-to-video desde cero, la transformación de imagen o vídeo parece ser el principal argumento comercial.
Limitaciones
  • Los 50 resultados recolectados por el worker no estaban clasificados por género; todos tenían vacío el campo genre y procedían de una única consulta. No se realizaron búsquedas diferenciadas de código cerrado y abierto.
  • Por tiempo solo se inspeccionaron visualmente 30 de los 50 pines; no se revisaron los índices 14, 15, 18, 21, 22, 26, 28, 29, 31, 37, 40, 42, 43, 45, 48 y otros. Sus títulos —comparativas de lip-sync, herramientas de edición de vídeo y detección de contenido de IA— se superponen en gran medida con temas ya observados y no indicaban señales de un género que alterara las tendencias anteriores.
  • No se navegó Pinterest directamente; el análisis se basó solo en imágenes y títulos recopilados previamente, conforme al playbook. El manifiesto y la tabla de pines no incluyen fecha de publicación ni métricas de interacción —me gusta o guardados—, así que no se puede determinar ni actualidad ni difusión.
  • No se encontraron menciones significativas de código abierto en Pinterest. Cualquier informe integrado posterior debe aclarar que Pinterest no sirve de fundamento para tendencias abiertas.

Acciones recomendadas

  • Mantener la generación visual mediante agentes GPT-6 Astra —operación de Blender y creación de ciudades 3D— como tema de seguimiento específico en próximas ediciones.
  • Para no perder anuncios de código abierto, añadir en la próxima ronda búsquedas transversales por nombres propios como "FLUX", "Stable Diffusion", "Qwen-Image", "Wan" y "ComfyUI".
  • Dado que la API de búsqueda de Bluesky sigue devolviendo 403, ampliar de antemano la lista de cuentas a supervisar.
  • Como Pinterest no ofrece fechas ni métricas de interacción, limitarlo a observación periódica de notoriedad de herramientas y no usarlo para comparativas de noticias urgentes que requieran actualidad.
  • Como la controversia sobre el supuesto giro de Midjourney hacia dispositivos médicos sigue sin confirmarse, evitar citas concluyentes hasta que haya una fuente primaria, como un anuncio oficial de Midjourney.
  • Priorizar !stable_diffusion de Lemmy y los canales de pruebas de YouTube como fuentes principales para seguir tendencias de código abierto.

Imágenes recopiladas

Image to Video AI: How It Works and Why It Matters - The Data Scientist🎨 AI Image and Video CreationAI content and social media concernsAi Content Creation Concept With Icons For Text Image Music And Video Generation Artificial Intelligence Images – Browse 57 Stock Photos, Vectors, and VideoThe Ultimate AI Image and Video Generation Platform - The Data Scientist️ Image to Video AI – Animate Your Photos With AIGoogle announces ultra-high quality video...Just Nail It 🎥🎬 10 FREE AI VIDEO TOOLS IN 2026 🤯 Create Videos Without Expensive Software!imageAI News: OpenAI Finally Released What We Asked ForVeo 3 Image-to-Video: Fast Generation & Native Audio via Gemini APIGoogle Unveils Veo 2: Advanced AI Video Generation Tool with Enhanced Realism and Cinematic FeaturesimageArtificial intelligence: let’s maintain our...AI For Image And video GenerationTop 10 Lip Sync Tools (2026) – Best AI Lip Sync Software for Realistic Lip Sync VideoTop AI Video Generators of 2025GPT 5.2, realtime video editor, AI stereo videos, mobile AI agents, full body control: AI NEWSimageHow AI Is Transforming Video EditingWhy AI Video Generation Is Becoming Essential for...More than 20% of YouTube is now AI-generatedGoogle announces video generation AI 'Veo 3',...‎🚨 AI is getting scary good.image5+ Best AI Video Generation Websites 2026 | Runway, Pika, Kling AI, Canva & MoreAI Tools for Video Editing — What Creators Actually Use to Make Content in 2026imageArtificial Intelligence: A Tool to Free the...AI driven image and video analysisDiscover how Grok is revolutionizing video...12 Best AI Video Generators in 2026 (Free & Paid) | Google Veo, Sora, Runway & MorePaul Lafargue of the IDEC Group: The impact of...How To Detect AI-Generated Images Online For Freeimage generation Ai tools 🔥🔥What is Imagvio AI and how it helps creators...TotalYmage revolutionizes interactive videos...The Latest AI Developments - AI Picks Up 911 Line Meta Offline Modelai toolsMicrosoft Unveils VASA-1, Setting New Standards for Generative AI in Video GenerationFuture of Video Creation: Best AI Video Generators of 2026🔸AI-Generated Videos: Good or Bad? Here's the Truth! 🤖🎥The Snarky AI News RoundUp #8I will do ai video creation explainer with synthesia sora ai kling ai runway ai invideoLe guide ultime pour exploiter Chat GPT en tant...AI Video Creating just got crazy.What Is Generative AI? Complete Technical Guide - RCN GuideHow To Create A News Channel With AI || AI News Video Generator || AI Lip SyncAi

Nota sobre la calidad de los datos

Bluesky no alcanzó el criterio de 20 publicaciones porque su API de búsqueda devolvió 403 constantemente. Pinterest no permitió determinar actualidad porque no se pudieron obtener fechas de publicación ni métricas de interacción. Reddit y X usaron una única consulta, por lo que no contrastaron intencionadamente código cerrado y abierto; como resultado, la conversación sobre código abierto quedó concentrada en Lemmy y YouTube.

Galería