KEN’S CAT LOG

Noticias de IA de generación de imágenes y vídeo — 2026-09-10

Alibaba lanzó Wan 3.0 como una API de pago con pesos no públicos, mientras que OpenAI cerrará la API de Sora 2 el 24 de septiembre. La IA de generación de vídeo se está reorganizando bajo el liderazgo chino, con una frontera cada vez más difusa entre lo abierto y lo cerrado.

Noticias de IA de generación de imágenes y vídeo — 2026-09-10

En el ámbito de código cerrado, OpenAI anunció que descontinuará la API de Sora 2 el 24 de septiembre de 2026, mientras se suceden los anuncios de nuevos modelos como la familia Nano Banana de Google (Gemini 2.5 Flash Image, rival de ChatGPT Images 2.5), «Muse» de Meta y «Grok Imagine» de xAI, haciendo que el mapa competitivo sea cada vez más cambiante. En el ámbito de código abierto, el hallazgo más relevante es que la propia frontera entre lo abierto y lo cerrado se está difuminando: pese a su reputación como abanderada de los pesos abiertos, construida con Wan 2.2 y Qwen-Image, Alibaba lanzó su última creación, Wan 3.0, como una API cerrada de pago con los pesos no publicados. En generación de vídeo, los modelos chinos (ByteDance Seedance 2.0, Alibaba Wan y MiniMax-H3) están ganando presencia tanto en vídeos comparativos como en el ecosistema de ComfyUI. Al mismo tiempo, crece en varias plataformas la preocupación por verificar la autenticidad de los contenidos generados por IA y por fallos de moderación. Se investigaron seis plataformas —Reddit, X, YouTube, Bluesky, Lemmy y Pinterest—; salvo X, todas permitieron recopilar publicaciones relacionadas con el tema de alguna forma.

En todas las plataformas

  • La frontera entre lo abierto y lo cerrado se está difuminando: en YouTube se criticó explícitamente que Wan 3.0 de Alibaba se lanzara como una API de pago con pesos no públicos, contradiciendo su imagen de «abanderado del código abierto». En Lemmy, mientras tanto, la conversación abierta se concentró en el ecosistema ComfyUI de MiniMax-H3, y la conversación cerrada se inclinó hacia polémicas y litigios (uso indebido de Nano Banana Earth AI, demanda contra Midjourney). La división entre ambos bandos ya no se explica con una distinción simple entre «empresa o individuo».
  • La familia de modelos «Nano Banana» de Google es el centro de la conversación en varias plataformas: aparecieron menciones independientes en Bluesky (dfl.bsky.social publicó a diario imágenes de paisajes generadas con Nano Banana 2), Lemmy (la función de composición con Google Earth de Nano Banana se retiró un día después de su lanzamiento por usos indebidos) y YouTube (GPT Image 2 fue calificado como «Nano Banana Pro Killer», y Midjourney V8 se comparó con Nano Banana 2).
  • Se expande la desconfianza y el deseo de verificar los contenidos generados por IA: Reddit mostró hilos que buscan pistas visuales concretas para distinguir la IA, así como una fuerte reacción contra técnicas que hacen pasar trabajo hecho por LLM como dibujo manual. Pinterest reunió infografías de verificación con sellos «FAKE» y distintivos como «97% likely AI generated». En Lemmy son frecuentes términos despectivos como «AI slop» y las comunidades anti-IA tienen una presencia notable.
  • Los modelos chinos impulsan la generación de vídeo: en vídeos comparativos de YouTube se ha vuelto habitual presentar a ByteDance Seedance 2.0 «derrotando» repetidamente a Kling, Sora y Veo. En Lemmy, más de diez publicaciones sobre nodos de ComfyUI, LoRA y herramientas de aceleración VAE para MiniMax-H3 de Alibaba aparecieron en solo una semana, del 02 al 08 de septiembre de 2026. El impulso chino destaca tanto en el ámbito cerrado como en el abierto.
  • El contenido comparativo y en formato de ranking se ha convertido en un formato nativo de cada plataforma: los vídeos de enfrentamientos «X vs. Nano Banana/Sora/Kling» en YouTube, las infografías de Pinterest con las diez mejores herramientas gratuitas de vídeo IA y los hilos de Reddit que clasifican generadores de imágenes sin censura expresan la misma preocupación práctica: «¿cuál debería usar?».

Plataforma por plataforma

Reddit: se analizaron 12 hilos recopilados previamente por workers, procedentes de 10 subreddits. Se contrastó la demanda de herramientas de generación de imágenes que prometen no tener censura ni límites (WildOwl, Mage.space, PixelForge) con el endurecimiento de las restricciones sobre personajes con propiedad intelectual en Grok, ChatGPT y Gemini. También destacó la preocupación por una moderación deficiente: la presencia de numerosos vídeos de abuso infantil generados por IA en Meta obtuvo una reacción destacada (772 puntos en r/TrueReddit y 1.024 comentarios). En varios hilos se observa un consenso de que la duración de los vídeos generados sigue limitada a entre 5 y 15 segundos.

X: de las 40 publicaciones y 37 cuentas recopiladas, solo 2 abordaban realmente el tema: una breve reacción de @DotCSV a una actualización de modelo de imágenes y una presentación de @QingQ77 de un repositorio de generación con IA y 3D. Como los términos de búsqueda se basaban en tendencias generales del día en Croacia (Apple, $LAPTOP, Hunter Biden, etc.) y no en IA de generación de imágenes o vídeo, esta fase prácticamente no logró captar el estado real del tema.

YouTube: en 11 vídeos se confirmó la noticia cerrada más importante —el cierre de la API de OpenAI Sora el 24 de septiembre de 2026—, las novedades de modelos como GPT Image 2 y Midjourney V8, y el giro «abierto → cerrado» de Alibaba Wan 3.0. Los tutoriales de ComfyUI y ejecución local de DevsKingdom y GeekatPlay son la principal forma de difusión del lado abierto. No fue posible obtener visualizaciones ni suscriptores porque las páginas se renderizan con JavaScript.

Bluesky: como la API de búsqueda de texto completo devolvía 403 para todas las consultas, se cambió a una investigación indirecta basada en cuentas. Bots agregadores de noticias como testingcatalog.com y genainews.bsky.social difundieron anuncios de «ChatGPT Images 2.5» de OpenAI y «Muse» de Meta. Por otro lado, las principales cuentas del ecosistema abierto —Black Forest Labs, Stability AI, Midjourney oficial y bots de notificación de Civitai— estaban prácticamente inactivas, por lo que la plataforma no funcionó como fuente primaria.

Lemmy: se observó una fuerte concentración en !«メールアドレス», cuyo contenido se compone principalmente de un feed automatizado de novedades de HuggingFace y GitHub. Durante la semana anterior, el mayor tema fue el ecosistema ComfyUI en torno a MiniMax-H3. En el lado cerrado no aparecieron publicaciones al buscar servicios principales como Sora, Kling, Runway, Ideogram y Veo 3; en su lugar circularon únicamente temas controvertidos o éticos, como el abuso de Nano Banana y la demanda contra Midjourney.

Pinterest: se examinaron 23 de 50 pines. La mayoría eran contenidos secundarios que republicaban miniaturas de vídeos de YouTube o infografías de blogs recopilatorios, y no se pudieron obtener métricas de interacción como «me gusta» o guardados. Aunque destacaron visuales de anuncios de grandes empresas como Veo 2 de Google y VASA-1 de Microsoft, el peso del ecosistema abierto —Stable Diffusion, Flux, Qwen, Wan y otros— se limitó a una sola ilustración técnica y una entrada en rankings de herramientas.

Qué vigilar

Recomendaciones

  • Seguir la adopción de Veo 3.1, Kling 3.0, Seedance 2.0 y la familia Wan como alternativas tras el cierre de la API de Sora el 24 de septiembre.
  • Vigilar continuamente el riesgo de cambios de estrategia en otros laboratorios de pesos abiertos, tomando como precedente el giro «abierto → cerrado» de Wan 3.0.
  • Observar de forma continuada las herramientas ComfyUI alrededor de MiniMax-H3 en Lemmy y HuggingFace para detectar pronto señales del próximo gran modelo abierto de vídeo.
  • Reinvestigar X reemplazando términos dependientes de tendencias regionales por términos específicos de IA de imágenes y vídeo, como Stable Diffusion, Sora y Nano Banana.
  • Seguir el estado de moderación de contenido dañino generado por IA en plataformas como Meta como indicador adelantado de riesgos regulatorios y reputacionales.
  • Vigilar de forma continua las ampliaciones de funciones de consumo cerradas de Nano Banana y Gemini Image como indicador de las respuestas competitivas de otras empresas.

Calidad de los datos

  • X: se recopilaron 40 publicaciones, pero solo 2 (5 %) se relacionaban con el tema. Los términos de búsqueda dependían de tendencias regionales del día —Apple, $LAPTOP, Hunter Biden y otros— y no incluían ni un solo término específico de IA de imágenes o vídeo; por ello, prácticamente no se obtuvieron hallazgos para esta plataforma.
  • Bluesky: la API oficial de búsqueda de texto completo (app.bsky.feed.searchPosts) devolvió 403 en todas las consultas y no pudo utilizarse, por lo que se recurrió a una investigación indirecta mediante búsqueda de cuentas. Solo se identificaron unas 10 publicaciones directamente relevantes, menos que el criterio de finalización de 20.
  • Reddit: se analizaron 12 hilos recopilados previamente por workers, mediante una única consulta. No se alcanzó el objetivo aproximado de 20 publicaciones, y los temas específicos de modelos abiertos fueron especialmente escasos.
  • Lemmy: el volumen de publicaciones sobre este tema es pequeño y la mayoría de las puntuaciones se sitúan entre un dígito y unas decenas. No se encontraron publicaciones relevantes al buscar los principales servicios cerrados como Sora, Kling, Runway, Ideogram o Veo 3.
  • YouTube: debido al renderizado con JavaScript, WebFetch no pudo obtener la cuadrícula de vídeos, las visualizaciones ni los comentarios. Mediante oEmbed solo se confirmaron títulos y nombres de canales; por tanto, se omitieron las visualizaciones y los suscriptores como «no disponibles».
  • Pinterest: los pines no incluían métricas de interacción como «me gusta» o guardados, por lo que no fue posible comparar cuantitativamente qué publicaciones estaban creciendo. Además, la mayor parte del material recopilado eran republicaciones de miniaturas de YouTube o artículos de blog, con valor limitado como información primaria.

Resumen por plataforma

Reddit

Reddit — Noticias de IA de generación de imágenes y vídeo

Dónde
  • r/AItips101 (1.210 suscriptores) — 1 publicación
  • r/antiai (320.447 suscriptores) — 1 publicación
  • r/aivideomaking (6.681 suscriptores) — 1 publicación
  • r/aiwars (167.556 suscriptores) — 2 publicaciones
  • r/generativeAI (151.900 suscriptores) — 2 publicaciones
  • r/freetoolsAI (7.991 suscriptores) — 1 publicación
  • r/isthisAI (407.630 suscriptores) — 1 publicación
  • r/RemoteWorkers (76.520 suscriptores) — 1 publicación
  • r/ChatGPT (11.626.217 suscriptores) — 1 publicación
  • r/TrueReddit (628.511 suscriptores) — 1 publicación

12 hilos en total; solo se utilizó la consulta de búsqueda "Image and Video Generation AI News".

Qué dice la gente
  • Hilo 1 «The best uncensored AI image generators in 2026» (r/AItips101, 110 pt, 45 comentarios, 2026-09-07) https://www.reddit.com/r/AItips101/comments/1w9yftp/ — Publicación de ranking de herramientas de generación de imágenes por IA «sin censura». WildOwl.ai ocupa el primer puesto y ofrece acceso a más de 35 modelos, incluidos Qwen, Flux, Seedream, Wan, Kling, Seedance, Veo y GPT Image, sin suscripción y con créditos sin caducidad. En comentarios, u/reliablemicrophone84 elogió WildOwl por resolver el dilema de «modelos más recientes o libertad», mientras que u/Clear-Assistance449 defendió Mage.space porque permite generación ilimitada dentro de la suscripción. El espacio de herramientas de imágenes sin censura parece muy fragmentado.

  • Hilo 2 «Warning: There is a new form of ai generated image» (r/antiai, 7.130 pt, 1.024 comentarios, 2026-09-05) https://www.reddit.com/r/antiai/comments/1w81kdd/ — Una publicación de advertencia sobre una técnica que otorga a un LLM, GPT-6, control de ratón y teclado para «dibujar» directamente en una tableta digital. Como incluso puede generar timelapses aparentemente auténticos, se argumenta que distinguirlo de una creación artística real se ha vuelto prácticamente imposible. Fue el hilo con mayor reacción de los 12 recopilados. El comentario principal de u/Nayutantantan (2.510 pt) expresó un fuerte rechazo: «ni siquiera documentarlo tiene sentido ya; ¿por qué se empeñan tanto en hacerse pasar por artistas de verdad?».

  • Hilo 11 «Facebook Is Hosting Huge Numbers of Horrifying AI-Generated Videos of Violent Child Abuse...» (r/TrueReddit, 772 pt, 40 comentarios, 2026-09-09) https://www.reddit.com/r/TrueReddit/comments/1wbnann/ — Comparte un artículo que denuncia que Meta, en Facebook, deja alojados grandes volúmenes de vídeos de abuso infantil generados por IA. El usuario u/mirh citó la respuesta de relaciones públicas de Meta: «hay normas estrictas contra el contenido que representa daño físico, ya sea real o generado por IA», y señaló que la empresa afirmó haber retirado los vídeos. Sin embargo, se observó que, aunque existen sistemas de detección, no se están utilizando. u/NinjaLion alertó de que Meta, X y eventualmente Reddit se dirigen hacia una renuncia a la moderación de tipo «venden espadas, pero no armaduras».

  • Hilo 9 «Get Paid $30/Hour Reviewing AI-Generated Images» (r/RemoteWorkers, 175 pt, 828 comentarios, 2026-09-04) https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/ — Anuncio de empleo remoto para verificar subtítulos generados por IA, con un pago de 30 dólares por hora. Aunque tiene 828 comentarios, la mayoría son respuestas repetidas con la palabra «Images» buscando el enlace de solicitud, por lo que casi no hay discusión sustantiva. Es un ejemplo del rápido crecimiento en Reddit de una nueva categoría laboral: la verificación y evaluación humana de productos de IA.

  • Hilo 4 «This Is a render made in Blender (not an AI generated video) by GPT 6 - Astra» (r/aiwars, 18 pt, 14 comentarios, 2026-09-06) https://www.reddit.com/r/aiwars/comments/1w96yaf/ — Republicación de un vídeo de X en el que GPT-6 «Astra» manipula Blender y crea un render. u/not_food (6 pt) dijo que no puede esperar a que sea posible ejecutarlo localmente: mientras exista el riesgo de cambios de precio, de política o de cierres de servidores, no puede usarlo para trabajar. u/ComfortPhil (1 pt) mostró confusión ante la ambigüedad de la definición: «¿hecho por GPT-6, pero no generado por IA? No lo entiendo».

  • Hilo 10 «Updated image generator. Trying to get back to "weird AI art"» (r/ChatGPT, 32 pt, 26 comentarios, 2026-09-09) https://www.reddit.com/r/ChatGPT/comments/1wbdbdj/ — Publicación que intenta recrear con el generador de imágenes actual de ChatGPT la «rareza» de los primeros Disco Diffusion y Stable Diffusion. u/Cubic_Inequality504 (9 pt) indicó que las extrañas texturas pictóricas seguían presentes y que en 2.5 eran prácticamente iguales a Image 2. Refleja la insatisfacción de algunos usuarios con una evolución hacia imágenes más realistas y bonitas.

  • Hilo 5 «Even a lot of Pros here will admit that current AI models suck at generating appetizing images of food» (r/aiwars, 4 pt, 177 comentarios, 2026-09-03) https://www.reddit.com/r/aiwars/comments/1w69cdj/ — Crítica a que las imágenes de alimentos generadas por IA para publicidad no parecen apetecibles. u/LCI_Jake (14 pt) las describió como deliberadamente grotescas, «como nidos de insectos». En cambio, u/Bassed_Hummble (5 pt) sostuvo que incluso Krea 2 gratuito puede lograr buena calidad en 40 segundos con un buen prompt y preguntó por qué las empresas usan imágenes tan malas. Las opiniones se dividen entre atribuir el problema al modelo o a la calidad de los prompts y de la ejecución.

  • Hilo 6 «Non Restrictive AI Image Generator» (r/generativeAI, 2 pt, 3 comentarios, 2026-09-08) https://www.reddit.com/r/generativeAI/comments/1waapc1/ — Consulta de alguien que quiere crear fan art personal de personajes de Disney, pero Grok lo bloquea. Es un ejemplo de la creciente restricción en grandes servicios cerrados como Grok, ChatGPT y Gemini para generar personajes protegidos por propiedad intelectual. u/frighten (1 pt) sugirió PixelForge como posible alternativa sin restricciones.

  • Hilo 7 «Free AI Image Generator» (r/freetoolsAI, 40 pt, 51 comentarios, 2026-09-04) https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/ — Publicación promocional de una herramienta gratuita de generación de imágenes, aifreeforever.com, que promete uso sin registro, ilimitado y sin marcas de agua. u/Puzzleheaded_Lab4757 (1 pt) afirmó haber ahorrado cientos de dólares y horas gracias al sitio, mientras u/Relevant_Syllabub895 (2 pt) se quejó de las prohibiciones de NSFW.

  • Hilo 8 «Is This Video AI-Generated or Real? Looking for Opinions From People Who Can Spot AI» (r/isthisAI, 0 pt, 31 comentarios, 2026-09-09) https://www.reddit.com/r/isthisAI/comments/1wbspxo/ — Publicación que pide ayuda para determinar si un vídeo es real o generado por IA. u/BouncingSphinx (3 pt) señaló que dura exactamente 15 segundos, lo que parece ser el límite de los vídeos de IA actuales. u/smalltiddygothb (16 pt) y u/EmergencyWaffleBox (14 pt) señalaron artefactos concretos —un collar que desaparece y reaparece— como pistas para identificar contenido generado.

  • Hilo 3 «free video ai generator» (r/aivideomaking, 12 pt, 29 comentarios, 2026-09-07) https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/ — Consulta sobre crear gratis un vídeo de 45 segundos solo con un teléfono o iPad. u/NewLifeWares (2 pt) explicó que 45 segundos exige hardware de nivel centro de datos y que, en niveles gratuitos, lo máximo suele ser un vídeo de 5 segundos con marca de agua. La corta duración sigue siendo el principal cuello de botella de los servicios de vídeo IA gratuitos.

Señales
  • Aumenta la demanda de herramientas «sin censura/sin límites» en el lado cerrado —WildOwl, Mage.space y PixelForge—, en paralelo con las restricciones de personajes con propiedad intelectual impuestas por grandes plataformas como Grok, ChatGPT y Gemini. Cuanto más estrictas son las restricciones, mayor parece ser la demanda de hilos que recomiendan alternativas.
  • Crece con fuerza el rechazo a las técnicas para ocultar o disfrazar que algo fue generado por IA. El hilo 2, sobre hacer que un LLM controle el ratón y produzca un timelapse aparentemente real, recibió 1.024 comentarios y fue por mucho el de mayor reacción. Aunque proviene de r/antiai, el debate sobre falsificar autenticidad resuena con el hilo 8 de r/isthisAI, donde se buscan pistas visuales para reconocer contenido de IA.
  • El límite de duración de los vídeos generados, alrededor de 5 a 15 segundos, sigue percibiéndose como una barrera, según los hilos 3 y 8. Las respuestas a la solicitud de un vídeo gratuito de 45 segundos coinciden en que no es factible; se trata más de un consenso que de una controversia.
  • Las valoraciones de calidad están divididas: el hilo 10 critica que las texturas extrañas no hayan cambiado pese a la evolución, mientras el hilo 5 responde que no es un límite del modelo sino un problema de prompts. Hay desacuerdo sobre quién es responsable de la calidad de las imágenes de IA.
  • Los empleos humanos relacionados con IA —verificación de subtítulos por 30 dólares por hora— empiezan a destacar en los tablones de empleo de Reddit. Es una señal de que, junto a la generación, crece el trabajo periférico de verificación y supervisión de los productos generados.
  • La preocupación por fallos de moderación aparece como tema transversal entre plataformas (hilo 11). Aunque se plantea como un problema específico de Meta, los comentarios predicen que X y Reddit seguirán el mismo camino; la brecha entre expansión de IA generativa y capacidad de moderación de plataformas podría convertirse en un punto de conflicto.
Límites
  • El criterio de finalización pedía analizar aproximadamente 20 hilos por plataforma, pero la recopilación de workers incluyó solo 12 hilos de 10 subreddits. También se utilizó una sola consulta, "Image and Video Generation AI News"; no se realizaron búsquedas adicionales en japonés ni con otras consultas en inglés, como «Stable Diffusion», «Midjourney», «Sora» u «open source diffusion model». Frente al requisito de brief.md de al menos diez hallazgos para cada lado —cerrado y abierto—, 12 hilos pueden ser una muestra insuficiente.
  • La recopilación casi no incluyó hilos centrados en nombres específicos de modelos abiertos —familias de Stable Diffusion, ComfyUI o nuevos modelos concretos distintos de Civitai—, por lo que ese lado está menos representado que las menciones cerradas a WildOwl, ChatGPT, Grok y GPT-6.
  • En el hilo 9 de r/RemoteWorkers, la mayoría de los 828 comentarios son repeticiones de «Images», por lo que casi no ofrece material sustantivo para citar.
  • Este archivo se elaboró leyendo únicamente output/reddit.threads.md y .json ya recopilados por workers; no se realizaron accesos adicionales a Reddit mediante WebFetch o búsqueda, conforme a las instrucciones del playbook.

X

X — Tendencias en noticias de IA de generación de imágenes y vídeo

Cuentas

De las 40 publicaciones recopiladas, procedentes de 37 cuentas, solo 2 cuentas abordaban realmente el tema de esta investigación —IA de generación de imágenes y vídeo—.

  • @DotCSV (Carlos Santana) — YouTuber y comentarista de IA conocido en el ámbito hispanohablante. Una publicación y 890 me gusta, una reacción de escala media dentro de la recopilación. Apareció al buscar «AI OS», pero su contenido es una breve reacción a una actualización de un modelo de imágenes.
  • @QingQ77 (Geek Lite) — Cuenta pequeña, con una publicación y 24 me gusta. Presentó un repositorio de GitHub para que agentes de IA generen piezas imprimibles en 3D dentro de Blender (jangtrinh/design-os-3d-blender). No se trata de generación de imágenes o vídeo en sentido estricto, sino de un área adyacente: generación IA × 3D/CAD.

Las otras 35 cuentas reunieron entre una y tres publicaciones sobre nuevos productos de Apple, la memecoin $LAPTOP, Real Madrid y fútbol, Hunter Biden, debates católicos, Love Island USA y comentarios de anime, entre otros temas sin relación con la IA de imágenes o vídeo; por ello, no se contabilizan como emisores del tema.

Publicaciones
  • #19 @DotCSV — 890 me gusta · 46 republicaciones · 15 respuestas · unas 63.000 visualizaciones · 2026-09-08
    https://x.com/DotCSV/status/2097406200006537543 («AI OS» fue el término de búsqueda que la encontró)

    "Fuck, and on top of that, they roll out an update to the image model... just in case the math milestone wasn't enough for you."
    La única publicación que menciona una actualización de un modelo de imágenes. Sin embargo, el texto no identifica el modelo ni la empresa, y solo constituye una reacción aislada.

  • #17 @QingQ77 — 24 me gusta · 2 republicaciones · 15 respuestas · unas 2.300 visualizaciones · 2026-09-08
    https://x.com/QingQ77/status/2097258894280347971 («AI OS» fue el término de búsqueda que la encontró)

    "Let AI agents build real parts with correct dimensions and 3D printability according to specifications in Blender 5.2, directly connecting to the printing production stage." (incluye un enlace a GitHub: jangtrinh/design-os-3d-blender)
    No es generación de imágenes o vídeo propiamente dicha, pero merece mención como ejemplo de una tendencia afín: la IA conecta directamente productos generados con la fase de producción en el ámbito 3D/CAD. La reacción fue pequeña y se mantuvo en un nicho.

Las otras 38 publicaciones —encontradas con «Apple», «$LAPTOP», «Hunter Biden», «iPhone», «Real Madrid», «Harvey», «Germans», «#chance», «Catholic», así como las otras dos encontradas con «AI OS»— no guardan relación con la IA de generación de imágenes o vídeo y se excluyeron de los hallazgos.

Señales
  • La señal más clara de esta fase es que el conjunto de publicaciones recopilado no guardaba prácticamente relación con el tema. Solo 2 de 40 publicaciones se refieren de forma sustantiva a noticias o discusiones sobre IA de imágenes o vídeo, ya sea cerrada o abierta, y ninguna funciona como una fuente primaria sólida: son una opinión aislada y una recomendación de repositorio.
  • La única publicación temática de @DotCSV sugiere que cuando un influencer de IA reacciona a una actualización de modelo de imágenes puede generar cierta difusión, equivalente a unas 63.000 visualizaciones. Sin embargo, no menciona el modelo ni sus funciones y no sirve para validación posterior.
  • Ninguno de los nombres propios directamente relevantes —Stable Diffusion, Midjourney, Flux, Sora, Veo, Runway, Kling, Seedance, ComfyUI, Civitai o Nano Banana— se utilizó como término de búsqueda. La recopilación no dice nada sobre el volumen ni la intensidad reales de la conversación de X sobre ellos.
Límites
  • Los términos de búsqueda no encajan con el tema. Siguiendo el playbook, el worker usó directamente las tendencias mostradas en la página Explore de X —«Trending in Croatia», según la ubicación del servidor conectado—: Apple, $LAPTOP, Hunter Biden, iPhone, AI OS, Real Madrid, Harvey, Germans, #chance y Catholic. Eran tendencias generales del día en el entorno de Croacia, no términos derivados del tema de investigación de IA de imágenes y vídeo. Como resultado, 9 de los 10 términos, equivalentes a unas 30 publicaciones, no tenían relación con el tema.
  • Incluso dentro de la búsqueda «AI OS», 2 de 4 resultados eran irrelevantes: #18 trataba sobre sesgo en encuestas de opinión regionales y #20 sobre «ai os cat beanie».
  • El criterio de finalización es analizar unas 20 publicaciones por red social, pero esta recopilación contenía solo dos publicaciones temáticas. En lugar de incluir forzadamente publicaciones irrelevantes para completar el número, los hallazgos se limitaron a esas dos.
  • Este archivo se elaboró solo a partir de output/x.posts.md y .posts.json ya recopilados; de acuerdo con el playbook, no se accedió adicionalmente a X para buscar o navegar. Una nueva búsqueda con términos directamente relevantes como Stable Diffusion, Midjourney, Sora, Veo o modelos de vídeo abiertos probablemente habría arrojado resultados distintos, pero quedaba fuera del alcance actual.

YouTube

YouTube — Noticias de IA de generación de imágenes y vídeo (código cerrado frente a código abierto)

Canales
  • Qwen (canal oficial de Alibaba Qwen) — publica directamente anuncios de lanzamientos de modelos, como Qwen-Image-2.0.
  • Youri van Hofwegen — revisor y comparador de herramientas de vídeo IA; cubre enfrentamientos directos entre Seedance, Kling, Veo y Wan.
  • DevsKingdom — tutoriales de generación local de código abierto, con FLUX.2 y flujos de trabajo de ComfyUI.
  • Vladimir Chopine [GeekatPlay] — enfocado en ComfyUI; realiza comparativas locales de varios modelos de texto a imagen, como Qwen, Z-Image, FLUX.2 klein, Ovis y LongCat.
  • CyberJungle — canal de reacciones y reseñas de lanzamientos de modelos cerrados, como GPT Image 2.
  • Creative AI Show — canal de comparaciones de modelos cerrados, como Midjourney frente a sus competidores.
  • Codedigipt — canal de recopilaciones que sigue múltiples lanzamientos cerrados en un mismo vídeo, incluidos GPT y Grok Imagine.
  • Airt — canal de alto volumen de demostraciones de generación de vídeo IA, con una gran recopilación de Wan 3.0.
  • Prompt Engineer — canal explicativo que contrasta afirmaciones promocionales con lo que realmente se lanzó, incluido el licenciamiento de Wan 3.0.
  • Zoom Vantage — canal de noticias y explicaciones sobre IA que cubre el aspecto empresarial, incluido el cierre de Sora.

No se pudieron obtener las cifras de suscriptores; véanse los Límites.

Vídeos
  1. Why OpenAI Shut Down Sora So Fast: What's Next? — Zoom Vantage — https://www.youtube.com/watch?v=H2jVcy5PuBI — Sostiene que el gasto de Sora, de aproximadamente 1 millón de dólares diarios, y el desplome del uso —de un pico de alrededor de 1 millón de usuarios a menos de 500.000, con la posición en App Store cayendo del puesto 1 al 165— obligaron a OpenAI a cerrar la aplicación de consumo y, según su propio aviso de retirada, eliminar por completo la API de Sora 2 el 24 de septiembre de 2026, sin modelo reemplazo indicado. (Código cerrado.)

  2. 🚀 Introducing Qwen-Image-2.0 — our next-gen image generation model! — Qwen (oficial) — https://www.youtube.com/watch?v=1tM7Wd0lEeI — 10 de febrero de 2026 — El canal de Alibaba anuncia Qwen-Image-2.0, un modelo de 7B que unifica generación y edición a resolución nativa 2K. (Código abierto.)

  3. Flux.2 Dev: The Best Free Image Generation Model Outperforms Nano Banana — DevsKingdom — https://www.youtube.com/watch?v=NCvbMKV9e8c — 4 de diciembre de 2025 — Afirma que FLUX.2 Dev de Black Forest Labs, gratuito y ejecutable localmente, supera a Nano Banana cerrado de Google en calidad. (Código abierto.)

  4. ComfyUI Text-to-Image Models Compared (Local): Qwen 2512, Z-Image, FLUX.2 klein, Ovis, LongCat — Vladimir Chopine [GeekatPlay] — https://www.youtube.com/watch?v=IwZbOXCZZGM — 6 de marzo de 2026 — Benchmark local en paralelo de cinco modelos actuales de texto a imagen con pesos abiertos ejecutables en ComfyUI. (Código abierto.)

  5. OpenAI JUST Dropped GPT Image 2 and It's WILD (Nano Banana Pro Killer?) — CyberJungle — https://www.youtube.com/watch?v=Tj3jFnx5IW0 — 21 de abril de 2026 — Reacciona al lanzamiento de GPT Image 2 y lo presenta como la respuesta de OpenAI a Nano Banana Pro de Google; señala que encabeza el Artificial Analysis Image Arena con un Elo de aproximadamente 1.370, mientras MAI-Image-2.6 de Microsoft reduce la diferencia. (Código cerrado.)

  6. MIDJOURNEY 8 — Compared to Nano Banana 2 & Midjourney V7 — Creative AI Show — https://www.youtube.com/watch?v=MgMZ6e2NBGA — 19 de marzo de 2026 — Compara el nuevo V8 de Midjourney con su V7 y Nano Banana 2 de Google. (Código cerrado.)

  7. Seedance 2.0 Just Destroyed Kling 3.0, Sora 2 & VEO 3.1 — Comparison — Youri van Hofwegen — https://www.youtube.com/watch?v=vw_Jk2-phsA — 11 de abril de 2026 — Uno de muchos vídeos comparativos casi idénticos de la primavera de 2026 que afirman que Seedance 2.0 «destruye a todos»; forma parte de una tendencia visible de Seedance 2.0 de ByteDance dominando enfrentamientos contra Kling, Sora y Veo. (Código cerrado.)

  8. Best AI Video Generator in 2026 (Don't Choose Wrong) — Youri van Hofwegen — https://www.youtube.com/watch?v=PsJLCiWnZhM — 3 de agosto de 2026 — Recopilación más reciente, dentro de los últimos 60 días, que compara Seedance 2.0, Gemini «Omni Flash», Kling 3.0 y otros para compradores de finales de 2026. (Código cerrado.)

  9. Finally Got FR*EE GPT 5.6 Luna & Grok Imagine Image 2.0 Is INSANE & OpenAI New Cyber Model Astra — Codedigipt — https://www.youtube.com/watch?v=aqiTD2dESFU — 8 de agosto de 2026 — Recopilación reciente sobre el lanzamiento de Grok Imagine Image 2.0 de xAI junto a otras noticias de modelos cerrados. (Código cerrado.)

  10. China Did It AGAIN? — 100+ Wan 3.0 AI Videos — Airt — https://www.youtube.com/watch?v=fNvv2u-1cGw — principios de agosto de 2026 — Muestra de la beta pública de Wan 3.0 de Alibaba, abierta el 6 de agosto de 2026, que extiende la duración de generación a 30 segundos —desde los 15 segundos de Wan 2.7— con 1080p nativo y audio sincronizado. (De linaje nominalmente «open source», pero véase el punto 11.)

  11. FREE Wan 3.0: what actually shipped (there are no weights) and How to use it for FREE — Prompt Engineer — https://www.youtube.com/watch?v=gbI8XV4Szrk — finales de agosto de 2026 — Vídeo de verificación que señala que, pese a la reputación abierta de Wan, las publicaciones públicas de pesos de Alibaba terminan en Wan 2.2; Wan 3.0 se lanzó solo como una API cerrada y de pago por uso, sin pesos disponibles. (Notable giro de abierto a cerrado.)

Señales
  • La salida de Sora es la mayor historia de código cerrado de la plataforma ahora mismo: varios vídeos tratan el cierre de la API el 24 de septiembre de 2026 como un referéndum sobre la economía unitaria de la generación de vídeo, no como un fracaso de capacidad. También señalan abiertamente que OpenAI no tiene modelo sucesor y dirigen a los espectadores hacia Veo 3.1, Kling 3.0, Seedance 2.0 y Wan 2.7.
  • Los vídeos de comparación «X vs. Nano Banana / Sora / Kling» son un formato dominante y casi estandarizado. Los mismos canales, como Youri van Hofwegen y Creative AI Show, publican enfrentamientos similares cada vez que aparece un modelo cerrado, lo que sugiere una fuerte demanda de contenido sobre «por cuál debería pagar».
  • La cobertura abierta se inclina hacia tutoriales de ComfyUI e instalación local —DevsKingdom y GeekatPlay—, más que hacia reacciones a noticias. La audiencia de contenido sobre FLUX.2, Qwen-Image y Z-Image está formada por desarrolladores y aficionados que ejecutan modelos localmente, no por público general.
  • La línea entre abierto y cerrado se está difuminando e incluso invirtiendo: Alibaba, antes referente de los lanzamientos con pesos abiertos por Wan 2.2, Qwen-Image y Z-Image, lanzó su nuevo buque insignia Wan 3.0 como API cerrada, medida y sin pesos. Un vídeo dedicado, el #11, lo señala directamente.
  • Los laboratorios chinos —Alibaba/Tongyi y Seedance de ByteDance— dominan la conversación sobre generación de vídeo en la segunda mitad de 2026, y se los menciona repetidamente como sustitutos o ganadores frente a modelos cerrados estadounidenses, como Sora y Veo.
  • Los canales oficiales de los propietarios de modelos, como Qwen, son una fuente primaria de noticias en YouTube, pues publican anuncios el mismo día de los lanzamientos; conviene tratarlos como fuentes primarias junto a los revisores independientes.
Límites
  • Las páginas de resultados y reproducción de YouTube se renderizan con JavaScript. WebFetch directo de youtube.com/results?... y youtube.com/watch?v=... devolvió solamente texto estático de pie de página y avisos legales, sin cuadrícula de vídeos, títulos, visualizaciones ni comentarios. No fue posible leer comentarios en la página.
  • Para compensarlo, se utilizaron búsquedas web con consultas site:youtube.com, que a menudo devolvían resultados alternativos, y el endpoint público oEmbed de YouTube (youtube.com/oembed) para confirmar títulos exactos y nombres de canales. oEmbed no ofrece visualizaciones ni suscriptores, por lo que se omitieron en vez de estimarlos.
  • Las fechas de publicación son aproximadas cuando oEmbed no las proporcionó; se utilizaron fechas de fragmentos de búsqueda web, generalmente exactas al día, aunque ocasionalmente solo al mes.
  • Esta cobertura se apoya en vídeos y comparativas porque dominan los resultados de YouTube indexados por buscadores. Puede haber contenido adicional de canales pequeños o en idiomas no ingleses que no apareció en estas consultas.

Bluesky

Bluesky — Noticias de IA de generación de imágenes y vídeo

Nota sobre el método de investigación

La API de búsqueda de texto completo app.bsky.feed.searchPosts de public.api.bsky.app devolvió HTTP 403 para todas las consultas realizadas, incluidas q=image generation AI, q=Stable Diffusion y q=cats, por lo que no pudo utilizarse. En su lugar, se localizaron cuentas relevantes mediante app.bsky.actor.searchActors, que funcionaba correctamente, y se obtuvo directamente el feed de cada cuenta con app.bsky.feed.getAuthorFeed.

Cuentas
  • testingcatalog.com (🚨 AI News | TestingCatalog) https://bsky.app/profile/testingcatalog.com — Agregador de noticias de IA de última hora. Publica varias veces al día sobre agentes, lanzamientos de modelos y filtraciones. Seguía activo en septiembre de 2026 y fue la fuente con más información de esta investigación.
  • genainews.bsky.social (Gen AI News 🅰︎ℹ︎) https://bsky.app/profile/genainews.bsky.social — Agregador independiente de noticias de IA. Continuaba publicando activamente hasta el 10 de septiembre de 2026.
  • dfl.bsky.social (DFL inc.) https://bsky.app/profile/dfl.bsky.social — Cuenta de estilo bot que publica casi a diario imágenes de paisajes fotorrealistas generadas con «Nano Banana 2» de Google. Publicó diariamente entre agosto y septiembre de 2026, con una respuesta estable de 30 a 90 me gusta.
  • generate-cmyxt.bsky.social (Generate created Tech) https://bsky.app/profile/generate-cmyxt.bsky.social — Cuenta de promoción y tutoriales de flujos de trabajo abiertos de ComfyUI para vídeo e imagen. Presenta repetidamente Flux, Wan, LTX, Qwen Image Edit, Ideogram 4 y DreamOmni2.
  • you32081.bsky.social (You32081) https://bsky.app/profile/you32081.bsky.social — Creador de arte IA NSFW cuyo perfil indica «R18 AI Photo/Illustration with Qwen-Image, Z-Image-Turbo». Su selección de herramientas permite observar el uso real de modelos de imagen abiertos por creadores individuales.
  • blackforestlabs.bsky.social (cuenta oficial de Black Forest Labs, desarrollador de Flux) https://bsky.app/profile/blackforestlabs.bsky.social — La cuenta existe, pero no tenía publicaciones cuando se realizó la recopilación.
  • stabilityai.bsky.social (cuenta oficial de Stability AI) https://bsky.app/profile/stabilityai.bsky.social — Su publicación más reciente era del 19 de noviembre de 2025 y se centraba en generación de música, Stable Audio. No se observaron anuncios recientes de modelos de imagen o vídeo.
  • midjourneyofficial.bsky.social (cuenta oficial de Midjourney) https://bsky.app/profile/midjourneyofficial.bsky.social — Activa solo entre agosto y octubre de 2025; sin actualizaciones posteriores.
  • civitai-bot.bsky.social (bot de actualizaciones de checkpoints de Civitai) https://bsky.app/profile/civitai-bot.bsky.social — Bot que publica automáticamente nuevos checkpoints de Civitai, pero su última publicación recuperada era del 09 de mayo de 2024, por lo que parece inactivo desde entonces.
  • artistsagainstai.bsky.social (Artists Against Billionaires & Their AI) https://bsky.app/profile/artistsagainstai.bsky.social — Cuenta de base contraria al arte con IA. Sin embargo, las publicaciones recuperadas se limitaban a la primera mitad de 2025.
Publicaciones
  1. «OpenAI launches ChatGPT Images 2.5 with faster editing» — testingcatalog.com, 2026-09-09, 2 me gusta/1 republicación https://bsky.app/profile/testingcatalog.com/post/3mv3hn2whdz27 — Según el artículo enlazado, ChatGPT Images 2.5 mejora la velocidad de generación, la claridad de salida, la precisión de edición y la consistencia de sujetos. Añade la función «Sketch» para generar imágenes a partir de bocetos a mano, y los modelos de API «Flare» para usos cotidianos rápidos y «Sunburst» para edición precisa. Código cerrado.

  2. «ChatGPT Images 2.5 adds Sketch for doodle-based image generation» — genainews.bsky.social, 2026-09-08 https://bsky.app/profile/genainews.bsky.social/post/3muzxnrah542m — Otro agregador informa de forma independiente sobre el mismo anuncio de OpenAI. Código cerrado.

  3. «Visko launches Orbis, a new real-time AI video model» — testingcatalog.com, 2026-08-31/09-01, publicado dos veces https://bsky.app/profile/testingcatalog.com/post/3muhthn6m7i2j — Según el artículo enlazado, Orbis genera continuamente en tiempo real mientras se modifica el prompt y mantiene memoria de la escena incluso durante generaciones largas. Ofrece salida 4K a 24 fps, actualizaciones subsegundo y afirma encabezar pruebas de calidad, movimiento y fidelidad al prompt. Código cerrado.

  4. «Exclusive: Early outputs of Muse Video model from Meta» — testingcatalog.com, 2026-08-19, 2 me gusta https://bsky.app/profile/testingcatalog.com/post/3mthtr6iu7p24 — Presentación anticipada de salidas iniciales de «Muse Video», el modelo de generación de vídeo de Meta. Código cerrado.

  5. «Meta's Muse agent enters closed alpha with invite codes» — testingcatalog.com, 2026-09-07, 2 me gusta https://bsky.app/profile/testingcatalog.com/post/3muv7evaa7a24 — Muse, el agente personal de Meta y de la misma línea que el modelo de vídeo Muse, entró en alfa cerrada mediante códigos de invitación. Código cerrado.

  6. «Tencent released open-source Hy4 preview model» — testingcatalog.com, 2026-08-29 https://bsky.app/profile/testingcatalog.com/post/3mu7v3bdkwo2h — Según el artículo enlazado, es un modelo de 77.000 millones de parámetros con contexto de un millón de tokens, abierto para software, oficina, juegos e investigación. Afirma superar a GLM 5.3 y Kimi K3 en pruebas internas. No es un modelo de imagen o vídeo, sino un LLM centrado en texto; se incluye como ejemplo de cómo cuentas de noticias de IA de Bluesky cubrieron la apertura de modelos importantes de Tencent.

  7. Publicaciones consecutivas «AI image generation / #Nano Banana 2» — dfl.bsky.social, 2026-09-09, 21 me gusta/1 republicación; publicaciones similares casi diarias con 30 a 90 me gusta https://bsky.app/profile/dfl.bsky.social/post/3mv4cwoxxks22 — Cuenta que publica a diario imágenes de paisajes de estilo japonés y natural, generadas con «Nano Banana 2» de Google y acompañadas de etiquetas detalladas de prompts. Es un ejemplo de cómo un modelo cerrado se ha integrado en el uso diario de creadores individuales.

  8. «Just dropped a full guide to the ultimate ComfyUI AI video stack 🔥 LTX-2.3 (video + native audio) + SCAIL-2 (perfect motion cloning) + FLUX (insane image quality)» — generate-cmyxt.bsky.social, 2026-07-02 https://bsky.app/profile/generate-cmyxt.bsky.social/post/3mpo6tdclwk2i — Publicación promocional y tutorial de un flujo ComfyUI que combina herramientas abiertas de generación de vídeo e imagen. Código abierto.

  9. «🚀 Unlock Pro AI Design Workflows with Ideogram 4 Local Setup! Run the powerful open-weight text-to-image model locally via ComfyUI. No API costs, full privacy.» — generate-cmyxt.bsky.social, 2026-06-13, 3 me gusta https://bsky.app/profile/generate-cmyxt.bsky.social/post/3mo6i5cm26k2q — Presenta la posibilidad de ejecutar Ideogram 4 localmente como modelo de texto a imagen con pesos abiertos. Código abierto.

  10. «Turn 1 image into cinematic 360° consistent character — FREE in ComfyUI! Qwen Image Edit + Multiple Angles LoRA» — generate-cmyxt.bsky.social, 2026-02-27 https://bsky.app/profile/generate-cmyxt.bsky.social/post/3mfsmtbgzgs2n — Presentación de un flujo gratuito que combina Qwen Image Edit y LoRA. Código abierto.

Señales
  • El espacio de «noticias de IA de imágenes y vídeo» en Bluesky está dominado por bots agregadores más que por conversaciones individuales. Bots como testingcatalog.com y genainews.bsky.social republican varias veces al día artículos de otros medios, mientras que apenas se observaron debates favorables o críticos en hilos como los de Reddit.
  • Las cuentas oficiales de los desarrolladores de modelos permanecen casi en silencio en Bluesky. Black Forest Labs no tenía publicaciones; la última de Stability AI era del 19 de noviembre de 2025 y estaba centrada en audio; Midjourney oficial dejó de actualizarse en octubre de 2025; y el bot de checkpoints de Civitai parece detenido desde mayo de 2024. Bluesky casi no funciona como canal de información primaria para modelos abiertos de imagen o vídeo.
  • La conversación sobre código abierto la sostienen cuentas personales de tutoriales y promoción de flujos de trabajo, no los desarrolladores de modelos. Publicadores como generate-cmyxt.bsky.social presentan reiteradamente Flux, Wan, LTX, Qwen Image Edit, Ideogram 4 y DreamOmni2 como flujos ComfyUI. La información circula más como consejos prácticos o promoción que como noticias técnicas.
  • La conversación sobre código cerrado se centra en anuncios de grandes empresas y nuevos actores, como OpenAI con ChatGPT Images 2.5, Google con Nano Banana 2, Meta con Muse Video y Visko con Orbis. El sesgo también se aprecia en qué temas seleccionan los bots agregadores.
  • Los creadores individuales, encontrados en decenas de resultados de cuentas, se concentran en publicar arte IA y obras NSFW con Stable Diffusion, Qwen-Image, Ideogram 4 y Krea 2, más como comunidad de creación que como espacio de noticias. Existen cuentas contrarias a la IA, como artistsagainstai.bsky.social, pero no se encontraron publicaciones recientes activas.
Límites
  • La API oficial de búsqueda de texto completo de Bluesky, app.bsky.feed.searchPosts, devolvió HTTP 403 Forbidden de forma persistente para todas las consultas probadas, incluidas image generation AI, video generation AI, Stable Diffusion y términos de prueba no relacionados como cats. Por el contrario, app.bsky.actor.searchActors, app.bsky.feed.getAuthorFeed y app.bsky.feed.getPostThread funcionaron correctamente. Al no poder realizarse la búsqueda de texto completo recomendada por el playbook, la investigación quedó limitada a un enfoque indirecto basado en cuentas.
  • La página de resultados https://bsky.app/search?q=... es una SPA renderizada con JavaScript, por lo que la herramienta de fetch no pudo obtener su contenido.
  • El criterio de finalización pedía analizar unas 20 publicaciones. Debido a la limitación de búsqueda, solo fue posible verificar el contenido de las 10 publicaciones listadas y de publicaciones relacionadas en los feeds de las cuentas. Aunque se revisaron decenas de publicaciones incluyendo contenido no temático, solo unas 10 podían presentarse como directamente relacionadas, por debajo del objetivo.
  • Muchas cuentas principales del lado abierto y de herramientas —Black Forest Labs, Stability AI, Midjourney oficial y el bot de Civitai— habían detenido o reducido mucho sus publicaciones, por lo que casi no había información primaria reciente de septiembre de 2026 en Bluesky. No es una omisión de investigación, sino consecuencia de la baja actividad de la plataforma.
  • No se encontraron en Bluesky debates en formato de hilo que abordaran explícitamente «código cerrado frente a código abierto», como sí ocurre en X o Reddit.

Lemmy

Lemmy — Tendencias de IA de generación de imágenes y vídeo (cerrado/abierto)

Comunidades
  • !«メールアドレス» (5.708 suscriptores, creada el 09-06-2023) — Comunidad central para información sobre herramientas abiertas de generación de imagen y vídeo. En la práctica, es un feed de estilo bot que publica lanzamientos nuevos de HuggingFace y GitHub; solo entre el 02 y el 08 de septiembre de 2026 publicó más de diez nuevos modelos y extensiones de ComfyUI.
  • !«メールアドレス» (8.532 suscriptores) — Espacio para compartir imágenes generadas por IA sin limitarse a un modelo. Incluye publicaciones hechas con Nano Banana, Gemini 2.5 Flash Image.
  • !«メールアドレス» (50 suscriptores) — Especializada en imágenes abstractas de la familia Stable Diffusion. Tiene una escala pequeña.
  • !«メールアドレス» (8.176 suscriptores) — «Un lugar para personas que odian la IA». Se centra en el rechazo y la crítica de la IA generativa, y la IA de imágenes y vídeo suele ser uno de sus objetivos.
  • !«メールアドレス» — Comunidad sobre películas de DC. En esta ocasión apareció una publicación relacionada con el uso de IA.
  • !«メールアドレス» — Comunidad espejo que republica automáticamente contenido de /r/ArtificialInteligence y otros subreddits. Debe tenerse en cuenta que no es una conversación propia de Lemmy.
  • !«メールアドレス» — Centrada en LLM locales. Las publicaciones recientes tratan principalmente sobre modelos de lenguaje como Qwen3.8 y GLM-5.3, y casi no sobre modelos de imagen o vídeo.
Publicaciones
  1. Aumento del ecosistema ComfyUI en torno a MiniMax-H3 (código abierto) — !«メールアドレス», publicaciones concentradas entre el 02 y el 06 de septiembre de 2026.

    • OpenVDN/vdn-minimax-h3 (puntuación 3, 2026-09-05) — Aceleración mediante atención híbrida para MiniMax-H3.
    • Saganaki22/ComfyUI-VDN-H3 (puntuación 4, 2026-09-05)
    • DANNY621/H3-World (puntuación 3, 2026-09-02) — Presentado como el primer modelo de mundo interactivo basado en MiniMax-H3.
    • En el mismo periodo aparecieron más de seis publicaciones consecutivas sobre aceleración VAE y LoRA, como «motion_enhancer», «MotionCache-FastVAE» y «H3VAE_TRT». El ecosistema de herramientas alrededor del modelo de vídeo MiniMax-H3 parece estar creciendo rápidamente.
  2. Viggle/Viggle-Animate (código abierto) — !«メールアドレス», puntuación 10, 2026-09-05. https://huggingface.co/Viggle/Viggle-Animate — Método para sustituir un personaje de un vídeo partiendo de un único fotograma redibujado. Fue la publicación con mayor puntuación entre las recopiladas.

  3. Krea2-Turbo-Distill-4step-LoRA (código abierto) — !«メールアドレス», puntuación 2, 2026-09-08. https://huggingface.co/lvladikov/Krea2-Turbo-Distill-4step-LoRA — LoRA destilado que promete reducir a la mitad el número de pasos y acelerar aproximadamente 1,6 veces.

  4. LLaDA-Image: Building Strong Image Generators (código abierto/artículo) — !«メールアドレス», puntuación 3, 2026-09-04. https://arxiv.org/abs/2609.03796 — Marco unificado de generación de imágenes basado en un Diffusion Transformer de 6.000 millones de parámetros.

  5. La función Earth AI de Google «Nano Banana» fue retirada un día después del lanzamiento (código cerrado) — !«メールアドレス», republicación de Reddit, puntuación 1, 2026-08-07. https://lemmy.durstig.online/post/52162 — Google añadió a Google Earth una función para superponer imágenes compuestas con Gemini 2.5 Flash Image, Nano Banana. Al emplearse para crear imágenes falsas de centrales nucleares e instalaciones militares, la compañía suspendió la función al día siguiente. Un portavoz de Google afirmó que «la gente valora la fiabilidad de Google Earth».

  6. Midjourney exige a estudios de Hollywood que revelen su uso de IA generativa (código cerrado) — !«メールアドレス», puntuación 76(↑)/2(↓), 2026-07-05. https://lemmy.today/post/56011946 (artículo original: TechCrunch) — En un litigio de derechos de autor, Midjourney solicitó que los estudios demandantes revelaran sus propias prácticas de uso de IA. Los comentarios indican que también deberían revelarse los datos de entrenamiento y critican una posible doble vara de medir en la postura de Disney sobre derechos de autor.

  7. Se descubre que DC Studios utilizó arte conceptual generado por IA en la producción de «Supergirl» (más próximo al código cerrado) — !«メールアドレス», puntuación 33(↑)/1(↓), 2026-08-13, 27 días desde la publicación original. https://lemmy.today/post/58316222 — Un vídeo de producción publicado por error mostró un flujo de trabajo con imágenes generadas por IA, tras lo cual DC eliminó el vídeo. En comentarios se señaló que la interfaz se parece a la pantalla de generación de Midjourney.

  8. Generación de estilo anime con Qwen Image VAE (código abierto) — !«メールアドレス», 2026-09-09. https://lemmy.dbzer0.com/post/75237492 — Generada con BASBetterAnimeStyleAnimaBase, un LoRA de personaje y qwen_image_vae, a 35 pasos, CFG 7 y Euler a. No tuvo comentarios, pero muestra un caso de uso real de componentes de generación de imágenes de Qwen en creación individual.

  9. «¿Por qué dbzer0 está lleno de AI slop y defensores de la IA?» (voz anti-IA, contexto) — !«メールアドレス», 2026-09-02. https://futurology.today/post/11938893 — Reacción contra las comunidades de dbzer0, abundantes en publicaciones abiertas de generación de imágenes. Es un ejemplo de la persistente hostilidad hacia contenidos generados por IA en Lemmy.

  10. Publicaciones periódicas de lanzamientos de SDNext / la comunidad stable_diffusion (código abierto, referencia) — !«メールアドレス» ha seguido publicando notas de lanzamiento de SDNext desde la segunda mitad de 2025 hasta 2026, por ejemplo, puntuación 7 el 31-10-2025: https://lemmy.dbzer0.com/post/56684869 . No se encontró una publicación correspondiente en el periodo más reciente, pero se incluye como contexto sobre el carácter continuo de la comunidad.

Señales
  • En Lemmy, la conversación sobre este tema se concentra de hecho en !«メールアドレス». Sin embargo, gran parte del contenido no es discusión humana sino un feed automático de novedades de HuggingFace y GitHub, y suele recibir pocos comentarios, entre cero y unos pocos.
  • El principal tema abierto de la última semana, del 02 al 09 de septiembre de 2026, fue el modelo de vídeo MiniMax-H3, rodeado de publicaciones diarias de nodos ComfyUI, LoRA y herramientas de aceleración VAE. Destaca más la rápida expansión del ecosistema alrededor de un modelo existente que el lanzamiento de un nuevo modelo aislado.
  • Los temas cerrados que llegan a Lemmy no son novedades de producto, sino polémicas, demandas y cuestiones éticas: abuso de Earth AI de Nano Banana, litigio de Midjourney y uso oculto de IA en DC Studios. No se encontraron noticias individuales de los principales servicios cerrados de vídeo e imagen, como Sora, Kling AI, Runway Gen, Ideogram o Veo 3.
  • Lemmy mantiene una atmósfera hostil hacia el contenido generado por IA, con comunidades como !fuck_ai y uso frecuente de la expresión despectiva «AI slop», independientemente de que los modelos sean abiertos o cerrados.
Límites
  • La API de búsqueda de Lemmy (/api/v3/search) tuvo baja relevancia: palabras generales como «image generation AI» devolvían sobre todo noticias políticas y tecnológicas no relacionadas. Se filtró ese ruido para aislar las publicaciones relevantes.
  • Se buscaron individualmente los principales servicios cerrados —Sora, Kling AI, Runway Gen, Ideogram, Veo 3 y Grok Imagine—, pero no se encontraron publicaciones relacionadas. Parece que estos temas apenas circulan en Lemmy.
  • !«メールアドレス» es una republicación automática de Reddit, no una discusión propia de Lemmy, por lo que se mantiene como referencia y se excluye en general de los principales hallazgos.
  • El volumen de publicaciones sobre este tema en Lemmy es pequeño y la mayoría de puntuaciones están entre un dígito y unas decenas. Aunque el criterio del brief pedía unas 20 publicaciones analizadas, las diez aquí presentadas son aproximadamente el máximo de publicaciones con relación directa; ampliar la muestra habría añadido ruido irrelevante, como política o debates generales sobre IA. Lemmy tiene una base pequeña para este tema.

Pinterest

Pinterest — Noticias de IA de generación de imágenes y vídeo

Temas visuales
  • Plantilla de «YouTuber con cara de sorpresa + panel de logos»: sobre un fondo oscuro de neón azul y violeta, se distribuyen logos de OpenAI, Google, Microsoft, Meta, DeepSeek, Nvidia, Notion, Grok y otros en una composición circular, con el rostro sorprendido de un hombre barbudo a la derecha. Este formato se repite en miniaturas de «AI NEWS» y parece ser una reutilización directa de miniaturas de YouTube en Pinterest. [4, 19, 29, 44]
  • Rostros de humanoides y robots que antropomorfizan la IA: androides blancos de rostro liso, «presentadores de noticias robot» con traje, cerebros de circuitos visibles y caras humanas construidas con código verde tipo Matrix son recursos visuales frecuentes en artículos de noticias del sector. [2, 23, 27, 34, 40, 46, 50]
  • Demostraciones de antes/después y transformaciones: cuadrículas paralelas que convierten una imagen real en madera, origami, bloques de Lego o flores; demostraciones de VASA-1 que producen vídeos expresivos desde audio y una foto de rostro; composiciones «AI Baby» de mujer, niño y hombre; y la imagen «history generative AI», dividida entre una multitud en blanco y negro y una lente que expulsa imágenes digitales. El patrón «imagen real → generación IA» es muy visible. [6, 13, 18, 47]
  • Infografías verticales de ranking: tablas comparativas verticales con logos de herramientas, listas de verificación y distintivos de «gratis». Incluyen Runway, Pika, Kling AI, Luma AI (Dream Machine), Canva AI, Hailuo AI, Synthesia, D-ID, Veed.io, Pictory, InVideo, Lumen5 y Hyperwrite, entre herramientas cerradas y abiertas. [10, 26]
  • Gráficos de preocupación por deepfakes y verificación: sellos rojos «FAKE», distintivos «AI VOICE DETECTORS» y «97% likely AI generated», lupas, signos de interrogación y siluetas sospechosas encapuchadas forman un tema independiente que expresa desconfianza y deseo de comprobación. [2, 39]
  • Eventos de anuncios empresariales y avances de producto: teaser de Veo 2 de Google con un perro nadando, flamencos y una joven estilo anime; ponentes ante una imagen de Lumiere; carteles que explican Gemini API; y fotos de Jensen Huang, CEO de Nvidia. [3, 9, 16, 44, 50]
  • Muy pocas ilustraciones técnicas: solo una imagen entre 50 muestra la arquitectura interna de un modelo de difusión, con Frozen T5 XXL, IF-I-M 400M y escalado Stable Diffusion 4x. Incluso esa imagen usa un título promocional sobre una próxima herramienta secreta de generación de imágenes de OpenAI, no una explicación técnica. [37]
Pines destacados
  • #9 “Google Unveils Veo 2...” — La propia imagen teaser oficial de Veo 2 de Google, con perro nadando, flamencos y una joven de estilo anime. #3, sin título, utiliza la misma imagen; que el mismo material aparezca varias veces sugiere reutilización de contenidos o cuentas de publicación masiva.
  • #47 “Microsoft Unveils VASA-1...” — Cuadrícula de demostración que genera un vídeo conversacional expresivo a partir de una imagen fija, un clip de voz y, opcionalmente, señales de control. Es el ejemplo visual más claro de la tecnología de generación de cabezas parlantes.
  • #13, sin título — Cuadrícula 3×3 que transforma vídeo real en «bloques de madera», «origami», «Lego» y «flores», con marca de agua tipo Lumen. Representa la presentación viral típica de transformación de estilo de vídeo.
  • #32 “Breaking News Latest AI Developments...” — Infografía fechada el 12 de agosto de 2026. Resume Grok 4.6, capaz de trabajar autónomamente durante decenas de pasos y devolver resultados; Gemini, que habría alcanzado 1.000 millones de usuarios a la mayor velocidad de la historia y generaría 150 millones de imágenes diarias; y el teléfono robot de Honor con cámara y cardán incorporado.
  • #22, sin título; en la práctica «Today's AI News» — Fechado el 20 de mayo de 2026. Infografía sobre una gran renovación de búsqueda en Google I/O 2026, con Gemini 3.5 Flash, Gemini Omni y Gemini Spark; mejoras de accesibilidad de IA de Apple; e intensificación de la competencia por gafas inteligentes de IA.
  • #26 “5+ Best AI Video Generation Websites” — Compara Runway, Pika, Kling AI, Luma AI, Canva AI y Hailuo AI, e indica al final que son ideales para pines de vídeo de Pinterest, YouTube Shorts y TikTok. Es una recomendación de herramientas autoconsciente, que considera Pinterest como destino de publicación.
  • #10 “Best 10 AI FREE Video Generation Tools 2026” — Selección de diez herramientas: Pictory, RunwayML, Veed.io, Synthesia, InVideo, Kling AI, D-ID, Lumen5, Canva AI y Hyperwrite AI. Incluye el típico mensaje afiliado de «sígueme y da me gusta para más detalles».
  • #2, sin título, «AI content and social media concerns» — Combina una foto viral de un gato con un sello rojo «FAKE», 1,2K de me gusta/7,4K de visualizaciones, una figura sospechosa encapuchada y signos de interrogación. Se centra en la desconfianza hacia contenidos generados por IA.
  • #39 “AI is Changing Everything!” — Infografía de sensibilización que reúne generación de vídeo IA, detección de voz IA con distintivo de 97 %, y ética de IA e ingeniería de prompts. Advierte que «ver ya no equivale a creer».
  • #6 “7 Best AI Baby Generators...” — Presenta herramientas virales de uso personal para predecir el rostro de un niño a partir de un rostro femenino y uno masculino. Es representativo de usos de entretenimiento para consumidores más que de noticias del sector.
Señales
  • Las «noticias de IA» visibles en Pinterest son casi totalmente contenidos secundarios: miniaturas de vídeos de YouTube e infografías de blogs recopilatorios, no información primaria. Destacan la reutilización de la misma imagen —#3 y #9— y los llamados de afiliación como «LIKE & FOLLOW». Su naturaleza es muy distinta de las conversaciones directas de Reddit o X.
  • En el lado cerrado, los anuncios de Google —Veo 2, Lumiere, Gemini 3.5/Omni/Spark y los 1.000 millones de usuarios de Gemini— y Microsoft —VASA-1— reciben una cobertura visual muy superior. OpenAI y Anthropic aparecen con frecuencia sobre todo como logos en paneles, pero Pinterest muestra pocos teasers de producto individuales de OpenAI comparado con Google.
  • Las publicaciones de listas comparativas y rankings de herramientas —como #10 y #26— son el contenido nativo más típico de Pinterest y reflejan interés práctico por herramientas cerradas accesibles o de bajo coste: Runway, Pika, Kling AI, Luma, Canva, Synthesia, D-ID, Veed.io y Hailuo.
  • La desconfianza en deepfakes y la detección, como en #2 y #39, constituyen un tema independiente. La ansiedad por no poder distinguir lo real convive con una intensidad similar a la de las recomendaciones de herramientas para creadores.
  • Los usos de entretenimiento para consumidores —«AI Baby», que predice el rostro de un hijo, y filtros que convierten vídeo real en madera, flores u bloques de Lego— se mezclan con anuncios de productos del sector dentro de los mismos resultados de búsqueda. La frontera entre publicaciones informativas y entretenimiento es difusa.
  • El ecosistema abierto tiene una presencia extremadamente débil: nombres como Stable Diffusion, Flux, Qwen, Wan, Kling, de la vertiente china abierta, y DeepSeek solo aparecen en una ilustración técnica de difusión, #37, además con título promocional, y como una entrada en rankings de herramientas. No se encontraron pines que transmitieran debates comunitarios o evolución específica de modelos.
  • Existen infografías con fechas concretas, como el 12 de agosto de 2026 en #32 y el 20 de mayo de 2026 en #22, por lo que el conjunto de imágenes recopilado contiene material reciente.
Límites
  • De acuerdo con las instrucciones de platforms/pinterest.md, no se navegó Pinterest directamente. El análisis se limitó a output/pinterest.pins.md, con 50 elementos recopilados previamente por workers, y a images/pinterest/manifest.json.
  • De los 50 pines, se abrieron y revisaron visualmente 23: #1, 2, 3, 4, 6, 9, 10, 13, 16, 18, 19, 21, 22, 23, 25, 26, 27, 29, 32, 34, 37, 39, 40, 44, 46, 47 y 50. Esto cubre el criterio de brief.md de aproximadamente 20 elementos. Los 27 restantes se evaluaron solo por título.
  • Seis pines no tenían título y aparecían como «(untitled)»; su contenido se infirió de las imágenes cuando se pudieron revisar. De #3, #11, #14, #15, #22 y #31, solo se verificaron visualmente #3 y #22; #11, #14, #15 y #31 quedaron sin verificar.
  • Los pines no incluyen métricas de interacción como me gusta, guardados ni comentarios, por lo que no se pudo comparar cuantitativamente qué publicaciones crecían más, a diferencia de Reddit o X.
  • El texto de las imágenes estaba casi por completo en inglés. No se encontraron pines en japonés u otros idiomas dentro de las 50 piezas recopiladas.

Acciones recomendadas

  • Seguir la adopción de Veo 3.1, Kling 3.0, Seedance 2.0 y la familia Wan como alternativas tras el cierre de la API de Sora el 24 de septiembre.
  • Vigilar continuamente el riesgo de cambios de estrategia en otros laboratorios de pesos abiertos, tomando como precedente el giro «abierto → cerrado» de Wan 3.0.
  • Observar de forma continuada las herramientas ComfyUI alrededor de MiniMax-H3 en Lemmy y HuggingFace para detectar pronto señales del próximo gran modelo abierto de vídeo.
  • Reinvestigar X reemplazando términos dependientes de tendencias regionales por términos específicos de IA de imágenes y vídeo, como Stable Diffusion, Sora y Nano Banana.
  • Seguir el estado de moderación de contenido dañino generado por IA en plataformas como Meta como indicador adelantado de riesgos regulatorios y reputacionales.
  • Vigilar de forma continua las ampliaciones de funciones de consumo cerradas de Nano Banana y Gemini Image como indicador de las respuestas competitivas de otras empresas.

Imágenes recopiladas

🎨 Creación de imágenes y vídeo con IAContenido de IA y preocupaciones sobre redes socialesimagenNoticias de IA: una filtración de Anthropic nos muestra el futuro de la IA...Concepto de creación de contenido de IA con iconos para generación de texto, imagen, música y vídeo — Explora 57 fotos de archivo, vectores y vídeosLos 7 mejores generadores AI Baby: predice el rostro de tu hijo (2026)Hazlo perfecto 🎥IA para generación de imágenes y vídeoGoogle presenta Veo 2: herramienta avanzada de generación de vídeo IA con mayor realismo y funciones cinematográficas🎬 10 HERRAMIENTAS GRATUITAS DE VÍDEO IA EN 2026 🤯 Crea vídeos sin software caroimagenEl arma secreta de los creadores de contenido: generación de vídeo impulsada por IAGoogle anuncia vídeo de calidad ultraalta...imagenimagenVeo 3 de imagen a vídeo: generación rápida y audio nativo mediante Gemini APIVídeos generados por IA: ¿buenos o malos? Aquí está la verdad 🤖🎥Adobe desarrolla un modelo de IA para escalar vídeos y convertir grabaciones borrosas en calidad HDNoticias de IA: OpenAI por fin lanzó lo que pedíamosLos mejores generadores de vídeo IA de 2025Los 10 mejores herramientas de sincronización labial (2026) — Mejor software de IA para vídeos con sincronización labial realistaimagenMás del 20 % de YouTube ahora se genera con IACreación de vídeo con IA: 10 formas inteligentes de crear vídeos atractivos más rápidoQué es Imagvio AI y cómo ayuda a los creadores...Más de 5 mejores sitios web de generación de vídeo IA en 2026 | Runway, Pika, Kling AI, Canva y másOpenAI lanza el generador de vídeo IA Sora — aquí está...TotalYmage revoluciona los vídeos interactivos...Noticias de IA: ahora todos están enfadados con Anthropic |Cómo la IA está transformando la edición de vídeoimagenÚltimas novedades de IA — Grok 4.6, Gemini 1B, Honor Robot PhoneHerramientas de IA para edición de vídeo — Lo que los creadores usan realmente para crear contenido en 2026Análisis de imágenes y vídeo impulsado por IADominar el vídeo y la IA: tendencias clave de marketing en redes sociales para 2025La creación de vídeo con IA acaba de volverse una locura.La herramienta secreta de generación de imágenes de OpenAI debutará prontoHaré un vídeo explicativo de creación con IA con Synthesia, Sora AI, Kling AI, Runway AI e InVideo‎🚨 La IA está volviéndose aterradoramente buena.Descubre cómo Grok está revolucionando el vídeo...Transforma tus ideas en visuales impresionantes 🎥Creación de vídeo con IA: guía completa para crear vídeos profesionales más rápido con IAHistoria de la IA generativaNuevas herramientas de IA de Nvidia 🤯 #news #ai #openai #chatgpt #highlights #shortsFuturo de la creación de vídeo: mejores generadores de vídeo IA de 2026🔸Imágenes de actualidad con mapas nacionales y mundialesMicrosoft presenta VASA-1 y establece nuevos estándares para IA generativa en generación de vídeo"Transforma tu visión con vídeos 4K personalizados impulsados por IA 🎥✨"Creación profesional de vídeo IA | Vídeos IA cinematográficos | Edición de vídeo personalizadaLUMIERE de Google, el mejor generador de texto a vídeo

Nota sobre la calidad de los datos

De las 40 publicaciones recopiladas en X, solo dos estaban relacionadas con el tema; los términos de búsqueda dependían de tendencias regionales, por lo que prácticamente no se obtuvieron datos útiles. Bluesky y Reddit tampoco alcanzaron el objetivo de unas 20 publicaciones debido a problemas con la API oficial de búsqueda y a la limitación de una única consulta, respectivamente. En YouTube y Pinterest, la estructura de las páginas impidió obtener métricas de interacción como visualizaciones y me gusta.

Galería