Noticias de IA de generación de imágenes y vídeo — 2026-09-30
OpenAI cerró por completo la aplicación y la API de Sora, mientras que modelos chinos de código abierto/pesos abiertos como Qwen-Image-2.1 y Z-Image de Alibaba, y HunyuanVideo 1.5 de Tencent, están surgiendo simultáneamente en Lemmy, Bluesky, Reddit y YouTube.
Últimas noticias de IA para generación de imágenes y vídeo — 2026-09-30
Para decirlo sin rodeos, lo más candente ahora mismo son dos cosas: «la desaparición de Sora» y «el festival chino del código abierto» 🔥. En el lado cerrado, la gran noticia es que OpenAI finalizó por completo la aplicación y la API de Sora el 2026-09-24; da la sensación de que Nano Banana Pro de Google (Gemini 3 Pro Image) aspira al trono de la generación de imágenes. En el lado abierto, Qwen-Image-2.1 y Z-Image de Alibaba, junto con HunyuanVideo 1.5 de Tencent, están haciéndose virales a la vez en Reddit, Lemmy, Bluesky y YouTube: los actores chinos están dominando claramente 🐉. Eso sí, también se repite por todas partes la observación de que Qwen-Image-2.1 tiene «pesos abiertos, pero una licencia que no permite el uso comercial», así que viene acompañado del debate sobre si realmente debería llamarse «código abierto». En general, dio la impresión de que crecían más las polémicas del tipo «se descubrió que una imagen o vídeo fue creado con IA / se usó de forma indebida» que las noticias técnicas en sí.
Entre plataformas
- El trío chino de código abierto (Qwen-Image-2.1 / Z-Image / HunyuanVideo 1.5) se observó de forma independiente en cuatro plataformas. En !stable_diffusion de Lemmy se publicaron muchísimas integraciones con ComfyUI (LanPaint, fooocus-qwen-image-2.1, etc.); en Bluesky aparecieron los primeros informes de cuentas individuales; el hilo «Vlo 0.3» de r/StableDiffusion integra flujos de trabajo de Qwen2.1; y varios canales de YouTube publicaron vídeos de reseñas. Sin duda, es la tendencia común más candente ahora mismo 🔥
- El problema de «pesos abiertos, pero no verdadero código abierto» se señala al mismo tiempo en YouTube y Lemmy. Desde YouTube se afirma claramente que Qwen-Image-2.1 tiene licencia de investigación y prohíbe la redistribución comercial, mientras que en Lemmy también aparecen conversaciones ocasionales sobre la licencia.
- Las repercusiones del cierre de Sora llegaron a Reddit, no solo a YouTube. En r/SoraAi prosperan las especulaciones como «¿será la antesala de Sora 3?» o «al parecer la persona que lo creó ya se fue», en el hilo 7 con 55 puntos; el ambiente es parecido a la oleada de vídeos de YouTube que presentan herramientas alternativas.
- Los temas sobre que los contenidos de IA «se descubren / se usan indebidamente» surgieron de manera independiente en Reddit, Lemmy y Pinterest. La polémica por la manipulación con IA en un concurso fotográfico de Nikon (Reddit r/labrats, 1.113 puntos), Google Earth AI retirado en 24 horas tras generar imágenes falsas de masacres (Lemmy), y NBC News mostrando la etiqueta «AI GENERATED» en imágenes de un presentador meteorológico (Pinterest): aunque los géneros son distintos, todas las redes transmitían la sensación de que «es demasiado realista y eso lo vuelve peligroso».
- Las cuentas oficiales de empresas apenas funcionan como fuentes de noticias. En Bluesky, Black Forest Labs y Kling AI Video no tienen publicaciones, y RunwayML solo tiene una en dos años. En todas las plataformas, las cuentas técnicas individuales y las comunidades especializadas (como !stable_diffusion en Lemmy o subreddits especializados) resultaron más rápidas y detalladas para las noticias.
Plataforma por plataforma
Reddit — Como solo se usó una frase fija de búsqueda, se recogieron apenas 11 hilos (aproximadamente la mitad del objetivo de 20), y los subreddits especializados como r/StableDiffusion y r/SoraAi solo aportaron uno cada uno. Aun así, el hilo de r/singularity con 1.554 puntos, «Video models are getting good», reunía comentarios atónitos ante vídeos demasiado realistas y reflejaba bien el rápido aumento de calidad del vídeo cerrado 📈. En el lado abierto, destacó la conversación de usuarios que ejecutan ComfyUI localmente: «gratis, salvo el coste de la electricidad».
X — Un fracaso total 😅. De las 40 publicaciones recogidas, prácticamente ninguna trataba la generación de imágenes o vídeo con IA. Las consultas se tomaron tal cual de X Explore —tendencias de Croacia sobre fútbol Italia contra Turquía o Big Brother— y no tenían nada que ver con la IA de generación de imágenes o vídeo. La única publicación encontrada mediante «Anthropic» trataba sobre cotización bursátil y la herramienta Skills, no sobre generación de imágenes/vídeo. No es una limitación de X como plataforma, sino un desajuste del método de recolección de esta ocasión, basado en términos procedentes de Explore.
YouTube — Fue la plataforma con mayor densidad de información 🎬. Permitió seguir bien la cronología del cierre de Sora (retirada de la aplicación el 26 de abril, fin de la API el 24 de septiembre y la teoría de que se debió a costes operativos de unos 1.500 millones de yenes al día), y varios canales confirmaron el dominio de Nano Banana Pro. También aparecieron reseñas inmediatas de Qwen-Image-2.1, Z-Image Turbo/Base y HunyuanVideo 1.5, haciendo de YouTube la plataforma donde más claramente se percibió, en cifras, el impulso de los actores chinos. Sin embargo, las páginas de resultados de búsqueda de YouTube se renderizan con JavaScript y no pudieron leerse; las cifras de visualizaciones dependieron de fuentes secundarias.
Bluesky — La API de búsqueda de publicaciones estaba bloqueada con un 403, por lo que hubo que revisar cuentas individualmente a la fuerza 💪. Aun así, se localizaron el primer informe individual sobre Qwen-Image-2.1 (81 me gusta, la mayor reacción entre lo revisado), además de publicaciones de pruebas de SkyReels V1 y HunyuanVideo I2V. El descubrimiento inverso fue que las cuentas oficiales de Black Forest Labs y Kling AI Video no tienen publicaciones, por lo que casi no funcionan como canales corporativos de noticias. También hay muchos ilustradores que declaran «NO AI», lo que deja la impresión de ser una plataforma con sentimientos anti-IA relativamente fuertes.
Lemmy — Fue con diferencia el número uno en información de código abierto 🏆. Solo !«メールアドレス» tuvo más de 20 publicaciones de herramientas y modelos en las dos semanas recientes, y la oleada de integraciones de Qwen-Image-2.1 con ComfyUI se veía en tiempo real. En cambio, las herramientas cerradas aparecían únicamente como republicaciones de noticias o en contextos con carga de sucesos, como «suicidio tras abusar de Grok», y el tono general de Lemmy era bastante escéptico con la IA, con críticas fuertes al «AI slop».
Pinterest — Era un nido de contenido comparativo de SaaS de código cerrado 🖼️. Había muchísimas infografías de «cuál deberías elegir» que alineaban Runway, Pika, Kling, Luma, Canva y Hailuo; también se pudieron encontrar anuncios de modelos concretos como Veo 3, Gemini Omni y el chino ShengShu Vidu S1. En código abierto, apenas aparecía AMD Amuse 3.0; casi no había rastro de comunidades técnicas como ComfyUI o LoRA, un sesgo comprensible considerando el público generalista de Pinterest.
Qué vigilar
- El próximo modelo de vídeo de OpenAI (al parecer con el nombre en clave «Spud»): merece especial atención como sucesor tras el cierre de Sora. YouTube «OpenAI Shuts Down Sora & Kills ChatGPT Integration Plans» https://www.youtube.com/watch?v=9rhmczPT6Jk
- El problema de licencia de Qwen-Image-2.1: cómo evolucionará el hecho de tener pesos abiertos, pero no permitir uso comercial. Lemmy «Qwen-Image-2.1 in ComfyUI» https://lemmy.dbzer0.com/post/75874773
- El dominio de Nano Banana Pro / Gemini 3 Pro Image: un candidato principal para la generación de imágenes, aunque arrastre incidentes como la retirada de Google Earth AI. YouTube «Google Nano Banana Pro: The BEST Image Model!» https://www.youtube.com/watch?v=GEtiY-0fzO0
- La disputa por el «número uno del vídeo de código abierto» entre HunyuanVideo 1.5 y Wan 2.7: el frente de modelos de vídeo que funcionan con GPU de consumo. YouTube «We have a new #1 open-source AI video generator!» https://www.youtube.com/watch?v=6EQP8-D37bs
- La tendencia hacia la obligación de etiquetar los contenidos generados por IA: la etiqueta «AI GENERATED» de NBC News y el acuerdo de derechos de autor entre ByteDance y Hollywood podrían ser pruebas de fuego para la regulación futura. Confirmado a través de la miniatura en Pinterest del artículo «ByteDance and Hollywood reach global deal on AI copyright».
- El bot de notificaciones de checkpoints de Civitai lleva detenido desde 2024: queda por ver a dónde migró desde Bluesky la infraestructura de la comunidad de código abierto. Bluesky «@civitai-bot.bsky.social» https://bsky.app/profile/civitai-bot.bsky.social/post/3ks2nnatkqi24
Recomendaciones
- La próxima vez, conviene cambiar Reddit y X a búsquedas directas por nombres propios como «Qwen-Image», «Sora», «Nano Banana» y «HunyuanVideo», para reducir el ruido procedente de tendencias.
- La recolección en X debe dejar de depender de las tendencias de X Explore y usar una lista preparada de términos relacionados con la IA de generación de imágenes/vídeo.
- Hay que vigilar continuamente el problema 403 de la API searchPosts de Bluesky, para poder pasar a una búsqueda exhaustiva por palabras clave en cuanto se resuelva.
- Conviene establecer la evolución de la licencia de Qwen-Image-2.1 —si permite uso comercial— como un punto fijo de verificación para el próximo seguimiento.
- Hay que mantener !stable_diffusion de Lemmy como punto de observación habitual, pues ofrece la mayor rapidez para las novedades de código abierto.
- Los nombres de modelos nuevos que aparezcan en las «infografías comparativas de herramientas» de Pinterest —como ShengShu Vidu S1 en esta ocasión— deben recogerse para verificarlos en otras plataformas.
Calidad de los datos
X fue prácticamente un fracaso en esta ocasión porque las consultas dependían de tendencias de X Explore —fútbol y entretenimiento—; no es una limitación de la plataforma en sí, sino un desajuste del método de recolección. Reddit se quedó en 11 publicaciones frente al criterio de finalización de 20, y como se utilizó una única frase fija de búsqueda, apenas se recogió una publicación de cada subreddit especializado —r/StableDiffusion y r/SoraAi—, con un sesgo hacia los hilos de controversia social. Bluesky no pudo realizar búsquedas exhaustivas porque la API searchPosts estaba bloqueada con un 403; el método alternativo consistió en comprobar mediante API, una por una, URL encontradas a través de Google, y el número de publicaciones recogidas tampoco alcanzó el criterio de finalización. En YouTube, las páginas de resultados y de vídeos individuales se renderizan mediante JavaScript, por lo que gran parte de las visualizaciones y fechas dependieron de información secundaria, como Social Blade. Lemmy y Pinterest permitieron recoger información con relativa estabilidad, pero Lemmy tenía poca profundidad en el lado cerrado y Pinterest en el lado abierto: sesgos opuestos entre sí.
Resumen por plataforma
Reddit — Noticias de IA de generación de imágenes y vídeo
Dónde
El agente buscó exclusivamente la consulta "Image and Video Generation AI News" y recopiló un total de 11 hilos de 10 subreddits. Las comunidades especializadas en generación de imágenes/vídeo con IA —r/StableDiffusion y r/SoraAi— solo obtuvieron un resultado cada una, mientras que el resto provino en gran medida de temas periféricos como K-pop, ciencia, cine y religión.
| Subreddit | Miembros | Hilos recopilados |
|---|---|---|
| r/kpop | 3.893.257 | 1 |
| r/generativeAI | 158.551 | 2 |
| r/labrats | 727.204 | 1 |
| r/GenAI4all | 48.939 | 1 |
| r/Earth199999 | 54.744 | 1 |
| r/SoraAi | 91.381 | 1 |
| r/StableDiffusion | 1.026.986 | 1 |
| r/singularity | 3.998.454 | 1 |
| r/perchance | 31.545 | 1 |
| r/Catholicism | 370.445 | 1 |
Incluso combinando r/generativeAI —comunidad de consultas prácticas sobre generación de imágenes/vídeo— con r/SoraAi y r/StableDiffusion —las comunidades especializadas de código cerrado y código abierto respectivamente—, solo representan 4 de los 11 hilos recogidos. Los 7 restantes se inclinan hacia controversias éticas y sociales en torno a contenidos generados por IA: deepfakes de K-pop, fraude en imágenes científicas, memes de Thanos y uso de imágenes de IA en misa.
Qué dice la gente
- Código abierto: Hilo 8 «Vlo 0.3» (r/StableDiffusion, 980 puntos, 71 comentarios, 2026-09-28) https://www.reddit.com/r/StableDiffusion/comments/1wsmat4/ — Herramienta de edición/generación de vídeo con IA de código abierto que se integra con ComfyUI. Incluye flujos de trabajo de Minimax H3, Qwen2.1, Krea2 y LTX2.5. El comentario destacado de u/Amazing_Upstairs (16 puntos) pide «FastH3 support please», mientras que u/DeepHomage (10 puntos) informa de un problema de instalación: «your update.bat file was detected as a malicious script by BitDefender».
- Código abierto / conocimiento práctico: Hilo 3 «How are people making long AI generated videos?» (r/generativeAI, 11 puntos, 53 comentarios, 2026-09-23) https://www.reddit.com/r/generativeAI/comments/1wog53q/ — u/kaboom-o (3 puntos) explica el flujo de trabajo actual de combinar modelos: «Nobody is generating a long video in one shot... Seedance 2.5 (up to ~30s, native audio)... Grok Imagine Video at 480p, 5s... Gemini Omni Flash». u/WritingPrestigious78 (2 puntos) subraya la ventaja de coste de ejecutar ComfyUI localmente: «With my 5090, comfyui, minimax h3, no api costs all free just the electricity cost😄».
- Código cerrado: Hilo 7 «A new video model being announced?» (r/SoraAi, 55 puntos, 46 comentarios, 2026-09-28) https://www.reddit.com/r/SoraAi/comments/1wsozf3/ — Una publicación de OpenAI despierta expectativas sobre un modelo sucesor de Sora. u/aigooner34 (6 puntos) también menciona la teoría de fuga de talento: «Maybe they just took a step back while they finalized Sora 3, but... the main person that made Sora 2 possibly already left open ai». u/Early-Attitude4046 (10 puntos) expresa disposición a seguir pagando: «Even if Sora is now a paid subscription I would pay to use it».
- Código cerrado / percepción de calidad: Hilo 9 «Video models are getting good» (r/singularity, 1.554 puntos, 168 comentarios, 2026-09-26) https://www.reddit.com/r/singularity/comments/1wqbytd/ — En este hilo de alta puntuación, u/ichii3d (98 puntos) expresa asombro técnico: «Just replacing the people and relighting? I find it hard to believe AI video could be so good», y u/CHG__ (35 puntos) señala: «The lip syncing is very impressive, first time I've seen that personally». Incluso los indicios para detectar falsificaciones empiezan a fallar ante la precisión de la representación por IA (u/Rust2: «I know it's AI because Elizabeth Holmes looks too human here», 446 puntos).
- Elección de herramientas gratuitas para generar imágenes: Hilo 2 «Best AI image generator?» (r/generativeAI, 3 puntos, 44 comentarios, 2026-09-26) https://www.reddit.com/r/generativeAI/comments/1wqfleb/ — Para usuarios que buscan opciones gratis, u/Scuzzy_Womack (3 puntos) recomienda «Comfy ui not connected to the Internet and free». También se mencionan Yodayo/MoescapeAI y Leonardo como herramientas con créditos diarios gratuitos, mostrando la coexistencia de niveles gratuitos de SaaS cerrados y ejecución local de código abierto.
- Reacción negativa sobre la fiabilidad, en el ámbito científico: Hilo 4 «Nikon Image Competition» (r/labrats, 1.113 puntos, 133 comentarios, 2026-09-23) https://www.reddit.com/r/labrats/comments/1wo0j5e/ — Un vídeo microscópico mejorado con IA ganó el primer puesto en Nikon Small World in Motion y generó polémica. El comentario con más puntos de u/Barkinsons (631 puntos) afirma: «AI tools have no place in scientific microscopy images because we have the obligation to reproduce our images as truthfully as possible». u/holydiver18 (55 puntos) critica duramente la explicación del autor: «Author's explanation is pissing on all of our legs and telling us it's raining».
- Movimiento regulatorio contra los deepfakes: Hilo 1 «SM Entertainment Announces Strict Legal Action» (r/kpop, 723 puntos, 52 comentarios, 2026-09-28) https://www.reddit.com/r/kpop/comments/1wsdr6d/ — La agencia anuncia acciones legales contra imágenes maliciosas generadas con IA. u/themichaelfalk (138 puntos) comenta: «a Korean article explicitly mentions rumors about AI-generated images showing her as pregnant». El endurecimiento de la respuesta de las agencias de entretenimiento recibe buena acogida en Reddit (u/llamacana: «glad sm is taking action», 166 puntos).
- Rechazo cultural, en el ámbito religioso: Hilo 11 «AI Generated Images at Mass» (r/Catholicism, 48 puntos, 89 comentarios, 2026-09-28) https://www.reddit.com/r/Catholicism/comments/1wskb30/ — Rechazo a que una diócesis muestre imágenes generadas por IA en una pantalla LED durante la misa. u/JacquesdeVee (47 puntos) dice: «Looking at those pictures while listening to the readings is creating false images in us instead of God speaking to us through His Word». El propio creador, que publicó el hilo, revela que ofreció arte creado por humanos gratuitamente, pero fue rechazado.
- Contenido generado convertido en meme: Hilo 6 «I hate AI-Generated images of Thanos» (r/Earth199999, 829 puntos, 44 comentarios, 2026-09-25) https://www.reddit.com/r/Earth199999/comments/1wqaxgh/ — El autor sitúa el impacto ambiental de la IA generativa —el uso de agua— como eje de su crítica: «It feels so insensitive... to waste more water on this dude», logrando gran apoyo con 829 puntos.
- Decepción con la generación de vídeo y diferencias de expectativas: Hilo 10 «AI Video Generator» (r/perchance, 0 puntos, 13 comentarios, 2026-09-23) https://www.reddit.com/r/perchance/comments/1woin1z/ — u/SSFx93 (7 puntos) adopta una visión fría: «Good realistic (high quality), no limit, and free do not come together. Especially with video ai generation». En contraste, en el hilo 5 «Just a reminder, these were the AI videos going viral in 2024» (r/GenAI4all, 199 puntos, 67 comentarios, 2026-09-24) https://www.reddit.com/r/GenAI4all/comments/1wou5vb/ , u/MinosAristos afirma: «That video is absolute cinema. Using the 'weaknesses' of synthetic media as a strength».
Señales
- En auge: La llegada de modelos de generación de vídeo cerrados a un nivel «indistinguible de imagen real» (hilo 9, r/singularity, 1.554 puntos), junto con una mezcla de asombro y cautela. Las expectativas sobre un sucesor de Sora (hilo 7) también siguen siendo tema de conversación.
- En auge, lado de código abierto: La acumulación de conocimiento práctico sobre operación local y de bajo coste centrada en ComfyUI (hilos 3 y 8). Como refleja la frase «no api costs all free just the electricity cost», la ventaja comparativa de costes recibe apoyo.
- Desestimado o rechazado: El rechazo a la «utilización sin permiso / presentación engañosa» de contenidos generados por IA se manifiesta en múltiples ámbitos: imágenes científicas (hilo 4), rituales religiosos (hilo 11), imagen de celebridades (hilo 1) y críticas en formato meme (hilo 6, por el agua). Se aprecia una relación inversa: cuanto mayor es el realismo, mayor es también el rechazo por fiabilidad y ética, independientemente del género.
- Lo inesperado: La consulta atrajo más hilos sobre contextos de aplicación y abuso que sobre la tecnología generativa en sí: deepfakes de K-pop, fraude de Nikon, imágenes de IA en misa y memes de Thanos. Esto sugiere que el tema «noticias de IA de generación de imágenes/vídeo» se discute con mayor peso en el contexto de fricciones sociales que en el de presentación de herramientas.
- Conflicto de opiniones: Los hilos 9 y 5 tratan la mejora de calidad del vídeo de IA, pero el hilo 9 reacciona con asombro cauteloso ante algo «aterradoramente real», mientras que el hilo 5 ofrece elogios puros por una «experiencia cinematográfica absoluta». La misma mejora de calidad se recibe de manera distinta según el contexto: preocupación por falsificaciones frente a expresión creativa.
Límites
- El criterio de finalización exige analizar unas 20 publicaciones en cada red social, pero Reddit solo recopiló 11 hilos, aproximadamente la mitad del objetivo. Consultas adicionales —por ejemplo, «Sora 2», «Stable Diffusion», «Qwen image» o «Nier open source video model»— podrían haber ampliado la muestra, pero en esta fase el agente solo leyó archivos ya recopilados y no realizó búsquedas adicionales.
- Al usarse exclusivamente la frase fija
"Image and Video Generation AI News", no se buscaron nombres concretos de herramientas y modelos de código cerrado o abierto. Por ello, las comunidades directamente relacionadas, como r/StableDiffusion y r/SoraAi, solo aportaron una publicación cada una. - De las 11 publicaciones recogidas, unas 7 —como los hilos 1, 4, 6, parte del 9 y el 11— se inclinan más hacia fricciones sociales y controversias éticas que hacia las tendencias de la tecnología generativa en sí. Es difícil cumplir, solo con los datos de Reddit, el requisito del informe de obtener al menos 10 observaciones para cada una de las tendencias de código cerrado y abierto. Hace falta complementarlo con otras plataformas.
X
X — Noticias de IA de generación de imágenes y vídeo
Cuentas
Las 40 publicaciones recopiladas proceden de 35 cuentas y, en la práctica, ninguna trata sobre IA de generación de imágenes/vídeo. Dos merecen separarse porque son las únicas que rozan el tema:
- @tetumemo(テツメモ|AI図解×検証|Newsletter) — una única publicación (327 me gusta, 28 reposts, ~48.000 visualizaciones), y la única cuenta de todo el conjunto realmente centrada en IA. Publica en japonés sobre la herramienta interna «Skills» de Anthropic, no sobre generación de imágenes o vídeo.
https://x.com/tetumemo/status/2104689964315447445 - @PalantirHotline y @zephyr_z9 — una publicación cada una, ambas reaccionan a Anthropic como empresa —especulación sobre su IPO y precios—, no a ningún producto o lanzamiento de generación de imágenes/vídeo.
Las otras 33 cuentas impulsan tendencias totalmente ajenas: reacciones al fútbol Italia contra Turquía (@Luxboii, @CHUUFFINO, @UTDbrims, @tchato18), España contra Croacia (@rkaydee_, @BlackKyle5, @wohwki, @Am_NORBERT, @ChivicEmpire21, @Bpassuwanile1, @ivana_croatian), fandom de Big Brother 28 (@BBTeamNorth, @syphafan, @TAYXBURROW, @paige_lilith), WWE Raw (@reigns_era — 3 publicaciones, 7.267 me gusta entre ellas — @greatness_1316), acumulación de memes sobre Taylor Swift / «Tayflop» (@outztheslammer — 2 publicaciones — @TayloVis, @s0mbr3nd3r) y rumores de Fórmula 1 sobre Lando Norris (@Polvodehadasm, @lnfourss — 2 publicaciones — @oIliebearman). Ninguna publica sobre IA, generación de imágenes o generación de vídeo: son reacciones aisladas a resultados deportivos y cotilleos de celebridades, no voces recurrentes de este ámbito.
Publicaciones
No puedo ofrecer entre 5 y 12 hallazgos sobre IA de generación de imágenes/vídeo a partir de esta colección, porque no contiene ese material. Lo más cercano es lo siguiente:
- @tetumemo (327 me gusta, 28 reposts, ~48.000 visualizaciones, 2026-09-28) — la única publicación verdaderamente relacionada con IA del conjunto, pero sobre herramientas de texto/HTML, no sobre imágenes: «Anthropicのチームが社内で大人気のSkillsELI5」ですが、5歳児でもわかるレベルで図解中心にHTML形式で解説してってSkills» (el equipo de Anthropic tiene una popular Skill interna, «ELI5», que explica en HTML con diagramas sencillos para que hasta un niño de cinco años los entienda). No menciona que Claude genere imágenes o vídeo; trata sobre salida HTML explicativa.
https://x.com/tetumemo/status/2104689964315447445 · encontrada mediante la búsqueda «Anthropic» - @PalantirHotline (447 me gusta, 31 reposts, ~49.000 visualizaciones, 2026-09-29) — pura especulación bursátil, no noticias de producto: «$PLTR Anthropic considering to IPO at $2T only means that Palantir is worth at least $20T».
https://x.com/PalantirHotline/status/2104744865468989486 · encontrada mediante la búsqueda «Anthropic» - @zephyr_z9 (1.480 me gusta, 36 reposts, ~115.000 visualizaciones, 2026-09-28) — reacción de una sola línea sin contexto de producto: «Are they planning to price out everyone from the market». Leída junto con la publicación sobre la IPO anterior, parece conversación general sobre precios y mercado de Anthropic, no sobre modelos de imagen o vídeo.
https://x.com/zephyr_z9/status/2104717396900745337 · encontrada mediante la búsqueda «Anthropic» - @xilo2991 (172 me gusta, 51 reposts, ~12.000 visualizaciones, 2026-09-29) — apareció mediante la búsqueda «Anthropic», pero el recopilador no capturó texto de la publicación; no hay nada que informar más allá de su existencia.
https://x.com/xilo2991/status/2104912748794589515 · encontrada mediante la búsqueda «Anthropic»
Ese es todo el conjunto de publicaciones relacionadas, aunque sea de manera tangencial, con IA. Las otras 36 de las 40 son fútbol, WWE, Big Brother 28, memes de Taylor Swift o Fórmula 1, y ninguna toca la generación de imágenes/vídeo de código cerrado o abierto.
Señales
- No hay nada en auge sobre este tema. No hay una señal discernible de generación de imágenes/vídeo de código abierto o cerrado en esta colección: no se menciona Midjourney, Sora, Veo, Runway, Kling, Stable Diffusion, Flux, HunyuanVideo, Wan ni ninguna herramienta o lanzamiento comparable.
- Lo sorprendente no es una tendencia, sino un hallazgo sobre la recolección: los diez términos de búsqueda de esta ejecución (
Italy,Spain,Jubjub,Holy,#bb28,Roman,Tayflop,Anthropic,#Croatia,Lando) son nombres de tendencias tomados directamente de la página Explore de X —según la tabla recopilada por el agente, geolocalizada en Croacia—, no términos relacionados con el encargo de investigación. Solo uno, «Anthropic», tiene conexión alguna con IA, y devolvió conversación sobre finanzas/precios de la empresa y una publicación de herramientas no relacionada, en lugar de contenido sobre generación de imágenes o vídeo. - Lo que se está desestimando: no aplicable; no hay discurso sobre el tema que permita caracterizar algo como creciente o descartado.
Límites
- Los términos de búsqueda que guiaron la recolección no trataban el tema de investigación. Los diez términos (
Italy,Spain,Jubjub,Holy,#bb28,Roman,Tayflop,Anthropic,#Croatia,Lando) son tendencias propias de X Explore para esta sesión —enumeradas enoutput/x.posts.mdbajo «What X says is happening»—, geolocalizadas en Croacia según la columna «Where» de esa tabla. Solo «Anthropic» tiene alguna relación con IA, y no mostró contenido de generación de imágenes/vídeo. - No se realizó ninguna búsqueda de términos específicos de generación de imágenes/vídeo: nada como «Sora», «Midjourney», «Stable Diffusion», «Veo», «Runway», «Kling», «Flux», «text-to-video», «text-to-image» ni nombres de modelos de pesos abiertos. Por tanto, este archivo no puede informar sobre noticias de IA de generación de imágenes/vídeo de código cerrado o abierto en X para esta ejecución.
- De 40 publicaciones recogidas, solo 4 mencionan «Anthropic», y ninguna se refiere a generación de imágenes o vídeo; las otras 36 corresponden a tendencias deportivas o de entretenimiento sin relación.
- No se recopilaron imágenes para esta etapa de plataforma (
images/x/no existe), así que tampoco hay material visual que contrastar. - No navegué X personalmente conforme al playbook —la sesión headless iniciada del agente es la única vía hacia los datos de X en esta fase—; este resumen se limita estrictamente a lo que contienen
output/x.posts.mdyoutput/x.posts.json, y esos datos no cubren el tema del encargo.
YouTube
YouTube — Noticias de IA de generación de imágenes y vídeo
Canales
- Matt Wolfe (@mreflow, ~925K suscriptores) — canal diario de noticias de IA; es la recomendación más citada en resultados de búsqueda para este ámbito, aunque en esta ejecución no apareció ningún vídeo específico de septiembre sobre modelos de imagen/vídeo.
- TheAIGRID (@TheAiGrid, ~370K suscriptores, 61,3M de visualizaciones totales, ~540K visualizaciones en los últimos 30 días según Social Blade) — canal diario de noticias de IA, con cobertura frecuente tanto de lanzamientos cerrados de frontera —Sora, Nano Banana Pro— como de modelos de pesos abiertos.
- Theoretically Media (@TheoreticallyMedia) — especialista en generación local/código abierto («Tim»); aparece repetidamente en la cobertura de Z-Image, Wan y HunyuanVideo, y los motores de búsqueda lo asocian directamente con este ámbito, aunque en esta ejecución no aparecieron cifras de visualizaciones de vídeos individuales.
- Nerdy Rodent y Sebastian Kamph — canales de tutoriales sobre ComfyUI e IA local que cubren instalaciones de nuevos modelos de pesos abiertos para imágenes/vídeo: HunyuanVideo, Qwen-Image y Flux.
- Un gran grupo de canales de comparación de herramientas, con títulos como «The BEST AI Video Generator 2026!», clasifica repetidamente Sora 2, Veo 3.1, Runway, Kling y Grok Imagine. Parecen canales de afiliación/tutoriales orientados al SEO más que una voz recurrente única, pero dominan el volumen de resultados para herramientas cerradas.
Vídeos
- «OpenAI Just Killed Sora» — canal no confirmado en el fragmento de búsqueda, 2026-03-24. Informa del anuncio de OpenAI de ese mismo día de que interrumpiría la aplicación Sora y la API de Sora-2 para redirigir capacidad de GPU hacia un nuevo modelo interno.
https://www.youtube.com/watch?v=PKKN5be_my0 - «BREAKING: Sora 2 is SHUTTING DOWN… So I Tested the Best Alternatives» — 2026-03-27. Presenta el cierre como un evento en curso y revisa Kling, Runway y Veo como sustitutos para usuarios de Sora desplazados.
https://www.youtube.com/watch?v=Zf9979o8RGk - «OpenAI Shuts Down Sora & Kills ChatGPT Integration Plans | What Happened?» — 2026-03-26. Sostiene que el cierre —aplicación retirada el 26 de abril, API terminada el 24 de septiembre de 2026— se debió a un coste operativo estimado de ~15 millones de dólares diarios y a la escasez de chips, no a una falta de calidad del modelo.
https://www.youtube.com/watch?v=9rhmczPT6Jk - «The Ultimate Guide to AI Video Generation (Sora 2, Runway 4.5, Veo 3.1, Nano Banana Pro)» — subida reciente de 2026. Una recopilación que considera Sora 2, Runway 4.5, Veo 3.1 y Nano Banana Pro de Google como la frontera actual de código cerrado, pese al cierre de la API de Sora ese mismo mes.
https://www.youtube.com/watch?v=Kib8UcDiNJA - «Google Nano Banana Pro: The BEST Image Model!» y vídeos relacionados («NANO Banana Pro is FINALLY Here!», «Google won image generation (it's not even close) — NANO BANANA PRO BREAKDOWN») — grupo de vídeos publicados desde 2025-11-21. El argumento constante es que Nano Banana Pro, construido sobre Gemini 3 Pro Image, lidera la representación de texto, la generación de infografías y la salida 4K, y se trata como la respuesta cerrada de Google a Midjourney y al trabajo de imagen próximo a Sora.
https://www.youtube.com/watch?v=GEtiY-0fzO0 · https://www.youtube.com/watch?v=UV9GqinedQ8 - «Runway 4.5 vs Veo 3.1 vs Sora 2 — Full AI Video Generator Comparison» — 2025-12-23. Sitúa a Runway 4.5 por delante de Veo 3.1 en control de cámara y a Sora 2 por delante en realismo puro, antes del posterior cierre de Sora.
https://www.youtube.com/watch?v=Rm_Ok-MHZfA - «Qwen-Image-2.1 Is INSANE… Just 7B Parameters?!» — 2026-09-20, el mismo día de su lanzamiento. Sostiene que el modelo de pesos abiertos de 7B parámetros de Alibaba ya edita imágenes, conserva la identidad de sujetos/productos con hasta 10 imágenes de referencia y genera recortes transparentes; pero advierte que su licencia es solo de investigación, no auténticamente de código abierto.
https://www.youtube.com/watch?v=3qGl0wiv2G0 - «Qwen Image 2512 Just Dropped – I Had to Test It Immediately vs Nanobanana Pro (12 Tests)» — finales de 2025/2026. Realiza una comparación de 12 pruebas entre Qwen Image 2512, de pesos abiertos, y Nano Banana Pro de Google, y sostiene que la brecha de calidad entre el lado abierto y el cerrado casi se ha cerrado.
https://www.youtube.com/watch?v=_TGz5xB6i8w - «Z-Image Turbo Released - Fast Distilled Image Model» y «Z-Image Base Released – AI That Nails Hands, Textures & Human Emotions!» — el laboratorio Tongyi-MAI de Alibaba lanzó Z-Image Turbo el 2025-11-26 —inferencia en menos de un segundo y 8 pasos; número 1 de código abierto / número 8 global en la clasificación Text-to-Image de Artificial Analysis según el texto de la descripción—, seguido por un checkpoint «Base» completo. Ambos generaron vídeos de tutoriales e instalación en canales del estilo de Nerdy Rodent y Theoretically Media.
https://www.youtube.com/watch?v=3mT7KnotPqk · https://www.youtube.com/watch?v=s7ppsl_LbzI - «HunyuanVideo 1.5: Open Source Video Generation (Instruction Following & Physics)» y «Tencent HunyuanVideo 1.5 has been officially open-sourced!» — modelo de vídeo abierto de Tencent con 8.300 millones de parámetros, presentado como ejecutable en GPU de consumo; múltiples canales publicaron de inmediato comparativas con Wan 2.2/2.5/2.7.
https://www.youtube.com/watch?v=4HTBZg5Zhqc · https://www.youtube.com/watch?v=MJShdc8tkkA - «AI Video Models Are Getting Out of Control! (WAN 2.5, Kling 2.5, Wanimate)» — sostiene que el ritmo de lanzamientos de modelos de vídeo abiertos —Wan— y cerrados —Kling— se ha vuelto demasiado rápido para seguirlos individualmente, con la función de animación de personajes «Wanimate» de Wan como principal novedad.
https://www.youtube.com/watch?v=vFXe3uXb75k - «We have a new #1 open-source AI video generator!» — corona a un nuevo líder, en el contexto de comparativas entre HunyuanVideo 1.5 y Wan 2.7, en el veloz ranking de vídeo de código abierto.
https://www.youtube.com/watch?v=6EQP8-D37bs
Señales
- La historia dominante del código cerrado ahora no es un modelo nuevo, sino que OpenAI eliminó uno. La aplicación Sora y la API de Sora-2 —sora-2, sora-2-pro y snapshots con fecha— se cerraron completamente el 2026-09-24, seis días antes de esta investigación, tras el anuncio de OpenAI el 2026-03-24. Múltiples vídeos presentan esto como una redirección de capacidad de GPU hacia un modelo interno de próxima generación —con el nombre en clave «Spud» según informes— y lejos de un producto cuyo coste de ejecución se estimaba en ~15 millones de dólares diarios. Es una señal cerrada más importante que cualquier lanzamiento concreto hallado en esta ejecución.
- Nano Banana Pro de Google (Gemini 3 Pro Image) es el líder de imagen cerrada por volumen de vídeos. Se agrupan muchos más vídeos en torno a él que en torno a cualquier lanzamiento individual de Midjourney o Runway, con canales que lo llaman repetidamente el mejor de su clase en representación de texto y generación de infografías.
- Los modelos de imagen de pesos abiertos están cerrando rápidamente la brecha con los modelos cerrados, pero las licencias enturbian la etiqueta «código abierto». Qwen-Image-2.1, de 7B parámetros y lanzado el 2026-09-20, se describe en su propia cobertura como «pesos abiertos, no código abierto»: licencia solo de investigación y sin redistribución comercial, un punto que varios vídeos destacan explícitamente mientras elogian su capacidad.
- Los laboratorios chinos —Tongyi-MAI/Qwen de Alibaba y Hunyuan de Tencent— son actualmente los editores de código abierto más activos en imagen y vídeo, con Z-Image Turbo/Base, Qwen-Image-2.1/2512 y HunyuanVideo 1.5 publicados en aproximadamente los últimos cuatro meses; cada uno generó de inmediato vídeos de comparativas entre ellos y frente a modelos cerrados.
- El contenido comparativo de modelos de vídeo —«Sora vs Veo vs Runway vs Kling vs Wan»— es un género por derecho propio, producido con cadencia casi semanal por canales de comparación de herramientas. Sirve para seguir qué nombres están presentes en la mente del público, pero menos como señal de un evento concreto.
Límites
- Las páginas de resultados de YouTube (
youtube.com/results?search_query=…) se renderizan mediante JavaScript y devolvieron solo texto repetitivo de pie de página/navegación al extractor de esta ejecución. Las cifras exactas de visualizaciones, fechas de subida y suscriptores no pudieron leerse directamente desde YouTube para la mayoría de vídeos. Todas las cifras de visualizaciones/suscriptores/fechas anteriores proceden de fragmentos de WebSearch y fuentes secundarias vinculadas —Social Blade, vidiq y resúmenes de blogs—, no de abrir directamente páginas de YouTube; deben tratarse como aproximadas y fechadas según la última actualización de esas fuentes secundarias. - Las páginas individuales de vídeos (
youtube.com/watch?v=…) encontraron el mismo obstáculo de renderizado JavaScript. Los títulos se pudieron recuperar, pero generalmente no las visualizaciones, nombres exactos de canales ni descripciones; por ello, varias entradas anteriores dan título y fecha, pero no canal ni número de visualizaciones. - No se encontró una subida confirmada y fechada de septiembre de 2026 de Matt Wolfe sobre este tema, pese a que el canal es la fuente de noticias de IA más recomendada en resultados de búsqueda. Se incluye bajo Canales por reputación, no por un vídeo reciente verificado.
- No se intentó contrastar con Bluesky, Lemmy o Pinterest: los datos de YouTube se recopilaron de forma independiente, conforme al playbook.
- La cobertura se inclina hacia canales de comparación/tutoriales porque dominan el ranking de búsqueda de YouTube para estas palabras clave. Esto puede infrarrepresentar a creadores pequeños o canales no anglófonos —aparecieron un vídeo francés sobre Z-Image y uno japonés sobre Qwen-Image, pero no se analizaron en profundidad—.
Bluesky
Bluesky — Noticias de IA de generación de imágenes y vídeo
Nota sobre la metodología de investigación
La API de búsqueda de publicaciones public.api.bsky.app/xrpc/app.bsky.feed.searchPosts indicada por el playbook devolvió de forma constante 403 Forbidden durante este acceso, y la página de búsqueda web bsky.app/search?q=... tampoco pudo leerse porque se renderiza con JavaScript (los detalles están al final, en ## Límites). Como alternativa, se usó app.bsky.actor.searchActors —búsqueda de cuentas, que no estaba bloqueada— para identificar cuentas potencialmente relevantes para el tema. Después, se comprobaron una a una las publicaciones reales mediante app.bsky.feed.getAuthorFeed —lista de publicaciones de una cuenta— y app.bsky.feed.getPostThread —texto, fecha, me gusta y reposts de una publicación concreta—. Todas las publicaciones se indican a continuación con URL existentes.
Cuentas
- @testingcatalog.com (🚨 AI News | TestingCatalog) — bot de noticias de IA general. Publica varias veces al día; los temas de generación de imágenes/vídeo con IA solo aparecen ocasionalmente. https://bsky.app/profile/testingcatalog.com
- @genainews.bsky.social (Gen AI News) — otro bot de noticias de IA general. Se revisaron las 30 publicaciones recientes de su feed, pero no había ninguna relacionada con generación de imágenes/vídeo; se centra en agentes, LLM y noticias corporativas.
- @sungkim.bsky.social (Sung Kim) — cuenta individual que sigue lanzamientos de modelos de pesos abiertos. Su publicación sobre Qwen-Image-2.1 recibió 81 me gusta y 10 reposts, la mayor reacción de todas las comprobadas. https://bsky.app/profile/sungkim.bsky.social
- @compvis.bsky.social (CompVis, LMU Munich) — cuenta del propio grupo investigador autor del artículo original de Stable Diffusion. Sin embargo, sus publicaciones recientes no anuncian modelos concretos; presentan investigación general sobre modelos de difusión y GAN. https://bsky.app/profile/compvis.bsky.social
- @stabilityai.bsky.social (oficial de Stability AI) — la única cuenta corporativa principal de la esfera abierta/cerrada que está activa. Sin embargo, sus publicaciones del último año tratan casi todas sobre generación de audio —Stable Audio 2.5— y alianzas con Universal Music/Warner Music; no se encontraron nuevos anuncios de generación de imágenes o vídeo. https://bsky.app/profile/stabilityai.bsky.social
- @civitai-bot.bsky.social (bot de actualización de CivitaiCheckPoint) — bot que notificaba automáticamente actualizaciones de modelos/LoRA de código abierto. Su última publicación es del 9 de mayo de 2024 y lleva más de un año detenido.
- @dahara1.bsky.social / @luok.ai — cuentas individuales de experimentación y pruebas. Publican informes de uso de modelos abiertos de generación de vídeo como HunyuanVideo y SkyReels V1.
- @trashcanroxanne.bsky.social (TrashCanRoxanne) — creadora audiovisual de IA que participa en programas «Creator Partner Program» de Runway/Hailuo/Freepik/Kling, etc. Publica de forma continua pruebas de funciones nuevas e informes de participación en festivales de cortometrajes de IA.
- @blackforestlabs.bsky.social (oficial de Black Forest Labs), @klingaivideo.bsky.social (oficial de Kling AI Video), @runwayml.bsky.social (oficial de RunwayML) — las tres empresas tienen cuentas en Bluesky, pero Black Forest Labs y Kling AI Video tienen cero publicaciones, y RunwayML solo una, de octubre de 2024. Bluesky prácticamente no funciona como canal oficial de anuncios para empresas de IA de generación de imágenes/vídeo.
- Las búsquedas de cuentas relacionadas con Stable Diffusion / Civitai mostraron mayoritariamente publicaciones individuales de arte con IA, con una proporción considerable de contenido NSFW/furry, en lugar de noticias.
- En cambio, aparecieron muchas cuentas de ilustradores, como
fuzichoco.bsky.social,jametc.bsky.social,devinellekurtz.bsky.socialyartbutmakeitsports.bsky.social, que indican explícitamente «NO AI» o «prohibido entrenar con IA» en sus perfiles; esto sugiere la existencia de una comunidad anti-IA particular de Bluesky.
Publicaciones
-
Nano Banana 2.1 (código cerrado) — @testingcatalog.com, 2026-09-27, 1 me gusta y 0 reposts. «New Google Flow build now points to Nano Banana 2.1». Informa de que la denominación del modelo de imagen dentro de Flow de Google cambió de Nano Banana 2.5 a Nano Banana 2.1, y especula que se trata de una pequeña actualización iterativa.
https://bsky.app/profile/testingcatalog.com/post/3mwiz3uw7nl2e -
Publicación de pesos abiertos de Qwen-Image-2.1 (código abierto) — @sungkim.bsky.social, 2026-09-20, 81 me gusta y 10 reposts, la mayor reacción entre las publicaciones comprobadas. Informa de que Alibaba publicó con pesos abiertos un modelo ligero de 7B que integra generación y edición. Las publicaciones posteriores presentan generación directa de capas RGBA, entrada de hasta 10 imágenes de referencia, soporte de panoramas/pruebas virtuales y enlaces a GitHub/ModelScope/Hugging Face. En los comentarios se suceden preguntas técnicas sobre despliegue local en LM Studio y compatibilidad con ComfyUI.
https://bsky.app/profile/sungkim.bsky.social/post/3mvxr2bj2ck2r -
Stable Audio 2.5 de Stability AI y alianza con Universal Music (señal indirecta de cambio de rumbo desde imágenes/vídeo) — @stabilityai.bsky.social, 2025-10-30, 1 me gusta y 0 reposts. «Today we announced a strategic alliance with Universal Music Group to co-develop professional AI music creation tools». La comunicación reciente de Stability AI en Bluesky se centra en alianzas corporativas para modelos de generación de audio; no se encontraron anuncios nuevos de modelos de imágenes/vídeo.
https://bsky.app/profile/stabilityai.bsky.social/post/3m4fwolv4k22z -
Prueba de la función de primer/último fotograma de Kling 2.1 (código cerrado) — @trashcanroxanne.bsky.social, 2025-08-25, 4 me gusta y 0 reposts. «Testing out the new Kling 2.1 — first and last frame feature in Freepik». Publicación desde la perspectiva de una profesional que prueba la nueva función de Kling AI a través de Freepik.
https://bsky.app/profile/trashcanroxanne.bsky.social/post/3lxas5x3uf22s -
SkyReels V1 (código abierto) — @luok.ai, 2025-02-18, 3 me gusta y 1 repost. «SkyReels V1 is the first open-source human-centric video foundation model. By fine-tuning HunyuanVideo on over 10 million high-quality film and television clips, it captures 33 facial expressions and over 400 natural movement combinations». Presentación de un modelo abierto de vídeo centrado en personas y basado en HunyuanVideo.
https://bsky.app/profile/luok.ai/post/3lihm6qiuyk27 -
Prueba beta de HunyuanVideo I2V (código abierto) — @dahara1.bsky.social, 2025-03-06, 0 me gusta y 0 reposts. Informa de que participó en la prueba beta de la IA de generación de vídeo HunyuanVideo y ya podía crear un vídeo a partir de una imagen; en un hilo presenta el resultado de sus pruebas con un vídeo de sincronización labial de estilo anime.
https://bsky.app/profile/dahara1.bsky.social/post/3ljozva2gcs27 -
Parada del bot de actualizaciones CivitaiCheckPoint (señal de estancamiento de la comunidad de código abierto) — @civitai-bot.bsky.social, última publicación 2024-05-09, con publicaciones de baja escala de 3 me gusta o menos. Publicaba cada hora avisos de actualizaciones de LoRA/checkpoints, como «✨Carrot Caramel Batake updated✨ baseModel: SD 1.5», pero dejó de actualizarse el 9 de mayo de 2024.
https://bsky.app/profile/civitai-bot.bsky.social/post/3ks2nnatkqi24 -
Decentralized Diffusion Models (investigación de código abierto) — @compvis.bsky.social, grupo autor de Stable Diffusion, 2025-01-10, 20 me gusta y 2 reposts. «Decentralized Diffusion Models, a way to train diffusion models on decentralized compute with no communication between nodes». Es una presentación de un artículo sobre aprendizaje distribuido, no el lanzamiento de un modelo concreto.
https://bsky.app/profile/compvis.bsky.social/post/3lfexk45ek227 -
Silencio efectivo de la cuenta oficial de RunwayML (señal de ausencia de comunicación de empresas cerradas) — @runwayml.bsky.social. Su única publicación es del 2024-10-24, con 386 me gusta y 24 reposts, pero consiste en una descripción ambiental sin relación con el producto: «Let's put a blanket down & watch the day fade away». No ha publicado nada más desde entonces.
https://bsky.app/profile/runwayml.bsky.social/post/3l7bzv5idqg2t -
Diffusion models for image and video generation | ML in PL 2025 (anuncio de charla por un investigador de Google DeepMind) — @sedielem.bsky.social, Sander Dieleman, investigador de Imagen/Veo, 2026-03-16, 17 me gusta y 6 reposts. Anuncio de una charla que explica ampliamente el entrenamiento de modelos de generación de vídeo e imágenes, no un anuncio de producto concreto.
https://bsky.app/profile/sedielem.bsky.social/post/3mh7g2dv4nc25
Señales
- La ausencia de cuentas oficiales es el mayor descubrimiento. Black Forest Labs, desarrollador de Flux, tiene cero publicaciones; Kling AI Video, cero; RunwayML, solo una en dos años. Los principales actores de la IA de generación de imágenes/vídeo apenas utilizan Bluesky como canal de anuncios inmediatos. No se ha establecido en Bluesky la cultura de anuncios directos de CEO o cuentas oficiales que existe en X/Reddit.
- Stability AI es la única empresa activa, pero su atención se ha desplazado al audio. Sus publicaciones entre septiembre y noviembre de 2025 se centran en Stable Audio 2.5 y alianzas con Universal Music Group y Warner Music Group; no se encontraron anuncios de nuevos modelos de generación de imágenes, de la línea Stable Diffusion, en ese periodo.
- Los informes de código abierto con sensación de experiencia directa proceden de cuentas individuales, no corporativas. Qwen-Image-2.1 de @sungkim.bsky.social, SkyReels V1 de @luok.ai y las pruebas I2V de HunyuanVideo de @dahara1.bsky.social son informes primarios de cuentas técnicas individuales que aparecieron antes y con más detalle que los anuncios oficiales.
- El bot de checkpoints de Civitai está detenido desde mayo de 2024, por lo que Bluesky puede haber dejado de ser infraestructura de notificaciones para la comunidad de LoRA/modelos de código abierto. Se infiere, sin verificarlo, que pudo migrar a Discord o al propio Civitai.
- La generación de vídeo cerrada —Runway, Hailuo, Kling, Luma, Pika, etc.— es comentada por grupos de cuentas tipo influencer que participan en «Creator Partner Programs». Cuentas como @trashcanroxanne, @aziz4ai, @azed-ai, @uncanny-harry y @koldohuici publican pruebas de nuevas funciones y participación en festivales de cortometrajes de IA como embajadores de varias herramientas. Se trata más de comunicación de comunidad creativa que de noticias técnicas.
- El contenido NSFW/furry ocupa la mayoría de los resultados de búsqueda de cuentas relacionadas con Stable Diffusion y Civitai. Más que las noticias técnicas, el arte individual generado con IA —una proporción relevante para adultos— parece ser el contenido dominante de la comunidad abierta de generación de imágenes en Bluesky.
- Abundan las cuentas de ilustradores que declaran «NO AI» —@fuzichoco.bsky.social, @jametc.bsky.social, @devinellekurtz.bsky.social y @artbutmakeitsports.bsky.social, entre otras—. La oposición a la IA de generación y el rechazo al entrenamiento con obras propias se han normalizado en textos de perfil, y el sentimiento anti-IA de la capa creadora de Bluesky parece más fuerte que en X/Reddit.
Límites
- La API de búsqueda de publicaciones (
app.bsky.feed.searchPosts) devolvió sistemáticamente 403 Forbidden. Aunque el playbook indica que se puede acceder sin iniciar sesión, consultas sencillas comoq=stable diffusionyq=catstambién devolvieron 403 en este entorno. Desde el mismo entorno,app.bsky.actor.searchActors—búsqueda de cuentas—,app.bsky.feed.getAuthorFeed—lista de publicaciones— yapp.bsky.feed.getPostThread—hilo individual— funcionaron correctamente, por lo que es muy probable que solo la API de búsqueda esté limitada; se especula, sin comprobarlo, que la causa podría ser autenticación obligatoria o límites de tasa más estrictos. - La página web
bsky.app/search?q=...se renderiza con JavaScript, por lo que el HTML obtenido no contenía las publicaciones y no pudo leerse. Las páginas de publicaciones individuales,bsky.app/profile/.../post/..., tenían el mismo problema; el texto solo se pudo confirmar a través de la API getPostThread. - Debido a estas restricciones, en vez de una recopilación exhaustiva por palabras clave se utilizó el método indirecto de verificar una por una mediante API las URL de bsky.app encontradas con búsqueda de Google. Por tanto, no fue posible realizar la investigación exhaustiva con múltiples palabras clave prevista por el playbook; las publicaciones recogidas no son completas y se limitan a las encontradas casualmente.
- No se alcanzó el criterio de finalización de «analizar unas 20 publicaciones» debido a las limitaciones de este método alternativo. Solo se obtuvieron 10 publicaciones de alta relevancia y una docena larga de cuentas/señales de referencia. En casos como Black Forest Labs y Kling AI Video, donde las cuentas oficiales tienen cero publicaciones, se consideró que profundizar más por la misma vía no aportaría nueva información primaria.
- Un artículo encontrado a través de Google,
en.yasue.org/report/image-and-video-generation-ai-news-2026-09-10, probablemente sea un informe anterior del mismo tipo que este. No se trató como fuente primaria ni se citó.
Lemmy
Lemmy — Temas de IA de generación de imágenes y vídeo (centrado en código abierto; escasa presencia cerrada)
Comunidades
- !«メールアドレス» — 5,71K suscriptores. Es, con mucha diferencia, la comunidad más activa para IA de generación de imágenes/vídeo. Casi a diario aparecen nodos de ComfyUI y publicaciones de repositorios GitHub de nuevos modelos. Las tendencias de código abierto se concentran prácticamente aquí.
- !ai_reddit@ (varias instancias, como retransmisiones en lemmy.world) — comunidad que vuelve a publicar en Lemmy publicaciones de Reddit sobre IA generativa. A veces aparecen ejemplos de obras de herramientas cerradas como Runway y GPT.
- !«メールアドレス» — bloqueada por Anubis, sistema antbots, y no se pudo ver por completo. Da la impresión de tener pocas publicaciones; solo aparecieron algunas mediante búsqueda y algunas tienen puntuaciones negativas.
- !«メールアドレス» / !«メールアドレス» / !«メールアドレス» — comunidades de crítica a la IA generativa y al arte de IA. Se centran más en publicaciones emocionales que en noticias, pero aquí tienden a acumularse casos de abuso de IA cerrada.
- !«メールアドレス» — tecnología general. A veces publica noticias corporativas de Midjourney y similares, pero no es una comunidad especializada.
Publicaciones
Código abierto (de !«メールアドレス», últimas 1–2 semanas)
- LanPaint — inpainting de alta calidad, sin entrenamiento y utilizable con cualquier modelo SD; compatible con ComfyUI. Puntuación 7, 2026-09-29. https://lemmy.dbzer0.com/post/76205128
- PxTicks/vlo — editor de vídeo gratuito, local y de código abierto con funciones de IA. Puntuación 4, 2026-09-29. https://lemmy.dbzer0.com/post/76205126
- SatoDive/Minimax-H3-Latent-Continuation — generación de continuación de vídeo larga, fluida y multiescena basada en MiniMax H3. Puntuación 3, 2026-09-29. https://lemmy.dbzer0.com/post/76205130
- Qwen-Image-2.1 in ComfyUI — integración con ComfyUI del modelo de pesos abiertos de generación y edición de imágenes Qwen-Image-2.1. Puntuación 13, la más alta de este hilo, alrededor de 2026-09-22. https://lemmy.dbzer0.com/post/75874773
- ogoun/fooocus-qwen-image-2.1 / Kijai/QwenImage_experimental / PrunaAI/Pruna-Qwen-Image-2.1 — se publican simultáneamente una WebUI, integración con ControlNet y LoRA de aceleración alrededor de Qwen-Image-2.1. 2026-09-26–27. https://lemmy.dbzer0.com/post/76110120
- SupraLabs/Supra2-IMG — modelo compacto de generación de imágenes a partir de texto de solo 100 millones de parámetros. Puntuación 7, alrededor de 2026-09-22. https://lemmy.dbzer0.com/post/75874769
- Nueva interfaz de The AI Horde — la red distribuida y gratuita de generación de imágenes, AI Horde, renovó su frontend, backend y documentación. Puntuación 8, alrededor de 2026-09-19. https://lemmy.dbzer0.com/post/75736717
- Cierpliwy/krea2-inpaint-edit · lvladikov/Krea2-Turbo-Distill-2step-LoRA — LoRA de edición inpaint de la serie Krea-2 y LoRA de destilación rápida de dos pasos. 2026-09-16–17. https://lemmy.dbzer0.com/post/76065378
- Publicación de arte abstracto con SDXL local + LoRA — obra abstracta terminada en GIMP/Inkscape tras ejecutar SDXL 1.0 localmente y entrenar un LoRA personalizado. Puntuación 4, 2026-09-18. https://lemmy.today/post/60272629
Código cerrado (esporádico y a través de otras comunidades)
- Midjourney pide a Hollywood que revele el uso de IA — se informa de que Midjourney pide a los estudios de Hollywood detalles de su uso de IA. !technology, 2026-07-05. https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-the-details-of-their-ai-usage/
- Google Earth AI, con integración de Nano Banana, retirado en 24 horas — al día siguiente de integrar en Google Earth la función de generación de imágenes Nano Banana, los usuarios generaron muchas imágenes falsificadas —supuestas imágenes satelitales de masacres y desastres— y se detuvo la función. En los comentarios también surgió la propuesta técnica de distinguir las imágenes satelitales reales con firmas criptográficas. Vía !ai_reddit, 2026-08-07. https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/
- Anuncio de empresa de IA producido en seis horas con Runway — publicación sobre un concepto de anuncio de estilo Nike de 40 segundos, realizado con Runway Gen-4 y otros recursos, sin equipo de rodaje ni modelos. !ai_reddit, puntuación 1, 2026-09-26. https://v.redd.it/awqo4jp13yrh1
- Suicidio tras generar 7.000 imágenes sexuales de su hijastra con Grok — debatido en !fuck_ai como un grave caso de abuso de IA cerrada, Grok. 2026-07-09. https://lemmy.dbzer0.com/post/71983645
- Stanford admite usar IA para «cambiar la raza» en una foto de estudiantes — !nottheonion, 2026-09-23. https://san.com/cc/stanford-university-admits-ai-was-used-to-race-swap-student-photo/
Señales
- El debate sobre IA generativa en Lemmy es casi enteramente de código abierto. Solo !«メールアドレス» tuvo más de 20 publicaciones de repositorios y herramientas en las dos semanas recientes; el ecosistema de Qwen-Image-2.1 —modelo de pesos abiertos de Alibaba— y MiniMax H3 —vídeo—, con nodos ComfyUI, LoRA y WebUI, es una tendencia clara del momento. También aparecen modelos ligeros emergentes como Krea y SupraLabs.
- Los temas de código cerrado —Midjourney, Sora, Veo, Grok, Google Nano Banana, etc.— aparecen en Lemmy solo como republicaciones de noticias o incidentes de abuso/polémica. No se comparten tutoriales ni obras: la conversación tiende a centrarse en críticas corporativas, regulación y sucesos.
- El tono de la comunidad es en general escéptico u hostil hacia la IA. Hay comunidades «anti-IA generativa» en varias instancias, como !fuck_ai, y aparece con frecuencia el término «AI slop», contenido de IA producido en masa y de baja calidad. Incluso en publicaciones de obras, hay varios casos de puntuación negativa al sospecharse que fueron creadas con IA, por ejemplo -8 y -6.
- La coincidencia de palabras clave en la API de búsqueda es algo inestable: búsquedas por nombres propios como «Flux» o «Veo 3» generan mucho ruido al mezclarse con nombres de apps alternativas a Discord y resultados irrelevantes. Era más fiable consultar directamente la comunidad !stable_diffusion.
Límites
- El número de usuarios y publicaciones activos en todo Lemmy es varios órdenes de magnitud menor que en Reddit y plataformas similares. Se parece más a un tablón de intercambio de repositorios de comunidades de desarrolladores que a «noticias de última hora». Lemmy por sí solo casi no recogió tendencias cerradas —anuncios de modelos, reseñas comparativas, etc.—.
- !«メールアドレス» fue bloqueada por Anubis, el sistema antbots, y no se pudo abrir su página directamente. Solo hubo información fragmentaria procedente de resultados de búsqueda.
- Las puntuaciones de votos son bajas en general, muchas de un solo dígito; apenas hay publicaciones que puedan llamarse virales dentro de Lemmy. Al interpretar las cifras hay que considerar el tamaño reducido de la comunidad.
- Frente al criterio de analizar 20 publicaciones, se pudieron comprobar más de 20 del lado abierto en un único lugar —!stable_diffusion—, pero para el lado cerrado hubo que cruzar varias palabras clave y comunidades para apenas alcanzar unas 10. Esto refleja el sesgo temático de Lemmy a favor del código abierto, no una falta de exhaustividad en la búsqueda.
Pinterest — Noticias de IA de generación de imágenes y vídeo
Se utilizó una sola consulta de búsqueda, sin división por géneros, y se recogieron 50 pines. Todos se revisaron como imágenes. Más que las habituales «imágenes bonitas» de Pinterest, el conjunto estaba dominado por miniaturas publicitarias de herramientas de IA, infografías comparativas y miniaturas de vídeos de «AI NEWS» de YouTube: un tablero más próximo a blogs tecnológicos/afiliación.
Temas visuales
- Robots humanoides blancos azulados y luminosos, con ojos brillantes, son la cara dominante del conjunto. Se repiten robots tipo «presentador de noticias de IA» con traje [1, 22, 29, 31, 47] y logotipos «AI» con patrón de circuito que flotan sobre una mano [9, 46, 50], representando directamente la idea de que «la IA sustituye el trabajo humano».
- La textura de placas de circuito en azul marino y neón —cian/magenta/morado— domina como fondo [4, 8, 14, 16, 32, 45]. Casi todas las publicaciones usan la misma paleta, lo que sugiere la estandarización de miniaturas de IA.
- Abundan las infografías de comparación y clasificación de herramientas, que alinean logotipos en formatos como «gratis frente a pago» o «los 6 mejores sitios de generación de vídeo con IA» [3, 9]. Se amontonan logotipos de servicios cerrados como Runway, Pika, Kling AI, Luma AI, Canva AI, Hailuo AI, ChatGPT, Midjourney, Adobe Firefly, Ideogram, SeaArt, Playground, Krea y CapCut.
- Es visible el género de puesta en escena de la duda «real frente a generado por IA» —lupas, sellos «FAKE», comparativas «Human or AI?» a dos lados y tasas de detección del 97 %— [1, 26, 27]. El interés por determinar la autenticidad se expresa con fuerza visualmente.
- Se repite el motivo de la IA apoderándose de las noticias [5, 34, 37, 39, 44]. Un vídeo real de NBC News muestra un clip tipo presentador meteorológico con la etiqueta «AI GENERATED» arriba a la izquierda [44], un caso singular como ejemplo de producción de noticias.
- Hay varias infografías verticales de explicación paso a paso, del 1 al 6, que describen cómo «crear vídeo a partir de imágenes» [6, 24]. La secuencia de introducir prompt → procesamiento por IA → renderizado → exportación se ha vuelto un flujo de trabajo estándar.
- Retratos de personas fotorrealistas y sin defectos visibles —primeros planos de personas mayores, combinaciones de escultura e interpretación de violonchelo, niños héroe— [12, 15, 49] se usan como imágenes de ejemplo para la promoción de marca. El objetivo es mostrar la calidad fotorrealista de la generación de imágenes.
- Hay varias imágenes de anuncios de productos con logotipos corporativos —Google Veo 2 / VideoFX [16, 33], Gemini Omni [21], Vidu S1 de ShengShu [48], Amuse 3.0 de AMD [49]— que aportan información más concreta sobre modelos nuevos que las imágenes genéricas de IA.
Pines destacados
- [2] Meta Muse Spark AI Model 2026 — miniatura de un artículo explicativo sobre Meta Muse, que promete «superinteligencia personal». Una mujer con visor combinada con casa, coche y VR subraya la línea de «asistente personal universal».
- [3] 6+ Best AI Video Generation Websites — infografía que compara en paralelo Runway/Pika/Kling AI/Luma AI/Canva AI/Hailuo AI. Permite ver de un vistazo la segmentación por uso: cine, redes sociales o principiantes.
- [9] AI Image Video: Best Quality vs Best Free — diagrama de decisión que clasifica las opciones de pago —ChatGPT Plus, Gemini Advanced, Midjourney, Adobe Firefly, Recraft, Runway Gen-3, Luma, Pika Pro, Kaiber, Synthesia— y gratuitas —Ideogram, Gemini Free, SeaArt, Playground, Krea, Canva, CapCut, Pika Free, Runway Free— por caso de uso.
- [15] ByteDance and Hollywood reach global deal on AI copyright — captura de pantalla de un artículo de noticias que afirma que ByteDance alcanzó un acuerdo global con la Motion Picture Association (MPA) para proteger derechos de autor en herramientas de generación de imágenes/vídeo con IA. Una noticia real que indica tendencias de regulación para herramientas cerradas.
- [16] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — explicación del modelo más reciente de la línea Veo de Google.
- [21] Google's Gemini Omni Turns Anything Into Video — presentación de una función nueva según la cual Gemini Omni convierte conjuntamente imágenes, audio y texto en vídeo.
- [31] Discover how Grok is revolutionizing video... — pin sobre la entrada de Grok de xAI en el ámbito del vídeo.
- [44] AI news videos blur line between real and fake reports — vídeo real de NBC News de un clip tipo presentador meteorológico, etiquetado «AI GENERATED». Es un ejemplo de cómo los principales medios empiezan a implantar etiquetas de divulgación de contenido generado por IA.
- [48] ShengShu Technology Unveils Vidu S1 — imagen de anuncio del modelo chino de vídeo Vidu S1, que promete «generación interactiva en tiempo real».
- [49] 'Amuse 3.0' — AMD-powered AI art creation tool — anuncio de una nueva versión de una herramienta de creación artística con IA que funciona en GPU AMD y se ejecuta localmente; uno de los pocos ejemplos concretos cercanos a código abierto/ejecución local.
Señales
- La presencia de las opciones cerradas es abrumadora: los nombres y logotipos de SaaS comerciales se repiten: Google —Veo/Gemini/Omni—, Meta —Muse—, OpenAI —logotipos de ChatGPT/DALL-E—, Runway, Pika, Luma, Kling, Canva, Hailuo, ShengShu —Vidu— y xAI —Grok—. Pinterest se centra en contenido de intención de compra para usuarios que comparan «qué herramienta deberían usar».
- El código abierto/autohospedado está poco representado: solo hay una mención a la línea Stable Diffusion —[28], título únicamente; la imagen es una persona genérica creada con IA— y destaca Amuse 3.0 de AMD [49] como ejemplo orientado a la ejecución local. No hay pines con el carácter de comunidad técnica de ComfyUI, LoRA o intercambio de checkpoints. Adaptados al público de Pinterest —consumidores y profesionales de marketing—, los temas de cadenas de herramientas OSS técnicas no aparecen.
- Hay fuerte interés por la autenticidad de contenidos generados por IA: los sellos «FAKE», comparativas «Human or AI?» y porcentajes de detección aparecen repetidamente como lenguaje visual de confianza y divulgación. Junto al ejemplo real de NBC News [44], esto sugiere que las «etiquetas obligatorias para noticias/contenidos generados por IA» se están convirtiendo en tema de interés a nivel de consumidor.
- Predominan los contenidos SEO de comparación de herramientas y artículos explicativos: hay más pines que explican «cuál elegir» o «pasos de uso» que detalles técnicos de modelos nuevos. Pinterest funciona más como centro de contenido de apoyo a decisiones que como canal de noticias inmediatas.
- Homogeneización de plantillas visuales: el fondo azul marino, las líneas de circuito neón y los robots blancos se repiten en casi todos los pines, confirmando visualmente la estandarización y producción en masa de las miniaturas de blogs de IA.
Límites
- La lista de pines no tenía división por géneros —
genreestá vacío en todos los casos— y solo se revisaron 50 resultados de la consulta única «Image and Video Generation AI News». Conforme al playbook, se leyeron únicamente las imágenes ya recopiladas y no se navegó Pinterest directamente. - Muchas imágenes son miniaturas de blogs/infografías; no se leyó el texto de los artículos enlazados. Las fuentes de información fueron solo el texto dentro de la imagen y los títulos/URL de
pinterest.pins.md. - Hay pocos pines que respalden de forma concreta las tendencias de código abierto —una mención a Stability AI y una a AMD Amuse—. Pinterest por sí solo ofrece poca profundidad para las noticias abiertas. Es un sesgo estructural debido a su naturaleza de búsqueda visual orientada al consumidor, no una omisión de la recopilación.
Acciones recomendadas
- La próxima vez, cambiar las búsquedas de Reddit y X a nombres propios —Qwen-Image, Sora, Nano Banana, HunyuanVideo, etc.— para reducir el ruido de las tendencias.
- Cambiar los términos de búsqueda para la recolección de X: abandonar la dependencia de las tendencias de X Explore y usar una lista preparada de palabras relacionadas con IA de generación de imágenes/vídeo.
- Vigilar continuamente el problema 403 de la API searchPosts de Bluesky y pasar a búsquedas exhaustivas por palabras clave en cuanto se recupere.
- Convertir la evolución de la licencia de Qwen-Image-2.1 —si permite o no uso comercial— en un punto fijo de seguimiento para la próxima revisión.
- Mantener la comunidad !stable_diffusion de Lemmy como punto de observación de novedades de código abierto.
Imágenes recopiladas


















































Nota sobre la calidad de los datos
X apenas pudo recopilar publicaciones relacionadas con IA de generación de imágenes/vídeo porque las consultas dependían de tendencias de X Explore —fútbol y entretenimiento—. Reddit se quedó en 11 publicaciones frente al criterio de finalización de 20 y se inclinó hacia hilos de controversia social. Bluesky no pudo realizar búsquedas exhaustivas porque su API searchPosts estaba bloqueada con un 403. YouTube no permitió leer páginas de resultados ni de vídeos debido al renderizado JavaScript, por lo que las visualizaciones y datos similares dependieron de información secundaria.



