Noticias de IA de generación de imágenes y video — 2026-09-23
La IA cerrada de imágenes/video está retrocediendo con fuerza (la API de Sora 2 cerrará el 2026-09-24, Midjourney gira hacia dispositivos médicos y hay rechazo a los precios de Grok Imagine/Seedance), mientras que las herramientas abiertas basadas en ComfyUI (Wan, HunyuanVideo, FLUX.2, Qwen-Image, MiniMax H3) se están convirtiendo discretamente en la opción predeterminada para el trabajo de producción real.
La primera línea de la IA generativa de imágenes y video: open source vs. cerrada está que arde — 2026-09-23
Vaya, lo estuve revisando y estamos en un momento realmente fascinante 🔥 Mientras los actores de código cerrado (Sora 2, Midjourney, Grok Imagine y otros) lanzan novedades llamativas, por detrás están retirándose, subiendo precios y cambiando de dirección a toda velocidad; sinceramente, empiezan a dar señales de inestabilidad 😳 Por otro lado, los proyectos open source (Wan, FLUX.2, Qwen-Image, HunyuanVideo) se están concentrando alrededor del hub de ComfyUI y, sin hacer demasiado ruido, están entrando de lleno en los flujos de producción reales 💪 Tras revisar Reddit, X, YouTube, Bluesky, Lemmy y Pinterest, se dibuja con claridad una dinámica: «noticias espectaculares = cerrado», «utilidad constante = abierto». Además, la presión pública para que el contenido generado por IA se identifique claramente está creciendo con fuerza 📢
Entre plataformas
- La desaceleración y los cambios de rumbo de los actores cerrados se confirman en varias plataformas. En YouTube se difundió que Sora 2 cerrará su aplicación tras apenas medio año (2026-04-26) y que su API también finalizará el 2026-09-24, el día posterior a la investigación; según el informe citado, frente a unos costes operativos de cerca de un millón de dólares al día, los ingresos acumulados por pagos fueron de solo 2,1 millones de dólares (https://www.youtube.com/watch?v=bIL7uU4CYnE). En Lemmy se compartió la misma noticia sobre el cierre de la API de Sora mediante un espejo de r/ArtificialInteligence (https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/), contrastándola con los 3.000 millones de dólares recaudados por Kuaishou (Kling), de China; el tono era claramente que «el negocio empresarial discreto es el que realmente genera dinero».
- El open source aparece en todas partes como “infraestructura de trabajo” articulada alrededor de ComfyUI. Reddit (ComfyUI + FramePack para generar video incluso en PC modestos), Lemmy (dos extensiones de ComfyUI para MiniMax H3 en la última semana) y YouTube (una proliferación de tutoriales para ejecutar Wan/HunyuanVideo/LTX localmente) muestran de forma independiente que ComfyUI y la familia Wan se han convertido en palabras clave.
- El malestar por que “todo se ha vuelto demasiado de pago” se dirige a las herramientas cerradas. En Reddit aparecieron tres hilos buscando generadores de video gratuitos (debido a la reducción de los planes gratuitos de las herramientas cerradas), y en Bluesky una artista de Tokio lamentó repetidamente que el precio de Seedance 2.5 era “devastating” (https://bsky.app/profile/metalmickey.bsky.social/post/3mu25rbs4dk2e).
- Los consumidores están cansados de comparar herramientas y preguntarse cuál usar. Los videos comparativos de Sora 2 vs. Seedance 2.0 vs. Runway se han vuelto habituales en YouTube, y en Pinterest triunfaban matrices de decisión de «mejor calidad vs. mejor gratis» (YouTube: https://www.youtube.com/watch?v=rb0p_mY3tPs / Pinterest #10). Cada vez más gente quiere saber cuál es la mejor opción ahora, en vez de adherirse a un modelo concreto.
- La desconfianza hacia el contenido generado por IA y el ambiente a favor de exigir su etiquetado son comunes en varias plataformas. Un hilo de propuesta legislativa en Reddit alcanzó 13.841 comentarios, con mucha diferencia el mayor volumen de debate de la recopilación (https://www.reddit.com/r/CriticalState/comments/1wmktek/). En Pinterest, los sellos «FAKE» y las insignias de detección de IA ya se han consolidado como género visual independiente.
Por plataforma
Reddit — De los 12 hilos recogidos, solo 4 procedían de comunidades especializadas en IA generativa de imágenes o video; el resto eran publicaciones en subreddits generales del tipo «encontré contenido generado por IA / me enfada». La demanda de generación de video gratuita y local aparece repetidamente. A la vez, DeepSeek (pesos abiertos) muestra un caso poco habitual en el que su rápido crecimiento de usuarios (DAU de 120 a 200 millones) superó la expansión de cómputo y deterioró la calidad: una situación en la que el proyecto abierto corre el riesgo de colapsar por hacerse demasiado popular (https://www.reddit.com/r/DeepSeek/comments/1wmcgex/).
X — Entre cuentas japonesas se produjo una oleada de demostraciones de generación en una sola pasada con Claude Opus 5.5 y Grok 4.7. @cherry_mx_reds, @NFT_Chen, @riku720720 y @chetaslua publicaron demos diferentes casi al mismo tiempo (21–22 de septiembre), lo que da la sensación de una ronda colectiva de pruebas inmediatamente tras el lanzamiento. Del lado abierto destacaron publicaciones de desarrolladores individuales, como @shinshin86 y @GeekCatX, celebrando sus estrellas de GitHub. El problema fue que más de 20 de los 40 elementos recolectados eran ruido ajeno al tema, provocado por palabras de tendencias propias de X.
YouTube — Fue la fuente con más información. El ascenso y caída de Sora 2 —un anuncio espectacular seguido de una retirada en seis meses— fue el tema principal, mientras continuaba la competencia de actualizaciones de Nano Banana 2, GPT Image 2.5 y Midjourney V8. En el campo abierto, Alibaba (Wan), Tencent (HunyuanVideo), Black Forest Labs (FLUX) y Lightricks (LTX) son los principales frentes, y ComfyUI se ha consolidado como el «panel de conexiones» que incorpora nuevos nodos continuamente.
Bluesky — No existe un hub sólido especializado en IA generativa de imágenes o video; las cuentas oficiales de Stability AI, Midjourney, Runway y otras están prácticamente inactivas. La única persona que seguía publicando de manera constante era @ethanhe, de xAI. Sin embargo, la API de búsqueda de texto completo devolvió 403 durante toda la investigación, por lo que solo fue posible analizar cuentas conocidas.
Lemmy — Aunque su escala es reducida (incluso la comunidad principal cuenta con solo 5.713 miembros), las publicaciones alrededor de ComfyUI en !«メールアドレス» tenían una alta densidad informativa. Del lado cerrado destacaron de forma desproporcionada las noticias de «retirada y cambio de rumbo» —cierre de la API de Sora, giro de Midjourney hacia dispositivos médicos y retirada inmediata de Earth AI de Google—, más que los lanzamientos llamativos.
Pinterest — Más que artículos de noticias, predominan imágenes tipo miniatura de «AI NEWS», gráficos comparativos y visuales de advertencia sobre deepfakes. El open source apenas aparece, salvo AMD «Amuse 3.0». En cambio, la ansiedad del consumidor por elegir una herramienta y su cautela ante el contenido generado por IA se manifiestan con mucha fuerza como géneros visuales.
Puntos destacados
- Cierre de la API de Sora 2 (2026-09-24) — YouTube: https://www.youtube.com/watch?v=bIL7uU4CYnE
- Aumento explosivo de DAU de DeepSeek y deterioro de calidad por falta de cómputo — Reddit: https://www.reddit.com/r/DeepSeek/comments/1wmcgex/
- Propuesta legislativa para exigir etiquetado de contenido generado por IA (13.841 comentarios) — Reddit: https://www.reddit.com/r/CriticalState/comments/1wmktek/
- Siguen apareciendo extensiones de generación de video largo con ComfyUI + MiniMax H3 — Lemmy: https://github.com/supElement/ComfyUI_MinimaxH3_AutoContext
- Grok 4.7 genera automáticamente una escena 3D en Blender (410.000 visualizaciones) — X: https://x.com/cherry_mx_reds/status/2102098340699668865
- Midjourney da un gran giro desde la generación de imágenes hacia dispositivos médicos (escáner CT por ultrasonido) — Lemmy: https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-to-medical-devices/
Acciones recomendadas
- Dado que las herramientas cerradas siguen subiendo precios y retirando productos, seguir de cerca el stack OSS Wan, HunyuanVideo, FLUX.2 y ComfyUI + MiniMax H3 como principal alternativa práctica.
- Anticiparse al clima creciente en Reddit y Pinterest a favor de etiquetar el contenido generado por IA preparando una política de procedencia y etiquetado.
- Tras el cierre de la API de Sora 2 (24/9), vigilar hacia dónde migran los usuarios: Kling, Seedance y Runway son los candidatos probables.
- Considerar la oleada de demos de generación en una sola pasada con Opus 5.5/Grok 4.7 en X como hype efímero de ventana de lanzamiento, no como una amenaza duradera para la cuota de atención del OSS.
- Vigilar la tensión de escalado de cómputo de DeepSeek como indicador adelantado de lo que sucede cuando la adopción de pesos abiertos supera la infraestructura propia de un operador.
- Responder a la fatiga de «qué herramienta uso» visible en YouTube y Pinterest con contenido comparativo, en lugar de noticias de un único producto.
Calidad de los datos
Solo YouTube y Pinterest alcanzaron aproximadamente el objetivo de unas 20 piezas por red; Reddit se quedó en 12 hilos, la mayoría procedentes de subreddits generales ajenos al tema; de las 40 publicaciones de X, más de la mitad fueron ruido de palabras en tendencia no relacionadas; la API de búsqueda de texto completo de Bluesky devolvió 403 de forma constante, por lo que la cobertura dependió solo de cuentas conocidas; y Lemmy es simplemente demasiado pequeña (su comunidad principal tiene unos 5.713 suscriptores y la mitad de sus publicaciones son espejos de Reddit) para llegar a 20 publicaciones nativas.
Resumen por plataforma
Reddit — Noticias de IA generativa de imágenes y video
Dónde (subreddits)
Los 12 hilos recopilados están repartidos entre 10 subreddits. Las comunidades especializadas en IA generativa de imágenes y video son minoritarias; el resto son hilos sobre menciones o quejas acerca de contenido generado por IA en subreddits generales.
| Subreddit | Miembros | Hilos recopilados |
|---|---|---|
| r/generativeAI | 156,181 | 3 |
| r/mildlyinfuriating | 12,586,808 | 1 |
| r/aivideomaking | 7,498 | 1 |
| r/CriticalState | 39,096 | 1 |
| r/Instagramreality | 1,155,566 | 1 |
| r/Purdue | 100,731 | 1 |
| r/DeepSeek | 140,681 | 1 |
| r/ImagineAiArt | 19,446 | 1 |
| r/youngpeopletiktoks | 8,226 | 1 |
| r/youtube | 3,459,719 | 1 |
Solo cuatro —r/generativeAI, r/aivideomaking, r/DeepSeek y r/ImagineAiArt— están especializados en IA generativa (4 hilos). Los otros ocho son menciones en subreddits generales dentro del contexto de «encontré contenido generado por IA / me irrita».
Reacciones de la comunidad
- La búsqueda de generadores de video gratuitos aparece repetidamente en tres hilos distintos (hilo #2 «Which AI video generator can still be used for free?» r/generativeAI, 20 pt, 73 comentarios, 2026-09-16 / hilo #3 «Looking for a free AI video generator» r/aivideomaking, 7 pt, 28 comentarios, 2026-09-20 / hilo #10, mismo título, r/generativeAI, 4 pt, 28 comentarios, 2026-09-20). A medida que las opciones cerradas pasan a ser de pago, u/RioMetal (+4) recomendó alternativas abiertas: «si puedes ejecutarlo localmente, tienes Wan o Minimax de sobra».
https://www.reddit.com/r/generativeAI/comments/1whtesl/ - Quejas de que «todo lo que recomienda la IA es de pago» (hilo #2, cuerpo de la publicación): una reacción típica a la reducción de los planes gratuitos de los servicios cerrados.
https://www.reddit.com/r/generativeAI/comments/1whtesl/ - Medidas prácticas para operar localmente y con open source: u/AztecWheels (+2, hilo #3) explicó que instalando FramePack mediante Pinokio se puede convertir imagen a video incluso en ordenadores modestos (sin audio, de 1 a 120 segundos). ComfyUI + FramePack se menciona como combinación habitual para la generación de video open source en equipos de gama baja.
https://www.reddit.com/r/aivideomaking/comments/1wled0f/ - Reacción contra “pedir cosas gratis”: u/activematrix99 (+2, hilo #3) comparó exigir uso gratuito con pedir comida gratis en un restaurante: las empresas han invertido miles de millones en esta tecnología. La comunidad está dividida sobre esa demanda.
https://www.reddit.com/r/aivideomaking/comments/1wled0f/ - Crecimiento acelerado de DeepSeek (pesos abiertos) y déficit de cómputo: según el cuerpo del hilo #7 «some deepseek news, if you care» (r/DeepSeek, 292 pt, 45 comentarios, 2026-09-21), la DAU de DeepSeek subió de 120 a 200 millones (+66,7%), mientras su capacidad de cálculo solo creció un 8,3%, causando degradación de calidad y fallos de regeneración. Como respuesta, se mencionó un pedido de 160.000 Ascend 960DT de Huawei. u/Equivalent-Grass-527 (+13) señaló que el desajuste entre demanda y recursos de cómputo era la explicación más convincente del deterioro reciente.
https://www.reddit.com/r/DeepSeek/comments/1wmcgex/ - Debate GPT Image 2.5 Flare (cerrado) vs. KREA 2 (abierto): en el hilo #9 «GPT Image 2.5 Flare — is this actually the best AI image generating model right now?» (r/ImagineAiArt, 93 pt, 62 comentarios, 2026-09-16), u/Dependent_Quit_3730 (+3, en portugués) comentó que es perfecto para quien busca simplicidad, pero que sigue usando KREA 2; u/SeaworthinessFresh16 (+2) afirmó que los resultados con ComfyUI + Krea2 se ven iguales. Frente a la notoriedad del nuevo modelo cerrado, hay quienes no perciben casi diferencia con los modelos abiertos.
https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/ - Fuerte rechazo a las fotos inmobiliarias generadas por IA: hilo #1 «It should be illegal to post AI-generated "inspirational" images in house listing photos.» (r/mildlyinfuriating, 25.962 pt, 706 comentarios, 2026-09-21; la mayor puntuación de la muestra). u/BojackWorseman13 (+1.128) sostuvo que, aunque no fuera ilegal, las inmobiliarias deberían indicar de forma prominente que las imágenes son generadas por IA.
https://www.reddit.com/r/mildlyinfuriating/comments/1wmja6n/ - Propuesta legislativa para exigir etiquetado del contenido generado por IA: hilo #4 «[Law Proposal] Every ai generated image and text must need to have watermark.» (r/CriticalState, 1.246 pt, 13.841 comentarios, 2026-09-21; el mayor número de comentarios de la recopilación). Los principales comentarios apoyaban de forma mayoritaria la medida, por ejemplo u/Timedforfun (+16): «no es algo que deba ocultarse; voten a favor».
https://www.reddit.com/r/CriticalState/comments/1wmktek/ - Las imágenes generadas por IA, ya indistinguibles para el público general, se vuelven virales: hilo #5 «AI generated images on Reddit with thousands of upvotes and comments» (r/Instagramreality, 2.148 pt, 343 comentarios, 2026-09-18). u/Habibti-Mimi81 (+146) dijo que no se habría dado cuenta; la esquina de las baldosas grises era la única pista, y describió la situación como triste y peligrosa.
https://www.reddit.com/r/Instagramreality/comments/1wk0euk/ - El uso de imágenes generadas por IA incluso en carteles oficiales universitarios se critica como “slop”: hilo #6 «AI generated image on MSEE wall» (r/Purdue, 139 pt, 19 comentarios, 2026-09-21). El texto de la publicación pregunta si no podían contratar a un diseñador gráfico y lamenta no poder escapar del “AI slop” en ninguna parte.
https://www.reddit.com/r/Purdue/comments/1wmq43f/ - Contenido de video generado con IA como Sora entra en subreddits de reposts de TikTok: hilo #11 «another ai generated grounded video» (r/youngpeopletiktoks, 81 pt, 35 comentarios, 2026-09-19). u/Pretend-Goat-8065 (+5) identificó directamente el producto cerrado: «Another Sora ai».
https://www.reddit.com/r/youngpeopletiktoks/comments/1wkjvor/ - Rechazo a los capítulos autogenerados por IA de YouTube: hilo #12 (r/youtube, 3 pt, 22 comentarios, 2026-09-17). u/avatar0027 (+2) indicó que se muestran cada vez más capítulos generados automáticamente a partir de transcripciones; los espectadores no disponen de una opción global para desactivarlos y cada creador debe hacerlo individualmente. No trata de generación de video como tal, pero evidencia fatiga ante la expansión de funciones de IA.
https://www.reddit.com/r/youtube/comments/1wiqamq/
Señales
- En alza: la necesidad de generación de video gratuita y local (Wan 2.2, Minimax H3, ComfyUI + FramePack) aparece una y otra vez en tres hilos independientes. La subida de precios y la transición a modelos de pago en herramientas cerradas están impulsando el interés por el open source.
- En alza: la opinión pública que exige obligación de identificar el contenido como generado por IA (el hilo #4, con 13.841 comentarios, produjo el mayor debate de la muestra). En Reddit en general, regulación y transparencia generan mucho más compromiso que la competencia de rendimiento entre modelos.
- Con cierta resistencia: hay oposición a la propia exigencia de «darlo gratis» (u/activematrix99 y otros). Parte de la comunidad no ve con buenos ojos la idea de que el uso gratuito sea un derecho, así que no existe consenso.
- Hallazgo inesperado: DeepSeek (pesos abiertos) ha sufrido degradación de calidad por falta de cómputo mientras crece rápidamente su base de usuarios (hilo #7). En vez del habitual eje abierto/cerrado, se discutía un nuevo tipo de restricción de oferta: un modelo abierto se vuelve tan popular que su infraestructura propia no puede seguirle el ritmo.
- División de opiniones: en el hilo #9 se dividieron las opiniones al comparar el nuevo modelo cerrado GPT Image 2.5 Flare con KREA 2 abierto; varias voces sostienen que el cerrado tiene más notoriedad, pero apenas se nota diferencia en la práctica.
Limitaciones
- El criterio de finalización del informe era analizar aproximadamente 20 publicaciones por red social, pero en reddit.threads.md/.json solo se habían recopilado 12 hilos (con una única consulta: «Image and Video Generation AI News»). Como el enfoque era leer datos ya recopilados por el worker, no se realizaron búsquedas adicionales.
- De los 12 elementos, solo cuatro proceden de comunidades especializadas en IA de imágenes/video (r/generativeAI, r/aivideomaking, r/DeepSeek, r/ImagineAiArt). Los otros ocho son derivados de «encontré contenido generado por IA» en subreddits generales, y casi no incluyen hilos de noticias sobre nuevos productos o actualizaciones de código abierto/cerrado.
- Ninguno de los principales subreddits especializados, como r/StableDiffusion, r/midjourney, r/runwayml o r/aivideo, aparece en el conjunto recopilado.
- El cuerpo de la publicación del hilo #9 (GPT Image 2.5 Flare) queda cortado a mitad del prompt; no fue posible verificar la continuación ni el contenido de la imagen adjunta.
- Debido a la restricción de no poder navegar Reddit directamente, no se investigó más allá de estos 12 elementos, ni con otras consultas ni profundizando en otros hilos.
X
X — Noticias de IA generativa de imágenes y video
X (Twitter), especialmente entre cuentas japonesas, está viviendo entusiasmo por demos de generación de video y animación con «Claude Opus 5.5» y «Grok 4.7», pero más de la mitad de las 40 publicaciones recopiladas era ruido no relacionado con el tema (véase Limits abajo).
Cuentas
- @cherry_mx_reds(Tak) — La cuenta con mayor presencia en esta recopilación. Publicó una animación «Oktoberfest» generada de una vez con Opus 5.5 (373 likes) y una escena 3D creada por Grok 4.7 en Blender (1.636 likes, ~410.000 visualizaciones). Probó dos demos de modelos distintos y funciona como cuenta de seguimiento comparativo.
- @NFT_Chen(SuSu_酥酥) — Publicó una demo en la que Opus 5.5 crea mediante código una animación stop-motion de aspecto dibujado a mano (151 likes, ~40.000 visualizaciones). Es una publicación aislada, pero se difundió gracias a su explicación detallada.
- @chetaslua — Publicó un caso de generación de video interactivo con Opus 5.5 usando únicamente JavaScript, sin assets, MCP ni skills (435 likes). Es una demo técnica orientada a implementación.
- @riku720720(Rikuo) — Publicó una animación pixel art generada con Opus 5.5 (173 likes) y compartió el prompt en las respuestas, con un enfoque práctico de intercambio.
- @old_pgmrs_will(operador de NeuralWire.org) — Publicó dos elementos relacionados con Grok 4.7: una aplicación de retoque fotográfico generada automáticamente con función de demo (8 likes), y una defensa ante las críticas a Grok-4.7 junto con mejoras de interfaz en una app de edición de video (8 likes). El alcance es pequeño, pero la cuenta publica de forma continuada como fuente de noticias de IA.
- @shinshin86(desarrollador de AITuber OnAir) — Informó que su herramienta OSS «Still2Rig PSD», que convierte imágenes fijas en PSD con separación automática de capas, superó las 60 estrellas en GitHub (586 likes, ~28.000 visualizaciones).
- @ishitaku39(いしたく) — Presentó «ARDY Mini», una versión derivada que un desarrollador individual aligeró hasta ejecutarla en navegador a partir del modelo de investigación ARDY de NVIDIA (226 likes).
- @GeekCatX(知识猫AI实验室) — Informó que «Hand-drawn Video Skill», proyecto open source de story-to-handdrawn-video, superó las 2.000 estrellas en GitHub (103 likes), además de compartir novedades tras un mes.
- @so_ainsight — Publicó una recopilación semanal de repositorios de IA en rápido ascenso en GitHub (573 likes, ~49.000 visualizaciones). No se limita a generación de imágenes y video, pero es relevante como contexto del impulso del OSS.
Publicaciones
Código cerrado (Opus 5.5 / Grok 4.7)
-
#1 @riku720720 — 173 likes, 19 reposts, 1 respuesta, unas 19.000 visualizaciones, 2026-09-22. https://x.com/riku720720/status/2102515055116063144
Opus 5.5 es una locura… sacó esta animación pixelada en menos de cinco minutos.
El núcleo de la publicación es la sorpresa por generar una animación pixel art en una sola pasada y en menos de cinco minutos. -
#2 @NFT_Chen — 151 likes, 20 reposts, 13 respuestas, unas 40.000 visualizaciones, 2026-09-22. https://x.com/NFT_Chen/status/2102455102896509431
¡Esto no está dibujado por una persona! Claude Opus 5.5 usó código para dibujar esta animación fotograma a fotograma… 32 segundos, todo generado por IA.
El asombro se centra en el método: stop-motion de aspecto manual creado mediante código. -
#3 @cherry_mx_reds — 373 likes, 17 reposts, 10 respuestas, unas 36.000 visualizaciones, 2026-09-21. https://x.com/cherry_mx_reds/status/2102493303388475855
Opus 5.5 generó esta animación de una sola vez en 14 min 48 s: «Oktoberfest» de Opus 5.5.
Destaca la generación «one-shot» y el tiempo concreto de 14 minutos y 48 segundos. -
#4 @chetaslua — 435 likes, 23 reposts, 10 respuestas, unas 20.000 visualizaciones, 2026-09-22. https://x.com/chetaslua/status/2102501773705670994
Generación de video interactivo en cualquier estilo artístico con @claudeai Opus 5.5: sin assets, MCP ni skills; solo JavaScript.
Una demo técnica que enfatiza la ligereza de la implementación. -
#17 @AbhinavXJ — 57 likes, 2 reposts, 2 respuestas, unas 3.200 visualizaciones, 2026-09-22. https://x.com/AbhinavXJ/status/2102473742723260606
Decían que había que mantener el ritmo de la frontera, y ahora tenemos Grok 4.7, Claude Opus 5.5, GPT-6 sol y luna en el plazo de dos días.
No se centra en un modelo individual, sino en la velocidad de lanzamientos del sector. -
#19 @cherry_mx_reds — 1.636 likes, 215 reposts, 127 respuestas, unas 410.000 visualizaciones, 2026-09-21. https://x.com/cherry_mx_reds/status/2102098340699668865
Grok 4.7 hizo esto en Blender. No le dije qué crear, solo que hiciera algo que pudiera completar en unos 10 minutos.
Es la demo generativa con mayor interacción de la recopilación y destaca por entrar en generación 3D dentro de Blender. -
#18 @old_pgmrs_will — 8 likes, 0 reposts, 0 respuestas, unas 611 visualizaciones, 2026-09-21. https://x.com/old_pgmrs_will/status/2102182047989338264
Con Grok 4.7 generé una aplicación de retoque fotográfico para mi propio uso. De paso, le hice implementar una función de demo automática para mostrar cómo se usa.
Un informe de uso práctico orientado a aplicación personal y demostración integrada. -
#20 @old_pgmrs_will — 8 likes, 0 reposts, 0 respuestas, unas 599 visualizaciones, 2026-09-22. https://x.com/old_pgmrs_will/status/2102376309020299517
Veo, sobre todo entre gente de fuera, publicaciones del tipo «Grok-4.7 no sirve», pero o son haters o no saben usarlo.
Aunque hay críticas a Grok 4.7, el autor responde que está logrando mejoras de UI/UX en su aplicación de edición de video con IA. La evaluación está dividida.
Open source
-
#33 @shinshin86 — 586 likes, 59 reposts, 2 respuestas, unas 28.000 visualizaciones, 2026-09-21. https://x.com/shinshin86/status/2102163713679577301
La herramienta de IA «Still2Rig PSD», que permite crear PSD a partir de una imagen fija, ya supera las 60 estrellas en GitHub… Si entregas una imagen a un agente de IA como Codex, puede ejecutar See-through en Google Colab, separar las capas y avanzar hasta montar el PSD.
Una herramienta OSS individual supera 60 estrellas en GitHub; su característica es la integración con agentes de IA. -
#34 @ishitaku39 — 226 likes, 22 reposts, 3 respuestas, unas 9.800 visualizaciones, 2026-09-21. https://x.com/ishitaku39/status/2102038146489946532
¡Pude generar el movimiento de un personaje en tiempo real siguiendo los comentarios! Integré «ARDY Mini» en mi AITuber casero. Es una variante que un desarrollador individual aligeró hasta poder ejecutarla en navegador a partir del modelo de investigación ARDY de NVIDIA.
Ejemplo de cómo la comunidad OSS convierte una investigación de NVIDIA en una herramienta práctica que corre en navegador. -
#35 @GeekCatX — 103 likes, 18 reposts, 4 respuestas, unas 7.800 visualizaciones, 2026-09-22. https://x.com/GeekCatX/status/2102336276230025224
¡Hand-drawn Video Skill se ha actualizado otra vez! …las estrellas de GitHub de story-to-handdrawn-video ya superaron las 2.000. Esta vez el foco está en añadir más estilos artísticos.
El proyecto OSS «story-to-handdrawn-video» supera 2.000 estrellas; la novedad central son más estilos artísticos. -
#36 @so_ainsight — 573 likes, 75 reposts, 6 respuestas, unas 49.000 visualizaciones, 2026-09-21. https://x.com/so_ainsight/status/2101871551255830529
Diez repositorios de IA que más crecieron esta semana en GitHub: 1. OpenCodeReview…
Recopilación semanal de repositorios de IA en ascenso, no limitada a imágenes/video, pero útil como contexto del impulso de la comunidad OSS.
Señales
- Lo que crece: las demostraciones individuales de Claude Opus 5.5 y Grok 4.7 que muestran video/animación generado en una sola pasada, rápidamente y a bajo coste, obtienen interacción de forma consistente. En particular, varias cuentas independientes (@riku720720, @NFT_Chen, @cherry_mx_reds, @chetaslua) publicaron demos distintas de Opus 5.5 casi al mismo tiempo (2026-09-21–22), lo que revela una oleada de pruebas inmediatamente posterior al lanzamiento.
- Lo que se minimiza o divide opiniones: Grok 4.7 recibe tanto elogios (generación 3D en Blender, ~410.000 visualizaciones) como críticas de «no sirve». @old_pgmrs_will responde personalmente a estas últimas, por lo que no hay una admiración uniforme.
- Hallazgo inesperado: en el lado abierto, destacaron publicaciones de desarrolladores individuales de habla japonesa (@shinshin86, @ishitaku39, @GeekCatX) que presentan métricas concretas de estrellas de GitHub. Más que anuncios corporativos, abundan casos de personas que combinan modelos de investigación existentes y agentes de IA para crear herramientas útiles.
- Segundo hallazgo inesperado: de las consultas de X, solo «Opus 5.5», «Grok 4.7» y «GitHub» se relacionaban directamente con IA de imágenes/video. Las otras siete (#chance, England, #sweepstakes, #giveaways, Lauren, $SONG, Jesus) eran tendencias de Explore sin relación con el tema.
Limitaciones
- De las 10 consultas, #chance (reality romántico de ABEMA), England (clima y fútbol), #sweepstakes (campañas de sorteos como Fanatics), #giveaways (sorteos relacionados con festividades de India), Lauren (un escándalo de una cantante de R&B y la telenovela brasileña «Estrelas da Casa»), $SONG (token de criptomoneda en Cardano) y Jesus (contextos religiosos, crítica a la industria del videojuego y comentarios de fútbol) no tenían relación con la IA generativa de imágenes/video. Más de 20 de los 40 elementos eran este ruido, aparentemente resultado de búsquedas mecánicas basadas en las tendencias de Explore de X.
- La lista de tendencias de Explore de X, basada en la ubicación del servidor de esta sesión, incluía «Trending in Croatia» y reflejaba principalmente tendencias croatas. No puede presentarse como indicador global, y es probable que las consultas ruidosas procedan de esa lista local.
- Las publicaciones que conectan directamente con el tema se reducen a cuatro sobre Opus 5.5, cuatro sobre Grok 4.7 y tres herramientas OSS procedentes de GitHub: 11 en total. El análisis de publicaciones por sí solo no basta para cumplir el mínimo de 10 hallazgos para open source y código cerrado que solicitaba el informe; debe complementarse con otras plataformas.
- Los nombres de otros actores principales —OpenAI (GPT-6/Sora), Midjourney, Stable Diffusion y Runway— no figuraban en las consultas de X ni aparecieron en los datos recopilados. Esta ejecución no confirmó las reacciones en X a esos actores.
YouTube
YouTube — Últimas noticias de IA generativa de imágenes y video (código cerrado/open source)
Canales
- OpenAI (canal oficial) — Publica los anuncios oficiales de Sora 2 y ChatGPT Images 2.5.
- Google / Google DeepMind (oficial) — Publica anuncios de la serie «Nano Banana» de Gemini.
- Adobe (oficial) — Publica anuncios del despliegue multimodelo de Firefly.
- Runway (oficial) — Publica anuncios de Gen-4.5 y de su servidor MCP.
- Lev Selector — Canal individual que resume noticias de IA semanalmente (serie «Exciting AI Updates Weekly»).
- Canales de tutoriales de ComfyUI / Stable Diffusion (por ejemplo, relacionados con «AI on the Lot» y explicadores de flujos de ComfyUI) — Producen numerosos tutoriales para ejecutar localmente modelos abiertos como Wan, LTX, Flux y HunyuanVideo.
- Canales de comparativas y reseñas (con títulos repetidos tipo «Best AI Video Generator») — Publican numerosos videos que comparan en paralelo Sora 2, Seedance 2.0, Runway y Kling.
- No se pudo confirmar el número de suscriptores, ya que el HTML exige renderizado JavaScript y tampoco aparece en los fragmentos de resultados de búsqueda (véase
## Limits).
Videos
Código cerrado
- Introducing Sora 2 — OpenAI oficial / 2025-09-30 / https://www.youtube.com/watch?v=gzneGhpXwjU — Bill Peebles, Rohan Sahai y Thomas Dimson presentaron Sora 2 y la nueva aplicación Sora, una nueva generación de modelo de video con física fiel y sincronización de diálogos.
- OpenAI Abandons Sora to Refocus on Enterprise Solutions — Canal de análisis / alrededor de marzo de 2026 / https://www.youtube.com/watch?v=bIL7uU4CYnE — Explica que OpenAI cerrará la aplicación Sora el 2026-04-26 y la API el 2026-09-24, el día posterior a esta investigación. Cita informes según los cuales, frente a unos costes operativos de cerca de un millón de dólares diarios, los ingresos de pago acumulados fueron de solo 2,1 millones de dólares.
- OpenAI Shuts Down Sora & Kills ChatGPT Integration Plans | What Happened? — Canal de análisis / alrededor de marzo–abril de 2026 / https://www.youtube.com/watch?v=9rhmczPT6Jk — Explica que una asociación de IA con Disney, valorada en alrededor de 1.000 millones de dólares, se rompió justo antes del anuncio del cierre de Sora.
- Introducing ChatGPT Images 2.5 — OpenAI oficial / alrededor de 2026-09-08 / https://www.youtube.com/watch?v=6l7ble9P74o — Anuncio de GPT Image 2.5 (ChatGPT Images 2.5), con velocidad de generación 50% superior y la nueva función «Sketch», que convierte bocetos dibujados a mano directamente en imágenes.
- Sketch with ChatGPT Images 2.5 — OpenAI oficial / septiembre de 2026 / https://www.youtube.com/watch?v=imPtIEAEHSU — Demo de escribir «@Sketch» para dibujar directamente un boceto en ChatGPT y convertirlo en imagen con IA.
- The New Gemini Image Generator is Insane (Nano Banana 2) — Canal de reseñas / 2026-02-27 / https://www.youtube.com/watch?v=nikIxHM_AQY — Reseña de la actualización de Google que sustituyó el modelo de generación de imágenes predeterminado de la aplicación Gemini por «Nano Banana 2».
- Midjourney Update | March 2026: V8 Alpha, BIG Changes Coming, New Edit Model + More — Canal de análisis de Midjourney / alrededor de marzo de 2026 / https://www.youtube.com/watch?v=TZ1zWvbXFug — Episodio que presenta la alfa de V8 y sirve de punto de partida para las actualizaciones posteriores V8.1 (2026-04-14) y V8.2 (mejoras de calidad y personalización; el modelo de edición se abrió a todos los usuarios el 2026-08-27).
- Kling 3.0: the biggest advancement in AI video generation? — Canal de reseñas / primera mitad de 2026 / https://www.youtube.com/watch?v=G1VHCrl4jy4 — Prueba de Kling 3.0 de Kuaishou. Se presenta como el primer modelo que genera video nativo a 4K y 60 fps y que alcanzó el primer lugar de la sección de video de Artificial Analysis.
- Grok Imagine 1.5 Preview - Mind-Blowing AI Video Just Dropped 🔥 | xAI — Canal de reseñas / 2026-06-03 / https://www.youtube.com/watch?v=grxiFAC-NNI — Prueba de la vista previa de Grok Imagine 1.5 de xAI.
- Sora 2 vs. Seedance 2.0 vs. Runway: The 2026 AI Video War Explained — Canal de comparativas / 2026-02-13 / https://www.youtube.com/watch?v=rb0p_mY3tPs — Comparación entre Sora 2, Seedance 2.0 de ByteDance y Runway.
- Runway Ships an MCP Server - Generate Video From Inside Claude, ChatGPT, Cursor and Replit — Runway oficial / alrededor de 2026-05-27 / https://www.youtube.com/shorts/t9Bg_4rOQqM — Anuncia el servidor MCP de Runway, que permite generar video directamente desde Claude, ChatGPT, Cursor y Replit.
Open source
- Now that Wan 2.5 (open source model from Alibaba China) can do AI dialogues, AI Lip Syncing to... — Canal de análisis / primera mitad de 2026 / https://www.youtube.com/watch?v=kzXNJO6caGw — Presenta que Wan 2.5, modelo open source de Alibaba, incorpora generación de diálogos y sincronización labial.
- Wan2.6: Multi-shot Storytelling & Cinematic Shot Control — Canal de tutoriales / finales de 2025–principios de 2026 / https://www.youtube.com/watch?v=VHJ925WoWgw — Explica «multi-shot storytelling», función de Wan 2.6 que puede generar hasta 15 segundos de video cinematográfico de varios planos a partir de un prompt.
- Black Forest Labs: FLUX 2 – The King of AI Image Generation — Canal de reseñas / 2026-06-04 / https://www.youtube.com/watch?v=WZfKzzX65-o — Prueba de FLUX.2 de Black Forest Labs.
- FLUX.2 Just Beat Every AI Image Model — Black Forest Labs' Most Powerful Release Yet — Canal de reseñas / 2025-11-27 / https://www.youtube.com/watch?v=VMBSUBKON_U — Sostiene que FLUX.2 supera a los modelos existentes de generación de imágenes en calidad, controlabilidad y consistencia.
- Qwen Image-2512 First Test – The BEST Open Source Image Model! — Canal de reseñas / 2026 / https://www.youtube.com/watch?v=SBaK616nP6Q — Prueba de la versión más reciente de la familia Qwen-Image-2.1 de Alibaba, que integra renderizado de texto, edición de imagen y generación de imágenes transparentes, con un componente generativo de 7B parámetros.
- HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model? — Canal de comparativas / 2026 / https://www.youtube.com/watch?v=4GNT4-QYekg — Compara localmente HunyuanVideo 1.5 de Tencent (8,3B parámetros, ejecutable en GPU de consumo) con Wan 2.7 de Alibaba.
- LTX 2 Full Tutorial | Run on Low VRAM PC + Video & Audio AI Generation (2026 Strongest Open-Source?) — Canal de tutoriales / 2026 / https://www.youtube.com/watch?v=ytxbq9ZSgxo — Explica cómo ejecutar LTX-2 de Lightricks, totalmente open source desde enero de 2026 y con un editor de video de escritorio como LTX-2.3 desde marzo, en equipos con poca VRAM.
- Best Open-Source AI Video in 2026: WAN 2.2 vs LTX 2.3 — Canal de comparativas / 2026 / https://www.youtube.com/watch?v=ZZ5VH-rqHXQ — Compara Wan 2.2 y LTX 2.3, dos principales opciones de video open source.
- Inpaint Canvas for ComfyUI: Krita-Style Layers, Colour Match & Retouch in One Node — Canal de análisis de ComfyUI / principios de septiembre de 2026 (dos semanas antes de la publicación) / https://www.youtube.com/watch?v=Lz7AT8SByx8 — Presenta «Inpaint Canvas», nodo personalizado open source de ComfyUI lanzado el 2026-09-05, con capas, selecciones, selección asistida por SAM y exportación PSD, convirtiendo ComfyUI en una herramienta de pintura más completa.
Señales
- La mayor noticia del código cerrado es el cierre de Sora 2: Sora 2 fue anunciado de forma espectacular a finales de septiembre de 2025, pero su aplicación cerrará apenas medio año después (2026-04-26) y su API estaba programada para finalizar el 2026-09-24, el día posterior a la investigación realizada el 2026-09-23. Varios videos de análisis mencionan informes de costes operativos de aproximadamente un millón de dólares al día frente a solo 2,1 millones de dólares de ingresos de pago acumulados. La alianza con Disney, que se decía valorada en unos 1.000 millones de dólares, también habría fracasado justo antes del anuncio.
- La generación de imágenes sigue recibiendo actualizaciones rápidas de Google, OpenAI y Midjourney: Nano Banana 2 (Gemini, 2026-02), GPT Image 2.5 / ChatGPT Images 2.5 (2026-09-08, con Sketch) y Midjourney V8→V8.1→V8.2 (2026-03–08, con el modelo de edición abierto a todos) muestran que los actores cerrados siguen presentando nuevos modelos cada pocos meses.
- El contenido comparativo sobre una “guerra” de generación de video se ha normalizado: hay muchos videos y Shorts que comparan Sora 2, Seedance 2.0, Runway Gen-4.5, Kling 3.0 y Grok Imagine. Esto sugiere que el interés se desplaza de la lealtad a una herramienta a identificar cuál es la mejor en cada momento.
- Alibaba (Wan), Tencent (HunyuanVideo), Black Forest Labs (FLUX) y Lightricks (LTX) son los principales frentes del open source: todos publican modelos en Hugging Face/GitHub y generan una gran cantidad de tutoriales para ComfyUI y GPU local. Wan está ampliando rápidamente sus capacidades, desde diálogo y sincronización labial hasta filmación multi-plano (2.5→2.6).
- El ecosistema ComfyUI se consolida como el “panel de conexiones” de la IA generativa: solo en septiembre de 2026 aparecieron de manera consecutiva nuevos nodos como Core Sparse Attention Node, Comfy Compiler, Inpaint Canvas, MiniMax H3 RefMods y Krea2T Enhancer. Su importancia como capa intermedia para llevar modelos abiertos a producción crece.
- Adobe Firefly se convierte en un hub de agregación de herramientas cerradas y abiertas: además de sus propios modelos, integra más de 30 modelos externos en un único espacio de trabajo, incluyendo Runway Gen-4.5, Google Nano Banana Pro, generación de imágenes de OpenAI y Black Forest Labs FLUX.2 [pro]. El movimiento empresarial también se orienta a combinar herramientas, no a elegir una sola.
- Una parte considerable de los videos de reseña y comparación utiliza títulos sensacionalistas: proliferan títulos como «BEST AI Image Generator in 2026 (Don't Choose Wrong!)», de modo que la propia elección de modelo se ha convertido en contenido, a veces más que la información técnica real.
Limitaciones
- Las páginas de resultados y de videos de YouTube requieren renderizado JavaScript; WebFetch solo devolvía el pie de página y no permitía obtener reproducciones, suscriptores ni fechas reales. Por ello, el informe se apoya únicamente en fechas y resúmenes de los fragmentos de WebSearch, y no incluye cifras de visualizaciones exactas.
- Algunos videos, como los relacionados con Wan 2.6 y comparativas de HunyuanVideo, solo podían fecharse como «2026», sin mes. No se pudo confirmar estrictamente el criterio de «últimos 60 días»; se priorizaron los elementos cuya actualidad era más clara, como las noticias del cierre de la API de Sora, ChatGPT Images 2.5 e Inpaint Canvas.
- No se encontró un video oficial de YouTube que anunciara directamente el cierre de la API de Sora el 2026-09-24; solo se identificaron videos posteriores de canales de análisis.
- Las consultas realizadas no posicionaron canales o videos japoneses de YouTube, por lo que predomina la información anglófona.
Bluesky
Bluesky — Últimas tendencias de IA generativa de imágenes y video
Cuentas
- @stabilityai.bsky.social — Cuenta oficial de Stability AI. Sin embargo, en la segunda mitad de 2025 se centró en Stable Audio y alianzas empresariales más que en modelos de imagen, con casi 0 likes.
- @midjourneyofficial.bsky.social — Cuenta oficial de Midjourney. Anunció su llegada a Bluesky en agosto de 2025, pero su última publicación es del 8 de octubre de 2025 y no hay noticias recientes.
- @promptheroofficial.bsky.social — Cuenta oficial de PromptHero, servicio para compartir prompts. Publica avisos sobre compatibilidad con modelos cerrados como Sora 2.
- @ethanhe.bsky.social — Ingeniero del equipo Grok Imagine de xAI, antes en NVIDIA/Meta. Es una de las pocas personas internas que comunica directamente novedades y contrataciones de Grok Imagine.
- @chorizemabang.bsky.social — Usuario japonés que genera video con Grok Imagine. Ofrece quejas e informes de fallos desde la perspectiva de uso real.
- @metalmickey.bsky.social (澤村徹) — Artista residente en Tokio que crea videoclips y piezas de exposición combinando Seedance 2.5, GPT-6 y Suno V6. Comparte costes reales de producción.
- @you32081.bsky.social — Creador que produce numerosas ilustraciones R-18 con modelos abiertos como Qwen-Image y Z-Image-Turbo.
- @lijack1001.bsky.social — Cuenta de spam SEO que publica masivamente sitios clonados/afiliados de Nano Banana Pro, Seedance, Sora 2, Veo 3, Wan y GPT-5 Image. No es una fuente de noticias, pero sirve como indicio de qué nombres de modelos se tratan como palabras clave rentables.
- @runwayml.bsky.social / @blackforestlabs.bsky.social / @comfy-ui.bsky.social — Existen los handles oficiales de Runway, Black Forest Labs y ComfyUI, pero sus publicaciones están prácticamente vacías o se limitan a una entrada de 2024, por lo que están de facto inactivos.
Publicaciones
- PromptHero: «Sora 2 is now available on Prompthero: No watermarks, Available in Europe, Combine it with other models» — 2025-10-13, 0 likes/0 reposts. Publicación
Cerrado. Indica que un servicio de prompts de terceros revende Sora 2 como «sin marcas de agua» y disponible en Europa. - xAI · Ethan He: «Excited to share our most advanced image generation model at xAI! Grok Imagine Quality mode — enhanced details, stronger text rendering...» — 2026-04-05, 0 likes/0 reposts. Publicación
Cerrado. Un ingeniero oficial anuncia Quality mode para Grok Imagine, con mayor detalle y mejor renderizado de texto. - xAI · Ethan He: anuncio de contratación de entrenadores de video «familiarity with AI video generation tools (Grok Imagine, Runway, Kling, Sora, Veo, or similar)» — 2026-03-29. Publicación
Cerrado. Evidencia de inversión de xAI en personal para crear datos de entrenamiento de modelos de video, mencionando Runway, Kling, Sora y Veo como referencias. - @chorizemabang: «Grok Imagine ya prácticamente no genera nada, pero también tiene su encanto crear con calma una obra al día.» — 2026-06-05, 13 likes/1 repost. Publicación
Cerrado. Informe de un usuario sobre fallos de generación de Grok Imagine. - @chorizemabang: «Como Grok Imagine está acabado, comparto obras anteriores a modo de disculpa…» — 2026-05-31, 11 likes/1 repost. Publicación
Cerrado. Junto con la publicación anterior, respalda que Grok Imagine tuvo problemas de estabilidad en mayo–junio. - @metalmickey: «road movie rain version. Stitched Seedance2.5's 30-second clips. Fees are devastating.» — 2026-08-27. Publicación
Cerrado. Producción real de una road movie de IA de unos cinco minutos a partir de clips de Seedance 2.5, acompañada de una queja por su alto coste. - @metalmickey: «Intenté crear un videoclip totalmente delegado a la IA sin escribir una sola línea de prompt. GPT-6 Astra permite un flujo de trabajo dirigido por voz.» — 2026-09-07. Publicación
Cerrado. Ejemplo de un nuevo flujo de trabajo de producción de videoclips con instrucciones solo por voz mediante GPT-6 Astra. - Stability AI: «We're launching our Stability AI Image Services on Amazon Bedrock, bringing professional-grade image editing capabilities...» — 2025-09-18, 0 likes/0 reposts. Publicación
Orientado a API cerrada. Servicio de edición de imágenes —inpainting y transferencia de estilo— en AWS Bedrock. - Midjourney oficial: «#Midjourney is now on BlueSky! Who are the best creators to follow here?» — 2025-08-15, 41 likes/4 reposts. Publicación
Aunque Midjourney es cerrado, esta publicación fue seguida de una interrupción casi completa de su actividad en Bluesky; es un caso de entrada sin consolidación. - @you32081: publicación de ilustraciones R-18 realizadas con Qwen-Image / Z-Image-Turbo — 2026-08-01, 6 likes/0 reposts. Publicación
Open source. Ejemplo de cómo modelos chinos de pesos abiertos, Qwen-Image y Z-Image-Turbo, se han asentado como herramientas de producción en círculos doujin y R-18.
Señales
- No existe en Bluesky un hub potente especializado en noticias de IA generativa de imágenes/video. Las cuentas oficiales de Midjourney, Stability AI, Runway, Black Forest Labs y ComfyUI casi no tienen publicaciones recientes ni interacción; están de facto inactivas. No funciona como espacio de debate inmediato comparable a X o Reddit.
- Los temas sobre herramientas cerradas aparecen casi exclusivamente a través de cuentas personales internas de las empresas. La única persona que publicaba regularmente era Ethan He de xAI (@ethanhe.bsky.social), con anuncios prácticos sobre Quality mode y contratación de entrenadores de video en marzo–abril de 2026.
- Hay indicios de que Grok Imagine se volvió inestable en mayo–junio de 2026. El usuario japonés @chorizemabang publicó varias veces que ya no podía generar y que el servicio «estaba acabado» (2026-05-31, 2026-06-05), a pesar de que xAI había anunciado mejoras en abril. Es posible que la operación no siguiera el ritmo de la expansión.
- Como registro de trabajo real, destaca Seedance 2.5 de ByteDance. La artista tokiota @metalmickey produjo en agosto de 2026 una road movie de IA de unos cinco minutos con clips de Seedance 2.5 y se quejó repetidamente de los precios elevados: una dificultad concreta de una herramienta cerrada/API de pago.
- Las menciones de herramientas abiertas (Flux, Wan, Qwen-Image, Z-Image-Turbo, HunyuanImage, ComfyUI) aparecen de forma fragmentaria como hashtags en publicaciones de arte R-18/doujin, no como noticias. No se encontró en Bluesky un divulgador de noticias especializado equivalente a r/StableDiffusion.
- Abunda el spam SEO/de afiliación basado en nombres de modelos. Cuentas como @lijack1001 publican de forma mecánica enlaces a clones relacionados con «Nano Banana Pro», «Seedance 2.0», «Sora 2», «Veo 3», «Wan 2.2» o «GPT-5 Image». Pueden indicar demanda de búsqueda, pero no tienen valor como fuente de noticias.
- Nano Banana Pro, de Google, se menciona con frecuencia en círculos de arte R-18/IA. Aparece en hashtags y biografías junto a Ideogram 4 y Krea 2, lo que sugiere que se ha establecido como una de las herramientas comerciales de uso actual.
Limitaciones
- La API oficial de búsqueda de texto completo de Bluesky (
app.bsky.feed.searchPosts) devolvió HTTP 403 para todas las consultas realizadas (Stable Diffusion,Midjourney,Flux,test, etc.) y no pudo utilizarse en ningún momento.app.bsky.actor.getProfile,app.bsky.actor.searchActorsyapp.bsky.feed.getAuthorFeedfuncionaron, por lo que la investigación se limitó al método indirecto de buscar cuentas y consultar sus publicaciones. - La versión web de
bsky.appes una SPA con renderizado del lado cliente; al recuperarla solo devolvía una página vacía y fue necesario recurrir directamente a la API JSON pública. - Al no disponer de búsqueda de texto completo, es muy probable que se hayan omitido publicaciones relevantes de cuentas desconocidas difíciles de descubrir por búsqueda o relaciones de seguimiento. No se puede separar si la ausencia de cuentas especializadas en noticias open source se debe a que no existen o a la limitación de descubrimiento.
- Se investigaron las cuentas oficiales de Stability AI, Midjourney, Runway, Black Forest Labs y ComfyUI, pero ninguna tenía novedades recientes sobre modelos de imagen/video. Esto describe la plataforma Bluesky, no la presencia o ausencia de interés en otras plataformas.
Lemmy
Lemmy — Noticias de IA generativa de imágenes y video (open source/código cerrado)
Lemmy es un foro federado de pequeña escala. Los temas de generación de imágenes con IA se concentran principalmente en !«メールアドレス» y comunidades cercanas, así como en !«メールアドレス», que refleja r/ArtificialInteligence mediante publicaciones automáticas de bots. Se utilizaron la API de búsqueda de lemmy.world (/api/v3/search) y búsqueda web con términos como «image generation», «video generation», «Stable Diffusion», «Flux», «Qwen Image», «Sora», «Midjourney», «Nano Banana», «Grok Imagine» y «ComfyUI».
Comunidades
!«メールアドレス»— 5.713 suscriptores. Publicaciones técnicas sobre modelos de imágenes/video de pesos abiertos y ComfyUI.!«メールアドレス»— 2.361 suscriptores. Principalmente obras generadas; escaso contenido noticioso.!«メールアドレス»— Publica cada día numerosas imágenes estilo anime generadas vía civitai; son obras, no artículos de noticias.!«メールアドレス»(Free Open-Source AI) — 4,84K suscriptores (1,81K locales). Trata de IA open source en general, pero contiene pocas publicaciones específicas sobre generación de imágenes/video.!«メールアドレス»— Comunidad que refleja automáticamente r/ArtificialInteligence. Debe tenerse en cuenta que no representa debate originado en Lemmy.!stable_diffusion_abstraction(50 personas) /!stable_diffusion_furry(52 personas) /!stable_diffusion_mycology(97 personas) — Comunidades de obras compartidas muy nicho y de pocos suscriptores.
Publicaciones
Orientadas a open source
-
Qwen-Image-2.1 in ComfyUI: Open-Weight Image Generation and Editing, Now with Transparency
!«メールアドレス», 2026-09-22, puntuación 9
https://blog.comfy.org/p/qwen-image-21-in-comfyui-open-weight
Modelo de generación y edición de imágenes de pesos abiertos y 7.000 millones de parámetros del equipo Qwen de Alibaba. Admite salida RGBA transparente para logotipos y recursos recortados, resolución nativa de 2048×2048 y hasta 10 imágenes de referencia; está integrado de forma nativa en ComfyUI. -
Qwen-Image-2.1: Compact, efficient, and unified image creation
!«メールアドレス», 2026-09-20, puntuación 1
https://qwen.ai/blog?id=qwen-image-2.1
Anuncio del blog oficial de Qwen; fuente primaria del artículo de ComfyUI anterior. -
supElement/ComfyUI_MinimaxH3_AutoContext: A long video generation solution that breaks through the memory barrier
!«メールアドレス», 2026-09-16, puntuación 1
https://github.com/supElement/ComfyUI_MinimaxH3_AutoContext
Extensión de ComfyUI para MiniMax H3. Divide automáticamente los videos en segmentos y los conecta mediante anclaje latente, evitando las limitaciones de VRAM en la generación de video largo. Apache-2.0, 31 estrellas y 153 commits. -
Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder
!«メールアドレス», 2026-09-16, puntuación 3
https://github.com/Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder
Herramienta de construcción de prompts para MiniMax H3 dentro de ComfyUI. Otro ejemplo de actualizaciones activas en el ecosistema de flujos de trabajo de video local. -
Boogu-Image-0.1 — Efficient Image Generation Foundation Model
!«メールアドレス», 2026-06-17, puntuación 5
https://boogu.org/
Publicación de un nuevo modelo fundacional de generación de imágenes open source que prioriza ligereza y eficiencia. -
AI video generation is becoming less about the model and more about the workflow
!«メールアドレス»(espejo de Reddit), 2026-09-19, puntuación 1
https://www.reddit.com/r/ArtificialInteligence/comments/1wkl4db/
Publicación que sostiene que, en generación de video, los flujos de trabajo con modelos de pesos abiertos y estilo ComfyUI determinan más la calidad que el modelo aislado.
Orientadas a código cerrado
-
OpenAI is shutting down Sora's API next week while a Chinese competitor raised $3B
!«メールアドレス»(espejo de Reddit), 2026-09-20, puntuación 1
https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/
La API de Sora 2 de OpenAI estaba prevista para cerrarse el 24/9, mientras la aplicación ya había cerrado en abril; se contrapone a los 3.000 millones de dólares recaudados por Kuaishou (Kling). El tono es que el producto de consumo espectacular fracasa mientras las aplicaciones empresariales discretas son las rentables. -
Midjourney pivots from AI image generation to body scanning medical spa (artículo de contexto; gran giro de junio que sigue teniendo impacto)
!«メールアドレス», 2026-06-18, puntuación 58
https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-to-medical-devices/
Informe de que Midjourney giró de la generación de imágenes con IA a un negocio de dispositivos médicos, incluidos escáneres CT por ultrasonido. Hay también publicaciones relacionadas en!«メールアドレス», «Midjourney Medical» y «Midjourney Ultrasonic CT Scanner», ambas del 2026-06-18. -
Midjourney wants Hollywood studios to reveal the details of their AI usage
!«メールアドレス», 2026-07-05, puntuación 73
https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-ai-usage/
Continuación que muestra que, aun tras el giro hacia medicina, Midjourney sigue enfrentándose a Hollywood por copyright y uso de IA generativa de imágenes/video. -
Google lanciert KI-Bildgenerierung Nano Banana 2 Lite
!«メールアドレス», 2026-07-02, puntuación 0
https://www.itmagazine.ch/artikel/87529/
Noticia tecnológica suiza sobre el lanzamiento por Google de «Nano Banana 2 Lite», modelo de generación de imágenes de la familia Gemini. También existe una publicación en!«メールアドレス»que enlaza a la fuente primaria de deepmind.google, del 2026-06-30. -
Seedream 5.0 Pro is here: an honest comparison and technical breakdown
!«メールアドレス»(espejo de Reddit), 2026-07-10, puntuación 1
https://www.reddit.com/gallery/1usc03q
Publicación de reseña y comparación del modelo cerrado Seedream 5.0 Pro de ByteDance. -
Google quietly discontinues its Earth AI feature a day after its rollout after users made no-no images
!«メールアドレス»(espejo de Reddit), 2026-08-07, puntuación 1
https://fortune.com/2026/08/07/
Informe de que Google retiró la función «Earth AI» un día después de lanzarla debido a imágenes problemáticas generadas por usuarios: ejemplo de problemas de guardrails en un proveedor cerrado. -
Elon Musk maakt complete AI-film met zijn versie van The Odyssey
!«メールアドレス», 2026-07-22, puntuación 1
https://lemy.nl/post/4342454
Artículo en neerlandés sobre Elon Musk creando una película con su interpretación de «La Odisea» usando funciones de generación de video de Grok (xAI). Tema con fuerte tono de marketing del campo cerrado. -
Same Berserk spread, 4 AI colorizations. Looks like GPT wins again?
!«メールアドレス»(espejo de Reddit), 2026-09-14, puntuación 1
https://www.reddit.com/gallery/1wfyqdy
Publicación que compara la colorización de una misma página de manga con cuatro IA, incluido un modelo de imagen GPT, y concluye que GPT parece ganar de nuevo.
Señales
- En Lemmy, el «debate vivo» sobre IA generativa de imágenes/video se limita casi por completo a publicaciones de herramientas alrededor de ComfyUI en
!«メールアドレス»y a espejos de Reddit en!ai_reddit. Hay pocas noticias originales de Lemmy. - Del lado open source, la frecuencia de publicaciones sobre «flujos de trabajo/extensiones de ComfyUI» supera a la de modelos aislados. Dos extensiones para MiniMax H3 aparecieron consecutivamente en la última semana, señal de actividad en la capa de herramientas prácticas de video.
- Del lado cerrado, destacan las noticias de «retirada o cambio de rumbo»: cierre de la API de Sora, giro de Midjourney hacia dispositivos médicos y retirada inmediata de Earth AI de Google. Se habla más de fallos de monetización y correcciones de trayectoria que de lanzamientos espectaculares.
- Comunidades de obras compartidas como
!«メールアドレス»tienen muchas publicaciones, pero son listas de imágenes de civitai sin carácter noticioso.
Limitaciones
- La escala de Lemmy es muy pequeña en comparación con Reddit/X: incluso
!«メールアドレス»tiene solo 5.713 suscriptores. Lemmy por sí sola no dispone de suficiente volumen de noticias propias para cumplir el objetivo de analizar unas 20 publicaciones (encaja con el rango previsto de 5–12 en el playbook). !ai_redditno representa debate nativo de Lemmy, sino republicaciones automáticas de Reddit, con casi cero comentarios; la reacción de la propia comunidad de Lemmy es prácticamente inobservable.- El endpoint oficial
/api/v3/communityde Lemmy requería a menudocommunity_id, y algunas comunidades comoaiwarso búsquedas directas deimageaidevolvían errores 400/404. Esos casos se completaron solo a partir de resultados de búsqueda web. - Las búsquedas de modelos de video concretos como «Wan», «HunyuanVideo» o «Kling» producían mucho ruido por colisión con términos generales o abreviaturas, y no se encontraron publicaciones claramente originadas en Lemmy para esos modelos.
Pinterest — Noticias de IA de generación de imágenes y video
Temas visuales
- Formato de miniatura de YouTuber «AI NEWS»: creadores barbudos sorprendidos o emocionados frente a logos neón en cuadrados redondeados de OpenAI, Google, Microsoft, Meta y Notion, dispuestos en una cuadrícula; es el estilo de pin que más se repite. [1, 8, 30]
- Imágenes hero de SaaS para herramientas de generación de video con IA: maquetas de interfaz azul marino/morada con una caja brillante de «prompt de texto → generar», o una simpática mascota robot blanca con claqueta, junto a filas de iconos de funciones (Texto a video / Edición por IA / Banda sonora automática / Subtítulos). [6, 11, 16]
- Gráficos comparativos de «mejor herramienta» y listas clasificadas: matrices de decisión con bordes neón y tarjetas «My Top Picks» que comparan ChatGPT Plus, Midjourney, Gemini, Ideogram, Kling, Runway, Luma y Pika por precio y caso de uso. [10, 20]
- Imágenes de advertencia sobre deepfakes y desinformación: sellos rojos de goma «FAKE», lupas sobre un «?», un ojo mitad humano mitad malla, una insignia de detector de voz «97% likely AI generated» y el texto «AI GENERATED NEWS CLIP» sobre un presentador fabricado. [4, 27, 38, 49]
- Anuncios de apps de face-swap y mezcla de identidades: dos rostros que se disuelven en una malla triangulada («Professional Face Swap») y un tríptico madre + padre → hijo predicho («AI Baby in Seconds»). [43, 44]
- Fantasía generada por IA usada como demo de estilo o cebo de interacción: una nutria hiperrealista con chaleco salvavidas sobre una tabla de surf, un retrato de pescador anciano y un collage fantástico (castillo, oso polar, pareja samurái, tarta) que exhiben calidad de generación más que informar. [13, 34, 45]
- Infografías explicativas en lenguaje sencillo: un diagrama de 8 pasos sobre cómo la IA genera video (prompt → comprensión de lenguaje → espacio latente → difusión de fotogramas → comprobación de consistencia → salida), dirigido a público general, no a desarrolladores. [12]
- Imágenes sobre disrupción en redacciones y economía de avatares: un collage de sala de control con presentadores renderizados por IA llenando pantallas, una cuadrícula de avatares de influencers estilizados tras un rostro fotorrealista y un gráfico de caminos divididos «Human Journalism vs Machine-Generated Media». [38, 40, 23]
Pines destacados
- #1 — «AI News: Anthropic Leak Shows Us The Future of AI...»: miniatura arquetípica de creador sorprendido con logos de OpenAI/Google/Microsoft/ChatGPT; establece la plantilla visual que copian muchos otros pines de «AI NEWS».
- #3 — «Google announces ultra-high quality video...»: cuadrícula de 3×5 que transforma un video fuente en estilos «bloques de madera / origami / Lego / flores»; una demo concreta de restilización de video tipo Lumiere, no solo una tarjeta de titular.
- #10 — «AI Image Video: Best Quality vs Best Free»: matriz de decisión completa (10 herramientas de pago, 10 gratuitas y casos de uso); el artefacto más claro de la ansiedad por «qué herramienta de IA uso realmente» presente en la muestra.
- #12 — «AI & Machine Learning: How AI Generates Video Infographic»: explicador de LivePhysics.com sobre un proceso de difusión/predicción de fotogramas en 8 pasos, dirigido a principiantes; útil como referencia para «explicárselo a un amigo».
- #27 — «AI is getting scary good»: combina generadores de video con IA, detectores de voz («97% likely AI generated») y ética de IA en una infografía; es la condensación más intensa del tema de ansiedad por deepfakes.
- #38 — «AI News Anchors & Creator-Led Coverage Take Over U.S. Media»: collage de una redacción con presentadores renderizados por IA llenando un muro de monitores; visualiza directamente la sustitución de talentos de radiodifusión tradicionales.
- #40 — «Het perfecte avatar-tijdperk» en neerlandés (la era perfecta de los avatares): un rostro fotorrealista ante una cuadrícula de avatares de IA estilizados; refleja la tendencia de influencers de IA como resultado de búsqueda específicamente europeo y multilingüe.
- #43 — Akool «Professional Face Swap» (anuncio en español): los rostros de dos mujeres se fusionan mediante una superposición de malla facial; un producto comercial de intercambio de rostros anunciado directamente en Pinterest, no solo comentado.
- #44 — «AI Baby in Seconds»: tríptico madre/hijo predicho/padre; subgénero distintivo en crecimiento (generadores de bebés por IA) que apareció como grupo propio de pines, no como caso aislado.
- #49 — «You Are Not Prepared for This Terrifying New Wave of AI-Generated Videos»: un falso presentador generado por IA, identificado dentro del propio encuadre como «AI GENERATED NEWS CLIP»; el pin de advertencia más directo de la muestra.
Señales
- La fatiga por decidir herramientas es el ángulo dominante para el consumidor. Una gran proporción de pines son gráficos comparativos, matrices de «mejor gratis vs. de pago» y tarjetas de «mis selecciones», en vez de noticias de un lanzamiento individual. Los usuarios de Pinterest parecen buscar más guía de compra/adopción que anuncios. [10, 20, 29]
- La ansiedad por deepfakes y desinformación es un género visual propio, no una nota al pie: sellos FAKE, insignias de detectores de voz y etiquetas de divulgación «generado por IA» aparecen casi tan a menudo como el contenido promocional de herramientas. [4, 27, 38, 41, 49]
- La tendencia de presentadores de noticias con IA tiene tracción visual real: varios pines independientes —collages de salas de control, contenido de presentadores de Channel1 y etiquetas de «AI generated news clip»— tratan a los presentadores IA como fenómeno actual, no hipotético. [38, 49, 50]
- Ausencia: el open source es casi invisible. En toda la muestra, la única herramienta claramente local/abierta es «Amuse 3.0» de AMD [34]; no hay capturas de Stable Diffusion, ComfyUI ni interfaces de modelos locales, frente a una presencia muy intensa de logos y maquetas cercanos a herramientas cerradas (ChatGPT, Gemini, Midjourney, Kling, Runway y Luma).
- Ausencia: no aparecieron capturas directas de los modelos cerrados más nuevos. La muestra no mostró interfaces nativas de Sora 2, Nano Banana o Veo 3; la mayor parte de los pines cerrados son miniaturas de afiliados o creadores que hablan de las novedades, no imágenes del producto.
- Señal de cautela: el pin #47, titulado «Elon Musk's New AI Already Being Used to Generate...», muestra en realidad una composición de Donald Trump y una mujer haciendo pulgar arriba en una cabina, con el World Trade Center en llamas al fondo; el título no describe la imagen. Es un ejemplo concreto de imágenes realistas compuestas por IA sobre desastre/política que circulan con títulos clickbait no coincidentes, y recuerda que no se puede confiar en que los títulos de los pines describan su contenido.
Limitaciones
- No se definieron géneros para esta recopilación (una única búsqueda sin filtrar de «Image and Video Generation AI News»), de modo que los 50 pines mezclan miniaturas de creadores, anuncios de productos, fotografía de stock e imágenes de estilo noticioso, sin clasificación previa por tema.
- De las 50 imágenes recopiladas, solo se abrieron e inspeccionaron visualmente 26, una muestra representativa que priorizaba variedad de título y tema; las conclusiones se basan en esa muestra.
- Varios títulos no coincidían con sus imágenes —especialmente el #47—, por lo que cualquier tema construido solo a partir de la tabla de títulos sería poco fiable. El informe se basa en lo que las imágenes muestran realmente.
- Los pines de Pinterest no incluyen recuentos de repins o likes en los datos recopilados; por ello, «qué es tendencia» se infiere de la frecuencia con que se repite un estilo visual, no de popularidad medida.
- Pinterest se inclina por contenido secundario y derivado —miniaturas, cabeceras de blog y creatividad publicitaria— en lugar de anuncios primarios de productos. Para confirmar afirmaciones concretas sobre productos/versiones, como detalles exactos de Veo o Kling, habría que recurrir a las fuentes primarias de otras plataformas cubiertas en esta ejecución.
Acciones recomendadas
- Seguir el stack local OSS de video (Wan, HunyuanVideo, FLUX.2, ComfyUI + MiniMax H3) como alternativa práctica mientras las herramientas cerradas suben precios y cierran productos.
- Anticiparse al sentimiento a favor de divulgar contenido de IA que crece en Reddit y Pinterest preparando desde ahora mensajes de procedencia y etiquetado.
- Vigilar dónde migran los usuarios tras el cierre de la API de Sora 2 el 2026-09-24; Kling, Seedance y Runway son los beneficiarios probables.
- Considerar la ola de demos de generación en una sola pasada con Opus 5.5/Grok 4.7 en X como un ciclo de hype breve, propio de la ventana de lanzamiento, y no como una amenaza duradera para la atención hacia OSS.
- Monitorizar la tensión de escalado de cómputo de DeepSeek como señal temprana de lo que ocurre cuando la adopción de pesos abiertos supera la infraestructura propia de un operador.
- Responder a la fatiga de comparación «qué herramienta uso» visible en YouTube y Pinterest con contenido comparativo, en vez de noticias centradas en un solo producto.
Imágenes recopiladas


















































Nota sobre la calidad de los datos
Solo YouTube y Pinterest alcanzaron aproximadamente el objetivo de unas 20 piezas del informe; Reddit produjo apenas 12 hilos (en su mayoría subreddits generales ajenos al tema), más de la mitad de las 40 publicaciones de X eran ruido de palabras en tendencia no relacionadas, la API de búsqueda de texto completo de Bluesky devolvió 403 durante toda la recopilación y la cobertura se basó únicamente en cuentas conocidas, y Lemmy es simplemente demasiado pequeña (su comunidad principal cuenta con unos 5.713 suscriptores y la mitad de sus publicaciones son espejos de Reddit) para llegar a 20 publicaciones nativas.



