Noticias de IA para generación de imágenes y vídeo — 2026-09-12
El bando de código abierto, especialmente Z-Image, Qwen-Image y MiniMax-H3 de China, se acerca a las alternativas de código cerrado en evaluaciones ciegas. Mientras tanto, Google lanza una ofensiva en todos los frentes con Nano Banana/Veo/Gemini Omni, y Sora de OpenAI muestra señales de desaceleración tras la retirada de modelos de su página de precios y la salida de su responsable.
Resumen de noticias sobre IA de generación de imágenes y vídeo — 2026-09-12
¡Hola! Esta vez investigué a fondo el mundo de la IA para generación de imágenes y vídeo en seis plataformas: Reddit, X, YouTube, Bluesky, Lemmy y Pinterest 🔥 En resumen: mientras Google está atacando a plena potencia tanto en imágenes como en vídeo del lado cerrado, Sora de OpenAI parece estar perdiendo algo de impulso 😳. Por su parte, el código abierto está viviendo un momento muy intenso: los actores chinos (Qwen, Z-Image, MiniMax y Wan) se están acercando de verdad en evaluaciones ciegas 🔥🔥. La investigación en X, sin embargo, fue un fracaso total: no apareció ni una publicación sobre IA de imágenes o vídeo, así que lo dejo claramente señalado como una laguna importante 💦. Además, en todas las plataformas hubo muchísimo debate sobre la incertidumbre y la fiabilidad de distinguir si algo «es IA», y sorprendentemente ese tema tuvo más alcance que las conversaciones sobre rendimiento de modelos 👀
En todas las plataformas
- El protagonismo del código abierto ya es completamente chino 🇨🇳: de forma independiente en YouTube, Bluesky y Lemmy, Qwen-Image, Z-Image (Turbo), MiniMax (H3/Hailuo 3.0) y Alibaba Wan aparecen elogiados como los «nuevos reyes». En la clasificación ciega de Bluesky, se dice que Qwen-Image-3.0-Pro está a solo 92 puntos Elo de GPT Image 2 (high), algo realmente impresionante (https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t).
- Google ataca con todo en imágenes y vídeo: entre la reseña de Veo 3.1 en YouTube (https://www.youtube.com/watch?v=sTOFXi2eY_k), la presentación de Nano Banana 2 de Teacher's Tech (https://www.youtube.com/watch?v=nikIxHM_AQY), y el informe en Bluesky sobre una aplicación de escritorio para Windows con «Gemini Omni» (https://bsky.app/profile/itmatterss.bsky.social/post/3mvayanva5c2n), su ofensiva integral se ve muy sólida 💪
- El contenido de «detectar si es IA» es realmente popular: los hilos de verificación de Reddit (r/isthisAI) (https://www.reddit.com/r/isthisAI/comments/1wbspxo/) y las infografías de Pinterest sobre detección de deepfakes y voces de IA se están moviendo de forma independiente. La ansiedad por la autenticidad se ha convertido en un tema transversal. Es llamativo que tenga más difusión que las noticias sobre rendimiento de modelos.
- En todas partes se desconfía de los reclamos de «ilimitado» y «afiliado»: el comentario de Reddit de que los sitios que prometen «unlimited» suelen rozar la estafa (#4, r/generativeAI), y el spam repetido de circuitai.bsky.social sobre WAN 3.0 en Bluesky (más de 15 veces al día) responden al mismo patrón. Los usuarios son razonablemente escépticos ante estos reclamos 😤
- Los usuarios generales apenas distinguen entre abierto y cerrado: en los hilos de recomendaciones de herramientas de Reddit, Qwen, Flux, Seedream, Veo y GPT Image se mencionan en paralelo como una lista de modelos disponibles. Casi no hubo comentarios que destacaran esa diferencia. Hay una brecha considerable entre la estructura de dos ejes solicitada por el informe y la percepción real de los usuarios.
Plataforma por plataforma
Reddit — Se recopilaron 12 hilos (sin alcanzar el objetivo aproximado de 20). Lo que más creció no fue una noticia de un modelo nuevo, sino una publicación indignada por usar GPT-6 para controlar un ratón y crear falsos timelapses de dibujo a mano (r/antiai, 7.146 pt, https://www.reddit.com/r/antiai/comments/1w81kdd/). También aparecieron de forma independiente varios hilos sobre plataformas integradas sin censura y compatibles con NSFW (WildOwl.ai, cyberbara, Tensor.art, etc.), lo que indica demanda.
X — Un fracaso total 😭 Las 40 publicaciones recopiladas trataban de la situación en Yemen, la memecoin $SONG o Chelsea FC, y hubo cero publicaciones relacionadas con IA de generación de imágenes o vídeo. La causa fue que las consultas usadas —palabras de tendencia— no correspondían al tema; la próxima vez habrá que volver a buscar con nombres propios como Midjourney, Sora o Runway.
YouTube — Fue la plataforma con más información esta vez ✨ Del lado cerrado, GPT Image 2/2.5 lidera el Artificial Analysis Image Arena (Elo 1.339, la mayor diferencia histórica entre el primero y el segundo, https://www.youtube.com/watch?v=DY6TkI8XtkQ); Veo 3.1 mejora la sincronización labial, y ByteDance Seedream 5.0 Pro supera a los modelos existentes (https://www.youtube.com/watch?v=WpcxwSNT3X4). Del lado abierto, Black Forest Labs FLUX.2 se discute como un posible «nuevo rey» (https://www.youtube.com/watch?v=YQuTkPVkCS8), Alibaba Z-Image Turbo es considerado el rey de los modelos locales (https://www.youtube.com/watch?v=K0FgDU-9uik), y Lightricks LTX-2 llega a ser llamado el «santo grial del vídeo de código abierto».
Bluesky — Sora podría estar desacelerándose seriamente 👀 Además de una publicación que detectó la retirada silenciosa de sora-2 y sora-2-pro de la página de precios (https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23), hubo una exclusiva según la cual el antiguo responsable de Sora, Bill Peebles, prepara una startup independiente junto a figuras importantes de Hollywood (https://bsky.app/profile/theinformation.com/post/3mv6myz7pa52n). En código abierto, los actores chinos Qwen, Z-Image, MiniMax, WAN 3.0 y SenseNova-U1.5 dominan la conversación.
Lemmy — Es una plataforma pequeña, dependiente de facto de la curación de una sola persona, Even_Adder 😅. Aun así, la principal noticia del lado cerrado es impactante: Midjourney habría pivotado de la generación de imágenes a un negocio de spa médico con escáneres CT por ultrasonido (https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429). Algunos lo ridiculizan como «el regreso de Theranos». Del lado abierto, el ecosistema alrededor de MiniMax-H3 está explotando, con más de siete herramientas de ComfyUI y cuantización lanzadas en una semana.
Pinterest — Se revisaron visualmente los 50 pines 👀 Las herramientas comerciales cerradas (Runway, Pika, Kling AI, Luma, Canva, Hailuo y Synthesia) aparecen casi siempre en las infografías de rankings, mientras que apenas se encontraron pines de código abierto. Hay algunas noticias reales, como material promocional oficial de Google Veo 2/3 y la noticia de un acuerdo de copyright entre ByteDance y Hollywood (MPA) (#31), pero la mayoría son miniaturas de producción masiva para SEO y afiliados. También había un pin con el dato concreto de que «más del 20 % de YouTube es generado por IA» (#44).
Qué vigilar
- Si la desaceleración de Sora es real — Bluesky, detección de retirada de modelos de la página de precios (https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23)
- Hasta dónde puede reducir Qwen-Image-3.0-Pro la distancia con GPT Image 2 — Bluesky, clasificación de evaluación ciega (https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t)
- El ritmo de expansión del ecosistema MiniMax-H3 — Lemmy, conjunto de herramientas para ComfyUI (https://github.com/sepiablue-ai/ComfyUI-MiniMax-H3-W4A4-VSA)
- Novedades del negocio de spa médico de Midjourney — Lemmy, artículo de TheRegister (https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429)
- El desenlace de la disputa por el «rey local» entre FLUX.2 y Z-Image Turbo — YouTube (https://www.youtube.com/watch?v=YQuTkPVkCS8, https://www.youtube.com/watch?v=K0FgDU-9uik)
- La evolución del mercado de plataformas integradas sin censura y NSFW (WildOwl.ai, etc.) — Reddit (https://www.reddit.com/r/AItips101/comments/1w9yftp/)
Recomendaciones
- La próxima investigación en X debería usar nombres propios como Midjourney, Sora, Runway, Kling, Flux y ComfyUI, en vez de palabras de tendencia.
- Conviene seguir vigilando las cuentas de Bluesky que monitorizan las páginas de precios para confirmar la evolución de Sora.
- El indicador más claro para observar la diferencia de rendimiento entre abierto y cerrado es seguir la evolución del Elo de Qwen-Image-3.0Pro frente a GPT Image 2.
- Vale la pena seguir el giro de Midjourney hacia servicios médicos como noticia de estrategia empresarial, más que como noticia tecnológica.
- La recopilación de Reddit debería ampliar las consultas para llegar al objetivo de 20 publicaciones en vez de 12.
- Las infografías de rankings de Pinterest y las publicaciones afiliadas repetitivas de Bluesky no deberían tomarse como fiables por sí solas; solo deberían adoptarse cuando haya confirmación en otras plataformas.
Calidad de los datos
En X hubo cero publicaciones relacionadas con IA de imágenes y vídeo por un error en la selección de consultas, de modo que no hay datos sustanciales sobre el tema. Reddit se quedó en 12 hilos, sin llegar al umbral de aproximadamente 20, y su contenido se inclinó más hacia consultas de herramientas recomendadas que hacia noticias. Pinterest no clasificaba los datos originales entre abierto y cerrado y requirió una reclasificación manual. Lemmy es una plataforma pequeña que depende de facto de la curación de una única cuenta, Even_Adder. En YouTube, las páginas de vídeo se renderizan con JavaScript, por lo que WebFetch no pudo obtener el cuerpo; tampoco se pudieron obtener reproducciones o suscriptores mediante oEmbed. En Bluesky, las búsquedas de ciertas palabras clave (Runway, Kling y Black Forest Labs) siguieron devolviendo errores 403, por lo que se abandonó la recopilación; además, las publicaciones sobre WAN 3.0 estaban inundadas de spam repetitivo.
Resumen por plataforma
Reddit — Noticias de IA de generación de imágenes y vídeo
Dónde
El desglose de los 12 hilos recopilados abarca los siguientes 9 subreddits.
| Subreddit | Miembros | Hilos recopilados |
|---|---|---|
| r/isthisAI | 408,823 | 1 |
| r/antiai | 322,973 | 1 |
| r/GetNoted | 298,488 | 1 |
| r/generativeAI | 152,415 | 3 |
| r/aiwars | 167,809 | 1 |
| r/hatethissmug | 134,660 | 1 |
| r/aivideomaking | 6,823 | 2 |
| r/GoogleFlow | 1,884 | 1 |
| r/AItips101 | 1,299 | 1 |
Destaca la participación de grandes subreddits que debaten la conveniencia de la IA generativa en sí misma (r/antiai, r/aiwars, r/isthisAI y r/GetNoted), mientras que los subreddits medianos de presentación y recomendación de herramientas (r/generativeAI y r/aivideomaking) reflejan las tendencias reales de uso.
Qué dice la gente
- 【#6, r/antiai, 7.146 pt / 1.025 comentarios, 2026-09-05】Publicación sobre dar a un LLM (identificado como GPT-6) permiso para controlar ratón y teclado, hacer que «dibuje a mano» en un lienzo digital y hasta falsificar un timelapse. El comentario principal (2.511 pt, u/Nayutantantan) expresa su enfado: «Ya ni me dan ganas de grabar timelapses de mis propias obras, porque los falsos se están volviendo normales». Por sí solo, este hilo fue el que obtuvo con diferencia más reacciones de toda la recopilación. https://www.reddit.com/r/antiai/comments/1w81kdd/
- 【#11, r/GetNoted, 4.470 pt / 325 comentarios, 2026-09-10】Ejemplo de una publicación de X con una imagen generada por IA —con texto deformado parecido a “Handloags” en una imagen de horarios— que se convirtió en objeto de burla. Los comentarios principales se ríen de la mala calidad de la generación. https://www.reddit.com/r/GetNoted/comments/1wcw3n9/
- 【#1, r/AItips101, 145 pt / 83 comentarios, 2026-09-07】«Ranking 2026 de generación de imágenes con IA sin censura». WildOwl.ai ocupa el primer puesto y se presenta como acceso por pago por uso a más de 35 modelos, incluidos Qwen Image, Flux, Seedream, Wan, Kling, Seedance, Veo y GPT Image, sin cuota mensual y con créditos sin caducidad. Un comentario (u/reliablemicrophone84, 4 pt) está de acuerdo: «Me ayuda porque en otros sitios desperdiciaba créditos al chocar contra filtros». Por otro lado, u/Pretend_Program_3696 (3 pt) recomienda Perchance/Uncensored.ai; las opiniones están divididas. https://www.reddit.com/r/AItips101/comments/1w9yftp/
- 【#8, r/aivideomaking, 4 pt / 21 comentarios, 2026-09-09】Ante la pregunta «Busco herramientas gratuitas o con créditos para generar imágenes y vídeo fotorrealistas», se enumeran OpenartAI, fal, dzine, pixverse, Higgsfield y RunningHub —que permite usar modelos OSS y cerrados mediante ComfyUI—. u/zeroludesigner comenta que «Seedance 2.5 de cyberbara no tiene censura y admite rostros reales». https://www.reddit.com/r/aivideomaking/comments/1wbxpdf/
- 【#3, r/generativeAI, 0 pt / 7 comentarios, 2026-09-11】Hilo en busca de una herramienta de generación de imágenes/vídeo con NSFW que funcione enteramente en el navegador. u/MisterZan25 organiza recomendaciones de RunDiffusion/Tensor.art (imágenes y consistencia de personajes), PornGen/PornJourney y alternativas tipo espejo de Pika Labs (vídeo). u/frighten (1 pt) recomienda «PixelForge», una app exclusiva para iPhone, local y sin censura. https://www.reddit.com/r/generativeAI/comments/1wdkbxv/
- 【#4, r/generativeAI, 1 pt / 11 comentarios, 2026-09-07】A la pregunta «¿Cuál es el servicio más barato e ilimitado para imagen a vídeo a 1080p?», se propone Artlist.io (€550/año). Pero varios comentarios critican la etiqueta «ilimitado»: u/ai_art_is_art (3 pt) afirma que «los sitios que anuncian “unlimited” suelen rozar la estafa; pagas $550, solo generas por valor de $200 y tienes que esperar 24 horas». https://www.reddit.com/r/generativeAI/comments/1wa4k88/
- 【#5, r/aivideomaking, 16 pt / 38 comentarios, 2026-09-07】A la pregunta «Quiero generar gratis un vídeo de 45 segundos solo con móvil/iPad», u/NewLifeWares (2 pt) responde con calma que «45 segundos exige prácticamente infraestructura de centro de datos; gratis, como mucho, tendrás 1 o 2 clips de cinco segundos con marca de agua, y habrá que unirlos». u/GuessingEngineer (2 pt) ironiza: «Si eso pudiera hacerse de una vez, serías el gobernante del mundo». El hilo visibiliza la demanda —y falta de realismo— de combinar gratuidad, alta calidad y larga duración. https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/
- 【#7, r/GoogleFlow, 6 pt / 2 comentarios, 2026-09-10】Se lanza AutoFlow, una extensión de Chrome para generación por lotes en Google Flow (Veo). Implementa generación por lotes, continuación desde el último fotograma del clip anterior y edición automática de vídeos narrados con audio/subtítulos; tiene versión gratuita y suscripciones Pro/Ultra. https://www.reddit.com/r/GoogleFlow/comments/1wccmrg/
- 【#12, r/aiwars, 0 pt / 14 comentarios, 2026-09-08】Debate sobre riesgos de derechos de imagen y uso publicitario cuando una persona generada por IA se parece por casualidad a alguien real. u/Upstairs-Mammoth-509 (3 pt) señala que «el caso más problemático es coincidir accidentalmente con el rostro de una persona anónima; las empresas solo pueden comprobarlo con búsqueda inversa de imágenes y cruzar los dedos», destacando el retraso regulatorio. https://www.reddit.com/r/aiwars/comments/1wafe86/
- 【#10, r/hatethissmug, 59 pt / 20 comentarios, 2026-09-12】Diferencias internas dentro del sector anti-IA sobre un vídeo que usa IA mientras la critica. u/AprilsStuff (22 pt) afirma: «Soy anti-IA, pero el debate sobre el coste medioambiental está muy exagerado; decir que “la IA desaparecerá por sí sola” tampoco es realista». Incluso dentro del discurso anti-IA existen desacuerdos. https://www.reddit.com/r/hatethissmug/comments/1wdxv6k/
- 【#2, r/isthisAI, 0 pt / 31 comentarios, 2026-09-09】Hilo para determinar si un vídeo es IA o grabación real. La desaparición y reaparición de un collar (u/smalltiddygothb, 16 pt / u/EmergencyWaffleBox, 14 pt) se considera decisiva, y u/BouncingSphinx (5 pt) comenta que «el hecho de que el vídeo dure exactamente 15 segundos también parece el límite actual de los vídeos de IA». Entre los usuarios generales se está consolidando el uso de límites técnicos —duración e inconsistencias— como criterio de detección. https://www.reddit.com/r/isthisAI/comments/1wbspxo/
Señales
- Lo que crece: menciones independientes en varios hilos a plataformas integradas sin censura y compatibles con NSFW (WildOwl.ai, cyberbara, RunDiffusion, Tensor.art, PixelForge, etc.). Hay una fuerte demanda de combinar acceso a modelos recientes y menor censura.
- Lo que crece: ecosistemas complementarios de herramientas oficiales, como AutoFlow (#7), una automatización de terceros para Google Flow.
- Lo que genera rechazo: las suscripciones que prometen «ilimitado» (#4, como Artlist.io) reciben desconfianza constante por parte de la comunidad.
- Lo que genera rechazo: incluso dentro del sector anti-IA, el argumento que enfatiza el coste medioambiental (#10) recibe críticas internas por exagerado; el discurso anti-IA no es monolítico.
- Lo sorprendente: de los 12 hilos reunidos, los de mayor interacción no fueron lanzamientos de modelos, sino la denuncia anti-IA de falsificar un timelapse de dibujo mediante IA (#6, 7.146 pt) y la burla generada por una imagen de IA (#11, 4.470 pt). En Reddit, los temas de engaño y fiabilidad vinculados a IA se difunden con enorme diferencia por encima de las noticias de producto.
- Lo sorprendente: la distinción entre código cerrado y abierto no es central para los usuarios. En muchos hilos, modelos de ambos grupos (Qwen, Flux, Seedream, Wan, Kling, Seedance, Veo, GPT Image, etc.) se discuten en paralelo como una lista de opciones, y apenas aparecen comentarios que destaquen la diferencia.
Límites
- Solo se utilizó una consulta, "Image and Video Generation AI News", y se recopilaron 12 hilos, sin alcanzar el objetivo aproximado de 20.
- La recopilación consistía en leer material que un trabajador había reunido previamente con un navegador sin interfaz; no se pudo volver a buscar ni consultar Reddit directamente porque Reddit rechaza las páginas solicitadas mediante WebFetch o búsquedas.
- Muchas publicaciones recopiladas son hilos de preguntas y respuestas del tipo «recomienden herramientas», más cercanos a patrones comunitarios de uso que a «noticias». No se encontraron hilos especializados que analizaran claramente las tendencias de código abierto y cerrado.
- r/AItips101 (1.299 personas) y r/GoogleFlow (1.884 personas) son subreddits muy pequeños, por lo que sus hallazgos representan voces individuales más que a toda la comunidad.
X
X — Tendencias de noticias de IA para generación de imágenes y vídeo
Cuentas
Las 40 publicaciones recopiladas proceden de 40 cuentas distintas y cada una aparece una sola vez. Además, ninguna se especializa en IA de generación de imágenes o vídeo (Midjourney, Stable Diffusion, Sora, Runway, Kling, Veo, ComfyUI, Flux, etc.). Los grupos se separan según la consulta.
- Yemen/Saudi (situación de Oriente Medio y OSINT): @tleilax___, @Ahmed175143, @IranTimes72, @citrinowicz, @Osinttechnical, @c14english, @Rusia_HD, @MerruX — cuentas de OSINT/noticias sobre ataques a infraestructura petrolera saudí y el conflicto yemení.
- $SONG (memecoin del ecosistema Cardano): @LagyADA, @EAjdarovic, @JureKaramarko, @SintoAndrej — pequeñas cuentas de especulación y promoción.
- Charlie Kirk (aniversario de un año): @tivent_1, @TruthNetwork24, @mscaradapawjob, @rokkstarrrrrrr — comentarios políticos y reacciones de memes.
- Britain (política británica): @brigantia__, @Steven41849941, @SirJBritain, @BROKENBRITAIN0 — publicaciones nacionalistas sobre inmigración y seguridad.
- Anthropic (economía y seguridad de IA): @restitutorII, @BrianRoemmele, @walterkirn, @claudecode84 — pronósticos de escenarios económicos de Anthropic, código abierto de Claude Code y críticas a la IA. No tratan de imágenes o vídeo, sino de agentes LLM y debates sociales sobre IA.
- Apple/Samsung (debate de móviles): @FlossyCarter, @cagriozturkish, @appleinteligen, @BrandonKHill — provocaciones entre seguidores de móviles plegables.
- Sony (industria del videojuego): @JayDubcity16, @Cris_Uther, @treeblazah, @ScreenCraveHQ — cotilleos sobre Hideo Kojima y películas de Spider-Man.
- "one ai os" (autopromoción de startups de IA): @de1lymoon, @neda_sefati, @harvey_control, @Iamanusbutt — publicaciones de networking de startups de agentes de IA o sistemas operativos empresariales, sin mencionar la generación de imágenes o vídeo.
- Chelsea (fútbol): @declanstar1, @TheHateCentra, @Lea_EFC, @chelcatastr0phe — publicaciones sobre partidos del Chelsea FC.
No hay autores recurrentes suficientes para distinguir entre «alguien que se hizo viral con una publicación» y «alguien que acumuló muchas publicaciones pequeñas». Como mucho, @rokkstarrrrrrr (9.404 me gusta), @TheHateCentra (19.654 me gusta) y @Cris_Uther (17.095 me gusta) fueron quienes más crecieron en una sola publicación, pero todos están fuera del tema.
Publicaciones
Hubo cero publicaciones que mencionaran directamente IA de generación de imágenes o vídeo. A modo de referencia, estas son las más cercanas al tema —aunque siguen sin corresponder—.
-
#21 @restitutorII — 458 likes · 69 reposts · 41 respuestas · ~57.000 visualizaciones · 2026-09-10
https://x.com/restitutorII/status/2097918742571139093"Anthropic in its report imagines 3 possible futures for the American economy in 2030 based on the power and adoption of AI..."
→ Predicciones de escenarios económicos de Anthropic. Trata sobre IA generativa en general, no sobre IA de imágenes o vídeo. -
#24 @claudecode84 — 2.585 likes · 268 reposts · 24 respuestas · ~741.000 visualizaciones · 2026-09-10
https://x.com/claudecode84/status/2097959830942367747«El propio máximo responsable de Anthropic está haciendo de código abierto todo su “entorno de Claude Code”»
→ Trata de la apertura de Claude Code, una IA de programación, no de modelos de imágenes o vídeo. -
#33 @de1lymoon — 49 likes · 6 reposts · 9 respuestas · ~3.500 visualizaciones · 2026-09-11
https://x.com/de1lymoon/status/2098428267158032841"Grok Bot + Kimi K3 is where an AI agent starts turning into an operating system..."
→ Una reflexión sobre orquestación de agentes de IA, sin relación con generación de imágenes o vídeo. -
#22 @BrianRoemmele — 792 likes · 187 reposts · 105 respuestas · ~100.000 visualizaciones · 2026-09-10
https://x.com/BrianRoemmele/status/2098024115231924568
→ Publicación tipo meme que critica a Anthropic y plantea amenazas de IA. No trata de generación de imágenes o vídeo. -
#23 @walterkirn — 723 likes · 91 reposts · 39 respuestas · ~28.000 visualizaciones · 2026-09-10
https://x.com/walterkirn/status/2098059171325427949
→ También en el contexto de críticas a Anthropic y a los medios; no menciona generación de imágenes o vídeo.
Estas cinco publicaciones son todo lo que se pudo recuperar con la palabra clave «AI» y no ofrecen contenido que pueda adoptarse como noticias de IA de imágenes/vídeo, ni de código cerrado ni abierto.
Señales
- Los diez principales temas de X Explore —posiblemente según Croacia, dado que la sesión mostraba «Trending in Croatia»— eran «Yemen», «Saudi», «$SONG», «Charlie Kirk», «Britain», «Anthropic», «Apple», «Sony», «one ai os» y «Chelsea». Ninguno incluía términos de IA de generación de imágenes o vídeo como Midjourney, Sora, Stable Diffusion, Runway, Kling o Veo.
- Que «Anthropic» y «one ai os» estén entre tendencias sugiere actividad sobre agentes de IA y el impacto económico de los LLM en X, pero pertenece a otro grupo de temas distinto del de este informe.
- Ninguna de las 40 publicaciones mencionaba nombres de herramientas de IA de imágenes o vídeo, lanzamientos, demostraciones o comparativas.
Límites
- Las consultas usadas —"Yemen", "Saudi", "$SONG", "Charlie Kirk", "Britain", "Anthropic", "Apple", "Sony", "one ai os" y "Chelsea"— eran las tendencias del día en X Explore, no términos dirigidos a IA de imágenes y vídeo como Midjourney, Stable Diffusion, Sora, Runway, Kling, Veo, ComfyUI o Flux. Por ello, las 40 publicaciones no incluyeron ni una noticia de IA de imágenes/vídeo, ni abierta ni cerrada.
- Como resultado, en esta fase no fue posible producir a partir de X los «10 hallazgos de código abierto y 10 de código cerrado» solicitados por el informe. No es que X «no dijera nada» sobre el tema: la razón exacta es que no se realizó una búsqueda acorde al tema.
- La próxima vez será necesario volver a recopilar utilizando nombres de herramientas y empresas de generación de imágenes/vídeo, como Midjourney, Stability AI, Runway, Pika, Luma, Kling, Sora, Google Veo, Flux y ComfyUI.
YouTube
YouTube — Noticias de IA de generación de imágenes y vídeo (código cerrado/abierto)
Canales
- There's An AI For That — Canal de presentación de herramientas de IA. Publicó una reseña de FLUX.2.
- AI Search — Canal de noticias rápidas sobre modelos nuevos. Vídeos sobre Sora 2 y HunyuanVideo 1.5.
- Theoretically Media — Canal especializado en vídeo de IA. Reseña detallada de Veo 3.1.
- Teacher's Tech — Canal de herramientas prácticas. Reseña de Nano Banana 2.
- Codebreakers — Canal de reseñas y explicaciones de modelos de IA de código abierto. Especial sobre MiniMax H3.
- Bijan Bowen — Canal especializado en IA local para imágenes. Pruebas de Z-Image Turbo.
- Benji's AI Playground — Canal de tutoriales de ComfyUI/generación local. Explicación de Ideogram 4.0.
- Curious Refuge — Canal veterano de formación en producción audiovisual con IA. Reseña de Midjourney V8.
- RandomAI — Canal de noticias y comparativas de modelos nuevos. Explicación de GPT Image 2.5.
- Standarity / The AI Filmmaking Advantage — Canales de noticias rápidas y pruebas comparativas. Resumen del anuncio y prueba completa de Seedream 5.0 Pro.
- MattVidPro AI — Mencionado en vídeos de primeras impresiones de Runway Gen-4.
Vídeos
- «Is FLUX 2.0 The New Open Source King?» — There's An AI For That — https://www.youtube.com/watch?v=YQuTkPVkCS8 — Examina si FLUX.2 de Black Forest Labs puede ser el nuevo rey de la generación de imágenes de código abierto.
- «We have a new #1 open-source AI video generator!» (2025-11-25) — AI Search — https://www.youtube.com/watch?v=6EQP8-D37bs — Reseña e instalación de HunyuanVideo 1.5 en ComfyUI; se presenta como usable incluso con poca VRAM.
- «Sora 2… wtf» — AI Search — https://www.youtube.com/watch?v=El-G4cO4x4I — Compara OpenAI Sora 2 con Veo 3, Kling 2.5 y Hailuo 02; destaca mejoras en sincronización de audio y representación física.
- «Veo 3.1 Is More Powerful Than You Realize!» (2025-10-16) — Theoretically Media — https://www.youtube.com/watch?v=sTOFXi2eY_k — Explica mejoras de Google Veo 3.1 en sincronización labial, consistencia de personajes y escalado a 1080p.
- «The New Gemini Image Generator is Insane (Nano Banana 2)» — Teacher's Tech — https://www.youtube.com/watch?v=nikIxHM_AQY — Presenta que el valor predeterminado de la app Gemini fue reemplazado por Nano Banana 2.
- «MiniMax H3: The New Open-Source Video Champ?» (2026-08-03) — Codebreakers — https://www.youtube.com/watch?v=3R5GROj8Tcg — Presenta MiniMax H3 (Hailuo 3.0), un modelo de vídeo multimodal de pesos abiertos que puede generar vídeo con audio estéreo nativo en una pasada.
- «Alibaba Z-Image Turbo Test – The New KING of LOCAL Image Models» — Bijan Bowen — https://www.youtube.com/watch?v=K0FgDU-9uik — Prueba Z-Image Turbo, bajo licencia Apache-2.0, localmente y lo declara KING.
- «Ideogram 4.0 Released! The New Open Model That FINALLY Gets Text Right» (2026-06-04) — Benji's AI Playground — https://www.youtube.com/watch?v=HY_e5CZfJfQ — Informa de que el primer modelo de pesos abiertos de Ideogram llegó al primer lugar de Design Arena y por fin representa texto correctamente.
- «I Tried Midjourney 8… Here's the Truth» (2026-03-19) — Curious Refuge — https://www.youtube.com/watch?v=i9qV9-2tzEA — Prueba las capacidades de Midjourney V8 con una reseña honesta.
- «GPT Image 2.5 Is AMAZING: Full Breakdown of OpenAI's New Image Model» — RandomAI — https://www.youtube.com/watch?v=DY6TkI8XtkQ — Explica la línea GPT Image 2/2.5 de OpenAI y sus mejoras en representación de texto y soporte multilingüe.
- «ByteDance Seedream 5.0 Pro: The Announcement, Read and Highlighted» — Standarity — https://www.youtube.com/watch?v=g05iPef37Qs — Resume el anuncio de Seedream 5.0 Pro, que permite edición por capas.
- «🚨BREAKING: Seedream 5.0 Pro Just SMOKED Every Image Model (Fully Tested)» (2026-07-16) — The AI Filmmaking Advantage — https://www.youtube.com/watch?v=WpcxwSNT3X4 — Compara y prueba por completo Seedream 5.0 Pro frente a otros modelos, concluyendo que los supera.
Señales
Movimientos del lado de código cerrado
- Se informa que OpenAI GPT Image 2 / 2.5 lidera el Artificial Analysis Image Arena con Elo 1.339 y la mayor diferencia histórica entre el primer y segundo puesto (a septiembre de 2026).
- Google Veo 3.1 y Nano Banana Pro (Gemini 3 Pro Image) se refuerzan como dupla de vídeo/imagen, con una orientación clara a usos profesionales mediante sincronización labial, escalado a 1080p y edición por capas.
- ByteDance Seedance 2.0 (2026-02) y Seedream 5.0 Pro (alrededor de julio de 2026) ganan presencia rápidamente gracias a capacidades multimodales —referencias de texto, imagen, vídeo y audio—.
- Varios vídeos afirman que xAI Grok Imagine 1.5 supera a Veo y Sora en benchmarks, convirtiéndolo en tema de conversación hacia junio de 2026.
- Jugadores existentes como Runway Gen-4/4.5 y Midjourney V8 (V8.1, V8.2) también siguen actualizándose, y abundan las reseñas centradas en «defender el trono».
Movimientos del lado de código abierto
- FLUX.2 de Black Forest Labs recibe varias reseñas que lo describen como el «nuevo rey» entre los modelos de imagen de alta calidad ejecutables localmente.
- Tencent HunyuanVideo 1.5 obtiene soporte nativo de ComfyUI y se perfila como el nuevo estándar de vídeo de código abierto que funciona incluso con poca VRAM.
- Z-Image y Z-Image Turbo de Alibaba/Tongyi-MAI se publican bajo Apache-2.0 y muchos canales los califican como los nuevos reyes de los modelos locales.
- Ideogram 4.0 se lanza como el primer modelo de pesos abiertos de la compañía, obtiene el primer puesto en Design Arena y se subraya su precisión al representar texto.
- MiniMax H3 (Hailuo 3.0) crece rápidamente en agosto de 2026 como un modelo multimodal de vídeo de pesos abiertos que puede ejecutarse en GPU personales como una RTX 3090; se multiplican los vídeos sobre su soporte en ComfyUI.
- Lightricks LTX-2 logra generación de vídeo de código abierto con 4K, 50 fps y audio sincronizado, y se le describe como el «santo grial del vídeo de código abierto».
- Alibaba Wan 2.5/2.6 sigue apareciendo como modelo de vídeo de código abierto que acepta texto, imágenes, audio y vídeo como entradas.
Límites
- Las páginas de resultados de YouTube (
youtube.com/results?...) se renderizan con JavaScript y WebFetch solo devolvía el pie de página, sin títulos, reproducciones ni información de canales. Las páginas individuales (watch?v=) tuvieron el mismo problema; los títulos y canales se confirmaron usando la API oEmbed de YouTube (youtube.com/oembed). - La API oEmbed no devuelve reproducciones, fecha de publicación, suscriptores ni comentarios, por lo que no se pudieron obtener las reproducciones ni los suscriptores requeridos por el playbook. Las fechas solo se incluyeron cuando aparecían en fragmentos de WebSearch; las desconocidas se omitieron.
LTX-2: Open Source AI Video, Released to the Community(zSvCnVi181A) devolvió 403 Forbidden al acceder mediante oEmbed y no pudo verificarse.- Por estas razones, no se pudo revisar el contenido de los comentarios de los vídeos; los resúmenes se basan únicamente en títulos y descripciones.
- Para reforzar las tendencias se combinó información obtenida mediante WebSearch —fragmentos de artículos y blogs relacionados—, pero se confirmó que todos los enlaces de vídeo incluidos son URL reales de YouTube.
Bluesky
Bluesky — Noticias de IA de generación de imágenes y vídeo (código cerrado/abierto)
Cuentas
- theinformation.com / techmeme.com / mediagazer.com / lefiltech.fr — Bots informativos conectados a RSS. Difunden exclusivas sobre OpenAI y Sora en varios idiomas.
- ctxwindow.kynth.studio(#TechBluesky) — Observador que vigila continuamente cambios en la página de precios de OpenAI.
- gen-ai.news — Cuenta individual de noticias rápidas sobre actualizaciones de Midjourney.
- oludai.bsky.social — Opera su propia clasificación de evaluación humana ciega (olud.ai), clasificando por hora modelos de imagen abiertos y cerrados.
- aichina.news — Cuenta tipo bot que informa casi a diario de LoRA basados en FLUX con licencia Apache-2.0 publicados en Modelers.cn de Huawei.
- circuitai.bsky.social — Cuenta de spam/promoción que publica más de una docena de veces al día enlaces afiliados de Alibaba WAN 3.0 (vidhapi.app), casi siempre con el mismo texto.
- arxiv-cs-cv.bsky.social — Publica automáticamente nuevos artículos de arXiv sobre generación de imágenes y vídeo.
- un1v3rse.bsky.social / carlbetheav.bsky.social / stumblegirl.bsky.social / ttaships.airminded.org — Artistas individuales que publican obras diarias con Midjourney (#midjourney #QP #FoxyFriday).
- rin-yamami.bsky.social / satomin6.alimika.jp — Ilustradores de IA japoneses que usan Qwen-Image-Edit y ComfyUI.
Publicaciones
- theinformation.com (2026-09-10, 👍1 🔁0) — Exclusiva: el antiguo responsable de OpenAI Sora, Bill Peebles, crea una startup propia de IA de generación audiovisual junto a Jeffrey Katzenberg, figura importante de Hollywood y ex-DreamWorks, y el antiguo CFO de Dropbox.
https://bsky.app/profile/theinformation.com/post/3mv6myz7pa52n - ctxwindow.kynth.studio (2026-09-08, 👍0/1 🔁0) — Detecta que OpenAI retiró silenciosamente sora-2 y sora-2-pro de la página de precios (precio anterior: 720p $0.05–$0.30). Se presenta como evidencia de una reducción de Sora.
https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23 - somewhattolerable.com (2026-09-06, 👍2) — Observación de que «OpenAI canceló Sora porque ingenieros internos se quejaron de que consumía demasiados recursos».
https://bsky.app/profile/somewhattolerable.com/post/3muuuazkaf223 - itmatterss.bsky.social (2026-09-11, 👍1) — Gemini de Google llega como aplicación de escritorio para Windows, activable con Alt+Space. Indica explícitamente que usa Nano Banana para imágenes y «Gemini Omni» para vídeo.
https://bsky.app/profile/itmatterss.bsky.social/post/3mvayanva5c2n - dimnews.bsky.social (2026-09-11, ruso) — SenseTime anuncia SenseNova-U1.5, un modelo multimodal de 8.000 millones de parámetros, y afirma superar a Nano-Banana-Pro en razonamiento visual.
https://bsky.app/profile/dimnews.bsky.social/post/3mv7u7crnzz25 - gen-ai.news (2026-08-30, 👍1) — Informa de que el modelo de edición Midjourney V8.2 recibió discretamente un parche tras quejas por deterioro de calidad de imagen.
https://bsky.app/profile/gen-ai.news/post/3mudbgowbnz2s - futureautomationai.bsky.social (2026-09-03, 👍2) — Resumen de «Midjourney in 2026»: V8.2, personalización, tableros de estado de ánimo, modelo de edición y funciones de referencia.
https://bsky.app/profile/futureautomationai.bsky.social/post/3mumtnbxuv22d - oludai.bsky.social (2026-09-10/11, 👍1-2) — En su clasificación ciega, el «mejor modelo descargable» es Qwen-Image-3.0-Pro (#12), a 92 puntos Elo de GPT Image 2 (high).
https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t - ddigitalmedia.bsky.social (2026-09-10, 👍1) — Opina que «Qwen, Z-Image y MiniMax son los únicos capaces de competir contra los productos occidentales de LLM/imágenes».
https://bsky.app/profile/ddigitalmedia.bsky.social/post/3mv6lyejx3223 - circuitai.bsky.social (2026-09-11–12, publicaciones repetidas) — Promociona WAN 3.0 de Alibaba como alternativa barata de pago por uso frente a Seedance 2.5 de ByteDance, con hasta 30 segundos por clip. Nota: más de 15 publicaciones afiliadas diarias con el mismo texto.
https://bsky.app/profile/circuitai.bsky.social/post/3mvbvqsdvr22p - minaxlab.bsky.social (2026-09-11) — Anuncia ComfyUI v0.35.1. El entorno local de generación de código abierto sigue actualizándose.
https://bsky.app/profile/minaxlab.bsky.social/post/3mvasr3l72x2i - aichina.news (2026-09-08–09, publicaciones seguidas) — Informa de la publicación consecutiva de LoRA basados en FLUX bajo Apache-2.0 en Modelers.cn de Huawei, pero señala repetidamente que muchos carecen de palabras activadoras y benchmarks, por lo que «no hay evidencia suficiente para afirmar que superen Qwen-Image».
https://bsky.app/profile/aichina.news/post/3mv3vq3zdui24 - arxiv-cs-cv.bsky.social (2026-09-11) — Se publica un artículo que evalúa y mejora la capacidad de razonamiento «Think-with-Video» de modelos de generación de vídeo (From Evaluation to Enhancement).
https://bsky.app/profile/arxiv-cs-cv.bsky.social/post/3mvbfk6tunc2j
Señales
- Sora está en una desaceleración de facto: la retirada de modelos de la página de precios, la salida de su antiguo responsable para fundar una startup rival y la observación de que fue cancelado por consumir demasiados recursos se concentran en el mismo periodo. La generación de vídeo de OpenAI parece adoptar una postura defensiva.
- Google, en cambio, se despliega por completo: integra Nano Banana (imagen), Nano Banana Pro, Veo y Gemini Omni (vídeo) incluso en una aplicación de Windows, aplicando IA generativa en todos los frentes.
- Los protagonistas del código abierto son chinos: Qwen-Image-3.0-Pro, Z-Image (Turbo), MiniMax, Alibaba WAN 3.0 y SenseTime SenseNova-U1.5 concentran la conversación. Varias cuentas sostienen que los modelos abiertos chinos son los únicos que pueden rivalizar con productos occidentales de IA de imagen/vídeo.
- La diferencia con el código cerrado se reduce: en evaluación ciega, Qwen-Image-3.0-Pro se acerca a solo 92 Elo de GPT Image 2 (high), según las mediciones continuas de oludai.bsky.social.
- Atención al ruido y la promoción: gran parte de las publicaciones sobre WAN 3.0 son repeticiones afiliadas de circuitai.bsky.social, no un interés orgánico; conviene descontar ese factor.
- ComfyUI y el ecosistema LoRA siguen evolucionando: además de actualizaciones de ComfyUI, avanzan adaptaciones a hardware distinto de CUDA, como LoRA de FLUX para NPU Ascend de Huawei (aichina.news).
Límites
- La API pública de Bluesky (
public.api.bsky.appyapi.bsky.appmedianteapp.bsky.feed.searchPosts) devolvía errores 403 intermitentes, probablemente por límites de tasa. Las consultas consecutivas fallaban con facilidad; la mayoría funcionaba al reintentarlas con intervalos. - Se abandonaron varias palabras clave tras errores 403 persistentes, entre ellas
Runway Gen,Kling AI,Black Forest LabsyWan 2.5con variantes ortográficas; se usaron consultas alternativas comoWan video. No se pudieron incluir publicaciones directas sobre Runway y Kling. - La interfaz web de
bsky.app/searches una SPA de JavaScript y no renderizaba el contenido al consultarla, por lo que se dependió por completo del JSON de la API pública. - Palabras como «Flux» y «Z-Image» se buscan literalmente, por lo que la mayoría de resultados irrelevantes trataba de Aeon Flux, flujo solar, Pokémon Z-A o sitios de vídeo para adultos; el filtrado requirió tiempo.
- Las exclusivas de The Information sobre Katzenberg y los artículos de arXiv se verificaron solo a nivel de titular y resumen, no de texto completo, por muros de pago y complejidad técnica.
Lemmy
Lemmy — Noticias de IA de generación de imágenes y vídeo
Comunidades
- !«メールアドレス» — 5.709 suscriptores totales (893 locales). Es el mayor centro de Lemmy para herramientas y lanzamientos de modelos de IA de imágenes/vídeo. Casi todas las publicaciones recientes provienen de una sola persona,
Even_Adder, que enlaza a diario nuevos lanzamientos de GitHub/HuggingFace. - !«メールアドレス» / lemmy.world — Comunidades para compartir obras generadas. Son más galerías que noticias (puntuaciones entre -14 y 16).
- !«メールアドレス» — Comunidad especializada en arte abstracto con SDXL y LoRA personalizados. Tiene más de 10 publicaciones solo en septiembre y muestra actividad.
- !ai_reddit@[varias instancias] — Comunidades que recopilan crossposts de Reddit r/ArtificialInteligence. Hay poca discusión original.
- !«メールアドレス» — Noticias tecnológicas generales. Aquí los artículos sobre Midjourney lograron puntuaciones superiores a 70.
- !hackernews@[varias instancias] — Crossposts de Hacker News. Recoge varias publicaciones sobre la controversia de Midjourney.
- !techtakes@[varias instancias] — Comunidad con fuerte tono crítico hacia la IA. «Midjourney pivots to Theranos» obtuvo 40 pt.
- !llm@[varias instancias] — Comunidad especializada en LLM. Hay una publicación del lanzamiento de GPT-6 Astra, pero obtuvo puntuación negativa (-3) y una recepción fría.
- !«メールアドレス» — Pequeña comunidad especializada en la herramienta de generación de texto/imágenes Perchance.
Las API devolvían 404 según la instancia para los recuentos de suscriptores; salvo !«メールアドレス», no pudieron verificarse cifras exactas.
Publicaciones
Más cercanas al código cerrado
- "Midjourney pivots from AI image generation to body scanning medical spa" — !«メールアドレス», 58 pt, 2026-06-18. https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429 — Noticia impactante sobre el supuesto giro de Midjourney desde la generación de imágenes a un negocio de spa médico (Midjourney Medical) basado en CT por ultrasonido.
- "Midjourney AI pivots to Theranos: Ultrasonic CT" — !techtakes, 40 pt, 2026-06-19. https://pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/ — Comentario sarcástico que lo describe como «el regreso de Theranos».
- Página oficial de "Midjourney Medical" — !hackernews, 3 pt, 2026-06-18. https://www.midjourney.com/medical
- "Midjourney wants Hollywood studios to reveal the details of their AI usage" — !«メールアドレス», 73 pt, 2026-07-05. https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-the-details-of-their-ai-usage/ — Midjourney pide a estudios de Hollywood que revelen cómo usan IA.
- "Behind the scenes with the Midjourney scanner" (vídeo) — !hackernews, 1 pt, 2026-07-06. https://www.youtube.com/watch?v=4nzzpUKhj1M
- "Amnesty International's May 2026 briefing calls leading generative AI systems 'unlawful by design'" — !ai_reddit, 1 pt, 2026-06-24. https://www.reddit.com/r/ArtificialInteligence/comments/1ue64s2/ — Una organización de derechos humanos critica como potencialmente ilegales por diseño los métodos de recopilación de datos de grandes sistemas cerrados de IA generativa, incluida la generación de imágenes.
- Lanzamiento de GPT-6 Astra — !llm, -3 pt, 2026-09-04. https://openai.com/index/gpt-6-astra/ — El LLM no genera directamente imagen/vídeo; llama a herramientas mediante Responses API. Su relevancia directa para este tema es escasa y la reacción en la comunidad fue negativa.
Más cercanas al código abierto (todas en !«メールアドレス», publicadas por Even_Adder)
- Conjunto de herramientas alrededor del modelo de vídeo MiniMax-H3 — Más de siete entre el 4 y el 10 de septiembre (
ComfyUI-MiniMax-H3-W4A4-VSA,MiniMax-H3-Semantic-Bridge,ComfyUI-Ref2VA-VSA,Minimax-h3_Singularity,minimax-h3_fl2v_8Step_motion_enhancer,ComfyUI-VDN-H3,vdn-minimax-h3,FastH3-Ref2V-Stream-Controller). El ecosistema del modelo de vídeo abierto MiniMax-H3 está creciendo explosivamente, con cuantización, aceleración y puentes semánticos. Ejemplo: https://github.com/sepiablue-ai/ComfyUI-MiniMax-H3-W4A4-VSA - "LLaDA-Image: Building Strong Image Generators" — 3 pt, 2026-09-04. https://arxiv.org/abs/2609.03796 — Artículo sobre un Diffusion Transformer de código abierto de 6.000 millones de parámetros.
- Dos LoRA para Krea 2 Turbo —
F16/krea2-turbo-sda(2 pt, 10/9, https://huggingface.co/F16/krea2-turbo-sda) ylvladikov/Krea2-Turbo-Distill-4step-LoRA(2 pt, 8/9, afirma un 45 % de mejora de calidad con destilación a cuatro pasos). - "Viggle/Viggle-Animate" — 10 pt, 2026-09-05. https://huggingface.co/Viggle/Viggle-Animate — Tecnología para sustituir un personaje dentro de un vídeo a partir de un solo fotograma redibujado.
- "How a 20-year-old independent builder from Bihar created an open omni AI model" — !ai_reddit, 0 pt, 2026-09-11. https://www.reddit.com/gallery/1wdii5s — Un modelo omni abierto de 5.840 millones de parámetros habría superado al modelo AFM 3B de Apple en benchmarks como MATH-500.
Señales
- El principal campo de batalla del código abierto no es el modelo base, sino el ecosistema periférico. En torno a MiniMax-H3, un modelo de generación de vídeo, se lanzaron más de diez recursos de cuantización, aceleración, nodos de ComfyUI y LoRA en una semana, y ahí se concentra el entusiasmo de la comunidad.
- La comunicación de Lemmy sobre este tema depende de facto de la curación de una única persona, Even_Adder. Tiene más aspecto de directorio de enlaces que de hilos de debate, y casi no hay comentarios.
- La mayor conversación del lado cerrado no es la competencia de rendimiento de modelos, sino el escandaloso giro de Midjourney hacia un negocio de spa médico. Predomina un tono de crítica empresarial y sarcasmo, visible en medios críticos como pivot-to-ai.
- Críticas de organizaciones de derechos humanos, como el informe de Amnesty International, sobre la legalidad y recopilación de datos de la IA generativa, también aparecen como tema ligado al lado cerrado.
- GPT-6 Astra, lanzado en septiembre de 2026, no genera directamente imágenes/vídeo y por eso tiene escasa relevancia para el tema; su recepción en Lemmy fue incluso negativa.
Límites
- La búsqueda de Lemmy depende de coincidencias de palabras clave. Las búsquedas de
Sora,Veo,Runway,Kling,Grok ImagineyNano Bananadevolvieron cero resultados relevantes, solo publicaciones no relacionadas. Estos temas apenas se discuten en Lemmy. !«メールアドレス»—la versión de otra instancia— no pudo cargarse por HTTP 503; se usó la instancia dbzer0 como alternativa.- Las API de suscriptores de varias comunidades (
/api/v3/community?name=...) devolvieron 404, impidiendo verificar cifras exactas en varios casos. - En total se reunieron 20 publicaciones relevantes, pero Lemmy es una plataforma muy pequeña para este tema y las fuentes se concentran en pocas comunidades y cuentas. Hay poca discusión original: la mayoría son enlaces o reposts.
Pinterest — Noticias de IA de generación de imágenes y vídeo
Se revisaron una por una las imágenes de los 50 pines de output/pinterest.pins.md —recopilados sin clasificación de género mediante una única consulta, "Image and Video Generation AI News"—.
Temas visuales
- Predominan con diferencia los fondos de interfaz futurista en azul neón/púrpura. Fondos negros con patrones de circuitos, logotipos de IA brillantes y siluetas humanas holográficas se repiten tanto en infografías como en miniaturas de vídeo
[1, 3, 4, 5, 34, 37, 39, 41, 48]. - Aparece varias veces la fórmula de rostro de YouTuber masculino barbudo + texto grande «AI NEWS» + collage de logotipos corporativos. Se repiten rostros sorprendidos o escépticos junto a logos de Google, OpenAI, Microsoft, Meta y Anthropic
[4, 20, 21, 45]. - Son muy abundantes las infografías de ranking del tipo «best AI video tool», que reutilizan casi la misma plantilla: tarjetas numeradas, logotipo, lista de funciones y «best for». Runway, Pika, Kling AI, Luma (Dream Machine), Canva, Hailuo y Synthesia son las herramientas habituales en casi todas las listas
[7, 8, 13, 24, 40]. - Destaca el formato para adivinar o detectar «real vs. IA». Hay cuestionarios de comparación de paisajes, explicaciones de tendencias de deepfakes y medidores de detección de voz de IA
[16, 17, 20, 37]. - Se reutilizan mucho los robots humanoides como símbolo genérico de «IA»: robots tipo presentador de noticias, robots señalando la Tierra o imágenes compuestas de medias caras cíborg, independientemente del contenido técnico
[2, 34, 37, 39, 48]. - Hay un pin con una cuadrícula de demostración de transformación de materiales, que muestra el mismo vídeo de una persona, un perro y un coche convertidos en bloques de madera, origami, Lego y flores; es una demostración concreta de la expresividad de un modelo de vídeo
[6]. - Se mezclan pines promocionales de freelance/servicios: anuncios estilo Fiverr que ofrecen crear vídeos de IA, algunos con contactos de WhatsApp o imágenes generadas de Jeff Bezos
[15, 32, 42]. - Las noticias reales de productos, con capturas de anuncios oficiales, son minoritarias. La mayoría son infografías producidas en masa para SEO/afiliados o miniaturas de YouTube. Entre las noticias reales están Google Veo 2/3, Microsoft VASA-1, Vidu S1 de ShengShu, el modelo de escalado de Adobe, AMD Amuse 3.0 y el acuerdo de copyright ByteDance-MPA
[3, 5, 12, 29, 46, 10, 47, 31].
Pines destacados
- #3/#5 — Google announces ultra-high quality video / Veo 2 promo — Material promocional oficial de Google: páginas con muestras reales de salida de Veo 2, como un perro nadando bajo el agua, flamencos y una animación de una niña en una cocina.
- #12 — Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — Actualización concreta de imagen a vídeo con Veo 3 mediante Gemini API y audio nativo.
- #6 — Cuadrícula de demostración de transformación de materiales (tipo Luma) — Cuadrícula comparativa que transforma el mismo vídeo fuente en bloques de madera, origami, Lego y flores, mostrando de forma muy concreta el rendimiento del modelo.
- #16 — "Why Is Trump Obama AI Video Trending?" — Infografía detallada que analiza una tendencia viral de vídeo de IA. Enumera Runway ML, Pika Labs, Kaiber, HeyGen, CapCut AI y DeepBrain AI como herramientas usadas.
- #29 — ShengShu Technology unveils Vidu S1 — Pin sobre un modelo chino que anuncia «generación interactiva en tiempo real».
- #31 — ByteDance and Hollywood reach global deal on AI copyright — Noticia real de carácter legal/IP sobre un acuerdo entre ByteDance y la MPA para proteger copyright en herramientas de IA de generación de imágenes y vídeo.
- #44 — "More than 20% of YouTube is now AI-generated" — Uno de los pocos pines que ofrece una estadística concreta.
- #46 — Microsoft VASA-1 — Demostración de investigación que genera un vídeo parlante a partir de una fotografía y un clip de audio.
- #47 — "Amuse 3.0" (AMD) — Anuncio de una nueva versión de una herramienta de generación de imágenes con IA.
- #37 — Infografía de detección de voz de IA ("97% likely AI generated") — Pin educativo centrado en verificación de autenticidad y ética de la IA.
Señales
- El centro de atención sigue siendo el grupo de herramientas comerciales de código cerrado (Runway, Pika, Kling AI, Luma, Canva, Hailuo, Synthesia y D-ID), cuyos logotipos aparecen en casi todas las infografías de rankings. No se encontraron pines que pusieran en primer plano sistemas de código abierto o autohospedados, como Stable Video Diffusion, flujos de ComfyUI u Open-Sora.
- Google Veo 2/3 es la noticia de producto oficial más visible, destacando imagen a vídeo y audio nativo mediante Gemini API.
- Entre los actores chinos, Vidu S1 de ShengShu aparece con el enfoque de «generación interactiva en tiempo real».
- La ansiedad por deepfakes y autenticidad —la tendencia del vídeo Trump-Obama, detección de voz de IA y cuestionarios de «cuál es IA»— es un subtema consistente en Pinterest.
- También hay cierta presencia de noticias sobre estructura industrial y aspectos legales: la proporción de contenido generado por IA en YouTube (más del 20 %) y el acuerdo de copyright ByteDance-MPA.
- Por la naturaleza de Pinterest, casi no hay pines que profundicen en aspectos técnicos como arquitectura de modelos, métodos de entrenamiento o comparación de benchmarks; predominan las presentaciones de herramientas, guías prácticas y explicaciones de fenómenos virales.
Límites
- La consulta usada por el recopilador fue única (
"Image and Video Generation AI News") y no clasificó por géneros —código abierto/cerrado, etc.—, por lo que este archivo analiza 50 elementos consecutivos, no categorías separadas. La división por categorías se deja para la fase de integración posterior. - Algunos pines tenían poca relación con el tema o eran imágenes de archivo genéricas, como
#35una imagen de actualidad con mapa mundial,#43una imagen de una estatua tocando el violonchelo o#22un recurso de iconos de Adobe Stock. La búsqueda de Pinterest parece tener coincidencias laxas, y se consideran ruido. - Pinterest no muestra fechas de publicación en los pines, por lo que no es posible saber cuándo se publicó cada uno; las menciones de «2025» o «2026» en los títulos son la única pista.
- Los títulos de los pines son texto almacenado en caché por Pinterest y pueden diferir de la fecha y detalles reales de los artículos enlazados. Esta página los verifica únicamente dentro del alcance de la imagen y el título.
Acciones recomendadas
- En la próxima investigación de X, usar nombres propios como Midjourney, Sora, Runway, Kling, Flux y ComfyUI, en lugar de palabras de tendencia.
- Observar de forma continua la diferencia de Elo entre Qwen-Image-3.0-Pro y GPT Image 2 para seguir la brecha de rendimiento entre abierto y cerrado.
- Seguir observando la cuenta de Bluesky que vigila páginas de precios para confirmar la teoría de la desaceleración de Sora.
- Ampliar las consultas de Reddit hasta alcanzar el objetivo de 20 publicaciones.
- No confiar por sí solos en las infografías de rankings de Pinterest ni en las publicaciones afiliadas repetitivas de Bluesky hasta que puedan verificarse en otras plataformas.
Imágenes recopiladas


















































Nota sobre la calidad de los datos
En X hubo cero publicaciones relacionadas con IA de generación de imágenes y vídeo debido a un error en la selección de consultas. Reddit se quedó en 12 casos, sin alcanzar el umbral aproximado de 20; YouTube no permitió obtener reproducciones ni suscriptores por las limitaciones del renderizado con JavaScript; y Bluesky devolvió 403 de forma continua para algunas palabras clave, por lo que se abandonó parte de la recopilación.



