Noticias de IA para generación de imágenes y vídeo — 2026-09-09
Los dos grandes del lado cerrado son Nano Banana Pro de Google y GPT Image 2 de OpenAI; mientras Sora se encamina a su final, Qwen-Image/FLUX/Wan/HunyuanImage de código abierto se acercan a una calidad de nivel cerrado.
Resumen de noticias sobre IA de generación de imágenes y vídeo — 2026-09-09
¡He reunido todo esto! 🔥 En resumen, del lado cerrado Nano Banana Pro de Google (Gemini 3 Pro Image) y GPT Image 2 de OpenAI son los dos pesos pesados y están compitiendo cara a cara; la app independiente de Sora ya parece estar llegando a su fin, y en vídeo el campo de batalla principal lo ocupan Kling, Seedance y Veo, con los modelos chinos y Google a la cabeza 😤 Por otro lado, en el mundo open source, Qwen-Image, Z-Image, FLUX, Wan y HunyuanImage han llegado al punto de hacerte pensar: «¿¡Se puede lograr tanto gratis!?». Las comunidades de ComfyUI y de ejecución local siguen tan activas como siempre 💪 Eso sí: X fue un fracaso total esta vez, así que lo dejo anotado con total honestidad.
Entre plataformas
Hallazgos sobre código cerrado (10) 🏢
- Nano Banana Pro (Gemini 3 Pro Image) tiene fama de «superar con creces a todos los demás modelos de generación de imágenes» y domina la conversación en YouTube → https://www.youtube.com/watch?v=UV9GqinedQ8
- Llega GPT Image 2 de OpenAI. Supera el 99 % de precisión textual en más de 12 idiomas, genera ocho imágenes de una vez en modo Thinking y avanza hacia compatibilidad con 4K → https://www.youtube.com/watch?v=blOlUnC75O4
- Google retiró Imagen por completo el 17 de agosto de 2026 y se concentró exclusivamente en la familia Nano Banana. El movimiento en imágenes cerradas se inclina hacia Google.
- OpenAI cerró la app Sora el 26 de abril y prevé retirar también la API de Sora el 24 de septiembre. La marca Sora parece estar prácticamente en su ocaso → https://lemmy.world/post/44721138
- dahara1, de Bluesky, ya informó que «la versión gratuita de Sora dejó de funcionar al agotarse los créditos» → https://bsky.app/profile/dahara1.bsky.social/post/3miogq762u223
- Grok Imagine Image 2.0 de xAI, lanzado el 7 de agosto, se situó en Arena en un segundo puesto muy cercano a GPT Image 2, formando una lucha a tres bandas.
- Seedance 2.5 de ByteDance abrió su API al público el 7 de agosto y se consolidó como opción principal junto a Veo 3.1 y Kling 3.0.
- Usuarios de Reddit compararon Seedance 2.5 y Wan 3.0, de código abierto, usando el mismo prompt, con opiniones muy divididas → https://www.reddit.com/r/generativeAI/comments/1w60fip/
- Midjourney ha causado cierta polémica al pasar inesperadamente de la generación de imágenes al negocio de escáneres médicos por ultrasonidos; incluso surgieron ironías comparándolo con Theranos → Lemmy (vía theregister.com).
- ByteDance y Hollywood (MPA) alcanzaron un acuerdo global sobre protección de derechos de autor para IA, señal de que las medidas de copyright están entrando en una fase seria → investigación en Pinterest.
- En Reddit, una técnica para fingir con IA un «timelapse auténtico dibujado a mano» provocó una enorme polémica con 7.088 puntos; también hubo voces que pidieron etiquetado obligatorio de IA → https://www.reddit.com/r/antiai/comments/1w81kdd/
- Solo en Bluesky, entre diciembre de 2025 y febrero de 2026 aparecieron de forma consecutiva nuevos modelos de Kling, Runway, PixVerse, Vidu, Seedance y Niji a través de luok.ai, lo que deja clara la fuerza de los actores chinos.
Hallazgos sobre código abierto (10) 🛠️
- Qwen-Image 2512 (Alibaba, licencia tipo Apache) y Z-Image Turbo son las dos tendencias principales; abundan los vídeos comparativos → https://www.youtube.com/watch?v=uAGH_yRZ2Gw
- Flux 2.0 se está enfrentando a Qwen-Image 2512 y Z-Image en una prueba de estrés de 15 categorías → https://www.youtube.com/watch?v=54zvSiAWz2Y
- LTX-2.3 de Lightricks (22.000 millones de parámetros, sincronización de audio y 4K/50 fps) tiene fama de ofrecer calidad de nivel cerrado → https://www.youtube.com/watch?v=qQXzlk134Sw
- También hay vídeos prácticos que afirman que Wan 2.5 de Alibaba ha superado al Veo 3 cerrado → https://www.youtube.com/watch?v=yvD8TxNsR4Q
- Aparece el agente gratuito «WanGP», que integra varios modelos OSS —LTX-2.3, Qwen, Flux.2 Klein y Z-Image—, avanzando hacia flujos de trabajo unificados → https://www.youtube.com/watch?v=h-k6xOEITx4
- HunyuanImage 3.0 de Tencent, un MoE de más de 80B, sigue siendo la referencia entre los grandes modelos de imagen OSS.
- FLUX 3 de Black Forest Labs admite imágenes y vídeos de 20 segundos con audio; lanzamiento limitado → https://bfl.ai/blog/flux-3
- Han aparecido variantes ligeras como FLUX.2-klein-9b-kv-fp8 y se inició el FLUX Creator Program, con Martin Scorsese incluso participando como asesor.
- Las comunidades de Stable Diffusion en Lemmy, aunque rondan los 5.000 miembros, siguen publicando cada día creaciones con ComfyUI, SDXL y Krea2, mostrando una gran profundidad de uso real.
- Simon Willison, en Bluesky, informó que ejecutó Qwen 3.7 27B localmente en un MacBook M5 y logró su mejor imagen de un pelícano con un GGUF de 17 GB; se ha convertido en parte de la cultura de benchmarks de generación de imágenes con LLM locales → https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z
- El modelo abierto de vídeo SkyReels V1, basado en HunyuanVideo, y el flujo de trabajo OSS integral gratuito «Open Creative Studio» también reciben actualizaciones constantes → https://bsky.app/profile/perilli.com/post/3mdddenkss22v
Punto clave que destacó entre plataformas: en Reddit, YouTube y Lemmy se repite la oposición entre «cerrado, fácil de usar pero con censura y costes altos» frente a «abierto, libre pero más laborioso». Además, varias comunidades comparten su escepticismo hacia las herramientas que prometen ser «gratis e ilimitadas» 🙅♂️. En Pinterest, en cambio, esta oposición apenas se ve: predominan las presentaciones de herramientas y miniaturas de noticias, lo cual también resulta interesante.
Plataforma por plataforma
Reddit: se recopilaron 12 hilos. Un hilo anti-IA (7.088 pt) se hizo tan viral que destacó más que todos los temas técnicos combinados, reflejando que el rechazo al mal uso de IA es más fácil de visibilizar. Esta vez no hubo resultados en subreddits centrales como r/StableDiffusion, por lo que hay un vacío de cobertura.
X: sinceramente, aquí fue un desastre total 😅 Las búsquedas del trabajador usaron términos ajenos al tema, como "Harvey" y "$LAPTOP", por lo que ninguno de los 40 resultados recopilados trataba sobre IA de generación de imágenes o vídeo. Es la única carencia real entre las seis plataformas indicadas en el encargo.
YouTube: hubo abundantes vídeos de reseñas y comparativas. En cerrado, aparece una lucha a tres bandas entre Google, OpenAI y xAI; en abierto, se cubrió ampliamente Qwen-Image, FLUX, Wan, LTX-2.3, HunyuanImage y hasta flujos integrados como WanGP. Sin embargo, las visualizaciones y suscriptores dependen de JavaScript y no se pudieron obtener, por lo que no fue posible comparar la actualidad con métricas numéricas.
Bluesky: la API de búsqueda (searchPosts) devolvió 403 para todas las consultas, así que se cambió a lectura de feeds mediante cuentas. Esto dio una buena cobertura de vídeo cerrado, sobre todo a través de luok.ai, pero poco contenido sobre vídeo abierto. Apenas apareció SkyReels V1.
Lemmy: destacan las noticias cerradas sobre el giro médico de Midjourney y las ironías acerca del fin de Sora. En abierto, Black Forest Labs y la familia FLUX dominan claramente, con movimientos concretos y constantes cada trimestre.
Pinterest: se revisaron visualmente los 50 pines. Predominan miniaturas de noticias con caras de robots y neón, así como infografías de recopilación de herramientas; no hubo ninguna imagen entre 50 que representara la cultura abierta y autoalojada de Stable Diffusion o ComfyUI. Tampoco se pudieron obtener métricas de interacción en la mayoría de los casos.
Qué vigilar
- Retirada de la API de Sora de OpenAI, prevista para el 24 de septiembre de 2026 — Lemmy https://lemmy.world/post/44721138
- Evolución de la clasificación de Arena entre Grok Imagine Image 2.0 y GPT Image 2 — YouTube (vídeos comparativos de Marin Method)
- La lucha a tres bandas de código abierto entre Qwen-Image, Z-Image y FLUX, y cuál se convertirá en estándar — YouTube https://www.youtube.com/watch?v=uAGH_yRZ2Gw
- Si el negocio de escáneres médicos por ultrasonidos de Midjourney llega a consolidarse — Lemmy (vía theregister.com)
- Las reglas operativas concretas del acuerdo de copyright ByteDance × Hollywood — investigación en Pinterest [24]
- Hasta qué punto se extienden los agentes integradores OSS como WanGP — YouTube https://www.youtube.com/watch?v=h-k6xOEITx4
Recomendaciones
- La recopilación adicional para X debería repetirse con términos directamente relacionados con el tema, como "Midjourney", "Stable Diffusion", "Sora", "Nano Banana" y "Qwen-Image".
- La investigación en Reddit debería incluir obligatoriamente en adelante subreddits grandes y centrales como r/StableDiffusion, r/midjourney y r/comfyui.
- Como alternativa a la API de búsqueda de Bluesky, convendría convertir las cuentas principales encontradas esta vez —luok.ai, simonwillison.net y otras— en una lista de seguimiento periódico.
- Para visualizar mejor la dicotomía cerrado/abierto, deberían priorizarse los comentarios de Reddit y Lemmy, donde las opiniones son más marcadas que en Pinterest.
- La retirada de la API de Sora de OpenAI el 24 de septiembre y las novedades sobre el cambio de negocio de Midjourney deberían ser prioridades en la próxima investigación.
Calidad de los datos
X no recopiló ninguna publicación relacionada con IA de generación de imágenes o vídeo debido a un desajuste en los términos de búsqueda, por lo que en la práctica no hay datos. Bluesky y Pinterest no permitieron obtener la API de búsqueda ni métricas de interacción —visualizaciones y «me gusta»—, así que no se pudo respaldar cuantitativamente la difusión de los temas. YouTube tampoco permitió acceder al contenido de los vídeos ni a las visualizaciones por su dependencia de JavaScript, por lo que se dependió de fragmentos de WebSearch. El resto, Reddit y Lemmy, proporcionó en general material suficiente en cantidad y calidad.
Resumen por plataforma
Reddit — Noticias sobre IA de generación de imágenes y vídeo
Dónde
Los 12 hilos recopilados se distribuyen entre ocho subreddits.
| Subreddit | Miembros | Hilos recopilados |
|---|---|---|
| r/generativeAI | 151,605 | 4 |
| r/antiai | 319,039 | 1 |
| r/RemoteWorkers | 75,979 | 1 |
| r/Seedance_AI | 20,508 | 1 |
| r/freetoolsAI | 7,942 | 1 |
| r/aivideomaking | 6,614 | 2 |
| r/AItips101 | 1,153 | 1 |
| r/Unrouted_AI | 517 | 1 |
r/generativeAI, dedicado a la IA generativa en general, fue el más frecuente con cuatro hilos. Sin embargo, el que dominó claramente en puntuación y número de comentarios fue el único hilo de r/antiai, crítico con la generación de imágenes por IA, con una interacción muy superior al total de los demás hilos.
Qué dice la gente
- Las plataformas integradas que priorizan libertad y ausencia de censura ganan terreno: el hilo 1 (r/AItips101, 81 puntos, 2026-09-07, https://www.reddit.com/r/AItips101/comments/1w9yftp/) presenta «WildOwl.ai», un servicio de pago por uso sin suscripción que permite acceder a más de 35 modelos como Qwen Image, Flux, Seedream, Wan, Kling, Seedance, Veo y GPT Image. En comentarios, u/reliablemicrophone84 valoró que WildOwl resuelve el problema de no tener que elegir entre modelos de vanguardia y libertad creativa, mientras que u/Clear-Assistance449 propuso como alternativa la suscripción ilimitada de Mage.space.
- Fuerte escepticismo ante lo «gratis e ilimitado»: los hilos 2 (r/aivideomaking, 2 puntos, 22 comentarios, 2026-09-06, https://www.reddit.com/r/aivideomaking/comments/1w953eo/) y 5 (r/generativeAI, 1 punto, 2026-09-07, https://www.reddit.com/r/generativeAI/comments/1wa4k88/) coinciden en que no existe algo realmente gratis e ilimitado. u/ai_art_is_art (hilo 5, 3 puntos) fue especialmente contundente: «Unlimited is a lie. You put $550 in, you get $200 out and you have to wait 24 hours between generations.»
- La solicitud de vídeos de 45 segundos provoca burlas: en el hilo 4 (r/aivideomaking, 13 puntos, 22 comentarios, 2026-09-07, https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/), alguien quería crear gratis un vídeo de IA de 45 segundos solo con móvil y iPad. u/NewLifeWares (2 puntos) señaló la barrera técnica: «45 seconds is reaching data center level requirements of hardware. At best you might find a free 5 second generator...with a watermark».
- Gran polémica por falsificar dibujos «hechos a mano» con IA: el hilo 3 (r/antiai, 7.088 puntos, 1.023 comentarios, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/) trataba de hacer que un LLM de nivel GPT-6 controle ratón y teclado para falsificar un «timelapse auténtico» en un programa de pintura. Fue, con diferencia, la publicación mejor valorada de toda la recopilación. u/Nayutantantan (2.512 puntos) expresó su decepción porque «the trends of creating fake timelapses are getting common», y u/Soggy_Supermarket100 (171 puntos) pidió etiquetado inmediato de IA: «EVERY SINGLE online space NEEDS AI filtering».
- Los deepfakes de celebridades reales convergen en el debate sobre la responsabilidad del usuario: en el hilo 6 (r/Seedance_AI, 0 puntos, 22 comentarios, 2026-09-07, https://www.reddit.com/r/Seedance_AI/comments/1w9zqac/), u/Jean_velvet (7 puntos) explicó que casos judiciales recientes sitúan la responsabilidad en el usuario: «It's the distribution and sharing that's the potential crime». Por otra parte, u/Alchemist42 (1 punto) sugirió el uso de herramientas con regulaciones más laxas: «They don't use Seedance».
- Duelo entre modelos cerrados y abiertos: el hilo 10 (r/generativeAI, 110 puntos, 31 comentarios, 2026-09-03, https://www.reddit.com/r/generativeAI/comments/1w60fip/) comparó Seedance 2.5, cerrado y de ByteDance, con Wan 3.0, de pesos abiertos y de Alibaba, usando el mismo prompt. u/SpecialistDragonfly9 (5 puntos) consideró que Seedance era «by FAR superior», mientras que u/Positive-Key6640 (5 puntos) cuestionó el método: «Same-prompt comparisons are fun but they mostly measure which model happens to like your prompt style, not which one is better».
- El nuevo modelo de imagen de OpenAI genera atención discreta: el hilo 7 (r/Unrouted_AI, 2 puntos, 6 comentarios, 2026-09-08, https://www.reddit.com/r/Unrouted_AI/comments/1waxp14/) enlazó el blog oficial de OpenAI «introducing-chatgpt-images-2-5». u/Ok_Homework_1859 se fijó especialmente en la función Sketch, que permite dibujar en ChatGPT para guiar la imagen.
- Malestar por las restricciones para generar personajes con copyright: en el hilo 11 (r/generativeAI, 2 puntos, 2 comentarios, 2026-09-08, https://www.reddit.com/r/generativeAI/comments/1waapc1/), se criticaba que Grok no permitiera ni fan art de personajes Disney para uso personal. u/frighten propuso PixelForge para iOS como herramienta alternativa sin restricciones integradas.
- Nostalgia y correcciones a los diez años de historia de generación de imágenes: el hilo 9 (r/generativeAI, 15 puntos, 9 comentarios, 2026-09-06, https://www.reddit.com/r/generativeAI/comments/1w8gzt6/) resumía la evolución desde StackGAN en 2016 hasta las imágenes generadas por ChatGPT en 2026. u/noctalla señaló una omisión histórica: Google DeepDream fue un generador de imágenes por IA anterior, alrededor de 2015.
- Surgen nuevos «trabajos secundarios de IA» alrededor de la generación de imágenes: el hilo 8 (r/RemoteWorkers, 169 puntos, 787 comentarios, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/) ofrecía un empleo remoto de 30 USD/hora para revisar subtítulos generados por IA. Pese al alto número de comentarios, los principales eran esencialmente respuestas repetidas de «Images» solicitando un enlace de candidatura, por lo que la discusión sustantiva fue escasa.
- Dudas sobre la sostenibilidad de las herramientas de generación gratuitas: el hilo 12 (r/freetoolsAI, 40 puntos, 50 comentarios, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/) presentaba aifreeforever.com como gratuito, ilimitado y sin registro. u/thecragmire preguntó por la sostenibilidad del modelo de negocio: «How do you maintain this? It's got to cost you something, right?», y u/Relevant_Syllabub895 se quejó de las restricciones NSFW.
Señales
- En rápido ascenso: los agregadores «sin censura e integradores de múltiples modelos» —WildOwl.ai, Venice, Mage.space y PixelForge— se mencionan en varios hilos como alternativa a contratar modelos individualmente. Destacan los servicios que venden «elección libre de modelos + filtros laxos» en vez de un solo modelo.
- Afirmaciones rechazadas: los servicios de generación de vídeo o imagen que prometen ser «gratis e ilimitados» son recibidos con escepticismo o rechazo casi unánime en r/aivideomaking, r/generativeAI y r/freetoolsAI. El consenso es que siempre debe existir algún coste: hardware o pago.
- Conflicto de opiniones: en la comparación Seedance contra Wan del hilo 10, hay división sobre cuál es superior e incluso sobre el método comparativo, pues un prompt idéntico no basta. En el hilo 6 también hay una diferencia de postura entre quienes defienden la responsabilidad del usuario y quienes creen que el servicio debe actuar.
- Sorpresa: de los 12 hilos, el hilo anti-IA (hilo 3, 7.088 puntos / 1.023 comentarios) recibió una interacción de un orden de magnitud mayor que los temas técnicos —comparativas de modelos y nuevas herramientas—. Casi equivale a la suma de puntuaciones de todos los demás hilos, de alrededor de 7.600 puntos. Sugiere que en Reddit es más visible el rechazo al abuso y al engaño con IA que el entusiasmo por la tecnología generativa.
- Panorama abierto/cerrado: la oposición explícita se concentra en Wan, de pesos abiertos, frente a Seedance, cerrado, y en la comparación entre generación local —ComfyUI/Civitai/Hugging Face— y servicios cloud de pago. Se repite la valoración de que el código abierto ofrece libertad pero exige trabajo, mientras que el cerrado es cómodo pero choca con censura y coste.
Límites
- Se recopilaron 12 hilos, por debajo del umbral de «unos 20» que solicita brief.md. Solo se usó una búsqueda: "Image and Video Generation AI News"; no se realizaron búsquedas adicionales dirigidas específicamente a código cerrado o abierto.
- No aparece ningún subreddit grande y central de IA de generación de imágenes o vídeo, como r/StableDiffusion, r/midjourney, r/aivideo o r/comfyui. Es un vacío de cobertura que impide considerar el resultado plenamente representativo del clima de Reddit.
- En el hilo 8 de r/RemoteWorkers, los comentarios principales son esencialmente repeticiones de «Images» para solicitar empleo y casi no contienen información útil como debate.
- Este agente no puede navegar directamente Reddit ni sus páginas de resultados de búsqueda debido al rechazo de WebFetch; lo anterior procede exclusivamente de la información que los trabajadores recopilaron previamente en
output/reddit.threads.mdy.json, sin poder confirmar otros hilos o comentarios.
X
X — Noticias sobre IA de generación de imágenes y vídeo
Nota previa: los resultados recopilados no coinciden con el tema
Al revisar output/x.posts.md, las diez consultas realizadas por el trabajador durante esta fase fueron
"Harvey", "#Crypto", "#sweepstakes", "#Chance", "#giveaways", "Serbia",
"$LAPTOP", "Arsenal", "Germans", "Nazis". Ninguna está relacionada con IA de
generación de imágenes o vídeo, y las 40 publicaciones recopiladas, de 39 cuentas, tampoco
contienen resultados pertinentes. La propia lista Explore de X —tendencias vinculadas a la
ubicación croata del servidor, mostradas abajo— no incluyó nada relativo a IA.
| # | Tendencia | Dónde |
|---|---|---|
| 1 | Harvey | Tendencia en Croacia |
| 2 | #Crypto | Negocios y finanzas · Tendencia |
| 3 | #sweepstakes | Tendencia en Croacia |
| 4 | #Chance | Tendencia en Croacia |
| 5 | #giveaways | Tendencia en Croacia |
| 6 | Serbia | Política · Tendencia |
| 7 | $LAPTOP | Tendencia en Croacia |
| 8 | Arsenal | Deportes · Tendencia |
| 9 | Germans | Política · Tendencia |
| 10 | Nazis | Política · Tendencia |
De acuerdo con la regla 7, que prohíbe inventar fuentes, no se presentarán publicaciones irrelevantes como si fueran hallazgos sobre el tema. A continuación se describen únicamente los hechos dentro de lo que realmente se recopiló.
Cuentas
Las 39 cuentas recopiladas forman grupos desconectados: fans de realities románticos, operadores de criptomonedas, cuentas de promoción de sorteos y regalos, discusiones políticas balcánicas, círculos de memecoins, seguidores del Arsenal y cuentas que debaten revisionismo histórico o antisemitismo. No se confirmó ni una sola cuenta que hablara de IA de generación de imágenes o vídeo, o que publicara contenido explícitamente identificado como creado con tales herramientas. Algunas publicaciones indican "has an image", pero no mencionan IA generativa ni confirman que sea material generado. Las mayores interacciones fueron las de @saintjupitr, con 64.747 «me gusta» en una sola publicación, y @Kwin8675309, con 42.021, ambos casos de publicaciones políticas aisladas que se volvieron virales y que no guardan relación con el tema.
Publicaciones
No hay resultados. De las 40 publicaciones, 0 coincidieron con el tema de IA de generación de imágenes y vídeo, ya fuera en código cerrado o abierto. Algunas publicaciones individuales —por ejemplo, las #21–24 sobre la política serbia, las #29–32 sobre fútbol y Arsenal y las #33–40 sobre controversias históricas relacionadas con Alemania y el nazismo— tuvieron gran interacción, pero no se contabilizan como hallazgos por no tener relación con IA visual.
Señales
- No fue posible detectar señales temáticas de ascenso o descenso porque no había datos pertinentes.
- Lo único que puede afirmarse es un hecho del proceso de recopilación: Explore se geolocalizó según una conexión desde Croacia y las consultas quedaron fijadas en términos ajenos al tema, como "Harvey" o "$LAPTOP".
Límites
- Las consultas no coinciden con el tema: los registros «Found by searching "…"» de
output/x.posts.mdcorresponden todos a términos sin relación con la generación de imágenes o vídeo por IA. Parece un problema de configuración de consultas del trabajador. Siguiendo las instrucciones del playbook —el trabajador ya había recopilado el material— no se efectuó una nueva búsqueda; será necesario repetir la recopilación con términos correctos como "AI image generation", "Midjourney", "Stable Diffusion", "Sora", "Veo" u "オープンソース 画像生成AI". - De las 40 publicaciones recopiladas, 0 ofrecen hallazgos sobre la evolución de IA de generación de imágenes o vídeo de código cerrado o abierto. El requisito de brief.md de analizar «unas 20 publicaciones por SNS» no pudo cumplirse porque no existe material temático.
- Explore de X, con tendencias 1–10, solo mostraba tendencias generales croatas, sin ninguna relacionada con IA.
- La sesión funcionó y se recopilaron publicaciones correctamente; no hubo errores como «session expired». El problema radica en la selección de consultas.
YouTube
YouTube — Últimas tendencias de IA para imágenes y vídeo (código cerrado / abierto)
Canales
- AICodeKing — Canal centrado en reseñas prácticas de herramientas de IA, incluyendo acceso anticipado a Google Nano Banana Pro (Gemini 3 Pro Image). https://www.youtube.com/@AICodeKing
- Theo - t3.gg — Canal de explicaciones tecnológicas para desarrolladores, con un vídeo sobre Nano Banana Pro. https://www.youtube.com/@t3dotgg
- ElevenLabs (oficial) — Canal oficial de la empresa de IA de voz que también explica noticias de imagen generativa como GPT Image 2. https://www.youtube.com/@Elevenlabs
- AIOnTrend — Especializado en reseñas comparativas de modelos de imagen open source, como Qwen-Image 2512. https://www.youtube.com/@aiontrend
- BMF MEDIA — Reseñas de modelos abiertos de generación de vídeo, como LTX-2.3. https://www.youtube.com/@BeerMoneyForum
- Marin Method — Comparativas directas de modelos de vídeo cerrados, incluidos Kling, Grok Imagine, Runway y Veo. https://www.youtube.com/@MarinMethod
- Jack Vs. AI — Canal de flujos de trabajo prácticos para modelos como Wan 2.5. https://www.youtube.com/@JackVsAI
- Youri van Hofwegen — Verificaciones comparativas de modelos recientes de vídeo como Seedance 2.0. https://www.youtube.com/@Yourivanhofwegen
- AI Late to Class — Explicaciones de flujos de trabajo locales abiertos con ComfyUI, WanGP y otros. https://www.youtube.com/@ailatetoclass
- AI大学【AI&ChatGPT最新情報】 — Canal japonés que explica en japonés comparativas de IA de imagen como GPT Image 2 frente a Nano Banana. https://www.youtube.com/@AIAIChatGPT-cj4sh
- Referencia: Matt Wolfe (@mreflow) tiene aproximadamente 965.000 suscriptores y reúne noticias semanales del sector de IA. No fue un resultado directo esta vez, pero se conoce como un gran canal representativo del ámbito.
Vídeos
-
«Google won image generation (it's not even close) NANO BANANA PRO BREAKDOWN»
Canal: Theo - t3.gg|Publicado aproximadamente el 26 de noviembre de 2025|https://www.youtube.com/watch?v=UV9GqinedQ8
→ Vídeo de análisis que sostiene que Nano Banana Pro de Google (Gemini 3 Pro Image) supera ampliamente a todos los demás modelos de generación de imágenes. Es una entrega simbólica de la vanguardia cerrada. -
«Nano Banana PRO (Gemini-3.0-Pro-Image): I GOT EARLY ACCESS...»
Canal: AICodeKing|https://www.youtube.com/watch?v=13AovEj4oDM
→ Reseña de acceso anticipado a Gemini 3 Pro Image, con muchos ejemplos prácticos y una valoración de rendimiento «impactante». -
«GPT Image 2 Is Here — Everything You NEED to Know»
Canal: ElevenLabs|Publicado el 23 de abril de 2026|https://www.youtube.com/watch?v=blOlUnC75O4
→ Explica GPT Image 2 de OpenAI (ChatGPT Images 2.0): precisión textual superior al 99 % en más de 12 idiomas, hasta ocho imágenes por prompt en modo Thinking y compatibilidad con 4K en API/beta. Se presenta como una de las mayores evoluciones de modelos de imagen del año. -
【ナノバナナ超え】OpenAIの新しい画像生成AIモデル「GPT Image 2」とは?
Canal: AI大学【AI&ChatGPT最新情報】 (japonés)|https://www.youtube.com/watch?v=ZrO7tv-uv1E
→ Explicación en japonés de GPT Image 2 comparado con Nano Banana, que cubre rendimiento, uso y casos prácticos. -
«Kling 3.0 vs Grok Imagine vs Runway Gen-4.5 vs Veo 3.1: The Ultimate AI Video Comparison»
Canal: Marin Method|Publicado el 10 de marzo de 2026|https://www.youtube.com/watch?v=x5fMQvhKP60
→ Enfrentamiento directo de cuatro modelos cerrados de vídeo. Valora a Kling 3.0 como líder en capacidad general y a Grok Imagine como fuerte en imagen a vídeo. -
«Seedance 2.0 Just Destroyed Kling 3.0, Sora 2 & VEO 3.1 - Comparison»
Canal: Youri van Hofwegen|https://www.youtube.com/watch?v=vw_Jk2-phsA
→ Vídeo de comparación que afirma que Seedance 2.0 de ByteDance supera a los principales modelos cerrados existentes. -
«New Qwen Image 2512: Better Than Z-Image? (Open Source & Free)»
Canal: AIOnTrend|Publicado a principios de enero de 2026|https://www.youtube.com/watch?v=uAGH_yRZ2Gw
→ Compara el modelo abierto Qwen-Image 2512 de Alibaba con el popular Z-Image Turbo, destacando la ventaja de ser gratuito y tener licencia tipo Apache. -
«Is Flux 2.0 DEAD? Qwen image 2512 & Z-Image vs. The King (15 Stress Tests)»
https://www.youtube.com/watch?v=54zvSiAWz2Y
→ Compara la familia Flux de Black Forest Labs con Qwen-Image 2512 y Z-Image en 15 pruebas de estrés, analizando cómo está cambiando el panorama de la imagen open source. -
«LTX-2.3 Review: The Open-Source AI Video Model Built for Creators»
Canal: BMF MEDIA|Publicado aproximadamente un mes antes de la búsqueda, hacia agosto de 2026|https://www.youtube.com/watch?v=qQXzlk134Sw
→ Reseña desde el punto de vista de creadores sobre LTX-2.3 de Lightricks: 22.000 millones de parámetros, sincronización de audio, 4K/50 fps y código abierto. Se publicó dentro de los últimos 60 días y es muy reciente. -
«WAN 2.5 CRUSHES VEO 3 (Higgsfield AI Workflow)»
Canal: Jack Vs. AI|https://www.youtube.com/watch?v=yvD8TxNsR4Q
→ Flujo de trabajo práctico que sostiene que Wan 2.5 de Alibaba Tongyi, de código abierto, ofrece mejores resultados que Google Veo 3, cerrado. -
«This AI Agent Can Make Movies WanGP Deepy - Open source free Agent for LTX 2.3 Qwen Klein Z-Image»
Canal: AI Late to Class|https://www.youtube.com/watch?v=h-k6xOEITx4
→ Presenta un flujo de producción automática de vídeos con el agente gratuito WanGP, que reúne LTX-2.3, Qwen, Flux.2 Klein, Z-Image y otros modelos abiertos. Es evidencia de la integración del ecosistema OSS. -
«HunyuanImage 3.0 : Open Source Text To Image Model (Forget Nano Banana & Seedream 4)»
https://www.youtube.com/watch?v=32lhiZKhgOY
→ Presenta HunyuanImage 3.0 de Tencent, modelo de imagen abierto de más de 80.000 millones de parámetros, arquitectura MoE y 13.000 millones activos. Afirma rivalizar o superar a Nano Banana. Aunque apareció originalmente en septiembre de 2025, sigue siendo una referencia para los grandes modelos abiertos MoE de imagen.
Señales
Movimientos del lado de código cerrado
- Google retiró por completo la línea Imagen el 17 de agosto de 2026 y se concentró en la familia Nano Banana, incluidos Gemini 3 Pro Image y modelos similares. La imagen cerrada parece concentrarse en la familia Gemini de Google.
- OpenAI cerró la app Sora el 26 de abril de 2026 y prevé cerrar la API de Sora el 24 de septiembre de 2026, fecha cercana al momento del informe. La marca Sora como producto independiente de vídeo parece extinguirse de facto, mientras los recursos de OpenAI se orientan a GPT Image 2 y a su integración en ChatGPT.
- GPT Image 2 de OpenAI, de abril de 2026, ocupa posiciones de cabeza en Arena en texto a imagen y edición. Grok Imagine Image 2.0 de xAI, publicado el 7 de agosto de 2026, quedó muy cerca en segundo lugar; la generación de imágenes cerrada se ha convertido en una competencia entre OpenAI, Google y xAI.
- Seedance 2.5 de ByteDance abrió al público su API el 7 de agosto de 2026 y crece rápidamente como opción principal junto a Google Veo 3.1 y Kling 3.0.
- En comparativas de vídeo cerrado comienza a consolidarse una división: Kling 3.0 destaca en capacidad general, Veo 3.1 en calidad visual y Runway Gen-4.5 en libertad creativa.
Movimientos del lado de código abierto
- Qwen-Image 2512 de Alibaba, con licencia tipo Apache, y Z-Image Turbo, que funciona en 16 GB de VRAM y ocho pasos, son las dos grandes tendencias de imagen. Su popularidad se refleja en la proliferación de vídeos comparativos.
- Flux.2 Klein de Black Forest Labs, con 4B, 13 GB de VRAM en equipos del nivel RTX 3090 y licencia Apache 2.0, recibe numerosas menciones como alternativa ligera de código abierto.
- HunyuanImage 3.0 de Tencent, de más de 80B y arquitectura MoE, sigue siendo una referencia entre los grandes modelos abiertos de imagen.
- En vídeo, Wan 2.2/2.5 de Alibaba Tongyi —difusión MoE, con versión GGUF de 8 GB— y LTX-2.3 de Lightricks —sincronización de audio, 4K/50 fps y 22.000 millones de parámetros— son valorados por varios canales como modelos que han llegado a calidad de nivel cerrado.
- Aumentan los vídeos sobre agentes y flujos de trabajo que integran varios modelos abiertos, como ComfyUI y WanGP. El interés se desplaza de comparar modelos aislados a comparar flujos de trabajo integrados.
- En general, reseñas y comparativas coinciden en que la diferencia de calidad entre abierto y cerrado se estrecha, y que muchos equipos de producción consideran primero las opciones abiertas.
Límites
- En este entorno, las páginas de resultados y los vídeos de YouTube se renderizan con JavaScript; WebFetch no pudo obtener directamente visualizaciones, fechas de publicación ni número de suscriptores. Los nombres de canales se obtuvieron mediante la API oEmbed de YouTube, pero esta tampoco proporciona visualizaciones ni suscriptores.
- Por ello, las cifras de visualizaciones y suscriptores se registran como desconocidas. En su lugar, se muestran solo fechas y contexto presentes en fragmentos de WebSearch. No fue posible comparar cuantitativamente la actualidad, por ejemplo por reproducciones dentro de los últimos 60 días.
- El contenido de los vídeos y sus comentarios principales no pudieron leerse directamente por la dependencia de JavaScript; las descripciones se basan indirectamente en títulos, fragmentos de búsqueda y resúmenes de artículos relacionados, no en citas literales de los vídeos.
- El vídeo relacionado con HunyuanImage 3.0 apareció originalmente en septiembre de 2025, fuera de la ventana recomendada de 60 días, y solo se incluye como referencia persistente de grandes modelos abiertos de imagen.
- Solo hubo un resultado de canal japonés, AI大学, por lo que no se pudo confirmar la profundidad del debate de YouTube en japonés frente al anglófono.
Bluesky
Bluesky — Últimas tendencias de IA de generación de imágenes y vídeo
Cuentas
- Simon Willison @simonwillison.net — Desarrollador de IA reconocido. Cuando aparece un modelo nuevo, suele comparar sus capacidades de imagen con un benchmark de «un pelícano montando en bicicleta». Tiene muchos seguidores y varias publicaciones con más de 100–500 «me gusta».
- Ethan Mollick @emollick.bsky.social — Profesor de Wharton, Universidad de Pensilvania. Publica con frecuencia experimentos en los que modelos como GPT-6 Astra y Fable 5.1 generan contenido 3D en Blender.
- Alessandro Perilli @perilli.com — Desarrollador de «Open Creative Studio», antes AP Workflow, un flujo de generación abierto e integral para ComfyUI. Sigue anunciando una herramienta capaz de generar texto, imágenes, vídeo y audio.
- luokai @luok.ai — Cuenta que presenta de forma continuada novedades de IA de vídeo cerrada, como Kling, Runway, Vidu, PixVerse, Seedance y Niji.
- dahara1 @dahara1.bsky.social — Ingeniero que publica en japonés sobre experiencia de uso de LLM e IA generativa, y crea sus propias herramientas de traducción automática. Recoge temas de actualidad como el fin de Sora y comparativas de Nano Banana. Cuenta pequeña, con 113 seguidores.
- Midjourney Experience Newsletter @midjourneynews.bsky.social — Cuenta no oficial de fans o newsletter, no asociada oficialmente a Midjourney. Publica experimentos de prompts y fragmentos de noticias, con interacción baja.
- Stable Diffusion online AI @stablediffusion.bsky.social — Feed para compartir creaciones de SD y Midjourney. Sus publicaciones recientes se detuvieron entre enero y febrero de 2025, por lo que no sirve como fuente de noticias actuales.
- Resultado de la búsqueda de cuentas oficiales: no se pudieron confirmar cuentas oficiales de Black Forest Labs, Runway, Stability AI o Civitai en Bluesky, ya fuera porque no existen o porque se desconoce el identificador. La aparente cuenta oficial
midjourney.bsky.socialno tiene publicaciones.
Publicaciones
-
«Fin de Sora» — dahara1, 2026-04-28, 0 me gusta/0 RP
https://bsky.app/profile/dahara1.bsky.social/post/3mkjnla6hnk2m
Comenta que OpenAI dio por terminado su servicio de vídeo Sora y sugiere que la empresa no le tenía demasiado apego. Verificado también mediante WebSearch: se informó de que OpenAI terminó la app y la API para desarrolladores de Sora alrededor de marzo de 2026. -
La versión gratuita de Sora agotó créditos y no permite generar — dahara1, 2026-04-04
https://bsky.app/profile/dahara1.bsky.social/post/3miogq762u223
Informó de que no podía crear vídeos aun quedándole un crédito, señal de deterioro del servicio y coherente con las noticias de cierre. -
Comparación de marcas de agua entre Nano Banana gratis y ChatGPT Images 2.0 — dahara1, 2026-05-04, 1 me gusta
https://bsky.app/profile/dahara1.bsky.social/post/3mkztj6phrk2l
Señala que ChatGPT Images 2.0, como Nano Banana gratis, no tiene una marca de agua muy visible y resulta fácil de usar. -
Seedance 2 supera a otros modelos — luokai, 2026-02-10, 5 me gusta
https://bsky.app/profile/luok.ai/post/3mehseuzlls2r
Acompañó un vídeo original creado «en un día» y elogió el rendimiento de Seedance 2. -
Lanzamiento de Niji 7 — luokai, 2026-01-10, 3 me gusta
https://bsky.app/profile/luok.ai/post/3mc2422hgck2m
Anuncia Niji 7, modelo de imagen especializado en anime, con ojos más nítidos, mayor consistencia y mejor seguimiento de prompts. -
Runway Gen-4.5 — luokai, 2025-12-02, 4 me gusta/1 RP
https://bsky.app/profile/luok.ai/post/3m6xsakpud226
Lo presenta como un modelo que eleva el estándar en movimiento, fidelidad y control de prompts, destacando su base de modelado del mundo. -
Kling IMAGE O1 — luokai, 2025-12-03, 3 me gusta
https://bsky.app/profile/luok.ai/post/3m72caiexw225
Renovación integral de la generación de imágenes de Kling con la promesa de admitir, comprender y generar cualquier tipo de entrada. -
Kling VIDEO 2.6 — luokai, 2025-12-05, 2 me gusta
https://bsky.app/profile/luok.ai/post/3m7aio7hntk2f
Promueve generación de vídeo centrada en la narrativa, con sincronización de audio, lip sync y coherencia de escena. -
PixVerse V5.5 — luokai, 2025-12-02, 4 me gusta/2 RP
https://bsky.app/profile/luok.ai/post/3m6xrxnh47c27
Destaca la simplificación de producción mediante generación multishot con un toque y efectos de sonido automáticos. -
Modelo de imagen Vidu AI Q2 — luokai, 2025-12-02, 5 me gusta/2 RP
https://bsky.app/profile/luok.ai/post/3m6xrt43ll227
Anuncia «generación 4K en cinco segundos» y una campaña de generación ilimitada hasta el 31 de diciembre. -
SkyReels V1, modelo base de vídeo open source — luokai, 2025-02-18, 3 me gusta/1 RP
https://bsky.app/profile/luok.ai/post/3lihm6qiuyk27
Se presenta como el «primer modelo base de vídeo de código abierto centrado en humanos», afinado desde HunyuanVideo con más de 10 millones de vídeos para reproducir 33 expresiones y más de 400 movimientos naturales. Tiene más de un año, pero es la única publicación clara sobre un modelo abierto de vídeo encontrada en esa cuenta. -
Open Creative Studio v13.0, flujo integrado abierto para ComfyUI — Alessandro Perilli, 2026-01-26, 0 me gusta
https://bsky.app/profile/perilli.com/post/3mdddenkss22v
Se promociona como el flujo de trabajo integral más completo para ComfyUI, capaz de generar texto, imágenes, vídeo, audio, música, efectos y letras, gratis e ilimitadamente. -
Generación local de imagen con Qwen 3.7 27B, el pelícano — Simon Willison, 2026-08-14, 183 me gusta/14 RP
https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z
Informa de que Qwen 3.7 27B, ejecutado mediante LM Studio en un MacBook Pro M5 Max con un GGUF de 17 GB, produjo «el mejor pelícano en bicicleta» que había visto entre los modelos que funcionan en su portátil. Es un ejemplo de la capacidad de imagen local de modelos de pesos abiertos. -
Cuadrícula comparativa de pelícanos: GPT-6 Astra frente a GPT-5.6 — Simon Willison, 2026-09-04, 202 me gusta/9 RP
https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c
Publicó una cuadrícula de 12 imágenes que compara GPT-6 Astra con Sol, Terra y Luna de GPT-5.6. Continúa el benchmarking de la generación visual de modelos cerrados. -
Generación 3D de Blender con GPT-6 Astra, maqueta arquitectónica — Ethan Mollick, 2026-09-05, 163 me gusta/17 RP
https://bsky.app/profile/emollick.bsky.social/post/3murua22igs2i
Informa de que, a partir de un boceto y una explicación, el modelo creó en Blender una reconstrucción 3D del monumento no construido del siglo XVIII de Boullée, incluso con un recorrido narrado. En otra publicación del 7 de septiembre, señala que la generación visual de LLM cerrados se está convirtiendo en una herramienta de presencia y persuasión visual. -
«Midjourney pasó a formar parte de Meta.ai» — Midjourney Experience Newsletter, 2026-02-03, 1 me gusta
https://bsky.app/profile/midjourneynews.bsky.social/post/3mdxymie7pi25
⚠️ Precaución: procede de una cuenta de fans no oficial y probablemente simplifica en exceso los hechos. La verificación mediante WebSearch indica que Meta anunció en agosto de 2025 una colaboración para licenciar la «tecnología estética» de Midjourney; no fue una adquisición y Midjourney mantiene su independencia (referencia: TechCrunch, implicator.ai).
Señales
- El vídeo cerrado vive una competencia caótica: solo entre diciembre de 2025 y febrero de 2026, el feed de luok.ai recoge al menos siete nuevos modelos o versiones: Runway Gen-4.5, Kling IMAGE O1/VIDEO 2.6/O1, PixVerse V5.5, Vidu AI Q2, Seedance 2 y Niji 7. Destaca el impulso de los modelos chinos, como Kling, Vidu, PixVerse y Seedance.
- Sora pierde fuerza y se dirige al cierre: según las publicaciones de dahara1, en abril de 2026 los créditos de generación de la versión gratuita dejaron de funcionar y a finales de ese mes se anunció el «fin de Sora». Esto coincide con las noticias de que OpenAI cerró la app y la API de desarrolladores alrededor de marzo de 2026. El liderazgo del vídeo parece pasar a los modelos chinos y a funciones integradas en modelos generales de Google y OpenAI.
- La generación de imágenes se convierte en una función benchmarkeada del propio LLM: las publicaciones de Simon Willison y Ethan Mollick comparan más la capacidad de imagen y 3D de LLM generales como GPT-6 Astra, Claude Fable 5.1 y Qwen 3.7/3.8 27B que herramientas independientes de imagen. Esta práctica se ha establecido como cultura de benchmarks. La generación visual de GPT-6 Astra, como la recreación arquitectónica en Blender, se menciona como indicador de potencia en redes sociales.
- El vídeo de código abierto tiene poca presencia en Bluesky: a través de búsquedas y exploración de feeds, solo se encontró una publicación clara sobre un modelo abierto de vídeo: SkyReels V1, basado en HunyuanVideo, de febrero de 2025. No se encontraron referencias a Wan2.2, Qwen-Image o Z-Image, pese a que deberían ser modelos de pesos abiertos relevantes en 2026. El contenido de ComfyUI se limita sobre todo a anuncios periódicos de Open Creative Studio de Alessandro Perilli, más que a una conversación amplia.
- La relación Midjourney × Meta se presta a malentendidos: una cuenta no oficial afirmó de forma simplista que Midjourney se convirtió en parte de Meta.ai, cuando la realidad fue una licencia tecnológica, no una adquisición. Es un buen ejemplo de la necesidad de cautela ante la precisión de la información en redes sociales.
Límites
- La API oficial de búsqueda de Bluesky (
app.bsky.feed.searchPosts) devolvió 403 Forbidden para todas las consultas durante esta investigación, por lo que no se pudo realizar ninguna búsqueda por palabras clave. Otros endpoints públicos comoapp.bsky.actor.getProfile,app.bsky.feed.getAuthorFeedyapp.bsky.feed.getPostThreadfuncionaron correctamente, lo que apunta a una restricción específica del endpoint de búsqueda. - La página web de búsqueda
https://bsky.app/search?q=...también se renderiza en cliente y no devolvió contenido de publicaciones al recuperarla. - Ante esas limitaciones, se encontraron cuentas relevantes mediante búsqueda web y se leyeron sus feeds con
getAuthorFeed. No es una cobertura exhaustiva por palabras clave y depende de las cuentas que llegaron a aparecer en buscadores; probablemente explica sesgos como la poca cobertura del vídeo open source. - Se buscaron en la web publicaciones de Bluesky sobre «Wan2.2», «Qwen-Image», «Z-Image» y «HunyuanVideo», pero surgieron principalmente artículos de arXiv o cuentas no pertinentes, sin publicaciones relevantes identificables.
- No se pudieron confirmar identificadores de cuentas oficiales de Black Forest Labs, Runway, Stability AI o Civitai; las búsquedas de identificadores devolvieron errores 400 o resultados inexistentes.
- El feed de
stablediffusion.bsky.socialse detuvo entre enero y febrero de 2025 y no puede utilizarse para noticias actuales. - Respecto al criterio de completar «unas 20 publicaciones analizadas en cada red social», se revisaron más de 100 publicaciones en los feeds de seis cuentas y se seleccionaron 16 relevantes.
Lemmy
Lemmy — Últimas tendencias de IA de generación de imágenes y vídeo
Lemmy es parte de Fediverse y sus instancias están distribuidas, así que la investigación se centró en búsquedas de la API de lemmy.world (/api/v3/search) y lemmy.today —que en realidad refleja comunidades de lemmy.dbzer0.com—, complementadas por búsquedas web como site:lemmy.world. Se revisaron alrededor de 25 publicaciones en total.
Comunidades
- !«メールアドレス» — Aproximadamente 5.050 suscriptores. Comunidad central de generación de imágenes abierta basada en Stable Diffusion.
- !«メールアドレス» (
lemmy.todayla muestra como «Stable Diffusion Art») — 2.362 suscriptores. Publica cada día varias obras creadas con SDXL, ComfyUI y Krea2, a menudo con enlaces a civitai.com. - Stable Diffusion Anime, Stable Diffusion Abstraction, Stable Diffusion Witches, Stable Diffusion Furry y Stable Werewolves, todas comunidades especializadas de
lemmy.dbzer0.com— No publican el número de suscriptores, pero mantienen actividad diaria también en septiembre de 2026. - c/«メールアドレス» — Comunidad tecnológica general, donde se concentran grandes noticias cerradas como la controversia del escáner médico de Midjourney y temas de Sora.
- c/genart — 47 suscriptores. Comunidad pequeña que declara apoyar modelos generativos de IA abiertos y con licencias abiertas.
- c/«メールアドレス» — Comunidad de sentimiento anti-IA. Aunque no es exclusiva de imagen o vídeo, una publicación sobre querer abandonar la dependencia de herramientas de IA alcanzó 83 puntos.
- c/euroai — Comunidad especializada que publica listas de LLM e IA open source desarrollados en Europa.
Publicaciones
Más cercanas al código cerrado
- «Midjourney pivots from AI image generation to body scanning medical spa» (2026-06-18, puntuación 58, technology) https://lemmy.world/post/... vía theregister.com — Tema sobre la entrada de Midjourney en el negocio de escáneres CT por ultrasonidos tras alejarse de la generación de imágenes. The Register señaló que la tecnología subyacente es real, aunque no se han revelado socios.
- «Midjourney AI pivots to Theranos: Ultrasonic CT» (2026-06-19, puntuación 40, techtakes) vía pivot-to-ai.com — Publicación que ironiza comparando el giro anterior con Theranos, empresa fraudulenta de análisis de sangre.
- «I was wrong about the Midjourney ultrasound scanner» (2026-06-21, hackernews) https://twitter.com/MattZirwas/status/2068365802491834541 — El autor, inicialmente escéptico, verificó los hechos y rectificó.
- «Midjourney wants Hollywood studios to reveal details of their AI usage» (2026-07-05, puntuación 73, technology) vía techcrunch.com — En un litigio con tres estudios, Midjourney pide que Hollywood revele cómo utiliza IA.
- Publicación de reacción al fin de Sora de OpenAI: «OpenAI: decides to shut down their AI slop video generating model Sora» https://lemmy.world/post/44721138 — Se burla del cierre de la app independiente de Sora, anunciado el 24 de marzo de 2026, detenida el 26 de abril, y de la retirada prevista de la API de Sora 2 el 24 de septiembre de 2026.
- «OpenAI collapses media reality with Sora AI video generator» https://lemmy.world/post/12056737 — Comparte un artículo que teme la pérdida de confianza en vídeos anónimos.
- «OpenAI's new Sora video generator to require copyright holders to opt out, WSJ reports» https://lemmy.world/post/36665644 — Crítica a una política que requeriría a los titulares de derechos optar activamente por excluirse.
- «Elon Musk maakt complete AI-film met zijn versie van The Odyssey» (2026-07-22, films) vía ad.nl — Anuncia que Musk planea realizar una película de IA de larga duración basada en La Odisea con Grok Imagine.
- Publicación sobre análisis de ingresos de ChatGPT (2026-07-15, ai_reddit) — Analiza que la mayor parte de los ingresos de Grok, de xAI, procede de contenido de imagen y vídeo NSFW de pago.
- «Video AI» — Pregunta sobre los créditos gratuitos de generación de vídeo de Adobe Firefly. Firefly ofrece dos usos gratuitos; se comparan Hailuo, Kling, Runway, Pixverse y Hunyuan como alternativas.
Más cercanas al código abierto
- «Black Forest Labs launches FLUX 3 capable of generating images and 20-second video with audio» (2026-07-24, puntuación 1, tech) https://bfl.ai/blog/flux-3 — Lanzamiento limitado de FLUX 3, modelo multimodal capaz de generar imágenes y vídeos de 20 segundos con audio.
- «FLUX.2-klein-9b-kv-fp8 optimized variant» (2026-03-14, puntuación 8, stable_diffusion) vía huggingface.co — Variante ligera de FLUX.2 con compatibilidad de caché KV.
- «Black Forest Labs Opening up the first FLUX Creator Program» (2026-05-06, puntuación 3, stable_diffusion) — Anuncio de inicio de un programa para creadores.
- «Regisseur Martin Scorsese wordt adviseur bij AI-bedrijf» (2026-06-03, films) vía nu.nl — El director Martin Scorsese pasa a ser asesor de Black Forest Labs.
- «FLUX Chroma (The Perchance T2i model)» (hace alrededor de un año, comunidad Perchance) vía huggingface.co(lodestones/Chroma) — Modelo derivado que usa NAG (Normalized Attentive Guidance), con comentarios que valoran sus representaciones de lip sync.
- Ejemplos de publicaciones diarias en comunidades de Stable Diffusion (2026-09-06–09, generación local con SDXL/ComfyUI/Krea2): «Erika - Mahouka Koukou No Rettousei» (puntuación 16), «Colors in Quiet Water» (14), «Giant Wire Walker» (11), «Karin - Umi Monogatari» (13), todas con enlaces a civitai.com.
- «Opendream = NEW! Stable Diffusion Automatic1111/ComfyUI alternative that uses nondestructive layering like Gimp» https://lemmy.world/post/3243205 — Presentación de una interfaz OSS con edición de capas no destructiva al estilo GIMP.
- «Europäische KI- & LLM-Anbieter» (2026-02-15, euroai) — Lista de IA y LLM abiertos europeos que promueven soberanía tecnológica y protección de datos, incluidos modelos de imagen.
- «Your Lemmy Crash Course to Free Open-Source AI» https://lemmy.world/post/76020 — Guía introductoria de herramientas locales como text-generation-webui, Automatic1111 y ComfyUI + Pinokio.
Señales
- El mayor tema cerrado es la controversia del giro médico de Midjourney (puntuaciones 40–73): la transición desde generación de imágenes hacia equipos de diagnóstico por ultrasonidos generó reacciones a favor y en contra en technology, hackernews y techtakes. Destacan reacciones que lo comparan irónicamente con un fraude tipo Theranos, aunque también hubo autores inicialmente críticos que rectificaron tras verificar los hechos.
- OpenAI Sora se usa repetidamente como ejemplo de «AI slop». Incluso después del cierre de la app entre marzo y abril de 2026, siguen apareciendo conversaciones sobre la retirada prevista de la API de Sora 2 el 24 de septiembre de 2026.
- Black Forest Labs y FLUX dominan el lado open source. FLUX 3, con imágenes y vídeo de 20 segundos con audio; la variante ligera FLUX.2-klein; el Creator Program; y el nombramiento de Scorsese como asesor muestran actividad concreta cada trimestre.
- Las comunidades creativas cotidianas de Stable Diffusion Art, Anime y Abstraction son pequeñas —entre 2.000 y 5.000 suscriptores—, pero continúan publicando diariamente en septiembre de 2026 creaciones locales con SDXL, ComfyUI y Krea2. Esto evidencia la profundidad operativa real del código abierto.
- El sentimiento anti-IA también es una señal relevante: una publicación de c/fuck_ai sobre querer salir de la dependencia de IA alcanzó 83 puntos, por encima de muchas publicaciones de IA normales, lo que refleja un rechazo persistente a contenido generado por IA en Lemmy.
- Las noticias cerradas de Lemmy no suelen descubrirse allí de primera mano: se trata sobre todo de reacciones o republicaciones de medios como TechCrunch, The Register y WSJ. La información primaria está fuera de Lemmy.
Límites
- Lemmy tiene una escala pequeña de usuarios y publicaciones comparada con Reddit; las conversaciones dedicadas específicamente a IA de imágenes y vídeo son limitadas. No se encontraron comunidades especializadas que profundizaran en vídeo como Sora, Veo, Kling o Runway.
- La búsqueda de texto completo de la API de
lemmy.worldfue poco precisa. Consultas generales como "AI image generation" devolvían publicaciones irrelevantes, como mapas mundiales de la ONU o cría de búhos. Las búsquedas por modelos concretos, Sora, Midjourney o FLUX, ayudaron a encontrar contenido pertinente. - Algunas páginas, como
lemmy.world/post/44721138y una publicación sobre DLSS 5 enlemmy.world/post/44347792, devolvieron HTTP 500 o no permitieron obtener su contenido. Se juzgaron solo por títulos y fragmentos de búsqueda. - Se buscaron directamente en Lemmy modelos recientes como Grok Imagine, Qwen Image, HunyuanVideo, Wan2.2, Nano Banana/Gemini y Veo, pero casi no se encontraron menciones. Grok Imagine solo apareció una vez en el contexto de producción cinematográfica. Puede afirmarse que estos modelos tienen poca conversación en Lemmy.
- Las búsquedas individuales en lemmy.ml y lemm.ee resultaron, en muchos casos, duplicadas de lemmy.world o publicaciones reflejadas por la federación, sin información adicional independiente.
Pinterest — Noticias sobre IA de generación de imágenes y vídeo
Se revisaron visualmente las 50 imágenes recopiladas. No se dividieron en géneros: todas proceden de una única consulta, «Image and Video Generation AI News».
Temas visuales (temas visuales)
- Proliferación de plantillas de «cara de robot + noticia de última hora»: se repiten miniaturas de primeros planos de medio rostro de un robot humanoide blanco, combinados con texto de neón rojo y azul como "AI NEWS" o "BREAKING NEWS". Aparecen robots sentados en mesas de presentadores [22], rostros de youtubers sorprendidos junto a caras de robots [29] y robots femeninos con "THE FUTURE IS AI" [39]. Predominan azul marino oscuro y neones cian, magenta y naranja.
- Miniaturas con rostros de reacción de youtubers: en varios pines se repite una foto de un hombre blanco con expresión de sorpresa o sospecha, junto a iconos redondos de OpenAI, Google, Meta, Anthropic, Grok, Notion y otros, rodeados de neón [4, 18]. Parecen republicaciones de vídeos de YouTube.
- Infografías de recopilaciones «N mejores» (listicle): el formato más frecuente son infografías verticales con tarjetas numeradas sobre fondos oscuros violetas o negros. Runway, Pika, Kling AI, Luma AI/Dream Machine, Canva AI y Hailuo AI aparecen repetidamente como lista casi fija [9, 10, 27, 36, 50].
- Antes/después y comparativas tipo cuestionario: destacan composiciones que muestran dos fotos de montaña preguntando "Which is AI?" [13], o cuadrículas que transforman un vídeo fuente en personajes de bloques de madera, origami, Lego o flores [11]. Estas imágenes enfatizan lo difícil que resulta detectar la IA y su capacidad de transformar materiales.
- Escenas de colaboración entre robots y humanos, especialmente médicas: hay CG fotorrealistas de robots humanoides blancos manipulando hologramas junto a personal sanitario [3, 33], además de ilustraciones de médicos con estetoscopios junto a robots [32]. Presentan una convivencia humano-IA de tono más sereno.
- Estética tecnológica de oscuro + neón: fondos azul índigo o negros con circuitos luminosos, partículas y neones cian, magenta y púrpura conforman la paleta dominante de casi el 70 % de las imágenes, señal de un estilo típico de las noticias tecnológicas en Pinterest.
- Anuncios de generación de vídeo con avatares e iconos de personalidad: aparecen anuncios de servicios de vídeo tipo Fiverr con imágenes compuestas de Jeff Bezos [38], y una demostración fotorrealista oficial de AMD de 'Amuse 3.0' con el rostro de un pescador anciano [46]. Varios pines utilizan rostros famosos o retratos realistas para demostrar calidad de IA.
- Imágenes sobre si el contenido de IA se detecta o no: se repiten composiciones de un robot mirando un móvil, un sello «FAKE» y una foto de gato, o siluetas de personas enmascaradas [3], además de presentaciones de herramientas de detección de IA [37]. Visualizan la preocupación por autenticidad, engaño y desinformación.
Pines destacados (pines destacados)
- [11] Demostración de transformación de materiales al estilo Luma AI: compara en una cuadrícula cinco transformaciones del mismo vídeo fuente —una persona, un panda de peluche y un coche— a «bloques de madera», «origami», «bloques Lego» y «flores». Es el pin que muestra de manera más concreta el poder de transformación de texturas de la IA de vídeo.
- [24] Acuerdo de copyright entre ByteDance y Hollywood: imagen de noticia con el titular "ByteDance and Hollywood reach global deal on AI copyright". Indica que ByteDance y la Motion Picture Association (MPA) alcanzaron un acuerdo global para reforzar la protección de propiedad intelectual en herramientas de generación de imagen y vídeo. Es contenido cercano a una fuente primaria sobre la respuesta al copyright de una gran empresa cerrada.
- [35] Resumen de noticias de IA fechado el 12 de agosto de 2026: tres noticias: "Grok 4.6 drops", capaz de realizar decenas de pasos de forma autónoma y verificarse; "Gemini hits 1 billion users", donde Google llega a 100 millones de usuarios a gran velocidad, dos de cada tres usan entrada de voz y se generan 150 millones de imágenes al día; y "Honor's robot phone", con una cámara que sigue automáticamente al sujeto mediante un brazo de titanio. Es un pin poco común con fecha y cifras explícitas.
- [36] Ranking «Best AI Video Generators of 2026»: Google Veo 3.1, Runway Gen 4.5 y Kling 3.0 aparecen como los tres primeros con iconos de corona; les siguen Adobe Firefly, Seedance 1.5 Pro, Pika 2.5 y HeyGen. Es una lista de generaciones recientes con números de versión.
- [42] Vidu S1 de ShengShu Technology: imagen de producto para un modelo chino de vídeo con interacción en tiempo real, bajo el lema "The World's Most Advanced Model for Real-Time AI Interaction". Es uno de los pocos ejemplos que muestran actores chinos más allá de los modelos occidentales.
- [45] Artículo de adelanto de una nueva herramienta de imagen de OpenAI: imagen con el titular "OpenAI's Secret Image Generation Tool to Debut Soon", que anticipa una herramienta aún no anunciada.
- [25] Especial de Google I/O 2026: resumen fechado el 20 de mayo de 2026 de Gemini 3.5 Flash, Gemini Omni y Gemini Spark, transición a búsquedas con IA y competencia de gafas XR entre Apple y Google. Permite ver movimientos del ecosistema alrededor de la IA de imagen, no solo del producto aislado.
- [9] Infografía comparativa de herramientas de vídeo «Just Nail It»: organiza Runway, Pika, Kling AI, Luma AI, Canva AI y Hailuo AI por funciones y público objetivo, junto a la estadística de que para 2026 el 80 % del contenido online incluirá vídeo.
- [8] Conjunto de iconos de contenido IA para stock photos: imagen de stock al estilo Adobe Stock, «Ai Content Creation Concept», con iconos de generación de texto, imágenes, música y vídeo. No es una noticia en sí, pero refleja la demanda de este tipo de recursos.
- [43] Infografía cronológica de la historia de IA generativa: línea temporal púrpura desde ELIZA en los años 1950 hasta GPT en los años 2020. Sitúa el actual auge generativo en contexto histórico y educativo.
Señales (señales)
- Es difícil leer la dicotomía abierto/cerrado solo a partir de las imágenes: los pines de Pinterest se centran en presentaciones de herramientas, miniaturas de noticias y recopilaciones de consejos; no aparece una composición explícita de abierto contra cerrado como Seedance frente a Wan en Reddit o X. Vidu S1 [42], de ShengShu chino, y Amuse 3.0 [46], relacionado con AMD y más próximo a lo local, apenas destacan como alternativas a los grandes servicios cerrados estadounidenses como Google Veo, OpenAI Sora o Runway.
- Predominan las recopilaciones, comparativas y guías; las noticias rápidas son minoritarias: de los 50 resultados, solo [24], [25], [35] y [45] aproximadamente contienen fecha o anuncios concretos cercanos a información primaria. La gran mayoría son listicles perennes y contenido orientado a afiliación, como "Best AI Video Generators" o "10 Smart Ways", característicos de Pinterest y fáciles de guardar.
- Se hace visible el interés por incertidumbre y verificación: varias imágenes como [3], [22] y [37] usan sellos «FAKE», robots presentadores o herramientas de detección de IA. Esto indica una presencia apreciable de escepticismo e interés por la autenticidad entre los usuarios de Pinterest.
- Las generaciones de modelos se actualizan a gran velocidad: [36] confirma las versiones recientes de 2026 —Veo 3.1, Runway Gen 4.5, Kling 3.0 y Seedance 1.5 Pro—. Junto con Grok 4.6 y Gemini con 1.000 millones de usuarios de [35], las imágenes respaldan que las actualizaciones trimestrales se han normalizado.
- Ausencia: no aparece ninguna imagen de Stable Diffusion, ComfyUI o Hugging Face, símbolos de la cultura de pesos abiertos, local y autoalojada habitual en Reddit. Los resultados de Pinterest están muy sesgados hacia material promocional de herramientas comerciales y SaaS, y apenas visibilizan emisiones de comunidades verdaderamente open source.
Límites
- La recopilación la efectuó previamente un trabajador mediante navegador sin interfaz; este agente no navegó Pinterest directamente, siguiendo el playbook.
- No se realizó clasificación por géneros mediante secciones
## <genre> (n); los 50 resultados proceden de una sola consulta y no se puede comparar tendencias entre géneros. - Cinco pines, [5, 13, 15, 20, 24], tenían el título «(untitled)». En [24] el título está vacío, pero el contenido pudo inferirse a partir del titular de la imagen.
- Se incluyeron URL de pines —pinterest.com/pin/...—, pero no se verificaron abriendo el destino; las conclusiones proceden solo de las imágenes y títulos. No se recopilaron fechas de publicación ni métricas de «me gusta», por lo que, salvo imágenes con fecha impresa como [25] y [35], no se puede determinar el momento exacto.
- Frente al criterio de finalización de obtener al menos diez hallazgos tanto cerrados como abiertos, Pinterest por sí solo ofrece pocos hallazgos claramente clasificables como open source. Apenas [42], de origen chino, y [46], relacionado con AMD, pueden aproximarse a ello. Esta carencia debe compensarse con resultados de otras plataformas, como Reddit.
Acciones recomendadas
- Repetir la recopilación de X con términos directamente relacionados con el tema, como Midjourney, Stable Diffusion, Sora, Nano Banana y Qwen-Image.
- Incluir en adelante r/StableDiffusion, r/midjourney y r/comfyui, entre otros subreddits centrales y grandes, en el alcance de Reddit.
- Como sustituto de la búsqueda de Bluesky, crear una lista de seguimiento periódico con las cuentas principales identificadas en esta investigación.
- Dar máxima prioridad en la próxima investigación a la retirada de la API de Sora de OpenAI, prevista para el 24 de septiembre de 2026, y a las novedades del cambio de negocio de Midjourney.
Imágenes recopiladas


















































Nota sobre calidad de datos
X no recopiló ni una publicación relacionada con el tema debido al desajuste de los términos de búsqueda, por lo que no hay datos. Bluesky, Pinterest y YouTube tuvieron limitaciones en APIs de búsqueda o métricas de interacción, lo que debilita parte del respaldo cuantitativo.



