Noticias de IA de generación de imágenes y vídeo — 2026-09-18
En el ámbito de código cerrado, la generación de imágenes Nano Banana de Google se ha consolidado para uso personal, mientras Sora 2 retrocede con el cierre de su API (24/9). En código abierto, MiniMax-H3 y Qwen-Image dominan la escena de ComfyUI.
Resumen de noticias de IA de generación de imágenes y vídeo — 2026-09-18
Vaya, esta vez ha estado cargadísimo 🔥 En resumen, en el lado de código cerrado la familia Nano Banana de Google (generación de imágenes de Gemini) es claramente la protagonista, mientras que Sora 2, con el cierre de su app y de su API (24/9), empieza a transmitir una sensación de producto del pasado 🤖📉. En código abierto, MiniMax-H3 (generación de vídeo) y Qwen-Image (generación de imágenes) forman un claro duopolio; en particular, la comunidad de ComfyUI estaba inundada de conversaciones sobre MiniMax-H3 😳. También hubo una constatación importante: más que las comparativas de rendimiento de herramientas, los temas de ética y legislación, como la legalización de la generación sin consentimiento o la demanda de Disney contra Midjourney, son los que más atención están captando ⚖️🔥. Esta vez X (antes Twitter) no dio ningún resultado útil, así que lo indicaré honestamente como «sin datos» 🙏
En todas las plataformas
Aquí reunimos únicamente los temas que se pudieron contrastar en varias plataformas 📝✨
- 🍌 Nano Banana (generación de imágenes de Gemini) se está convirtiendo en una herramienta cotidiana para creadores individuales. En Bluesky, usuarios como dfl y triflingtree publican obras de Nano Banana 2 a diario (https://bsky.app/profile/dfl.bsky.social/post/3mvqfoprrek2i), y en YouTube «Ultimate Nano Banana Pro Guide 2026» está logrando muchas reproducciones en canales de hasta 327K suscriptores (canales como https://www.youtube.com/watch?v=Q7SiipUCjro). Nano Banana también apareció como integración en un hilo de Riverside en Reddit (https://www.reddit.com/r/RiversideFM/comments/1wiweik/).
- 🌊 Sora 2 está dejando de ser «lo que viene» para convertirse en objeto de retrospectiva. En Bluesky hubo publicaciones aconsejando cambiar a Runway/Kling/Veo tras el cierre de la aplicación independiente (https://bsky.app/profile/beginnersinai.bsky.social/post/3mhvsiik2ij2l), y en YouTube está pasando de protagonizar presentaciones de novedades a utilizarse como referencia en vídeos comparativos del tipo «State of AI Video». El cierre de la API está previsto para el 2026-09-24. Es justo el momento en que está cambiando la marea 😮
- 🧩 La estrategia dominante en código cerrado se orienta a las «plataformas integradas». Reddit (Adobe Firefly Boards y Riverside, que ofrecen varios modelos reunidos) y Pinterest (numerosas infografías que comparan Runway, Pika, Kling, Luma, Veo, Hailuo y CapCut) confirmaron la misma tendencia. En lugar de impulsar un solo modelo, parece que hemos entrado en la era de dejar elegir al usuario 🛠️
- 🐉 Los protagonistas del código abierto son MiniMax-H3 y Qwen-Image. La comunidad de ComfyUI en Lemmy estuvo prácticamente llena de publicaciones sobre herramientas de MiniMax-H3 a comienzos y mediados de septiembre (por ejemplo: https://github.com/filliptm/ComfyUI-FL-MiniMaxH3 , puntuación 5). Informes de usuarios indican que funciona localmente incluso en equipos con una RTX 3090 (puntuación 12 en comentarios). Qwen-Image apareció tanto en YouTube (incluidos vídeos de benchmarks de 700 pruebas) como en Bluesky (vista previa de Qwen3.8-Flash: https://bsky.app/profile/primereports.bsky.social/post/3mub3pkd2rf2s).
- ⚖️ Los temas de ética y legislación generan más atención que la tecnología. Reddit (hilos sobre si legalizar la generación con IA sin consentimiento, con cerca de 900 comentarios en total: https://www.reddit.com/r/CriticalState/comments/1wisk2n/), Bluesky (seguimiento de la demanda Disney contra Midjourney: https://bsky.app/profile/ai.bots.law/post/3mvqwgixvkm2n), Lemmy (Midjourney virando de generar imágenes a dispositivos médicos y recibiendo burlas de «¿Theranos o qué?»: https://awful.systems/post/8731127) y Pinterest (pines sobre el acuerdo de copyright entre ByteDance y Hollywood) mostraron que los temas legales y éticos fueron los más activos en cuatro plataformas.
- 😤 El rechazo al «AI slop» se mantiene fuerte y consistente. Reddit (críticas generalizadas en r/aitubers a los vídeos sin rostro totalmente automatizados desde guion) y Lemmy (una publicación en r/fuck_ai, «las empresas empeoran la IA», con puntuación 63) reflejan el mismo clima. No hay elogios acríticos en ninguna parte.
Plataforma por plataforma
Reddit — Debido a que el término de búsqueda era único, no se detectaron subreddits especializados en generación de imágenes como r/StableDiffusion. En su lugar, los hilos de ética y cultura (mal uso de imágenes de IA por DHS, debate sobre legalizar la generación sin consentimiento) concentraron la interacción. Las herramientas individuales (Google Flow, Wan, Minimax) recibieron valoraciones divididas y no había una sensación clara de que «esta sea la mejor» 😐
X — Aquí tengo que disculparme de verdad: fue un fallo completo 🙅♂️. Las 40 publicaciones recopiladas trataban exclusivamente de política, apuestas deportivas y criptomonedas; no había ni una sobre IA de generación de imágenes o vídeo. Al parecer, la búsqueda recogió tendencias de X como Africa, Serbia y Zcash, en vez de temas de IA. Dado que una de las seis plataformas especificadas en el informe no funcionó en absoluto, lo reportamos como una brecha real.
YouTube — En código cerrado, las novedades llegan a escala semanal: ChatGPT Images 2.5 de OpenAI (lanzado el 8/9) y Nano Banana Pro/2 de Google recibieron reseñas inmediatas y virales en canales medianos, de entre 30.000 y 330.000 suscriptores. El código abierto se concentra en canales técnicos como SECourses y explicaciones japonesas de Qwen-Image, con aproximadamente una décima parte de las visualizaciones del código cerrado. Otro dato inesperado: Seedance 2.0/2.5 de ByteDance fue el modelo de generación de vídeo más cubierto este año 📹
Bluesky — Mientras las publicaciones de creadores individuales con Nano Banana 2 aparecen diariamente, también se detectaron mediante bots de noticias LTX-2.5 de Lightricks, LoRA de FLUX y modelos completamente abiertos de Abu Dabi. Sin embargo, las búsquedas de frases como «Stable Diffusion», «Wan 2.5» y «Qwen Image» fueron rechazadas repetidamente con errores 403 de la API, por lo que las voces directas sobre generación de vídeo de código abierto quedaron subrepresentadas 😑
Lemmy — La plataforma más fructífera esta vez 🎯. !«メールアドレス» estaba lleno de extensiones de ComfyUI relacionadas con MiniMax-H3, y fue el lugar donde más claramente se vio el presente de la generación de vídeo de código abierto. En cambio, en el lado cerrado destacaron noticias de «desorientación», como el giro de Midjourney hacia dispositivos médicos; el tono general de Lemmy fue bastante escéptico.
Pinterest — La investigación visual recopilada previamente mostró una enorme cantidad de infografías SEO/de afiliación que comparan Runway, Pika, Kling, Luma, Veo, Hailuo y CapCut 🖼️. El contenido de alfabetización del tipo «distingue lo real de la IA» también se ha consolidado como género. Las conversaciones sobre código abierto fueron muy escasas: Stable Video Diffusion apenas aparecía como logo en listas de herramientas.
Qué vigilar
- 🔥 La expansión del ecosistema ComfyUI de MiniMax-H3 — Lemmy, https://github.com/filliptm/ComfyUI-FL-MiniMaxH3
- 📉 El cierre de la API de Sora 2 (previsto para el 2026-09-24) y el destino de sus usuarios — Bluesky, https://bsky.app/profile/beginnersinai.bsky.social/post/3mhvsiik2ij2l
- 🍌 La consolidación de Nano Banana Pro/generación de imágenes de Gemini entre creadores individuales — Bluesky, https://bsky.app/profile/dfl.bsky.social/post/3mvqfoprrek2i
- 🎬 La presencia de ByteDance Seedance 2.0/2.5 en generación de vídeo y su acuerdo de copyright con Hollywood — YouTube (tutorial de Dan Kieft) y pines de Pinterest sobre ByteDance-MPA
- ⚖️ La evolución del debate sobre legalizar la generación con IA sin consentimiento — Reddit, https://www.reddit.com/r/CriticalState/comments/1wisk2n/
- 🐦⬛ La creciente presencia de Qwen-Image en el ecosistema de pesos abiertos — YouTube (vídeos de benchmarks de 700 pruebas) y publicación de Bluesky sobre Qwen3.8-Flash
Recomendaciones
- En la próxima recopilación de X, volver a buscar con términos directamente vinculados a IA, como Sora, Nano Banana, Kling, Qwen, Flux y ComfyUI; esta vez se recogieron tendencias completamente irrelevantes.
- Seguir vigilando MiniMax-H3 y Qwen-Image como los dos indicadores más relevantes del panorama de código abierto.
- Seguir cómo cambia el destino de los usuarios de Sora 2 hacia Runway/Kling/Veo antes y después del cierre de su API (24/9).
- Dar más prioridad a la vía legal y ética —por ejemplo, la demanda Disney contra Midjourney y el debate sobre generación sin consentimiento— que a las comparativas de rendimiento de herramientas.
- Añadir a la recopilación de Reddit consultas dirigidas a subreddits especializados en generación de imágenes, como r/StableDiffusion y r/aiArt.
- Dado que Pinterest se basa solo en inferencias visuales, abrir y verificar en directo los artículos enlazados la próxima vez.
Calidad de los datos
X (antes Twitter) no aportó datos útiles: las 40 publicaciones recopiladas eran ajenas al tema. Reddit omitió comunidades especializadas en generación de imágenes por usar un solo término de búsqueda, y 5 de 12 hilos tenían puntuación 0pt y poca reacción. En YouTube, los errores 401/CAPTCHA impidieron confirmar cerca de dos tercios de la información y muchas cifras de visualizaciones de vídeo de código abierto no se pudieron verificar. En Bluesky, la API pública rechazó reiteradamente con 403 las búsquedas de frases, por lo que no se obtuvieron datos directos sobre «Stable Diffusion», «Wan 2.5» y similares. Lemmy se limitó a publicaciones indexadas en lemmy.world; otras instancias, como lemmy.ml, no se investigaron. Pinterest se basó únicamente en imágenes recopiladas previamente por un trabajador, sin verificación en directo.
Resumen por plataforma
Reddit — Noticias de IA de generación de imágenes y vídeo
Dónde
Se recopilaron 12 hilos de 11 subreddits utilizando la búsqueda «Image and Video Generation AI News».
| Subreddit | Miembros | Hilos recopilados |
|---|---|---|
| r/generativeAI | 154,407 | 1 |
| r/CriticalState | 35,134 | 2 |
| r/aifilmmaking | 8,038 | 1 |
| r/aitubers | 28,687 | 1 |
| r/agi | 123,187 | 1 |
| r/AIToolTalks | 6,513 | 1 |
| r/ContentCreators | 88,168 | 1 |
| r/AIContentAutomators | 9,387 | 1 |
| r/AIDangers | 53,842 | 1 |
| r/popculturechat | 6,680,224 | 1 |
| r/RiversideFM | 728 | 1 |
No aparecieron grandes subreddits especializados en generación de imágenes, como r/StableDiffusion o r/aiArt; con este término de búsqueda, los resultados se inclinan hacia subreddits de herramientas de IA, cultura y debates éticos.
Lo que dice la gente
- Hilo 1(r/generativeAI・13pt・41 comentarios・2026-09-16)https://www.reddit.com/r/generativeAI/comments/1whtesl/ — Ante la pregunta «¿Qué herramientas gratuitas de generación de vídeo con IA hay?», u/RioMetal respondió: «Si puedes ejecutarlo localmente, hay muchísimos Wan y Minimax»; u/juzellicious indicó: «Wan tiene 3 segundos diarios de cuota gratuita; Google Veo 3 todavía daba más». Se habla de una reducción de cuotas gratuitas en la nube y de un regreso a modelos locales/de código abierto.
- Hilo 3(r/aifilmmaking・7pt・7 comentarios・2026-09-14)https://www.reddit.com/r/aifilmmaking/comments/1wg7izt/ — Publicación que afirma que los créditos gratuitos de Google Flow son «muy generosos ahora». u/MechanicForward2274 dijo: «Con 50 créditos al día puedes probar bastante si no los desperdicias». Sin embargo, u/Sea-Temporary-6995 replicó: «Es débil en leyes físicas y lógica; Minimax es mucho mejor», reflejando opiniones divididas.
- Hilo 8(r/ContentCreators・0pt・6 comentarios・2026-09-17)https://www.reddit.com/r/ContentCreators/comments/1wj380j/ — Informe sobre la creación de un anuncio de belleza para especificaciones con Adobe Firefly Boards. El autor declaró explícitamente que eligió Firefly Video en vez de Veo o Kling por seguridad para uso comercial. u/avatar0027 señaló: «Los primeros planos son bonitos, pero la falta de continuidad entre planos revela el aspecto de IA».
- Hilo 12(r/RiversideFM・0pt・1 comentario・2026-09-17)https://www.reddit.com/r/RiversideFM/comments/1wiweik/ — Riverside, herramienta de producción de pódcast, lanzó funciones de generación de imágenes y vídeo que integran varios modelos, incluidos Seedance 2.5, Veo 3.1 y Nano Banana. Todos los planes de pago reciben 2.000 créditos.
- Hilo 4(r/aitubers・0pt・40 comentarios・2026-09-14)https://www.reddit.com/r/aitubers/comments/1wg3duk/ — Una publicación que preguntaba cómo crear vídeos de YouTube sin rostro totalmente automáticos a partir de un guion recibió una fuerte reacción negativa. u/RobJames007 comentó: «YouTube intenta reducir el AI slop y tú buscas herramientas para aumentarlo»; u/-NearlyThere- afirmó que los denunciaría y votaría negativamente.
- Hilo 9(r/AIContentAutomators・0pt・11 comentarios・2026-09-11)https://www.reddit.com/r/AIContentAutomators/comments/1wdm1n4/ — Afirmación de haber reducido costes de vídeo con IA usando los $300 de créditos gratuitos de nuevas cuentas Google Cloud y ganado $5.000 al mes. El comentario más votado, de u/Truegentlehat, cuestionó su credibilidad: «Hace una hora dijiste en otra publicación que apenas empezabas a ganar con €120 al mes. ¿Mentira?».
- Hilos 2 y 5(r/CriticalState・0pt/1pt・421/475 comentarios・2026-09-17)https://www.reddit.com/r/CriticalState/comments/1wisk2n/ , https://www.reddit.com/r/CriticalState/comments/1wiwhm4/ — Dos hilos de votación sobre «legalizar o prohibir la generación de imágenes de IA sin consentimiento». En ambos, los comentarios mejor valorados defendían la prohibición. u/AwarenessOk7862 señaló que «falsifica la realidad y dificulta aún más distinguir entre verdad y ficción».
- Hilo 11(r/popculturechat・448pt・22 comentarios・2026-09-11)https://www.reddit.com/r/popculturechat/comments/1wd49kb/ — El Departamento de Seguridad Nacional de EE. UU. (DHS) usó una imagen generada por IA de Optimus Prime en la comunicación de una campaña de deportaciones, lo que llevó a Hasbro a reaccionar. u/Jerkrollatex comentó: «Optimus también era un refugiado de guerra; ¿quienes hicieron esto son humanos recién llegados a la Tierra?».
- Hilo 7(r/AIToolTalks・12pt・35 comentarios・2026-09-13)https://www.reddit.com/r/AIToolTalks/comments/1wfhbnv/ — Publicación que expresa ansiedad sobre la IA en general —consumo de agua y pérdida de empleo— en un contexto que también incluye IA de generación de imágenes y vídeo. u/EstablishmentRare276 respondió: «Los centros de datos existen desde los años cincuenta; un vídeo de YouTube de dos horas equivale a 50 solicitudes pesadas de IA».
- Hilo 10(r/AIDangers・28pt・31 comentarios・2026-09-14)https://www.reddit.com/r/AIDangers/comments/1wg5y17/ — Afirmación de que «la IA no es una herramienta imprescindible y muchas empresas han experimentado deterioro, no mejora, de rendimiento». u/LopsidedSolution cuestionó la antigüedad del estudio: «¿Usaba modelos de 2024, como GPT-4o? Quiero que se vuelva a evaluar con Astra o Fable».
Señales
- Tendencia al alza: atención a modelos locales/de código abierto de generación de vídeo (Wan, Minimax). La reducción de cuotas gratuitas de la nube (hilo 1) está impulsando a usuarios que buscan evitar costes a ejecutar modelos por su cuenta.
- Tendencia al alza: herramientas de flujo de trabajo que integran múltiples modelos. Adobe Firefly Boards (hilo 8) y Riverside (hilo 12) permiten elegir modelos asociados de código cerrado, como Veo, Kling, Seedance y Nano Banana, desde una única plataforma.
- Fuerte rechazo: la automatización de vídeos sin rostro del tipo «introduces un guion y se genera todo» recibe sistemáticamente el calificativo de «slop» y se considera objeto de burlas o denuncias en r/aitubers y r/ContentCreators. Los testimonios de ganancias (hilo 9) también despiertan sospechas de publicidad o exageración.
- Conflicto visible: las evaluaciones prácticas de Google Flow y de la IA en general están divididas. En el hilo 3 se argumenta que Minimax es mejor; en el hilo 10 hay opiniones encontradas sobre si la IA mejora el rendimiento empresarial. Destacan los comentarios prácticos, lejos tanto de la celebración simple como del rechazo absoluto.
- Aspecto inesperado: los hilos sobre la legalidad de la generación sin consentimiento (hilos 2 y 5, cerca de 900 comentarios combinados) y el mal uso de imágenes generadas por IA por DHS (hilo 11, 448pt) generaron una interacción muy superior a los debates técnicos. Los hilos de comparación pura de herramientas se mantuvieron en puntuaciones bajas, de 0 a 13pt.
Límites
- Todas las búsquedas de Reddit se realizaron con un único término: «Image and Video Generation AI News». No se hicieron consultas separadas para «código abierto» y «código cerrado», ni por nombres concretos como Stable Diffusion, ComfyUI o Flux. Por ello, ningún resultado incluyó los principales subreddits especializados en generación de imágenes, como r/StableDiffusion o r/aiArt.
- Cinco de los 12 hilos recopilados tienen puntuación 0pt, por lo que una parte de la muestra presenta poca respuesta comunitaria. Las voces de subreddits pequeños —r/RiversideFM: 728 miembros; r/AIToolTalks: 6.513 miembros— deben interpretarse como muestras limitadas.
- Debido a restricciones del playbook, este agente no navegó Reddit directamente y solo refleja los 12 hilos recopilados previamente por el trabajador; no incluye publicaciones recientes ni hilos relacionados que no aparezcan con ese término de búsqueda.
- El periodo de recopilación se limita aproximadamente a una semana, del 2026-09-11 al 2026-09-17, por lo que no permite conocer la evolución de discusiones anteriores.
X
X — Noticias de IA de generación de imágenes y vídeo
Cuentas
Las 40 publicaciones recopiladas proceden de 39 cuentas distintas (output/x.posts.md), y ninguna está asociada a IA de generación de imágenes o vídeo: no aparecen Midjourney, OpenAI/Sora, Runway, Stability AI, Black Forest Labs, ByteDance/Kling, Pika, Luma ni identificadores similares. Las cuentas son una mezcla de comentaristas políticos (@GunterFehlinger, @AntiTrumpCanada, @Rusia_HD), pronosticadores de apuestas deportivas (@BDreamz37398, @thekasik, @TheRealCEOAmber), cuentas promocionales de cripto/NFT (@Hasan_NFTOX, @0xHeatt, @jubjubcommunity, @patlandcrypto, @AltcoinSherpa) y cuentas de comentarios o memes (@Keegan59992745, @LeeLovesBey, @Captian_Loden_4). Ninguna publica sobre generación de imágenes o vídeo por IA, y ninguna impulsa el tema, porque no hay actividad relevante en el conjunto.
Publicaciones
Sin hallazgos: ninguna de las 40 publicaciones trata de IA de generación de imágenes o vídeo, ni de código cerrado ni abierto. La revisión de cada publicación y de su texto completo frente al informe de investigación dio cero resultados relevantes. Ejemplos representativos ajenos al tema: #1 (https://x.com/TicTocTick/status/2100319322682134729, 16,936 me gusta, «Xi of China and Ramaphosa of Africa suffered from ischemic stroke...»), #35 (https://x.com/GunterFehlinger/status/2100099276672040971, 13,824 me gusta, «Russia is collapsing in Donbas») y #38 (https://x.com/Keegan59992745/status/2100583905204326909, 159,030 me gusta, un chiste sobre burritos/Israel), las tres publicaciones con más interacción y todas irrelevantes para IA.
Señales
No hay nada que informar sobre tendencias de IA de generación de imágenes o vídeo, de código cerrado o abierto, en X durante esta ejecución. El único patrón observable está en los propios términos de búsqueda: «Africa», «Serbia», «Zcash», «Germany», «$JubJub», «Canada», «Zagreb», «#CyberSecurity», «Russia», «Israel». Parecen tendencias de Explore de X para esta sesión y ubicación —según output/x.posts.md, Explore mostraba tendencias geolocalizadas en Croacia y de «Politics»—, no términos vinculados al informe. La recopilación buscó tendencias de X en vez del tema de IA de imágenes/vídeo.
Límites
- Los datos recopilados no responden al encargo de esta ejecución.
output/x.posts.mdyoutput/x.posts.jsoncontienen 40 publicaciones halladas buscando «Africa», «Serbia», «Zcash», «Germany», «$JubJub», «Canada», «Zagreb», «#CyberSecurity», «Russia» e «Israel»: contenido político, de apuestas deportivas y cripto, correspondiente a las tendencias geolocalizadas de Explore de X, no al tema «Image and Video Generation AI News». - Según el playbook, esta etapa no navega X directamente —las lecturas anónimas no devuelven nada— y trabaja solo con lo recogido previamente. Como ninguno de los términos recopilados guarda relación con IA de imágenes/vídeo de código cerrado o abierto —Sora, Veo, Midjourney, Runway, Kling, Stable Diffusion, Flux, ComfyUI, LoRA, Nano Banana, etc.— no es posible responder al encargo desde este archivo. Es necesario recopilar de nuevo usando términos del tema real.
- No se usó ningún término de búsqueda relevante para el encargo, por lo que no puede afirmarse qué dice o deja de decir X sobre IA de generación de imágenes y vídeo en esta ejecución.
YouTube
YouTube — Noticias de IA de generación de imágenes y vídeo
Canales
- Paul J Lipsky — reseñador general de herramientas de IA; su vídeo «ChatGPT Images 2.5 Is Here (And It's A LOT Of Fun)» alcanzó 277K visualizaciones en 9 días (ver).
- Kevin Stratvert — gran canal generalista de tutoriales tecnológicos; «ChatGPT Images 2.5 Tutorial for Beginners» logró 58K visualizaciones en 1 día.
- AI Master — 327K suscriptores; «Ultimate Nano Banana Pro Guide 2026: How to Use Gemini 3 Image AI», 76,658 visualizaciones desde el 17 de enero de 2026.
- JohnnyTube — 30.6K suscriptores; «Nano Banana 2 Is INSANE! Everything You Need To Know (Full Course)», 26,162 visualizaciones desde el 6 de marzo de 2026.
- AffContent — 262K suscriptores; contenido de comparativas/afiliación, como «BEST AI Image Generator in 2026 (Don't Choose Wrong!)», 14,694 visualizaciones desde el 9 de abril de 2026.
- Dan Kieft — 295K suscriptores, centrado en cine con IA; «Seedance 2.0 is CRAZY for AI Filmmaking - Full Course», 179,589 visualizaciones desde el 24 de abril de 2026, su mejor resultado reciente respecto de su rango habitual según el número de suscriptores.
- SECourses — 53.7K suscriptores, tutoriales densos de ComfyUI local/código abierto; «Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models», 6,649 visualizaciones (publicado el 18 de agosto de 2025, fuera de la ventana de 60 días; se mantiene como contexto de un canal activo de tutoriales de código abierto).
- Canales pequeños y de cola larga que aparecieron repetidamente en búsquedas de Qwen-Image y Wan, solo por título y sin métricas confirmadas: canales japoneses sobre «Qwen-Image完全ガイド» y tutoriales de «Qwen-Image-2512», y canales en inglés con «ComfyUI Text-to-Image Models Compared (Local): Qwen 2512, Z-Image, FLUX.2 klein, Ovis, LongCat».
Vídeos
- «ChatGPT Images 2.5 Is Here (And It's A LOT Of Fun)» — Paul J Lipsky, unos 9 días, 277K visualizaciones. https://www.youtube.com/watch?v=Q7SiipUCjro — Reacciona al lanzamiento de ChatGPT Images 2.5 de OpenAI del 8 de septiembre de 2026 (de boceto a imagen, ~50% menos latencia, modelos API Flare/Sunburst), y presenta la consistencia de identidad como la mejora más destacada.
- «ChatGPT Images 2.5 Tutorial for Beginners» — Kevin Stratvert, aproximadamente 1 día, 58K visualizaciones. Guía a una audiencia generalista por la nueva función de bocetos y la edición en varios pasos, que por fin conserva el contexto entre ediciones.
- «Everyone's Lying to You About GPT Image 2.5» — Joseph Martin, aproximadamente 2 días, 10K visualizaciones. Visión contraria: sostiene que el «salto» es principalmente de velocidad/latencia, no de calidad de imagen bruta, frente a GPT-Image-1.
- «Ultimate Nano Banana Pro Guide 2026: How to Use Gemini 3 Image AI» — AI Master, desde el 17 de enero de 2026, 76,658 visualizaciones. Guía de estructura de prompts en 6 partes (Sujeto+Acción+Entorno+Estilo artístico+Iluminación+Detalles) para el modelo Gemini 3 Pro Image de Google, orientada a fotos de productos y marcas.
- «Nano Banana 2 Is INSANE! Everything You Need To Know (Full Course)» — JohnnyTube, desde el 6 de marzo de 2026, 26,162 visualizaciones. Presenta Nano Banana Pro 2 como generador de imágenes y vídeo en una sola herramienta, comparado informalmente con Midjourney, Flux, Sora 2 y Veo 3.1.
- «BEST AI Image Generator in 2026 (Don't Choose Wrong!)» — AffContent, desde el 9 de abril de 2026, 14,694 visualizaciones. Resumen general/de afiliación que compara generadores de código cerrado gratuitos y de pago.
- «Seedance 2.0 is CRAZY for AI Filmmaking - Full Course» — Dan Kieft, desde el 24 de abril de 2026, 179,589 visualizaciones. Destaca Seedance 2.0 de ByteDance por la calidad de las secuencias de acción, precisión de prompts y consistencia visual, con limitaciones señaladas; es su vídeo de Seedance con más tracción frente a varias publicaciones de otros creadores sobre el mismo tema esa semana.
- «State of AI Video in 2026: Sora 2, Veo 3.1, Kling 3.0 & Cinematic Prompting Workflows» — @StarnationsAI, estrenado el 20 de marzo de 2026, 177 visualizaciones / ~1K suscriptores. Ejemplo de baja tracción incluido para mostrar que existe el formato de vídeo comparativo incluso en canales pequeños; la descripción incluye mucho contenido de formación corporativa ajeno al tema, rellenado con palabras clave de IA de vídeo.
- «Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models» — SECourses, 6,649 visualizaciones (18 de agosto de 2025, fuera de la ventana de 60 días, pero el dato más claro encontrado específicamente sobre código abierto). Prueba semanal de configuraciones preestablecidas para Wan 2.2 (vídeo), FLUX y Qwen-Image (texto a imagen), con descargas, preajustes, escalado y entrenamiento/ajuste fino.
- Grupo de títulos de código abierto con métricas no verificadas, encontrados mediante búsqueda pero no confirmados por la recuperación de páginas —YouTube bloqueó repetidamente las solicitudes de metadatos; ver Límites—: «Qwen-Image完全ガイド|ポスター作成から画像編集まで5分で終わらせる方法», «【徹底解説】最強オープンソース『Qwen-Image-2512』», «ComfyUI Text-to-Image Models Compared (Local): Qwen 2512, Z-Image, FLUX.2 klein, Ovis, LongCat» y «Qwen Image Dominates Text-to-Image: 700+ Tests Reveal Why It's Better Than FLUX.»
Señales
- La cadencia del código cerrado es semanal actualmente. OpenAI lanzó ChatGPT Images 2.5 el 8 de septiembre de 2026 y Google lanzó Nano Banana 2 (Gemini 3.1 Flash Image, 4K) el 26 de febrero de 2026; ambos provocaron oleadas de vídeos de tutoriales y reacciones esa misma semana en canales de 30K a 330K suscriptores, con decenas de miles de visualizaciones en días.
- Seedance 2.0 de ByteDance, lanzado el 10 de febrero de 2026, es el modelo de vídeo más cubierto en YouTube este año. Una búsqueda simple por título halló más de diez tutoriales y reseñas dedicados entre febrero y junio de 2026, más que para Sora 2, Veo 3.1 o Kling 3.0 individualmente. El mejor vídeo detectado, de Dan Kieft con 179.6K vistas, supera aproximadamente en 2x a los tutoriales líderes de imágenes de código cerrado.
- La conversación sobre Sora 2 en YouTube es retrospectiva, no prospectiva: los resultados se inclinan por comparativas de «estado de la IA de vídeo» antes que tutoriales de nuevas funciones, coherente con el cierre confirmado de la app de consumo el 26 de abril de 2026 y la fecha de retirada de API del 24 de septiembre de 2026. Se usa cada vez más como referencia que otros modelos superan, no como herramienta que aprender.
- La cobertura de código abierto se inclina hacia canales de tutoriales técnicos y profundos, al estilo SECourses, y explicaciones japonesas de Qwen-Image, en lugar del formato de gran comparativa dominante en código cerrado. Las 6,649 visualizaciones del vídeo abierto confirmado son un orden de magnitud inferior a los líderes cerrados, lo que apunta a una audiencia menor pero más técnica.
- Qwen-Image de Alibaba es el modelo de pesos abiertos que recibe más atención específica en vídeo, con un benchmark inglés de más de 700 generaciones frente a FLUX y varios vídeos japoneses que presentan el checkpoint Qwen-Image-2512 como algo ya difícil de distinguir de contenido no generado por IA.
Límites
- Las páginas de resultados de YouTube (
/results?search_query=...) y la mayoría de páginas individuales/watchdevolvieron repetidos bloqueos 401/CAPTCHA al intentar recuperar metadatos estructurados. Esta ejecución utilizó un proxy lector HTML porque la búsqueda de YouTube se renderiza con JavaScript del lado del cliente y una descarga simple no puede verla. Aproximadamente 1 de cada 3 intentos tuvo éxito; el resto se descartó o se informó solo con título/fecha de fragmentos del buscador. - Por ese bloqueo, no se pudieron confirmar recuentos exactos de visualizaciones, suscriptores ni descripciones completas de varios vídeos relevantes de código abierto, incluidas explicaciones de Qwen-Image-2512, la comparativa ComfyUI de Ovis/LongCat/Z-Image y Qwen-Image-Edit-Rapid-AIO.
- No se pudieron recuperar los comentarios principales de ningún vídeo; el mismo bloqueo impidió leer la sección de comentarios.
- No se pudieron confirmar cifras exactas de visualizaciones para vídeos generales de comparación de Sora 2 / Veo 3.1 / Kling 3.0, salvo el ejemplo de baja tracción de StarnationsAI; muchas páginas de vídeos comparativos devolvieron 401 constantemente.
- No se halló en esta ejecución un vídeo inglés dedicado y con buen rendimiento sobre un único modelo de generación de vídeo de código abierto —Wan, HunyuanVideo o LTX— con visualizaciones confirmadas. El único dato abierto verificable, de SECourses, combina Wan 2.2 con dos modelos de imagen y tiene más de un año.
Bluesky
Bluesky — Noticias de IA de generación de imágenes y vídeo
Fecha de investigación: 2026-09-18. Se utilizó la API pública de búsqueda de Bluesky (https://api.bsky.app/xrpc/app.bsky.feed.searchPosts) con palabras clave como «Sora 2», «Nano Banana», «Midjourney», «ComfyUI», «open weights model release» y «Runway/Veo», revisando hasta 15 publicaciones por consulta y más de 70 en total.
Cuentas(cuentas emisoras)
- dfl.bsky.social — creador individual que publica a diario ilustraciones de paisajes fotorrealistas hechas con Nano Banana 2 (generación de imágenes Gemini).
- triflingtree.bsky.social — usuario intensivo que publica abundantes obras de arte con IA usando las etiquetas
#NanoBananaProy#GeminiAi. - ai.bots.law — bot que sigue demandas y tendencias legales relacionadas con IA.
- gen-ai.news / aichina.news / stechtimes.com / channelnewsasia.bsky.social(vía bridgy) — bots y feeds de noticias que distribuyen novedades de la industria de IA generativa.
- pitchwall.bsky.social / onestudio1.bsky.social / beginnersinai.bsky.social — cuentas que presentan comparativas de herramientas de IA y noticias de productos.
- primereports.bsky.social / techpresso.bsky.social / theregister.com / socialmedialab.ca — cuentas internacionales de noticias que siguen las tendencias de apertura de pesos de modelos como Muse de Meta y Qwen de Alibaba.
- singularityhorizon.bsky.social / heppokopu.bsky.social / misaka-mikoto-17.bsky.social / 404ai.bsky.social — usuarios japoneses que crean arte con IA mediante Midjourney y entornos locales como ComfyUI.
Publicaciones(principales publicaciones)
Código cerrado
- Publicación que presenta una API de Sora 2: «Sora 2 API: A developer-friendly API for Sora 2 and Sora 2 Pro». 2026-09-15, Likes 0 / Reposts 0。
https://bsky.app/profile/pitchwall.bsky.social/post/3mvjwvr327k2u - Publicación comparativa de IA de vídeo: «Veo 3.1 vs Sora 2 vs Kling 3.0». 2026-09-14, Likes 2 / Reposts 0。
https://bsky.app/profile/onestudio1.bsky.social/post/3mvhdlv5vgk2w - Publicación que comenta el cierre de la app independiente de Sora y aconseja «cambiar a Runway, Kling o Veo», aclarando que OpenAI solo cierra la app independiente y no la tecnología. 2026-03-25, Likes 0。
https://bsky.app/profile/beginnersinai.bsky.social/post/3mhvsiik2ij2l - Publicación sobre una nueva presentación en la demanda de copyright de Disney contra Midjourney. 2026-09-18, Likes 0。
https://bsky.app/profile/ai.bots.law/post/3mvqwgixvkm2n - Ilustración de paisaje japonés en vista cenital generada con Nano Banana 2. Likes 25 / Reposts 1, 2026-09-17。
https://bsky.app/profile/dfl.bsky.social/post/3mvqfoprrek2i - Obra surrealista de árboles con la etiqueta
#NanoBananaPro. Likes 15, 2026-09-17。
https://bsky.app/profile/triflingtree.bsky.social/post/3mvpliiqt5c25 - Publicación de última hora: «Meta ya tiene su rival para Nano Banana 2». 2026-09-16, Likes 0。
https://bsky.app/profile/laiadesk.bsky.social/post/3mvmiod2iod26
Código abierto
- Noticia de que Lightricks convirtió LTX-2.3 en modelo heredado y cambió su recomendación a LTX-2.5. 2026-09-12, Likes 0。
https://bsky.app/profile/gen-ai.news/post/3mvdadb2upx2l - Publicación que presenta un LoRA de FLUX de pesos abiertos para representación de personas africanas, publicado a través de Modelers.cn. 2026-09-09, Likes 0。
https://bsky.app/profile/aichina.news/post/3mv3dcr6hgz2i - Publicación sobre el lanzamiento de «Qwen3.8-Flash», modelo multimodal MoE de Alibaba y vista previa de la arquitectura Qwen4. 2026-08-30, Likes 1。
https://bsky.app/profile/primereports.bsky.social/post/3mub3pkd2rf2s - Publicación que informa de que una institución de investigación de Abu Dabi publicó una familia de modelos de IA completamente abiertos, incluidos pesos, datos de entrenamiento y código. 2026-09-03, Likes 0。
https://bsky.app/profile/channelnewsasia.bsky.social/post/3mumk4agbwm2g - Publicación de análisis que indica que empresas chinas de IA están liberando sucesivamente modelos abiertos en medio de una guerra de precios con empresas occidentales. 2026-09-06, Likes 0。
https://bsky.app/profile/stechtimes.com/post/3muuykcvzv62i
Señales
- Nano Banana 2, la generación de imágenes Gemini de Google, se ha consolidado en las publicaciones cotidianas de creadores individuales. Personas como triflingtree y dfl publican trabajos casi a diario con las etiquetas
#NanoBananaProy#GeminiAi; parece un uso real extendido y no solo entusiasmo inicial. - En torno a Sora 2 conviven expectativa e incertidumbre. Hay noticias sobre API para desarrolladores, pero también publicaciones que recomiendan pasar a Runway/Kling/Veo tras el cierre de la app independiente. La reorganización de la estrategia de vídeo generativo de OpenAI es tema de conversación.
- Las demandas de copyright son un asunto relevante en código cerrado. Cuentas bot siguen el avance de Disney contra Midjourney, mientras continúa la disputa judicial entre estudios y empresas de generación de imágenes con IA.
- En código abierto predominan las novedades distribuidas por bots de noticias, con pocas publicaciones personales apasionadas. LTX-2.5 de Lightricks, LoRA de FLUX, Qwen3.8-Flash y modelos totalmente abiertos de Abu Dabi muestran una procedencia distribuida entre Occidente, China y Oriente Medio.
- Los modelos Muse de Meta —Spark/Glimmer 30B— siguen anunciándose como próximos a publicarse con pesos abiertos, y varias cuentas internacionales observan su evolución como rival de Nano Banana 2.
- ComfyUI se menciona como herramienta habitual de generación local entre usuarios japoneses, como heppokopu y misaka-mikoto-17. Se observa experimentación para acercarse localmente a la calidad de ChatGPT/Nano Banana.
Límites
- La API pública de búsqueda (
public.api.bsky.app/api.bsky.app) devolvió de forma intermitente HTTP 403 para solicitudes automatizadas. Consultas sencillas separadas por espacios, comoSora 2 videooMidjourney, funcionaron repetidamente, pero frases entre comillas —por ejemplo,"Stable Diffusion"— y consultas OR casi siempre fallaron. No se recuperaron datos ni una vez para «Stable Diffusion», «Wan 2.5» o «Qwen Image», lo que contribuye a la escasez de publicaciones directas sobre vídeo de código abierto. - Las páginas web de
bsky.appse renderizan en cliente; al recuperarlas directamente, el texto no se obtiene sin ejecutar JavaScript. Todas las lecturas se basan en texto y contadores de la API JSON. - Al no iniciar sesión, no fue posible ver el feed de cuentas seguidas, feeds personalizados ni listas privadas. Solo se obtuvo el ámbito de búsqueda pública por palabras clave.
- La búsqueda se hizo principalmente con nombres de productos y modelos en inglés; no se realizaron búsquedas activas en japonés. Las publicaciones japonesas que aparecieron —singularityhorizon, heppokopu, tjb-shizuka y otras— coincidieron incidentalmente con palabras clave inglesas, por lo que no se puede garantizar una cobertura completa del debate japonés.
Lemmy
Lemmy — Temas de IA de generación de imágenes y vídeo(septiembre de 2026)
Comunidades
- !«メールアドレス» — especializada en IA de generación de imágenes y vídeo de pesos abiertos, extensiones de ComfyUI y distribución de modelos. Fue el mejor hallazgo de esta ejecución, con concentración de publicaciones sobre el modelo de vídeo MiniMax-H3.
- !«メールアドレス» — alrededor de 1.6K suscriptores, 206 locales. Dedicada a ilustraciones de anime creadas con modelos de Stable Diffusion; solo SFW.
- !stable_diffusion_art / !stable_diffusion_abstract / !stable_diffusion_witches / !stable_diffusion_mycology / !stable_diffusion_furry / !stable_werewolves(todos en lemmy.today)— grupos de comunidades de publicación de arte con IA, subdivididas por temas nicho. Son más galerías de obras que fuentes de noticias.
- !«メールアドレス» — comunidad espejo que retransmite publicaciones de r/ArtificialIntelligence. Casi no hay discusión original de Lemmy.
- !«メールアドレス» — 8,235 suscriptores. Comunidad crítica con la IA, con muchas publicaciones escépticas sobre generación de imágenes/vídeo.
- !«メールアドレス» — 2,698 suscriptores. Comunidad de tono sarcástico que se burla de la publicidad exagerada de la industria tecnológica. Las noticias del cambio de rumbo de Midjourney tuvieron aquí su mayor conversación.
- !«メールアドレス» — noticias tecnológicas generales. Circularon varias noticias importantes relacionadas con Midjourney.
Publicaciones
- Ráfaga de extensiones ComfyUI para MiniMax-H3 (principal tendencia de código abierto) — alrededor de 20 publicaciones en !«メールアドレス» solo entre 2026-08-28 y 09-16. Ejemplos:
- «ComfyUI-FL-MiniMaxH3»(score 5、2026-08-30、github.com/filliptm/ComfyUI-FL-MiniMaxH3)con gestión de líneas temporales de prompts y composición de planos.
- «H3-World»(score 3、2026-09-02、huggingface.co/DANNY621/H3-World)se autodefine como «the first interactive world model built on MiniMax-H3».
- «ComfyUI-MiniMaxH3-CLSS»(score 0、2026-09-01、github.com/nazgut/ComfyUI-MiniMaxH3-CLSS)afirma generar vídeos con audio de longitud arbitraria en equipos de consumo con 16GB de VRAM.
- «ComfyUI_MinimaxH3_AutoContext»(score 1、2026-09-16、github.com/supElement/ComfyUI_MinimaxH3_AutoContext)promete generación continua de vídeo de longitud infinita incluso con poca VRAM.
- Según un comentario del usuario brucethemoose(score 12、2026-09-14), MiniMax-H3 permite referenciar libremente combinaciones de audio, vídeo e imágenes y funciona localmente en un PC doméstico con RTX 3090 + Ryzen 7800.
- Midjourney cambia de la generación de imágenes a dispositivos médicos, concretamente un escáner de ultrasonidos de cuerpo entero — publicación de !«メールアドレス»(https://awful.systems/post/8731127 、score 40、15 comentarios、2026-06-19). David Gerard presentó el anuncio de «Midjourney Medical» y los comentarios lo compararon repetidamente, de forma sarcástica, con Theranos. YourNetworkIsHaunted señaló un defecto técnico: «este aparato solo puede sumergir hasta personas de 60 pulgadas de altura, así que no puede capturar por encima del corazón»(score 10). Terranoid lo llamó «un ave maría tras el estancamiento del negocio de generación de imágenes»(score 10).
- La misma noticia también circuló varias veces en !«メールアドレス»: «Midjourney pivots from AI image generation...»(theregister.com、score 58、2026-06-18)y «Midjourney wants Hollywood studios to reveal...»(techcrunch.com、score 73、2026-07-05).
- Se informa que el negocio corporativo de Runway se ha duplicado — !«メールアドレス»(score 0、2026-08-30、republicación vía reddit.com/r/ArtificialInteligence/comments/1w2hnea). Se comentó que la retención neta de ingresos de contratos empresariales supera el 300%.
- La integración de «Nano Banana» en funciones de IA de Google Earth se detuvo al día siguiente de publicarse — publicación en !«メールアドレス»(fortune.com、2026-08-07)y en comunidades relacionadas con !«メールアドレス». Se señaló que cualquiera podía crear imágenes falsas de aspecto satelital, y se informó de que Google detuvo rápidamente la función.
- Comparativa del mismo prompt en seis modelos de vídeo con IA — !«メールアドレス»: «I ran the same prompt through 6 AI video models...»(score 1、2026-09-17、reddit.com/r/ArtificialIntelligence/comments/1wipgwa).
- Comparativa de coloreado de un manga en blanco y negro entre ChatGPT Images, Wan, Nano Banana Pro y Seedream — !«メールアドレス»: «Same Berserk spread, 4 AI colorizations. Looks like GPT wins again?»(score 1、2026-09-14). Compara Wan de código abierto con Nano Banana Pro, Seedream y GPT Images de código cerrado; varios comentarios valoraron el acabado de GPT.
- Publicación que muestra el tono anti-IA — !«メールアドレス»: «Why companies like anthropic and open AI make AI even worse»(score 63、2026-09-14). No trata específicamente de IA de imágenes/vídeo, pero sirve como indicador de la fuerte desconfianza de Lemmy hacia las grandes empresas cerradas.
- Informe de ejecución local de Qwen — !«メールアドレス»: «Testing Qwen 3.8 27B running locally on a single 5090»(score 1、2026-09-16、v.redd.it/jdrothgw4vph1). No es generación de imágenes propiamente dicha, pero se menciona como parte del contexto de ejecutar modelos abiertos en GPU de consumo.
- Flujo cotidiano de obras generadas por IA, como anime y arte abstracto — en !share_anime_art y comunidades !stable_diffusion_art aparecen publicaciones nuevas casi a diario con imágenes alojadas en civitai.com(por ejemplo, «Isshiki Clear - Mahjong Fight Girl», score 15, 2026-09-17, lemmy.dbzer0.com/post/75601449). Tienen poco valor noticioso, pero muestran el uso habitual de modelos como Stable Diffusion, Flux y Krea2.
Señales
- El lado de código abierto está dominado por MiniMax-H3. La comunidad stable_diffusion a comienzos y mediados de septiembre estaba prácticamente llena de herramientas de ComfyUI para este modelo de vídeo. Se destacan repetidamente la combinación de audio, imágenes y vídeo en GPU local, y las optimizaciones para funcionar con unos 16GB de VRAM.
- Hay pocas noticias positivas en código cerrado. Destacaron el giro de Midjourney hacia hardware y la suspensión de funciones de Google Earth, ambas noticias con tono de extravío. El informe de crecimiento de Runway fue una de las pocas notas positivas.
- El tono general de Lemmy es escéptico y crítico, especialmente en !fuck_ai y !techtakes. Hay poca admiración sin reservas y una gran diferencia de temperatura entre comunidades de implementación —familia stable_diffusion— y comunidades de crítica informativa —techtakes, fuck_ai—.
- Predominan las obras y los crossposts sobre el debate original. !ai_reddit es literalmente una retransmisión de Reddit, por lo que no debe considerarse información primaria surgida de Lemmy.
Limitaciones
- Lemmy está distribuido entre instancias y la API de búsqueda solo recoge publicaciones indexadas en lemmy.world. No hubo tiempo para buscar individualmente en lemmy.ml o lemm.ee; esta ejecución se limita a resultados federados a través de lemmy.world.
- Se buscaron varias palabras clave, como «Sora», «Veo», «Gemini image» y «Flux», pero no se encontraron publicaciones sobre los propios anuncios de nuevos modelos Sora 2 o Google Veo; aparecieron principalmente asuntos no relacionados. En Lemmy, las noticias de lanzamientos de productos de grandes actores cerrados son escasas.
- El artículo original de pivot-to-ai.com presentaba problemas de codificación y no se pudo citar directamente con WebFetch. El contenido se reforzó con el texto y comentarios de la publicación de Lemmy en awful.systems, además de informes externos hallados mediante buscador.
- La API fue inestable, con errores 400/500, al recuperar suscriptores comunitarios. Solo se pudieron obtener cifras de !share_anime_art —aprox. 1.6K—, !fuck_ai —8,235— y !techtakes —2,698—; no fue posible confirmar las cifras exactas de !stable_diffusion y !ai_reddit.
- Frente al criterio del informe de analizar unas 20 publicaciones por red social, se confirmaron más de 20 publicaciones con texto, puntuación y fecha usando varias búsquedas. En este archivo se seleccionaron solo nueve ejemplos representativos.
Pinterest — Noticias de IA de generación de imágenes y vídeo
Temas visuales
- Domina una plantilla infográfica de «resumen de noticias de IA» en neón oscuro. Fondos casi negros o azul marino, líneas brillantes en cian, magenta y púrpura, titulares blancos en negrita y filas numeradas de logotipos de herramientas en insignias redondeadas. Este lenguaje visual cubre la mayoría de pines informativos.
[6, 9, 10, 11, 18, 20, 26, 31, 38, 39, 41, 45, 48] - El formato de reto «detecta la IA», real frente a falso, está por todas partes. Comparativas en pantalla dividida o A/B que desafían a elegir la foto, vídeo u ojo real, además de una demostración de foto de alfombra roja con intercambio facial y un selfie hiperrealista con la leyenda «This is AI».
[3, 21, 24, 33, 46] - La IA aparece personificada como robot humanoide cromado o blanco. Androides de cuerpo entero —uno en un escritorio de presentador con «BREAKING NEWS», otro con un móvil junto a un sello «FAKE», otro tocando un globo luminoso sobre un paisaje urbano— representan a la IA en general en vez de a un producto concreto.
[3, 40, 44] - Miniaturas de reacción de youtubers para contenido de noticias de IA. Hombres sorprendidos o con barba junto a filas de logotipos de empresas —OpenAI, Google, Meta, Anthropic, Notion—, una convención visual reconocible para vídeos de «noticias semanales de IA».
[2, 19, 22, 42] - Demostraciones de una fuente de vídeo y muchos estilos que muestran tecnología de consistencia en imagen/vídeo. La misma persona caminando y el mismo coche se reinterpretan como bloques de madera, origami, piezas Lego, flores y juguetes: una demostración de difusión al estilo «Lumendra/Luminate».
[5] - Los mismos nombres de herramientas se repiten en todas las listas: Runway (Gen-3), Pika, Kling AI, Luma/Dream Machine, Google Veo (2 y 3), Canva AI, Hailuo AI (MiniMax), CapCut, ElevenLabs y Stable Video Diffusion.
[6, 10, 18, 20, 31, 45] - Retratos hiperrealistas generados por IA como demostración de calidad. Un pescador anciano fotorrealista de AMD «Amuse 3.0», una estatua de mármol y madera tocando el violonchelo y compuestos de rostros de «bebés IA» se usan para vender lo convincente que parecen los modelos actuales.
[25, 47, 50] - Encuadres de noticiero y periódico falsos para hablar de noticias de IA. Rótulos simulados de «BREAKING NEWS», un generador de avatares de presentador de noticias con IA —Wondershare Virbo— y una portada ficticia completa de periódico, «The AI Dispatch» del 15 de agosto de 2026, muestran cómo el contenido de noticias de IA imita las convenciones del periodismo de televisión e imprenta.
[14, 36, 40, 41]
Pines destacados
[5](sin título, cuadrícula de transformación de vídeo multestilo) — un vídeo fuente de una persona y un coche reinterpretado en cinco materiales distintos —madera, origami, Lego, flores y plástico de juguete—; la demostración concreta más clara del conjunto sobre la actual tecnología de consistencia imagen/vídeo.[9]«4 Major AI Updates You Need to Know in 2026» — nombra elementos específicos: «GPT-6 Astra» de OpenAI, Gemini volviéndose agéntico en Gmail/Docs/Slides, Adobe Premiere generando vídeo/audio dentro de la línea de tiempo y la ronda Series E de $2B de Cognition (Devin) a una valoración de $48B.[28]«ByteDance and Hollywood reach global deal on AI copyright» — pin de aspecto periodístico: ByteDance alcanzó un acuerdo con la Motion Picture Association para reforzar la protección de propiedad intelectual en sus herramientas de imagen/vídeo con IA.[45]«Today's AI News — May 20, 2026» — resume Google I/O 2026: Gemini 3.5 Flash, Gemini Omni, una revisión de Search impulsada por IA, funciones de accesibilidad de Apple AI y la carrera de gafas inteligentes de IA en Android XR.[41]«The AI Dispatch», 15 de agosto de 2026 — portada de periódico simulada que enumera una amplia variedad de temas actuales relacionados con IA: velocidad de inferencia, IA soberana, arneses de agentes, seguridad de IA e investigación profunda.[31]«AI Video Creation Tools Changing How Content Is Made» — el directorio individual de herramientas más exhaustivo hallado: 20 productos en categorías de texto a vídeo, imagen a vídeo, edición, voz en off, material de stock/B-roll y publicación/optimización.[24](sin título, foto de alfombra roja generada por IA frente a «clip original») — demostración de deepfake/intercambio facial que empareja un retrato brillante generado por IA con el clip fuente real de otra persona, ilustrando tecnología de transferencia de identidad.[40]«Discover how Grok is revolutionizing video...» — un robot humanoide presentador en un escritorio de «BREAKING NEWS» promociona la capacidad de vídeo de Grok.[47]«Amuse 3.0» — herramienta de arte de IA local/en dispositivo de AMD, demostrada con un retrato fotorrealista de un pescador anciano.[10]«AI Image Video: Best Quality vs Best Free» — infografía de árbol de decisión que divide las herramientas entre calidad superior de pago —ChatGPT Plus, Midjourney, Adobe Firefly, Runway Gen-3, Luma— y gratuitas —Ideogram, nivel gratuito de Gemini, SeaArt, Krea, CapCut—.
Señales
- Los resúmenes y listas de herramientas de generación de vídeo son el tipo de contenido más ruidoso y repetido. La audiencia de generación de imágenes con IA de Pinterest está formada sobre todo por creadores de SEO/afiliación que empaquetan el mismo conjunto de herramientas cerradas —Runway, Pika, Kling, Luma, Veo, Hailuo y CapCut— en vez de publicar noticias originales.
- El contenido de alfabetización «¿puedes distinguir que es IA?» —retos de real frente a falso y demostraciones de deepfake— es un subgénero completo. Sugiere que la ansiedad y curiosidad sobre detección son un motor de contenido independiente de cualquier lanzamiento de modelo concreto.
- Algunos pines hacen referencia a eventos fechados y con nombre posteriores al inicio de la ventana de recopilación —resumen de Google I/O 2026, «GPT-6 Astra», un digest de noticias de «15 de agosto de 2026» y la ronda de $2B de Cognition—; son lo más cercano a noticias verificables encontrado en esta plataforma.
- Los detalles de código abierto son escasos: «Stable Video Diffusion» aparece solo como un logotipo en un directorio de 20 herramientas
[31]; ningún pin aborda en profundidad lanzamientos de pesos abiertos, licencias o forks de la comunidad. - Nada del conjunto aborda metodología de entrenamiento, arquitectura de modelos o debates sobre datos/licencias, excepto el único pin del acuerdo de copyright ByteDance–MPA
[28].
Límites
- Esta etapa solo describe imágenes que el trabajador recopiló previamente —según
platforms/pinterest.md—; no se navegaron Pinterest ni artículos enlazados en directo. Ninguna afirmación se ha contrastado con una página viva o el artículo tras cada pin. - Varios pines son plantillas casi duplicadas de cuentas que parecen de republicación o scraping: el gráfico neón de stock «Generate content with AI» aparece dos veces
[11, 26], el banner de Google Veo 2 aparece dos veces[7, 8]y la lista «Best AI Video Generation Websites» aparece dos veces con la misma lista de herramientas[6, 18]. - Cinco pines no tienen título (
(untitled)) en la tabla de origen[8, 17, 20, 21, 24, 28... ]; concretamente[8, 20, 21, 24, 28]tenían títulos vacíos o genéricos, lo que limita la atribución a lo visible en la imagen. - El conjunto de pines es de un solo género —no se definió un desglose por género en esta ejecución—, por lo que no se pudo hacer comparación por género: los 50 pines procedían de una única búsqueda indiferenciada.
Acciones recomendadas
- Recopilar de nuevo X buscando Sora, Nano Banana, Kling, Qwen, Flux y ComfyUI, entre otras palabras directamente relacionadas con IA; esta vez se recogieron erróneamente tendencias de X y el resultado fue completamente vacío.
- Mantener MiniMax-H3 y Qwen-Image como indicadores principales del ecosistema de código abierto.
- Seguir el movimiento de usuarios de Sora 2 hacia Runway/Kling/Veo alrededor del cierre de su API, el 2026-09-24.
- Vigilar con igual o mayor prioridad que las comparativas de herramientas las líneas legales y éticas, incluidas la demanda Disney contra Midjourney y el debate sobre legalizar la generación sin consentimiento.
- Añadir consultas a Reddit dirigidas a comunidades especializadas en generación de imágenes, como r/StableDiffusion y r/aiArt.
- Verificar en directo los artículos enlazados a los hallazgos de Pinterest.
Imágenes recopiladas


















































Nota sobre la calidad de los datos
De las seis plataformas especificadas en el informe, X no pudo utilizarse porque los datos recopilados estaban completamente fuera de tema. Reddit, Bluesky y YouTube también omitieron algunos temas principales —Stable Diffusion, Wan 2.5 y otros— debido a limitaciones de términos de búsqueda o de API (403/401/CAPTCHA).



