KEN’S CAT LOG

Noticias de IA para generación de imágenes y vídeo — 2026-09-20

El código abierto (en especial los modelos chinos Qwen, Wan y MiniMax-H3) está ganando presencia rápidamente como refugio para quienes agotan los niveles gratuitos de servicios cerrados. Por otro lado, la etapa de X no produjo datos debido a términos de búsqueda irrelevantes, así que este informe se sustenta en la práctica en solo cinco plataformas.

Resumen de noticias de IA de generación de imágenes y vídeo: código cerrado vs. código abierto — 2026-09-20

¡Ey! Esta vez revisamos a toda velocidad seis plataformas: Reddit, X, YouTube, Bluesky, Lemmy y Pinterest 🔥🔥 En resumen, el bando de código cerrado (Google Veo/Nano Banana, Sora 2, Midjourney, Kling y Seedance) sigue protagonizando las noticias y la sincronización de audio se está convirtiendo de verdad en una función estándar. Sin embargo, el bando de código abierto —sobre todo Qwen, Wan y MiniMax-H3 de China— está alcanzándolos a una velocidad brutal y se ha consolidado como refugio para usuarios que se quedan sin créditos gratuitos 🚀. También es importante que el rechazo a los contenidos generados por IA está creciendo más entre el público general que en las comunidades de entusiastas de IA 😤. Eso sí: siendo sinceros, la etapa de X fue un fracaso total, por lo que la base de este informe equivale a cinco plataformas 🙏

Entre plataformas

  • El impulso del código abierto no se detiene: hay una coincidencia muy clara entre Reddit (Wan, Minimax H3 y Krea2 aparecen en varios hilos como alternativas tras agotar los niveles gratuitos de servicios cerrados), Lemmy (más de 15 publicaciones de herramientas ComfyUI para MiniMax-H3 solo en septiembre en la comunidad !stable_diffusion) y YouTube (Qwen-Image→Qwen-Image-2512→Z-Image, y Wan 2.5→2.6→2.7 se actualizan casi mensualmente). La idea de «código abierto = gratis y de alta calidad» está convirtiéndose en el estándar de facto 💪
  • La generación de vídeo cerrada da por sentado que incluye sonido: se confirmó la misma tendencia en Bluesky (audio sincronizado de Kling 3.0 anunciado por Replicate, e integración de audio y vídeo de Seedance 2.0) y YouTube (Grok Imagine 1.5 se presenta como capaz de generar diálogos y sonido ambiente a la vez) 🎬🔊
  • La familia Veo/Nano Banana de Google se ha convertido en la “cara” del código cerrado: se confirmó por triplicado en Pinterest (vídeos cálidos de estilo Pixar de Veo reutilizados repetidamente como imágenes virales), YouTube (Theo - t3.gg afirma que «Google ganó la generación de imágenes») y Reddit (se comenta la ampliación de créditos gratuitos de Google Flow) 👀
  • El rechazo a los contenidos generados por IA está explotando fuera de los círculos pro-IA: Reddit (354 puntos de indignación porque ArtPrize aceptó obras de IA, y 63 puntos de quejas por cuotas laborales de producción masiva de imágenes), Lemmy (la comunidad anti-IA !fuck_ai tiene 9.179 usuarios activos mensuales, una de las mayores de Lemmy) y Pinterest (los cuestionarios de autenticidad «Real vs. AI» se han asentado como género propio) reflejan el mismo ambiente 😨
  • La información primaria circula más a través de personas que de empresas: en Bluesky las cuentas corporativas oficiales están casi en silencio; las fuentes son investigadores individuales como Simon Willison y proveedores de alojamiento como Replicate. En YouTube, los resúmenes semanales de canales individuales como AIPOD-CAST y Lev Selector son también fuentes de noticias. Parece una tendencia común que haya pocos canales donde las empresas publiquen información primaria 📢

Plataforma por plataforma

Reddit: se recopilaron 12 hilos de 9 subreddits, sin alcanzar el objetivo de 20. Varios hilos repitieron que el código abierto —Wan, Minimax H3 y Krea2— se está convirtiendo en la salida cuando se terminan los niveles gratuitos de soluciones cerradas. Las opiniones sobre GPT Image 2.5 Flare están divididas entre quienes lo consideran «increíble» y quienes dicen que «es igual que Krea2» 😂. Lo más llamativo fue que el debate más intenso no estuvo en subreddits técnicos, sino en comunidades generales (la reacción a ArtPrize, 354 puntos) y profesionales (las quejas de diseñadores, 63 puntos).

X: sinceramente, aquí ocurrió un accidente total 🙈 Las 40 publicaciones recopiladas solo buscaban tendencias generales del entorno de Croacia, como «Greenland», «#Bitcoin» y «Chelsea», y no hubo ni una publicación sobre IA de generación de imágenes o vídeo. Por tanto, X no aportó ninguna conclusión sobre código cerrado ni abierto. Es una laguna clara en una plataforma mencionada explícitamente en el encargo 🕳️

YouTube: se revisaron 12 vídeos. Los canales centrados en código cerrado (Theo, Astrovah, Woollyfern, especializado en actualizaciones mensuales de Midjourney, y FixNode) y los enfocados en código abierto (Bijan Bowen, HitPaw, MaxonShire y Promptus AI) están claramente diferenciados. El lado abierto destaca «ComfyUI», «ejecución local» y «gratis», mientras que el cerrado apuesta por calidad y funciones. Fue una pena que la fuerte dependencia de JavaScript de los resultados de búsqueda impidiera recuperar casi todas las cifras de visualizaciones y suscriptores 😅

Bluesky: como la API oficial de búsqueda devolvía repetidamente 403, se pasó a seguir publicaciones de investigadores individuales —Simon Willison, Max Woolf y Ethan Mollick— y de Replicate. Como resultado, casi todas las publicaciones encontradas trataban de código cerrado: GPT Image 2, Runway Gen-4.5, Kling 3.0, Seedance 2.0 y Vidu Q3. No se encontraron cuentas activas de comunidades de código abierto; la única cuenta parecida había dejado de publicar en febrero de 2025. También resultó curioso que la imagen de un pelícano montando en bicicleta se haya convertido en un tópico recurrente para comparar modelos 🐦🚲

Lemmy: fue la plataforma más equilibrada, con una separación clara entre abierto y cerrado. Del lado abierto destacan la avalancha de MiniMax-H3 en la comunidad !stable_diffusion y el nuevo modelo Boogu-Image-0.1 (Apache-2.0, 10.000 millones de parámetros). Del lado cerrado aparecieron Nano Banana 2 Lite de Google, MAI-Image-2.5 de Microsoft, experimentos narrativos largos con Sora 2 y la sorprendente noticia de que Midjourney «pivotaría hacia un spa médico» 😲. La presencia de la comunidad anti-IA !fuck_ai (8.252 personas) fue un hallazgo particular de Lemmy.

Pinterest: se verificaron, con imágenes, 30 de los 50 pines recopilados previamente. Se producen en masa listas de herramientas cerradas y plantillas reutilizadas de miniaturas «AI NEWS», mientras que las señales de código abierto son casi inexistentes: solo apareció una herramienta local, Amuse 3.0. Destacaron la reutilización constante de imágenes de Veo de Google y la consolidación de cuestionarios de autenticidad del tipo «¿esto es IA o real?» como género 🎨

Qué vigilar

Recomendaciones

  • Repetir la recopilación de la etapa de X con términos directamente relacionados, como "Sora 2", "Midjourney", "Stable Diffusion", "Runway Gen", "Kling AI" y "open source image generation".
  • Incluir de forma permanente en la lista de vigilancia la frecuencia de lanzamientos de proyectos chinos de código abierto, como MiniMax-H3, Qwen, Wan y Z-Image.
  • Seguir no solo las comunidades especializadas en IA, sino también las generales y profesionales, ya que emiten señales fuertes de rechazo.
  • Verificar antes de la próxima ronda formas de evitar el problema 403 de la API oficial de búsqueda de Bluesky.
  • Dar seguimiento en la próxima ronda al problema de «production memory» de Sora 2 y al giro de Midjourney hacia los spas médicos.
  • Recopilar Pinterest con etiquetas de género para poder clasificar automáticamente abierto y cerrado.

Calidad de los datos

La etapa de X usó términos de búsqueda no relacionados con el tema —geopolítica, criptomonedas y fútbol, entre otros—, de modo que 0 de las 40 publicaciones recopiladas eran pertinentes y no hubo datos útiles. Reddit (12 elementos) y Bluesky (unas 12 publicaciones extraídas mediante cuentas individuales por el bloqueo de la API de búsqueda) no alcanzaron el criterio de finalización del encargo, de aproximadamente 20 publicaciones por plataforma. Pinterest y YouTube también tuvieron restricciones parciales: Pinterest carecía de etiquetas de género y de navegación en vivo, mientras que YouTube no permitió obtener visualizaciones ni suscriptores debido a JavaScript. Aun así, se obtuvo suficiente información para el resumen. Lemmy y YouTube fueron relativamente sólidos y ofrecieron conclusiones concretas sobre ambos bandos.

Resumen por plataforma

Reddit

Reddit — Noticias de IA de generación de imágenes y vídeo

Dónde

Los 12 hilos recopilados provienen de 9 subreddits.

Subreddit Miembros Hilos recopilados
r/generativeAI 154,961 4
r/graphic_design 2,929,382 1
r/GeminiAI 375,783 1
r/grandrapids 161,719 1
r/aitubers 28,785 1
r/ImagineAiArt 19,335 1
r/AIToolTalks 6,757 1
r/aifilmmaking 8,200 1
r/aivideomaking 7,267 1

r/generativeAI es el centro principal dedicado a la generación de imágenes y vídeo con IA (4 elementos). r/GeminiAI y r/ImagineAiArt recogen experiencias con modelos cerrados; r/aifilmmaking y r/aivideomaking abordan la producción de vídeo desde una perspectiva práctica; r/grandrapids y r/graphic_design muestran reacciones cuando los contenidos de IA entran en contacto con la vida real —concursos artísticos y trabajo—; y r/AIToolTalks sirve como salida para la ansiedad sobre la IA en general.

Qué dice la gente
  • Hilo 1, «Which AI video generator can still be used for free?» (r/generativeAI, 18 puntos, 57 comentarios, 2026-09-16) https://www.reddit.com/r/generativeAI/comments/1whtesl/ — La generación abierta/local —Wan y Minimax— se ha convertido en la salida una vez agotados los niveles gratuitos de herramientas cerradas. u/RioMetal: «If you can go local you have plenty of them, like Wan or Minimax».
  • Hilo 2, «GPT Image 2.5 Flare — is this actually the best AI image generating model right now?» (r/ImagineAiArt, 84 puntos, 60 comentarios, 2026-09-16) https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/ — Opiniones totalmente divididas. u/oldboi777 lo elogia como una «incredible upgrade», mientras que u/SeaworthinessFresh16 señala que «The result in Comfyui with Krea2 looks the same».
  • Hilo 12, «Need a good video generation AI for image to video of people» (r/generativeAI, 0 puntos, 22 comentarios, 2026-09-15) https://www.reddit.com/r/generativeAI/comments/1wh1y9d/ — La publicación se centra en quejas sobre filtros de censura de herramientas cerradas, Google Flow / Nano Banana Pro. u/f5alcon afirma: «Minimax H3 is the best local generator»; u/jworm0624 recomienda: «Krea 2 turbo for images, minimax h3 for videos. All on comfyui».
  • Hilo 7, «Google Flow is giving creators a surprisingly generous amount of free AI video generation right now» (r/aifilmmaking, 8 puntos, 7 comentarios, 2026-09-14) https://www.reddit.com/r/aifilmmaking/comments/1wg7izt/ — Google Flow/Veo, de código cerrado, amplió sus créditos gratuitos y está evolucionando de simple generación de vídeo a partir de texto a un espacio de trabajo de producción con construcción de escenas, control de cámara y referencia de materiales. Pero u/MrBoondoggles mantiene una visión fría: «I'm not surprised Google is giving away Veo at this point... trying to maintain some interest in their product».
  • Hilo 8, «Did Anyone Notice Sudden Quality Drop of Image Generation? From 2 MB to 500 KB» (r/GeminiAI, 10 puntos, 25 comentarios, 2026-09-17) https://www.reddit.com/r/GeminiAI/comments/1wj02p4/ — Se informó de una bajada de calidad en Gemini —PNG→JPEG, 8 MB→2 MB→500 KB—, con quejas incluso de personas con planes de pago. u/Well_HellooF: «there's no difference in quality between the free version and the paid one. suck».
  • Hilo 5, «ArtPrize Allows Generative AI» (r/grandrapids, 354 puntos, 176 comentarios, 2026-09-16) https://www.reddit.com/r/grandrapids/comments/1wi4ub0/ — Fuerte rechazo a que un concurso artístico admita obras generadas por IA. u/Chirotera (319 puntos): «Fucking disgusting. It is not AI "Art," it's fucking theft.». La ira de la comunidad general es mayor que la de los subreddits técnicos.
  • Hilo 10, «Company expects us to generate 500 AI images PER WEEK. Is this realistic?» (r/graphic_design, 63 puntos, 133 comentarios, 2026-09-17) https://www.reddit.com/r/graphic_design/comments/1wieke2/ — Diseñadores en activo se quejan de cuotas de producción masiva con herramientas cerradas, ChatGPT. u/Diligent-Educator409 (123 puntos): «500 AI images? Yes. 500 good AI images? No. 1 good AI image? Also no.»
  • Hilo 9, «best apps for generating AI videos» (r/aitubers, 0 puntos, 46 comentarios, 2026-09-14) https://www.reddit.com/r/aitubers/comments/1wg3duk/ — Hay demanda de herramientas cerradas que generan vídeos automáticamente desde guiones, como InVideo AI y Steve AI, pero la comunidad reacciona con frialdad. u/RobJames007 (15 puntos): «Youtube is trying to reduce AI slop, not allow more of it onto the platform.»
  • Hilo 3, «Please help me generate free ai video without subscription» (r/aivideomaking, 0 puntos, 20 comentarios, 2026-09-15) https://www.reddit.com/r/aivideomaking/comments/1wh80z3/ — u/Chance-Business dice «google flow you get 50 free credits per day, each vid is 6-12 credits», frente a u/Bastisheen92: «Local Generation is free if you already own the Hardware». Reproduce el contraste clásico entre créditos gratuitos cerrados y ejecución local abierta.
  • Hilo 11, «Are all of you also anxious about recent news about AI?» (r/AIToolTalks, 12 puntos, 36 comentarios, 2026-09-13) https://www.reddit.com/r/AIToolTalks/comments/1wfhbnv/ — No trata específicamente de generación de imágenes o vídeo, sino de preocupaciones generales sobre consumo de agua, pérdida de empleo y regulación. Los comentarios están claramente enfrentados: u/Big-Pops78 relativiza el consumo de agua, mientras u/UnburyingBeetle replica irónicamente a la expresión «cost efficiency».
Señales
  • Tendencia al alza: nombres de modelos abiertos/locales como Wan, Minimax H3, LTX Video y Krea2 se repiten en varios hilos independientes —1, 2 y 12— en el mismo contexto: alternativas tras terminarse los niveles gratuitos de servicios cerrados. La generación local se está convirtiendo en sinónimo de «gratis y alta calidad».
  • Minimizado o recibido con cinismo: hay un fuerte sarcasmo hacia los servicios de generación de vídeo que se anuncian como gratuitos. En varios hilos —1, 4, 6 y 12— la cuenta bot u/Jenna_AI publicó extensos comentarios sarcásticos, similares entre sí, sobre servicios que prometen gratuidad pero terminan cobrando. Es representativo del ambiente cínico de la comunidad.
  • Lo inesperado: las comunidades generales —r/grandrapids, 354 puntos y 176 comentarios— y profesionales —r/graphic_design, 63 puntos y 133 comentarios— tienen más interacción y puntuación que los subreddits de IA —r/generativeAI y similares, mayoritariamente de un dígito a unas decenas de puntos—. El rechazo y el debate aumentan cuando los contenidos generados por IA chocan con la vida cotidiana o el trabajo.
  • Conflicto de opiniones: el hilo 2 sobre GPT Image 2.5 Flare enfrenta «incredible upgrade» de u/oldboi777 a «Krea2 produce el mismo resultado» de u/SeaworthinessFresh16. El hilo 7 sobre Google Flow/Veo también mezcla voces positivas sobre la generosidad de los créditos gratuitos con críticas como «it's weak at physics and logic. Even Minimax is far better» de u/Sea-Temporary-6995.
Límites
  • Solo se recopilaron 12 hilos, por debajo del criterio de finalización del encargo —analizar unas 20 publicaciones por plataforma—. Estos 12 elementos son todos los datos de Reddit disponibles; en esta etapa no se puede buscar ni navegar más Reddit según las instrucciones del playbook.
  • Solo hay evidencia de que se usó la consulta en inglés "Image and Video Generation AI News"; no se probaron consultas en japonés ni enfoques como «código abierto» o «código cerrado».
  • Algunos subreddits, incluidos r/aitubers, r/aivideomaking y r/AIToolTalks, aportaron un único hilo, por lo que no es posible medir la intensidad de las tendencias internas de cada comunidad.

X

X — Noticias de IA de generación de imágenes y vídeo (código cerrado/abierto)

Cuentas

Las 39 cuentas y 40 publicaciones recopiladas en output/x.posts.md no guardan ninguna relación con IA de generación de imágenes o vídeo. Los términos de búsqueda fueron "Greenland", "Denmark", "#Bitcoin", "NATO", "Christ", "Jubjub", "Charles", "Bosnia", "Chelsea" y "Belgrade". Son tendencias generales extraídas directamente de Explore de X —geolocalizado alrededor de Croacia según el origen de conexión del servidor— y no incluyen ni un término ligado al encargo de investigación.

Por ello, no hay en estos datos cuentas que permitan responder quién lidera este tema en X. Esto es lo que se recopiló en su lugar:

  • Grupo político/geopolítico: @RapidResponse47 (30.291 me gusta, relacionado con Groenlandia), @AJENews, @Rusia_HD, @Globalsurv, @NepCorres y otros, con noticias u opiniones sobre Groenlandia, Dinamarca y la OTAN.
  • Grupo de criptomonedas: @aacryptoverse, @Bitcoin_Pirate_, @StackandRun, @bitcr_org y otros, con publicaciones etiquetadas #Bitcoin, todas de pequeña escala, entre pocos y decenas de me gusta.
  • Grupo de cotilleo de la realeza: @barristerlawusa, @hernandez_64876, @thebluestshade y @Rimmesfk, donde "Charles" alude al libro de revelaciones de Charles Spencer.
  • Grupo de fútbol: @icunga_, @john322226, @Cfc_Kemboi y @Pats_Aura, donde "Chelsea" corresponde a resultados del Chelsea FC.
  • Grupo de memes/conversación informal: @SardineKing_O, @isellbeforeyou, @0xHeatt, con el memecoin "$jubjub", y @MarquiseDeBelgr, con dos publicaciones informales en serbio.

Cada cuenta aportó solo una o dos publicaciones; no hay cuentas con una secuencia destacada de publicaciones. La publicación de @RapidResponse47, con 30.000 me gusta y aproximadamente 6,8 millones de vistas, es por mucho la de mayor alcance del conjunto, pero trata de la pertenencia de Groenlandia y no tiene relación con el tema.

Publicaciones

Hubo 0 de 40 publicaciones que mencionaran IA de generación de imágenes o vídeo, abierta o cerrada. Por tanto, no existe una publicación representativa que presentar. A modo de referencia, se incluye solo la publicación de mayor interacción para mostrar la naturaleza de la recopilación —dejando explícito que no está relacionada con el tema—:

  1. @RapidResponse47 (fuera de tema, como referencia) — 30,291 likes, 5,022 reposts, 1,164 replies, aproximadamente 6,800,000 views, 2026-09-18. https://x.com/RapidResponse47/status/2101059494587285834. Apareció en una búsqueda de "Greenland". Es una publicación política sobre la pertenencia de Groenlandia y no tiene relación con imágenes o vídeos generados por IA.
Señales
  • En esta etapa de X no se confirmó ninguna mención, debate ni noticia sobre IA de generación de imágenes o vídeo —Midjourney, Sora, Runway, Stable Diffusion, Flux, Wan, Kling y otros—. No existe material con el que determinar qué está o no está siendo tendencia.
  • Los términos de búsqueda —Greenland, Denmark, #Bitcoin, NATO, Christ, Jubjub, Charles, Bosnia, Chelsea, Belgrade— coinciden exactamente con los encabezados de la lista «X's own Explore list» al inicio de output/x.posts.md. Parece que solo se buscaron tendencias generales del entorno de conexión de la sesión, como geopolítica, cotilleo de la realeza, fútbol y memes de criptomonedas. Nunca se emplearon términos ajustados al tema, como generación de imágenes o vídeo, Sora, Midjourney, Stable Diffusion u open source AI.
  • Por ello, esta etapa no permite extraer ni una sola conclusión sobre tendencias de código cerrado ni abierto.
Límites
  • La recopilación no coincide con el tema. Los diez términos usados en output/x.posts.md no se relacionan con IA de generación de imágenes o vídeo, sino con tendencias de Explore sobre geopolítica, cotilleo de la realeza, fútbol y memes de criptomonedas. No se hizo ninguna búsqueda relacionada con el tema, así que el criterio de finalización de X —analizar unas 20 publicaciones relacionadas con el tema— no se cumplió en sentido sustantivo.
  • Se analizaron 40 publicaciones, pero ninguna mencionaba IA de generación de imágenes o vídeo.
  • output/x.posts.json contiene los mismos datos y no aportó pistas adicionales.
  • La única conclusión posible de esta etapa es que los términos y publicaciones recopilados no permiten informar de ninguna tendencia en X sobre IA de imágenes o vídeo, ni cerrada ni abierta. Hace falta una nueva recopilación temática con consultas como "Sora 2", "Midjourney", "Stable Diffusion", "Runway Gen", "Kling AI", "Flux" y "open source image generation".

YouTube

YouTube — Últimas tendencias de IA de generación de imágenes y vídeo (código cerrado/código abierto)

Canales

Más orientados al código cerrado

  • Theo - t3.gg (@t3dotgg) — explicación técnica de Google Nano Banana Pro
  • Astrovah (@astrovah) — reseñas y casos de uso de Sora 2
  • Woollyfern (@woollyferncreative) — canal especializado en actualizaciones mensuales de Midjourney
  • FixNode (@Fixnode1) — tutoriales de Runway Gen-4.5
  • Higher E-Learning (@higherelearning) — pruebas de los modelos integrados en Adobe Firefly
  • AIPOD-CAST (@AIPOD-CAST) — resumen semanal de noticias de IA, episodios de la serie 220
  • Lev Selector (@lev-selector) — resumen semanal de actualizaciones de IA

Más orientados al código abierto

  • Bijan Bowen (@Bijanbowen) — pruebas locales de Qwen Image
  • HitPaw Edimakor (@HitPawEdimakorOfficial) — reseñas y uso de la serie Wan
  • MaxonShire (@MaxonShire) — comparativas de modelos de vídeo abiertos
  • Promptus AI (@promptusai) — guías de instalación local de nuevos modelos como Z-Image
  • 黎黎原上啃 / SweetValberry (@SweetValberry) — explicaciones en chino de modelos como FLUX.1 Kontext

No se pudieron recuperar cifras de suscriptores de las páginas de los canales, como se explica en los límites, por lo que no se pudo confirmar su escala.

Vídeos
  1. «Google won image generation (it's not even close) NANO BANANA PRO BREAKDOWN» — Theo - t3.gg / fecha de publicación desconocida (Nano Banana Pro se anunció el 20 de noviembre de 2025; el vídeo es posterior) / visualizaciones desconocidas
    https://www.youtube.com/watch?v=UV9GqinedQ8
    Sostiene que la calidad de generación de imágenes de Nano Banana Pro, basado en Gemini 3 Pro, está al nivel de «ya no hace falta Photoshop» y supera claramente a otros modelos cerrados.

  2. «Sora 2 - An Honest Review As Well As 20 Creative Use Cases To Try» — Astrovah / 7 de octubre de 2025 / visualizaciones desconocidas
    https://www.youtube.com/watch?v=pJHWIgri5vk
    Califica a Sora 2 como «el vídeo de IA más realista hasta ahora» y presenta 20 usos prácticos.

  3. «Midjourney Update | July 2026: V8.2 is HERE! Personalization, NIJI Style Creator, and More!» — Woollyfern / julio de 2026 / visualizaciones desconocidas
    https://www.youtube.com/watch?v=dvfH5HzCARY
    Explica que Midjourney V8.2 añadió personalización y un creador de estilos para NIJI. Es la entrega más reciente de una serie mensual.

  4. «I Tested Every AI Video Model in Adobe Firefly So You Don't Have To (July 2026)» — Higher E-Learning / julio de 2026 / visualizaciones desconocidas
    https://www.youtube.com/watch?v=nOSYufWVdq8
    Prueba en paralelo todos los modelos tras la integración en Adobe Firefly de Veo 3.1, Kling 3.0, Runway Gen-4.5 y Sora 2.

  5. «Ultimate Runway Gen 4.5 Tutorial For New Users in 2026» — FixNode / 29 de marzo de 2026 / visualizaciones desconocidas
    https://www.youtube.com/watch?v=IUge3u4ZrqQ
    Tutorial de generación imagen→vídeo con Runway Gen-4.5 que destaca una estética cinematográfica.

  6. «Episode 222: Weekly AI News Summary - 6 September 2026» — AIPOD-CAST / 6 de septiembre de 2026 / visualizaciones desconocidas
    https://www.youtube.com/watch?v=8f34nSLdNtk
    Resumen semanal que aborda novedades de modelos, agentes y negocios, e incluye noticias de IA de generación de imágenes y vídeo.

  7. «Exciting AI Updates Weekly - September 18, 2026» — Lev Selector / 18 de septiembre de 2026 / visualizaciones desconocidas
    https://www.youtube.com/watch?v=Utu4zIcqPtM
    Resumen rápido de un canal individual sobre las actualizaciones de IA de la semana. Es la publicación más reciente dentro del alcance de esta investigación.

  8. «Qwen Image-2512 First Test – The BEST Open Source Image Model!» — Bijan Bowen / fecha de publicación desconocida (el modelo corresponde a la versión de diciembre de 2025) / visualizaciones desconocidas
    https://www.youtube.com/watch?v=SBaK616nP6Q
    Prueba localmente Qwen-Image-2512 de Alibaba, con 20.000 millones de parámetros, y lo valora como «el mejor modelo abierto de imágenes actual».

  9. «Wan 2.6 Review | How to Use Wan 2.6 for Free | New AI Video Generator Tutorial» — HitPaw Edimakor / fecha de publicación desconocida (el modelo se lanzó en diciembre de 2025) / visualizaciones desconocidas
    https://www.youtube.com/watch?v=6FMisTHYYgA
    Reseña y guía de uso gratuito de Wan 2.6 de Alibaba; menciona varios modos, incluidos T2V, I2V y R2V.

  10. «HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model?» — MaxonShire / 25 de junio de 2026 / visualizaciones desconocidas
    https://www.youtube.com/watch?v=4GNT4-QYekg
    Compara directamente HunyuanVideo 1.5 de Tencent y Wan 2.7 de Alibaba, lanzado el 22 de abril de 2026, dos importantes modelos locales gratuitos de vídeo.

  11. «Z-Image Open-Source Image Generator: Free Online and Local Setup» — Promptus AI / 2026, mes desconocido / visualizaciones desconocidas
    https://www.youtube.com/watch?v=JF4Q5hXh-_Q
    Presenta Z-Image de Alibaba —6.000 millones de parámetros y arquitectura S3-DiT— como un modelo ligero cuya calidad supera a Flux 2 y Qwen Image, además de explicar su integración con ComfyUI.

  12. «FLUX.1 Kontext [dev] is open source! Try image editing locally in ComfyUI» — 黎黎原上啃 / 2025, inmediatamente después de la publicación de Flux Kontext Dev / visualizaciones desconocidas
    https://www.youtube.com/watch?v=v4pp3TdbWNw
    Tras la publicación de los pesos de Flux Kontext Dev de Black Forest Labs, demuestra la edición local de imágenes con ComfyUI. Es algo antiguo, pero se incluyó como punto de partida para entender la genealogía de edición de imágenes de código abierto.

Señales
  • Los modelos cerrados han convertido las «actualizaciones mensuales» en rutina: la serie «Update» de Midjourney de Woollyfern publica vídeos mensuales. En 2026, las versiones avanzaron de V8 a V8.1 y V8.2 de forma constante. Canales tecnológicos también revisan de inmediato grandes actualizaciones de Runway y Adobe Firefly cada pocos meses.
  • La sincronización de audio se está convirtiendo en función estándar de la generación de vídeo cerrada: Kling 3.0 —diálogo nativo en cinco idiomas—, Seedance 2.0 —arquitectura integrada de audio y vídeo que reproduce incluso reverberaciones— y Grok Imagine 1.5 —genera a la vez diálogo y sonido ambiente— destacan el diseño de generación simultánea de sonido e imagen. El eje competitivo se desplaza de clips aislados a cortometrajes con sonido.
  • La velocidad de lanzamiento del código abierto, especialmente de China, iguala o supera a la del código cerrado: dentro de Alibaba, Qwen-Image→Qwen-Image-2512→Z-Image y Wan 2.5→2.6→2.7 se actualizaron a intervalos breves. Tencent HunyuanVideo 1.5 y LTX-2→2.3→2.5 de Lightricks también evolucionan casi a ritmo mensual o trimestral. Los títulos de vídeo usan con frecuencia expresiones como «el mejor código abierto» o «derrota a...», señal de interés del público.
  • La mayoría de los vídeos sobre código abierto enfatizan «ComfyUI», «ejecución local» y «gratis»: canales como HitPaw Edimacor, Promptus AI y MaxonShire ponen en primer plano «cómo usarlo gratis» y «funciona con GPU local». Esto contrasta con los canales de código cerrado, como Theo, Astrovah y Woollyfern, más centrados en calidad y funciones.
  • Los canales de noticias semanales de IA —AIPOD-CAST y Lev Selector— han convertido la IA de imágenes y vídeo en un segmento regular, tratándola como tema de vigilancia continua más que como una noticia aislada.
Límites
  • La página de resultados de búsqueda de YouTube (https://www.youtube.com/results?search_query=…) se renderiza dinámicamente con JavaScript. Al recuperarla mediante WebFetch, el contenido se reducía a enlaces de navegación del pie de página, de modo que no funcionó el método del playbook para leer título, canal, visualizaciones y fecha desde el HTML.
  • Como alternativa, se hallaron vídeos mediante búsquedas web normales con consultas site:youtube.com y se verificaron títulos y canales con el endpoint oembed de YouTube. Este método no permitió recuperar ni visualizaciones ni suscriptores, por lo que todas las visualizaciones aparecen como «desconocidas» y no se inventaron cifras.
  • Por la misma razón, varios vídeos carecen de fecha exacta: la explicación de Nano Banana Pro, la prueba de Qwen Image-2512, la reseña de Wan 2.6 y la presentación de Z-Image. Solo se indica una época aproximada a partir de fragmentos de búsqueda o de las fechas de lanzamiento de los modelos.
  • Tampoco se pudieron leer directamente las descripciones ni los comentarios principales por la dependencia de JavaScript.
  • Se priorizaron publicaciones dentro de 60 días —desde el 22 de julio de 2026—, aunque se incluyeron uno o dos vídeos anteriores por cada bando, como Flux Kontext y el tutorial de Runway Gen-4.5, para contextualizar sus trayectorias.

Bluesky

Bluesky — Últimas tendencias de IA de generación de imágenes y vídeo

Cuentas
  • Simon Willison (@simonwillison.net) — investigador independiente de IA. Cada vez que aparece un nuevo modelo multimodal, prueba la capacidad de generación de imágenes con su benchmark propio de «un pelícano montando en bicicleta». Tiene unos 50.000 seguidores y publica con frecuencia.
  • Max Woolf (@minimaxir.bsky.social) — antiguo científico de datos de BuzzFeed. Conoce bien la ética y la I+D de generación de contenido con IA, y suele comentar lanzamientos de modelos de imagen.
  • Ethan Mollick (@emollick.bsky.social) — profesor de Wharton. Trata tendencias generales de IA y también comenta cambios de calidad en la generación de vídeo.
  • Replicate (@replicate.com) — cuenta oficial del servicio de alojamiento de modelos. Anuncia nuevos modelos cerrados de imagen y vídeo cuando se incorporan a su plataforma.
  • Stability AI (@stabilityai.bsky.social) — cuenta oficial del desarrollador de Stable Diffusion. Sin embargo, sus últimas publicaciones se centraron en Stable Audio y APIs empresariales de edición de imágenes, y dejó de publicar tras el 19 de noviembre de 2025.
  • Stable Diffusion online AI (@stablediffusion.bsky.social) — cuenta de recopilación de arte de IA e intercambio de prompts de SDXL/ComfyUI, con unos 1.800 seguidores. No publica desde el 24 de febrero de 2025.
  • AI Art News (@ai-art-news.bsky.social) — cuenta de curación de noticias de arte con IA. No hay publicaciones desde el 18 de septiembre de 2025.
Publicaciones
  1. Simon Willison (2026-09-19) — en una serie de publicaciones donde pidió a GPT-6 Astra y Claude Fable 5.1 que crearan modelos 3D para Blender usando datos cartográficos, presentó un flujo de trabajo de imagen generada→conversión a 3D. 57 me gusta y 5 reposts.
    https://bsky.app/profile/simonwillison.net/post/3mv4su6pfzk24

  2. Simon Willison (2026-09-05) — prueba en la que pidió a GPT-6 Astra renderizar en Blender una escena de un pelícano montando en bicicleta. 405 me gusta y 30 reposts.
    https://bsky.app/profile/simonwillison.net/post/3murtmdynq22s

  3. Simon Willison (2026-09-04) — cuadrícula comparativa del benchmark de «pelícano montando en bicicleta» entre GPT-6 Astra, GPT-5.6 Sol/Terra/Luna. 206 me gusta y 9 reposts.
    https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c

  4. Simon Willison (2026-09-02) — generó con Claude Fable 5.1, nivel de razonamiento Max y coste de $3.30 por ejecución, una imagen SVG de pelícano de la máxima calidad hasta entonces, y luego la animó. 362 me gusta y 22 reposts.
    https://bsky.app/profile/simonwillison.net/post/3muimzxo2sk2g

  5. Max Woolf (2026-09-19) — señaló que, al pedir a una IA de imágenes una ilustración vectorial de un «pelícano montando en bicicleta», no entendía la relación entre las patas y los pedales. 1 me gusta.
    https://bsky.app/profile/minimaxir.bsky.social/post/3mvtt3uxdrk2c

  6. Max Woolf (2026-09-08) — tras el anuncio de un nuevo modelo de imágenes de OpenAI, comentó que era bueno haber pospuesto su artículo resumen sobre ChatGPT Images 2.0, porque este anuncio —referido a ChatGPT Images 2.5— parecía más importante. 4 me gusta.
    https://bsky.app/profile/minimaxir.bsky.social/post/3muzq6mcadk2n

  7. Ethan Mollick (2026-09-19) — señaló que, en medio de una inundación de «slop», contenido producido en masa de baja calidad, empiezan a surgir obras de vídeo con IA realmente interesantes. 58 me gusta y 7 reposts.
    https://bsky.app/profile/emollick.bsky.social/post/3mvuss476oc2b

  8. Replicate (2026-04-21) — anunció la incorporación de «GPT Image 2» de OpenAI a Replicate. Destacó su fotorealismo, renderizado de texto y fidelidad a la composición. 5 me gusta.
    https://bsky.app/profile/replicate.com/post/3mjzygaefs224

  9. Replicate (2026-04-09) — anunció que «Seedance 2.0» de ByteDance se abría a todos los usuarios. Integra texto, imagen, vídeo y audio, con sonido estéreo sincronizado y física realista. 2 me gusta y 1 repost.
    https://bsky.app/profile/replicate.com/post/3mj3junhvnh26

  10. Replicate (2026-02-18) — anunció el lanzamiento de Runway «Gen-4.5», una generación de vídeo cinematográfica caracterizada por precisión física y realismo. 2 me gusta.
    https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c

  11. Replicate (2026-02-17) — añadió «Kling 3.0» y «Kling o3» de Kuaishou. Ofrecen generación 4K multishot, audio sincronizado, edición de vídeo y transferencia de estilo. 2 me gusta.
    https://bsky.app/profile/replicate.com/post/3mf35lkhoyw2q

  12. Replicate (2026-03-11) — añadió «Vidu Q3» de Shengshu. Genera vídeo desde texto, imágenes o fotogramas inicial y final, hasta 16 segundos a 1080p y con audio sincronizado. 1 me gusta.
    https://bsky.app/profile/replicate.com/post/3mgsan3ddpl2w

Señales
  • Predominio del código cerrado: las publicaciones realmente encontradas sobre este tema en Bluesky tratan casi todas de modelos cerrados de gran tamaño: OpenAI —GPT Image 2 / ChatGPT Images 2.5—, Runway Gen-4.5, Kling 3.0, Seedance 2.0 y Vidu Q3. No son publicaciones orgánicas virales, sino anuncios de novedades de alojadores como Replicate o pruebas de investigadores individuales, Simon Willison y Max Woolf.
  • Casi no hay rastro de código abierto: no se encontraron cuentas activas que publicaran sobre Flux, Stable Diffusion, Qwen-Image, Wan o flujos de trabajo de ComfyUI. La única cuenta comunitaria parecida, stablediffusion.bsky.social, dejó de publicar en febrero de 2025; Stability AI también permanecía en silencio desde noviembre de 2025 y sus últimas publicaciones se referían sobre todo a Stable Audio y APIs empresariales, no a Stable Diffusion para imágenes.
  • «Un pelícano montando en bicicleta» se ha convertido en benchmark de facto: cada vez que aparece un modelo multimodal nuevo —GPT-6 Astra, Claude Fable 5.1 y otros—, varios observadores independientes comparan la calidad de generación de imágenes con esa misma consigna. Es una tendencia interna particular de Bluesky y funciona como indicador común no oficial de la capacidad de los modelos.
  • Ausencia de cuentas corporativas oficiales: los identificadores previstos de OpenAI, Midjourney, Runway ML, Black Forest Labs, Hugging Face, Civitai y ComfyUI no existen o son cuentas sin uso. Bluesky no funciona como canal de anuncio primario para estas empresas; las noticias circulan principalmente a través de investigadores individuales e intermediarios como Replicate.
  • Cambio en la valoración de la generación de vídeo: como muestra la publicación de Ethan Mollick, se extiende la idea de que entre los vídeos de IA producidos masivamente comienzan a aparecer piezas realmente buenas. Sin embargo, es una observación general y no menciona ningún modelo abierto de vídeo concreto.
Límites
  • La API oficial de búsqueda de Bluesky (https://public.api.bsky.app/xrpc/app.bsky.feed.searchPosts) devolvió siempre HTTP 403 Forbidden, incluso cambiando palabras clave y probando dos proxies CORS. La interfaz web de https://bsky.app/search?q=... es una SPA renderizada en cliente, por lo que WebFetch tampoco pudo recuperar su contenido.
  • Como alternativa se usaron los endpoints sin autenticación app.bsky.actor.getProfile y app.bsky.feed.getAuthorFeed, recopilando feeds por cuenta descubierta mediante búsqueda web o deducción. Por ello, este resultado no representa una búsqueda transversal por palabras clave en todo Bluesky, sino publicaciones de las cuentas que fue posible encontrar.
  • Las cuentas oficiales de las principales marcas —OpenAI, Midjourney, Runway ML, Black Forest Labs, Hugging Face, Civitai, ComfyUI y parte de Stability AI— estaban sin uso o en silencio y no permitieron recoger noticias directamente.
  • Por la imposibilidad de buscar, no se pudo cumplir con unas 20 publicaciones claramente relacionadas con el tema. Tras leer más de 100 publicaciones de 7 cuentas, se seleccionaron las 12 directamente relevantes.
  • No se mostraron ni verificaron las imágenes y vídeos; la fuente fue únicamente la descripción textual de las publicaciones.

Lemmy

Lemmy — Últimas tendencias de IA de generación de imágenes y vídeo (código cerrado/abierto)

Comunidades
  • !«メールアドレス» — 5,712 suscriptores, 893 locales; 1,407 publicaciones y 1,927 comentarios. Trata modelos abiertos de generación de imágenes y vídeo. Tiene 10 usuarios activos diarios y 66 mensuales: una comunidad pequeña pero con actualizaciones frecuentes.
  • !«メールアドレス» — 2,362 suscriptores; 24 activos diarios, 114 semanales y 344 mensuales. Espacio para obras hechas con modelos abiertos de Stable Diffusion, principalmente enlaces directos a imágenes de civitai.
  • !«メールアドレス» — la comunidad se llama share_anime_art y se muestra como "Stable Diffusion Anime"; 1,598 suscriptores, 206 locales. Publica ilustraciones de IA de anime aptas para todos los públicos.
  • !«メールアドレス» — 8,252 suscriptores, 3,027 locales, y 9,179 usuarios activos mensuales. Es la mayor comunidad observada en esta investigación y se define como «a place for all those who loathe AI». Se centra en crítica y sarcasmo sobre la IA en general, más que específicamente en generación de imágenes o vídeo.
  • !«メールアドレス» — 52 suscriptores, por lo que es pequeña, pero replica mediante RSS hilos de Reddit como r/ArtificialInteligence y recibe con frecuencia temas de IA de imágenes y vídeo. Tiene 725 usuarios activos semestrales.
  • !«メールアドレス»・!«メールアドレス»・!«メールアドレス» — comunidades tecnológicas generales. Las grandes noticias de Midjourney aparecieron aquí.
Publicaciones
  1. Aumento rápido de herramientas ComfyUI para MiniMax-H3 (código abierto) — en !«メールアドレス» se confirmaron al menos 15 publicaciones de herramientas para MiniMax-H3, un modelo de vídeo, solo entre el 1 y el 16 de septiembre de 2026. Ejemplos representativos:
  2. Boogu-Image-0.1, nuevo modelo base abierto de un laboratorio vinculado a Huawei (código abierto) — !«メールアドレス», score 5, 2026-06-17. Licencia Apache-2.0, 10.000 millones de parámetros y cinco variantes: Base, Turbo de 3-4 pasos, FP8 y edición. Destaca por la representación bilingüe de texto en chino e inglés. https://boogu.org/
  3. Artículo de validación técnica de Seedream 5.0 Pro, modelo cerrado vinculado a ByteDance (código cerrado) — vía !«メールアドレス», score 1, 2026-07-10. Publicación titulada «an honest comparison and technical breakdown». https://www.reddit.com/gallery/1usc03q
  4. Anuncio de Google "Nano Banana 2 Lite" (código cerrado) — espejo de hackernews, score 1, 2026-06-30, enlazando a la página oficial de DeepMind. En paralelo también apareció una publicación de medios tecnológicos suizos en alemán, score 0, swisstechnews, 2026-07-02. https://deepmind.google/models/gemini-image/flash-lite/
  5. MAI-Image-2.5 de Microsoft se acerca a Nano Banana 2 en benchmarks (código cerrado) — !«メールアドレス», score 1, 2026-05-28. Trata la competencia entre Google y Microsoft en modelos de generación de imágenes. https://www.reddit.com/r/ArtificialInteligence/comments/1tpu2cd/
  6. Experimento de creación de una historia larga con Sora 2 (código cerrado) — !«メールアドレス», score 1, 2026-09-13. Su autor empezó a usarlo aproximadamente un mes después del lanzamiento de Sora 2 y creó siete vídeos de una hora. La conclusión: crear clips únicos bonitos no es difícil; lo realmente difícil es la «production memory», mantener la coherencia. https://lemmy.durstig.online/post/59922 (Reddit original: https://www.reddit.com/r/ArtificialInteligence/comments/1wfabp9/)
  7. Noticia real de que Midjourney pivotaría de imágenes de IA a un spa médico (código cerrado / evolución empresarial) — !«メールアドレス», artículo de The Register replicado en lemmy.zip, score 58-66, 2026-06-18. Se informó de un giro hacia un negocio de spa de escaneo corporal llamado «Golden Light», basado además en tecnología prestada de un socio. Los comentarios estaban llenos de comparaciones sarcásticas con Theranos. https://lemmy.zip/post/66397234
  8. Midjourney exige a estudios de Hollywood divulgar su uso de IA (código cerrado) — !«メールアドレス», score 73, 2026-07-05. Se informó en el contexto de litigios de derechos de autor. https://lemmy.today/post/56011946
  9. Presentación del artículo InterleaveThinker (código abierto / investigación) — !«メールアドレス», score 0, 2026-06-12. Enlace a un artículo de arXiv titulado "Reinforcing Agentic Interleaved Generation". https://arxiv.org/abs/2606.13679
  10. Temperatura del rechazo a los contenidos generados por IA (señal social) — !«メールアドレス», score 923, 2026-09-13. No trata directamente de generación de imágenes o vídeo, sino de gafas inteligentes con IA Ray-Ban Meta, pero el tamaño de la comunidad —9.179 activos mensuales— y la intensidad de la reacción son evidencia del clima adverso ante la IA de imágenes y vídeo. https://lemmy.world/post/51874921
Señales
  • El lado abierto está dominado por MiniMax-H3. En la comunidad !stable_diffusion de lemmy.dbzer0.com, durante la primera mitad de septiembre se sucedieron a diario nodos ComfyUI, LoRA, cuantizaciones y herramientas de aceleración VAE para MiniMax-H3. Los nombres de modelos anteriores, Wan, Flux y HunyuanVideo, apenas aparecieron. Muchos autores primarios son desarrolladores individuales con cuentas personales de GitHub, lo que muestra un ecosistema de base centrado en Hugging Face y civitai.
  • El lado cerrado reúne a Google —familia Nano Banana—, Microsoft —MAI-Image—, ByteDance —Seedream—, OpenAI —Sora 2— y Midjourney, pero las menciones en Lemmy son escasas y sus puntuaciones casi siempre de un dígito. La corriente principal llega principalmente a través del espejo de Reddit !ai_reddit. Las menciones originadas en Lemmy se inclinan hacia noticias empresariales, como el giro de Midjourney hacia spas médicos.
  • Las publicaciones de obras con enlaces directos a civitai —stable_diffusion_art / share_anime_art— son activas, pero mencionan poco modelos o detalles de prompts, por lo que aportan más material que noticias.
  • La comunidad de sentimiento anti-IA !fuck_ai tiene una de las mayores escalas de Lemmy. Cuando allí llegan publicaciones sobre IA de imágenes o vídeo, suelen predominar los comentarios de rechazo sobre el debate equilibrado.
Límites
  • Lemmy tiene una base pequeña y su API de búsqueda devuelve muchas publicaciones antiguas —por ejemplo HunyuanVideo-I2V de marzo de 2025— o resultados irrelevantes —como una startup de combustible nuclear llamada Fluxnium al buscar "Flux"—, por lo que fue necesario retirar manualmente mucho ruido por palabra clave.
  • Se buscaron individualmente Runway Gen, Kling AI y Wan 2.5, pero no se encontraron publicaciones directamente relacionadas: Kling no devolvió resultados, Runway tampoco, y Wan solo devolvió elementos irrelevantes. No se confirmó conversación propia de Lemmy sobre esos modelos.
  • !«メールアドレス» es un bot de republicación RSS de Reddit, no una conversación propia de Lemmy. Las fuentes se indicaron explícitamente y solo se usaron hallazgos específicos para evitar duplicación con la etapa de Reddit.
  • Las noticias del giro de Midjourney hacia spas médicos y de su exigencia de divulgación a Hollywood corresponden al 18 de junio y 5 de julio de 2026; no son sucesos de la última semana y no se encontraron seguimientos más recientes en Lemmy.
  • Se examinaron aproximadamente 20 publicaciones, pero las únicas con puntuaciones de dos dígitos o más fueron el giro de Midjourney hacia el spa médico y la publicación sobre gafas inteligentes de !fuck_ai. No se confirmó que temas de generación de imágenes o vídeo, por sí solos, se volvieran muy virales en Lemmy.

Pinterest

Pinterest — Noticias de IA de generación de imágenes y vídeo

Se abrieron y leyeron directamente 30 de los 50 pines recopilados, todos mediante Read e incluyendo imágenes, para escribir este resumen. Los otros 20 títulos —en su mayoría listados genéricos de fotos de stock sobre «AI content creation concept» y gráficos duplicados de recopilaciones de herramientas— no se abrieron porque sus títulos ya coincidían con los temas confirmados a continuación.

Temas visuales
  • Domina la plantilla de miniatura de YouTube de «AI news»: fondo negro o azul marino, un rostro humano reaccionando —cejas sorprendidas o risas—, texto blanco y rojo grande con «AI NEWS», y una fila de insignias luminosas de marcas —OpenAI, Google, Anthropic en naranja, Meta, Microsoft y Notion—. Se repite en temas no relacionados, a veces bajo títulos que no coinciden con el contenido visual. Es una plantilla reutilizable de canal, no arte creado específicamente. [6, 14, 41, 43, 47]
  • Los listados de herramientas usan el mismo lenguaje de infografía oscura y neón: insignias numeradas en morado, naranja o turquesa; una maqueta de portátil con interfaz de generación; y una cuadrícula de logos de Runway, Pika, Kling AI, Luma/Dream Machine, Canva, Hailuo, invideo AI, CapCut, Synthesia y HeyGen. Todas las herramientas citadas son SaaS de código cerrado. [2, 29]
  • La ansiedad por la autenticidad, «Real vs AI», es un formato recurrente propio: cuestionarios comparativos «Which is AI?», etiquetas rojas «AI-GENERATED» estampadas sobre fotos y comparaciones tipo meme «AI GENERATED / ORIGINAL CLIP». Es un género tan habitual como las propias miniaturas de noticias. [3, 21, 32]
  • Veo de Google aporta el vocabulario visual predeterminado del vídeo de IA cinematográfico: las mismas imágenes cálidas de estilo Pixar —una chica en una cocina, flamencos, una bailarina bajo las estrellas, un nadador y un científico ante un microscopio— se repiten en pines distintos, junto a una demostración de imagen→vídeo de Veo 3 con un monstruo de peluche. Ningún competidor aparece tanto. [8, 9, 13, 27]
  • Los retratos hiperrealistas de IA se utilizan como cebo visual genérico, con independencia del tema real del artículo: el rostro arrugado de un pescador para un anuncio de herramienta, el perfil de una mujer de piel brillante para una tarjeta de noticias y un tríptico de transformación facial para una aplicación de ocio. Poros, reflejos en los ojos y profundidad de campo reducida delatan que también son generados por IA. [33, 45, 48, 20]
  • Las imágenes de stock genéricas de ciencia ficción y placas de circuito llenan los vacíos cuando no hay una captura de producto real: cerebros de alambre brillantes, un robot humanoide cromado y un empresario con traje frente a un panel holográfico de IA. No aportan valor informativo; solo ambiente. [1, 37, 50]
  • Las infografías educativas para principiantes utilizan una estética pastel y caricaturesca —amarillo y rosa, mascota robótica sonriente, flechas dibujadas a mano—, visiblemente más suave que el género de miniaturas de noticias y destinada a quienes todavía no saben qué significa «IA generativa». [7]
  • Los diagramas técnicos genuinos son raros: solo un pin de la muestra mostraba una figura real de arquitectura de modelo —incrustación de texto → difusión → etapas de escalado—, y aun así estaba presentada como un gráfico editorial brillante en lugar de una ilustración de investigación. [34]
Pines destacados
  1. #48 — "Amuse 3.0", una herramienta de creación de arte con IA (pin) — generador de imágenes local con marca AMD, mostrado mediante un retrato hiperrealista; es la única herramienta claramente local o cercana al código abierto de la muestra, frente a un mar de listas de SaaS cerrados.
  2. #27 — Google anuncia la IA de generación de vídeo "Veo 3" (pin) — muestra una imagen de entrada de un monstruo de peluche y tres vídeos generados en escenas distintas; es decir, la consistencia imagen→vídeo de Veo 3 es el verdadero punto de venta.
  3. #46 — ByteDance y Hollywood alcanzan un acuerdo global sobre derechos de autor de IA (pin) — tarjeta de noticias estilo Cointelegraph que informa de un acuerdo de propiedad intelectual entre ByteDance y MPA para sus herramientas de imagen y vídeo, ilustrado con un niño generado de estilo Pixar.
  4. #10 — "4 Major AI Updates" (pin) — nombra GPT-6 Astra, un Gemini más orientado a agentes, medios generativos dentro de Adobe Premiere y la Serie E de $2B de Cognition, con una valoración de $48B, en una infografía.
  5. #49 — "Today's AI News, May 20 2026" (pin) — resumen de Google I/O: Gemini 3.5 Flash, Gemini Omni, Gemini Spark y el impulso hacia gafas inteligentes con IA.
  6. #3 — Hollywood Reporter entrevista a la primera actriz de IA (pin) — rótulo televisivo sobre «Tilly Norwood», actriz generada por IA, con el propio fotograma estampado con «AI-GENERATED IMAGE».
  7. #41 — "More than 20% of YouTube is now AI-generated" (pin) — pin de titular estadístico sin gráfico de respaldo, presentado como hecho.
  8. #29 — "10 Best Free AI Video Generators for YouTube 2026" (pin) — la recopilación de herramientas más amplia de la muestra: Google Veo, Runway, Pika, invideo AI, CapCut, Synthesia y HeyGen, todas presentadas como gratuitas y preparadas para YouTube.
  9. #34 — "OpenAI's Secret Image Generation Tool to Debut Soon" (pin) — titular sobre una herramienta cerrada aún no lanzada, ilustrado con un diagrama real de una canalización de difusión —aunque con estilo de revista— en lugar de una imagen de producto.
  10. #32 — meme comparativo "AI GENERATED" frente a "ORIGINAL CLIP" (pin) — un rostro y gesto recreados por IA junto al clip fuente real; forma parte del género continuo de detección de autenticidad en la plataforma.
Señales
  • Actual: Google Veo, tanto Veo 2 como Veo 3, es el modelo de vídeo más repetido visualmente en el tablero, más que cualquier otra herramienta mencionada. «La IA está pasando del chat al trabajo real» es un marco explícito en varios pines: líneas de tiempo generativas de Adobe Premiere, financiación de Devin de Cognition y Gemini más agente en Gmail, Drive y Docs. Los acuerdos de propiedad intelectual y derechos de autor —ByteDance × MPA— ya son material de noticias generalistas, no solo historias legales de nicho. El formato «identifica la IA» o etiquetado de autenticidad es un género por derecho propio, lo que sugiere ansiedad real del público ante imágenes falsas y actrices como Tilly Norwood. Las miniaturas genéricas reutilizadas —la misma plantilla de rostro y logos bajo titulares distintos— sugieren que gran parte de este contenido de «noticias» es producción de baja calidad de granjas de contenido, no reportaje original.
  • Ausente: la cultura de modelos de código abierto es casi invisible. No aparecieron Stable Diffusion, Flux, ComfyUI, LoRA ni capturas de repositorios GitHub. Amuse 3.0, el pin #48, fue la única herramienta local o próxima al código abierto, e incluso se presentaba como aplicación de consumo pulida, no como proyecto abierto. No aparecieron pines en idiomas distintos del inglés. Nada de la muestra se reproduce como vídeo: todo son miniaturas estáticas, así que no se puede juzgar la calidad real de los resultados de modelo, solo lo que las imágenes afirman.
Límites
  • Según el playbook, Pinterest no se navegó directamente. Este resumen se basa por completo en la tabla precompilada output/pinterest.pins.md del trabajador y en images/pinterest/manifest.json e imágenes, provenientes de una única consulta sin nombre, "Image and Video Generation AI News", en vez de un desglose por género. El campo genre del manifiesto está vacío para todos los pines, así que no fue posible elaborar comparación por género.
  • Se abrieron 30 de los 50 pines; se omitieron los otros 20 porque sus títulos repetían formatos ya cubiertos, como fotos de stock genéricas de «AI content creation concept» y gráficos repetidos de listas de herramientas. Es una comprobación por muestreo, no una cobertura completa.
  • Varios pines no tienen título y aparecen como «(untitled)». En esos casos, la descripción se basó en el texto visible dentro de la imagen.
  • Algunos contenidos visuales no coinciden literalmente con su título: por ejemplo, la imagen de #47 es una tarjeta genérica de canal «AI NEWS», no algo específico sobre Grok 5. Esto respalda el hallazgo de reutilización de miniaturas genéricas, pero implica que los títulos deben leerse como orientativos y no como reportaje confirmado.
  • Ningún pin mostraba fecha de publicación visible, de modo que no se pudo verificar la actualidad de las afirmaciones —por ejemplo, la estadística de que el 20 % de YouTube ya es generado por IA— solo a partir de la imagen.

Acciones recomendadas

  • Volver a recopilar la etapa de X con consultas directamente temáticas, como 'Sora 2', 'Midjourney', 'Stable Diffusion', 'Runway Gen', 'Kling AI' y 'open source image generation'.
  • Vigilar continuamente la frecuencia de lanzamiento de proyectos chinos de código abierto como MiniMax-H3, Qwen, Wan y Z-Image.
  • Seguir las reacciones no solo de comunidades especializadas en IA, sino también de comunidades generales y profesionales, para monitorizar la expansión del rechazo a los contenidos generados por IA.
  • Probar vías de acceso alternativas para resolver el problema 403 de la API oficial de búsqueda de Bluesky.
  • Seguir en la próxima ronda el problema de «production memory» de Sora 2 y las novedades del giro de Midjourney hacia los spas médicos.
  • Añadir etiquetas de género a la recopilación de Pinterest para poder clasificar mecánicamente abierto y cerrado.

Imágenes recopiladas

🎨 Creación de imágenes y vídeo con IASimplemente hazlo 🎥Hollywood Reporter entrevista a la primera actriz de IA...Concepto de creación de contenido con IA con iconos para generación de texto, imagen, música y vídeo; imágenes de inteligencia artificial – Explora 66 fotos de stock, vectores y vídeosPreocupaciones sobre contenido de IA y redes socialesNoticias de IA: una filtración de Anthropic nos muestra el futuro de la IA...🤯 ¡IA GENERATIVA EXPLICADA! 🤖✨ Cómo crea IA texto, imágenes, vídeo y másimagenGoogle presenta Veo 2: herramienta avanzada de generación de vídeo con IA, con realismo y funciones cinematográficas mejorados4 grandes actualizaciones de IA que debes conocer en 2026Google anuncia vídeo de calidad ultraalta...Vídeos generados por IA para marketing de contenidosVeo 3 de imagen a vídeo: generación rápida y audio nativo mediante Gemini APINoticias de IA: OpenAI por fin publicó lo que pedimosIA para generación de imágenes y vídeoConcepto de creación de contenido con IA con iconos para generación de texto, imagen, música y vídeo; imágenes de inteligencia artificial – Explora 57 fotos de stock, vectores y vídeosQué es Imagvio AI y cómo ayuda a los creadores...imagenimagen7 mejores generadores de bebés con IA: predice el rostro de tu hijo (2026)imagenSoftware de creación de vídeo con IACrea sesiones fotográficas fotorrealistas de ti con ChatGPT + Higgsfield 📸🤖Vídeos generados por IA: ¿buenos o malos? Esta es la verdad 🤖🎥El arma secreta para creadores de contenido: generación de vídeo con IAMejores generadores de vídeo con IA de 2025Google anuncia la IA de generación de vídeo 'Veo 3',...Herramientas de IA para edición de vídeo — Lo que los creadores usan de verdad para hacer contenido en 2026imagenTransforma tus ideas en imágenes impresionantes 🎥¿Puedes detectar el falso? Reto de vídeo de IA frente a vida realimagenimagenLa herramienta secreta de generación de imágenes de OpenAI debutará prontoCreación profesional de vídeo con IA | Vídeos cinematográficos con IA | Edición de vídeo personalizadaAnálisis de imágenes y vídeo impulsado por IA‎🚨 La IA se está volviendo aterradoramente buena.Generación de imágenes con IAVídeo de retrato realista generado por IA | Ambiente interior acogedor, sin cámara"Transforma tu visión con vídeos 4K personalizados impulsados por IA 🎥✨"Más del 20 % de YouTube ya está generado por IAEsta semana en noticias de IA - 15 de agosto de 2026GPT 5.2, editor de vídeo en tiempo real, vídeos estéreo con IA, agentes de IA móviles, control corporal completo: NOTICIAS DE IACuando la IA permitió a los humanos revivir sus propios recuerdosEfecto viral de personitas con IA — ¡aprende a crearlo!imagenGrok 5: la revolución de IA de Elon Musk: una sorpresa...‘Amuse 3.0’, una herramienta de creación artística con IA que incluye...imagenIA

Nota sobre la calidad de los datos

X solo permitió usar 0 de 40 publicaciones porque los términos de búsqueda no estaban relacionados con el tema. Reddit, con 12 elementos, y Bluesky, con unas 12 publicaciones a través de cuentas individuales debido al bloqueo de la API de búsqueda, tampoco alcanzaron el objetivo de unas 20 publicaciones. Pinterest se basa en datos precompilados sin etiquetas de género, y YouTube no permitió recuperar visualizaciones ni suscriptores.

Galería