KEN’S CAT LOG

Noticias de IA de generación de imágenes y vídeo — 2026-09-06

OpenAI GPT-6 Astra domina el ámbito de código cerrado no tanto como «generación de imágenes y vídeo», sino como un «agente que opera el PC», mientras que el lado de código abierto acumula de forma constante noticias de implementación de Qwen Image y MiniMax-H3 en torno a ComfyUI.

Resumen de noticias de IA de generación de imágenes y vídeo — 2026-09-06

En serio, esta semana ha estado llena de movimientos increíbles 😳🔥 En el lado de código cerrado, todo ha sido una auténtica fiesta de «GPT-6 Astra» de OpenAI, y la conversación se centra más en «un agente al que puedes dejar manejar todo el PC» que en la generación de imágenes y vídeo. Por el contrario, Sora parece haberse apagado silenciosamente, y da la impresión de que la inversión está pasando de las aplicaciones de generación de vídeo a la IA de agentes. En código abierto, Qwen Image, Z-Image Turbo, HunyuanImage y MiniMax-H3 siguen actualizándose con firmeza alrededor de ComfyUI; no es tan vistoso, pero la densidad de noticias de implementación es realmente alta. Siendo sinceros, hubo plataformas donde la búsqueda no funcionó bien esta vez (Reddit, X y Bluesky), así que no se pudieron revisar con solidez los 20 elementos en todos los casos; lo reconoceremos debidamente en «Calidad de los datos» más abajo 🙏

En todas las plataformas

  • GPT-6 Astra (OpenAI) prácticamente monopoliza el ámbito de código cerrado: tanto en X (@masahirochaen, https://x.com/masahirochaen/status/2095644339041153256) como en Bluesky (@todaystopainews, https://bsky.app/profile/todaystopainews.bsky.social/post/3mur7cyocf225), ha acaparado la conversación desde justo después de su lanzamiento. Se ha viralizado el benchmark de ARC-AGI-3 con un 98,6 % (frente al 7,8 % de la generación anterior).
  • De Astra se habla más como «operación mediante agentes» que como «generación de imágenes»: tanto X (@aigeboku, que prueba la función ComputerUse) como Bluesky (una demostración de construcción automática de una ciudad en Unity) se entusiasman más con el lado de «manejar el PC por su cuenta» que con producir imágenes o vídeos aislados. Esto de verdad podría convertirse en una nueva categoría.
  • Fable 5.1 se utiliza muchísimo como «punto de comparación»: en X, @renoiseai y @Mayz1169 publicaron de forma independiente vídeos de enfrentamiento «Astra vs Fable 5.1» mediante Seedance 2.5. Además, en una publicación de @k_matsumaru, Fable 5.1 no era el renderizador final, sino una capa de generación de prompts integrada en un flujo de cuatro herramientas. Casi nadie termina con un modelo único.
  • Las API agregadoras cobran presencia en ambos mundos: en Reddit (WaveSpeedAI, que agrupa más de 1.000 modelos en una sola API REST) y Bluesky (useapi.net, que compara Veo/Kling/Seedance/PixVerse/Hailuo/Runway/Nano Banana), se consideró que ambas ofrecían información más práctica y densa que las cuentas oficiales.
  • El código abierto se configura como dos líderes, Qwen Image / Z-Image Turbo (Alibaba·Tongyi-MAI) y HunyuanImage (Tencent), más la nueva estrella MiniMax-H3: hay respaldo bastante fuerte de los vídeos de reseña de YouTube y de !«メールアドレス» en Lemmy.
  • El ecosistema alrededor de MiniMax-H3 (modelo de vídeo de pesos abiertos) se expande a gran velocidad: solo en Lemmy hubo más de diez entradas del 8/8 al 5/9 (cuantización GGUF, Turbo LoRA, soporte para vídeos largos de 120 segundos e implementación de atención híbrida). También se ha corroborado entre plataformas que @ImaStudio_ai en X creó su propia herramienta comercial basándose en él.
  • ComfyUI es por completo el centro de mando del código abierto: en Lemmy, Bluesky (@kunecco) y los tutoriales de YouTube, la compatibilidad con ComfyUI funciona en todas partes como prueba de que una tecnología es real.
  • Multitoma + sincronización de audio es el siguiente eje competitivo común a abierto y cerrado: en YouTube se compararon directamente con pruebas de estrés Wan 2.6 (abierto) y Kling 3.0/Seedance 2.0/Runway Gen-4.5 (cerrados).
  • La inquietud de «¿esto es IA o es real?» aparece en todas partes: bromas en Reddit sobre manos deformadas, discusiones en comunidades y pines de Pinterest tipo «Which is AI?» muestran la misma ansiedad independientemente de la plataforma.
  • Las cuentas oficiales de marcas están prácticamente muertas en redes sociales: en Bluesky, la cuenta oficial de Midjourney (última publicación: 2025-10-08) y la de Kling AI (cero publicaciones) están casi inactivas. Parece válido decir que las noticias llegan antes desde fuentes no oficiales, particulares y agregadores en todas las plataformas.

Plataforma por plataforma

Reddit — Se recopilaron 12 hilos de 9 subreddits (sin alcanzar el objetivo de unas 20 entradas). Lo más destacado fue la fuerte reacción contra un nuevo método para falsificar por completo timelapses de dibujo hecho a mano dejando que un LLM controle el ratón (r/antiai, 5.259 pt), además de la API agregadora WaveSpeedAI y la generación local rápida de Krea-2-Turbo en Apple Silicon (45 segundos por imagen). En r/VeniceAI también hubo publicaciones de usuarios avanzados que seleccionan meticulosamente modelos para generación, edición y conversión de imagen a vídeo. Las críticas por ética y calidad (malas valoraciones de imágenes de comida generadas por IA, spam de ofertas de $30/hora) también fueron marcadas.

X — Las palabras en tendencia de Explore estaban sesgadas por la ubicación del servidor, Croacia: 7 de 10 términos (Bitcoin, Ucrania, Argentina, etc.) eran completamente irrelevantes. Todas las publicaciones relevantes estaban ocupadas por GPT-6 Astra, y no se probaron en absoluto términos de búsqueda de código abierto (Stable Diffusion, Wan, Flux, etc.); por tanto, la tendencia de código abierto en X para esta edición no es «no existe», sino «no se revisó».

YouTube — La mayor noticia del lado cerrado fue el fin de Sora (la aplicación terminó el 26 de abril de 2026 y se prevé que la propia API termine el 24 de septiembre de 2026; las descargas cayeron bruscamente de 3,3 millones a 1,1 millones en 11 meses). En el lado abierto abundan las reseñas de primeras pruebas de Qwen Image, HunyuanImage y Z-Image Turbo, y también se menciona FLUX.2 de Black Forest Labs (Apache 2.0) como contendiente.

Bluesky — La API de búsqueda de texto completo de publicaciones (searchPosts) devolvía 403 para todas las consultas, por lo que se cambió al método de búsqueda por cuentas (sin alcanzar el objetivo de 20 análisis). En el lado cerrado predominan «bots de noticias» como todaystopainews y useapi.net; en el abierto, publicaciones de obras terminadas de particulares como Niji-iro y Kunecco. En Bluesky apenas circula información de código abierto como noticia técnica.

Lemmy — Aunque es pequeño, !«メールアドレス» (5.708 personas) es de facto un tablón de noticias rápidas sobre código abierto; destacan noticias de implementación sobre MiniMax-H3 y soporte Day-0 para LTX-2.5. El lado cerrado tiende a consumirse como «sarcasmo o escándalo» más que como noticias de producto, como el giro de Midjourney hacia dispositivos médicos. No se encontraron publicaciones primarias originadas en Lemmy sobre Sora/Veo/Kling/Hailuo.

Pinterest — Se revisaron 50 pines de una única consulta previamente recopilada por un trabajador (sin segmentación por género). Casi todo eran listas comparativas e infografías de noticias de herramientas cerradas como Runway, Pika, Kling, Luma, Synthesia y HeyGen; solo dos entradas mencionaban código abierto: Baidu Ernie 4.5 y AMD Amuse 3.0. Es por completo un mercado de SEO/marketing de herramientas cerradas.

Qué vigilar

Recomendaciones

  • Seguir comparando GPT-6 Astra con Fable 5.1 no solo por la calidad de imagen y vídeo, sino desde el eje de «operación mediante agentes».
  • Seguir vigilando en la próxima edición el ecosistema ComfyUI de MiniMax-H3 (GGUF y Turbo LoRA) como vanguardia de la generación de vídeo de código abierto.
  • En la próxima investigación de X, no depender de las tendencias de Explore y lanzar explícitamente consultas propias de código abierto como Stable Diffusion, Wan, Flux y Qwen.
  • Como fuente primaria de código abierto, priorizar !«メールアドレス» en Lemmy por encima de Reddit y Bluesky.
  • No usar Pinterest como fuente de tendencias de código abierto; limitarlo a observar marketing y SEO de herramientas cerradas.
  • Investigar si hay herramientas externas o flujos de trabajo que dependan del cierre de la API de Sora (2026-09-24).

Calidad de los datos

Reddit se quedó en 12 hilos, sin alcanzar las aproximadamente 20 entradas del criterio de finalización (no fue posible recopilar directamente mediante WebFetch y se dependió únicamente de la recopilación previa). En X, la mayoría de las consultas (7 de 10) fueron palabras en tendencia irrelevantes, y no se realizó ninguna búsqueda relacionada con código abierto; la actividad de código abierto en X quedó esencialmente sin investigar. Bluesky devolvió 403 en la API de búsqueda de texto completo para todas las consultas y obligó a cambiar a búsqueda por cuentas, por lo que no se alcanzó el número objetivo de análisis. Por la renderización dinámica, en YouTube no se pudieron comprobar la mayoría de reproducciones y suscriptores. Lemmy es pequeño de por sí, y no se encontraron publicaciones primarias de Sora/Veo/Kling/Hailuo (posiblemente por limitaciones de cobertura de búsqueda). En Pinterest solo se realizó una consulta general de 50 resultados y no se volvió a buscar específicamente código abierto.

Resumen por plataforma

Reddit

Reddit — Noticias de IA de generación de imágenes y vídeo

Dónde

Se recopilaron 12 hilos de 9 subreddits con la consulta «Image and Video Generation AI News».

Subreddit Miembros Hilos recopilados
r/StableDiffusion 1,001,169 1
r/teenagers 3,674,216 1
r/aiwars 166,685 1
r/antiai 314,968 2
r/generativeAI 150,823 3
r/RemoteWorkers 74,528 1
r/VeniceAI 10,421 1
r/DailyIncome 12,914 1
r/freetoolsAI 7,736 1

r/generativeAI (3 hilos) y r/antiai (2 hilos) son los que más trataron este tema. r/antiai adopta una posición crítica hacia la generación de imágenes con IA, mientras que r/generativeAI se centra en comparativas de herramientas y consultas prácticas, mostrando tonos opuestos.

Qué dice la gente
  • Advertencia sobre la falsificación de timelapses de dibujo manual mediante LLM (hilo #1, r/antiai, 5.259 pt · 760 comentarios, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/). Una publicación mostró un método que da control de ratón y teclado a GPT-6 para falsificar de forma «verosímil» incluso el timelapse de un dibujo digital, y recibió un fuerte rechazo, como «¿por qué lanzar una tecnología así? No tiene otro propósito que perjudicar a artistas reales» (u/sanstheskelebrotherc, 235 pt).
  • Comparativa diaria de herramientas gratuitas de generación de vídeo con IA (hilo #2, r/generativeAI, 42 pt · 28 comentarios, 2026-08-31, https://www.reddit.com/r/generativeAI/comments/1w3frr2/). Adobe Firefly (2 vídeos al día), PixVerse (1 al día), Grok Imagine (1 al día) y Google Flow (3–4 al día) fueron el eje; los comentarios añadieron Kling AI (66 créditos cada 24 horas, equivalentes a 2–6 vídeos de 5 segundos a 720p) y créditos diarios gratuitos de CapCut.
  • Hilo para compartir herramientas gratuitas e ilimitadas de generación de imágenes (hilo #3, r/freetoolsAI, 37 pt · 38 comentarios, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/). La compatibilidad con NSFW fue el principal interés en los comentarios, con frases como «¿por qué todos banean NSFW?» (u/Relevant_Syllabub895), además de una lista de alternativas como Deepany, Aifun, Perchance y Z-Image-Turbo de huggingface.
  • Oferta de «$30/hora por revisar imágenes generadas por IA» difundida en paralelo en dos subs (hilo #4, r/RemoteWorkers, 114 pt · 520 comentarios, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/ y hilo #6, r/DailyIncome, 129 pt · 1.123 comentarios, 2026-09-04, https://www.reddit.com/r/DailyIncome/comments/1w7b18p/). Las ofertas son casi idénticas, pero la mayoría de comentarios son respuestas de una palabra como «images» o «Interested», generadas por el deseo de conseguir un enlace de solicitud.
  • Demostración de aceleración de generación local de imágenes (hilo #5, r/StableDiffusion, 31 pt · 10 comentarios, 2026-09-03, https://www.reddit.com/r/StableDiffusion/comments/1w6bphf/). Informó de una ejecución local de Vpipe + Krea-2-Turbo-M87 (16 bit) en Apple Silicon (M5 Pro 24GB), logrando aproximadamente 45 segundos por imagen a 1024×1024 y 8 pasos (35 segundos en tiempo real con cuantización de 8 bit).
  • Hilo de memes sobre que las imágenes de IA son cada vez más difíciles de detectar (hilo #8, r/antiai, 113 pt · 30 comentarios, 2026-08-30, https://www.reddit.com/r/antiai/comments/1w2mr8g/). En realidad se centra en manos deformadas, con bromas como «¿por qué su pie es una mano?» (u/GurInside278, 31 pt), señal de que las fallas clásicas aún son motivo de risa.
  • Valoración del servicio agregador de API WaveSpeedAI (hilo #7, r/generativeAI, 2 pt · 4 comentarios, 2026-09-05, https://www.reddit.com/r/generativeAI/comments/1w8ci5z/). Se afirma que «agrupa más de 1.000 modelos como Flux, Wan 2.1/2.6, Hailuo y Kling en una única API REST» (u/Jenna_AI), y un usuario que lo integró en su propia herramienta mediante Seedance (u/BradClarkAI) lo valoró diciendo que «no hay ningún problema».
  • Información sobre la selección de modelos en la comunidad VeniceAI (hilo #9, r/VeniceAI, 8 pt · 6 comentarios, 2026-08-30, https://www.reddit.com/r/VeniceAI/comments/1w2rtq1/). u/jerm2z propuso usos concretos: Chroma para generar imágenes; Qwen Edit Uncensored, Seedream y FireRed para editar (sin soporte NSFW, pero con alta consistencia facial); y WAN Enhanced, Seedance y Minimax R2V para imagen a vídeo.
  • Las imágenes de comida generadas por IA reciben duras críticas por «no apetecibles» (hilo #10, r/aiwars, 4 pt · 175 comentarios, 2026-09-03, https://www.reddit.com/r/aiwars/comments/1w69cdj/). Junto a comentarios mordaces como «solo parece una colmena de larvas» (u/LCI_Jake, 14 pt), un usuario que probó generación local con Krea 2 (40 segundos), u/Bassed_Hummble, preguntó por qué obtenía resultados tan malos pese a que el prompt no era nada especial.
  • Debate juvenil sobre la legitimidad del arte con IA (hilo #12, r/teenagers, 7 pt · 41 comentarios, 2026-08-31, https://www.reddit.com/r/teenagers/comments/1w2y305/). Una publicación sostuvo que «la IA recibe un prompt y es la propia IA quien realmente crea el dibujo, algo fundamentalmente distinto de la creación humana que usa materiales o software», generando división. u/TheDarkmore expresó una posición de uso práctico: «No dibujo bien, así que dejé en manos de IA las ilustraciones para 120 cartas de un juego de cartas, y me parece bien».
Señales
  • Tendencias al alza: el nuevo método que permite a LLM controlar ratón y teclado y falsificar «dibujo manual» (hilo #1) genera rápidamente rechazo como amenaza distinta a la detección tradicional de modelos de difusión, añadiendo un nuevo foco de tensión al conflicto IA vs. anti-IA. También crecen discretamente temas de infraestructura y eficiencia para desarrolladores, como servicios agregadores que «agrupan más de 1.000 modelos en una sola API» como WaveSpeedAI (hilo #7), y generación local rápida en Apple Silicon (hilo #5).
  • Áreas minimizadas o ridiculizadas: la publicidad alimentaria mediante imágenes de IA (hilo #10) recibió críticas como «sería mejor pegar una foto de stock», y se reiteraron los límites de calidad. Las ofertas de «$30/hora por revisar imágenes generadas por IA» (hilos #4 y #6) tienen contenido casi idéntico y comentarios mayoritariamente formales de solicitud de enlace, por lo que apenas hay debate práctico: es muy posible que se consuman como spam de empleo.
  • Conflicto inesperado: incluso sobre el mismo tema de que «las imágenes de IA son más difíciles de distinguir», en r/antiai (hilo #8) las manos deformadas siguen siendo material de broma, mientras que en el hilo #1 la nueva técnica capaz de «falsificar incluso el timelapse» se trata como una amenaza seria. La propia comunidad está dividida sobre el estado real de la detección de imágenes de IA. Del mismo modo, r/VeniceAI y r/StableDiffusion se entusiasman con selección técnica de herramientas y optimización, mientras r/antiai y r/aiwars despliegan fuertes críticas éticas y de calidad; las actitudes de Reddit hacia la generación de imágenes por IA están muy fragmentadas por subreddit.
Límites
  • Solo se utilizó la consulta «Image and Video Generation AI News»; no se hicieron búsquedas separadas para «código abierto» y «código cerrado». Por ello, este archivo por sí solo no permite separar directamente las «al menos 10 observaciones para código abierto/cerrado» requeridas por el brief (la clasificación debe hacerse en el informe compuesto).
  • El criterio de finalización del brief era analizar unas 20 publicaciones por red social, pero solo se recopilaron 12 hilos, sin alcanzar el objetivo.
  • En los hilos #4 y #6 (ofertas de $30/hora), la mayoría de comentarios son reacciones estereotipadas como «images» e «Interested», de modo que no se obtuvo una discusión o verificación sustantiva.
  • Reddit rechaza la obtención de páginas mediante WebFetch y búsquedas; por tanto, se depende exclusivamente de archivos de recopilación previa del trabajador (reddit.threads.md/json). No fue posible profundizar más en esta sesión de búsqueda, por ejemplo siguiendo hilos relacionados o ampliando comentarios.

X

X — Noticias de IA de generación de imágenes y vídeo

La propia lista Explore de X para esta sesión está geolocalizada en Croacia (la ubicación del servidor), no en Japón ni en un feed global: muestra como tendencias «Astra», «Bitcoin», «Ukrainian», «Argentina», «$SONG», «OpenAI», «Russia», «Black», «$KURO» y «Fable», sin recuentos de publicaciones. Solo tres de esos diez términos («Astra», «OpenAI» y «Fable») resultaron tener relación con IA de generación de imágenes/vídeo; el resto son predicciones de precios cripto, la guerra Rusia-Ucrania, cotilleo de celebridades argentinas y memecoins, y no se cubren aquí; véanse los Límites.

Cuentas

Cuentas relevantes, según lo que publicaron realmente:

Cuenta Qué publica Alcance de esta publicación
@masahirochaen (チャエン) Cuenta japonesa de noticias de IA/tecnología; dio la primicia del lanzamiento de GPT-6 Astra con cifras de benchmark y luego publicó sobre la frase de Altman de que «hay más allá de Astra» 2 publicaciones, 841 + 133 me gusta, hasta ~550.000 visualizaciones en la publicación del lanzamiento
@UNIBRACITY (SHINTARO) Artista aficionado de 3D que combina GPT-6 Astra con Blender 1 publicación, 306 me gusta
@hayashimon1 (ハヤシモン|AI×個人開発) Creador de IA/3D que también imparte seminarios de pago; usa Fable 5.1 × Blender 1 publicación, 55 me gusta
@manaimovie (Mankyu) Aficionado al vídeo con IA, alimenta Astra con un modelo 3D de Tripo 1 publicación, 409 me gusta
@yachimat_manga (yachimat‑AI Short Anime) Creador de cortos de anime con IA, especula que Astra podría sustituir herramientas dedicadas de generación de vídeo para ciertos estilos 1 publicación, 51 me gusta
@aigeboku (AI様の下僕) Usuario avanzado de IA que prueba el control agéntico «ComputerUse» de Astra 1 publicación, 653 me gusta
@gagarot200 (ガガロット) Cuenta de demostraciones de IA, clips de prompt de una línea a juego 1 publicación, 306 me gusta
@SSSS_CRYPTOMAN Cuenta híbrida de cripto+IA, publicó una demostración de creación de juego con Astra 1 publicación, 161 me gusta
@Mayz1169 (Kiki) / @renoiseai (Renoise) Cuentas de comparación de vídeo con IA en paralelo, ambas enfrentan GPT-6 Astra a Fable 5.1 renderizado mediante Seedance 2.5 1 publicación cada una, 64 y 140 me gusta
@k_matsumaru Creador de vídeo con IA que documenta un flujo completo (Typeless → Fable 5.1 → Seedream 5.0 → Seedance) 1 publicación, 279 me gusta
@Strength04_X Cuenta que comparte prompts para Seedance 2.5 (mediante lovart_ai) 1 publicación, 444 me gusta
@ImaStudio_ai Cuenta de producto/estudio para su propia herramienta de vídeo de moda con IA (basada en MiniMax H3) 1 publicación, 132 me gusta

Todas estas son publicaciones individuales, no hilos ni campañas sostenidas: se trata de una reacción dispersa de un día a un lanzamiento, no de una cuenta organizada que impulse la conversación.

Publicaciones
24. @masahirochaen (チャエン)

【Última hora】OpenAI anuncia «GPT-6 Astra». Por fin se publica el modelo clave que delega por completo el trabajo de PC y supera a Fable 5.1. …ARC-AGI-3 (capacidad de resolver rompecabezas inéditos) 98,6 %. La generación anterior, GPT-5.6, 7,8 %. Un salto anómalo.

Con mucha diferencia, la publicación más grande de esta colección y la que enmarca todo lo demás: anuncia GPT-6 Astra como un agente que opera el PC y supera a Fable 5.1, citando el salto de ARC-AGI-3 del 7,8 % (GPT-5.6) al 98,6 %.

21. @masahirochaen (チャエン)

Sam Altman habla públicamente del «más allá» de GPT-6… Aclaró que el modelo cuyo trabajo se pausó temporalmente en agosto por riesgo cibernético no era GPT-6 Astra.

Dos días tras el lanzamiento, la misma cuenta informa de que Altman dijo que el modelo que OpenAI pausó en agosto por riesgos cibernéticos no era Astra, lo que implica que hay un modelo todavía más capaz aún sin publicar.

3. @aigeboku (AI様の下僕)

Como se dice que GPT-6 Astra es muy capaz de «manejar otras cosas», con ComputerUse se amplía todo lo que puede hacerse… quizá sea difícil conseguirlo de un golpe, pero con ajustes desde aquí se podrán crear expresiones más interesantes.

Enmarca el punto fuerte de Astra como control mediante agentes («ComputerUse») y no como calidad bruta de generación: los primeros usuarios exploran lo que este control desbloquea para flujos creativos, no solo la salida de imágenes.

1. @manaimovie (Mankyu)

Le di a Astra un modelo creado con Tripo y le pedí que lo animara; esto es lo que consiguió. …¡Bastante mejor que con Fable o Sol!

Una afirmación concreta de flujo antes/después: entregar a Astra un modelo 3D creado con Tripo y pedirle que lo animara funcionó mejor que hacer lo mismo con Fable o «Sol».

22. @gagarot200 (ガガロット)

GPT-6 Astra lo genera por completo de forma automática… Basta con explicarle con una sola frase «GPT-6 Astra, haz un juego así».

Una demostración de prompt de una línea a juego jugable de principio a fin, presentada como prueba del posicionamiento de Astra de «hacer toda la tarea».

23. @UNIBRACITY (SHINTARO)

GPT-6 Astra × Blender «Forest Retreat / Retiro forestal». Tiempo de funcionamiento de Astra: unas 7 horas; llegó hasta aquí.

Una ejecución de Astra de unas 7 horas produjo una escena 3D completa en Blender, uno de los datos más detallados del conjunto acerca de cuánto tiempo llevó realmente.

4. @SSSS_CRYPTOMAN (SSSS.CRYPTOMAN⚡️AI)

¡Un juego terminado enseguida con GPT-6 Astra! 🎮 …Con un prompt impreciso y unas pocas interacciones se logró algo de calidad perfectamente jugable.

Otra demostración de prompt impreciso a juego jugable, con enlace en directo, que repite de forma independiente la afirmación de @gagarot200.

2. @yachimat_manga (yachimat - AI Short Anime)

Probé a modelar con GPT-6 Astra. …¿No hay una posibilidad de que, según el estilo de vídeo, en el futuro ya no haga falta generación de vídeo?

Un creador activo de anime corto con IA especula que, para algunos estilos, el modelado 3D de Astra podría volver innecesarias las herramientas específicas de generación de vídeo.

40. @renoiseai (Renoise)

GPT-6 Astra vs Fable 5.1. Ambos vídeos se generaron con Seedance 2.5 en Renoise.

Un clip de enfrentamiento directo, con ambas salidas renderizadas mediante la misma herramienta posterior (Seedance 2.5) para controlar esa variable.

39. @Mayz1169 (Kiki)

Olvida los benchmarks por un momento. Solo mira esto. Comparación lado a lado de GPT-6 Astra vs. Fable 5.1 con los mismos prompts. ¿Cuál elegirías?

El mismo impulso comparativo que el anterior, de forma independiente: los cara a cara Astra vs. Fable 5.1 son un microgénero reconocible en este conjunto, no algo aislado.

37. @k_matsumaru (松丸 彗吾)

Mi manera reciente de hacer vídeos… ① Redacto el guion con Typeless ② Hago que Fable 5.1 redacte prompts de generación de vídeo ③ Lo convierto en storyboard con Seedream 5.0 Pro y reviso el contenido ④ Seedance…

El flujo de producción más detallado del conjunto: Typeless para guion → Fable 5.1 para redactar prompts → Seedream 5.0 Pro para storyboard → Seedance para el vídeo final. Aquí Fable aparece como capa de prompting, no como renderizador.

32. @ImaStudio_ai (Ima Studio)

MiniMax H3 K-Fashion Outfit Change MV… 8 LOOKS. 1 GIRL. ZERO IDENTITY DRIFT.

Una cuenta de estudio comercial promociona su propio producto basado en MiniMax H3, vendiendo «cero deriva de identidad» entre cambios de vestuario como diferenciador.

Señales
  • Lo que crece: GPT-6 Astra (OpenAI) domina todas las publicaciones relevantes de este lote, y se habla de él primero como un modelo agéntico que opera ordenadores y solo después como generador de imágenes/vídeo. Los usuarios lo combinan continuamente con otras herramientas (Tripo para mallas 3D, Blender para escenas), en vez de tratarlo como renderizador autónomo.
  • Un microgénero reconocible: cuentas independientes y no coordinadas (@renoiseai, @Mayz1169) publican comparativas lado a lado de «GPT-6 Astra vs Fable 5.1» renderizadas mediante Seedance 2.5. Fable 5.1 es el modelo elegido como referencia, mientras Seedance/Seedream reaparecen como la capa real de renderizado de vídeo bajo ambos.
  • Flujos encadenados, no herramientas únicas: la publicación más detallada (@k_matsumaru, #37) encadena cuatro herramientas (Typeless → Fable 5.1 → Seedream 5.0 Pro → Seedance) para un solo vídeo. Nadie en este conjunto describe terminar un vídeo con un único modelo.
  • Lo que sorprendió: los términos en tendencia obtenidos del panel Explore de X, geolocalizado en Croacia —Bitcoin, Ukrainian, Argentina, $SONG, Russia, Black y $KURO— no tenían prácticamente ninguna conexión con IA de generación de imágenes/vídeo. Las tendencias de X en la ubicación del servidor el 2026-09-05/06 eran cripto y geopolítica, no modelos de IA; usarlas como indicador del discurso sobre IA habría sido engañoso.
  • Lo que se descarta: no apareció ningún hilo escéptico o crítico sobre GPT-6 Astra en este lote. Cada publicación relevante es una demostración, un repost de benchmark o un clip comparativo. Esa ausencia resulta notable ante la agresividad de la afirmación de que «supera a Fable 5.1» (#24).
Límites
  • Los diez términos de búsqueda utilizados («Astra», «Bitcoin», «Ukrainian», «Argentina», «$SONG», «OpenAI», «Russia», «Black», «$KURO», «Fable») procedían de la lista de tendencias Explore de X para esta sesión, no de una lista seleccionada de términos de IA de imagen/vídeo. Siete de los diez («Bitcoin», «Ukrainian», «Argentina», «$SONG», «Russia», «Black», «$KURO») devolvieron publicaciones totalmente ajenas al tema de investigación —sorteos y predicciones de cripto, la guerra Rusia-Ucrania, noticias de celebridades argentinas y dos memecoins pequeños— y se excluyen de la sección de Publicaciones.
  • Por ello, la cobertura de código abierto aquí es escasa e indirecta: ninguna publicación utilizó términos como «Stable Diffusion», «ComfyUI», «Wan», «HunyuanVideo» o «Flux». Esas búsquedas no se realizaron en esta etapa. Todo lo relevante remite a nombres cerrados/comerciales (GPT-6 Astra, Fable 5.1, Seedance, Seedream, MiniMax H3, Tripo), así que la imagen del código abierto en X debe tratarse como ausente, no como «no ocurre nada».
  • La publicación #35 (@MINHxDYNASTY, etiquetada «$KURO») se recopiló sin texto, por lo que no pudo usarse como hallazgo.
  • La columna «Dónde» de Explore se geolocaliza donde esté el servidor de la sesión, Croacia, no en Japón ni globalmente. No debe interpretarse como imagen de tendencias globales o de Japón.
  • No hubo fallo de sesión ni acceso: la recopilación devolvió datos para todos los términos intentados. La carencia fue temática (qué términos se buscaron), no técnica.

YouTube

YouTube — Noticias de IA de generación de imágenes y vídeo (código cerrado/código abierto)

Canales
  • Bijan Bowen (@Bijanbowen, aproximadamente 37.000 suscriptores) — Especializado en reseñas detalladas de LLM y modelos de generación de imágenes. Prueba Qwen Image-2512.
  • Future Tools / Matt Wolfe (@mreflow, más de 900.000 suscriptores) — Resume semanalmente tendencias de IA de imagen y vídeo, como Midjourney y Runway, con el formato «Everything in AI This Week».
  • Conjunto de canales de tutoriales de ComfyUI/generación local (muchos vídeos sobre flujos de Wan 2.2/2.6, FLUX y Qwen Image; solo se confirmaron títulos de vídeo y los nombres de canal individuales no aparecían en resultados de búsqueda).
Vídeos
  1. "Why OpenAI Shut Down Sora So Fast: What's Next?" — Publicado alrededor de marzo–abril de 2026. Explica el contexto de la decisión de OpenAI de cerrar la aplicación Sora el 26 de abril de 2026 y de finalizar la propia API el 24 de septiembre de 2026 (las descargas mensuales cayeron de 3,3 millones en noviembre de 2025 a 1,1 millones en febrero de 2026, y también se rompió un acuerdo de 1.000 millones de dólares y tres años con Disney). https://www.youtube.com/watch?v=H2jVcy5PuBI
  2. "Why Did Sora AI Shut Down? The Real Reason OpenAI Killed Its Viral Video App" — Publicado en primavera de 2026. Examina el coste económico de una aplicación de generación de vídeo que no logró monetizarse y el giro estratégico hacia IA de agentes. https://www.youtube.com/watch?v=MpLY9bjYVuA
  3. "HunyuanImage-3.0 First Test – The Open Source Nano Banana?" — Publicado el 29 de septiembre de 2025. Prueba localmente HunyuanImage-3.0 de Tencent, uno de los mayores modelos de texto a imagen de código abierto, incluidos los requisitos de hardware. https://www.youtube.com/watch?v=lLTv4sGf8Wo
  4. "Qwen Image-2512 First Test – The BEST Open Source Image Model!" (Bijan Bowen) — Publicado el 31 de diciembre de 2025. Prueba mediante imágenes reales las mejoras de Qwen Image-2512 de Alibaba en realismo de personas y renderizado de texto. https://www.youtube.com/watch?v=SBaK616nP6Q
  5. "New Qwen Image 2512: Better Than Z-Image? (Open Source & Free)" — Publicado el 5 de enero de 2026. Compara directamente Qwen Image 2511/2512 con Z-Image Turbo de Tongyi-MAI. https://www.youtube.com/watch?v=uAGH_yRZ2Gw
  6. "Tencent Hunyuan 2.1 vs. Qwen Image: Who is the True King? A 2K Image & Text Rendering Showdown!" — Publicado el 28 de septiembre de 2025. Enfrentamiento de renderizado de texto a 2K entre Hunyuan Image 2.1, que lideraba por entonces la clasificación Arena de texto a imagen de código abierto, y Qwen Image. https://www.youtube.com/watch?v=MUDTryJS0XM
  7. "Z-Image la nouvelle star des modèles Open Source?? Test dans ComfyUI" — Publicado el 28 de noviembre de 2025. Prueba en ComfyUI Z-Image Turbo, el modelo de texto a imagen de código abierto de Alibaba/Tongyi-MAI. https://www.youtube.com/watch?v=eOKSBu7KLh0
  8. "Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models" — Publicado el 11 de enero de 2026. Tutorial largo sobre los últimos modelos abiertos de generación de imagen y vídeo (Wan 2.2/FLUX/Qwen Image) en ComfyUI. https://www.youtube.com/watch?v=3BFDcO2Ysu4
  9. "WAN 2.6 Hands-On: The Good, the Bad, and the Useful" — Publicado el 26 de diciembre de 2025. Prueba práctica de Wan 2.6 de Alibaba, con soporte para hasta 15 segundos, multitoma y sincronización de audio. https://www.youtube.com/watch?v=iNnmLwPg7OE
  10. "Multi-Shot AI Videos: Wan 2.6 vs Kling 2.6 (Stress Test)" — Publicado el 27 de diciembre de 2025. Compara mediante una prueba de estrés la generación multitoma de Wan 2.6 abierto y Kling 2.6 cerrado. https://www.youtube.com/watch?v=CDRKn4I-Iv0
  11. "I Tested Google's Nano Banana Pro Tips - This One Creates Pro Graphics in 30 Seconds" — Publicado alrededor de noviembre–diciembre de 2025. Prueba práctica de Gemini 3 Pro Image de Google DeepMind, también llamado Nano Banana Pro, con salida 4K, soporte para más de 14 objetos y renderizado de texto multilingüe. https://www.youtube.com/watch?v=ca4SXmRqtKE
  12. "Qwen Image Edit Review — Free Open-Source Alternative to Nano Banana" — Publicado el 4 de diciembre de 2025. Reseña de Qwen Image Edit, un modelo de edición abierto que compite con Nano Banana de código cerrado. https://www.youtube.com/watch?v=Ur3udfFJ2QQ
Señales
  • La mayor noticia de código cerrado es la retirada de Sora: OpenAI avisó a desarrolladores el 24 de marzo de 2026, terminó la aplicación/web de Sora el 26 de abril y prevé finalizar la API el 24 de septiembre de 2026. Varios vídeos atribuyen el hecho a la caída de descargas (3,3 millones en noviembre de 2025 → 1,1 millones en febrero de 2026) y a la ruptura de la alianza de 1.000 millones de dólares con Disney. Se presenta como ejemplo de un cambio sectorial de recursos desde generación de vídeo hacia IA de programación/agentes.
  • El bando abierto adopta la estructura «dos líderes + nueva estrella»: el bloque Alibaba (Qwen Image, Z-Image Turbo, Wan 2.2/2.6) y el bloque Tencent (HunyuanImage 3.0/2.1) compiten por el liderazgo en las principales clasificaciones, mientras FLUX.2 de Black Forest Labs ([dev]/[klein], VAE bajo Apache 2.0) compite en fotorrealismo. Muchos creadores presentan Qwen Image y HunyuanImage como «alternativas abiertas a Nano Banana», consolidando la comparación directa entre cerrado y abierto como formato.
  • En vídeo, multitoma y sincronización de audio son el nuevo estándar: Wan 2.6 (abierto) y Kling 3.0/Seedance 2.0/Runway Gen-4.5 (cerrados) compiten por ofrecer «varias tomas en una generación» y «generación simultánea de audio y SFX», pasando de clips aislados a una competencia de funciones más avanzada.
  • Muchas reseñas adoptan el formato práctico de «first test» o «first look», una modalidad rápida que suele publicarse entre unos días y una semana después del anuncio de un modelo.
Límites
  • Las páginas de resultados y reproducción de YouTube (youtube.com/results, youtube.com/watch) se renderizan con JavaScript, por lo que WebFetch solo obtuvo pies de página estáticos (avisos de copyright, enlaces de condiciones, etc.). En la mayoría de casos no se pudieron confirmar directamente reproducciones, suscriptores ni comentarios. Las cifras indicadas proceden solo de fragmentos disponibles en resultados web y muchos vídeos no incluyen recuento de reproducciones.
  • No se pudieron identificar URL directas de reseñas individuales de YouTube para Kling 3.0 / Seedance 2.0 / Runway Gen-4.5, porque los resultados se concentraron en artículos de blogs de comparación técnica (invideo.io, Pixo, AI.cc, etc.).
  • Solo se pudieron confirmar los suscriptores individuales de Bijan Bowen (aproximadamente 37.000) y Matt Wolfe / Future Tools (más de 900.000).

Bluesky

Bluesky — Noticias de IA de generación de imágenes y vídeo

La API oficial de búsqueda de Bluesky (app.bsky.feed.searchPosts) devolvió de manera consistente 403 Forbidden en esta sesión, haciendo imposible recopilar publicaciones mediante búsqueda por palabras clave (véanse los Límites). Por ello, se pasó a buscar cuentas relacionadas mediante app.bsky.actor.searchActors y a leer uno a uno sus historiales de publicaciones (getAuthorFeed).

Cuentas
Cuenta Contenido Seguidores Publicaciones
@todaystopainews.bsky.social «Today's Top AI News». Cuenta tipo bot que recopila y publica automáticamente noticias del sector de IA. Trata mucho GPT-6 Astra, Fable 5.1 y otros modelos cerrados 272 1.826
@useapi.bsky.social useapi.net. Cuenta oficial de un servicio agregador de API para Veo, Kling, Seedance, PixVerse, Hailuo, Runway, Nano Banana y otros modelos de imagen/vídeo 13 24
@nijiironokeshiki.bsky.social «Niji-iro». Creador particular que publica 2–3 veces al día ilustraciones derivadas de Re:Zero, Lycoris Recoil, Frieren y otras obras, con Stable Diffusion y ComfyUI 699 1.963
@kunecco.bsky.social «Kunecco». Desarrollador de nodos, flujos y LoRA para la versión git de ComfyUI. También publica contenido técnico, como traducciones de etiquetas danbooru 540 494
@midjourneyofficial.bsky.social Cuenta oficial de Midjourney. Anunció su entrada en Bluesky en agosto de 2025 Desconocido Última publicación: 2025-10-08
@comfyuistudio.bsky.social Cuenta de terceros que presenta flujos de ComfyUI Desconocido Última publicación: 2024-12-19
@klingaivideo.bsky.social Cuenta de presentación de la herramienta de generación de vídeo Kling AI Desconocido Feed vacío (sin publicaciones)
Publicaciones
Código cerrado
  1. GPT-6 Astra genera un SVG de un mando de PS4 (@todaystopainews, 11 me gusta · 2 reposts · 1 respuesta, 2026-09-05, https://bsky.app/profile/todaystopainews.bsky.social/post/3mur7cyocf225). Incluye el tiempo de generación, 11 minutos y 54 segundos, un ejemplo concreto de cuánto tarda GPT-6 Astra de OpenAI en resolver una tarea relacionada con imagen.

  2. GPT-6 Astra monta una escena urbana en Unity (@todaystopainews, 4 me gusta · 1 repost, 2026-09-04, https://bsky.app/profile/todaystopainews.bsky.social/post/3muoucqf4tk2w). Una demostración de composición automática de una escena 3D usando activos existentes, que ejemplifica un uso agéntico más allá de la generación simple de imágenes.

  3. Repost de «Fable 5.1 world modeling» (@todaystopainews, 11 me gusta · 4 reposts, 2026-09-03, https://bsky.app/profile/todaystopainews.bsky.social/post/3mumdxgujh22h) y «una ciudad medieval creada con Fable 5.1» del día anterior (10 me gusta · 3 reposts, 2026-09-02, https://bsky.app/profile/todaystopainews.bsky.social/post/3mukekiwxws2j). Fable 5.1 vinculado a Anthropic se cubre repetidamente mediante demostraciones de modelado 3D y mundos.

  4. Blog de useapi.net «Seedance 2.5 on Dreamina API» (@useapi.bsky.social, 2026-08-08, https://bsky.app/profile/useapi.bsky.social/post/3mskj7fb2ok2a). Presenta en formato de blog técnico que Seedance 2.5, modelo de generación de vídeo asociado a ByteDance, puede usarse mediante una API a través de Dreamina.

  5. Comparativa de useapi.net «MiniMax H3 vs Seedance 2.0» con la misma imagen de referencia (@useapi.bsky.social, 2026-07-31, https://bsky.app/profile/useapi.bsky.social/post/3mrw5xyd4zk2x). Comparación directa entre modelos usando el mismo material de referencia (omni references), una validación de calidad desde la perspectiva de un proveedor de API.

  6. useapi.net «Comparativa exhaustiva de más de 17 modelos de imagen con IA» (@useapi.bsky.social, 3 me gusta, 2026-07-25, https://bsky.app/profile/useapi.bsky.social/post/3mrigfks25k2n). Artículo comparativo de múltiples modelos de generación de imagen, que deja ver la proliferación de modelos de diversas empresas de código cerrado.

  7. useapi.net «Comparativa de precios entre ruta oficial y ruta de terceros para Seedance 2.0» (@useapi.bsky.social, 2026-07-23, https://bsky.app/profile/useapi.bsky.social/post/3mrdyxqswcb2p). Compara concretamente las diferencias de precio entre la API oficial y una vía agregadora para el mismo modelo, haciendo visible la estructura en capas del mercado de API.

Código abierto
  1. Publicaciones cotidianas de ilustraciones con IA de «Niji-iro» (@nijiironokeshiki, entre 87 y 245 me gusta, varias publicaciones entre 2026-09-02 y 09-05; ejemplo: https://bsky.app/profile/nijiironokeshiki.bsky.social/post/3mumi7nop522l, 104 me gusta · 25 reposts). Según indica su perfil, produce con Stable Diffusion y ComfyUI, y es una cuenta particular que recibe de forma sostenida una participación excepcionalmente alta dentro de Bluesky.

  2. Comentarios de Kunecco sobre desarrollo de flujos ComfyUI (@kunecco, 2025-10-27, https://bsky.app/profile/kunecco.bsky.social/post/3m45jd5s2ek2f): «Crear nodos y flujos se ha vuelto divertido y estoy cayendo en el pozo». La misma cuenta publicó aproximadamente entonces que «tradujo 140.000 líneas de tokens de danbooru» (https://bsky.app/profile/kunecco.bsky.social/post/3m432qalae22t), un ejemplo de trabajo con el ecosistema ComfyUI a nivel de diccionario de etiquetas.

  3. Estancamiento de las cuentas oficiales o semioficiales de ComfyUI (@comfyuistudio.bsky.social, última publicación: 2024-12-19; @comfy-ui.bsky.social, feed vacío). La búsqueda de actores encontró muchos identificadores parecidos como comfyuistudio, real-comfyui, comfy-ui y comfyuiorg, pero quienes realmente permanecen activos son creadores particulares de ilustración IA como Niji-iro y Kunecco; apenas existe presencia oficial en Bluesky de desarrolladores o fuentes de noticias de la herramienta.

Señales
  • En código cerrado predominan las noticias de última hora; en abierto, las publicaciones de obras: las entradas de todaystopainews y useapi.net tratan de nombres de modelo, precios de API y benchmarks como GPT-6 Astra, Fable 5.1, Seedance y MiniMax H3. Aunque tienen pocos me gusta, de una a unas diez unidades, su densidad informativa es alta. El lado abierto (Stable Diffusion/ComfyUI) se centra en ilustraciones terminadas de creadores particulares como Niji-iro; la conversación está orientada a las obras, no a las tendencias de modelos. En Bluesky casi no fluye actividad de código abierto como noticia técnica.
  • Las cuentas oficiales de Midjourney y Kling AI están de facto inactivas: Midjourney anunció su llegada a Bluesky en agosto de 2025, pero su última publicación es de 2025-10-08, y la cuenta oficial de Kling AI Video tiene el feed vacío. Las marcas no usan Bluesky como canal de comunicación sostenido.
  • Cuentas de personalidad/agente de IA bajo el nombre GPT-6 Astra: aparecieron cuentas como astrra.space (Astra, «AI agent running on GPT-6 Astra») y maple-nekokami.bsky.social («Runs on OpenAI GPT-6 Astra»), que operan personajes usando el nombre del modelo como marca. No son directamente sobre generación de imagen/vídeo, pero muestran que GPT-6 Astra se consume como meme de marca en Bluesky.
  • Las API agregadoras, como useapi.net, se convierten en hub de comparación de código cerrado: useapi.net, que reúne Veo, Kling, Seedance, PixVerse, Hailuo, Runway, Nano Banana y otros, produce en Bluesky las publicaciones más concretas como fuente primaria de comparativas de precio y rendimiento. Los servicios transversales ofrecen información más útil que las cuentas oficiales de un solo modelo.
Límites
  • app.bsky.feed.searchPosts (la API de búsqueda completa de texto de publicaciones) devolvió HTTP 403 para todas las consultas («image generation AI», «Stable Diffusion», «Flux» e incluso consultas de una sola palabra). En cambio, app.bsky.actor.searchActors (búsqueda de cuentas) y app.bsky.feed.getAuthorFeed (historial de publicaciones por cuenta) respondieron sin problemas. Por ello, este informe depende de «encontrar cuentas que parecen relacionadas y leerlas individualmente», no de buscar publicaciones transversalmente por palabra clave; las publicaciones y cuentas no halladas por el motor no están incluidas.
  • Frente al objetivo de analizar unas 20 publicaciones por red social, solo pudieron leerse y analizarse las 10 indicadas más publicaciones periféricas. Para aumentar la muestra bajo la limitación de no tener búsqueda completa por cuenta habría que descubrir más cuentas relacionadas, pero en esta sesión, tras revisar los principales enfoques —bots de noticias cerradas como GPT-6 Astra/Fable 5.1, agregadores API como useapi.net y creadores de ComfyUI/Stable Diffusion—, la mayoría de cuentas adicionales resultaron inactivas o irrelevantes (deportes, política, periodismo), por lo que se detuvo la recopilación.
  • Las cuentas oficiales de marcas como Midjourney y Kling AI tienen publicaciones detenidas o feeds vacíos, por lo que no pudieron utilizarse como noticias actuales.
  • Las búsquedas de cuentas con nombres recientes de modelos abiertos como «Wan2.5», «Flux.2» y «オープンソース 画像生成» no dieron resultados; no se encontraron cuentas de Bluesky que publicaran sobre modelos abiertos concretos como Wan, HunyuanVideo, Qwen-Image o Chroma. Las tendencias abiertas solo pudieron verificarse dentro de marcas establecidas como Stable Diffusion/ComfyUI.

Lemmy

Lemmy — Últimas tendencias de IA de generación de imágenes y vídeo

Comunidades
  • !«メールアドレス» — 5.708 personas. Con diferencia la comunidad más activa. Cada día aparecen nodos personalizados de ComfyUI, pesos de modelos nuevos y LoRA; es de facto un «tablón de noticias rápidas de IA de generación de imagen/vídeo de código abierto».
  • !«メールアドレス» — 2.360 personas. Principalmente comparte obras generadas, con pocas noticias.
  • !«メールアドレス» — 1.662 personas. Similar a la versión dbzer0, pero con menor frecuencia de publicación.
  • !«メールアドレス» — 87.858 personas. Una de las mayores comunidades tecnológicas de Lemmy, pero con poca conversación específica sobre IA de imagen/vídeo; solo aparecen ocasionalmente noticias corporativas de Midjourney.
  • !«メールアドレス» (incluidos espejos de otras instancias) — Contiene muchos reposts de subreddits de IA. Hay pocas entradas, pero permite recoger fuentes particulares como información financiera de Runway.
  • !techtakes — Comunidad crítica y escéptica sobre IA. Incluye publicaciones sarcásticas sobre los tropiezos de Midjourney.
Publicaciones
  1. Midjourney gira hacia el negocio de escáneres CT ultrasónicos médicos — !«メールアドレス», puntuación 58, 2026-06-18, https://www.theregister.com (artículo original de The Register). Relacionado: blog oficial de Midjourney https://midjourney.com/medical/blogpost (!hackernews, puntuación 2, 2026-06-18), y reacción en comunidad sarcástica: «Midjourney AI pivots to Theranos», !techtakes, puntuación 40, 2026-06-19, https://pivot-to-ai.com/2026/06/19
  2. Midjourney exige a estudios de Hollywood que revelen su uso de IA — !«メールアドレス», puntuación 73, 2026-07-05, https://techcrunch.com/2026/07/04
  3. Runway: «el negocio empresarial se duplicó y el NRR supera el 300 %» — !ai_reddit, puntuación 0, 2026-08-30, https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/ (repost de Lemmy)
  4. Lanzamiento de Qwen-Image-2.0: gran reducción de parámetros de 20B a 7B, generación y edición integradas, supera a Nano Banana en evaluación Elo (pesos previstos próximamente) — !«メールアドレス», puntuación 12, 2026-02-12, https://files.catbox.moe/l3mzzs.jpg (también publicado en !LocalLLaMA, !Aii y !artificial_intel)
  5. Wan Animate 2 disponible en ComfyUI — !«メールアドレス», puntuación 8, 2026-08-08, https://blog.comfy.org/p/wan-animate-2-is-now-available-in
  6. LTX-2.5 con soporte Day-0 en ComfyUI — !«メールアドレス», puntuación 5, 2026-08-12, https://blog.comfy.org/p/ltx-25-day-0-support-in-comfyui
  7. Trellis.2 y Pixal3D (modelos de generación 3D) reciben soporte nativo en ComfyUI — !«メールアドレス», puntuación 4, 2026-09-01, https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native
  8. El ecosistema de MiniMax-H3 (modelo de vídeo de pesos abiertos) crece rápidamente — Más de diez publicaciones solo en !«メールアドレス» entre 8/8 y 9/5. Extractos: versión cuantizada GGUF (21,6GB→8,9GB, puntuación 10, https://huggingface.co/Abiray/MiniMax-H3-Pruned-GGUF) / LoRA de aceleración de 4–8 pasos (puntuación 6–7, https://huggingface.co/lightx2v/Minimax-h3-Turbo) / soporte de vídeo largo de hasta 120 segundos con sincronización de audio (puntuación 5, https://huggingface.co/Smite79/MiniMax-H3-Longvideos) / implementación de atención híbrida (puntuación 3, https://github.com/Saganaki22/ComfyUI-VDN-H3, 2026-09-05)
  9. Conjunto de nodos de mejora de calidad de vídeo nativos de GPU (ComfyUI-AetherScale, DLSS5 Visual Enhancer) — !«メールアドレス», puntuación 5, 2026-09-01/09-05, https://github.com/vizart-vj/ComfyUI-AetherScalehttps://github.com/Merserk/dlss5-visual-enhancer
  10. Mediante MCP para Claude se pueden invocar más de 30 modelos de generación de imagen/vídeo desde un solo chat, reduciendo el mismo proyecto de 2,5 horas a 50 minutos — !ai_reddit, puntuación 1, 2026-05-01, https://i.redd.it/6gqfafpaukyg1.png
Señales
  • El lado abierto está completamente centrado en ComfyUI/HuggingFace y las «noticias de implementación». Más que anuncios de modelos nuevos, la mayoría de publicaciones son actualizaciones de ecosistema: «X llegó a ComfyUI», «salió un LoRA», «salió una versión cuantizada». El desarrollo de herramientas alrededor de MiniMax-H3 es el principal campo de batalla actual.
  • La generación 3D (Trellis.2, Pixal3D) empieza a integrarse en ComfyUI, ganando presencia como siguiente objetivo generativo tras imágenes y vídeo.
  • El código cerrado en Lemmy tiende a consumirse como «crítica o escándalo», no como «noticia de producto». El giro de Midjourney hacia dispositivos médicos creció más en comunidades generales de tecnología y sátira que en comunidades de IA generativa (puntuaciones 58, 73 y 40).
  • Las menciones a Nano Banana en Lemmy aparecen casi siempre solo en el contexto comparativo de «un modelo abierto lo superó»; no se hallaron publicaciones como información primaria procedente de Google.
  • No hubo resultados directos para Sora, Veo, Kling, Hailuo, Seedream/Seedance ni las últimas versiones de Adobe Firefly durante el período investigado del último mes; las publicaciones sobre Adobe Firefly más recientes eran de 2025.
Límites
  • Lemmy es pequeño y la discusión especializada sobre IA de generación de imagen/vídeo se concentra casi por completo en !«メールアドレス». Se realizaron búsquedas transversales en otras instancias (lemmy.ml, lemm.ee, lemmy.zip, etc.), pero los resultados eran duplicados o irrelevantes.
  • La búsqueda de texto completo (/api/v3/search) tiene coincidencia difusa débil y nombres cortos como «Sora» o «Veo» devuelven muchas publicaciones irrelevantes (nombres de persona, otros servicios). Se probaron tanto API como búsqueda web, pero no se hallaron publicaciones primarias originadas en Lemmy sobre OpenAI Sora, Google Veo, Kling AI, Hailuo o ByteDance Seedream/Seedance. Esto probablemente es una limitación de búsqueda/cobertura de Lemmy, no prueba de que no hubiera conversación.
  • La publicación sobre Qwen-Image-2.0 es antigua, de febrero de 2026, y no un tema del último mes, pero se conserva por ser valiosa como eje comparativo entre abierto y cerrado.
  • Las publicaciones de Runway y Claude MCP no nacen en Lemmy, sino que son reposts desde Reddit (!ai_reddit); la información primaria está en Reddit.

Pinterest

Pinterest — Noticias de IA de generación de imágenes y vídeo

Se recopilaron 50 pines de Pinterest con la consulta «Image and Video Generation AI News» (output/pinterest.pins.md, búsqueda única sin segmentación por género). Se revisaron las 50 imágenes.

Temas visuales
  • Conversión de «IA = robot humanoide blanco/cyborg» en símbolo: sin relación con el funcionamiento real de la IA generativa, los robots humanoides blancos y los perfiles combinados de robot y humano se repiten como sinónimo visual de «IA» ([2, 19, 30, 35, 37, 40, 43, 44, 46, 48]). Las miniaturas de pines de noticias y explicaciones casi convergen por completo en este motivo.
  • Dominio de la paleta ciber neón × azul marino: la mayoría son infografías de apariencia templada que combinan brillos cian, púrpura y magenta, patrones de circuitos y fondo oscuro ([3, 5, 6, 7, 10, 13, 17, 18, 19, 21, 29, 32, 34, 39, 42, 44, 46, 48, 49]). Casi no hay fotografía real ni elementos dibujados a mano; es evidente que son diseños masivos basados en Canva/material de stock.
  • Las listas clasificatorias de «best AI tool» son el pilar del género: se repiten tablas comparativas y gráficos de clasificación con logos de Runway, Pika, Kling AI, Luma AI (Dream Machine), Synthesia, HeyGen, InVideo AI, Kaiber, Adobe Firefly, ChatGPT Plus, Midjourney y Canva AI ([9, 16, 20, 24, 38, 42]). [16] y [24] tienen contenido casi idéntico, lo que muestra que la misma plantilla se reutiliza por varios autores.
  • Infografías de noticias rápidas y resúmenes: abundan pines que resumen «las noticias de IA de esta semana» con diseño de periódico o banners de «Breaking News» ([11, 12, 21, 29, 32, 33, 39, 43, 47, 50]). Muchos tienen fechas impresas dentro de la imagen; «noticias rápidas» de fechas diferentes, como 30 de junio de 2025 [29], 20 de mayo de 2026 [21] y 15 de agosto de 2026 [32], conviven en los mismos resultados.
  • Los pines que muestran generación real o demostraciones de vídeo son minoritarios: frente a la mayoría de imágenes de marketing con logos y texto, solo alrededor de una décima parte de los 50 pines muestran salidas reales: demo reel oficial de Google Veo 2 [8], cuadrícula de transformación de estilo probablemente de Luma (persona → talla de madera/papiroflexia/LEGO/flores) [4], demo de Microsoft VASA-1 de expresión desde una imagen y audio [22], ejemplo de salida de imagen a vídeo con un personaje monstruoso púrpura consistente [26] y retrato realista de un pescador anciano creado con AMD Amuse [41].
  • Tema de escepticismo y detección: «¿es real? ¿es IA?»: hay una cantidad estable de contenido que incentiva dudas sobre autenticidad, como foto de gato con sello FAKE y robot [2], cuestionario de montañas «Which is AI?» [15], detección de voz IA al 97 % [18], lista de pros y contras sobre si los vídeos IA son buenos o malos [23] y un letrero de neón que dice que «todo el mundo usa mal la IA» [46].
  • Mezcla de fotografías de personas famosas reales e imágenes IA «tipo celebridad»: aparecen una foto real de Jensen Huang, CEO de Nvidia, en escenario [45] y una miniatura de YouTube de alguien parecido a Sam Altman [33], junto con un anuncio de Fiverr que genera con IA un rostro parecido al de Bezos [36]. La frontera entre fotografía real e imagen IA es difícil de distinguir en la lista de pines.
  • Las menciones a código abierto son extremadamente escasas: frente a la abrumadora exposición de herramientas cerradas (Veo, Sora, ChatGPT, Midjourney, Runway, etc.), solo dos pines mencionan código abierto/generación local: una página de noticias sobre la apertura de «Ernie 4.5» de Baidu [29] y la herramienta local para GPU AMD «Amuse 3.0» [41]. No aparecen pines que sugieran la comunidad OSS de generación de imágenes de Stable Diffusion, ComfyUI o LoRA.
Pines destacados
  • [4] (sin título / cuadrícula de transformación de estilo tipo Lumalabs) — Convierte un fotograma de vídeo real en «talla de madera», «papiroflexia», «bloques LEGO» y «flores», comparando en paralelo las mismas transformaciones para perros y coches Tesla. Es la demostración técnica más concreta.
  • [8] Google Unveils Veo 2 — Un conjunto de materiales promocionales oficiales —una mujer mirando por un microscopio, una persona nadando bajo el agua, una bailarina dibujando constelaciones, una chica animada en una cocina y una bandada de flamencos— que muestra del modo más directo la amplitud expresiva de Veo 2.
  • [9] 6+ Best AI Video Generation Websites — Infografía para guardar que organiza Runway/Pika/Kling AI/Luma AI/Canva AI/Hailuo AI por funciones y público objetivo. Con una llamada a «Save this pin», ilustra el consumo de listas característico de Pinterest.
  • [16] AI Image Video: Best Quality vs Best Free — Contrapone 10 herramientas de pago y 10 gratuitas, con un flujo de diagnóstico por uso. Su contenido es casi igual al de [24], lo que respalda la difusión de plantillas similares.
  • [22] VASA-1 (Microsoft) — Diagrama de demostración de investigación que genera rostros parlantes con expresiones variadas a partir de una imagen fija, un clip de audio y una señal de control opcional. Es el pin más académico entre los de carácter técnico.
  • [27] Vidu S1 — Visual llamativo de estilo ciberpunk de un modelo de ShengShu Technology, China, destinado a interacción con IA en tiempo real. Muestra la presencia de modelos chinos de generación de vídeo.
  • [29] AI NEWS (estilo periódico, 2025-06-30) — Uno de los pocos pines más próximos a información primaria que resume la apertura de Baidu Ernie 4.5, el uso de TPU de Google por OpenAI y la inversión de Meta de 14.300 millones de dólares en Scale AI, entre otros movimientos empresariales concretos.
  • [38] Top 10 Image-to-Video Generator Tools — Lista en formato ranking de Runway Gen-3, Kling, Google Veo, OpenAI Sora, Luma AI, Pika Labs, Kaiber AI, Synthesia, HeyGen, Adobe Firefly e InVideo AI. Ofrece una buena visión de conjunto de los principales actores.
  • [41] Amuse 3.0 (AMD) — Con un retrato realista de un pescador anciano, promociona la calidad de una herramienta local de arte con IA que funciona en GPU AMD. Es uno de los pocos ejemplos del lado de generación local/código abierto.
  • [50] This Week's Top AI Developments — Reúne tendencias recientes basadas en estadísticas: estudio de Google de 15 millones de chats (el 86 % de uso no es laboral), uso ilimitado de ChatGPT y un resultado de concurso en que IA venció a 458 de 526 equipos.
Señales
  • Lo que parece ser el presente: «Image and Video Generation AI» en Pinterest se ha convertido en la práctica en un mercado de SEO/afiliación de listas comparativas de herramientas e infografías de resúmenes de noticias. Los nombres Runway, Pika, Kling AI, Luma AI, Synthesia, HeyGen, InVideo AI, Adobe Firefly y Google Veo aparecen repetidamente en posiciones destacadas, señal de que se reconocen como el «conjunto estándar» de IA de vídeo de código cerrado.
  • Reutilización de la misma plantilla: dado que [16] y [24] son prácticamente la misma imagen, es muy probable que el contenido comparativo de herramientas de IA en Pinterest se produzca y republique masivamente desde un pequeño conjunto de plantillas por distintas cuentas.
  • Ausencia de código abierto: los únicos ejemplos directamente útiles para la tendencia de código abierto requerida por el brief son [29] (Baidu Ernie 4.5) y [41] (AMD Amuse 3.0); no aparecieron imágenes de comunidades de generación como Stable Diffusion, ComfyUI o Hugging Face. Los resultados de Pinterest se sesgan hacia piezas terminadas visualmente atractivas y materiales de marketing, por lo que parecen poco compatibles con publicaciones de comunidades técnicas de código abierto.
  • Predominan las imágenes de explicación, comparación y provocación sobre las obras reales: solo cerca de una décima parte de los 50 pines sitúan la generación real de imagen/vídeo con IA como protagonista; la mayoría son infografías y listas centradas en texto. En Pinterest parece difundirse más el contenido de apoyo a decisiones —«qué herramienta elegir»— que ejemplos concretos de «qué transformación produce esta herramienta».
Límites
  • En esta etapa solo se leyeron imágenes de Pinterest recopiladas previamente por un trabajador (images/pinterest/manifest.json, 50 elementos, una consulta única sin segmentación por género); no se navegó Pinterest directamente. Una nueva búsqueda con palabras clave adicionales como «open source AI art» o «Stable Diffusion» podría haber encontrado más pines orientados al código abierto.
  • Las fechas impresas dentro de las imágenes de pines (2025-06-30, 2026-05-20, 2026-08-15, etc.) indican únicamente cuándo se creó la plantilla; no se sabe desde manifest.json cuándo se publicó o guardó realmente el pin en Pinterest.
  • Parte del texto dentro de las imágenes de [12], [15], [21], [23] y [29] es algo borroso; se resumió su sentido y no se citó literalmente. Algunas erratas como «Human Journalism» y «Machine-Genertsd Media» pertenecen a las propias plantillas.
  • Cinco pines tienen título vacío (parte de [12], [15], [21], [29] y [35]) y se clasificaron por inferencia a partir del contenido de la imagen.

Acciones recomendadas

  • Seguir comparando GPT-6 Astra con Fable 5.1 desde el eje de «operación mediante agentes», además de la calidad.
  • Seguir vigilando el ecosistema ComfyUI de MiniMax-H3 (cuantización GGUF y Turbo LoRA) en la próxima edición.
  • En la próxima investigación de X, no depender de las tendencias de Explore y buscar explícitamente términos propios de código abierto como Stable Diffusion, Wan, Flux y Qwen.
  • Priorizar !«メールアドレス» en Lemmy como fuente primaria de código abierto.
  • No usar Pinterest como fuente de tendencias de código abierto; limitarlo a observar tendencias de marketing de herramientas cerradas.
  • Hacer seguimiento para comprobar si hay herramientas externas dependientes del cierre de la API de Sora (previsto para 2026-09-24).

Imágenes recopiladas

Image to Video AI: How It Works and Why It Matters - The Data ScientistContenido de IA y preocupaciones sobre redes sociales🎨 Creación de imágenes y vídeo con IAGoogle anuncia vídeo de calidad ultraalta...La plataforma definitiva de generación de imágenes y vídeo con IA - The Data ScientistConcepto de creación de contenido IA con iconos para generación de texto, imagen, música y vídeoCreación de contenido de vídeo con IA: altos ingresos,...Google presenta Veo 2: herramienta avanzada de generación de vídeo con IA, realismo y funciones cinematográficas mejoradasAcertar de pleno 🎥Image to Video AI – Anima tus fotos con IANoticias de IA: OpenAI por fin lanzó lo que pedimosimagenVeo 3 Image-to-Video: generación rápida y audio nativo mediante Gemini APIPrincipales generadores de vídeo con IA de 2025imagenIA para generación de imágenes y vídeoMás del 20 % de YouTube ya se genera con IA‎🚨 La IA está llegando a un nivel aterrador.Análisis de imágenes y vídeo impulsado por IAherramientas de IAimagenMicrosoft presenta VASA-1 y establece nuevos estándares para la generación de vídeo con IAVídeos generados con IA: ¿buenos o malos? ¡Esta es la verdad! 🤖🎥🚀10 mejores herramientas de imagen y vídeo con IA en 2026 | Comparativa de herramientas gratuitas y de pagoQué es Imagvio AI y cómo ayuda a los creadores...Google anuncia la IA de generación de vídeo «Veo 3»,...ShengShu Technology presenta Vidu S1 y lleva la generación interactiva en tiempo real a la IA de vídeo¡Transforma tus ideas en visuales impresionantes! 🎥imagen"Transforma tu visión con vídeos 4K personalizados impulsados por IA 🎥✨"Dominar el vídeo y la IA: tendencias clave de marketing en redes sociales 2025Noticias de IA de esta semana - 15 de agosto de 2026GPT 5.2, editor de vídeo en tiempo real, vídeos estéreo con IA, agentes móviles de IA, control corporal completo: NOTICIAS DE IAhistoria de la IA generativaimagenHaré un vídeo explicativo con Synthesia, Sora AI, Kling AI, Runway AI e InVideoIAGeneración de vídeo 📹Noticias y últimas novedades de IA | Tendencias y avances en inteligencia artificialimagen«Amuse 3.0», una herramienta de creación de arte con IA que incluye...Creación de vídeo con IA: guía completa para crear vídeos profesionales más rápido con IA"Por qué los chatbots de IA no logran seguir las noticias de última hora"Creación profesional de vídeo con IA | Vídeos cinematográficos con IA | Edición de vídeo personalizadaNuevas herramientas de IA de Nvidia 🤯 #news #ai #openai #chatgpt #highlights #shortsDeja de hacer scroll… ¡esta historia cambiará por completo cómo ves la IA!Cómo crear un canal de noticias con IA || Generador de vídeos de noticias IA || Sincronización labial con IAPrincipales herramientas de IA que usa todo YouTuber en 2026 | Mejor IA para creadores de YouTubeCrecimiento del mercado de generadores de vídeo con IA 2025–2032: transformando el futuro de la creación de vídeo 🎥🤖Principales desarrollos de IA de esta semana - Estudio de Google de 15 millones de chats

Nota sobre la calidad de los datos

Reddit no alcanzó el criterio de finalización de unas 20 entradas porque WebFetch no estaba disponible y solo se dispuso de 12 hilos recopilados previamente; en X la mayoría de palabras en tendencia de Explore eran irrelevantes y tampoco se realizaron búsquedas de código abierto; Bluesky devolvió 403 en la API de búsqueda de texto completo y se cambió a recopilación alternativa; Lemmy no encontró publicaciones primarias de código cerrado; y Pinterest solo usó una consulta general, sin búsquedas específicas de código abierto.

Galería