Noticias de IA de generación de imágenes y vídeo — 2026-09-22
El cierre de la API de Sora el 2026-09-24 es la historia decisiva del momento en el ámbito de código cerrado, mientras que MiniMax H3 y los laboratorios chinos de pesos abiertos (Alibaba/Qwen, ByteDance, Baidu y Tencent) impulsan el ecosistema de código abierto de mayor crecimiento, centrado en ComfyUI.
Noticias de IA de generación de imágenes y vídeo — 2026-09-22
La principal noticia del código cerrado es que la API de generación de vídeo Sora de OpenAI cerrará por completo el 2026-09-24 (dos días después de este informe). La aplicación ya había cerrado en abril, en un contexto de deterioro de la rentabilidad: costes operativos de aproximadamente un millón de dólares al día frente a unos ingresos acumulados de cerca de 2,1 millones de dólares. Por otra parte, GPT Image 2.5 y Nano Banana Pro/2 de Google DeepMind compiten en velocidad y fotorrealismo, y la carrera de desarrollo del bloque cerrado se ha intensificado con actualizaciones cada pocas semanas. En el lado de código abierto, el ecosistema de ComfyUI sigue creciendo en torno a MiniMax H3, y destacan los nuevos modelos de laboratorios chinos como Alibaba (Qwen), ByteDance, Baidu y Tencent. También se escuchan opiniones de que la diferencia de calidad percibida entre los modelos cerrados y abiertos se está reduciendo en varias plataformas.
Entre plataformas
- El cierre de la API de Sora (2026-09-24) es el gran tema común del código cerrado. Una publicación de Ed Zitron en Bluesky (3.572 me gusta, la mayor interacción de toda esta recopilación) dio la primicia; también se abordó en un vídeo de YouTube que resume el estado del vídeo con IA y en una publicación de !ai_reddit en Lemmy. Tres plataformas consideran de forma independiente este caso como el más importante, y lo presentan como un ejemplo de que el código cerrado no es necesariamente un mercado donde el ganador se lo lleva todo, debido al deterioro de la relación entre ingresos y costes.
- MiniMax H3 es la palabra clave compartida de la generación de vídeo de código abierto. En Reddit se explican métodos concretos para usar Wan y MiniMax H3 gratis; Adina Yakup en Bluesky presenta «HyperFlow», una versión de MiniMax H3 destilada en ocho pasos y de alta velocidad; y en Lemmy se publicaron más de cinco nodos relacionados con MiniMax H3 para ComfyUI entre agosto y septiembre de 2026. El mismo nombre de modelo aparece de forma independiente en tres plataformas, por lo que puede considerarse el modelo de vídeo de pesos abiertos con mayor impulso.
- GPT Image 2.5 se menciona en tres plataformas como representante de la generación de imágenes cerrada. En Reddit (r/ImagineAiArt, hilo de 92 puntos) hay tanto elogios como comentarios de que «no se nota diferencia» frente a KREA2; YouTube explica una reducción del 50 % de la latencia de generación y la función Sketch; y Simon Willison en Bluesky ha creado imágenes conceptuales con este modelo.
- Los laboratorios chinos destacan especialmente en el lado de código abierto. Bluesky (Adina Yakup), YouTube y Lemmy mencionan reiteradamente modelos de pesos abiertos con licencias de estilo Apache-2.0 de compañías chinas: Alibaba (Qwen-Image-2.1), ByteDance (Lance, Seedance), Baidu (ERNIE-Image) y Tencent (HunyuanVideo 1.5). Varias plataformas confirman que las empresas chinas son prácticamente las protagonistas de las tendencias de código abierto.
- ComfyUI es la infraestructura común de facto. Casi todos los vídeos de revisión de YouTube y la mayoría de las publicaciones de !«メールアドレス» en Lemmy mencionan implementaciones y flujos de trabajo en ComfyUI; el uso práctico de herramientas de código abierto parece estar concentrándose en ComfyUI.
- Se percibe una reducción de la brecha de calidad entre modelos cerrados y abiertos. En Reddit, un comentario indica que «GPT Image 2.5 y KREA2 dan el mismo resultado». En Pinterest, en cambio, el marketing de código cerrado domina de forma abrumadora y las menciones al código abierto son casi inexistentes; esto probablemente indica no que el código abierto sea débil, sino que tiene menor visibilidad ante el consumidor general.
Plataforma por plataforma
Reddit: Se recopilaron 12 hilos de siete subreddits. La demanda de generación de vídeo con IA gratuita se contrapone a un ambiente de «acepta que ya no es posible», y abundan de forma espontánea los comentarios que dirigen a modelos de pesos abiertos como Wan y MiniMax H3. También se informó como señal clara del aumento de usuarios de DeepSeek (+66,7 %) y la brecha de capacidad de cómputo. El mismo código de recomendación aparece promocionado en varios hilos, por lo que conviene tener cuidado con la mezcla de publicidad en debates orgánicos.
X: Entre las 32 publicaciones y 31 cuentas recopiladas, ninguna mencionaba IA de generación de imágenes o vídeo. Los términos usados (Bitcoin, Zelensky, Zagreb, etc.) reutilizaban tal cual las tendencias estándar de Explore de X —probablemente tendencias regionales en torno a Croacia—, lo que explica su falta de relación con el tema. No se obtuvo conocimiento sustancial sobre este asunto en X.
YouTube: Se encontraron más de 30 títulos a través de WebSearch y se seleccionaron 13 representativos. En el bloque cerrado, la comparación entre GPT Image 2.5, Nano Banana Pro/2, Sora 2, Veo 3.1 y Kling 3.0 es un formato habitual. En el bloque abierto continúa la tendencia de «reducir peso sin perder rendimiento», con Z-Image Turbo, Qwen-Image-2.1, LTX-2 y HunyuanVideo 1.5. Como las páginas se renderizan con JavaScript, no se pudieron obtener los recuentos de visualizaciones ni fechas exactas, así que se tratan como aproximaciones.
Bluesky: Como la API de búsqueda (searchPosts) devolvió 403 durante todo el proceso, se sustituyó por lectura directa de los feeds de cuentas relevantes. La publicación de Ed Zitron sobre el cierre de Sora obtuvo la mayor interacción. La información de última hora sobre código abierto depende casi por completo de Adina Yakup de Hugging Face; las cuentas oficiales de Civitai, ComfyUI y Stability AI estaban silenciosas o inactivas.
Lemmy: Se analizaron 16 publicaciones de ocho comunidades. Casi todas las noticias de código cerrado son referencias indirectas procedentes de espejos de Reddit (!ai_reddit) o Hacker News (!hackernews), con puntuaciones bajas. La única noticia viral fue el supuesto giro de Midjourney desde la generación de imágenes hacia escáneres médicos de tomografía por ultrasonidos (puntuación 40). En el lado abierto, se observaron publicaciones continuas de nodos de ComfyUI para MiniMax H3 entre agosto y septiembre.
Pinterest: Se analizaron 50 pines. Predominan las imágenes tipo listículo de «Best AI Video Generator» y recursos genéricos de robots de IA; Kling AI y Hailuo AI aparecen en la capa superior junto con Runway, Pika y Luma. Las referencias al código abierto son prácticamente cero en 50 elementos: solo aparece una vez el titular «Open Models. Open weights.». Esto revela que el código abierto es casi invisible en plataformas orientadas al consumidor.
De las seis plataformas indicadas en el encargo, X (cero resultados prácticos por una mala selección de términos de búsqueda) y Reddit (12 hilos frente a un objetivo de 20) no alcanzaron el criterio de finalización de «analizar aproximadamente 20 publicaciones». Se deja constancia de estas carencias; la ausencia de otras plataformas no especificadas en el encargo queda fuera del alcance.
Qué vigilar
- La competencia por captar migraciones tras el cierre de la API de Sora (2026-09-24) — Bluesky, publicación de Ed Zitron: https://bsky.app/profile/edzitron.com/post/3mhtesqgwxk2k
- El problema de la «licencia de investigación no comercial» de Qwen-Image-2.1 — debate sobre si realmente puede llamarse código abierto. YouTube: https://www.youtube.com/watch?v=tP_gGGJzEqg
- El ritmo de expansión del ecosistema MiniMax H3 × ComfyUI — Lemmy: https://lemmy.dbzer0.com/post/74279236
- Si LTX-2 se convertirá en el nuevo referente del vídeo de código abierto — YouTube: https://www.youtube.com/watch?v=27UAb_Tlv4E
- Las consecuencias del rápido aumento de demanda de DeepSeek (+66,7 %) y la escasez de cómputo — Reddit: https://www.reddit.com/r/DeepSeek/comments/1wmcgex/
- Novedades sobre el giro de Midjourney hacia dispositivos médicos — Lemmy: https://awful.systems/post/8731127
Recomendaciones
- Seguir en la próxima investigación a cuál de Seedance 2.5, MiniMax H3 y Kling v3 migra el tráfico tras el cierre de la API de Sora.
- Vigilar de forma continua los anuncios oficiales de Hugging Face y Alibaba para comprobar si cambia la política de licencia de Qwen-Image-2.1.
- Observar periódicamente la frecuencia de publicaciones de nodos ComfyUI relacionados con MiniMax H3 como indicador adelantado del impulso de la generación de vídeo de código abierto.
- En la próxima recopilación de X, dejar de depender de tendencias regionales y usar términos específicos del tema como "AI image generation", "Sora" y "Midjourney".
- Cambiar también la recopilación de Reddit de una sola búsqueda a varias búsquedas por nombre de modelo para alcanzar el criterio de finalización de 20 elementos.
- Verificar el supuesto giro de Midjourney hacia la tomografía por ultrasonidos médica mediante la fuente primaria (midjourney.com/medical) y distinguirlo de la información secundaria viral.
Calidad de los datos
X recopiló 32 publicaciones, pero ninguna relacionada con el tema debido a una mala selección de términos. Reddit se limitó a 12 hilos con una sola búsqueda y no alcanzó el objetivo de unas 20 publicaciones. Como la API oficial de búsqueda de Bluesky devolvía 403, se pasó a un muestreo mediante lectura directa de cuentas, no una búsqueda exhaustiva por palabras clave. En YouTube, el renderizado con JavaScript impidió obtener los recuentos de visualizaciones y las fechas exactas de publicación, por lo que las fechas son aproximadas. Lemmy no permite búsquedas entre todas sus instancias distribuidas, así que la comprobación se limita a seis instancias principales. Pinterest permitió analizar 50 elementos, pero, al no haber casi menciones al código abierto, los datos están sesgados hacia una sola perspectiva: la cerrada.
Resumen por plataforma
Reddit — Noticias de IA de generación de imágenes y vídeo
Dónde
Los 12 hilos recopilados proceden de siete subreddits.
| Subreddit | Miembros | Hilos recopilados |
|---|---|---|
| r/generativeAI | 155,851 | 5 |
| r/ImagineAiArt | 19,415 | 1 |
| r/aivideomaking | 7,414 | 2 |
| r/DeepSeek | 140,403 | 1 |
| r/Purdue | 100,714 | 1 |
| r/aivideos | 123,539 | 1 |
| r/Instagramreality | 1,155,229 | 1 |
r/generativeAI concentra el mayor número, y el tema central es la demanda misma de «crear vídeo con IA gratis». Los subreddits especializados (r/aivideomaking, r/aivideos, r/ImagineAiArt) debaten herramientas y técnicas concretas; r/DeepSeek trata noticias de un único modelo; y r/Purdue y r/Instagramreality (una enorme comunidad con más de 1,15 millones de miembros) muestran casos en los que contenido generado por IA se coló en situaciones reales y provocó polémica.
Lo que dice la gente
- La demanda de generación gratuita de vídeo con IA sigue siendo fuerte, pero el ambiente comunitario se inclina hacia «acepta que ya no es posible». En el hilo #2 «Why do so many people expect to find a free AI video generator?» (39 puntos, 79 comentarios, 2026-09-21, https://www.reddit.com/r/generativeAI/comments/1wm2csy/), el propio autor señala que «Sora 2 se lanzó gratis y ganó una gran cantidad de usuarios, pero al final OpenAI lo canceló», y concluye: "AI video generation is just expensive, and free is not a sustainable model".
- En comentarios del mismo hilo, u/buttchuckjones (4 puntos) dice que pasó de 10 GB de VRAM a una 5080 de 16 GB para generar localmente y anima al enfoque local/de código abierto: "I very much wish that people on this subreddit would be more inclined to do local generation".
- En el hilo #1 «Which AI video generator can still be used for free?» (20 puntos, 68 comentarios, 2026-09-16, https://www.reddit.com/r/generativeAI/comments/1whtesl/), u/RioMetal (4 puntos) recomienda modelos de pesos abiertos como Wan o Minimax: "If you can go local you have plenty of them, like Wan or Minimax". u/tuckken2 (3 puntos) comparte una forma concreta de uso: "Wan 2.2 and Minimax H3 are free on cnaps studio, credit resets every 5 hours".
- En el lado cerrado, GPT Image 2.5 Flare es el centro de atención. En el hilo #3 «GPT Image 2.5 Flare — is this actually the best AI image generating model right now?» (92 puntos, 62 comentarios, 2026-09-16, https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/), u/oldboi777 (4 puntos) lo elogia: "its really good, its an incredible upgrade I think". En cambio, u/Dependent_Quit_3730 (3 puntos) dice: "É um modelo perfeito... mas eu ainda fico com o KREA 2". u/SeaworthinessFresh16 (2 puntos) considera que "The result in Comfyui with Krea2 looks the same", es decir, que no percibe diferencia con la herramienta abierta.
- DeepSeek, de pesos abiertos, combina rápido crecimiento y escasez de oferta. En el hilo #6 «some deepseek news, if you care» (206 puntos, 36 comentarios, 2026-09-21, https://www.reddit.com/r/DeepSeek/comments/1wmcgex/), se informa que los usuarios activos diarios pasaron de 120 a 200 millones (+66,7 %), mientras que la capacidad de cómputo solo aumentó un 8,3 %, lo que estaría provocando caída de calidad y problemas de regeneración. Como respuesta, se menciona un pedido de 160.000 Ascend 960DT a Huawei. u/Equivalent-Grass-527 (6 puntos) comenta que "The demand vs. compute mismatch is probably the most important part here".
- La valoración de las técnicas para ocultar el «aspecto de IA» está dividida. El hilo #8 «I stopped prompting for clean shots and my AI video finally stopped looking like AI» (63 puntos, 56 comentarios, 2026-09-20, https://www.reddit.com/r/aivideos/comments/1wl6op9/、Seedance 2.5使用) compartió técnicas detalladas de prompting, pero los comentarios fueron escépticos. u/TCristatus (9 puntos) dijo: "What a load of waffle, and the video is still obviously AI"; u/Biscuits4u2 (6 puntos) señaló: "You need 5 percent uglier people to make it look realistic. Faces are too perfect."
- Los casos en que imágenes generadas por IA se infiltran en espacios reales están provocando controversia. En el hilo #7 «AI generated image on MSEE wall» (61 puntos, 13 comentarios, 2026-09-21, r/Purdue, https://www.reddit.com/r/Purdue/comments/1wmq43f/), se criticó la disposición absurda de la placa de circuito de una imagen generada por IA expuesta en el campus universitario. u/j909m (11 puntos) comentó: "Whoever did the PCBA layout for that IC gets an F."
- Incluso en un gran subreddit de más de 1,15 millones de miembros, se intensifica la detección de imágenes generadas por IA. El hilo #12 «AI generated images on Reddit with thousands of upvotes and comments» (2.109 puntos, 341 comentarios, 2026-09-18, r/Instagramreality, https://www.reddit.com/r/Instagramreality/comments/1wk0euk/) obtuvo, con diferencia, la mayor interacción de esta recopilación. u/Smart-Membership-117 (405 puntos) detecta inconsistencias en detalles: "The trim on the baseboard by her knee in pictures 2 and 3 is different and the greenery outside the window completely changes as well." u/Negative-Raise-8286 (275 puntos) se queja de que no pudo publicar la observación en el hilo original.
- También hay varias voces que consideran muy generosos los créditos gratuitos, no solo pesimismo. En el hilo #9 (r/aivideomaking, 3 puntos, 26 comentarios, 2026-09-15, https://www.reddit.com/r/aivideomaking/comments/1wh80z3/), u/Chance-Business (2 puntos) valora la cuota gratuita de Google Flow (Veo): "google flow you get 50 free credits per day, each vid is 6-12 credits. I have most days not hit 50." En el hilo #4 (https://www.reddit.com/r/aivideomaking/comments/1wled0f/), u/MrBoondoggles (1 punto) observa de forma similar: "You can use Nanobanana and Veo in Google flow. They have very generous daily free credit allowance."
- La promoción del mismo código de recomendación aparece en varios hilos. u/MeatStickMcFapperton publicó comentarios casi idénticos en los hilos #2 (4 puntos) y #5 (1 punto), promocionando «mil millones de tokens gratis» con el código de recomendación "42JB8K" para Meta «Muse».
Señales
- Tendencia al alza: Las menciones a generación local/de pesos abiertos de vídeo (Wan, MiniMax H3, FramePack y ComfyUI) surgen espontáneamente en la mayoría de los hilos de «quiero algo gratis». El rápido aumento de usuarios de DeepSeek (+66,7 %) también es una señal ascendente clara.
- Escepticismo y rechazo: Hay una reacción fuerte contra la propia exigencia de «vídeo con IA gratis». u/activematrix99 (2 puntos) en el hilo #4 comenta con dureza: "Imagine showing up at a restaurant and demanding to eat for free... what makes YOU so important that they should just give it to you for free?" El hecho de que varios comentarios aleccionadores sobre la pretensión de obtener generación de vídeo gratis reciban muchos votos indica un cambio de ambiente comunitario.
- Lo inesperado: El mismo código de recomendación ("42JB8K") y un discurso de venta muy similar aparecen varias veces en hilos diferentes, por lo que es muy probable que haya publicidad o comentarios autopromocionales mezclados con conversaciones orgánicas. Hay que interpretar las cifras con cautela.
- Conflicto: Quienes creen que «la generación de vídeo gratuita ya es una fantasía» (varios comentarios valorados positivamente en los hilos #2, #9 y #10) se enfrentan directamente con quienes consideran que las cuotas gratuitas de Google Flow/Veo/Muse/Nanobanana son realmente generosas (hilos #4, #5 y #9). Ambas posturas se basan en experiencia práctica, así que no puede decirse sencillamente que una sea correcta.
- También hay quien percibe poca diferencia entre cerrado y abierto: En el hilo #3, GPT Image 2.5 Flare, cerrado, y KREA 2 usando herramientas abiertas reciben la valoración de que «el resultado parece igual», lo que sugiere que, en generación de imágenes, la distancia de calidad entre ambos bloques se ha reducido casi por completo desde la perspectiva del usuario.
Límites
- La herramienta de recopilación solo utilizó la búsqueda "Image and Video Generation AI News". Frente al criterio de finalización del encargo —analizar unas 20 publicaciones por red social—, solo se obtuvieron 12 hilos de siete subreddits. Búsquedas adicionales por términos concretos como "Sora", "Veo", "Kling", "Stable Diffusion", "Flux", "open source" / "closed source" probablemente habrían encontrado más hilos y más ajustados al tema.
- El hilo #9 no incluye el cuerpo de la publicación en los datos recopilados; el contenido se infiere únicamente de los comentarios.
- Por las instrucciones del playbook de esta fase, Reddit no se navegó ni buscó directamente; la verificación se limita al contenido ya recopilado de
output/reddit.threads.md/.json. Los debates no incluidos aquí, por ejemplo hilos específicos de determinados modelos de imagen o vídeo, quedan fuera del informe.
X
X — Noticias de IA de generación de imágenes y vídeo
Cuentas
Se revisaron las 32 publicaciones y 31 cuentas recogidas en output/x.posts.md, pero ninguna cuenta trataba IA de generación de imágenes o vídeo. El desglose se inclina hacia áreas sin relación con el tema:
| Categoría | Cuentas correspondientes |
|---|---|
| Criptomonedas/bolsa ($SDOG, $AMD, Bitcoin) | @SDOGWITHSNAP, @DeItaone, @AJM_web, @S500ALERTS, @blackwidowbtc, @0xSweep, @USronaldcarter, @TedPillows |
| Situación Ucrania-Rusia | @dystoman, @sentdefender, @Polymarket, @Alex_Oloyede2, @bayraktar_1love, @AlaskanTzar, @SomaliSasuke, @gmanredux, @idkmypronouns, @Katauroraaa, @AbotGrenfield, @jaccocharite |
| Chismes de entretenimiento y política (relacionados con Lauren) | @Rach_delauren, @fvslaurs, @LimeriTweets, @karignejauregui |
| Deportes y lucha (relacionados con Muhammad) | @CylinderAnalyst, @bullyb170(2 publicaciones) |
| Religión | @TaymiFawaid |
| Cuentas personales relacionadas con la tendencia geográfica Zagreb | @slimey34, @AlphaGainer, @enafriedric2372, @Earldormancy |
Hay cuentas que concentran la interacción en una publicación enorme —por ejemplo, @AlaskanTzar recibió 34.704 me gusta en una sola— y otras que acumulan publicaciones menores; en cualquier caso, ninguna difundía noticias ni herramientas de generación de imágenes o vídeo con IA.
Publicaciones
Como no hay publicaciones relacionadas con el tema en los datos recopilados, no se pueden informar las habituales «5 a 12 observaciones» sobre IA de generación de imágenes y vídeo. Como referencia, estos son algunos elementos recopilados:
- #8 @TedPillows (2.829 me gusta, 293 republicaciones, unas 486.000 visualizaciones, 2026-09-20, https://x.com/TedPillows/status/2101642897535762562)— "If Bitcoin breaks $83,000, the cycle bottom will be confirmed..." Es análisis del mercado de Bitcoin, sin relación con la IA.
- #30 @AlaskanTzar (34.704 me gusta, 1.083 republicaciones, aproximadamente 1.500.000 visualizaciones, 2026-09-20, https://x.com/AlaskanTzar/status/2101819330703032636)— "Back in 2017 Russia and Ukraine were ratioing each other on twitter". Es la mayor interacción de toda la recopilación, pero se trata de un meme sobre Ucrania y Rusia.
- #22 @Katauroraaa (2.840 me gusta, unas 309.000 visualizaciones, 2026-09-20, https://x.com/Katauroraaa/status/2101716186132087180)— una publicación humorística que se burla de Rusia y los países bálticos.
Ninguna de ellas menciona generación de imágenes o vídeo con IA, ni de código cerrado ni abierto.
Señales
- La única «señal» que puede extraerse es que los términos de búsqueda de esta fase no estaban relacionados con el tema. Al usar sin cambios las tendencias de Explore de X (véanse los Límites), la conversación se limitó a criptomonedas, geopolítica, chismes de entretenimiento y deportes.
- No se observó ni un solo debate sustancial sobre si la IA de generación de imágenes o vídeo está creciendo, genera escepticismo u otra dinámica relevante.
Límites
-
Los términos de búsqueda no guardaban relación con el tema: Como indica el inicio de
output/x.posts.md, los términos usados fueron"$SDOG", "Bitcoin", "Zelensky", "Lauren", "Muhammad", "Russians", "Zagreb", "Ukraine", "Weeknd", "USSR". Se reutilizó directamente la «Explore list» propia de X (tabla siguiente), sin usar ninguno de los términos pertinentes: «generación de imágenes con IA», «generación de vídeo con IA», «Sora», «Midjourney» o «Stable Diffusion».# Tendencia Ubicación (según X) 1 $SDOG Tendencia en Croacia 2 Bitcoin Negocios y finanzas · Tendencia 3 Zelensky Política · Tendencia 4 Lauren Tendencia en Croacia 5 Muhammad Política · Tendencia 6 Russians Política · Tendencia 7 Zagreb Tendencia en Croacia 8 Ukraine Política · Tendencia 9 Weeknd Tendencia en Croacia 10 USSR Política · Tendencia Esta lista de Explore parece estar vinculada geográficamente a la ubicación del servidor que accedió en esta sesión —probablemente la zona de Croacia— y no a tendencias globales.
-
No se alcanzó el criterio de finalización:
brief.mdexige «analizar y resumir unas 20 publicaciones de cada red social», pero, de las 32 recopiladas, cero se relacionaban con generación de imágenes o vídeo mediante IA. Por tanto, este informe no proporciona conocimiento sustancial de X sobre el tema. -
La sesión era válida —se pudo recopilar con inicio de sesión y no apareció un mensaje como "no posts were collected"—; no hubo un fallo de las funciones de búsqueda o navegación de X. El problema fue la selección de términos durante la recopilación.
-
La próxima vez será necesario volver a recopilar usando términos pertinentes como "AI image generation", "AI video generation", "Sora 2", "Midjourney", "Stable Diffusion", "Nano Banana" y "Veo".
YouTube
YouTube — Noticias de IA de generación de imágenes y vídeo (código cerrado/código abierto)
Canales
- Matt Wolfe (@mreflow) — canal de noticias de IA con más de 925.000 suscriptores. Publica continuamente revisiones rápidas de modelos cerrados como Nano Banana Pro y Nano Banana 2. (https://www.youtube.com/@mreflow)
- Theoretically Media — canal especializado en reseñas y pruebas prácticas de herramientas de vídeo con IA de código abierto, como LTX-2 / LTX-2.3 y la familia HunyuanVideo. (https://theoreticallymedia.com/videos/)
- Aitrepreneur — destaca por sus explicaciones de flujos de trabajo de ComfyUI y trata la instalación local de modelos recientes de vídeo de código abierto, como LTX-2.3. (Con integración de Patreon: https://www.patreon.com/aitrepreneur)
- Otros canales medianos de reseñas de herramientas de IA que cubren Z-Image Turbo, Flux.2 y HunyuanVideo 1.5, entre otros; solo se pudieron confirmar los títulos de los vídeos, no los nombres de canal ni sus suscriptores —véanse los Límites.
Vídeos
-
Google won image generation (it's not even close) — NANO BANANA PRO BREAKDOWN
fecha: 2025-11-26 | visualizaciones: sin confirmar | https://www.youtube.com/watch?v=UV9GqinedQ8
Revisión representativa del código cerrado que sostiene que Nano Banana Pro (Gemini 3 Pro Image) de Google DeepMind supera a los generadores de imágenes existentes a un nivel «sin competencia», destacando la precisión del texto y el fotorrealismo. -
Google's Nano Banana Pro is raising concerns over realistic AI image generation
fecha: finales de noviembre de 2025 | visualizaciones: sin confirmar | https://www.youtube.com/watch?v=RmmrVCUGYp8
Vídeo informativo sobre las preocupaciones por los riesgos de deepfakes y desinformación ante un fotorrealismo excesivo. -
GPT Image 2.5 Is AMAZING: Full Breakdown of OpenAI's New Image Model
fecha: alrededor de 2026-09-08 (publicado hace dos semanas) | visualizaciones: sin confirmar | https://www.youtube.com/watch?v=DY6TkI8XtkQ
Explicación completa de GPT Image 2.5 de OpenAI: reducción del 50 % en la latencia de generación y función Sketch para convertir dibujos a mano en imágenes de IA. Es la actualización más reciente del bloque cerrado. -
Sketch with ChatGPT Images 2.5
fecha: principios de septiembre de 2026 | visualizaciones: sin confirmar | https://www.youtube.com/watch?v=imPtIEAEHSU
Demostración de la nueva función de ChatGPT que permite escribir «@Sketch» y convertir directamente un dibujo en una imagen de IA. -
State of AI Video in 2026: Sora 2, Veo 3.1, Kling 3.0 & Cinematic Prompting Workflows
fecha: 2026-03-20 | visualizaciones: sin confirmar | https://www.youtube.com/watch?v=vtJzDgmWVWc
Vídeo de síntesis que compara el trío de generación de vídeo cerrada formado por Sora 2, Veo 3.1 y Kling 3.0, e incluye técnicas de prompting cinematográfico. -
Seedance 2.5 REVIEW: ByteDance's New AI Video Model Explained
fecha: 2026-08-01 | visualizaciones: sin confirmar | https://www.youtube.com/watch?v=LTAOvsH6cjM
Seedance 2.5 de ByteDance admite tomas continuas de 30 segundos y hasta 50 imágenes de referencia, y ha llamado la atención por superar la duración de Sora 2 y Veo 3.1. Es de código cerrado. -
Kling 2.6 Pro DESTROYS Competition - Veo 3.1 & Sora 2 Pro
fecha: 2025-12-19 | visualizaciones: sin confirmar | https://www.youtube.com/watch?v=-vRsjX9seUU
Vídeo de benchmark que sostiene que Kling 2.6 Pro ya superaba a Veo 3.1 y Sora 2 Pro antes de la llegada de Kling 3.0. El impulso continuó con Kling 3.0, lanzado el 2026-02-05 y líder con una puntuación ELO de 1.243. -
Z Image Turbo (FREE): This Open-Source AI Changed Image Generation Forever! (Like nano banana pro)
fecha: 2025-11-27 | visualizaciones: sin confirmar | https://www.youtube.com/watch?v=sPQQPpQ9X4E
Modelo de 6B parámetros con licencia Apache-2.0 de Tongyi-MAI, el equipo de Alibaba. Permite inferencia rápida en ocho pasos con GPU de consumo de 16 GB y se describe como comparable a Nano Banana Pro. -
New Open-Source Model DESTROYS Flux 2 — Z-Image + Promptus Tutorial
fecha: 2025-12-11 | visualizaciones: sin confirmar | https://www.youtube.com/watch?v=JF4Q5hXh-_Q
Tutorial comparativo que afirma que Z-Image supera a Flux.2. -
FLUX.2 EL MEJOR MODELO OPEN SOURCE, EN LOCAL Y GGUF
fecha: alrededor de noviembre-diciembre de 2025 | visualizaciones: sin confirmar | https://www.youtube.com/watch?v=t4eVxZPP0b0
Guía para ejecutar localmente en ComfyUI FLUX.2 de Black Forest Labs, una serie que incluye Pro/Flex/Dev y Klein con Apache-2.0. Sus puntos fuertes son la salida de hasta 4 MP y la consistencia con hasta 10 imágenes de referencia. -
The "Holy Grail" of Open Source AI Video is Here (LTX-2)
fecha: principios de enero de 2026 | visualizaciones: sin confirmar | https://www.youtube.com/watch?v=27UAb_Tlv4E
LTX-2, lanzado por Lightricks el 2026-01-06, es elogiado como el primer modelo de vídeo de código abierto «con calidad de producción» al combinar 4K nativo, sincronización de audio, pesos completamente abiertos y código de entrenamiento público. -
Tencent HunyuanVideo 1.5 has been officially open-sourced!
fecha: primera mitad de 2026 | visualizaciones: sin confirmar | https://www.youtube.com/watch?v=MJShdc8tkkA
Tencent publicó HunyuanVideo 1.5, que reduce los parámetros de 13B a 8,3B manteniendo el rendimiento. Se valora que funcione en GPU de consumo. -
Qwen-Image 2.1 | Early Access Showcase
fecha: alrededor de 2026-09-20 (publicado hace dos días) | visualizaciones: sin confirmar | https://www.youtube.com/watch?v=tP_gGGJzEqg
Demostración de acceso anticipado de Qwen-Image-2.1, publicado por Alibaba Qwen el 2026-09-20: comprime el generador visual a 7B, unifica generación y edición y admite salida RGBA transparente. Sin embargo, su licencia es solo para investigación no comercial.
Señales
- El código cerrado intensifica la competencia en «velocidad y fotorrealismo»: GPT Image 2.5 (2026-09-08, 50 % menos de latencia), Nano Banana Pro y Nano Banana 2 (2026, el doble de velocidad); OpenAI y Google compiten con actualizaciones cada pocas semanas. En vídeo, las comparativas del trío Sora 2/Veo 3.1/Kling 3.0 son un formato habitual.
- Sora cerrará incluida su API: La web/aplicación de Sora ya cerró el 2026-04-26 y la API tiene previsto cerrar por completo el 2026-09-24, dos días después de redactar este informe. Se atribuye a costes operativos de aproximadamente un millón de dólares diarios frente a ingresos acumulados de cerca de 2,1 millones, y se presenta como ejemplo de que el vídeo de código cerrado no es un mercado donde el ganador se lo lleva todo.
- El bloque abierto se desplaza hacia modelos ligeros y rápidos: Z-Image Turbo (6B, Apache-2.0), Qwen-Image-2.1 (generador visual comprimido a 7B) y HunyuanVideo 1.5 (13B→8,3B) siguen todos la dirección de reducir parámetros sin pérdida de rendimiento para funcionar en GPU de consumo.
- La frontera entre pesos abiertos y licencia comercial es objeto de debate: Mientras que una parte de Flux.2 (Klein) es completamente abierta bajo Apache 2.0, Qwen-Image-2.1 publica sus pesos pero especifica una «licencia solo para investigación no comercial». Tanto comentarios como vídeos de reseña discuten si puede llamarse realmente código abierto.
- LTX-2 se perfila como referente del vídeo de código abierto: La combinación de «4K nativo, audio sincronizado y código de entrenamiento público» es inédita, y varios canales comparan la generación local de vídeo entre LTX-2, Wan 2.2 y HunyuanVideo 1.5.
- ComfyUI es la base común de facto: Flux.2, Z-Image, LTX-2, Wan y HunyuanVideo disponen de compatibilidad desde el primer día y numerosos vídeos de flujos de trabajo en ComfyUI; casi todas las revisiones de código abierto incluyen pruebas prácticas en ComfyUI.
Límites
- Las páginas de resultados de YouTube (
/results?search_query=...) y de vídeo (/watch?v=...) se renderizan con JavaScript, por lo que WebFetch solo pudo obtener enlaces de navegación del pie. No fue posible obtener directamente desde las páginas los recuentos exactos de visualizaciones, nombres de canal, fechas de publicación ni subtítulos/comentarios. Las fechas del informe son aproximaciones inferidas de fragmentos de resultados y artículos relacionados, y las visualizaciones figuran como «sin confirmar». - Por esta limitación no se pudo ejecutar el procedimiento ideal del playbook de abrir y analizar individualmente unas 20 publicaciones. En su lugar, se reunieron títulos, pistas de canales y periodos de publicación mediante WebSearch. Se encontraron más de 30 títulos en total y se seleccionaron los 13 anteriores como ejemplos representativos.
- Los vídeos relacionados con Qwen-Image-2.1 solo llevaban dos días publicados y aún eran pocos. Es probable que aumenten en las próximas semanas.
Bluesky
Bluesky — Noticias de IA de generación de imágenes y vídeo
Cuentas
- Ed Zitron (
edzitron.com) — crítico de la industria tecnológica y de IA (Where's Your Ed At); difundió en Bluesky la noticia del cierre de Sora con un gran pico de interacción. - Simon Willison (
simonwillison.net) — investigador independiente de IA; compara regularmente modelos nuevos, incluidos generadores de imágenes, con sus pruebas de «pelican», y comparte el arte conceptual generado durante el proceso. - Adina Yakup (
adinayakup.bsky.social) — defensora del ML de código abierto en Hugging Face; con diferencia, la cronista más activa en Bluesky de lanzamientos de modelos de imágenes y vídeo de pesos abiertos, con publicaciones casi semanales. - useapi.net (
useapi.bsky.social) — revendedor de API REST para generación de vídeo, imágenes y música con IA (Veo, Kling, Seedance, Runway, MiniMax, etc.); publica comparativas frecuentes entre modelos. - GPT Image Prompt (
gptimageprompt.bsky.social) — cuenta de intercambio de prompts centrada en ChatGPT/GPT Image de OpenAI. - Stable Diffusion online AI (
stablediffusion.bsky.social) — cuenta comunitaria veterana dedicada a compartir prompts de Stable Diffusion y retos de arte con IA. - Stability AI (oficial) — permanece silenciosa sobre imagen/vídeo desde aproximadamente noviembre de 2025; sus publicaciones recientes se concentran casi por completo en Stable Audio y alianzas con sellos musicales (Warner, Universal), no en modelos de imagen Stable Diffusion.
Publicaciones
-
Ed Zitron — OpenAI cierra Sora (2026-03-24, 👍 3.572 · 🔁 984)
"Both the Wall Street Journal and The Information confirming that OpenAI is killing Sora - both the app and access to its video-generating model for developers. This is a huge move that suggests things are a bit desperate."
https://bsky.app/profile/edzitron.com/post/3mhtesqgwxk2k
(Esto coincide con informaciones según las cuales la aplicación Sora cerró el 26 de abril de 2026 y la API tiene previsto finalizar el 24 de septiembre de 2026, dos días después de esta investigación.) -
Simon Willison — crear con ChatGPT Images 2.5 (2026-09-10, 👍 56 · 🔁 5)
"Here's a Blender model of a Pluribus themed Fabergé egg I had GPT-6 Astra build - I generated the concept image using ChatGPT Images 2.5"
https://bsky.app/profile/simonwillison.net/post/3mv4su6pfzk24 -
Adina Yakup — HyperFlow (destilación abierta de vídeo) (2026-09-19, 👍 6 · 🔁 1)
"HyperFlow⚡ New MiniMax-H3 variant from Video Rebirth — Open weight 8 step LoRA — 3× faster with data free self distillation — Video + stereo audio intact"
https://bsky.app/profile/adinayakup.bsky.social/post/3mvunely5222b -
Adina Yakup — Lance de ByteDance (2026-05-19, 👍 48 · 🔁 5)
"ByteDance dropped Lance👀 — This 3B model can generate images + edit images + generate videos + edit videos, and understand both images/videos."
https://bsky.app/profile/adinayakup.bsky.social/post/3mm6xqsryf22b -
Adina Yakup — ERNIE-Image de Baidu (2026-04-14, 👍 1)
"Baidu just released ERNIE-Image on Hugging Face🔥 — 8B DiT - Image/Image Turbo — Apache 2.0"
https://bsky.app/profile/adinayakup.bsky.social/post/3mjhrc3y7u22i -
Adina Yakup — Matrix-Game 3.0 de Skywork (2026-03-27, 👍 13 · 🔁 2)
"Matrix-Game 3.0🔥 real-time interactive world models from Skywork — ✨ 720p @ 40FPS with a 5B model"
https://bsky.app/profile/adinayakup.bsky.social/post/3mi2efsyp7k2x -
Adina Yakup — LongCat-Video-Avatar 1.5 (2026-05-22, 👍 16 · 🔁 3)
"LongCat-Video-Avatar 1.5🐱 an audio driven avatar video generation [model]"
https://bsky.app/profile/adinayakup.bsky.social/post/3mmglm72zn22i -
Adina Yakup — HiDream-O1-Image (2026-05-19, 👍 10 · 🔁 2)
"HiDream-O1-Image is getting a lot of attention🔥"
https://bsky.app/profile/adinayakup.bsky.social/post/3mm73u27jek26 -
useapi.net — alternativas de API para Sora 2 (2026-09-21, 👍 0)
"Sora 2 API Alternatives Compared, With Code: Seedance 2.5, Omni Flash, MiniMax H3, Kling v3 #sora2 #seedance #kling #aivideo"
https://bsky.app/profile/useapi.bsky.social/post/3mvyugq6wgz27 -
useapi.net — MiniMax H3 frente a Seedance 2.0 (2026-07-31, 👍 0)
"MiniMax H3 head to head with Seedance 2.0 on identical omni references #minimax #seedance #ai #api"
https://bsky.app/profile/useapi.bsky.social/post/3mrw5xyd4zk2x -
GPT Image Prompt — prompt de meme compartido (2026-05-07, 👍 0)
"Theme: Text to Meme — Prompt put on comment — Welcome to our website:gptimageprompt.io #Chatgpt2 #GPTImagePropmt #AIPrompts"
https://bsky.app/profile/gptimageprompt.bsky.social/post/3mlaa6swzc226
Señales
- El cierre de Sora es la historia de código cerrado de la que realmente habla Bluesky. La publicación de Ed Zitron es, con unos 3.500 me gusta, el elemento de mayor interacción encontrado en toda la búsqueda, muy por encima de cualquier lanzamiento de modelo. El público de IA de Bluesky se inclina aquí por las narrativas y críticas de industria, no por el marketing de los laboratorios.
- Las noticias de código abierto en Bluesky son prácticamente la especialidad de una sola persona. Casi todos los lanzamientos concretos de pesos abiertos localizados —ERNIE-Image de Baidu, Lance de ByteDance, Matrix-Game 3.0 de Skywork, LongCat-Video-Avatar, HyperFlow y HiDream-O1-Image— proceden de una sola cuenta: Adina Yakup de Hugging Face. El patrón está fuertemente impulsado por laboratorios chinos (Baidu, ByteDance, Alibaba/Qwen, Ant Group, Skywork, Tencent) que publican con licencias de estilo Apache-2.0.
- Ningún gran laboratorio cerrado mantiene una presencia activa en Bluesky para lanzamientos de imagen o vídeo. No apareció ninguna cuenta oficial de OpenAI, Google DeepMind, Adobe o Midjourney; la cobertura de modelos cerrados llega de forma indirecta mediante probadores independientes como Simon Willison o revendedores de API como useapi.net.
- Las publicaciones técnicas centradas en herramientas apenas generan interacción —de 0 a 13 me gusta para las comparativas de useapi.net y la mayoría de los lanzamientos de Adina Yakup— frente a las narrativas generales sobre el destino de una empresa —miles de me gusta para la historia de Sora—. La interacción de esta plataforma sigue la narrativa industrial, no la novedad técnica.
- Varios centros evidentes de arte con IA están muertos o inactivos en Bluesky: las cuentas oficial y bot de Civitai, la cuenta de ComfyUI y la propia Stability AI, que pasó a contenido de Stable Audio y acuerdos con sellos musicales y no publica sobre modelos de imagen Stable Diffusion desde mediados de 2025.
Límites
- La API pública de búsqueda por palabras clave está bloqueada.
app.bsky.feed.searchPostsdevolvióHTTP 403 Forbiddenen todos los intentos —consultas de varias palabras, una palabra y formulaciones distintas— mediante WebFetch; la interfaz webbsky.app/searchtambién se renderiza enteramente con JavaScript y no devolvió contenido de publicaciones. Por ello no fue posible hacer una búsqueda real de «qué se publica ahora». Todo lo anterior se reunió mediante (a) localizar cuentas relevantes con búsqueda website:bsky.appy (b) leer directamente sus historialesgetAuthorFeeda través de la API pública de AT Protocol, que sí funcionó. - Varias cuentas prometedoras resultaron estar vacías o inactivas:
civitai.bsky.social(feed vacío),civitai-bot.bsky.social(última publicación en mayo de 2024),real-comfyui.bsky.social(feed vacío),runwayml.bsky.social(remite a una cuenta personal no relacionada, una publicación de 2024),midjourney-api.bsky.social(revendedor no oficial, una publicación de noviembre de 2024) yqwen1.bsky.social(cuenta de fans, una publicación de febrero de 2025). - Qwen-Image-2.1 de Alibaba —modelo unificado de generación y edición de imágenes de pesos abiertos de 7B, supuestamente publicado el 2026-09-20 según cobertura externa— aún no apareció en ninguna publicación de Bluesky encontrada. Puede que las cuentas seguidas todavía no lo hayan recogido o que quede fuera de lo que habría mostrado la API de búsqueda bloqueada.
- Ethan Mollick (
emollick.bsky.social) y Tanishq Abraham (iscienceluvr.bsky.social), fuentes plausibles, se comprobaron y descartaron porque se centran respectivamente en noticias generales de LLM/texto y artículos académicos más antiguos, no en noticias actuales de generación de imágenes o vídeo. - Dado el bloqueo de búsqueda, el objetivo de una muestra de unas 20 publicaciones se alcanzó en conjunto leyendo historiales completos de autores —unas 30 publicaciones de Adina Yakup, unas 15 de useapi.net, unas 20 de Stable Diffusion, además de feeds recientes de Simon Willison y Ed Zitron— y no mediante una única búsqueda ordenada. Es una muestra dirigida por cuentas, no un barrido exhaustivo por palabras clave.
Lemmy
Lemmy — Tendencias recientes de IA de generación de imágenes y vídeo
Comunidades
- !«メールアドレス» (5.713 personas) — comunidad principal para discusión de técnicas de generación de imágenes y vídeo con IA de código abierto. Las novedades de herramientas de GitHub/HuggingFace aparecen casi a diario.
- !«メールアドレス» (2.361 personas) — espacio para publicar obras creadas con Stable Diffusion y otros modelos de pesos abiertos.
- !«メールアドレス» (1.599 personas) — dedicado al arte de IA estilo anime, solo SFW.
- !«メールアドレス» (52 personas, 157 activas al mes) — comunidad que refleja directamente hilos de IA de Reddit. Muchas noticias de código cerrado, como Sora o Midjourney, llegan por esta vía.
- !«メールアドレス» (204 personas, con publicaciones de la instancia lemmy.bestiver.se también mezcladas) — espejo de Hacker News. Aquí circulan artículos sobre lanzamientos de modelos como Qwen-Image o Nano Banana.
- !«メールアドレス» — comunidad de tono irónico sobre la industria de IA. Aquí se originó la noticia sobre el supuesto extravío de Midjourney.
- !«メールアドレス» (8.265 personas) — gran comunidad crítica de la IA generativa. No aporta noticias directamente, pero sirve para medir el clima general de Lemmy.
- !stable_diffusion_furry / _witches / _mycology / «メールアドレス» — comunidades de obras de SD especializadas en nichos. Hay publicaciones, pero sus puntuaciones son de un dígito o negativas.
Publicaciones
Relacionadas con código cerrado
- OpenAI is shutting down Sora's API next week while a chinese competitor just raised $3 billion — !«メールアドレス», 2026-09-20, puntuación 1. Contrapone el cierre de la API de Sora con una gran ronda de financiación de empresas chinas.
- Midjourney AI pivots to Theranos: Ultrasonic CT — !«メールアドレス», 2026-06-19, puntuación 40. Tema sobre un giro brusco de Midjourney desde la generación de imágenes hacia equipos médicos de tomografía por ultrasonidos; fue la publicación sobre Midjourney con mayor crecimiento en Lemmy.
- Midjourney Ultrasonic CT Scanner — !hackernews, 2026-06-18, puntuación 2. Espejo de HN de la fuente primaria anterior (midjourney.com/medical).
- Publicación a través de Midjourney wants Hollywood studios to reveal AI usage details — !«メールアドレス», 2026-07-05, puntuación 73. Presentación de un artículo de TechCrunch que obtuvo una puntuación relativamente alta en la comunidad tecnológica.
- Google quietly discontinues its Earth AI feature a day after its rollout after users made no-no images — !ai_reddit, 2026-08-07, puntuación 1.
- Seedream 5.0 Pro is here: an honest comparison and technical breakdown — !ai_reddit, 2026-07-10, puntuación 1. Verificación del modelo cerrado de imágenes de ByteDance.
- Nano Banana 2 Lite — !hackernews, 2026-06-30, puntuación 1. Anuncio de un modelo ligero de generación de imágenes de Google DeepMind.
- Microsoft's MAI-Image-2.5 Pulls Even With Google's Nano Banana 2 on Benchmarks — !ai_reddit, 2026-05-28, puntuación 1.
Relacionadas con código abierto
- Qwen-Image-2.1: Compact, efficient, and unified image creation — !hackernews, 2026-09-20, puntuación 1. Última versión del modelo de generación de imágenes de pesos abiertos de Alibaba Qwen.
- supElement/ComfyUI_MinimaxH3_AutoContext — !«メールアドレス», 2026-09-16, puntuación 1. Nodo para generación de vídeo largo con MiniMax H3 que supera límites de memoria.
- Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder — misma comunidad, 2026-09-16, puntuación 3. Generador de prompts para MiniMax H3.
- nazgut/ComfyUI-MiniMaxH3-CLSS — misma comunidad, 2026-09-01, puntuación 0. Generación de vídeo con audio de duración arbitraria con 16 GB de VRAM.
- filliptm/ComfyUI-FL-MiniMaxH3 — misma comunidad, 2026-08-30, puntuación 5.
- Luisacaotica/ComfyUI-MiniMaxH3Mod — misma comunidad, 2026-08-20, puntuación 7. Adaptador de compresión de imágenes/vídeos de referencia sin entrenamiento.
- I've been testing Wan for AI video generation — !«メールアドレス», 2026-09-10, puntuación -9 (mala recepción/debate tenso). Reseña de generación de vídeo con el modelo de pesos abiertos Wan.
- Boogu-Image-0.1 — Efficient Image Generation Foundation Model — !«メールアドレス», 2026-06-17, puntuación 5. Nuevo modelo base abierto para generación de imágenes.
Señales
- El ecosistema de ComfyUI alrededor de MiniMax H3 crece de forma continua entre agosto y septiembre. Desde 2026-08-07 hasta 09-16 se publicaron al menos cinco nodos/herramientas relacionados en !«メールアドレス», sin interrupción en el ritmo. En esta comunidad, «MiniMax H3» fue la principal palabra clave del impulso del vídeo de código abierto.
- Las noticias de código cerrado tienen poco debate nativo en Lemmy: casi todas son referencias indirectas de espejos de Reddit (!ai_reddit) o Hacker News (!hackernews) y sus puntuaciones suelen ser de 1 a 3. Prácticamente no hay debate original.
- La única noticia de código cerrado que creció de forma notable fue el supuesto giro de Midjourney desde la generación de imágenes hacia escáneres médicos de tomografía por ultrasonidos (!techtakes, puntuación 40), que se hizo viral en una comunidad con fuerte tono satírico e irónico.
- Las comunidades de intercambio de obras (stable_diffusion_art, share_anime_art, etc.) tienen una frecuencia alta —varias publicaciones casi cada día—, pero sus puntuaciones se mantienen entre un dígito y la decena; se centran más en compartir creaciones que en noticias.
- La comunidad crítica !«メールアドレス» (8.265 personas) supera en tamaño a la comunidad favorable a la generación de IA (stable_diffusion, 5.713), lo que sugiere una composición comunitaria de Lemmy con fuerte hostilidad hacia estas tecnologías.
Límites
- La API de búsqueda de Lemmy permite solo búsqueda por texto completo y tiene una clasificación de relevancia débil. Al buscar términos generales como "Sora" o "Veo" se mezclaron numerosas noticias políticas irrelevantes (latam, pravda_news, etc.). Se revisaron de hecho entre 15 y 20 resultados por palabra clave, más de 100 en total, pero solo una decena larga resultó pertinente.
- Lemmy usa instancias distribuidas y no hay una búsqueda transversal de todas ellas. Se buscaron principalmente lemmy.world, lemmy.dbzer0.com, lemmy.durstig.online, awful.systems, lemmy.bestiver.se y lemmy.today, pero podrían no verse conversaciones de instancias pequeñas y cerradas al estilo Mastodon.
- No se encontraron publicaciones significativas sobre otros modelos destacados en plataformas distintas, como Runway, Kling, Ideogram, Recraft, Grok Imagine, Flux.2 o HunyuanImage; los resultados fueron cero o completamente irrelevantes.
- En conjunto, Lemmy es un espacio pequeño para noticias de última hora sobre IA de generación de imágenes y vídeo. Depende de espejos de Reddit/Hacker News para la actualidad, y su contenido propio se concentra en compartir herramientas de implementación para ejecutar modelos de pesos abiertos en ComfyUI.
Pinterest — Noticias de IA de generación de imágenes y vídeo
Temas visuales
- Logotipos de «IA» con brillo neón e imágenes de robots/circuitos son la abreviatura visual predeterminada de Pinterest para «IA»: chips brillantes, cabezas y manos robóticas holográficas y circuitos de partículas usados como portada genérica en vez de ilustrar una herramienta o noticia concreta
[1, 2, 8, 22, 25, 28, 29, 31, 39, 49]. - Miniaturas tipo listículo numeradas de «Best AI Video/Image Generator» —titular grande y cuadrícula de logotipos de aplicaciones (Runway, Pika, Kling AI, Luma Dream Machine, Canva, Hailuo AI, Synthesia, HeyGen, D-ID, CapCut, InVideo, Adobe Firefly)— son el formato de pin más común de todo el conjunto
[7, 13, 20, 30, 32, 33, 41, 43]. - Miniaturas de youtubers sin rostro con caras de reacción (hombre barbudo sorprendido, auriculares, fondo borroso de explosión) junto a logotipos de grandes tecnológicas, usadas para vender vídeos de resumen de «AI NEWS»
[6, 19, 40]. - Tarjetas de resumen «Today's/This Week's AI News» fechadas, diseñadas como pequeñas portadas o carruseles de Instagram, que reúnen varios titulares reales por tarjeta
[17, 35, 44, 47]. - Demostraciones de «Spot the AI» / realismo —una jugadora de tenis fotorrealista con el texto «This is AI», una foto de gato con sello «FAKE»— venden el realismo del contenido generado, no un producto particular
[5, 23]. - Demostración de transferencia de estilo con personaje consistente —un pin de Lumalabs convierte un vídeo fuente en cuatro estilos: bloques de madera, papiroflexia, ladrillos de juguete y flores—, siguiendo el mismo formato viral de «convierte esto en material X» visto en otros lugares este ciclo
[10]. - Anuncios de servicios freelance/de ingresos extra que ofrecen «vídeo de IA para tu marca», con número de WhatsApp y dirección de Gmail integrados directamente en el gráfico
[24]. - Infografías introductorias que descomponen el proceso en pasos (prompt → espacio latente → eliminación de ruido → fotogramas → salida), dirigidas a quienes no saben cómo funciona la generación
[3, 36].
Pines destacados
- #9 — página oficial de producto Veo 2 («Our state-of-the-art video generation model», llamada a registrarse en VideoFX). Marketing real de producto cerrado, no un listículo. https://www.pinterest.com/pin/716705728243313502/
- #10 — Lumalabs: «Made of wooden blocks / origami folded paper art / colorful toy bricks / flowers»: un vídeo fuente se vuelve a renderizar en cuatro estilos coherentes. https://www.pinterest.com/pin/308144799526598925/
- #17 — «4 Major AI Updates: Real News. Real Impact.» reúne GPT-6 Astra de OpenAI, una mayor orientación agéntica de Gemini en Gmail/Drive/Docs/Slides/Chat, vídeo y sonido generativos dentro de la línea de tiempo de Adobe Premiere, y la Serie E de 2.000 millones de dólares de Cognition con una valoración de 48.000 millones. https://www.pinterest.com/pin/982558843745608433/
- #20 — gráfico de decisión «AI Image Video: Best Quality vs Best Free», el mapa en una sola imagen más claro de las herramientas de pago actuales (ChatGPT Plus, Gemini Advanced, Midjourney, Adobe Firefly, Recraft, Runway Gen-3, Luma, Pika Pro, Kaiber, Synthesia) frente a las gratuitas (Ideogram, Gemini Free, SeaArt, Playground, Krea, Canva, Inkscape, CapCut, Pika Free, Runway Free). https://www.pinterest.com/pin/37295503160959330/
- #26 — tarjeta de noticias: «ByteDance and Hollywood reach global deal on AI copyright»; ByteDance y la Motion Picture Association acuerdan reforzar la protección de PI en las herramientas de generación de imágenes y vídeo de ByteDance. https://www.pinterest.com/pin/1074530792376376121/
- #27 — infografía de ética de IA/detector de voz que señala un resultado de análisis de voz «97% likely AI-generated», junto a paneles de «AI video generators» y «AI ethics & prompt engineering»: ansiedad generalizada sobre confiar en medios generados. https://www.pinterest.com/pin/951104015101996491/
- #32 — «22 Best & Free AI Video Generators», el mayor recopilatorio de herramientas del conjunto; en sus «Top 5 Picks» sitúa Kling AI y Hailuo AI por encima de Runway y Pika en realismo. https://www.pinterest.com/pin/128493395623874987/
- #35 — «Today's AI News, May 20 2026»: resumen de Google I/O 2026 con Gemini 3.5 Flash, Gemini Omni, el agente Gemini Spark y gafas inteligentes Android XR. https://www.pinterest.com/pin/652670171044638578/
- #44 — maqueta de periódico «This Week in AI News» (15 de agosto de 2026), con titulares sobre «Open Models / Open weights», «Sovereign AI» y «Agent Harness»: el único pin de todo el conjunto que siquiera nombra modelos de pesos abiertos, y solo como avance de titular, no como demostración. https://www.pinterest.com/pin/644577765463965693/
- #48 — lanzamiento de «Amuse 3.0», herramienta local de creación de arte con IA respaldada por AMD; uno de los pocos pines que nombra un lanzamiento de producto específico en vez de una tarjeta genérica o un listículo. https://www.pinterest.com/pin/4601060441986715264/
Señales
- Kling AI y Hailuo AI se han incorporado a la primera línea junto con Runway, Pika y Luma en casi todos los listículos recopilados (
[7, 13, 30, 32, 41, 43]), un conjunto de «mejores opciones» más amplio que el duopolio Runway/Pika de hace un año. - El impulso de Veo/Gemini de Google es la historia cerrada más visible en esta plataforma, recurrente en pines independientes de noticias de IA —lanzamiento de Veo 2, Gemini 3.5/Omni/Spark y gafas Android XR en I/O 2026—, y no mediante una sola publicación viral.
- OpenAI aparece sobre todo como una mezcla de logotipos, con una única mención concreta de Sora-2 (#4, una grabación borrosa de una herramienta de terceros, «zeely.ai», funcionando en modo «sora-2-video-ad»), algo escaso frente a su presencia habitual en otras plataformas.
- La ansiedad por deepfakes y autenticidad es un trasfondo recurrente, no un caso aislado: aparecen de forma independiente un pin de contenido con sello «FAKE», una lectura de detector de voz con 97 % de IA y un gráfico «Human Journalism vs. Machine-Generated Media» (
[5, 16, 27]). - El enfoque de monetización/ingresos extra es explícito: anuncios de servicios freelance de vídeo con IA con datos de contacto integrados (#24), propuestas de «canal sin rostro» y marketing de contenidos (#23, #25). La audiencia de Pinterest para vídeo con IA parece inclinarse a creadores que buscan vender o escalar contenido, no a investigadores.
- El código abierto está prácticamente ausente. Entre los 50 pines no hay menciones de Stable Diffusion, Flux, ComfyUI, Wan, HunyuanVideo, LTX, Mochi ni enlaces de GitHub/HuggingFace. La única huella del concepto son las palabras «Open Models. Open weights.» como una línea de titular en una portada simulada de noticias de IA (#44), nunca como pin, logotipo de herramienta o demostración propia. Para este tema, Pinterest es casi por completo marketing SaaS de código cerrado y listículos SEO de «los mejores»; quien dependiera solo de esta plataforma no sabría que existe una escena de generación abierta de imágenes y vídeo.
Límites
- La tabla
pinterest.pins.mddel trabajador no tenía secciones por género —una sola lista plana de 50 pines bajo un género implícito—, por lo que todos los pines se analizaron juntos en vez de por género, como describe el playbook para ejecuciones multigénero. - Varios títulos de pines no coinciden con lo que muestran realmente sus imágenes y, según el playbook, esta fase no navega Pinterest para verificarlo. Por ello se marcan como no confirmados: #42 («Nvidia #NEW AI Tools») solo muestra una foto genérica de Jensen Huang hablando, sin texto visible sobre ninguna herramienta; #45 («Grok 5: Elon Musk's AI Revolution») y #50 («Discover how Grok is revolutionizing video») muestran imágenes genéricas de archivo o presentador de noticias de IA sin nada específico de Grok; #40 («GPT 5.2, realtime video editor...») solo muestra una miniatura genérica de reacción sobre «huge AI news».
- Varios pines son gráficos de archivo genéricos casi duplicados sin contenido informativo distintivo (
[2, 8, 22, 29, 39, 45, 49]): se contaron entre los 50, pero no se trataron como señales separadas. - No se encontró contenido de generación abierta de imágenes o vídeo en Pinterest para este tema. Esta ausencia es en sí el hallazgo principal de la plataforma, no una carencia de la investigación; véanse las Señales anteriores.
Acciones recomendadas
- Seguir hacia dónde migra el tráfico de la API de Sora después del 2026-09-24: Seedance 2.5, MiniMax H3 o Kling v3.
- Vigilar cambios en la licencia de investigación no comercial de Qwen-Image-2.1 ante el debate activo de «¿esto es código abierto?».
- Usar la frecuencia de publicaciones de nodos ComfyUI de MiniMax H3 en Lemmy como indicador adelantado de adopción de vídeo de pesos abiertos.
- Repetir la fase de recopilación de X con términos de búsqueda específicos del tema en lugar de tendencias regionales.
- Repetir la fase de Reddit con términos de búsqueda por modelo para llegar al objetivo de unas 20 publicaciones.
- Verificar el giro de Midjourney hacia la tomografía médica por ultrasonidos con su fuente primaria antes de tratarlo como confirmado.
Imágenes recopiladas


















































Nota sobre la calidad de los datos
X produjo cero publicaciones pertinentes de las 32 recopiladas debido a una falta de correspondencia en los términos de búsqueda, y Reddit solo recopiló 12 de los aproximadamente 20 hilos previstos usando un único término. La API de búsqueda de Bluesky estaba bloqueada (403) y se tuvo que sortear mediante muestreo de feeds de cuentas; los recuentos de visualizaciones y fechas exactas de YouTube no pudieron confirmarse debido a páginas renderizadas con JavaScript.



