Noticias de IA de generación de imágenes y vídeo — 2026-09-25
Las empresas cerradas están reconfigurándose por la rápida expansión de Seedance 2.5 y el fin de la API de Sora, mientras que en el ámbito abierto Qwen-Image-2.1, con solo 7B, se acerca a los principales modelos cerrados. Al mismo tiempo, fue una semana marcada por casos en los que la etiqueta «código abierto» no refleja la realidad (MiniMax H3, Wan 3.0).
Resumen de noticias sobre IA de generación de imágenes y vídeo: ¿cómo están ahora los modelos cerrados y abiertos? — 2026-09-25
¡Hola! El mundo de la IA de imágenes y vídeo se ha movido muchísimo esta semana, así que vamos a resumirlo de una vez 🔥. Del lado cerrado, Seedance 2.5, Nano Banana y el cierre de Sora han convertido todo en una auténtica fiesta 🎉. Pero el lado abierto también viene fuerte: Qwen-Image-2.1, un modelo de apenas 7B parámetros, está plantando cara directamente a los pesos pesados cerrados, y la verdad es que el panorama está muy emocionante 👀. Por otro lado, también están apareciendo varios casos de modelos como MiniMax H3 o Wan 3.0 que se anuncian como «¡de código abierto!» pero en realidad están fuertemente restringidos por licencias o limitados a API: el problema de lo «abierto de mentira» merece atención ⚠️. Además, en Reddit y Pinterest sigue creciendo el enfado ante contenido generado por IA que se infiltra como si fuera real; la conversación técnica y la de confianza van claramente de la mano.
En todas las plataformas
- Seedance 2.5 (ByteDance, cerrado) es el gran protagonista común en todas las plataformas 🎬. Aparece en Reddit (explicaciones de técnicas para vídeos largos), X (publicaciones que procesan material base de MiniMax H3 con AE), YouTube (tutoriales para producir anuncios UGC en volumen) y Lemmy. Parece claro que hoy es el modelo de vídeo cerrado que más se está usando de verdad.
- MiniMax H3 (modelo de vídeo de pesos abiertos) transmite la idea de que «se puede usar gratis», pero no es código abierto de verdad 😅. Es tema de conversación en Reddit, X, YouTube y Lemmy, pero una investigación de YouTube reveló que su «MiniMax H3 Community License» es una licencia personalizada que excluye a usuarios de la UE, Reino Unido, Corea del Sur y Estados Unidos. Mucha gente cae por títulos que dicen «Open-Source», pero hay que comprobar qué hay detrás.
- Qwen-Image-2.1 (Alibaba, abierto) compite con Nano Banana 2.0, el principal modelo cerrado, con solo 7B parámetros 💪. Tanto YouTube como Lemmy lo valoran positivamente como un modelo pequeño pero potente, y es un buen ejemplo de la eficiencia de parámetros del ecosistema abierto.
- La etiqueta «código abierto» se está inflando 📢. No solo MiniMax H3: YouTube señala que Wan 3.0 (Alibaba), aunque se publica solo vía API, suele confundirse con el anterior Wan 2.2 (Apache 2.0). También en Lemmy son pocas las publicaciones que distinguen con rigor entre «abierto» y «cerrado»; parece que las etiquetas van por delante de los hechos.
- La indignación por contenido de IA que se hace pasar por real es un tema común en varias plataformas 😤. En Reddit se han viralizado tres casos: retoques de IA sin autorización en fotos de anuncios inmobiliarios, sospechas de «fabricación científica» en el concurso Nikon Small World in Motion e imágenes de IA descubiertas en Instagram. En Pinterest también existe como género habitual la imagen de «presentador de noticias falsas», con cintillos al estilo NBC News. La confianza sigue siendo una preocupación inseparable de las tendencias técnicas.
- El cierre de la API de Sora (OpenAI) el 2026-09-24 aparece como un «vacío informativo» en varias plataformas 🕳️. En Lemmy circula junto con la noticia de que un competidor chino recaudó 3.000 millones de dólares, pero recibe poca reacción. En YouTube tampoco se encontraron vídeos especializados: la atención ya parece haberse desplazado a herramientas sucesoras como Seedance y Wan.
Plataforma por plataforma
Reddit repite hilos de preguntas sobre cómo crear vídeos de IA gratuitos y de gran calidad, pero los mayores éxitos son la indignación por imágenes inmobiliarias de IA en r/mildlyinfuriating (27.000 pt) y la sospecha de fraude en un concurso científico de Nikon en r/labrats (1.089 pt). Son pocas las publicaciones que separan claramente lo cerrado de lo abierto; la mayoría se limita a enumerar herramientas.
X tuvo un punto de partida de búsqueda basado en el panel de tendencias de Croacia, por lo que 32 de 40 publicaciones trataban temas no relacionados (criptomonedas, fútbol y cotilleos de celebridades) 🙈. Las 8 restantes hablaban casi todas de hacer que Claude Opus 5.5 controle After Effects, Blender, Unreal o Godot. La sorpresa principal no era la generación en sí, sino que un agente de IA opere herramientas existentes.
YouTube tiene pocos canales (7 casos), pero contenido denso: predominan canales de actualidad que revisan GPT Image 2.5, Qwen-Image-2.1, MiniMax H3 y Seedance 2.5 justo tras sus lanzamientos. Fue el único lugar que señaló claramente la ambigüedad entre abierto y cerrado, especialmente los problemas de licencia de MiniMax H3 y Wan 3.0.
Bluesky tenía la API de búsqueda bloqueada con un 403, así que no se pudieron usar búsquedas por palabras clave 😢 y hubo que seguir publicaciones de cuentas encontradas individualmente. Los anuncios de nuevos modelos cerrados de Replicate se concentraban en la primera mitad de 2026, mientras que creadores del mundo abierto como ostris, doctordiffusion y la cuenta oficial de Hugging Face no actualizaban desde 2024–2025. Apenas aparecieron en Bluesky temas de 2026 como Qwen-Image-2.1.
Lemmy tiene en las comunidades de !stable_diffusion su hogar de facto para el mundo abierto, con énfasis en asuntos técnicos como integración con ComfyUI y enlaces de Hugging Face. Las noticias cerradas —el final de Sora o el giro de Midjourney hacia equipos médicos— solo llegan mediante crossposts de r/ArtificialInteligence, con puntuaciones de casi 0–1 y sin discusión local.
Pinterest: se abrieron y comprobaron 20 de 50 pines. Lo que aparece son sobre todo comparativas de aplicaciones cerradas —Runway, Pika, Kling, Luma, Google/OpenAI— y visuales de desconfianza hacia la IA; no apareció ni un nombre de modelo abierto ni capturas de ComfyUI 📌. La separación solicitada de 10 casos abiertos y 10 cerrados no puede hacerse con Pinterest por sí solo, porque faltan materiales del lado abierto.
Qué vigilar
- Qwen-Image-2.1 (compite con los principales modelos cerrados con 7B) — YouTube: https://www.youtube.com/watch?v=3qGl0wiv2G0
- El problema de licencia de MiniMax H3 (se anuncia como «Open-Source», pero excluye a la UE, Reino Unido, Corea del Sur y EE. UU.) — YouTube: https://www.youtube.com/watch?v=XJ4mHfQzZ7I
- Cierre de la API de Sora y ronda de 3.000 millones de dólares de un competidor chino — vía Lemmy: https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/
- Sospechas de «mejora» con IA en Nikon Small World in Motion (un problema de confianza en concursos científicos) — Reddit: https://www.reddit.com/r/labrats/comments/1wo0j5e/
- Claude Opus 5.5 operando directamente Blender/Unreal/Godot (la «agentificación» de la IA generativa) — X: https://x.com/kevin_t_ngo/status/2102761406315839798
- Cláusula de prohibición de entrenamiento de IA en la nueva película de DreamWorks, «Forgotten Island» — Reddit: https://www.reddit.com/r/antiai/comments/1wnrfi6/
Recomendaciones
- Seguir vigilando modelos abiertos pequeños como Qwen-Image-2.1 y revisar individualmente las actualizaciones de benchmarks.
- Comprobar siempre el texto de la licencia antes de clasificar como «código abierto» un modelo que lo afirme; MiniMax H3 y Wan 3.0 son casos paradigmáticos.
- Incluir en la próxima investigación la migración a servicios alternativos —Seedance, Wan, Kling y otros— después del fin de la API de Sora.
- En próximas búsquedas en Bluesky y Pinterest, añadir términos específicos como «ComfyUI», «Hugging Face» y «Flux» para compensar la falta de visibilidad del ecosistema abierto.
- Seguir de forma continua, y no separada de las noticias técnicas, el tema común en Reddit y Pinterest de la desconfianza hacia contenido generado por IA.
- Para X, volver a recopilar usando palabras clave específicas del tema, en vez de depender del panel de tendencias.
Calidad de los datos
Ninguna plataforma alcanzó el criterio de finalización del encargo —analizar unas 20 publicaciones por red social—: Reddit 12; X, 8 relevantes de 40; YouTube 7; Bluesky, 12 hallazgos a partir de unas 30 publicaciones; Lemmy 12; y Pinterest abrió 20 de 50. En particular, en X el 80 % del contenido fue irrelevante porque el punto de partida fue el panel de tendencias de Croacia; Bluesky devolvía continuamente 403, impidiendo buscar transversalmente por palabras clave; y Pinterest no dividió sus consultas entre abierto y cerrado, por lo que no había ningún material de código abierto. Como resultado, las «últimas noticias» del lado abierto se concentran especialmente en YouTube y Lemmy, con poca corroboración desde X, Bluesky y Pinterest.
Resumen por plataforma
Reddit — Noticias de IA de generación de imágenes y vídeo
Dónde
Desglose de los 12 hilos recopilados (solo se usó la búsqueda «Image and Video Generation AI News»):
| Subreddit | Miembros | Hilos recopilados |
|---|---|---|
| r/generativeAI | 156.863 | 5 |
| r/labrats | 726.659 | 1 |
| r/aivideomaking | 7.660 | 1 |
| r/mildlyinfuriating | 12.593.078 | 1 |
| r/Instagramreality | 1.155.761 | 1 |
| r/AIdaily_news | 3.108 | 1 |
| r/aiwars | 169.389 | 1 |
| r/antiai | 338.300 | 1 |
r/generativeAI es el centro de facto de las «noticias» (5 casos), aunque la mayoría de su contenido son preguntas sobre cómo encontrar servicios gratuitos de generación de vídeo. En cambio, los mayores éxitos no llegaron de comunidades especializadas o favorables a la IA, sino de r/mildlyinfuriating (una gran comunidad generalista, 12,59 millones) y r/labrats (una comunidad de investigación, 730.000), ambas centradas en el enfado hacia contenido generado por IA.
Qué dice la gente
- #1 r/generativeAI · 37 pt · 36 comentarios · 2026-09-22 (enlace) — Un desarrollador independiente promociona «Locally Uncensored», un servicio de generación de imágenes, vídeo y texto que se presenta como sin censura. La reacción es escéptica. u/No_Laugh_3115 plantea la pregunta esencial: «Cuando se actualicen los modelos ascendentes, la parte “uncensored” debería degradarse antes que nada. ¿Cómo lo abordáis? ¿Hacéis fine-tuning propio o solo envolvéis pesos abiertos?»
- #2 r/labrats · 1.089 pt · 131 comentarios · 2026-09-23 (enlace) — El vídeo ganador de este año en Nikon Small World in Motion aparentemente fue «mejorado y coloreado» con IA, mostrando la aparición y desaparición de estructuras biológicamente imposibles. u/Barkinsons (618 pt): «Las herramientas de IA no tienen cabida en la microscopía científica. Tenemos la obligación de reproducir las imágenes con la mayor fidelidad posible, no de hacerlas más bonitas». u/holydiver18 (53 pt) critica duramente la respuesta de la organización: «Esto es claramente una conducta indebida».
- #3/#9/#11/#12 r/generativeAI · r/aivideomaking (16 pt/2 pt/0 pt/4 pt, 2026-09-19–22) — Cuatro hilos independientes preguntan cómo «hacer vídeos de IA gratis», lo que revela que es la necesidad más frecuente en Reddit. El patrón de respuesta común es que no existe el trío de gratis, gran calidad y sin marca de agua; el bot Jenna_AI repite el mismo argumento en #9, #11 y #12. Herramientas mencionadas: FramePack, ComfyUI, Grok ($10/mes), Venice, Nanobanana/Veo (mediante Google Flow), Muse (Meta) y dreamfort.ai.
- #4 r/mildlyinfuriating · 26.766 pt · 719 comentarios · 2026-09-21 (enlace) — Con diferencia, la puntuación más alta de la muestra. Indignación por incorporar sin avisar «imágenes de inspiración» generadas por IA en fotografías de anuncios inmobiliarios. u/slothboy (5.749 pt): «Convertir ese comedor en un baño es un proyecto que cuesta cinco cifras». u/BojackWorseman13 (1.138 pt) propone mostrar claramente en la imagen que ha sido generada por IA.
- #5 r/generativeAI · 7 pt · 31 comentarios · 2026-09-23 (enlace) — Sobre cómo crear vídeos largos con IA, la explicación práctica de u/kaboom-o (2 pt) es útil: «Nadie hace vídeos largos en una sola toma. Descompones el guion en una lista de planos, creas una montaña de clips de 5 a 15 segundos y después los editas». Para mantener expresiones faciales durante más tiempo recomienda Seedance 2.5 (hasta unos 30 segundos, con audio nativo); para borradores de movimiento, Grok Imagine Video (480p, 5 segundos); y para calidad casi fotográfica, Gemini Omni Flash.
- #6 r/Instagramreality · 2.206 pt · 351 comentarios · 2026-09-18 (enlace) — Hilo que señala que una imagen generada por IA, muy valorada en Reddit, era falsa. u/Smart-Membership-117 (427 pt): «El borde del rodapié junto a la rodilla es distinto entre las fotos 2 y 3. El verde fuera de la ventana también cambia por completo». u/Habibti-Mimi81 (154 pt): «Sinceramente, yo no me habría dado cuenta. Es una época triste y peligrosa».
- #7 r/AIdaily_news · 0 pt · 12 comentarios · 2026-09-24 (enlace) — Hilo retrospectivo sobre vídeos de IA que fueron tema de conversación en 2024. La frase de u/Erosion139 (1 pt) es representativa: «Aquella era la época en la que la IA “soñaba”». Abundan las voces nostálgicas de los extraños artefactos de entonces.
- #8 r/aiwars · 0 pt · 144 comentarios · 2026-09-24 (enlace) — Debate polarizado sobre un clip de animación que, según el autor, fue creado por una sola persona por $13 con Seedance 2.5. El autor lo celebra como una época en la que se puede crear trabajo de nivel industrial sin convertirse en animador. u/GameMask (4 pt) replica: «Que se haya podido hacer por $13 es precisamente incómodo. No ha supuesto ningún progreso para la industria de la animación». u/Onionadin (7 pt) va más allá: «Parece que le emociona haber mejorado su capacidad de engañar a la gente».
- #10 r/antiai · 18.115 pt · 623 comentarios · 2026-09-23 (enlace) — La comunidad antiai celebra que DreamWorks añadiera a su nueva película «Forgotten Island» un aviso que prohíbe el entrenamiento de IA. Sin embargo, u/SlowlyDyingInAPit (2.561 pt, comentario principal) se mantiene prudente: «Es fantástico, pero los creyentes de la IA seguirán usándolo obstinadamente para hacer basura. Cuando se lo prohíbes, aún quieren hacerlo más». u/Arckanoid (143 pt) analiza el objetivo legal: «No se trata de detenerlos, sino de crear una base para demandar».
Señales
- Presencia del mundo abierto/local: nombres de modelos como ComfyUI, FramePack, Seedance 2.5 y Minimax H3, que pueden ejecutarse localmente o a bajo coste, aparecen repetidamente en varios hilos. En especial, la respuesta de kaboom-o en #5 se aprecia como conocimiento práctico sobre «encadenar modelos».
- El código cerrado se describe como una experiencia fragmentada: ante la proliferación de servicios cerrados como Grok, Veo, Nanobanana, Runway, Luma, Kling, Hailuo y Pixverse, está tan asentada la resignación de que no se puede tener a la vez gratis, gran calidad y sin marca de agua, que el bot Jenna_AI repite ese comentario estandarizado en tres hilos (#9, #11 y #12).
- El conflicto se intensifica en torno a si se puede detectar o no: en #6 (Instagramreality) y #2 (Nikon), el enfado gira en torno a que las creaciones de IA se consuman como reales. En #8 (aiwars), quienes ven positiva la democratización de la tecnología chocan frontalmente con quienes la ven como una herramienta de engaño; la división de opiniones en Reddit queda visible tal cual.
- Lo sorprendente: que un vídeo con «mejoras» de IA —en la práctica, fabricación— haya ganado el gran premio del prestigioso concurso científico Nikon Small World in Motion, y que además la organización respondiera de manera desafiante (#2). La reacción de la comunidad científica es extremadamente severa: no se trata de una simple controversia sobre «arte de IA», sino de ética de investigación, y la intensidad es distinta a la del resto de noticias de IA generativa.
- Lo que se minimiza o ya se da por perdido: las peticiones de «vídeos de IA gratuitos y de calidad» (#3, #9, #11 y #12) llegan siempre a la misma conclusión —«lo gratis no existe; alguien tiene que pagar la electricidad y las GPU»—, por lo que se está convirtiendo en un tema agotado para la comunidad.
Limitaciones
- Solo se usó la consulta
"Image and Video Generation AI News"; no se buscaron otras formulaciones, como nombres concretos de modelos abiertos o servicios cerrados. Frente al objetivo de analizar unas 20 publicaciones por red social, solo se recopilaron 12 hilos. - Los hilos #6 (r/Instagramreality) y #7 (r/AIdaily_news) no incluían en los datos recopilados el cuerpo inicial de la publicación, por lo que se infirió su contenido solo a partir de los comentarios principales.
- Toda la recopilación está sesgada hacia subreddits anglófonos; no se reunió ni un hilo en japonés o de una comunidad no inglesa de Reddit. Aunque el encargo está en japonés, esa brecha de perspectiva no se cubrió.
- Pocos hilos discuten explícitamente la diferencia entre «código cerrado» y «código abierto»; la mayoría se limita a listas de herramientas de ambos tipos. Los datos de Reddit por sí solos no bastan para separar con rigor las 10 tendencias abiertas y las 10 cerradas solicitadas.
X
X — La toma agentiva de herramientas creativas por Claude Opus 5.5 es la única señal de IA de imagen/vídeo en esta ventana
De dónde procede esta lista
El panel Explore de X que proporcionó los términos de búsqueda estaba geolocalizado en Croacia (output/x.posts.md, «What X says is happening»): 6 de sus 10 tendencias dicen explícitamente «Trending in Croatia», y el resto son tendencias genéricas de Deportes/Música/Negocios/Tecnología superpuestas. Es una instantánea local de Croacia, no global. Solo 2 de esos 10 términos —«Opus 5.5» y «Claude»— tocan siquiera la IA de generación de imágenes/vídeo; los otros 8 ($song, Serbia, Taylor, Cardano, Croats, Croatia, NFTs, England) son conversaciones no relacionadas sobre criptomonedas, fútbol, cotilleos de celebridades y geopolítica. Véase ## Limitaciones para las implicaciones sobre la cobertura.
Cuentas
Todas las personas que publican sobre el tema son participantes puntuales salvo una:
- @KanaWorks_AI (KANA|東京AI映像) — la única cuenta repetida, con 2 publicaciones (150 + 335 me gusta). Es una cuenta de «vídeo con IA» de Tokio; ambas publicaciones tratan de usar Claude Opus 5.5 para manejar motores de juego, primero Unreal y después Godot.
- @kevin_t_ngo (Kevin Ngo) — 1 publicación, pero con el mayor alcance: 3.480 me gusta y unas 236.000 visualizaciones. Etiqueta directamente a
@claudeai; una animación Python/Blender fue renderizada por Claude Opus 5.5. - @developedbyed (Dev Ed) — 1 publicación, 1.071 me gusta y unas 70.000 visualizaciones. Una conocida cuenta de educación para desarrolladores que compara animaciones «OPUS 5.5 vs GPT 6 Astra».
- @ring_hyacinth — 1 publicación, 712 me gusta y unas 44.000 visualizaciones. Un creador individual narra un experimento personal: convertir un cortometraje antiguo en un juego de pixel art.
- @aicreataro — 1 publicación, 444 me gusta y unas 45.000 visualizaciones. Una cuenta de creador de IA que publica un registro estructurado de pruebas: clip base + operaciones en After Effects.
- @seiiiiiiiiiiru (SEIIIRUAIを使う映像クリエイター) — 1 publicación, 163 me gusta y unas 7.900 visualizaciones. Cuenta japonesa de creador de vídeo con IA, autoidentificada por la herramienta que usa.
- @ponzponz15 (ぽんず) — 1 publicación, 212 me gusta y unas 32.000 visualizaciones. Creador japonés que documenta una técnica de edición concreta.
En resumen: una cuenta dedicada a vídeo con IA publica dos veces y seis creadores individuales presentan una demostración o prueba de alto engagement cada uno. Ninguna cuenta es un medio de noticias o de la industria; todo es contenido en primera persona del tipo «lo probé».
Publicaciones
-
@developedbyed (1.071 me gusta · 26 reposts · 35 respuestas · ~70.000 visualizaciones · 2026-09-23) — https://x.com/developedbyed/status/2102789774461280370
OPUS 5.5 vs GPT 6 Astra Loss Screen Animation
Comparación directa de animaciones entre modelos para una gran audiencia de desarrolladores: es lo más cercano en este conjunto a contenido de benchmarking «cerrado frente a cerrado». -
@kevin_t_ngo (3.480 me gusta · 167 reposts · 81 respuestas · ~236.000 visualizaciones · 2026-09-23) — https://x.com/kevin_t_ngo/status/2102761406315839798
Thank you @claudeai ! GIF animated in Python and rendered in Blender by Claude Opus 5.5
La publicación con más interacción de las 40 relacionadas con el tema. Señala una sorpresa genuina ante que un LLM pueda manejar un renderizador 3D de extremo a extremo, no solo generar una imagen estática. -
@ring_hyacinth (712 me gusta · 81 reposts · 51 respuestas · ~44.000 visualizaciones · 2026-09-23) — https://x.com/ring_hyacinth/status/2102865595675050010
Opus 5.5 is really amazing! I sent the short film Pixel Shanghai that I made a year ago to Opus 5.5, asking him to turn this video into a pixel game about Shanghai, where the protagonist Xiaoman collects 42 memories about Shanghai in this city. The scenes use the pixel [texto cortado por X]
Conversión de vídeo en recursos para juegos: usa Opus como capa de dirección creativa sobre material existente, no como generador desde cero. -
@aicreataro (444 me gusta · 66 reposts · 7 respuestas · ~45.000 visualizaciones · 2026-09-23) — https://x.com/aicreataro/status/2102656273112326609
Prueba para hacer que Opus 5.5 opere After Effects y procese un vídeo de IA. ■Base: un clip de 15 segundos con MiniMax H3 ■Lo que hizo en AE: ajustar la velocidad para alinear los cortes con el ritmo; un efecto por sección (partículas, rayos, caleidoscopio, datamosh, etc.) ■Lo que descubrí [cortado]
Menciona un modelo real de generación de vídeo como capa base (MiniMax H3, clip de 15 segundos), mientras Opus 5.5 realiza la posproducción en After Effects: un detalle concreto de un flujo abierto/cerrado. -
@KanaWorks_AI (335 me gusta · 39 reposts · 16 respuestas · ~18.000 visualizaciones · 2026-09-24) — https://x.com/KanaWorks_AI/status/2102955708321062975
Desarrollo de juegos 3D con Claude Opus 5.5 × Godot. Crear un juego en Godot se siente algo más fácil que hacerlo en Unity. También es ligero y el resultado tiene muy buena pinta.
La segunda publicación de la misma cuenta confirma que no es algo puntual: está realizando una pequeña serie que prueba Opus 5.5 con distintos motores. -
@KanaWorks_AI (150 me gusta · 16 reposts · 11 respuestas · ~8.300 visualizaciones · 2026-09-24) — https://x.com/KanaWorks_AI/status/2103138051165933661
Claude Opus 5.5 × Unreal. Nunca pensé que llegaría el día en que pudiera crear yo mismo un ARPG así. Cogí el mando, hice correr al personaje, rodar y blandir la espada. Cuando lo probé de verdad, me latía el corazón y tenía las palmas empapadas de sudor.
Reacción emocional y en primera persona ante Opus 5.5 creando un ARPG jugable en Unreal Engine; se presenta como un hito personal, no como un anuncio de producto. -
@ponzponz15 (212 me gusta · 17 reposts · 7 respuestas · ~32.000 visualizaciones · 2026-09-24) — https://x.com/ponzponz15/status/2102931824918106499
Cámara 3D × texto tridimensional, presentación ②. Ahora también es posible con Claude Opus o Codex hacer ediciones como las de After Effects. Arriba: Seedance 2.5 prev. Abajo: Codex + habilidad Hyperframes #dreaminacpp
Menciona dos piezas más de generación/herramientas —Seedance 2.5 para vídeo y una habilidad Codex + «Hyperframes»— encadenadas con Claude para motion graphics al estilo AE. -
@seiiiiiiiiiiru (163 me gusta · 23 reposts · 9 respuestas · ~7.900 visualizaciones · 2026-09-24) — https://x.com/seiiiiiiiiiiru/status/2103227982592831846
Vídeo publicitario de IA → voz de IA × edición de IA. Ya podemos decir que este es el objetivo final, ¿no? jaja. Hice que Claude Opus 5.5 generara la narración con Gemini 3.8 Flash TTS y, siguiendo ese audio, operara AE y otras herramientas para crear el vídeo.
Un flujo completo para vídeo publicitario: Gemini 3.8 Flash TTS genera la narración y Claude Opus 5.5 orquesta After Effects para sincronizar la edición con la pista de voz.
Señales
- En ascenso: la conversación en X no es «escribe un prompt y obtén una imagen o vídeo», sino Claude Opus 5.5 como agente que opera software creativo existente —After Effects, Blender, Unreal y Godot— sobre clips o recursos procedentes de otros lugares. Todas las publicaciones relevantes tratan esto como la novedad emocionante, no la generación en sí.
- En ascenso: un patrón de encadenamiento: un modelo dedicado genera el material bruto —MiniMax H3, Seedance 2.5, Gemini 3.8 Flash TTS— y Opus 5.5 se encarga del montaje, la posproducción o la dirección. Dos publicaciones (@aicreataro y @ponzponz15) nombran explícitamente el generador aguas arriba, el detalle más concreto relacionado con abierto/cerrado que revela esta plataforma.
- Sorpresa: la publicación con más interacción (@kevin_t_ngo, unas 236.000 visualizaciones) no trata de calidad visual, sino de que un LLM pueda manejar Blender de extremo a extremo. La reacción se centra en capacidad y agencia, no en fidelidad visual.
- Ausente o descartado: no hay menciones a Midjourney, Stable Diffusion, Flux, Sora, Runway, Kling ni un marco explícito de «código abierto frente a código cerrado» en lo que X mostró durante esta ventana. Si ese marco aparece en una síntesis posterior, tendrá que ser una inferencia, no una cita de X.
Limitaciones
- Los términos de búsqueda procedían de la lista de tendencias de X, no del tema. Los 10 términos del trabajador salieron directamente del panel Explore de X (véase
output/x.posts.md), geolocalizado en Croacia. Solo «Opus 5.5» y «Claude» se relacionan con IA de generación de imágenes/vídeo; los otros 8 devolvieron promoción de criptomonedas, resultados de fútbol, cotilleos de celebridades y discusiones políticas sobre los Balcanes: 32 de 40 publicaciones, ninguna útil para este encargo. - Por debajo del objetivo de unas 20 publicaciones. Solo 8 de las 40 recopiladas son pertinentes, por debajo del criterio de analizar alrededor de 20 por plataforma. No hay más margen en el archivo recopilado; es una brecha de cobertura de lo reunido, no de lectura.
- Sin publicaciones directas sobre abierto frente a cerrado. Nada recogido usa explícitamente ese marco; la separación anterior se infiere de las herramientas nombradas en cada publicación. Claude Opus 5.5 y Gemini 3.8 Flash TTS son cerrados; la licencia de MiniMax H3 y Seedance 2.5 no se indica en las publicaciones.
- Varios textos están truncados en el punto en que X los cortó (@aicreataro, @ring_hyacinth, @pfPokeFUN y otros); el texto completo no estaba disponible en
output/x.posts.mdnioutput/x.posts.json. - Solo aparecieron publicaciones en inglés y japonés; no hay cobertura de comunidades chinas, coreanas u otras comunidades de creadores de IA activas en X.
YouTube
YouTube — Noticias de IA de generación de imágenes y vídeo (código cerrado / código abierto)
Canales
No se pudieron obtener directamente los suscriptores porque la página de resultados de YouTube se renderiza con JavaScript; solo se indica lo encontrado mediante oEmbed y búsqueda web. Véase ## Limitaciones.
- AI WITH Rithesh (RitheshSreenivasan, más de 10.000 suscriptores y más de 1 millón de visualizaciones acumuladas) — Canal educativo indio de IA. Revisó tanto ChatGPT Images 2.5 de OpenAI como Qwen-Image-2.1 de Alibaba justo tras sus lanzamientos, uno de los pocos ejemplos que siguen en el mismo canal ambos ecosistemas.
- Astrovah (@astrovah) — Canal de herramientas de IA para creadores, con una reseña «honesta» de GPT Image 2.5.
- REBEL AI (@realrebelai) — Publicó una demostración de acceso anticipado de Qwen-Image 2.1; funciona como escaparate de modelos abiertos de imagen.
- Adrian Viral AI Marketing (@AdrianViralAIMarketing) — Canal comparativo para especialistas en marketing de IA que clasifica nuevos modelos, sean abiertos o cerrados.
- Miko (@MikoxAI) — Canal de tutoriales para producir anuncios UGC en volumen con modelos cerrados de vídeo como Seedance 2.5.
- jingchen573 — Especializado en ejecución local con ComfyUI; informó con rapidez sobre la publicación de los pesos abiertos de MiniMax H3.
Vídeos
-
Qwen-Image-2.1 Is INSANE… Just 7B Parameters?! — AI WITH Rithesh — alrededor de 2026-09-20 (justo después de la publicación de Qwen-Image-2.1) — https://www.youtube.com/watch?v=3qGl0wiv2G0
Examina Qwen-Image-2.1, el modelo de imagen de pesos abiertos de Alibaba publicado el 2026-09-20, con solo 7B parámetros en el generador, y explica que logra benchmarks comparables a Nano Banana 2.0 de Google, de código cerrado. -
Qwen-Image 2.1 | Early Access Showcase — REBEL AI — finales de 2026-09 — https://www.youtube.com/watch?v=tP_gGGJzEqg
Demuestra ejemplos de generación usando acceso anticipado. Destaca que un mismo modelo puede generar y editar imágenes transparentes. -
[ComfyUI] Breakthrough Release: MiniMax H3, the New Leading Open-Source Video Model — jingchen573 — alrededor de 2026-08-03 (fecha de publicación de pesos abiertos de MiniMax H3) — https://www.youtube.com/watch?v=XJ4mHfQzZ7I
Informa rápidamente de la publicación de MiniMax H3 en Hugging Face, incluyendo su instalación en ComfyUI: 33.000 millones de parámetros, multimodal, hasta 2K/24 fps y audio estéreo nativo. El título dice «Open-Source», pero la licencia real es personalizada y excluye UE, Reino Unido, Corea del Sur y EE. UU. Véase## Señales. -
ChatGPT Images 2.5 Is INSANE… 48 Hours Later, I'm Still Shocked! — AI WITH Rithesh — alrededor de 2026-09-10 (dos días después del lanzamiento de GPT Image 2.5) — https://www.youtube.com/watch?v=LYUr4BY33h4
Revisa ChatGPT Images 2.5, lanzado por OpenAI el 2026-09-08, con hasta un 50 % menos de latencia y la nueva función «Sketch», tras sus primeras 48 horas. -
GPT Image 2.5 - Creative Use Cases You've Probably Missed And A Honest Review — Astrovah — alrededor de 2026-09-21 — https://www.youtube.com/watch?v=_S71zN5tgQY
Una «reseña honesta» que profundiza en usos prácticos menos evidentes del mismo modelo. -
I Ranked Every New AI Video Model (Omni 1.1, Seedance 2.5, H3 Max, Wan 3.0, Flux 3, Grok) — Adrian Viral AI Marketing — finales de 2026-08 (hace aproximadamente un mes) — https://www.youtube.com/watch?v=4BoTXsJrxQ4
Clasifica lado a lado Gemini Omni 1.1, Seedance 2.5 y Grok —cerrados— junto con Wan 3.0 y Flux 3, incluidos modelos que a menudo se interpretan equivocadamente como abiertos. Es un vídeo de «cuál usar ahora» con herramientas abiertas y cerradas mezcladas. -
Seedance 2.5 + Grok Bot = 50 Viral AI UGC Ads a Day (Full Tutorial) — Miko — 2026-08-22 — https://www.youtube.com/watch?v=mcY7ReDNrd0
Tutorial práctico para producir anuncios UGC en volumen combinando Seedance 2.5 y Grok, ambos cerrados. Es un ejemplo típico de creadores individuales que explotan APIs cerradas como canal comercial.
Señales
- La frontera entre abierto y cerrado se difumina: muchos títulos describen MiniMax H3 como «Open-Source», pero su licencia real, MiniMax H3 Community License, es personalizada y excluye EE. UU., la UE, Reino Unido y Corea del Sur. Abundan los vídeos que no distinguen entre «pesos abiertos» y código abierto realmente libre de usar.
- Wan 3.0 tampoco es «abierto»: la versión más reciente de la serie Wan de Alibaba, Wan 3.0, publicada por API alrededor del 2026-08-06, no ha publicado pesos ni en Hugging Face ni en GitHub. En los vídeos comparativos de YouTube se confunde a menudo con Wan 2.2, la versión anterior bajo Apache 2.0, facilitando que el público piense erróneamente que toda la familia Wan es de código abierto.
- El ecosistema abierto compite con los grandes con 7B: Qwen-Image-2.1, con un generador de solo 7B parámetros, se considera comparable a Nano Banana 2.0, un modelo cerrado. Es fuerte la narrativa de que el mundo abierto usa la eficiencia de parámetros como ventaja.
- El lado cerrado se diferencia mediante UX de edición, como «Sketch»: las reseñas de GPT Image 2.5 se centran menos en la calidad de generación pura que en la función «@Sketch», que convierte bocetos en imágenes, y en la consistencia de edición —precisión en edición multivuelta—. La competencia está pasando de la generación aislada a los flujos de edición.
- La generación de vídeo acelera su conversión en cadenas de herramientas: están creciendo tutoriales como el de Miko, que combinan Seedance 2.5 y Grok para producir anuncios UGC en volumen. La atención se desplaza de comparar el rendimiento de un solo modelo a combinar varios modelos para monetizar, en línea con los hallazgos de X.
- OpenAI Sora es una zona vacía en las noticias: aunque la API de Sora se había cerrado el 2026-09-24, el día anterior a esta investigación, no se encontraron vídeos de YouTube centrados específicamente en el cierre; solo artículos de blog lo comunicaban de inmediato. El interés de los youtubers parece haberse movido ya a herramientas alternativas como Seedance, Wan y Kling.
Limitaciones
- La página de resultados de YouTube (
youtube.com/results?...) se renderiza con JavaScript, por lo que WebFetch no pudo obtener directamente el listado de vídeos —títulos, reproducciones y fechas—. Como alternativa, se combinaron WebSearch (site:youtube.com) y la API oEmbed de YouTube (youtube.com/oembed?url=...). Los títulos y nombres de canal se verificaron con oEmbed, mientras que las fechas se estimaron a partir de fragmentos de WebSearch como «hace n días». - No se pudieron obtener las visualizaciones ni los suscriptores de la mayoría de vídeos. oEmbed no devuelve reproducciones, y los fragmentos de WebSearch no suelen contener cifras; por ello la sección «Vídeos» no las incluye. Tampoco se pudo aplicar la recomendación del playbook de comparar con el rendimiento habitual del canal.
- Muchas fechas de publicación son estimaciones a partir de «hace n días/semanas», no fechas exactas. En particular, las de #1, #2, #5 y #7 son cálculos aproximados desde la fecha de búsqueda, 2026-09-25.
- No se cumple estrictamente el objetivo de analizar unas 20 publicaciones. Se recopilaron 7 vídeos, dentro del rango de 5–12 del playbook, pero por debajo del criterio de unas 20 para otras plataformas. La página de resultados no era accesible y el único método era verificar enlace por enlace los resultados de búsqueda con oEmbed.
- No se encontró ningún vídeo especializado sobre el fin de la API de Sora el 2026-09-24. Blogs y sitios de noticias sí lo trataron ampliamente, pero en YouTube puede haber quedado enterrado entre vídeos sobre herramientas sucesoras.
- No se analizaron comentarios. La revisión se limitó a títulos y descripciones, ya que no se pudo acceder a las páginas de vídeo.
Bluesky
Bluesky — Últimas noticias sobre IA de generación de imágenes y vídeo
Cuentas
- replicate.com (Replicate) — Anuncia nuevos modelos por API, abiertos y cerrados. Es la única cuenta que ha publicado con actividad constante noticias sobre IA generativa de imagen y vídeo en 2026.
- ostris.com (Ostris / desarrollador de AI-Toolkit) — Publica sobre fine-tuning LoRA de modelos de pesos abiertos como FLUX, Flex y Wan2.1. No actualiza desde abril de 2025.
- doctordiffusion.bsky.social — Creador del modelo derivado de Stable Diffusion 3.5, «Absynth». También publica sobre entrenamiento LoRA para HunyuanVideo. Sin actualizaciones desde marzo de 2025.
- reach-vb.hf.co / hf.co (cuentas oficiales y personal de Hugging Face) — Presentan Spaces de modelos abiertos. Las publicaciones relacionadas con generación de imágenes y vídeo terminan en diciembre de 2024.
- simonwillison.net — Investigador independiente de IA. No se especializa en generación de imágenes, pero comenta capacidades multimodales de LLM de frontera y sigue activo en septiembre de 2026.
- midjourneynews.bsky.social — Cuenta de fans/comunidad que publica experimentos de prompts de Midjourney. Tiene poco engagement, pero publicó de forma ocasional hasta junio de 2026.
Publicaciones
Código cerrado
-
GPT Image 2 (OpenAI) se añade a Replicate — «Fotorrealismo espectacular y texto nítido, con gran fidelidad a diseños, UI y casos de uso de diseño».
2026-04-21|5 me gusta · 0 reposts|https://bsky.app/profile/replicate.com/post/3mjzygaefs224 -
Seedance 2.0 (ByteDance) se abre al público general — Unifica texto, imagen, vídeo y audio, y genera vídeo de calidad de estudio con audio estéreo sincronizado y simulación física.
2026-04-09|2 me gusta · 1 repost|https://bsky.app/profile/replicate.com/post/3mj3junhvnh26 -
Artículo de evaluación de Seedance 2.0 — «Hemos pasado mucho tiempo con Seedance 2.0. Esto es lo que descubrimos». Incluye enlace al blog de Replicate.
2026-04-15|1 me gusta · 0 reposts|https://bsky.app/profile/replicate.com/post/3mjkkogr7nd2f -
Vidu Q3 llega a Replicate — Generación de vídeo a partir de texto, imagen y fotogramas inicial/final; hasta 16 segundos a 1080p y con audio sincronizado.
2026-03-11|1 me gusta · 0 reposts|https://bsky.app/profile/replicate.com/post/3mgsan3ddpl2w -
Lanzamiento de Runway Gen-4.5 — Se presenta con «una precisión física y realismo sin precedentes».
2026-02-18|2 me gusta · 0 reposts|https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c -
Kling 3.0 / o3 se añade a Replicate — Generación 4K multishot, audio sincronizado, hasta 15 segundos, edición de vídeo y transferencia de estilo.
2026-02-17|2 me gusta · 0 reposts|https://bsky.app/profile/replicate.com/post/3mf35lkhoyw2q -
GPT-6 Astra + Blender crea un pelícano 3D — Experimento de Simon Willison que hace que GPT-6 Astra construya progresivamente un modelo en Blender; presenta un flujo de trabajo de generación de imagen a 3D.
2026-09-05|406 me gusta · 30 reposts|https://bsky.app/profile/simonwillison.net/post/3murtmdynq22s
Código abierto (2024–2025; no se verificaron actualizaciones recientes)
-
Publicación de Flex.2-preview — «Texto a imagen, control universal (línea, pose, profundidad) e inpainting, todo integrado en un modelo. Ajustable con AI-Toolkit, licencia Apache 2.0, 8B parámetros».
2025-04-22|4 me gusta · 0 reposts|https://bsky.app/profile/ostris.com/post/3lngo5cf66k2a -
Compatibilidad con fine-tuning LoRA para HiDream — Disponible en AI-Toolkit CLI/GUI; requiere un mínimo de 36 GB de VRAM.
2025-04-16|3 me gusta · 0 reposts|https://bsky.app/profile/ostris.com/post/3lmxfwzrjlc2v -
Vídeo navideño de un «yo de IA» entrenado con LoRA en HunyuanVideo — También comparte un método de entrenamiento con diffusion-pipe.
2024-12-25|1 me gusta · 0 reposts|https://bsky.app/profile/doctordiffusion.bsky.social/post/3le5ovtycmk23 -
Publicación de Absynth 2.0, derivado de Stable Diffusion 3.5 — «¡SD3.5 vive! 🎨🤖», distribuido en Civitai/Hugging Face.
2025-01-19|3 me gusta · 0 reposts|https://bsky.app/profile/doctordiffusion.bsky.social/post/3lg36y7u2i22x -
Resumen semanal de Spaces de Hugging Face — Presenta Spaces abiertos de generación de imágenes como «Flux Kolors Character» y «JanusFlow 1.3B».
2024-11-18|7 me gusta · 0 reposts|https://bsky.app/profile/reach-vb.hf.co/post/3lb7slz2ycc2j
Señales
- Los modelos cerrados se actualizaron rápidamente en la primera mitad de 2026: OpenAI GPT Image 2, ByteDance Seedance 2.0, Kling 3.0, Runway Gen-4.5 y Vidu Q3 aparecieron concentrados entre febrero y abril. Multishot, audio sincronizado y 4K/1080p se han convertido en especificaciones estándar para los modelos de vídeo. En Bluesky, la cuenta de Replicate es prácticamente la única fuente primaria.
- La comunicación sobre código abierto en Bluesky se ha detenido en la práctica: los creadores que publicaban sobre fine-tuning de FLUX/Flex/Wan2.1/HunyuanVideo —ostris y doctordiffusion—, así como las cuentas oficiales de Hugging Face, dejaron de publicar contenido de imagen/vídeo entre finales de 2024 y primavera de 2025. En cambio, búsquedas web confirmaron que en 2026 sí se lanzaron modelos de pesos abiertos como Qwen-Image-2.1, HunyuanImage 3.0 y Z-Image Turbo; esos temas son casi invisibles en Bluesky.
- El engagement general es pequeño: salvo cuentas que alcanzan al público tecnológico general, como Simon Willison, los me gusta suelen ser de una sola cifra o pocas decenas. Bluesky no parece ser un centro de información primaria para este ámbito; X, Discord y Hugging Face parecen ser los principales escenarios.
Limitaciones
app.bsky.feed.searchPosts, la API oficial de búsqueda, devolvía HTTP 403 para todas las palabras clave probadas, incluidas «image generation AI» y «nano banana». La versión web debsky.app/searchtambién está impulsada por JavaScript y WebFetch no pudo obtener su contenido. Como sustituto, se usógetAuthorFeedindividualmente para cuentas encontradas por búsqueda web.- Por estas restricciones, el análisis no es una búsqueda transversal exhaustiva por palabras clave, sino que queda limitado a publicaciones de cuentas que se lograron descubrir. Es muy probable que falten cuentas y publicaciones populares no encontradas.
- No se pudieron resolver en Bluesky cuentas esperadas de Black Forest Labs, fal.ai, Stability AI o Civitai: no existen, o son cuentas vacías como
civitai.bsky.social, con 19 seguidores y 0 publicaciones. - No se encontraron publicaciones primarias en Bluesky de los principales lanzamientos de pesos abiertos de 2026, como Qwen-Image-2.1, HunyuanImage 3.0 y Z-Image Turbo.
- Frente al objetivo de unas 20 publicaciones analizadas por red social, se recopilaron alrededor de 30 candidatas de 6 cuentas y se informaron 12 hallazgos concretos. Sin una API de búsqueda utilizable, se consideró difícil aumentar con seguridad el volumen.
Lemmy
Lemmy — Últimas tendencias de IA de generación de imágenes y vídeo
Comunidades
- !«メールアドレス» (también aparece federada en lemmy.world) — 5,71K suscriptores, de los cuales 894 son locales. Es el espacio para hablar de tecnologías favoritas de generación de arte por IA, centrado en temas técnicos de pesos abiertos —integración con ComfyUI, enlaces de modelos de HF/GitHub—. Es el hogar de facto del tema en Lemmy.
- !«メールアドレス» — 2,36K suscriptores, 362 locales, 3,55K publicaciones, 31 usuarios activos diarios/97 semanales. Espacio para compartir obras realizadas con Stable Diffusion o modelos de pesos abiertos; hay publicaciones casi todos los días.
- !share_anime_art (serie stable_diffusion_art) — Publicaciones de arte generado por IA centradas en personajes de anime, como Fate, Idolmaster y Disgaea.
- !stable_diffusion_abstract / !stable_diffusion_mycology (pequeñas comunidades de la serie stable_diffusion_art) — El usuario PapaSkwat entrena LoRA propios con sus pinturas al óleo y acrílico y los ejecuta en SDXL local para generar arte abstracto y motivos de hongos; publica de forma continua.
- !ai_reddit (instancia desconocida, probablemente un crosspost automático de r/ArtificialIntelligence) — Recibe muchas noticias cerradas de Sora API, Nano Banana, Seedance, Veo y Kling, pero las puntuaciones suelen ser 0–1 y casi no hay conversación.
- !hackernews (comunidad espejo de Hacker News) — Recibe ocasionalmente enlaces a anuncios oficiales de Qwen-Image-2.1 y Seedance 2.5.
- Referencia: !«メールアドレス», !«メールアドレス» y !«メールアドレス» también son espacios de IA, pero no están especializados en generación de imágenes/vídeo.
Publicaciones
- Qwen-Image-2.1 in ComfyUI: Open-Weight Image Generation and Editing, Now with Transparency — !stable_diffusion, puntuación 13, 2026-09-22. Nueva versión de un modelo de imagen de pesos abiertos con 7B parámetros, salida 2K nativa, RGBA con transparencia y edición usando hasta 10 imágenes. https://blog.comfy.org/p/qwen-image-21-in-comfyui-open-weight
- Qwen-Image-2.1: Compact, efficient, and unified image creation — !hackernews, puntuación 2, 2026-09-20. Anuncio oficial de Qwen. https://qwen.ai/blog?id=qwen-image-2.1
- ComfyUI-Fantastic-MiniMaxH3-PromptBuilder / ComfyUI_MinimaxH3_AutoContext / comfyui-obvpm-timeline — !stable_diffusion, puntuaciones 1–6, 2026-09-16–09-22. Se añaden sucesivamente al ecosistema ComfyUI herramientas de generación de vídeo largo y gestión de prompts para MiniMax H3.
- tencent/HunyuanVideo-I2V — !stable_diffusion, puntuación 5. Modelo de imagen a vídeo de código abierto con modelo FP8 y flujo de trabajo de integración con ComfyUI. https://huggingface.co/tencent/HunyuanVideo-I2V
- I ran the same prompt through 6 AI video models and had ~40 people blindrank the results — !ai_reddit, puntuación 1, 2026-09-17. Evaluación perceptual: Veo en primer lugar, Seedance 2.5 en segundo por poco y Hailuo muy por detrás en último. https://www.reddit.com/r/ArtificialInteligence/comments/1wipgwa/
- OpenAI is shutting down Sora's API next week while a chinese competitor just raised $3 billion — !ai_reddit, puntuación 1, 2026-09-20. Resume que el consumidor llamativo ha fracasado, mientras que las empresas discretas —Synthesia, Heygen, Kling y Argil— están obteniendo beneficios. https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/
- Seedance 2.5, anuncio oficial — !hackernews, puntuación 3, 2026-08-01. Mejora de funciones como vídeos de 30 segundos y hasta 50 imágenes de referencia. https://seed.bytedance.com/en/blog/
- Google quietly discontinues its Earth AI feature a day after its rollout — !ai_reddit, puntuación 1, 2026-08-07. Google integró Nano Banana 2 en Google Earth, pero lo retiró en 24 horas porque usuarios generaban falsas imágenes de desastres y conflictos en lugares reales. https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/
- Nano Banana 2 Lite, página oficial — !hackernews, puntuación 1, 2026-06-30. Lanzado como modelo de generación de imágenes de bajo coste, unos 3 yenes por imagen. https://deepmind.google.com/models/gemini-image/flash-lite/
- Microsoft's MAI-Image-2.5 Pulls Even With Google's Nano Banana 2 on Benchmarks — !ai_reddit, puntuación 1, 2026-05-28. Sube al tercer puesto en la clasificación Arena. https://www.reddit.com/r/ArtificialInteligence/comments/1tpu2cd/
- Midjourney pivots from AI image generation to body scanning medical spa / Midjourney Medical — !technology (puntuación 58) / !hackernews / !techtakes (puntuación 40), 2026-06-18–19. Sorprendente noticia de que Midjourney, sinónimo de generación de imágenes, cambia hacia equipos médicos de escaneo «Ultrasonic CT». En la misma época también se habló de que «Midjourney wants Hollywood studios to reveal AI usage» (!technology, puntuación 73, 2026-07-05), sobre un litigio para exigir divulgación del uso de IA. https://www.theregister.com/ (spa médico de Midjourney), https://techcrunch.com/ (uso de IA en Hollywood)
- Same Berserk spread, 4 AI colorizations. Looks like GPT wins again? — !ai_reddit, puntuación 1, 2026-09-14. Compara coloreado automático de manga con ChatGPT Images 2.5, Wan 2.7 Pro, Nano Banana Pro y Seedream 5.0 Pro; evalúa que ChatGPT conserva mejor el line art. https://www.reddit.com/gallery/1wfyqdy
Señales
- Lemmy es frío con la IA: en una publicación titulada «Where are the AI user communities on Lemmy?» (lemmy.world/post/46457184), el comentario con más votos —36— responde «mejor mira fuera del Fediverse; aquí hay una inclinación anti-IA». Da la impresión de que a los usuarios interesados en IA les resulta incómodo estar en Lemmy. El verdadero refugio del mundo abierto se concentra en las comunidades !stable_diffusion de la instancia db0.
- El lado abierto se centra en retransmitir el “hacer y usar”: !stable_diffusion publica principalmente información técnica —nodos de ComfyUI y enlaces de modelos de Hugging Face—, mientras !stable_diffusion_art comparte obras generadas diariamente con Krea2 turbo, modelos Qwen y LoRA propios. Sus puntuaciones suelen ser de un dígito o pocas decenas; tienen menor escala que Reddit, pero actividad continua.
- Las noticias cerradas son casi todas “importadas”: las grandes noticias sobre el fin de Sora API, Nano Banana, Seedance y el giro de Midjourney a equipos médicos solo llegan mediante crossposts de r/ArtificialInteligence como !ai_reddit. Sus puntuaciones suelen ser 0–1 y no generan debate comunitario local. Lemmy por sí solo no permite seguir bien este género de noticias.
- En conjunto, se verificaron 12 hallazgos en las publicaciones anteriores, equivalentes a 6 abiertos y 6 cerrados. Al alcanzar el límite de 12 del playbook, se detuvo la recopilación.
Limitaciones
- Las consultas directas a la API oficial de Lemmy (
/api/v3/community,/api/v3/post/list) devolvían errores HTTP 400/500, por lo que la obtención directa de cuerpos de publicaciones y parte de las cifras de suscriptores se basa en fragmentos de búsquedas web y páginas. - Algunas palabras clave produjeron mucho ruido político y social no relacionado; búsquedas aisladas como «Flux AI», «Runway AI» o «Kling AI» no tuvieron resultados. No se encontraron noticias individuales de Flux de Black Forest Labs ni de Runway dentro de Lemmy.
- No se pudo identificar con precisión la instancia de la comunidad !ai_reddit, porque los resultados de búsqueda no mostraban el nombre de la instancia.
- El objetivo de analizar unas 20 publicaciones no se cumple estrictamente, dado que la densidad de publicaciones de Lemmy es baja. Siguiendo el playbook, la sección se limitó a 5–12 publicaciones; se revisaron más de 30 artículos y candidatas relacionadas en resultados de búsqueda antes de eliminar duplicados y ruido irrelevante.
Pinterest — Noticias de IA de generación de imágenes y vídeo
Se recopilaron 50 pines con una única búsqueda («Image and Video Generation AI News», sin separar por género). Abrí directamente 20 imágenes —índices 1–13, 16, 22, 25–26, 28, 31–33, 36, 38–39, 41–43, 45 y 47–49— para comprobar qué mostraban realmente, ya que la mayoría de títulos eran vagos o genéricos.
Temas visuales
- Miniaturas de youtubers de «AI NEWS»: un hombre barbudo, sorprendido o con los ojos muy abiertos, junto a una cuadrícula de logotipos 3D neón de empresas como OpenAI, Google, Microsoft, Meta y Notion. El encuadre clásico de clickbait al estilo MrBeast aplicado a resúmenes de noticias de IA [1, 28].
- Primeros planos de robots humanoides blancos o androides con ojos azules brillantes, usados como representación genérica de «IA» en historias no relacionadas: detección de noticias falsas, explicaciones sobre ética, infografías de IA generativa para la industria e incluso ilustraciones de «principales presentadores de noticias con IA» [3, 22, 41, 43, 48, 49].
- Infografías publicitarias SaaS en neón sobre azul marino: fondos azul oscuro/negro, cajas de iconos delineadas en púrpura, rosa y cian brillante, y tipografía condensada grande: «6+ BEST AI VIDEO GENERATION WEBSITES», «AI IMAGE VIDEO — BEST QUALITY VS BEST FREE». Es el formato dominante para contenido de «qué herramienta debería usar» [4, 9, 39].
- Cuadrículas de logos de herramientas/listículos comparativos que repiten los mismos productos: Runway, Pika, Kling AI, Luma (Dream Machine), Canva AI y Hailuo AI para vídeo; ChatGPT/DALL·E, Midjourney, Gemini, Adobe Firefly, Recraft, Ideogram y Krea para imagen [4, 9, 39].
- Imágenes de ansiedad por «noticias generadas por IA»: cintillos tipo telediario real —«AI GENERATED», franja inferior de NBC News— sobre una presentadora o reportera claramente sintética, además de un sello «FAKE» sobre un robot con teléfono. La confianza y la desinformación son un género visual recurrente, no solo un tema textual [3, 32, 45, 48].
- Macros de circuitos y chips con una marca «AI» brillante incrustada en el silicio, usadas como imágenes genéricas de hardware o computación para pines de «la IA está en todas partes» [5].
- Cuadrículas de demostración de transferencia de estilo/preservación de identidad: el mismo vídeo o foto de origen reinterpretado lado a lado como «bloques de madera», «origami», «lego» o «flores». Es un formato concreto de demostración de producto, en este caso de una capacidad de Luma [2].
- El motivo del collage o “muro de miniaturas”: decenas de fotogramas pequeños de vídeos de IA o tarjetas de vídeo vertical agrupadas en una única imagen alta, simbolizando el volumen y escala de contenido de IA que inunda los feeds [31, 49].
Pines destacados
- #1 — «AI News: Anthropic Leak Shows Us The Future of AI...»: formato de miniatura de reacción que menciona Anthropic junto a logos de OpenAI/Google/Microsoft. Muestra que las noticias de laboratorios cerrados se empaquetan como drama o filtración para conseguir clics.
- #2 — «Google announces ultra-high quality video...»: cuadrícula 3x5 que vuelve a renderizar un vídeo fuente en estilos de bloques de madera, origami, lego y flores; una demostración concreta de reestilización de vídeo que preserva la identidad al estilo Nano Banana/Gemini, no una simple diapositiva de logos.
- #4 — «6+ Best AI Video Generation Websites»: infografía que enumera Runway, Pika, Kling AI, Luma, Canva y Hailuo como conjunto predeterminado actual de herramientas de vídeo, con el dato de que en 2026 el 80 % del contenido en línea incluirá vídeo.
- #9 — «AI Image Video: Best Quality vs Best Free»: infografía de árbol de decisión que divide opciones de pago —ChatGPT Plus, Gemini Advanced, Midjourney, Adobe Firefly, Recraft, Runway Gen-3, Luma, Pika Pro, Kaiber, Synthesia— y gratuitas —Ideogram, Gemini Free, SeaArt, Playground, Krea, Canva, Inkscape, CapCut, Pika Free, Runway Free—. Es una instantánea útil de las herramientas que Pinterest trata actualmente como «de primer nivel».
- #11 — «Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API»: gráfico de embudo que muestra entradas de imagen y texto convergiendo en una salida, con la marca «Gemini API». La generación cerrada de vídeo con audio se comercializa como producto de API para desarrolladores, no solo como aplicación de consumo.
- #26 — «Google’s Gemini Omni Turns Anything Into Video»: un pin de una agencia de marketing externa, Osiz Technologies, que reempaqueta un anuncio de capacidades de Gemini Omni. Muestra que las noticias de modelos cerrados se reutilizan inmediatamente como contenido SEO y de captación de clientes por agencias ajenas.
- #28 — «AI News: OpenAI Finally Released What We Asked For»: el mismo creador y formato de miniatura de reacción que #1, ahora centrado en OpenAI; confirma que es una serie recurrente, no un caso aislado.
- #38 — «Amuse 3.0»: retrato fotorrealista de un pescador anciano, acreditado como «imagen generada por IA creada en AMD». Es uno de los pocos pines que vincula generación de imágenes con la vertiente de hardware local/NPU de un proveedor específico, en lugar de una API en la nube.
- #39 — «4 Major AI Updates»: menciona GPT-6 Astra, Gemini agéntico entre aplicaciones, vídeo/sonido generativo en la línea de tiempo de Adobe Premiere y la Serie E de Cognition de 2.000 millones de dólares a una valoración de 48.000 millones. Es el resumen de noticias cerradas más concreto y aparentemente más fechado de la muestra.
- #45 — «AI Generated News Clip»: un presentador sintético etiquetado directamente en la imagen; la ilustración de un solo fotograma más clara de la llegada del vídeo de IA a la producción de noticias y medios, en línea con los pines de cintillos NBC de #32 y #48.
Señales
- Lo actual: el panorama de herramientas de Pinterest está dominado por los mismos nombres cerrados —Runway, Pika, Kling, Luma/Dream Machine, Google Gemini/Veo, OpenAI y Adobe Firefly/Premiere—. Los modelos abiertos —Stable Diffusion, Flux, HunyuanVideo, Wan, LTX y ComfyUI— prácticamente no aparecen por nombre. La audiencia de generación de imágenes de Pinterest se inclina hacia «qué aplicación gratis o de pago debería usar» y resúmenes de noticias en formato reacción, no hacia debate técnico a nivel de modelo.
- Una corriente secundaria fuerte: el contenido de ansiedad y confianza —sellos «FAKE», presentadores de noticias de IA, clips de IA con aspecto de NBC, gráficos sobre «¿puedes confiar en esa voz?»— es aproximadamente tan frecuente como las comparativas de herramientas. El marco de desinformación y confianza mediática es un género visual de primer orden, no una nota al pie.
- Ausencias: no hay nombres de modelos abiertos ni repositorios, marca de Hugging Face, capturas de flujos LoRA/fine-tuning/ComfyUI, gráficos de benchmarks ni casi nada sobre artículos de investigación o avances técnicos en generación de vídeo. La versión de Pinterest del tema es casi por completo para consumidores y marketing —anuncios de herramientas, listículos de «lo mejor» e ilustraciones de ansiedad por IA—, no el ángulo de desarrolladores y entusiastas que aparecería en Reddit o X.
- Varios pines son contenido SEO antiguo o perenne que se vuelve a circular —por ejemplo, imágenes genéricas de archivo sobre «AI Image Generation» o un listículo de «Top AI Video Generators» de 2025—, no noticias de última hora de esta semana. Los resultados de Pinterest mezclan marketing atemporal con contenido fechado, por lo que la actualidad debe juzgarse pin por pin según fechas y números de versión visibles, como «GPT-6 Astra» o «Amuse 3.0», no suponerse.
Limitaciones
- El playbook de esta fase indica que las imágenes ya fueron recopiladas por un trabajador de navegador sin interfaz; no navegué Pinterest personalmente ni pude buscar más allá de
pinterest.pins.md/images/pinterest/. - Los 50 pines procedían de una única consulta plana, «Image and Video Generation AI News», sin desglose por género. No pude separar pines «cerrados» y «abiertos» como requiere la estructura de dos informes, porque el conjunto de imágenes simplemente no muestra herramientas o proyectos abiertos para cubrir esa mitad.
- Abrí 20 de 50 imágenes; las 30 restantes, mayormente entradas genéricas «(untitled)» según la tabla, no se inspeccionaron de forma individual, aunque sus títulos sugieren que repiten los patrones visuales ya cubiertos.
- Los datos recopilados no exponen métricas de interacción de los pines —guardados o comentarios—, por lo que lo «en tendencia» se infiere de repetición visual y temática, no de señales de popularidad.
Acciones recomendadas
- Seguir continuamente las actualizaciones de benchmarks de modelos abiertos pequeños como Qwen-Image-2.1.
- Verificar el texto de las licencias antes de clasificar modelos que se anuncien como «código abierto».
- Incluir en la próxima investigación la migración hacia servicios alternativos después del fin de la API de Sora.
- Añadir búsquedas por nombres propios como ComfyUI y Hugging Face para Bluesky y Pinterest, compensando la baja visibilidad de lo abierto.
- En X, recopilar de nuevo mediante palabras clave específicas del tema, no basándose en el panel de tendencias.
Imágenes recopiladas


















































Nota sobre la calidad de los datos
Ninguna de las seis plataformas alcanzó el objetivo del encargo —unas 20 publicaciones por red social—. En X, solo 8 de 40 publicaciones se ajustaban al tema, porque el punto de partida de búsqueda era el panel de tendencias de Croacia. Bluesky no pudo usar su API de palabras clave por el error 403 y dependió de cuentas ya descubiertas. Pinterest, por usar una única consulta, no recopiló en absoluto material relacionado con código abierto.



