KEN’S CAT LOG

Noticias de IA de generación de imágenes y vídeo — 2026-09-07

El código cerrado anuncia un cambio de protagonismo: la retirada de la API de Sora2 (2026/9/24) y la evolución de GPT-6 Astra hacia un agente de propósito general. Mientras tanto, el ecosistema de código abierto de ComfyUI/MiniMax-H3/Qwen-Image-Edit se expande a diario y ya alcanza un nivel práctico incluso en GPU de consumo.

Últimas noticias de IA de generación de imágenes y vídeo — 7 de septiembre de 2026

Vaya semana, de verdad 🔥🔥 En el lado del código cerrado, "GPT-6 Astra" de OpenAI está ganando una valoración enorme, no solo como generador de imágenes y vídeo sino como un "agente que controla multitud de herramientas". En cambio, el hasta ahora rey "Sora 2" ha entrado inesperadamente en la recta final de su cierre de servicio (la web y la app terminaron el 26/4/2026, y la API también está prevista para cerrar por completo este mes, el 24/9/2026) 😱 Por otro lado, el bando de código abierto está avanzando de forma discreta pero intensísima: alrededor de ComfyUI, el ecosistema de "MiniMax-H3" y "Qwen-Image-Edit" incorpora piezas nuevas prácticamente cada día, y ya hemos llegado a una era en la que se puede generar vídeo en serio con GPU de consumo, incluso de AMD 🛠️✨ Además, hay una sensación común en todas las plataformas: si se descubre que algo ha sido generado por IA, la reacción puede ser muy dura. Las exigencias de etiquetado de autenticidad y las voces anti-IA están copando las publicaciones con más me gusta, algo que resultó realmente llamativo.

Entre plataformas 🌐

Plataforma por plataforma 📱

Reddit: las publicaciones de benchmarks de generación local en r/StableDiffusion y las listas de herramientas gratuitas de r/freetoolsAI (Deepany, Aifun, Perchance, etc.) destacan como información práctica favorable al código abierto. Mientras tanto, en r/aiwars se criticó la calidad de imágenes comerciales de IA de código cerrado para publicidad alimentaria (177 comentarios, https://www.reddit.com/r/aiwars/comments/1w69cdj/). Solo se utilizó un término de búsqueda, por lo que la recopilación se quedó en 12 hilos y no alcanzó el objetivo de 20.

X: se recopilaron 40 publicaciones, pero solo 4 estaban relacionadas con el tema 😅 (el resto era ruido de tendencias sobre fútbol, política o Croacia). Sin embargo, las cuatro elogiaban ampliamente a GPT-6 Astra y no había ninguna mención al código abierto. Predominó por completo el código cerrado.

YouTube: fue la plataforma con mayor volumen de información. En código cerrado destacaron el cierre de Sora2, GPT-6 Astra, la actualización Midjourney V7 (compatible con entrada de voz en japonés, https://www.youtube.com/watch?v=wFHlG7wcRUQ) y Google Nano Banana 2 (https://www.youtube.com/watch?v=nikIxHM_AQY). En código abierto, los protagonistas fueron Flux.2 (Dev/Klein con Apache 2.0, https://www.youtube.com/watch?v=ISRy5Skd04U) y Qwen-Image-Edit-2511 (muchos tutoriales de ComfyUI, https://www.youtube.com/watch?v=ScoIZYsoRwo). También hubo pruebas que ejecutan Wan2.2 y Hunyuan1.5 en GPU de consumo AMD (https://www.youtube.com/watch?v=a_xzC7ckwno).

Bluesky: estructura bipolar entre usuarios individuales que usan herramientas y grupos anti-IA. En código cerrado, fue popular el flujo de trabajo que combina Nano Banana (Gemini 3.1) y Kling 3.0 (https://bsky.app/profile/drewkav.bsky.social/post/3muubykpdfk2k), mientras que el anuncio del nuevo modelo Grok Imagine de xAI no obtuvo ningún me gusta. En código abierto hubo comentarios favorables a ComfyUI y usuarios de Stable Diffusion WebUI reForge con AMD ROCm. Las restricciones de API, con repetidos errores 403, dejaron la muestra en 11 publicaciones efectivas frente a un objetivo de 20.

Lemmy: la energía del código abierto fue abrumadora: solo !«メールアドレス» reunió 11 publicaciones de herramientas, como Viggle-Animate y la integración nativa de Trellis.2 + Pixal3D en ComfyUI. En código cerrado, el único tema sustancial fue la noticia de que Midjourney pasaría de la generación de imágenes al negocio de escáneres médicos por ultrasonido (puntuación máxima 73, https://techcrunch.com/2026/07/04/midjourney-wants-hollywood), reproducida en varias instancias. Resultó revelador que Lemmy no tuviera ni una sola noticia sobre Sora o Veo como tales.

Pinterest: se revisaron los 50 pines recopilados previamente por el worker. Allí, las infografías de rankings de herramientas comerciales de código cerrado —Veo, Sora, Runway, Kling, Pika, Adobe Firefly y otras— dominaron casi por completo. Las referencias al código abierto fueron prácticamente inexistentes, salvo "Amuse 3.0", que promocionaba la ejecución local. También fue llamativo que el contenido sobre preocupación por deepfakes y detección se haya consolidado como un género independiente.

Qué vigilar 👀

Recomendaciones 💡

  • Si existe un flujo de trabajo dependiente de Sora2, conviene crear ya un plan de migración a Kling 3.0 o Veo 3.1 antes del cierre de la API, el 24/9/2026.
  • Conviene seguir ComputerUse de GPT-6 Astra evaluándolo como herramienta de automatización de pipelines de producción, y no como IA generativa aislada.
  • Si se busca reducir costes, parece más rentable probar edición local con Qwen-Image-Edit + ComfyUI antes de decidir pagar por soluciones de código cerrado.
  • Para prepararse ante el riesgo de polémicas por falsos timelapses o edición con IA, conviene establecer de antemano reglas internas de divulgación sobre el uso de IA en contenido publicado.
  • El flujo de trabajo dividido Nano Banana (imagen fija) + Kling 3.0 (conversión a vídeo) ya ha sido valorado por varios creadores independientes, así que merece una prueba.
  • Conviene seguir vigilando la noticia del giro empresarial de Midjourney para comprobar si se produce una diversificación similar en otras empresas de código cerrado.

Calidad de los datos 📊

Ninguna plataforma alcanzó por completo los criterios de finalización de brief.md, que pedían analizar unas 20 publicaciones por red social 😅 En especial, X solo produjo 4 publicaciones relevantes de 40 recopiladas: los términos de búsqueda procedían de tendencias regionales de Croacia y estaban llenos de ruido de fútbol y política. Bluesky también se quedó en 11 casos efectivos, porque las limitaciones 403 de la API pública hicieron que casi la mitad de los términos probados no devolvieran resultados. Reddit se limitó a 12 hilos por haber usado un único término de búsqueda; Lemmy sumó 15 casos, 11 de código abierto y 4 de código cerrado, debido a que ni siquiera existe una comunidad especializada en noticias. YouTube completó 11 vídeos siguiendo el criterio de su playbook, de 5 a 12 vídeos, pero no fue posible obtener metadatos como las visualizaciones debido al renderizado mediante JS. Solo Pinterest permitió revisar los 50 elementos recopilados previamente por el worker, aunque, al proceder de una sola consulta, apenas aparecieron pines de código abierto. En conjunto, aunque las cantidades no alcanzaron el objetivo, seis plataformas corroboran de forma independiente la misma dirección —GPT-6 Astra, el final de Sora2 y la expansión del ecosistema ComfyUI—, por lo que el panorama general debería ser suficientemente fiable 🙆

Resumen por plataforma

Reddit

Reddit — Noticias de IA de generación de imágenes y vídeo

Dónde

12 hilos recopilados en 11 subreddits mediante el término de búsqueda "Image and Video Generation AI News".

Subreddit Miembros Hilos recopilados
r/antiai 316,504 1
r/generativeAI 151,065 2
r/freetoolsAI 7,817 1
r/StableDiffusion 1,001,556 1
r/teenagers 3,675,063 1
r/aiwars 166,920 1
r/RemoteWorkers 74,882 1
r/aislop 82,721 1
r/TopAITools4U 2,396 1
r/GoogleFlow 1,750 1
r/EyesWideShut 15,320 1

La composición de subreddits está dividida casi a partes iguales entre comunidades especializadas que tratan la generación por IA en sí misma (r/StableDiffusion, r/generativeAI, r/GoogleFlow, r/TopAITools4U, r/freetoolsAI) y comunidades opuestas o críticas con las imágenes de IA (r/antiai, r/aiwars, r/aislop, r/EyesWideShut, r/teenagers). r/RemoteWorkers corresponde a una mención en el contexto de un anuncio de empleo.

Lo que dice la gente
  • Hilo n.º 1 r/antiai · 6.792 pt · 994 comentarios · 2026-09-05 — "Warning: There is a new form of ai generated image". La publicación afirma que, en vez de usar modelos de difusión, se puede hacer que un LLM —identificado como GPT-6— controle ratón y teclado para falsificar una "ilustración auténtica" acompañada incluso de un timelapse de apariencia dibujada a mano. Alcanzó 994 comentarios. Comentario principal (2.483 pt, u/Nayutantantan): "Even though i stopped using social media, stopped being an artist online... now the trends of creating fake timelapses are getting common." También se apoyó ampliamente la exigencia de "hacer obligatorio el etiquetado de inmediato" (u/Soggy_Supermarket100, 170 pt).

  • Hilo n.º 5 r/teenagers · 7 pt · 41 comentarios · 2026-08-31 — "To all AI image/video generator users". Su tesis sostiene que "la IA solo ejecuta tu idea, pero quien realmente dibuja es la propia IA". u/LiterallyGarbage_0 (5 pt): "if you want to make art, pick up a pencil and start drawing". En cambio, u/TheDarkmoore (2 pt) defendió su uso práctico: había usado IA para el arte de un juego de cartas porque, al dibujar mal, era una opción necesaria. Las opiniones están divididas incluso dentro de la misma generación.

  • Hilo n.º 6 r/aiwars · 4 pt · 177 comentarios · 2026-09-03 — "Even a lot of Pros here will admit that current AI models suck at generating appetizing images of food". El debate alcanzó unos destacados 177 comentarios. u/Your-local-enjoyer (9 pt) afirmó que tomar una fotografía real ofrece expectativas más precisas a los clientes. Como contraargumento, u/Bassed_Hummble (5 pt) presentó un prompt concreto que generó en 40 segundos con Krea 2 local y dijo haber conseguido un "burrito de desayuno apetitoso"; también apareció la idea de que el problema es el prompt, no el modelo.

  • Hilo n.º 4 r/StableDiffusion · 31 pt · 10 comentarios · 2026-09-03 — "VPIPE: Not Just Video — Local Image Generation Is Fast Too". Benchmark de generación local en Apple Silicon (M5 Pro de 24 GB) con krea/Krea-2-Turbo-M87 (16 bits) + LoRA M87: aproximadamente 45 segundos por imagen a 1024×1024 y 8 pasos; 35 segundos con cuantización a 8 bits en tiempo real. u/Glittering-Call8746 (1 pt) comentó que estaba examinando diferencias de velocidad entre M5 Max y M5 Pro, así como comparaciones con la serie RTX 5000.

  • Hilo n.º 11 r/GoogleFlow · 12 pt · 6 comentarios · 2026-09-01 — "AutoFlow just got continuous AI video generation". La extensión no oficial de Chrome "AutoFlow" para Google Flow/Veo añadió "Continue from Last Frame", que reutiliza automáticamente el último fotograma del clip anterior como inicio del siguiente para facilitar vídeos largos. El siguiente paso previsto es una función que renderice varios clips sin cortes en un solo vídeo.

  • Hilo n.º 10 r/TopAITools4U · 1 pt · 10 comentarios · 2026-09-01 — "Tested 4 best AI video generators in 2026 for beginners". La persona autora compara Sora 2 (cinematográfico, pero con precio y acceso como barreras), Kling AI (orientado a B-roll realista), DomoAI (animación y conversión de estilo) y Google Veo 3.1 (genera vídeo y audio a la vez, con cuota gratuita). En comentarios, u/brarkaddy (2 pt) menciona la generación de vídeo gratuita de Qwen como posible alternativa.

  • Hilo n.º 3 r/freetoolsAI · 38 pt · 45 comentarios · 2026-09-04 — "Free AI Image Generator". En respuesta a la presentación de aifreeforever.com, que promete uso gratis, ilimitado y sin registro, u/Odd-Lingonberry1516 (3 pt) enumera alternativas: Deepany (familias z-image turbo/illustrious), Aifun (wai illustrious y dos usos diarios de vídeo gratuitos) y Perchance (familias Stable Diffusion/flux). u/Relevant_Syllabub895 (2 pt) se quejó de las restricciones NSFW.

  • Hilo n.º 2 r/generativeAI · 43 pt · 29 comentarios · 2026-08-31 — "List of daily AI video generative websites". u/Jenna_AI (4 pt, bot de IA) detalla la cuota gratuita de Kling AI: 66 créditos gratis cada 24 horas, equivalentes a entre 2 y 6 vídeos de cinco segundos al día. u/Julia_Leeds94 (2 pt) presenta YalleryLabs: con un presupuesto de 3 dólares, el vídeo de cinco segundos a 720p cuesta 0,18 dólares por unidad.

  • Hilo n.º 12 r/EyesWideShut · 35 pt · 9 comentarios · 2026-09-06 — "AI generated images shouldn't be allowed here". A raíz de una publicación que procesó con IA una captura de una película de Kubrick, se acusó a la persona autora de difundir desinformación. Quien hizo la edición, u/ffcc01 (2 pt), respondió que "solo superpuso dos fotos y no alteró el contenido". La comunidad se dividió sobre los límites admisibles de la edición con IA.

  • Hilo n.º 8 r/RemoteWorkers · 130 pt · 623 comentarios · 2026-09-04 — "Get Paid $30/Hour Reviewing AI-Generated Images". Anuncio de empleo para verificar datos de subtítulos generados por IA —detección de objetos, colores y texto mal identificados— por 30 dólares la hora. Aunque cuenta con 623 comentarios, la mayoría son repeticiones de una sola palabra, "images", buscando el enlace para aplicar; no hubo una discusión sustancial.

  • Hilo n.º 9 r/aislop · 37 pt · 4 comentarios · 2026-09-06 — "Saw this on a news article, an AI slop image explaining what is AI slop". Una imagen generada por IA que explicaba qué es el "AI slop", incluida en un artículo de noticias, fue recogida como una broma autorreferencial. Solo hubo cuatro comentarios y no se profundizó en el tema.

Señales
  • Tendencia al alza: los informes de implementación de generación local y de código abierto, como VPIPE/Krea 2 del hilo n.º 4, son bien recibidos cuando incluyen benchmarks concretos: segundos, pasos y hardware. En r/StableDiffusion, velocidad y calidad son los criterios de valoración.
  • Tendencia al alza: las exigencias de etiquetado de autenticidad para materiales generados por IA (hilo n.º 1) recibieron un apoyo intenso a escala de 994 comentarios, y el "fraude de timelapse" se señaló explícitamente como nueva preocupación.
  • Minimizado o recibido con burla: las imágenes comerciales de IA de código cerrado, especialmente para publicidad alimentaria, se tratan incluso en r/aiwars como de una calidad difícil de defender (hilo n.º 6). El debate de 177 comentarios se inclinó casi por completo hacia la crítica.
  • Hallazgo inesperado: en muchos hilos, los bots de IA fueron quienes sostuvieron la conversación práctica; u/Jenna_AI apareció tanto en los hilos n.º 2 como n.º 7. Más que debates profundos entre personas, el principal valor se concentró en información práctica, como listas de cuotas gratuitas.
  • Conflicto: en el hilo n.º 12 (EyesWideShut), el grupo que considera que "edición con IA = alteración y desinformación" y el que sostiene que "una simple composición no cambia el contenido" chocan frontalmente. No hay consenso claro sobre el límite aceptable de la edición con IA.
  • Hallazgo inesperado: el hilo n.º 8 tuvo la mayor interacción de la muestra, con 623 comentarios, pero casi todos eran mensajes de una palabra para obtener el enlace de empleo. Es un caso típico de cómo una cifra alta de comentarios no implica profundidad de debate.
Límites
  • Solo se utilizó el término de búsqueda "Image and Video Generation AI News"; no se hicieron búsquedas adicionales con "open source image generation", "closed source video AI" o servicios concretos como Midjourney, Sora y Kling. Por ello, los datos están sesgados hacia los temas que coincidieron con una consulta genérica.
  • Frente al criterio de finalización de brief.md —analizar unas 20 publicaciones por red social— solo se recopilaron 12 hilos, por debajo del objetivo.
  • Los hilos n.º 7 y n.º 9 tienen únicamente 1 y 4 comentarios respectivamente; en algunos casos solo hubo una respuesta de bot, como u/Jenna_AI, por lo que hay poco material para un análisis profundo.
  • El periodo de recopilación abarca aproximadamente una semana, del 31/8/2026 al 6/9/2026, y no permite comparar con tendencias previas.
  • Son limitados los hilos que se pueden clasificar claramente por el eje código cerrado/código abierto: tendencia a código cerrado: n.º 6, n.º 10 y n.º 11; tendencia a código abierto: n.º 3 y n.º 4. Para cumplir las diez observaciones de cada tipo del informe final habría que complementarlos con datos de otras plataformas.

X

X — Noticias de IA de generación de imágenes y vídeo

Cuentas

De las 40 publicaciones y 37 cuentas recopiladas, solo las cuatro cuentas siguientes estaban realmente relacionadas con el tema de la IA de generación de imágenes y vídeo. Todas son cuentas personales con una sola publicación cada una; no son grandes cuentas especializadas en viralidad, sino personas que comparten experiencia directa con las herramientas.

Cuenta Nombre Publicaciones Me gusta Perfil
@aigeboku AI様の下僕 1 1,281 Persona que prueba usos de ComputerUse de GPT-6 Astra
@MiraMusic_AI MiraMusic 1 525 Cuenta que comparte producción de anime con IA
@manaimovie Mankyu 1 562 Creador individual de modelos 3D × vídeo de IA
@Yokohara_h Hirokazu Yokohara 1 2,156 Mayor respuesta de las cuatro cuentas; perfil técnico individual

Las otras 33 cuentas —encabezadas por @kaihavertz29, con 96.184 me gusta, e incluyendo perfiles sobre fútbol, F1, política alemana, bitcoin y Bosnia— no guardaban relación con el tema. Véase "Límites" más abajo.

Publicaciones
  • n.º 29 @aigeboku (2026-09-05 · 1.281 me gusta · 135 reposts · 14 respuestas · unas 94.000 visualizaciones) https://x.com/aigeboku/status/2096187322924687799 — "GPT-6 Astra, tal como se dice, es muy capaz de controlar otras cosas; con ComputerUse se amplía muchísimo lo que se puede hacer 😎🙌". Valora GPT-6 Astra no por generar imagen o vídeo en sí, sino como base para controlar otras aplicaciones.

  • n.º 30 @MiraMusic_AI (2026-09-06 · 525 me gusta · 50 reposts · 6 respuestas · unas 26.000 visualizaciones) https://x.com/MiraMusic_AI/status/2096441679847006358 — "【Compartiendo producción de anime con IA, parte 1】¡Intenté crear una ciudad con GPT-6 Astra y Blender! Es un vídeo que hice en 15 minutos, así que quizá no se aprecia bien...". Ejemplo de producción de arte de fondo usando GPT-6 Astra junto con Blender.

  • n.º 31 @manaimovie (2026-09-05 · 562 me gusta · 61 reposts · 19 respuestas · unas 35.000 visualizaciones) https://x.com/manaimovie/status/2096176821377380677 — "Le di a Astra un modelo hecho con Tripo y le pedí que lo animara; esto es lo que consiguió. Aún hay muchos puntos que me preocupan, pero es mucho mejor que con Fable o Sol". Compara explícitamente Astra con herramientas similares, Fable y Sol, y valora su superioridad.

  • n.º 32 @Yokohara_h (2026-09-06 · 2.156 me gusta · 299 reposts · 19 respuestas · unas 178.000 visualizaciones; la mayor respuesta de las cuatro) https://x.com/Yokohara_h/status/2096622171011666003 — "Le das una imagen y modela automáticamente una ciudad de fondo en Blender, además de editar automáticamente el breakdown. El resultado aún está lejos de ser bueno, pero por primera vez siento el comienzo de una época en la que el 3DCG no se crea manualmente". Aunque reconoce que la calidad todavía está en desarrollo, valora el cambio de época hacia la producción de 3DCG sin intervención manual.

Fuera de estas cuatro, ninguna de las 40 publicaciones recopiladas mencionaba IA de generación de imágenes o vídeo, ni de código cerrado ni de código abierto.

Señales
  • Tendencia al alza: GPT-6 Astra, de código cerrado, llama la atención por su papel de "controlar otras herramientas" —ComputerUse e integración con Blender—. Su rasgo distintivo es que se describe como hub que automatiza todo el pipeline de producción 3DCG, y no como un modelo aislado de imagen o vídeo (n.º 29, n.º 30 y n.º 32).
  • Hallazgo inesperado: las cuatro personas lo valoran positivamente, aunque todas añaden reservas como "el resultado aún es tosco" o "hay muchos puntos que preocupan". Coexisten expectativas elevadas y una evaluación sobria de la calidad (n.º 31 y n.º 32).
  • Sin atención ni menciones: no hubo ni una referencia a IA de generación de imágenes o vídeo de código abierto —familia Stable Diffusion, Krea, Kling o Veo— en esta recopilación. Las voces relacionadas con el tema en X se concentraron por completo en GPT-6 Astra de código cerrado.
  • Herramientas mencionadas como comparación: "Fable" y "Sol" (n.º 31). La publicación no explica sus detalles y requieren investigación adicional.
  • Frente a las tendencias ajenas al tema —fútbol: hasta 96.184 me gusta; política: 10.062, entre otras—, la interacción fue reducida incluso en el máximo de 2.156 me gusta. No se puede afirmar que el tema esté siendo viral en X por ahora.
Límites
  • Los términos de búsqueda no coincidían con el tema: las consultas de esta ronda —Arsenal, Kimi, Charles, Chelsea, Harvey, Germany, $SONG, Astra, Bitcoin y Bosnia— se tomaron directamente de las tendencias de X Explore. Salvo "Astra", se referían a fútbol, F1, personas y cumpleaños, política alemana, criptomonedas o conversaciones sobre Bosnia, no a IA de generación de imágenes y vídeo. 36 de las 40 publicaciones eran ruido ajeno al tema; las cuatro sobre "Astra" fueron las únicas pistas útiles.
  • Criterio de finalización no alcanzado: frente al objetivo de brief.md de unas 20 publicaciones por red social, solo se recopilaron cuatro relacionadas con el tema.
  • Regionalidad de Explore: la columna "Where" indicaba que "$SONG" y "Bosnia" eran "Trending in Croatia". Por ello, esta lista no representa tendencias globales, sino tendencias regionalizadas para Croacia o los Balcanes. Además, la columna "Posts on X" estaba vacía en todos los casos, por lo que no se pudo obtener el volumen de publicaciones desde X.
  • No se encontraron movimientos de código abierto en X: esta recopilación no halló ninguna publicación sobre IA de generación de imágenes o vídeo de código abierto. Debe complementarse con datos de otras plataformas, como Reddit.
  • Las cuatro publicaciones relevantes pertenecen a cuentas en japonés; no se recopilaron reacciones de comunidades en inglés, chino u otros idiomas.

YouTube

YouTube — Noticias de IA de generación de imágenes y vídeo

Canales
Canal Tipo Contenido tratado
AI大学【AI&ChatGPT最新情報】 Japonés, explicativo Vídeos sobre los últimos modelos de IA, incluido GPT-6 Astra
まさおAI じっくり解説ch Japonés, explicativo Pruebas prácticas y reseñas de modelos de IA
RKJ VIDEO【イケている動画を作りたいなら】 Japonés, especializado en IA de vídeo Comparativas de IA de vídeo como Sora/Veo/Kling
AI収益化ラボ Japonés, monetización Impacto de herramientas de IA y de cierres de servicios
StableDiffusion等 チュートリアル&自作アニメ Japonés, originalmente especializado en código abierto Originalmente tutoriales de Stable Diffusion; también ha empezado a cubrir noticias de código cerrado como el final de Sora2
AIたろう Japonés, explicativo Explicaciones de funciones de IA de imagen como Midjourney
Teacher's Tech Inglés, explicativo Reseñas de herramientas de Google y funciones de IA; canal tecnológico de tamaño medio
OpenArt Inglés, orientado a producto oficial Vídeos de presentación como interfaz para modelos como Flux.2
Donato Capitella Inglés, técnico Pruebas de generación abierta de imágenes y vídeo con GPU locales, incluidas AMD
ErrorFixer Inglés, tutoriales Tutoriales de operación de modelos abiertos en ComfyUI
AI Search Inglés, reseñas Reseñas rápidas de nuevas herramientas de generación de imágenes y vídeo

El número de suscriptores se encuentra en la parte renderizada con JS de cada página de vídeo. No fue posible obtenerlo mediante WebFetch de youtube.com/watch ni de youtube.com/results (véase "Límites"). Aquí solo se incluye lo que pudo confirmarse mediante snippets de búsqueda y oEmbed, una API ligera que devuelve título y nombre de canal.

Vídeos
  • "OpenAIの最新AIモデル『GPT-6 Astra』徹底解説!ほぼ全てのベンチマークでClaude Fable 5.1超え、史上最も賢く安全" — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=jtavLwXCZeQ — Afirma que GPT-6 Astra, publicado el 3/9/2026, supera a Claude Fable 5.1 en casi todos los benchmarks y es el modelo más inteligente y seguro de la historia. Enfatiza su desempeño como agente general —operación de navegador y generación de código— más que la generación de imagen y vídeo en sí.

  • "【現環境最強】『GPT-6 Astra』を実際に使ってきた結果、最もAGIに近いモデルと感じたので解説" — まさおAI じっくり解説ch — https://www.youtube.com/watch?v=_pAAaBv_G7A — Tras usarlo personalmente, lo califica como "el modelo actualmente más cercano a la AGI". Valora mucho su capacidad ComputerUse para controlar otras aplicaciones, en línea con la valoración de GPT-6 Astra observada en X.

  • "VEO 3.1とSORA2どっちがすごい?最新比較!" — RKJ VIDEO【イケている動画を作りたいなら】 — https://www.youtube.com/watch?v=JuGPYl0V9UA — Compara Veo 3.1, publicado el 15/10/2025, y Sora 2 por funciones y calidad visual. Se publicó justo después del lanzamiento de Sora 2, aproximadamente en octubre de 2025, por lo que queda fuera de la ventana de 60 días; se incluyó como contexto para las noticias posteriores sobre el cierre de Sora2.

  • "Sora2完全終了…なぜ突然消えたのか?公式情報で徹底解説" — StableDiffusion等 チュートリアル&自作アニメ — https://www.youtube.com/watch?v=DSfAZdE5rWA — Explica, basándose en información oficial, el final de Sora 2: web y app el 26/4/2026, y API el 24/9/2026, tres semanas después de la fecha del informe. Menciona como posible motivo la necesidad de reservar recursos de cómputo para el desarrollo de AGI.

  • "【サービス終了】世界一の動画生成AI『Sora2』が使えなくなったので解説します" — AI収益化ラボ — https://www.youtube.com/watch?v=YHPmaUb_X6c — Explica el impacto del final de Sora2 en creadores que monetizaban contenido. Menciona la exportación de datos en sora.chatgpt.com/sunset y la necesidad de migrar APIs a Kling, Runway u otras alternativas.

  • "Midjourney がV7にアップデート!使い方から新機能まで完全解説します!日本語音声入力も可能に。" — AIたろう — https://www.youtube.com/watch?v=wFHlG7wcRUQ — Explica las nuevas funciones de Midjourney V7: herramienta de generación de vídeo, modo conversación y entrada de voz en japonés. Muestra cómo un referente histórico de generación de imágenes incorpora funciones de texto a vídeo.

  • "The New Gemini Image Generator is Insane (Nano Banana 2)" — Teacher's Tech — https://www.youtube.com/watch?v=nikIxHM_AQY — Prueba "Nano Banana 2", la función de generación de imágenes Gemini de Google, y la considera una mejora importante respecto a la generación anterior. Ilustra cómo el eje competitivo de la generación de imágenes de código cerrado se está ampliando de Midjourney/Ideogram hacia Google Gemini.

  • "FLUX.2 Has Landed On OpenArt!" — OpenArt — https://www.youtube.com/watch?v=ISRy5Skd04U — Presenta la disponibilidad de la familia Flux.2 de Black Forest Labs —Pro/Flex/Dev/Klein, anunciada el 25/11/2025— en OpenArt. Destaca que Dev/Klein son pesos abiertos bajo Apache 2.0 y admiten diez imágenes de referencia y edición de 4 MP.

  • "Video and Image Generation on AMD R9700 AI PRO (Qwen Image, Wan 2.2, Hunyuan 1.5)" — Donato Capitella — https://www.youtube.com/watch?v=a_xzC7ckwno — Prueba conjuntamente tres modelos abiertos —Qwen Image, Wan 2.2 y Hunyuan 1.5— en una GPU AMD de consumo, R9700 AI PRO. Indica que la generación abierta de imagen y vídeo está dejando de depender exclusivamente de equipos NVIDIA de gama alta.

  • "Edit Any Image with Text in ComfyUI — Qwen Image Edit 2511 (Free Local Tutorial 2026)" — ErrorFixer — https://www.youtube.com/watch?v=ScoIZYsoRwo — Tutorial para operar localmente en ComfyUI Qwen-Image-Edit-2511, modelo abierto de edición de imágenes de Alibaba lanzado el 26/12/2025. Demuestra edición mediante instrucciones de texto y generación multiángulo.

  • "This new AI image editor is a BEAST. Qwen Image Edit tutorial" — AI Search — https://www.youtube.com/watch?v=WOcxMUwKWIk — También prueba Qwen-Image-Edit, con 20.000 millones de parámetros y soporte nativo de ControlNet, y lo valora como capaz de competir con herramientas de edición de código cerrado.

Señales
  • El mayor tema de código cerrado es GPT-6 Astra, publicado el 3/9/2026: se presenta no como un modelo aislado de generación de imagen y vídeo, sino como agente de propósito general capaz de controlar navegador y aplicaciones mediante ComputerUse, así como de realizar tareas de edición de vídeo. Coincide con la tendencia observada en X, donde se valora como hub de producción para integración con Blender y otros usos, lo que confirma la misma narrativa en varias plataformas.
  • El final de Sora 2 es una de las principales noticias de la generación de vídeo de código cerrado: la web y app acabaron el 26/4/2026, y la API está prevista para cerrar el 24/9/2026, dentro de tres semanas. Varios canales tratan tanto el motivo del cierre como el destino de las migraciones; el interés se ha desplazado de las novedades de Sora2 a qué hacer después de su final.
  • Kling compite por ocupar el lugar sucesor de Sora2: Kling 2.6, de 3/12/2025, añadió sincronización de audio, y Kling 3.0, de 4/2/2026, avanzó a 4K60fps y multishot. Se menciona explícitamente como destino de migración tras la retirada de Sora2.
  • Qwen-Image-Edit es ahora la figura principal de la edición de imágenes de código abierto: los tutoriales relacionados con ComfyUI aparecen frecuentemente, incluso en series de varios canales, y tienen más presencia que tutoriales nuevos de Stable Diffusion por sí solo. Los resultados de Stable Diffusion se limitan a guías habituales de instalación y listas de modelos, con poca novedad informativa.
  • La generación abierta de vídeo se está ordenando en tres familias: Wan 2.2 de Alibaba bajo Apache 2.0; HunyuanVideo 1.5 de Tencent; y LTX-2 de Lightricks, publicado el 6/1/2026, primer modelo abierto que admite generación simultánea de audio y vídeo, con 4K/50fps. Durante la búsqueda se encontraron varias páginas que afirmaban que se habían publicado pesos abiertos de "Wan 2.7", pero no existen en HuggingFace ni GitHub oficiales de Wan-AI; se consideraron información falsa orientada a SEO. La versión abierta oficial más reciente de Wan es 2.2.
  • Se están cruzando las audiencias de los canales: el canal "StableDiffusion等 チュートリアル&自作アニメ", originalmente dedicado a tutoriales de Stable Diffusion, también cubre el final de Sora2 de código cerrado. Esto sugiere que su audiencia está empezando a interesarse por ambos lados, abierto y cerrado.
Límites
  • Tanto youtube.com/results como youtube.com/watch se renderizan en el cliente con JavaScript; WebFetch solo devolvía enlaces de navegación del pie de página, sin poder leer directamente títulos, canales, visualizaciones ni fechas. El descubrimiento de vídeos dependió de una combinación de snippets de WebSearch y la API oEmbed de YouTube, que solo devuelve título y canal.
  • Debido a esa limitación, no se pudieron obtener con precisión las visualizaciones ni fechas de publicación de casi todos los vídeos. Para evitar inventar datos, el informe no incluye visualizaciones. Las fechas solo se indican cuando pueden inferirse de snippets de búsqueda o de fechas públicas de lanzamiento de modelos.
  • La instrucción del playbook de priorizar vídeos subidos dentro de los 60 días no pudo aplicarse de forma estricta. El vídeo comparativo VEO3.1 × SORA2, que parece publicado alrededor de octubre de 2025 justo tras el lanzamiento de Sora 2 y supera la ventana de 60 días, se incluyó como único antecedente de las noticias de cierre de Sora2.
  • El criterio de brief.md de unas 20 publicaciones por red social no coincide formalmente con el criterio del playbook de YouTube, de 5 a 12 vídeos. Esta etapa se consideró completa siguiendo el criterio de este último.
  • El contenido de comentarios solo pudo verificarse cuando aparecía en snippets de WebSearch; no se realizó una lectura detallada de comentarios destacados ni análisis de sentimiento.
  • No se incluyeron canales en chino. Qwen, de Alibaba, y Kling, de Kuaishou, son modelos de origen chino; las reacciones de comunidades chinas no se reflejan en el informe.

Bluesky

Bluesky — Noticias de IA de generación de imágenes y vídeo

Cuentas

Se buscó "Stable Diffusion", "Sora 2", "Midjourney", "Grok Imagine", "ComfyUI", "Veo 3" y "Nano Banana" con la API pública de Bluesky (https://api.bsky.app/xrpc/app.bsky.feed.searchPosts) y se extrajeron las cuentas que realmente hablaban de IA de generación de imágenes o vídeo.

Cuenta Perfil Relación con el tema
@xai-bot.bsky.social Bot oficial de xAI Anuncia información sobre el nuevo modelo Grok Imagine de código cerrado
@codename.cc Bot rastreador de actualizaciones de apps Anuncia actualizaciones de la función Imagine en la app de Grok para iOS
@drewkav.bsky.social Artista individual Comparte creaciones que combinan Gemini 3.1 Nano Banana 2 y Kling 3.0
@triflingtree.bsky.social Artista individual Publica obras realizadas con Nano Banana Pro
@gentile-of-hope.bsky.social(希望の異邦人) Persona individual, crítica de la IA generativa Crítica ética y ambiental de generación de imágenes con Stable Diffusion/ChatGPT/Gemini
@samperson.bsky.social Persona individual, lado artístico Difunde apoyo a la postura anti-IA generativa de Procreate
@ecutruin.bsky.social Persona que practica generación local Señala ventajas funcionales de herramientas locales como ComfyUI
@digitalhowl.bsky.social(Fenris) Creador individual de vídeo Comparte producción profesional de vídeo con ComfyUI + Minimax H3
@kerzefasta.bsky.social Ilustrador individual de fanart Publica continuamente personajes de Kantai Collection con Stable Diffusion WebUI reForge y ROCm; fue quien obtuvo más me gusta en esta búsqueda
@aichina.news Bot automatizado Publica masivamente LoRA basados en FLUX bajo Apache-2.0. Interacción casi nula

En conjunto, quienes publican realmente sobre el tema en Bluesky no son medios de noticias, sino dos polos: personas que utilizan las herramientas —creadores individuales— y personas críticas con la IA generativa. No aparecieron cuentas especializadas ni subcomunidades como las encontradas en X o Reddit.

Publicaciones
  • @xai-bot.bsky.social (2026-09-05 · 0 me gusta) https://bsky.app/profile/xai-bot.bsky.social/post/3mus2woiczo2w — "Grok Imagine Video 1.5 agent is now available. Powered by our newest Image 2.0 model...". Anuncio de la cuenta oficial de xAI para un nuevo agente de vídeo Grok Imagine de código cerrado. No tuvo me gusta ni reposts visibles en este rango de búsqueda.

  • @codename.cc (2026-09-06 · 0 me gusta) https://bsky.app/profile/codename.cc/post/3muspbmaiq22n — "SHIPPED: Grok iOS updated to 1.4.33 with improvements to Chat, Voice and Imagine features.". Registro de actualización de una cuenta personal que rastrea cambios en aplicaciones.

  • @drewkav.bsky.social (2026-09-06 · 9 me gusta) https://bsky.app/profile/drewkav.bsky.social/post/3muubykpdfk2k — En una obra titulada "Persistent Dream", especifica que creó la imagen fija con Gemini 3.1 Nano Banana 2 y la convirtió en vídeo con Kling 3.0. Ejemplo de flujo de trabajo que combina dos soluciones de código cerrado, Google × Kling.

  • @triflingtree.bsky.social (2026-09-06 · 15 me gusta · 1 repost) https://bsky.app/profile/triflingtree.bsky.social/post/3mutz2tm3bc2m — Publicación de una "madre e hijo extraterrestres" de estilo bizantino creada con Nano Banana Pro. Fue la publicación relacionada con Nano Banana con más me gusta de la muestra.

  • coah80.com (2026-09-06 · 0 me gusta) https://bsky.app/profile/coah80.com/post/3muulvyomz72c — "SORA 2 WAS GENUINELY SO BAD HOWD WE CALL THIS GOOD". Crítica severa a Sora 2 de código cerrado, coherente con el ambiente negativo asociado a su retirada de web/app el 26/4/2026 y de la API el 24/9/2026, confirmado en YouTube.

  • @gentile-of-hope.bsky.social (2026-09-05 · 100 me gusta · 42 reposts) https://bsky.app/profile/gentile-of-hope.bsky.social/post/3murgar5zys2j — "No solo Stable Diffusion: las funciones de generación de imágenes de IA como ChatGPT y Gemini se sostienen sobre una extracción de datos no ética y a gran escala. (...) La generación de imágenes consume enormes cantidades de electricidad y agua, y destruye el medio ambiente." Fue la publicación con más me gusta de las recopiladas por búsqueda, y la crítica a la IA generativa en sí —abierta o cerrada— obtuvo la mayor interacción.

  • @samperson.bsky.social (2026-09-05 · 121 me gusta · 11 reposts) https://bsky.app/profile/samperson.bsky.social/post/3muruvekma22b — Difusión de apoyo a la política anti-IA generativa de Procreate, una aplicación de ilustración. Fue la publicación con mayor número de me gusta de toda la recopilación.

  • @ecutruin.bsky.social (2026-09-06 · 1 me gusta) https://bsky.app/profile/ecutruin.bsky.social/post/3muv2pwq55s2t — "local software like ComfyUI has more features than the majority of hosted solutions". Comentario favorable que valora específicamente la superioridad funcional del entorno local de código abierto.

  • @digitalhowl.bsky.social (2026-09-06 · 0 me gusta) https://bsky.app/profile/digitalhowl.bsky.social/post/3muuu24tqf22g — Afirma utilizar ComfyUI y Minimax H3 para "professional grade video work". Ejemplo de operación híbrida que combina una base de código abierto con modelos comerciales.

  • @kerzefasta.bsky.social (2026-09-05–06 · varias publicaciones, hasta 29 me gusta y 10 reposts) https://bsky.app/profile/kerzefasta.bsky.social/post/3muroxdlm4k2j — Publica de forma continua ilustraciones de personajes de Kantai Collection usando Stable Diffusion WebUI reForge con ROCm y GPU AMD. No es contenido noticioso, pero fue la cuenta que reunió más interacción sostenida en la búsqueda de "Stable Diffusion".

  • @aichina.news (2026-09-06 · 0 me gusta; más de 20 publicaciones similares por hora) https://bsky.app/profile/aichina.news/post/3muup3wwiad2i — "Apache-2.0 LoRA for Flux, small enough to drop into ComfyUI or Diffusers". Bot que publica mecánicamente numerosos LoRA FLUX para Huawei Ascend/Modelers.cn, anunciando lanzamientos sin palabras de activación ni ejemplos. Aumenta el volumen de resultados relacionados con código abierto, pero no genera conversación real.

Señales
  • Código cerrado: Nano Banana —Gemini 3.1/Nano Banana Pro— es el nombre más frecuente en la producción práctica de creadores individuales, y varias publicaciones confirman un flujo de trabajo repartido: Nano Banana para imagen fija y otra herramienta, Kling 3.0, para convertirla en vídeo.
  • Código cerrado: la cuenta oficial anunció nuevos modelos Grok Imagine, Video 1.5 e Image 2.0, pero no obtuvo me gusta ni reposts en el rango de búsqueda. Los anuncios tipo comunicado de prensa parecen quedar enterrados en Bluesky.
  • Código cerrado: las únicas menciones a Sora 2 fueron críticas, como "SORA 2 WAS GENUINELY SO BAD"; no se encontraron publicaciones de defensa. Coincide con la secuencia de cierre observada en YouTube.
  • Código abierto: los usuarios que realmente usan ComfyUI valoran de manera concreta que las herramientas locales disponen de más funciones que los servicios alojados, con una opinión favorable.
  • Código abierto/ruido: la mayoría de resultados al buscar palabras como "Stable Diffusion" y "Flux" se concentraron en tres grupos: 1) fanart de Kantai Collection y similares; 2) publicaciones con enlaces externos a contenido NSFW; y 3) bots sin interacción que anuncian LoRA, como @aichina.news. Las conversaciones de carácter noticioso fueron muy escasas.
  • El principal eje de interacción es la crítica a la IA generativa: las dos publicaciones con más me gusta de la muestra, 121 y 100, criticaban o rechazaban la IA generativa, sin distinguir imagen de vídeo. Superaron ampliamente las publicaciones sobre uso de herramientas, cuyo máximo fue 15 me gusta. La base de usuarios de Bluesky parece dar más fuerza a voces anti-IA generativa que X o Reddit.
Límites
  • Restricciones de API: el endpoint de public.api.bsky.app devolvió 403 —acceso denegado— en todas las solicitudes. api.bsky.app funcionó como alternativa, pero aplicar varias consultas nuevas en poco tiempo desencadenaba frecuentemente límites de tasa 403. Cerca de la mitad de los términos probados —"Kling AI", "Wan2.2", "HunyuanVideo", "Qwen Image", "Krea" y "Sora shutdown", entre otros— no devolvieron datos ni una vez.
  • No se pudo obtener la interfaz web: bsky.app/search es una SPA renderizada con JavaScript y WebFetch no pudo recuperar el texto de las publicaciones, solo el metatítulo. La búsqueda dependió en la práctica de los resultados de la API.
  • Cantidad insuficiente: frente al objetivo de unas 20 publicaciones analizadas, solo se pudieron verificar aproximadamente 11. Los resultados de la API incluían mucho ruido irrelevante —por ejemplo, "Sora" como personaje de Kingdom Hearts o bots de agregación de hashtags—, y el número real de publicaciones pertinentes fue aún menor.
  • Límites de los indicadores de interacción: la API pública de Bluesky devuelve me gusta, reposts y respuestas, pero no visualizaciones o impresiones como X. Se desconoce por tanto el alcance real de las publicaciones.
  • Fallo al obtener detalles: al intentar recuperar individualmente el texto completo de la publicación de samperson.bsky.social mediante app.bsky.feed.getPostThread, se produjo un error 400. No fue posible confirmar más allá del snippet de los resultados de búsqueda, aunque el enlace está indicado.
  • Sesgo de cuentas: las publicaciones encontradas se concentraron en cuentas específicas —fanart de Kantai Collection de @kerzefasta.bsky.social y anuncios automatizados de LoRA de @aichina.news—, por lo que difícilmente representan una base amplia de usuarios.

Lemmy

Lemmy — Tendencias recientes en IA de generación de imágenes y vídeo

Comunidades
  • !«メールアドレス» — 5.708 suscriptores y 1.386 publicaciones. Principal punto de concentración efectivo de IA de imagen y vídeo de código abierto: modelos, nodos de ComfyUI y LoRA. Se publican herramientas nuevas casi todos los días. https://lemmy.dbzer0.com/c/stable_diffusion
  • !«メールアドレス» — 2.361 suscriptores y 3.500 publicaciones. Espacio para obras hechas con Stable Diffusion y modelos de pesos abiertos; tiene poca relevancia noticiosa y funciona más como galería. https://lemmy.dbzer0.com/c/stable_diffusion_art
  • !«メールアドレス» — 4,82 K suscriptores, aproximadamente 1,8 K locales en lemmy.world. Trata IA libre y de código abierto en general, con pocas publicaciones específicas de generación de imagen y vídeo. https://lemmy.world/c/fosai
  • !«メールアドレス», !«メールアドレス» y !«メールアドレス» — Aquí aparecen noticias de empresas de IA de código cerrado, como Midjourney. No son comunidades especializadas en noticias de IA de imagen, sino comunidades tecnológicas o de noticias generales donde se publican de forma ocasional.
Publicaciones
Orientadas al código abierto, principalmente en !«メールアドレス»
  1. MiniMax-H3_Singularity — Modelo de fusión afinado para modelos de generación de vídeo de la familia MiniMax-H3. Puntuación 3, 2026-09-06. https://lemmy.dbzer0.com/post/75088455 (origen: https://huggingface.co/WarmBloodAban/Minimax-h3_Singularity)
  2. Qwen3.8-Flash-Next-NVFP4 — Versión cuantizada NVFP4 del modelo Qwen de NVIDIA. Puntuación 3, 2026-09-06. https://lemmy.dbzer0.com/post/75088454 (https://huggingface.co/nvidia/Qwen3.8-Flash-Next-NVFP4)
  3. ComfyUI-AetherScale — Nueva extensión para ComfyUI. Puntuación 5, 2026-09-05. https://lemmy.dbzer0.com/post/75036491 (https://github.com/vizart-vj/ComfyUI-AetherScale)
  4. Viggle-Animate — Modelo de edición de vídeo que sustituye un personaje dentro de un vídeo a partir de una única imagen repintada. Puntuación 9, la mayor del conjunto, 2026-09-05. https://lemmy.dbzer0.com/post/75036488 (https://huggingface.co/Viggle/Viggle-Animate)
  5. FastH3-Ref2V-Stream-Controller — Controlador de ComfyUI para generación continua de vídeo. Puntuación 2, 2026-09-04. https://lemmy.dbzer0.com/post/74988027 (https://github.com/EarthDefenceForces/FastH3-Ref2V-Stream-Controller)
  6. ComfyUI-Majoor-OmniCam — Herramienta de disposición y animación de cámara para ComfyUI. Puntuación 4, 2026-09-04. https://lemmy.dbzer0.com/post/74988020 (https://github.com/MajoorWaldi/ComfyUI-Majoor-OmniCam)
  7. H3-World — Presentado como el "primer modelo de mundo interactivo basado en MiniMax-H3". Puntuación 3, 2026-09-02. https://lemmy.dbzer0.com/post/74893520 (https://huggingface.co/DANNY621/H3-World)
  8. ComfyUI-MiniMaxH3-CLSS — Nodo que permite generación de vídeo con audio y duración arbitraria usando 16 GB de VRAM. Puntuación 0, 2026-09-01. https://lemmy.dbzer0.com/post/74843957 (https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS)
  9. Trellis.2 and Pixal3D Now Native in ComfyUI — Integración nativa de los modelos de generación 3D Trellis.2 y Pixal3D en ComfyUI. Puntuación 4, 2026-09-01. https://lemmy.dbzer0.com/post/74843948 (https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native)
  10. ComfyUI-DLSS5-NR — Soporte experimental en ComfyUI que emplea el renderizado neuronal de NVIDIA DLSS 5. Puntuación 2, 2026-09-01. https://lemmy.dbzer0.com/post/74843949 (https://github.com/lisitskyaa/ComfyUI-DLSS5-NR)
  11. LLaDA-Image — Artículo de investigación de generación de imágenes basada en difusión, publicado en arXiv. Puntuación 3, 2026-09-04. https://lemmy.dbzer0.com/post/74988021 (https://arxiv.org/abs/2609.03796)
Orientadas al código cerrado
  1. Midjourney pivots from AI image generation to body scanning medical spa — Se informó de que Midjourney pasaría de la generación de imágenes por IA al negocio de escaneo corporal médico por ultrasonido, "Midjourney Medical". Puntuación 58, 2026-06-18, !«メールアドレス». https://lemmy.zip/post/66397234 (artículo original: https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/)
  2. Midjourney AI pivots to Theranos: Ultrasonic CT — Comentario crítico sobre la misma noticia. Puntuación 40, 2026-06-19, !«メールアドレス». https://awful.systems/post/8731127 (https://pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/)
  3. Midjourney Medical / Midjourney Ultrasonic CT Scanner — Dos publicaciones con enlace directo a la página oficial de Midjourney. Puntuaciones 3 y 2, 2026-06-18, !«メールアドレス». https://lemmy.bestiver.se/post/1175129 / https://lemmy.bestiver.se/post/1175130
  4. Midjourney wants Hollywood studios to reveal AI usage details — Artículo sobre Midjourney solicitando a estudios de Hollywood que revelen el uso de IA. Puntuación 73, 2026-07-05, !«メールアドレス». https://techcrunch.com/2026/07/04/midjourney-wants-hollywood
Señales
  • La actividad de Lemmy relacionada con IA de generación de imágenes y vídeo se inclina casi por completo hacia el código abierto. El centro es !«メールアドレス», donde se publican herramientas a un ritmo de aproximadamente 3 a 9 al día, especialmente alrededor del ecosistema de MiniMax-H3 —LoRA, nodos ComfyUI, aceleración VAE y caché de movimiento—. También llegan a esa comunidad versiones cuantizadas de Qwen y artículos como LLaDA-Image.
  • En código cerrado, el único bloque temático sustancial fue la noticia de junio de 2026 sobre el giro de Midjourney desde generación de imágenes hacia escaneo médico por ultrasonido. Se reprodujo en varias instancias —lemmy.zip, awful.systems y lemmy.bestiver.se— y generó debate, con puntuaciones de 40 a 73, relativamente altas para este tema. A la inversa, apenas hay rastros en Lemmy de artículos sobre los lanzamientos principales de 2026: Sora, Veo, Kling, Runway, Nano Banana o Flux.2.
  • Las búsquedas de "Veo 3" y "Kling AI" no devolvieron publicaciones en Lemmy; las búsquedas combinadas de "Runway/Kling/Veo/Gemini image" tampoco dieron resultados. Los usuarios de Lemmy parecen responder más a herramientas utilizables en ComfyUI —nodos, LoRA y optimizaciones— que a anuncios de modelos nuevos.
Límites
  • Lemmy tiene una base pequeña de usuarios y publicaciones, y no existe una comunidad especializada en "noticias" de IA de generación de imagen o vídeo. Las fuentes reales se redujeron a la comunidad !«メールアドレス» y a artículos ocasionales sobre empresas de código cerrado que llegan a comunidades tecnológicas generales.
  • El objetivo de analizar unas 20 publicaciones no se alcanzó: fueron 15 en total, 11 herramientas de código abierto y 4 artículos sobre Midjourney de código cerrado. Las búsquedas en la API de lemmy.world y en la web no encontraron publicaciones sobre los lanzamientos principales de 2026, como Sora, Veo, Kling, Runway, Nano Banana o Flux.2; el hecho de no encontrarlas se deja expresamente registrado.
  • La página de comunidad /c/stablediffusion de lemmy.world devolvía HTTP 500 y no pudo consultarse directamente; se utilizó la API de búsqueda como alternativa.

Pinterest

Pinterest — Noticias de IA de generación de imágenes y vídeo

Se revisaron los 50 pines de output/pinterest.pins.md / images/pinterest/manifest.json. No se dividieron por géneros y todos procedían de la consulta única "Image and Video Generation AI News".

Temas visuales
  • La estética ciber de azul marino × neón —azul, violeta y rosa— se ha convertido en plantilla: la mayoría de miniaturas emplean circuitos, brillos de partículas, esferas o nodos similares a redes neuronales como fondo "típico de IA". [1, 2, 5, 7, 11, 13, 14, 17, 18, 20, 26, 30, 38, 40]
  • Repetición de la imagen de "presentador de noticias de IA": reaparece una y otra vez la composición de un androide blanco o un rostro mitad humano y mitad máquina, vestido de traje detrás de un escritorio de noticias. Produce una fuerte sensación de producción en serie donde solo se sustituye la marca. [4, 32, 34, 37, 42]
  • Las infografías de comparación y ranking de herramientas son el formato más frecuente: listas tipo "Best AI Video Generators" que repiten casi siempre Runway, Pika, Kling AI, Luma (Dream Machine), Canva AI, Hailuo AI, Synthesia, InVideo AI, HeyGen, Vidu AI, PixVerse, Google Veo, OpenAI Sora y Adobe Firefly. [9, 19, 28, 33, 36, 46]
  • Cuadrículas de demostración que transforman una imagen o vídeo original en varios estilos: la misma persona, panda disfrazado o coche Tesla se convierte en bloques de madera, origami, Lego o flores. Es una composición de antes y después que vende coherencia. [8, 25, 44]
  • Contenido sobre ansiedad y detección de deepfakes: imágenes de gatos con sello "FAKE", cuestionarios de "Which is AI?", presentaciones de detectores de imágenes y texto de IA, e infografías que advierten que ver ya no equivale a creer. [4, 12, 18, 26, 47]
  • Tarjetas fechadas tipo "AI News Roundup": formato de noticias breves que reúne varios temas con un encabezado y viñetas, como Google I/O 2026, IA para llamadas al 911 y el stack de IA de Corea del Norte. [21, 29, 31, 35]
  • Conversión en escaparate de arte de IA genérico, fuera del tema principal: también aparecen pines promocionales de obras sin valor noticioso, como una escultura de mármol tocando el violonchelo o un retrato de un pescador anciano; parecen publicidad de herramientas. [49, 50]
  • El fondo oscuro con letras neón es la norma; las infografías corporativas sobre fondo blanco —azul corporativo y diseño plano— son minoritarias. [3, 10, 27, 33]
Pines destacados
  • [11] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — Presentación de un producto real que promociona generación de imagen a vídeo y audio nativo con Veo 3 a través de la API Gemini.
  • [16] Google Unveils Veo 2 — Cuadrícula promocional de tono oficial de Google para Veo 2, con numerosas muestras generadas: científica con microscopio, natación y una chica de estilo anime, entre otras.
  • [25] Google announces Veo 3 — Demostración de un personaje monstruoso violeta generado de forma coherente en varios entornos. La composición presenta tres vídeos generados a partir de una imagen original y enfatiza la consistencia de personajes.
  • [29] Today's AI News: MAY 20, 2026 — Especial sobre Google I/O 2026. Enumera Gemini 3.5 Flash, Gemini Omni, Gemini Spark, IA de accesibilidad de Apple y la competencia de gafas inteligentes Android XR.
  • [35] The Latest AI Developments — Noticias breves en tres partes: IA respondiendo llamadas al 911 en Nueva Orleans; Meta publicando el modelo de agente offline Muse Glimmer; y el grupo norcoreano Kimsuky automatizando phishing con su propio stack de IA.
  • [44] Microsoft Unveils VASA-1 — Presentación de un modelo que genera un vídeo de rostro parlante a partir de una imagen fija, un clip de audio y, opcionalmente, señales de control; incluye una cuadrícula de rostros diversos.
  • [48] ShengShu Technology Unveils Vidu S1 — Presentación de Vidu S1, definido como modelo de vanguardia para interacción de IA en tiempo real, con personajes de estética cyberpunk y múltiples rostros.
  • [8] Demostración de conversión de estilo consistente, tipo Luma — Cuadrícula que compara cinco transformaciones de una misma persona, animal o coche: bloques de madera, origami, Lego y flores. Tiene gran capacidad persuasiva como demostración técnica.
  • [46] Future of Video Creation: Best AI Video Generators of 2026 — Ranking reciente que llega a incluir números de versión: Pika 2.5, HeyGen, Google Veo 3.1, Runway Gen 4.5, Kling 3.0, Adobe Firefly y Seedance 1.5 Pro.
  • [20] More than 20% of YouTube is now AI-generated — Pin sencillo con un titular que muestra una estadística concreta. Simboliza el grado de expansión del contenido generado por IA.
Señales
  • La competencia entre generaciones de modelos es visible: aparecen con frecuencia Veo 2 → 3 → 3.1, Kling AI → 3.0, Runway Gen-3 → Gen 4.5, Pika 2.5 y Seedance 1.5 Pro. Esto sugiere un ciclo acelerado de mejoras en IA de generación de vídeo. [16, 25, 11, 46]
  • El siguiente foco es la agentización, el tiempo real y el funcionamiento offline: herramientas de pipeline que automatizan desde la búsqueda de talento hasta guion, generación y edición con un clic ([24]); Vidu S1 para interacción en tiempo real ([48]); y Meta Muse Glimmer sin conexión de red ([35]). El interés se desplaza de la mera "generación" hacia agentes, tiempo real y ejecución en dispositivo.
  • La operación práctica y el abuso de IA comienzan a ser tema: se mezclan noticias sobre aplicación social y seguridad más allá de la generación, como la introducción de IA en sistemas de llamadas de emergencia ([35]) y abuso de IA por parte de actores estatales, Corea del Norte ([35]).
  • Exposición oligopólica de herramientas comerciales de código cerrado: los nombres recurrentes en pines de ranking son Google Veo, OpenAI Sora, Runway, Kling AI, Adobe Firefly, Pika, Luma, HeyGen y Synthesia. Están fuertemente sesgados hacia servicios comerciales cerrados; las menciones de modelos de código abierto —familia Stable Diffusion, AnimateDiff, Open-Sora o flujos de trabajo ComfyUI— son casi inexistentes. "Amuse 3.0" ([50]), que promociona ejecución local en AMD Ryzen AI, es una de las pocas excepciones.
  • La conexión con fuentes primarias es débil: de los 50 pines, solo unos pocos parecen enlazar directamente con blogs corporativos o artículos técnicos —el tono oficial de Veo en [16] y [25], y Microsoft VASA-1 en [44]—. La mayoría son miniaturas de blogs de afiliación, artículos SEO o servicios de Fiverr, como [45]. Pinterest funciona más como lugar para vender herramientas que para seguir noticias.
  • La ansiedad por los deepfakes se ha convertido en contenido de fórmula: presentaciones de detectores y cuestionarios de identificación forman un género independiente. Se consume más la inquietud sobre si se puede confiar en el contenido que el avance tecnológico mismo. [4, 12, 18, 26, 47]
Límites
  • Esta etapa solo consistió en leer imágenes recopiladas previamente por un worker con navegador headless; no se realizaron búsquedas ni desplazamientos adicionales dentro de Pinterest, de acuerdo con el procedimiento del playbook.
  • La recopilación utilizó una sola consulta, sin división por género, y no se hicieron búsquedas dirigidas que separaran código cerrado y código abierto. Como resultado, casi no aparecen pines de código abierto. Puede reflejar la tendencia de publicación de Pinterest, aunque no puede descartarse que una búsqueda dirigida hubiera encontrado más.
  • Hay dos pines con título (untitled); en [12] pudo inferirse que trataba esencialmente de "Which is AI?", pero otros eran difíciles de identificar.
  • No se accedió a las URL de los propios pines, pinterest.com/pin/...; el análisis se basa solo en imágenes y títulos. No se verificaron el texto de destino, comentarios, guardados u otros indicadores de interacción.
  • [49], una escultura de mármol tocando el violonchelo, es un pin promocional de arte de IA genérico con poca relación temática; no se trató como conocimiento noticioso.

Acciones recomendadas

  • Para flujos de trabajo dependientes de Sora2, elaborar un plan de migración a Kling 3.0 o Veo 3.1 antes del cierre de API, el 24/9/2026.
  • Seguir la función ComputerUse de GPT-6 Astra como herramienta de automatización de pipelines de producción, no como IA generativa aislada.
  • Si el objetivo es reducir costes, probar primero la edición local con Qwen-Image-Edit + ComfyUI antes de pagar por servicios de código cerrado.
  • Establecer reglas de divulgación sobre el uso de IA en contenido público para prepararse ante requisitos de etiquetado de autenticidad y riesgos de polémica por falsos timelapses.
  • Probar el flujo de trabajo dividido Nano Banana (imagen fija) + Kling 3.0 (conversión a vídeo).
  • Seguir el giro de Midjourney desde generación de imágenes hacia dispositivos médicos como posible indicador adelantado de diversificación en otras empresas de código cerrado.

Imágenes recopiladas

Image to Video AI: How It Works and Why It Matters - The Data Scientist🎨 AI Image and Video CreationThe Ultimate AI Image and Video Generation Platform - The Data ScientistAI content and social media concernsAi Content Creation Concept With Icons For Text Image Music And Video Generation Artificial Intelligence Images – Browse 57 Stock Photos, Vectors, and VideoAI Video Content Creation: High earners,...️ Image to Video AI – Animate Your Photos With AIGoogle announces ultra-high quality video...Just Nail It 🎥Why AI Video Generation Is Becoming Essential for...Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini APIimageimageArtificial intelligence: let’s maintain our...AI News: OpenAI Finally Released What We Asked ForGoogle Unveils Veo 2: Advanced AI Video Generation Tool with Enhanced Realism and Cinematic FeaturesPaul Lafargue of the IDEC Group: The impact of...How To Detect AI-Generated Images Online For FreeAI For Image And video GenerationMore than 20% of YouTube is now AI-generatedGPT 5.2, realtime video editor, AI stereo videos, mobile AI agents, full body control: AI NEWSTop AI Video Generators of 2025Artificial Intelligence: A Tool to Free the...AI Video Creating just got crazy.Google announces video generation AI 'Veo 3',...‎🚨 AI is getting scary good.How AI Is Transforming Video Editing5+ Best AI Video Generation Websites 2026 | Runway, Pika, Kling AI, Canva & MoreimageAI driven image and video analysisLe guide ultime pour exploiter Chat GPT en tant...TotalYmage revolutionizes interactive videos...ai toolsDiscover how Grok is revolutionizing video...The Latest AI Developments - AI Picks Up 911 Line Meta Offline Model12 Best AI Video Generators in 2026 (Free & Paid) | Google Veo, Sora, Runway & MoreThe Snarky AI News RoundUp #12What Is Generative AI? Complete Technical Guide - RCN GuideWhat is Imagvio AI and how it helps creators..."Transform Your Vision with Personalized AI-Powered 4K Videos 🎥✨"AI-Generated Videos: Good or Bad? Here's the Truth! 🤖🎥The Snarky AI News RoundUp #8Mastering Video and AI: Key Social Media Marketing Trends 2025Microsoft Unveils VASA-1, Setting New Standards for Generative AI in Video GenerationI will do ai video creation explainer with synthesia sora ai kling ai runway ai invideoFuture of Video Creation: Best AI Video Generators of 2026🔸Practical Online Resources For Checking AI-Generated TextShengShu Technology Unveils Vidu S1, Bringing Real-Time Interactive Generation to AI VideoTransform your ideas into stunning visuals! 🎥'Amuse 3.0', an AI art creation tool that includes...

Nota sobre calidad de datos

Las seis plataformas quedaron por debajo de los criterios de finalización de brief.md, de unas 20 publicaciones por red social. Especialmente, X solo produjo 4 casos relevantes entre 40 publicaciones; Bluesky llegó a 11 casos efectivos debido a límites de tasa 403; y Lemmy se quedó en 15 por la ausencia de una comunidad especializada en noticias. Sin embargo, las principales tendencias —GPT-6 Astra, el final de Sora2 y la expansión del ecosistema ComfyUI— fueron corroboradas de forma independiente por varias plataformas.

Galería