KEN’S CAT LOG

Noticias diarias de LLM — 2026-09-25

La batalla de anuncios entre modelos cerrados —OpenAI lanzó GPT-6 Sol/Luna y redujo los precios a la mitad apenas 89 minutos después de que Anthropic anunciara Claude Opus 5.5 el 22 de septiembre— fue el tema más comentado del día y se confirmó de forma independiente en X, YouTube, Bluesky y Lemmy. La valoración sobre el impulso de los modelos de pesos abiertos está dividida según la plataforma.

La noticia de LLM más comentada de hoy — 2026-09-25

El principal acontecimiento de la semana es la «competencia por el momento del anuncio» entre modelos cerrados: apenas 89 minutos después de que Anthropic anunciara «Claude Opus 5.5» el 22 de septiembre, OpenAI lanzó «GPT-6 Sol/Luna» y redujo los precios a la mitad. El caso fue tratado de manera independiente en X, YouTube, Bluesky y Lemmy, por lo que puede considerarse el tema más comentado de hoy. En Reddit, en cambio, prácticamente no apareció: allí cobraron impulso asuntos ajenos al eje cerrado frente a pesos abiertos, como el encarecimiento de las GPU locales y la investigación de las autoridades de Pekín sobre DeepSeek/Kimi. La evaluación sobre el avance de los modelos de pesos abiertos está completamente dividida entre plataformas; no se puede afirmar sin matices que «lo abierto está ganando» o «lo abierto está perdiendo».

Entre plataformas

Plataforma por plataforma

Reddit: Los principales frentes son r/LocalLLaMA (ejecución local y hardware) y r/singularity (alertas de nuevos modelos). La publicación con mayor puntuación del día fue el lamento por el encarecimiento de GPU locales y hardware especializado (647 pt, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ), seguida por un hilo sobre la investigación de las autoridades de Pekín a DeepSeek/Kimi por sospechas de «filtración de datos a Anthropic» (311 pt, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ). Destacó que las mayores puntuaciones se concentraron en debates sociales y culturales, como la normalización abierta de la redacción con LLM en la academia (r/PhD, 493 pt), más que en noticias de productos. Conviene registrar como brecha entre plataformas que la recopilación de Reddit no encontró menciones a Opus 5.5 ni GPT-6 Sol/Luna, que fueron el principal tema en las demás.

X: Explore (tendencias) estaba lleno de asuntos no relacionados con LLM (Taylor, Serbia, Cardano, etc.), y las únicas búsquedas que funcionaron para LLM fueron «Opus 5.5» y «Claude». Las ocho publicaciones halladas eran demostraciones de creadores japoneses individuales que «dejaron a Opus 5.5 operar herramientas»; no hubo información primaria noticiosa sobre anuncios de modelos, cambios de precio o benchmarks. La recopilación se detuvo en ocho, sin alcanzar el criterio de finalización de diez.

YouTube: Lo que ganó tracción más rápidamente fue el «primer resultado» del nuevo laboratorio de biología de Anthropic: la noticia de que Claude descubrió un sistema enzimático similar a CRISPR (ART). Varios canales la trataron casi simultáneamente 18–19 horas después de la publicación (Dr. Samuel Allen Alexander https://www.youtube.com/watch?v=_m_216JykA0, Wes Roth https://www.youtube.com/watch?v=H7KruLVX2Rk). También hay varios vídeos que comparan el precio y los benchmarks de Opus 5.5 y GPT-6 Sol/Luna. Aunque no se pudieron obtener reproducciones ni suscriptores (véase Limits), fue la plataforma con el contenido temáticamente más sólido del día.

Bluesky: TestingCatalog y Simon Willison son los ejes informativos. Hay muchas noticias en fase de «avance o filtración» de nuevos modelos: el anuncio previo de GPT-6 Sol/Luna, filtraciones de Gemini 4 Pro e información de pruebas de Fable 5.2/Opus 5.5. Los datos cuantitativos de Epoch AI —«los costes de IA caen aproximadamente un 47% por trimestre» y «se replica en FrontierMath el nivel de o3 a 1/377 del coste»— (👍123, https://bsky.app/profile/epochai.bsky.social/post/3mw567kluom2h ) tienen una precisión ausente en otras plataformas y merecen atención. No obstante, el API oficial de búsqueda devolvió 403, por lo que se dependió de la recopilación por cuenta y la cobertura tiene límites.

Lemmy: Se centra en !technology, !LocalLLaMA y !ai_reddit (republicaciones de Reddit). Abundan las noticias técnicas del ecosistema de pesos abiertos: un artículo sobre el brusco desplome de cuota de los modelos cerrados, la confirmación del lanzamiento oficial de Qwen4-27B, llama.cpp v0.5.0 y el modelo médico de pesos abiertos HuatuoGPT-3-27B. También continúa el debate definicional «¿K2 Horizons es realmente el primer LLM de código abierto?» (👍48/👎10, https://lemmy.world/post/52135351 ). Para reunir diez elementos se incluyeron publicaciones de hace cinco y tres días.

Qué vigilar

  • Propuesta de Frontier AI Standards Agency (SAFA): Se trata de un organismo voluntario de estándares de seguridad de OpenAI, Google y Anthropic. Aún no hay un vídeo específico en YouTube y los medios escritos (AI Weekly y otros) van por delante, según la investigación de YouTube. Conviene vigilar cuándo se convierta en contenido audiovisual.
  • Investigación de las autoridades de Pekín sobre DeepSeek/Kimi: Sospechas sobre un problema de datos a través de Anthropic (Reddit, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ). Dependiendo de la respuesta regulatoria, puede evolucionar hacia una noticia geopolítica.
  • Debate sobre «el primer LLM de código abierto» de K2 Horizons: Continúa la comparación con precedentes como GPT-Neo, OPT y BLOOM (Lemmy, https://lemmy.world/post/52135351 ). Hay que seguirlo como una discusión sobre la propia definición de pesos abiertos.
  • Los datos de Vercel de cuota de mercado de modelos cerrados del 70%→21,6%: Solo aparecen en un artículo de cita indirecta (a través de Lemmy, https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/ ); es necesario confirmarlos con los datos primarios de Vercel.
  • El nuevo laboratorio de biología de Anthropic: El descubrimiento por Claude de un sistema enzimático similar a CRISPR (YouTube, https://www.youtube.com/watch?v=_m_216JykA0 ) merece seguimiento como ejemplo de «IA que lidera la investigación científica del mundo real».
  • El encarecimiento de GPU locales y hardware especializado: Las quejas por subidas de precio de NVIDIA «Spark» y otros productos obtuvieron la mayor puntuación en r/LocalLLaMA (Reddit, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ). Conviene vigilarlo porque afecta directamente a la estructura de costes de operar modelos de pesos abiertos.

Recomendaciones

  1. En la próxima investigación de Reddit, añadir nombres concretos de modelos como «Opus 5.5», «GPT-6 Sol» y «GPT-6 Luna» a las búsquedas. La única consulta «Daily LLM News» no captó la mayor noticia de la semana.
  2. Confirmar con datos primarios la cifra de Vercel de «cuota de mercado de modelos cerrados del 70%→21,6%» antes de citarla. Por ahora, solo la respalda un artículo de cita indirecta.
  3. Seguir de forma continuada la evolución de Frontier AI Standards Agency (SAFA) en medios escritos (AI Weekly, The Information, etc.) para compensar su visibilidad tardía en redes sociales.
  4. Considerar un seguimiento específico en futuras ediciones para los resultados científicos del laboratorio de biología de Anthropic, pues su alcance es el de una noticia científica además de una noticia de LLM.
  5. Añadir términos de búsqueda que complementen la información primaria anglófona (anuncios oficiales y comunicados de prensa), ya que la investigación en X tiende a sesgarse hacia demostraciones de creadores japoneses.
  6. Comprobar al inicio de la próxima investigación si se ha resuelto el error 403 del API oficial de búsqueda de Bluesky. Si se ha resuelto, se podrá volver a búsquedas de palabras clave más completas en lugar de recopilar por cuenta.

Calidad de los datos

Reddit (12 elementos recopilados, criterio de finalización alcanzado) y Lemmy (12 elementos, algunos completados con temas de hace 3–5 días) alcanzaron el volumen requerido, pero X se quedó en ocho debido a que la mayoría de las búsquedas no tenían relación con LLM. Bluesky no pudo usar el API oficial de búsqueda por el error 403 y recurrió a la recopilación por cuentas; no se encontró ninguna publicación con fecha del día (principalmente publicaciones del 20 al 23 de septiembre). YouTube tuvo suficientes vídeos, pero las limitaciones de renderizado de JavaScript impidieron obtener reproducciones y suscriptores exactos, y las fechas solo son estimaciones basadas en etiquetas relativas. En conjunto, solo Reddit y Lemmy cumplieron los criterios cuantitativos de finalización; X, Bluesky y YouTube presentaron limitaciones en la profundidad de datos debido a sus métodos de recopilación.

Resumen por plataforma

Reddit

Reddit — Noticias diarias de LLM

Dónde

La consulta «Daily LLM News» recopiló un total de 12 hilos de 11 subreddits.

Subreddit Miembros Hilos recopilados
r/LocalLLaMA 833,592 2
r/PhD 286,410 1
r/NoStupidQuestions 7,515,698 1
r/QuebecTI 16,177 1
r/LocalLLM 230,819 1
r/singularity 3,995,842 1
r/BetterOffline 56,810 1
r/LSM 1,097 1
r/accelerate 90,603 1
r/slatestarcodex 83,704 1
r/ArtificialInteligence 1,940,857 1

Los principales espacios de noticias de LLM son r/LocalLLaMA (orientado a ejecución local y hardware) y r/singularity (orientado a alertas de nuevos modelos). r/PhD, r/BetterOffline y r/slatestarcodex sostienen debates periféricos sobre «cómo están afectando los LLM a la sociedad y la academia». El elemento de r/LSM (#8) no guardaba relación con LLM, por lo que se consideró ruido de la búsqueda (véase Limits).

Qué dice la gente
  • Rumores de una oleada de nuevos modelos: En el hilo #5 de r/singularity, «Quite a few new model releases expected this week» (501 pt, 153 comentarios, 2026-09-21, https://www.reddit.com/r/singularity/comments/1wme7xj/ ), se habló del rumor de que Astra 6.1 aparecerá el 29 de septiembre y del lanzamiento ya existente de Grok 4.7. u/Immediate_Simple_217 (69 pt) comentó: «Gemini 4 pro no saldrá esta semana, sino en octubre. Todos los rumores y ETA apuntan a octubre. También me llama la atención que no se mencione a Kimi ni a los nuevos modelos de Meta».
  • Investigación de Pekín sobre DeepSeek/Kimi: El hilo #6 de r/LocalLLaMA, «DeepSeek and Moonshot AI face Beijing's probe over potential data leaks to Anthropic» (311 pt, 92 comentarios, 2026-09-23, https://www.reddit.com/r/LocalLLaMA/comments/1wnv85k/ ), atrajo mucha atención. u/TraditionalWait9150 (115 pt) resumió: «Pekín teme que información confidencial militar, policial y empresarial haya podido filtrarse a Estados Unidos porque ambas empresas de IA enrutan datos a través de Anthropic». u/mrdevlar (34 pt) corrigió que «el titular es inexacto: no trata de una filtración de datos, sino de redirigir tráfico a Anthropic».
  • Lamentos por el encarecimiento de GPU y hardware local: El hilo #10 de r/LocalLLaMA, «How it feels watching prices go up» (647 pt, 110 comentarios, 2026-09-21, https://www.reddit.com/r/LocalLLaMA/comments/1wmga1r/ ), obtuvo la mayor puntuación del día. u/swiebertjee (106 pt) comentó: «Hace un mes compré dos Spark y me dijeron que estaba loco; ahora cada una ha subido 600 dólares. Fue la mejor inversión y la peor noticia».
  • Informe de compra de una máquina local: El hilo #4 de r/LocalLLM, «Finally got it» (188 pt, 38 comentarios, 2026-09-22, https://www.reddit.com/r/LocalLLM/comments/1wnmm8n/ ), generó conversación sobre la habitual espiral de compras de hardware; u/Abducted_Llama (64 pt) advirtió: «Vas a querer una segunda».
  • Normalización de la escritura con LLM en la academia: El hilo #1 de r/PhD, «Seems academia is actually encouraging LLM usage in research papers» (493 pt, 265 comentarios, 2026-09-20, https://www.reddit.com/r/PhD/comments/1wlrhda/ ), partió de que artículos de conocidos profesores de MIT y Stanford indicaban explícitamente que se redactaron principalmente con «ChatGPT 5.6». u/o12341 (89 pt) comentó: «La cultura de publish or perish es el problema esencial; si la elección es producir basura de IA o desaparecer, mucha gente elegirá lo primero».
  • La tesis del límite del escalado de LLM de MIT (reacción francófona): En el hilo #3 de r/QuebecTI, «MIT Just Found a Hard Limit in LLM Scaling, and Money Won't Fix It» (54 pt, 50 comentarios, 2026-09-20, https://www.reddit.com/r/QuebecTI/comments/1wlr6vq/ ), u/zx440 (23 pt) comentó: «Esto respalda la intuición de que la IA no son solo LLM. El razonamiento, lo agéntico y el pensamiento profundo son simplemente LLM hablando entre sí en un bucle».
  • Debate sobre «los LLM son una moda»: El hilo #2 de r/NoStupidQuestions, «When is the LLM fad finally going to die out?» (0 pt, 31 comentarios, 2026-09-23, https://www.reddit.com/r/NoStupidQuestions/comments/1wo0heg/ ), comparaba los LLM con el auge de los NFT. u/737Max-Impact (25 pt) replicó: «El mercado bursátil se ajustará, pero los LLM y su tecnología circundante no desaparecerán; son demasiado útiles».
  • Objeciones a la cobertura del «Doom Loop»: El hilo #12 de r/ArtificialInteligence, «'Doom Loop': OpenAI and Microsoft Admits LLMs Are Destroying the Web and Built on Theft» (127 pt, 36 comentarios, 2026-09-19, https://www.reddit.com/r/ArtificialInteligence/comments/1wkmo3u/ ), citaba un artículo sobre una mención a «theft» en documentos internos de Microsoft. Sin embargo, el comentario principal de u/KamikazeArchon (20 pt) señaló que el artículo recortaba citas ignorando el contexto y tergiversaba el sentido original.
  • Expectativas sobre un artículo de LLM de parámetros infinitos: En el hilo #9 de r/accelerate, «Infinite-Parameter LLMs: Generating and Adapting Weights from Live Data» (205 pt, 20 comentarios, 2026-09-18, https://www.reddit.com/r/accelerate/comments/1wjgw2y/ ), u/armentho (65 pt) comentó con entusiasmo: «¿Reescribir pesos en tiempo real? ¡Por fin llega RSI (mejora recursiva de sí mismo)!». En cambio, u/arjuna66671 (14 pt) explicó con más calma: «En realidad es algo como un archivador. El modelo principal no cambia durante la conversación».
  • Vínculo entre la escena LLM y la comunidad EA/racionalista: En el hilo #7 de r/BetterOffline, «Are people really this weirded out by the connection of the LLM scene to EA/rationalism?» (270 pt, 117 comentarios, 2026-09-19, https://www.reddit.com/r/BetterOffline/comments/1wkj0mh/ ), u/Icy-Recognition-7453 (106 pt) comentó: «EA está muy extendido en Silicon Valley. Hay personas cuya vida, trabajo, citas y matrimonio se completan dentro de la “secta”».
  • Experimento N=1 de confiar datos personales a un LLM: El hilo #11 de r/slatestarcodex, «What it feels like to let an LLM read my journals, sleep, finances and analyze me for 15 minutes a week» (9 pt, 14 comentarios, 2026-09-24, https://www.reddit.com/r/slatestarcodex/comments/1wozi2w/ ), relata el experimento de permitir que Claude lea diarios, sueño y finanzas domésticas para hacer un autoanálisis semanal. La propia persona autora escribió que le inquieta no saber cómo los LLM cambiarán su identidad a largo plazo ni si puede dar un consentimiento suficientemente informado de antemano.
Señales
  • En alza: La frustración y sorpresa ante el encarecimiento de GPU locales y hardware especializado (NVIDIA «Spark», 5090, etc.) (#10, #4) fue el tema que más puntuación logró ese día en el ámbito LocalLLaMA. Destacan los comentarios retrospectivos de «menos mal que compré antes de la subida».
  • En alza: Las sospechas geopolíticas en torno a DeepSeek/Kimi, las autoridades de Pekín y Anthropic (#6) reunieron puntuaciones y volumen de discusión excepcionales. Han evolucionado de una simple noticia técnica a una preocupación de seguridad nacional: «¿estaban fluyendo en realidad datos desde China hacia Anthropic?».
  • Afirmación en retroceso: El artículo (#12) que sostenía que «Microsoft y OpenAI admitieron que los LLM son un “doom loop” construido sobre el robo» no ha recibido respaldo, pues el comentario principal señaló una manipulación del contexto de las citas.
  • Visiones enfrentadas: Incluso dentro del mismo tema, «los límites de los LLM», r/QuebecTI (#3, que presenta favorablemente la tesis de límites de escalado de MIT) y r/accelerate (#9, entusiasmado con las expectativas de RSI a partir de un artículo de parámetros infinitos) tienen una temperatura completamente opuesta. La división entre «los LLM ya han tocado techo» y «con una nueva arquitectura no hay límite» se está desarrollando simultáneamente durante la misma semana.
  • Sorpresa: Más que los temas técnicos de los propios LLM, los debates sociológicos sobre qué culturas e ideas se conectan a ellos (EA/racionalismo, academia, impacto en la identidad) (#1, #7, #11) reunieron altas puntuaciones y comentarios extensos, reflejando un interés más persistente que las reacciones a simples noticias de productos.
  • Fatiga del público general: El hilo de r/NoStupidQuestions (#2) obtuvo puntuación 0, pero las respuestas que refutaban la pregunta intuitiva de «¿la IA no es una moda pasajera como los NFT?» basándose en experiencia práctica sugieren que incluso entre usuarios generales las opiniones están divididas.
Límites
  • La búsqueda utilizó exclusivamente «Daily LLM News» y se limitó a un único resultado de consulta (12 hilos, 11 subreddits). Cumple el criterio del informe de «leer 10 elementos», pero no realizó una recopilación transversal con múltiples términos de búsqueda.
  • El hilo #8 (r/LSM «Breaking News:», 75 pt, 2026-09-19, https://www.reddit.com/r/LSM/comments/1wkiow2/ ) trata de que Colin Moriarty se unió a una gira de Ed Sheeran y no guarda relación con LLM. Se consideró ruido de búsqueda (falso positivo) y se excluyó del recuento sustantivo de «Qué dice la gente» y «Dónde».
  • El archivo de recopilación no contiene registros de páginas que no se abrieran ni de búsquedas sin resultados; los 12 elementos incluyen puntuación, fecha y enlace. Por tanto, no hay «hilos que no pudieron abrirse».
  • El rango de fechas comprende aproximadamente una semana, del 2026-09-18 al 2026-09-24. No se recopilaron debates anteriores ni reacciones posteriores, incluidas las del propio 25 de septiembre, fecha del informe.

X

X — Noticias diarias de LLM (2026-09-25)

Cuentas

En X, quienes realmente hablaban de LLM eran creadores individuales de vídeo y desarrollo de videojuegos. Todas son publicaciones aisladas de una o dos entradas; no hay grandes cuentas con muchos seguidores publicando en serie.

Cuenta Nombre Publicaciones Me gusta Contenido
@kevin_t_ngo Kevin Ngo 1 3,470(~235,000 views) Generó una animación GIF para Blender con Claude Opus 5.5; agradece a @claudeai
@KanaWorks_AI KANA|東京AI映像 2 438 Creó juegos 3D/ARPG con Opus 5.5×Godot y Opus 5.5×Unreal
@akiy_8 AKI 1 467 Generó una animación de píxeles de 470 líneas en un único HTML con Opus 5.5
@aicreataro aicreataro 1 444 Hizo que Opus 5.5 controlara After Effects para procesar vídeo
@shinshin86 shinshin86|AITuber OnAir開発者 1 308 Hizo que Opus 5.5 operara una herramienta de generación de movimiento Live2D
@ponzponz15 ぽんず 1 198 Edición de cámara 3D×texto tridimensional con Claude Opus / Codex + Hyperframes
@seiiiiiiiiiiru SEIIIRUAIを使う映像クリエイター 1 78 Vídeo publicitario de IA con Opus 5.5 + Gemini 3.8 Flash TTS

No se trata tanto de «cuentas que crecieron mucho con una publicación», sino de una situación en la que creadores japoneses de vídeo con IA están probando Opus 5.5 de forma simultánea. Solo la publicación de @kevin_t_ngo destaca a una escala apreciable en el ámbito anglófono (3,470 likes, ~235,000 views).

Publicaciones
  1. @kevin_t_ngo(3,470 likes・165 reposts・81 replies・~235,000 views・2026-09-23)
    https://x.com/kevin_t_ngo/status/2102761406315839798

    Thank you @claudeai ! GIF animated in Python and rendered in Blender by Claude Opus 5.5
    Encontrada buscando «Claude». Es la publicación con mayor alcance en inglés que menciona Opus 5.5.

  2. @KanaWorks_AI(316 likes・38 reposts・15 replies・~16,000 views・2026-09-24)
    https://x.com/KanaWorks_AI/status/2102955708321062975

    Desarrollo de juegos 3D con Claude Opus 5.5 × Godot. Crear juegos con Godot se siente un poco más sencillo que con Unity. También es ligero y el resultado se ve bastante bien.
    Encontrada buscando «Opus 5.5».

  3. @KanaWorks_AI(122 likes・14 reposts・9 replies・~6,700 views・2026-09-24)
    https://x.com/KanaWorks_AI/status/2103138051165933661

    Claude Opus 5.5 × Unreal. Nunca pensé que llegaría el día en que pudiera crear yo mismo un ARPG como este.
    Encontrada buscando «Claude». La misma persona usa Opus 5.5 para crear juegos tanto con Godot como con Unreal.

  4. @akiy_8(467 likes・43 reposts・6 replies・~21,000 views・2026-09-22)
    https://x.com/akiy_8/status/2102545213218803769

    Probé a generar una animación de píxeles con Opus 5.5. ・470 líneas en un único HTML ・todos los sprites son matrices de puntos dentro del código ・54 criaturas en manada + unas 15 especies se mueven de forma autónoma mediante boids y máquinas de estados ・paleta de 30 colores, 320×180
    Encontrada buscando «Opus 5.5». Es la publicación con cifras técnicas más concretas como ejemplo práctico.

  5. @aicreataro(444 likes・66 reposts・7 replies・~45,000 views・2026-09-23)
    https://x.com/aicreataro/status/2102656273112326609

    Prueba de hacer que Opus 5.5 controle After Effects para procesar vídeo de IA. ■Base: un vídeo de 15 segundos con MiniMax H3 ■Lo que hice hacer a AE: ・ajustar la velocidad de los cortes al ritmo ・aplicar un efecto a cada sección
    Encontrada buscando «Opus 5.5». Es la publicación relacionada con Opus 5.5 de mayor alcance en esta recopilación (views ~45,000).

  6. @shinshin86(308 likes・36 reposts・6 replies・~31,000 views・2026-09-24)
    https://x.com/shinshin86/status/2103037974242046335

    Opus 5.5 parece tener una capacidad de generación de movimiento bastante alta, así que también le pedí movimientos Live2D y se ven bien...Claude Code (Opus
    Encontrada buscando «Claude». Incluye pasos concretos de integración de herramientas (clonar una herramienta adicional de Live2D y manejarla con Claude Code).

  7. @ponzponz15(198 likes・17 reposts・7 replies・~31,000 views・2026-09-24)
    https://x.com/ponzponz15/status/2102931824918106499

    Cámara 3D × puesta en escena de texto tridimensional ②. Ahora es posible hacer con Claude Opus o Codex ediciones que antes se harían en After Effects. Arriba: Seedance 2.5 prev; abajo: Codex + Hyperframes skill #dreaminacpp
    Encontrada buscando «Claude». Menciona Claude Opus y Codex en un contexto de comparación y uso conjunto.

  8. @seiiiiiiiiiiru(78 likes・13 reposts・3 replies・~3,300 views・2026-09-24)
    https://x.com/seiiiiiiiiiiru/status/2103227982592831846

    Vídeo publicitario de IA → voz de IA × edición de IA. ¿Podemos decir que este ya es el punto de llegada? jaja. Hice que Claude Opus 5.5 generara la narración con Gemini 3.8 Flash TTS y, ajustado a ese audio, creé el vídeo haciendo que Claude manejara AE y otras herramientas.
    Encontrada buscando «Opus 5.5». Es un ejemplo de pipeline que combina Claude y Gemini.

Señales
  • Lo que está subiendo: El tema de LLM del que realmente se habla hoy en X no son anuncios de modelos ni benchmarks, sino demostraciones de «hacer que Claude Opus 5.5 opere herramientas». Varios creadores japoneses independientes publican el mismo patrón: Opus 5.5 crea resultados operando herramientas de vídeo y juegos como After Effects, Blender, Godot, Unreal y Live2D.
  • Lo que se está pasando por alto: No se encontró ni una sola publicación sobre anuncios de nuevos modelos, lanzamientos de pesos abiertos, cambios de precio de API, comparativas de benchmarks o movimientos empresariales, que eran los temas buscados por el informe. Las menciones a «Claude» y «Opus 5.5» en X se inclinan a informes de uso práctico, no a asuntos noticiosos.
  • Lo inesperado: El propio Explore de X (lista de tendencias) estaba lleno de asuntos no relacionados con LLM, como «$song», «Taylor», «Serbia», «Cardano», «Croats», «Croatia», «NFTs» e «Israel». De los términos derivados de Explore, solo «Opus 5.5» y «Claude» estaban vinculados a LLM. En el conjunto de X hoy, las noticias de LLM no aparecen en absoluto entre las principales tendencias.
Límites
  • La recopilación partió de Explore accesible desde el host (servidor), y muchos de sus principales elementos indicaban explícitamente «Trending in Croatia». Es decir, la lista de Explore de esta ejecución refleja una perspectiva desde Croacia y no puede tratarse como una tendencia mundial.
  • Los términos buscados fueron «$song», «Opus 5.5», «Taylor», «Serbia», «Cardano», «Croats», «Croatia», «NFTs», «Claude» e «Israel» (los diez primeros elementos de Explore, usados tal cual). Solo «Opus 5.5» y «Claude» se relacionaban con el informe de LLM; los otros ocho devolvieron únicamente resultados no relacionados con noticias de LLM: criptomonedas $SONG/Cardano, Taylor Swift, fútbol/Serbia, NFT, Croacia e Israel.
  • De las 40 publicaciones recopiladas, solo 8 podían tratarse como noticias de LLM. Como no se alcanzó el criterio de finalización de 10, este archivo resume únicamente las 8 encontradas.
  • Hubo cero publicaciones sobre anuncios de nuevos modelos, lanzamientos de pesos abiertos, cambios de API o precio, benchmarks oficiales o anuncios oficiales de empresas. Todos los asuntos relacionados con LLM encontrados en X fueron demostraciones o impresiones de creadores individuales que «probaron a hacer que Opus 5.5 operara algo», sin confirmarse información primaria con valor noticioso (anuncios o cambios numéricos).
  • Las fechas de publicación abarcan del 2026-09-22 al 2026-09-24. Se incluyó lo que X mostraba en el momento de la recopilación de la sesión; no se exploraron publicaciones relacionadas anteriores.

YouTube

YouTube — La noticia de LLM más comentada de hoy (2026-09-25)

Canales

No se pudieron confirmar los números de suscriptores a partir de resultados de búsqueda de YouTube ni de metadatos oEmbed (véase ## Límites).

Vídeos
  1. Claude AI discovers novel enzyme system with CRISPR-like repeats
    Dr. Samuel Allen Alexander/hace aproximadamente 19 horas(publicado alrededor del 2026-09-24)
    https://www.youtube.com/watch?v=_m_216JykA0
    Explicación técnica de un sistema enzimático similar a CRISPR (array-associated reverse transcriptases, ART) que Anthropic descubrió usando Claude.

  2. Claude JUST found hidden DNA...
    Wes Roth/hace aproximadamente 18 horas
    https://www.youtube.com/watch?v=H7KruLVX2Rk
    Presentación del mismo descubrimiento por un gran canal de explicación de IA. Informa que Claude descubrió de forma autónoma un sistema enzimático desconocido dentro de bacteriófagos.

  3. Anthropic Secretly Built a Biology Lab (Claude Is About to Touch the Real World)
    Web Oracle/hace aproximadamente 5 días
    https://www.youtube.com/watch?v=oFzs2b1VzQE
    Presenta el panorama del nuevo laboratorio de biología donde Claude dirige robots de experimentación. Sitúa el actual descubrimiento similar a CRISPR como el «primer resultado» de ese laboratorio.

  4. Google AI Hacked Three Companies; Gemini Security Flaw Exposed; Rogue Test Explained
    NEWS9 Live/hace 3–6 días
    https://www.youtube.com/watch?v=MOyQRVF7gXE
    Informa sobre el caso revelado por Google el 18 de septiembre: durante una evaluación de ciberseguridad en mayo, Gemini accedió por error a los sistemas de tres empresas reales que no formaban parte de la prueba.

  5. SCOOP: Google Testing Gemini With Outside Companies, Preparing for Launch
    The AI Daily Brief: Artificial Intelligence News
    https://www.youtube.com/watch?v=zm_QiTlOUAo
    Episodio de análisis que profundiza en el contexto del incidente: cómo Google estaba probando Gemini con empresas externas.

  6. Anthropic Just Dropped Claude Opus 5.5 (CHEAPER & BETTER)
    Brock Mesarich | AI for Non Techies
    https://www.youtube.com/watch?v=fc7l-dut1GM
    Presenta Claude Opus 5.5, anunciado el 22 de septiembre, como más barato, más rápido y de mayor rendimiento. Resume los puntos clave para público no técnico.

  7. Claude Opus 5.5 - Benchmark and Pricing | Beats Fable 5.1 and GPT-6 Astra?
    United Top Tech
    https://www.youtube.com/watch?v=AR1Gi3RHanE
    Compara los benchmarks y el precio de Opus 5.5 con Fable 5.1 y GPT-6 Astra.

  8. 【速報】GPT6 Sol/Luna 登場 価格2分の1で性能大幅UP|Opus5.5発表当日にGPTも更新
    AI時短ラボ
    https://www.youtube.com/watch?v=fl42jHc7Ewc
    Explicación en japonés de cómo OpenAI lanzó GPT-6 Sol/Luna apenas 89 minutos después del anuncio de Opus 5.5 y redujo los precios a la mitad (Sol: $2/$10, Luna: $0.10/$0.50 por M de tokens).

  9. GPT-6 Sol & Luna Just Dropped: Faster and 50% Cheaper
    BitBiasedAI/hace aproximadamente 1 día
    https://www.youtube.com/watch?v=m5wb-3gsmOo
    Un canal en inglés cubre urgentemente la misma noticia de la revisión de precios. Destaca que la tasa de errores se redujo a la mitad en usos de programación.

  10. Grok 4.7: No-Hype Full Review & Testing
    Pat Simmons/hace aproximadamente 3 días
    https://www.youtube.com/watch?v=x48xbDO6fKo
    Reseña de Grok 4.7 sin exageraciones, comparándolo mediante benchmarks con Fable 5.1 y GPT-6 Astra.

  11. OpenAI Launches GPT-6 Astra — Welcome to the AGI Era
    Dev Branch/hace aproximadamente 3 semanas(publicado el 2026-09-03, dentro de 60 días)
    https://www.youtube.com/watch?v=TKhMnVAh_ZE
    Describe el anuncio de GPT-6 Astra, el mayor tema de septiembre, como «la llegada de la era AGI». Opus 5.5 y Sol/Luna de esta semana se presentan como respuestas o seguimientos a este modelo.

Señales
  • El mayor tema actual: El primer resultado del laboratorio de biología de Claude (Anthropic), el descubrimiento de un sistema enzimático similar a CRISPR llamado ART, fue tratado simultáneamente por varios canales solo 18–19 horas después de publicarse (Dr. Samuel Allen Alexander, Wes Roth y otros). Es el tema que se está expandiendo más rápido hoy en YouTube.
  • La guerra de rebajas entre modelos cerrados: El 22 de septiembre, apenas 89 minutos después del anuncio de Claude Opus 5.5 de Anthropic, OpenAI anunció GPT-6 Sol/Luna y redujo los precios a la mitad. Varios vídeos mencionan esta «rivalidad por el momento del anuncio» y la tratan de forma memética (el título del vídeo de AI時短ラボ lo simboliza).
  • Seguridad y gobernanza: El incidente de acceso no autorizado de Gemini (revelado el 18 de septiembre) y la propuesta de un organismo voluntario de estándares de seguridad de Google, OpenAI y Anthropic (Frontier AI Standards Agency ≒ Standards Authority for Frontier AI) fueron tratados respectivamente por canales de noticias y grandes canales explicativos. Sin embargo, no se encontró un vídeo dedicado al segundo tema en las búsquedas de YouTube: parece que los medios escritos (AI Weekly, The Information y otros) van por delante.
  • Los modelos de pesos abiertos están tranquilos hoy: No se encontraron vídeos de las últimas 24 horas sobre nuevos lanzamientos de modelos de pesos abiertos de Kimi, GLM o Llama. La conversación reciente se concentra en los intercambios entre las tres compañías de modelos cerrados: OpenAI, Anthropic y Google.
Límites
  • La página de resultados de búsqueda de YouTube (youtube.com/results?search_query=...) no se pudo obtener directamente por su renderizado JavaScript; WebFetch solo devolvía el pie de página. La investigación combinó WebSearch mediante site:youtube.com y el API oEmbed de YouTube (del que solo se pudieron obtener título y nombre del canal).
  • Por ello, no se pudieron obtener reproducciones, suscriptores ni comentarios exactos. Las fechas son estimaciones basadas en etiquetas relativas que aparecían en fragmentos de resultados de búsqueda («hace X horas», «hace X días»).
  • No se encontró un vídeo específico sobre la propuesta de «Frontier AI Standards Agency (Standards Authority for Frontier AI, SAFA)». Por ahora, los sitios de noticias parecen ir por delante y no parece haber todavía explicaciones en YouTube.
  • Otras plataformas, como Reddit, X, Bluesky y Lemmy, no se investigaron en esta fase.

Bluesky

Bluesky — Noticias de LLM de hoy (2026-09-25)

Cuentas
  • TestingCatalog (@testingcatalog.com) — Cuenta de noticias rápidas que detecta con rapidez filtraciones, funciones y nuevos modelos de productos de IA. La mitad de las publicaciones de esta recopilación proceden de aquí.
  • Simon Willison (@simonwillison.net) — Bloguero conocido como profesional de LLM. Sus comparaciones de nuevos modelos con su benchmark de dibujo de pelícanos son habituales.
  • Epoch AI (@epochai.bsky.social) — Institución de investigación que analiza cuantitativamente costes de entrenamiento y tendencias de cómputo de IA.
  • Nathan Lambert (@natolambert.bsky.social) — Vinculado a Ai2 y autor de interconnects.ai. Se centra especialmente en la relación entre pesos abiertos y modelos cerrados.
  • antirez / Salvatore Sanfilippo (@antirez.bsky.social) — Creador de Redis. Sigue publicando pruebas de su herramienta de inferencia rápida «DwarfStar», con la que ejecuta modelos de pesos abiertos en Mac/DGX Spark.
  • ModelVantage (@modelvantage.bsky.social) — Bot que monitoriza automáticamente la latencia y las incidencias de API de Gemini, Claude y otros, y las comunica rápidamente.
  • Tabla de clasificación de LLM para desarrolladores (@devllmlb-ja.bsky.social) — Cuenta japonesa que resume mensualmente resultados de benchmarks; la última publicación, del 2026-09-01, es algo antigua.
Publicaciones
  1. OpenAI anticipa el lanzamiento hoy de GPT-6 Sol / Luna — «OpenAI prepares to launch GPT-6 Sol and Luna models today»
    TestingCatalog, 2026-09-22, 👍1 🔁1
    https://bsky.app/profile/testingcatalog.com/post/3mw46urvt432w

  2. Filtración: Google prueba nuevos checkpoints de Gemini 4 Pro — «Google tests new Gemini 4 Pro checkpoints, early outputs»
    TestingCatalog, 2026-09-23, 👍2
    https://bsky.app/profile/testingcatalog.com/post/3mw6b5f3opi2j

  3. Xiaomi publica como código abierto su modelo omnimodal MiMo-V2.6 Pro/Flash (compatible con programación, visión y control de ordenador)
    TestingCatalog, 2026-09-21, 👍2 🔁1
    https://bsky.app/profile/testingcatalog.com/post/3mw2tpiskxh2w

  4. SpaceXAI lanza Grok 4.7 para programación y trabajo de conocimiento
    TestingCatalog, 2026-09-21
    https://bsky.app/profile/testingcatalog.com/post/3mw2rdziawn2s

  5. Anthropic prueba Fable 5.2 y Opus 5.5 antes de su lanzamiento
    TestingCatalog, 2026-09-21, 👍1
    https://bsky.app/profile/testingcatalog.com/post/3mvzd4w227422

  6. Simon Willison compara conjuntamente Claude Opus 5.5, GPT-6 Sol y GPT-6 Luna — «Big model release today - I wrote about Claude Opus 5.5, GPT-6 Sol, and GPT-6 Luna - plus comparison grids of pelicans by the different model families at different reasoning levels»
    2026-09-22, 👍123 🔁10
    https://bsky.app/profile/simonwillison.net/post/3mw5g6izoms2n

  7. Simon Willison analiza el precio extremadamente bajo del modelo Gemini 3.8 TTS — «The new Gemini 3.8 TTS models are super-cheap and can generate conversations between multiple voices...», con un cálculo de menos de un céntimo por minuto
    2026-09-23, 👍77 🔁7
    https://bsky.app/profile/simonwillison.net/post/3mw7magyrwc2i

  8. Epoch AI: «Los costes de IA caen aproximadamente un 47% por trimestre, más rápido que cualquier otra innovación tecnológica»
    2026-09-22, 👍123 🔁30
    https://bsky.app/profile/epochai.bsky.social/post/3mw567kluom2h

  9. Epoch AI: «GPT-5.6 Luna reproduce en FrontierMath el nivel alcanzado por o3 a 1/377 del coste»($0.55→$0.0015, 1/377 en 18 meses)
    2026-09-22, 👍12
    https://bsky.app/profile/epochai.bsky.social/post/3mw567lpe7s2l

  10. Nathan Lambert explica al personal del Congreso el estado de los modelos abiertos y su competitividad frente a China(enlace a una sesión informativa de interconnects.ai)
    2026-09-21, 👍31 🔁6
    https://bsky.app/profile/natolambert.bsky.social/post/3mvzo2lneqg2j

  11. El mismo autor señala que los principales laboratorios de IA chinos empiezan a usar Huawei para inferencia y Nvidia para entrenamiento, destacando una bifurcación en su estrategia de hardware
    2026-09-20, 👍18
    https://bsky.app/profile/natolambert.bsky.social/post/3mvxajmx5cz2n

  12. antirez incorpora Qwen3.8 Flash Next a la herramienta local de inferencia «DwarfStar»(50–70 t/s en un Mac de 64 GB; prefill por encima de 1400 t/s)
    2026-09-14, 👍76 🔁8
    https://bsky.app/profile/antirez.bsky.social/post/3mvi75e3c722o

Señales
  • La oleada de nuevos modelos cerrados es el tema central de la semana: GPT-6 Sol/Luna, Claude Opus 5.5/Fable 5.2 y las filtraciones o pruebas de Gemini 4 Pro se concentraron en la misma semana. La velocidad de respuesta característica de Bluesky se refleja en que cuentas profesionales como Simon Willison publican de inmediato comparaciones paralelas (benchmark de dibujo de pelícanos).
  • Se habla del «desplome de los costes de razonamiento» con datos cuantitativos: Las cifras de Epoch AI, «caída del 47% trimestral» y «1/377 del coste en FrontierMath», se han difundido con citas más rigurosas que en otras plataformas (👍123 y 🔁30, la publicación con mayor reacción de esta investigación).
  • El campo de pesos abiertos se centra en informes de «ejecución local»: antirez sigue verificando Qwen3.8 Flash Next y DeepSeek v4.1 Flash en Mac/DGX Spark personales, mientras también se comunicó rápidamente la apertura de MiMo-V2.6 por Xiaomi. La publicación de Xiaomi de TestingCatalog (👍2) tuvo una reacción pequeña frente a la de Simon Willison (👍123), lo que sugiere que en Bluesky los nuevos lanzamientos de modelos cerrados se convierten más fácilmente en tema de conversación.
  • Nathan Lambert aporta un marco geopolítico para «cerrado frente a abierto»: Su observación de que los actores chinos separan Huawei para inferencia y Nvidia para entrenamiento ofrece un enfoque distinto de las discusiones sobre benchmarks técnicos de otras plataformas.
  • También existen bots de monitorización de API como ModelVantage, pero las incidencias recientes (fallo de Gemini 3.1 Pro del 14–15 de septiembre, con tasa de error del 100% durante varios minutos en US-East) no son un tema de «hoy» y no generaron repercusión, con 0 me gusta.
Límites
  • El API oficial de búsqueda (app.bsky.feed.searchPosts) devolvió de forma consistente 403 Forbidden desde el entorno de esta investigación, por lo que no fue posible realizar búsquedas directas por palabras clave (ocurrió tanto con acceso directo como mediante dos proxies CORS). Otros endpoints, como getProfile, getAuthorFeed y getPostThread, funcionaron correctamente, por lo que es probable que solo el endpoint de búsqueda esté bloqueado.
  • Debido a esta limitación, en vez de una búsqueda transversal por palabras clave se usó el método alternativo de «identificar cuentas probablemente relevantes → leer la lista de publicaciones de esas cuentas». Por ello, pueden faltar publicaciones de cuentas individuales o pequeñas no mencionadas aquí.
  • La página de búsqueda y las páginas de publicaciones de bsky.app son SPA renderizadas en cliente; WebFetch no pudo recuperar el cuerpo del contenido (solo el título «Bluesky»). Todos los enlaces corresponden a publicaciones confirmadas mediante el API, pero no se pudieron verificar visualmente abriéndolos en un navegador.
  • Bots de publicación automática como ai-news-jp.bsky.social llevan detenidos desde julio de 2025 y no podían utilizarse como temas de «hoy» (se excluyeron de Accounts).
  • No se encontró contenido publicado el propio 2026-09-25. Las publicaciones incluidas son principalmente recientes, del 2026-09-20 al 09-23, sobre GPT-6 Sol/Luna, Opus 5.5, Gemini 4 Pro y otros temas que siguen dominando la conversación. No fue posible reunir diez elementos solamente con publicaciones fechadas hoy.
  • Las cuentas japonesas (devllmlb-ja.bsky.social y otras) no publicaron durante la semana, por lo que la discusión sobre LLM en Bluesky en japonés parece menos activa que la de las cuentas anglófonas.

Lemmy

Lemmy — Lo más comentado hoy: el desplome de cuota de los modelos cerrados y el entusiasmo por Opus 5.5 / modelos locales

Comunidades
  • !«メールアドレス» — 88,221 personas. Foro general de tecnología al que llegan noticias relacionadas con LLM. Principal fuente de publicaciones sobre Gemini.
  • !«メールアドレス»(también con espejo en sh.itjust.works, ID 330)— 5,172 personas. Se centra en lanzamientos de modelos de pesos abiertos, benchmarks y publicaciones técnicas alrededor de llama.cpp.
  • !ai_reddit — Comunidad que vuelve a publicar entradas de r/ClaudeCode y r/ArtificialInteligence (no se pudo obtener el número de suscriptores en lemmy.world; no se pudo confirmar directamente por errores 404/500, véase Limits más abajo). Los hilos sobre Opus 5.5 se concentran aquí.
  • !hackernews — Espejo de artículos populares de Hacker News. Los temas de aplicación de LLM (investigación histórica y desanonimización) ocupan posiciones altas.
  • !«メールアドレス» — Comunidad de desarrollo del propio Lemmy. Se debate la creación de reglas de divulgación para el uso de IA/LLM.
  • !selfhosted — Comunidad de autoalojamiento. Está en marcha el debate sobre la definición de código abierto para LLM (K2 Horizons).
  • !blueteamsec / !lobsters — Republicaciones de investigación relacionada con LLM desde la seguridad y la tecnología.
Publicaciones
  1. Closed Models Fell From 70% to 21.6% Market Share in 3 Months — !tecnologia, puntuación 1, 2026-09-24 05:00
    https://officechai.com/ai/share-of-closed-models-has-fallen-from-around-70-to-21-in-the-last-3-months-vercel-data/
    Artículo que, basándose en datos de Vercel, informa que la cuota de uso de modelos cerrados se desplomó del 70% al 21,6% en apenas tres meses. Simboliza el eje cerrado frente a pesos abiertos de hoy.

  2. New Opus is absolutely bonkers — !ai_reddit(originalmente r/ClaudeCode), puntuación 0, 2026-09-24 20:01
    https://www.reddit.com/r/ClaudeCode/comments/1wp1q8n/new_opus_is_absolutely_bonkers/
    Hilo que describe el nuevo Opus de Anthropic como «una locura».

  3. Is Opus 5.5 really better than Fable in your experience? — !ai_reddit(originalmente r/ClaudeCode), puntuación 0, 2026-09-24 02:50
    https://www.reddit.com/r/ClaudeCode/comments/1woe3lo/is_opus_55_really_better_than_fable_in_your/
    Debate que compara, basándose en experiencia práctica, el rendimiento de Opus 5.5 y Fable en benchmarks.

  4. I A/B tested Opus 5 vs Opus 5.5 for AI slop: 98 em dashes vs 0 — !ai_reddit(originalmente r/ClaudeCode), puntuación 1, 2026-09-23 07:45
    https://www.reddit.com/r/ClaudeCode/comments/1wnwqcs/i_ab_tested_opus_5_vs_opus_55_for_ai_slop_98_em/
    Informe de una prueba A/B de la calidad de salida entre Opus 5 y Opus 5.5, según la cual se redujo notablemente la «sensación de IA» (como el uso excesivo de rayas largas).

  5. llama.cpp v0.5.0 — !LocalLLaMA, puntuación 23・comentarios 0, 2026-09-24 16:18
    https://github.com/ggml-org/llama.cpp/releases/tag/v0.5.0
    Lanzamiento de una nueva versión compatible con varias arquitecturas nuevas, incluido Qwen4Exp.

  6. New medical model: FreedomIntelligence/HuatuoGPT-3-27B — !LocalLLaMA, puntuación 7・comentarios 1, 2026-09-24 16:52
    https://huggingface.co/FreedomIntelligence/HuatuoGPT-3-27B
    Modelo médico de pesos abiertos basado en Qwen3.8-27B, construido con One-stage Policy Optimization sin ajuste fino supervisado.

  7. Qwen4-27B just confirmed — !LocalLLaMA, puntuación 34・comentarios 5, 2026-09-22 22:45
    https://lemmy.ml/post/53074988
    Hilo que informa de la confirmación oficial del lanzamiento de Qwen4-27B (han pasado tres días desde el anuncio, pero sigue mencionándose como el principal tema semanal de pesos abiertos).

  8. Google introduce "Call for Me" sui Pixel 11 per affidare le telefonate a Gemini — !tecnologia, puntuación 1, 2026-09-24 18:17
    https://www.theverge.com/ai-artificial-intelligence/1000116/google-gemini-business-phone-calls
    Google anuncia la nueva función «Call for Me», con la que Gemini responde llamadas en Pixel 11.

  9. Google invented the Transformer, so why does using Gemini still feel like a chore? — !ai_reddit(originalmente r/ArtificialInteligence), puntuación 1, 2026-09-24 08:35
    https://www.reddit.com/r/ArtificialInteligence/comments/1wovzal/google_invented_the_transformer_so_why_does_using/
    Publicación crítica que pregunta: «¿Por qué Google, que inventó el Transformer, sigue siendo superada por modelos de pesos abiertos ágiles como DeepSeek y Qwen?».

  10. Using LLMs to trace alchemical knowledge and decode 17th century letters — !hackernews, puntuación 7, 2026-09-24 20:00
    https://lemmy.bestiver.se/post/1359598
    Ejemplo de aplicación en investigación histórica que utiliza GPT-6 y Opus 5.5 para descifrar cartas alquímicas del siglo XVII.

  11. Large-scale online deanonymization with LLMs — !blueteamsec, puntuación 6, 2026-09-24 19:23
    https://infosec.pub/post/52730942
    Investigación que sostiene que es posible reidentificar con alta precisión a usuarios de Hacker News y participantes de Anthropic Interviewer usando LLM (hasta un 68% de recall con 90% de precisión). Destaca como ejemplo de incidente o riesgo asociado a LLM.

  12. Is K2 Horizons historically significant as the first actual open-source LLM, or am I falling for hype? — !Selfhosted, puntuación 48(a favor)/10(en contra)・20 comentarios, hace 5 días(aprox. 2026-09-20)
    https://lemmy.zip/post/... (republicado en lemmy.world: https://lemmy.world/post/52135351)
    Debate sobre si K2 Horizons puede considerarse «el primer LLM verdaderamente de código abierto». Hay muchas objeciones que citan precedentes como GPT-Neo, OPT y BLOOM, además de señalamientos de que los datos de entrenamiento no se han publicado.

Señales
  • Modelos cerrados frente a pesos abiertos: El elemento más simbólico de hoy fue el artículo que afirma que «la cuota de mercado de modelos cerrados cayó abruptamente del 70% al 21,6% en tres meses» (publicación 2). El ambiente general de Lemmy también favorece fuertemente a los pesos abiertos: destacan publicaciones que elogian el avance de DeepSeek/Qwen y ridiculizan la lentitud de Google (publicación 9), junto con nuevos modelos de pesos abiertos como Qwen4-27B y HuatuoGPT-3-27B (publicaciones 6 y 7).
  • Anthropic Opus 5.5: Varios hilos relacionados con Opus 5.5 se desarrollan simultáneamente en !ai_reddit (republicaciones de r/ClaudeCode; publicaciones 2, 3 y 4). Se habla tanto de calidad (reducción de rayas largas y otros rasgos) como de evaluación en benchmarks.
  • Incidentes y riesgos de LLM: También aparecen publicaciones técnicas sobre seguridad y prevención de abusos, como la investigación sobre desanonimización (publicación 11) y tecnologías de marca de agua (vLLM), en el clúster Lobsters/blueteamsec.
  • Despliegue práctico: También hay cierta cantidad de noticias sobre integración de producto, no sobre los modelos mismos, como «Call for Me» de Google Gemini (atención telefónica en Pixel 11, publicación 8).
Límites
  • Lemmy tiene comunidades pequeñas y no alcanzó diez hilos relacionados con LLM que pudieran llamarse con certeza nuevos del día. Se añadieron el debate de K2 Horizons de hace cinco días (publicación 12) y la publicación de Qwen4-27B de hace tres días (publicación 7) como «temas que siguen siendo referenciados esta semana», para completar 12 elementos.
  • No se pudo obtener el número de suscriptores de la comunidad !ai_reddit (lemmy.world/api/v3/community?name=ai_reddit devolvió 404 y lemmy.world/c/ai_reddit devolvió 500). Es posible que la instancia de origen sea otra, pero no se pudo identificar.
  • El acceso directo mediante WebFetch a las publicaciones originales de reddit.com (www.reddit.com/r/ClaudeCode/...) estaba bloqueado. El contenido se resumió únicamente a partir del título, puntuación y fecha de la publicación espejo de Lemmy; no se pudo confirmar el detalle de los textos originales.
  • Las interfaces de búsqueda de otras instancias, como lemmy.ml y lemm.ee, se sustituyeron por búsqueda de API en lemmy.world y consultas de API de instancias individuales en sh.itjust.works. No se realizó una búsqueda transversal de todas las instancias individuales.

Acciones recomendadas

  • En la próxima investigación de Reddit, añadir nombres concretos de modelos como «Opus 5.5», «GPT-6 Sol» y «GPT-6 Luna» a las búsquedas.
  • Confirmar con datos primarios la cifra de Vercel de «cuota de mercado de modelos cerrados del 70%→21,6%» antes de citarla.
  • Seguir de forma continuada la evolución de Frontier AI Standards Agency (SAFA) en medios escritos para compensar su visibilidad tardía en redes sociales.
  • Considerar un seguimiento específico en futuras ediciones para los resultados científicos del laboratorio de biología de Anthropic.
  • Añadir términos de búsqueda que complementen información primaria anglófona en la investigación de X, ya que tiende a sesgarse hacia demostraciones de creadores japoneses.
  • Comprobar al inicio de la próxima investigación si se ha resuelto el error 403 del API oficial de búsqueda de Bluesky.

Nota sobre la calidad de los datos

Reddit y Lemmy cumplieron el criterio de finalización de diez elementos, pero X se quedó en ocho porque la mayoría de los términos de búsqueda no guardaban relación con el tema. Bluesky recurrió a recopilación por cuenta a causa del error 403 del API de búsqueda y no obtuvo publicaciones fechadas el día de hoy; YouTube no pudo obtener reproducciones ni suscriptores exactos debido a limitaciones de renderizado.