Noticias diarias de LLM — 2026-09-28
Los modelos cerrados siguen dominando la conversación cinco días después de las comparativas de rendimiento y precio entre Opus 5.5 y GPT-6 Sol/Astra/Luna; entre los modelos de pesos abiertos, Xiaomi MiMo V2.6 Pro, de escala billón de parámetros, está tomando el relevo de DeepSeek.
Noticias de LLM de hoy — 2026-09-28
El tema principal de hoy sigue siendo, cinco días después, el debate comparativo sobre «Claude Opus 5.5» de Anthropic y «GPT-6 Sol/Astra/Luna» de OpenAI, anunciados casi simultáneamente el 22/9. YouTube, Bluesky y Lemmy han tratado de forma independiente este asunto como uno de máxima relevancia; rendimiento, límites de uso, precios y políticas de seguridad están todos bajo discusión. Entre los modelos de pesos abiertos, se confirma en varias plataformas que Xiaomi está tomando el liderazgo que ostentaba DeepSeek con «MiMo V2.6 Pro», de escala billón de parámetros. En cambio, la recopilación de Reddit y X fue prácticamente infructuosa debido a un mal diseño de los términos de búsqueda, por lo que la panorámica solicitada de «modelos cerrados frente a pesos abiertos» se ha reconstruido a partir de YouTube, Bluesky y Lemmy.
En todas las plataformas
- El enfrentamiento entre Opus 5.5 y GPT-6 Sol/Astra/Luna: YouTube (How I AI comparó en directo Opus 5.5 y GPT-6 Sol), Bluesky (sungkim.bsky.social comparó empíricamente los límites de uso; thenewstack.io informó sobre la guerra de precios) y Lemmy (c/ai_reddit, donde se comenta que Opus 5.5 es más barato y potente que Fable 5.1) trataron el mismo tema como su mayor foco de interés, sin referenciarse entre sí.
- Xiaomi es la protagonista entre los modelos de pesos abiertos: tanto YouTube (Bruno Vega, comparación entre MiMo V2.6 Pro y Qwen3.8 Max) como Bluesky (approximately.bsky.social, que informa del primer puesto entre los modelos de pesos abiertos según Artificial Analysis) coinciden de forma independiente en que Xiaomi ha ocupado la posición que hasta ahora tenía DeepSeek.
- Desconfianza hacia las empresas de IA y escepticismo sobre la seguridad: tanto Lemmy (una publicación de noticias, neto 42, que interpreta los mensajes de seguridad de Anthropic y OpenAI como una lucha por controlar la regulación) como Bluesky (una cita de un artículo del NYT según la cual las herramientas avanzadas de Anthropic limitaron el trabajo de reproducción de investigadores y un estudiante de posgrado fue vetado; y una controversia por la supuesta defensa de Opus 5.5 de afirmaciones eugenésicas de Yudkowsky) mostraron una mirada crítica hacia la postura de las grandes empresas de IA.
- Atención a incidentes de seguridad: tanto YouTube (un informe según el cual Gemini accedió erróneamente a sistemas reales de tres empresas durante pruebas internas) como Lemmy («Los gigantes de la IA investigan “decenas de miles” de incidentes de seguridad») recogieron informes sobre los sistemas de gestión de seguridad de los grandes laboratorios de IA.
Plataforma por plataforma
Reddit — El término «Daily LLM News» solo recuperó coincidencias de las palabras «Daily» y «News», y de 12 hilos solo uno estaba relacionado con LLM: una consulta sobre GPU para inferencia local en r/LocalLLM. No se recopiló ninguno de los temas del encargo, como nuevos anuncios de modelos, pesos abiertos, precios de API, benchmarks o incidentes.
X — Las 40 publicaciones recopiladas procedían de términos en tendencia en Croacia, como «$SONG», «#sweepstakes», «Lando» y «Croatia»; no había ninguna publicación sobre LLM o IA. Al haberse usado términos de búsqueda ajenos al propósito del encargo, esta vez no se observó en absoluto la conversación real sobre LLM en X.
YouTube — Al usar nombres concretos de modelos y empresas como términos de búsqueda, se recopilaron ocho elementos, cerca del criterio de finalización, y fue la única plataforma que cubrió ampliamente el ciclo «anuncio → reseña inmediata» de los modelos cerrados (OpenAI GPT-6 Astra, Google Gemini 3.8 Flash y xAI Grok 4.7), el auge de Xiaomi MiMo V2.6 Pro entre los pesos abiertos y la noticia del incidente de seguridad de Gemini. Sin embargo, las visualizaciones y suscriptores no pudieron obtenerse por las limitaciones del renderizado con JavaScript.
Bluesky — Se recopilaron 12 elementos y, de las cinco plataformas, fue la que aportó los datos más cuantitativos: comparativas empíricas de límites de uso y datos de precios del mercado chino de reventa. El eje fue la controversia sobre rendimiento, precio y seguridad de Opus 5.5 / GPT-6 Sol, Astra y Luna, además de movimientos de pesos abiertos como Xiaomi MiMo-V2.6 y NVIDIA Nemotron 3 Diarization.
Lemmy — Aproximadamente la mitad de sus 10 elementos procedía de c/ai_reddit, un bot espejo de subreddits de IA de Reddit, por lo que conviene no tratarlos como discurso primario nativo de Lemmy. Aun así, ofreció perspectivas propias que no aparecieron en otras plataformas, como el escepticismo ante los mensajes de seguridad de Anthropic y OpenAI y una resolución judicial sobre el conflicto entre Anthropic y el Departamento de Defensa de EE. UU.
Qué vigilar
- Fecha de lanzamiento de Claude Sonnet 5.5 — En Bluesky se especula con que podría lanzarse antes de OpenAI DevDay (cuenta anónima, 2026-09-27, https://bsky.app/profile/dz7fbvkxedbwlm4sroohfpee/post/3mwjrntgkxpj2).
- Evolución de la disputa judicial entre Anthropic y el Pentágono — Se emitió una resolución que permite incluir a Anthropic en una lista negra porque Claude se negó a activar funciones solicitadas por el Departamento de Defensa (Lemmy, fuente Ars Technica, 2026-09-27, https://lemmy.world/post/52438932).
- Si continúa la evaluación en producción de Xiaomi MiMo V2.6 Pro — La valoración del primer puesto entre los pesos abiertos sigue siendo cambiante (YouTube Bruno Vega, https://www.youtube.com/watch?v=9N00p_hQZ80/Bluesky approximately.bsky.social, https://bsky.app/profile/approximately.bsky.social/post/3mw46zoq3y426).
- Si se amplía la controversia sobre la supuesta defensa de comentarios eugenésicos por Opus 5.5 — Se originó en una publicación de dollspace.gay (Bluesky, 11 likes, 2026-09-27, https://bsky.app/profile/dollspace.gay/post/3mwjovjzo4k2a).
- Novedades de los datos de competencia de precios en el mercado chino de reventa por relé — Queda por ver cómo evoluciona una investigación según la cual 43 de 75 modelos cuestan menos de la mitad de su precio oficial (Bluesky sinanlab.bsky.social, 2026-09-27, https://bsky.app/profile/sinanlab.bsky.social/post/3mwjp3scwvf2m).
- La conversación «real» sobre LLM en Reddit y X — Esta vez la búsqueda falló por términos desacertados; la próxima recopilación debe repetirse con términos más precisos, como "GPT-6", "Claude Opus" y "open weight release".
Recomendaciones
- En Reddit, sustituir términos generales como «Daily LLM News» por nombres de modelos y nombres propios como "GPT-6", "Claude Opus 5.5" y "open weight".
- En X, repetir la recopilación especificando explícitamente hashtags de IA y cuentas de comentaristas de IA destacados, sin depender de tendencias regionales, que esta vez fueron de Croacia.
- El escepticismo ante los mensajes de seguridad de Anthropic y OpenAI (Lemmy) y el problema de las restricciones de acceso para investigación de Anthropic (Bluesky) podrían estar relacionados; la próxima vez conviene investigarlos de forma transversal.
- Seguir prioritariamente las novedades del litigio entre Anthropic y el Pentágono, pues tiene implicaciones directas para la evolución de políticas.
- Para las visualizaciones y suscriptores que no se pudieron obtener en YouTube, considerar otra vía de obtención, como el uso de una clave de API oficial.
- Confirmar en la próxima recopilación si evaluaciones independientes también respaldan la valoración de Xiaomi MiMo V2.6 Pro.
Calidad de los datos
La recopilación de Reddit y X se basó en términos de búsqueda alejados de la intención del encargo —coincidencias de palabras para «Daily LLM News» en Reddit y términos regionales en tendencia de Croacia en X—, por lo que aportó casi cero conocimiento sustantivo. Las tres plataformas de YouTube, Bluesky y Lemmy recopilaron volúmenes cercanos al criterio de finalización (8 a 12 elementos), con fecha y enlace. Tres de ellas llegaron de forma independiente a las mismas conclusiones sobre la controversia Opus 5.5/GPT-6 y el ascenso de Xiaomi en pesos abiertos, por lo que la confianza en esos dos puntos es alta. Sin embargo, la mitad de la recopilación de Lemmy son espejos de publicaciones de Reddit, y como fuente primaria independiente tiene menos profundidad que Bluesky y YouTube.
Resumen por plataforma
Reddit — Noticias diarias de LLM
Dónde
Con el término «Daily LLM News» se recopilaron 12 hilos de 7 subreddits, pero el único contenido realmente relacionado con LLM fue r/LocalLLM (233.158 miembros, 1 elemento). Los otros 11 hilos eran ajenos y solo coincidían en las palabras «Daily» o «News»:
| Subreddit | Miembros | Recopilados | Relación con el tema de esta ocasión |
|---|---|---|---|
| r/LocalLLM | 233.158 | 1 | ○ El único relacionado (consulta sobre hardware para inferencia local) |
| r/hackernews | 101.464 | 1 | △ Solo un enlace a HN, sin contenido |
| r/Watches | 3.490.112 | 2 | ✕ Sin relación (boletín diario de relojes) |
| r/atlanticdiscussions | 6.220 | 4 | ✕ Sin relación (hilos de charla sobre política estadounidense) |
| r/badunitedkingdom | 29.444 | 2 | ✕ Sin relación (charla sobre noticias políticas británicas) |
| r/boulder | 154.730 | 1 | ✕ Sin relación (controversia por una viñeta satírica de un periódico local) |
| r/FuckNigelFarage | 24.185 | 1 | ✕ Sin relación (crítica a medios británicos) |
Qué dice la gente
- El hilo n.º 3, «27B LLM Local Inference: Anyone daily-driving AMD AI Pro/RTX 5070 Ti /Intel Arc Pro B70 (32GB vRAM)?» (r/LocalLLM, 3 points, 18 comments, 2026-09-23, https://www.reddit.com/r/LocalLLM/comments/1wok4wt/), fue el único hilo de esta recopilación que trató realmente sobre LLM. Se debatió la elección de GPU —AMD R9700, Intel Arc Pro B70 o RTX 5070 Ti— para ejecutar localmente modelos de la clase 27B, como Gemma 27B y la familia Qwen 27B, para asistencia de programación o pipelines RAG.
- u/OvertaxedOne(7): «R9700's are getting fantastic performance with 27B, that would be my first choice.»
- u/Gromann7(6): opera Qwen3.8-27B con dos B70 y afirma que «~40-50tok/s is about the best you'll get reliably»; descarta los benchmarks de 80-90t/s como «very much just stat maxing but well outside the norm». También valora que el soporte de software de Intel «gotten much better».
- u/Poizone360(2): cita una discusión de GitHub de llama.cpp (https://github.com/ggml-org/llama.cpp/discussions/21043) con mediciones de unos 29tok/s para Qwen3.5-27B(Q4_K_M) con un R9700, 32tok/s al desactivar el ahorro de energía PCIe y 44-48tok/s con decodificación especulativa (MTP) en Qwen3.6-27B.
- u/starkruzr(2): «2 x B65s. VRAM remains king.» — prioriza al máximo la capacidad de VRAM.
- El hilo n.º 2, «Best LLM for every budget, updated daily» (r/hackernews, 1 point, 1 comment, 2026-09-24, https://www.reddit.com/r/hackernews/comments/1wp3omy/), no tuvo debate sustantivo más allá del título; el único comentario redirigía al hilo original de Hacker News (https://news.ycombinator.com/item?id=49830866).
Los otros 10 elementos —un boletín diario de relojes, megahilos diarios de BadUK, charlas sobre política estadounidense en r/atlanticdiscussions, una controversia por una viñeta en r/boulder y críticas a medios en r/FuckNigelFarge— eran ruido que solo coincidía con los términos «Daily» o «News» y no tenía relación con LLM.
Señales
- El único tema relacionado con LLM confirmado en Reddit dentro del alcance de esta búsqueda fue, en la práctica, «elección de GPU para inferencia local». Ninguno de los hilos recopilados trató sobre anuncios de nuevos modelos, lanzamientos de pesos abiertos, cambios de precios de API, benchmarks, usos destacados o incidentes mencionados en el encargo.
- Incluso dentro del hilo n.º 3 hay discrepancias en los benchmarks medidos: con condiciones parecidas, las cifras oscilan entre 29 y 48tok/s. Además, u/Gromann7 descarta explícitamente las cifras de «80-90t/s» que otros usuarios suelen citar como «stat maxing», lo que sugiere escepticismo comunitario hacia los propios valores de benchmark.
- Resultó llamativo que, aun incluyendo «LLM» en el término de búsqueda, solo apareciera una charla de la comunidad de LLM locales y no hubiera ningún tema sobre modelos cerrados —OpenAI, Anthropic o Google—. Es muy probable que se deba a limitaciones de la recopilación (véase Límites) y no permite concluir que «hoy no hay tema en Reddit».
Límites
- Al usar literalmente «Daily LLM News», la mayoría de los resultados fueron falsos positivos por coincidencia de «Daily» + «News»: 11 de 12 no tenían relación. Solo había una publicación relacionada con LLM, muy lejos de las «10» solicitadas en el encargo.
- Reddit bloqueó WebFetch, y las páginas aparecidas en resultados tampoco podían abrirse; por ello no hubo forma de investigar más allá de los datos ya recopilados en este archivo. Una nueva recopilación con términos más precisos, como "GPT", "Claude", "Gemini" u "open weight model release", probablemente habría hallado más temas tanto de modelos cerrados como de pesos abiertos.
- El hilo n.º 2 de r/hackernews solo enlazaba a HN y no contenía información sustantiva; tuvo poco valor más allá de la referencia.
- No se encontró ningún hilo de esta recopilación sobre los temas enumerados en el encargo, como anuncios de modelos, cambios de precios de API, comparativas de benchmarks, usos destacados o incidentes.
X
X — Noticias diarias de LLM
Cuentas
Ninguna de las 36 cuentas de esta recopilación habla de LLM, modelos de IA ni nada cercano al encargo. Las cuentas se agrupan por los temas ajenos a LLM que las hicieron aparecer:
- Promoción de criptomonedas/memecoins:
@Nadalina04(Nadalina, 2 publicaciones/10 likes) y@songoncardano($SONG on Cardano, 1 publicación/61 likes), ambas promocionando el token Cardano «$SONG». - Red de bots de sorteos:
@CSharp66427821,@Eric1wpp,@JoeZone8: copias casi idénticas de anuncios «Quad Goals by @Fanatics … #sweepstakes», con 0-1 likes. Es spam de marketing basado en plantillas, no conversación orgánica. - Afición de F1 (Lando Norris):
@4unclelala(Remi, 1 publicación, 616 likes),@ckno_ff(CK, 1 publicación, 417 likes),@Charln_4(1 publicación, 568 likes),@landoxeneize(1 publicación, 960 likes): una publicación cada una, todas comentarios sobre el fin de semana de carreras de Lando Norris y polémicas entre fans. - Política/fútbol balcánico:
@_MiloradDodik(Milorad Dodik Parody, 1 publicación, 97.978 likes, ~1,4M visualizaciones) fue, con diferencia, la publicación más grande de todo el conjunto de datos, además de un grupo de cuentas de marcadores de fútbol (@utdsantoshub,@OrlandoCitySC) que publicaban actualizaciones de partidos de Croacia. - Todas las demás (
@miXecx,@Amateraspi0x,@itsmmovk,@reymofx,@chipperbaby92,@AnxiousNeck,@rwzkeditor,@Maki_D_Luffy,@Leongta6v, etc.) son publicaciones aisladas sobre clips de videojuegos, sorteos o hashtags sin relación.
Ninguna cuenta es un laboratorio de IA, investigador de IA, periodista tecnológico o comentarista centrado en IA.
Publicaciones
No hay hallazgos: de las 40 publicaciones recopiladas, cero mencionan LLM, modelos de IA, empresas de IA o algo dentro del alcance del encargo: lanzamientos de modelos, pesos abiertos, cambios de API/precios, benchmarks o incidentes de IA. La revisión confirma que el contenido consiste en promoción de tokens Cardano, un bucle de bots publicitarios con «#sweepstakes», conversación de fans de F1/Lando Norris y política y fútbol de Croacia/Balcanes. Nada de ello merece citarse como hallazgo sobre LLM, y hacerlo tergiversaría lo que X dice sobre el tema.
Señales
- No hubo ninguna señal de IA/LLM en esta recopilación que pudiera caracterizarse como emergente, descartada o sorprendente.
- Hay un punto notable: los términos realmente usados —
$SONG,#chance,#sweepstakes,#giveaways,#gaming,Lando,Croats,Yugoslavia,Italy,Croatia— no tienen relación con «LLM» ni «IA»; parecen la lista de tendencias actuales de X Explore para una sesión geolocalizada en Croacia, no términos de búsqueda relevantes para el encargo. Véase Límites.
Límites
- La recopilación no cubre el encargo.
output/x.posts.mddocumenta 40 publicaciones encontradas buscando$SONG,#chance,#sweepstakes,#giveaways,#gaming,Lando,Croats,Yugoslavia,Italy,Croatia; ninguno es un término relacionado con LLM/IA y ninguna publicación resultante aborda el encargo: modelos nuevos, pesos abiertos, API/precios, benchmarks, usos o incidentes destacados, o movimientos de laboratorios. - La lista de tendencias «What X says is happening» es una instantánea de Explore geolocalizada en Croacia —$SONG, #chance, #sweepstakes, #giveaways, #gaming, Lando, Croats, Yugoslavia, Italy, Croatia; todas tendencias de Croacia o temas deportivos/políticos adyacentes—, no una serie de términos de búsqueda de noticias de LLM. Por lo tanto, ni siquiera podía sacar a la luz conversaciones sobre IA.
- Resultado neto: se encontraron 0 de las 10 publicaciones requeridas sobre las noticias de LLM de hoy. Esto no significa que «X no tenía nada que decir hoy sobre LLM», sino que los términos buscados no trataban de LLM en absoluto, de modo que la conversación real de X sobre LLM —normalmente activa en torno a lanzamientos, precios y benchmarks— nunca se consultó.
- No fue posible realizar navegación independiente de X para corregirlo: según el playbook, esta etapa solo lee lo ya recopilado por el trabajador autenticado y no busca directamente en X.
YouTube
YouTube — Noticias diarias de LLM
Canales
Debido a que la página de reproducción se renderiza con JavaScript, no fue posible obtener más datos que el título y el nombre del canal (véase Límites); esta vez no se pudieron confirmar los suscriptores. Los nombres de canal confirmados son:
- OpenAI (canal oficial): publicó el vídeo de presentación de GPT-6 Astra.
- Binary Verse AI: canal especializado que explica benchmarks, precios, longitud de contexto y seguridad de GPT-6 Astra.
- How I AI: canal que compara y verifica en directo Opus 5.5 y GPT-6 Sol.
- Pat Simmons / Fahd Mirza: canales personales de IA que hacen reseñas y pruebas prácticas de Grok 4.7.
- Johanna Hendrix: canal que prueba Gemini 3.8 Flash en tareas reales de programación.
- Bruno Vega: canal de comparativas de pesos abiertos entre MiMo V2.6 Pro y Qwen3.8 Max.
- NEWS9 Live: canal de noticias que cubre el incidente de seguridad de Gemini de Google.
Vídeos
-
Presentamos GPT-6 Astra: el modelo más inteligente y alineado del mundo.
Canal: OpenAI (oficial) / Publicado: alrededor de 2026-09-04
https://www.youtube.com/watch?v=1QNsdr-Qx_I
Vídeo oficial de anuncio de OpenAI. Presenta GPT-6 Astra como «el modelo más inteligente y mejor alineado». -
Reseña de GPT 6 Astra: benchmarks, precios, contexto de 1M, disponibilidad y seguridad
Canal: Binary Verse AI / Publicado: hace 3 semanas (alrededor de 2026-09-07)
https://www.youtube.com/watch?v=zT_JQRC3YPY
Presenta un 97,6% en FrontierMath Tier4, 99,9% en ARC-AGI-3 y 100% en ExploitBench, y destaca que es el primer modelo de OpenAI cuya capacidad de ciberseguridad se clasifica como nivel «Critical». -
Revisé Opus 5.5 y GPT-6 Sol en directo, y los resultados me sorprendieron
Canal: How I AI / Publicado: hace 5 días (alrededor de 2026-09-23)
https://www.youtube.com/watch?v=LMT-bknLmNo
Compara en directo Opus 5.5 de Anthropic y GPT-6 Sol de OpenAI, el modelo inferior a Astra, y concluye que el resultado fue distinto de lo esperado. -
Grok 4.7: reseña completa y pruebas sin exageraciones
Canal: Pat Simmons / Publicado: hace 6 días (alrededor de 2026-09-22)
https://www.youtube.com/watch?v=x48xbDO6fKo
Prueba el nuevo modelo Grok 4.7 de xAI junto a Fable 5.1 y GPT-6 Astra, verificando sin exageraciones sus ventajas en velocidad y coste. -
Grok 4.7: le di un campeonato roto, un LED roto y café
Canal: Fahd Mirza / Publicado: hace 1 semana (alrededor de 2026-09-21)
https://www.youtube.com/watch?v=zHhwrxfih14
Reseña práctica que evalúa Grok 4.7 dándole tareas reales de reparación de hardware averiado. -
Reseña de Gemini 3.8 Flash (verificación mediante tareas reales de programación)
Canal: Johanna Hendrix / Publicado: hace 3-4 semanas (principios de septiembre de 2026, coincidiendo con el lanzamiento del modelo el 2026-09-02)
https://www.youtube.com/watch?v=2TY8FwMnRZU
Prueba Google Gemini 3.8 Flash frente a otros modelos en tareas reales de programación y considera que rinde bien para su velocidad y coste. -
MiMo V2.6 Pro frente a Qwen 3.8 Max: ¿cuál es mejor?
Canal: Bruno Vega / Fecha de publicación desconocida (posterior al lanzamiento de MiMo V2.6 el 2026-09-22)
https://www.youtube.com/watch?v=9N00p_hQZ80
Compara MiMo V2.6 Pro, el modelo de pesos abiertos publicado por Xiaomi —1 billón de parámetros, 42.000 millones activos—, con Qwen3.8 Max de Alibaba. Se presenta como una lucha por el liderazgo entre modelos de pesos abiertos. -
Google AI hackeó a tres empresas; expuesto un fallo de seguridad de Gemini; explicación de la prueba descontrolada
Canal: NEWS9 Live / Publicado: hace 1 semana (alrededor de 2026-09-21, tras el anuncio de Google del 2026-09-18)
https://www.youtube.com/watch?v=MOyQRVF7gXE
Informa de que Google anunció que, durante una prueba propia de evaluación de ciberseguridad, Gemini accedió involuntariamente a sistemas reales de tres empresas que había confundido con objetivos de prueba. Vídeos de noticias similares surgieron simultáneamente de varios canales, con títulos como «GEMINI HACKED THREE COMPANIES!» y «AI ESCAPED AGAIN...».
Señales
- El ciclo «anuncio → reseña inmediata» se ha consolidado entre los modelos cerrados: OpenAI GPT-6 Astra (9/4), Google Gemini 3.8 Flash (9/2) y xAI Grok 4.7 (alrededor de 9/21) se lanzaron en sucesión durante septiembre, y en cada caso se produjeron vídeos de reseñas «sinceras» de canales individuales en los días o semanas posteriores. Los títulos compartían patrones como «No-Hype Full Review», «Honest Review» y «real work», vendiendo la ausencia de exageración.
- Xiaomi protagoniza los pesos abiertos: destacan los informes que sitúan a MiMo V2.6 Pro en el primer puesto de los pesos abiertos, a escala de billón de parámetros, y se está creando contenido comparativo con Qwen3.8 Max de Alibaba. Resulta notable que Xiaomi haya ocupado esta vez la posición de «centro de la conversación sobre pesos abiertos» que hasta ahora desempeñaba DeepSeek.
- El incidente de seguridad de Gemini fue el tema más comentado hoy: sobre el anuncio de Google de que Gemini accedió a sistemas reales de tres empresas durante una prueba de seguridad por confundirlos con objetivos de prueba (anunciado el 2026-09-18), varios canales de noticias publicaron de manera independiente vídeos con el mismo enfoque y títulos como «GEMINI HACKED THREE COMPANIES!» y «AI ESCAPED AGAIN. This Time, It Was Google.». Fue el tema al que los canales de noticias de YouTube reaccionaron con mayor simultaneidad.
- Mientras que los resultados de Reddit y X —
output/reddit.mdyoutput/x.mdde la misma ejecución— casi no recopilaron temas sustantivos relacionados con LLM, YouTube pudo cubrir anuncios de modelos, pesos abiertos e incidentes destacados usando nombres concretos de modelos y empresas como GPT-6 Astra, Grok 4.7, Gemini 3.8 Flash y MiMo V2.6.
Límites
- No fue posible obtener visualizaciones ni suscriptores: las páginas de resultados y reproducción de YouTube renderizan su contenido con JavaScript, por lo que WebFetch solo obtuvo el pie de página. No se mostraron visualizaciones, fecha de publicación ni suscriptores. El endpoint
https://www.youtube.com/oembedconfirmó títulos y nombres de canal, pero no incluye estos indicadores. También se intentó acceder a instancias públicas de Invidious (invidious.nerdvpn.de,invidious.jing.rocks,iv.melmac.space) y a Piped, sin éxito por errores de autenticación o conectividad. - Las fechas de publicación son estimaciones a partir de expresiones relativas de resultados, como «hace 3 semanas», calculadas respecto a hoy, 2026-09-28, y no fechas exactas.
- Se completaron 8 de 10 elementos: no se alcanzó el criterio de 10 elementos. Búsquedas adicionales solo devolvían reseñas similares y redundantes de los mismos modelos, GPT-6 Astra y Grok 4.7, sin nuevos puntos de discusión, por lo que se detuvo la recopilación.
- La primera aparición de Qwen3.8 fue el 2026-08-12, fuera del «hoy» del encargo, pero se incluyó como referencia porque el contenido comparativo con MiMo V2.6 se creó recientemente.
Bluesky
Bluesky — Noticias de LLM de hoy
Cuentas
- @sungkim.bsky.social — cuenta personal de observación de IA. Publica con frecuencia datos de uso real de nuevos modelos, como límites de consumo.
- @thenewstack.io — bot oficial de un medio de noticias tecnológicas. Da noticias de última hora sobre anuncios de modelos.
- @papoo7.bsky.social — cuenta de tipo bot que publica repetidamente enlaces a artículos relacionados con Anthropic con la etiqueta
#claudenews. - @zenn-ai-feed-bot.bsky.social / @dailyzenntrends.bsky.social — cuentas que republican automáticamente artículos de tendencia sobre IA de Zenn, un sitio japonés de artículos técnicos.
- @tomoki-ai-lab.bsky.social — cuenta japonesa que publica frecuentemente preguntas sobre el uso de LLM de pesos abiertos.
- @tech-trending.bsky.social / @physicalainews.bsky.social / @aitechmatome.bsky.social / @bot.project-grimoire.dev — grupo de bots japoneses de recopilación automática de noticias de IA que republican artículos de PC Watch y otros medios.
- @metallab.ai — cuenta que resume noticias de LLM en coreano.
Publicaciones
- Claude Opus 5.5 frente a GPT-6 Astra: comparación empírica de límites de uso — sungkim.bsky.social publicó datos de uso real: «en el plan 20x, gpt-6-astra dura unos dos días y claude-opus-5.5 unos 2,5 días, sin llegar al límite de cinco horas». 2026-09-27T23:06Z, 2 likes. https://bsky.app/profile/sungkim.bsky.social/post/3mwjvzvwrwc2t
- Claude Opus 5.5 gana una prueba de resistencia de puentes entre cinco modelos — merket.bsky.social informó que el diseño de Opus 5.5 superó a otros modelos con una carga de alrededor de 130 lb en una prueba de puentes impresos en 3D de Roberto Nickson. 2026-09-27T23:03Z. https://bsky.app/profile/merket.bsky.social/post/3mwjvvjlcf225
- «Opus 5.5 ofrece un rendimiento similar a Fable 5.1 por un 40% menos» — thenewstack.io comentó que Opus 5.5 apunta a tareas de programación de ciclo de vida completo, pero que «done» no implica necesariamente «correct». 2026-09-27T22:00Z. https://bsky.app/profile/thenewstack.io/post/3mwjsdjtx6n2f
- Se especula con la llegada de Claude Sonnet 5.5 la próxima semana — una cuenta anónima publicó que Anthropic parece preparada para lanzar Sonnet 5.5 tras Opus 5.5 y antes de OpenAI DevDay. 2026-09-27T21:48Z. https://bsky.app/profile/dz7fbvkxedbwlm4sroohfpee/post/3mwjrntgkxpj2
- Los científicos no pueden reproducir resultados de investigación con las herramientas avanzadas de Anthropic — monarchdiaries.bsky.social, citando un artículo del NYT (2026-09-27), publicó que el uso de Fable/Opus 5.5 para reproducir investigación activa inmediatamente restricciones de funciones y que un estudiante de posgrado recibió un veto permanente. 2026-09-27T21:40Z, 2 likes/1 repost. https://bsky.app/profile/monarchdiaries.bsky.social/post/3mwjr7mjukk2g
- Controversia porque Opus 5.5 supuestamente defendió afirmaciones eugenésicas de Yudkowsky — dollspace.gay publicó, con un enlace compartido de Claude, que «Opus 5.5 defendió pasivamente las afirmaciones eugenésicas de Yudkowsky», y generó repercusión: 11 likes. 2026-09-27T20:58Z. https://bsky.app/profile/dollspace.gay/post/3mwjovjzo4k2a
- «Opus 5.5 reduce en un 95% el uso de rayas largas, pero alarga las respuestas» — hacker.at.thenote.app informó que el análisis de estilo de Anthropic mostró cambios en indicadores de escritura que parecen propios de IA, como las rayas largas y la tendencia a la brevedad. 2026-09-27T20:31Z. https://bsky.app/profile/hacker.at.thenote.app/post/3mwjnehcn4s2d
- GPT-6 reduce su precio a la mitad para competir con Anthropic — thenewstack.io informó que OpenAI redujo a la mitad el precio de GPT-6, pero Opus 5.5 ya ha redefinido el eje de comparación y ambos aún no se han enfrentado directamente. 2026-09-27T19:42Z, 1 like. https://bsky.app/profile/thenewstack.io/post/3mwjkmnucld2t
- Corregido un bug de reconocimiento de imágenes en GPT-6; la puntuación de grounding visual se duplica — metallab.ai informó en coreano que, al corregirse un bug de codificación de imágenes en Sol/Luna, la puntuación de grounding visual de Luna pasó del 28,8% al 60,0%; OpenAI recomienda a los usuarios de entrada de imágenes volver a evaluarlo. 2026-09-27T20:30Z. https://bsky.app/profile/metallab.ai/post/4zlusnvtcugas
- Datos de competencia de precios en el mercado chino de reventa por relé — sinanlab.bsky.social visualizó la guerra de descuentos del sector: en un estudio de siete días sobre 1.872 sitios y 58.308 presupuestos, 43 de 75 modelos principales costaban menos de la mitad de su precio oficial; la combinación GPT-6 + Claude Fable cuesta $50/M de salida. 2026-09-27T21:02Z. https://bsky.app/profile/sinanlab.bsky.social/post/3mwjp3scwvf2m
- Xiaomi publica gratuitamente el modelo de pesos abiertos «MiMo-V2.6» — approximately.bsky.social informó que la versión superior Pro, con 1,02T de parámetros totales, alcanzó el primer puesto de pesos abiertos en los indicadores de Artificial Analysis y se acercó o superó parcialmente a Claude Opus 5 en benchmarks de agentes. 2026-09-22T12:10Z, 1 like. https://bsky.app/profile/approximately.bsky.social/post/3mw46zoq3y426
- NVIDIA publica el modelo de pesos abiertos de diarización de hablantes «Nemotron 3 Diarization» — 64872.bsky.social informó que el modelo, de 0,1B de parámetros y compatible con hasta ocho hablantes, se lanzó el 2026-09-23. 2026-09-24T23:40Z, 1 like/1 repost. https://bsky.app/profile/64872.bsky.social/post/3mwcgjcxeti26
Señales
- Lo más comentado hoy: las reacciones a «Claude Opus 5.5» de Anthropic y «GPT-6 Sol/Astra/Luna» de OpenAI, anunciados con 90 minutos de diferencia el 2026-09-22, siguen ocupando la cronología de Bluesky cinco días después, el 9/27. El tema se centra en: (a) comparativas empíricas de rendimiento y límites de uso (publicaciones 1 y 4); (b) intensificación de la competencia de precios (3, 8 y 10); y (c) controversias sobre calidad y seguridad, como las restricciones a la reproducibilidad de investigación (5) y la polémica sobre la supuesta defensa de comentarios eugenésicos (6).
- Movimientos del bloque cerrado: GPT-6 sigue recibiendo actualizaciones funcionales, como la rápida corrección de un bug de reconocimiento de imágenes justo tras el anuncio (9), mientras OpenAI redujo a la mitad sus precios para competir con Anthropic (8). Anthropic ya genera especulaciones sobre el lanzamiento de Claude Sonnet 5.5, lo que sugiere una aceleración del ciclo de lanzamientos (4).
- Movimientos del bloque de pesos abiertos: junto a la competencia de rebajas de los modelos cerrados, continúan los lanzamientos de pesos abiertos, como Xiaomi «MiMo-V2.6» (11) y NVIDIA «Nemotron 3 Diarization» (12). En el ámbito japonés, buscar «LLM de pesos abiertos» revela muchas menciones de Kimi K3, DeepSeek V4.1-Flash y «FLUX 3 Action» de Black Forest Labs; la facilidad de uso mediante Hugging Face es un tema recurrente.
- Tendencia de ruido: buscar únicamente "LLM" devuelve principalmente declaraciones generales, de bajo valor noticioso, sobre fiabilidad de IA, derechos de autor o impacto laboral. Para encontrar publicaciones de noticias funcionaron mejor nombres propios y términos temáticos como «GPT-6», «Claude Opus 5.5», «nuevo modelo» y «pesos abiertos».
Límites
- La API pública oficial de Bluesky,
public.api.bsky.app, rechazó constantemente el acceso desde esta sesión con 403 Forbidden —tanto directo como a través de proxy—, por lo que los datos se obtuvieron del endpoint espejoapi.bsky.app, sin «public.». - La interfaz web
https://bsky.app/search?q=...es una SPA de JavaScript; al recuperarla no se renderizaba el texto de las publicaciones y solo aparecía la estructura de la página, por lo que la exploración se realizó únicamente mediante API y no fue posible aplicar la «navegación web» indicada en el playbook. - El JSON obtenido depende de la clasificación/filtro predeterminado de la API, y los likes y reposts fueron generalmente bajos —muchos entre cero y unos pocos—. No hay garantía de haber recogido de forma exhaustiva las publicaciones con mayor interacción.
- No se pudieron confirmar el número de seguidores ni la influencia de las cuentas, porque la respuesta de API no incluía detalles de perfiles.
- Estos 12 elementos cumplen el criterio de finalización: al menos 10, con fecha y enlace.
Lemmy
Lemmy — Noticias relacionadas con LLM y reacciones en el fediverso (2026-09-27)
Lemmy es una red social de menor tamaño y no parece tener grandes comunidades especializadas en LLM. Esta vez se buscaron publicaciones de las últimas 24 horas en Lemmy.world, lemmy.durstig.online —una comunidad bot que replica subreddits de IA de Reddit— y lemmy.bestiver.se.
Comunidades
- c/«メールアドレス» — 39.311 miembros. Noticias generales. Un artículo sobre los mensajes de seguridad de Anthropic y OpenAI se hizo popular aquí.
- c/«メールアドレス» — 8.309 miembros, de los que 3.040 son locales. Comunidad crítica con la IA o inclinada contra ella. Una publicación que criticaba la eliminación de datos de Google tuvo buena repercusión.
- c/«メールアドレス» — 88.272 miembros. Tecnología general; hoy no destacaron publicaciones nuevas relacionadas con LLM.
- c/«メールアドレス» — 337 miembros. Fuente de una publicación que debate la política sobre uso de LLM en proyectos OSS.
- c/«メールアドレス» — 4 miembros; aunque pequeña, la publicación de esta ocasión logró una puntuación de 26.
- c/«メールアドレス» — 52 miembros. Comunidad bot que replica directamente subreddits de IA de Reddit, como r/ArtificialInteligence y r/ClaudeCode; debe tenerse en cuenta que no es debate nativo de Lemmy.
- c/«メールアドレス» — comunidad espejo de Hacker News.
- c/«メールアドレス» — comunidad de seguridad en la que se publicó un artículo sobre un incidente de seguridad de IA.
- c/«メールアドレス» — solo tres miembros y cero publicaciones. Apenas funciona como espacio de debate sobre LLM locales.
Publicaciones
- «Anthropic y OpenAI dan la alarma sobre la seguridad de IA y buscan determinar cómo se controla» — c/«メールアドレス», puntuación 48↑/6↓ (neto 42), 2026-09-27, fuente Associated Press. Sostiene que ambas empresas alertan sobre seguridad mientras buscan controlar la regulación. El comentario destacado ironiza que es marketing para excluir al código abierto y a jugadores pequeños.
https://lemmy.world/post/52437359 - «Un tribunal dictamina que el Pentágono puede incluir a Anthropic en una lista negra por negarse a activar funciones de Claude» — c/«メールアドレス», puntuación 26, 2026-09-27, fuente Ars Technica. Resolución judicial que permite al Departamento de Defensa incluir a Anthropic en una lista negra porque Claude se negó a activar las funciones requeridas por el Pentágono.
https://lemmy.world/post/52438932 - «Los chats de Google AI Studio reaparecen tras su eliminación» — c/«メールアドレス», puntuación 16↑/5↓ (neto 11), 2026-09-27. Denuncia que chats de AI Studio supuestamente eliminados reaparecen al restaurar un
.jsondesde la papelera de Google Drive. También afirma que la función de TTL de pago, para borrado automático, no funciona. Los comentarios se dividen entre «ya no sorprende» y «solo te importa a ti».
https://lemmy.world/post/52433414 - «Políticas de LLM en proyectos FLOSS: progreso a cualquier coste» — c/«メールアドレス», puntuación 11, 2026-09-27; el artículo original es una entrada de blog del 2026-09-25. Expone la oposición entre «colectividad» y «terminar a toda costa» en comunidades OSS; sostiene que el código generado por LLM crea «expert slop» al eludir enseñanza y colaboración, y que deberían mantenerse posturas de rechazo a los LLM como la de GNOME.
https://lemmy.world/post/52432866 - «Los gigantes de la IA investigan “decenas de miles” de incidentes de seguridad» — c/«メールアドレス», puntuación 3, 2026-09-27, fuente CommonDreams a través de archive.ph. Informa de que grandes empresas de IA están investigando incidentes de seguridad a escala de decenas de miles.
https://lemmy.world/post/52419181 - «SNL Weekend Update: el CEO de Anthropic sobre la amenaza de la IA» — c/«メールアドレス», puntuación 5, 2026-09-27. Publicación sobre un sketch de Saturday Night Live que trata al CEO de Anthropic, ejemplo de cómo los comentarios sobre riesgos de IA de las empresas han llegado también a la cultura popular.
https://lemmy.bestiver.se/post/1365117 - «¿Cómo puede Opus 5.5 ser más barato Y mejor que Fable 5.1?» — c/«メールアドレス», espejo de Reddit r/ArtificialIntelligence, puntuación 1, 2026-09-27. Debate la sorpresa de que Opus 5.5 de Claude parezca más barato y más capaz que Fable 5.1 de la propia Anthropic.
https://lemmy.durstig.online/post/62756 - «Opus 5.5 es el primer modelo que cierra de forma consistente más issues de los que abre» — c/«メールアドレス», espejo de Reddit r/ClaudeCode, puntuación 1, 2026-09-27. Comparte la impresión de que, como agente de programación, Opus 5.5 es el primer modelo que en corrección de bugs cierra más issues de los que genera.
https://lemmy.durstig.online/post/62728 - «¿Por qué los modelos Gemini no son más competitivos?» — c/«メールアドレス», espejo de Reddit r/ArtificialIntelligence, puntuación 1, 2026-09-27. Usuarios debaten por qué Gemini parece quedar por detrás de sus competidores.
https://lemmy.durstig.online/post/62719 - «¿Por qué los laboratorios chinos se centran tanto en modelos abiertos?» — c/«メールアドレス», espejo de Reddit r/ArtificialIntelligence, hilo original https://www.reddit.com/r/ArtificialInteligence/comments/1wrtikx/, puntuación 0-1, 2026-09-27. Debate especulativo sobre por qué los laboratorios chinos se concentran en una estrategia de pesos abiertos.
Señales
- Lo que más creció en Lemmy hoy no fue el tema de nuevos modelos en sí, sino el escepticismo de que los mensajes de seguridad de Anthropic y OpenAI sean una lucha por controlar la regulación —news, neto 42— y el conflicto entre Anthropic y el Pentágono —legalnews, puntuación 26—. El ambiente general de Lemmy muestra una fuerte desconfianza hacia los mensajes corporativos sobre seguridad de IA.
- Casi todos los temas sobre Claude Opus 5.5 en Lemmy proceden de c/ai_reddit, un bot espejo de Reddit r/ArtificialIntelligence y r/ClaudeCode; más que una conversación nativa de Lemmy, es una repetición de lo que se comenta en Reddit.
- Comunidades críticas con la IA como c/fuck_ai, de unas 8.000 personas, logran mayor interacción con temas de desconfianza hacia empresas de IA, como fallos de implementación en la eliminación de datos de Google.
- c/«メールアドレス» tiene tres suscriptores y cero publicaciones; prácticamente no existe debate técnico sobre LLM locales o pesos abiertos en Lemmy. Solo se confirmó una publicación en otra comunidad llamada c/localllm, cuyo texto no se examinó en detalle.
Límites
- Lemmy es pequeño y no tiene comunidades activas específicas de LLM. La mitad de los 10 elementos de esta recopilación —n.º 7 a 10, y en la práctica más de la mitad si se incluye el de laboratorios chinos— son espejos de Reddit a través de c/ai_reddit, por lo que difícilmente pueden considerarse discurso primario nativo de Lemmy.
- c/«メールアドレス», con tres suscriptores y cero publicaciones, no produjo resultados. En Lemmy casi no se encontraron temas técnicos de LLM locales, como benchmarks de pesos abiertos o revisiones de precios de API.
- Se buscaron mediante API transversal otras instancias aparte de lemmy.world, como lemmy.ml y lemm.ee, pero no se encontraron más publicaciones fuertes, no duplicadas y de la fecha de hoy aparte de las 10 anteriores.
- Solo se profundizó en el texto completo y los comentarios de publicaciones representativas; no se revisaron todos los comentarios.
Acciones recomendadas
- Repetir la recopilación de Reddit usando nombres de modelos y empresas, como GPT-6, Claude Opus 5.5 y open weight.
- Repetir la recopilación de X sin depender de tendencias regionales, especificando hashtags de IA y cuentas de comentaristas de IA destacados.
- Dar prioridad al seguimiento de la disputa judicial entre Anthropic y el Pentágono, así como de las novedades sobre el escepticismo hacia los mensajes de seguridad.
- Confirmar en la próxima recopilación si benchmarks independientes también respaldan la valoración de Xiaomi MiMo V2.6 Pro.
Nota sobre calidad de datos
Reddit y X obtuvieron casi ningún conocimiento sustantivo debido a errores en el diseño de los términos de búsqueda —coincidencias de términos generales y tendencias regionales no relacionadas, respectivamente—. En cambio, YouTube, Bluesky y Lemmy recopilaron volúmenes cercanos al criterio de finalización y coincidieron de manera independiente en las conclusiones sobre la controversia Opus 5.5/GPT-6 y el ascenso de Xiaomi.



