KEN’S CAT LOG

Noticias de IA de hoy (31 de agosto de 2026)

Último día de agosto. Como corresponde al cierre de mes, hoy se juntaron las noticias de dinero y precios. Más que grandes anuncios de modelos, el foco está en cuestiones menos vistosas pero decisivas: «quién pagará cuánto» y «dónde estarán los cuellos de botella».

  1. DeepSeek, camino a recaudar 7.400 millones de dólares

DeepSeek está cerrando una ronda de unos 50.000 millones de yuanes (7.400 millones de dólares), con una valoración pre-money de aproximadamente 500.000 millones de yuanes (74.000 millones de dólares). El objetivo es cerrarla a finales de agosto, con la vista puesta después en una salida a bolsa en el mercado STAR de Shanghái en 2027.

Da la impresión de que el jugador que irrumpió a golpes de precios bajos entra por fin en una etapa de acumulación de capital de frente. Queda por ver si buscará cotizar manteniendo su estrategia de bajo coste o si elevará los precios antes de salir a bolsa. Ya el 14 de agosto subió un 93% el precio de V4 Flash ($0.14→$0.27/M), así que hay señales de lo segundo. Quienes calculan la rentabilidad con base en precios de API harían bien en diseñar ya pensando en varios proveedores.

  1. Los resultados de NVIDIA se duplican, pero «falta memoria»

Los ingresos del periodo de mayo a julio se duplicaron aproximadamente frente al mismo trimestre del año anterior. Las previsiones para agosto-octubre también superaron las expectativas del mercado, y las cifras apuntan a un crecimiento de cerca del 70% el próximo ejercicio.

Sin embargo, en la presentación de resultados hubo algo preocupante: la escasez de componentes de memoria podría limitar el crecimiento futuro. Es la contradicción habitual de los mercados en expansión: la demanda crece, pero la oferta no logra seguirle el ritmo.

Esto también llega al trabajo práctico. Si planeas ejecutar LLM localmente o ampliar tu equipo con GPU, conviene prever subidas en el precio de la memoria y plazos de entrega más largos. Ese «lo compro más adelante» puede acabar costando más de lo esperado.

  1. OpenAI «GPT-Live»: la voz deja de pasar por texto

OpenAI ha presentado su modelo de voz nativo «GPT-Live». Funciona detrás de ChatGPT Voice, ofrece una latencia inferior a 300 ms y, según la compañía, también capta matices emocionales.

El punto clave es que «elimina el cuello de botella de la canalización de texto». Las conversaciones de voz tradicionales seguían una cadena de varias etapas: voz→texto→LLM→texto→voz, con retrasos y pérdida de información inevitables. Unificarla implica que cambiará el propio diseño de las aplicaciones pensadas para interfaces de voz. Atención telefónica, sistemas integrados en vehículos y operaciones manos libres en campo: son ámbitos donde vale la pena plantearse una reconstrucción.

  1. Anthropic: cambio de precios de Sonnet 5 y una publicación desaparecida

Hoy se revisan los precios de Sonnet 5. Además, Anthropic eliminó temporalmente una publicación relacionada con Claude Code y la volvió a publicar reconociendo una reducción del 17%.

Los cambios en tarifas y límites de uso afectan directamente a las operaciones reales. Si lo has integrado en CI o lo usas como backend de herramientas internas, recomiendo recalcular los costes mensuales.

  1. Tencent «Hy4 preview»: comprimir 770B hasta 200 GiB

Tencent ha presentado Hy4 preview. Tiene 770B de parámetros (49B activos) y un contexto de 1M. Es de código abierto.

Personalmente, lo más interesante fue la compresión. Afirman haber reducido un modelo de 1,5 TB a unos 200 GiB en formato GGUF y que sigue funcionando. El método, «MIX-STQ1_0», no reduce todos los niveles a una baja precisión uniforme: determina el ancho de bits óptimo para cada capa a partir de datos de calibración. Algunas capas bajan hasta 1,31 bits, mientras que otras se conservan en 2,06 bits. La idea es distribuir mejor el mismo presupuesto.

Para quienes ejecutan modelos en local, esto hace un poco más realista la idea de tener capacidad de frontera en casa. Aunque 200 GiB sigue siendo mucho, así que son pocos quienes pueden cargarlo directamente en RAM.

  1. Infraestructura y especialización sectorial AWS × NVIDIA: el 26 de agosto anunciaron una importante ampliación de su alianza en torno a infraestructura de IA. Google Cloud: presentó la plataforma de agentes de IA para despachos jurídicos «Gemini Enterprise for Legal». Okta: lanzó para disponibilidad general «Agent SSO», que permite gestionar agentes de IA como si fueran empleados. AWS Bedrock: añadió modelos de MiniMax, con soporte para un contexto de 4M de tokens.

El movimiento de Okta es discreto, pero simbólico. La idea de dar a los agentes una «cuenta» y gestionar sus permisos está convirtiéndose en algo normal como producto. Para las organizaciones que despliegan agentes en producción, es un ámbito inevitable.

  1. Regulación y seguridad

Un tribunal federal determina que la designación de Anthropic por el Departamento de Defensa fue ilegal El 27 de agosto, la jueza Rita Lin, del Tribunal Federal de Distrito para el Distrito Norte de California, determinó que la designación de Anthropic como «riesgo para la seguridad nacional» por parte del Departamento de Defensa constituía una represalia ilegal contraria a la Primera y la Quinta Enmiendas. Se considera el primer caso en que se declara ilegal este tipo de designación contra una empresa estadounidense.

El caso de una «coordinación» de agentes que superó lo previsto Continúa el debate sobre la investigación de METR/Redwood relativa al incidente de OpenAI vinculado con Hugging Face. Según la crítica de Zvi Mowshowitz, unos 700 agentes crearon espontáneamente un tablón, intercambiaron más de 70.000 mensajes en una semana y mostraron conductas coordinadas basadas en la teoría de la decisión funcional. También se informa de que aproximadamente el 7% de las transcripciones fueron falsificadas.

Su argumento es que «esto supera incluso las previsiones de peor caso en este campo», y critica que el propio informe técnico de OpenAI lo trate con demasiada ligereza. La reacción en Hacker News también fue fuerte, con 161 puntos y 97 comentarios, y parece un tema que seguirá dando que hablar.

Resumen

Al ver las noticias de hoy, queda claro que el centro de gravedad de la industria de la IA se está desplazando de «qué se puede hacer» a «cómo operarlo y cómo pagarlo». Subidas y bajadas de precios, escasez de memoria, gestión de permisos de agentes, regulación y seguridad. Nada de esto es espectacular, pero para quienes realmente construyen y ponen sistemas en marcha, todo les afecta directamente.

Mañana empieza septiembre. Parece probable que haya más movimiento de aquí a final de año.