El Compilado Hilos Temas Archivo RSS

martes · 9 min de lectura

El Compilado — 11 de agosto de 2026

Meta libera Muse Glimmer de 30B, OpenAI lanza GPT-5.6-Cyber y encuentra dos zero-days en Chrome, un Claude experimental mejora una cota del problema de Riemann y Anthropic cierra un lease de 191 MW por US$9.100M.

iahardwareroboticaciberseguridadtecnicas

Generado el 11/08/2026 a las 10:09. Cubre las últimas 24 horas (10/08 ~10:00 → 11/08 10:09).

TL;DR

  • Meta liberó Muse Glimmer: modelo agéntico open-weight de 30B (Apache 2.0) que corre en una sola GPU de consumo.
  • OpenAI lanzó GPT-5.6-Cyber, que ya encontró dos 0-days en Chrome; primer modelo en alcanzar el umbral “High” de capacidad cyber de su Preparedness Framework.
  • Anthropic tuvo un día cargado: un Claude experimental mejoró una cota del problema de Riemann (41,6% → 67,2%), cerró un lease de datacenter de 191 MW con Riot por ~US$9.100M y prepara una IPO récord.
  • Unitree abrió la suscripción de su IPO (~US$9.000M de valuación) e Intel anunció una emisión de acciones por US$15.000M para financiar su expansión en AI.
  • tl;dv, el notetaker con IA, expuso 181.000 reuniones por una falla de aislamiento de tenants que quedó sin arreglar seis meses tras el reporte.

IA

  • Meta lanzó Muse Glimmer, un modelo agéntico de 30B que corre en una laptop (10/08). Es un modelo denso multimodal bajo Apache 2.0, destilado de Muse Spark 1.2, con contexto de 131K y optimizado para agentes locales: tool use, coding y LLM-as-judge. Con cuantización 4-bit entra en menos de 20 GB (una GPU de 24 GB alcanza) y logra 3,1× de speedup en una RTX 5090 vía speculative decoding. Zuckerberg lo acompañó con un ensayo defendiendo los open weights y la destilación, y prometió liberar Muse Spark 1.2 en las próximas semanas. Meta AI · TechCrunch · Hugging Face

  • OpenAI presentó GPT-5.6-Cyber y ya encontró dos 0-days en Chrome (10/08). Expandió su iniciativa Daybreak en dos niveles: Blue (GPT-5.6 Sol sin guardrails cyber de sistema) y Red, con acceso a GPT-5.6-Cyber, un modelo entrenado a propósito que responde el 95% de las consultas sensibles de seguridad ofensiva. El modelo descubrió dos vulnerabilidades desconocidas en V8 que Google parcheó como CVE-2026-15903. Es el primer modelo de OpenAI en alcanzar el umbral “High” de capacidad cyber; desde el 1/09 las cuentas Daybreak exigirán llaves de seguridad físicas. The Decoder

  • Un Claude experimental mejoró una cota del problema de Riemann orquestando ~60 subagentes (10/08). Anthropic reveló que una versión de investigación no publicada de Claude elevó la cota inferior de la fracción de ceros de la función zeta que cumplen la hipótesis de Riemann de 41,6% a 67,2%, sintetizando papers recientes. Corrió dentro de Claude Code en dos sesiones: 31M de tokens de salida, 650 ideas iniciales, ~60 subagentes y 2.400 comandos de shell. Lo presentan como evidencia del enfoque de orquestación de agentes para matemática dura. Anthropic

  • Anthropic firmó un lease de datacenter a 20 años con Riot Platforms por ~US$9.100M (10/08). Riot reveló un contrato por 191 MW en su campus de Rockdale, Texas, hasta 2048, con opciones de extensión que llevarían el total a US$16.100M; 96 MW entran en línea en diciembre 2027. Las acciones de Riot saltaron 25% after-hours. En paralelo, el WSJ reporta que Anthropic está cortejando inversores para una posible IPO en octubre que sería la mayor de la historia, con un run rate de ingresos rumbo a US$50.000M+. The Block · WSJ

  • Moody’s advirtió que la dependencia bancaria de OpenAI y Anthropic es un riesgo sistémico (10/08). El informe señala que la adopción acelerada de IA propietaria crea una “dependencia sistémica” de un grupo concentrado de proveedores que aún pierden plata, con potencial poder de pricing sobre los bancos. Más de tres cuartos de las firmas financieras del Reino Unido ya usan IA. Anticipa mayor escrutinio regulatorio sobre resiliencia operativa y concentración de proveedores. The Guardian · Enterprise AM

Hardware y Robótica

  • Intel anunció una emisión de acciones por US$15.000M (10/08). La oferta pública (con opción a US$2.250M adicionales) financiará capex y capital de trabajo mientras Intel empuja en physical AI, silicio a medida, advanced packaging y producción de wafers para terceros. La acción cayó ~3% en premarket por dilución, aunque acumula más del doble en el año por el momentum del turnaround y su apuesta foundry contra TSMC. TechStartups

  • Unitree abrió la suscripción de su IPO en Shanghai con valuación de ~US$9.000M (10/08). La empresa de Hangzhou busca recaudar ~6.100M de yuanes (US$904M) en el STAR Market y se convierte en el primer fabricante de humanoides rentable y a escala en cotizar: facturó 1.700M de yuanes en 2025, con los humanoides ya superando a los cuadrúpedos como principal negocio. Es el primer “reality check” público diario para valuaciones privadas como la de Figure AI (US$39.000M con ingresos casi nulos). Robotics & Automation News · TechTimes

  • TSMC reportó ventas de julio por US$14.500M, +45% interanual (10/08). El dato confirma que el gasto en infraestructura de IA sigue firme: TSMC fabrica para Nvidia, Apple, AMD y Qualcomm, y ya subió su guidance 2026 a más de 40% de crecimiento en dólares mientras expande capacidad de packaging CoWoS, cuello de botella de los aceleradores. TechStartups

  • Alibaba DAMO publicó RynnValue, un reward model para robots sin labels de preferencia (11/08). Usa distancia temporal como señal de supervisión en vez de preferencias humanas, lo que le permitió escalar a 7.000+ horas y ~3M de clips condicionados por instrucción. Convertido en rewards densos, sube el éxito de políticas reales de 52,5% a 72,5% online — un camino más barato para entrenar manipulación robótica. Paper (HF)

  • Corea del Sur lanzó un fondo de US$3.500M para su cadena de suministro de chips (10/08). El fondo de 5 billones de wones apoyará materiales, equipos, componentes y diseño fabless, más otros 5 billones en financiamiento comercial para exportadores. Se suma a la estrategia de destrabar más de US$576.000M en inversión fabril, apuntalando la posición de Samsung y SK Hynix en memoria HBM. TechStartups

Ciberseguridad

  • Framework sufrió una brecha por un 0-day de SQL injection en Metabase (10/08). El fabricante de laptops reparables confirmó que atacantes explotaron una vulnerabilidad sin CVE en Metabase Cloud (versiones 58+) que permite inyectar SQL sin autenticación y ganar acceso de administrador. Se filtraron nombres, emails, teléfonos, direcciones e IPs de login de clientes, aunque no datos de pago. Si usás Metabase self-hosted, actualizá ya. Help Net Security · SecurityWeek

  • tl;dv expuso 181.000 reuniones grabadas y tardó seis meses en arreglarlo (10/08). El investigador bobdahacker reveló que el notetaker con IA para Zoom/Meet/Teams dejó 181.874 registros de reuniones de 84.312 usuarios consultables por cualquier usuario autenticado, por una regla de aislamiento de tenants faltante en Firestore. Había sesiones activas de agencias de gobierno, universidades, HubSpot y Confluent a las que un tercero podía unirse. Reportado el 28/01, siguió sin fix durante meses. bobdahacker

  • Nuevo ataque desencripta el chain-of-thought cifrado de Anthropic, OpenAI y Google (11/08). Un paper muestra que los bloques de razonamiento cifrados que emiten los providers son intercambiables entre sesiones, usuarios y modelos del mismo ecosistema: un atacante puede inyectar el CoT cifrado de un modelo capaz en un hermano más débil y forzarlo a desencriptarlo en texto plano. Decodificaron 315.320 bloques de repos públicos y recuperaron 367 artefactos de PII y 182 credenciales, además de una vía de prompt injection invisible que persiste en rollouts agénticos. Paper (HF)

  • Mozilla rotó la clave GPG que firma releases de Firefox y Thunderbird (10/08). Una copia sin cifrar de la subkey se commiteó por accidente a un repo privado de GitHub. La auditoría no encontró evidencia de acceso no autorizado y la clave vieja fue revocada; solo tenés que actuar si verificás firmas manualmente o usás paquetes RPM. Mozilla Security Blog · SecurityWeek

  • Venció el plazo de CISA para parchear el RCE crítico de Kemp LoadMaster (CVE-2026-8037) (10/08). El command injection pre-auth (CVSS 9.6) entró al catálogo KEV el 7/08 tras 792 intentos de explotación registrados desde 65 IPs; las agencias federales tenían hasta ayer para mitigar. Si tenés LoadMaster expuesto con la API habilitada, actualizá a 7.2.63.2 / LTSF 7.2.54.18. The Hacker News · CISA

Técnicas, repos y práctica

  • antirez publicó h3.c: inferencia nativa de MiniMax H3 en Apple Silicon (11/08). Salvatore Sanfilippo (creador de Redis) lanzó una implementación from-scratch en Metal 4 del modelo de generación de video MiniMax H3. En una M5 Max renderiza clips de 512×512 y 22 frames en ~12,6 s (u ~8 s con reuso de velocity 3×), con pico de ~25,9 GiB usando cuantización int8 de activaciones y kernels fusionados. Referencia excelente si te interesa inferencia local optimizada a mano. GitHub

  • Evo-Bench: el primer benchmark que mide si un LLM puede mejorar su propio harness de agente (11/08). Aísla la capacidad del modelo de optimizar autónomamente su scaffolding en dominios Search, Office y General. En nueve modelos frontier y open-weight, los mejores logran ganancias absolutas de hasta 16,6 puntos, casi igualando harnesses diseñados por humanos en Search y General — pero se estancan en workflows de Office. Útil si estás construyendo agentes que se auto-mejoran. Paper (HF)

  • SWE-Bench ProMax: nuevo benchmark multilenguaje de refactoring donde el mejor modelo saca 41,2% (11/08). Son 170 tareas curadas por expertos en Python, Java, TypeScript, Go, C, C++ y Rust, con un promedio de 11,4 archivos modificados por tarea. Los autores reescribieron cada issue y revisaron los test suites a mano, corrigiendo los tests defectuosos que una auditoría reciente encontró en el 60% de las instancias no resueltas de SWE-Bench Verified. Recalibra qué tan lejos están los agentes de coding del trabajo real. Paper (HF)

  • Dan Luu: el lenguaje de programación casi no predice el costo de un coding agent (11/08). Desafía el claim viral de que los lenguajes dinámicos dan una gran ventaja de eficiencia de tokens: corriendo los mismos agentes en tareas realistas (decoder de Zstd, Pandoc), la brecha de 2,6× entre C y Clojure reportada en problemas triviales desaparece a mayor dificultad. Lo que sí correlaciona con éxito es la popularidad del lenguaje. Dato útil antes de elegir stack “para agentes”. danluu.com

  • Metodología para inferir el training run real de modelos frontier (10/08). Shrivu Shankar publicó una técnica de probing con quizzes de hechos históricos y auto-identificación que revela que los Opus 4.7+ de Anthropic comparten un cutoff de fines de diciembre 2025 (probablemente un mismo run), que la familia GPT-5.6 se agrupa en un checkpoint de febrero 2026, y que Opus 5 tiene un estado de conocimiento más viejo (~enero 2026) que su cutoff publicado de mayo. Interesante para entender qué hay realmente detrás de los model cards. blog.sshh.io

Ver todos los briefings