El Compilado Hilos Temas Archivo RSS

viernes · 6 min de lectura

El Compilado — 17 de julio de 2026

Moonshot lanza Kimi K3 con 2,8T de parámetros y Thinking Machines presenta Inkling, Google pone Gemini 3.5 Pro en la calle con 2M de contexto, TSMC marca un trimestre récord de US$40.200M y siguen los ataques a npm y PyPI.

iahardwareciberseguridad

Generado el 17/07/2026, ~10:15 (hora de Argentina). Cobertura: últimas ~24-48 horas.

TL;DR

  • Ola de modelos abiertos: Moonshot lanzó Kimi K3 (MoE abierto de 2.8T de parámetros) y Thinking Machines, la startup de Mira Murati, presentó “Inkling” (975B, razonamiento), acercando el open-weights a la frontera.
  • Google DeepMind pone hoy (17/07) en la calle Gemini 3.5 Pro, reconstruido desde cero, con ventana de contexto de 2M de tokens.
  • TSMC reportó un trimestre récord (US$40.200M, +36% interanual) y subió su pronóstico anual de crecimiento por IA a más del 40%: el ciclo de gasto en cómputo no se enfría.
  • Microsoft Patch Tuesday de julio: 570 fallas corregidas, incluidos 3 zero-days (dos explotados activamente); sigue la campaña de explotación de SharePoint on-prem.
  • Cadena de suministro bajo fuego: paquetes maliciosos en npm/PyPI que roban secretos de CI/CD (falsos SDKs de pago) y compromiso del pipeline de AsyncAPI.

IA

Moonshot lanza Kimi K3, un modelo abierto de 2.8 billones de parámetros. La china Moonshot AI publicó Kimi K3, un MoE open-weights de 2.8T de parámetros (activa 16 de 896 expertos) con ventana de contexto de ~1M de tokens, posicionado para cerrar la brecha con los modelos top de EE.UU. como Opus 4.8. Es una de las señales más fuertes de que el open-weights chino ya juega en la primera división. Bloomberg · TechCrunch · Fortune

Thinking Machines (Mira Murati) presenta “Inkling”, un modelo de razonamiento de 975B. La startup fundada por la ex-CTO de OpenAI mostró Inkling, un modelo de razonamiento entrenado con RL que pesa 975.000 millones de parámetros y requiere más de 2 TB de memoria de GPU. Afirman igualar a Nvidia Nemotron 3 Ultra en Terminal Bench 2.1 usando ~un tercio de los tokens, y planean liberar los pesos cuando termine el testeo. The Register

Google DeepMind lanza hoy Gemini 3.5 Pro tras un rediseño total. DeepMind había pospuesto el lanzamiento hasta el 17/07 para reconstruir la arquitectura desde cero en vez de partir de Gemini 2.5 Pro. El modelo suma una ventana de contexto de 2M de tokens, una capa “Deep Think” de razonamiento y capacidades de flujos de trabajo autónomos. BigGo Finance

xAI/SpaceXAI pone a Grok 4.5 como “clase Opus” a menor costo. Anunciado el 8/07 y disponible esta semana, Grok 4.5 fue entrenado junto a Cursor sobre decenas de miles de GPUs NVIDIA GB300. Musk lo describe como “clase Opus, pero más rápido, más eficiente en tokens y más barato”, a US$2/US$6 por millón de tokens (input/output) frente a US$5/US$25 de Opus 4.8. TechCrunch · Axios

Contexto de la carrera de frontera: GPT-5.6 y Sonnet 5. OpenAI completó el despliegue de su familia GPT-5.6 (Sol como buque insignia con modo subagente “Ultra”), y Anthropic lanzó Sonnet 5 con desempeño cercano a Opus 4.8 a precio introductorio de US$2/US$10 por millón hasta el 31 de agosto. El ritmo de releases de julio marca una intensificación de la competencia por precio y capacidades. ThursdAI · LLM Stats

Hardware

TSMC cierra un trimestre récord y sube el pronóstico por IA. La fundición reportó US$40.200M de ingresos (+36% interanual) y ganancia neta récord; el segmento de alto rendimiento (aceleradores de IA) creció 20% secuencial y ya representa el 66% de los ingresos por wafers. Subió su outlook anual a más de 40% de crecimiento: el gasto en infraestructura de IA, lejos de mesetear, se aceleró. TechTimes · Bloomberg

Meta empieza a fabricar su chip de IA “Iris” en septiembre. Meta comenzará la producción de su acelerador de datacenter propio (codename Iris), desarrollado con Broadcom y fabricado por TSMC, dentro de un roadmap MTIA de cuatro generaciones. El chip pasó el testeo en apenas seis semanas sin incidentes mayores, señal de que los hyperscalers siguen internalizando silicio para reducir dependencia de Nvidia. Tech Startups

AMD despliega toda la línea Instinct MI400 para pelearle a Nvidia. AMD detalló su familia MI400 (variantes MI455X y MI430X) para 2026, con plataforma Helios y nodo TSMC de 2 nm, apuntando directamente a la generación Vera Rubin de Nvidia; el salto MI500 queda para 2027. Es el intento más serio de AMD por recortar la brecha en aceleradores de datacenter. DataCenterDynamics · Wccftech

Intel invierte €5.000M en su campus de Irlanda. Intel ampliará su planta de Leixlip (oeste de Dublín) con una inversión de 5.000 millones de euros para sumar capacidad de producción e I+D, apostando a la demanda de procesadores para datacenters de IA y reforzando uno de los hubs de fabricación más avanzados de Europa. Tech Startups

Nvidia empuja la IA al PC y rompe su racha de GPUs gamer. Tras el anuncio en COMPUTEX 2026 del superchip para PC (RTX Spark) y DLSS 4.5, reportes indican que Nvidia saltearía una nueva generación de GPUs gaming en 2026, rompiendo una racha de tres décadas, para concentrar obleas en aceleradores de IA. La escasez de capacidad avanzada y HBM sigue condicionando al mercado de consumo. Nvidia GeForce · CNBC

Ciberseguridad

Patch Tuesday de julio: 570 fallas y 3 zero-days. Microsoft corrigió 570 vulnerabilidades, con dos zero-days explotados activamente y uno divulgado públicamente. Entre las críticas: CVE-2026-57092 (elevación de privilegios en Windows VMSwitch, CVSS 9.9, cruza el límite de una VM) y CVE-2026-56155 (AD FS, explotada activamente, otorga privilegios administrativos). BleepingComputer · Zero Day Initiative

CISA alerta por explotación activa de SharePoint on-premises. La agencia pide endurecer SharePoint ante una cadena de vulnerabilidades explotadas en servidores on-prem (CVE-2026-32201, CVE-2026-45659, CVE-2026-56164 y CVE-2026-58644), que permiten acceso no autorizado. CVE-2026-45659 ya fue agregada al catálogo KEV tras explotación activa. CISA · The Hacker News

Falsos SDKs de pago en npm y PyPI roban secretos de CI/CD. El 7/07 se detectó un clúster de 17 paquetes maliciosos publicados casi en simultáneo en npm y PyPI, imitando SDKs de PaySafe, Skrill y Neteller. El malware cosecha credenciales y tokens de máquinas de desarrollo y runners de CI, exfiltrando a infraestructura oculta tras cifrado XOR y un dominio en Ngrok. GBHackers · Unit 42

Compromiso del pipeline de AsyncAPI abusando de GitHub Actions OIDC. El 14/07 atacantes comprometieron los pipelines de release de cuatro repos centrales de AsyncAPI y publicaron cinco paquetes troyanizados en npm (campaña “miasma-train-p1”, con payloads emparentados con el RAT Miasma). No usaron ningún token de npm: abusaron del propio CI del proyecto vía OIDC de GitHub Actions, un vector cada vez más común. The Hacker News / SecurityOnline

Bypass de autenticación crítico en SimpleHelp (CVSS 10.0). Se reportó CVE-2026-48558, un bypass de autenticación con puntaje máximo (10.0) en el software de soporte remoto SimpleHelp, ampliamente usado por MSPs, lo que lo vuelve un objetivo atractivo para acceso inicial masivo. En paralelo, la aseguradora Aflac reveló una brecha en sus operaciones en Japón con datos de ~4,4 millones de clientes expuestos. CISA KEV · Check Point Research


Notas: briefing generado automáticamente a partir de búsquedas web y fuentes primarias. Los ítems se incluyeron solo con al menos una fuente reconocida; algunas cifras (benchmarks, parámetros) provienen de los anuncios de los propios fabricantes y conviene tomarlas con cautela.

Ver todos los briefings