El Compilado Temas Archivo RSS

viernes · 11 min de lectura

El Compilado — 14 de agosto de 2026

Google lanzó Gemini 3.7 Flash (13 ago), enfocado en código y agentes, a tres semanas de la 3.6, OpenAI presentó "Ultrafast mode" para GPT-5.6 Sol, corriendo sobre hardware de Cerebras, DeepSeek abrió Harness v0.1 en developer preview con licencia MIT.

iahardwareroboticaciberseguridadtecnicas

Generado el viernes 14 de agosto de 2026, 13:20 UTC. Ventana cubierta: últimas 24 horas (13 ago 13:20 UTC → 14 ago 13:20 UTC).

TL;DR

  • Google lanzó Gemini 3.7 Flash (13 ago), enfocado en código y agentes, a tres semanas de la 3.6 Flash y con el Gemini 3.5 Pro todavía demorado.
  • OpenAI presentó “Ultrafast mode” para GPT-5.6 Sol, corriendo sobre hardware de Cerebras a hasta 750 tokens/s y 14× más rápido que el tier Standard. Irónicamente, Cerebras se desplomó ~20% en bolsa el mismo día por resultados flojos.
  • DeepSeek abrió Harness v0.1 en developer preview con licencia MIT: un harness de agentes donde todo es un plugin, planteado como alternativa open source a Claude Code / Cowork.
  • Un 0-day sin parche en GeoServer ya está siendo explotado, y “Zoomsday” mostró que un solo investigador con IA pública encontró un RCE zero-click en Zoom en menos de 24h y con menos de 20 prompts.
  • CXMT superó a Tencent como la empresa más valiosa de China ($524-531B) 17 días después de su IPO — la crisis de memoria como eje del mercado.

IA

Google lanza Gemini 3.7 Flash, orientado a código y agentes. El 13 de agosto Google publicó Gemini 3.7 Flash, apenas tres semanas después de la 3.6 Flash, posicionándolo como la opción barata para sistemas autónomos que planifican, usan herramientas y encadenan pasos. Los saltos que muestra son grandes en benchmarks agénticos: DeepSWE v1.1 de 49.0% a 65.3% y FrontierCode 1.1 Main de 34.4% a 43.6%. Precio introductorio de $0.75 / $3.75 por millón de tokens (se duplica después del 31/12/2026) y ya está disponible en GitHub Copilot. El contexto incómodo: el Gemini 3.5 Pro sigue demorado. SiliconANGLE · 9to5Google · GitHub Changelog

OpenAI + Cerebras: “Ultrafast mode” corre GPT-5.6 Sol a 750 tokens/s. OpenAI anunció el 13 de agosto un nuevo tier de servicio en la API que entrega hasta 14× la velocidad del modo Standard con el mismo modelo y la misma inteligencia, no una versión destilada. Corre sobre el Wafer-Scale Engine de Cerebras, que mantiene los pesos en 44 GB de SRAM on-chip para esquivar el cuello de botella de ancho de banda de memoria. En Humanity’s Last Exam resolvió las 2.500 preguntas en poco más de 11 horas (~7× más rápido que Claude Fable 5 con precisión comparable) y en GDP-Val dio 5.6× de speedup end-to-end sin pérdida de calidad. Por ahora es preview limitado. Casos citados: respuesta a incidentes, soporte, análisis de mercados, e-commerce. OpenAI · TechCrunch · Cerebras (nota de prensa)

DeepSeek V4 Pro 0813 sale de preview y los benchmarks generan ruido. El release fue sigiloso (un comunicado breve que después borraron) pero la cobertura y los números llegaron el 13. Es un MoE de 1.6T parámetros totales con ~49B activos por token, ventana de 1M y hasta 384K de salida, a $0.435/$0.87 por millón de tokens in/out. En agéntico el salto respecto al preview es enorme — DeepSWE de 12.8 a 62.7, CyberGym de 52.7 a 83.3, Terminal Bench 2.1 de 72.1 a 87.9 — pero en el Artificial Analysis Intelligence Index queda en 53, lejos de la frontera, y no tiene soporte de visión. Lectura: DeepSeek está optimizando duro para agentes de código y ciberseguridad, no para generalidad. SCMP · OpenRouter · VentureBeat

OpenAI publica datos duros de uso empresarial (paper del 12, que circuló fuerte el 13). El working paper “How Organizations Use AI: Evidence from ChatGPT” analiza más de 17 millones de registros reales de ChatGPT Enterprise. Entre junio 2025 y marzo 2026 el consumo total de tokens se multiplicó ~7×, y en clientes que ya estaban antes de junio 2025 el uso interno creció ~4× — o sea, el grueso del crecimiento es profundización, no clientes nuevos. Las empresas usuarias tienen ingresos, capitalización y gasto en I+D unas 10× mayores que las no usuarias, y los empleados de carrera temprana son los que más lo usan. arXiv 2608.12236 · PDF


Hardware y Robótica

LG y Nvidia firman MOU para un humanoide sobre Isaac GR00T. El 13 de agosto, en la sede de Nvidia en Santa Clara, Kwang Mo Koo (LG Corp) y Jensen Huang firmaron un acuerdo que va bastante más allá del robot: LG desarrollará un humanoide bípedo con Jetson Thor como cómputo a bordo, el modelo fundacional abierto Isaac GR00T y Nvidia Halos for Robotics como capa de seguridad, con presentación pública prevista para el Q1 de 2027. El paquete también incluye validar robots CLoiD con ruedas en la línea de lavarropas de LG en Tennessee, sitios de referencia de AI factories con DSX y Vera Rubin, y una plataforma vehicular sobre DRIVE Hyperion. PR Newswire · The AI Insider

Unitree encara su debut en el STAR Market con demanda récord. La cobertura del 14 de agosto pone el foco en el listado inminente (esperado entre el 17 y el 21 de agosto): precio de 150,80 yuanes por acción, ~$905M levantados, valuación de ~$9.000M y un tramo minorista sobresuscrito más de 8.000 veces, récord para tecnológicas en Shanghái. Unitree ya lleva ~18.000 humanoides producidos de forma acumulada y se llevó el 31% de los ~19.100 envíos globales del primer semestre. La pregunta que atraviesa la cobertura es la de siempre: los backflips ya están, la rentabilidad sostenida todavía no. CNBC · ChinaTechNews

CXMT pasa a ser la empresa más valiosa de China, 17 días después de su IPO. El fabricante de memoria alcanzó 3,58 billones de yuanes (~$524-531B) el 13 de agosto y superó a Tencent. Detalle importante: el sorpasso lo produjo más la caída de Tencent — cuyo capex en infraestructura de IA saltó 176% interanual — que una suba de CXMT, que ese día bajó 1,2%. Es el símbolo más claro de que la escasez de memoria y la autosuficiencia semiconductora china son ahora el eje del mercado. Del lado del consumidor la misma crisis se ve al revés: el 14 Gigabyte revivió el chipset B450 de hace ocho años con placas nuevas, como escape barato vía DDR4 ante los precios de RAM. Bloomberg · TechNode · Tom’s Hardware (B450)

Cerebras cae ~20% en bolsa el mismo día que anuncia lo de OpenAI. Contraste llamativo del 13 de agosto: mientras la compañía publicaba el logro técnico de Ultrafast, sus resultados quedaron por debajo de expectativas. La venta de hardware cayó, pero los ingresos de su nube de IA subieron 281% — señal de que el modelo de negocio se está corriendo de vender wafers a vender inferencia. Tom’s Hardware

Musk: xAI multiplicará por 7 su capacidad de datacenter para 2027. El 13 de agosto Elon Musk puso como objetivo 10 gigavatios de cómputo y hasta $500.000M de ingresos para fines del año que viene. Tomarlo con pinzas — son proyecciones, no compromisos verificables — pero marca la escala a la que se está compitiendo por energía y silicio. En la misma línea, AMD tomó deuda por $4.750M el 14 de agosto “para fines corporativos generales”, sin explicar el destino. Tom’s Hardware (xAI) · Tom’s Hardware (AMD)


Ciberseguridad

0-day sin parche en GeoServer, ya explotado en la web. Una inyección SQL sin CVE asignado en la plataforma open source de datos geoespaciales permite RCE cuando la base corre con permisos de sa. Se hizo público el 12 de agosto a las 10:46 UTC en X y watchTowr detectó intentos de explotación en cuestión de horas — cientos, desde un pool acotado de IPs. Por ahora los atacantes están sondeando para identificar sistemas vulnerables. No hay parche. Si tenés GeoServer expuesto, restringí acceso ya. The Hacker News

“Zoomsday”: RCE zero-click en Zoom, encontrado con IA en menos de 24 horas. La cadena explota corrupción de memoria en la función de anotación de Zoom y permite que cualquier participante de una reunión tome control total del dispositivo de otro, sin interacción. Confirmado contra Zoom Client v7.0.5 en Windows, macOS, iOS y Android — unos 220 millones de usuarios activos mensuales. Lo que lo vuelve un hito no es el bug sino el método: los investigadores de A Security dicen haber encontrado la falla y armado el exploit funcional en menos de un día usando menos de 20 prompts contra modelos públicos (Claude Opus 4.7 y 4.8). Lo que antes requería un equipo de nivel estatal ahora lo hace una persona en una tarde. Tom’s Hardware · TechRepublic

“Spaghettifying DRAM”: una sola instrucción abre las zonas más protegidas del CPU, y no tiene parche. Christopher Domas (xoreaxeaxeax) publicó skitter-creek-bath-salts: la traducción de direcciones del controlador de DRAM es una operación lineal configurable sobre GF(2), y alterando un registro de configuración del DCT se puede remapear una región física prohibida a un alias alcanzable. Con eso demostró extraer la rutina de firma RSA del fTPM desde memoria del Platform Security Processor y sacar el handler de interrupciones SMM de la SMRAM en AMD Family 16h. Rompe aislamiento tipo SEV, SGX, TDX, TrustZone y SMM. Los registros afectados no se pueden bloquear: no hay parche posible. Fue el #3 de Hacker News el 13 de agosto. GitHub · Tom’s Hardware

“ShieldBreak”: exploit de 0-day de escalada en Windows liberado justo en el Patch Tuesday. El grupo Nightmare Eclipse publicó el 13 de agosto un exploit que permite a cualquier usuario abrir una shell con privilegios de System. Puede que ya esté cubierto por los parches del mismo día, pero conviene verificar el estado de aplicación. Va en paralelo con el 0-day de Windows (CVE-2026-68820, AFD.sys) que Lazarus venía explotando contra empresas de defensa y aeroespacial en Francia, Alemania, Brasil e India. SecurityWeek · The Hacker News (Lazarus)

Ronda de parches y explotación casi inmediata: SharePoint, Fortinet, Adobe, WordPress. El patrón del día fue la ventana entre PoC público y explotación real, que ya se mide en horas. Atacantes empezaron a explotar CVE-2026-55040 en SharePoint (CVSS 9.1, bypass de autenticación parcheado en julio) apenas Rapid7 liberó el PoC — es la quinta falla de SharePoint explotada este año. Adobe Commerce (CVE-2026-71362) fue atacado inmediatamente después de la publicación del parche. Fortinet corrigió fallos de autenticación en FortiWeb y FortiManager que permitían loguearse con usuario y contraseña aleatorios o suplantar cualquier appliance FortiGate, y WordPress 7.0.4 tapó un RCE explotable vía archivos PostScript con permisos de Author o superiores. Prioridad de parcheo alta en los cuatro. The Hacker News (SharePoint) · SecurityWeek (Fortinet) · SecurityWeek (Adobe) · SecurityWeek (WordPress)


Técnicas, repos y práctica

DeepSeek libera Harness v0.1: “todo es un plugin”, licencia MIT. Lo más accionable del día. DeepSeek abrió en developer preview un harness de agentes completo y ejecutable — no otro anuncio de modelo — construido sobre su meta-framework Cordis. Cada capacidad es un plugin intercambiable: modelos, herramientas, skills, sesiones, sandboxes, storage, loops, scheduling y hasta la UI, todo configurable sin tocar el código fuente. Se levanta con npx @deepseek-ai/dsh web. Es explícitamente una preview con cambios que rompen compatibilidad, así que no para producción todavía, pero si estás armando scaffolding de agentes vale la pena leer cómo separaron las capas. Fue el #2 de Hacker News el 13 de agosto. deepseek.com/harness · GitHub · The New Stack

El writeup técnico de Cerebras sobre cómo sirven GPT-5.6 Sol a 750 tok/s. Más allá del anuncio comercial, el post de ingeniería explica la apuesta contraria al consenso: la inferencia en modelos grandes está limitada por ancho de banda de memoria, así que en lugar de optimizar el movimiento de pesos los meten enteros en 44 GB de SRAM por wafer y pipelinean las capas del modelo entre wafers, con los tokens fluyendo sin interrupción. Lectura obligada si estás pensando en serving y en el trade-off latencia/costo/calidad. Cerebras

Terminal-Bench 2.1 y DeepSWE se consolidaron como la vara real. Vale la pena notar el patrón: los tres releases de la semana (Gemini 3.7 Flash, DeepSeek V4 Pro, GPT-5.6 Sol) se comparan entre sí en DeepSWE, FrontierCode y Terminal-Bench 2.1, no en MMLU ni en benchmarks académicos saturados. Terminal-Bench v2 son 89 tareas en entornos de shell reales cubriendo ingeniería de software, ML, seguridad y data science; hoy GPT-5.6 Sol lidera con 89.5% y Claude Opus 5 queda en 89.1%. Si estás evaluando modelos para trabajo agéntico, esa es la tabla a mirar. Leaderboard de agentes de código (agosto 2026)

Comparativa práctica: un prompt, 11 modelos, resultados distintos. Netlify publicó un experimento simple y honesto sobre cuánto divergen los modelos ante el mismo prompt — útil como recordatorio de que el “mejor modelo” depende de la tarea y de que conviene probar antes de casarse con uno. Estuvo entre lo más leído de Hacker News el 13 de agosto. Discusión en HN (con link al post original)


Fuentes consultadas: The Hacker News, SecurityWeek, Tom’s Hardware, Hacker News (front page del 13/08), GitHub Trending, OpenAI, Cerebras, DeepSeek, Bloomberg, TechNode, CNBC, SiliconANGLE, TechCrunch, VentureBeat, SCMP.

Ver todos los briefings