El Compilado Hilos Temas Archivo RSS

jueves · 14 min de lectura

Briefing Tech — 3 de septiembre de 2026

Google saca Gemini 3.8 Flash y una variante Cyber para defensores, Meta contesta con Muse Spark 1.3, y ocho fallas de configuración de Git hacen que Claude Code, Codex y Cursor ejecuten código del atacante sin pedir permiso.

iahardwareroboticaciberseguridadtecnicas

Generado el jueves 3 de septiembre de 2026, 13:10 UTC. Ventana cubierta: últimas 24 horas (2 sep 13:10 UTC → 3 sep 13:10 UTC).

TL;DR

  • Google lanzó Gemini 3.8 Flash y 3.8 Flash Cyber, el tercer Flash en seis semanas. El Cyber va solo a defensores acreditados por el nuevo Fairwind Program y encuentra vulnerabilidades en más del 70% de un benchmark interno de 20 lenguajes.
  • Meta respondió con Muse Spark 1.3, que necesita 20% menos llamadas a herramientas y 25% menos tokens que 1.2. Los tres grandes anunciaron modelo la misma semana.
  • Ocho fallas de configuración de Git hacen que siete agentes de código ejecuten comandos del repositorio antes del prompt de confianza y fuera del sandbox. Cuatro seguían sin parche al publicarse.
  • TSMC casi duplicó en seis meses lo que necesita comprar en equipamiento de fábrica, pero su CapEx 2026 subió solo ~15%, a USD 60.000-64.000 millones. No consigue las máquinas.
  • Tres sitios generaron 215.128 páginas de “mejor software” dirigidas a modelos, no a personas, y son parte de la base de evidencia que Perplexity cita al recomendar productos.

IA

Google lanza Gemini 3.8 Flash y una variante Cyber para defensores, su tercer modelo Flash en seis semanas (02/09). Sigue de lo de ayer, donde OpenAI declaró a Astra en el umbral Crítico de ciberseguridad y Anthropic partió Fable y Mythos en dos niveles de salvaguardas: ahora Google hace lo mismo con el mismo modelo base y dos juegos de mitigaciones. El 3.8 Flash queda al precio de introducción de 3.7 —USD 0,75 por millón de tokens de entrada y USD 3,75 de salida, hasta el 31 de diciembre; después pasa a USD 1,50 y USD 7,50— y saca 54,9% en HLE-Verified además de ganarle a modelos frontera más caros en DeepSWE v1.1. El 3.8 Flash Cyber solo se consigue por el Fairwind Program, con más de 650 socios entre gobiernos, operadores de infraestructura crítica y empresas como CrowdStrike, Palo Alto Networks y Snowflake. Google dice que prioriza el parcheo sobre la explotación: 47,2% pass@1 en CWE-Bench contra 47,8% del líder pero a costo mucho menor, más del 70% de acierto descubriendo vulnerabilidades en un benchmark interno que cubre 20 lenguajes, 2,6 veces más parches correctos que los mejores modelos comerciales en el equipo de seguridad de Chrome, y una vulnerabilidad crítica encontrada en menos de dos horas por el equipo de Cloud Vulnerability Research. Google · The Hacker News · The Decoder

Meta contesta con Muse Spark 1.3: 20% menos llamadas a herramientas y 25% menos tokens que la versión anterior (02/09). Sale de Meta Superintelligence Labs, ya está en Muse Code y en la Meta Model API, y mantiene el precio de 1.2. Lo que cambia es el comportamiento agéntico: el modelo arma su propio contexto con herramientas cuando las fuentes son desordenadas o contradictorias, corrige huecos del plan sobre la marcha, pregunta cuando el pedido es ambiguo y confirma antes de acciones con consecuencias. Alexandr Wang le dijo a Axios que la actualización prepara el terreno para los agentes personales que Zuckerberg viene prometiendo en los llamados de resultados, y aportó un dato que se lee solo: un porcentaje “de dos dígitos considerable” de los desarrolladores está eligiendo el “contributor tier”, que abarata mucho el producto de código a cambio de dejar que Meta use su trabajo para entrenar. La versión de “max reasoning” queda pendiente de más pruebas de seguridad. A diferencia de OpenAI y Anthropic, Wang dice que Meta no tuvo que pausar ningún entrenamiento. Meta · Axios

El Departamento de Justicia de Estados Unidos se pone del lado del fair use para entrenar modelos, en la demanda colectiva del New York Times (02/09). El escrito sostiene que entrenar con texto con derechos de autor califica como uso legítimo, y contradice de frente un informe de la Oficina de Copyright de Estados Unidos cuya directora fue despedida por la administración Trump poco después de publicarlo. No es una sentencia, pero que el gobierno se presente a favor de los laboratorios en el caso testigo cambia el terreno de todos los juicios de entrenamiento que vienen atrás. The Decoder

El Pentágono suma ChatGPT Mil y Grok for Government a GenAI.mil, y Claude sigue ausente (02/09). Hasta ahora la plataforma solo tenía Gemini, desde su lanzamiento en diciembre pasado; el Departamento de Defensa dice que ya la usan más de 1,7 millones de personas sobre más de tres millones de empleados y militares. ChatGPT Mil apunta a tareas administrativas, logística y planificación; a Grok lo presentan con vocabulario más militar, análisis de compras y cadena de suministro. Los dos corren en un entorno seguro separado de las versiones comerciales, sin recolección de datos de usuario. La ausencia de Anthropic tiene historia: la empresa se negó a darle al Pentágono uso irrestricto, la administración la clasificó como riesgo de cadena de suministro y a fines de agosto un tribunal declaró ilegal esa clasificación. The Decoder · Departamento de Defensa

Anthropic cierra un contrato de cómputo de USD 35.000 millones con Lambda, con Nvidia como dueña del arrendamiento del datacenter (03/09). El centro se construye en el condado de Nueces, Texas, con unos 350 megavatios de capacidad, y lo desarrolla Hut 8, una ex minera de cripto que en julio había anunciado un arrendamiento a 15 años con un cliente sin nombrar. Viene apenas una semana después del contrato de USD 45.000 millones con Nscale por un datacenter en Virginia Occidental, y las dos operaciones son parte del mismo empujón de infraestructura antes de la salida a bolsa. Ninguna de las empresas involucradas quiso comentar. The Decoder · Reuters


Hardware y Robótica

TSMC casi duplicó en seis meses lo que necesita comprar en equipamiento de fábrica, y no lo consigue (03/09). Cliff Hou, subdirector de operaciones, lo contó en Semicon Taiwan: la proyección que la empresa hizo a fines del año pasado sobre cuántas máquinas iba a necesitar en 2026 quedó en 1,5 veces esa cifra para el final del primer trimestre, y en 1,9 veces para julio. La foundry admite que no puede atender toda la demanda de todos sus clientes. Lo llamativo es que el CapEx no siguió esa curva: en enero guió entre USD 52.000 y 56.000 millones, y en julio lo subió a entre USD 60.000 y 64.000 millones, un 15% en puntos medios contra un 90% de aumento en cantidad de herramientas. El cuello de botella no es la plata sino la disponibilidad: todos los fabricantes están comprando al mismo tiempo. Tom’s Hardware

Samsung apunta a duplicar el ancho de banda con HBM5 y a mejorar 20% el rendimiento por vatio (02/09). Lo dijo Choi Jang-seok, jefe de planificación de producto de la división de memoria, en el Memory Executive Summit previo a Semicon Taiwan. Duplicar el HBM4E significa llegar a unos 4 TB/s por pila hacia 2028-2029, y como subir la tasa por pin de 12 a 24 GT/s es difícil de sostener eléctricamente, el objetivo apunta a ensanchar la interfaz de 2.048 a 4.096 bits, o a alguna combinación intermedia de ancho y velocidad. TSMC espera aceleradores con 20 a 24 pilas HBM5 por paquete hacia el final de la década, o sea entre 80 y 96 TB/s por sistema. La especificación todavía no está cerrada, así que todo esto sigue siendo un objetivo declarado, no un número de JEDEC. Tom’s Hardware

DLSS 5 se estrena hoy con NBA 2K27, exclusivo de las RTX 50, y los desarrolladores de RPCS3 lo llaman “generador de slop de IA” (03/09). Nvidia lo habilita a las 21:00 hora del Pacífico en todas las GeForce RTX 50, incluidas laptops, y en GeForce NOW; el juego sale el 4 de septiembre. La novedad técnica es el renderizado neuronal guiado por 3D, sobre la base de super resolución y multi frame generation que ya existía. La crítica desde el emulador de PS3 no es sobre la calidad de imagen sino sobre el incentivo: sostienen que la industria empuja “más upscalers y generación de cuadros para alucinar juegos y tapar su falta de optimización”. Para el que compró una RTX 50 el punto práctico es otro: activar DLSS 5 cuesta entre 50% y 60% de rendimiento antes de recuperarlo con las otras técnicas. Nvidia · Tom’s Hardware

PlusAI sale a bolsa por un SPAC que la valúa en USD 800 millones, con camiones autónomos ya facturando (03/09). La fusión es con Texas Ventures Acquisition III y llega con hasta USD 300 millones de capital, de los cuales unos USD 236 millones vienen del fideicomiso del SPAC y más de USD 60 millones son financiamiento ya comprometido. El dato que importa es la separación entre los dos productos: HyperFoundry, la plataforma de desarrollo de software, ya generó USD 25 millones de ingresos y la empresa apunta a entre USD 40 y 50 millones contratados en 2026, mientras SuperDrive —el conductor virtual de nivel 4 de SAE— recién apunta a lanzamiento comercial en 2027. Hoy opera rutas de carga autónomas en Texas con Ryder e International Motors, y trabaja con Scania, TRATON, Hyundai e IVECO. Es su segundo intento: el SPAC anterior, con Churchill Capital IX, se canceló en abril. The Robot Report


Ciberseguridad

GitSpawn: ocho fallas hacen que siete agentes de código ejecuten comandos que vienen adentro del repositorio, sin sandbox y sin pedir permiso (02/09). El mecanismo es viejo y aburrido, que es justamente por qué funciona: core.fsmonitor es una opción de rendimiento de Git cuyo valor es un comando que Git corre para saber qué archivos cambiaron, y Git la lee del .git/config del propio repositorio. Cualquier operación que refresque el índice —git status, git diff— lo ejecuta, y los agentes llaman a esos comandos en segundo plano al arrancar para saber en qué rama están. En Claude Code y Hermes Agent el payload dispara antes de que se acepte el prompt de confianza del workspace; en Qwen Code, antes de autenticarse; en Grok Build, con la primera tecla. No aplica a un git clone normal: hace falta que el repositorio llegue como archivos con su directorio .git intacto, o sea un ZIP compartido, un disco de red, una carpeta sincronizada o un pendrive. Ya hay fixes en goose 1.44.0, Codex CLI 0.131.0 y Claude Code 2.1.196; seguían vivos Hermes Agent, Qwen Code, Grok Build y un segundo camino en Claude Code vía claude ultrareview, que Manifold reconfirmó el 1 de septiembre. OpenAI publicó tres CVEs propios el mismo día. La mitigación casera es una línea: git config --global core.fsmonitor false. The Hacker News · Manifold Security

CISA agrega siete fallas explotadas a su catálogo KEV, entre ellas las dos de SonicWall y una inyección SQL sin autenticar en Sangoma Switchvox (03/09). Las dos de SonicWall son las de ayer: CVE-2026-83548, el SSRF preautenticación de puntaje 10,0 en la interfaz WorkPlace de los SMA 1000, y CVE-2026-83549, la inyección de comandos posautenticación de 7,8 en la consola de administración. La que se suma con peso propio es CVE-2026-9586, puntaje 9,3, una inyección SQL en Sangoma Switchvox que deja a un atacante remoto sin autenticar ejecutar sentencias arbitrarias contra el PostgreSQL de atrás, y de ahí a ejecución de código. Entrar al KEV no es un trámite: para las agencias federales de Estados Unidos arranca un plazo de parcheo obligatorio, y para el resto es la señal más confiable de que la falla ya se está usando. The Hacker News · CISA

Usan el runtime de Node.js como vehículo de malware contra gobiernos, tecnológicas y hoteles (03/09). El equipo de Threat Hunter de Symantec, ahora parte de Broadcom, lo viene viendo desde febrero de 2026. El atractivo de la técnica es que node.exe es una herramienta de desarrollo legítima y firmada: el código malicioso vive en scripts interpretados y no en un binario, así que la detección por firmas tiene poco a qué agarrarse, y una entrada en la clave Run del registro relanza el payload en cada inicio de sesión. En una intrusión observada entre el 23 de marzo y el 25 de julio contra una tecnológica asiática, los atacantes se bajaron el instalador oficial desde nodejs.org. Es el mismo patrón de siempre —vivir de la tierra— corrido a un runtime que hoy está instalado en casi cualquier máquina de desarrollo. The Hacker News

Confirman una infección con Pegasus por exploit zero-click en el iPhone de un integrante del movimiento estudiantil serbio (03/09). El análisis es de Citizen Lab junto con la SHARE Foundation, y encontró indicadores de alta confianza de infección en el período diciembre de 2025 - enero de 2026, sin descartar otras. El exploit apuntó a iMessage y Apple ya lo había cerrado en iOS 18.4.1, publicado en abril de 2025, lo que ubica el ataque contra un dispositivo desactualizado. Llega después de que Apple mandara una nueva tanda de notificaciones de amenaza a usuarios en 110 países que sospecha apuntados por spyware mercenario. The Hacker News

Publican FalconFlank, una prueba de concepto de escalada de privilegios contra CrowdStrike Falcon (03/09). El investigador que firma como Chaotic Eclipse dice que abusa de la remediación de macros maliciosas de Office en el sensor de Falcon, y que la empresa probablemente ya tenga detecciones: para probarlo hay que agregarlo a las exclusiones u ofuscar el PoC y cambiar la técnica de carga de la DLL. Funciona en Windows 11 25H2 y Windows Server 2025 completamente actualizados. Es el segundo en pocos días del mismo investigador, después de otra escalada de privilegios contra el endpoint de Kaspersky. CrowdStrike no comentó todavía. The Hacker News


Técnicas, repos y práctica

Tres sitios publicaron 215.128 páginas de “mejor software” hechas para ser leídas por modelos, y Perplexity las cita (02/09). Trellner Research le pidió a perplexity/sonar y sonar-pro el top cinco de productos en 380 categorías y se guardó cada URL recuperada: de 7.534 citas, el 59,8% apunta a dominios peor rankeados que el puesto 100.000 de Tranco y el 23,4% a dominios que no están en el top millón. El tercer dominio más citado, con 194 citas en 96 categorías, es el blog de marketing de guideflow.com, una empresa que vende demos interactivas y no compite en ninguna de esas categorías. Más raro todavía: wifitalents.com, worldmetrics.org y gitnux.org comparten nameservers de Cloudflare, plantilla y taxonomía, ninguno existía antes de diciembre de 2023, entre los tres suman 215.128 páginas /best/<algo>-software/ contra seis posts de blog cada uno, y dos de ellos le pusieron a su portada el título HTML “Facts & Grounding Page” —grounding es el nombre del paso en que un sistema de recuperación busca documentos para condicionar la respuesta—. Consultados por la misma categoría, los tres devuelven rankings distintos y nueve autores distintos. Si armás cualquier cosa con recuperación web, esto es el estado real de la base de evidencia. Trellner Research · Hacker News

fable51-worlds reconstruye lugares reales en el navegador con enjambres de agentes, y todo el pipeline está en el repo (03/09). Llegó a la portada de Hacker News. El primer mundo es Union Square, San Francisco: 453 huellas de edificios de OpenStreetMap, 75 fachadas hechas a mano, 129 vitrinas identificadas, 220 peatones sobre un grafo de navegación de 1.398 nodos, 109 vehículos incluidos los cable cars de Powell, semáforos que funcionan, ciclo día/atardecer/noche y dos interiores explorables. No hay motor de juego ni tiles 3D propietarios: sale un app de Three.js que corre con npm run dev, bajo MIT. Lo que conviene copiar es el control de calidad: agentes de reconocimiento en paralelo traen geometría de OSM, elevación de USGS y un censo de comercios con fuente y nivel de confianza por dato; scripts de Blender como librería (bpy) emiten kits GLB optimizados; y después Playwright maneja la app real, saca capturas de 34 puntos de vista fijos y las compara contra fotografías de licencia libre tomadas desde el mismo lugar, con agentes revisores —arquitecto, geógrafo, artista técnico, interacción— que escriben informes que alimentan el siguiente ciclo de arreglos. 147 planillas de comparación y 9 informes independientes para un mundo. GitHub · Hacker News

Gemini 3.8 Flash “trabaja más” y por eso sale más caro que su antecesor, aunque la tarifa por token sea idéntica (02/09). Google lo dice con todas las letras en su propio anuncio: en tareas complejas el modelo ejecuta pasos de razonamiento extra y llama herramientas de forma iterativa, y a veces gasta más tokens para maximizar el resultado, sobre todo en niveles de esfuerzo altos. The Decoder mide ese sobrecosto en torno al 30% más de tokens de salida por tarea contra 3.7 Flash. La recomendación oficial es explícita y vale como regla general para cualquier modelo con esfuerzo configurable: si la restricción principal es el costo de cómputo, bajá el nivel de esfuerzo o quedate en 3.7 Flash, que sigue soportado para cargas donde la eficiencia manda. Comparar modelos por precio de lista dejó de decir mucho; hay que medir tokens por tarea terminada. Google · The Decoder


Fuentes consultadas: Google, Meta, Anthropic, Axios, Reuters, The Decoder, The Hacker News, CISA, Manifold Security, Trellner Research, Tom’s Hardware, Nvidia, The Robot Report, GitHub, Hacker News, Departamento de Defensa de Estados Unidos.

Ver todos los briefings