miércoles · 17 min de lectura
Briefing Tech — 2 de septiembre de 2026
Anthropic lanza Fable 5.1 y Mythos 5.1 con 25% menos de costo y capacidades científicas que diseñan proteínas y remapean Venus, OpenAI declara a Astra el primer modelo en el umbral Crítico de ciberseguridad, y SonicWall avisa que le encadenan dos zero-days en sus SMA1000.
Generado el miércoles 2 de septiembre de 2026, 13:15 UTC. Ventana cubierta: últimas 24 horas (1 sep 13:15 UTC → 2 sep 13:15 UTC).
TL;DR
- Anthropic lanzó Claude Fable 5.1 y Mythos 5.1, el mismo modelo con dos niveles de salvaguardas. Cuesta ~25% menos que Fable 5 en cargas típicas y hasta 45% menos en trabajo agéntico, porque bajó el precio de las lecturas de caché un 75%.
- OpenAI declaró a Astra el primer modelo en el umbral Crítico de ciberseguridad de su Preparedness Framework: encuentra vulnerabilidades desconocidas y construye exploits en sistemas endurecidos sin guía humana paso a paso.
- World Labs presentó Atlas, un world model omni que genera, reconstruye y simula mundos 3D a partir de unas pocas fotos, y que gana a modelos especializados en reconstrucción.
- SonicWall avisó que están encadenando dos zero-days en sus appliances SMA1000 para ejecutar código remoto. Shadowserver ve más de 400 equipos expuestos.
- Gemini incorporó análisis de video agéntico: el modelo decide qué tramos mirar y a qué resolución, en vez de barrer a un frame por segundo. Google mide hasta 88% menos tokens y 66% menos costo, sin cargo extra en la API.
IA
Anthropic lanza Claude Fable 5.1 y Mythos 5.1: el mismo modelo con dos niveles de salvaguardas, 25% más barato y con resultados científicos que valen mirar (01/09). Fable 5.1 está disponible en todas las plataformas; Mythos 5.1 es idéntico pero con salvaguardas más permisivas y solo llega por dos programas de acceso verificado, uno de ciberdefensa y otro de ciencias de la vida armado con el gobierno de Estados Unidos. La baja de precio no viene del token de entrada ni de salida —siguen en USD 10 y USD 50 por millón— sino de las lecturas de caché, que bajaron 75% a USD 0,25 por millón: eso da ~25% menos en cargas típicas y hasta ~45% en trabajo agéntico pesado en contexto. En benchmarks salta de 24,7% a 52,6% en Terminal-Bench-Science 0.1 y de 42,0% a 55,8% en Terminal-Bench 4.0 (60,9% con Mythos). Lo más concreto está en la sección científica: Mythos 5.1 diseñó binders de proteínas con afinidades diez veces mejores que las mejores entradas de las competencias de Adaptyv Bio en tres targets, con una tasa de acierto cercana al 50% sobre 12 targets contra el 10-15% habitual, y escribió kernels de GPU que aceleran siete modelos open source de biología hasta 2,5 veces con salidas idénticas. Fable 5.1 además entrenó una red que produjo un mapa de elevación nuevo de un tercio de Venus con detalle de 2 a 3 km, publicado bajo Creative Commons. También cambian las salvaguardas: ahora Fable 5.1 puede usarse para descubrir vulnerabilidades de software —no para desarrollar exploits—, con unas 60% menos intervenciones por sesión en Claude Code. Anthropic · TechCrunch · The Decoder
OpenAI declara a Astra el primer modelo que alcanza el umbral Crítico de ciberseguridad, y demora el lanzamiento para reforzar las protecciones (01/09). El umbral Crítico del Preparedness Framework se cruza si el modelo puede identificar y desarrollar zero-days funcionales en muchos sistemas críticos endurecidos sin intervención humana, o ejecutar estrategias de ataque de punta a punta contra objetivos duros dándole solo un objetivo de alto nivel. Astra sacó 100% en ExploitBench, y en un port interno con 20 vulnerabilidades de V8 divulgadas entre junio y agosto descubrió y usó dos zero-days como parte de una cadena de exploits, que OpenAI está reportando a los mantenedores. En evaluaciones con expertos armó una cadena completa de compromiso de navegador que escapó del sandbox y ejecutó comandos en el host al abrir un archivo HTML. La empresa pausó dos semanas cierto entrenamiento frontera tras el incidente de Hugging Face y recién el 28 de agosto reinició la corrida grande de RL que había frenado. El dato que importa para el usuario común es que las protecciones extra pueden pausar trabajo legítimo, incluso tareas que no parecen de ciberseguridad: en ChatGPT o Codex piden revisión antes de seguir, en la API la tarea se corta. OpenAI · TechCrunch
World Labs presenta Atlas, un world model omni que genera, reconstruye y simula mundos 3D desde unas pocas fotos (01/09). El laboratorio que cofundó Fei-Fei Li lo entrenó desde cero para operar de forma nativa sobre texto, imágenes, video y 3D. La idea central es el “contexto espacial”: cada imagen queda anclada a una posición 3D concreta en vez de tratarse como un elemento más de una secuencia plana, y de ahí sale el control de cámara exacto —hasta un minuto de video a 1440p— y la capacidad de interpolar entre dos imágenes de referencia sin relación entre sí. En reconstrucción le gana a modelos open source especializados en la tarea, con dos o tres imágenes alcanza reconstrucciones fieles, y saca salidas 3D explícitas como nubes de puntos o gaussian splats. Para robótica es lo más interesante: reconstruye un espacio desde un video de celular de 24 frames y después genera el RGB y la profundidad que verían las cámaras del robot mientras se mueve, o sea el mundo y la vista del robot salen del mismo modelo. Está en acceso anticipado con socios seleccionados. World Labs · The Decoder
Anthropic abre la API de detección de su marca de agua a reguladores, medios y verificadores (01/09). Va junto con el lanzamiento de Fable 5.1: el Código de Prácticas sobre Transparencia del Reglamento de IA de la UE obliga a marcar la salida de texto de los modelos publicados después del 2 de agosto de 2026, y también a dar una manera de verificarla. El método se apoya en SynthID de Google: ajusta la aleatoriedad con que el modelo elige palabras para dejar un patrón detectable estadísticamente que, según Anthropic, “puede sobrevivir a algunas ediciones”. La API está en preview privada para reguladores, fuerzas de seguridad, medios, fact-checkers, investigadores independientes, organizaciones educativas y grupos de sociedad civil de la UE, más empresas que necesiten verificar por cumplimiento propio. La crítica que circula es directa: si Claude elige sinónimos según una clave de marca de agua y no según el significado, la calidad del texto paga el costo. The Decoder · Anthropic
El nuevo jefe de Google DeepMind sale a decir que lo único que importa es estar en la frontera (01/09). Koray Kavukcuoglu respondió a la lectura de que a Google no le interesa ganar la carrera de modelos porque su ventaja está en la relación precio-rendimiento: “para decirlo muy crudamente, no hay nada más que estar en la frontera que sea importante para nosotros”. Admitió que los modelos actuales están “un poco por debajo” de esa frontera. No trajo novedades concretas: sobre Gemini 4 repitió que es “la corrida más ambiciosa” hasta ahora y que va bien, y de Gemini 3.5 Pro —que lleva meses de atraso— no dijo nada. En cambio señaló el ritmo de la serie Flash, y describió el salto de 3.5 a 3.6 y 3.7 como el pasaje de modelo de lenguaje a agente de código: “la ingeniería de software es el dominio más crítico en el que querés que tus sistemas sean exitosos”. The Decoder · YouTube
Hardware y Robótica
La RTX 5090 ya cuesta como mínimo USD 5.000, dos veces y media su precio de lanzamiento (01/09). Nvidia la anunció en el CES del año pasado a USD 1.999. Hoy la más barata en Estados Unidos es la Zotac Solid OC a USD 4.999 en Newegg, y hace exactamente un año la misma clase de tarjeta se conseguía a USD 2.250; una ROG Astral 4X OC pasó de USD 3.360 a USD 6.000. En Alemania la MSI Gaming Trio OC está a 4.850 euros contra 2.249 hace un año, y 800 euros más cara que el mes pasado. No es solo el tope de gama: la RTX 5060 Ti de 16 GB subió 77% sobre su MSRP, la 5080 un 55%, y el promedio de toda la familia Blackwell ronda el 60%. La causa es la misma que aprieta a las SSD y a la memoria: los componentes se están desviando a clientes enterprise para las construcciones de IA, con la RAM 500% más cara en doce meses. Armar una PC por partes se vuelve cada vez menos viable. Tom’s Hardware
Nori sale de YC con un humanoide de USD 1.688 fabricado en San Francisco (02/09). El Launch HN llegó a la portada de Hacker News. Las especificaciones son modestas y están declaradas sin vueltas: 19 grados de libertad, base con ruedas, 1,5 kg de carga por brazo y 55 kg de levante lineal, cuatro cámaras de 720p a 30 fps, array de micrófonos con diálogo full-duplex, y un módulo de cómputo Raspberry Pi 5 de 4 GB. Parte del hardware es open source, empieza a despacharse este otoño boreal, y el modelo de negocio es vender la máquina con software pago opcional encima. El argumento de la empresa es que el desafío de ingeniería fue justamente bajar de los USD 2.000, contra los ~USD 16.000 del piso actual del mercado. El público objetivo no es la casa sino el laboratorio: desarrolladores e investigadores que hoy no pueden justificar un humanoide para probar políticas de control. Y Combinator · Hacker News
Un tribunal chino congela USD 318 millones en activos de Nexperia mientras Wingtech pelea por recuperar el control (01/09). El monto de los activos congelados supera toda la facturación del primer semestre de Wingtech, que reportó 1.510 millones de yuanes en el primer semestre de 2026, una caída de más del 90% interanual. La disputa por Nexperia —fabricante de semiconductores discretos y de potencia, los componentes baratos y omnipresentes de la industria automotriz— es el frente más visible de la pelea regulatoria entre Europa, China y Estados Unidos sobre el control de fabricantes de chips. Que la pelea legal se libre ahora también en tribunales chinos agrega una capa de riesgo para cualquier fabricante que dependa de esa cadena. Tom’s Hardware
Arm enfrenta una posible rebelión de accionistas por el paquete de USD 800 millones para su CEO (01/09). Los asesores de voto se plantaron contra la propuesta de aprobar un plan de retribución por desempeño que le daría a Rene Haas unos USD 800 millones si la diseñadora de chips llega a una valuación de dos billones de dólares. El plan solo se realiza por completo con ese hito, lo que en teoría lo ata a un resultado extraordinario, pero la magnitud del premio es lo que los proxy advisers califican de excesivo. Arm cotiza hoy bien por debajo de ese objetivo, así que el debate es tanto sobre gobernanza como sobre qué tan creíble es el camino a esa cifra. Tom’s Hardware
TP-Link anuncia sus primeros routers Wi-Fi 8 de consumo, con la reserva del Archer 8 Ultra desde el 30 de septiembre (01/09). Es el primer movimiento de un fabricante grande para llevar Wi-Fi 8 al mercado hogareño, aunque el lanzamiento en Estados Unidos sigue complicado por las restricciones vigentes de la FCC sobre la marca. Wi-Fi 8 no apunta a picos de velocidad sino a fiabilidad: menos latencia de cola y mejor comportamiento con muchos dispositivos compitiendo por el mismo aire, que es el problema real de una casa moderna. La reserva arranca en regiones seleccionadas. Tom’s Hardware
Ciberseguridad
SonicWall avisa que están encadenando dos zero-days en los appliances SMA1000 para ejecutar código remoto (02/09). El primero es CVE-2026-83548, una inyección de comandos de severidad máxima en la interfaz WorkPlace que arranca de una falla de server-side request forgery. El segundo, CVE-2026-83549, es otra inyección de comandos en la consola de administración que un atacante con privilegios de admin usa para ejecutar comandos arbitrarios del sistema operativo. Afecta a los modelos 6210, 7210 y 8200v, y no toca ni el SSL-VPN de los firewalls ni la línea SMA 100. Shadowserver ve más de 400 appliances expuestos, aunque algunos ya podrían estar parcheados. SonicWall pide actualizar al hotfix, y si aparecen indicadores de compromiso, reimagenar el equipo, cambiar todas las contraseñas de usuarios y administradores y resetear los tokens TOTP. No publicó todavía la lista de IOCs. Es el tercer episodio de zero-days en SMA1000 en menos de un año, y los dos anteriores terminaron con bandas de ransomware explotándolos. BleepingComputer · Aviso de SonicWall
Explotan una falla crítica de JFrog Artifactory para fabricar tokens de admin, días después de que se divulgara (01/09). CVE-2026-82329 (CVSS 9,8) es un bypass de autenticación que, con la configuración por defecto, deja a un atacante sin autenticar y con acceso de red obtener privilegios administrativos. JFrog la parcheó en la versión 7.161.20, publicada el 28 de agosto, y watchTowr ya ve explotación activa. Afecta a varias ramas de mantenimiento —7.161.0 a 7.161.19, 7.146.0 a 7.146.36, 7.133.0 a 7.133.28, 7.125.0 a 7.125.19, 7.117.0 a 7.117.27 y 7.111.4 a 7.111.21—, así que quedarse en una rama vieja no protege. Artifactory es el repositorio de artefactos de la organización: quien saca un token de admin ahí puede envenenar lo que después se despliega en producción. The Hacker News
Secuestraron rutas BGP para entregar una actualización maliciosa de Virtualizor (01/09). Entre las 20:57 UTC del 28 de agosto y las 06:10 UTC del 30, un atacante anunció como propio un bloque de direcciones IP alojadas en Hetzner y desvió hacia sus servidores el tráfico de los sistemas de actualización de Softaculous y del portal de clientes y facturación. Virtualizor es el panel que usan los proveedores de hosting para crear y administrar VPS, así que el objetivo estaba bien elegido. Softaculous confirmó que llegó un paquete malicioso a un puñado de instalaciones que buscaron actualizaciones durante la ventana; como las peticiones fueron al atacante, la empresa no tiene logs y no puede decir a quiénes. Hay que revisar si existe el servicio /etc/systemd/system/java-jre-update.service, y si aparece, rotar credenciales de API y auditar claves SSH, cuentas, tareas programadas y conexiones salientes. La versión 3.2.9.9 salió el 1 de septiembre, y recién ahora la empresa promete firmar criptográficamente todos sus paquetes: eso, y no el BGP, es lo que habría cortado el ataque de raíz. BleepingComputer · Aviso de Virtualizor
Desmantelan la infraestructura de Sality, una botnet P2P que llevaba más de dos décadas prendida (02/09). El DOJ, el FBI y el DCIS incautaron dominios en Estados Unidos, y fuerzas de Bulgaria, Hungría y Rumania hicieron lo propio con los alojados en Europa. El equipo de Counter Adversary Operations de CrowdStrike sumó la parte técnica: un sinkhole peer-to-peer sobre los “super peers” que forman la columna de comunicación, para cortar la propagación de payloads e ir purgando las listas de pares de las máquinas infectadas. Sality apareció en 2003 y pasó por robo de credenciales, spam, servicios de proxy y DDoS; en los últimos ocho años su carga principal fue EggJagger, una herramienta de clipjacking que vigila el portapapeles y reemplaza direcciones de billeteras cripto por las del operador. CrowdStrike atribuye la operación al grupo SALTY SPIDER, probablemente operando desde Bashkortostán, Rusia. BleepingComputer · DOJ
A METR le robaron una clave de API y le quemaron unos USD 600.000 en créditos de inferencia (01/09). METR —la organización sin fines de lucro que evalúa modelos frontera en tareas agénticas de horizonte largo— reveló dos incidentes de seguridad. En marzo de 2026 los atacantes robaron una clave de API para inferencia sobre modelos públicos y consumieron una cantidad sustancial de créditos; en mayo la sondearon sistemáticamente en su infraestructura accesible desde internet, sin éxito. La organización dice que no cree que se haya accedido a información sensible y aclara el punto que muchos iban a suponer al revés: no hubo agentes de IA escapando de sus evaluaciones, fueron actores externos comunes. Compartió los hallazgos con las empresas de IA con las que trabaja antes de publicarlos. La lectura práctica es aburrida y por eso vale: la organización que audita a los modelos frontera tenía la misma clase de exposición de clave que cualquier startup. The Hacker News
Técnicas, repos y práctica
Gemini incorpora análisis de video agéntico: el modelo decide qué tramos mirar, y baja hasta 88% los tokens (02/09). Está disponible ya en la API para Gemini 3.7 Flash, 3.6 Flash y 3.5 Flash-Lite, sin cargo extra: se pone el modo de procesamiento en agentic en la configuración y se paga la tarifa normal por tokens. En vez de muestrear a un frame por segundo fijo, el modelo corre un bucle de pensar, actuar y observar sobre tres herramientas nativas —get_transcript, get_frames(start, end, fps) y get_audio(start, end)— y decide por su cuenta qué sección traer, a qué velocidad y por qué modalidad. Google mide hasta 88% menos tokens y 66% menos costo en 1H-VideoQA y LVBench, con la precisión levemente arriba, y el beneficio crece con la duración: de tutoriales de diez minutos a grabaciones de varias horas. Detecta momentos de menos de un segundo, como cambios de estado o cortes que a un frame por segundo se pierden, y remuestrea a mayor tasa las ventanas sospechosas para encontrar anomalías. Lo que antes se armaba a mano —traer solo el pedazo relevante del archivo— ahora lo hace el modelo. The Decoder · Documentación de Google
slotstream corre un MoE de 104 GB en una Mac de 48 GB a ~12 tokens por segundo, transmitiendo los expertos desde el SSD (02/09). Es un binario único en Swift sobre MLX, con los endpoints de chat y generate compatibles con Ollama y con los SDK de OpenAI, y llegó a la portada de Hacker News. El truco es que casi todos los bytes del modelo están en dos lugares: 68 GB de expertos ruteados (512 por capa, 10 activos por token) y una tabla de n-gramas de 32 GB; el tronco denso son apenas 3,8 GB y queda residente. Los expertos se leen con pread a un pool fijo de slots compartido por las 48 capas, así que las capas calientes le piden slots a las frías. El detalle que conviene copiar es el de la planificación de memoria: el autor barrió gigabyte por gigabyte y encontró que 33 GB es la rodilla —nada entre 34 y 84 GB mejora ni la velocidad de decodificación ni el prefill—, así que una Mac de 128 GB pide lo mismo que una de 48. El tamaño del caché cambia la velocidad, nunca la salida: la equivalencia byte a byte entre un caché de 4 GB y uno de 24 GB es un test permanente. Está medido en una sola máquina, un M5 Pro de 48 GB; el resto de la tabla es extrapolación. GitHub · Hacker News
Baseten publica un mapa de qué técnicas de inferencia mueven el punto sobre la frontera eficiente y cuáles corren la frontera entera (01/09). La distinción es simple y útil para decidir dónde gastar tiempo. Las que negocian latencia contra throughput: el tamaño de batch, que con lotes chicos da latencia por usuario excelente y costo por token alto, y al revés; la estrategia de paralelismo, con tensor parallelism para latencia sobre NVLink, expert parallelism angosto para latencia y ancho para throughput, y attention data parallelism para throughput a costa de velocidad por pedido. Las que corren la frontera: optimización de kernels y del runtime, decodificación especulativa —EAGLE-3, DSpark, DFlash, que hoy rinden especialmente en generación de código porque las secuencias de salida son predecibles— y la desagregación de prefill y decode en workers dedicados. La cuantización queda en el medio: mejora latencia y throughput a la vez, pero abre otra frontera contra calidad, y es jagged, con formatos como MXFP4 y NVFP4 dando mucha eficiencia a costo casi nulo. La advertencia que atraviesa el post es que estas fronteras son irregulares y los puntos de corte se encuentran barriendo, no razonando. Baseten · Hacker News
La app de escritorio de Codex trae adentro una copia entera de LibreOffice (01/09). Lo encontró Simon Willison revisando su carpeta ~/.cache/ con OmniDiskSweeper, y el hallazgo llegó a la portada de Hacker News. La aplicación —ya rebautizada simplemente ChatGPT— guarda 1,7 GB en codex-primary-runtime: una instalación completa de Python, otra de Node.js, y binarios nativos de Poppler, git y LibreOffice en modo headless, más libheif y jxrlib. La carpeta plugins/openai-primary-runtime/plugins/documents contiene las skills que le explican al modelo dónde están esos binarios y cómo usarlos. El patrón vale la pena para cualquiera que arme su propio agente: en vez de reimplementar la conversión de documentos, empaquetás las herramientas de siempre y escribís las instrucciones para encontrarlas. El costo es el que se ve en el disco. Simon Willison · Hacker News
Fuentes consultadas: Anthropic, OpenAI, World Labs, Google, Baseten, TechCrunch, The Decoder, The Hacker News, BleepingComputer, Tom’s Hardware, Y Combinator, Hacker News, Simon Willison, DOJ, SonicWall, Virtualizor.