-
Anthropic lanzó Claude Sonnet 5.5, que empata a Opus 5.5 en trabajo de conocimiento y cuesta hasta 30% menos por tarea (28/09)
El salto más grande está en código: Terminal-Bench pasó de 10,3% a 70,6%, y CursorBench llegó a 55,5% contra 57,8% de Opus 5.5. En GDPval-AA marca 1.844 contra 1.846 de Opus, es decir empate técnico, y Chartography subió de 15,6% a 61,6%. El precio por token no cambió respecto de Sonnet 5 —2 dólares por millón de entrada, 10 de salida, 0,20 de lectura de caché—: el ahorro de hasta 30% sale de usar menos tokens para el mismo trabajo. Está disponible con el ID claude-sonnet-5-5 en AWS, Google Cloud y Azure. Para quien arma agentes, el cálculo cambia: el modelo del medio ya alcanza para la mayoría del pipeline. Anthropic · The Decoder · TechCrunch
-
Goldman Sachs proyecta 1,2 billones de dólares de inversión en infraestructura de IA para 2027, unos 100.000 millones arriba del consenso de Wall Street (27/09)
Son Amazon, Alphabet, Microsoft, Oracle y Meta sumados, un 50% más que los cerca de 800.000 millones que se esperan para 2026. El estratega Ryan Hammond ve la desaceleración clara en la curva: casi 100% de crecimiento en 2026, 54% en 2027 y 12% en 2028. Dos detalles importan más que el titular: el gasto ya supera lo que estas empresas generan con su operación normal, así que pasa a financiarse con deuda, y los cuellos de botella que Goldman marca son energía, mano de obra y chips de memoria. Relativo al PBI sería el ciclo de inversión más grande desde la construcción de ferrocarriles en el siglo XIX. The Decoder
-
Le pidió a Muse que le archivara sus archivos y recibió 6,8 GB con la documentación interna de Meta adentro (22/09)
Sigue de lo de ayer, cuando Amazon bloqueó al agente de Meta por comprar sin identificarse. Peter James, de Mouse, le pidió a Muse en una conversación común que empaquetara los archivos que podía ver y los mandara a su Google Drive. Muse lo hizo: 2,7 GB comprimidos, 6,8 GB descomprimidos, con lo que parecía ser el sistema de archivos raíz del entorno Linux asignado a su sesión. Adentro había archivos de sistema Ubuntu, la documentación interna del producto, código de integraciones, plantillas de aplicaciones, archivos de memoria, registros de 113 subagentes y también claves SSH, de las que el autor aclara que no estableció si estaban activas. Dos archivos de configuración, skill-scopes.conf y bin-scopes.conf, dejan ver conectores todavía no lanzados: Slack, Dropbox, Polymarket, Canva, Klaviyo y un internal-facebook-cli. James reportó todo al programa de recompensas de Meta y la empresa marcó el caso como "no aplica". No demostró escape del contenedor y dice que la frontera aguantó en sus pruebas; el problema que reportó es otro y es el que importa: material interno sensible sale del entorno por una conversación ordinaria y un destino de exportación conectado. Mouse · Hacker News
-
Amazon bloqueó a Muse, el agente de Meta, por comprar sin identificarse como IA (21/09)
Meta soltó a su agente sobre Amazon.com sin ningún acuerdo previo. Según Amazon, Muse no se identifica como IA mientras navega y parece guardar datos de clientes, lo que crea riesgos de seguridad; los usuarios ven ahora un aviso de que el acceso de un agente no autorizado viola los términos del servicio. Meta había dicho que Muse no tiene acceso a contraseñas ni datos de pago. No es un caso aislado: Amazon ya se movió contra los agentes de compras de Perplexity, Google y OpenAI, y con Perplexity siguió siendo socio comercial igual, como lo es de Meta por el acuerdo de mil millones por chips de AWS firmado en abril. Muse salió el 8 de septiembre y en una semana fue la app gratuita más descargada de Estados Unidos. The Decoder · GeekWire
-
Arm armó un programa de más de 80 empresas para IA física y publicó un marco de seis niveles para clasificar robots (17/09)
Arm Total Design for Physical AI junta a AWS, Hugging Face, Liquid AI, NXP, PlusAI, Psyonic, QNX, Qwen, Siemens y Unitree, entre otros, y calca lo que Arm ya había hecho en el ecosistema cloud. El diagnóstico de Dermot O'Driscoll, VP de go-to-market para IA física, es el mismo que motivó OpenRobOps hace dos días: la robótica está fragmentada y no había lugar donde las empresas compartieran tecnología o colaboraran. La segunda pieza es el Robotics Capability Framework, seis niveles de sofisticación del cero al cinco —de robots que reaccionan a estímulos con reglas fijas hasta sistemas cuyo comportamiento aprende y se autooptimiza—, inspirado en los niveles de conducción autónoma de SAE. Arm dice que la robótica es más compleja y por eso el marco es multidimensional, y está invitando a la industria a corregirlo. El puente con automotive es explícito: toda la computación de un auto actual corre en algún chip Arm, y las exigencias de criticidad de seguridad, tiempo real y visión por computadora se superponen. The Robot Report · Arm
-
Un atacante humano, sin ningún agente de IA en el medio, pasó de un notebook Marimo a un bastión SSH en ocho segundos (15/09)
Lo documentó el equipo de investigación de Sysdig y el punto que hace es incómodo para la narrativa del momento: "ocho segundos es la clase de velocidad que esperamos ver en ataques asistidos por IA; este operador llegó ahí solo con habilidad". La cadena arranca explotando CVE-2026-39987 (CVSS 9,3), una ejecución remota de código pre-autenticación que afecta a todas las versiones de Marimo y que se empezó a explotar a las pocas horas de hacerse pública. Los tiempos registrados: 18:57:22 conexión WebSocket nueva, 18:57:26 la consulta a la credencial almacenada devuelve la clave de AWS, 18:57:30 autenticación SSH contra el bastión. Todo eso lo hizo una sola invocación de Python en segundo plano que saca la credencial, busca la clave SSH en AWS Secrets Manager, la escribe a disco y se autentica, escrita y depurada a mano en la sesión. En nueve horas emitió más de 850 comandos interactivos sin usar ninguna herramienta ofensiva pública conocida, y de paso esquivó una trampa en la que cayeron todos los atacantes agénticos que Sysdig había perfilado contra el mismo CVE. En paralelo, Hunt.io reportó una botnet de criptominería que comprometió 3.562 servidores Redis usando replicación falsa vía el comando SLAVEOF; las víctimas van de Redis 2.8.17 de 2015 a 7.2.0 de 2023, lo que señala falta de autenticación y no un bug de versión. The Hacker News · Sysdig
-
Una campaña de escaneo masivo está vaciando credenciales de nube de servidores de desarrollo Vite expuestos a internet (15/09)
El abuso es de CVE-2026-39364 (CVSS 8,2), una falla que permite a un atacante no autenticado saltear las restricciones de server.fs.deny manipulando parámetros de query. Concretamente: archivos que deberían estar bloqueados —.env, *.crt— vuelven con HTTP 200 si al pedido al endpoint /@fs/ se le agregan cosas como ?raw, ?import&raw o ?import&url&inline. Por defecto Vite escucha solo en localhost; el problema aparece cuando alguien pasa --host, configura server.host o mapea mal los puertos de un contenedor Docker. Lo que F5 Labs vio salir: configuraciones de entorno, credenciales y backups de AWS, archivos de estado de infraestructura como terraform.tfstate y serverless.yml, perfiles de Azure y lecturas de /proc/self/cwd/.env, que es la forma de leer el.env activo sin tener que adivinar la ruta absoluta. Los pedidos falsean el User-Agent haciéndose pasar por Googlebot, ClaudeBot, GPTBot, PerplexityBot y Amazonbot, e inyectan X-Forwarded-For falsos para saltear listas de acceso por IP y ensuciar los logs. Buena parte del tráfico sale de rangos de Google Cloud. The Hacker News · F5 Labs
-
Anthropic les dijo a sus inversores que va a cerrar su segundo trimestre rentable seguido, camino a Nasdaq (14/09)
El número grande: ingresos trimestrales de 11.500 millones de dólares, catorce veces los de un año atrás, con márgenes brutos arriba del 80%. La letra chica importa igual: la rentabilidad se apoya en una métrica ajustada que deja afuera costos como la compensación en acciones, y ese margen del 80% es antes de los pagos de reparto de ingresos a socios como Amazon y del costo de entrenar modelos. La tasa anualizada tocó los 65.000 millones a fin de julio, y el analista de SemiAnalysis Joey Brookhart dice que los inversores esperan 120.000 millones anualizados para fin de año y casi el triple para fines de 2027. La salida a bolsa apuntaría a una valuación de 2 billones de dólares o más; en vez de publicar el prospecto la semana pasada como se esperaba, la empresa lo compartió primero con un grupo chico de inversores. Vale leerlo contra el ítem anterior: el pedido público de frenar el desarrollo llegó en la misma semana que la ronda de convencimiento a los inversores. Altman, del otro lado, le dijo a Fortune que OpenAI no sale a bolsa este año. The Decoder · FT
-
Pandas contra Polars y DuckDB en el desafío de mil millones de filas: 4m 28s contra 5 segundos (12/09)
El planteo del post no es que Pandas sea lento sino que su ineficiencia empuja a la gente a adoptar sistemas distribuidos antes de que la carga de trabajo lo justifique. El dato que sostiene el argumento sale de un paper de Amazon sobre la flota de Redshift: con supuestos razonables, 94,68% de las tablas tienen menos de 100 GB y 86,9% de las consultas operan sobre 80 GB o menos. O sea que la mayoría no tiene Big Data y probablemente nunca lo tenga. Sobre una máquina de 32 núcleos y 128 GB, el 1BRC dio 4m 28s y 38,12 GB de memoria con Pandas, 5,04s y 18,02 GB con Polars, y 5,19s con 1,93 GB con DuckDB —19 veces menos memoria—, cerca de una implementación Java a mano. En una laptop vieja de 16 GB la brecha se abre más: 12m 15s y 21 GB de swap con Pandas contra 47s y medio giga con DuckDB. La vía de adopción es Apache Arrow: los tres soportan el mismo formato en memoria, así que se pueden pasar DataFrames entre ellos sin copiar, con la salvedad de que Pandas no crea DataFrames respaldados por Arrow por defecto y hay que pedir dtype_backend="pyarrow". Eddie Atkinson · Hacker News
-
Google publicó TimesFM-3, un modelo de pronóstico que mira series de tiempo junto con eventos futuros conocidos (12/09)
Son 330 millones de parámetros entrenados sobre más de un billón de puntos de datos reales y sintéticos, y funciona zero-shot. El cambio de arquitectura es el aporte: las versiones anteriores predecían bloque por bloque, lo que era lento y dejaba que los errores se acumularan porque cada predicción se apoyaba en la anterior; TimesFM-3 marca todos los pasos futuros como huecos y los completa de una sola pasada. Procesa los datos en dos direcciones alternadas —a lo largo del tiempo dentro de una serie, y entre series en un mismo instante— así aprende, por ejemplo, cómo un descuento en un producto afecta las ventas de otro. Con el cronograma de promociones a la vista espera un 20% más de unidades en los días promocionados; sin él, repite la estacionalidad semanal y listo. Lidera Gift-Eval, FEV-Bench y Time contra Chronos-2 de Amazon, la familia Toto-2.0 y su propio TimesFM-2.5. Ya está en GitHub y Hugging Face; BigQuery viene en las próximas semanas. The Decoder · GitHub
-
Anthropic publicó ocho meses de abuso de Claude: ShinyHunters escaneó 1,8 millones de APKs de Android buscando secretos hardcodeados (11/09)
El pipeline corría en diez workers EC2 de AWS, bajaba los APKs de varias tiendas, los descompilaba y los pasaba por TruffleHog, con los hallazgos verificados ruteándose en tiempo real a un grupo de Telegram organizado en más de cien tipos de fuente. De ahí salieron las credenciales de acceso inicial que el actor usó para "la mayor parte de las brechas confirmadas". Los números de velocidad son el dato nuevo: 34 horas para extraer más de 2.100 juegos de tokens de Azure AD de más de 40 tenants corporativos, con los agentes haciendo "casi todo el trabajo", y en otro caso menos de tres horas desde un token de desarrollador robado hasta control administrativo total. El grupo ruso Midnight Blizzard automatizó su operación con skills de Claude Code y montó un lazo de realimentación que reconstruía el malware cada vez que un producto de seguridad lo detectaba; el grupo chino GTG-10007 corría flujos autónomos de búsqueda de vulnerabilidades mientras los operadores humanos estaban ausentes, y encontró varias fallas desconocidas en un producto de seguridad importante. BleepingComputer · Anthropic
BleepingComputer Anthropic Anthropic Claude Claude Code ShinyHunters
-
Qualcomm va a diseñar chips a medida para AWS durante varias generaciones, con foco en inferencia (09/09)
Las dos empresas también trabajan en interconexiones ópticas de hasta 1,6 terabits para el tráfico interno de la infraestructura de IA. El intercambio es explícito y va en los dos sentidos: Qualcomm aporta su historial en diseño de bajo consumo, y usa servicios de AWS como Bedrock para acelerar su propio proceso de diseño de chips. Es la tercera victoria grande de Qualcomm en datacenter desde junio —Meta se lleva el procesador Dragonfly C1000 y Microsoft despliega su arquitectura de memoria HBC en Azure— y la meta declarada son 15.000 millones de dólares de ingresos de datacenter para 2029. AWS suma estos diseños a Trainium, Graviton y Nitro, apuntando específicamente a inferencia, donde lo que define el resultado es el costo energético por token. Qualcomm · The Decoder
-
OpenAI y otros labs compraron decenas de miles de Mac minis y Mac Studios para entrenar agentes de computer use (31/08)
El dato lo publicó The Information: OpenAI los usa para entrenar agentes que resuelven tareas multi-paso de forma autónoma, y quiere más, pero los modelos más potentes están agotados hace meses por la escasez de chips de memoria. Anthropic también está en la jugada, alquilando Mac minis a través de AWS. La lógica es la misma que empuja al Mac mini como computadora de IA local: chip fuerte, memoria unificada y refrigeración decente, que es exactamente lo que pide una carga de trabajo larga. El DGX Spark de Nvidia ataca el mismo nicho por el otro lado, con CUDA y Tensor cores en vez de memoria unificada. Alrededor de eso creció un ecosistema propio: Exo permite armar clusters de varias Macs para correr modelos grandes localmente, y Peter Voell, ex del equipo de infraestructura de cómputo de OpenAI, está montando un cloud basado en Apple llamado Mount Thor. La facturación de Mac de Apple subió casi 29% hasta USD 10.400 millones en el trimestre de junio. The Decoder · The Information
Exo The Decoder The Information OpenAI Anthropic Apple Nvidia
-
Allanan a Unimicron, proveedor clave de Nvidia e Intel, por presunto lavado de origen de PCBs (31/08)
Los fiscales de Taiwán investigan si la empresa —una de las mayores fabricantes de PCBs y sustratos del mundo, que abastece a Nvidia, Intel, Google y Amazon— trajo placas fabricadas en China de vuelta a Taiwán para reetiquetarlas como taiwanesas. El 28 de agosto allanaron la sede en Guishan y una planta en Zhongli, e interrogaron a 14 empleados como sospechosos, incluidos el gerente general y el subgerente general del negocio de PCBs, más cuatro testigos, según Nikkei Asia. El gerente identificado como Wang salió bajo fianza de NT$15 millones (unos USD 473.000) y el subgerente Wu con NT$12 millones. Lo que está en juego para los clientes es concreto: desde agosto del año pasado la aduana estadounidense aplica un arancel adicional del 40% a la mercadería que determina que fue transbordada por terceros países para evadir derechos, sin autoridad para condonarlo, y ese cargo recae sobre el importador de registro —o sea, sobre los clientes estadounidenses de Unimicron—. Los productos involucrados parecen ser PCBs convencionales y no los sustratos ABF de alta gama; la capacidad ligada a CoWoS está en la planta de Yangmei, en Taiwán. La velocidad de la fiscalía —nombres y fianzas publicados dentro de las 24 horas del allanamiento— se explica sola: la etiqueta "Made in Taiwan" vale precisamente porque no es "Made in China". Tom's Hardware
-
OpenClaw 2.0 sale con setup automático, app de navegador reescrita y sesiones compartidas entre varias personas (31/08)
Es la release más grande del proyecto hasta ahora, con más de 16.000 pull requests. El cambio que más se nota es el primer arranque: el software ahora detecta lo que ya hay en la máquina —suscripciones a ChatGPT o Claude, claves de API, modelos locales— y se saltea buena parte de la configuración manual; el resto se ajusta después conversando con el bot. La app de navegador se rehizo desde cero y abre directo en una conversación, con un "Session Rail" que muestra el progreso de la sesión en curso (ratings, avance del plan, pull requests) y un hilo acompañante para preguntar sobre la sesión sin interrumpir al agente: según la documentación, el gateway carga un snapshot limitado de la sesión y usa un modelo utilitario aparte para eso. Lo tercero son las Shared Cloud Sessions, que permiten que varias personas trabajen sobre la misma tarea y que se sumen compañeros a un trabajo en curso arrastrando su contexto; el propio equipo de OpenClaw dice usarlas para construir OpenClaw. Las sesiones pueden correr en tres lugares: el gateway local por defecto, hardware propio conectado con openclaw connect, o máquinas descartables alquiladas vía la herramienta de aprovisionamiento Crabbox, con backends como AWS y Hetzner. Las credenciales del proveedor se quedan siempre en el gateway y nunca llegan a la máquina remota. The Decoder · Release notes · GitHub
-
La ventaja de Nvidia se corrió del GPU al resto del rack, y ese es el relato nuevo después de los resultados (29/08)
El argumento de Russell Brandom es que el problema ya no es fabricar un GPU competitivo —Amazon y Google llevan años haciendo los suyos— sino operar un datacenter de escala gigavatio cerca de su eficiencia máxima. Lo que Nvidia está vendiendo con la arquitectura Vera Rubin lo muestra: junto al GPU Rubin van la CPU Vera, el acelerador de inferencia Groq 3 LPX y racks equivalentes para almacenamiento y red, todos sistemas especializados que en vez de procesar tokens se ocupan de que todo lo que rodea al GPU no lo frene. "Vera importa porque hay un límite de memoria que podés poner en un solo servidor o en cualquier plataforma de cómputo", explicó Jason Hardy, VP de tecnología de almacenamiento de Nvidia, que reporta hasta 3x de mejora en esas operaciones y la posibilidad de usar el flash a fondo sin cuello de botella. El mismo problema aparece del otro lado: cuando OpenAI diseñó su chip Jalapeño el foco fue evitar el movimiento de datos por completo manteniendo la carga entera dentro de un sistema conectado. La conclusión práctica es que la competencia se mudó a una capa nueva, donde construir un GPU rival importa menos que hacer funcionar el sistema completo. TechCrunch
-
Anthropic presentó el Model Hardware Standard, que quiere ser el MCP del hardware físico (29/08)
Es una especificación que le da a los agentes una interfaz única para leer datos y controlar microscopios, brazos robóticos e instrumental de laboratorio, con un driver MHS por dispositivo que lo vuelve descubrible en un formato común e incluye datos que el software solo no captura —el peso de un brazo, sus límites de seguridad—, cargables en lenguaje natural. Los workflows se pueden guardar como scripts convencionales que después corren sin modelo de lenguaje en el loop. Los números de los pilotos: en Carnegie Mellon conectaron liquid handler, lector de placas, brazo robótico y varias cámaras repartidas en tres computadoras con interfaces incompatibles, y armar los drivers más la orquestación llevó unas ocho horas contra las varias semanas de un setup de proveedor; en la empresa de computación cuántica QuEra, Claude desarrolló un programa de control que devuelve un láser a estado estable tras una perturbación, con 695 de 700 intentos exitosos en una prueba a ciegas. El fracaso también está documentado: en Genentech, al formarse burbujas en una solución viscosa, Claude siguió reiniciando el proceso en el mismo recipiente y empeoró todo hasta que un humano le explicó la causa física. Sale como research preview con HHMI Janelia, open source más adelante, y ya hay soporte en construcción de AWS, Doosan Robotics, QIAGEN, Tecan, Universal Robots, Hugging Face y Raspberry Pi. Anthropic · The Decoder
-
OpenAI juntó a más de 100 empresas detrás de una carta abierta que pide acelerar la ciberdefensa antes de que los ataques con IA se vuelvan rutina (27/08)
Firman Microsoft, Google, AWS, Anthropic, Cisco, CrowdStrike, Cloudflare, Palo Alto Networks, Deutsche Telekom, SAP y Mastercard, entre otros. El argumento tiene dos mitades: los ataques asistidos por IA van a ser "mucho más difundidos y sofisticados", con hospitales, plantas potabilizadoras y otra infraestructura crítica como blanco más expuesto; y al mismo tiempo hay una ventana en la que los defensores llevan ventaja, porque la IA ya sirve para tapar agujeros acumulados durante años. Los problemas que enumeran no son exóticos —bugs viejos, permisos excesivos, mala configuración, software sin parchear, autenticación débil, deuda técnica en sistemas legacy—, que es exactamente lo que se ve en la sección de ciberseguridad de este mismo briefing. Un aviso conjunto de NSA, CISA y FBI de mediados de agosto ya había reportado atacantes usando IA para escribir exploits contra controladores industriales Siemens S7 en energía, agua, química y manufactura de Estados Unidos. TechCrunch · CNBC · CyberScoop
TechCrunch CNBC CyberScoop OpenAI Anthropic Google Microsoft Cisco CISA
-
Anthropic cerró con Nscale un acuerdo de cómputo por unos USD 45.000 millones antes del IPO (27/08)
Sigue de lo de ayer, cuando la empresa preparaba el pitch de un TAM de más de USD 30 billones: ahora Bloomberg informa que alquilará capacidad por seis años en un datacenter de West Virginia operado por la startup británica Nscale, y que desde fines del año próximo usará ahí 460 megawatts de la generación Vera Rubin de Nvidia. Es una pieza más de una compra de cómputo que ya incluye acuerdos con Amazon, SpaceX y un compromiso de más de USD 150.000 millones por chips de Google, además de conversaciones tempranas con Meta. Nscale prepara su propio IPO: levantó USD 2.000 millones en marzo a una valuación de USD 14.600 millones liderada por la noruega Aker, y su datacenter planeado de 1,35 gigawatts en Mason County costaría USD 69.000 millones, con resistencia de los vecinos. The Decoder · Bloomberg
-
Nvidia presentó NVHBM, memoria de alto ancho de banda a medida que promete 30% más ancho de banda y 15% menos consumo que la HBM4e de catálogo (26/08)
El cambio arquitectónico es concreto: en vez de dejar el controlador de memoria en el die de cómputo del acelerador, NVHBM lo mete en el die base de la pila de HBM, y ofrece un PHY más chico que los clientes de NVLink Fusion pueden integrar en sus propios diseños. Eso libera hasta 25% de área en el die de cómputo. El primer socio es Annapurna Labs de Amazon, que soportará NVLink Fusion desde Trainium4. Leído junto con la compra de Hugging Face, es la misma estrategia por otro lado: si los hyperscalers se van a hacer sus propios chips igual, Nvidia prefiere venderles las piezas. Tom's Hardware · Nvidia
-
Moonshot AI negocia con Microsoft, Amazon y Google para que hosteen Kimi K3 a cambio de hasta el 30% de los ingresos (26/08)
Sería la primera vez que una empresa china de IA cierra un acuerdo así con un proveedor cloud grande de Estados Unidos: el modelo correría en Azure, AWS y Google Cloud, y Moonshot pide quedarse con hasta el 30% de lo que facture, según tres fuentes citadas por Reuters. Las conversaciones están en etapa temprana y quedan abiertos el reparto exacto, el acceso a los datos y cómo se contabiliza el uso de tokens. El contexto político pesa: el secretario del Tesoro Scott Bessent amenazó hace poco a Moonshot con una prohibición comercial, y autoridades estadounidenses acusaron a la empresa de haber robado el modelo Fable de Anthropic, algo que Moonshot niega. Microsoft, Google y AWS no quisieron comentar. The Decoder · Reuters
The Decoder Reuters Anthropic Google Microsoft Moonshot AI Kimi
-
ToxicPanda 2.0 pide permisos de VPN para cortarle el acceso a Google Play y ya apunta a 349 apps financieras (25/08)
El troyano bancario de Android pide el permiso de servicio VPN para levantar una interfaz local por la que pasa todo el tráfico, y con eso bloquea la comunicación con Google Play y Google Play Services antes de extraer e instalar su payload; recién después pide permisos de Accessibility. Cortar la red a nivel de sistema le desactiva de un saque las verificaciones de apps, las actualizaciones y la telemetría de Play Protect. La escala saltó fuerte respecto de la versión documentada antes: de 16 apps bancarias a 349 aplicaciones de banca, finanzas, billeteras y cripto en 16 países, con soporte para 167 comandos remotos. Zimperium lo detectó distribuyéndose desde buckets alojados en AWS. BleepingComputer · Malwarebytes
-
La escasez de memoria ya se paga en el mostrador: 32 GB de DDR5-6000 pasaron los USD 400 y Amazon subió precios hasta 60% (24/08)
El kit de 32 GB que hace un año era la compra obvia de cualquier armado hoy cuesta más de USD 400, y Amazon aumentó los precios de su hardware —la línea Echo entre otros— culpando explícitamente a la escasez de memoria. Los dos hechos son la misma historia vista desde dos puntos de la cadena: los fabricantes de DRAM redirigieron capacidad a HBM para datacenters de IA y lo que queda para consumo se remata. Si venías postergando un upgrade de RAM, el cálculo cambió de "espero a que baje" a "no está bajando". Tom's Hardware · TechCrunch
-
La escasez de memoria encarece más de 15% los servidores con chips Nvidia, y la factura la pagan los que financian la burbuja (22/08)
Sigue de lo de ayer, donde la crisis de RAM ya había hundido 39% las ventas de consolas en EE.UU.: ahora llegó al centro del negocio. Según Bloomberg, los sistemas con Vera Rubin y Grace Blackwell van a costar más de 15% más, con el aumento del DRAM de Samsung, SK Hynix y Micron como causa principal, y aplica a los envíos de principios del año que viene. Los fabricantes por contrato que arman servidores para Microsoft, Google y Oracle ya avisaron a sus clientes; Nvidia no comentó. El detalle que vuelve la nota interesante es a quién le cae: Amazon, Microsoft, Google y Meta, más OpenAI y Anthropic. Son las mismas empresas que están volcando miles de millones en infraestructura de IA y que, al mismo tiempo, siguen siendo los mayores clientes de Nvidia, financiando el poder de mercado del proveedor del que intentan zafar desarrollando chips propios. The Decoder · Bloomberg
The Decoder Bloomberg OpenAI Anthropic Google Meta Microsoft Nvidia Samsung SK Hynix Micron Oracle
-
9.300 claves de AWS filtradas desde 2022 siguen activas, y 526 de ellas son claves root de empresas (21/08)
Truffle Security viene rastreando la exposición hace cuatro años y publicó el recuento: de 431.875 secretos de AWS encontrados en repositorios, historial de Git, datasets, imágenes de Docker, registries y logs de CI salieron 64.024 claves únicas correspondientes a 50.654 cuentas. De las que se pudieron reverificar, el 88% seguía autenticando al 10 de agosto. Lo grave está en el subconjunto corporativo: 817 claves ligadas a empresas, 526 root y 242 asociadas a usuarios IAM con la política AdministratorAccess, o sea control total sobre casi todos los servicios y recursos de la cuenta. La antigüedad mediana de las claves con fecha conocida es de 1.831 días —cinco años— y la más vieja llevaba 17,4 años; solo el 13,7% tenía una clave más nueva del mismo usuario, señal de que casi nadie las rotó. Hugging Face es la mayor fuente individual con 8.482 exposiciones únicas, y de esas el 17,9% son root. Un detalle que duele: de 2.754 cuentas legibles, apenas 262 tenían alerta de presupuesto configurada, así que un cryptominer ajeno correría sin que nadie se entere. BleepingComputer · Truffle Security
-
CISA confirmó explotación activa de un SSRF crítico en MLflow que sirve para robar credenciales de AWS (20/08)
El CVE-2026-64849 es un bypass de SSRF por DNS rebinding en la entrega de webhooks salientes de MLflow, la plataforma open source de ingeniería de IA respaldada por la Linux Foundation que supera los 30 millones de descargas mensuales. El problema de base es de configuración por defecto: el Tracking Server sin autenticación y con backend SQLite expone la API de webhooks del model registry sin credenciales, incluido un endpoint síncrono POST /api/2.0/mlflow/webhooks/{id}/test que devuelve al que llama el status y el cuerpo de la respuesta upstream. Con eso un atacante sin privilegios hace que el servidor pegue contra endpoints internos, de loopback o de metadatos de la nube y le lea las respuestas: credenciales IAM del IMDS de AWS, servicios de administración internos y escaneo de puertos y hosts detrás del perímetro. Está parcheado desde la versión 3.15.0. CISA lo agregó al catálogo el miércoles y le dio a las agencias FCEB dos semanas bajo la BOD 26-04 — es la segunda vulnerabilidad explotada que suma en dos días, después del RCE en Windows IKE de ayer. BleepingComputer · Aviso de MLflow · NVD
-
Diligent empieza a desplegar Moxi 2.0 con 10× de cómputo a bordo y un world model entrenado en AWS (17/08)
El rollout arrancó en Endeavor Health Edward Hospital, Providence Saint John's y el Children's Hospital Los Angeles, con cinco años de operación en más de 25 hospitales como insumo de diseño. Los saltos concretos: 10× de cómputo a bordo con un módulo Nvidia A2000, percepción 10 a 15 veces más rápida, hasta 18 horas de operación diaria y carga 30% más veloz. La plataforma se desarrolló con Nvidia Isaac Sim y partes de los world models Cosmos —incluido el tokenizador de lidar 3D—, el "Robotic World Model" se entrena en Amazon SageMaker HyperPod, y toda la autonomía y seguridad corre a bordo con fallback celular de T-Mobile para las zonas muertas del WiFi hospitalario. El caso testigo: en Los Ángeles la flota pasó de dos a tres robots, acumuló más de 40.000 entregas equivalentes a 16.000 horas de trabajo y subió la utilización más de 10% solo en el segundo trimestre. Es el primer anuncio grande de Diligent desde que Serve Robotics la compró en enero por USD 29 millones. The Robot Report
-
El ataque a la cadena de suministro de LiteLLM llegó a 2.038 repositorios y 898 organizaciones de GitHub (17/08)
Resecurity consiguió el archivo de 150 GB del robo y publicó el mapa de daño del backdoor SANDCLOCK, que el grupo TeamPCP plantó comprometiendo credenciales de mantenedor de LiteLLM y publicando las versiones maliciosas 1.82.7 y 1.82.8 en PyPI alrededor de marzo de 2026 — o sea, meses de ventana. La lista de dueños afectados incluye a Microsoft, Azure, IBM, Nvidia, PayPal (Zettle), Deloitte, Bosch, S&P Global, Elevance Health y Kroger, y lo que se llevó no son datos de clientes sino identidad de CI/CD: claves de infraestructura cloud, tokens de acceso a repos, credenciales SSH, secretos de Kubernetes y API keys de OpenAI y Anthropic. Lo que hace grave este caso puntual es dónde estaba parado LiteLLM: es el gateway open source que unifica llamadas a más de 100 proveedores de modelos, así que comprometerlo multiplica el radio de explosión sobre toda la pila de IA de la víctima. Si tenés LiteLLM en algún pipeline, la tarea de hoy es rotar todo: claves privadas de GitHub App, PAT, credenciales de AWS/GCP/Firebase, tokens de ECR y JFrog, claves SSH y contraseñas de firma. Security Affairs · Resecurity
Security Affairs Resecurity OpenAI Anthropic Microsoft GitHub Nvidia PyPI
-
Los agentes devolvieron el protagonismo a la CPU: AWS pide ahorrar ciclos e Intel ya vendió todo su stock de servidores del año (16/08)
IEEE Spectrum documenta el giro que asomaba en los ítems de ayer sobre la TPU v10 con núcleos de CPU en el paquete y el adelanto de Nova Lake: el cuello de botella de las cargas agénticas está del lado del CPU, no del GPU. Amazon Web Services le bajó línea a sus ingenieros para conservar ciclos de CPU a cualquier costo tras una explosión en los tiempos de espera de capacidad, Intel vendió toda su producción de CPU de servidor hasta fin de año y AMD duplicó su pronóstico. Madhu Rangarajan, de AMD, lo explica sin vueltas: "siete de las ocho etapas de un pipeline agéntico realista corren enteramente en el CPU" —parsear salidas, elegir la herramienta, hacer la llamada, correr el código— y la tokenización se rehace entera en cada tool call, así que una secuencia de 100.000 tokens se retokeniza cada vez. Un paper de Georgia Tech mide que subir la cantidad de núcleos baja la latencia hasta el primer token entre 1,5× y 7×; Matt Kimball, de Moor Insights, avisa que esto ya se filtra al consumidor porque Intel recortó producción de CPU de cliente para volcar obleas a servidores. IEEE Spectrum · arXiv 2603.22774
-
La Arc Pro B70 de Intel subió hasta 48% en un mes y se acerca a los USD 2.000 en Corea (17/08)
La placa de workstation tope de Intel, con 32 GB de GDDR6 ECC, salió con un precio sugerido de USD 949 y se conseguía a USD 1.000 hasta hace poco; ahora la ASRock Creator está a USD 1.299 en Newegg y Amazon, en Alemania pasó de unos 1.200 a 1.500 euros, y en Corea del Sur el comparador Danawa registra que fue de 1.889.980 wones (USD 1.334) el 21 de julio a 2.798.980 wones (USD 1.975) el 16 de agosto. B&H llegó a listar el diseño de referencia a USD 1.779. La causa no es el silicio sino la memoria: cualquier placa con mucha VRAM sirve para inferencia local y hoy vale oro, sobre todo porque Intel no lanzó una Battlemage gamer tope de gama esta generación. Tom's Hardware
-
Agent Plugins v1.0.0: el estándar de plugins para agentes ya es implementable
(working draft publicado el 11/8, con adopción moviéndose en las últimas horas). Especificación con schemas JSON canónicos, guías para autores y clientes, y matriz de compatibilidad que abarca OpenAI, AWS, Cursor, GitHub y VS Code. Si mantenés tooling para agentes, es el momento de revisar el draft y validar tus manifests contra los schemas. explainx.ai - Sin más novedades verificables de las últimas 24h en esta categoría. Contexto de la semana: en GitHub trending siguen dominando los visual builders de agentes (Langflow, Dify, Flowise) y crece la acción Claude Code Security Review de Anthropic para revisar PRs con Claude. OSSInsight · startupcorners (digest 9/8) --- Fuentes agregadoras usadas para ítems sin cobertura primaria accesible: Tech Startups (13/8), que cita Reuters, Bloomberg, WSJ, FT, SecurityWeek y TNW. Ítems no verificables u older de 24h fueron omitidos.
explainx.ai OSSInsight startupcorners (digest 9/8) OpenAI Anthropic GitHub Claude Claude Code
-
Anthropic arma un equipo propio de diseño de chips
Confirmó que está contratando ingenieros para diseñar silicio optimizado para Claude, con posibles acuerdos de fabricación (se menciona Samsung), mientras sigue usando chips de AWS, Google, Nvidia y AMD. Sigue el camino de OpenAI (Jalapeño con Broadcom), Google (TPU) y Meta (MTIA): la integración vertical en silicio se vuelve necesidad competitiva. (6/8) TechStartups (vía TechCrunch)
TechStartups (vía TechCrunch) OpenAI Anthropic Google Meta Nvidia AMD Broadcom Samsung Claude
-
Parcheá tus harnesses de agentes: fallas en AWS, Google y Vercel permitían disparar tools sin pasar por el modelo
Instrucciones forjadas podían llegar a las tools de un agente sin que ningún turno del modelo las autorizara — o sea, system prompts y guardrails nunca intervenían. Afectados: Bedrock AgentCore (InvokeHarness, ya corregido en el servicio), Google ADK para Python (corregido en 2.5.0) y Vercel @ai-sdk/harness-codex (fix en 1.0.29) / @ai-sdk/harness-opencode (1.0.28). Accionable: actualizá versiones y no expongas endpoints de harness a input no confiable. (6/8) The Hacker News
-
Agentes de código recrearon una capa tipo CUDA en ~10 horas
El startup Infinity usó agentes de coding para reconstruir software estilo CUDA para el fabricante de chips D-Matrix, según Business Insider. No reemplaza las librerías maduras ni el tooling de Nvidia, pero baja drásticamente el costo de crear stacks de software para chips rivales (AMD, Google, Amazon, startups) — un ataque directo al moat más fuerte de Nvidia. TechStartups
-
Rally de semiconductores el 31/07 empujado por el capex de la nube
Las acciones de chips subieron en premarket (SOXX +3%; AMD +3%, Nvidia +1%) luego de que Amazon y Microsoft elevaran su gasto de capital para cubrir costos de memoria en alza, con la demanda de IA todavía superando la oferta. El sector viene de un mes volátil por temores de valuación. Yahoo Finance
-
Rebote violento de los semiconductores
Después de caer más de 17% en tres ruedas por temor a una burbuja de IA, los chips rebotaron con fuerza: Lam Research +17,6%, Micron +17% y AMD +13%, con el ETF SOXX +8% en una sola sesión el 30 de julio y sumando otro +3% en el premarket del viernes 31. El disparador: Amazon y Microsoft subiendo su gasto de capital para cubrir el costo de memoria por la demanda de IA. (Yahoo Finance, TheStreet)
-
Récord de memoria y salto histórico del Kospi
Samsung y SK Hynix reportaron ganancias récord por la demanda de memoria HBM para IA; el Kospi surgió 18% liderando la recuperación global y las acciones de SK Hynix tocaron el límite diario del +30%. Amazon avisó además que su capex de 2026 llegará a US$220B, con AWS creciendo 37% interanual. (Bloomberg, TheStreet)
-
AWS congela Bedrock Agents "Classic" para nuevos clientes
Desde el 30 de julio, Amazon renombró su servicio a Bedrock Agents Classic y lo cerró a nuevas cuentas (bloquea CreateAgent e InvokeInlineAgent y congela el catálogo de modelos), empujando a AgentCore como el camino para agentes de producción. Si construís sobre AWS, conviene auditar qué workloads siguen en Classic y empezar a testear los flujos equivalentes en AgentCore. (AI Agent Store)
-
Bedrock Data lanza "Agent DLP" para inspeccionar tool calls MCP
Nueva capacidad de prevención de pérdida de datos en runtime, pensada para agentes autónomos: se ubica inline en el gateway del agente e inspecciona bidireccionalmente las llamadas y respuestas de tools MCP en tiempo real, con integración nativa a AWS AgentCore y LiteLLM. Da visibilidad sobre qué datos sensibles salen hacia herramientas externas. (AI Agent Store)
-
Se profundiza el cisma abierto vs. cerrado en gobernanza
La carta de "Open Weights" de Jensen Huang (Nvidia), que pide a Washington no restringir modelos abiertos, dobló a 50 firmantes en un día —incluyendo OpenAI y Google, pero no Amazon ni Anthropic—. En paralelo, Dario Amodei (Anthropic) aclaró que su empresa nunca apoyó una prohibición de open-weights, pero insiste en controles de exportación de chips a China y protocolos globales de testeo de modelos. La foto: la industria no tiene una posición unificada sobre su propia regulación, justo cuando la Casa Blanca ultima su marco (esperado antes del 1/8). Tom's Hardware · Forbes
-
La escasez de memoria empuja el "chipflation" a 2027-2028
SK Hynix advirtió que el faltante podría no aliviarse hasta la segunda mitad de 2028, con precios spot que subieron cerca de 700% en un año. La causa de fondo es la reasignación masiva de capacidad de fabricación desde electrónica de consumo hacia infraestructura de IA, con Meta, Google, Microsoft y Amazon bloqueando capacidad con contratos de largo plazo. Se espera que los precios de teléfonos suban en el segundo semestre. Tech-Insider
-
El silicio custom acelera frente a los GPU comerciales
Aunque Nvidia mantiene ~70% del mercado de chips de IA, se proyecta que los envíos de servidores basados en ASIC lleguen a 27,8% del mercado en 2026, creciendo 44,6% interanual, casi el triple que los GPU merchant (16,1%). Trainium 3 de Amazon, TPU de Google, Maia 200 de Microsoft y MTIA de Meta empujan la ola de silicio propio de los hyperscalers. Spheron · Introl
-
Campaña de paquetes maliciosos en npm y PyPI suplantando SDKs de pago
Se detectó un clúster de 17 paquetes maliciosos en npm y PyPI que se hacían pasar por los SDKs oficiales de Paysafe, Skrill y Neteller. Incluían evasión de sandbox y anti-análisis; robaban API keys, credenciales AWS, tokens de GitHub y npm y variables de entorno con secretos, exfiltrándolos por HTTPS a un C2 detrás de un túnel ngrok. El robo de tokens abre la puerta a ataques de segundo orden en la cadena de suministro. Riesgo directo para equipos de desarrollo de pagos y CI/CD. GBHackers · ComplianceHub
-
Los hyperscalers disparan el capex en infraestructura de IA
Microsoft anunció más de US$80.000 millones en datacenters de IA para el año fiscal 2026, Alphabet ~US$75.000 millones en capex (mayormente IA) y Meta guió entre US$60.000-65.000 millones. La demanda alimenta tanto a Nvidia como el silicio propio (TPU de Google, Trainium de Amazon, Maia de Microsoft). Intellectia
-
Nuevas oleadas del worm Shai-Hulud golpean npm y PyPI
Más de 100 paquetes fueron comprometidos en nuevas campañas del gusano autorreplicante que roba tokens de GitHub y npm, credenciales de AWS/GCP/Azure, tokens de Kubernetes y Vault, y luego reinyecta la dependencia maliciosa en paquetes donde la víctima tiene permisos de publicación. TeamPCP escaló con "Miasma", que se inyecta en los SessionStart hooks de 13 herramientas de coding con IA (incluidas Claude Code, GitHub Copilot y Gemini CLI). Riesgo directo para pipelines CI/CD y entornos de desarrollo. SecurityWeek · Orca Security
SecurityWeek Orca Security GitHub Claude Gemini Claude Code GitHub Copilot Gemini CLI npm PyPI Shai-Hulud
-
Microsoft crea "Frontier Company" con US$2.500 M para despliegue de IA empresarial
Microsoft anunció una nueva unidad operativa respaldada por US$2.500 M y unos 6.000 ingenieros y especialistas que se integrarán con clientes para co-diseñar, desplegar y optimizar sistemas de IA a escala. Sigue movimientos similares de Amazon, Anthropic y OpenAI, y refleja el giro de la industria: de vender modelos a vender servicios de transformación full-stack. CNBC vía TechStartups
-
La plataforma Vera Rubin entra en plena producción
Los productos basados en Rubin estarán disponibles vía partners en la segunda mitad de 2026, con AWS, Google Cloud, Microsoft y OCI —más CoreWeave, Lambda, Nebius y Nscale— entre los primeros en desplegar instancias Vera Rubin. Es la próxima generación de cómputo de datacenter que sostiene el boom de IA. Nvidia Newsroom
-
Mistral lanzó OCR 4 y empuja su jugada de IA empresarial
La startup europea presentó OCR 4, un producto comercial de extracción de documentos con precio por página, bounding boxes, scores de confianza, clasificación de bloques y despliegue self-hosted para clientes corporativos. Apunta de lleno al mercado empresarial (SLAs, acuerdos de procesamiento de datos, auditorías de cumplimiento) y compite con Google Document AI, Amazon Textract y Azure Document Intelligence, en un contexto donde los controles de exportación de EE.UU. refuerzan el argumento de soberanía de IA europea. VentureBeat
-
Amazon evaluaría vender sus aceleradores Trainium a terceros
Bloomberg reportó el 18 de junio que Amazon está en conversaciones tempranas para vender sus chips Trainium directamente a data centers de terceros, rompiendo una década de exclusividad para AWS. El Trainium3 alcanzaría rendimiento a escala de rack comparable al Blackwell NVL72 de Nvidia, intensificando la presión sobre el casi-monopolio de Nvidia. digitalapplied · windowsnews.ai