domingo · 18 min de lectura
Briefing Tech — 23 de agosto de 2026
Un mercado gris chino vende tokens de Claude al 10% del precio de lista, la escasez de memoria encarece 15% los servidores con chips Nvidia, y un humanoide corrió los 100 metros en 9,39 segundos en Beijing.
Generado el domingo 23 de agosto de 2026, 13:15 UTC. Ventana cubierta: últimas 24 horas (22 ago 13:15 UTC → 23 ago 13:15 UTC).
TL;DR
- En China se compran tokens de Claude al 10% del precio oficial a través de “estaciones de transferencia”, una cadena de suministro modular que esquiva geobloqueo, tarjeta extranjera y hasta la verificación biométrica con selfie.
- La crisis de memoria trepó a los servidores de IA: los sistemas con Vera Rubin y Grace Blackwell van a costar más de 15% más, y la factura la pagan Amazon, Microsoft, Google, Meta, OpenAI y Anthropic.
- Un humanoide corrió los 100 metros en 9,39 segundos en los World Humanoid Robot Games de Beijing, contra los 9,58 de Usain Bolt; en pruebas previas otro robot había marcado 9,32.
- Los funcionarios locales que votan sobre data centers reciben amenazas de muerte, y más de 500 municipios de EE.UU. ya restringieron obras.
- Un estudio de 8.135 corridas explica por qué sirven las skills de los agentes: el 65,7% del beneficio viene del procedimiento, no del conocimiento, y la precisión de recuperación se derrumba de 29,6% a 3,3% cuando la biblioteca pasa de 5 a 100 entradas.
IA
En China se compran tokens de Claude al 10% del precio de lista a través de “estaciones de transferencia” (23/08). Anthropic tiene probablemente los controles de acceso más duros de la industria contra China —chequea teléfono, tarjeta de crédito extranjera y domicilio de facturación, banea empresas con más del 50% de propiedad china directa o indirecta, y a algunos usuarios les pide documento con selfie en vivo—, y aun así un análisis de Zilan Qian, del Oxford China Policy Lab publicado por ChinaTalk, describe un mercado floreciente. Las “estaciones de transferencia” son proxies de API alojados fuera de China que reciben el pedido, lo reenvían como si viniera de una ubicación legítima y devuelven la respuesta; se paga en yuanes por WeChat o Alipay, sin VPN ni tarjeta extranjera, y hay directorios comunitarios que las rankean por precio y disponibilidad. Los precios de 70% a 90% por debajo de lista salen de granjear el crédito gratis de USD 5, explotar descuentos de empresa y educación, partir un plan Max de USD 200 entre varios usuarios y —lo que el ambiente llama “diluir”— desviar en silencio un pedido para Opus 4.7 hacia Sonnet o hacia modelos chinos como Qwen: investigadores del CISPA alemán revisaron 17 proxies y encontraron un supuesto endpoint “Gemini-2.5” que sacó 37% en un benchmark médico contra el 83,82% oficial. La hipótesis más incómoda de Qian es que el negocio real no son los tokens sino los logs, porque cada prompt, respuesta y llamada a herramienta pasa por el operador, y ya circulan en Hugging Face datasets con salidas de razonamiento de Opus 4.6 sin procedencia clara. Lo que hace que esto sea más que una nota de negocios: cuando el pedido llega por proxy, Anthropic ve la cuenta y la IP del proxy, no al usuario final, y eso degrada sistemas de monitoreo como Clio, que buscan patrones coordinados de abuso entre cuentas. The Decoder · ChinaTalk
Los funcionarios que votan sobre data centers reciben amenazas de muerte, y ya hay más de 500 municipios con restricciones (23/08). Sigue de la encuesta de ayer, donde la oposición a tener un data center cerca saltó de 42% a 75% en un año: acá se ve qué forma toma esa oposición cuando aterriza en un concejo deliberante. La constante es que el blanco es el funcionario local, vote como vote. En Marshall, Michigan, el concejo aprobó el 3 de agosto una moratoria de un año a obras nuevas, y diez días después la policía les avisó que había una amenaza de muerte creíble ligada al proyecto. En Salix, Iowa, la oficina del sheriff del condado de Woodbury investiga posteos que pedían “varias cosas del tipo muerte y terrorismo” contra todo el gobierno municipal, después de que el pueblo anexara campo para un predio que Google está evaluando. En el condado de Box Elder, Utah, un comisionado que aprobó un proyecto tiene policía apostada afuera de su casa; en abril, al concejal de Indianápolis Ron Gibson le metieron 13 tiros en la casa tras respaldar una rezonificación. La respuesta institucional está siendo cerrar la puerta: la comisión de Emporia, en Kansas, hizo sus reuniones del 5 y del 19 de agosto por videollamada y sin período de comentarios del público. Tom’s Hardware · The Soufan Center
Un paper sostiene que la IA va a hacer que los científicos trabajen más y peor, no lo mismo mejor (23/08). El argumento es económico, no técnico, y por eso conviene leerlo aunque uno crea que los modelos van a seguir mejorando: los autores —de Princeton, la Universidad de Washington y otras instituciones— idealizan a propósito al LLM como una herramienta que ahorra tiempo sin introducir errores y a costo despreciable, para aislar el efecto puro del ahorro. Con ese supuesto arman un modelo basado en la teoría del forrajeo óptimo, de la ecología del comportamiento, donde el proyecto tiene una parte obligatoria —hacer las figuras, formatear, enviar— y una voluntaria: correr experimentos extra, analizar más hondo, pulir la prosa. Cuando la IA acorta una fase, la hora restante del investigador vale más, y lo que se sacrifica es justamente la parte voluntaria, porque conviene arrancar un proyecto nuevo antes que mejorar el que ya es publicable. De tres escenarios, en dos cae la calidad: si la IA ayuda a evaluar ideas temprano, se filtra mejor pero se profundiza menos; si ayuda a publicar, entran proyectos más flojos y salen más papers pero más chatos. Solo mejora la calidad en el tercer caso, cuando la IA acelera la fase profunda, que es exactamente donde siempre se recortó por falta de tiempo. La cita que resume todo: “como tecnología que aumenta el trabajo, los LLM incrementan el costo de oportunidad de nuestro tiempo, empujándonos a hacer más, peor —en vez de lo mismo, mejor”. The Decoder · arXiv 2607.17397
Hardware y Robótica
La escasez de memoria encarece más de 15% los servidores con chips Nvidia, y la factura la pagan los que financian la burbuja (22/08). Sigue de lo de ayer, donde la crisis de RAM ya había hundido 39% las ventas de consolas en EE.UU.: ahora llegó al centro del negocio. Según Bloomberg, los sistemas con Vera Rubin y Grace Blackwell van a costar más de 15% más, con el aumento del DRAM de Samsung, SK Hynix y Micron como causa principal, y aplica a los envíos de principios del año que viene. Los fabricantes por contrato que arman servidores para Microsoft, Google y Oracle ya avisaron a sus clientes; Nvidia no comentó. El detalle que vuelve la nota interesante es a quién le cae: Amazon, Microsoft, Google y Meta, más OpenAI y Anthropic. Son las mismas empresas que están volcando miles de millones en infraestructura de IA y que, al mismo tiempo, siguen siendo los mayores clientes de Nvidia, financiando el poder de mercado del proveedor del que intentan zafar desarrollando chips propios. The Decoder · Bloomberg
Un humanoide corrió los 100 metros en 9,39 segundos en Beijing y dejó atrás el récord de Usain Bolt (22/08). El robot de X-Humanoid marcó ese tiempo en la carrera oficial de los segundos World Humanoid Robot Games, contra los 9,58 de Bolt en Berlín 2009; en una prueba previa, el humanoide “Lightning” de Honor —sí, la marca de teléfonos— había marcado 9,32, con un pico de 14,5 m/s, y es el mismo robot que ganó la media maratón de Beijing en abril en 50 minutos y 26 segundos. Otro robot de X-Humanoid saltó 2,88 metros en salto alto sin carrera, contra los 0,95 del mejor humanoide de la edición 2025 y el récord humano de 2,45 de Javier Sotomayor. La comparación con Bolt conviene tomarla con pinzas —un robot no corre con la misma mecánica ni con las mismas reglas—, pero la escala del evento sí dice algo: 666 equipos de 16 países, 2.056 robots y 51 eventos en cinco días, con los equipos creciendo 138% y los robots multiplicándose por cuatro contra 2025. El telón de fondo político es que en julio la FCC prohibió la importación de humanoides extranjeros nuevos y el Pentágono sumó a Unitree a su lista de empresas con vínculos militares chinos. Al Jazeera · NBC News
τ_0-VLA: el paper de robótica más votado de la semana pone al planificador a pensar más cuando la decisión importa. Con 519 upvotes en Hugging Face, es el modelo fundacional de robots del Shanghai Innovation Institute y ataca un problema estructural de los VLA jerárquicos: la política de alto nivel decide el próximo subtarea con un solo forward pass, sin ningún mecanismo para gastar más cómputo en las decisiones difíciles o consecuentes. τ_0-VLA reformula la generación de subtareas como un problema de inferencia escalable en cómputo, guiado por un modelo del mundo: en cada paso la política de alto nivel usa memoria de ejecución para proponer una subtarea y, cuando hace falta, busca entre alternativas antes de comprometerse; después una política de bajo nivel la ejecuta sobre varios cuerpos robóticos distintos. Se entrenó sobre 40.115 horas de datos reales heterogéneos con co-entrenamiento multimodal, y los autores reportan que asignar más cómputo en tiempo de inferencia mejora sustancialmente la precisión de predicción del próximo subtarea, tanto en dominio como bajo cambio de distribución, y que esa mejora se traduce en más éxito en lazo cerrado en tareas de manipulación de horizonte largo. Es, en los hechos, llevar el “pensar más antes de responder” del lado del texto al lado del control. arXiv 2608.16885 · Web del proyecto · Hugging Face
Microsoft le echa la culpa a las luces RGB de que se cuelguen los juegos en Windows 11 (22/08). La raíz está en un cambio al driver de kernel inpoutx64.sys que llegó con la actualización KB5121003 del 11 de agosto, en Windows 11 24H2 y 25H2. El software de iluminación RGB instala drivers con nombres casi idénticos a inpoutx64, y el choque produce pantallazos azules, congelamientos y reinicios inesperados, con EXCEPTION_ACCESS_VIOLATION como error típico. Los juegos confirmados afectados son ARC Raiders, MARVEL Tōkon: Fighting Souls y The Finals; Embark Studios, que desarrolla dos de los tres, publicó un workaround provisorio que consiste en borrar el servicio y sacar el archivo de la carpeta de drivers de Windows. Microsoft todavía no tiene arreglo oficial. Es el tipo de falla que vale tener anotada: no es el juego ni la placa de video, es un driver de terceros que nadie recuerda haber instalado. Tom’s Hardware · BleepingComputer
Los envíos de CPUs de escritorio cayeron más de 20% y AMD marcó récord histórico de cuota x86 justamente ahí (22/08). El derrumbe se explica por precios de PC altos, oferta limitada de GPUs y estacionalidad, todo apoyado en la misma crisis de componentes que atraviesa el resto del briefing. Lo llamativo es que AMD subió de 33,2% a 34,9% de cuota unitaria en escritorio trimestre contra trimestre despachando menos CPUs: ganó porque Intel cayó más rápido. En notebooks la diferencia es más modesta, de 28,3% a 28,9%, y ahí Intel sí amplió capacidad y despachó millones de procesadores más. El trimestre completo no fue malo para el sector —+10% secuencial en unidades—, con data center y laptops compensando el agujero del escritorio. Tom’s Hardware
Ciberseguridad
Infectaron las centrales multimedia Android de los autos y las convirtieron en nodos de proxy residencial (22/08). Kaspersky documentó lo que dice que es el primer caso de una cadena de infección hecha específicamente para head units de auto, y la vía de entrada es de manual de cadena de suministro: TWCore, una app legítima del sistema de DoFun —proveedor chino de software, nube y hardware automotor, propiedad de Shenzhen Driving Control Technology—, descarga un APK malicioso siguiendo instrucciones de un servidor MQTT alojado en cardoor[.]cn. La app, sin interfaz, se llama JarService y descifra un cargador de segunda etapa que baja el payload final; ese payload reporta modelo, resolución, SSID de Wi-Fi y MAC, y acepta nueve comandos, entre ellos abrir una URL en un WebView y ejecutar JavaScript arbitrario, descargar y correr código nuevo, y hacer traceroute. El módulo que el operador cargaba principalmente se llama “zhima” y es un proxy reverso que convierte la central del auto en nodo de botnet residencial; también hacía pedidos web para fraude de clics. Kaspersky atribuye la operación al grupo MoYu, ya ligado a la botnet BadBox, aclara que el malware no toca los sistemas críticos de manejo, y dice que DoFun respondió que ya resolvió el problema. BleepingComputer · Securelist
Catorce paquetes npm troyanizados sueltan un implante de Linux con capa LLM para traducir órdenes en castellano llano a comandos (21/08). Los paquetes se hacen pasar por utilidades de calendario y rachas —streak-metrics-math, kit-map-vim, streak-map-cache, map-streak-kit y otros diez— y no usan install hook: el dist/index.mjs funciona como cargador y ejecuta el implante al importar el módulo, incluso como dependencia transitiva, lo que quiere decir que alcanza con que aparezca en cualquier parte del árbol. El binario se disfraza de “acelerador matemático nativo” con nombres como math-core.bin o calc-cache.bin. El payload es RedShell, el beacon de Linux nuevo en la versión 4.0 del framework RedC2: shell por /bin/sh, robo de claves SSH y credenciales de navegador, ejecución de ELF en memoria, proxy SOCKS5 y pivoteo. Lo que hay que mirar con atención es Red Agent, la capa de LLM que traduce pedidos en lenguaje natural a comandos del framework para reconocimiento de red y volcado de credenciales: baja el piso de habilidad necesaria para operar la herramienta. RedC2 se vende a USD 99,99 en el sitio “Red Offsec” y lo promociona el actor “MarlboroMan” en Hack Forums desde principios de junio. The Hacker News · TrendAI
El driver de remediación del propio Microsoft Defender sirve para borrar el antivirus durante el arranque (21/08). Jiří Vinopal, de Check Point Research, presentó la técnica en Black Hat USA 2026 y DEF CON 34 y publicó el paper y una PoC llamada BTR_CLI. No hay vulnerabilidad: es abuso de BTR.sys, el Boot Time Removal Tool, un driver legítimo y firmado que viene embebido en MpEngine.dll como recurso BOOTTIMETOOL y que Windows necesita, así que no se lo puede meter en la Vulnerable Driver Blocklist ni bloquear por WDAC sin romper Defender. Los blobs de configuración van cifrados con RC4 y una clave de 256 bytes hardcodeada en .rdata, que no cambió en 18 versiones x64 distintas desde Windows 7. La PoC instala el driver escribiendo directo en HKLM —Type=1, Start=1, grupo “Boot Bus Extender”—, esquivando el Service Control Manager y sin generar el Event ID 7045 que normalmente delata una instalación de driver; después corre en Ring 0 atribuido al proceso System y borra WdFilter.sys y MsMpEng.exe en la ventana dorada del arranque. La demo en vivo se llevó puesto todo el stack de Defender en Windows 11 25H2 con Tamper Protection activo. Requiere admin con SeLoadDriverPrivilege, y el MSRC contestó que no cumple criterios de arreglo inmediato. Check Point no vio abuso real todavía. The Hacker News · Check Point Research
Apollo Global confirma una brecha y es la primera víctima formal de la ola BlackFile contra el sector financiero (21/08). El acceso no autorizado a plataformas cloud ocurrió entre el 6 y el 10 de julio, y recién el 12 de agosto Apollo determinó qué se llevaron: nombres, fechas de nacimiento, datos de contacto, domicilios y números de Seguridad Social. La gestora maneja USD 1,05 billones en activos al cierre de junio y no dijo a cuántas personas afecta; la notificación se presentó ante el fiscal general de California. Google atribuye la campaña a BlackFile, un grupo afiliado a The Com que partió su operación de extorsión en cuatro marcas con infraestructura compartida —Redact, Pink, Helix y Falcon— para diluir la atribución. El modus operandi no tiene nada de exótico: vishing haciéndose pasar por soporte de IT, pedidos que arrancan cerca de USD 3 millones y se negocian por debajo del millón, y swatting como escalada cuando la víctima no paga. Blackstone y Bain Capital habrían sido apuntados con la misma infraestructura, sin confirmación de compromiso. CyberScoop
TikTok paga USD 400 millones para cerrar el caso de privacidad infantil del Departamento de Justicia (21/08). Son 300 millones inmediatos y 100 millones más cuando se dicte la orden que anule el consent decree previo contra Musical.ly, la antecesora de la plataforma. La demanda es de 2024, derivada de la FTC y presentada en el Distrito Central de California, y acusaba a TikTok y ByteDance de permitir cuentas a menores de 13 años, recolectar datos en el “Kids Mode” sin consentimiento parental e incumplir pedidos de borrado. No hay admisión de responsabilidad, y el DoJ lo presenta como una de las mayores recuperaciones en un caso COPPA. Departamento de Justicia · The Hacker News
Técnicas, repos y práctica
Las skills sirven por el procedimiento, no por el conocimiento, y la recuperación se rompe a las 100 entradas (22/08). Es el primer estudio controlado que se pregunta no si las skills mejoran a un agente sino por qué, y el número que ordena todo es este: el anclaje procedimental explica el 65,7% de los casos en que el agente con skill le gana al que no la tiene, contra apenas 4,5% para la inyección explícita de conocimiento. O sea que una skill no le está dando datos que le faltaban: le está estabilizando la acción —qué pasos de setup correr, qué herramientas en qué orden, qué chequeos intermedios— y por eso reduce errores de ejecución como armar mal el entorno de trabajo o equivocar el formato de salida. Los autores, de Princeton, UC San Diego y otras casas, normalizaron 8.135 corridas y codificaron a mano 240 trayectorias pareadas para llegar a una taxonomía de doce modos de uso; contra Workflow Memory, las skills sacan 6,06 puntos en comparaciones apareadas. El cuello de botella real es otro: cuando la biblioteca crece de 5 a 100 entradas, la precisión de uso efectivo se desploma de 29,6% a 3,3%, y las opciones que suenan parecido empeoran la elección. Dos matices útiles para quien escribe skills: invocar exactamente la correcta no es ni suficiente ni necesario —una skill emparentada suele alcanzar para orientar—, y en 10% de los casos el agente aplicó un playbook por otra parte razonable de forma mecánica o fuera de contexto. La conclusión práctica es que conviene tratar el asunto como ciclo de vida, y que el próximo avance está en cómo recuperar, no en cuánto guardar. The Decoder · arXiv 2608.14036
FACET: para entrenar agentes de terminal, primero armá el contenedor y recién después escribí la consigna, la solución y el verificador. Segundo puesto de HF Daily Papers, y el diagnóstico es de los que se entienden solo con enunciarlos: cada tarea de terminal acopla cuatro artefactos —instrucción, entorno inicializado, solución de referencia y verificador ejecutable—, y si se generan a partir de supuestos inconsistentes entre sí, la tarea sale irresoluble o mal evaluada, que es peor porque no avisa. Encima la síntesis en varias etapas suele tirar a la basura los objetivos, dependencias, transiciones de estado y restricciones de procedimiento que estaban codificados en la fuente original. FACET —Fine-grained Agentic Construction of Executable Tasks— reconstruye skills relacionadas en escenarios coherentes y densos en información, y después realiza y repara el entorno de ejecución antes de generar los artefactos finales: el estado del contenedor queda como fundamento compartido para la instrucción, la solución y el verificador. La validación es por ejecución, con reparación dirigida al artefacto que falló en vez de regenerar todo de cero. Afinar modelos de varias escalas con trayectorias exitosas recolectadas así mejora consistentemente el rendimiento en Terminal-Bench 2.1, y los autores dejan formulado el principio general: preservar la intención de la fuente y anclar todo al mismo estado ejecutable. arXiv 2608.18580 · Web del proyecto · Hugging Face
MemTrapBench: la memoria correcta y relevante igual puede empeorar la respuesta, y todos los frameworks probados rinden peor que no tener memoria. El punto de partida es que los benchmarks de memoria existentes miden si la información se extrae, se guarda y se recupera bien, y casi nadie mide qué le hace esa memoria recuperada al razonamiento sobre la tarea actual. Los autores llaman a eso trampas cognitivas inducidas por memoria y distinguen dos formas: fijación de razonamiento, donde el modelo se queda pegado a un camino que funcionó antes, y distorsión de creencias, donde un recuerdo fiel le corre el mapa de lo que da por cierto. El resultado incómodo es que sobre dos familias de modelos y cinco frameworks de memoria representativos, todas las estrategias evaluadas quedan por debajo del setting sin memoria, y hasta las mejores caen más de 10%. La mitigación que proponen, AdaptiveMem, es de las que se pueden probar en una tarde porque opera en tiempo de inferencia y consiste en instruir al modelo a esquivar las trampas: reduce el daño en MemTrapBench y preserva o mejora el rendimiento en los benchmarks de memoria estándar, sin cambiar el framework de abajo. Si estás armando memoria persistente para un agente, este es el paper que dice dónde vas a chocar. arXiv 2608.20202 · Hugging Face
Fuentes consultadas: The Decoder, ChinaTalk, Tom’s Hardware, The Soufan Center, Bloomberg, Al Jazeera, NBC News, BleepingComputer, Securelist, The Hacker News, TrendAI, Check Point Research, CyberScoop, Departamento de Justicia de EE.UU., arXiv, Hugging Face.