El Compilado Hilos Temas Archivo RSS

jueves · 15 min de lectura

Briefing Tech — 10 de septiembre de 2026

Estados Unidos acusa formalmente a seis empresas chinas de destilar los modelos frontera, y un experimento independiente muestra a Qwen copiando el razonamiento de GPT-5.5 Pro. Apple presentó su primer plegable. Y el gasto en IA de las empresas que más gastan cayó 10%.

iahardwareroboticaciberseguridadtecnicas

Generado el jueves 10 de septiembre de 2026, 13:10 UTC. Ventana cubierta: últimas 24 horas (9 sep 13:20 UTC → 10 sep 13:10 UTC).

TL;DR

  • CISA, la NSA y el FBI acusaron a seis empresas chinas de destilación a escala industrial sobre los modelos de Anthropic, OpenAI, Google y xAI: miles de millones de tokens extraídos desde fines de 2024, con conocimiento del gobierno chino según las agencias.
  • El mismo día, un experimento independiente de prefills de razonamiento midió que Qwen3.8 se corre 18 puntos hacia GPT-5.5 Pro cuando se le inyecta el inicio del razonamiento del modelo de OpenAI, incluso en puzzles sintéticos privados.
  • Apple presentó el iPhone Duo, su primer plegable, a 1.999 dólares, con el A20 Pro: el primer chip de teléfono fabricado en 2 nanómetros.
  • El gasto en IA por empleado del 1% de empresas que más gasta cayó 9,7% en agosto, y el precio efectivo por millón de tokens bajó 41% desde marzo. Los modelos frontera pasaron del 53% al 45% del volumen.
  • DeepSeek lanzó V4.1 Flash, 552.000 millones de parámetros con solo 8.000 activos en entrada, al mismo precio que V4 Flash.

IA

DeepSeek lanzó V4.1 Flash, con arquitectura nueva y precio sin recargo (10/09). Es el modelo más chico de una familia de arquitectura nueva, con multimodalidad de visión nativa y mayor throughput, y es el que le da nombre a la línea completa que viene arriba. Tiene 552.000 millones de parámetros totales pero solo 8.000 millones activos para procesar la entrada y 16.000 millones para generar salida, un reparto pensado para que la inferencia salga barata sin vaciar la capacidad. En los benchmarks agénticos y de código que publica la propia empresa queda adelante o a tiro de GPT-5.6 Sol y Claude Opus 5; en evaluaciones de conocimiento como HLE y en algunos benchmarks de terminal, los dos occidentales siguen claramente arriba. El precio es idéntico al de V4 Flash y rige desde las 04:00 UTC de hoy. OfficeChai · DeepSeek API Docs · Hacker News

El gasto en IA por empleado de las empresas que más gastan cayó 9,7% en agosto, y el precio por token bajó 41% desde marzo (10/09). El índice de Ramp para septiembre muestra que la mediana de gasto por empleado en el 1% de empresas que más invierte bajó a 7.205 dólares. Parte es estacional —los ingenieros se toman vacaciones en agosto—, pero hay dos fuerzas más de fondo: el precio efectivo por millón de tokens cayó de su pico de marzo a 0,68 dólares, y las empresas están migrando activamente a modelos más baratos. Los frontera —Opus, Fable, Sol— pasaron del 53% de los tokens consumidos a principios de agosto al 45% a principios de septiembre, empujados por políticas internas que restringen su uso porque los modelos estándar ya se consideran suficientes. Lo interesante para el proveedor es el detalle inverso: la migración no va hacia open-weight, que solo usa el 6,4% de las empresas con IA en la plataforma. The Decoder · Ramp

El pánico por el riesgo existencial de la IA llegó a CNN, a Fox News y a un episodio entero de Joe Rogan (10/09). El disparador fue Jacob Coxon, investigador de pre-entrenamiento que pasó por OpenAI y Anthropic, que renunció acusando a las dos empresas de arriesgar conscientemente la extinción humana; su colega en Anthropic Evan Hubinger pone la probabilidad de que una superinteligencia desalineada extermine a la humanidad esta década por encima del 10%. Varios políticos estadounidenses levantaron el tema, y otros investigadores de seguridad de Anthropic y OpenAI respaldaron a Coxon. Paul Christiano —que acaba de entrar al board de la OpenAI Foundation y a su comité de seguridad, sin voto— advirtió que sin mejor supervisión la humanidad podría perder el control de forma permanente. Conviene leerlo con las capas de interés cultural y financiero que hay atrás, y con el dato de que sigue sin estar claro si algo parecido a una super IA puede salir de la tecnología actual. The Decoder · The Decoder

Anthropic publicó un modelo económico que deja las predicciones más sombrías de su propio CEO como el escenario menos probable (09/09). Son tres escenarios para la economía estadounidense hasta 2030. En el moderado, el impacto de la IA se parece al de internet: crecimiento leve del PBI y salarios estables. En el intermedio, el crecimiento se duplica pero los salarios de los trabajadores del conocimiento se estancan, y programadores y empleados de call center tienen que reconvertirse a oficios como electricista o enfermero, un salto difícil que empuja el desempleo. En el extremo, la producción se duplica cada 4,5 años, el desempleo de trabajadores del conocimiento llega al 17,9% y la participación del trabajo en el PBI cae de 60% a 45%. Ese último escenario es el que coincide con lo que Dario Amodei viene diciendo en público desde 2025. The Decoder · Anthropic

Suno lanzó sus modelos v6 hechos junto a Warner, BMG y Believe, y apagó todos los anteriores (09/09). Son tres versiones, y las novedades técnicas son dos: se puede modificar parcialmente una canción con instrucciones de texto, y generar de forma multimodal a partir de texto, audio e imágenes. La empresa no dice qué catálogos entraron al entrenamiento. Universal y Sony siguen litigando, así que el acuerdo con tres sellos no cierra el frente legal, lo reparte. The Decoder


Hardware y Robótica

Apple presentó el iPhone Duo, su primer plegable, a 1.999 dólares (09/09). Cerrado tiene el tamaño de un pasaporte, con pantalla externa de 5,4 pulgadas; abierto llega a 7,6, la pantalla más grande que puso en un iPhone. La bisagra tiene más de cien componentes y un perfil de torque a medida, y el marco es de titanio para bajar peso. Adentro van el A20 Pro y el módem propio C2, con dos baterías —una de cada lado— que Apple estima en 31 horas de video usando la pantalla interna. Hay Apple Pencil en las dos pantallas, Touch ID en el botón lateral y multitarea en pantalla partida. Se preordena el 16 de octubre y llega a 70 países el 23. En el mismo evento salieron los AirPods 5, el Apple Watch Series 12 con un sistema nuevo de sensado de salud y el Watch Ultra 4. Engadget · Apple

El A20 Pro es el primer chip de teléfono de Apple fabricado en 2 nanómetros (09/09). Va en el iPhone Duo y en el iPhone 18 Pro. El dato importa menos por el número que por el calendario: 2 nm en un chip de consumo de alto volumen marca dónde está realmente la capacidad de producción de la foundry, no dónde están los anuncios. Tom’s Hardware

OpenAI dijo que sus próximos procesadores podrían fabricarse en Samsung (09/09). Profundiza la cooperación de chips con la coreana y apunta a un esquema de doble fuente para sus ASICs de IA, con TSMC del otro lado. La lectura que hace Tom’s Hardware es la más útil: doble sourcing no se hace por diversificar por las dudas, se hace cuando el volumen requerido no entra en una sola foundry. Es una señal indirecta de cuánto silicio propio planea meter OpenAI en sus datacenters. Tom’s Hardware

Las acciones de Unitree cayeron 53% desde su debut, apenas tres semanas después de la IPO (09/09). El mercado está corrigiendo la valuación de 66.000 millones de dólares que alcanzó en el estreno en la bolsa de Shanghái en agosto, cuando las acciones llegaron a subir cerca de 629% en el día. Es el primer termómetro público que tiene el sector de humanoides: hasta ahora las valuaciones se fijaban en rondas privadas, donde nadie tiene que revisarlas todos los días. The Robot Report

LG negó de forma tajante la investigación sobre espionaje en sus televisores (09/09). Cierra —por ahora— lo de ayer: la empresa dice que las acusaciones de rastreo y escucha “no son ciertas”. La investigación original, de Gamers Nexus con Level1Techs, sostiene que los equipos escanean la red local, registran redes Wi-Fi cercanas y pueden grabar audio en standby incluso desconectados de internet, guardando los archivos para subirlos después. LG no publicó capturas de tráfico propias que contradigan las del análisis, así que la palabra de la empresa queda enfrentada a paquetes de red, no a otra medición. Tom’s Hardware


Ciberseguridad

CISA, la NSA y el FBI acusaron a seis empresas chinas de destilar los modelos frontera estadounidenses a escala industrial (09/09). El aviso conjunto nombra a DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun y Z.AI, y sostiene que desde fines de 2024 extrajeron miles de millones de tokens con millones de pedidos a los modelos de Anthropic, OpenAI, Google y xAI. Las agencias evalúan que la escala y la sofisticación implican conocimiento del gobierno chino y que la práctica es parte central de la estrategia de desarrollo de esas empresas. La mecánica descrita es la de una operación armada: pedidos repartidos entre cuentas fraudulentas o compartidas, servicios cloud, agregadores y proxies “estación de transferencia” para saltar restricciones geográficas y límites de uso; prompts que buscan sacar cadenas de razonamiento restringidas; failover automático entre rutas cuando una se bloquea; y frameworks de evaluación de calidad para detectar si el proveedor empezó a degradar las respuestas a propósito. DeepSeek y Moonshot figuran como los principales, seguidos por MiniMax. BleepingComputer · CISA

Dos fallas de dispositivos de borde pasaron a explotación confirmada: Cisco Secure FMC con CVSS 10 y WatchGuard Firebox en manos de ransomware (09-10/09). La de Cisco es CVE-2026-20079, un bypass de autenticación que deja ejecutar scripts y comandos como root con solo mandar pedidos HTTP armados a la interfaz web; se conoce desde marzo y recién ahora la empresa confirma que se explota, aunque los indicadores que publicó en julio incluyen una entrada de log del 23 de julio, semanas antes de que su PSIRT dijera enterarse. CISA la metió en el catálogo KEV con plazo del 12 de septiembre para las agencias federales. Cisco avisa además que instalar el hot fix previene ataques futuros pero no remedia un equipo ya comprometido. Del otro lado, CISA confirmó que las bandas de ransomware están explotando la falla crítica de RCE en los firewalls WatchGuard Firebox que ya había marcado como explotada en diciembre. BleepingComputer · BleepingComputer

Alguien publicó en GitHub una reconstrucción del código fuente de Stuxnet, con instrucciones de compilación (09/09). El repositorio, del usuario Sadpainy, es producto de ingeniería inversa sobre los binarios originales encontrados en 2010, y dice preservar la lógica y los vectores de ataque reorganizados para que se puedan leer y estudiar. Stuxnet fue el primer gusano que causó daño físico directo: entraba por USB y red a hosts Windows, apuntaba a PLC Siemens de la planta de enriquecimiento de Natanz y alteraba las frecuencias de las centrifugadoras mientras le mostraba datos normales al operador. El detalle que conviene tener a mano antes de tomarlo como referencia: al momento de la publicación no hay validación de ningún investigador de malware con nombre, especialista en control industrial, proveedor, CERT ni agencia, y la identidad y las credenciales de quien lo subió se desconocen. Tom’s Hardware · Adafruit

AdaptHealth confirmó 4,1 millones de personas expuestas, y Veradigm reconoció otra filtración de datos de pacientes (09/09). El ataque a AdaptHealth se descubrió en julio y se atribuye a ShinyHunters. El de Veradigm entró por un proveedor externo y expuso datos personales de pacientes; la banda Gentlemen se adjudicó el ataque. Los dos casos son de salud y los dos siguen el mismo patrón del año: el dato no sale de la empresa que lo custodia sino de alguien en su cadena. BleepingComputer · BleepingComputer

Trezor avisó que atacantes que entraron a su proveedor de mail están usando la lista para phishing (10/09). El fabricante de billeteras de hardware alertó a sus clientes el miércoles. Es la combinación más peligrosa que existe para el rubro cripto: una lista de correos verificada de gente que tiene cripto, en manos de alguien que puede escribir desde una dirección que parece legítima. La regla no cambia: la semilla de recuperación no se ingresa nunca en una página web, mande quien mande el mail. BleepingComputer


Técnicas, repos y práctica

Un experimento de prefills de razonamiento midió que Qwen3.8 se corre 18 puntos hacia GPT-5.5 Pro cuando se le inyecta el arranque del razonamiento ajeno (09/09). El método es simple y replicable: para cada problema se generan dos respuestas del modelo objetivo, una normal y otra que arranca con el primer 1% del razonamiento del modelo maestro insertado en su canal de razonamiento, y después se mide cuánto de la respuesta visible del maestro aparece en los primeros 100 tokens de la del alumno, promediando recall de unigramas, bigramas y trigramas. Sobre 45 problemas —15 STEM, 15 no-STEM y 15 puzzles sintéticos privados—, Qwen3.8 A95B pasa de 16,79% a 34,97%, con +27 puntos en STEM y +14,75 en los puzzles que nadie más tiene. DeepSeek V4 Flash no se mueve, Kimi K3 sube 4,54 puntos pero ya arranca con el solapamiento más alto. El experimento no prueba destilación, pero es la clase de evidencia técnica y reproducible que el aviso de CISA de ayer no aporta. Gist de wsxiaoys · Hacker News

Sebastian Raschka desarmó el rumor de que los looped transformers de GPT-6 Astra sirven para esconder el razonamiento (09/09). Un looped transformer es un ajuste de arquitectura: en vez de agregar bloques nuevos, se pasa la representación intermedia varias veces por los mismos bloques, con los pesos compartidos —la idea viene de Universal Transformers, de 2018—. Raschka considera probable que Astra use algo así, apoyado en el reporte de The Information y en que el científico jefe de OpenAI dijo que la profundidad del grafo de cómputo de sus modelos frontera está dentro de un factor de dos respecto de GPT-4. Pero su conclusión sobre el rumor es negativa: OpenAI viene ocultando las trazas de razonamiento desde o1, y el looping no es lo que las oculta; la mejora de Astra la atribuye sobre todo a mejores recetas y datos de entrenamiento. Hay un consejo aparte que vale por sí solo: archivar contenido viejo de AGENTS.md y SKILL.md, porque los modelos nuevos entienden mejor el problema solos y el andamiaje de más los puede constreñir. Ahead of AI · Hacker News

“Procedural Graphs”: un paper de Google propone guardar el procedimiento del agente en un grafo que se reescribe solo (09/09). Firmado por Yuxing Lu, Yicheng Chen, Shanchan Wu y Sercan Arık, con Georgia Tech y la Universidad de Pekín, la idea es la contracara del grafo de conocimiento: donde ese guarda hechos como tripletes entidad-relación-entidad, este guarda procedimientos como tripletes procedimiento-relación-procedimiento, para que el agente pueda consultar qué hacer y en qué orden en vez de dejarlo implícito en un historial que crece. En cada paso, un modelo de guía convierte el subgrafo alrededor del nodo activo en una sugerencia que sesga la próxima acción sin dictarla, así que el solver puede desviarse cuando el grafo está mal. El grafo se auto-mejora: un refinador contrasta trayectorias fallidas contra exitosas, propone ediciones y solo commitea las que no empeoran una validación held-out, guardando las rechazadas para no volver a proponerlas. Partiendo de un esqueleto mínimo alcanza o supera grafos hechos a mano, y corrige un prior experto defectuoso en vez de heredarlo. arXiv · DAIR.AI

Desert Ant Labs explotó en Hacker News: 18 modelos on-device, gratis hasta 100.000 dispositivos activos por mes (10/09). El lanzamiento es del 8 pero llegó al frente hoy. Es un laboratorio europeo que entrena modelos chicos y especializados —uno por tarea— para audio, visión y texto, con un solo SDK para Swift, Kotlin y JavaScript. Los números que publican son el argumento: Voz transcribe diez minutos de audio en dos segundos en un iPhone, 4,7 veces más rápido que Whisper; Clear limpia audio con un modelo de 9 MB a 302x tiempo real en un teléfono; Tongue identifica 84 idiomas con tres palabras y 2 MB, con mejor score que un detector de 293 MB; Redact enmascara datos personales en 27 idiomas con 12 MB, cerca de un GLiNER-PII de 2,3 GB. El caso de uso que proponen es el que más se parece a un problema real de costos: la llamada que se repite cien mil veces por día —limpiar una grabación, etiquetar una foto, sacar una fecha de una oración— no necesita un modelo frontera. Citan un trabajo de investigadores de Nvidia que estima que entre 40% y 70% de las llamadas a modelos grandes en sistemas de agentes podrían ir a uno chico. Desert Ant Labs · Hacker News

Un juego de navegador sobre pedirle a un agente que cambie un botón de color llegó primero a Hacker News con 786 puntos (10/09). Se llama Opusfived y la consigna entera es “hacé que el botón ‘Add to Cart’ sea azul; no dejes que Claude cambie nada más”. Es una comedia interactiva corta sobre agentes que nunca pueden limitarse a hacer la cosa pedida, y vale como termómetro: la queja que más resuena hoy entre quienes usan agentes de código a diario no es que fallen, es que hagan de más. La contracara técnica está dos ítems más arriba, en el consejo de Raschka de podar el andamiaje viejo. Opusfived · Hacker News


Fuentes consultadas: The Decoder, BleepingComputer, Tom’s Hardware, Engadget, Apple, Ramp, Anthropic, CISA, Cisco, The Robot Report, Adafruit, OfficeChai, DeepSeek, Ahead of AI, arXiv, DAIR.AI, Desert Ant Labs, GitHub, Hacker News.

Ver todos los briefings