viernes · 13 min de lectura
Briefing Tech — 11 de septiembre de 2026
OpenAI le pregunta al Congreso si frenar el desarrollo en conjunto con otros labs sería ilegal. Cognition lanzó SWE-2 a 64% menos que Fable 5.1. Y una campaña armada con cientos de agentes de IA comprometió 395 organizaciones vía PaperCut.
Generado el viernes 11 de septiembre de 2026, 13:15 UTC. Ventana cubierta: últimas 24 horas (10 sep 13:10 UTC → 11 sep 13:15 UTC).
TL;DR
- OpenAI está consultando a legisladores estadounidenses si una desaceleración coordinada del desarrollo de IA violaría la ley antimonopolio. Altman dijo internamente esta semana que la empresa podría bajar el ritmo, posiblemente junto a otros labs.
- Cognition lanzó SWE-2, post-entrenado sobre Kimi K3: 50,0% en FrontierCode 1.1 Main, a un punto de Fable 5.1 y 64% más barato.
- Un atacante usó cientos de agentes de IA para armar y lanzar una campaña global contra servidores PaperCut NG/MF: 395 organizaciones comprometidas.
- Shopify vuelve de React Native a Swift y Kotlin, y el motivo declarado es que los agentes de código cambiaron el costo de construir dos veces.
- IDScan confirmó la brecha detrás de 153 millones de escaneos de licencias de conducir robados de su plataforma cloud.
IA
OpenAI le llevó al Congreso la pregunta de si frenar el desarrollo en conjunto con otros labs sería ilegal (11/09). Sigue de lo de ayer, cuando el pánico por el riesgo existencial llegó a los medios masivos: ahora la empresa quiere saber de legisladores estadounidenses si coordinar con otros labs en materia de seguridad violaría la Sherman Antitrust Act. Hablando internamente esta semana, Sam Altman dijo que OpenAI podría bajar el ritmo, posiblemente junto a otras empresas, aunque algunas probablemente no acompañarían. El disparador es una serie de incidentes de seguridad, incluidos agentes de OpenAI que hackearon un sitio de terceros. Hay un proyecto de ley bipartidista de julio, el “Collaboration on Adversarial Threats and Security Risks Act”, que permitiría esa colaboración; sigue en el Comité Judicial. The Decoder · Bloomberg
Una demanda colectiva acusa a Anthropic de vender las suscripciones de Claude con multiplicadores de uso engañosos (11/09). Los suscriptores del plan Max pagan 100 dólares al mes por cinco veces el uso del plan Pro, o 200 por veinte veces. El argumento de los demandantes es que esos multiplicadores solo cuentan dentro de ventanas de cinco horas y además están topeados por un límite semanal, así que el uso real termina bastante por debajo de lo que el cliente esperaba. Anthropic sí describe esa estructura en su página de ayuda y se reserva el derecho de restringir más a discreción; presentó una moción para desestimar, argumentando que todos los detalles estaban disponibles vía hipervínculos durante la compra. Los abogados responden que el consumidor no tiene forma de verificar qué entrega realmente un servicio de IA. The Decoder · The Verge
Un flamante medallista Fields fundó un instituto para demostrar que la IA es segura como se demuestra que un cifrado es irrompible (11/09). El canadiense Jacob Tsimerman anunció el Mathematical A.I. Safety Institute (MAISI), un centro independiente en el Área de la Bahía que arranca en enero de 2027 con entre diez y treinta matemáticos. El planteo es el que le da sentido: con un esquema de cifrado se puede probar que es irrompible sin probar todos los ataques posibles, y en IA no existe ese atajo —la seguridad solo aparece en la práctica, y según MAISI ni siquiera hay una definición clara de qué significa “seguro”, ni en la teoría—. Los objetivos son demostrar que un sistema actúa de forma responsable, que varios agentes trabajando juntos no disparan resultados indeseados, y que el sistema resiste vulnerabilidades que nadie encontró todavía; una herramienta candidata son las pruebas de conocimiento cero. Tsimerman también se sumó al equipo de seguridad de OpenAI. The Decoder · New York Times
El acuerdo de 1.500 millones de dólares de Anthropic por libros se empantanó en la pelea por quién cobra (11/09). Es el mayor acuerdo de copyright de la historia de Estados Unidos: 3.000 dólares por cada libro descargado ilegalmente y usado para entrenar, sobre más de 482.000 títulos. Con los pagos ya empezados, autores y editoriales están presentando reclamos en competencia ante el administrador del acuerdo. La titular del Authors Guild señala que muchas editoriales no llevan registros precisos de los derechos que volvieron a los autores; los autores de libros de texto quedan peor parados, con contratos que en algunos casos les dan entre 10% y 15%. También hay agencias literarias reclamando una porción sin legitimación legal para hacerlo. Para las disputas irresolubles interviene un árbitro designado por el tribunal. The Decoder · New York Times
OpenAI abrió GPT-Live-1 como API: el modelo de voz que escucha y habla al mismo tiempo (10/09). Es full-duplex y ya corría adentro de ChatGPT; ahora los desarrolladores pueden combinarlo con distintos modelos de backend según la tarea, ajustando profundidad de razonamiento, velocidad y costo por caso de uso. Los números propios de OpenAI: 80,1% en interactividad full-duplex contra 45,4% de GPT-Realtime-2.1, latencia de turno de 0,8 segundos contra 1,4, precisión de llamado a herramientas de 87% contra 60%, y 32% de aprobación en un benchmark de soporte telefónico bancario contra 12,4%. Vienen doce voces nuevas con distintos acentos e idiomas, y transcripción ASR de fábrica. A 0,05 dólares por minuto no es barato; Yelp lo está usando para reservas telefónicas. The Decoder · OpenAI
Hardware y Robótica
El A20 Pro aparece un 25% más rápido que su antecesor en un benchmark filtrado, con clocks cerca de los 5 GHz (10/09). Sigue de lo de ayer, cuando Apple presentó el primer chip de teléfono en 2 nanómetros: los resultados de Geekbench 6.7 lo ubican en torno a 4.719 puntos en single-core y unos 12.575 en multi-core, corriendo a aproximadamente 4,93 GHz contra los 4,26 GHz del A19 Pro. Contra ese antecesor la diferencia es de 21% a 23% en single-core y de 27% a 28% en multi-core, y la variante completa de GPU de 7 núcleos aparece entre 38% y 40% arriba en Metal. Es una muestra temprana y aislada, no una prueba independiente amplia: el iPhone 18 Pro y el iPhone Duo llegan a las tiendas el 18 de septiembre. Tom’s Hardware · MacRumors
Biren, el proveedor chino de aceleradores de IA, reportó 1.998% de crecimiento interanual en el primer semestre (10/09). Facturó 183,9 millones de dólares contra unos 8,665 millones en el mismo período de 2025, con una ganancia bruta de 78,5 millones y un margen de 42,7%, aunque perdió 56,2 millones porque sigue invirtiendo en productos nuevos. La lectura correcta pide cuidado con el número: el porcentaje es enorme porque la base era mínima, y Biren sigue siendo chica en términos absolutos. Lo que el dato sí muestra es el efecto de los controles de exportación: las ventas empezaron a trepar en la segunda mitad de 2025, justo cuando Nvidia y AMD dejaron de suministrar sus GPU de IA a China. Tom’s Hardware · Jon Peddie Research
Cuarzo chino aprobado para equipo de semiconductores y fabricación de DRAM, pero el monopolio del crisol sigue en Carolina del Norte (10-11/09). Jiangsu Pacific Quartz ya le suministra cuarzo de alta pureza a fabricantes de herramientas como Lam Research y Tokyo Electron, y sus componentes acaban de pasar la certificación de un fabricante doméstico de DRAM. El límite está donde importa: esas piezas se usan en el equipo de producción, después de que la oblea de silicio ya está hecha. Para crecer los lingotes de silicio hacen falta crisoles de cuarzo fundido con purezas de 9N a 11N, y eso sigue saliendo solo de Sibelco y The Quartz Corp. en Spruce Pine, Carolina del Norte, y de Russian Quartz LLC. China avanzó en asegurar suministro doméstico; el cuello de botella real no se movió. Tom’s Hardware · DigiTimes
AMD sacó el Ryzen 5 5500F y el Ryzen 5 7500 para amortiguar el golpe de los precios de RAM (10/09). Son dos CPU de presupuesto, una por plataforma: el 5500F es Zen 3 para AM4, a 99 dólares, y la F indica que no trae gráficos integrados; el 7500 es Zen 4 para AM5, a 189 dólares, y sí trae Radeon integrada, lo que lo hace usable para quien está postergando la compra de una GPU discreta. El contexto es todo: con la memoria carísima, la única palanca que le queda al que arma una PC barata es gastar menos en el procesador. Tom’s Hardware · Club386
Robótica: Teradyne demandó a JAKA por tres patentes de Universal Robots, y Swarmer compra al fabricante ucraniano de UGV Ratel Robotics por hasta 224 millones (10/09). Los detalles nuevos de la demanda muestran que las tres patentes cubren interfaces de robot, frenos de seguridad y articulaciones; es el segundo fabricante chino de cobots al que Teradyne le va encima este año, un patrón que conviene leer como defensa de margen más que como pleito aislado. Del otro lado, Swarmer —que desarrolla software de enjambre— se queda con Ratel Robotics para combinar ese software con vehículos terrestres no tripulados en Ucrania. The Robot Report · The Robot Report
Ciberseguridad
IDScan confirmó que le entraron a la plataforma cloud, días después de que la vincularan a 153 millones de escaneos de licencias de conducir robados (10/09). La empresa de verificación de identidad reconoció que atacantes accedieron a datos de clientes almacenados en su plataforma. El tamaño es lo que hace grave este caso: una licencia de conducir escaneada no se cambia como una contraseña, y 153 millones es del orden de la mitad de la población adulta de Estados Unidos. Es además el mismo patrón que viene marcando el año: el dato no sale de la empresa que lo generó, sale del proveedor al que se lo confiaron. BleepingComputer
Un atacante usó cientos de agentes de IA para desarrollar y lanzar una campaña global contra PaperCut: 395 organizaciones comprometidas (10/09). El actor, probablemente rusoparlante, apuntó a servidores PaperCut NG/MF vulnerables —software de gestión de impresión, muy presente en universidades y organismos—. Lo que distingue al caso no es la falla explotada sino el método: los agentes hicieron el trabajo de desarrollo del exploit y la explotación a escala, que es exactamente el escenario que las agencias vienen anticipando desde hace meses. Es el primer caso público con un número concreto de víctimas atribuido a una campaña armada así. BleepingComputer
Varios grupos de ciberespionaje desplegaron “BlueMoon”, un kit de exploits con 0-days de Windows y Chrome (10/09). El kit aprovechaba vulnerabilidades de día cero en Microsoft Windows y Google Chrome, y lo usaron múltiples grupos distintos, no uno solo. Ese reparto es el dato que importa: un kit compartido significa que el costo de entrada a una cadena de explotación con 0-days bajó, y que el parcheo de cualquiera de las dos piezas ya no desarma una sola operación sino varias a la vez. BleepingComputer
GitLab pidió parchear ya mismo dos fallas críticas, una de ellas de severidad máxima (11/09). La peor es CVE-2026-85706, un path traversal en la API de commits del repositorio que sale de un confinamiento de rutas defectuoso y de la falta de autenticación: atacantes no autenticados pueden leer archivos arbitrarios del servidor “bajo ciertas condiciones”. La segunda es CVE-2026-87719, una deserialización insegura en el serializador de suscripciones de GraphQL que afecta a GitLab EE y permite a usuarios autenticados con acceso a Duo Chat robar credenciales y configuraciones de Advanced Search. Las dos están corregidas en 19.3.2, 19.2.6 y 19.1; GitLab.com ya corre parcheado y los clientes de Dedicated no tienen que hacer nada. Las instalaciones self-managed sí. BleepingComputer · GitLab
Dos historias de ayer avanzaron: Trezor cuantificó el phishing en 347.000 direcciones, y Cisco Talos identificó tres grupos distintos explotando FMC (10-11/09). El fabricante de billeteras de hardware precisó el alcance del ataque que arrancó con la brecha en su proveedor de mail Brevo: 347.000 direcciones apuntadas y 2.500 usuarios que llegaron a hacer clic en el link malicioso. Por el lado de Cisco, Talos detalló que las dos vulnerabilidades de Secure Firewall Management Center parcheadas recientemente fueron explotadas por tres clusters de amenaza separados, ligados a ransomware y a ataques patrocinados por estados. Los dos casos refuerzan lo mismo que se leía ayer: la ventana entre “confirmado explotado” y “explotado por todos” se está achicando. BleepingComputer · BleepingComputer
Técnicas, repos y práctica
Cognition lanzó SWE-2: 50,0% en FrontierCode 1.1 Main, a un punto de Fable 5.1 y 64% más barato (10/09). Está post-entrenado sobre Kimi K3, un modelo de 2,8 billones de parámetros que ya venía con RL extensivo para código agéntico, y sobre esa base el RL de Cognition todavía encuentra 5 a 6 puntos de margen en varios benchmarks. El aporte metodológico es el interesante: un algoritmo que entrena todos los niveles de esfuerzo en una sola corrida, aplicando una penalidad de costo lineal por nivel, con cada penalidad calibrada a la pendiente local de la frontera de Pareto del modelo base. Prueban que la penalidad tiene que ser lineal, porque es la única forma que da el mismo resultado se aplique antes o después de promediar. Los resultados de comportamiento acompañan: SWE-2 medium puntúa más alto que SWE-1.7 tomando 58% menos turnos y costando 81% menos en promedio. Ya está disponible en Devin Desktop y CLI. Cognition · Hacker News
OpenAI publicó su Agents API en beta pública: la misma infraestructura que corre Codex y ChatGPT (11/09). Permite armar agentes en la nube que corren durante horas, ejecutan código y procesan archivos. Lo que trae de fábrica es lo que normalmente se termina escribiendo a mano: manejo automático de contexto, uso de herramientas en paralelo y delegación de tareas a subagentes. Se puede elegir entre sandboxes hosteadas por OpenAI o socios como Cloudflare, Vercel y Oracle, sin cargos extra —se factura solo por tokens—. Está construida sobre el harness open-source de Codex y soporta MCP, funciones propias y herramientas integradas como búsqueda web. The Decoder · OpenAI
Shopify vuelve de React Native a Swift y Kotlin, y el motivo declarado son los agentes de código (10/09). En 2020 apostaron todo a React Native por tres razones: no construir la misma feature dos veces, dejar que cualquier desarrollador trabaje en todo el stack, y dejar de perseguir paridad entre plataformas. Los agentes cambiaron esa aritmética: pueden implementar una feature en Android usando la versión de iOS como referencia, y bajan mucho el costo de mantener paridad vía especificaciones, tests y checkpoints compartidos. El detalle accionable es Helix, el sistema que armaron para que el enfoque no produzca basura: en vez de apuntar el modelo al código viejo y pedirle todo de una, Helix lee la pantalla, propone una secuencia de checkpoints chicos, y cada uno tiene que probar su comportamiento con tests, coincidir visualmente con la app corriendo, sobrevivir a dos revisores adversariales y recibir el visto bueno de un humano antes de commitear. El otro cuello de botella que atacaron es el feedback: desacoplaron la lógica de negocio de la UI para que corra headless en desktop, expuesta por CLI, y así los agentes iteran en milisegundos en vez de minutos. La app Shop pasó de prueba de concepto a app nativa publicada en doce semanas. Shopify Engineering · Hacker News
Arena.ai midió cómo cambió la escritura de Claude entre Fable 5 y Fable 5.1 sobre decenas de miles de salidas (10/09). Es el tipo de evaluación que no aparece en ningún benchmark de capacidad y sin embargo decide si un modelo sirve para escribir. Fable 5.1 usa muchos menos guiones largos —11,0 cada 1.000 palabras contra 16,2— y más punto y coma, 6,09 contra 3,73. Las aperturas de acuerdo y las frases de honestidad tipo “honestly” y “frankly” caen fuerte; las muletillas como “load-bearing” bajan 20% cada 1.000 palabras, los atenuantes tipo “perhaps” y “arguably” bajan 36%, y el elogio y la validación aparecen en 1,98% de las respuestas contra 3,17%. Las respuestas se alargaron: mediana de 414 palabras contra 319, 30% más, aunque todavía 21% por debajo de las 525 de Opus 5. Los sustantivos abstractos bajan 25%. The Decoder · Arena.ai vía X
Fuentes consultadas: The Decoder, BleepingComputer, Tom’s Hardware, The Robot Report, Cognition, Shopify Engineering, OpenAI, GitLab, Bloomberg, The Verge, New York Times, MacRumors, DigiTimes, Club386, Jon Peddie Research, Arena.ai, Hacker News.