martes · 13 min de lectura
Briefing Tech — 6 de octubre de 2026
Reflection liberó Beam, 501B de pesos abiertos con Apache 2.0; Meta cortó a la mitad sus usuarios de Claude Code y Microsoft bajó el presupuesto a dos tercios; Dinamarca filtró el CPR de 8,8 millones de personas; y llama.cpp v0.6.0 trae API de batch nueva.
Generado el 6 de octubre de 2026 a las 13:12 UTC. Cubre las últimas 24 horas.
TL;DR
- Reflection liberó Beam: 501.000 millones de parámetros totales, 23.000 activos, licencia Apache 2.0 y 80,9 en SWE-bench Verified, con 3 a 4 veces menos cómputo de inferencia que GLM-5.2.
- Meta bajó los usuarios de Claude Code de unos 60.000 a 30.000 empleados y Microsoft recortó el presupuesto anual con Anthropic de 1.000 a unos 667 millones de dólares.
- OpenAI empieza a marcar el texto de ChatGPT en la UE con una marca de agua estadística invisible, y abre el detector a investigadores.
- Dinamarca: alguien usó la cuenta legítima de una empresa privada para barrer el registro civil y se llevó nombre, dirección y número CPR de 8,8 millones de personas.
- llama.cpp v0.6.0 estrena la API
llama_batch_ext, soporte de GLM-5.3-Flash de 320B y flash attention por la tensor API de Metal.
IA
Reflection liberó Beam: 501.000 millones de parámetros totales, 23.000 activos por token y licencia Apache 2.0 (05/10). Sigue de lo de ayer: el modelo que Axios anunciaba para este mes ya tiene números. Es un mixture-of-experts disperso de 52 capas con atención local y global intercalada, 1 millón de tokens de contexto y 23,8 billones de tokens de entrenamiento con peso en código, material técnico y STEM. El pre-entrenamiento llevó menos de cuatro semanas en 6.144 GPUs GB300 NVL72 con 92,3% de goodput, y la corrida de RL generó más de 100 millones de rollouts en 10.500 GB300 durante cuatro semanas, con unos 1.300 millones de evaluaciones en sandbox. Saca 80,9 en SWE-bench Verified y 80,1 en Terminal-Bench v2.1, a la par de GLM-5.2 pero con 3 a 4 veces menos cómputo de inferencia; los pesos y el reporte técnico salen más adelante en octubre. Reflection · TechCrunch · SiliconANGLE · Semafor
Meta cortó a la mitad sus usuarios de Claude Code y Microsoft bajó el presupuesto anual con Anthropic de 1.000 a unos 667 millones de dólares (05/10). Lo reportó The Information: Meta pasó de unos 60.000 empleados con acceso a 30.000 y empuja Muse Code y MetaCode, mientras Microsoft dirige a su gente a GitHub Copilot aunque los ingenieros pueden seguir eligiendo otros modelos. Los dos venían usando Claude Code como la herramienta más usada adentro. El contexto importa: Anthropic todavía tiene 43,5% de las empresas estadounidenses que pagan suscripción o tokens, según el dato de julio de 2026, así que esto es sustitución por producto propio, no fuga de clientes. PYMNTS · Seeking Alpha · Yahoo Finance
OpenAI le empieza a poner marca de agua invisible al texto de ChatGPT en la Unión Europea (05/10). La técnica se llama textGrain y mete una señal estadística en la elección de palabras del modelo; en la UE se activa sola sobre ChatGPT y Codex en las próximas semanas para todos los planes, y los clientes de la API en el resto del mundo pueden optar por ella, apagada por defecto. El detector queda para investigadores y organizaciones que lo pidan, y solo dice si encuentra la marca, sin identificar al usuario ni mostrar el prompt. Los límites están publicados y son el dato útil: con 1% de falsos positivos detecta cerca del 80% de los pasajes de 200 tokens, y baja a 66% si se reemplaza el 10% de las palabras por sinónimos. Que no haya marca no prueba que lo escribió una persona. OpenAI · TechCrunch · Tech Startups
OpenAI metió publicidad visual dentro de ChatGPT, y arranca por la generación de imágenes (05/10). El formato aparece al costado de los resultados mientras el modelo genera, que es el momento de espera más largo del producto y por eso el primer lugar donde lo probaron. Es el paso siguiente del movimiento publicitario que viene armando: ya no es un anuncio de texto en una respuesta, es inventario visual al lado de una imagen que el usuario pidió. TechCrunch · BleepingComputer
Hardware y Robótica
Nvidia volvió a su máximo histórico y quedó a un paso de los 6 billones de dólares de valor de mercado (06/10). Es el primer récord desde el verano boreal y llega en la semana en que la compañía aparece en la agenda de la nueva estructura federal de IA. El número en sí dice menos que la mecánica: la demanda de aceleradores sigue adelantada a la oferta, y cada señal de compromiso de capacidad para 2027 mueve la acción más que los resultados del trimestre. Bloomberg · Seoul Economic Daily
AMD adelantó benchmarks de Gorgon Halo antes del lanzamiento esperado del RTX Spark, y dice que ya despachó más de medio millón de “PCs agénticas” (05/10). El Ryzen AI Max+ Pro 495 llega a 192 GB de memoria unificada contra los 128 GB del RTX Spark, y por lo demás es un Strix Halo con 100 MHz más de boost: mismos núcleos, misma microarquitectura. Las cifras que publicó son de ComfyUI contra el Core Ultra X9 388H de Intel, de 1,1x a 32,2x, y AMD misma reconoce que el número de arriba parece anómalo; comparó contra Intel y no contra el Spark porque todavía no hay datos. Lo que sirve para decidir son los tokens por segundo: hasta 20 con GLM 5.3 Flash de 320.000 millones de parámetros y hasta 42 con Qwen3.8 Flash Next de 125.000 millones, los dos cuantizados. Las primeras máquinas arrancan cerca de los 7.000 dólares en las configuraciones de arriba. Tom’s Hardware
Investigan el datacenter de Google en Finlandia por talar más de 300 hectáreas de bosque antes de la evaluación de impacto ambiental obligatoria (05/10). Son unas 420 canchas de fútbol en Muhos, un pueblo de menos de 9.000 habitantes al norte del país, dentro de una inversión de 13.000 millones de euros en dos años que incluye además Kajaani y Vaala. Hanna Halmeenpää, que preside la Asociación Finlandesa de Conservación de la Naturaleza, le pidió a la agencia de conservación que suspenda la obra. Tuike Finland, el operador local de Google, niega la falta y sostiene que la tala cumplió con la Ley Forestal y que protegieron las zonas de alto valor natural dentro del predio. Es el mismo choque que le costó a Amazon 68.000 millones en proyectos bloqueados, pero con el regulador ambiental en el medio. Tom’s Hardware
Robótica: Panasonic apunta a producir humanoides en 2029 y pone la seguridad de la batería como su ventaja (05/10). Lo anunció Akira Sakakibara, su Chief AI Officer, y lo va a llevar una división nueva de I+D de IA y robótica que abrió el 1 de octubre; el objetivo inicial son líneas de producción y depósitos. El argumento competitivo es que las baterías de Panasonic Energy no estuvieron involucradas en ningún incendio grave, algo que para un fierro de 60 kilos caminando entre gente no es un detalle. Sakakibara admitió a Nikkei Asia que todavía no hay nada que mostrar. En la misma semana Kawasaki puso el despliegue comercial de su Kaleido alrededor de 2030, con la autonomía creciendo por etapas: la ventana japonesa de los humanoides se está corriendo al final de la década. Humanoids Daily · Kawasaki vía Humanoids Daily
Robótica: Agility hizo su día de analistas e inversores con Digit 5 y el plan de escala, camino a cotizar por una fusión de 2.500 millones de dólares (06/10). El webcast arrancó a las 12:30 ET en Nueva York, con la CEO Peggy Johnson y el cofundador Jonathan Hurst, más los responsables de negocio, operaciones y finanzas. La operación es la fusión propuesta con Churchill Capital Corp XI, valuada en 2.500 millones y con el ticker AGLT. Las tres preguntas que importan no son de producto: cuán rápido amplían los clientes sus despliegues, qué limita el crecimiento de la fabricación, y cuánto soporte humano necesita cada instalación. Humanoids Daily
Ciberseguridad
Dinamarca: alguien usó la cuenta legítima de una empresa privada para barrer el registro civil y se llevó nombre, dirección y número CPR de 8,8 millones de personas (05-06/10). Son cuatro de cada cinco de las 11 millones de entradas del CPR, e incluye residentes, gente que se mudó al exterior y personas fallecidas; quedaron afuera los que tienen protección de nombre y dirección. El método fueron búsquedas automatizadas para adivinar números CPR válidos, durante unos diez días de septiembre, y lo notó una empleada el viernes 2 de octubre. La ministra Christina Egelund admitió que las salvaguardas alrededor de ese tipo de acceso “no eran lo bastante sólidas” y que con esa duración algo tendría que haber sonado. No dijeron qué empresa es, le cortaron el acceso, lo reportaron a Datatilsynet y hay investigación policial. The Hacker News · TechCrunch
Atlassian: un path traversal de 9,3 sin autenticar deja leer archivos en ocho productos Data Center a la vez (05-06/10). El CVE-2026-21589 vive en el directorio raíz de la aplicación web y afecta Bitbucket, Confluence, Jira Software, Jira Service Management, Bamboo, Crowd, Crucible y Fisheye. La limitación práctica es que hay que saber la ruta y el nombre exactos del archivo, porque no se pueden listar directorios: sirve para configuraciones y secretos en lugares conocidos, no para explorar. Atlassian sacó versiones parchadas de los ocho el 6 de octubre, la nube ya estaba cubierta, y dice que no encontró evidencia de explotación ahí; sobre las instalaciones propias no se pronunció. The Hacker News
El FBI echó al contratista de Accenture que no aplicó el parche por el que ShinyHunters entró a su portal de empleo (06/10). Sigue de la detención de “Rey” en Jordania: ahora se sabe cómo entraron. El sistema era Oracle PeopleSoft, puntualmente el endpoint PSEMHUB del Environment Management Hub, y el grupo explotó el CVE-2026-35273 con un truco de codificación de URL para pasar por arriba del WAF. El director asistente Brett Leatherman dijo que el incidente fue consecuencia de que un contratista no implementara un parche de seguridad que se había emitido justamente para asegurar la plataforma, y se llevaron datos personales de miles de empleados del FBI. Van dos arrestos del grupo y esperan más. The Hacker News
ClickFix ahora precachea el payload disfrazado de PNG para saltar el límite de caracteres del cuadro Ejecutar de Windows (06/10). Lo documentó Microsoft Threat Intelligence: el sitio malicioso deja un VBScript en la caché del navegador haciéndolo pasar por imagen, y cuando la víctima pega el comando en Ejecutar —que corta cerca de los 260 caracteres— el script ya está en disco y no hay descarga remota que bloquear. Después cmd.exe busca en las carpetas de perfil del navegador las entradas de caché que coinciden con el patrón de nombre, las copia a %LOCALAPPDATA%\Temp\t.vbs y desde ahí siguen las etapas de PowerShell que roban credenciales e información del sistema. Identificaron más de 3.000 sitios comprometidos sirviendo las páginas falsas. El control que sirve es el egreso: si no hay descarga, hay que mirar la ejecución. The Hacker News
De 15.465 servidores MCP públicos indexados en cinco registros, hay dominios caídos que cualquiera puede re-registrar por 4 dólares al año (06/10). El relevamiento es de OX Security y deduplica a 5.095 hostnames únicos. El 15,6% resuelve fuera de Estados Unidos, con 19 servidores en China y 18 en Rusia; el 0,45% enruta por túneles de consumo tipo ngrok-free, o sea que corre en la máquina personal de alguien; y el 2,3% son dominios colgados que ya no resuelven, de los cuales seis están libres y se compran por entre 4 y 12 dólares anuales. El punto estructural es peor que la lista: un servidor MCP remoto puede ejecutar backend distinto del que muestra su repositorio público, y ningún registro revisa nada antes de publicar. Si tu agente consume MCPs de un registro, el chequeo barato es fijar el host y mirar a quién resuelve. The Hacker News
Técnicas, repos y práctica
llama.cpp v0.6.0 estrena la API llama_batch_ext, soporte de GLM-5.3-Flash de 320B y flash attention por la tensor API de Metal (05/10). La API nueva, con llama_process(), acepta batches mixtos de tokens y embeddings y embeddings de “estado” por token, que es lo que hacía falta para los modelos MTP y deepstack. Suma GLM-5.3-Flash (GLM5-Next), un híbrido de 320.000 millones con texto y visión, el modelo de decisión Clef con texto y visión, y decodificación especulativa MTP para Qwen4Exp. Del lado del rendimiento hay kernel de flash attention por la tensor API de Metal para KV en F16, flash attention disperso para K/V cuantizados en Vulkan, y ggml actualizado a v0.26.0. También rehicieron la Web UI con una capa de datos del Hub de Hugging Face y pipeline de descarga de modelos. GitHub
Repos: rea explotó con 2.963 estrellas en el día — ingeniería inversa con agentes, de la conducta de una app hasta el binario nativo (06/10). El flujo son tres etapas declaradas: decompilar para recuperar código y metadatos legibles, entender para rastrear cómo está implementada una función, y recrear para construir tu propia versión adaptada a tu stack. Funciona como CLI y como servidor MCP, y rutea por un registro de proveedores: Hopper en macOS, Ghidra si lo traés vos —solo lectura en Linux x64, experimental en Windows x64—, utilidades nativas de macOS para Mach-O, firmas y plists, y un proveedor de grafo de artefactos que recorre ZIP, APK, IPA, ASAR y DMG. Observa además por CDP del navegador y por el V8 Inspector de Electron y Node. La parte que vale copiar es el registro Evidence v2: cada hallazgo queda con confianza, proveedor y limitaciones anotadas, que es exactamente lo que falta cuando un agente afirma cosas sobre un binario. Licencia MIT, se instala con npx rea-agents@latest setup y pide Node 22.19+ o 24.11+. GitHub · Trending
Repos: e2e se quedó con el tope del trending por segundo día y aceleró a 1.720 estrellas en el día (06/10). Sigue de cuando cuadruplicó el ritmo ayer: va por 5.634 estrellas totales, 1.733 más que hace 24 horas. La idea no cambió y es la que conviene adoptar en cualquier suite de agentes: describís el objetivo en lenguaje natural, el agente lo ejecuta, y los pasos quedan grabados para que las corridas siguientes los repitan sin llamar al modelo hasta que la app cambie. Tres días de trending sostenido en una herramienta de testing dice que el problema de la factura de tokens en CI es general. GitHub · Trending
Repos: mattpocock/skills sumó 1.028 estrellas en el día con un set de skills de ingeniería que atacan los modos de falla del agente, no sus capacidades (06/10). El criterio declarado es el útil: cada skill apunta a una falla concreta —agente desalineado con lo que querías, verborrágico, con bugs, o degradando la arquitectura—. Las que se invocan a mano son /grill-with-docs para alinear vocabulario del dominio antes de empezar, /triage como máquina de estados para issues, /implement con TDD y revisión adentro, /improve-codebase-architecture para buscar refactors, y /wayfinder para planificar trabajo que no entra en una sesión. Las que llama el modelo solo son /tdd, /diagnosing-bugs, /code-review con dos ejes —estándares y cumplimiento del spec— y /research contra fuentes primarias. Se instala con claude plugins install mattpocock-skills o npx skills@latest add mattpocock/skills, y después /setup-matt-pocock-skills una vez por repo. Licencia MIT. GitHub · Trending
Repos: claude-mem sumó 536 estrellas en el día — contexto persistente entre sesiones, comprimido con IA e inyectado en la siguiente (06/10). Captura lo que el agente hace durante la sesión, lo comprime y vuelve a meter lo relevante en las sesiones que siguen, con soporte declarado para Claude Code, OpenClaw, Codex, Gemini, Hermes, Copilot y OpenCode. Es la misma apuesta que empuja el trending desde varios días: lo que mejora el resultado no es el modelo sino lo que el harness recuerda. Licencia Apache 2.0, y va por 96.905 estrellas totales. GitHub · Trending