-
Alibaba DAMO publicó RynnValue, un reward model para robots sin labels de preferencia
Usa distancia temporal como señal de supervisión en vez de preferencias humanas, lo que le permitió escalar a 7.000+ horas y ~3M de clips condicionados por instrucción. Convertido en rewards densos, sube el éxito de políticas reales de 52,5% a 72,5% online — un camino más barato para entrenar manipulación robótica. Paper (HF)
-
Seguimiento: los pesos abiertos de Qwen3.8-Max siguen sin aparecer
Alibaba prometió el 3-ago que liberaría los pesos de Qwen3.8-Max y Qwen3.8-27B "la semana siguiente", pero al cierre de esta edición no hay repo en el Hugging Face oficial ni licencia publicada (Testing Catalog). Si cumplen, cae en los próximos días — sería el open-weights más importante del mes.
-
Guerra de precios con Qwen3.8-Max y DeepSeek V4 Flash
Alibaba presentó Qwen3.8-Max —su modelo más capaz, con planes de liberar los pesos, revirtiendo su giro propietario— a US$2/US$6 por millón de tokens (input/output), frente a US$10/US$50 de Fable 5. DeepSeek, por su parte, empuja V4 Flash como modelo de coding que se acerca a gama alta a costo de commodity. La cadencia de releases y los recortes de precio (GPT-5.6 Luna, Gemini Flash, Muse Spark) confirman que los modelos se envían "como parches de software". (llm-stats, MarkTechPost)
-
OpenAI baja precios de GPT-5.6 y estrena "Fast mode" en la API
El 4 de agosto recortó los precios de GPT-5.6 Luna y Terra y lanzó un modo rápido para GPT-5.6 Sol en la API, además de ampliar el acceso enterprise en ChatGPT Work, Codex y la API. Accionable: si tenés pipelines sobre estos modelos, conviene rehacer el cálculo de costos y probar Fast mode donde la latencia manda. Releasebot — OpenAI updates --- Fuentes verificadas por búsqueda web el 2026-08-05. Nota: Qwen3.8-Max (Alibaba, 2.4T parámetros MoE) se lanzó el 3 de agosto — fuera de la ventana de 24h — con open weights prometidos para esta semana; vale la pena seguirlo.
-
Alibaba lanzó Qwen3.8-Max, su modelo más grande hasta ahora
MoE de 2.4 billones (trillions) de parámetros totales con solo 95B activos por token, contexto de 1M, multimodal nativo, disponible ya por API ($2/$6 por millón de tokens) y con open weights prometidos para la semana próxima. En pruebas internas completó un proyecto de software autónomo de 16 días y compite con Anthropic y Kimi K3 en coding y tareas de horizonte largo. TechStartups
-
CVE-2026-16723: 0-day en Fastjson 1.x sin parche, explotado contra empresas de EE.UU. (29 jul)
RCE sin autenticación (CVSS 9.0) en la librería de Alibaba, todavía embebida en muchos stacks Java/Spring Boot. No requiere reactivar AutoType ni gadget previo, y como Fastjson 1.x está end-of-life no habrá parche: hay que activar SafeMode o migrar a Fastjson2. Ataques activos desde el 22/7 contra finanzas, salud y retail, concentrados en EE.UU. The Hacker News · BleepingComputer
-
XRING: un bug sin parche en XQUIC tumba servidores HTTP/3 con 260 bytes
El investigador Sébastien Féry (FoxIO) divulgó el 8 de julio una falla en XQUIC, la librería QUIC/HTTP/3 de Alibaba: una sola variable equivocada permite que cualquier cliente remoto crashee el proceso del servidor con ~260 bytes de tráfico QPACK perfectamente legal. Sin login, sin paquetes malformados, sin parche y sin CVE al 10 de julio. Afecta a todas las versiones hasta la v1.9.4, incluido Tengine (el Nginx de Alibaba que fronteaba su cloud y CDN en sitios como Taobao y Alipay). Mitigación: poner SETTINGS_QPACK_MAX_TABLE_CAPACITY en 0 o desactivar HTTP/3. En la misma semana, Binarly reportó seis fallas nuevas en U-Boot, dos de ellas explotables para correr código antes de que el dispositivo verifique la firma del software. XRING / XQUIC · U-Boot
-
Anthropic acusa a Alibaba de la mayor "destilación" ilícita de Claude
En una carta del 10 de junio al Comité Bancario del Senado de EE.UU., Anthropic afirma que operadores vinculados a Alibaba y su laboratorio Qwen usaron ~25.000 cuentas fraudulentas para generar 28,8 millones de intercambios con Claude entre el 22/4 y el 5/6, apuntando a sus capacidades más valiosas (desarrollo de software, razonamiento multipaso y tareas agénticas). Importa porque expone la tensión geopolítica y competitiva alrededor de la "destilación" de modelos frontera, y porque Anthropic ya había hecho acusaciones similares contra DeepSeek, Moonshot y MiniMax. Tom's Hardware · InfoWorld
Tom's Hardware InfoWorld Anthropic DeepSeek Moonshot AI Claude Qwen
-
Anthropic acusa a Alibaba del mayor ataque de destilación contra Claude
En una carta a senadores y funcionarios de la Casa Blanca, Anthropic acusó al lab Qwen de Alibaba de usar ~25.000 cuentas fraudulentas para realizar 28,8 millones de interacciones con Claude entre el 22 de abril y el 5 de junio, apuntando específicamente a sus capacidades de ingeniería de software y razonamiento agéntico. La destilación consiste en consultar masivamente un modelo frontera para entrenar un rival más barato que aproxime sus capacidades. Importa por la escalada geopolítica y porque la campaña habría ocurrido tras advertencias explícitas de la administración. The Next Web · Cybersecurity Insiders