El Compilado Hilos Temas Archivo RSS

Hilos · 6 noticias en 8 días

Alibaba liberó el revisor de código que usa internamente, y el aporte grande no es la herramienta sino el argumento de arquitectura que trae con benchmark propio (13-14/09)

Noticias
6
Briefings
6
Empieza
Última
  1. Técnicas y repos

    Alibaba liberó el revisor de código que usa internamente, y el aporte grande no es la herramienta sino el argumento de arquitectura que trae con benchmark propio (13-14/09)

    Open Code Review venía siendo el asistente oficial de revisión de código de Alibaba Group: dos años de uso, decenas de miles de desarrolladores, millones de defectos encontrados. Ahora salió como CLI en Go bajo Apache-2.0, compatible con endpoints de OpenAI y Anthropic, y trepó a lo más alto de tendencias con 443 estrellas en un día sobre 22.300 acumuladas. El diagnóstico que hacen sobre los agentes de propósito general es el que le sirve a cualquiera que arme un flujo así: en changesets grandes el agente "corta camino" y revisa solo algunos archivos; los issues reportados no coinciden con la ubicación real del código porque las líneas se corren; y la calidad oscila fuerte ante variaciones menores del prompt. Su respuesta es un híbrido: lo que no puede fallar lo resuelve ingeniería determinista —selección de archivos, agrupamiento de archivos relacionados en una misma unidad de revisión que corre como subagente con contexto aislado, matching de reglas por características del archivo con motor de plantillas, y módulos externos de posicionamiento y reflexión de comentarios—, y le deja al agente solo la decisión dinámica y la búsqueda de contexto. El número que respalda el diseño sale de AACR-Bench, un benchmark de 50 repos populares, 200 pull requests reales, 10 lenguajes y 1.505 issues anotados y validados por más de 80 ingenieros senior: contra Claude Code con el mismo modelo de base, mejor precisión y F1 consumiendo alrededor de un noveno de los tokens, con menor recall como concesión deliberada a favor de menos ruido. GitHub · Hugging Face · Open Code Review

    GitHub Hugging Face Open Code Review OpenAI Anthropic Alibaba Hugging Face GitHub Claude Claude Code

  2. Técnicas y repos

    El revisor de código de Alibaba no fue un pico de un día: hoy volvió a ser el repo número uno con 2.751 estrellas más (15/09)

    Sigue de ayer, cuando Open Code Review apareció en tendencias con 443 estrellas en el día: en veinticuatro horas sextuplicó ese ritmo y pasó de unas 22.300 estrellas acumuladas a 27.311. El dato importa porque separa una novedad de un adopción real: lo que se está llevando la gente no es la herramienta sino el argumento de arquitectura que trae —resolver con ingeniería determinista todo lo que no puede fallar (selección y agrupamiento de archivos, matching de reglas, posicionamiento de comentarios) y dejarle al agente solo la decisión dinámica—, respaldado por AACR-Bench y por un consumo de alrededor de un noveno de los tokens contra un agente de propósito general. GitHub · Open Code Review

    GitHub Open Code Review Alibaba GitHub

  3. Técnicas y repos

    El revisor de código de Alibaba lleva tres días al tope y hoy sumó 3.215 estrellas, su mejor día (16/09)

    Sigue de ayer, cuando Open Code Review ya había sextuplicado su ritmo: de 443 estrellas diarias pasó a 2.751 y ahora a 3.215, con 30.485 acumuladas. Tres días de aceleración seguida descartan el pico de novedad. Lo nuevo que aporta el repo cuando uno lo abre es la honestidad del benchmark: contra un agente de propósito general con el mismo modelo, Open Code Review gana en precisión y F1 consumiendo alrededor de un noveno de los tokens, pero pierde en recall, y lo declara como una decisión deliberada a favor de menos ruido. AACR-Bench, el dataset con el que lo mide, está construido sobre 50 repos populares, 200 pull requests reales, 10 lenguajes y 1.505 issues anotadas y validadas de forma cruzada por más de 80 ingenieros senior, y está publicado en Hugging Face. GitHub · Open Code Review

    GitHub Open Code Review Alibaba Hugging Face GitHub

  4. Técnicas y repos

    El revisor de código de Alibaba lleva cuatro días en tendencias y sumó 3.290 estrellas más (17/09)

    Sigue de ayer: Open Code Review pasó de 30.485 a 33.709 estrellas acumuladas, con 2.402 forks, y mantiene un ritmo diario prácticamente idéntico al de ayer (3.215). Cuatro días de meseta alta, no de pico. El argumento que lo sostiene sigue siendo el de arquitectura híbrida —pipelines deterministas más agente LLM, con comentarios a nivel de línea y un ruleset multilenguaje propio para NPE, seguridad de hilos, XSS e inyección SQL—, y el benchmark honesto: gana en precisión y F1 contra un agente de propósito general con el mismo modelo usando cerca de un noveno de los tokens, y pierde en recall a propósito, para hacer menos ruido. GitHub · Open Code Review

    GitHub Open Code Review Alibaba GitHub

  5. Técnicas y repos

    ECC llegó al tope de tendencias: 263.000 estrellas y un sistema de plan-test-implement-review-verify-remember-improve instalable de una (20/09)

    263.300 acumuladas, 39.401 forks, 1.012 en el día, licencia MIT. La propuesta es instalar una vez el proceso de ingeniería en vez de reconstruirlo en cada prompt: 68 agentes especializados en planificación, revisión, reparación de builds, seguridad y arquitectura, 292 skills, 94 shims de comandos legacy, más hooks, reglas, memoria y AgentShield, su escáner de seguridad. La frase que resume el diseño es "optimizá la ventana de contexto, persistí todo lo demás". Funciona mejor con Claude Code, tiene camino de sincronización soportado para Codex y adaptadores con capacidades limitadas para Cursor, OpenCode, Gemini, Zed, Copilot, Qwen y otros; conviene mirar la matriz de soporte antes de asumir paridad. Se instala con npx ecc-universal@2.2.2 setup o con /plugin install ecc@ecc adentro de Claude Code, y el propio repo advierte contra apilar métodos de instalación en la misma herramienta. GitHub

    GitHub GitHub Claude Gemini Qwen Claude Code GitHub Copilot

  6. Técnicas y repos

    Alibaba abrió open-code-review y se puso primero en las tendencias de GitHub el mismo día (21/09)

    34.836 estrellas acumuladas, 2.475 forks y 3.286 en el día, escrito en Go. La propuesta es una arquitectura híbrida para revisión de código: pipelines deterministas para lo que se puede verificar con reglas, más un agente LLM para lo que no, con comentarios precisos a nivel de línea. Trae un conjunto de reglas multi-lenguaje integrado que cubre desreferencias nulas, seguridad de hilos, XSS e inyección SQL, y es compatible con las APIs de OpenAI y Anthropic. La empresa lo presenta como probado en batalla a la escala de Alibaba, que es el argumento que este tipo de herramientas suele no poder hacer. GitHub

    GitHub OpenAI Anthropic Alibaba GitHub

El hilo se arma solo en cada build: junta noticias de días distintos que nombran a la misma entidad y repiten vocabulario que casi no aparece en el resto del archivo. Nadie lo edita a mano, así que puede dejar afuera una noticia o sumar una de al lado.