El Compilado Hilos Temas Archivo RSS

Hilos · 3 noticias en 18 días

prime-agent (Prime Intellect) es de lo más caliente de GitHub trending hoy

Noticias
3
Briefings
3
Empieza
Última
  1. Técnicas y repos

    prime-agent (Prime Intellect) es de lo más caliente de GitHub trending hoy

    Agente open source (MIT) de coding e investigación para tareas largas, construido sobre dos ideas: un Recursive Language Model que trata el contexto como variables y a los subagentes como llamadas a función dentro de un REPL de IPython persistente, y un "continual harness" que persiste memorias, skills y specs de subagentes como estado durable que el agente refina con updates chicos respaldados por evidencia. La v0.7.0 salió el 5-ago y el repo está en el top del trending de esta mañana (GitHub, OSSInsight). Si estás armando agentes long-running, vale la pena mirar el diseño del harness.

    GitHub OSSInsight GitHub

  2. Técnicas y repos

    Prime Agent (PrimeIntellect): agente RLM auto-mejorable para tareas largas

    (trending hoy). Open source (MIT), implementa el modelo Recursive Language Model: el contexto se trata como variables y los subagentes como llamadas a función dentro de un REPL de Python persistente. Lo distintivo es el "Continual Harness": con /refine el agente aplica mejoras pequeñas y con evidencia a sus prompts, memorias y skills, con rollback. Corre en daemon para trabajo de fondo y comunicación agente-a-agente. GitHub

    GitHub GitHub

  3. Técnicas y repos

    Prime Agent sube el Best@1 de ARC-AGI-3 RHAE de 30% a 95,5% sin tocar el modelo, y el código está publicado

    Prime Intellect liberó un harness open source para evaluación de horizonte largo y flujos de agentes de código, con tres piezas que valen por separado. Un REPL de IPython persistente que sigue la abstracción de Recursive Language Model, o sea que el procesamiento de contexto y el cómputo en tiempo de test se hacen programáticamente en vez de todo dentro de la ventana. Un "Continual Harness" que preserva historiales, memorias, skills, prompts y especificaciones de subagentes entre trayectorias. Y subagentes recursivos que se coordinan por comunicación directa agente a agente, con una vista para que un humano inspeccione y maneje sesiones respaldadas por demonios. La tesis del paper es la que conviene retener aunque no lo uses: el harness estandariza ejecución, recuperación, verificación y contabilidad de recursos, y deja la estrategia al modelo, para que los fallos del andamiaje dejen de contarse como fallos del modelo. Empata o supera a harnesses nativos y populares en código de contexto largo, generación de kernels de GPU, construcción de emuladores y speedruns autónomos de nanoGPT. arXiv 2608.23552 · GitHub

    arXiv 2608.23552 GitHub GitHub

El hilo se arma solo en cada build: junta noticias de días distintos que nombran a la misma entidad y repiten vocabulario que casi no aparece en el resto del archivo. Nadie lo edita a mano, así que puede dejar afuera una noticia o sumar una de al lado.