Paper Scout.
← Último digest
verificado

code generation agents

8 papers seleccionados por el agente esta mañana

  1. 1

    PerfAgent: Profiler-Guided Iterative Refinement for Repository-Level Code Optimization

    Un agente que usa perfilado para hallar cuellos de botella ocultos y refinar parches que mejoran el rendimiento sin romper el comportamiento a nivel de repositorio.

  2. 2

    TraceDev: A Traceability-Driven Multi-agent Framework for Requirement-to-Code Development

    Marco multiagente que transforma requisitos en lenguaje natural en código de repositorio con trazabilidad explícita para alinear y validar lo generado.

  3. 3

    Towards Reliable C-to-Rust Translation with Rule-Guided Reasoning and Reinforcement Learning

    Combina razonamiento guiado por reglas específicas de Rust y aprendizaje por refuerzo para traducir C heredado a Rust seguro con mayor corrección.

  4. 4

    Multi-Source and Cross-Scenario Strategy-Guided Code Optimization

    Aprovecha estrategias de optimización de múltiples fuentes (commits, libros, web) y las adapta a distintos escenarios para que un LLM genere mejores parches de rendimiento.

  5. 5

    Beyond Fail-to-Pass: Iterative Hardening of Co-Generated Bug Reproduction Tests and Fixes

    Propone endurecer iterativamente los tests de reproducción de bugs y sus parches, superando las limitaciones del criterio fail-to-pass en reparación automática.

  6. 6

    Context Matters: Improving the Practical Reliability of LLM-Based Unit Test Generation

    Presenta CATGen, un flujo consciente del contexto que reduce tests que no compilan y estabiliza la cobertura en proyectos industriales reales.

  7. 7

    EvoDRC: A Self-Evolving Agentic Framework for Automated DRC Violation Repair

    Agente que evoluciona habilidades por capa para reparar violaciones de reglas de diseño en physical design, preservando la conectividad del circuito.

  8. 8

    SciCodePile: A 128GB Corpus and Executable Benchmark for Challenging Scientific Code Generation

    Ofrece el mayor corpus de código científico y un benchmark ejecutable para medir la brecha real de los LLMs en generación de código científico.