Evgenii Arsentev revisó When Does a Second Model Help? Cross-Model Review in LLM Verification Sistemas de Información y GestiónSistemas de InformaciónInteligencia Artificial Revisión publicada 4 de octubre de 2026 Servidor de preprint arXiv
Evgenii Arsentev revisó AutoCompact: Learning When to Compact Context in Long-Horizon Coding Agents Revisión publicada 2 de octubre de 2026 Servidor de preprint arXiv
Evgenii Arsentev revisó Can Terminal Agents Trust Their Own Verification? Diagnosing and Improving Self-Verification Revisión publicada 1 de octubre de 2026 Servidor de preprint arXiv
Evgenii Arsentev revisó FOCUS: Training-Free Decision-Preserving Context Compression for LLM Agents Revisión publicada 30 de septiembre de 2026 Servidor de preprint arXiv
Evgenii Arsentev revisó TokenCast: Forecasting Token Consumption During LLM Agent Execution Revisión publicada 29 de septiembre de 2026 Servidor de preprint arXiv
Evgenii Arsentev revisó Analyzing and Mitigating Cost-Inefficient Behaviors in Coding Agents Revisión publicada 28 de septiembre de 2026 Servidor de preprint arXiv
Evgenii Arsentev revisó Harness Tokenomics: A Router for the Enterprise Agentic Control Plane Revisión publicada 26 de septiembre de 2026 Servidor de preprint arXiv
Evgenii Arsentev revisó Total Cost of Agency: Exact Attribution of Memory Injection Cost in Multi-Agent LLM Workflows Sistemas de Información y GestiónInteligencia ArtificialQuímica de Materiales Revisión publicada 25 de septiembre de 2026 Servidor de preprint arXiv
Evgenii Arsentev revisó An Empirical Study of Harness Design for Coding Agents Sistemas de InformaciónInteligencia ArtificialRedes y Comunicaciones por Computadora Revisión publicada 21 de septiembre de 2026 Servidor de preprint arXiv
Evgenii Arsentev revisó Quantifying Overclaiming Propensity in Frontier LLM Agents Revisión publicada 18 de septiembre de 2026 Servidor de preprint arXiv
Evgenii Arsentev revisó Subagents vs Agent Skills: Executing Reusable Knowledge for Long-Horizon Agentic Tasks Inteligencia ArtificialVisión por Computadora y Reconocimiento de Patrones Revisión publicada 17 de septiembre de 2026 Servidor de preprint arXiv
Evgenii Arsentev revisó Protocol-Preserving Context Trimming for Agentic Workflows: Benefits, Failure Regimes, and Budget Guardrails Revisión publicada 16 de septiembre de 2026 Servidor de preprint arXiv
Evgenii Arsentev revisó Governed Human-AI Prioritization Under Uncertainty: Adaptive Estimation and Dependency-Constrained Portfolio Selection Inteligencia ArtificialInvestigación sobre SeguridadCiencia de la Gestión e Investigación de Operaciones Revisión publicada 14 de septiembre de 2026 Servidor de preprint arXiv
Evgenii Arsentev revisó The widening evaluation gap in medical large language model research 2023 to 2026 Revisión publicada 13 de septiembre de 2026 Servidor de preprint arXiv
Evgenii Arsentev revisó Reproducibility in the Age of Agentic AI: Context Engineering at the Timescale of a Codebase Revisión publicada 12 de septiembre de 2026 Servidor de preprint arXiv