Evgenii Arsentev revisou When Does a Second Model Help? Cross-Model Review in LLM Verification Sistemas de Informação e GestãoSistemas de InformaçãoInteligência Artificial Avaliação publicada 4 de outubro de 2026 Servidor de preprints arXiv
Evgenii Arsentev revisou AutoCompact: Learning When to Compact Context in Long-Horizon Coding Agents Avaliação publicada 2 de outubro de 2026 Servidor de preprints arXiv
Evgenii Arsentev revisou Can Terminal Agents Trust Their Own Verification? Diagnosing and Improving Self-Verification Avaliação publicada 1 de outubro de 2026 Servidor de preprints arXiv
Evgenii Arsentev revisou FOCUS: Training-Free Decision-Preserving Context Compression for LLM Agents Avaliação publicada 30 de setembro de 2026 Servidor de preprints arXiv
Evgenii Arsentev revisou TokenCast: Forecasting Token Consumption During LLM Agent Execution Avaliação publicada 29 de setembro de 2026 Servidor de preprints arXiv
Evgenii Arsentev revisou Analyzing and Mitigating Cost-Inefficient Behaviors in Coding Agents Avaliação publicada 28 de setembro de 2026 Servidor de preprints arXiv
Evgenii Arsentev revisou Harness Tokenomics: A Router for the Enterprise Agentic Control Plane Avaliação publicada 26 de setembro de 2026 Servidor de preprints arXiv
Evgenii Arsentev revisou Total Cost of Agency: Exact Attribution of Memory Injection Cost in Multi-Agent LLM Workflows Sistemas de Informação e GestãoInteligência ArtificialQuímica de Materiais Avaliação publicada 25 de setembro de 2026 Servidor de preprints arXiv
Evgenii Arsentev revisou An Empirical Study of Harness Design for Coding Agents Sistemas de InformaçãoInteligência ArtificialRedes de Computadores e Comunicações Avaliação publicada 21 de setembro de 2026 Servidor de preprints arXiv
Evgenii Arsentev revisou Quantifying Overclaiming Propensity in Frontier LLM Agents Avaliação publicada 18 de setembro de 2026 Servidor de preprints arXiv
Evgenii Arsentev revisou Subagents vs Agent Skills: Executing Reusable Knowledge for Long-Horizon Agentic Tasks Inteligência ArtificialVisão Computacional e Reconhecimento de Padrões Avaliação publicada 17 de setembro de 2026 Servidor de preprints arXiv
Evgenii Arsentev revisou Protocol-Preserving Context Trimming for Agentic Workflows: Benefits, Failure Regimes, and Budget Guardrails Avaliação publicada 16 de setembro de 2026 Servidor de preprints arXiv
Evgenii Arsentev revisou Governed Human-AI Prioritization Under Uncertainty: Adaptive Estimation and Dependency-Constrained Portfolio Selection Inteligência ArtificialPesquisa em SegurançaCiência da Gestão e Pesquisa Operacional Avaliação publicada 14 de setembro de 2026 Servidor de preprints arXiv
Evgenii Arsentev revisou The widening evaluation gap in medical large language model research 2023 to 2026 Avaliação publicada 13 de setembro de 2026 Servidor de preprints arXiv
Evgenii Arsentev revisou Reproducibility in the Age of Agentic AI: Context Engineering at the Timescale of a Codebase Avaliação publicada 12 de setembro de 2026 Servidor de preprints arXiv