Skip to main content
PREreviews
-
Evgenii Arsentev reviewed When Does a Second Model Help? Cross-Model Review in LLM Verification
- Information Systems and Management
- Information Systems
- Artificial Intelligence
- Review published
- Preprint server
- arXiv
-
Evgenii Arsentev reviewed AutoCompact: Learning When to Compact Context in Long-Horizon Coding Agents
- Review published
- Preprint server
- arXiv
-
Evgenii Arsentev reviewed Can Terminal Agents Trust Their Own Verification? Diagnosing and Improving Self-Verification
- Review published
- Preprint server
- arXiv
-
Evgenii Arsentev reviewed FOCUS: Training-Free Decision-Preserving Context Compression for LLM Agents
- Review published
- Preprint server
- arXiv
-
Evgenii Arsentev reviewed TokenCast: Forecasting Token Consumption During LLM Agent Execution
- Review published
- Preprint server
- arXiv
-
Evgenii Arsentev reviewed Analyzing and Mitigating Cost-Inefficient Behaviors in Coding Agents
- Review published
- Preprint server
- arXiv
-
Evgenii Arsentev reviewed Harness Tokenomics: A Router for the Enterprise Agentic Control Plane
- Review published
- Preprint server
- arXiv
-
Evgenii Arsentev reviewed Total Cost of Agency: Exact Attribution of Memory Injection Cost in Multi-Agent LLM Workflows
- Information Systems and Management
- Artificial Intelligence
- Materials Chemistry
- Review published
- Preprint server
- arXiv
-
Evgenii Arsentev reviewed An Empirical Study of Harness Design for Coding Agents
- Information Systems
- Artificial Intelligence
- Computer Networks and Communications
- Review published
- Preprint server
- arXiv
-
Evgenii Arsentev reviewed Quantifying Overclaiming Propensity in Frontier LLM Agents
- Review published
- Preprint server
- arXiv
-
Evgenii Arsentev reviewed Subagents vs Agent Skills: Executing Reusable Knowledge for Long-Horizon Agentic Tasks
- Artificial Intelligence
- Computer Vision and Pattern Recognition
- Review published
- Preprint server
- arXiv
-
Evgenii Arsentev reviewed Protocol-Preserving Context Trimming for Agentic Workflows: Benefits, Failure Regimes, and Budget Guardrails
- Review published
- Preprint server
- arXiv
-
Evgenii Arsentev reviewed Governed Human-AI Prioritization Under Uncertainty: Adaptive Estimation and Dependency-Constrained Portfolio Selection
- Artificial Intelligence
- Safety Research
- Management Science and Operations Research
- Review published
- Preprint server
- arXiv
-
Evgenii Arsentev reviewed The widening evaluation gap in medical large language model research 2023 to 2026
- Review published
- Preprint server
- arXiv
-
Evgenii Arsentev reviewed Reproducibility in the Age of Agentic AI: Context Engineering at the Timescale of a Codebase
- Review published
- Preprint server
- arXiv