Aller directement aux détails du preprintAller directement aux PREreviews

PREreviews de Evaluating Human-AI Safety: A Framework for Measuring Harmful Capability Uplift

1 PREreview

  1. PREreview par Mattia Gaggi

    Summary

    This position paper proposes a shift in AI safety evaluation from static benchmarks to "Harmful Capability Uplift" a metric quantifying the marginal advantage a user gains from AI assistance. The authors advocate for rigorous three-condition human-subjects experiments (Human-alone,…

    Lire la PREreview de Mattia Gaggi