Evaluating language models as risk scores
Fuente:
arXiv
Salvato in:
| Autori principali: | Cruz, André F., Hardt, Moritz, Mendler-Dünner, Celestine |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Performative Prediction: Past and Future
di: Hardt, Moritz, et al.
Pubblicazione: (2023)
di: Hardt, Moritz, et al.
Pubblicazione: (2023)
Questioning the Survey Responses of Large Language Models
di: Dominguez-Olmedo, Ricardo, et al.
Pubblicazione: (2023)
di: Dominguez-Olmedo, Ricardo, et al.
Pubblicazione: (2023)
Algorithmic Collective Action in Machine Learning
di: Hardt, Moritz, et al.
Pubblicazione: (2023)
di: Hardt, Moritz, et al.
Pubblicazione: (2023)
Decline Now: A Combinatorial Model for Algorithmic Collective Action
di: Sigg, Dorothee, et al.
Pubblicazione: (2024)
di: Sigg, Dorothee, et al.
Pubblicazione: (2024)
An engine not a camera: Measuring performative power of online search
di: Mendler-Dünner, Celestine, et al.
Pubblicazione: (2024)
di: Mendler-Dünner, Celestine, et al.
Pubblicazione: (2024)
Look-Ahead Reasoning on Learning Platforms
di: Zhu, Haiqing, et al.
Pubblicazione: (2025)
di: Zhu, Haiqing, et al.
Pubblicazione: (2025)
Algorithmic Collective Action in Recommender Systems: Promoting Songs by Reordering Playlists
di: Baumann, Joachim, et al.
Pubblicazione: (2024)
di: Baumann, Joachim, et al.
Pubblicazione: (2024)
Performative Validity of Recourse Explanations
di: König, Gunnar, et al.
Pubblicazione: (2025)
di: König, Gunnar, et al.
Pubblicazione: (2025)
Test-Time Training on Nearest Neighbors for Large Language Models
di: Hardt, Moritz, et al.
Pubblicazione: (2023)
di: Hardt, Moritz, et al.
Pubblicazione: (2023)
Unprocessing Seven Years of Algorithmic Fairness
di: Cruz, André F., et al.
Pubblicazione: (2023)
di: Cruz, André F., et al.
Pubblicazione: (2023)
Training on the Test Task Confounds Evaluation and Emergence
di: Dominguez-Olmedo, Ricardo, et al.
Pubblicazione: (2024)
di: Dominguez-Olmedo, Ricardo, et al.
Pubblicazione: (2024)
Stochastic wage suppression on gig platforms and how to organize against it
di: Stoica, Ana-Andreea, et al.
Pubblicazione: (2026)
di: Stoica, Ana-Andreea, et al.
Pubblicazione: (2026)
Limits to Predicting Online Speech Using Large Language Models
di: Remeli, Mina, et al.
Pubblicazione: (2024)
di: Remeli, Mina, et al.
Pubblicazione: (2024)
Answer Matching Outperforms Multiple Choice for Language Model Evaluation
di: Chandak, Nikhil, et al.
Pubblicazione: (2025)
di: Chandak, Nikhil, et al.
Pubblicazione: (2025)
B-score: Detecting biases in large language models using response history
di: Vo, An, et al.
Pubblicazione: (2025)
di: Vo, An, et al.
Pubblicazione: (2025)
Scaling Open-Ended Reasoning to Predict the Future
di: Chandak, Nikhil, et al.
Pubblicazione: (2025)
di: Chandak, Nikhil, et al.
Pubblicazione: (2025)
Adjusting Pretrained Backbones for Performativity
di: Demirel, Berker, et al.
Pubblicazione: (2024)
di: Demirel, Berker, et al.
Pubblicazione: (2024)
FutureSim: Replaying World Events to Evaluate Adaptive Agents
di: Goel, Shashwat, et al.
Pubblicazione: (2026)
di: Goel, Shashwat, et al.
Pubblicazione: (2026)
Estimating near-verbatim extraction risk in language models with decoding-constrained beam search
di: Cooper, A. Feder, et al.
Pubblicazione: (2026)
di: Cooper, A. Feder, et al.
Pubblicazione: (2026)
Scaling behavior of large language models in emotional safety classification across sizes and tasks
di: Pinzuti, Edoardo, et al.
Pubblicazione: (2025)
di: Pinzuti, Edoardo, et al.
Pubblicazione: (2025)
ImageNot: A contrast with ImageNet preserves model rankings
di: Salaudeen, Olawale, et al.
Pubblicazione: (2024)
di: Salaudeen, Olawale, et al.
Pubblicazione: (2024)
Aligning language models with human preferences
di: Korbak, Tomasz
Pubblicazione: (2024)
di: Korbak, Tomasz
Pubblicazione: (2024)
The opportunities and risks of large language models in mental health
di: Lawrence, Hannah R., et al.
Pubblicazione: (2024)
di: Lawrence, Hannah R., et al.
Pubblicazione: (2024)
Good Allocations from Bad Estimates
di: Casacuberta, Sílvia, et al.
Pubblicazione: (2026)
di: Casacuberta, Sílvia, et al.
Pubblicazione: (2026)
Amortizing intractable inference in large language models
di: Hu, Edward J., et al.
Pubblicazione: (2023)
di: Hu, Edward J., et al.
Pubblicazione: (2023)
Cross-modal linkage risk in clinical vision-language models
di: Arasteh, Soroosh Tayebi, et al.
Pubblicazione: (2026)
di: Arasteh, Soroosh Tayebi, et al.
Pubblicazione: (2026)
Do language models plan ahead for future tokens?
di: Wu, Wilson, et al.
Pubblicazione: (2024)
di: Wu, Wilson, et al.
Pubblicazione: (2024)
Perturbed examples reveal invariances shared by language models
di: Rawal, Ruchit, et al.
Pubblicazione: (2023)
di: Rawal, Ruchit, et al.
Pubblicazione: (2023)
A mean teacher algorithm for unlearning of language models
di: Klochkov, Yegor
Pubblicazione: (2025)
di: Klochkov, Yegor
Pubblicazione: (2025)
Visualizing token importance for black-box language models
di: Rauba, Paulius, et al.
Pubblicazione: (2025)
di: Rauba, Paulius, et al.
Pubblicazione: (2025)
Reaching a Consensus in Predictive Loops
di: Wu, Jiduan, et al.
Pubblicazione: (2026)
di: Wu, Jiduan, et al.
Pubblicazione: (2026)
BabySLM: language-acquisition-friendly benchmark of self-supervised spoken language models
di: Lavechin, Marvin, et al.
Pubblicazione: (2023)
di: Lavechin, Marvin, et al.
Pubblicazione: (2023)
The language of time: a language model perspective on time-series foundation models
di: Xie, Yi, et al.
Pubblicazione: (2025)
di: Xie, Yi, et al.
Pubblicazione: (2025)
Prompt reinforcing for long-term planning of large language models
di: Lin, Hsien-Chin, et al.
Pubblicazione: (2025)
di: Lin, Hsien-Chin, et al.
Pubblicazione: (2025)
Machine-generated text detection prevents language model collapse
di: Drayson, George, et al.
Pubblicazione: (2025)
di: Drayson, George, et al.
Pubblicazione: (2025)
What Makes ImageNet Look Unlike LAION
di: Shirali, Ali, et al.
Pubblicazione: (2023)
di: Shirali, Ali, et al.
Pubblicazione: (2023)
Mixture-of-Depths: Dynamically allocating compute in transformer-based language models
di: Raposo, David, et al.
Pubblicazione: (2024)
di: Raposo, David, et al.
Pubblicazione: (2024)
Anchor function: a type of benchmark functions for studying language models
di: Zhang, Zhongwang, et al.
Pubblicazione: (2024)
di: Zhang, Zhongwang, et al.
Pubblicazione: (2024)
Simple linear attention language models balance the recall-throughput tradeoff
di: Arora, Simran, et al.
Pubblicazione: (2024)
di: Arora, Simran, et al.
Pubblicazione: (2024)
Just read twice: closing the recall gap for recurrent language models
di: Arora, Simran, et al.
Pubblicazione: (2024)
di: Arora, Simran, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Performative Prediction: Past and Future
di: Hardt, Moritz, et al.
Pubblicazione: (2023) -
Questioning the Survey Responses of Large Language Models
di: Dominguez-Olmedo, Ricardo, et al.
Pubblicazione: (2023) -
Algorithmic Collective Action in Machine Learning
di: Hardt, Moritz, et al.
Pubblicazione: (2023) -
Decline Now: A Combinatorial Model for Algorithmic Collective Action
di: Sigg, Dorothee, et al.
Pubblicazione: (2024) -
An engine not a camera: Measuring performative power of online search
di: Mendler-Dünner, Celestine, et al.
Pubblicazione: (2024)