SCRuB: Social Concept Reasoning under Rubric-Based Evaluation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Watson-Daniels, Jamelle, Bhattacharjee, Himaghna, Wang, Skyler, Handoko, Brandon, Li, Antonio, Ovalle, Anaelia, Pasupuleti, Mahesh, Ross, Candace, Sarma, Vidya, Subramonian, Arjun, Ullrich, Karen, van der Vaart, Will, Xin, Yijing, Nickel, Maximilian |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Task-Dependent Evaluation of LLM Output Homogenization: A Taxonomy-Guided Framework
par: Jain, Shomik, et autres
Publié: (2025)
par: Jain, Shomik, et autres
Publié: (2025)
Algorithmic Fairness and Color-blind Racism: Navigating the Intersection
par: Watson-Daniels, Jamelle
Publié: (2024)
par: Watson-Daniels, Jamelle
Publié: (2024)
Representative Ranking for Deliberation in the Public Sphere
par: Revel, Manon, et autres
Publié: (2025)
par: Revel, Manon, et autres
Publié: (2025)
Beg to Differ: Understanding Reasoning-Answer Misalignment Across Languages
par: Ovalle, Anaelia, et autres
Publié: (2025)
par: Ovalle, Anaelia, et autres
Publié: (2025)
Survey of Bias In Text-to-Image Generation: Definition, Evaluation, and Mitigation
par: Wan, Yixin, et autres
Publié: (2024)
par: Wan, Yixin, et autres
Publié: (2024)
Weisfeiler and Leman Go Measurement Modeling: Probing the Validity of the WL Test
par: Subramonian, Arjun, et autres
Publié: (2023)
par: Subramonian, Arjun, et autres
Publié: (2023)
auto-fpt: Automating Free Probability Theory Calculations for Machine Learning Theory
par: Subramonian, Arjun, et autres
Publié: (2025)
par: Subramonian, Arjun, et autres
Publié: (2025)
Cross-Modal Projection in Multimodal LLMs Doesn't Really Project Visual Attributes to Textual Space
par: Verma, Gaurav, et autres
Publié: (2024)
par: Verma, Gaurav, et autres
Publié: (2024)
Theoretical and Empirical Insights into the Origins of Degree Bias in Graph Neural Networks
par: Subramonian, Arjun, et autres
Publié: (2024)
par: Subramonian, Arjun, et autres
Publié: (2024)
Networked Inequality: Preferential Attachment Bias in Graph Neural Network Link Prediction
par: Subramonian, Arjun, et autres
Publié: (2023)
par: Subramonian, Arjun, et autres
Publié: (2023)
Rallying for Reflection: Pilot Use of Rubric to Facilitate Self‐Reflection in Dental Education
par: Margarita S. Katser, et autres
Publié: (2025)
par: Margarita S. Katser, et autres
Publié: (2025)
Understanding "Democratization" in NLP and ML Research
par: Subramonian, Arjun, et autres
Publié: (2024)
par: Subramonian, Arjun, et autres
Publié: (2024)
Stop! In the Name of Flaws: Disentangling Personal Names and Sociodemographic Attributes in NLP
par: Gautam, Vagrant, et autres
Publié: (2024)
par: Gautam, Vagrant, et autres
Publié: (2024)
Strong Model Collapse
par: Dohmatob, Elvis, et autres
Publié: (2024)
par: Dohmatob, Elvis, et autres
Publié: (2024)
Predictive Churn with the Set of Good Models
par: Watson-Daniels, Jamelle, et autres
Publié: (2024)
par: Watson-Daniels, Jamelle, et autres
Publié: (2024)
Disentangling Geometry, Performance, and Training in Language Models
par: Kulkarni, Atharva, et autres
Publié: (2026)
par: Kulkarni, Atharva, et autres
Publié: (2026)
An Effective Theory of Bias Amplification
par: Subramonian, Arjun, et autres
Publié: (2024)
par: Subramonian, Arjun, et autres
Publié: (2024)
Model of Robotic Process Automation Adoption in Internal Auditors Profession
par: Handoko, Bambang Leo
Publié: (2025)
par: Handoko, Bambang Leo
Publié: (2025)
Brittlebench: Quantifying LLM robustness via prompt sensitivity
par: Romanou, Angelika, et autres
Publié: (2026)
par: Romanou, Angelika, et autres
Publié: (2026)
Physics-Informed Residual Learning for Safe and Adaptive Battery Charging Under Extreme Conditions
par: Pasupuleti, Ramakrishna
Publié: (2026)
par: Pasupuleti, Ramakrishna
Publié: (2026)
A K–R Constant–Based Framework for Predictive Stabilization, Uncertainty Regulation, and Physical Reservoir Computing
par: Pasupuleti, Ramakrishna
Publié: (2026)
par: Pasupuleti, Ramakrishna
Publié: (2026)
KR-Regulated Nonlinear Parabolic and Fractional Evolution Equations: Attractor Scaling Laws, Critical Thresholds, and Computational Efficiency
par: Pasupuleti, Ramakrishna
Publié: (2026)
par: Pasupuleti, Ramakrishna
Publié: (2026)
Pre Seismic Quiescence and Dynamical Regime Transitions in the Japan and Chile Earthquake Catalogs Evidence from KR Critical Slowing Down Indicators
par: Pasupuleti, Ramakrishna
Publié: (2026)
par: Pasupuleti, Ramakrishna
Publié: (2026)
Pairwise Matching of Intermediate Representations for Fine-grained Explainability
par: Shrack, Lauren, et autres
Publié: (2025)
par: Shrack, Lauren, et autres
Publié: (2025)
Counterfactual Evaluation of Ads Ranking Models through Domain Adaptation
par: Radwan, Mohamed A., et autres
Publié: (2024)
par: Radwan, Mohamed A., et autres
Publié: (2024)
OpenApps: Simulating Environment Variations to Measure UI-Agent Reliability
par: Ullrich, Karen, et autres
Publié: (2025)
par: Ullrich, Karen, et autres
Publié: (2025)
“Nursing My Own Work Destiny”: A Concept Analysis of Basic Psychological Need Crafting
par: Rutger Kotze, et autres
Publié: (2024)
par: Rutger Kotze, et autres
Publié: (2024)
Subfield codes of $C_D$-codes over $\mathbb{F}_2[x]/\langle x^3-x \rangle$ are really nice!
par: Bhagat, Anuj Kumar, et autres
Publié: (2024)
par: Bhagat, Anuj Kumar, et autres
Publié: (2024)
A Unified Two-Parameter K–R Framework for Generalized Jensen, Hölder, Young, and Stability Inequalities
par: Pasupuleti, RamaKrishna
Publié: (2026)
par: Pasupuleti, RamaKrishna
Publié: (2026)
From Concepts to Components: Concept-Agnostic Attention Module Discovery in Transformers
par: Su, Jingtong, et autres
Publié: (2025)
par: Su, Jingtong, et autres
Publié: (2025)
A Hierarchy of Tinhofer Graphs: Separations and Membership Testing
par: Bhattacharjee, Sutanay, et autres
Publié: (2026)
par: Bhattacharjee, Sutanay, et autres
Publié: (2026)
Effect of color reconnection on multiplicity dependent charged particle production in Pythia-generated $pp$ collisions at the LHC energies
par: Sarma, Pranjal, et autres
Publié: (2021)
par: Sarma, Pranjal, et autres
Publié: (2021)
Pluto: Authoring Semantically Aligned Text and Charts for Data-Driven Communication
par: Srinivasan, Arjun, et autres
Publié: (2025)
par: Srinivasan, Arjun, et autres
Publié: (2025)
The Cake that is Intelligence and Who Gets to Bake it: An AI Analogy and its Implications for Participation
par: Mundt, Martin, et autres
Publié: (2025)
par: Mundt, Martin, et autres
Publié: (2025)
Agree to Disagree? A Meta-Evaluation of LLM Misgendering
par: Subramonian, Arjun, et autres
Publié: (2025)
par: Subramonian, Arjun, et autres
Publié: (2025)
A Blockchain-Based Approach for Pharmaceutical Drug Authentication
par: Pasupuleti, Venkata Sai shyam
Publié: (2026)
par: Pasupuleti, Venkata Sai shyam
Publié: (2026)
Concept-based Rubrics Improve LLM Formative Assessment and Data Synthesis
par: Wei, Yuchen, et autres
Publié: (2025)
par: Wei, Yuchen, et autres
Publié: (2025)
Whistler Chorus Amplification in the Magnetosphere: The Nonlinear Free-Electron Laser Model and the Ginzburg-Landau Equation
par: Bonham, Brandon, et autres
Publié: (2025)
par: Bonham, Brandon, et autres
Publié: (2025)
The Ginzburg-Landau Model of Magnetospheric Chorus: Instabilities and Mode Condensation
par: Bonham, Brandon, et autres
Publié: (2025)
par: Bonham, Brandon, et autres
Publié: (2025)
Artifact For: Meaningful Human-in-the-Loop Checking of GenAI Synthesis for Restricted Languages
par: Prasad, Siddhartha Arjun, et autres
Publié: (2026)
par: Prasad, Siddhartha Arjun, et autres
Publié: (2026)
Documents similaires
-
Task-Dependent Evaluation of LLM Output Homogenization: A Taxonomy-Guided Framework
par: Jain, Shomik, et autres
Publié: (2025) -
Algorithmic Fairness and Color-blind Racism: Navigating the Intersection
par: Watson-Daniels, Jamelle
Publié: (2024) -
Representative Ranking for Deliberation in the Public Sphere
par: Revel, Manon, et autres
Publié: (2025) -
Beg to Differ: Understanding Reasoning-Answer Misalignment Across Languages
par: Ovalle, Anaelia, et autres
Publié: (2025) -
Survey of Bias In Text-to-Image Generation: Definition, Evaluation, and Mitigation
par: Wan, Yixin, et autres
Publié: (2024)