KRISTEVA: Close Reading as a Novel Task for Benchmarking Interpretive Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Sui, Peiqi, Rodriguez, Juan Diego, Laban, Philippe, Murphy, Dean, Dexter, Joseph P., So, Richard Jean, Baker, Samuel, Chaudhuri, Pramit |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AcrosticSleuth: Probabilistic Identification and Ranking of Acrostics in Multilingual Corpora
di: Fedchin, Aleksandr, et al.
Pubblicazione: (2024)
di: Fedchin, Aleksandr, et al.
Pubblicazione: (2024)
Confabulation: The Surprising Value of Large Language Model Hallucinations
di: Sui, Peiqi, et al.
Pubblicazione: (2024)
di: Sui, Peiqi, et al.
Pubblicazione: (2024)
Critical Confabulation: Can LLMs Hallucinate for Social Good?
di: Sui, Peiqi, et al.
Pubblicazione: (2025)
di: Sui, Peiqi, et al.
Pubblicazione: (2025)
What Does AI Do for Cultural Interpretation? A Randomized Experiment on Close Reading Poems with Exposure to AI Interpretation
di: Zhi, Jiayin, et al.
Pubblicazione: (2026)
di: Zhi, Jiayin, et al.
Pubblicazione: (2026)
LLMs Exhibit Significantly Lower Uncertainty in Creative Writing Than Professional Writers
di: Sui, Peiqi
Pubblicazione: (2026)
di: Sui, Peiqi
Pubblicazione: (2026)
Spoiler Alert: Narrative Forecasting as a Metric for Tension in LLM Storytelling
di: Sui, Peiqi, et al.
Pubblicazione: (2026)
di: Sui, Peiqi, et al.
Pubblicazione: (2026)
SummExecEdit: A Factual Consistency Benchmark in Summarization with Executable Edits
di: Thorat, Onkar, et al.
Pubblicazione: (2024)
di: Thorat, Onkar, et al.
Pubblicazione: (2024)
Generative AI & Fictionality: How Novels Power Large Language Models
di: Roland, Edwin, et al.
Pubblicazione: (2026)
di: Roland, Edwin, et al.
Pubblicazione: (2026)
Hybrid star within $f(\mathcal{G})$ gravity
di: Rej, Pramit
Pubblicazione: (2024)
di: Rej, Pramit
Pubblicazione: (2024)
Measuring Fractal Dimension using Discrete Global Grid Systems
di: Ghosh, Pramit
Pubblicazione: (2025)
di: Ghosh, Pramit
Pubblicazione: (2025)
Charged analog of anisotropic dark energy star in Rastall gravity
di: Rej, Pramit
Pubblicazione: (2024)
di: Rej, Pramit
Pubblicazione: (2024)
MMTU: A Massive Multi-Task Table Understanding and Reasoning Benchmark
di: Xing, Junjie, et al.
Pubblicazione: (2025)
di: Xing, Junjie, et al.
Pubblicazione: (2025)
LLMs Corrupt Your Documents When You Delegate
di: Laban, Philippe, et al.
Pubblicazione: (2026)
di: Laban, Philippe, et al.
Pubblicazione: (2026)
MiniCheck: Efficient Fact-Checking of LLMs on Grounding Documents
di: Tang, Liyan, et al.
Pubblicazione: (2024)
di: Tang, Liyan, et al.
Pubblicazione: (2024)
INDIC DIALECT: A Multi Task Benchmark to Evaluate and Translate in Indian Language Dialects
di: Sharma, Tarun, et al.
Pubblicazione: (2026)
di: Sharma, Tarun, et al.
Pubblicazione: (2026)
La tiranía de la mala teoría económica
di: Dean Baker
Pubblicazione: (2009)
di: Dean Baker
Pubblicazione: (2009)
La "Nueva Economía" de EEUU. Alguien a quien culpar cuando la próxima burbuja estalle
di: Dean Baker
Pubblicazione: (2009)
di: Dean Baker
Pubblicazione: (2009)
Beyond Vision: How Large Language Models Interpret Facial Expressions from Valence-Arousal Values
di: Mehra, Vaibhav, et al.
Pubblicazione: (2025)
di: Mehra, Vaibhav, et al.
Pubblicazione: (2025)
LEXI: Large Language Models Experimentation Interface
di: Laban, Guy, et al.
Pubblicazione: (2024)
di: Laban, Guy, et al.
Pubblicazione: (2024)
NLIP_Lab-IITH Multilingual MT System for WAT24 MT Shared Task
di: Brahma, Maharaj, et al.
Pubblicazione: (2024)
di: Brahma, Maharaj, et al.
Pubblicazione: (2024)
La inversión con reformas increíbles / Raúl Laban, Holger C. Wolf
di: Laban, Raúl
di: Laban, Raúl
NLIP_Lab-IITH Low-Resource MT System for WMT24 Indic MT Shared Task
di: Sahoo, Pramit, et al.
Pubblicazione: (2024)
di: Sahoo, Pramit, et al.
Pubblicazione: (2024)
AI-Slop to AI-Polish? Aligning Language Models through Edit-Based Writing Rewards and Test-time Computation
di: Chakrabarty, Tuhin, et al.
Pubblicazione: (2025)
di: Chakrabarty, Tuhin, et al.
Pubblicazione: (2025)
Can AI writing be salvaged? Mitigating Idiosyncrasies and Improving Human-AI Alignment in the Writing Process through Edits
di: Chakrabarty, Tuhin, et al.
Pubblicazione: (2024)
di: Chakrabarty, Tuhin, et al.
Pubblicazione: (2024)
Jane Austen’s Novels: A Study from Feminist Perspective
di: Anuradha Chaudhuri
Pubblicazione: (2021)
di: Anuradha Chaudhuri
Pubblicazione: (2021)
Weighted Support Points from Random Measures: An Interpretable Alternative for Generative Modeling
di: Zhao, Peiqi, et al.
Pubblicazione: (2025)
di: Zhao, Peiqi, et al.
Pubblicazione: (2025)
Flipping the Dialogue: Training and Evaluating User Language Models
di: Naous, Tarek, et al.
Pubblicazione: (2025)
di: Naous, Tarek, et al.
Pubblicazione: (2025)
Attribution Gradients: Incrementally Unfolding Citations for Critical Examination of Attributed AI Answers
di: Kambhamettu, Hita, et al.
Pubblicazione: (2025)
di: Kambhamettu, Hita, et al.
Pubblicazione: (2025)
LLMs Get Lost In Multi-Turn Conversation
di: Laban, Philippe, et al.
Pubblicazione: (2025)
di: Laban, Philippe, et al.
Pubblicazione: (2025)
Supplementary Data 1
di: Wan, Peiqi
Pubblicazione: (2025)
di: Wan, Peiqi
Pubblicazione: (2025)
Uncertainty Quantification Via the Posterior Predictive Variance
di: Chaudhuri, Sanjay, et al.
Pubblicazione: (2026)
di: Chaudhuri, Sanjay, et al.
Pubblicazione: (2026)
Man or Monster?
di: Hinton, Alexander Laban
Pubblicazione: (2017)
di: Hinton, Alexander Laban
Pubblicazione: (2017)
One Model for Teaching Research Skills.
di: Laban, Lawrence F.
Pubblicazione: (1977)
di: Laban, Lawrence F.
Pubblicazione: (1977)
AbstentionBench: Reasoning LLMs Fail on Unanswerable Questions
di: Kirichenko, Polina, et al.
Pubblicazione: (2025)
di: Kirichenko, Polina, et al.
Pubblicazione: (2025)
Lexical and Statistical Analysis of Bangla Newspaper and Literature: A Corpus-Driven Study on Diversity, Readability, and NLP Adaptation
di: Bhattacharyya, Pramit, et al.
Pubblicazione: (2025)
di: Bhattacharyya, Pramit, et al.
Pubblicazione: (2025)
Isotropic Buchdahl's relativistic fluid sphere within $f(R,\,T)$ gravity
di: Bhar, Piyali, et al.
Pubblicazione: (2022)
di: Bhar, Piyali, et al.
Pubblicazione: (2022)
Video-based Exercise Classification and Activated Muscle Group Prediction with Hybrid X3D-SlowFast Network
di: Pasula, Manvik, et al.
Pubblicazione: (2024)
di: Pasula, Manvik, et al.
Pubblicazione: (2024)
Model of hybrid star with baryonic and strange quark matter in Tolman-Kuchowicz spacetime
di: Rej, Pramit, et al.
Pubblicazione: (2022)
di: Rej, Pramit, et al.
Pubblicazione: (2022)
Well behaved class of Heintzmann's solution within $f(R,\,T)$ framework
di: Rej, Pramit, et al.
Pubblicazione: (2024)
di: Rej, Pramit, et al.
Pubblicazione: (2024)
Investigating Deep Learning Models for Ejection Fraction Estimation from Echocardiography Videos
di: Saranyan, Shravan, et al.
Pubblicazione: (2025)
di: Saranyan, Shravan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
AcrosticSleuth: Probabilistic Identification and Ranking of Acrostics in Multilingual Corpora
di: Fedchin, Aleksandr, et al.
Pubblicazione: (2024) -
Confabulation: The Surprising Value of Large Language Model Hallucinations
di: Sui, Peiqi, et al.
Pubblicazione: (2024) -
Critical Confabulation: Can LLMs Hallucinate for Social Good?
di: Sui, Peiqi, et al.
Pubblicazione: (2025) -
What Does AI Do for Cultural Interpretation? A Randomized Experiment on Close Reading Poems with Exposure to AI Interpretation
di: Zhi, Jiayin, et al.
Pubblicazione: (2026) -
LLMs Exhibit Significantly Lower Uncertainty in Creative Writing Than Professional Writers
di: Sui, Peiqi
Pubblicazione: (2026)