Zero-shot LLM-guided Counterfactual Generation: A Case Study on NLP Model Evaluation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bhattacharjee, Amrita, Moraffah, Raha, Garland, Joshua, Liu, Huan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Towards LLM-guided Causal Explainability for Black-box Text Classifiers
par: Bhattacharjee, Amrita, et autres
Publié: (2023)
par: Bhattacharjee, Amrita, et autres
Publié: (2023)
EAGLE: A Domain Generalization Framework for AI-generated Text Detection
par: Bhattacharjee, Amrita, et autres
Publié: (2024)
par: Bhattacharjee, Amrita, et autres
Publié: (2024)
Adversarial Text Purification: A Large Language Model Approach for Defense
par: Moraffah, Raha, et autres
Publié: (2024)
par: Moraffah, Raha, et autres
Publié: (2024)
Exploiting Class Probabilities for Black-box Sentence-level Attacks
par: Moraffah, Raha, et autres
Publié: (2024)
par: Moraffah, Raha, et autres
Publié: (2024)
A Generative Approach to Surrogate-based Black-box Attacks
par: Moraffah, Raha, et autres
Publié: (2024)
par: Moraffah, Raha, et autres
Publié: (2024)
Can Large Language Models Infer Causal Relationships from Real-World Text?
par: Saklad, Ryan, et autres
Publié: (2025)
par: Saklad, Ryan, et autres
Publié: (2025)
Towards Interpretable Hate Speech Detection using Large Language Model-extracted Rationales
par: Nirmal, Ayushi, et autres
Publié: (2024)
par: Nirmal, Ayushi, et autres
Publié: (2024)
Harnessing Artificial Intelligence to Combat Online Hate: Exploring the Challenges and Opportunities of Large Language Models in Hate Speech Detection
par: Kumarage, Tharindu, et autres
Publié: (2024)
par: Kumarage, Tharindu, et autres
Publié: (2024)
A Survey of AI-generated Text Forensic Systems: Detection, Attribution, and Characterization
par: Kumarage, Tharindu, et autres
Publié: (2024)
par: Kumarage, Tharindu, et autres
Publié: (2024)
Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering
par: Keluskar, Aryan, et autres
Publié: (2024)
par: Keluskar, Aryan, et autres
Publié: (2024)
Causal Feature Selection for Responsible Machine Learning
par: Moraffah, Raha, et autres
Publié: (2024)
par: Moraffah, Raha, et autres
Publié: (2024)
Evaluating the Factuality of Zero-shot Summarizers Across Varied Domains
par: Ramprasad, Sanjana, et autres
Publié: (2024)
par: Ramprasad, Sanjana, et autres
Publié: (2024)
A Zero-shot and Few-shot Study of Instruction-Finetuned Large Language Models Applied to Clinical and Biomedical Tasks
par: Labrak, Yanis, et autres
Publié: (2023)
par: Labrak, Yanis, et autres
Publié: (2023)
Revisiting Chain-of-Thought Prompting: Zero-shot Can Be Stronger than Few-shot
par: Cheng, Xiang, et autres
Publié: (2025)
par: Cheng, Xiang, et autres
Publié: (2025)
Enhancing NLP Robustness and Generalization through LLM-Generated Contrast Sets: A Scalable Framework for Systematic Evaluation and Adversarial Training
par: Lin, Hender
Publié: (2025)
par: Lin, Hender
Publié: (2025)
Cross-Platform Hate Speech Detection with Weakly Supervised Causal Disentanglement
par: Sheth, Paras, et autres
Publié: (2024)
par: Sheth, Paras, et autres
Publié: (2024)
The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs
par: Baidya, Avinash, et autres
Publié: (2025)
par: Baidya, Avinash, et autres
Publié: (2025)
LLMs as Zero-shot Graph Learners: Alignment of GNN Representations with LLM Token Embeddings
par: Wang, Duo, et autres
Publié: (2024)
par: Wang, Duo, et autres
Publié: (2024)
Autonomous Data Selection with Zero-shot Generative Classifiers for Mathematical Texts
par: Zhang, Yifan, et autres
Publié: (2024)
par: Zhang, Yifan, et autres
Publié: (2024)
Classification of User Reports for Detection of Faulty Computer Components using NLP Models: A Case Study
par: Silva, Maria de Lourdes M., et autres
Publié: (2025)
par: Silva, Maria de Lourdes M., et autres
Publié: (2025)
DiZiNER: Disagreement-guided Instruction Refinement via Pilot Annotation Simulation for Zero-shot Named Entity Recognition
par: Kim, Siun, et autres
Publié: (2026)
par: Kim, Siun, et autres
Publié: (2026)
Inductive Biases for Zero-shot Systematic Generalization in Language-informed Reinforcement Learning
par: Dijujin, Negin Hashemi, et autres
Publié: (2025)
par: Dijujin, Negin Hashemi, et autres
Publié: (2025)
LIME-LLM: Probing Models with Fluent Counterfactuals, Not Broken Text
par: Mihaila, George, et autres
Publié: (2026)
par: Mihaila, George, et autres
Publié: (2026)
DiCoRe: Enhancing Zero-shot Event Detection via Divergent-Convergent LLM Reasoning
par: Parekh, Tanmay, et autres
Publié: (2025)
par: Parekh, Tanmay, et autres
Publié: (2025)
PLAY2PROMPT: Zero-shot Tool Instruction Optimization for LLM Agents via Tool Play
par: Fang, Wei, et autres
Publié: (2025)
par: Fang, Wei, et autres
Publié: (2025)
Gumbel Counterfactual Generation From Language Models
par: Ravfogel, Shauli, et autres
Publié: (2024)
par: Ravfogel, Shauli, et autres
Publié: (2024)
Counterfactual Token Generation in Large Language Models
par: Chatzi, Ivi, et autres
Publié: (2024)
par: Chatzi, Ivi, et autres
Publié: (2024)
Shared Doubt: Zero-shot Cross-Lingual Confidence Estimation for Language Models
par: Kyriakou, Athina, et autres
Publié: (2026)
par: Kyriakou, Athina, et autres
Publié: (2026)
M$^2$PT: Multimodal Prompt Tuning for Zero-shot Instruction Learning
par: Wang, Taowen, et autres
Publié: (2024)
par: Wang, Taowen, et autres
Publié: (2024)
EvalxNLP: A Framework for Benchmarking Post-Hoc Explainability Methods on NLP Models
par: Dhaini, Mahdi, et autres
Publié: (2025)
par: Dhaini, Mahdi, et autres
Publié: (2025)
From Word Sequences to Behavioral Sequences: Adapting Modeling and Evaluation Paradigms for Longitudinal NLP
par: Ganesan, Adithya V, et autres
Publié: (2026)
par: Ganesan, Adithya V, et autres
Publié: (2026)
Automatic Curriculum Expert Iteration for Reliable LLM Reasoning
par: Zhao, Zirui, et autres
Publié: (2024)
par: Zhao, Zirui, et autres
Publié: (2024)
From Haystack to Needle: Label Space Reduction for Zero-shot Classification
par: Vandemoortele, Nathan, et autres
Publié: (2025)
par: Vandemoortele, Nathan, et autres
Publié: (2025)
Bridging the Gap between Expert and Language Models: Concept-guided Chess Commentary Generation and Evaluation
par: Kim, Jaechang, et autres
Publié: (2024)
par: Kim, Jaechang, et autres
Publié: (2024)
The Wolf Within: Covert Injection of Malice into MLLM Societies via an MLLM Operative
par: Tan, Zhen, et autres
Publié: (2024)
par: Tan, Zhen, et autres
Publié: (2024)
REMEMBER: Retrieval-based Explainable Multimodal Evidence-guided Modeling for Brain Evaluation and Reasoning in Zero- and Few-shot Neurodegenerative Diagnosis
par: Can, Duy-Cat, et autres
Publié: (2025)
par: Can, Duy-Cat, et autres
Publié: (2025)
PathCoT: Chain-of-Thought Prompting for Zero-shot Pathology Visual Reasoning
par: Zhou, Junjie, et autres
Publié: (2025)
par: Zhou, Junjie, et autres
Publié: (2025)
DOGe: Defensive Output Generation for LLM Protection Against Knowledge Distillation
par: Li, Pingzhi, et autres
Publié: (2025)
par: Li, Pingzhi, et autres
Publié: (2025)
DAGverse: Building Document-Grounded Semantic DAGs from Scientific Papers
par: Wan, Shu, et autres
Publié: (2026)
par: Wan, Shu, et autres
Publié: (2026)
Interpretable AI for Time-Series: Multi-Model Heatmap Fusion with Global Attention and NLP-Generated Explanations
par: Francis, Jiztom Kavalakkatt, et autres
Publié: (2025)
par: Francis, Jiztom Kavalakkatt, et autres
Publié: (2025)
Documents similaires
-
Towards LLM-guided Causal Explainability for Black-box Text Classifiers
par: Bhattacharjee, Amrita, et autres
Publié: (2023) -
EAGLE: A Domain Generalization Framework for AI-generated Text Detection
par: Bhattacharjee, Amrita, et autres
Publié: (2024) -
Adversarial Text Purification: A Large Language Model Approach for Defense
par: Moraffah, Raha, et autres
Publié: (2024) -
Exploiting Class Probabilities for Black-box Sentence-level Attacks
par: Moraffah, Raha, et autres
Publié: (2024) -
A Generative Approach to Surrogate-based Black-box Attacks
par: Moraffah, Raha, et autres
Publié: (2024)