The Effect of Human v/s Synthetic Test Data and Round-tripping on Assessment of Sentiment Analysis Systems for Bias
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lakkaraju, Kausik, Gupta, Aniket, Srivastava, Biplav, Valtorta, Marco, Wu, Dezhi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GAICo: A Deployed and Extensible Framework for Evaluating Diverse and Multimodal Generative AI Outputs
par: Gupta, Nitin, et autres
Publié: (2025)
par: Gupta, Nitin, et autres
Publié: (2025)
BEACON: Balancing Convenience and Nutrition in Meals With Long-Term Group Recommendations and Reasoning on Multimodal Recipes
par: Nagpal, Vansh, et autres
Publié: (2024)
par: Nagpal, Vansh, et autres
Publié: (2024)
SafeChat: A Framework for Building Trustworthy Collaborative Assistants and a Case Study of its Usefulness
par: Srivastava, Biplav, et autres
Publié: (2025)
par: Srivastava, Biplav, et autres
Publié: (2025)
Rating Multi-Modal Time-Series Forecasting Models (MM-TSFM) for Robustness Through a Causal Lens
par: Lakkaraju, Kausik, et autres
Publié: (2024)
par: Lakkaraju, Kausik, et autres
Publié: (2024)
Holistic Explainable AI (H-XAI): Extending Transparency Beyond Developers in AI-Driven Decision Making
par: Lakkaraju, Kausik, et autres
Publié: (2025)
par: Lakkaraju, Kausik, et autres
Publié: (2025)
On Identifying Why and When Foundation Models Perform Well on Time-Series Forecasting Using Automated Explanations and Rating
par: Widener, Michael, et autres
Publié: (2025)
par: Widener, Michael, et autres
Publié: (2025)
PLANTS: A Novel Problem and Dataset for Summarization of Planning-Like (PL) Tasks
par: Pallagani, Vishal, et autres
Publié: (2024)
par: Pallagani, Vishal, et autres
Publié: (2024)
Creating a Causally Grounded Rating Method for Assessing the Robustness of AI Models for Time-Series Forecasting
par: Lakkaraju, Kausik, et autres
Publié: (2025)
par: Lakkaraju, Kausik, et autres
Publié: (2025)
Trust and ethical considerations in a multi-modal, explainable AI-driven chatbot tutoring system: The case of collaboratively solving Rubik's Cube
par: Lakkaraju, Kausik, et autres
Publié: (2024)
par: Lakkaraju, Kausik, et autres
Publié: (2024)
RPDR: A Round-trip Prediction-Based Data Augmentation Framework for Long-Tail Question Answering
par: Zhang, Yiming, et autres
Publié: (2026)
par: Zhang, Yiming, et autres
Publié: (2026)
RoSE: Round-robin Synthetic Data Evaluation for Selecting LLM Generators without Human Test Sets
par: Cegin, Jan, et autres
Publié: (2025)
par: Cegin, Jan, et autres
Publié: (2025)
Text Style Transfer with Parameter-efficient LLM Finetuning and Round-trip Translation
par: Liu, Ruoxi, et autres
Publié: (2026)
par: Liu, Ruoxi, et autres
Publié: (2026)
BTC-SAM: Leveraging LLMs for Generation of Bias Test Cases for Sentiment Analysis Models
par: Kardkovacs, Zsolt T., et autres
Publié: (2025)
par: Kardkovacs, Zsolt T., et autres
Publié: (2025)
A Neurosymbolic Fast and Slow Architecture for Graph Coloring
par: Khandelwal, Vedant, et autres
Publié: (2024)
par: Khandelwal, Vedant, et autres
Publié: (2024)
Enhancing Cryptocurrency Sentiment Analysis with Multimodal Features
par: Liu, Chenghao, et autres
Publié: (2025)
par: Liu, Chenghao, et autres
Publié: (2025)
ADVOSYNTH: A Synthetic Multi-Advocate Dataset for Speaker Identification in Courtroom Scenarios
par: Deroy, Aniket
Publié: (2026)
par: Deroy, Aniket
Publié: (2026)
A Novel Approach to Balance Convenience and Nutrition in Meals With Long-Term Group Recommendations and Reasoning on Multimodal Recipes and its Implementation in BEACON
par: Nagpal, Vansh, et autres
Publié: (2024)
par: Nagpal, Vansh, et autres
Publié: (2024)
Financial Sentiment Analysis: Leveraging Actual and Synthetic Data for Supervised Fine-tuning
par: Atsiwo, Abraham
Publié: (2024)
par: Atsiwo, Abraham
Publié: (2024)
Model in Distress: Sentiment Analysis on French Synthetic Social Media
par: Langlais, Pierre-Carl, et autres
Publié: (2026)
par: Langlais, Pierre-Carl, et autres
Publié: (2026)
Bridging the Gap for Test-Time Multimodal Sentiment Analysis
par: Guo, Zirun, et autres
Publié: (2024)
par: Guo, Zirun, et autres
Publié: (2024)
Understanding the Effects of Iterative Prompting on Truthfulness
par: Krishna, Satyapriya, et autres
Publié: (2024)
par: Krishna, Satyapriya, et autres
Publié: (2024)
Towards Multimodal Sentiment Analysis Debiasing via Bias Purification
par: Yang, Dingkang, et autres
Publié: (2024)
par: Yang, Dingkang, et autres
Publié: (2024)
Scaling Efficient LLMs
par: Kausik, B. N.
Publié: (2024)
par: Kausik, B. N.
Publié: (2024)
From Annotation to Adaptation: Metrics, Synthetic Data, and Aspect Extraction for Aspect-Based Sentiment Analysis with Large Language Models
par: Neveditsin, Nikita, et autres
Publié: (2025)
par: Neveditsin, Nikita, et autres
Publié: (2025)
Information Extraction from Heterogeneous Documents without Ground Truth Labels using Synthetic Label Generation and Knowledge Distillation
par: Bhattacharyya, Aniket, et autres
Publié: (2024)
par: Bhattacharyya, Aniket, et autres
Publié: (2024)
Analyzing Language Bias Between French and English in Conventional Multilingual Sentiment Analysis Models
par: Wong, Ethan Parker, et autres
Publié: (2024)
par: Wong, Ethan Parker, et autres
Publié: (2024)
Do Voters Get the Information They Want? Understanding Authentic Voter FAQs in the US and How to Improve for Informed Electoral Participation
par: Rawte, Vipula, et autres
Publié: (2024)
par: Rawte, Vipula, et autres
Publié: (2024)
A Controlled Synthetic Benchmark for Educational Aspect-Based Sentiment Analysis
par: Aperstein, Yehudit, et autres
Publié: (2026)
par: Aperstein, Yehudit, et autres
Publié: (2026)
Development and Evaluation of a Retrieval-Augmented Generation Tool for Creating SAPPhIRE Models of Artificial Systems
par: Majumder, Anubhab, et autres
Publié: (2024)
par: Majumder, Anubhab, et autres
Publié: (2024)
A Study on Effect of Reference Knowledge Choice in Generating Technical Content Relevant to SAPPhIRE Model Using Large Language Model
par: Bhattacharya, Kausik, et autres
Publié: (2024)
par: Bhattacharya, Kausik, et autres
Publié: (2024)
Explainable AI for Sentiment Analysis of Human Metapneumovirus (HMPV) Using XLNet
par: Apu, Md. Shahriar Hossain, et autres
Publié: (2025)
par: Apu, Md. Shahriar Hossain, et autres
Publié: (2025)
Arabic Text Sentiment Analysis: Reinforcing Human-Performed Surveys with Wider Topic Analysis
par: Almurqren, Latifah, et autres
Publié: (2024)
par: Almurqren, Latifah, et autres
Publié: (2024)
Balanced Training Data Augmentation for Aspect-Based Sentiment Analysis
par: Liu, Junjie, et autres
Publié: (2025)
par: Liu, Junjie, et autres
Publié: (2025)
Equilibrium Dynamics and Mitigation of Gender Bias in Synthetically Generated Data
par: Kattamuri, Ashish, et autres
Publié: (2025)
par: Kattamuri, Ashish, et autres
Publié: (2025)
Exploring the Capabilities of Prompted Large Language Models in Educational and Assessment Applications
par: Maity, Subhankar, et autres
Publié: (2024)
par: Maity, Subhankar, et autres
Publié: (2024)
The Bias is in the Details: An Assessment of Cognitive Bias in LLMs
par: Knipper, R. Alexander, et autres
Publié: (2025)
par: Knipper, R. Alexander, et autres
Publié: (2025)
Controlling Distributional Bias in Multi-Round LLM Generation via KL-Optimized Fine-Tuning
par: Jiang, Yanbei, et autres
Publié: (2026)
par: Jiang, Yanbei, et autres
Publié: (2026)
Understanding Environmental Posts: Sentiment and Emotion Analysis of Social Media Data
par: Amangeldi, Daniyar, et autres
Publié: (2023)
par: Amangeldi, Daniyar, et autres
Publié: (2023)
Data Uncertainty-Aware Learning for Multimodal Aspect-based Sentiment Analysis
par: Yang, Hao, et autres
Publié: (2024)
par: Yang, Hao, et autres
Publié: (2024)
Industry Risk Assessment via Hierarchical Financial Data Using Stock Market Sentiment Indicators
par: Zhu, Hongyin
Publié: (2023)
par: Zhu, Hongyin
Publié: (2023)
Documents similaires
-
GAICo: A Deployed and Extensible Framework for Evaluating Diverse and Multimodal Generative AI Outputs
par: Gupta, Nitin, et autres
Publié: (2025) -
BEACON: Balancing Convenience and Nutrition in Meals With Long-Term Group Recommendations and Reasoning on Multimodal Recipes
par: Nagpal, Vansh, et autres
Publié: (2024) -
SafeChat: A Framework for Building Trustworthy Collaborative Assistants and a Case Study of its Usefulness
par: Srivastava, Biplav, et autres
Publié: (2025) -
Rating Multi-Modal Time-Series Forecasting Models (MM-TSFM) for Robustness Through a Causal Lens
par: Lakkaraju, Kausik, et autres
Publié: (2024) -
Holistic Explainable AI (H-XAI): Extending Transparency Beyond Developers in AI-Driven Decision Making
par: Lakkaraju, Kausik, et autres
Publié: (2025)