Automatic Generation of Model and Data Cards: A Step Towards Responsible AI
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Jiarui, Li, Wenkai, Jin, Zhijing, Diab, Mona |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Towards Global AI Inclusivity: A Large-Scale Multilingual Terminology Dataset (GIST)
par: Liu, Jiarui, et autres
Publié: (2024)
par: Liu, Jiarui, et autres
Publié: (2024)
Taming Object Hallucinations with Verified Atomic Confidence Estimation
par: Liu, Jiarui, et autres
Publié: (2025)
par: Liu, Jiarui, et autres
Publié: (2025)
BIG5-CHAT: Shaping LLM Personalities Through Training on Human-Grounded Data
par: Li, Wenkai, et autres
Publié: (2024)
par: Li, Wenkai, et autres
Publié: (2024)
LLM Microscope: What Model Internals Reveal About Answer Correctness and Context Utilization
par: Liu, Jiarui, et autres
Publié: (2025)
par: Liu, Jiarui, et autres
Publié: (2025)
MixSD: Mixed Contextual Self-Distillation for Knowledge Injection
par: Liu, Jiarui, et autres
Publié: (2026)
par: Liu, Jiarui, et autres
Publié: (2026)
Analyzing the Role of Semantic Representations in the Era of Large Language Models
par: Jin, Zhijing, et autres
Publié: (2024)
par: Jin, Zhijing, et autres
Publié: (2024)
Can Large Language Models Infer Causation from Correlation?
par: Jin, Zhijing, et autres
Publié: (2023)
par: Jin, Zhijing, et autres
Publié: (2023)
Evaluating Large Language Model Biases in Persona-Steered Generation
par: Liu, Andy, et autres
Publié: (2024)
par: Liu, Andy, et autres
Publié: (2024)
Humanizing Machines: Rethinking LLM Anthropomorphism Through a Multi-Level Framework of Design
par: Xiao, Yunze, et autres
Publié: (2025)
par: Xiao, Yunze, et autres
Publié: (2025)
A Note on Bias to Complete
par: Xu, Jia, et autres
Publié: (2024)
par: Xu, Jia, et autres
Publié: (2024)
Depth-Wise Attention (DWAtt): A Layer Fusion Method for Data-Efficient Classification
par: ElNokrashy, Muhammad, et autres
Publié: (2022)
par: ElNokrashy, Muhammad, et autres
Publié: (2022)
Towards Valid Student Simulation with Large Language Models
par: Yuan, Zhihao, et autres
Publié: (2026)
par: Yuan, Zhihao, et autres
Publié: (2026)
Combining Discrete Wavelet and Cosine Transforms for Efficient Sentence Embedding
par: Salama, Rana, et autres
Publié: (2025)
par: Salama, Rana, et autres
Publié: (2025)
Biases Propagate in Encoder-based Vision-Language Models: A Systematic Analysis From Intrinsic Measures to Zero-shot Retrieval Outcomes
par: Ghate, Kshitish, et autres
Publié: (2025)
par: Ghate, Kshitish, et autres
Publié: (2025)
EVALUESTEER: Measuring Reward Model Steerability Towards Values and Preferences
par: Ghate, Kshitish, et autres
Publié: (2025)
par: Ghate, Kshitish, et autres
Publié: (2025)
CoRAG: Collaborative Retrieval-Augmented Generation
par: Muhamed, Aashiq, et autres
Publié: (2025)
par: Muhamed, Aashiq, et autres
Publié: (2025)
Decoding Dark Matter: Specialized Sparse Autoencoders for Interpreting Rare Concepts in Foundation Models
par: Muhamed, Aashiq, et autres
Publié: (2024)
par: Muhamed, Aashiq, et autres
Publié: (2024)
Semantic Compression for Word and Sentence Embeddings using Discrete Wavelet Transform
par: Salama, Rana Aref, et autres
Publié: (2025)
par: Salama, Rana Aref, et autres
Publié: (2025)
CORE: Measuring Multi-Agent LLM Interaction Quality under Game-Theoretic Pressures
par: Pandey, Punya Syon, et autres
Publié: (2025)
par: Pandey, Punya Syon, et autres
Publié: (2025)
Personal Information Parroting in Language Models
par: Subramani, Nishant, et autres
Publié: (2026)
par: Subramani, Nishant, et autres
Publié: (2026)
StressRoBERTa: Cross-Condition Transfer Learning from Depression, Anxiety, and PTSD to Stress Detection
par: Alqahtani, Amal, et autres
Publié: (2025)
par: Alqahtani, Amal, et autres
Publié: (2025)
DWTSumm: Discrete Wavelet Transform for Document Summarization
par: Salama, Rana, et autres
Publié: (2026)
par: Salama, Rana, et autres
Publié: (2026)
Revealing Hidden Mechanisms of Cross-Country Content Moderation with Natural Language Processing
par: Yadav, Neemesh, et autres
Publié: (2025)
par: Yadav, Neemesh, et autres
Publié: (2025)
DSPA: Dynamic SAE Steering for Data-Efficient Preference Alignment
par: Wedgwood, James, et autres
Publié: (2026)
par: Wedgwood, James, et autres
Publié: (2026)
Voices of Her: Analyzing Gender Differences in the AI Publication World
par: Ding, Yiwen, et autres
Publié: (2023)
par: Ding, Yiwen, et autres
Publié: (2023)
Synthetic Socratic Debates: Examining Persona Effects on Moral Decision and Persuasion Dynamics
par: Liu, Jiarui, et autres
Publié: (2025)
par: Liu, Jiarui, et autres
Publié: (2025)
Causality for Natural Language Processing
par: Jin, Zhijing
Publié: (2025)
par: Jin, Zhijing
Publié: (2025)
Emotion Classification in Low and Moderate Resource Languages
par: Tafreshi, Shabnam, et autres
Publié: (2024)
par: Tafreshi, Shabnam, et autres
Publié: (2024)
SimBA: Simplifying Benchmark Analysis Using Performance Matrices Alone
par: Subramani, Nishant, et autres
Publié: (2025)
par: Subramani, Nishant, et autres
Publié: (2025)
Investigating Cultural Alignment of Large Language Models
par: AlKhamissi, Badr, et autres
Publié: (2024)
par: AlKhamissi, Badr, et autres
Publié: (2024)
RefusalBench: Generative Evaluation of Selective Refusal in Grounded Language Models
par: Muhamed, Aashiq, et autres
Publié: (2025)
par: Muhamed, Aashiq, et autres
Publié: (2025)
AdaptiveStep: Automatically Dividing Reasoning Step through Model Confidence
par: Liu, Yuliang, et autres
Publié: (2025)
par: Liu, Yuliang, et autres
Publié: (2025)
AgenticRAGTracer: A Hop-Aware Benchmark for Diagnosing Multi-Step Retrieval Reasoning in Agentic RAG
par: You, Qijie, et autres
Publié: (2026)
par: You, Qijie, et autres
Publié: (2026)
Implicit Personalization in Language Models: A Systematic Study
par: Jin, Zhijing, et autres
Publié: (2024)
par: Jin, Zhijing, et autres
Publié: (2024)
Beyond Understanding: Evaluating the Pragmatic Gap in LLMs' Cultural Processing of Figurative Language
par: Attia, Mena, et autres
Publié: (2025)
par: Attia, Mena, et autres
Publié: (2025)
Hire Your Anthropologist! Rethinking Culture Benchmarks Through an Anthropological Lens
par: AlKhamissi, Mai, et autres
Publié: (2025)
par: AlKhamissi, Mai, et autres
Publié: (2025)
Are LLMs Good Safety Agents or a Propaganda Engine?
par: Yadav, Neemesh, et autres
Publié: (2025)
par: Yadav, Neemesh, et autres
Publié: (2025)
Generative Value Conflicts Reveal LLM Priorities
par: Liu, Andy, et autres
Publié: (2025)
par: Liu, Andy, et autres
Publié: (2025)
Difficulty-Based Preference Data Selection by DPO Implicit Reward Gap
par: Qi, Xuan, et autres
Publié: (2025)
par: Qi, Xuan, et autres
Publié: (2025)
The Curious Case of Curiosity across Human Cultures and LLMs
par: Borah, Angana, et autres
Publié: (2025)
par: Borah, Angana, et autres
Publié: (2025)
Documents similaires
-
Towards Global AI Inclusivity: A Large-Scale Multilingual Terminology Dataset (GIST)
par: Liu, Jiarui, et autres
Publié: (2024) -
Taming Object Hallucinations with Verified Atomic Confidence Estimation
par: Liu, Jiarui, et autres
Publié: (2025) -
BIG5-CHAT: Shaping LLM Personalities Through Training on Human-Grounded Data
par: Li, Wenkai, et autres
Publié: (2024) -
LLM Microscope: What Model Internals Reveal About Answer Correctness and Context Utilization
par: Liu, Jiarui, et autres
Publié: (2025) -
MixSD: Mixed Contextual Self-Distillation for Knowledge Injection
par: Liu, Jiarui, et autres
Publié: (2026)