Reliable and Responsible Foundation Models: A Comprehensive Survey
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Yang, Xinyu, Han, Junlin, Bommasani, Rishi, Luo, Jinqi, Qu, Wenjie, Zhou, Wangchunshu, Bibi, Adel, Wang, Xiyao, Yoon, Jaehong, Stengel-Eskin, Elias, Tong, Shengbang, Shen, Lingfeng, Rafailov, Rafael, Li, Runjia, Wang, Zhaoyang, Zhou, Yiyang, Cui, Chenhang, Wang, Yu, Zheng, Wenhao, Zhou, Huichi, Gu, Jindong, Chen, Zhaorun, Xia, Peng, Lee, Tony, Zollo, Thomas, Sehwag, Vikash, Leng, Jixuan, Chen, Jiuhai, Wen, Yuxin, Zhang, Huan, Deng, Zhun, Zhang, Linjun, Izmailov, Pavel, Koh, Pang Wei, Tsvetkov, Yulia, Wilson, Andrew, Zhang, Jiaheng, Zou, James, Xie, Cihang, Wang, Hao, Torr, Philip, McAuley, Julian, Alvarez-Melis, David, Tramèr, Florian, Xu, Kaidi, Jana, Suman, Callison-Burch, Chris, Vidal, Rene, Kokkinos, Filippos, Bansal, Mohit, Chen, Beidi, Yao, Huaxiu |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Calibrated Self-Rewarding Vision Language Models
von: Zhou, Yiyang, et al.
Veröffentlicht: (2024)
von: Zhou, Yiyang, et al.
Veröffentlicht: (2024)
Aligning Modalities in Vision Large Language Models via Preference Fine-tuning
von: Zhou, Yiyang, et al.
Veröffentlicht: (2024)
von: Zhou, Yiyang, et al.
Veröffentlicht: (2024)
Fine-Grained Verifiers: Preference Modeling as Next-token Prediction in Vision-Language Alignment
von: Cui, Chenhang, et al.
Veröffentlicht: (2024)
von: Cui, Chenhang, et al.
Veröffentlicht: (2024)
Verifiable Format Control for Large Language Model Generations
von: Wang, Zhaoyang, et al.
Veröffentlicht: (2025)
von: Wang, Zhaoyang, et al.
Veröffentlicht: (2025)
Enhancing Visual-Language Modality Alignment in Large Vision Language Models via Self-Improvement
von: Wang, Xiyao, et al.
Veröffentlicht: (2024)
von: Wang, Xiyao, et al.
Veröffentlicht: (2024)
MMIE: Massive Multimodal Interleaved Comprehension Benchmark for Large Vision-Language Models
von: Xia, Peng, et al.
Veröffentlicht: (2024)
von: Xia, Peng, et al.
Veröffentlicht: (2024)
MJ-Bench: Is Your Multimodal Reward Model Really a Good Judge for Text-to-Image Generation?
von: Chen, Zhaorun, et al.
Veröffentlicht: (2024)
von: Chen, Zhaorun, et al.
Veröffentlicht: (2024)
S$^{2}$FT: Efficient, Scalable and Generalizable LLM Fine-tuning by Structured Sparsity
von: Yang, Xinyu, et al.
Veröffentlicht: (2024)
von: Yang, Xinyu, et al.
Veröffentlicht: (2024)
HALC: Object Hallucination Reduction via Adaptive Focal-Contrast Decoding
von: Chen, Zhaorun, et al.
Veröffentlicht: (2024)
von: Chen, Zhaorun, et al.
Veröffentlicht: (2024)
MPAT: Building Robust Deep Neural Networks against Textual Adversarial Attacks
von: Zhang, Fangyuan, et al.
Veröffentlicht: (2024)
von: Zhang, Fangyuan, et al.
Veröffentlicht: (2024)
Multi-Objective Linguistic Control of Large Language Models
von: Nguyen, Dang, et al.
Veröffentlicht: (2024)
von: Nguyen, Dang, et al.
Veröffentlicht: (2024)
AgenTracer: Who Is Inducing Failure in the LLM Agentic Systems?
von: Zhang, Guibin, et al.
Veröffentlicht: (2025)
von: Zhang, Guibin, et al.
Veröffentlicht: (2025)
Kestrel: Grounding Self-Refinement for LVLM Hallucination Mitigation
von: Mao, Jiawei, et al.
Veröffentlicht: (2026)
von: Mao, Jiawei, et al.
Veröffentlicht: (2026)
Can LLMs Speak For Diverse People? Tuning LLMs via Debate to Generate Controllable Controversial Statements
von: Li, Ming, et al.
Veröffentlicht: (2024)
von: Li, Ming, et al.
Veröffentlicht: (2024)
From EduVisBench to EduVisAgent: A Benchmark and Multi-Agent Framework for Reasoning-Driven Pedagogical Visualization
von: Ji, Haonian, et al.
Veröffentlicht: (2025)
von: Ji, Haonian, et al.
Veröffentlicht: (2025)
From Pixels to Feelings: Aligning MLLMs with Human Cognitive Perception of Images
von: Chen, Yiming, et al.
Veröffentlicht: (2025)
von: Chen, Yiming, et al.
Veröffentlicht: (2025)
MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation
von: Tong, Haibo, et al.
Veröffentlicht: (2025)
von: Tong, Haibo, et al.
Veröffentlicht: (2025)
MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark
von: Chen, Dongping, et al.
Veröffentlicht: (2024)
von: Chen, Dongping, et al.
Veröffentlicht: (2024)
The Predictive Value of Quantitative Flow Ratio and Its Derived Angiographic Microvascular Resistance for Restenosis Following Drug‐Coated Balloon Angioplasty
von: Chenhang Wang, et al.
Veröffentlicht: (2025)
von: Chenhang Wang, et al.
Veröffentlicht: (2025)
ProMMSearchAgent: A Generalizable Multimodal Search Agent Trained with Process-Oriented Rewards
von: Yan, Wentao, et al.
Veröffentlicht: (2026)
von: Yan, Wentao, et al.
Veröffentlicht: (2026)
DR-MMSearchAgent: Deepening Reasoning in Multimodal Search Agents
von: Wang, Shengqin, et al.
Veröffentlicht: (2026)
von: Wang, Shengqin, et al.
Veröffentlicht: (2026)
OThink-R1: Intrinsic Fast/Slow Thinking Mode Switching for Over-Reasoning Mitigation
von: Zhang, Shengjia, et al.
Veröffentlicht: (2025)
von: Zhang, Shengjia, et al.
Veröffentlicht: (2025)
SEAL: Can Saturated Benchmarks Be Revived by LLM-as-a-Meta-Judge?
von: Chen, Jiamin, et al.
Veröffentlicht: (2026)
von: Chen, Jiamin, et al.
Veröffentlicht: (2026)
Grounding and Enhancing Informativeness and Utility in Dataset Distillation
von: Wang, Shaobo, et al.
Veröffentlicht: (2026)
von: Wang, Shaobo, et al.
Veröffentlicht: (2026)
AutoPRM: Automating Procedural Supervision for Multi-Step Reasoning via Controllable Question Decomposition
von: Chen, Zhaorun, et al.
Veröffentlicht: (2024)
von: Chen, Zhaorun, et al.
Veröffentlicht: (2024)
Analyzing and Mitigating Object Hallucination in Large Vision-Language Models
von: Zhou, Yiyang, et al.
Veröffentlicht: (2023)
von: Zhou, Yiyang, et al.
Veröffentlicht: (2023)
Automated Data Curation for Robust Language Model Fine-Tuning
von: Chen, Jiuhai, et al.
Veröffentlicht: (2024)
von: Chen, Jiuhai, et al.
Veröffentlicht: (2024)
From Quantity to Quality: Boosting LLM Performance with Self-Guided Data Selection for Instruction Tuning
von: Li, Ming, et al.
Veröffentlicht: (2023)
von: Li, Ming, et al.
Veröffentlicht: (2023)
Particle-based Energetic Variational Inference
von: Wang, Yiwei, et al.
Veröffentlicht: (2020)
von: Wang, Yiwei, et al.
Veröffentlicht: (2020)
ClinSeekAgent: Automating Multimodal Evidence Seeking for Agentic Clinical Reasoning
von: Wu, Juncheng, et al.
Veröffentlicht: (2026)
von: Wu, Juncheng, et al.
Veröffentlicht: (2026)
Learning to Inject: Automated Prompt Injection via Reinforcement Learning
von: Chen, Xin, et al.
Veröffentlicht: (2026)
von: Chen, Xin, et al.
Veröffentlicht: (2026)
WWW.Serve: Interconnecting Global LLM Services through Decentralization
von: Wang, Huanyu, et al.
Veröffentlicht: (2026)
von: Wang, Huanyu, et al.
Veröffentlicht: (2026)
Improving Alignment in LVLMs with Debiased Self-Judgment
von: Yang, Sihan, et al.
Veröffentlicht: (2025)
von: Yang, Sihan, et al.
Veröffentlicht: (2025)
Can Large Language Models Improve the Adversarial Robustness of Graph Neural Networks?
von: Zhang, Zhongjian, et al.
Veröffentlicht: (2024)
von: Zhang, Zhongjian, et al.
Veröffentlicht: (2024)
Navigation as Attackers Wish? Towards Building Robust Embodied Agents under Federated Learning
von: Zhang, Yunchao, et al.
Veröffentlicht: (2022)
von: Zhang, Yunchao, et al.
Veröffentlicht: (2022)
ROVER: Benchmarking Reciprocal Cross-Modal Reasoning for Omnimodal Generation
von: Liang, Yongyuan, et al.
Veröffentlicht: (2025)
von: Liang, Yongyuan, et al.
Veröffentlicht: (2025)
Speculative Prefill: Turbocharging TTFT with Lightweight and Training-Free Token Importance Estimation
von: Liu, Jingyu, et al.
Veröffentlicht: (2025)
von: Liu, Jingyu, et al.
Veröffentlicht: (2025)
JoMA: Demystifying Multilayer Transformers via JOint Dynamics of MLP and Attention
von: Tian, Yuandong, et al.
Veröffentlicht: (2023)
von: Tian, Yuandong, et al.
Veröffentlicht: (2023)
CaughtCheating: Is Your MLLM a Good Cheating Detective? Exploring the Boundary of Visual Perception and Reasoning
von: Li, Ming, et al.
Veröffentlicht: (2025)
von: Li, Ming, et al.
Veröffentlicht: (2025)
BEVDilation: LiDAR-Centric Multi-Modal Fusion for 3D Object Detection
von: Zhang, Guowen, et al.
Veröffentlicht: (2025)
von: Zhang, Guowen, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Calibrated Self-Rewarding Vision Language Models
von: Zhou, Yiyang, et al.
Veröffentlicht: (2024) -
Aligning Modalities in Vision Large Language Models via Preference Fine-tuning
von: Zhou, Yiyang, et al.
Veröffentlicht: (2024) -
Fine-Grained Verifiers: Preference Modeling as Next-token Prediction in Vision-Language Alignment
von: Cui, Chenhang, et al.
Veröffentlicht: (2024) -
Verifiable Format Control for Large Language Model Generations
von: Wang, Zhaoyang, et al.
Veröffentlicht: (2025) -
Enhancing Visual-Language Modality Alignment in Large Vision Language Models via Self-Improvement
von: Wang, Xiyao, et al.
Veröffentlicht: (2024)