Towards Self-Robust LLMs: Intrinsic Prompt Noise Resistance via CoIPO
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Xin, Li, Letian, Wuerkaixi, Abudukelimu, Cheng, Xuxin, Liu, Cao, Zeng, Ke, Cai, Xunliang, Jiang, Wenyuan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AutothinkRAG: Complexity-Aware Control of Retrieval-Augmented Reasoning for Image-Text Interaction
par: Yang, Jiashu, et autres
Publié: (2026)
par: Yang, Jiashu, et autres
Publié: (2026)
Breaking the Illusion: When Positive Meets Negative in Multimodal Decoding
par: Jiang, Yubo, et autres
Publié: (2026)
par: Jiang, Yubo, et autres
Publié: (2026)
V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization
par: Jiang, Yubo, et autres
Publié: (2026)
par: Jiang, Yubo, et autres
Publié: (2026)
Global Context or Local Detail? Adaptive Visual Grounding for Hallucination Mitigation
par: Jiang, Yubo, et autres
Publié: (2026)
par: Jiang, Yubo, et autres
Publié: (2026)
Reflecting Twice before Speaking with Empathy: Self-Reflective Alternating Inference for Empathy-Aware End-to-End Spoken Dialogue
par: Jia, Yuhang, et autres
Publié: (2026)
par: Jia, Yuhang, et autres
Publié: (2026)
DIFFA-2: A Practical Diffusion Large Language Model for General Audio Understanding
par: Zhou, Jiaming, et autres
Publié: (2026)
par: Zhou, Jiaming, et autres
Publié: (2026)
Intrinsic Self-Correction in LLMs: Towards Explainable Prompting via Mechanistic Interpretability
par: Lee, Yu-Ting, et autres
Publié: (2025)
par: Lee, Yu-Ting, et autres
Publié: (2025)
Beyond Similarity: Personalized Federated Recommendation with Composite Aggregation
par: Zhang, Honglei, et autres
Publié: (2024)
par: Zhang, Honglei, et autres
Publié: (2024)
Silo-Bench: A Scalable Environment for Evaluating Distributed Coordination in Multi-Agent LLM Systems
par: Zhang, Yuzhe, et autres
Publié: (2026)
par: Zhang, Yuzhe, et autres
Publié: (2026)
Balancing Similarity and Complementarity for Federated Learning
par: Yan, Kunda, et autres
Publié: (2024)
par: Yan, Kunda, et autres
Publié: (2024)
SIRI: Self-Internalizing Reinforcement Learning with Intrinsic Skills for LLM Agent Training
par: He, Zhongyu, et autres
Publié: (2026)
par: He, Zhongyu, et autres
Publié: (2026)
Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement
par: Ding, Peng, et autres
Publié: (2025)
par: Ding, Peng, et autres
Publié: (2025)
Learning or Self-aligning? Rethinking Instruction Fine-tuning
par: Ren, Mengjie, et autres
Publié: (2024)
par: Ren, Mengjie, et autres
Publié: (2024)
Too Consistent to Detect: A Study of Self-Consistent Errors in LLMs
par: Tan, Hexiang, et autres
Publié: (2025)
par: Tan, Hexiang, et autres
Publié: (2025)
Don't Half-listen: Capturing Key-part Information in Continual Instruction Tuning
par: He, Yongquan, et autres
Publié: (2024)
par: He, Yongquan, et autres
Publié: (2024)
IPO: Interpretable Prompt Optimization for Vision-Language Models
par: Du, Yingjun, et autres
Publié: (2024)
par: Du, Yingjun, et autres
Publié: (2024)
Accurate Forgetting for Heterogeneous Federated Continual Learning
par: Wuerkaixi, Abudukelimu, et autres
Publié: (2025)
par: Wuerkaixi, Abudukelimu, et autres
Publié: (2025)
Decentralized Dynamic Cooperation of Personalized Models for Federated Continual Learning
par: Yang, Danni, et autres
Publié: (2025)
par: Yang, Danni, et autres
Publié: (2025)
Learning to Act under Noise: Enhancing Agent Robustness via Noisy Environments
par: Chen, Yuxin, et autres
Publié: (2026)
par: Chen, Yuxin, et autres
Publié: (2026)
CountLLM: Towards Generalizable Repetitive Action Counting via Large Language Model
par: Yao, Ziyu, et autres
Publié: (2025)
par: Yao, Ziyu, et autres
Publié: (2025)
FD2Talk: Towards Generalized Talking Head Generation with Facial Decoupled Diffusion Model
par: Yao, Ziyu, et autres
Publié: (2024)
par: Yao, Ziyu, et autres
Publié: (2024)
Understanding the Dark Side of LLMs' Intrinsic Self-Correction
par: Zhang, Qingjie, et autres
Publié: (2024)
par: Zhang, Qingjie, et autres
Publié: (2024)
S^3cMath: Spontaneous Step-level Self-correction Makes Large Language Models Better Mathematical Reasoners
par: Yan, Yuchen, et autres
Publié: (2024)
par: Yan, Yuchen, et autres
Publié: (2024)
Towards LLMs Robustness to Changes in Prompt Format Styles
par: Ngweta, Lilian, et autres
Publié: (2025)
par: Ngweta, Lilian, et autres
Publié: (2025)
Towards Spoken Language Understanding via Multi-level Multi-grained Contrastive Learning
par: Cheng, Xuxin, et autres
Publié: (2024)
par: Cheng, Xuxin, et autres
Publié: (2024)
Attention is All You Need to Defend Against Indirect Prompt Injection Attacks in LLMs
par: Zhong, Yinan, et autres
Publié: (2025)
par: Zhong, Yinan, et autres
Publié: (2025)
Fingerprinting LLMs via Prompt Injection
par: Hu, Yuepeng, et autres
Publié: (2025)
par: Hu, Yuepeng, et autres
Publié: (2025)
IPO Breaking Anomaly in China: A Prospectus‐Based Textual Analysis
par: Xundi Diao, et autres
Publié: (2025)
par: Xundi Diao, et autres
Publié: (2025)
Intrinsically Thermally Robust Nanocrystals for High‐Flux Photonics
par: Xiachu Xiao, et autres
Publié: (2026)
par: Xiachu Xiao, et autres
Publié: (2026)
On the Intrinsic Self-Correction Capability of LLMs: Uncertainty and Latent Concept
par: Liu, Guangliang, et autres
Publié: (2024)
par: Liu, Guangliang, et autres
Publié: (2024)
Boosting Self-Supervised Tracking with Contextual Prompts and Noise Learning
par: Zheng, Yaozong, et autres
Publié: (2026)
par: Zheng, Yaozong, et autres
Publié: (2026)
Reasoner for Real-World Event Detection: Scaling Reinforcement Learning via Adaptive Perplexity-Aware Sampling Strategy
par: Zhang, Xiaoyun, et autres
Publié: (2025)
par: Zhang, Xiaoyun, et autres
Publié: (2025)
Determinants of IPO Overpricing
par: Jacqueline Rossovski, et autres
Publié: (2024)
par: Jacqueline Rossovski, et autres
Publié: (2024)
DeCoOp: Robust Prompt Tuning with Out-of-Distribution Detection
par: Zhou, Zhi, et autres
Publié: (2024)
par: Zhou, Zhi, et autres
Publié: (2024)
SWAP: Towards Copyright Auditing of Soft Prompts via Sequential Watermarking
par: Yang, Wenyuan, et autres
Publié: (2025)
par: Yang, Wenyuan, et autres
Publié: (2025)
VerIPO: Cultivating Long Reasoning in Video-LLMs via Verifier-Gudied Iterative Policy Optimization
par: Li, Yunxin, et autres
Publié: (2025)
par: Li, Yunxin, et autres
Publié: (2025)
Enhancing LLMs via High-Knowledge Data Selection
par: Duan, Feiyu, et autres
Publié: (2025)
par: Duan, Feiyu, et autres
Publié: (2025)
Lost in the Noise: How IPO Suspensions Distract Venture Capitalists From Monitoring Portfolio Firms
par: Ao Li, et autres
Publié: (2026)
par: Ao Li, et autres
Publié: (2026)
Towards Robust Image Stitching: An Adaptive Resistance Learning against Compatible Attacks
par: Jiang, Zhiying, et autres
Publié: (2024)
par: Jiang, Zhiying, et autres
Publié: (2024)
Intrinsic Gradient Suppression for Label-Noise Prompt Tuning in Vision-Language Models
par: Li, Jiayu, et autres
Publié: (2026)
par: Li, Jiayu, et autres
Publié: (2026)
Documents similaires
-
AutothinkRAG: Complexity-Aware Control of Retrieval-Augmented Reasoning for Image-Text Interaction
par: Yang, Jiashu, et autres
Publié: (2026) -
Breaking the Illusion: When Positive Meets Negative in Multimodal Decoding
par: Jiang, Yubo, et autres
Publié: (2026) -
V-tableR1: Process-Supervised Multimodal Table Reasoning with Critic-Guided Policy Optimization
par: Jiang, Yubo, et autres
Publié: (2026) -
Global Context or Local Detail? Adaptive Visual Grounding for Hallucination Mitigation
par: Jiang, Yubo, et autres
Publié: (2026) -
Reflecting Twice before Speaking with Empathy: Self-Reflective Alternating Inference for Empathy-Aware End-to-End Spoken Dialogue
par: Jia, Yuhang, et autres
Publié: (2026)