Unified Enhancement of the Generalization and Robustness of Language Models via Bi-Stage Optimization
Fuente:
arXiv
Saved in:
| Main Authors: | Sun, Yudao, Yin, Juan, Zhao, Juan, Zhang, Fan, Liu, Yongheng, Chen, Hongji |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
CE-RM: A Pointwise Generative Reward Model Optimized via Two-Stage Rollout and Unified Criteria
by: Hu, Xinyu, et al.
Published: (2026)
by: Hu, Xinyu, et al.
Published: (2026)
DataGen: Unified Synthetic Dataset Generation via Large Language Models
by: Huang, Yue, et al.
Published: (2024)
by: Huang, Yue, et al.
Published: (2024)
Improving the Robustness of Large Language Models via Consistency Alignment
by: Zhao, Yukun, et al.
Published: (2024)
by: Zhao, Yukun, et al.
Published: (2024)
Identity-Robust Language Model Generation via Content Integrity Preservation
by: Zhang, Miao, et al.
Published: (2026)
by: Zhang, Miao, et al.
Published: (2026)
Scalable Multi-Stage Influence Function for Large Language Models via Eigenvalue-Corrected Kronecker-Factored Parameterization
by: Bao, Yuntai, et al.
Published: (2025)
by: Bao, Yuntai, et al.
Published: (2025)
PR-CAD: Progressive Refinement for Unified Controllable and Faithful Text-to-CAD Generation with Large Language Models
by: An, Jiyuan, et al.
Published: (2026)
by: An, Jiyuan, et al.
Published: (2026)
Personalized Steering of Large Language Models: Versatile Steering Vectors Through Bi-directional Preference Optimization
by: Cao, Yuanpu, et al.
Published: (2024)
by: Cao, Yuanpu, et al.
Published: (2024)
SpikeLM: Towards General Spike-Driven Language Modeling via Elastic Bi-Spiking Mechanisms
by: Xing, Xingrun, et al.
Published: (2024)
by: Xing, Xingrun, et al.
Published: (2024)
Optimizing RLHF Training for Large Language Models with Stage Fusion
by: Zhong, Yinmin, et al.
Published: (2024)
by: Zhong, Yinmin, et al.
Published: (2024)
HarmonyGuard: Toward Safety and Utility in Web Agents via Adaptive Policy Enhancement and Dual-Objective Optimization
by: Chen, Yurun, et al.
Published: (2025)
by: Chen, Yurun, et al.
Published: (2025)
On Fairness of Unified Multimodal Large Language Model for Image Generation
by: Liu, Ming, et al.
Published: (2025)
by: Liu, Ming, et al.
Published: (2025)
Compiling by Proving: Language-Agnostic Automatic Optimization from Formal Semantics
by: Zhao, Jianhong, et al.
Published: (2025)
by: Zhao, Jianhong, et al.
Published: (2025)
KG-BiLM: Knowledge Graph Embedding via Bidirectional Language Models
by: Chen, Zirui, et al.
Published: (2025)
by: Chen, Zirui, et al.
Published: (2025)
QUILL: Quotation Generation Enhancement of Large Language Models
by: Xiao, Jin, et al.
Published: (2024)
by: Xiao, Jin, et al.
Published: (2024)
Marco-LLM: Bridging Languages via Massive Multilingual Training for Cross-Lingual Enhancement
by: Ming, Lingfeng, et al.
Published: (2024)
by: Ming, Lingfeng, et al.
Published: (2024)
Faithful Bi-Directional Model Steering via Distribution Matching and Distributed Interchange Interventions
by: Bao, Yuntai, et al.
Published: (2026)
by: Bao, Yuntai, et al.
Published: (2026)
Lens: Rethinking Multilingual Enhancement for Large Language Models
by: Zhao, Weixiang, et al.
Published: (2024)
by: Zhao, Weixiang, et al.
Published: (2024)
EComStage: Stage-wise and Orientation-specific Benchmarking for Large Language Models in E-commerce
by: Zhao, Kaiyan, et al.
Published: (2026)
by: Zhao, Kaiyan, et al.
Published: (2026)
Unifying Inference-Time Planning Language Generation
by: Kagitha, Prabhu Prakash, et al.
Published: (2025)
by: Kagitha, Prabhu Prakash, et al.
Published: (2025)
Characterizing Truthfulness in Large Language Model Generations with Local Intrinsic Dimension
by: Yin, Fan, et al.
Published: (2024)
by: Yin, Fan, et al.
Published: (2024)
On the Robustness of Editing Large Language Models
by: Ma, Xinbei, et al.
Published: (2024)
by: Ma, Xinbei, et al.
Published: (2024)
Robust and Scalable Model Editing for Large Language Models
by: Chen, Yingfa, et al.
Published: (2024)
by: Chen, Yingfa, et al.
Published: (2024)
UniConv: Unifying Retrieval and Response Generation for Large Language Models in Conversations
by: Mo, Fengran, et al.
Published: (2025)
by: Mo, Fengran, et al.
Published: (2025)
Bi'an: A Bilingual Benchmark and Model for Hallucination Detection in Retrieval-Augmented Generation
by: Jiang, Zhouyu, et al.
Published: (2025)
by: Jiang, Zhouyu, et al.
Published: (2025)
DRPruning: Efficient Large Language Model Pruning through Distributionally Robust Optimization
by: Deng, Hexuan, et al.
Published: (2024)
by: Deng, Hexuan, et al.
Published: (2024)
Transfer-Prompting: Enhancing Cross-Task Adaptation in Large Language Models via Dual-Stage Prompts Optimization
by: Chang, Yupeng, et al.
Published: (2025)
by: Chang, Yupeng, et al.
Published: (2025)
CCHall: A Novel Benchmark for Joint Cross-Lingual and Cross-Modal Hallucinations Detection in Large Language Models
by: Zhang, Yongheng, et al.
Published: (2025)
by: Zhang, Yongheng, et al.
Published: (2025)
R.U.Psycho? Robust Unified Psychometric Testing of Language Models
by: Schelb, Julian, et al.
Published: (2025)
by: Schelb, Julian, et al.
Published: (2025)
Breaking the Stage Barrier: A Novel Single-Stage Approach to Long Context Extension for Large Language Models
by: Lian, Haoran, et al.
Published: (2024)
by: Lian, Haoran, et al.
Published: (2024)
Derivative-Free Optimization for Low-Rank Adaptation in Large Language Models
by: Jin, Feihu, et al.
Published: (2024)
by: Jin, Feihu, et al.
Published: (2024)
Evaluation and Enhancement of Semantic Grounding in Large Vision-Language Models
by: Lu, Jiaying, et al.
Published: (2023)
by: Lu, Jiaying, et al.
Published: (2023)
SAGE: A Visual Language Model for Anomaly Detection via Fact Enhancement and Entropy-aware Alignment
by: Zang, Guoxin, et al.
Published: (2025)
by: Zang, Guoxin, et al.
Published: (2025)
Can We Edit Multimodal Large Language Models?
by: Cheng, Siyuan, et al.
Published: (2023)
by: Cheng, Siyuan, et al.
Published: (2023)
Debiasing Multimodal Large Language Models via Noise-Aware Preference Optimization
by: Zhang, Zefeng, et al.
Published: (2025)
by: Zhang, Zefeng, et al.
Published: (2025)
VecGlypher: Unified Vector Glyph Generation with Language Models
by: Huang, Xiaoke, et al.
Published: (2026)
by: Huang, Xiaoke, et al.
Published: (2026)
Data Quality Enhancement on the Basis of Diversity with Large Language Models for Text Classification: Uncovered, Difficult, and Noisy
by: Zeng, Min, et al.
Published: (2024)
by: Zeng, Min, et al.
Published: (2024)
Chats-Grid: An Iterative Retrieval Q&A Optimization Scheme Leveraging Large Model and Retrieval Enhancement Generation in smart grid
by: Li, Yunfeng, et al.
Published: (2025)
by: Li, Yunfeng, et al.
Published: (2025)
BiMol-Diff: A Unified Diffusion Framework for Molecular Generation and Captioning
by: Shahane, Aditya Hemant, et al.
Published: (2026)
by: Shahane, Aditya Hemant, et al.
Published: (2026)
ViTCoT: Video-Text Interleaved Chain-of-Thought for Boosting Video Understanding in Large Language Models
by: Zhang, Yongheng, et al.
Published: (2025)
by: Zhang, Yongheng, et al.
Published: (2025)
Mutual Enhancement of Large Language and Reinforcement Learning Models through Bi-Directional Feedback Mechanisms: A Planning Case Study
by: Gu, Shangding
Published: (2024)
by: Gu, Shangding
Published: (2024)
Similar Items
-
CE-RM: A Pointwise Generative Reward Model Optimized via Two-Stage Rollout and Unified Criteria
by: Hu, Xinyu, et al.
Published: (2026) -
DataGen: Unified Synthetic Dataset Generation via Large Language Models
by: Huang, Yue, et al.
Published: (2024) -
Improving the Robustness of Large Language Models via Consistency Alignment
by: Zhao, Yukun, et al.
Published: (2024) -
Identity-Robust Language Model Generation via Content Integrity Preservation
by: Zhang, Miao, et al.
Published: (2026) -
Scalable Multi-Stage Influence Function for Large Language Models via Eigenvalue-Corrected Kronecker-Factored Parameterization
by: Bao, Yuntai, et al.
Published: (2025)