Source-Grounded Semantic Reinforcement Learning for Low-Resource Target-Language Generation
Fuente:
arXiv
Saved in:
| Main Authors: | Su, Zeli, Zhang, Ziyin, Pan, Zewei, Liu, Zhou, Huang, Dingcheng, Li, Dehan, Xu, Zhankai, Zheng, Longfei, Zhang, Xiaolu, Zhou, Jun, Zhang, Wentao |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Reinforcement Learning with Semantic Rewards Enables Low-Resource Language Expansion without Alignment Tax
by: Su, Zeli, et al.
Published: (2026)
by: Su, Zeli, et al.
Published: (2026)
The Curse of Helpfulness: Inverse Scaling Law in Robustness to Distractor Instructions via DistractionIF
by: Su, Zeli, et al.
Published: (2026)
by: Su, Zeli, et al.
Published: (2026)
SHRP: Specialized Head Routing and Pruning for Efficient Encoder Compression
by: Su, Zeli, et al.
Published: (2025)
by: Su, Zeli, et al.
Published: (2025)
Multilingual Encoder Knows more than You Realize: Shared Weights Pretraining for Extremely Low-Resource Languages
by: Su, Zeli, et al.
Published: (2025)
by: Su, Zeli, et al.
Published: (2025)
FTibSuite: A Comprehensive Resource Suite for Tibetan Vision-Language Modeling
by: Xu, Guixian, et al.
Published: (2026)
by: Xu, Guixian, et al.
Published: (2026)
CMHG: A Dataset and Benchmark for Headline Generation of Minority Languages in China
by: Xu, Guixian, et al.
Published: (2025)
by: Xu, Guixian, et al.
Published: (2025)
Deterministic Differentiable Structured Pruning for Large Language Models
by: Huang, Weiyu, et al.
Published: (2026)
by: Huang, Weiyu, et al.
Published: (2026)
RelMap: Enhancing Online Map Construction with Class-Aware Spatial Relation and Semantic Priors
by: Cai, Tianhui, et al.
Published: (2025)
by: Cai, Tianhui, et al.
Published: (2025)
Fine-Grained Zero-Shot Composed Image Retrieval with Complementary Visual-Semantic Integration
by: Ye, Yongcong, et al.
Published: (2026)
by: Ye, Yongcong, et al.
Published: (2026)
AutoVLA: A Vision-Language-Action Model for End-to-End Autonomous Driving with Adaptive Reasoning and Reinforcement Fine-Tuning
by: Zhou, Zewei, et al.
Published: (2025)
by: Zhou, Zewei, et al.
Published: (2025)
EfficientDet ‐ EdgeUAV : A Multi‐Scale Fusion Architecture for Target Detection in UAV Imagery With Edge Computing Optimization
by: Chang Su, et al.
Published: (2025)
by: Chang Su, et al.
Published: (2025)
Understanding and Mitigating Overrefusal in LLMs from an Unveiling Perspective of Safety Decision Boundary
by: Pan, Licheng, et al.
Published: (2025)
by: Pan, Licheng, et al.
Published: (2025)
Effective and Efficient Masked Image Generation Models
by: You, Zebin, et al.
Published: (2025)
by: You, Zebin, et al.
Published: (2025)
MDG: Masked Denoising Generation for Multi-Agent Behavior Modeling in Traffic Environments
by: Huang, Zhiyu, et al.
Published: (2025)
by: Huang, Zhiyu, et al.
Published: (2025)
Exponential Topology-enabled Scalable Communication in Multi-agent Reinforcement Learning
by: Li, Xinran, et al.
Published: (2025)
by: Li, Xinran, et al.
Published: (2025)
TRACER: Turn-level Regret Matching with Inner Reinforcement Credit for Cooperative Multi-LLM Reasoning
by: Li, Chusen, et al.
Published: (2026)
by: Li, Chusen, et al.
Published: (2026)
Bridge-Coder: Unlocking LLMs' Potential to Overcome Language Gaps in Low-Resource Code
by: Zhang, Jipeng, et al.
Published: (2024)
by: Zhang, Jipeng, et al.
Published: (2024)
Perceive What Matters: Relevance-Driven Scheduling for Multimodal Streaming Perception
by: Huang, Dingcheng, et al.
Published: (2026)
by: Huang, Dingcheng, et al.
Published: (2026)
Relevance-driven Decision Making for Safer and More Efficient Human Robot Collaboration
by: Zhang, Xiaotong, et al.
Published: (2024)
by: Zhang, Xiaotong, et al.
Published: (2024)
$PD^3F$: A Pluggable and Dynamic DoS-Defense Framework Against Resource Consumption Attacks Targeting Large Language Models
by: Zhang, Yuanhe, et al.
Published: (2025)
by: Zhang, Yuanhe, et al.
Published: (2025)
Controllable Unlearning for Image-to-Image Generative Models via $\varepsilon$-Constrained Optimization
by: Feng, Xiaohua, et al.
Published: (2024)
by: Feng, Xiaohua, et al.
Published: (2024)
Deep Reinforcement Learning-Based Resource Allocation for Hybrid Bit and Generative Semantic Communications in Space-Air-Ground Integrated Networks
by: Huang, Chong, et al.
Published: (2024)
by: Huang, Chong, et al.
Published: (2024)
GALLa: Graph Aligned Large Language Models for Improved Source Code Understanding
by: Zhang, Ziyin, et al.
Published: (2024)
by: Zhang, Ziyin, et al.
Published: (2024)
Large Vision Model-Guided Masked Low-Rank Approximation for Ground-Roll Attenuation
by: Liao, Jiacheng, et al.
Published: (2026)
by: Liao, Jiacheng, et al.
Published: (2026)
Reinforcing Few-step Generators via Reward-Tilted Distribution Matching
by: Huang, Yushi, et al.
Published: (2026)
by: Huang, Yushi, et al.
Published: (2026)
Empowering Sequential Recommendation from Collaborative Signals and Semantic Relatedness
by: Cheng, Mingyue, et al.
Published: (2024)
by: Cheng, Mingyue, et al.
Published: (2024)
Active Testing of Large Language Models via Approximate Neyman Allocation
by: Liu, Zeli, et al.
Published: (2026)
by: Liu, Zeli, et al.
Published: (2026)
Efficient Low-Resource Language Adaptation via Multi-Source Dynamic Logit Fusion
by: Zhang, Chen, et al.
Published: (2026)
by: Zhang, Chen, et al.
Published: (2026)
Rhodium‐Catalyzed Pyridylation of Alkynamides with Pyridylboronic Acids: A Route to Functionalized Enamides
by: Huilong Zhu, et al.
Published: (2024)
by: Huilong Zhu, et al.
Published: (2024)
Bifurcation Dynamics of a Pest Management System With Cooperative Predation, Fear Effect, and Impulsive Density‐Dependent Nonlinear Effects
by: Zeli Zhou, et al.
Published: (2026)
by: Zeli Zhou, et al.
Published: (2026)
MEEA: Mere Exposure Effect-Driven Confrontational Optimization for LLM Jailbreaking
by: Zhang, Jianyi, et al.
Published: (2025)
by: Zhang, Jianyi, et al.
Published: (2025)
FL-PLAS: Federated Learning with Partial Layer Aggregation for Backdoor Defense Against High-Ratio Malicious Clients
by: Zhang, Jianyi, et al.
Published: (2025)
by: Zhang, Jianyi, et al.
Published: (2025)
General Phrase Debiaser: Debiasing Masked Language Models at a Multi-Token Level
by: Shi, Bingkang, et al.
Published: (2023)
by: Shi, Bingkang, et al.
Published: (2023)
Multi-tracklet Tracking for Generic Targets with Adaptive Detection Clustering
by: Wu, Zewei, et al.
Published: (2025)
by: Wu, Zewei, et al.
Published: (2025)
Massively Multilingual Text Translation For Low-Resource Languages
by: Zhou, Zhong
Published: (2024)
by: Zhou, Zhong
Published: (2024)
Extending AI for Research to the Humanities: A Multi-Agent Framework for Evidence-Grounded Scholarship
by: Pan, Yating, et al.
Published: (2026)
by: Pan, Yating, et al.
Published: (2026)
IndoSafety: Culturally Grounded Safety for LLMs in Indonesian Languages
by: Azmi, Muhammad Falensi, et al.
Published: (2025)
by: Azmi, Muhammad Falensi, et al.
Published: (2025)
Predicting Human Chess Moves: An AI Assisted Analysis of Chess Games Using Skill-group Specific n-gram Language Models
by: Zhong, Daren, et al.
Published: (2025)
by: Zhong, Daren, et al.
Published: (2025)
IVLMap: Instance-Aware Visual Language Grounding for Consumer Robot Navigation
by: Huang, Jiacui, et al.
Published: (2024)
by: Huang, Jiacui, et al.
Published: (2024)
Paper2SysArch: Structure-Constrained System Architecture Generation from Scientific Papers
by: Guo, Ziyi, et al.
Published: (2025)
by: Guo, Ziyi, et al.
Published: (2025)
Similar Items
-
Reinforcement Learning with Semantic Rewards Enables Low-Resource Language Expansion without Alignment Tax
by: Su, Zeli, et al.
Published: (2026) -
The Curse of Helpfulness: Inverse Scaling Law in Robustness to Distractor Instructions via DistractionIF
by: Su, Zeli, et al.
Published: (2026) -
SHRP: Specialized Head Routing and Pruning for Efficient Encoder Compression
by: Su, Zeli, et al.
Published: (2025) -
Multilingual Encoder Knows more than You Realize: Shared Weights Pretraining for Extremely Low-Resource Languages
by: Su, Zeli, et al.
Published: (2025) -
FTibSuite: A Comprehensive Resource Suite for Tibetan Vision-Language Modeling
by: Xu, Guixian, et al.
Published: (2026)