MR-UIE: Multi-Perspective Reasoning with Reinforcement Learning for Universal Information Extraction
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Li, Zhongqiu, Wang, Shiquan, Fang, Ruiyu, Bao, Mengjiao, Wu, Zhenhe, Song, Shuangyong, Li, Yongxiang, He, Zhongjiang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Emotional Support with LLM-based Empathetic Dialogue Generation
von: Wang, Shiquan, et al.
Veröffentlicht: (2025)
von: Wang, Shiquan, et al.
Veröffentlicht: (2025)
Multi-Intent Spoken Language Understanding: Methods, Trends, and Challenges
von: Wu, Di, et al.
Veröffentlicht: (2025)
von: Wu, Di, et al.
Veröffentlicht: (2025)
RB-SQL: A Retrieval-based LLM Framework for Text-to-SQL
von: Wu, Zhenhe, et al.
Veröffentlicht: (2024)
von: Wu, Zhenhe, et al.
Veröffentlicht: (2024)
TableZoomer: A Collaborative Agent Framework for Large-scale Table Question Answering
von: Xiong, Sishi, et al.
Veröffentlicht: (2025)
von: Xiong, Sishi, et al.
Veröffentlicht: (2025)
Table-R1: Region-based Reinforcement Learning for Table Understanding
von: Wu, Zhenhe, et al.
Veröffentlicht: (2025)
von: Wu, Zhenhe, et al.
Veröffentlicht: (2025)
Towards Robustness and Diversity: Continual Learning in Dialog Generation with Text-Mixup and Batch Nuclear-Norm Maximization
von: Wang, Zihan, et al.
Veröffentlicht: (2024)
von: Wang, Zihan, et al.
Veröffentlicht: (2024)
Stop Rewarding Hallucinated Steps: Faithfulness-Aware Step-Level Reinforcement Learning for Small Reasoning Models
von: Nie, Shuo, et al.
Veröffentlicht: (2026)
von: Nie, Shuo, et al.
Veröffentlicht: (2026)
ProUIE: A Macro-to-Micro Progressive Learning Method for LLM-based Universal Information Extraction
von: Liu, Wenda, et al.
Veröffentlicht: (2026)
von: Liu, Wenda, et al.
Veröffentlicht: (2026)
Dynamic Knowledge Fusion for Multi-Domain Dialogue State Tracking
von: Su, Haoxiang, et al.
Veröffentlicht: (2026)
von: Su, Haoxiang, et al.
Veröffentlicht: (2026)
YAYI-UIE: A Chat-Enhanced Instruction Tuning Framework for Universal Information Extraction
von: Xiao, Xinglin, et al.
Veröffentlicht: (2023)
von: Xiao, Xinglin, et al.
Veröffentlicht: (2023)
ReasonTabQA: A Comprehensive Benchmark for Table Question Answering from Real World Industrial Scenarios
von: Pan, Changzai, et al.
Veröffentlicht: (2026)
von: Pan, Changzai, et al.
Veröffentlicht: (2026)
Introducing Visual Scenes and Reasoning: A More Realistic Benchmark for Spoken Language Understanding
von: Wu, Di, et al.
Veröffentlicht: (2025)
von: Wu, Di, et al.
Veröffentlicht: (2025)
UniARM: Towards a Unified Autoregressive Reward Model for Multi-Objective Test-Time Alignment
von: Xie, Hongyan, et al.
Veröffentlicht: (2026)
von: Xie, Hongyan, et al.
Veröffentlicht: (2026)
Prompt-Level Reward Specifications for Open-Ended Post-Training
von: Weng, Zijun, et al.
Veröffentlicht: (2026)
von: Weng, Zijun, et al.
Veröffentlicht: (2026)
ChatUIE: Exploring Chat-based Unified Information Extraction using Large Language Models
von: Xu, Jun, et al.
Veröffentlicht: (2024)
von: Xu, Jun, et al.
Veröffentlicht: (2024)
A benchmark for joint dialogue satisfaction, emotion recognition, and emotion state transition prediction
von: Bian, Jing, et al.
Veröffentlicht: (2026)
von: Bian, Jing, et al.
Veröffentlicht: (2026)
T2R-bench: A Benchmark for Generating Article-Level Reports from Real World Industrial Tables
von: Zhang, Jie, et al.
Veröffentlicht: (2025)
von: Zhang, Jie, et al.
Veröffentlicht: (2025)
TableReasoner: Advancing Table Reasoning Framework with Large Language Models
von: Xiong, Sishi, et al.
Veröffentlicht: (2025)
von: Xiong, Sishi, et al.
Veröffentlicht: (2025)
Mitigating Spurious Correlations Between Question and Answer via Chain-of-Thought Correctness Perception Distillation
von: Xie, Hongyan, et al.
Veröffentlicht: (2025)
von: Xie, Hongyan, et al.
Veröffentlicht: (2025)
52B to 1T: Lessons Learned via Tele-FLM Series
von: Li, Xiang, et al.
Veröffentlicht: (2024)
von: Li, Xiang, et al.
Veröffentlicht: (2024)
GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness
von: Chen, Hongjie, et al.
Veröffentlicht: (2025)
von: Chen, Hongjie, et al.
Veröffentlicht: (2025)
TCNN: Triple Convolutional Neural Network Models for Retrieval-based Question Answering System in E-commerce
von: Song, Shuangyong, et al.
Veröffentlicht: (2020)
von: Song, Shuangyong, et al.
Veröffentlicht: (2020)
Adaptive Ordered Information Extraction with Deep Reinforcement Learning
von: Huang, Wenhao, et al.
Veröffentlicht: (2023)
von: Huang, Wenhao, et al.
Veröffentlicht: (2023)
Tele-FLM Technical Report
von: Li, Xiang, et al.
Veröffentlicht: (2024)
von: Li, Xiang, et al.
Veröffentlicht: (2024)
BoSS: Beyond-Semantic Speech
von: Wang, Qing, et al.
Veröffentlicht: (2025)
von: Wang, Qing, et al.
Veröffentlicht: (2025)
Offline Reinforcement Learning for LLM Multi-Step Reasoning
von: Wang, Huaijie, et al.
Veröffentlicht: (2024)
von: Wang, Huaijie, et al.
Veröffentlicht: (2024)
TeleChat Technical Report
von: He, Zhongjiang, et al.
Veröffentlicht: (2024)
von: He, Zhongjiang, et al.
Veröffentlicht: (2024)
Label Drop for Multi-Aspect Relation Modeling in Universal Information Extraction
von: Yang, Lu, et al.
Veröffentlicht: (2025)
von: Yang, Lu, et al.
Veröffentlicht: (2025)
GraphIF: Enhancing Multi-Turn Instruction Following for Large Language Models with Relation Graph Prompt
von: Li, Zhenhe, et al.
Veröffentlicht: (2025)
von: Li, Zhenhe, et al.
Veröffentlicht: (2025)
Not All Thoughts are Generated Equal: Efficient LLM Reasoning via Multi-Turn Reinforcement Learning
von: Ning, Yansong, et al.
Veröffentlicht: (2025)
von: Ning, Yansong, et al.
Veröffentlicht: (2025)
Chain-of-Lure: A Universal Jailbreak Attack Framework using Unconstrained Synthetic Narratives
von: Chang, Wenhan, et al.
Veröffentlicht: (2025)
von: Chang, Wenhan, et al.
Veröffentlicht: (2025)
Teaching LLM to Reason: Reinforcement Learning from Algorithmic Problems without Code
von: Bao, Keqin, et al.
Veröffentlicht: (2025)
von: Bao, Keqin, et al.
Veröffentlicht: (2025)
Technical Report of TeleChat2, TeleChat2.5 and T1
von: Wang, Zihan, et al.
Veröffentlicht: (2025)
von: Wang, Zihan, et al.
Veröffentlicht: (2025)
LLMs are not Zero-Shot Reasoners for Biomedical Information Extraction
von: Nagar, Aishik, et al.
Veröffentlicht: (2024)
von: Nagar, Aishik, et al.
Veröffentlicht: (2024)
Faithful-MR1: Faithful Multimodal Reasoning via Anchoring and Reinforcing Visual Attention
von: Tian, Changyuan, et al.
Veröffentlicht: (2026)
von: Tian, Changyuan, et al.
Veröffentlicht: (2026)
Not All Tokens Learn Alike: Attention Entropy Reveals Heterogeneous Signals in RL Reasoning
von: Li, Gengyang, et al.
Veröffentlicht: (2026)
von: Li, Gengyang, et al.
Veröffentlicht: (2026)
Adaptive Reinforcement Learning Planning: Harnessing Large Language Models for Complex Information Extraction
von: Ding, Zepeng, et al.
Veröffentlicht: (2024)
von: Ding, Zepeng, et al.
Veröffentlicht: (2024)
Schema as Parameterized Tools for Universal Information Extraction
von: Liang, Sheng, et al.
Veröffentlicht: (2025)
von: Liang, Sheng, et al.
Veröffentlicht: (2025)
Reasoning-Table: Exploring Reinforcement Learning for Table Reasoning
von: Lei, Fangyu, et al.
Veröffentlicht: (2025)
von: Lei, Fangyu, et al.
Veröffentlicht: (2025)
Native Parallel Reasoner: Reasoning in Parallelism via Self-Distilled Reinforcement Learning
von: Wu, Tong, et al.
Veröffentlicht: (2025)
von: Wu, Tong, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Emotional Support with LLM-based Empathetic Dialogue Generation
von: Wang, Shiquan, et al.
Veröffentlicht: (2025) -
Multi-Intent Spoken Language Understanding: Methods, Trends, and Challenges
von: Wu, Di, et al.
Veröffentlicht: (2025) -
RB-SQL: A Retrieval-based LLM Framework for Text-to-SQL
von: Wu, Zhenhe, et al.
Veröffentlicht: (2024) -
TableZoomer: A Collaborative Agent Framework for Large-scale Table Question Answering
von: Xiong, Sishi, et al.
Veröffentlicht: (2025) -
Table-R1: Region-based Reinforcement Learning for Table Understanding
von: Wu, Zhenhe, et al.
Veröffentlicht: (2025)