Learning Structured Reasoning via Tractable Trajectory Control
Fuente:
arXiv
Salvato in:
| Autori principali: | Kung, Po-Nien, Yang, Zhen, Luo, Jeffrey, Yang, Cheng-Fu, Deng, Haikang, Dou, Zi-Yi, Yang, Yinfei, Peng, Nanyun, Gan, Zhe, Chang, Kai-Wei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Decoupling Task-Solving and Output Formatting in LLM Generation
di: Deng, Haikang, et al.
Pubblicazione: (2025)
di: Deng, Haikang, et al.
Pubblicazione: (2025)
GenEARL: A Training-Free Generative Framework for Multimodal Event Argument Role Labeling
di: Bansal, Hritik, et al.
Pubblicazione: (2024)
di: Bansal, Hritik, et al.
Pubblicazione: (2024)
Adaptable Logical Control for Large Language Models
di: Zhang, Honghua, et al.
Pubblicazione: (2024)
di: Zhang, Honghua, et al.
Pubblicazione: (2024)
STAR: Boosting Low-Resource Information Extraction by Structure-to-Text Data Generation with Large Language Models
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2023)
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2023)
Re-ReST: Reflection-Reinforced Self-Training for Language Agents
di: Dou, Zi-Yi, et al.
Pubblicazione: (2024)
di: Dou, Zi-Yi, et al.
Pubblicazione: (2024)
Improving Event Definition Following For Zero-Shot Event Detection
di: Cai, Zefan, et al.
Pubblicazione: (2024)
di: Cai, Zefan, et al.
Pubblicazione: (2024)
Medical Vision-Language Pre-Training for Brain Abnormalities
di: Monajatipoor, Masoud, et al.
Pubblicazione: (2024)
di: Monajatipoor, Masoud, et al.
Pubblicazione: (2024)
Reward-Augmented Decoding: Efficient Controlled Text Generation With a Unidirectional Reward Model
di: Deng, Haikang, et al.
Pubblicazione: (2023)
di: Deng, Haikang, et al.
Pubblicazione: (2023)
DialectGen: Benchmarking and Improving Dialect Robustness in Multimodal Generation
di: Zhou, Yu, et al.
Pubblicazione: (2025)
di: Zhou, Yu, et al.
Pubblicazione: (2025)
LLM-REVal: Can We Trust LLM Reviewers Yet?
di: Li, Rui, et al.
Pubblicazione: (2025)
di: Li, Rui, et al.
Pubblicazione: (2025)
How Easy is It to Fool Your Multimodal LLMs? An Empirical Analysis on Deceptive Prompts
di: Qian, Yusu, et al.
Pubblicazione: (2024)
di: Qian, Yusu, et al.
Pubblicazione: (2024)
VALOR-EVAL: Holistic Coverage and Faithfulness Evaluation of Large Vision-Language Models
di: Qiu, Haoyi, et al.
Pubblicazione: (2024)
di: Qiu, Haoyi, et al.
Pubblicazione: (2024)
UltraCUA: A Foundation Model for Computer Use Agents with Hybrid Action
di: Yang, Yuhao, et al.
Pubblicazione: (2025)
di: Yang, Yuhao, et al.
Pubblicazione: (2025)
Guiding Instruction-based Image Editing via Multimodal Large Language Models
di: Fu, Tsu-Jui, et al.
Pubblicazione: (2023)
di: Fu, Tsu-Jui, et al.
Pubblicazione: (2023)
Matryoshka Query Transformer for Large Vision-Language Models
di: Hu, Wenbo, et al.
Pubblicazione: (2024)
di: Hu, Wenbo, et al.
Pubblicazione: (2024)
VaPR -- Vision-language Preference alignment for Reasoning
di: Wadhawan, Rohan, et al.
Pubblicazione: (2025)
di: Wadhawan, Rohan, et al.
Pubblicazione: (2025)
SafeWorld: Geo-Diverse Safety Alignment
di: Yin, Da, et al.
Pubblicazione: (2024)
di: Yin, Da, et al.
Pubblicazione: (2024)
UniVG: A Generalist Diffusion Model for Unified Image Generation and Editing
di: Fu, Tsu-Jui, et al.
Pubblicazione: (2025)
di: Fu, Tsu-Jui, et al.
Pubblicazione: (2025)
Policy Frameworks for Transparent Chain-of-Thought Reasoning in Large Language Models
di: Chen, Yihang, et al.
Pubblicazione: (2025)
di: Chen, Yihang, et al.
Pubblicazione: (2025)
Improve Vision Language Model Chain-of-thought Reasoning
di: Zhang, Ruohong, et al.
Pubblicazione: (2024)
di: Zhang, Ruohong, et al.
Pubblicazione: (2024)
Ferret-UI Lite: Lessons from Building Small On-Device GUI Agents
di: Yang, Zhen, et al.
Pubblicazione: (2025)
di: Yang, Zhen, et al.
Pubblicazione: (2025)
LLM-A*: Large Language Model Enhanced Incremental Heuristic Search on Path Planning
di: Meng, Silin, et al.
Pubblicazione: (2024)
di: Meng, Silin, et al.
Pubblicazione: (2024)
Unlocking Exocentric Video-Language Data for Egocentric Video Representation Learning
di: Dou, Zi-Yi, et al.
Pubblicazione: (2024)
di: Dou, Zi-Yi, et al.
Pubblicazione: (2024)
MIDDAG: Where Does Our News Go? Investigating Information Diffusion via Community-Level Information Pathways
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2023)
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2023)
MRAG-Bench: Vision-Centric Evaluation for Retrieval-Augmented Multimodal Models
di: Hu, Wenbo, et al.
Pubblicazione: (2024)
di: Hu, Wenbo, et al.
Pubblicazione: (2024)
ConTextual: Evaluating Context-Sensitive Text-Rich Visual Reasoning in Large Multimodal Models
di: Wadhawan, Rohan, et al.
Pubblicazione: (2024)
di: Wadhawan, Rohan, et al.
Pubblicazione: (2024)
OpenVLThinker: Complex Vision-Language Reasoning via Iterative SFT-RL Cycles
di: Deng, Yihe, et al.
Pubblicazione: (2025)
di: Deng, Yihe, et al.
Pubblicazione: (2025)
On Asymmetric Optimization of Reasoning and Perception in Vision-Language Model Post-Training
di: Wu, Xueqing, et al.
Pubblicazione: (2026)
di: Wu, Xueqing, et al.
Pubblicazione: (2026)
PRISM-Bench: A Benchmark of Puzzle-Based Visual Tasks with CoT Error Detection
di: Qian, Yusu, et al.
Pubblicazione: (2025)
di: Qian, Yusu, et al.
Pubblicazione: (2025)
Compressing LLMs: The Truth is Rarely Pure and Never Simple
di: Jaiswal, Ajay, et al.
Pubblicazione: (2023)
di: Jaiswal, Ajay, et al.
Pubblicazione: (2023)
Ferret-UI: Grounded Mobile UI Understanding with Multimodal LLMs
di: You, Keen, et al.
Pubblicazione: (2024)
di: You, Keen, et al.
Pubblicazione: (2024)
OpenVLThinkerV2: A Generalist Multimodal Reasoning Model for Multi-domain Visual Tasks
di: Hu, Wenbo, et al.
Pubblicazione: (2026)
di: Hu, Wenbo, et al.
Pubblicazione: (2026)
AMRFact: Enhancing Summarization Factuality Evaluation with AMR-Driven Negative Samples Generation
di: Qiu, Haoyi, et al.
Pubblicazione: (2023)
di: Qiu, Haoyi, et al.
Pubblicazione: (2023)
MIA-Bench: Towards Better Instruction Following Evaluation of Multimodal LLMs
di: Qian, Yusu, et al.
Pubblicazione: (2024)
di: Qian, Yusu, et al.
Pubblicazione: (2024)
GLARE: Agentic Reasoning for Legal Judgment Prediction
di: Yang, Xinyu, et al.
Pubblicazione: (2025)
di: Yang, Xinyu, et al.
Pubblicazione: (2025)
DiCoRe: Enhancing Zero-shot Event Detection via Divergent-Convergent LLM Reasoning
di: Parekh, Tanmay, et al.
Pubblicazione: (2025)
di: Parekh, Tanmay, et al.
Pubblicazione: (2025)
BRIEF: Bridging Retrieval and Inference for Multi-hop Reasoning via Compression
di: Li, Yuankai, et al.
Pubblicazione: (2024)
di: Li, Yuankai, et al.
Pubblicazione: (2024)
Control Large Language Models via Divide and Conquer
di: Li, Bingxuan, et al.
Pubblicazione: (2024)
di: Li, Bingxuan, et al.
Pubblicazione: (2024)
ConjNorm: Tractable Density Estimation for Out-of-Distribution Detection
di: Peng, Bo, et al.
Pubblicazione: (2024)
di: Peng, Bo, et al.
Pubblicazione: (2024)
GIE-Bench: Towards Grounded Evaluation for Text-Guided Image Editing
di: Qian, Yusu, et al.
Pubblicazione: (2025)
di: Qian, Yusu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Decoupling Task-Solving and Output Formatting in LLM Generation
di: Deng, Haikang, et al.
Pubblicazione: (2025) -
GenEARL: A Training-Free Generative Framework for Multimodal Event Argument Role Labeling
di: Bansal, Hritik, et al.
Pubblicazione: (2024) -
Adaptable Logical Control for Large Language Models
di: Zhang, Honghua, et al.
Pubblicazione: (2024) -
STAR: Boosting Low-Resource Information Extraction by Structure-to-Text Data Generation with Large Language Models
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2023) -
Re-ReST: Reflection-Reinforced Self-Training for Language Agents
di: Dou, Zi-Yi, et al.
Pubblicazione: (2024)