Pheromone-based Learning of Optimal Reasoning Paths
Fuente:
arXiv
Salvato in:
| Autori principali: | Chari, Anirudh, Tiwari, Aditya, Lian, Richard, Reddy, Suraj, Zhou, Brian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MINDSTORES: Memory-Informed Neural Decision Synthesis for Task-Oriented Reinforcement in Embodied Systems
di: Chari, Anirudh, et al.
Pubblicazione: (2025)
di: Chari, Anirudh, et al.
Pubblicazione: (2025)
End-to-end Sequence Labeling via Bi-directional LSTM-CNNs-CRF: A Reproducibility Study
di: Ganesh, Anirudh, et al.
Pubblicazione: (2025)
di: Ganesh, Anirudh, et al.
Pubblicazione: (2025)
Learning Adaptive Reasoning Paths for Efficient Visual Reasoning
di: Huang, Yixu, et al.
Pubblicazione: (2026)
di: Huang, Yixu, et al.
Pubblicazione: (2026)
Learning from Diverse Reasoning Paths with Routing and Collaboration
di: Lei, Zhenyu, et al.
Pubblicazione: (2025)
di: Lei, Zhenyu, et al.
Pubblicazione: (2025)
Reasoning Paths Optimization: Learning to Reason and Explore From Diverse Paths
di: Chia, Yew Ken, et al.
Pubblicazione: (2024)
di: Chia, Yew Ken, et al.
Pubblicazione: (2024)
PathReasoner: Modeling Reasoning Path with Equivalent Extension for Logical Question Answering
di: Xu, Fangzhi, et al.
Pubblicazione: (2024)
di: Xu, Fangzhi, et al.
Pubblicazione: (2024)
Neural Chain-of-Thought Search: Searching the Optimal Reasoning Path to Enhance Large Language Models
di: Ling, Guoming, et al.
Pubblicazione: (2026)
di: Ling, Guoming, et al.
Pubblicazione: (2026)
Compactor: Calibrated Query-Agnostic KV Cache Compression with Approximate Leverage Scores
di: Chari, Vivek, et al.
Pubblicazione: (2025)
di: Chari, Vivek, et al.
Pubblicazione: (2025)
CS4: Measuring the Creativity of Large Language Models Automatically by Controlling the Number of Story-Writing Constraints
di: Atmakuru, Anirudh, et al.
Pubblicazione: (2024)
di: Atmakuru, Anirudh, et al.
Pubblicazione: (2024)
Rank-K: Test-Time Reasoning for Listwise Reranking
di: Yang, Eugene, et al.
Pubblicazione: (2025)
di: Yang, Eugene, et al.
Pubblicazione: (2025)
Path-LLM: A Shortest-Path-based LLM Learning for Unified Graph Representation
di: Shang, Wenbo, et al.
Pubblicazione: (2024)
di: Shang, Wenbo, et al.
Pubblicazione: (2024)
Reliable Reasoning Path: Distilling Effective Guidance for LLM Reasoning with Knowledge Graphs
di: Xiao, Yilin, et al.
Pubblicazione: (2025)
di: Xiao, Yilin, et al.
Pubblicazione: (2025)
ReasonGraph: Visualisation of Reasoning Paths
di: Li, Zongqian, et al.
Pubblicazione: (2025)
di: Li, Zongqian, et al.
Pubblicazione: (2025)
Reasoning Path Compression: Compressing Generation Trajectories for Efficient LLM Reasoning
di: Song, Jiwon, et al.
Pubblicazione: (2025)
di: Song, Jiwon, et al.
Pubblicazione: (2025)
Extracting and Following Paths for Robust Relational Reasoning with Large Language Models
di: Zhang, Ge, et al.
Pubblicazione: (2024)
di: Zhang, Ge, et al.
Pubblicazione: (2024)
Short-Path Prompting in LLMs: Analyzing Reasoning Instability and Solutions for Robust Performance
di: Tang, Zuoli, et al.
Pubblicazione: (2025)
di: Tang, Zuoli, et al.
Pubblicazione: (2025)
KV-Distill: Nearly Lossless Learnable Context Compression for LLMs
di: Chari, Vivek, et al.
Pubblicazione: (2025)
di: Chari, Vivek, et al.
Pubblicazione: (2025)
Learning Adaptive Parallel Reasoning with Language Models
di: Pan, Jiayi, et al.
Pubblicazione: (2025)
di: Pan, Jiayi, et al.
Pubblicazione: (2025)
TransEvalnia: Reasoning-based Evaluation and Ranking of Translations
di: Sproat, Richard, et al.
Pubblicazione: (2025)
di: Sproat, Richard, et al.
Pubblicazione: (2025)
REARANK: Reasoning Re-ranking Agent via Reinforcement Learning
di: Zhang, Le, et al.
Pubblicazione: (2025)
di: Zhang, Le, et al.
Pubblicazione: (2025)
Consistent Paths Lead to Truth: Self-Rewarding Reinforcement Learning for LLM Reasoning
di: Zhang, Kongcheng, et al.
Pubblicazione: (2025)
di: Zhang, Kongcheng, et al.
Pubblicazione: (2025)
Learning from Contrasts: Synthesizing Reasoning Paths from Diverse Search Trajectories
di: Liu, Peiyang, et al.
Pubblicazione: (2026)
di: Liu, Peiyang, et al.
Pubblicazione: (2026)
Cut Your Losses! Learning to Prune Paths Early for Efficient Parallel Reasoning
di: Bi, Jiaxi, et al.
Pubblicazione: (2026)
di: Bi, Jiaxi, et al.
Pubblicazione: (2026)
Language Matters: How Do Multilingual Input and Reasoning Paths Affect Large Reasoning Models?
di: Tam, Zhi Rui, et al.
Pubblicazione: (2025)
di: Tam, Zhi Rui, et al.
Pubblicazione: (2025)
On Path to Multimodal Historical Reasoning: HistBench and HistAgent
di: Qiu, Jiahao, et al.
Pubblicazione: (2025)
di: Qiu, Jiahao, et al.
Pubblicazione: (2025)
EthicsMH: A Pilot Benchmark for Ethical Reasoning in Mental Health AI
di: Kasu, Sai Kartheek Reddy
Pubblicazione: (2025)
di: Kasu, Sai Kartheek Reddy
Pubblicazione: (2025)
d1: Scaling Reasoning in Diffusion Large Language Models via Reinforcement Learning
di: Zhao, Siyan, et al.
Pubblicazione: (2025)
di: Zhao, Siyan, et al.
Pubblicazione: (2025)
KAM-CoT: Knowledge Augmented Multimodal Chain-of-Thoughts Reasoning
di: Mondal, Debjyoti, et al.
Pubblicazione: (2024)
di: Mondal, Debjyoti, et al.
Pubblicazione: (2024)
Domain-adaptative Continual Learning for Low-resource Tasks: Evaluation on Nepali
di: Duwal, Sharad, et al.
Pubblicazione: (2024)
di: Duwal, Sharad, et al.
Pubblicazione: (2024)
Where Reasoning Breaks: Logic-Aware Path Selection by Controlling Logical Connectives in LLMs Reasoning Chains
di: Park, Seunghyun, et al.
Pubblicazione: (2026)
di: Park, Seunghyun, et al.
Pubblicazione: (2026)
MuCRASP: Multimodal Chain-of-thought Reasoning aware Structured Pruning
di: Dutta, Aritra, et al.
Pubblicazione: (2026)
di: Dutta, Aritra, et al.
Pubblicazione: (2026)
GCoT-Decoding: Unlocking Deep Reasoning Paths for Universal Question Answering
di: Luo, Guanran, et al.
Pubblicazione: (2026)
di: Luo, Guanran, et al.
Pubblicazione: (2026)
Enhancing LLM Reasoning with Multi-Path Collaborative Reactive and Reflection agents
di: He, Chengbo, et al.
Pubblicazione: (2024)
di: He, Chengbo, et al.
Pubblicazione: (2024)
MATHSENSEI: A Tool-Augmented Large Language Model for Mathematical Reasoning
di: Das, Debrup, et al.
Pubblicazione: (2024)
di: Das, Debrup, et al.
Pubblicazione: (2024)
ASTRO: Teaching Language Models to Reason by Reflecting and Backtracking In-Context
di: Kim, Joongwon, et al.
Pubblicazione: (2025)
di: Kim, Joongwon, et al.
Pubblicazione: (2025)
Reasoning Aware Self-Consistency: Leveraging Reasoning Paths for Efficient LLM Sampling
di: Wan, Guangya, et al.
Pubblicazione: (2024)
di: Wan, Guangya, et al.
Pubblicazione: (2024)
Follow the Path: Reasoning over Knowledge Graph Paths to Improve Large Language Model Factuality
di: Zhang, Mike, et al.
Pubblicazione: (2025)
di: Zhang, Mike, et al.
Pubblicazione: (2025)
Enhancing Long Chain-of-Thought Reasoning through Multi-Path Plan Aggregation
di: Xiong, Siheng, et al.
Pubblicazione: (2025)
di: Xiong, Siheng, et al.
Pubblicazione: (2025)
Paths-over-Graph: Knowledge Graph Empowered Large Language Model Reasoning
di: Tan, Xingyu, et al.
Pubblicazione: (2024)
di: Tan, Xingyu, et al.
Pubblicazione: (2024)
SarcasmBench: Towards Evaluating Large Language Models on Sarcasm Understanding
di: Zhang, Yazhou, et al.
Pubblicazione: (2024)
di: Zhang, Yazhou, et al.
Pubblicazione: (2024)
Documenti analoghi
-
MINDSTORES: Memory-Informed Neural Decision Synthesis for Task-Oriented Reinforcement in Embodied Systems
di: Chari, Anirudh, et al.
Pubblicazione: (2025) -
End-to-end Sequence Labeling via Bi-directional LSTM-CNNs-CRF: A Reproducibility Study
di: Ganesh, Anirudh, et al.
Pubblicazione: (2025) -
Learning Adaptive Reasoning Paths for Efficient Visual Reasoning
di: Huang, Yixu, et al.
Pubblicazione: (2026) -
Learning from Diverse Reasoning Paths with Routing and Collaboration
di: Lei, Zhenyu, et al.
Pubblicazione: (2025) -
Reasoning Paths Optimization: Learning to Reason and Explore From Diverse Paths
di: Chia, Yew Ken, et al.
Pubblicazione: (2024)