Learning Temporal Abstractions via Variational Homomorphisms in Option-Induced Abstract MDPs
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Chang, Zhang, Yaren, Lv, Haoran, Cao, Qiong, Xue, Chao, He, Xiaodong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Beyond Token Length: Step Pruner for Efficient and Accurate Reasoning in Large Language Models
di: Wu, Canhui, et al.
Pubblicazione: (2025)
di: Wu, Canhui, et al.
Pubblicazione: (2025)
Temporal Knowledge Question Answering via Abstract Reasoning Induction
di: Chen, Ziyang, et al.
Pubblicazione: (2023)
di: Chen, Ziyang, et al.
Pubblicazione: (2023)
Efficient Reasoning via Thought-Training and Thought-Free Inference
di: Wu, Canhui, et al.
Pubblicazione: (2025)
di: Wu, Canhui, et al.
Pubblicazione: (2025)
SOCIA-EVO: Automated Simulator Construction via Dual-Anchored Bi-Level Optimization
di: Hua, Yuncheng, et al.
Pubblicazione: (2026)
di: Hua, Yuncheng, et al.
Pubblicazione: (2026)
Pharos-ESG: A Framework for Multimodal Parsing, Contextual Narration, and Hierarchical Labeling of ESG Report
di: Chen, Yan, et al.
Pubblicazione: (2025)
di: Chen, Yan, et al.
Pubblicazione: (2025)
The Unified Cognitive Consciousness Theory for Language Models: Anchoring Semantics, Thresholds of Activation, and Emergent Reasoning
di: Chang, Edward Y., et al.
Pubblicazione: (2025)
di: Chang, Edward Y., et al.
Pubblicazione: (2025)
Unlocking the Wisdom of Large Language Models: An Introduction to The Path to Artificial General Intelligence
di: Chang, Edward Y.
Pubblicazione: (2024)
di: Chang, Edward Y.
Pubblicazione: (2024)
EVINCE: Optimizing Multi-LLM Dialogues Using Conditional Statistics and Information Theory
di: Chang, Edward Y.
Pubblicazione: (2024)
di: Chang, Edward Y.
Pubblicazione: (2024)
Ensuring Ground Truth Accuracy in Healthcare with the EVINCE framework
di: Chang, Edward Y.
Pubblicazione: (2024)
di: Chang, Edward Y.
Pubblicazione: (2024)
Diagnosing and Mitigating Sycophancy and Skepticism in LLM Causal Judgment
di: Chang, Edward Y.
Pubblicazione: (2026)
di: Chang, Edward Y.
Pubblicazione: (2026)
ALAS: A Stateful Multi-LLM Agent Framework for Disruption-Aware Planning
di: Chang, Edward Y., et al.
Pubblicazione: (2025)
di: Chang, Edward Y., et al.
Pubblicazione: (2025)
RAudit: A Blind Auditing Protocol for Large Language Model Reasoning
di: Chang, Edward Y., et al.
Pubblicazione: (2026)
di: Chang, Edward Y., et al.
Pubblicazione: (2026)
SagaLLM: Context Management, Validation, and Transaction Guarantees for Multi-Agent LLM Planning
di: Chang, Edward Y., et al.
Pubblicazione: (2025)
di: Chang, Edward Y., et al.
Pubblicazione: (2025)
ScrapMem: A Bio-inspired Framework for On-device Personalized Agent Memory via Optical Forgetting
di: Chang, Jiale, et al.
Pubblicazione: (2026)
di: Chang, Jiale, et al.
Pubblicazione: (2026)
Option-Order Randomisation Reveals a Distributional Position Attractor in Prompted Sandbagging
di: Cacioli, Jon-Paul
Pubblicazione: (2026)
di: Cacioli, Jon-Paul
Pubblicazione: (2026)
SOCIA-Nabla: Textual Gradient Meets Multi-Agent Orchestration for Automated Simulator Generation
di: Hua, Yuncheng, et al.
Pubblicazione: (2025)
di: Hua, Yuncheng, et al.
Pubblicazione: (2025)
SOCIA-$\nabla$: Textual Gradient Meets Multi-Agent Orchestration for Automated Simulator Generation
di: Hua, Yuncheng, et al.
Pubblicazione: (2025)
di: Hua, Yuncheng, et al.
Pubblicazione: (2025)
RomanLens: The Role Of Latent Romanization In Multilinguality In LLMs
di: Saji, Alan, et al.
Pubblicazione: (2025)
di: Saji, Alan, et al.
Pubblicazione: (2025)
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
di: Peters, Sydney, et al.
Pubblicazione: (2025)
di: Peters, Sydney, et al.
Pubblicazione: (2025)
Low-Resource Court Judgment Summarization for Common Law Systems
di: Liu, Shuaiqi, et al.
Pubblicazione: (2024)
di: Liu, Shuaiqi, et al.
Pubblicazione: (2024)
Learning Efficient Guardrails for Compliance
di: Wen, Xiaofei, et al.
Pubblicazione: (2025)
di: Wen, Xiaofei, et al.
Pubblicazione: (2025)
Executing Arithmetic: Fine-Tuning Large Language Models as Turing Machines
di: Lai, Junyu, et al.
Pubblicazione: (2024)
di: Lai, Junyu, et al.
Pubblicazione: (2024)
Good to Go: The LOOP Skill Engine That Hits 99% Success and Slashes Token Usage by 99% via One-Shot Recording and Deterministic Replay
di: Wang, Xiaohua, et al.
Pubblicazione: (2026)
di: Wang, Xiaohua, et al.
Pubblicazione: (2026)
FastGRPO: Accelerating Policy Optimization via Concurrency-aware Speculative Decoding and Online Draft Learning
di: Zhang, Yizhou, et al.
Pubblicazione: (2025)
di: Zhang, Yizhou, et al.
Pubblicazione: (2025)
PRISM: Prompt Reliability via Iterative Simulation and Monitoring for Enterprise Conversational AI
di: Chaitanya, Keshava, et al.
Pubblicazione: (2026)
di: Chaitanya, Keshava, et al.
Pubblicazione: (2026)
$\rm SP^3$: Enhancing Structured Pruning via PCA Projection
di: Hu, Yuxuan, et al.
Pubblicazione: (2023)
di: Hu, Yuxuan, et al.
Pubblicazione: (2023)
Preventing Safety Drift in Large Language Models via Coupled Weight and Activation Constraints
di: Peng, Songping, et al.
Pubblicazione: (2026)
di: Peng, Songping, et al.
Pubblicazione: (2026)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2023)
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2023)
LLM-based Automated Theorem Proving Hinges on Scalable Synthetic Data Generation
di: Lai, Junyu, et al.
Pubblicazione: (2025)
di: Lai, Junyu, et al.
Pubblicazione: (2025)
End-to-End Optimization of LLM-Driven Multi-Agent Search Systems via Heterogeneous-Group-Based Reinforcement Learning
di: Chen, Guanzhong, et al.
Pubblicazione: (2025)
di: Chen, Guanzhong, et al.
Pubblicazione: (2025)
Robust Tool Use via Fission-GRPO: Learning to Recover from Execution Errors
di: Zhang, Zhiwei, et al.
Pubblicazione: (2026)
di: Zhang, Zhiwei, et al.
Pubblicazione: (2026)
CausalT5K: Diagnosing and Informing Refusal for Trustworthy Causal Reasoning of Skepticism, Sycophancy, Detection-Correction, and Rung Collapse
di: Geng, Longling, et al.
Pubblicazione: (2026)
di: Geng, Longling, et al.
Pubblicazione: (2026)
Automated CAD Modeling Sequence Generation from Text Descriptions via Transformer-Based Large Language Models
di: Liao, Jianxing, et al.
Pubblicazione: (2025)
di: Liao, Jianxing, et al.
Pubblicazione: (2025)
A Library of LLM Intrinsics for Retrieval-Augmented Generation
di: Danilevsky, Marina, et al.
Pubblicazione: (2025)
di: Danilevsky, Marina, et al.
Pubblicazione: (2025)
HIP Network: Historical Information Passing Network for Extrapolation Reasoning on Temporal Knowledge Graph
di: He, Yongquan, et al.
Pubblicazione: (2024)
di: He, Yongquan, et al.
Pubblicazione: (2024)
Fine-Grained Emotion Recognition via In-Context Learning
di: Ren, Zhaochun, et al.
Pubblicazione: (2025)
di: Ren, Zhaochun, et al.
Pubblicazione: (2025)
Learning Software Bug Reports: A Systematic Literature Review
di: Long, Guoming, et al.
Pubblicazione: (2025)
di: Long, Guoming, et al.
Pubblicazione: (2025)
LLM-Based SQL Generation: Prompting, Self-Refinement, and Adaptive Weighted Majority Voting
di: Yang, Yu-Jie, et al.
Pubblicazione: (2026)
di: Yang, Yu-Jie, et al.
Pubblicazione: (2026)
FastForward Pruning: Efficient LLM Pruning via Single-Step Reinforcement Learning
di: Yuan, Xin, et al.
Pubblicazione: (2025)
di: Yuan, Xin, et al.
Pubblicazione: (2025)
Future Language Modeling from Temporal Document History
di: Li, Changmao, et al.
Pubblicazione: (2024)
di: Li, Changmao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Beyond Token Length: Step Pruner for Efficient and Accurate Reasoning in Large Language Models
di: Wu, Canhui, et al.
Pubblicazione: (2025) -
Temporal Knowledge Question Answering via Abstract Reasoning Induction
di: Chen, Ziyang, et al.
Pubblicazione: (2023) -
Efficient Reasoning via Thought-Training and Thought-Free Inference
di: Wu, Canhui, et al.
Pubblicazione: (2025) -
SOCIA-EVO: Automated Simulator Construction via Dual-Anchored Bi-Level Optimization
di: Hua, Yuncheng, et al.
Pubblicazione: (2026) -
Pharos-ESG: A Framework for Multimodal Parsing, Contextual Narration, and Hierarchical Labeling of ESG Report
di: Chen, Yan, et al.
Pubblicazione: (2025)