Episodic Novelty Through Temporal Distance
Fuente:
arXiv
Salvato in:
| Autori principali: | Jiang, Yuhua, Liu, Qihan, Yang, Yiqin, Ma, Xiaoteng, Zhong, Dianyu, Hu, Hao, Yang, Jun, Liang, Bin, Xu, Bo, Zhang, Chongjie, Zhao, Qianchuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Fewer May Be Better: Enhancing Offline Reinforcement Learning with Reduced Dataset
di: Yang, Yiqin, et al.
Pubblicazione: (2025)
di: Yang, Yiqin, et al.
Pubblicazione: (2025)
Efficient Multi-agent Reinforcement Learning by Planning
di: Liu, Qihan, et al.
Pubblicazione: (2024)
di: Liu, Qihan, et al.
Pubblicazione: (2024)
GlobeDiff: State Diffusion Process for Partial Observability in Multi-Agent Systems
di: Yang, Yiqin, et al.
Pubblicazione: (2026)
di: Yang, Yiqin, et al.
Pubblicazione: (2026)
DSAC: Distributional Soft Actor-Critic for Risk-Sensitive Reinforcement Learning
di: Ma, Xiaoteng, et al.
Pubblicazione: (2020)
di: Ma, Xiaoteng, et al.
Pubblicazione: (2020)
Bayesian Design Principles for Offline-to-Online Reinforcement Learning
di: Hu, Hao, et al.
Pubblicazione: (2024)
di: Hu, Hao, et al.
Pubblicazione: (2024)
OPRIDE: Offline Preference-based Reinforcement Learning via In-Dataset Exploration
di: Yang, Yiqin, et al.
Pubblicazione: (2026)
di: Yang, Yiqin, et al.
Pubblicazione: (2026)
Integrating Diffusion-based Multi-task Learning with Online Reinforcement Learning for Robust Quadruped Robot Control
di: Qin, Xinyao, et al.
Pubblicazione: (2025)
di: Qin, Xinyao, et al.
Pubblicazione: (2025)
Hierarchical Control Framework Integrating LLMs with RL for Decarbonized HVAC Operation
di: Zhong, Dianyu, et al.
Pubblicazione: (2026)
di: Zhong, Dianyu, et al.
Pubblicazione: (2026)
DAIL: Beyond Task Ambiguity for Language-Conditioned Reinforcement Learning
di: Xie, Runpeng, et al.
Pubblicazione: (2025)
di: Xie, Runpeng, et al.
Pubblicazione: (2025)
Novelty Seeking Differences in Temporal Dynamics for Novelty and Appropriateness Processing of Creative Information: An ERP Investigation
di: Yuanjing Lyu, et al.
Pubblicazione: (2024)
di: Yuanjing Lyu, et al.
Pubblicazione: (2024)
Priority-based Energy Allocation in Buildings through Distributed Model Predictive Control
di: Li, Hongyi, et al.
Pubblicazione: (2024)
di: Li, Hongyi, et al.
Pubblicazione: (2024)
DPMT: Dual Process Multi-scale Theory of Mind Framework for Real-time Human-AI Collaboration
di: Li, Xiyun, et al.
Pubblicazione: (2025)
di: Li, Xiyun, et al.
Pubblicazione: (2025)
A Two-Stage Masked Autoencoder Based Network for Indoor Depth Completion
di: Sun, Kailai, et al.
Pubblicazione: (2024)
di: Sun, Kailai, et al.
Pubblicazione: (2024)
STAIR: Addressing Stage Misalignment through Temporal-Aligned Preference Reinforcement Learning
di: Luan, Yao, et al.
Pubblicazione: (2025)
di: Luan, Yao, et al.
Pubblicazione: (2025)
Data-Enabled Policy and Value Iteration for Continuous-Time Linear Quadratic Output Feedback Control
di: Xie, Jun, et al.
Pubblicazione: (2026)
di: Xie, Jun, et al.
Pubblicazione: (2026)
An Efficient Data-Driven Framework for Linear Quadratic Output Feedback Control
di: Xie, Jun, et al.
Pubblicazione: (2025)
di: Xie, Jun, et al.
Pubblicazione: (2025)
CAST: Character-and-Scene Episodic Memory for Agents
di: Ma, Kexin, et al.
Pubblicazione: (2026)
di: Ma, Kexin, et al.
Pubblicazione: (2026)
Linking Stochastic Self-Propagating Star Formation and Spatio-Temporal Point Processes
di: Zou, Qihan
Pubblicazione: (2025)
di: Zou, Qihan
Pubblicazione: (2025)
CLARIFY: Contrastive Preference Reinforcement Learning for Untangling Ambiguous Queries
di: Mu, Ni, et al.
Pubblicazione: (2025)
di: Mu, Ni, et al.
Pubblicazione: (2025)
Risk-Sensitive RL for Alleviating Exploration Dilemmas in Large Language Models
di: Jiang, Yuhua, et al.
Pubblicazione: (2025)
di: Jiang, Yuhua, et al.
Pubblicazione: (2025)
PAG: Multi-Turn Reinforced LLM Self-Correction with Policy as Generative Verifier
di: Jiang, Yuhua, et al.
Pubblicazione: (2025)
di: Jiang, Yuhua, et al.
Pubblicazione: (2025)
Chameleon: Episodic Memory for Long-Horizon Robotic Manipulation
di: Guo, Xinying, et al.
Pubblicazione: (2026)
di: Guo, Xinying, et al.
Pubblicazione: (2026)
Learning from Many and Adapting to the Unknown in Open-set Test Streams
di: Zhang, Xiao, et al.
Pubblicazione: (2026)
di: Zhang, Xiao, et al.
Pubblicazione: (2026)
LongInsightBench: A Comprehensive Benchmark for Evaluating Omni-Modal Models on Human-Centric Long-Video Understanding
di: Han, ZhaoYang, et al.
Pubblicazione: (2025)
di: Han, ZhaoYang, et al.
Pubblicazione: (2025)
Boosting LLM Reasoning via Human-Inspired Reward Shaping
di: Lin, Wenze, et al.
Pubblicazione: (2026)
di: Lin, Wenze, et al.
Pubblicazione: (2026)
Co-Reinforcement Learning for Unified Multimodal Understanding and Generation
di: Jiang, Jingjing, et al.
Pubblicazione: (2025)
di: Jiang, Jingjing, et al.
Pubblicazione: (2025)
Unified Noise Steering for Efficient Human-Guided VLA Adaptation
di: Lu, Junjie, et al.
Pubblicazione: (2026)
di: Lu, Junjie, et al.
Pubblicazione: (2026)
MetMamba: Regional Weather Forecasting with Spatial-Temporal Mamba Model
di: Qin, Haoyu, et al.
Pubblicazione: (2024)
di: Qin, Haoyu, et al.
Pubblicazione: (2024)
Beyond Pairwise Distance: Cognitive Traversal Distance as a Holistic Measure of Scientific Novelty
di: Xiang, Yi, et al.
Pubblicazione: (2026)
di: Xiang, Yi, et al.
Pubblicazione: (2026)
Infinite-dimensional Mahalanobis Distance with Applications to Kernelized Novelty Detection
di: Zozoulenko, Nikita, et al.
Pubblicazione: (2024)
di: Zozoulenko, Nikita, et al.
Pubblicazione: (2024)
Research on the Construction of Maximum Distance Separable Codes via Arbitrary twisted Generalized Reed-Solomon Codes
di: Zhao, Chun'e, et al.
Pubblicazione: (2024)
di: Zhao, Chun'e, et al.
Pubblicazione: (2024)
Beyond Single-Dimension Novelty: How Combinations of Theory, Method, and Results-based Novelty Shape Scientific Impact
di: Zhao, Yi, et al.
Pubblicazione: (2026)
di: Zhao, Yi, et al.
Pubblicazione: (2026)
See Further for Parameter Efficient Fine-tuning by Standing on the Shoulders of Decomposition
di: Si, Chongjie, et al.
Pubblicazione: (2024)
di: Si, Chongjie, et al.
Pubblicazione: (2024)
Existence and multiplicity of normalized solutions for the quasi-linear Schrödinger equations with mixed nonlinearities
di: He, Qihan, et al.
Pubblicazione: (2025)
di: He, Qihan, et al.
Pubblicazione: (2025)
Exploring Critical Testing Scenarios for Decision-Making Policies: An LLM Approach
di: Xu, Weichao, et al.
Pubblicazione: (2024)
di: Xu, Weichao, et al.
Pubblicazione: (2024)
Rethinking Model Selection in VLM Through the Lens of Gromov-Wasserstein Distance
di: Li, Muyang, et al.
Pubblicazione: (2026)
di: Li, Muyang, et al.
Pubblicazione: (2026)
Weak deflection angle of charged signal in magnetic fields
di: Wang, Qianchuan, et al.
Pubblicazione: (2025)
di: Wang, Qianchuan, et al.
Pubblicazione: (2025)
Taypsi: Static Enforcement of Privacy Policies for Policy-Agnostic Oblivious Computation
di: Ye, Qianchuan, et al.
Pubblicazione: (2023)
di: Ye, Qianchuan, et al.
Pubblicazione: (2023)
Echo: A Large Language Model with Temporal Episodic Memory
di: Liu, WenTao, et al.
Pubblicazione: (2025)
di: Liu, WenTao, et al.
Pubblicazione: (2025)
Understanding GEMM Performance and Energy on NVIDIA Ada Lovelace: A Machine Learning-Based Analytical Approach
di: Xiaoteng, et al.
Pubblicazione: (2024)
di: Xiaoteng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Fewer May Be Better: Enhancing Offline Reinforcement Learning with Reduced Dataset
di: Yang, Yiqin, et al.
Pubblicazione: (2025) -
Efficient Multi-agent Reinforcement Learning by Planning
di: Liu, Qihan, et al.
Pubblicazione: (2024) -
GlobeDiff: State Diffusion Process for Partial Observability in Multi-Agent Systems
di: Yang, Yiqin, et al.
Pubblicazione: (2026) -
DSAC: Distributional Soft Actor-Critic for Risk-Sensitive Reinforcement Learning
di: Ma, Xiaoteng, et al.
Pubblicazione: (2020) -
Bayesian Design Principles for Offline-to-Online Reinforcement Learning
di: Hu, Hao, et al.
Pubblicazione: (2024)