Enregistré dans:
| Auteurs principaux: | Maharana, Adyasha, Lee, Dong-Ho, Tulyakov, Sergey, Bansal, Mohit, Barbieri, Francesco, Fang, Yuwei |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2402.17753 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
REALTALK: A 21-Day Real-World Dataset for Long-Term Conversation
par: Lee, Dong-Ho, et autres
Publié: (2025)
par: Lee, Dong-Ho, et autres
Publié: (2025)
Exposing and Addressing Cross-Task Inconsistency in Unified Vision-Language Models
par: Maharana, Adyasha, et autres
Publié: (2023)
par: Maharana, Adyasha, et autres
Publié: (2023)
Adapt-$\infty$: Scalable Continual Multimodal Instruction Tuning via Dynamic Data Selection
par: Maharana, Adyasha, et autres
Publié: (2024)
par: Maharana, Adyasha, et autres
Publié: (2024)
Soft Self-Consistency Improves Language Model Agents
par: Wang, Han, et autres
Publié: (2024)
par: Wang, Han, et autres
Publié: (2024)
DataEnvGym: Data Generation Agents in Teacher Environments with Student Feedback
par: Khan, Zaid, et autres
Publié: (2024)
par: Khan, Zaid, et autres
Publié: (2024)
Playing Along: Learning a Double-Agent Defender for Belief Steering via Theory of Mind
par: Xiao, Hanqi, et autres
Publié: (2026)
par: Xiao, Hanqi, et autres
Publié: (2026)
PRInTS: Reward Modeling for Long-Horizon Information Seeking
par: Lee, Jaewoo, et autres
Publié: (2025)
par: Lee, Jaewoo, et autres
Publié: (2025)
MemRouter: Memory-as-Embedding Routing for Long-Term Conversational Agents
par: Hu, Tianyu, et autres
Publié: (2026)
par: Hu, Tianyu, et autres
Publié: (2026)
EnvGen: Generating and Adapting Environments via LLMs for Training Embodied Agents
par: Zala, Abhay, et autres
Publié: (2024)
par: Zala, Abhay, et autres
Publié: (2024)
Inducing Systematicity in Transformers by Attending to Structurally Quantized Embeddings
par: Jiang, Yichen, et autres
Publié: (2024)
par: Jiang, Yichen, et autres
Publié: (2024)
Preference-Aware Memory Update for Long-Term LLM Agents
par: Sun, Haoran, et autres
Publié: (2025)
par: Sun, Haoran, et autres
Publié: (2025)
Mem-Gallery: Benchmarking Multimodal Long-Term Conversational Memory for MLLM Agents
par: Bei, Yuanchen, et autres
Publié: (2026)
par: Bei, Yuanchen, et autres
Publié: (2026)
Effective Reasoning Chains Reduce Intrinsic Dimensionality
par: Prasad, Archiki, et autres
Publié: (2026)
par: Prasad, Archiki, et autres
Publié: (2026)
UPCORE: Utility-Preserving Coreset Selection for Balanced Unlearning
par: Patil, Vaidehi, et autres
Publié: (2025)
par: Patil, Vaidehi, et autres
Publié: (2025)
EngramaBench: Evaluating Long-Term Conversational Memory with Structured Graph Retrieval
par: Acuna, Julian
Publié: (2026)
par: Acuna, Julian
Publié: (2026)
MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent
par: Yu, Hongli, et autres
Publié: (2025)
par: Yu, Hongli, et autres
Publié: (2025)
Hierarchical Memory for High-Efficiency Long-Term Reasoning in LLM Agents
par: Sun, Haoran, et autres
Publié: (2025)
par: Sun, Haoran, et autres
Publié: (2025)
Branch-Solve-Merge Improves Large Language Model Evaluation and Generation
par: Saha, Swarnadeep, et autres
Publié: (2023)
par: Saha, Swarnadeep, et autres
Publié: (2023)
HyperMem: Hypergraph Memory for Long-Term Conversations
par: Yue, Juwei, et autres
Publié: (2026)
par: Yue, Juwei, et autres
Publié: (2026)
TrajAgent: An LLM-Agent Framework for Trajectory Modeling via Large-and-Small Model Collaboration
par: Du, Yuwei, et autres
Publié: (2024)
par: Du, Yuwei, et autres
Publié: (2024)
A Human-Inspired Reading Agent with Gist Memory of Very Long Contexts
par: Lee, Kuang-Huei, et autres
Publié: (2024)
par: Lee, Kuang-Huei, et autres
Publié: (2024)
DiagrammerGPT: Generating Open-Domain, Open-Platform Diagrams via LLM Planning
par: Zala, Abhay, et autres
Publié: (2023)
par: Zala, Abhay, et autres
Publié: (2023)
VideoDirectorGPT: Consistent Multi-scene Video Generation via LLM-Guided Planning
par: Lin, Han, et autres
Publié: (2023)
par: Lin, Han, et autres
Publié: (2023)
ReConcile: Round-Table Conference Improves Reasoning via Consensus among Diverse LLMs
par: Chen, Justin Chih-Yao, et autres
Publié: (2023)
par: Chen, Justin Chih-Yao, et autres
Publié: (2023)
ComPEFT: Compression for Communicating Parameter Efficient Updates via Sparsification and Quantization
par: Yadav, Prateek, et autres
Publié: (2023)
par: Yadav, Prateek, et autres
Publié: (2023)
The Unreasonable Effectiveness of Easy Training Data for Hard Tasks
par: Hase, Peter, et autres
Publié: (2024)
par: Hase, Peter, et autres
Publié: (2024)
ReGAL: Refactoring Programs to Discover Generalizable Abstractions
par: Stengel-Eskin, Elias, et autres
Publié: (2024)
par: Stengel-Eskin, Elias, et autres
Publié: (2024)
Functional Entropy: Predicting Functional Correctness in LLM-Generated Code with Uncertainty Quantification
par: Bouchard, Dylan, et autres
Publié: (2026)
par: Bouchard, Dylan, et autres
Publié: (2026)
MemGuard: Preventing Memory Contamination in Long-Term Memory-Augmented Large Language Models
par: Ha, Hyeonjeong, et autres
Publié: (2026)
par: Ha, Hyeonjeong, et autres
Publié: (2026)
RecMem: Recurrence-based Memory Consolidation for Efficient and Effective Long-Running LLM Agents
par: Dai, Zijie, et autres
Publié: (2026)
par: Dai, Zijie, et autres
Publié: (2026)
Multi-Attribute Steering of Language Models via Targeted Intervention
par: Nguyen, Duy, et autres
Publié: (2025)
par: Nguyen, Duy, et autres
Publié: (2025)
Peeking Behind Closed Doors: Risks of LLM Evaluation by Private Data Curators
par: Bansal, Hritik, et autres
Publié: (2025)
par: Bansal, Hritik, et autres
Publié: (2025)
GRAVITY: Architecture-Agnostic Structured Anchoring for Long-Horizon Conversational Memory
par: Sun, Yushi, et autres
Publié: (2026)
par: Sun, Yushi, et autres
Publié: (2026)
Task-Circuit Quantization: Leveraging Knowledge Localization and Interpretability for Compression
par: Xiao, Hanqi, et autres
Publié: (2025)
par: Xiao, Hanqi, et autres
Publié: (2025)
Attacks, Defenses and Evaluations for LLM Conversation Safety: A Survey
par: Dong, Zhichen, et autres
Publié: (2024)
par: Dong, Zhichen, et autres
Publié: (2024)
FLAMES: Improving LLM Math Reasoning via a Fine-Grained Analysis of the Data Synthesis Pipeline
par: Seegmiller, Parker, et autres
Publié: (2025)
par: Seegmiller, Parker, et autres
Publié: (2025)
Executable Functional Abstractions: Inferring Generative Programs for Advanced Math Problems
par: Khan, Zaid, et autres
Publié: (2025)
par: Khan, Zaid, et autres
Publié: (2025)
One Life to Learn: Inferring Symbolic World Models for Stochastic Environments from Unguided Exploration
par: Khan, Zaid, et autres
Publié: (2025)
par: Khan, Zaid, et autres
Publié: (2025)
RSQ: Learning from Important Tokens Leads to Better Quantized LLMs
par: Sung, Yi-Lin, et autres
Publié: (2025)
par: Sung, Yi-Lin, et autres
Publié: (2025)
PSYCHE: A Multi-faceted Patient Simulation Framework for Evaluation of Psychiatric Assessment Conversational Agents
par: Lee, Jingoo, et autres
Publié: (2025)
par: Lee, Jingoo, et autres
Publié: (2025)
Documents similaires
-
REALTALK: A 21-Day Real-World Dataset for Long-Term Conversation
par: Lee, Dong-Ho, et autres
Publié: (2025) -
Exposing and Addressing Cross-Task Inconsistency in Unified Vision-Language Models
par: Maharana, Adyasha, et autres
Publié: (2023) -
Adapt-$\infty$: Scalable Continual Multimodal Instruction Tuning via Dynamic Data Selection
par: Maharana, Adyasha, et autres
Publié: (2024) -
Soft Self-Consistency Improves Language Model Agents
par: Wang, Han, et autres
Publié: (2024) -
DataEnvGym: Data Generation Agents in Teacher Environments with Student Feedback
par: Khan, Zaid, et autres
Publié: (2024)