LM2: Large Memory Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Kang, Jikun, Wu, Wenqi, Christianos, Filippos, Chan, Alex J., Greenlee, Fraser, Thomas, George, Purtorab, Marvin, Toulis, Andy |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
WebGames: Challenging General-Purpose Web-Browsing AI Agents
por: Thomas, George, et al.
Publicado: (2025)
por: Thomas, George, et al.
Publicado: (2025)
Ask more, know better: Reinforce-Learned Prompt Questions for Decision Making with Large Language Models
por: Yan, Xue, et al.
Publicado: (2023)
por: Yan, Xue, et al.
Publicado: (2023)
Think Before You Act: Decision Transformers with Working Memory
por: Kang, Jikun, et al.
Publicado: (2023)
por: Kang, Jikun, et al.
Publicado: (2023)
Lightweight Neural App Control
por: Christianos, Filippos, et al.
Publicado: (2024)
por: Christianos, Filippos, et al.
Publicado: (2024)
CogLM: Tracking Cognitive Development of Large Language Models
por: Wang, Xinglin, et al.
Publicado: (2024)
por: Wang, Xinglin, et al.
Publicado: (2024)
SQL-PaLM: Improved Large Language Model Adaptation for Text-to-SQL (extended)
por: Sun, Ruoxi, et al.
Publicado: (2023)
por: Sun, Ruoxi, et al.
Publicado: (2023)
Intrinsic Language-Guided Exploration for Complex Long-Horizon Robotic Manipulation Tasks
por: Triantafyllidis, Eleftherios, et al.
Publicado: (2023)
por: Triantafyllidis, Eleftherios, et al.
Publicado: (2023)
JudgeLM: Fine-tuned Large Language Models are Scalable Judges
por: Zhu, Lianghui, et al.
Publicado: (2023)
por: Zhu, Lianghui, et al.
Publicado: (2023)
Compositional Subspace Representation Fine-tuning for Adaptive Large Language Models
por: Zhou, Andy
Publicado: (2025)
por: Zhou, Andy
Publicado: (2025)
LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models
por: Han, Chi, et al.
Publicado: (2023)
por: Han, Chi, et al.
Publicado: (2023)
Teaching Models to Verbalize Reward Hacking in Chain-of-Thought Reasoning
por: Turpin, Miles, et al.
Publicado: (2025)
por: Turpin, Miles, et al.
Publicado: (2025)
Cognitive Memory in Large Language Models
por: Shan, Lianlei, et al.
Publicado: (2025)
por: Shan, Lianlei, et al.
Publicado: (2025)
When to Retrieve During Reasoning: Adaptive Retrieval for Large Reasoning Models
por: Guo, Dongxin, et al.
Publicado: (2026)
por: Guo, Dongxin, et al.
Publicado: (2026)
ReaLM: Residual Quantization Bridging Knowledge Graph Embeddings and Large Language Models
por: Guo, Wenbin, et al.
Publicado: (2025)
por: Guo, Wenbin, et al.
Publicado: (2025)
InternLM2 Technical Report
por: Cai, Zheng, et al.
Publicado: (2024)
por: Cai, Zheng, et al.
Publicado: (2024)
HiAgent: Hierarchical Working Memory Management for Solving Long-Horizon Agent Tasks with Large Language Model
por: Hu, Mengkang, et al.
Publicado: (2024)
por: Hu, Mengkang, et al.
Publicado: (2024)
FaithLM: Towards Faithful Explanations for Large Language Models
por: Chuang, Yu-Neng, et al.
Publicado: (2024)
por: Chuang, Yu-Neng, et al.
Publicado: (2024)
TernaryLM: Memory-Efficient Language Modeling via Native 1.5-Bit Quantization with Adaptive Layer-wise Scaling
por: Nargund, Nisharg, et al.
Publicado: (2026)
por: Nargund, Nisharg, et al.
Publicado: (2026)
LP-LM: No Hallucinations in Question Answering with Logic Programming
por: Wu, Katherine, et al.
Publicado: (2025)
por: Wu, Katherine, et al.
Publicado: (2025)
Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought
por: Lee, Jooyoung, et al.
Publicado: (2024)
por: Lee, Jooyoung, et al.
Publicado: (2024)
CataLM: Empowering Catalyst Design Through Large Language Models
por: Wang, Ludi, et al.
Publicado: (2024)
por: Wang, Ludi, et al.
Publicado: (2024)
ToM-LM: Delegating Theory of Mind Reasoning to External Symbolic Executors in Large Language Models
por: Tang, Weizhi, et al.
Publicado: (2024)
por: Tang, Weizhi, et al.
Publicado: (2024)
Investigating Context-Faithfulness in Large Language Models: The Roles of Memory Strength and Evidence Style
por: Li, Yuepei, et al.
Publicado: (2024)
por: Li, Yuepei, et al.
Publicado: (2024)
Identifying the Risks of LM Agents with an LM-Emulated Sandbox
por: Ruan, Yangjun, et al.
Publicado: (2023)
por: Ruan, Yangjun, et al.
Publicado: (2023)
Demographic Attributes Prediction from Speech Using WavLM Embeddings
por: Yang, Yuchen, et al.
Publicado: (2025)
por: Yang, Yuchen, et al.
Publicado: (2025)
Rethinking KenLM: Good and Bad Model Ensembles for Efficient Text Quality Filtering in Large Web Corpora
por: Kim, Yungi, et al.
Publicado: (2024)
por: Kim, Yungi, et al.
Publicado: (2024)
Active Confusion Expression in Large Language Models: Leveraging World Models toward Better Social Reasoning
por: Du, Jialu, et al.
Publicado: (2025)
por: Du, Jialu, et al.
Publicado: (2025)
CaLM: Contrasting Large and Small Language Models to Verify Grounded Generation
por: Hsu, I-Hung, et al.
Publicado: (2024)
por: Hsu, I-Hung, et al.
Publicado: (2024)
Xmodel-LM Technical Report
por: Wang, Yichuan, et al.
Publicado: (2024)
por: Wang, Yichuan, et al.
Publicado: (2024)
PonderLM: Pretraining Language Models to Ponder in Continuous Space
por: Zeng, Boyi, et al.
Publicado: (2025)
por: Zeng, Boyi, et al.
Publicado: (2025)
Cooper: Co-Optimizing Policy and Reward Models in Reinforcement Learning for Large Language Models
por: Hong, Haitao, et al.
Publicado: (2025)
por: Hong, Haitao, et al.
Publicado: (2025)
MedBioLM: Optimizing Medical and Biological QA with Fine-Tuned Large Language Models and Retrieval-Augmented Generation
por: Kim, Seonok
Publicado: (2025)
por: Kim, Seonok
Publicado: (2025)
Personal Intelligence System UniLM: Hybrid On-Device Small Language Model and Server-Based Large Language Model for Malay Nusantara
por: Nazri, Azree, et al.
Publicado: (2024)
por: Nazri, Azree, et al.
Publicado: (2024)
Large Language Models are In-Context Molecule Learners
por: Li, Jiatong, et al.
Publicado: (2024)
por: Li, Jiatong, et al.
Publicado: (2024)
$\texttt{LM}^\texttt{2}$: A Simple Society of Language Models Solves Complex Reasoning
por: Juneja, Gurusha, et al.
Publicado: (2024)
por: Juneja, Gurusha, et al.
Publicado: (2024)
AntigenLM: Structure-Aware DNA Language Modeling for Influenza
por: Pei, Yue, et al.
Publicado: (2026)
por: Pei, Yue, et al.
Publicado: (2026)
LaFFi: Leveraging Hybrid Natural Language Feedback for Fine-tuning Language Models
por: Li, Qianxi, et al.
Publicado: (2023)
por: Li, Qianxi, et al.
Publicado: (2023)
ArXiv-to-Model: A Practical Study of Scientific LM Training
por: Gupta, Anuj
Publicado: (2026)
por: Gupta, Anuj
Publicado: (2026)
UrduLM: A Resource-Efficient Monolingual Urdu Language Model
por: Ali, Syed Muhammad, et al.
Publicado: (2026)
por: Ali, Syed Muhammad, et al.
Publicado: (2026)
REFINE-LM: Mitigating Language Model Stereotypes via Reinforcement Learning
por: Qureshi, Rameez, et al.
Publicado: (2024)
por: Qureshi, Rameez, et al.
Publicado: (2024)
Ejemplares similares
-
WebGames: Challenging General-Purpose Web-Browsing AI Agents
por: Thomas, George, et al.
Publicado: (2025) -
Ask more, know better: Reinforce-Learned Prompt Questions for Decision Making with Large Language Models
por: Yan, Xue, et al.
Publicado: (2023) -
Think Before You Act: Decision Transformers with Working Memory
por: Kang, Jikun, et al.
Publicado: (2023) -
Lightweight Neural App Control
por: Christianos, Filippos, et al.
Publicado: (2024) -
CogLM: Tracking Cognitive Development of Large Language Models
por: Wang, Xinglin, et al.
Publicado: (2024)