CogMem: A Cognitive Memory Architecture for Sustained Multi-Turn Reasoning in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Yiran, Hu, Jincheng, Dras, Mark, Naseem, Usman |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Beyond the Black Box: Demystifying Multi-Turn LLM Reasoning with VISTA
por: Zhang, Yiran, et al.
Publicado: (2025)
por: Zhang, Yiran, et al.
Publicado: (2025)
AlignCultura: Towards Culturally Aligned Large Language Models?
por: Kashyap, Gautam Siddharth, et al.
Publicado: (2026)
por: Kashyap, Gautam Siddharth, et al.
Publicado: (2026)
TurnBench-MS: A Benchmark for Evaluating Multi-Turn, Multi-Step Reasoning in Large Language Models
por: Zhang, Yiran, et al.
Publicado: (2025)
por: Zhang, Yiran, et al.
Publicado: (2025)
Seeing the Threat: Vulnerabilities in Vision-Language Models to Adversarial Attack
por: Ren, Juan, et al.
Publicado: (2025)
por: Ren, Juan, et al.
Publicado: (2025)
Framing Political Bias in Multilingual LLMs Across Pakistani Languages
por: Nadeem, Afrozah, et al.
Publicado: (2025)
por: Nadeem, Afrozah, et al.
Publicado: (2025)
Over-Refusal and Representation Subspaces: A Mechanistic Analysis of Task-Conditioned Refusal in Aligned LLMs
por: Maskey, Utsav, et al.
Publicado: (2026)
por: Maskey, Utsav, et al.
Publicado: (2026)
SHIELD: Classifier-Guided Prompting for Robust and Safer LVLMs
por: Ren, Juan, et al.
Publicado: (2025)
por: Ren, Juan, et al.
Publicado: (2025)
Should LLM Safety Be More Than Refusing Harmful Instructions?
por: Maskey, Utsav, et al.
Publicado: (2025)
por: Maskey, Utsav, et al.
Publicado: (2025)
Steering Over-refusals Towards Safety in Retrieval Augmented Generation
por: Maskey, Utsav, et al.
Publicado: (2025)
por: Maskey, Utsav, et al.
Publicado: (2025)
When the Model Said 'No Comment', We Knew Helpfulness Was Dead, Honesty Was Alive, and Safety Was Terrified
por: Kashyap, Gautam Siddharth, et al.
Publicado: (2026)
por: Kashyap, Gautam Siddharth, et al.
Publicado: (2026)
Steering Towards Fairness: Mitigating Political Bias in LLMs
por: Nadeem, Afrozah, et al.
Publicado: (2025)
por: Nadeem, Afrozah, et al.
Publicado: (2025)
Fairness Evaluation and Inference Level Mitigation in LLMs
por: Nadeem, Afrozah, et al.
Publicado: (2025)
por: Nadeem, Afrozah, et al.
Publicado: (2025)
We Think, Therefore We Align LLMs to Helpful, Harmless and Honest Before They Go Wrong
por: Kashyap, Gautam Siddharth, et al.
Publicado: (2025)
por: Kashyap, Gautam Siddharth, et al.
Publicado: (2025)
Too Helpful, Too Harmless, Too Honest or Just Right?
por: Kashyap, Gautam Siddharth, et al.
Publicado: (2025)
por: Kashyap, Gautam Siddharth, et al.
Publicado: (2025)
SafeConstellations: Mitigating Over-Refusals in LLMs Through Task-Aware Representation Steering
por: Maskey, Utsav, et al.
Publicado: (2025)
por: Maskey, Utsav, et al.
Publicado: (2025)
MemCog: From Memory-as-Tool to Memory-as-Cognition in Conversational Agents
por: Li, Zihan, et al.
Publicado: (2026)
por: Li, Zihan, et al.
Publicado: (2026)
VITAL: A New Dataset for Benchmarking Pluralistic Alignment in Healthcare
por: Shetty, Anudeex, et al.
Publicado: (2025)
por: Shetty, Anudeex, et al.
Publicado: (2025)
Mechanistic Interpretability for Large Language Model Alignment: Progress, Challenges, and Future Directions
por: Naseem, Usman
Publicado: (2026)
por: Naseem, Usman
Publicado: (2026)
VaxGuard: A Multi-Generator, Multi-Type, and Multi-Role Dataset for Detecting LLM-Generated Vaccine Misinformation
por: Ahmad, Syed Talal, et al.
Publicado: (2025)
por: Ahmad, Syed Talal, et al.
Publicado: (2025)
Agentic Moderation: Multi-Agent Design for Safer Vision-Language Models
por: Ren, Juan, et al.
Publicado: (2025)
por: Ren, Juan, et al.
Publicado: (2025)
CogAtom: From Cognitive Atoms to Olympiad-level Mathematical Reasoning in Large Language Models
por: Chen, Zhuofan, et al.
Publicado: (2025)
por: Chen, Zhuofan, et al.
Publicado: (2025)
CogLM: Tracking Cognitive Development of Large Language Models
por: Wang, Xinglin, et al.
Publicado: (2024)
por: Wang, Xinglin, et al.
Publicado: (2024)
Benchmarking Large Language Models for Cryptanalysis and Side-Channel Vulnerabilities
por: Maskey, Utsav, et al.
Publicado: (2025)
por: Maskey, Utsav, et al.
Publicado: (2025)
A Survey on Progress in LLM Alignment from the Perspective of Reward Design
por: Ji, Miaomiao, et al.
Publicado: (2025)
por: Ji, Miaomiao, et al.
Publicado: (2025)
Reversal of Thought: Enhancing Large Language Models with Preference-Guided Reverse Reasoning Warm-up
por: Yuan, Jiahao, et al.
Publicado: (2024)
por: Yuan, Jiahao, et al.
Publicado: (2024)
EvolMem: A Cognitive-Driven Benchmark for Multi-Session Dialogue Memory
por: Shen, Ye, et al.
Publicado: (2026)
por: Shen, Ye, et al.
Publicado: (2026)
PersoBench: Benchmarking Personalized Response Generation in Large Language Models
por: Afzoon, Saleh, et al.
Publicado: (2024)
por: Afzoon, Saleh, et al.
Publicado: (2024)
XGUARD: A Graded Benchmark for Evaluating Safety Failures of Large Language Models on Extremist Content
por: Abishethvarman, Vadivel, et al.
Publicado: (2025)
por: Abishethvarman, Vadivel, et al.
Publicado: (2025)
DUAL-Bench: Measuring Over-Refusal and Robustness in Vision-Language Models
por: Ren, Kaixuan, et al.
Publicado: (2025)
por: Ren, Kaixuan, et al.
Publicado: (2025)
TokMem: One-Token Procedural Memory for Large Language Models
por: Wu, Zijun, et al.
Publicado: (2025)
por: Wu, Zijun, et al.
Publicado: (2025)
CogRAG+: Cognitive-Level Guided Diagnosis and Remediation of Memory and Reasoning Deficiencies in Professional Exam QA
por: Wang, Xudong, et al.
Publicado: (2026)
por: Wang, Xudong, et al.
Publicado: (2026)
From Generation to Detection: A Multimodal Multi-Task Dataset for Benchmarking Health Misinformation
por: Zhang, Zhihao, et al.
Publicado: (2025)
por: Zhang, Zhihao, et al.
Publicado: (2025)
CogGPT: Unleashing the Power of Cognitive Dynamics on Large Language Models
por: Lv, Yaojia, et al.
Publicado: (2024)
por: Lv, Yaojia, et al.
Publicado: (2024)
MulCogBench: A Multi-modal Cognitive Benchmark Dataset for Evaluating Chinese and English Computational Language Models
por: Zhang, Yunhao, et al.
Publicado: (2024)
por: Zhang, Yunhao, et al.
Publicado: (2024)
LLM-MemCluster: Empowering Large Language Models with Dynamic Memory for Text Clustering
por: Zhu, Yuanjie, et al.
Publicado: (2025)
por: Zhu, Yuanjie, et al.
Publicado: (2025)
G-MemLLM: Gated Latent Memory Augmentation for Long-Context Reasoning in Large Language Models
por: Xu, Xun
Publicado: (2026)
por: Xu, Xun
Publicado: (2026)
Web-CogReasoner: Towards Knowledge-Induced Cognitive Reasoning for Web Agents
por: Guo, Yuhan, et al.
Publicado: (2025)
por: Guo, Yuhan, et al.
Publicado: (2025)
Do Personality Traits Interfere? Geometric Limitations of Steering in Large Language Models
por: Bhandari, Pranav, et al.
Publicado: (2026)
por: Bhandari, Pranav, et al.
Publicado: (2026)
Myanmar XNLI: Building a Dataset and Exploring Low-resource Approaches to Natural Language Inference with Myanmar
por: Htet, Aung Kyaw, et al.
Publicado: (2025)
por: Htet, Aung Kyaw, et al.
Publicado: (2025)
MemOS: An Operating System for Memory-Augmented Generation (MAG) in Large Language Models
por: Li, Zhiyu, et al.
Publicado: (2025)
por: Li, Zhiyu, et al.
Publicado: (2025)
Ejemplares similares
-
Beyond the Black Box: Demystifying Multi-Turn LLM Reasoning with VISTA
por: Zhang, Yiran, et al.
Publicado: (2025) -
AlignCultura: Towards Culturally Aligned Large Language Models?
por: Kashyap, Gautam Siddharth, et al.
Publicado: (2026) -
TurnBench-MS: A Benchmark for Evaluating Multi-Turn, Multi-Step Reasoning in Large Language Models
por: Zhang, Yiran, et al.
Publicado: (2025) -
Seeing the Threat: Vulnerabilities in Vision-Language Models to Adversarial Attack
por: Ren, Juan, et al.
Publicado: (2025) -
Framing Political Bias in Multilingual LLMs Across Pakistani Languages
por: Nadeem, Afrozah, et al.
Publicado: (2025)