ImplicitMemBench: Measuring Unconscious Behavioral Adaptation in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Qin, Chonghan, Feng, Xiachong, Ma, Weitao, Feng, Xiaocheng, Kong, Lingpeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The Granularity Axis: A Micro-to-Macro Latent Direction for Social Roles in Language Models
di: Qin, Chonghan, et al.
Pubblicazione: (2026)
di: Qin, Chonghan, et al.
Pubblicazione: (2026)
SAVOIR: Learning Social Savoir-Faire via Shapley-based Reward Attribution
di: Feng, Xiachong, et al.
Pubblicazione: (2026)
di: Feng, Xiachong, et al.
Pubblicazione: (2026)
Reasoning Does Not Necessarily Improve Role-Playing Ability
di: Feng, Xiachong, et al.
Pubblicazione: (2025)
di: Feng, Xiachong, et al.
Pubblicazione: (2025)
PERSONA: Dynamic and Compositional Inference-Time Personality Control via Activation Vector Algebra
di: Feng, Xiachong, et al.
Pubblicazione: (2026)
di: Feng, Xiachong, et al.
Pubblicazione: (2026)
Stratagem: Learning Transferable Reasoning via Trajectory-Modulated Game Self-Play
di: Feng, Xiachong, et al.
Pubblicazione: (2026)
di: Feng, Xiachong, et al.
Pubblicazione: (2026)
Learning Fine-Grained Grounded Citations for Attributed Large Language Models
di: Huang, Lei, et al.
Pubblicazione: (2024)
di: Huang, Lei, et al.
Pubblicazione: (2024)
A Survey on Large Language Model-Based Social Agents in Game-Theoretic Scenarios
di: Feng, Xiachong, et al.
Pubblicazione: (2024)
di: Feng, Xiachong, et al.
Pubblicazione: (2024)
GlobeSumm: A Challenging Benchmark Towards Unifying Multi-lingual, Cross-lingual and Multi-document News Summarization
di: Ye, Yangfan, et al.
Pubblicazione: (2024)
di: Ye, Yangfan, et al.
Pubblicazione: (2024)
TMGBench: A Systematic Game Benchmark for Evaluating Strategic Reasoning Abilities of LLMs
di: Wang, Haochuan, et al.
Pubblicazione: (2024)
di: Wang, Haochuan, et al.
Pubblicazione: (2024)
Advancing Large Language Model Attribution through Self-Improving
di: Huang, Lei, et al.
Pubblicazione: (2024)
di: Huang, Lei, et al.
Pubblicazione: (2024)
Adaptive Backtracking for Privacy Protection in Large Language Models
di: Yao, Zhihao, et al.
Pubblicazione: (2025)
di: Yao, Zhihao, et al.
Pubblicazione: (2025)
Investigating and Mitigating the Multimodal Hallucination Snowballing in Large Vision-Language Models
di: Zhong, Weihong, et al.
Pubblicazione: (2024)
di: Zhong, Weihong, et al.
Pubblicazione: (2024)
Unveiling Entity-Level Unlearning for Large Language Models: A Comprehensive Analysis
di: Ma, Weitao, et al.
Pubblicazione: (2024)
di: Ma, Weitao, et al.
Pubblicazione: (2024)
Causal Tracing of Object Representations in Large Vision Language Models: Mechanistic Interpretability and Hallucination Mitigation
di: Li, Qiming, et al.
Pubblicazione: (2025)
di: Li, Qiming, et al.
Pubblicazione: (2025)
Understanding the Role of LLMs in Multimodal Evaluation Benchmarks
di: Jiang, Botian, et al.
Pubblicazione: (2024)
di: Jiang, Botian, et al.
Pubblicazione: (2024)
Large Language Models Meet NLP: A Survey
di: Qin, Libo, et al.
Pubblicazione: (2024)
di: Qin, Libo, et al.
Pubblicazione: (2024)
From Hypothesis to Publication: A Comprehensive Survey of AI-Driven Research Support Systems
di: Zhou, Zekun, et al.
Pubblicazione: (2025)
di: Zhou, Zekun, et al.
Pubblicazione: (2025)
Linguistic Frameworks Go Toe-to-Toe at Neuro-Symbolic Language Modeling
di: Prange, Jakob, et al.
Pubblicazione: (2021)
di: Prange, Jakob, et al.
Pubblicazione: (2021)
Fine-Mem: Fine-Grained Feedback Alignment for Long-Horizon Memory Management
di: Ma, Weitao, et al.
Pubblicazione: (2026)
di: Ma, Weitao, et al.
Pubblicazione: (2026)
BioMaze: Benchmarking and Enhancing Large Language Models for Biological Pathway Reasoning
di: Zhao, Haiteng, et al.
Pubblicazione: (2025)
di: Zhao, Haiteng, et al.
Pubblicazione: (2025)
PromptCoT: Synthesizing Olympiad-level Problems for Mathematical Reasoning in Large Language Models
di: Zhao, Xueliang, et al.
Pubblicazione: (2025)
di: Zhao, Xueliang, et al.
Pubblicazione: (2025)
Non-myopic Generation of Language Models for Reasoning and Planning
di: Ma, Chang, et al.
Pubblicazione: (2024)
di: Ma, Chang, et al.
Pubblicazione: (2024)
Not All Tokens See Equally: Perception-Grounded Policy Optimization for Large Vision-Language Models
di: Ye, Zekai, et al.
Pubblicazione: (2026)
di: Ye, Zekai, et al.
Pubblicazione: (2026)
Empowering Large Language Model Agents through Action Learning
di: Zhao, Haiteng, et al.
Pubblicazione: (2024)
di: Zhao, Haiteng, et al.
Pubblicazione: (2024)
Medical Reasoning with Large Language Models: A Survey and MR-Bench
di: Ren, Xiaohan, et al.
Pubblicazione: (2026)
di: Ren, Xiaohan, et al.
Pubblicazione: (2026)
Proxy Compression for Language Modeling
di: Zheng, Lin, et al.
Pubblicazione: (2026)
di: Zheng, Lin, et al.
Pubblicazione: (2026)
Reflection-Bench: Evaluating Epistemic Agency in Large Language Models
di: Li, Lingyu, et al.
Pubblicazione: (2024)
di: Li, Lingyu, et al.
Pubblicazione: (2024)
CheeseBench: Evaluating Large Language Models on Rodent Behavioral Neuroscience Paradigms
di: Bugaud, Zacharie
Pubblicazione: (2026)
di: Bugaud, Zacharie
Pubblicazione: (2026)
Implicit Search via Discrete Diffusion: A Study on Chess
di: Ye, Jiacheng, et al.
Pubblicazione: (2025)
di: Ye, Jiacheng, et al.
Pubblicazione: (2025)
CoMT: A Novel Benchmark for Chain of Multi-modal Thought on Large Vision-Language Models
di: Cheng, Zihui, et al.
Pubblicazione: (2024)
di: Cheng, Zihui, et al.
Pubblicazione: (2024)
UniMem: Towards a Unified View of Long-Context Large Language Models
di: Fang, Junjie, et al.
Pubblicazione: (2024)
di: Fang, Junjie, et al.
Pubblicazione: (2024)
MemBench: Towards More Comprehensive Evaluation on the Memory of LLM-based Agents
di: Tan, Haoran, et al.
Pubblicazione: (2025)
di: Tan, Haoran, et al.
Pubblicazione: (2025)
CASE-Bench: Context-Aware SafEty Benchmark for Large Language Models
di: Sun, Guangzhi, et al.
Pubblicazione: (2025)
di: Sun, Guangzhi, et al.
Pubblicazione: (2025)
OMIBench: Benchmarking Olympiad-Level Multi-Image Reasoning in Large Vision-Language Model
di: Chen, Qiguang, et al.
Pubblicazione: (2026)
di: Chen, Qiguang, et al.
Pubblicazione: (2026)
MDIT-Bench: Evaluating the Dual-Implicit Toxicity in Large Multimodal Models
di: Jin, Bohan, et al.
Pubblicazione: (2025)
di: Jin, Bohan, et al.
Pubblicazione: (2025)
ImgTrojan: Jailbreaking Vision-Language Models with ONE Image
di: Tao, Xijia, et al.
Pubblicazione: (2024)
di: Tao, Xijia, et al.
Pubblicazione: (2024)
Implicit Reasoning in Large Language Models: A Comprehensive Survey
di: Li, Jindong, et al.
Pubblicazione: (2025)
di: Li, Jindong, et al.
Pubblicazione: (2025)
SarcasmBench: Towards Evaluating Large Language Models on Sarcasm Understanding
di: Zhang, Yazhou, et al.
Pubblicazione: (2024)
di: Zhang, Yazhou, et al.
Pubblicazione: (2024)
CogBench: A Large Language Model Benchmark for Multilingual Speech-Based Cognitive Impairment Assessment
di: Feng, Rui, et al.
Pubblicazione: (2025)
di: Feng, Rui, et al.
Pubblicazione: (2025)
MemTrace: Tracing and Attributing Errors in Large Language Model Memory Systems
di: Deng, Xinle, et al.
Pubblicazione: (2026)
di: Deng, Xinle, et al.
Pubblicazione: (2026)
Documenti analoghi
-
The Granularity Axis: A Micro-to-Macro Latent Direction for Social Roles in Language Models
di: Qin, Chonghan, et al.
Pubblicazione: (2026) -
SAVOIR: Learning Social Savoir-Faire via Shapley-based Reward Attribution
di: Feng, Xiachong, et al.
Pubblicazione: (2026) -
Reasoning Does Not Necessarily Improve Role-Playing Ability
di: Feng, Xiachong, et al.
Pubblicazione: (2025) -
PERSONA: Dynamic and Compositional Inference-Time Personality Control via Activation Vector Algebra
di: Feng, Xiachong, et al.
Pubblicazione: (2026) -
Stratagem: Learning Transferable Reasoning via Trajectory-Modulated Game Self-Play
di: Feng, Xiachong, et al.
Pubblicazione: (2026)