The Other Mind: How Language Models Exhibit Human Temporal Cognition
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Lingyu, Yao, Yang, Wang, Yixu, Li, Chubo, Teng, Yan, Wang, Yingchun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Reflection-Bench: Evaluating Epistemic Agency in Large Language Models
por: Li, Lingyu, et al.
Publicado: (2024)
por: Li, Lingyu, et al.
Publicado: (2024)
Mechanistic Origin of Moral Indifference in Language Models
por: Li, Lingyu, et al.
Publicado: (2026)
por: Li, Lingyu, et al.
Publicado: (2026)
AgenticEval: Toward Agentic and Self-Evolving Safety Evaluation of Large Language Models
por: Wang, Yixu, et al.
Publicado: (2025)
por: Wang, Yixu, et al.
Publicado: (2025)
Towards Context-Invariant Safety Alignment for Large Language Models
por: Wang, Yixu, et al.
Publicado: (2026)
por: Wang, Yixu, et al.
Publicado: (2026)
LinguaSafe: A Comprehensive Multilingual Safety Benchmark for Large Language Models
por: Ning, Zhiyuan, et al.
Publicado: (2025)
por: Ning, Zhiyuan, et al.
Publicado: (2025)
Argus Inspection: Do Multimodal Large Language Models Possess the Eye of Panoptes?
por: Yao, Yang, et al.
Publicado: (2025)
por: Yao, Yang, et al.
Publicado: (2025)
Probing the Robustness of Large Language Models Safety to Latent Perturbations
por: Gu, Tianle, et al.
Publicado: (2025)
por: Gu, Tianle, et al.
Publicado: (2025)
A Mousetrap: Fooling Large Reasoning Models for Jailbreak with Chain of Iterative Chaos
por: Yao, Yang, et al.
Publicado: (2025)
por: Yao, Yang, et al.
Publicado: (2025)
Dr. Bench: A Multidimensional Evaluation for Deep Research Agents, from Answers to Reports
por: Yao, Yang, et al.
Publicado: (2025)
por: Yao, Yang, et al.
Publicado: (2025)
IDEATOR: Jailbreaking and Benchmarking Large Vision-Language Models Using Themselves
por: Wang, Ruofan, et al.
Publicado: (2024)
por: Wang, Ruofan, et al.
Publicado: (2024)
SafeVid: Toward Safety Aligned Video Large Multimodal Models
por: Wang, Yixu, et al.
Publicado: (2025)
por: Wang, Yixu, et al.
Publicado: (2025)
MLLMGuard: A Multi-dimensional Safety Evaluation Suite for Multimodal Large Language Models
por: Gu, Tianle, et al.
Publicado: (2024)
por: Gu, Tianle, et al.
Publicado: (2024)
Cognitive-Aligned Spatio-Temporal Large Language Models For Next Point-of-Interest Prediction
por: Zhai, Penglong, et al.
Publicado: (2025)
por: Zhai, Penglong, et al.
Publicado: (2025)
Do Language Models Exhibit the Same Cognitive Biases in Problem Solving as Human Learners?
por: Opedal, Andreas, et al.
Publicado: (2024)
por: Opedal, Andreas, et al.
Publicado: (2024)
Fake Alignment: Are LLMs Really Aligned Well?
por: Wang, Yixu, et al.
Publicado: (2023)
por: Wang, Yixu, et al.
Publicado: (2023)
A-IO: Adaptive Inference Orchestration for Memory-Bound NPUs
por: Zhang, Chen, et al.
Publicado: (2026)
por: Zhang, Chen, et al.
Publicado: (2026)
Visual Large Language Models Exhibit Human-Level Cognitive Flexibility in the Wisconsin Card Sorting Test
por: Hao, Guangfu, et al.
Publicado: (2025)
por: Hao, Guangfu, et al.
Publicado: (2025)
From Sparse Decisions to Dense Reasoning: A Multi-attribute Trajectory Paradigm for Multimodal Moderation
por: Gu, Tianle, et al.
Publicado: (2026)
por: Gu, Tianle, et al.
Publicado: (2026)
CogToM: A Comprehensive Theory of Mind Benchmark inspired by Human Cognition for Large Language Models
por: Tong, Haibo, et al.
Publicado: (2026)
por: Tong, Haibo, et al.
Publicado: (2026)
MEOW: MEMOry Supervised LLM Unlearning Via Inverted Facts
por: Gu, Tianle, et al.
Publicado: (2024)
por: Gu, Tianle, et al.
Publicado: (2024)
MetaMind: General and Cognitive World Models in Multi-Agent Systems by Meta-Theory of Mind
por: Wang, Lingyi, et al.
Publicado: (2026)
por: Wang, Lingyi, et al.
Publicado: (2026)
Flames: Benchmarking Value Alignment of LLMs in Chinese
por: Huang, Kexin, et al.
Publicado: (2023)
por: Huang, Kexin, et al.
Publicado: (2023)
Language Models Exhibit Inconsistent Biases Towards Algorithmic Agents and Human Experts
por: Bo, Jessica Y., et al.
Publicado: (2026)
por: Bo, Jessica Y., et al.
Publicado: (2026)
SpatialBench: Benchmarking Multimodal Large Language Models for Spatial Cognition
por: Xu, Peiran, et al.
Publicado: (2025)
por: Xu, Peiran, et al.
Publicado: (2025)
CogLM: Tracking Cognitive Development of Large Language Models
por: Wang, Xinglin, et al.
Publicado: (2024)
por: Wang, Xinglin, et al.
Publicado: (2024)
Unveiling the Learning Mind of Language Models: A Cognitive Framework and Empirical Study
por: Hu, Zhengyu, et al.
Publicado: (2025)
por: Hu, Zhengyu, et al.
Publicado: (2025)
World2Mind: Cognition Toolkit for Allocentric Spatial Reasoning in Foundation Models
por: Ruan, Shouwei, et al.
Publicado: (2026)
por: Ruan, Shouwei, et al.
Publicado: (2026)
GhostEI-Bench: Do Mobile Agents Resilience to Environmental Injection in Dynamic On-Device Environments?
por: Chen, Chiyu, et al.
Publicado: (2025)
por: Chen, Chiyu, et al.
Publicado: (2025)
Modeling Others' Minds as Code
por: Jha, Kunal, et al.
Publicado: (2025)
por: Jha, Kunal, et al.
Publicado: (2025)
Language Models Largely Exhibit Human-like Constituent Ordering Preferences
por: Tur, Ada Defne, et al.
Publicado: (2025)
por: Tur, Ada Defne, et al.
Publicado: (2025)
Minds on the Move: Decoding Trajectory Prediction in Autonomous Driving with Cognitive Insights
por: Liao, Haicheng, et al.
Publicado: (2025)
por: Liao, Haicheng, et al.
Publicado: (2025)
Harnessing the Intrinsic Knowledge of Pretrained Language Models for Challenging Text Classification Settings
por: Gao, Lingyu
Publicado: (2024)
por: Gao, Lingyu
Publicado: (2024)
MindCraft: How Concept Trees Take Shape In Deep Models
por: Tian, Bowei, et al.
Publicado: (2025)
por: Tian, Bowei, et al.
Publicado: (2025)
Do LLMs Exhibit Human-Like Reasoning? Evaluating Theory of Mind in LLMs for Open-Ended Responses
por: Amirizaniani, Maryam, et al.
Publicado: (2024)
por: Amirizaniani, Maryam, et al.
Publicado: (2024)
How to Exhibit More Predictable Behaviors
por: Lepers, Salomé, et al.
Publicado: (2024)
por: Lepers, Salomé, et al.
Publicado: (2024)
Automatic Minds: Cognitive Parallels Between Hypnotic States and Large Language Model Processing
por: Riva, Giuseppe, et al.
Publicado: (2025)
por: Riva, Giuseppe, et al.
Publicado: (2025)
Instructed to Bias: Instruction-Tuned Language Models Exhibit Emergent Cognitive Bias
por: Itzhak, Itay, et al.
Publicado: (2023)
por: Itzhak, Itay, et al.
Publicado: (2023)
Beyond Correctness: Confidence-Aware Reward Modeling for Enhancing Large Language Model Reasoning
por: He, Qianxi, et al.
Publicado: (2025)
por: He, Qianxi, et al.
Publicado: (2025)
Do LLMs Know When to Flip a Coin? Strategic Randomization through Reasoning and Experience
por: Yang, Lingyu
Publicado: (2025)
por: Yang, Lingyu
Publicado: (2025)
Through the Theory of Mind's Eye: Reading Minds with Multimodal Video Large Language Models
por: Chen, Zhawnen, et al.
Publicado: (2024)
por: Chen, Zhawnen, et al.
Publicado: (2024)
Ejemplares similares
-
Reflection-Bench: Evaluating Epistemic Agency in Large Language Models
por: Li, Lingyu, et al.
Publicado: (2024) -
Mechanistic Origin of Moral Indifference in Language Models
por: Li, Lingyu, et al.
Publicado: (2026) -
AgenticEval: Toward Agentic and Self-Evolving Safety Evaluation of Large Language Models
por: Wang, Yixu, et al.
Publicado: (2025) -
Towards Context-Invariant Safety Alignment for Large Language Models
por: Wang, Yixu, et al.
Publicado: (2026) -
LinguaSafe: A Comprehensive Multilingual Safety Benchmark for Large Language Models
por: Ning, Zhiyuan, et al.
Publicado: (2025)