Pelican-VL 1.0: A Foundation Brain Model for Embodied Intelligence
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Yi, Liu, Che, Ren, Xiancong, Ni, Hanchu, Zhang, Shuai, Ding, Zeyuan, Hu, Jiayu, Shan, Hanzhe, Niu, Zhenwei, Liu, Zhaoyang, Liu, Shuang, Zhao, Yue, Qi, Junbo, Zhang, Qinfan, Li, Dengjie, Wang, Yidong, Luo, Jiachen, Dai, Yong, Xu, Zenglin, Shen, Bin, Wang, Qifan, Tang, Jian, Ju, Xiaozhu |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Bridging VLMs and Embodied Intelligence with Deliberate Practice Policy Optimization
by: Zhang, Yi, et al.
Published: (2025)
by: Zhang, Yi, et al.
Published: (2025)
Pelican-Unify 1.0: A Unified Embodied Intelligence Model for Understanding, Reasoning, Imagination and Action
by: Zhang, Yi, et al.
Published: (2026)
by: Zhang, Yi, et al.
Published: (2026)
EPIC-Bench: A Perception-Centric Benchmark for Fine-Grained Embodied Visual Grounding in Vision-Language Models
by: Shan, Haozhe, et al.
Published: (2026)
by: Shan, Haozhe, et al.
Published: (2026)
Robo-Cortex: A Self-Evolving Embodied Agent via Dual-Grain Cognitive Memory and Autonomous Knowledge Induction
by: Chan, Nga Teng, et al.
Published: (2026)
by: Chan, Nga Teng, et al.
Published: (2026)
VLA-Trace: Diagnosing Vision-Language-Action Models through Representation and Behavior Tracing
by: Shi, Haoyuan, et al.
Published: (2026)
by: Shi, Haoyuan, et al.
Published: (2026)
A2Eval: Agentic and Automated Evaluation for Embodied Brain
by: Zhang, Shuai, et al.
Published: (2026)
by: Zhang, Shuai, et al.
Published: (2026)
Synchronized Online Friction Estimation and Adaptive Grasp Control for Robust Gentle Grasp
by: Niu, Zhenwei, et al.
Published: (2026)
by: Niu, Zhenwei, et al.
Published: (2026)
Advocating for the Silent: Enhancing Federated Generalization for Non-Participating Clients
by: Wu, Zheshun, et al.
Published: (2023)
by: Wu, Zheshun, et al.
Published: (2023)
EmbodiedVSR: Dynamic Scene Graph-Guided Chain-of-Thought Reasoning for Visual Spatial Tasks
by: Zhang, Yi, et al.
Published: (2025)
by: Zhang, Yi, et al.
Published: (2025)
Body Discovery of Embodied AI
by: Sun, Zhe, et al.
Published: (2025)
by: Sun, Zhe, et al.
Published: (2025)
IDInit: A Universal and Stable Initialization Method for Neural Network Training
by: Pan, Yu, et al.
Published: (2025)
by: Pan, Yu, et al.
Published: (2025)
Simple Yet Effective: Extracting Private Data Across Clients in Federated Fine-Tuning of Large Language Models
by: Hu, Yingqi, et al.
Published: (2025)
by: Hu, Yingqi, et al.
Published: (2025)
Ella: Embodied Social Agents with Lifelong Memory
by: Zhang, Hongxin, et al.
Published: (2025)
by: Zhang, Hongxin, et al.
Published: (2025)
Pelicans
by: Le Souëf, Albert Sherbourne
Published: (1920)
by: Le Souëf, Albert Sherbourne
Published: (1920)
SDAR-VL: Stable and Efficient Block-wise Diffusion for Vision-Language Understanding
by: Cheng, Shuang, et al.
Published: (2025)
by: Cheng, Shuang, et al.
Published: (2025)
On the Power of Adaptive Weighted Aggregation in Heterogeneous Federated Learning and Beyond
by: Zeng, Dun, et al.
Published: (2023)
by: Zeng, Dun, et al.
Published: (2023)
Learning Agile Swimming: An End-to-End Approach without CPGs
by: Lin, Xiaozhu, et al.
Published: (2024)
by: Lin, Xiaozhu, et al.
Published: (2024)
Guideline Forest: Retrieval-Augmented Reasoning with Branching Experience-Induced Guidelines
by: Chen, Jiaxiang, et al.
Published: (2025)
by: Chen, Jiaxiang, et al.
Published: (2025)
Singpath-VL Technical Report
by: Qiu, Zhen, et al.
Published: (2026)
by: Qiu, Zhen, et al.
Published: (2026)
FinHEAR: Human Expertise and Adaptive Risk-Aware Temporal Reasoning for Financial Decision-Making
by: Chen, Jiaxiang, et al.
Published: (2025)
by: Chen, Jiaxiang, et al.
Published: (2025)
FewFedPIT: Towards Privacy-preserving and Few-shot Federated Instruction Tuning
by: Zhang, Zhuo, et al.
Published: (2024)
by: Zhang, Zhuo, et al.
Published: (2024)
Fluctuation Response Patterns of Network Dynamics -- an Introduction
by: Zhang, Xiaozhu, et al.
Published: (2024)
by: Zhang, Xiaozhu, et al.
Published: (2024)
Nexus: An Omni-Perceptive And -Interactive Model for Language, Audio, And Vision
by: Liu, Che, et al.
Published: (2025)
by: Liu, Che, et al.
Published: (2025)
Controlled chain‐growth thiol‐Michael polymerization
by: Suqiu Jiang, et al.
Published: (2024)
by: Suqiu Jiang, et al.
Published: (2024)
Reversible Thiyl Radical Addition−Fragmentation Chain Transfer Polymerization
by: Yongjin Wang, et al.
Published: (2024)
by: Yongjin Wang, et al.
Published: (2024)
Reversible Thiyl Radical Addition−Fragmentation Chain Transfer Polymerization
by: Yongjin Wang, et al.
Published: (2024)
by: Yongjin Wang, et al.
Published: (2024)
SEEA-R1: Tree-Structured Reinforcement Fine-Tuning for Self-Evolving Embodied Agents
by: Tian, Wanxin, et al.
Published: (2025)
by: Tian, Wanxin, et al.
Published: (2025)
ShotVL: Human-Centric Highlight Frame Retrieval via Language Queries
by: Xue, Wangyu, et al.
Published: (2024)
by: Xue, Wangyu, et al.
Published: (2024)
Notes on Pelican Island
by: NA
Published: (1911)
by: NA
Published: (1911)
MiMo-VL Technical Report
by: Core Team, et al.
Published: (2025)
by: Core Team, et al.
Published: (2025)
VL-GenRM: Enhancing Vision-Language Verification via Vision Experts and Iterative Training
by: Zhang, Jipeng, et al.
Published: (2025)
by: Zhang, Jipeng, et al.
Published: (2025)
Third-order Orbital Corner State and its Realization in Acoustic Crystals
by: Wang, Jiyu, et al.
Published: (2024)
by: Wang, Jiyu, et al.
Published: (2024)
Structural Optimization Design of Vacuum Interrupter Based on Transient Electric Field Distribution
by: Can Ding, et al.
Published: (2024)
by: Can Ding, et al.
Published: (2024)
JW-VL: A Vision-Language Model for Solar Physics
by: Shao, Mingfu, et al.
Published: (2026)
by: Shao, Mingfu, et al.
Published: (2026)
Topological phases in twisted Rashba superconductors
by: Lin, Conghao, et al.
Published: (2024)
by: Lin, Conghao, et al.
Published: (2024)
HY-Embodied-0.5: Embodied Foundation Models for Real-World Agents
by: X, Tencent Robotics, et al.
Published: (2026)
by: X, Tencent Robotics, et al.
Published: (2026)
Multi-Scenario User Profile Construction via Recommendation Lists
by: Zhang, Hui, et al.
Published: (2026)
by: Zhang, Hui, et al.
Published: (2026)
KairosVL: Orchestrating Time Series and Semantics for Unified Reasoning
by: Si, Haotian, et al.
Published: (2026)
by: Si, Haotian, et al.
Published: (2026)
Qwen3-VL Technical Report
by: Bai, Shuai, et al.
Published: (2025)
by: Bai, Shuai, et al.
Published: (2025)
The White Pelican in the Province of Quebec
by: Casgrain, A. Chase
Published: (1937)
by: Casgrain, A. Chase
Published: (1937)
Similar Items
-
Bridging VLMs and Embodied Intelligence with Deliberate Practice Policy Optimization
by: Zhang, Yi, et al.
Published: (2025) -
Pelican-Unify 1.0: A Unified Embodied Intelligence Model for Understanding, Reasoning, Imagination and Action
by: Zhang, Yi, et al.
Published: (2026) -
EPIC-Bench: A Perception-Centric Benchmark for Fine-Grained Embodied Visual Grounding in Vision-Language Models
by: Shan, Haozhe, et al.
Published: (2026) -
Robo-Cortex: A Self-Evolving Embodied Agent via Dual-Grain Cognitive Memory and Autonomous Knowledge Induction
by: Chan, Nga Teng, et al.
Published: (2026) -
VLA-Trace: Diagnosing Vision-Language-Action Models through Representation and Behavior Tracing
by: Shi, Haoyuan, et al.
Published: (2026)