Compass-Thinker-7B Technical Report
Fuente:
arXiv
Saved in:
| Main Authors: | Zeng, Anxiang, Zhang, Haibo, Mo, Kaixiang, Zhang, Long, Liu, Shuman, Huang, Yanhui, Liu, Yawen, Sheng, Yuepeng, Huang, Yuwei |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
ESPO: Entropy Importance Sampling Policy Optimization
by: Sheng, Yuepeng, et al.
Published: (2025)
by: Sheng, Yuepeng, et al.
Published: (2025)
Each Prompt Matters: Scaling Reinforcement Learning Without Wasting Rollouts on Hundred-Billion-Scale MoE
by: Zeng, Anxiang, et al.
Published: (2025)
by: Zeng, Anxiang, et al.
Published: (2025)
Compass-Embedding v4: Robust Contrastive Learning for Multilingual E-commerce Embeddings
by: Ueareeworakul, Pakorn, et al.
Published: (2025)
by: Ueareeworakul, Pakorn, et al.
Published: (2025)
Towards Reliable Evaluation of Large Language Models for Multilingual and Multimodal E-Commerce Applications
by: Xie, Shuyi, et al.
Published: (2025)
by: Xie, Shuyi, et al.
Published: (2025)
Mid-Training of Large Language Models: A Survey
by: Mo, Kaixiang, et al.
Published: (2025)
by: Mo, Kaixiang, et al.
Published: (2025)
Optimal Transport-Based Token Weighting scheme for Enhanced Preference Optimization
by: Li, Meng, et al.
Published: (2025)
by: Li, Meng, et al.
Published: (2025)
Safety Instincts: LLMs Learn to Trust Their Internal Compass for Self-Defense
by: Shen, Guobin, et al.
Published: (2025)
by: Shen, Guobin, et al.
Published: (2025)
Establishing Reliability Metrics for Reward Models in Large Language Models
by: Chen, Yizhou, et al.
Published: (2025)
by: Chen, Yizhou, et al.
Published: (2025)
From Thinker to Society: Security in Hierarchical Autonomy Evolution of AI Agents
by: Zhang, Xiaolei, et al.
Published: (2026)
by: Zhang, Xiaolei, et al.
Published: (2026)
PreferThinker: Reasoning-based Personalized Image Preference Assessment
by: Xu, Shengqi, et al.
Published: (2025)
by: Xu, Shengqi, et al.
Published: (2025)
AMAP Agentic Planning Technical Report
by: AMAP AI Agent Team, et al.
Published: (2025)
by: AMAP AI Agent Team, et al.
Published: (2025)
Decomposing and Steering Functional Metacognition in Large Language Models
by: Li, Yanshi, et al.
Published: (2026)
by: Li, Yanshi, et al.
Published: (2026)
Xmodel-LM Technical Report
by: Wang, Yichuan, et al.
Published: (2024)
by: Wang, Yichuan, et al.
Published: (2024)
SafeThinker: Reasoning about Risk to Deepen Safety Beyond Shallow Alignment
by: Fang, Xianya, et al.
Published: (2026)
by: Fang, Xianya, et al.
Published: (2026)
dots.llm1 Technical Report
by: Huo, Bi, et al.
Published: (2025)
by: Huo, Bi, et al.
Published: (2025)
Trillion 7B Technical Report
by: Han, Sungjun, et al.
Published: (2025)
by: Han, Sungjun, et al.
Published: (2025)
BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens
by: Wen, Hao, et al.
Published: (2025)
by: Wen, Hao, et al.
Published: (2025)
XekRung Technical Report
by: Zeng, Jiutian, et al.
Published: (2026)
by: Zeng, Jiutian, et al.
Published: (2026)
Apriel-Nemotron-15B-Thinker
by: Radhakrishna, Shruthan, et al.
Published: (2025)
by: Radhakrishna, Shruthan, et al.
Published: (2025)
CodeShell Technical Report
by: Xie, Rui, et al.
Published: (2024)
by: Xie, Rui, et al.
Published: (2024)
Tele-FLM Technical Report
by: Li, Xiang, et al.
Published: (2024)
by: Li, Xiang, et al.
Published: (2024)
BlueLM-2.5-3B Technical Report
by: Xiong, Baojiao, et al.
Published: (2025)
by: Xiong, Baojiao, et al.
Published: (2025)
ParaThinker: Native Parallel Thinking as a New Paradigm to Scale LLM Test-time Compute
by: Wen, Hao, et al.
Published: (2025)
by: Wen, Hao, et al.
Published: (2025)
SPEC-RL: Accelerating On-Policy Reinforcement Learning with Speculative Rollouts
by: Liu, Bingshuai, et al.
Published: (2025)
by: Liu, Bingshuai, et al.
Published: (2025)
LongCat-Flash-Thinking-2601 Technical Report
by: Meituan LongCat Team, et al.
Published: (2026)
by: Meituan LongCat Team, et al.
Published: (2026)
xLLM Technical Report
by: Liu, Tongxuan, et al.
Published: (2025)
by: Liu, Tongxuan, et al.
Published: (2025)
HoloMotion-1 Technical Report
by: Chen, Maiyue, et al.
Published: (2026)
by: Chen, Maiyue, et al.
Published: (2026)
GeoGPT-RAG Technical Report
by: Huang, Fei, et al.
Published: (2025)
by: Huang, Fei, et al.
Published: (2025)
TeleChat Technical Report
by: He, Zhongjiang, et al.
Published: (2024)
by: He, Zhongjiang, et al.
Published: (2024)
Introducing LongCat-Flash-Thinking: A Technical Report
by: Meituan LongCat Team, et al.
Published: (2025)
by: Meituan LongCat Team, et al.
Published: (2025)
WebCompass: Towards Multimodal Web Coding Evaluation for Code Language Models
by: Lei, Xinping, et al.
Published: (2026)
by: Lei, Xinping, et al.
Published: (2026)
Leum-VL Technical Report
by: He, Yuxuan, et al.
Published: (2026)
by: He, Yuxuan, et al.
Published: (2026)
Xmodel-2 Technical Report
by: Qun, Wang, et al.
Published: (2024)
by: Qun, Wang, et al.
Published: (2024)
Logics-Parsing-Omni Technical Report
by: An, Xin, et al.
Published: (2026)
by: An, Xin, et al.
Published: (2026)
GenesisGeo: Technical Report
by: Zhu, Minfeng, et al.
Published: (2025)
by: Zhu, Minfeng, et al.
Published: (2025)
Skywork Open Reasoner 1 Technical Report
by: He, Jujie, et al.
Published: (2025)
by: He, Jujie, et al.
Published: (2025)
MOSS-Audio Technical Report
by: Yang, Chen, et al.
Published: (2026)
by: Yang, Chen, et al.
Published: (2026)
IQuest-Coder-V1 Technical Report
by: Yang, Jian, et al.
Published: (2026)
by: Yang, Jian, et al.
Published: (2026)
Qwen2 Technical Report
by: Yang, An, et al.
Published: (2024)
by: Yang, An, et al.
Published: (2024)
SmallThinker: A Family of Efficient Large Language Models Natively Trained for Local Deployment
by: Song, Yixin, et al.
Published: (2025)
by: Song, Yixin, et al.
Published: (2025)
Similar Items
-
ESPO: Entropy Importance Sampling Policy Optimization
by: Sheng, Yuepeng, et al.
Published: (2025) -
Each Prompt Matters: Scaling Reinforcement Learning Without Wasting Rollouts on Hundred-Billion-Scale MoE
by: Zeng, Anxiang, et al.
Published: (2025) -
Compass-Embedding v4: Robust Contrastive Learning for Multilingual E-commerce Embeddings
by: Ueareeworakul, Pakorn, et al.
Published: (2025) -
Towards Reliable Evaluation of Large Language Models for Multilingual and Multimodal E-Commerce Applications
by: Xie, Shuyi, et al.
Published: (2025) -
Mid-Training of Large Language Models: A Survey
by: Mo, Kaixiang, et al.
Published: (2025)