Marco-o1 v2: Towards Widening The Distillation Bottleneck for Reasoning Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Yin, Huifeng, Zhao, Yu, Wu, Minghao, Ni, Xuanfan, Zeng, Bo, Wang, Hao, Shi, Tianqi, Shao, Liangying, Lyu, Chenyang, Wang, Longyue, Luo, Weihua, Zhang, Kaifu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Marco-o1: Towards Open Reasoning Models for Open-Ended Solutions
di: Zhao, Yu, et al.
Pubblicazione: (2024)
di: Zhao, Yu, et al.
Pubblicazione: (2024)
Marco-ASR: A Principled and Metric-Driven Framework for Fine-Tuning Large-Scale ASR Models for Domain Adaptation
di: Ni, Xuanfan, et al.
Pubblicazione: (2025)
di: Ni, Xuanfan, et al.
Pubblicazione: (2025)
Marco-Voice Technical Report
di: Tian, Fengping, et al.
Pubblicazione: (2025)
di: Tian, Fengping, et al.
Pubblicazione: (2025)
Marco-Bench-MIF: On Multilingual Instruction-Following Capability of Large Language Models
di: Zeng, Bo, et al.
Pubblicazione: (2025)
di: Zeng, Bo, et al.
Pubblicazione: (2025)
New Trends for Modern Machine Translation with Large Reasoning Models
di: Liu, Sinuo, et al.
Pubblicazione: (2025)
di: Liu, Sinuo, et al.
Pubblicazione: (2025)
Speech-XL: Towards Long-Form Speech Understanding in Large Speech Language Models
di: Sun, Haoqin, et al.
Pubblicazione: (2026)
di: Sun, Haoqin, et al.
Pubblicazione: (2026)
The Bitter Lesson Learned from 2,000+ Multilingual Benchmarks
di: Wu, Minghao, et al.
Pubblicazione: (2025)
di: Wu, Minghao, et al.
Pubblicazione: (2025)
LongSpeech: A Scalable Benchmark for Transcription, Translation and Understanding in Long Speech
di: Yang, Fei, et al.
Pubblicazione: (2026)
di: Yang, Fei, et al.
Pubblicazione: (2026)
A State-Transition Framework for Efficient LLM Reasoning
di: Zhang, Liang, et al.
Pubblicazione: (2026)
di: Zhang, Liang, et al.
Pubblicazione: (2026)
Marco-MoE: Open Multilingual Mixture-of-Expert Language Models with Efficient Upcycling
di: Jiang, Fan, et al.
Pubblicazione: (2026)
di: Jiang, Fan, et al.
Pubblicazione: (2026)
Beyond Single-Reward: Multi-Pair, Multi-Perspective Preference Optimization for Machine Translation
di: Wang, Hao, et al.
Pubblicazione: (2025)
di: Wang, Hao, et al.
Pubblicazione: (2025)
The Affective Bridge: Preserving Speech Representations while Enhancing Deepfake Detection vian emotional Constraints
di: Li, Yupei, et al.
Pubblicazione: (2025)
di: Li, Yupei, et al.
Pubblicazione: (2025)
Towards Lightweight, Adaptive and Attribute-Aware Multi-Aspect Controllable Text Generation with Large Language Models
di: Zhu, Chenyu, et al.
Pubblicazione: (2025)
di: Zhu, Chenyu, et al.
Pubblicazione: (2025)
Marco-LLM: Bridging Languages via Massive Multilingual Training for Cross-Lingual Enhancement
di: Ming, Lingfeng, et al.
Pubblicazione: (2024)
di: Ming, Lingfeng, et al.
Pubblicazione: (2024)
Towards Threshold-Free KV Cache Pruning
di: Ni, Xuanfan, et al.
Pubblicazione: (2025)
di: Ni, Xuanfan, et al.
Pubblicazione: (2025)
(Perhaps) Beyond Human Translation: Harnessing Multi-Agent Collaboration for Translating Ultra-Long Literary Texts
di: Wu, Minghao, et al.
Pubblicazione: (2024)
di: Wu, Minghao, et al.
Pubblicazione: (2024)
Rethinking Multilingual Vision-Language Translation: Dataset, Evaluation, and Adaptation
di: Wang, Xintong, et al.
Pubblicazione: (2025)
di: Wang, Xintong, et al.
Pubblicazione: (2025)
ComfyUI-R1: Exploring Reasoning Models for Workflow Generation
di: Xu, Zhenran, et al.
Pubblicazione: (2025)
di: Xu, Zhenran, et al.
Pubblicazione: (2025)
TransBench: Benchmarking Machine Translation for Industrial-Scale Applications
di: Li, Haijun, et al.
Pubblicazione: (2025)
di: Li, Haijun, et al.
Pubblicazione: (2025)
LayAlign: Enhancing Multilingual Reasoning in Large Language Models via Layer-Wise Adaptive Fusion and Alignment Strategy
di: Ruan, Zhiwen, et al.
Pubblicazione: (2025)
di: Ruan, Zhiwen, et al.
Pubblicazione: (2025)
TeEFusion: Blending Text Embeddings to Distill Classifier-Free Guidance
di: Fu, Minghao, et al.
Pubblicazione: (2025)
di: Fu, Minghao, et al.
Pubblicazione: (2025)
A Systematic Evaluation of Large Language Models for Natural Language Generation Tasks
di: Ni, Xuanfan, et al.
Pubblicazione: (2024)
di: Ni, Xuanfan, et al.
Pubblicazione: (2024)
MECap-R1: Emotion-aware Policy with Reinforcement Learning for Multimodal Emotion Captioning
di: Sun, Haoqin, et al.
Pubblicazione: (2025)
di: Sun, Haoqin, et al.
Pubblicazione: (2025)
Retrieval-augmented Multi-modal Chain-of-Thoughts Reasoning for Large Language Models
di: Liu, Bingshuai, et al.
Pubblicazione: (2023)
di: Liu, Bingshuai, et al.
Pubblicazione: (2023)
Challenging Multilingual LLMs: A New Taxonomy and Benchmark for Unraveling Hallucination in Translation
di: Wu, Xinwei, et al.
Pubblicazione: (2025)
di: Wu, Xinwei, et al.
Pubblicazione: (2025)
CaptchaMind: Training CAPTCHA Solvers via Reinforcement Learning with Explicit Reasoning Supervision
di: Wang, Pengcheng, et al.
Pubblicazione: (2026)
di: Wang, Pengcheng, et al.
Pubblicazione: (2026)
Difficulty-Estimated Policy Optimization
di: Zhao, Yu, et al.
Pubblicazione: (2026)
di: Zhao, Yu, et al.
Pubblicazione: (2026)
A Unified Agentic Framework for Evaluating Conditional Image Generation
di: Wang, Jifang, et al.
Pubblicazione: (2025)
di: Wang, Jifang, et al.
Pubblicazione: (2025)
DeepWideSearch: Benchmarking Depth and Width in Agentic Information Seeking
di: Lan, Tian, et al.
Pubblicazione: (2025)
di: Lan, Tian, et al.
Pubblicazione: (2025)
Finding the Translation Switch: Discovering and Exploiting the Task-Initiation Features in LLMs
di: Wu, Xinwei, et al.
Pubblicazione: (2026)
di: Wu, Xinwei, et al.
Pubblicazione: (2026)
HSCodeComp: A Realistic and Expert-level Benchmark for Deep Search Agents in Hierarchical Rule Application
di: Yang, Yiqian, et al.
Pubblicazione: (2025)
di: Yang, Yiqian, et al.
Pubblicazione: (2025)
Towards Continual Learning Desiderata via HSIC-Bottleneck Orthogonalization and Equiangular Embedding
di: Li, Depeng, et al.
Pubblicazione: (2024)
di: Li, Depeng, et al.
Pubblicazione: (2024)
ComfyUI-Copilot: An Intelligent Assistant for Automated Workflow Development
di: Xu, Zhenran, et al.
Pubblicazione: (2025)
di: Xu, Zhenran, et al.
Pubblicazione: (2025)
DetectRL-X: Towards Reliable Multilingual and Real-World LLM-Generated Text Detection
di: Wu, Junchao, et al.
Pubblicazione: (2026)
di: Wu, Junchao, et al.
Pubblicazione: (2026)
GPT4Video: A Unified Multimodal Large Language Model for lnstruction-Followed Understanding and Safety-Aware Generation
di: Wang, Zhanyu, et al.
Pubblicazione: (2023)
di: Wang, Zhanyu, et al.
Pubblicazione: (2023)
XL$^2$Bench: A Benchmark for Extremely Long Context Understanding with Long-range Dependencies
di: Ni, Xuanfan, et al.
Pubblicazione: (2024)
di: Ni, Xuanfan, et al.
Pubblicazione: (2024)
Diffusion-SDPO: Safeguarded Direct Preference Optimization for Diffusion Models
di: Fu, Minghao, et al.
Pubblicazione: (2025)
di: Fu, Minghao, et al.
Pubblicazione: (2025)
CHATS: Combining Human-Aligned Optimization and Test-Time Sampling for Text-to-Image Generation
di: Fu, Minghao, et al.
Pubblicazione: (2025)
di: Fu, Minghao, et al.
Pubblicazione: (2025)
ComplexMCP: Evaluation of LLM Agents in Dynamic, Interdependent, and Large-Scale Tool Sandbox
di: Li, Yuanyang, et al.
Pubblicazione: (2026)
di: Li, Yuanyang, et al.
Pubblicazione: (2026)
Marco DeepResearch: Unlocking Efficient Deep Research Agents via Verification-Centric Design
di: Zhu, Bin, et al.
Pubblicazione: (2026)
di: Zhu, Bin, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Marco-o1: Towards Open Reasoning Models for Open-Ended Solutions
di: Zhao, Yu, et al.
Pubblicazione: (2024) -
Marco-ASR: A Principled and Metric-Driven Framework for Fine-Tuning Large-Scale ASR Models for Domain Adaptation
di: Ni, Xuanfan, et al.
Pubblicazione: (2025) -
Marco-Voice Technical Report
di: Tian, Fengping, et al.
Pubblicazione: (2025) -
Marco-Bench-MIF: On Multilingual Instruction-Following Capability of Large Language Models
di: Zeng, Bo, et al.
Pubblicazione: (2025) -
New Trends for Modern Machine Translation with Large Reasoning Models
di: Liu, Sinuo, et al.
Pubblicazione: (2025)