Guardado en:
| Autores principales: | Wang, Bin, He, Tianyao, Ouyang, Linke, Wu, Fan, Zhao, Zhiyuan, Chu, Tao, Qu, Yuan, Jin, Zhenjiang, Zeng, Weijun, Miao, Ziyang, Xu, Bangrui, Niu, Junbo, Cai, Mengzhang, Qiu, Jiantao, Zhang, Qintong, Ma, Dongsheng, Sun, Yuefeng, Dong, Hejun, Zhang, Wenzheng, Xiao, Jutao, Shi, Jiayong, Liao, Pengyu, Zhao, Xiaomeng, Zhong, Huaping, Wei, Liqun, Yu, Jing, Yang, Jie, Li, Wei, Wang, Shasha, Wu, Qianqian, Zhou, Xuanhe, Li, Weijia, Li, Zhenxiang, Tu, Zhongying, Wu, Jiang, Wu, Lijun, Xu, Chao, Chen, Kai, Zhang, Wentao, Qiao, Yu, Zhou, Bowen, Lin, Dahua, He, Conghui |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2604.04771 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MinerU-Popo: Universal Post-Processing Model for Structured Document Parsing
por: Xu, Bangrui, et al.
Publicado: (2026)
por: Xu, Bangrui, et al.
Publicado: (2026)
MinerU2.5: A Decoupled Vision-Language Model for Efficient High-Resolution Document Parsing
por: Niu, Junbo, et al.
Publicado: (2025)
por: Niu, Junbo, et al.
Publicado: (2025)
MinerU-Diffusion: Rethinking Document OCR as Inverse Rendering via Diffusion Decoding
por: Dong, Hejun, et al.
Publicado: (2026)
por: Dong, Hejun, et al.
Publicado: (2026)
MinerU: An Open-Source Solution for Precise Document Content Extraction
por: Wang, Bin, et al.
Publicado: (2024)
por: Wang, Bin, et al.
Publicado: (2024)
Qute: Towards Quantum-Native Database
por: Chen, Muzhi, et al.
Publicado: (2026)
por: Chen, Muzhi, et al.
Publicado: (2026)
MoDora: Tree-Based Semi-Structured Document Analysis System
por: Xu, Bangrui, et al.
Publicado: (2026)
por: Xu, Bangrui, et al.
Publicado: (2026)
OpenDataLab: Empowering General Artificial Intelligence with Open Datasets
por: He, Conghui, et al.
Publicado: (2024)
por: He, Conghui, et al.
Publicado: (2024)
Automating Database-Native Function Code Synthesis with LLMs
por: Zhou, Wei, et al.
Publicado: (2026)
por: Zhou, Wei, et al.
Publicado: (2026)
Closing the Data Loop: Using OpenDataArena to Engineer Superior Training Datasets
por: Gao, Xin, et al.
Publicado: (2025)
por: Gao, Xin, et al.
Publicado: (2025)
DynaAct: Large Language Model Reasoning with Dynamic Action Spaces
por: Zhao, Xueliang, et al.
Publicado: (2025)
por: Zhao, Xueliang, et al.
Publicado: (2025)
Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning
por: Tang, Zinan, et al.
Publicado: (2025)
por: Tang, Zinan, et al.
Publicado: (2025)
MetaLadder: Ascending Mathematical Solution Quality via Analogical-Problem Reasoning Transfer
por: Lin, Honglin, et al.
Publicado: (2025)
por: Lin, Honglin, et al.
Publicado: (2025)
LLM/Agent-as-Data-Analyst: A Survey
por: Tang, Zirui, et al.
Publicado: (2025)
por: Tang, Zirui, et al.
Publicado: (2025)
Leave No One Behind: Online Self-Supervised Self-Distillation for Sequential Recommendation
por: Wei, Shaowei, et al.
Publicado: (2024)
por: Wei, Shaowei, et al.
Publicado: (2024)
CrossViewDiff: A Cross-View Diffusion Model for Satellite-to-Street View Synthesis
por: Li, Weijia, et al.
Publicado: (2024)
por: Li, Weijia, et al.
Publicado: (2024)
PARROT: A Benchmark for Evaluating LLMs in Cross-System SQL Translation
por: Zhou, Wei, et al.
Publicado: (2025)
por: Zhou, Wei, et al.
Publicado: (2025)
Generalizable Synthetic Image Detection via Language-guided Contrastive Learning
por: Wu, Haiwei, et al.
Publicado: (2023)
por: Wu, Haiwei, et al.
Publicado: (2023)
IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment
por: Ming, Chenlin, et al.
Publicado: (2025)
por: Ming, Chenlin, et al.
Publicado: (2025)
Stop Looking for Important Tokens in Multimodal Language Models: Duplication Matters More
por: Wen, Zichen, et al.
Publicado: (2025)
por: Wen, Zichen, et al.
Publicado: (2025)
VIGC: Visual Instruction Generation and Correction
por: Wang, Bin, et al.
Publicado: (2023)
por: Wang, Bin, et al.
Publicado: (2023)
Unlocking Data Value in Finance: A Study on Distillation and Difficulty-Aware Training
por: Cao, Chuxue, et al.
Publicado: (2026)
por: Cao, Chuxue, et al.
Publicado: (2026)
High‐performance self‐healing epoxy by microencapsulated epoxy‐amine chemistry I: Properties of the adopted healant system
por: Mengzhang Zhu, et al.
Publicado: (2024)
por: Mengzhang Zhu, et al.
Publicado: (2024)
High‐performance self‐healing epoxy by microencapsulated epoxy‐amine chemistry II: Performance of the system
por: Mengzhang Zhu, et al.
Publicado: (2024)
por: Mengzhang Zhu, et al.
Publicado: (2024)
Multi-party Agent Relation Sampling for Multi-party Ad Hoc Teamwork
por: Zhang, Beiwen, et al.
Publicado: (2025)
por: Zhang, Beiwen, et al.
Publicado: (2025)
FoundaBench: Evaluating Chinese Fundamental Knowledge Capabilities of Large Language Models
por: Li, Wei, et al.
Publicado: (2024)
por: Li, Wei, et al.
Publicado: (2024)
DBAIOps: A Reasoning LLM-Enhanced Database Operation and Maintenance System using Knowledge Graphs
por: Zhou, Wei, et al.
Publicado: (2025)
por: Zhou, Wei, et al.
Publicado: (2025)
OpenMLDB: A Real-Time Relational Data Feature Computation System for Online ML
por: Zhou, Xuanhe, et al.
Publicado: (2025)
por: Zhou, Xuanhe, et al.
Publicado: (2025)
LLM-Enhanced Data Management
por: Zhou, Xuanhe, et al.
Publicado: (2024)
por: Zhou, Xuanhe, et al.
Publicado: (2024)
ST-Raptor: LLM-Powered Semi-Structured Table Question Answering
por: Tang, Zirui, et al.
Publicado: (2025)
por: Tang, Zirui, et al.
Publicado: (2025)
A Survey of LLM $\times$ DATA
por: Zhou, Xuanhe, et al.
Publicado: (2025)
por: Zhou, Xuanhe, et al.
Publicado: (2025)
Intern-Atlas: A Methodological Evolution Graph as Research Infrastructure for AI Scientists
por: Wu, Yujun, et al.
Publicado: (2026)
por: Wu, Yujun, et al.
Publicado: (2026)
Heterogeneous Adaptive Policy Optimization: Tailoring Optimization to Every Token's Nature
por: Liu, Zheng, et al.
Publicado: (2025)
por: Liu, Zheng, et al.
Publicado: (2025)
FeatInsight: An Online ML Feature Management System on 4Paradigm Sage-Studio Platform
por: Tong, Xin, et al.
Publicado: (2025)
por: Tong, Xin, et al.
Publicado: (2025)
Fault diagnosis for blast furnace ironmaking process based on randomized local fisher discriminant analysis
por: Jiawei Zhou, et al.
Publicado: (2024)
por: Jiawei Zhou, et al.
Publicado: (2024)
GaussMaster: An LLM-based Database Copilot System
por: Zhou, Wei, et al.
Publicado: (2025)
por: Zhou, Wei, et al.
Publicado: (2025)
VRBench: A Benchmark for Multi-Step Reasoning in Long Narrative Videos
por: Yu, Jiashuo, et al.
Publicado: (2025)
por: Yu, Jiashuo, et al.
Publicado: (2025)
Is Coumel's Law Always True?
por: Jia He, et al.
Publicado: (2026)
por: Jia He, et al.
Publicado: (2026)
Weakly-Supervised Image Forgery Localization via Vision-Language Collaborative Reasoning Framework
por: Sheng, Ziqi, et al.
Publicado: (2025)
por: Sheng, Ziqi, et al.
Publicado: (2025)
Efficient Multi-modal Large Language Models via Progressive Consistency Distillation
por: Wen, Zichen, et al.
Publicado: (2025)
por: Wen, Zichen, et al.
Publicado: (2025)
Lightweight yet Efficient: An External Attentive Graph Convolutional Network with Positional Prompts for Sequential Recommendation
por: Zhang, Jinyu, et al.
Publicado: (2025)
por: Zhang, Jinyu, et al.
Publicado: (2025)
Ejemplares similares
-
MinerU-Popo: Universal Post-Processing Model for Structured Document Parsing
por: Xu, Bangrui, et al.
Publicado: (2026) -
MinerU2.5: A Decoupled Vision-Language Model for Efficient High-Resolution Document Parsing
por: Niu, Junbo, et al.
Publicado: (2025) -
MinerU-Diffusion: Rethinking Document OCR as Inverse Rendering via Diffusion Decoding
por: Dong, Hejun, et al.
Publicado: (2026) -
MinerU: An Open-Source Solution for Precise Document Content Extraction
por: Wang, Bin, et al.
Publicado: (2024) -
Qute: Towards Quantum-Native Database
por: Chen, Muzhi, et al.
Publicado: (2026)