Guardado en:
| Autores principales: | Kong, Zicheng, Ma, Dehua, Xu, Zhenbo, Yang, Alven, Ru, Yiwei, Wang, Haoran, Zhou, Zixuan, Bie, Fuqing, Xiang, Liuyu, Wu, Huijia, Zhao, Jian, He, Zhaofeng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2602.00846 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
OmniPlay: Benchmarking Omni-Modal Models on Omni-Modal Game Playing
por: Bie, Fuqing, et al.
Publicado: (2025)
por: Bie, Fuqing, et al.
Publicado: (2025)
Rethinking Class-Incremental Learning from a Dynamic Imbalanced Learning Perspective
por: Wang, Leyuan, et al.
Publicado: (2024)
por: Wang, Leyuan, et al.
Publicado: (2024)
Omni-Reward: Towards Generalist Omni-Modal Reward Modeling with Free-Form Preferences
por: Jin, Zhuoran, et al.
Publicado: (2025)
por: Jin, Zhuoran, et al.
Publicado: (2025)
ThinkOmni: Lifting Textual Reasoning to Omni-modal Scenarios via Guidance Decoding
por: Guan, Yiran, et al.
Publicado: (2026)
por: Guan, Yiran, et al.
Publicado: (2026)
Dynamic Generation of Personalities with Large Language Models
por: Liu, Jianzhi, et al.
Publicado: (2024)
por: Liu, Jianzhi, et al.
Publicado: (2024)
Select-Then-Decompose: From Empirical Analysis to Adaptive Selection Strategy for Task Decomposition in Large Language Models
por: Liu, Shuodi, et al.
Publicado: (2025)
por: Liu, Shuodi, et al.
Publicado: (2025)
Unlocking the Address Book: Dissecting the Sparse Semantic Structure of LLM Key-Value Caches via Sparse Autoencoders
por: Ma, Qingsen, et al.
Publicado: (2025)
por: Ma, Qingsen, et al.
Publicado: (2025)
OmniJigsaw: Enhancing Omni-Modal Reasoning via Modality-Orchestrated Reordering
por: Jia, Yiduo, et al.
Publicado: (2026)
por: Jia, Yiduo, et al.
Publicado: (2026)
OmniSTVG: Toward Spatio-Temporal Omni-Object Video Grounding
por: Yao, Jiali, et al.
Publicado: (2025)
por: Yao, Jiali, et al.
Publicado: (2025)
OmniVGGT: Omni-Modality Driven Visual Geometry Grounded Transformer
por: Peng, Haosong, et al.
Publicado: (2025)
por: Peng, Haosong, et al.
Publicado: (2025)
OmniDPO: A Preference Optimization Framework to Address Omni-Modal Hallucination
por: Chen, Junzhe, et al.
Publicado: (2025)
por: Chen, Junzhe, et al.
Publicado: (2025)
ChronusOmni: Improving Time Awareness of Omni Large Language Models
por: Chen, Yijing, et al.
Publicado: (2025)
por: Chen, Yijing, et al.
Publicado: (2025)
AVID: A Benchmark for Omni-Modal Audio-Visual Inconsistency Understanding via Agent-Driven Construction
por: Chen, Zixuan, et al.
Publicado: (2026)
por: Chen, Zixuan, et al.
Publicado: (2026)
OmniAlign-V: Towards Enhanced Alignment of MLLMs with Human Preference
por: Zhao, Xiangyu, et al.
Publicado: (2025)
por: Zhao, Xiangyu, et al.
Publicado: (2025)
Visual Preference Optimization with Rubric Rewards
por: Yu, Ya-Qi, et al.
Publicado: (2026)
por: Yu, Ya-Qi, et al.
Publicado: (2026)
RRM: Robust Reward Model Training Mitigates Reward Hacking
por: Liu, Tianqi, et al.
Publicado: (2024)
por: Liu, Tianqi, et al.
Publicado: (2024)
OmniACBench: A Benchmark for Evaluating Context-Grounded Acoustic Control in Omni-Modal Models
por: Kim, Seunghee, et al.
Publicado: (2026)
por: Kim, Seunghee, et al.
Publicado: (2026)
Beyond Darkness: Thermal-Supervised 3D Gaussian Splatting for Low-Light Novel View Synthesis
por: Ma, Qingsen, et al.
Publicado: (2025)
por: Ma, Qingsen, et al.
Publicado: (2025)
OmniQuality-R: Advancing Reward Models Through All-Encompassing Quality Assessment
por: Lu, Yiting, et al.
Publicado: (2025)
por: Lu, Yiting, et al.
Publicado: (2025)
OmniDiagram: Advancing Unified Diagram Code Generation via Visual Interrogation Reward
por: Yang, Haoyue, et al.
Publicado: (2026)
por: Yang, Haoyue, et al.
Publicado: (2026)
AEQ-Bench: Measuring Empathy of Omni-Modal Large Models
por: Luo, Xuan, et al.
Publicado: (2026)
por: Luo, Xuan, et al.
Publicado: (2026)
OmniRe: Omni Urban Scene Reconstruction
por: Chen, Ziyu, et al.
Publicado: (2024)
por: Chen, Ziyu, et al.
Publicado: (2024)
Speech-Omni-Lite: Portable Speech Interfaces for Vision-Language Models
por: Tao, Dehua, et al.
Publicado: (2026)
por: Tao, Dehua, et al.
Publicado: (2026)
Omni-DuplexEval: Evaluating Real-time Duplex Omni-modal Interaction
por: He, Chaoqun, et al.
Publicado: (2026)
por: He, Chaoqun, et al.
Publicado: (2026)
OmniBench: Towards The Future of Universal Omni-Language Models
por: Li, Yizhi, et al.
Publicado: (2024)
por: Li, Yizhi, et al.
Publicado: (2024)
Simulation-Free PSRO: Removing Game Simulation from Policy Space Response Oracles
por: Liu, Yingzhuo, et al.
Publicado: (2025)
por: Liu, Yingzhuo, et al.
Publicado: (2025)
CLIP model is an Efficient Online Lifelong Learner
por: Wang, Leyuan, et al.
Publicado: (2024)
por: Wang, Leyuan, et al.
Publicado: (2024)
Adaptive Articulated Object Manipulation On The Fly with Foundation Model Reasoning and Part Grounding
por: Zhang, Xiaojie, et al.
Publicado: (2025)
por: Zhang, Xiaojie, et al.
Publicado: (2025)
OmniGaze: Reward-inspired Generalizable Gaze Estimation In The Wild
por: Qu, Hongyu, et al.
Publicado: (2025)
por: Qu, Hongyu, et al.
Publicado: (2025)
VideoDPO: Omni-Preference Alignment for Video Diffusion Generation
por: Liu, Runtao, et al.
Publicado: (2024)
por: Liu, Runtao, et al.
Publicado: (2024)
Multimodal RewardBench 2: Evaluating Omni Reward Models for Interleaved Text and Image
por: Hu, Yushi, et al.
Publicado: (2025)
por: Hu, Yushi, et al.
Publicado: (2025)
OmniVox: Zero-Shot Emotion Recognition with Omni-LLMs
por: Murzaku, John, et al.
Publicado: (2025)
por: Murzaku, John, et al.
Publicado: (2025)
RoboOmni: Proactive Robot Manipulation in Omni-modal Context
por: Wang, Siyin, et al.
Publicado: (2025)
por: Wang, Siyin, et al.
Publicado: (2025)
OmniGAIA: Towards Native Omni-Modal AI Agents
por: Li, Xiaoxi, et al.
Publicado: (2026)
por: Li, Xiaoxi, et al.
Publicado: (2026)
OmniDiT: Extending Diffusion Transformer to Omni-VTON Framework
por: Zeng, Weixuan, et al.
Publicado: (2026)
por: Zeng, Weixuan, et al.
Publicado: (2026)
OmniGuard: Unified Omni-Modal Guardrails with Deliberate Reasoning
por: Zhu, Boyu, et al.
Publicado: (2025)
por: Zhu, Boyu, et al.
Publicado: (2025)
OmniVDiff: Omni Controllable Video Diffusion for Generation and Understanding
por: Xi, Dianbing, et al.
Publicado: (2025)
por: Xi, Dianbing, et al.
Publicado: (2025)
Interpretable Safety Alignment via SAE-Constructed Low-Rank Subspace Adaptation
por: Wang, Dianyun, et al.
Publicado: (2025)
por: Wang, Dianyun, et al.
Publicado: (2025)
OmniCompliance-100K: A Multi-Domain, Rule-Grounded, Real-World Safety Compliance Dataset
por: Hu, Wenbin, et al.
Publicado: (2026)
por: Hu, Wenbin, et al.
Publicado: (2026)
Auto-Rubric: Learning From Implicit Weights to Explicit Rubrics for Reward Modeling
por: Xie, Lipeng, et al.
Publicado: (2025)
por: Xie, Lipeng, et al.
Publicado: (2025)
Ejemplares similares
-
OmniPlay: Benchmarking Omni-Modal Models on Omni-Modal Game Playing
por: Bie, Fuqing, et al.
Publicado: (2025) -
Rethinking Class-Incremental Learning from a Dynamic Imbalanced Learning Perspective
por: Wang, Leyuan, et al.
Publicado: (2024) -
Omni-Reward: Towards Generalist Omni-Modal Reward Modeling with Free-Form Preferences
por: Jin, Zhuoran, et al.
Publicado: (2025) -
ThinkOmni: Lifting Textual Reasoning to Omni-modal Scenarios via Guidance Decoding
por: Guan, Yiran, et al.
Publicado: (2026) -
Dynamic Generation of Personalities with Large Language Models
por: Liu, Jianzhi, et al.
Publicado: (2024)