Résultats de la recherche - Huang, Linjiang
- Résultat(s) 1 - 20 résultats de 21
- Aller à la page suivante
-
1
FR-TTS: Test-Time Scaling for NTP-based Image Generation with Effective Filling-based Reward Signal Autoría: Xu, Hang, Huang, Linjiang, Zhao, Feng
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
2
Highly Efficient Test-Time Scaling for T2I Diffusion Models with Text Embedding Perturbation Autoría: Xu, Hang, Huang, Linjiang, Zhao, Feng
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
3
GaussianPainter: Painting Point Cloud into 3D Gaussians with Normal Guidance Autoría: Zhou, Jingqiu, Fan, Lue, Chen, Xuesong, Huang, Linjiang, Liu, Si, Li, Hongsheng
Publié 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
4
SOLVE: Synergy of Language-Vision and End-to-End Networks for Autonomous Driving Autoría: Chen, Xuesong, Huang, Linjiang, Ma, Tao, Fang, Rongyao, Shi, Shaoshuai, Li, Hongsheng
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
5
FreeDNA: Endowing Domain Adaptation of Diffusion-Based Dense Prediction with Training-Free Domain Noise Alignment Autoría: Xu, Hang, Huang, Jie, Huang, Linjiang, Li, Dong, Liu, Yidi, Zhao, Feng
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
6
"Hi AirStar, Guide Me to the Badminton Court." Autoría: Wang, Ziqin, Chen, Jinyu, Zheng, Xiangyi, Liao, Qinan, Huang, Linjiang, Liu, Si
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
7
AnyExperts: On-Demand Expert Allocation for Multimodal Language Models with Mixture of Expert Autoría: Gao, Yuting, Lan, Wang, Zhao, Hengyuan, Huang, Linjiang, Liu, Si, Guo, Qingpei
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
8
FouriScale: A Frequency Perspective on Training-Free High-Resolution Image Synthesis Autoría: Huang, Linjiang, Fang, Rongyao, Zhang, Aiping, Song, Guanglu, Liu, Si, Liu, Yu, Li, Hongsheng
Publié 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
9
FlexDrive: Toward Trajectory Flexibility in Driving Scene Reconstruction and Rendering Autoría: Zhou, Jingqiu, Fan, Lue, Huang, Linjiang, Shi, Xiaoyu, Liu, Si, Zhang, Zhaoxiang, Li, Hongsheng
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
10
InfoScale: Unleashing Training-free Variable-scaled Image Generation via Effective Utilization of Information Autoría: Zhang, Guohui, Tan, Jiangtong, Huang, Linjiang, Yuan, Zhonghang, Yao, Mingde, Huang, Jie, Zhao, Feng
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
11
GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning Autoría: Duan, Chengqi, Fang, Rongyao, Wang, Yuqing, Wang, Kun, Huang, Linjiang, Zeng, Xingyu, Li, Hongsheng, Liu, Xihui
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
12
SkeNa: Learning to Navigate Unseen Environments Based on Abstract Hand-Drawn Maps Autoría: Xu, Haojun, Xiang, Jiaqi, Wei, Wu, Chen, Jinyu, Zhong, Linqing, Huang, Linjiang, Yang, Hongyu, Liu, Si
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
13
AeroDuo: Aerial Duo for UAV-based Vision and Language Navigation Autoría: Wu, Ruipu, Zhang, Yige, Chen, Jinyu, Huang, Linjiang, Zhang, Shifeng, Zhou, Xu, Wang, Liang, Liu, Si
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
14
FreeEdit: Mask-free Reference-based Image Editing with Multi-modal Instruction Autoría: He, Runze, Ma, Kai, Huang, Linjiang, Huang, Shaofei, Gao, Jialin, Wei, Xiaoming, Dai, Jiao, Han, Jizhong, Liu, Si
Publié 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
15
VaccineRAG: Boosting Multimodal Large Language Models' Immunity to Harmful RAG Samples Autoría: Sun, Qixin, Wang, Ziqin, Zhao, Hengyuan, Li, Yilin, Song, Kaiyou, Huang, Linjiang, Hu, Xiaolin, Guo, Qingpei, Liu, Si
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
16
Group Critical-token Policy Optimization for Autoregressive Image Generation Autoría: Zhang, Guohui, Yu, Hu, Ma, Xiaoxiao, Zhang, JingHao, Pan, Yaning, Yao, Mingde, Xiao, Jie, Huang, Linjiang, Zhao, Feng
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
17
FLUX-Reason-6M & PRISM-Bench: A Million-Scale Text-to-Image Reasoning Dataset and Comprehensive Benchmark Autoría: Fang, Rongyao, Yu, Aldrich, Duan, Chengqi, Huang, Linjiang, Bai, Shuai, Cai, Yuxuan, Wang, Kun, Liu, Si, Liu, Xihui, Li, Hongsheng
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
18
VCBench: A Streaming Counting Benchmark for Spatial-Temporal State Maintenance in Long Videos Autoría: Liu, Pengyiang, Shi, Zhongyue, Hao, Hongye, Fu, Qi, Bi, Xueting, Zhang, Siwei, Hu, Xiaoyang, Wang, Zitian, Huang, Linjiang, Liu, Si
Publié 2026Fuente: arXivTipo de material: PreprintAcceso al recurso -
19
GoT: Unleashing Reasoning Capability of Multimodal Large Language Model for Visual Generation and Editing Autoría: Fang, Rongyao, Duan, Chengqi, Wang, Kun, Huang, Linjiang, Li, Hao, Yan, Shilin, Tian, Hao, Zeng, Xingyu, Zhao, Rui, Dai, Jifeng, Liu, Xihui, Li, Hongsheng
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
20
MathCanvas: Intrinsic Visual Chain-of-Thought for Multimodal Mathematical Reasoning Autoría: Shi, Weikang, Yu, Aldrich, Fang, Rongyao, Ren, Houxing, Wang, Ke, Zhou, Aojun, Tian, Changyao, Fu, Xinyu, Hu, Yuxuan, Lu, Zimu, Huang, Linjiang, Liu, Si, Liu, Rui, Li, Hongsheng
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso