HALO: Human-Aligned End-to-end Image Retargeting with Layered Transformations
Fuente:
arXiv
Salvato in:
| Autori principali: | Xu, Yiran, Xie, Siqi, Li, Zhuofang, Shadmany, Harris, Li, Yinxiao, Sbaiz, Luciano, Wang, Miaosen, Ke, Junjie, Lezama, Jose, Qi, Hang, Zhang, Han, Berent, Jesse, Yang, Ming-Hsuan, Essa, Irfan, Huang, Jia-Bin, Yang, Feng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Calibrated Multi-Preference Optimization for Aligning Diffusion Models
di: Lee, Kyungmin, et al.
Pubblicazione: (2025)
di: Lee, Kyungmin, et al.
Pubblicazione: (2025)
Cropper: Vision-Language Model for Image Cropping through In-Context Learning
di: Lee, Seung Hyun, et al.
Pubblicazione: (2024)
di: Lee, Seung Hyun, et al.
Pubblicazione: (2024)
Kilohertz-Safe: A Scalable Framework for Constrained Dexterous Retargeting
di: Tian, Yinxiao, et al.
Pubblicazione: (2026)
di: Tian, Yinxiao, et al.
Pubblicazione: (2026)
DynamicScaler: Seamless and Scalable Video Generation for Panoramic Scenes
di: Liu, Jinxiu, et al.
Pubblicazione: (2024)
di: Liu, Jinxiu, et al.
Pubblicazione: (2024)
Multimodal Large Language Models for End-to-End Affective Computing: Benchmarking and Boosting with Generative Knowledge Prompting
di: Luo, Miaosen, et al.
Pubblicazione: (2025)
di: Luo, Miaosen, et al.
Pubblicazione: (2025)
HierSum: A Global and Local Attention Mechanism for Video Summarization
di: Beedu, Apoorva, et al.
Pubblicazione: (2025)
di: Beedu, Apoorva, et al.
Pubblicazione: (2025)
CamViG: Camera Aware Image-to-Video Generation with Multimodal Transformers
di: Marmon, Andrew, et al.
Pubblicazione: (2024)
di: Marmon, Andrew, et al.
Pubblicazione: (2024)
End-to-end Generative Spatial-Temporal Ultrasonic Odometry and Mapping Framework
di: Jia, Fuhua, et al.
Pubblicazione: (2024)
di: Jia, Fuhua, et al.
Pubblicazione: (2024)
Align-DETR: Enhancing End-to-end Object Detection with Aligned Loss
di: Cai, Zhi, et al.
Pubblicazione: (2023)
di: Cai, Zhi, et al.
Pubblicazione: (2023)
Parrot: Pareto-optimal Multi-Reward Reinforcement Learning Framework for Text-to-Image Generation
di: Lee, Seung Hyun, et al.
Pubblicazione: (2024)
di: Lee, Seung Hyun, et al.
Pubblicazione: (2024)
A Unified Conditional Flow for Motion Generation, Editing, and Intra-Structural Retargeting
di: Li, Junlin, et al.
Pubblicazione: (2026)
di: Li, Junlin, et al.
Pubblicazione: (2026)
Ondas ultra-sônicas de alta freqüência causam disfunção endotelial em artérias coronárias caninas epicárdicas
di: Berent DISCIGIL
Pubblicazione: (2008)
di: Berent DISCIGIL
Pubblicazione: (2008)
Algunos aspectos demográficos del empleo de las mujeres en Europe oriental y en la URSS
di: Jerzy Berent
Pubblicazione: (1970)
di: Jerzy Berent
Pubblicazione: (1970)
Aspects démographiques de l'emploi des femmes en Europe orientale et en URSS
di: Jerzy Berent
Pubblicazione: (1970)
di: Jerzy Berent
Pubblicazione: (1970)
Some demographic aspects of female employment in Eastern Europe and the USSR
di: Jerzy Berent
Pubblicazione: (1970)
di: Jerzy Berent
Pubblicazione: (1970)
Leveraging Procedural Knowledge and Task Hierarchies for Efficient Instructional Video Pre-training
di: Samel, Karan, et al.
Pubblicazione: (2025)
di: Samel, Karan, et al.
Pubblicazione: (2025)
SLAIM: Robust Dense Neural SLAM for Online Tracking and Mapping
di: Cartillier, Vincent, et al.
Pubblicazione: (2024)
di: Cartillier, Vincent, et al.
Pubblicazione: (2024)
3D Semantic MapNet: Building Maps for Multi-Object Re-Identification in 3D
di: Cartillier, Vincent, et al.
Pubblicazione: (2024)
di: Cartillier, Vincent, et al.
Pubblicazione: (2024)
HENet++: Hybrid Encoding and Multi-task Learning for 3D Perception and End-to-end Autonomous Driving
di: Xia, Zhongyu, et al.
Pubblicazione: (2025)
di: Xia, Zhongyu, et al.
Pubblicazione: (2025)
New characterizations of completely useful topologies in mathematical utility theory
di: Bosi, Gianni, et al.
Pubblicazione: (2024)
di: Bosi, Gianni, et al.
Pubblicazione: (2024)
Temperature Anomalies and Climate Physical Risk in Portfolio Construction
di: Azzone, Michele, et al.
Pubblicazione: (2026)
di: Azzone, Michele, et al.
Pubblicazione: (2026)
End-to-end Video Gaze Estimation via Capturing Head-face-eye Spatial-temporal Interaction Context
di: Guan, Yiran, et al.
Pubblicazione: (2023)
di: Guan, Yiran, et al.
Pubblicazione: (2023)
PALUM: Part-based Attention Learning for Unified Motion Retargeting
di: Liu, Siqi, et al.
Pubblicazione: (2026)
di: Liu, Siqi, et al.
Pubblicazione: (2026)
SPARK: Skeleton-Parameter Aligned Retargeting on Humanoid Robots with Kinodynamic Trajectory Optimization
di: Wang, Hanwen, et al.
Pubblicazione: (2026)
di: Wang, Hanwen, et al.
Pubblicazione: (2026)
A Simple Approach to Unifying Diffusion-based Conditional Generation
di: Li, Xirui, et al.
Pubblicazione: (2024)
di: Li, Xirui, et al.
Pubblicazione: (2024)
Safety-Aligned 3D Object Detection: Single-Vehicle, Cooperative, and End-to-End Perspectives
di: Liao, Brian Hsuan-Cheng, et al.
Pubblicazione: (2026)
di: Liao, Brian Hsuan-Cheng, et al.
Pubblicazione: (2026)
End-to-end Graph Learning Approach for Cognitive Diagnosis of Student Tutorial
di: Yang, Fulai, et al.
Pubblicazione: (2024)
di: Yang, Fulai, et al.
Pubblicazione: (2024)
Mamba Fusion: Learning Actions Through Questioning
di: Dong, Zhikang, et al.
Pubblicazione: (2024)
di: Dong, Zhikang, et al.
Pubblicazione: (2024)
On the Efficacy of Text-Based Input Modalities for Action Anticipation
di: Beedu, Apoorva, et al.
Pubblicazione: (2024)
di: Beedu, Apoorva, et al.
Pubblicazione: (2024)
Exploring Efficient Foundational Multi-modal Models for Video Summarization
di: Samel, Karan, et al.
Pubblicazione: (2024)
di: Samel, Karan, et al.
Pubblicazione: (2024)
Raw2Drive: Reinforcement Learning with Aligned World Models for End-to-End Autonomous Driving (in CARLA v2)
di: Yang, Zhenjie, et al.
Pubblicazione: (2025)
di: Yang, Zhenjie, et al.
Pubblicazione: (2025)
MALT Diffusion: Memory-Augmented Latent Transformers for Any-Length Video Generation
di: Yu, Sihyun, et al.
Pubblicazione: (2025)
di: Yu, Sihyun, et al.
Pubblicazione: (2025)
Retargeting Matters: General Motion Retargeting for Humanoid Motion Tracking
di: Araujo, Joao Pedro, et al.
Pubblicazione: (2025)
di: Araujo, Joao Pedro, et al.
Pubblicazione: (2025)
In-Context Autonomous Network Incident Response: An End-to-End Large Language Model Agent Approach
di: Gao, Yiran, et al.
Pubblicazione: (2026)
di: Gao, Yiran, et al.
Pubblicazione: (2026)
End-to-End Transformer Acceleration Through Processing-in-Memory Architectures
di: Yang, Xiaoxuan, et al.
Pubblicazione: (2025)
di: Yang, Xiaoxuan, et al.
Pubblicazione: (2025)
End-to-end training of Multimodal Model and ranking Model
di: Deng, Xiuqi, et al.
Pubblicazione: (2024)
di: Deng, Xiuqi, et al.
Pubblicazione: (2024)
End-to-end autonomous scientific discovery on a real optical platform
di: Yang, Shuxing, et al.
Pubblicazione: (2026)
di: Yang, Shuxing, et al.
Pubblicazione: (2026)
An Ensemble Information Filter: Retrieving Markov-information from the SPDE discretisation
di: Lunde, Berent Ånund Strømnes
Pubblicazione: (2025)
di: Lunde, Berent Ånund Strømnes
Pubblicazione: (2025)
An X‐tra role for NFκB in gene regulation?
di: Sara Berent, et al.
Pubblicazione: (2025)
di: Sara Berent, et al.
Pubblicazione: (2025)
End-to-end Autonomous Driving: Challenges and Frontiers
di: Chen, Li, et al.
Pubblicazione: (2023)
di: Chen, Li, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Calibrated Multi-Preference Optimization for Aligning Diffusion Models
di: Lee, Kyungmin, et al.
Pubblicazione: (2025) -
Cropper: Vision-Language Model for Image Cropping through In-Context Learning
di: Lee, Seung Hyun, et al.
Pubblicazione: (2024) -
Kilohertz-Safe: A Scalable Framework for Constrained Dexterous Retargeting
di: Tian, Yinxiao, et al.
Pubblicazione: (2026) -
DynamicScaler: Seamless and Scalable Video Generation for Panoramic Scenes
di: Liu, Jinxiu, et al.
Pubblicazione: (2024) -
Multimodal Large Language Models for End-to-End Affective Computing: Benchmarking and Boosting with Generative Knowledge Prompting
di: Luo, Miaosen, et al.
Pubblicazione: (2025)