TeleBoost: A Systematic Alignment Framework for High-Fidelity, Controllable, and Robust Video Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Liang, Yuanzhi, Wu, Xuan'er, Liu, Yirui, Fang, Yijie, Fan, Yizhen, Hao, Ke, Li, Rui, Liu, Ruiying, Ni, Ziqi, Yu, Peng, Wang, Yanbo, Huang, Haibin, Weng, Qizhen, Zhang, Chi, Li, Xuelong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Beyond Binary: Turning Partial Success into Dense Verifiable Rewards for Reinforcement Learning in Code Generation
por: Wang, Longwen, et al.
Publicado: (2026)
por: Wang, Longwen, et al.
Publicado: (2026)
TeleWorld: Towards Dynamic Multimodal Synthesis with a 4D World Model
por: Chen, Yabo, et al.
Publicado: (2025)
por: Chen, Yabo, et al.
Publicado: (2025)
Seeing What Matters: Visual Preference Policy Optimization for Visual Generation
por: Ni, Ziqi, et al.
Publicado: (2025)
por: Ni, Ziqi, et al.
Publicado: (2025)
Learning What to Trust: Bayesian Prior-Guided Optimization for Visual Generation
por: Liu, Ruiying, et al.
Publicado: (2025)
por: Liu, Ruiying, et al.
Publicado: (2025)
Computation-Bandwidth-Memory Trade-offs: A Unified Paradigm for AI Infrastructure
por: Fan, Yuankai, et al.
Publicado: (2025)
por: Fan, Yuankai, et al.
Publicado: (2025)
Tele-Omni: a Unified Multimodal Framework for Video Generation and Editing
por: Liu, Jialun, et al.
Publicado: (2026)
por: Liu, Jialun, et al.
Publicado: (2026)
Rethinking Reward Signals in Video GRPO: When Scores Become Targets
por: Li, Rui, et al.
Publicado: (2025)
por: Li, Rui, et al.
Publicado: (2025)
TeleStyle: Content-Preserving Style Transfer in Images and Videos
por: Zhang, Shiwen, et al.
Publicado: (2026)
por: Zhang, Shiwen, et al.
Publicado: (2026)
Swift-SVD: Theoretical Optimality Meets Practical Efficiency in Low-Rank LLM Compression
por: Qi, Ruoling, et al.
Publicado: (2026)
por: Qi, Ruoling, et al.
Publicado: (2026)
PRTS: A Primitive Reasoning and Tasking System via Contrastive Representations
por: Zhang, Yang, et al.
Publicado: (2026)
por: Zhang, Yang, et al.
Publicado: (2026)
TelePhysics: Physics-Grounded Multi-Object Scene Generation from a Single Image with Real-Time Interaction
por: Zhang, Xin, et al.
Publicado: (2026)
por: Zhang, Xin, et al.
Publicado: (2026)
Integrating Reinforcement Learning with Visual Generative Models: Foundations and Advances
por: Liang, Yuanzhi, et al.
Publicado: (2025)
por: Liang, Yuanzhi, et al.
Publicado: (2025)
UniModel: A Visual-Only Framework for Unified Multimodal Understanding and Generation
por: Zhang, Chi, et al.
Publicado: (2025)
por: Zhang, Chi, et al.
Publicado: (2025)
InterSyn: Interleaved Learning for Dynamic Motion Synthesis in the Wild
por: Ma, Yiyi, et al.
Publicado: (2025)
por: Ma, Yiyi, et al.
Publicado: (2025)
QwenStyle: Content-Preserving Style Transfer with Qwen-Image-Edit
por: Zhang, Shiwen, et al.
Publicado: (2026)
por: Zhang, Shiwen, et al.
Publicado: (2026)
Uni-Inter: Unifying 3D Human Motion Synthesis Across Diverse Interaction Contexts
por: Liu, Sheng, et al.
Publicado: (2025)
por: Liu, Sheng, et al.
Publicado: (2025)
VAST 1.0: A Unified Framework for Controllable and Consistent Video Generation
por: Zhang, Chi, et al.
Publicado: (2024)
por: Zhang, Chi, et al.
Publicado: (2024)
Decoupling the Image Perception and Multimodal Reasoning for Reasoning Segmentation with Digital Twin Representations
por: Li, Yizhen, et al.
Publicado: (2025)
por: Li, Yizhen, et al.
Publicado: (2025)
Learning to Credit the Right Steps: Objective-aware Process Optimization for Visual Generation
por: Li, Rui, et al.
Publicado: (2026)
por: Li, Rui, et al.
Publicado: (2026)
KV-CoRE: Benchmarking Data-Dependent Low-Rank Compressibility of KV-Caches in LLMs
por: Chen, Jian, et al.
Publicado: (2026)
por: Chen, Jian, et al.
Publicado: (2026)
Reward-Aware Trajectory Shaping for Few-step Visual Generation
por: Li, Rui, et al.
Publicado: (2026)
por: Li, Rui, et al.
Publicado: (2026)
High-Fidelity Generative Audio Compression at 0.275kbps
por: Ma, Hao, et al.
Publicado: (2026)
por: Ma, Hao, et al.
Publicado: (2026)
CtrlVDiff: Controllable Video Generation via Unified Multimodal Video Diffusion
por: Xi, Dianbing, et al.
Publicado: (2025)
por: Xi, Dianbing, et al.
Publicado: (2025)
Tele-FLM Technical Report
por: Li, Xiang, et al.
Publicado: (2024)
por: Li, Xiang, et al.
Publicado: (2024)
TeleEgo: Benchmarking Egocentric AI Assistants in the Wild
por: Yan, Jiaqi, et al.
Publicado: (2025)
por: Yan, Jiaqi, et al.
Publicado: (2025)
TeleAI-Safety: A comprehensive LLM jailbreaking benchmark towards attacks, defenses, and evaluations
por: Chen, Xiuyuan, et al.
Publicado: (2025)
por: Chen, Xiuyuan, et al.
Publicado: (2025)
TempoMaster: Efficient Long Video Generation via Next-Frame-Rate Prediction
por: Ma, Yukuo, et al.
Publicado: (2025)
por: Ma, Yukuo, et al.
Publicado: (2025)
Quantum-Boosted High-Fidelity Deep Learning
por: Wang, Feng-ao, et al.
Publicado: (2025)
por: Wang, Feng-ao, et al.
Publicado: (2025)
Enhance Vision-Language Alignment with Noise
por: Huang, Sida, et al.
Publicado: (2024)
por: Huang, Sida, et al.
Publicado: (2024)
What influenced the lack of diversity in CSR after the company's losses: evidence from topic modeling
por: Liu, Ruiying, et al.
Publicado: (2025)
por: Liu, Ruiying, et al.
Publicado: (2025)
TeleChat Technical Report
por: He, Zhongjiang, et al.
Publicado: (2024)
por: He, Zhongjiang, et al.
Publicado: (2024)
TeleMem: Building Long-Term and Multimodal Memory for Agentic AI
por: Chen, Chunliang, et al.
Publicado: (2025)
por: Chen, Chunliang, et al.
Publicado: (2025)
Technical Report of TeleChat2, TeleChat2.5 and T1
por: Wang, Zihan, et al.
Publicado: (2025)
por: Wang, Zihan, et al.
Publicado: (2025)
The Use of Deep Learning in Primary Agricultural Products Freshness Assessment: A Systematic Review
por: Yifan Kang, et al.
Publicado: (2025)
por: Yifan Kang, et al.
Publicado: (2025)
Peer interaction in second language learningBy JinfenXu, Beijing: Foreign Language Teaching and Research Press. 2020. pp. 263, 66.90 Chinese Yuan (Paperback). ISBN: 978‐7‐5213‐2256‐9
por: Ruiying Niu, et al.
Publicado: (2024)
por: Ruiying Niu, et al.
Publicado: (2024)
General Formulation and PCL-Analysis for Restless Bandits with Limited Observability
por: Liu, Keqin, et al.
Publicado: (2023)
por: Liu, Keqin, et al.
Publicado: (2023)
52B to 1T: Lessons Learned via Tele-FLM Series
por: Li, Xiang, et al.
Publicado: (2024)
por: Li, Xiang, et al.
Publicado: (2024)
OmniVDiff: Omni Controllable Video Diffusion for Generation and Understanding
por: Xi, Dianbing, et al.
Publicado: (2025)
por: Xi, Dianbing, et al.
Publicado: (2025)
Multi-Fidelity Methods for Optimization: A Survey
por: Li, Ke, et al.
Publicado: (2024)
por: Li, Ke, et al.
Publicado: (2024)
Unsupervised Spatial-Temporal Feature Enrichment and Fidelity Preservation Network for Skeleton based Action Recognition
por: Li, Chuankun, et al.
Publicado: (2024)
por: Li, Chuankun, et al.
Publicado: (2024)
Ejemplares similares
-
Beyond Binary: Turning Partial Success into Dense Verifiable Rewards for Reinforcement Learning in Code Generation
por: Wang, Longwen, et al.
Publicado: (2026) -
TeleWorld: Towards Dynamic Multimodal Synthesis with a 4D World Model
por: Chen, Yabo, et al.
Publicado: (2025) -
Seeing What Matters: Visual Preference Policy Optimization for Visual Generation
por: Ni, Ziqi, et al.
Publicado: (2025) -
Learning What to Trust: Bayesian Prior-Guided Optimization for Visual Generation
por: Liu, Ruiying, et al.
Publicado: (2025) -
Computation-Bandwidth-Memory Trade-offs: A Unified Paradigm for AI Infrastructure
por: Fan, Yuankai, et al.
Publicado: (2025)