RewardFlow: Generate Images by Optimizing What You Reward
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Susladkar, Onkar, Jang, Dong-Hwan, Prakash, Tushar, Juvekar, Adheesh, Shah, Vedant, Barik, Ayush, Bashir, Nabeel, Wahed, Muntasir, Shrirao, Ritish, Lourentzou, Ismini |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PyraTok: Language-Aligned Pyramidal Tokenizer for Video Understanding and Generation
par: Susladkar, Onkar, et autres
Publié: (2026)
par: Susladkar, Onkar, et autres
Publié: (2026)
CALICO: Part-Focused Semantic Co-Segmentation with Large Vision-Language Models
par: Nguyen, Kiet A., et autres
Publié: (2024)
par: Nguyen, Kiet A., et autres
Publié: (2024)
Uncertainty in Action: Confidence Elicitation in Embodied Agents
par: Yu, Tianjiao, et autres
Publié: (2025)
par: Yu, Tianjiao, et autres
Publié: (2025)
PRIMA: Multi-Image Vision-Language Models for Reasoning Segmentation
par: Wahed, Muntasir, et autres
Publié: (2024)
par: Wahed, Muntasir, et autres
Publié: (2024)
Best of Both Worlds: Multimodal Reasoning and Generation via Unified Discrete Flow Matching
par: Susladkar, Onkar, et autres
Publié: (2026)
par: Susladkar, Onkar, et autres
Publié: (2026)
Part$^{2}$GS: Part-aware Modeling of Articulated Objects using 3D Gaussian Splatting
par: Yu, Tianjiao, et autres
Publié: (2025)
par: Yu, Tianjiao, et autres
Publié: (2025)
Counterfactual Segmentation Reasoning: Diagnosing and Mitigating Pixel-Grounding Hallucination
par: Li, Xinzhuo, et autres
Publié: (2025)
par: Li, Xinzhuo, et autres
Publié: (2025)
Tiny but Trusted: Efficient Vision-Language Reasoning for Time-Series Anomaly Detection
par: Zhou, Xiaona, et autres
Publié: (2026)
par: Zhou, Xiaona, et autres
Publié: (2026)
DreamPartGen: Semantically Grounded Part-Level 3D Generation via Collaborative Latent Denoising
par: Yu, Tianjiao, et autres
Publié: (2026)
par: Yu, Tianjiao, et autres
Publié: (2026)
RewardFlow: Topology-Aware Reward Propagation on State Graphs for Agentic RL with Large Language Models
par: Feng, Xiao, et autres
Publié: (2026)
par: Feng, Xiao, et autres
Publié: (2026)
Full-Gradient Successor Feature Representations
par: Shrirao, Ritish, et autres
Publié: (2026)
par: Shrirao, Ritish, et autres
Publié: (2026)
Commonsense for Zero-Shot Natural Language Video Localization
par: Holla, Meghana, et autres
Publié: (2023)
par: Holla, Meghana, et autres
Publié: (2023)
MOCHA: Are Code Language Models Robust Against Multi-Turn Malicious Coding Prompts?
par: Wahed, Muntasir, et autres
Publié: (2025)
par: Wahed, Muntasir, et autres
Publié: (2025)
What Can You Do When You Have Zero Rewards During RL?
par: Prakash, Jatin, et autres
Publié: (2025)
par: Prakash, Jatin, et autres
Publié: (2025)
3D-VCD: Hallucination Mitigation in 3D-LLM Embodied Agents through Visual Contrastive Decoding
par: Ogunleye, Makanjuola, et autres
Publié: (2026)
par: Ogunleye, Makanjuola, et autres
Publié: (2026)
mTSBench: Benchmarking Multivariate Time Series Anomaly Detection and Model Selection at Scale
par: Zhou, Xiaona, et autres
Publié: (2025)
par: Zhou, Xiaona, et autres
Publié: (2025)
Bahasa Harmony: A Comprehensive Dataset for Bahasa Text-to-Speech Synthesis with Discrete Codec Modeling of EnGen-TTS
par: Susladkar, Onkar Kishor, et autres
Publié: (2024)
par: Susladkar, Onkar Kishor, et autres
Publié: (2024)
Historic Scripts to Modern Vision: A Novel Dataset and A VLM Framework for Transliteration of Modi Script to Devanagari
par: Kausadikar, Harshal, et autres
Publié: (2025)
par: Kausadikar, Harshal, et autres
Publié: (2025)
D2Styler: Advancing Arbitrary Style Transfer with Discrete Diffusion Methods
par: Susladkar, Onkar, et autres
Publié: (2024)
par: Susladkar, Onkar, et autres
Publié: (2024)
Hierarchical Dataset Selection for High-Quality Data Sharing
par: Zhou, Xiaona, et autres
Publié: (2025)
par: Zhou, Xiaona, et autres
Publié: (2025)
FAIR: Facilitating Artificial Intelligence Resilience in Manufacturing Industrial Internet
par: Zeng, Yingyan, et autres
Publié: (2025)
par: Zeng, Yingyan, et autres
Publié: (2025)
RAVEL: Rare Concept Generation and Editing via Graph-driven Relational Guidance
par: Venkatesh, Kavana, et autres
Publié: (2024)
par: Venkatesh, Kavana, et autres
Publié: (2024)
ELBA: Learning by Asking for Embodied Visual Navigation and Task Completion
par: Shen, Ying, et autres
Publié: (2023)
par: Shen, Ying, et autres
Publié: (2023)
Phantom: Physics-Infused Video Generation via Joint Modeling of Visual and Latent Physical Dynamics
par: Shen, Ying, et autres
Publié: (2026)
par: Shen, Ying, et autres
Publié: (2026)
Decomposable Reward Modeling and Realistic Environment Design for Reinforcement Learning-Based Forex Trading
par: Saidd, Nabeel Ahmad
Publié: (2026)
par: Saidd, Nabeel Ahmad
Publié: (2026)
ViCTr: Vital Consistency Transfer for Pathology Aware Image Synthesis
par: Susladkar, Onkar, et autres
Publié: (2025)
par: Susladkar, Onkar, et autres
Publié: (2025)
PurpCode: Reasoning for Safer Code Generation
par: Liu, Jiawei, et autres
Publié: (2025)
par: Liu, Jiawei, et autres
Publié: (2025)
MMPlanner: Zero-Shot Multimodal Procedural Planning with Chain-of-Thought Object State Reasoning
par: Tabassum, Afrina, et autres
Publié: (2025)
par: Tabassum, Afrina, et autres
Publié: (2025)
uaMix-MAE: Efficient Tuning of Pretrained Audio Transformers with Unsupervised Audio Mixtures
par: Tabassum, Afrina, et autres
Publié: (2024)
par: Tabassum, Afrina, et autres
Publié: (2024)
CoRe3D: Collaborative Reasoning as a Foundation for 3D Intelligence
par: Yu, Tianjiao, et autres
Publié: (2025)
par: Yu, Tianjiao, et autres
Publié: (2025)
MotionAura: Generating High-Quality and Motion Consistent Videos using Discrete Diffusion
par: Susladkar, Onkar, et autres
Publié: (2024)
par: Susladkar, Onkar, et autres
Publié: (2024)
Know What You Don't Know: Uncertainty Calibration of Process Reward Models
par: Park, Young-Jin, et autres
Publié: (2025)
par: Park, Young-Jin, et autres
Publié: (2025)
LaTtE-Flow: Layerwise Timestep-Expert Flow-based Transformer
par: Shen, Ying, et autres
Publié: (2025)
par: Shen, Ying, et autres
Publié: (2025)
Gain Tuning Is Not What You Need: Reward Gain Adaptation for Constrained Locomotion Learning
par: Srisuchinnawong, Arthicha, et autres
Publié: (2025)
par: Srisuchinnawong, Arthicha, et autres
Publié: (2025)
When Can You Poison Rewards? A Tight Characterization of Reward Poisoning in Linear MDPs
par: Escamilla, Jose Efraim Aguilar, et autres
Publié: (2026)
par: Escamilla, Jose Efraim Aguilar, et autres
Publié: (2026)
Uncertainty-aware Reward Model: Teaching Reward Models to Know What is Unknown
par: Lou, Xingzhou, et autres
Publié: (2024)
par: Lou, Xingzhou, et autres
Publié: (2024)
What Fundamental Structure in Reward Functions Enables Efficient Sparse-Reward Learning?
par: Shihab, Ibne Farabi, et autres
Publié: (2025)
par: Shihab, Ibne Farabi, et autres
Publié: (2025)
Role of spatial embedding and planarity in shaping the topology of the Street Networks
par: Khetarpal, Ritish, et autres
Publié: (2025)
par: Khetarpal, Ritish, et autres
Publié: (2025)
PACR: Progressively Ascending Confidence Reward for LLM Reasoning
par: Yoon, Eunseop, et autres
Publié: (2025)
par: Yoon, Eunseop, et autres
Publié: (2025)
Cost and Reward Infused Metric Elicitation
par: Bhateja, Chethan, et autres
Publié: (2025)
par: Bhateja, Chethan, et autres
Publié: (2025)
Documents similaires
-
PyraTok: Language-Aligned Pyramidal Tokenizer for Video Understanding and Generation
par: Susladkar, Onkar, et autres
Publié: (2026) -
CALICO: Part-Focused Semantic Co-Segmentation with Large Vision-Language Models
par: Nguyen, Kiet A., et autres
Publié: (2024) -
Uncertainty in Action: Confidence Elicitation in Embodied Agents
par: Yu, Tianjiao, et autres
Publié: (2025) -
PRIMA: Multi-Image Vision-Language Models for Reasoning Segmentation
par: Wahed, Muntasir, et autres
Publié: (2024) -
Best of Both Worlds: Multimodal Reasoning and Generation via Unified Discrete Flow Matching
par: Susladkar, Onkar, et autres
Publié: (2026)