A Non-Adversarial Approach to Idempotent Generative Modelling
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Al-Jaff, Mohammed, Marchetti, Giovanni Luca, Welle, Michael C, Lundell, Jens, Gustafsson, Mats G., Henter, Gustav Eje, Azizpour, Hossein, Kragic, Danica |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exploring Internal Numeracy in Language Models: A Case Study on ALBERT
par: Wennberg, Ulme, et autres
Publié: (2024)
par: Wennberg, Ulme, et autres
Publié: (2024)
CAPGrasp: An $\mathbb{R}^3\times \text{SO(2)-equivariant}$ Continuous Approach-Constrained Generative Grasp Sampler
par: Weng, Zehang, et autres
Publié: (2023)
par: Weng, Zehang, et autres
Publié: (2023)
DexDiffuser: Generating Dexterous Grasps with Diffusion Models
par: Weng, Zehang, et autres
Publié: (2024)
par: Weng, Zehang, et autres
Publié: (2024)
VoXtream: Full-Stream Text-to-Speech with Extremely Low Latency
par: Torgashov, Nikita, et autres
Publié: (2025)
par: Torgashov, Nikita, et autres
Publié: (2025)
VoXtream2: Full-stream TTS with dynamic speaking rate control
par: Torgashov, Nikita, et autres
Publié: (2026)
par: Torgashov, Nikita, et autres
Publié: (2026)
Preference Aligned Visuomotor Diffusion Policies for Deformable Object Manipulation
par: Moletta, Marco, et autres
Publié: (2026)
par: Moletta, Marco, et autres
Publié: (2026)
Learning Dexterous In-Hand Manipulation with Multifingered Hands via Visuomotor Diffusion
par: Koczy, Piotr, et autres
Publié: (2025)
par: Koczy, Piotr, et autres
Publié: (2025)
Pushing Everything Everywhere All At Once: Probabilistic Prehensile Pushing
par: Perugini, Patrizio, et autres
Publié: (2025)
par: Perugini, Patrizio, et autres
Publié: (2025)
S$^2$-Diffusion: Generalizing from Instance-level to Category-level Skills in Robot Manipulation
par: Yang, Quantao, et autres
Publié: (2025)
par: Yang, Quantao, et autres
Publié: (2025)
Harmonics of Learning: Universal Fourier Features Emerge in Invariant Networks
par: Marchetti, Giovanni Luca, et autres
Publié: (2023)
par: Marchetti, Giovanni Luca, et autres
Publié: (2023)
Voice Conversion-based Privacy through Adversarial Information Hiding
par: Webber, Jacob J, et autres
Publié: (2024)
par: Webber, Jacob J, et autres
Publié: (2024)
Reduced-order Control and Geometric Structure of Learned Lagrangian Latent Dynamics
par: Friedl, Katharina, et autres
Publié: (2026)
par: Friedl, Katharina, et autres
Publié: (2026)
A Riemannian Framework for Learning Reduced-order Lagrangian Dynamics
par: Friedl, Katharina, et autres
Publié: (2024)
par: Friedl, Katharina, et autres
Publié: (2024)
CARL-GT: Evaluating Causal Reasoning Capabilities of Large Language Models
par: Tu, Ruibo, et autres
Publié: (2024)
par: Tu, Ruibo, et autres
Publié: (2024)
Do Bias Benchmarks Generalise? Evidence from Voice-based Evaluation of Gender Bias in SpeechLLMs
par: Satish, Shree Harsha Bokkahalli, et autres
Publié: (2025)
par: Satish, Shree Harsha Bokkahalli, et autres
Publié: (2025)
When Voice Matters: Evidence of Gender Disparity in Positional Bias of SpeechLLMs
par: Satish, Shree Harsha Bokkahalli, et autres
Publié: (2025)
par: Satish, Shree Harsha Bokkahalli, et autres
Publié: (2025)
Relative Representations: Topological and Geometric Perspectives
par: García-Castellanos, Alejandro, et autres
Publié: (2024)
par: García-Castellanos, Alejandro, et autres
Publié: (2024)
AdaFold: Adapting Folding Trajectories of Cloths via Feedback-loop Manipulation
par: Longhini, Alberta, et autres
Publié: (2024)
par: Longhini, Alberta, et autres
Publié: (2024)
Grasping a Handful: Sequential Multi-Object Dexterous Grasp Generation
par: Lu, Haofei, et autres
Publié: (2025)
par: Lu, Haofei, et autres
Publié: (2025)
On the Generalization Capabilities, Design Choices and Limitations of Keypoint Imitation Learning
par: Lips, Thomas, et autres
Publié: (2026)
par: Lips, Thomas, et autres
Publié: (2026)
Puppeteer Your Robot: Augmented Reality Leader-Follower Teleoperation
par: van Haastregt, Jonne, et autres
Publié: (2024)
par: van Haastregt, Jonne, et autres
Publié: (2024)
Matcha-TTS: A fast TTS architecture with conditional flow matching
par: Mehta, Shivam, et autres
Publié: (2023)
par: Mehta, Shivam, et autres
Publié: (2023)
Real-Time Operator Takeover for Visuomotor Diffusion Policy Training
par: Moletta, Marco, et autres
Publié: (2025)
par: Moletta, Marco, et autres
Publié: (2025)
Voronoi Density Estimator for High-Dimensional Data: Computation, Compactification and Convergence
par: Polianskii, Vladislav, et autres
Publié: (2022)
par: Polianskii, Vladislav, et autres
Publié: (2022)
Low-Cost Teleoperation with Haptic Feedback through Vision-based Tactile Sensors for Rigid and Soft Object Manipulation
par: Lippi, Martina, et autres
Publié: (2024)
par: Lippi, Martina, et autres
Publié: (2024)
Hybrid-Diffusion Models: Combining Open-loop Routines with Visuomotor Diffusion Policies
par: Van Haastregt, Jonne, et autres
Publié: (2025)
par: Van Haastregt, Jonne, et autres
Publié: (2025)
LLM-Driven Augmented Reality Puppeteer: Controller-Free Voice-Commanded Robot Teleoperation
par: Zhang, Yuchong, et autres
Publié: (2025)
par: Zhang, Yuchong, et autres
Publié: (2025)
HyperSteiner: Computing Heuristic Hyperbolic Steiner Minimal Trees
par: García-Castellanos, Alejandro, et autres
Publié: (2024)
par: García-Castellanos, Alejandro, et autres
Publié: (2024)
Unified speech and gesture synthesis using flow matching
par: Mehta, Shivam, et autres
Publié: (2023)
par: Mehta, Shivam, et autres
Publié: (2023)
EmojiVoice: Towards long-term controllable expressivity in robot speech
par: Tuttösí, Paige, et autres
Publié: (2025)
par: Tuttösí, Paige, et autres
Publié: (2025)
Speak Your Mind: The Speech Continuation Task as a Probe of Voice-Based Model Bias
par: Satish, Shree Harsha Bokkahalli, et autres
Publié: (2025)
par: Satish, Shree Harsha Bokkahalli, et autres
Publié: (2025)
Should you use a probabilistic duration model in TTS? Probably! Especially for spontaneous speech
par: Mehta, Shivam, et autres
Publié: (2024)
par: Mehta, Shivam, et autres
Publié: (2024)
Causality for Tabular Data Synthesis: A High-Order Structure Causal Benchmark Framework
par: Tu, Ruibo, et autres
Publié: (2024)
par: Tu, Ruibo, et autres
Publié: (2024)
Visual Action Planning with Multiple Heterogeneous Agents
par: Lippi, Martina, et autres
Publié: (2024)
par: Lippi, Martina, et autres
Publié: (2024)
Gesture First, LLM-Assisted Voice Complement: Exploring Multimodal Robot 'Puppeteer' Teleoperation Via Virtual Counterpart in Augmented Reality
par: Zhang, Yuchong, et autres
Publié: (2025)
par: Zhang, Yuchong, et autres
Publié: (2025)
Standardization of Cloth Objects and its Relevance in Robotic Manipulation
par: Garcia-Camacho, Irene, et autres
Publié: (2024)
par: Garcia-Camacho, Irene, et autres
Publié: (2024)
Cloth-Splatting: 3D Cloth State Estimation from RGB Supervision
par: Longhini, Alberta, et autres
Publié: (2025)
par: Longhini, Alberta, et autres
Publié: (2025)
A Robotic Skill Learning System Built Upon Diffusion Policies and Foundation Models
par: Ingelhag, Nils, et autres
Publié: (2024)
par: Ingelhag, Nils, et autres
Publié: (2024)
Randomized HyperSteiner: A Stochastic Delaunay Triangulation Heuristic for the Hyperbolic Steiner Minimal Tree
par: Medbouhi, Aniss Aiman, et autres
Publié: (2025)
par: Medbouhi, Aniss Aiman, et autres
Publié: (2025)
Hyperbolic Delaunay Geometric Alignment
par: Medbouhi, Aniss Aiman, et autres
Publié: (2024)
par: Medbouhi, Aniss Aiman, et autres
Publié: (2024)
Documents similaires
-
Exploring Internal Numeracy in Language Models: A Case Study on ALBERT
par: Wennberg, Ulme, et autres
Publié: (2024) -
CAPGrasp: An $\mathbb{R}^3\times \text{SO(2)-equivariant}$ Continuous Approach-Constrained Generative Grasp Sampler
par: Weng, Zehang, et autres
Publié: (2023) -
DexDiffuser: Generating Dexterous Grasps with Diffusion Models
par: Weng, Zehang, et autres
Publié: (2024) -
VoXtream: Full-Stream Text-to-Speech with Extremely Low Latency
par: Torgashov, Nikita, et autres
Publié: (2025) -
VoXtream2: Full-stream TTS with dynamic speaking rate control
par: Torgashov, Nikita, et autres
Publié: (2026)