Enregistré dans:
| Auteurs principaux: | Bhattacharyya, Apratim, Xu, Bicheng, Haresh, Sanjay, Pourreza, Reza, Liu, Litian, Panchal, Sunny, Madan, Pulkit, Sigal, Leonid, Memisevic, Roland |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2511.21998 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Look, Remember and Reason: Grounded reasoning in videos with language models
par: Bhattacharyya, Apratim, et autres
Publié: (2023)
par: Bhattacharyya, Apratim, et autres
Publié: (2023)
Enhancing Hallucination Detection through Noise Injection
par: Liu, Litian, et autres
Publié: (2025)
par: Liu, Litian, et autres
Publié: (2025)
Can Vision-Language Models Answer Face to Face Questions in the Real-World?
par: Pourreza, Reza, et autres
Publié: (2025)
par: Pourreza, Reza, et autres
Publié: (2025)
Notes-to-Self: Scratchpad Augmented VLAs for Memory Dependent Manipulation Tasks
par: Haresh, Sanjay, et autres
Publié: (2026)
par: Haresh, Sanjay, et autres
Publié: (2026)
ClevrSkills: Compositional Language and Visual Reasoning in Robotics
par: Haresh, Sanjay, et autres
Publié: (2024)
par: Haresh, Sanjay, et autres
Publié: (2024)
What to Say and When to Say it: Live Fitness Coaching as a Testbed for Situated Interaction
par: Panchal, Sunny, et autres
Publié: (2024)
par: Panchal, Sunny, et autres
Publié: (2024)
Your Context Is Not an Array: Unveiling Random Access Limitations in Transformers
par: Ebrahimi, MohammadReza, et autres
Publié: (2024)
par: Ebrahimi, MohammadReza, et autres
Publié: (2024)
From Out-of-Distribution Detection to Hallucination Detection: A Geometric View
par: Liu, Litian, et autres
Publié: (2026)
par: Liu, Litian, et autres
Publié: (2026)
Delayed Attention Training Improves Length Generalization in Transformer--RNN Hybrids
par: Phan, Buu, et autres
Publié: (2025)
par: Phan, Buu, et autres
Publié: (2025)
On the "Induction Bias" in Sequence Models
par: Ebrahimi, M. Reza, et autres
Publié: (2026)
par: Ebrahimi, M. Reza, et autres
Publié: (2026)
Revisiting Bi-Linear State Transitions in Recurrent Neural Networks
par: Ebrahimi, M. Reza, et autres
Publié: (2025)
par: Ebrahimi, M. Reza, et autres
Publié: (2025)
Joint Generative Modeling of Grounded Scene Graphs and Images via Diffusion Models
par: Xu, Bicheng, et autres
Publié: (2024)
par: Xu, Bicheng, et autres
Publié: (2024)
Multi-Draft Speculative Sampling: Canonical Decomposition and Theoretical Limits
par: Khisti, Ashish, et autres
Publié: (2024)
par: Khisti, Ashish, et autres
Publié: (2024)
Distilling Multi-modal Large Language Models for Autonomous Driving
par: Hegde, Deepti, et autres
Publié: (2025)
par: Hegde, Deepti, et autres
Publié: (2025)
Do LLMs Benefit from User and Item Embeddings in Recommendation Tasks?
par: Hossain, Mir Rayat Imtiaz, et autres
Publié: (2026)
par: Hossain, Mir Rayat Imtiaz, et autres
Publié: (2026)
Replacing thinking with tool usage enables reasoning in small language models
par: Rainone, Corrado, et autres
Publié: (2025)
par: Rainone, Corrado, et autres
Publié: (2025)
Step-by-Step Video-to-Audio Synthesis via Negative Audio Guidance
par: Hayakawa, Akio, et autres
Publié: (2025)
par: Hayakawa, Akio, et autres
Publié: (2025)
Whiteboard-of-Thought: Thinking Step-by-Step Across Modalities
par: Menon, Sachit, et autres
Publié: (2024)
par: Menon, Sachit, et autres
Publié: (2024)
StepTool: Enhancing Multi-Step Tool Usage in LLMs via Step-Grained Reinforcement Learning
par: Yu, Yuanqing, et autres
Publié: (2024)
par: Yu, Yuanqing, et autres
Publié: (2024)
MMFactory: A Universal Solution Search Engine for Vision-Language Tasks
par: Fan, Wan-Cyuan, et autres
Publié: (2024)
par: Fan, Wan-Cyuan, et autres
Publié: (2024)
Self-Evaluating LLMs for Multi-Step Tasks: Stepwise Confidence Estimation for Failure Detection
par: Mavi, Vaibhav, et autres
Publié: (2025)
par: Mavi, Vaibhav, et autres
Publié: (2025)
One Step Forward and K Steps Back: Better Reasoning with Denoising Recursion Models
par: Cameron, Chris, et autres
Publié: (2026)
par: Cameron, Chris, et autres
Publié: (2026)
Can We Verify Step by Step for Incorrect Answer Detection?
par: Xu, Xin, et autres
Publié: (2024)
par: Xu, Xin, et autres
Publié: (2024)
Investigating the Shortcomings of LLMs in Step-by-Step Legal Reasoning
par: Mishra, Venkatesh, et autres
Publié: (2025)
par: Mishra, Venkatesh, et autres
Publié: (2025)
Step Guided Reasoning: Improving Mathematical Reasoning using Guidance Generation and Step Reasoning
par: Cao, Lang, et autres
Publié: (2024)
par: Cao, Lang, et autres
Publié: (2024)
One Step at a Time: Combining LLMs and Static Analysis to Generate Next-Step Hints for Programming Tasks
par: Birillo, Anastasiia, et autres
Publié: (2024)
par: Birillo, Anastasiia, et autres
Publié: (2024)
Transformers Can Navigate Mazes With Multi-Step Prediction
par: Nolte, Niklas, et autres
Publié: (2024)
par: Nolte, Niklas, et autres
Publié: (2024)
Live API-Bench: 2500+ Live APIs for Testing Multi-Step Tool Calling
par: Elder, Benjamin, et autres
Publié: (2025)
par: Elder, Benjamin, et autres
Publié: (2025)
Can Eccentric Binary Black Hole Signals Mimic Gravitational-Wave Microlensing?
par: Mishra, Anuj, et autres
Publié: (2025)
par: Mishra, Anuj, et autres
Publié: (2025)
Service Oriented Computing in Practice - An Agenda for Research into the Factors Influencing the Organizational Adoption of Service Oriented Architectures
par: Haresh Luthria
Publié: (2009)
par: Haresh Luthria
Publié: (2009)
Culture Roots Vs. Modernity in Mahesh Elkunchwar’s Old Stone Mansion
par: Haresh Kakde
Publié: (2017)
par: Haresh Kakde
Publié: (2017)
Aligning Robot Navigation Behaviors with Human Intentions and Preferences
par: Karnan, Haresh
Publié: (2024)
par: Karnan, Haresh
Publié: (2024)
Deconfinement to confinement by generalizing BRST symmetry on the sphere
par: Raval, Haresh
Publié: (2024)
par: Raval, Haresh
Publié: (2024)
Step-by-Step Guidance to Differential Anemia Diagnosis with Real-World Data and Deep Reinforcement Learning
par: Muyama, Lillian, et autres
Publié: (2024)
par: Muyama, Lillian, et autres
Publié: (2024)
RoCA: Robust Cross-Domain End-to-End Autonomous Driving
par: Yasarla, Rajeev, et autres
Publié: (2025)
par: Yasarla, Rajeev, et autres
Publié: (2025)
Do LLMs Align with My Task? Evaluating Text-to-SQL via Dataset Alignment
par: Rafiei, Davood, et autres
Publié: (2025)
par: Rafiei, Davood, et autres
Publié: (2025)
Long-term evolution of spin and other properties of neutron star low-mass X-ray binaries: implications for millisecond X-ray pulsars
par: Kar, Abhijnan, et autres
Publié: (2024)
par: Kar, Abhijnan, et autres
Publié: (2024)
Long-term evolution of Sco X-1: implications for the current spin frequency and ellipticity of the neutron star
par: Kar, Abhijnan, et autres
Publié: (2025)
par: Kar, Abhijnan, et autres
Publié: (2025)
RAISE: Enhancing Scientific Reasoning in LLMs via Step-by-Step Retrieval
par: Oh, Minhae, et autres
Publié: (2025)
par: Oh, Minhae, et autres
Publié: (2025)
Chain-of-Restoration: Multi-Task Image Restoration Models are Zero-Shot Step-by-Step Universal Image Restorers
par: Cao, Jin, et autres
Publié: (2024)
par: Cao, Jin, et autres
Publié: (2024)
Documents similaires
-
Look, Remember and Reason: Grounded reasoning in videos with language models
par: Bhattacharyya, Apratim, et autres
Publié: (2023) -
Enhancing Hallucination Detection through Noise Injection
par: Liu, Litian, et autres
Publié: (2025) -
Can Vision-Language Models Answer Face to Face Questions in the Real-World?
par: Pourreza, Reza, et autres
Publié: (2025) -
Notes-to-Self: Scratchpad Augmented VLAs for Memory Dependent Manipulation Tasks
par: Haresh, Sanjay, et autres
Publié: (2026) -
ClevrSkills: Compositional Language and Visual Reasoning in Robotics
par: Haresh, Sanjay, et autres
Publié: (2024)