E3VS-Bench: A Benchmark for Viewpoint-Dependent Active Perception in 3D Gaussian Splatting Scenes
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sakamoto, Koya, Miyanishi, Taiki, Azuma, Daichi, Kurita, Shuhei, Morikuni, Shu, Chiba, Naoya, Kawanabe, Motoaki, Iwasawa, Yusuke, Matsuo, Yutaka |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Answerability Fields: Answerable Location Estimation via Diffusion Models
par: Azuma, Daichi, et autres
Publié: (2024)
par: Azuma, Daichi, et autres
Publié: (2024)
Map-based Modular Approach for Zero-shot Embodied Question Answering
par: Sakamoto, Koya, et autres
Publié: (2024)
par: Sakamoto, Koya, et autres
Publié: (2024)
Cross3DVG: Cross-Dataset 3D Visual Grounding on Different RGB-D Scans
par: Miyanishi, Taiki, et autres
Publié: (2023)
par: Miyanishi, Taiki, et autres
Publié: (2023)
CityNav: A Large-Scale Dataset for Real-World Aerial Navigation
par: Lee, Jungdae, et autres
Publié: (2024)
par: Lee, Jungdae, et autres
Publié: (2024)
GeoProg3D: Compositional Visual Reasoning for City-Scale 3D Language Fields
par: Yasuki, Shunsuke, et autres
Publié: (2025)
par: Yasuki, Shunsuke, et autres
Publié: (2025)
EC-Bench: Enumeration and Counting Benchmark for Ultra-Long Videos
par: Tsuchiya, Fumihiko, et autres
Publié: (2026)
par: Tsuchiya, Fumihiko, et autres
Publié: (2026)
PhysQuantAgent: An Inference Pipeline of Mass Estimation for Vision-Language Models
par: Yokomizo, Hisayuki, et autres
Publié: (2026)
par: Yokomizo, Hisayuki, et autres
Publié: (2026)
LegalViz: Legal Text Visualization by Text To Diagram Generation
par: Onami, Eri, et autres
Publié: (2025)
par: Onami, Eri, et autres
Publié: (2025)
Vision Language Model-based Caption Evaluation Method Leveraging Visual Context Extraction
par: Maeda, Koki, et autres
Publié: (2024)
par: Maeda, Koki, et autres
Publié: (2024)
JDocQA: Japanese Document Question Answering Dataset for Generative Language Models
par: Onami, Eri, et autres
Publié: (2024)
par: Onami, Eri, et autres
Publié: (2024)
Language Models Do Hard Arithmetic Tasks Easily and Hardly Do Easy Arithmetic Tasks
par: Gambardella, Andrew, et autres
Publié: (2024)
par: Gambardella, Andrew, et autres
Publié: (2024)
Bridging Lottery Ticket and Grokking: Understanding Grokking from Inner Structure of Networks
par: Minegishi, Gouki, et autres
Publié: (2023)
par: Minegishi, Gouki, et autres
Publié: (2023)
ClinDet-Bench: Beyond Abstention, Evaluating Judgment Determinability of LLMs in Clinical Decision-Making
par: Watanabe, Yusuke, et autres
Publié: (2026)
par: Watanabe, Yusuke, et autres
Publié: (2026)
ReMoRa: Multimodal Large Language Model based on Refined Motion Representation for Long-Video Understanding
par: Yashima, Daichi, et autres
Publié: (2026)
par: Yashima, Daichi, et autres
Publié: (2026)
Error estimate for regularized optimal transport problems via Bregman divergence
par: Morikuni, Keiichi, et autres
Publié: (2023)
par: Morikuni, Keiichi, et autres
Publié: (2023)
Large Language Models as Theory of Mind Aware Generative Agents with Counterfactual Reflection
par: Yang, Bo, et autres
Publié: (2025)
par: Yang, Bo, et autres
Publié: (2025)
Inconsistent Tokenizations Cause Language Models to be Perplexed by Japanese Grammar
par: Gambardella, Andrew, et autres
Publié: (2025)
par: Gambardella, Andrew, et autres
Publié: (2025)
AQA-TTRL: Self-Adaptation in Audio Question Answering with Test-Time Reinforcement Learning
par: Zhang, Haoyu, et autres
Publié: (2025)
par: Zhang, Haoyu, et autres
Publié: (2025)
Rethinking Evaluation of Sparse Autoencoders through the Representation of Polysemous Words
par: Minegishi, Gouki, et autres
Publié: (2025)
par: Minegishi, Gouki, et autres
Publié: (2025)
Towards Empirical Interpretation of Internal Circuits and Properties in Grokked Transformers on Modular Polynomials
par: Furuta, Hiroki, et autres
Publié: (2024)
par: Furuta, Hiroki, et autres
Publié: (2024)
QuadNorm: Resolution-Robust Normalization for Neural Operators
par: Kim, Bum Jun, et autres
Publié: (2026)
par: Kim, Bum Jun, et autres
Publié: (2026)
Unlocking Noise-Resistant Vision: Key Architectural Secrets for Robust Models
par: Kim, Bum Jun, et autres
Publié: (2025)
par: Kim, Bum Jun, et autres
Publié: (2025)
HakushoBench: A Japanese Chart and Table VQA Benchmark from Governmental White Papers
par: Sugiura, Issa, et autres
Publié: (2026)
par: Sugiura, Issa, et autres
Publié: (2026)
HiFlow: Tokenization-Free Scale-Wise Autoregressive Policy Learning via Flow Matching
par: Yashima, Daichi, et autres
Publié: (2026)
par: Yashima, Daichi, et autres
Publié: (2026)
SPDIM: Source-Free Unsupervised Conditional and Label Shift Adaptation in EEG
par: Li, Shanglin, et autres
Publié: (2024)
par: Li, Shanglin, et autres
Publié: (2024)
Dynamic Injection of Entity Knowledge into Dense Retrievers
par: Yamada, Ikuya, et autres
Publié: (2025)
par: Yamada, Ikuya, et autres
Publié: (2025)
Automated Refinement of Essay Scoring Rubrics for Language Models via Reflect-and-Revise
par: Harada, Keno, et autres
Publié: (2025)
par: Harada, Keno, et autres
Publié: (2025)
Realtime Data-Efficient Portrait Stylization Based On Geometric Alignment
par: Wang, Xinrui, et autres
Publié: (2022)
par: Wang, Xinrui, et autres
Publié: (2022)
On the Multilingual Ability of Decoder-based Pre-trained Language Models: Finding and Controlling Language-Specific Neurons
par: Kojima, Takeshi, et autres
Publié: (2024)
par: Kojima, Takeshi, et autres
Publié: (2024)
Semantic Token Clustering for Efficient Uncertainty Quantification in Large Language Models
par: Cao, Qi, et autres
Publié: (2026)
par: Cao, Qi, et autres
Publié: (2026)
Topology of Reasoning: Understanding Large Reasoning Models through Reasoning Graph Properties
par: Minegishi, Gouki, et autres
Publié: (2025)
par: Minegishi, Gouki, et autres
Publié: (2025)
Understanding Emergent Misalignment via Feature Superposition Geometry
par: Minegishi, Gouki, et autres
Publié: (2026)
par: Minegishi, Gouki, et autres
Publié: (2026)
WorldPack: Compressed Memory Improves Spatial Consistency in Video World Modeling
par: Oshima, Yuta, et autres
Publié: (2025)
par: Oshima, Yuta, et autres
Publié: (2025)
Leave No Observation Behind: Real-time Correction for VLA Action Chunks
par: Sendai, Kohei, et autres
Publié: (2025)
par: Sendai, Kohei, et autres
Publié: (2025)
Retrieve-Augmented Generation for Speeding up Diffusion Policy without Additional Training
par: Odonchimed, Sodtavilan, et autres
Publié: (2025)
par: Odonchimed, Sodtavilan, et autres
Publié: (2025)
$\infty$-MoE: Generalizing Mixture of Experts to Infinite Experts
par: Takashiro, Shota, et autres
Publié: (2026)
par: Takashiro, Shota, et autres
Publié: (2026)
Beyond Induction Heads: In-Context Meta Learning Induces Multi-Phase Circuit Emergence
par: Minegishi, Gouki, et autres
Publié: (2025)
par: Minegishi, Gouki, et autres
Publié: (2025)
SPARK: Graph-Based Online Semantic Integration System for Robot Task Planning
par: Shirasaka, Mimo, et autres
Publié: (2025)
par: Shirasaka, Mimo, et autres
Publié: (2025)
Zipping the Thought: When and How Compressed Reasoning Data Works in LLM Post-Training
par: Matsutani, Kohsei, et autres
Publié: (2026)
par: Matsutani, Kohsei, et autres
Publié: (2026)
A Comprehensive Survey on Physical Risk Control in the Era of Foundation Model-enabled Robotics
par: Kojima, Takeshi, et autres
Publié: (2025)
par: Kojima, Takeshi, et autres
Publié: (2025)
Documents similaires
-
Answerability Fields: Answerable Location Estimation via Diffusion Models
par: Azuma, Daichi, et autres
Publié: (2024) -
Map-based Modular Approach for Zero-shot Embodied Question Answering
par: Sakamoto, Koya, et autres
Publié: (2024) -
Cross3DVG: Cross-Dataset 3D Visual Grounding on Different RGB-D Scans
par: Miyanishi, Taiki, et autres
Publié: (2023) -
CityNav: A Large-Scale Dataset for Real-World Aerial Navigation
par: Lee, Jungdae, et autres
Publié: (2024) -
GeoProg3D: Compositional Visual Reasoning for City-Scale 3D Language Fields
par: Yasuki, Shunsuke, et autres
Publié: (2025)