EgoGroups: A Benchmark For Detecting Social Groups of People in the Wild
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Murrugarra-Llerena, Jeffri, Chitale, Pranav, Liu, Zicheng, Ao, Kai, Ham, Yujin, Balakrishnan, Guha, Cascante-Bonilla, Paola |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DRAGON: Drone and Ground Gaussian Splatting for 3D Building Reconstruction
par: Ham, Yujin, et autres
Publié: (2024)
par: Ham, Yujin, et autres
Publié: (2024)
Beyond Blanket Masking: Examining Granularity for Privacy Protection in Images Captured by Blind and Low Vision Users
par: Murrugarra-LLerena, Jeffri, et autres
Publié: (2025)
par: Murrugarra-LLerena, Jeffri, et autres
Publié: (2025)
Generating Humanless Environment Walkthroughs from Egocentric Walking Tour Videos
par: Ham, Yujin, et autres
Publié: (2026)
par: Ham, Yujin, et autres
Publié: (2026)
GauCho: Gaussian Distributions with Cholesky Decomposition for Oriented Object Detection
par: Murrugarra-LLerena, Jeffri, et autres
Publié: (2025)
par: Murrugarra-LLerena, Jeffri, et autres
Publié: (2025)
SceneCritic: A Symbolic Evaluator for 3D Indoor Scene Synthesis
par: Sengupta, Kathakoli, et autres
Publié: (2026)
par: Sengupta, Kathakoli, et autres
Publié: (2026)
3D Scene Geometry Estimation from 360$^\circ$ Imagery: A Survey
par: da Silveira, Thiago Lopes Trugillo, et autres
Publié: (2024)
par: da Silveira, Thiago Lopes Trugillo, et autres
Publié: (2024)
Gaussian Bounding Boxes and Probabilistic Intersection-over-Union for Object Detection
par: Llerena, Jeffri M., et autres
Publié: (2021)
par: Llerena, Jeffri M., et autres
Publié: (2021)
TeleEgo: Benchmarking Egocentric AI Assistants in the Wild
par: Yan, Jiaqi, et autres
Publié: (2025)
par: Yan, Jiaqi, et autres
Publié: (2025)
Do VLMs Need Vision Transformers? Evaluating State Space Models as Vision Encoders
par: Kuo, Shang-Jui Ray, et autres
Publié: (2026)
par: Kuo, Shang-Jui Ray, et autres
Publié: (2026)
Fit Pixels, Get Labels: Meta-learned Implicit Networks for Image Segmentation
par: Vyas, Kushal, et autres
Publié: (2025)
par: Vyas, Kushal, et autres
Publié: (2025)
EgoCast: Forecasting Egocentric Human Pose in the Wild
par: Escobar, Maria, et autres
Publié: (2024)
par: Escobar, Maria, et autres
Publié: (2024)
Instance-Aware Group Quantization for Vision Transformers
par: Moon, Jaehyeon, et autres
Publié: (2024)
par: Moon, Jaehyeon, et autres
Publié: (2024)
PropTest: Automatic Property Testing for Improved Visual Programming
par: Koo, Jaywon, et autres
Publié: (2024)
par: Koo, Jaywon, et autres
Publié: (2024)
ElasticDiffusion: Training-free Arbitrary Size Image Generation through Global-Local Content Separation
par: Haji-Ali, Moayed, et autres
Publié: (2023)
par: Haji-Ali, Moayed, et autres
Publié: (2023)
Group-DINOmics: Incorporating People Dynamics into DINO for Self-supervised Group Activity Feature Learning
par: Tezuka, Ryuki, et autres
Publié: (2026)
par: Tezuka, Ryuki, et autres
Publié: (2026)
Towards Activated Muscle Group Estimation in the Wild
par: Peng, Kunyu, et autres
Publié: (2023)
par: Peng, Kunyu, et autres
Publié: (2023)
EgoNormia: Benchmarking Physical Social Norm Understanding
par: Rezaei, MohammadHossein, et autres
Publié: (2025)
par: Rezaei, MohammadHossein, et autres
Publié: (2025)
Social EgoMesh Estimation
par: Scofano, Luca, et autres
Publié: (2024)
par: Scofano, Luca, et autres
Publié: (2024)
EgoSocial: Benchmarking Proactive Intervention Ability of Omnimodal LLMs via Egocentric Social Interaction Perception
par: Wang, Xijun, et autres
Publié: (2025)
par: Wang, Xijun, et autres
Publié: (2025)
Towards More Practical Group Activity Detection: A New Benchmark and Model
par: Kim, Dongkeun, et autres
Publié: (2023)
par: Kim, Dongkeun, et autres
Publié: (2023)
Dynamic Group Detection using VLM-augmented Temporal Groupness Graph
par: Yokoyama, Kaname, et autres
Publié: (2025)
par: Yokoyama, Kaname, et autres
Publié: (2025)
EgoSpeak: Learning When to Speak for Egocentric Conversational Agents in the Wild
par: Kim, Junhyeok, et autres
Publié: (2025)
par: Kim, Junhyeok, et autres
Publié: (2025)
Bias for Action: Video Implicit Neural Representations with Bias Modulation
par: Kayabasi, Alper, et autres
Publié: (2025)
par: Kayabasi, Alper, et autres
Publié: (2025)
Fluoroscopic Shape and Pose Tracking of Catheters with Custom Radiopaque Markers
par: Lawson, Jared, et autres
Publié: (2025)
par: Lawson, Jared, et autres
Publié: (2025)
Ego-Exo 3D Hand Tracking in the Wild with a Mobile Multi-Camera Rig
par: Rim, Patrick, et autres
Publié: (2025)
par: Rim, Patrick, et autres
Publié: (2025)
EgoSound: Benchmarking Sound Understanding in Egocentric Videos
par: Zhu, Bingwen, et autres
Publié: (2026)
par: Zhu, Bingwen, et autres
Publié: (2026)
Natural Language Inference Improves Compositionality in Vision-Language Models
par: Cascante-Bonilla, Paola, et autres
Publié: (2024)
par: Cascante-Bonilla, Paola, et autres
Publié: (2024)
Grounding Language Models for Visual Entity Recognition
par: Xiao, Zilin, et autres
Publié: (2024)
par: Xiao, Zilin, et autres
Publié: (2024)
Pixels or Positions? Benchmarking Modalities in Group Activity Recognition
par: Karki, Drishya, et autres
Publié: (2025)
par: Karki, Drishya, et autres
Publié: (2025)
Part-Aware Bottom-Up Group Reasoning for Fine-Grained Social Interaction Detection
par: Kim, Dongkeun, et autres
Publié: (2025)
par: Kim, Dongkeun, et autres
Publié: (2025)
Learning from Synthetic Data for Visual Grounding
par: He, Ruozhen, et autres
Publié: (2024)
par: He, Ruozhen, et autres
Publié: (2024)
Can Hallucination Correction Improve Video-Language Alignment?
par: Zhao, Lingjun, et autres
Publié: (2025)
par: Zhao, Lingjun, et autres
Publié: (2025)
GeoViSTA: Geospatial Vision-Tabular Transformer for Multimodal Environment Representation
par: Liu, Yuhao, et autres
Publié: (2026)
par: Liu, Yuhao, et autres
Publié: (2026)
SplineCam: Exact Visualization and Characterization of Deep Network Geometry and Decision Boundaries
par: Humayun, Ahmed Imtiaz, et autres
Publié: (2023)
par: Humayun, Ahmed Imtiaz, et autres
Publié: (2023)
Intention-driven Ego-to-Exo Video Generation
par: Luo, Hongchen, et autres
Publié: (2024)
par: Luo, Hongchen, et autres
Publié: (2024)
Post-Hurricane Debris Segmentation Using Fine-Tuned Foundational Vision Models
par: Amini, Kooshan, et autres
Publié: (2025)
par: Amini, Kooshan, et autres
Publié: (2025)
Group3D: MLLM-Driven Semantic Grouping for Open-Vocabulary 3D Object Detection
par: Kim, Youbin, et autres
Publié: (2026)
par: Kim, Youbin, et autres
Publié: (2026)
CAMotion: A High-Quality Benchmark for Camouflaged Moving Object Detection in the Wild
par: Yao, Siyuan, et autres
Publié: (2026)
par: Yao, Siyuan, et autres
Publié: (2026)
COMPASS: Robust Feature Conformal Prediction for Medical Segmentation Metrics
par: Cheung, Matt Y., et autres
Publié: (2025)
par: Cheung, Matt Y., et autres
Publié: (2025)
EgoCVR: An Egocentric Benchmark for Fine-Grained Composed Video Retrieval
par: Hummel, Thomas, et autres
Publié: (2024)
par: Hummel, Thomas, et autres
Publié: (2024)
Documents similaires
-
DRAGON: Drone and Ground Gaussian Splatting for 3D Building Reconstruction
par: Ham, Yujin, et autres
Publié: (2024) -
Beyond Blanket Masking: Examining Granularity for Privacy Protection in Images Captured by Blind and Low Vision Users
par: Murrugarra-LLerena, Jeffri, et autres
Publié: (2025) -
Generating Humanless Environment Walkthroughs from Egocentric Walking Tour Videos
par: Ham, Yujin, et autres
Publié: (2026) -
GauCho: Gaussian Distributions with Cholesky Decomposition for Oriented Object Detection
par: Murrugarra-LLerena, Jeffri, et autres
Publié: (2025) -
SceneCritic: A Symbolic Evaluator for 3D Indoor Scene Synthesis
par: Sengupta, Kathakoli, et autres
Publié: (2026)