LISAT: Language-Instructed Segmentation Assistant for Satellite Imagery
Fuente:
arXiv
Salvato in:
| Autori principali: | Quenum, Jerome, Hsieh, Wen-Han, Wu, Tsung-Han, Gupta, Ritwik, Darrell, Trevor, Chan, David M. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Do What? Teaching Vision-Language-Action Models to Reject the Impossible
di: Hsieh, Wen-Han, et al.
Pubblicazione: (2025)
di: Hsieh, Wen-Han, et al.
Pubblicazione: (2025)
Visual Haystacks: A Vision-Centric Needle-In-A-Haystack Benchmark
di: Wu, Tsung-Han, et al.
Pubblicazione: (2024)
di: Wu, Tsung-Han, et al.
Pubblicazione: (2024)
REOrdering Patches Improves Vision Models
di: Kutscher, Declan, et al.
Pubblicazione: (2025)
di: Kutscher, Declan, et al.
Pubblicazione: (2025)
Puzzled by Puzzles: When Vision-Language Models Can't Take a Hint
di: Lee, Heekyung, et al.
Pubblicazione: (2025)
di: Lee, Heekyung, et al.
Pubblicazione: (2025)
Enough Coin Flips Can Make LLMs Act Bayesian
di: Gupta, Ritwik, et al.
Pubblicazione: (2025)
di: Gupta, Ritwik, et al.
Pubblicazione: (2025)
xT: Nested Tokenization for Larger Context in Large Images
di: Gupta, Ritwik, et al.
Pubblicazione: (2024)
di: Gupta, Ritwik, et al.
Pubblicazione: (2024)
LITA: Language Instructed Temporal-Localization Assistant
di: Huang, De-An, et al.
Pubblicazione: (2024)
di: Huang, De-An, et al.
Pubblicazione: (2024)
Seg the HAB: Language-Guided Geospatial Algae Bloom Reasoning and Segmentation
di: Hsieh, Patterson, et al.
Pubblicazione: (2025)
di: Hsieh, Patterson, et al.
Pubblicazione: (2025)
Data-Centric AI Governance: Addressing the Limitations of Model-Focused Policies
di: Gupta, Ritwik, et al.
Pubblicazione: (2024)
di: Gupta, Ritwik, et al.
Pubblicazione: (2024)
UnSAMv2: Self-Supervised Learning Enables Segment Anything at Any Granularity
di: Yu, Junwei, et al.
Pubblicazione: (2025)
di: Yu, Junwei, et al.
Pubblicazione: (2025)
CLAIR-A: Leveraging Large Language Models to Judge Audio Captions
di: Wu, Tsung-Han, et al.
Pubblicazione: (2024)
di: Wu, Tsung-Han, et al.
Pubblicazione: (2024)
Analyzing The Language of Visual Tokens
di: Chan, David M., et al.
Pubblicazione: (2024)
di: Chan, David M., et al.
Pubblicazione: (2024)
Optimizing TD3 for 7-DOF Robotic Arm Grasping: Overcoming Suboptimality with Exploration-Enhanced Contrastive Learning
di: Hsieh, Wen-Han, et al.
Pubblicazione: (2024)
di: Hsieh, Wen-Han, et al.
Pubblicazione: (2024)
Position Prediction Self-Supervised Learning for Multimodal Satellite Imagery Semantic Segmentation
di: Waithaka, John, et al.
Pubblicazione: (2025)
di: Waithaka, John, et al.
Pubblicazione: (2025)
Readable Minds: Emergent Theory-of-Mind-Like Behavior in LLM Poker Agents
di: Lin, Hsieh-Ting, et al.
Pubblicazione: (2026)
di: Lin, Hsieh-Ting, et al.
Pubblicazione: (2026)
SatBLIP: Context Understanding and Feature Identification from Satellite Imagery with Vision-Language Learning
di: Wu, Xue, et al.
Pubblicazione: (2026)
di: Wu, Xue, et al.
Pubblicazione: (2026)
VisLingInstruct: Elevating Zero-Shot Learning in Multi-Modal Language Models with Autonomous Instruction Optimization
di: Zhu, Dongsheng, et al.
Pubblicazione: (2024)
di: Zhu, Dongsheng, et al.
Pubblicazione: (2024)
VibeCheck: Discover and Quantify Qualitative Differences in Large Language Models
di: Dunlap, Lisa, et al.
Pubblicazione: (2024)
di: Dunlap, Lisa, et al.
Pubblicazione: (2024)
InstructFLIP: Exploring Unified Vision-Language Model for Face Anti-spoofing
di: Lin, Kun-Hsiang, et al.
Pubblicazione: (2025)
di: Lin, Kun-Hsiang, et al.
Pubblicazione: (2025)
One Token to Seg Them All: Language Instructed Reasoning Segmentation in Videos
di: Bai, Zechen, et al.
Pubblicazione: (2024)
di: Bai, Zechen, et al.
Pubblicazione: (2024)
Multimodal Chip Physical Design Engineer Assistant
di: Tsai, Yun-Da, et al.
Pubblicazione: (2025)
di: Tsai, Yun-Da, et al.
Pubblicazione: (2025)
Segment Anything for Satellite Imagery: A Strong Baseline and a Regional Dataset for Automatic Field Delineation
di: Scribano, Carmelo, et al.
Pubblicazione: (2025)
di: Scribano, Carmelo, et al.
Pubblicazione: (2025)
InstructMol: Multi-Modal Integration for Building a Versatile and Reliable Molecular Assistant in Drug Discovery
di: Cao, He, et al.
Pubblicazione: (2023)
di: Cao, He, et al.
Pubblicazione: (2023)
Navigating the Labyrinth: Evaluating LLMs' Ability to Reason About Search Problems
di: Borazjanizadeh, Nasim, et al.
Pubblicazione: (2024)
di: Borazjanizadeh, Nasim, et al.
Pubblicazione: (2024)
Whack-a-Chip: The Futility of Hardware-Centric Export Controls
di: Gupta, Ritwik, et al.
Pubblicazione: (2024)
di: Gupta, Ritwik, et al.
Pubblicazione: (2024)
Artificial Intelligence in Traffic Systems
di: Saxena, Ritwik Raj
Pubblicazione: (2024)
di: Saxena, Ritwik Raj
Pubblicazione: (2024)
IGraSS: Learning to Identify Infrastructure Networks from Satellite Imagery by Iterative Graph-constrained Semantic Segmentation
di: Hoque, Oishee Bintey, et al.
Pubblicazione: (2025)
di: Hoque, Oishee Bintey, et al.
Pubblicazione: (2025)
Bootstrapping Rare Object Detection in High-Resolution Satellite Imagery
di: Zaytar, Akram, et al.
Pubblicazione: (2024)
di: Zaytar, Akram, et al.
Pubblicazione: (2024)
3D-Layout-R1: Structured Reasoning for Language-Instructed Spatial Editing
di: Zhen, Haoyu, et al.
Pubblicazione: (2026)
di: Zhen, Haoyu, et al.
Pubblicazione: (2026)
Hyperbolic Active Learning for Semantic Segmentation under Domain Shift
di: Franco, Luca, et al.
Pubblicazione: (2023)
di: Franco, Luca, et al.
Pubblicazione: (2023)
InsTraj: Instructing Diffusion Models with Travel Intentions to Generate Real-world Trajectories
di: Zhu, Yuanshao, et al.
Pubblicazione: (2026)
di: Zhu, Yuanshao, et al.
Pubblicazione: (2026)
UniAPL: A Unified Adversarial Preference Learning Framework for Instruct-Following
di: Qian, FaQiang, et al.
Pubblicazione: (2025)
di: Qian, FaQiang, et al.
Pubblicazione: (2025)
DiffusionSat: A Generative Foundation Model for Satellite Imagery
di: Khanna, Samar, et al.
Pubblicazione: (2023)
di: Khanna, Samar, et al.
Pubblicazione: (2023)
BackSlash: Rate Constrained Optimized Training of Large Language Models
di: Wu, Jun, et al.
Pubblicazione: (2025)
di: Wu, Jun, et al.
Pubblicazione: (2025)
SegLLM: Multi-round Reasoning Segmentation
di: Wang, XuDong, et al.
Pubblicazione: (2024)
di: Wang, XuDong, et al.
Pubblicazione: (2024)
Deep Learning for Pavement Condition Evaluation Using Satellite Imagery
di: Lebaku, Prathyush Kumar Reddy, et al.
Pubblicazione: (2025)
di: Lebaku, Prathyush Kumar Reddy, et al.
Pubblicazione: (2025)
SatSwinMAE: Efficient Autoencoding for Multiscale Time-series Satellite Imagery
di: Nakayama, Yohei, et al.
Pubblicazione: (2024)
di: Nakayama, Yohei, et al.
Pubblicazione: (2024)
PartInstruct: Part-level Instruction Following for Fine-grained Robot Manipulation
di: Yin, Yifan, et al.
Pubblicazione: (2025)
di: Yin, Yifan, et al.
Pubblicazione: (2025)
How to Instruct Your Robot: Dense Language Annotations Power Robot Policy Learning
di: Kim, Bosung, et al.
Pubblicazione: (2026)
di: Kim, Bosung, et al.
Pubblicazione: (2026)
Vocabulary-Free 3D Instance Segmentation with Vision and Language Assistant
di: Mei, Guofeng, et al.
Pubblicazione: (2024)
di: Mei, Guofeng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Do What? Teaching Vision-Language-Action Models to Reject the Impossible
di: Hsieh, Wen-Han, et al.
Pubblicazione: (2025) -
Visual Haystacks: A Vision-Centric Needle-In-A-Haystack Benchmark
di: Wu, Tsung-Han, et al.
Pubblicazione: (2024) -
REOrdering Patches Improves Vision Models
di: Kutscher, Declan, et al.
Pubblicazione: (2025) -
Puzzled by Puzzles: When Vision-Language Models Can't Take a Hint
di: Lee, Heekyung, et al.
Pubblicazione: (2025) -
Enough Coin Flips Can Make LLMs Act Bayesian
di: Gupta, Ritwik, et al.
Pubblicazione: (2025)