Enregistré dans:
| Auteurs principaux: | Pantazopoulos, Georgios, Nikandrou, Malvina, Konstas, Ioannis, Suglia, Alessandro |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2603.02874 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Enhancing Continual Learning in Visual Question Answering with Modality-Aware Feature Distillation
par: Nikandrou, Malvina, et autres
Publié: (2024)
par: Nikandrou, Malvina, et autres
Publié: (2024)
Shaking Up VLMs: Comparing Transformers and Structured State Space Models for Vision & Language Modeling
par: Pantazopoulos, Georgios, et autres
Publié: (2024)
par: Pantazopoulos, Georgios, et autres
Publié: (2024)
CROPE: Evaluating In-Context Adaptation of Vision and Language Models to Culture-Specific Concepts
par: Nikandrou, Malvina, et autres
Publié: (2024)
par: Nikandrou, Malvina, et autres
Publié: (2024)
Learning To See But Forgetting To Follow: Visual Instruction Tuning Makes LLMs More Prone To Jailbreak Attacks
par: Pantazopoulos, Georgios, et autres
Publié: (2024)
par: Pantazopoulos, Georgios, et autres
Publié: (2024)
Lost in Space: Probing Fine-grained Spatial Understanding in Vision and Language Resamplers
par: Pantazopoulos, Georgios, et autres
Publié: (2024)
par: Pantazopoulos, Georgios, et autres
Publié: (2024)
Investigating the Role of Instruction Variety and Task Difficulty in Robotic Manipulation Tasks
par: Parekh, Amit, et autres
Publié: (2024)
par: Parekh, Amit, et autres
Publié: (2024)
Task Formulation Matters When Learning Continually: A Case Study in Visual Question Answering
par: Nikandrou, Mavina, et autres
Publié: (2022)
par: Nikandrou, Mavina, et autres
Publié: (2022)
Evaluating Multimodal Language Models as Visual Assistants for Visually Impaired Users
par: Karamolegkou, Antonia, et autres
Publié: (2025)
par: Karamolegkou, Antonia, et autres
Publié: (2025)
AlanaVLM: A Multimodal Embodied AI Foundation Model for Egocentric Video Understanding
par: Suglia, Alessandro, et autres
Publié: (2024)
par: Suglia, Alessandro, et autres
Publié: (2024)
When Chain-of-Thought Fails, the Solution Hides in the Hidden States
par: Mehrafarin, Houman, et autres
Publié: (2026)
par: Mehrafarin, Houman, et autres
Publié: (2026)
AgriPath: A Systematic Exploration of Architectural Trade-offs for Crop Disease Classification
par: Mooraj, Hamza, et autres
Publié: (2026)
par: Mooraj, Hamza, et autres
Publié: (2026)
An Efficient Training Pipeline for Reasoning Graphical User Interface Agents
par: Pantazopoulos, Georgios, et autres
Publié: (2025)
par: Pantazopoulos, Georgios, et autres
Publié: (2025)
Towards Understanding Visual Grounding in Visual Language Models
par: Pantazopoulos, Georgios, et autres
Publié: (2025)
par: Pantazopoulos, Georgios, et autres
Publié: (2025)
VoyagerVision: Investigating the Role of Multi-modal Information for Open-ended Learning Systems
par: Smyth, Ethan, et autres
Publié: (2025)
par: Smyth, Ethan, et autres
Publié: (2025)
VLM-RobustBench: A Comprehensive Benchmark for Robustness of Vision-Language Models
par: Saxena, Rohit, et autres
Publié: (2026)
par: Saxena, Rohit, et autres
Publié: (2026)
FOSSIL: Harnessing Feedback on Suboptimal Samples for Data-Efficient Generalisation with Imitation Learning for Embodied Vision-and-Language Tasks
par: McCallum, Sabrina, et autres
Publié: (2025)
par: McCallum, Sabrina, et autres
Publié: (2025)
Understanding In-Context Learning Beyond Transformers: An Investigation of State Space and Hybrid Architectures
par: Wang, Shenran, et autres
Publié: (2025)
par: Wang, Shenran, et autres
Publié: (2025)
Frontier Models are Capable of In-context Scheming
par: Meinke, Alexander, et autres
Publié: (2024)
par: Meinke, Alexander, et autres
Publié: (2024)
Priming: Hybrid State Space Models From Pre-trained Transformers
par: Chattopadhyay, Aditya, et autres
Publié: (2026)
par: Chattopadhyay, Aditya, et autres
Publié: (2026)
TACLer: Tailored Curriculum Reinforcement Learning for Efficient Reasoning
par: Lai, Huiyuan, et autres
Publié: (2026)
par: Lai, Huiyuan, et autres
Publié: (2026)
Beyond Semantics: How Temporal Biases Shape Retrieval in Transformer and State-Space Models
par: Bajaj, Anooshka, et autres
Publié: (2025)
par: Bajaj, Anooshka, et autres
Publié: (2025)
Retrieval-Augmented Decision Transformer: External Memory for In-context RL
par: Schmied, Thomas, et autres
Publié: (2024)
par: Schmied, Thomas, et autres
Publié: (2024)
RoboSSM: Scalable In-context Imitation Learning via State-Space Models
par: Yoo, Youngju, et autres
Publié: (2025)
par: Yoo, Youngju, et autres
Publié: (2025)
Algorithmic Administration and the EU AI Act: Legal Principles for Public Sector Use of AI
par: Pavlidis, Georgios, et autres
Publié: (2026)
par: Pavlidis, Georgios, et autres
Publié: (2026)
Motor Imagery Decoding Using Ensemble Curriculum Learning and Collaborative Training
par: Zoumpourlis, Georgios, et autres
Publié: (2022)
par: Zoumpourlis, Georgios, et autres
Publié: (2022)
Multi-property Steering of Large Language Models with Dynamic Activation Composition
par: Scalena, Daniel, et autres
Publié: (2024)
par: Scalena, Daniel, et autres
Publié: (2024)
HyMem: Hybrid Memory Architecture with Dynamic Retrieval Scheduling
par: Zhao, Xiaochen, et autres
Publié: (2026)
par: Zhao, Xiaochen, et autres
Publié: (2026)
TransXSSM: A Hybrid Transformer State Space Model with Unified Rotary Position Embedding
par: Wu, Bingheng, et autres
Publié: (2025)
par: Wu, Bingheng, et autres
Publié: (2025)
SegMaFormer: A Hybrid State-Space and Transformer Model for Efficient Segmentation
par: Nguyen, Duy D., et autres
Publié: (2026)
par: Nguyen, Duy D., et autres
Publié: (2026)
Non Verbis, Sed Rebus: Large Language Models are Weak Solvers of Italian Rebuses
par: Sarti, Gabriele, et autres
Publié: (2024)
par: Sarti, Gabriele, et autres
Publié: (2024)
Pickup & Delivery with Time Windows and Transfers: combining decomposition with metaheuristics
par: Avgerinos, Ioannis, et autres
Publié: (2025)
par: Avgerinos, Ioannis, et autres
Publié: (2025)
Practising responsibility: Ethics in NLP as a hands-on course
par: Nissim, Malvina, et autres
Publié: (2025)
par: Nissim, Malvina, et autres
Publié: (2025)
White-Basilisk: A Hybrid Model for Code Vulnerability Detection
par: Lamprou, Ioannis, et autres
Publié: (2025)
par: Lamprou, Ioannis, et autres
Publié: (2025)
Retrieval-Aware Distillation for Transformer-SSM Hybrids
par: Bick, Aviv, et autres
Publié: (2026)
par: Bick, Aviv, et autres
Publié: (2026)
A Reference Architecture for Agentic Hybrid Retrieval in Dataset Search
par: Terrenzi, Riccardo, et autres
Publié: (2026)
par: Terrenzi, Riccardo, et autres
Publié: (2026)
State Space Models for Bioacoustics: A Comparative Evaluation with Transformers
par: Tang, Chengyu, et autres
Publié: (2025)
par: Tang, Chengyu, et autres
Publié: (2025)
STree: Speculative Tree Decoding for Hybrid State-Space Models
par: Wu, Yangchao, et autres
Publié: (2025)
par: Wu, Yangchao, et autres
Publié: (2025)
Monte-Carlo Tree Search with Neural Network Guidance for Lane-Free Autonomous Driving
par: Peridis, Ioannis, et autres
Publié: (2026)
par: Peridis, Ioannis, et autres
Publié: (2026)
Neural Architecture Retrieval
par: Pei, Xiaohuan, et autres
Publié: (2023)
par: Pei, Xiaohuan, et autres
Publié: (2023)
Eliciting In-context Retrieval and Reasoning for Long-context Large Language Models
par: Qiu, Yifu, et autres
Publié: (2025)
par: Qiu, Yifu, et autres
Publié: (2025)
Documents similaires
-
Enhancing Continual Learning in Visual Question Answering with Modality-Aware Feature Distillation
par: Nikandrou, Malvina, et autres
Publié: (2024) -
Shaking Up VLMs: Comparing Transformers and Structured State Space Models for Vision & Language Modeling
par: Pantazopoulos, Georgios, et autres
Publié: (2024) -
CROPE: Evaluating In-Context Adaptation of Vision and Language Models to Culture-Specific Concepts
par: Nikandrou, Malvina, et autres
Publié: (2024) -
Learning To See But Forgetting To Follow: Visual Instruction Tuning Makes LLMs More Prone To Jailbreak Attacks
par: Pantazopoulos, Georgios, et autres
Publié: (2024) -
Lost in Space: Probing Fine-grained Spatial Understanding in Vision and Language Resamplers
par: Pantazopoulos, Georgios, et autres
Publié: (2024)