Masked Generative Story Transformer with Character Guidance and Caption Augmentation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Papadimitriou, Christos, Filandrianos, Giorgos, Lymperaiou, Maria, Stamou, Giorgos |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Counterfactual Edits for Generative Evaluation
par: Lymperaiou, Maria, et autres
Publié: (2023)
par: Lymperaiou, Maria, et autres
Publié: (2023)
HalCECE: A Framework for Explainable Hallucination Detection through Conceptual Counterfactuals in Image Captioning
par: Lymperaiou, Maria, et autres
Publié: (2025)
par: Lymperaiou, Maria, et autres
Publié: (2025)
Structure Your Data: Towards Semantic Graph Counterfactuals
par: Dimitriou, Angeliki, et autres
Publié: (2024)
par: Dimitriou, Angeliki, et autres
Publié: (2024)
U-CECE: A Universal Multi-Resolution Framework for Conceptual Counterfactual Explanations
par: Dimitriou, Angeliki, et autres
Publié: (2026)
par: Dimitriou, Angeliki, et autres
Publié: (2026)
The Contribution of Knowledge in Visiolinguistic Learning: A Survey on Tasks and Challenges
par: Lymperaiou, Maria, et autres
Publié: (2023)
par: Lymperaiou, Maria, et autres
Publié: (2023)
V-CECE: Visual Counterfactual Explanations via Conceptual Edits
par: Spanos, Nikolaos, et autres
Publié: (2025)
par: Spanos, Nikolaos, et autres
Publié: (2025)
Fine-Grained ImageNet Classification in the Wild
par: Lymperaiou, Maria, et autres
Publié: (2023)
par: Lymperaiou, Maria, et autres
Publié: (2023)
Automatic Generation of Fashion Images using Prompting in Generative Machine Learning Models
par: Argyrou, Georgia, et autres
Publié: (2024)
par: Argyrou, Georgia, et autres
Publié: (2024)
Prompt2Fashion: An automatically generated fashion dataset
par: Argyrou, Georgia, et autres
Publié: (2024)
par: Argyrou, Georgia, et autres
Publié: (2024)
AILS-NTUA at SemEval-2024 Task 9: Cracking Brain Teasers: Transformer Models for Lateral Thinking Puzzles
par: Panagiotopoulos, Ioannis, et autres
Publié: (2024)
par: Panagiotopoulos, Ioannis, et autres
Publié: (2024)
Puzzle Solving using Reasoning of Large Language Models: A Survey
par: Giadikiaroglou, Panagiotis, et autres
Publié: (2024)
par: Giadikiaroglou, Panagiotis, et autres
Publié: (2024)
ARPA: A Novel Hybrid Model for Advancing Visual Word Disambiguation Using Large Language Models and Transformers
par: Papastavrou, Aristi, et autres
Publié: (2024)
par: Papastavrou, Aristi, et autres
Publié: (2024)
Deep Ensemble Art Style Recognition
par: Menis-Mastromichalakis, Orfeas, et autres
Publié: (2024)
par: Menis-Mastromichalakis, Orfeas, et autres
Publié: (2024)
Conceptual Contrastive Edits in Textual and Vision-Language Retrieval
par: Lymperaiou, Maria, et autres
Publié: (2025)
par: Lymperaiou, Maria, et autres
Publié: (2025)
SCENIR: Visual Semantic Clarity through Unsupervised Scene Graph Retrieval
par: Chaidos, Nikolaos, et autres
Publié: (2025)
par: Chaidos, Nikolaos, et autres
Publié: (2025)
BERTtime Stories: Investigating the Role of Synthetic Story Data in Language Pre-training
par: Theodoropoulos, Nikitas, et autres
Publié: (2024)
par: Theodoropoulos, Nikitas, et autres
Publié: (2024)
RISCORE: Enhancing In-Context Riddle Solving in Language Models through Context-Reconstructed Example Augmentation
par: Panagiotopoulos, Ioannis, et autres
Publié: (2024)
par: Panagiotopoulos, Ioannis, et autres
Publié: (2024)
A survey on knowledge-enhanced multimodal learning
par: Lymperaiou, Maria, et autres
Publié: (2022)
par: Lymperaiou, Maria, et autres
Publié: (2022)
Language Models as Knowledge Bases for Visual Word Sense Disambiguation
par: Kritharoula, Anastasia, et autres
Publié: (2023)
par: Kritharoula, Anastasia, et autres
Publié: (2023)
Reasoning or Pattern Matching? Probing Large Vision-Language Models with Visual Puzzles
par: Lymperaiou, Maria, et autres
Publié: (2026)
par: Lymperaiou, Maria, et autres
Publié: (2026)
Fusion Transformer with Object Mask Guidance for Image Forgery Analysis
par: Karageorgiou, Dimitrios, et autres
Publié: (2024)
par: Karageorgiou, Dimitrios, et autres
Publié: (2024)
ATLAS: Adaptive Trading with LLM AgentS Through Dynamic Prompt Optimization and Multi-Agent Coordination
par: Papadakis, Charidimos, et autres
Publié: (2025)
par: Papadakis, Charidimos, et autres
Publié: (2025)
Enhancing adversarial robustness in Natural Language Inference using explanations
par: Koulakos, Alexandros, et autres
Publié: (2024)
par: Koulakos, Alexandros, et autres
Publié: (2024)
AILS-NTUA at SemEval-2024 Task 6: Efficient model tuning for hallucination detection and analysis
par: Grigoriadou, Natalia, et autres
Publié: (2024)
par: Grigoriadou, Natalia, et autres
Publié: (2024)
Optimal and efficient text counterfactuals using Graph Neural Networks
par: Lymperopoulos, Dimitris, et autres
Publié: (2024)
par: Lymperopoulos, Dimitris, et autres
Publié: (2024)
PAKTON: A Multi-Agent Framework for Question Answering in Long Legal Agreements
par: Raptopoulos, Petros, et autres
Publié: (2025)
par: Raptopoulos, Petros, et autres
Publié: (2025)
Three Things to Know about Deep Metric Learning
par: Patel, Yash, et autres
Publié: (2024)
par: Patel, Yash, et autres
Publié: (2024)
SAIL: Similarity-Aware Guidance and Inter-Caption Augmentation-based Learning for Weakly-Supervised Dense Video Captioning
par: Kim, Ye-Chan, et autres
Publié: (2026)
par: Kim, Ye-Chan, et autres
Publié: (2026)
HighFM: Towards a Foundation Model for Learning Representations from High-Frequency Earth Observation Data
par: Girtsou, Stella, et autres
Publié: (2026)
par: Girtsou, Stella, et autres
Publié: (2026)
OneActor: Consistent Character Generation via Cluster-Conditioned Guidance
par: Wang, Jiahao, et autres
Publié: (2024)
par: Wang, Jiahao, et autres
Publié: (2024)
Designing Practical Models for Isolated Word Visual Speech Recognition
par: Panagos, Iason Ioannis, et autres
Publié: (2025)
par: Panagos, Iason Ioannis, et autres
Publié: (2025)
UNCAGE: Contrastive Attention Guidance for Masked Generative Transformers in Text-to-Image Generation
par: Kang, Wonjun, et autres
Publié: (2025)
par: Kang, Wonjun, et autres
Publié: (2025)
Retrieval-Augmented Anatomical Guidance for Text-to-CT Generation
par: Molino, Daniele, et autres
Publié: (2026)
par: Molino, Daniele, et autres
Publié: (2026)
"I Never Said That": A dataset, taxonomy and baselines on response clarity classification
par: Thomas, Konstantinos, et autres
Publié: (2024)
par: Thomas, Konstantinos, et autres
Publié: (2024)
Bias Beware: The Impact of Cognitive Biases on LLM-Driven Product Recommendations
par: Filandrianos, Giorgos, et autres
Publié: (2025)
par: Filandrianos, Giorgos, et autres
Publié: (2025)
AILS-NTUA at SemEval-2026 Task 12: Graph-Based Retrieval and Reflective Prompting for Abductive Event Reasoning
par: Karafyllis, Nikolas, et autres
Publié: (2026)
par: Karafyllis, Nikolas, et autres
Publié: (2026)
Pitfalls of Scale: Investigating the Inverse Task of Redefinition in Large Language Models
par: Stringli, Elena, et autres
Publié: (2025)
par: Stringli, Elena, et autres
Publié: (2025)
AILS-NTUA at SemEval-2026 Task 8: Evaluating Multi-Turn RAG Conversations
par: Athanasiou, Dimosthenis, et autres
Publié: (2026)
par: Athanasiou, Dimosthenis, et autres
Publié: (2026)
AILS-NTUA at SemEval-2025 Task 8: Language-to-Code prompting and Error Fixing for Tabular Question Answering
par: Evangelatos, Andreas, et autres
Publié: (2025)
par: Evangelatos, Andreas, et autres
Publié: (2025)
SemEval-2026 Task 6: CLARITY -- Unmasking Political Question Evasions
par: Thomas, Konstantinos, et autres
Publié: (2026)
par: Thomas, Konstantinos, et autres
Publié: (2026)
Documents similaires
-
Counterfactual Edits for Generative Evaluation
par: Lymperaiou, Maria, et autres
Publié: (2023) -
HalCECE: A Framework for Explainable Hallucination Detection through Conceptual Counterfactuals in Image Captioning
par: Lymperaiou, Maria, et autres
Publié: (2025) -
Structure Your Data: Towards Semantic Graph Counterfactuals
par: Dimitriou, Angeliki, et autres
Publié: (2024) -
U-CECE: A Universal Multi-Resolution Framework for Conceptual Counterfactual Explanations
par: Dimitriou, Angeliki, et autres
Publié: (2026) -
The Contribution of Knowledge in Visiolinguistic Learning: A Survey on Tasks and Challenges
par: Lymperaiou, Maria, et autres
Publié: (2023)