Do I look like a `cat.n.01` to you? A Taxonomy Image Generation Benchmark
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Moskvoretskii, Viktor, Lobanova, Alina, Neminova, Ekaterina, Biemann, Chris, Panchenko, Alexander, Nikishina, Irina |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TaxoLLaMA: WordNet-based Model for Solving Multiple Lexical Semantic Tasks
par: Moskvoretskii, Viktor, et autres
Publié: (2024)
par: Moskvoretskii, Viktor, et autres
Publié: (2024)
Self-Taught Self-Correction for Small Language Models
par: Moskvoretskii, Viktor, et autres
Publié: (2025)
par: Moskvoretskii, Viktor, et autres
Publié: (2025)
Low-Resource Machine Translation through the Lens of Personalized Federated Learning
par: Moskvoretskii, Viktor, et autres
Publié: (2024)
par: Moskvoretskii, Viktor, et autres
Publié: (2024)
Argument-Based Comparative Question Answering Evaluation Benchmark
par: Nikishina, Irina, et autres
Publié: (2025)
par: Nikishina, Irina, et autres
Publié: (2025)
Adaptive Retrieval Without Self-Knowledge? Bringing Uncertainty Back Home
par: Moskvoretskii, Viktor, et autres
Publié: (2025)
par: Moskvoretskii, Viktor, et autres
Publié: (2025)
Leveraging LLM Parametric Knowledge for Fact Checking without Retrieval
par: Vazhentsev, Artem, et autres
Publié: (2026)
par: Vazhentsev, Artem, et autres
Publié: (2026)
Creating a Taxonomy for Retrieval Augmented Generation Applications
par: Nikishina, Irina, et autres
Publié: (2024)
par: Nikishina, Irina, et autres
Publié: (2024)
Evolutionary Search for Automated Design of Uncertainty Quantification Methods
par: Seleznyov, Mikhail, et autres
Publié: (2026)
par: Seleznyov, Mikhail, et autres
Publié: (2026)
Will It Still Be True Tomorrow? Multilingual Evergreen Question Classification to Improve Trustworthy QA
par: Pletenev, Sergey, et autres
Publié: (2025)
par: Pletenev, Sergey, et autres
Publié: (2025)
Perspectives - Interactive Document Clustering in the Discourse Analysis Tool Suite
par: Fischer, Tim, et autres
Publié: (2026)
par: Fischer, Tim, et autres
Publié: (2026)
LLM-Independent Adaptive RAG: Let the Question Speak for Itself
par: Marina, Maria, et autres
Publié: (2025)
par: Marina, Maria, et autres
Publié: (2025)
GIMMICK -- Globally Inclusive Multimodal Multitask Cultural Knowledge Benchmarking
par: Schneider, Florian, et autres
Publié: (2025)
par: Schneider, Florian, et autres
Publié: (2025)
Dataset of Quotation Attribution in German News Articles
par: Petersen-Frey, Fynn, et autres
Publié: (2024)
par: Petersen-Frey, Fynn, et autres
Publié: (2024)
MVL-SIB: A Massively Multilingual Vision-Language Benchmark for Cross-Modal Topical Matching
par: Schmidt, Fabian David, et autres
Publié: (2025)
par: Schmidt, Fabian David, et autres
Publié: (2025)
SemEval-2026 Task 4: Narrative Story Similarity and Narrative Representation Learning
par: Hatzel, Hans Ole, et autres
Publié: (2026)
par: Hatzel, Hans Ole, et autres
Publié: (2026)
Evaluating Text Style Transfer: A Nine-Language Benchmark for Text Detoxification
par: Protasov, Vitaly, et autres
Publié: (2025)
par: Protasov, Vitaly, et autres
Publié: (2025)
MTabVQA: Evaluating Multi-Tabular Reasoning of Language Models in Visual Space
par: Singh, Anshul, et autres
Publié: (2025)
par: Singh, Anshul, et autres
Publié: (2025)
Mitigating Hallucinations in Large Vision-Language Models with Instruction Contrastive Decoding
par: Wang, Xintong, et autres
Publié: (2024)
par: Wang, Xintong, et autres
Publié: (2024)
Just Use XML: Revisiting Joint Translation and Label Projection
par: DK, Thennal, et autres
Publié: (2026)
par: DK, Thennal, et autres
Publié: (2026)
Probing Large Language Models from A Human Behavioral Perspective
par: Wang, Xintong, et autres
Publié: (2023)
par: Wang, Xintong, et autres
Publié: (2023)
Tracing Persona Vectors Through LLM Pretraining
par: Moskvoretskii, Viktor, et autres
Publié: (2026)
par: Moskvoretskii, Viktor, et autres
Publié: (2026)
Large Language Models Are Overparameterized Text Encoders
par: K, Thennal D, et autres
Publié: (2024)
par: K, Thennal D, et autres
Publié: (2024)
FASCIST-O-METER: Classifier for Neo-fascist Discourse Online
par: Veliz, Rudy Alexandro Garrido, et autres
Publié: (2025)
par: Veliz, Rudy Alexandro Garrido, et autres
Publié: (2025)
Demarked: A Strategy for Enhanced Abusive Speech Moderation through Counterspeech, Detoxification, and Message Management
par: Yimam, Seid Muhie, et autres
Publié: (2024)
par: Yimam, Seid Muhie, et autres
Publié: (2024)
Beyond Detection: Rethinking Education in the Age of AI-writing
par: Marina, Maria, et autres
Publié: (2026)
par: Marina, Maria, et autres
Publié: (2026)
Don't Fight Hallucinations, Use Them: Estimating Image Realism using NLI over Atomic Facts
par: Rykov, Elisei, et autres
Publié: (2025)
par: Rykov, Elisei, et autres
Publié: (2025)
Through the Looking Glass: Common Sense Consistency Evaluation of Weird Images
par: Rykov, Elisei, et autres
Publié: (2025)
par: Rykov, Elisei, et autres
Publié: (2025)
On Zero-Shot Counterspeech Generation by LLMs
par: Saha, Punyajoy, et autres
Publié: (2024)
par: Saha, Punyajoy, et autres
Publié: (2024)
EncouRAGe: Evaluating RAG Local, Fast, and Reliable
par: Strich, Jan, et autres
Publié: (2025)
par: Strich, Jan, et autres
Publié: (2025)
Comprehensive Comparison of RAG Methods Across Multi-Domain Conversational QA
par: Alushi, Klejda, et autres
Publié: (2026)
par: Alushi, Klejda, et autres
Publié: (2026)
Self-Calibrating Language Models via Test-Time Discriminative Distillation
par: Hedna, Mohamed Rissal, et autres
Publié: (2026)
par: Hedna, Mohamed Rissal, et autres
Publié: (2026)
Tell me who its founders are and I'll tell you what your online community looks like: Online community founders' personality and community attributes
par: Dover, Yaniv, et autres
Publié: (2025)
par: Dover, Yaniv, et autres
Publié: (2025)
MultiParaDetox: Extending Text Detoxification with Parallel Data to New Languages
par: Dementieva, Daryna, et autres
Publié: (2024)
par: Dementieva, Daryna, et autres
Publié: (2024)
<think> So let's replace this phrase with insult... </think> Lessons learned from generation of toxic texts with LLMs
par: Pletenev, Sergey, et autres
Publié: (2025)
par: Pletenev, Sergey, et autres
Publié: (2025)
S3: A Simple Strong Sample-effective Multimodal Dialog System
par: Rykov, Elisei, et autres
Publié: (2024)
par: Rykov, Elisei, et autres
Publié: (2024)
LEMUR: A Corpus for Robust Fine-Tuning of Multilingual Law Embedding Models for Retrieval
par: Ahmadi, Narges Baba, et autres
Publié: (2026)
par: Ahmadi, Narges Baba, et autres
Publié: (2026)
HatePRISM: Policies, Platforms, and Research Integration. Advancing NLP for Hate Speech Proactive Mitigation
par: Rizwan, Naquee, et autres
Publié: (2025)
par: Rizwan, Naquee, et autres
Publié: (2025)
Overhearing LLM Agents: A Survey, Taxonomy, and Roadmap
par: Zhu, Andrew, et autres
Publié: (2025)
par: Zhu, Andrew, et autres
Publié: (2025)
Prompting Science Report 3: I'll pay you or I'll kill you -- but will you care?
par: Meincke, Lennart, et autres
Publié: (2025)
par: Meincke, Lennart, et autres
Publié: (2025)
Efficient estimation of the modified Gromov-Hausdorff distance between unweighted graphs
par: Oles, Vladyslav, et autres
Publié: (2019)
par: Oles, Vladyslav, et autres
Publié: (2019)
Documents similaires
-
TaxoLLaMA: WordNet-based Model for Solving Multiple Lexical Semantic Tasks
par: Moskvoretskii, Viktor, et autres
Publié: (2024) -
Self-Taught Self-Correction for Small Language Models
par: Moskvoretskii, Viktor, et autres
Publié: (2025) -
Low-Resource Machine Translation through the Lens of Personalized Federated Learning
par: Moskvoretskii, Viktor, et autres
Publié: (2024) -
Argument-Based Comparative Question Answering Evaluation Benchmark
par: Nikishina, Irina, et autres
Publié: (2025) -
Adaptive Retrieval Without Self-Knowledge? Bringing Uncertainty Back Home
par: Moskvoretskii, Viktor, et autres
Publié: (2025)