Exploring Adversarial Robustness in Classification tasks using DNA Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Yoo, Hyunwoo, Shin, Haebin, Xu, Kaidi, Rosen, Gail |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Predicting Microbial Ontology and Pathogen Risk from Environmental Metadata with Large Language Models
por: Yoo, Hyunwoo, et al.
Publicado: (2025)
por: Yoo, Hyunwoo, et al.
Publicado: (2025)
Predicting Anti-microbial Resistance using Large Language Models
por: Yoo, Hyunwoo, et al.
Publicado: (2024)
por: Yoo, Hyunwoo, et al.
Publicado: (2024)
Can Large Language Models Predict Antimicrobial Resistance Gene?
por: Yoo, Hyunwoo
Publicado: (2025)
por: Yoo, Hyunwoo
Publicado: (2025)
Overcoming Vocabulary Mismatch: Vocabulary-agnostic Teacher Guided Language Modeling
por: Shin, Haebin, et al.
Publicado: (2025)
por: Shin, Haebin, et al.
Publicado: (2025)
BiasJailbreak:Analyzing Ethical Biases and Jailbreak Vulnerabilities in Large Language Models
por: Lee, Isack, et al.
Publicado: (2024)
por: Lee, Isack, et al.
Publicado: (2024)
Abundance-Aware Set Transformer for Microbiome Sample Embedding
por: Yoo, Hyunwoo, et al.
Publicado: (2025)
por: Yoo, Hyunwoo, et al.
Publicado: (2025)
KTRL+F: Knowledge-Augmented In-Document Search
por: Oh, Hanseok, et al.
Publicado: (2023)
por: Oh, Hanseok, et al.
Publicado: (2023)
INSTRUCTIR: A Benchmark for Instruction Following of Information Retrieval Models
por: Oh, Hanseok, et al.
Publicado: (2024)
por: Oh, Hanseok, et al.
Publicado: (2024)
ZeroDL: Zero-shot Distribution Learning for Text Clustering via Large Language Models
por: Jo, Hwiyeol, et al.
Publicado: (2024)
por: Jo, Hwiyeol, et al.
Publicado: (2024)
SpeechGuard: Exploring the Adversarial Robustness of Multimodal Large Language Models
por: Peri, Raghuveer, et al.
Publicado: (2024)
por: Peri, Raghuveer, et al.
Publicado: (2024)
Robustness of Large Language Models Against Adversarial Attacks
por: Tao, Yiyi, et al.
Publicado: (2024)
por: Tao, Yiyi, et al.
Publicado: (2024)
Generative Prompt Internalization
por: Shin, Haebin, et al.
Publicado: (2024)
por: Shin, Haebin, et al.
Publicado: (2024)
IUQ: Interrogative Uncertainty Quantification for Long-Form Large Language Model Generation
por: Fan, Haozhi, et al.
Publicado: (2026)
por: Fan, Haozhi, et al.
Publicado: (2026)
Robust Fake News Detection using Large Language Models under Adversarial Sentiment Attacks
por: Tahmasebi, Sahar, et al.
Publicado: (2026)
por: Tahmasebi, Sahar, et al.
Publicado: (2026)
Perceptions to Beliefs: Exploring Precursory Inferences for Theory of Mind in Large Language Models
por: Jung, Chani, et al.
Publicado: (2024)
por: Jung, Chani, et al.
Publicado: (2024)
SafeRoute: Adaptive Model Selection for Efficient and Accurate Safety Guardrails in Large Language Models
por: Lee, Seanie, et al.
Publicado: (2025)
por: Lee, Seanie, et al.
Publicado: (2025)
On Adversarial Robustness and Out-of-Distribution Robustness of Large Language Models
por: Yang, April, et al.
Publicado: (2024)
por: Yang, April, et al.
Publicado: (2024)
Self-Refining Language Model Anonymizers via Adversarial Distillation
por: Kim, Kyuyoung, et al.
Publicado: (2025)
por: Kim, Kyuyoung, et al.
Publicado: (2025)
How the Advent of Ubiquitous Large Language Models both Stymie and Turbocharge Dynamic Adversarial Question Generation
por: Sung, Yoo Yeon, et al.
Publicado: (2024)
por: Sung, Yoo Yeon, et al.
Publicado: (2024)
DynamixSFT: Dynamic Mixture Optimization of Instruction Tuning Collections
por: Shin, Haebin, et al.
Publicado: (2025)
por: Shin, Haebin, et al.
Publicado: (2025)
Safety Alignment of Large Language Models via Contrasting Safe and Harmful Distributions
por: Zhang, Xiaoyun, et al.
Publicado: (2024)
por: Zhang, Xiaoyun, et al.
Publicado: (2024)
Chain-of-Thought Driven Adversarial Scenario Extrapolation for Robust Language Models
por: Rashid, Md Rafi Ur, et al.
Publicado: (2025)
por: Rashid, Md Rafi Ur, et al.
Publicado: (2025)
Robustness of Misinformation Classification Systems to Adversarial Examples Through BeamAttack
por: Fazla, Arnisa, et al.
Publicado: (2025)
por: Fazla, Arnisa, et al.
Publicado: (2025)
DNACHUNKER: Learnable Tokenization for DNA Language Models
por: Kim, Taewon, et al.
Publicado: (2026)
por: Kim, Taewon, et al.
Publicado: (2026)
Explore Spurious Correlations at the Concept Level in Language Models for Text Classification
por: Zhou, Yuhang, et al.
Publicado: (2023)
por: Zhou, Yuhang, et al.
Publicado: (2023)
Assessing Adversarial Robustness of Large Language Models: An Empirical Study
por: Yang, Zeyu, et al.
Publicado: (2024)
por: Yang, Zeyu, et al.
Publicado: (2024)
Self-Filtered Distillation with LLMs-generated Trust Indicators for Reliable Patent Classification
por: Yoo, Yongmin, et al.
Publicado: (2025)
por: Yoo, Yongmin, et al.
Publicado: (2025)
Advancing Single and Multi-task Text Classification through Large Language Model Fine-tuning
por: Zhao, Hang, et al.
Publicado: (2024)
por: Zhao, Hang, et al.
Publicado: (2024)
Adversarial Defence without Adversarial Defence: Enhancing Language Model Robustness via Instance-level Principal Component Removal
por: Wang, Yang, et al.
Publicado: (2025)
por: Wang, Yang, et al.
Publicado: (2025)
Evaluating Text Classification Robustness to Part-of-Speech Adversarial Examples
por: Samadi, Anahita, et al.
Publicado: (2024)
por: Samadi, Anahita, et al.
Publicado: (2024)
PapersPlease: A Benchmark for Evaluating Motivational Values of Large Language Models Based on ERG Theory
por: Myung, Junho, et al.
Publicado: (2025)
por: Myung, Junho, et al.
Publicado: (2025)
SentiXRL: An advanced large language Model Framework for Multilingual Fine-Grained Emotion Classification in Complex Text Environment
por: Wang, Jie, et al.
Publicado: (2024)
por: Wang, Jie, et al.
Publicado: (2024)
Beyond Surface Statistics: Robust Conformal Prediction for LLMs via Internal Representations
por: Wang, Yanli, et al.
Publicado: (2026)
por: Wang, Yanli, et al.
Publicado: (2026)
Breaking the Adversarial Robustness-Performance Trade-off in Text Classification via Manifold Purification
por: Dang, Chenhao, et al.
Publicado: (2025)
por: Dang, Chenhao, et al.
Publicado: (2025)
Adversarial Attack for Explanation Robustness of Rationalization Models
por: Zhang, Yuankai, et al.
Publicado: (2024)
por: Zhang, Yuankai, et al.
Publicado: (2024)
On Adversarial Robustness of Language Models in Transfer Learning
por: Turbal, Bohdan, et al.
Publicado: (2024)
por: Turbal, Bohdan, et al.
Publicado: (2024)
McBE: A Multi-task Chinese Bias Evaluation Benchmark for Large Language Models
por: Lan, Tian, et al.
Publicado: (2025)
por: Lan, Tian, et al.
Publicado: (2025)
Standardize: Aligning Language Models with Expert-Defined Standards for Content Generation
por: Imperial, Joseph Marvin, et al.
Publicado: (2024)
por: Imperial, Joseph Marvin, et al.
Publicado: (2024)
PromptRobust: Towards Evaluating the Robustness of Large Language Models on Adversarial Prompts
por: Zhu, Kaijie, et al.
Publicado: (2023)
por: Zhu, Kaijie, et al.
Publicado: (2023)
Enhancing Metaphor Detection through Soft Labels and Target Word Prediction
por: Jia, Kaidi, et al.
Publicado: (2024)
por: Jia, Kaidi, et al.
Publicado: (2024)
Ejemplares similares
-
Predicting Microbial Ontology and Pathogen Risk from Environmental Metadata with Large Language Models
por: Yoo, Hyunwoo, et al.
Publicado: (2025) -
Predicting Anti-microbial Resistance using Large Language Models
por: Yoo, Hyunwoo, et al.
Publicado: (2024) -
Can Large Language Models Predict Antimicrobial Resistance Gene?
por: Yoo, Hyunwoo
Publicado: (2025) -
Overcoming Vocabulary Mismatch: Vocabulary-agnostic Teacher Guided Language Modeling
por: Shin, Haebin, et al.
Publicado: (2025) -
BiasJailbreak:Analyzing Ethical Biases and Jailbreak Vulnerabilities in Large Language Models
por: Lee, Isack, et al.
Publicado: (2024)