Teaching a Language Model to Distinguish Between Similar Details using a Small Adversarial Training Set
Fuente:
arXiv
Guardado en:
| Autor principal: | Achard, Chris |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LightReasoner: Can Small Language Models Teach Large Language Models Reasoning?
por: Wang, Jingyuan, et al.
Publicado: (2025)
por: Wang, Jingyuan, et al.
Publicado: (2025)
A Survey on Collaborative Mechanisms Between Large and Small Language Models
por: Chen, Yi, et al.
Publicado: (2025)
por: Chen, Yi, et al.
Publicado: (2025)
ExpertPrompting: Instructing Large Language Models to be Distinguished Experts
por: Xu, Benfeng, et al.
Publicado: (2023)
por: Xu, Benfeng, et al.
Publicado: (2023)
SozKZ: Training Efficient Small Language Models for Kazakh from Scratch
por: Tukenov, Saken
Publicado: (2026)
por: Tukenov, Saken
Publicado: (2026)
Distinguishing the Knowable from the Unknowable with Language Models
por: Ahdritz, Gustaf, et al.
Publicado: (2024)
por: Ahdritz, Gustaf, et al.
Publicado: (2024)
MLLMs Know Where to Look: Training-free Perception of Small Visual Details with Multimodal LLMs
por: Zhang, Jiarui, et al.
Publicado: (2025)
por: Zhang, Jiarui, et al.
Publicado: (2025)
Prompting Strategies for Language Model-Based Item Generation in K-12 Education: Bridging the Gap Between Small and Large Language Models
por: Amini, Mohammad, et al.
Publicado: (2025)
por: Amini, Mohammad, et al.
Publicado: (2025)
Language Model Re-rankers are Fooled by Lexical Similarities
por: Hagström, Lovisa, et al.
Publicado: (2025)
por: Hagström, Lovisa, et al.
Publicado: (2025)
How Small Transformation Expose the Weakness of Semantic Similarity Measures
por: Nikiema, Serge Lionel, et al.
Publicado: (2025)
por: Nikiema, Serge Lionel, et al.
Publicado: (2025)
Fast Adversarial Training against Textual Adversarial Attacks
por: Yang, Yichen, et al.
Publicado: (2024)
por: Yang, Yichen, et al.
Publicado: (2024)
Teaching Language Models to Reason with Tools
por: Li, Chengpeng, et al.
Publicado: (2025)
por: Li, Chengpeng, et al.
Publicado: (2025)
The Same But Different: Structural Similarities and Differences in Multilingual Language Modeling
por: Zhang, Ruochen, et al.
Publicado: (2024)
por: Zhang, Ruochen, et al.
Publicado: (2024)
InfiR : Crafting Effective Small Language Models and Multimodal Small Language Models in Reasoning
por: Xie, Congkai, et al.
Publicado: (2025)
por: Xie, Congkai, et al.
Publicado: (2025)
DEFT: Data Efficient Fine-Tuning for Pre-Trained Language Models via Unsupervised Core-Set Selection
por: Das, Devleena, et al.
Publicado: (2023)
por: Das, Devleena, et al.
Publicado: (2023)
Teaching Language Models To Gather Information Proactively
por: Huang, Tenghao, et al.
Publicado: (2025)
por: Huang, Tenghao, et al.
Publicado: (2025)
Small, Private Language Models as Teammates for Educational Assessment Design
por: Jaldi, Chris Davis, et al.
Publicado: (2026)
por: Jaldi, Chris Davis, et al.
Publicado: (2026)
Adversarial Negotiation Dynamics in Generative Language Models
por: Kolbeinsson, Arinbjörn, et al.
Publicado: (2024)
por: Kolbeinsson, Arinbjörn, et al.
Publicado: (2024)
Small Language Model as Data Prospector for Large Language Model
por: Ni, Shiwen, et al.
Publicado: (2024)
por: Ni, Shiwen, et al.
Publicado: (2024)
DOCS: Quantifying Weight Similarity for Deeper Insights into Large Language Models
por: Min, Zeping, et al.
Publicado: (2025)
por: Min, Zeping, et al.
Publicado: (2025)
A Post-Training Enhanced Optimization Approach for Small Language Models
por: Zhai, Keke
Publicado: (2024)
por: Zhai, Keke
Publicado: (2024)
Train Small, Infer Large: Memory-Efficient LoRA Training for Large Language Models
por: Zhang, Jun, et al.
Publicado: (2025)
por: Zhang, Jun, et al.
Publicado: (2025)
Hallucination Detection with Small Language Models
por: Cheung, Ming
Publicado: (2025)
por: Cheung, Ming
Publicado: (2025)
Emissions and Performance Trade-off Between Small and Large Language Models
por: Garg, Anandita, et al.
Publicado: (2025)
por: Garg, Anandita, et al.
Publicado: (2025)
JAMDEC: Unsupervised Authorship Obfuscation using Constrained Decoding over Small Language Models
por: Fisher, Jillian, et al.
Publicado: (2024)
por: Fisher, Jillian, et al.
Publicado: (2024)
Less is More: Pre-Training Cross-Lingual Small-Scale Language Models with Cognitively-Plausible Curriculum Learning Strategies
por: Salhan, Suchir, et al.
Publicado: (2024)
por: Salhan, Suchir, et al.
Publicado: (2024)
SIMBA UQ: Similarity-Based Aggregation for Uncertainty Quantification in Large Language Models
por: Bhattacharjya, Debarun, et al.
Publicado: (2025)
por: Bhattacharjya, Debarun, et al.
Publicado: (2025)
Cosine-Similarity Routing with Semantic Anchors for Interpretable Mixture-of-Experts Language Models
por: Ternovtsii, Ivan, et al.
Publicado: (2025)
por: Ternovtsii, Ivan, et al.
Publicado: (2025)
Adversarial Poetry as a Universal Single-Turn Jailbreak Mechanism in Large Language Models
por: Bisconti, Piercosma, et al.
Publicado: (2025)
por: Bisconti, Piercosma, et al.
Publicado: (2025)
Constructing a Norm for Children's Scientific Drawing: Distribution Features Based on Semantic Similarity of Large Language Models
por: Zhang, Yi, et al.
Publicado: (2025)
por: Zhang, Yi, et al.
Publicado: (2025)
Is Training Data Quality or Quantity More Impactful to Small Language Model Performance?
por: Sajith, Aryan, et al.
Publicado: (2024)
por: Sajith, Aryan, et al.
Publicado: (2024)
Readability $\ne$ Learnability: Rethinking the Role of Simplicity in Training Small Language Models
por: Lee, Ivan, et al.
Publicado: (2025)
por: Lee, Ivan, et al.
Publicado: (2025)
Adapt-Pruner: Adaptive Structural Pruning for Efficient Small Language Model Training
por: Pan, Rui, et al.
Publicado: (2025)
por: Pan, Rui, et al.
Publicado: (2025)
Small Language Model Can Self-correct
por: Han, Haixia, et al.
Publicado: (2024)
por: Han, Haixia, et al.
Publicado: (2024)
Achieving Sparse Activation in Small Language Models
por: Song, Jifeng, et al.
Publicado: (2024)
por: Song, Jifeng, et al.
Publicado: (2024)
Wave Network: An Ultra-Small Language Model
por: Zhang, Xin, et al.
Publicado: (2024)
por: Zhang, Xin, et al.
Publicado: (2024)
Small Language Models for Curriculum-based Guidance
por: Katharakis, Konstantinos, et al.
Publicado: (2025)
por: Katharakis, Konstantinos, et al.
Publicado: (2025)
Once Upon a Time: Interactive Learning for Storytelling with Small Language Models
por: Martins, Jonas Mayer, et al.
Publicado: (2025)
por: Martins, Jonas Mayer, et al.
Publicado: (2025)
Mutarjim: Advancing Bidirectional Arabic-English Translation with a Small Language Model
por: Hennara, Khalil, et al.
Publicado: (2025)
por: Hennara, Khalil, et al.
Publicado: (2025)
Zero-shot Cross-lingual Transfer Learning with Multiple Source and Target Languages for Information Extraction: Language Selection and Adversarial Training
por: Ngo, Nghia Trung, et al.
Publicado: (2024)
por: Ngo, Nghia Trung, et al.
Publicado: (2024)
ASTRO: Teaching Language Models to Reason by Reflecting and Backtracking In-Context
por: Kim, Joongwon, et al.
Publicado: (2025)
por: Kim, Joongwon, et al.
Publicado: (2025)
Ejemplares similares
-
LightReasoner: Can Small Language Models Teach Large Language Models Reasoning?
por: Wang, Jingyuan, et al.
Publicado: (2025) -
A Survey on Collaborative Mechanisms Between Large and Small Language Models
por: Chen, Yi, et al.
Publicado: (2025) -
ExpertPrompting: Instructing Large Language Models to be Distinguished Experts
por: Xu, Benfeng, et al.
Publicado: (2023) -
SozKZ: Training Efficient Small Language Models for Kazakh from Scratch
por: Tukenov, Saken
Publicado: (2026) -
Distinguishing the Knowable from the Unknowable with Language Models
por: Ahdritz, Gustaf, et al.
Publicado: (2024)