Reducing the Scope of Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Yunis, David, Huo, Siyu, Gunasekara, Chulaka, Contractor, Danish |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Multi-Document Grounded Multi-Turn Synthetic Dialog Generation
por: Lee, Young-Suk, et al.
Publicado: (2024)
por: Lee, Young-Suk, et al.
Publicado: (2024)
MTRAG: A Multi-Turn Conversational Benchmark for Evaluating Retrieval-Augmented Generation Systems
por: Katsis, Yannis, et al.
Publicado: (2025)
por: Katsis, Yannis, et al.
Publicado: (2025)
Evaluating Large Language Models for Health-related Queries with Presuppositions
por: Kaur, Navreet, et al.
Publicado: (2023)
por: Kaur, Navreet, et al.
Publicado: (2023)
Granite-Function Calling Model: Introducing Function Calling Abilities via Multi-task Learning of Granular Tasks
por: Abdelaziz, Ibrahim, et al.
Publicado: (2024)
por: Abdelaziz, Ibrahim, et al.
Publicado: (2024)
DLM-Scope: Mechanistic Interpretability of Diffusion Language Models via Sparse Autoencoders
por: Wang, Xu, et al.
Publicado: (2026)
por: Wang, Xu, et al.
Publicado: (2026)
Training with Pseudo-Code for Instruction Following
por: Kumar, Prince, et al.
Publicado: (2025)
por: Kumar, Prince, et al.
Publicado: (2025)
Pruning as a Defense: Reducing Memorization in Large Language Models
por: Gupta, Mansi, et al.
Publicado: (2025)
por: Gupta, Mansi, et al.
Publicado: (2025)
Reducing the Probability of Undesirable Outputs in Language Models Using Probabilistic Inference
por: Zhao, Stephen, et al.
Publicado: (2025)
por: Zhao, Stephen, et al.
Publicado: (2025)
Stochastic Parrots or ICU Experts? Large Language Models in Critical Care Medicine: A Scoping Review
por: Shi, Tongyue, et al.
Publicado: (2024)
por: Shi, Tongyue, et al.
Publicado: (2024)
Context-Aware Initialization for Reducing Generative Path Length in Diffusion Language Models
por: Miao, Tongyuan, et al.
Publicado: (2025)
por: Miao, Tongyuan, et al.
Publicado: (2025)
Evaluating & Reducing Deceptive Dialogue From Language Models with Multi-turn RL
por: Abdulhai, Marwa, et al.
Publicado: (2025)
por: Abdulhai, Marwa, et al.
Publicado: (2025)
Active Layer-Contrastive Decoding Reduces Hallucination in Large Language Model Generation
por: Zhang, Hongxiang, et al.
Publicado: (2025)
por: Zhang, Hongxiang, et al.
Publicado: (2025)
ED-Copilot: Reduce Emergency Department Wait Time with Language Model Diagnostic Assistance
por: Sun, Liwen, et al.
Publicado: (2024)
por: Sun, Liwen, et al.
Publicado: (2024)
ParaPO: Aligning Language Models to Reduce Verbatim Reproduction of Pre-training Data
por: Chen, Tong, et al.
Publicado: (2025)
por: Chen, Tong, et al.
Publicado: (2025)
Richer Output for Richer Countries: Uncovering Geographical Disparities in Generated Stories and Travel Recommendations
por: Bhagat, Kirti, et al.
Publicado: (2024)
por: Bhagat, Kirti, et al.
Publicado: (2024)
Reducing Large Language Model Bias with Emphasis on 'Restricted Industries': Automated Dataset Augmentation and Prejudice Quantification
por: Mondal, Devam, et al.
Publicado: (2024)
por: Mondal, Devam, et al.
Publicado: (2024)
Downstream Trade-offs of a Family of Text Watermarks
por: Ajith, Anirudh, et al.
Publicado: (2023)
por: Ajith, Anirudh, et al.
Publicado: (2023)
Activated LoRA: Fine-tuned LLMs for Intrinsics
por: Greenewald, Kristjan, et al.
Publicado: (2025)
por: Greenewald, Kristjan, et al.
Publicado: (2025)
Could a Large Language Model be Conscious?
por: Chalmers, David J.
Publicado: (2023)
por: Chalmers, David J.
Publicado: (2023)
SMART: Automatically Scaling Down Language Models with Accuracy Guarantees for Reduced Processing Fees
por: Jo, Saehan, et al.
Publicado: (2024)
por: Jo, Saehan, et al.
Publicado: (2024)
Reducing Large Language Model Safety Risks in Women's Health using Semantic Entropy
por: Penny-Dimri, Jahan C., et al.
Publicado: (2025)
por: Penny-Dimri, Jahan C., et al.
Publicado: (2025)
GWQ: Gradient-Aware Weight Quantization for Large Language Models
por: Shao, Yihua, et al.
Publicado: (2024)
por: Shao, Yihua, et al.
Publicado: (2024)
All Language Models Large and Small
por: Chen, Zhixun, et al.
Publicado: (2024)
por: Chen, Zhixun, et al.
Publicado: (2024)
Lugha-Llama: Adapting Large Language Models for African Languages
por: Buzaaba, Happy, et al.
Publicado: (2025)
por: Buzaaba, Happy, et al.
Publicado: (2025)
Discovering Forbidden Topics in Language Models
por: Rager, Can, et al.
Publicado: (2025)
por: Rager, Can, et al.
Publicado: (2025)
Active Preference Learning for Large Language Models
por: Muldrew, William, et al.
Publicado: (2024)
por: Muldrew, William, et al.
Publicado: (2024)
AfroBench: How Good are Large Language Models on African Languages?
por: Ojo, Jessica, et al.
Publicado: (2023)
por: Ojo, Jessica, et al.
Publicado: (2023)
Adapting Language Models via Token Translation
por: Feng, Zhili, et al.
Publicado: (2024)
por: Feng, Zhili, et al.
Publicado: (2024)
Fluid Language Model Benchmarking
por: Hofmann, Valentin, et al.
Publicado: (2025)
por: Hofmann, Valentin, et al.
Publicado: (2025)
Non-Markovian Discrete Diffusion with Causal Language Models
por: Zhang, Yangtian, et al.
Publicado: (2025)
por: Zhang, Yangtian, et al.
Publicado: (2025)
Language Model Memory and Memory Models for Language
por: Badger, Benjamin L.
Publicado: (2026)
por: Badger, Benjamin L.
Publicado: (2026)
Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2
por: Lieberum, Tom, et al.
Publicado: (2024)
por: Lieberum, Tom, et al.
Publicado: (2024)
Labrador: Exploring the Limits of Masked Language Modeling for Laboratory Data
por: Bellamy, David R., et al.
Publicado: (2023)
por: Bellamy, David R., et al.
Publicado: (2023)
Derivational Morphology Reveals Analogical Generalization in Large Language Models
por: Hofmann, Valentin, et al.
Publicado: (2024)
por: Hofmann, Valentin, et al.
Publicado: (2024)
CovidLLM: A Robust Large Language Model with Missing Value Adaptation and Multi-Objective Learning Strategy for Predicting Disease Severity and Clinical Outcomes in COVID-19 Patients
por: Zhu, Shengjun, et al.
Publicado: (2024)
por: Zhu, Shengjun, et al.
Publicado: (2024)
Measuring and Controlling Instruction (In)Stability in Language Model Dialogs
por: Li, Kenneth, et al.
Publicado: (2024)
por: Li, Kenneth, et al.
Publicado: (2024)
From Words to Actions: Unveiling the Theoretical Underpinnings of LLM-Driven Autonomous Systems
por: He, Jianliang, et al.
Publicado: (2024)
por: He, Jianliang, et al.
Publicado: (2024)
Improved Out-of-Scope Intent Classification with Dual Encoding and Threshold-based Re-Classification
por: Zawbaa, Hossam M., et al.
Publicado: (2024)
por: Zawbaa, Hossam M., et al.
Publicado: (2024)
PII-Scope: A Comprehensive Study on Training Data PII Extraction Attacks in LLMs
por: Nakka, Krishna Kanth, et al.
Publicado: (2024)
por: Nakka, Krishna Kanth, et al.
Publicado: (2024)
BERT-LSH: Reducing Absolute Compute For Attention
por: Li, Zezheng, et al.
Publicado: (2024)
por: Li, Zezheng, et al.
Publicado: (2024)
Ejemplares similares
-
Multi-Document Grounded Multi-Turn Synthetic Dialog Generation
por: Lee, Young-Suk, et al.
Publicado: (2024) -
MTRAG: A Multi-Turn Conversational Benchmark for Evaluating Retrieval-Augmented Generation Systems
por: Katsis, Yannis, et al.
Publicado: (2025) -
Evaluating Large Language Models for Health-related Queries with Presuppositions
por: Kaur, Navreet, et al.
Publicado: (2023) -
Granite-Function Calling Model: Introducing Function Calling Abilities via Multi-task Learning of Granular Tasks
por: Abdelaziz, Ibrahim, et al.
Publicado: (2024) -
DLM-Scope: Mechanistic Interpretability of Diffusion Language Models via Sparse Autoencoders
por: Wang, Xu, et al.
Publicado: (2026)