Large Language Models aren't all that you need
Fuente:
arXiv
Guardado en:
| Autores principales: | Holla, Kiran Voderhobli, Kumar, Chaithanya, Singh, Aryan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Transformer Based Machine Fault Detection From Audio Input
por: Holla, Kiran Voderhobli
Publicado: (2026)
por: Holla, Kiran Voderhobli
Publicado: (2026)
Prakriti200: A Questionnaire-Based Dataset of 200 Ayurvedic Prakriti Assessments
por: Singh, Aryan Kumar, et al.
Publicado: (2025)
por: Singh, Aryan Kumar, et al.
Publicado: (2025)
Think before you speak: Training Language Models With Pause Tokens
por: Goyal, Sachin, et al.
Publicado: (2023)
por: Goyal, Sachin, et al.
Publicado: (2023)
Commonsense for Zero-Shot Natural Language Video Localization
por: Holla, Meghana, et al.
Publicado: (2023)
por: Holla, Meghana, et al.
Publicado: (2023)
100 instances is all you need: predicting the success of a new LLM on unseen data by testing on a few instances
por: Pacchiardi, Lorenzo, et al.
Publicado: (2024)
por: Pacchiardi, Lorenzo, et al.
Publicado: (2024)
Enhancing Domain-Specific Retrieval-Augmented Generation: Synthetic Data Generation and Evaluation using Reasoning Models
por: Jadon, Aryan, et al.
Publicado: (2025)
por: Jadon, Aryan, et al.
Publicado: (2025)
CARE-RFT: Confidence-Anchored Reinforcement Finetuning for Reliable Reasoning in Large Language Models
por: Li, Shuozhe, et al.
Publicado: (2026)
por: Li, Shuozhe, et al.
Publicado: (2026)
Is Training Data Quality or Quantity More Impactful to Small Language Model Performance?
por: Sajith, Aryan, et al.
Publicado: (2024)
por: Sajith, Aryan, et al.
Publicado: (2024)
DiscoveryBench: Towards Data-Driven Discovery with Large Language Models
por: Majumder, Bodhisattwa Prasad, et al.
Publicado: (2024)
por: Majumder, Bodhisattwa Prasad, et al.
Publicado: (2024)
H-Probes: Extracting Hierarchical Structures From Latent Representations of Language Models
por: Dawes, Cutter, et al.
Publicado: (2026)
por: Dawes, Cutter, et al.
Publicado: (2026)
Illuminate: A novel approach for depression detection with explainable analysis and proactive therapy using prompt engineering
por: Agrawal, Aryan
Publicado: (2024)
por: Agrawal, Aryan
Publicado: (2024)
Multilingual Natural Language Processing Model for Radiology Reports -- The Summary is all you need!
por: Lindo, Mariana, et al.
Publicado: (2023)
por: Lindo, Mariana, et al.
Publicado: (2023)
Rethinking Interpretability in the Era of Large Language Models
por: Singh, Chandan, et al.
Publicado: (2024)
por: Singh, Chandan, et al.
Publicado: (2024)
Ranking Large Language Models without Ground Truth
por: Dhurandhar, Amit, et al.
Publicado: (2024)
por: Dhurandhar, Amit, et al.
Publicado: (2024)
Noise Injection Systemically Degrades Large Language Model Safety Guardrails
por: Shahani, Prithviraj Singh, et al.
Publicado: (2025)
por: Shahani, Prithviraj Singh, et al.
Publicado: (2025)
Multilingual Prompt Engineering in Large Language Models: A Survey Across NLP Tasks
por: Vatsal, Shubham, et al.
Publicado: (2025)
por: Vatsal, Shubham, et al.
Publicado: (2025)
Variation in Verification: Understanding Verification Dynamics in Large Language Models
por: Zhou, Yefan, et al.
Publicado: (2025)
por: Zhou, Yefan, et al.
Publicado: (2025)
Emergence of Hierarchical Emotion Organization in Large Language Models
por: Zhao, Bo, et al.
Publicado: (2025)
por: Zhao, Bo, et al.
Publicado: (2025)
Towards Reasoning-Preserving Unlearning in Multimodal Large Language Models
por: Li, Hongji, et al.
Publicado: (2025)
por: Li, Hongji, et al.
Publicado: (2025)
Predicting Compact Phrasal Rewrites with Large Language Models for ASR Post Editing
por: Zhang, Hao, et al.
Publicado: (2025)
por: Zhang, Hao, et al.
Publicado: (2025)
Fourier Head: Helping Large Language Models Learn Complex Probability Distributions
por: Gillman, Nate, et al.
Publicado: (2024)
por: Gillman, Nate, et al.
Publicado: (2024)
Tabular Data: Is Deep Learning all you need?
por: Zabërgja, Guri, et al.
Publicado: (2024)
por: Zabërgja, Guri, et al.
Publicado: (2024)
UQLM: A Python Package for Uncertainty Quantification in Large Language Models
por: Bouchard, Dylan, et al.
Publicado: (2025)
por: Bouchard, Dylan, et al.
Publicado: (2025)
REL: Working out is all you need
por: Simonds, Toby, et al.
Publicado: (2024)
por: Simonds, Toby, et al.
Publicado: (2024)
Remember This Event That Year? Assessing Temporal Information and Reasoning in Large Language Models
por: Beniwal, Himanshu, et al.
Publicado: (2024)
por: Beniwal, Himanshu, et al.
Publicado: (2024)
Confidence Under the Hood: An Investigation into the Confidence-Probability Alignment in Large Language Models
por: Kumar, Abhishek, et al.
Publicado: (2024)
por: Kumar, Abhishek, et al.
Publicado: (2024)
Sysformer: Safeguarding Frozen Large Language Models with Adaptive System Prompts
por: Sharma, Kartik, et al.
Publicado: (2025)
por: Sharma, Kartik, et al.
Publicado: (2025)
Language Model Cascades: Token-level uncertainty and beyond
por: Gupta, Neha, et al.
Publicado: (2024)
por: Gupta, Neha, et al.
Publicado: (2024)
LLM Surgery: Efficient Knowledge Unlearning and Editing in Large Language Models
por: Veldanda, Akshaj Kumar, et al.
Publicado: (2024)
por: Veldanda, Akshaj Kumar, et al.
Publicado: (2024)
FineZip : Pushing the Limits of Large Language Models for Practical Lossless Text Compression
por: Mittu, Fazal, et al.
Publicado: (2024)
por: Mittu, Fazal, et al.
Publicado: (2024)
Large Language Model Pruning
por: Huang, Hanjuan, et al.
Publicado: (2024)
por: Huang, Hanjuan, et al.
Publicado: (2024)
Causality for Large Language Models
por: Wu, Anpeng, et al.
Publicado: (2024)
por: Wu, Anpeng, et al.
Publicado: (2024)
Large Language Model Unlearning
por: Yao, Yuanshun, et al.
Publicado: (2023)
por: Yao, Yuanshun, et al.
Publicado: (2023)
Foundations of Large Language Models
por: Xiao, Tong, et al.
Publicado: (2025)
por: Xiao, Tong, et al.
Publicado: (2025)
Large Language Models as Optimizers
por: Yang, Chengrun, et al.
Publicado: (2023)
por: Yang, Chengrun, et al.
Publicado: (2023)
ResearchAgent: Iterative Research Idea Generation over Scientific Literature with Large Language Models
por: Baek, Jinheon, et al.
Publicado: (2024)
por: Baek, Jinheon, et al.
Publicado: (2024)
Wanda++: Pruning Large Language Models via Regional Gradients
por: Yang, Yifan, et al.
Publicado: (2025)
por: Yang, Yifan, et al.
Publicado: (2025)
Inference-Aware Fine-Tuning for Best-of-N Sampling in Large Language Models
por: Chow, Yinlam, et al.
Publicado: (2024)
por: Chow, Yinlam, et al.
Publicado: (2024)
On the Compressibility of Quantized Large Language Models
por: Mao, Yu, et al.
Publicado: (2024)
por: Mao, Yu, et al.
Publicado: (2024)
Textual Aesthetics in Large Language Models
por: Jiang, Lingjie, et al.
Publicado: (2024)
por: Jiang, Lingjie, et al.
Publicado: (2024)
Ejemplares similares
-
Transformer Based Machine Fault Detection From Audio Input
por: Holla, Kiran Voderhobli
Publicado: (2026) -
Prakriti200: A Questionnaire-Based Dataset of 200 Ayurvedic Prakriti Assessments
por: Singh, Aryan Kumar, et al.
Publicado: (2025) -
Think before you speak: Training Language Models With Pause Tokens
por: Goyal, Sachin, et al.
Publicado: (2023) -
Commonsense for Zero-Shot Natural Language Video Localization
por: Holla, Meghana, et al.
Publicado: (2023) -
100 instances is all you need: predicting the success of a new LLM on unseen data by testing on a few instances
por: Pacchiardi, Lorenzo, et al.
Publicado: (2024)