TRAWL: Tensor Reduced and Approximated Weights for Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Luo, Yiran, Patel, Het, Fu, Yu, Ahn, Dawon, Chen, Jia, Dong, Yue, Papalexakis, Evangelos E. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Robust Hybrid Classical-Quantum Transfer Learning Model for Text Classification Using GPT-Neo 125M with LoRA & SMOTE Enhancement
di: Wishal, Santanam
Pubblicazione: (2025)
di: Wishal, Santanam
Pubblicazione: (2025)
Improving French Synthetic Speech Quality via SSML Prosody Control
di: Ouali, Nassima Ould, et al.
Pubblicazione: (2025)
di: Ouali, Nassima Ould, et al.
Pubblicazione: (2025)
MORQA: Benchmarking Evaluation Metrics for Medical Open-Ended Question Answering
di: Yim, Wen-wai, et al.
Pubblicazione: (2025)
di: Yim, Wen-wai, et al.
Pubblicazione: (2025)
Shift-Reduce Task-Oriented Semantic Parsing with Stack-Transformers
di: Fernández-González, Daniel
Pubblicazione: (2022)
di: Fernández-González, Daniel
Pubblicazione: (2022)
$δ$-STEAL: LLM Stealing Attack with Local Differential Privacy
di: Dang, Kieu, et al.
Pubblicazione: (2025)
di: Dang, Kieu, et al.
Pubblicazione: (2025)
TIS-DPO: Token-level Importance Sampling for Direct Preference Optimization With Estimated Weights
di: Liu, Aiwei, et al.
Pubblicazione: (2024)
di: Liu, Aiwei, et al.
Pubblicazione: (2024)
Detecting Sleeper Agents in Large Language Models via Semantic Drift Analysis
di: Zanbaghi, Shahin, et al.
Pubblicazione: (2025)
di: Zanbaghi, Shahin, et al.
Pubblicazione: (2025)
Model Surgery: Modulating LLM's Behavior Via Simple Parameter Editing
di: Wang, Huanqian, et al.
Pubblicazione: (2024)
di: Wang, Huanqian, et al.
Pubblicazione: (2024)
A Survey on Collaborating Small and Large Language Models for Performance, Cost-effectiveness, Cloud-edge Privacy, and Trustworthiness
di: Wang, Fali, et al.
Pubblicazione: (2025)
di: Wang, Fali, et al.
Pubblicazione: (2025)
GATE: Graph-based Adaptive Tool Evolution Across Diverse Tasks
di: Luo, Jianwen, et al.
Pubblicazione: (2025)
di: Luo, Jianwen, et al.
Pubblicazione: (2025)
Co-NAML-LSTUR: A Combined Model with Attentive Multi-View Learning and Long- and Short-term User Representations for News Recommendation
di: Nguyen, Minh Hoang, et al.
Pubblicazione: (2025)
di: Nguyen, Minh Hoang, et al.
Pubblicazione: (2025)
When Retrieval Succeeds and Fails: Rethinking Retrieval-Augmented Generation for LLMs
di: Wang, Yongjie, et al.
Pubblicazione: (2025)
di: Wang, Yongjie, et al.
Pubblicazione: (2025)
Unveiling Attractor Cycles in Large Language Models: A Dynamical Systems View of Successive Paraphrasing
di: Wang, Zhilin, et al.
Pubblicazione: (2025)
di: Wang, Zhilin, et al.
Pubblicazione: (2025)
PaperAudit-Bench: Benchmarking Error Detection in Research Papers for Critical Automated Peer Review
di: Tu, Songjun, et al.
Pubblicazione: (2026)
di: Tu, Songjun, et al.
Pubblicazione: (2026)
A Survey on Natural Language Counterfactual Generation
di: Wang, Yongjie, et al.
Pubblicazione: (2024)
di: Wang, Yongjie, et al.
Pubblicazione: (2024)
SentiCSE: A Sentiment-aware Contrastive Sentence Embedding Framework with Sentiment-guided Textual Similarity
di: Kim, Jaemin, et al.
Pubblicazione: (2024)
di: Kim, Jaemin, et al.
Pubblicazione: (2024)
Make Literature-Based Discovery Great Again through Reproducible Pipelines
di: Cestnik, Bojan, et al.
Pubblicazione: (2025)
di: Cestnik, Bojan, et al.
Pubblicazione: (2025)
Data and AI governance: Promoting equity, ethics, and fairness in large language models
di: Abhishek, Alok, et al.
Pubblicazione: (2025)
di: Abhishek, Alok, et al.
Pubblicazione: (2025)
Do Reasoning Models Enhance Embedding Models?
di: Chan, Wun Yu, et al.
Pubblicazione: (2026)
di: Chan, Wun Yu, et al.
Pubblicazione: (2026)
SHARP: Social Harm Analysis via Risk Profiles for Measuring Inequities in Large Language Models
di: Abhishek, Alok, et al.
Pubblicazione: (2026)
di: Abhishek, Alok, et al.
Pubblicazione: (2026)
Judgment2vec: Apply Graph Analytics to Searching and Recommendation of Similar Judgments
di: Shao, Hsuan-Lei
Pubblicazione: (2024)
di: Shao, Hsuan-Lei
Pubblicazione: (2024)
BEATS: Bias Evaluation and Assessment Test Suite for Large Language Models
di: Abhishek, Alok, et al.
Pubblicazione: (2025)
di: Abhishek, Alok, et al.
Pubblicazione: (2025)
Research on a hybrid LSTM-CNN-Attention model for text-based web content classification
di: Kuz, Mykola, et al.
Pubblicazione: (2025)
di: Kuz, Mykola, et al.
Pubblicazione: (2025)
Reasoning Promotes Robustness in Theory of Mind Tasks
di: de Haan, Ian B., et al.
Pubblicazione: (2026)
di: de Haan, Ian B., et al.
Pubblicazione: (2026)
Linguistic Collapse: Neural Collapse in (Large) Language Models
di: Wu, Robert, et al.
Pubblicazione: (2024)
di: Wu, Robert, et al.
Pubblicazione: (2024)
WeDLM: Reconciling Diffusion Language Models with Standard Causal Attention for Fast Inference
di: Liu, Aiwei, et al.
Pubblicazione: (2025)
di: Liu, Aiwei, et al.
Pubblicazione: (2025)
d-TreeRPO: Towards More Reliable Policy Optimization for Diffusion Language Models
di: Pan, Leyi, et al.
Pubblicazione: (2025)
di: Pan, Leyi, et al.
Pubblicazione: (2025)
Tailoring Vaccine Messaging with Common-Ground Opinions
di: Stureborg, Rickard, et al.
Pubblicazione: (2024)
di: Stureborg, Rickard, et al.
Pubblicazione: (2024)
Rule Extraction in Machine Learning: Chat Incremental Pattern Constructor
di: Nwokocha, Caleb Princewill
Pubblicazione: (2022)
di: Nwokocha, Caleb Princewill
Pubblicazione: (2022)
Omni-SafetyBench: A Benchmark for Safety Evaluation of Audio-Visual Large Language Models
di: Pan, Leyi, et al.
Pubblicazione: (2025)
di: Pan, Leyi, et al.
Pubblicazione: (2025)
Large Language Models are Inconsistent and Biased Evaluators
di: Stureborg, Rickard, et al.
Pubblicazione: (2024)
di: Stureborg, Rickard, et al.
Pubblicazione: (2024)
PairCFR: Enhancing Model Training on Paired Counterfactually Augmented Data through Contrastive Learning
di: Qiu, Xiaoqi, et al.
Pubblicazione: (2024)
di: Qiu, Xiaoqi, et al.
Pubblicazione: (2024)
Exploring and Reshaping the Weight Distribution in LLM
di: Ye, Chunming, et al.
Pubblicazione: (2025)
di: Ye, Chunming, et al.
Pubblicazione: (2025)
RV-HATE: Reinforced Multi-Module Voting for Implicit Hate Speech Detection
di: Lee, Yejin, et al.
Pubblicazione: (2025)
di: Lee, Yejin, et al.
Pubblicazione: (2025)
Emotional Sequential Influence Modeling on False Information
di: Naskar, Debashis, et al.
Pubblicazione: (2024)
di: Naskar, Debashis, et al.
Pubblicazione: (2024)
CognitiveArm: Enabling Real-Time EEG-Controlled Prosthetic Arm Using Embodied Machine Learning
di: Basit, Abdul, et al.
Pubblicazione: (2025)
di: Basit, Abdul, et al.
Pubblicazione: (2025)
Reducing Hallucinations in Summarization via Reinforcement Learning with Entity Hallucination Index
di: Katwe, Praveenkumar, et al.
Pubblicazione: (2025)
di: Katwe, Praveenkumar, et al.
Pubblicazione: (2025)
A transfer learning approach for automatic conflicts detection in software requirement sentence pairs based on dual encoders
di: Wang, Yizheng, et al.
Pubblicazione: (2025)
di: Wang, Yizheng, et al.
Pubblicazione: (2025)
The Knesset Corpus: An Annotated Corpus of Hebrew Parliamentary Proceedings
di: Goldin, Gili, et al.
Pubblicazione: (2024)
di: Goldin, Gili, et al.
Pubblicazione: (2024)
Math Natural Language Inference: this should be easy!
di: de Paiva, Valeria, et al.
Pubblicazione: (2025)
di: de Paiva, Valeria, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Robust Hybrid Classical-Quantum Transfer Learning Model for Text Classification Using GPT-Neo 125M with LoRA & SMOTE Enhancement
di: Wishal, Santanam
Pubblicazione: (2025) -
Improving French Synthetic Speech Quality via SSML Prosody Control
di: Ouali, Nassima Ould, et al.
Pubblicazione: (2025) -
MORQA: Benchmarking Evaluation Metrics for Medical Open-Ended Question Answering
di: Yim, Wen-wai, et al.
Pubblicazione: (2025) -
Shift-Reduce Task-Oriented Semantic Parsing with Stack-Transformers
di: Fernández-González, Daniel
Pubblicazione: (2022) -
$δ$-STEAL: LLM Stealing Attack with Local Differential Privacy
di: Dang, Kieu, et al.
Pubblicazione: (2025)