Salvato in:
| Autori principali: | Wu, Xinbo, Hartman, Max, Jayaraman, Vidhata Arjun, Varshney, Lav R. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2407.11780 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Skip-It? Theoretical Conditions for Layer Skipping in Vision-Language Models
di: Hartman, Max, et al.
Pubblicazione: (2025)
di: Hartman, Max, et al.
Pubblicazione: (2025)
Hiding in Plain Sight: Detectability-Aware Antidistillation of Reasoning Models
di: Hartman, Max, et al.
Pubblicazione: (2026)
di: Hartman, Max, et al.
Pubblicazione: (2026)
Transformer-based Causal Language Models Perform Clustering
di: Wu, Xinbo, et al.
Pubblicazione: (2024)
di: Wu, Xinbo, et al.
Pubblicazione: (2024)
A Meta-Learning Perspective on Transformers for Causal Language Modeling
di: Wu, Xinbo, et al.
Pubblicazione: (2023)
di: Wu, Xinbo, et al.
Pubblicazione: (2023)
Context-Gated Associative Retrieval: From Theory to Transformers
di: Choraria, Moulik, et al.
Pubblicazione: (2026)
di: Choraria, Moulik, et al.
Pubblicazione: (2026)
SparseJEPA: Sparse Representation Learning of Joint Embedding Predictive Architectures
di: Hartman, Max, et al.
Pubblicazione: (2025)
di: Hartman, Max, et al.
Pubblicazione: (2025)
Hallucination Basins: A Dynamic Framework for Understanding and Controlling LLM Hallucinations
di: Cherukuri, Kalyan, et al.
Pubblicazione: (2026)
di: Cherukuri, Kalyan, et al.
Pubblicazione: (2026)
Beyond Bilingual Transfer: Multilingual Code-Switching in Instruction Tuning
di: Asano, Shunta, et al.
Pubblicazione: (2026)
di: Asano, Shunta, et al.
Pubblicazione: (2026)
Efficient Model-Agnostic Multi-Group Equivariant Networks
di: Baltaji, Razan, et al.
Pubblicazione: (2023)
di: Baltaji, Razan, et al.
Pubblicazione: (2023)
Persona Inconstancy in Multi-Agent LLM Collaboration: Conformity, Confabulation, and Impersonation
di: Baltaji, Razan, et al.
Pubblicazione: (2024)
di: Baltaji, Razan, et al.
Pubblicazione: (2024)
Concealment of Intent: A Game-Theoretic Analysis
di: Wu, Xinbo, et al.
Pubblicazione: (2025)
di: Wu, Xinbo, et al.
Pubblicazione: (2025)
ProSwitch: Knowledge-Guided Instruction Tuning to Switch Between Professional and Non-Professional Responses
di: Zong, Chang, et al.
Pubblicazione: (2024)
di: Zong, Chang, et al.
Pubblicazione: (2024)
Fed-SB: A Silver Bullet for Extreme Communication Efficiency and Performance in (Private) Federated LoRA Fine-Tuning
di: Singhal, Raghav, et al.
Pubblicazione: (2025)
di: Singhal, Raghav, et al.
Pubblicazione: (2025)
Energy-Aware Routing to Large Reasoning Models
di: Ellis-Mohr, Austin R., et al.
Pubblicazione: (2025)
di: Ellis-Mohr, Austin R., et al.
Pubblicazione: (2025)
A Theoretical Game of Attacks via Compositional Skills
di: Wu, Xinbo, et al.
Pubblicazione: (2026)
di: Wu, Xinbo, et al.
Pubblicazione: (2026)
ExpliCIT-QA: Explainable Code-Based Image Table Question Answering
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)
AdaSwitch: Balancing Exploration and Guidance in Knowledge Distillation via Adaptive Switching
di: Peng, Jingyu, et al.
Pubblicazione: (2025)
di: Peng, Jingyu, et al.
Pubblicazione: (2025)
Beyond Continuity: Challenges of Context Switching in Multi-Turn Dialogue with LLMs
di: Sinha, Aditya, et al.
Pubblicazione: (2026)
di: Sinha, Aditya, et al.
Pubblicazione: (2026)
When to Continue Thinking: Adaptive Thinking Mode Switching for Efficient Reasoning
di: Zhang, Xiaoyun, et al.
Pubblicazione: (2025)
di: Zhang, Xiaoyun, et al.
Pubblicazione: (2025)
SwitchLingua: The First Large-Scale Multilingual and Multi-Ethnic Code-Switching Dataset
di: Xie, Peng, et al.
Pubblicazione: (2025)
di: Xie, Peng, et al.
Pubblicazione: (2025)
Parsing the Switch: LLM-Based UD Annotation for Complex Code-Switched and Low-Resource Languages
di: Kellert, Olga, et al.
Pubblicazione: (2025)
di: Kellert, Olga, et al.
Pubblicazione: (2025)
Instruction Tuning With Loss Over Instructions
di: Shi, Zhengyan, et al.
Pubblicazione: (2024)
di: Shi, Zhengyan, et al.
Pubblicazione: (2024)
Many LLMs Are More Utilitarian Than One
di: Keshmirian, Anita, et al.
Pubblicazione: (2025)
di: Keshmirian, Anita, et al.
Pubblicazione: (2025)
MixReasoning: Switching Modes to Think
di: Lu, Haiquan, et al.
Pubblicazione: (2025)
di: Lu, Haiquan, et al.
Pubblicazione: (2025)
Indic-TunedLens: Interpreting Multilingual Models in Indian Languages
di: Panchal, Mihir, et al.
Pubblicazione: (2026)
di: Panchal, Mihir, et al.
Pubblicazione: (2026)
Enhancing Multimodal Continual Instruction Tuning with BranchLoRA
di: Zhang, Duzhen, et al.
Pubblicazione: (2025)
di: Zhang, Duzhen, et al.
Pubblicazione: (2025)
Towards Automatic Continual Learning: A Self-Adaptive Framework for Continual Instruction Tuning
di: Lin, Peiyi, et al.
Pubblicazione: (2025)
di: Lin, Peiyi, et al.
Pubblicazione: (2025)
Computational Approaches to Arabic-English Code-Switching
di: Sabty, Caroline
Pubblicazione: (2024)
di: Sabty, Caroline
Pubblicazione: (2024)
Conditioning LLMs to Generate Code-Switched Text
di: Heredia, Maite, et al.
Pubblicazione: (2025)
di: Heredia, Maite, et al.
Pubblicazione: (2025)
ME-Switch: A Memory-Efficient Expert Switching Framework for Large Language Models
di: Liu, Jing, et al.
Pubblicazione: (2024)
di: Liu, Jing, et al.
Pubblicazione: (2024)
Mind the Gap: Conformative Decoding to Improve Output Diversity of Instruction-Tuned Large Language Models
di: Peeperkorn, Max, et al.
Pubblicazione: (2025)
di: Peeperkorn, Max, et al.
Pubblicazione: (2025)
Finding the Translation Switch: Discovering and Exploiting the Task-Initiation Features in LLMs
di: Wu, Xinwei, et al.
Pubblicazione: (2026)
di: Wu, Xinwei, et al.
Pubblicazione: (2026)
SwitchLoRA: Switched Low-Rank Adaptation Can Learn Full-Rank Information
di: Zhou, Kaiye, et al.
Pubblicazione: (2024)
di: Zhou, Kaiye, et al.
Pubblicazione: (2024)
Don't Half-listen: Capturing Key-part Information in Continual Instruction Tuning
di: He, Yongquan, et al.
Pubblicazione: (2024)
di: He, Yongquan, et al.
Pubblicazione: (2024)
MLLM-CTBench: A Benchmark for Continual Instruction Tuning with Reasoning Process Diagnosis
di: Guo, Haiyun, et al.
Pubblicazione: (2025)
di: Guo, Haiyun, et al.
Pubblicazione: (2025)
MANTIS: Interleaved Multi-Image Instruction Tuning
di: Jiang, Dongfu, et al.
Pubblicazione: (2024)
di: Jiang, Dongfu, et al.
Pubblicazione: (2024)
DeepInsert: Early Layer Bypass for Efficient and Performant Multimodal Understanding
di: Choraria, Moulik, et al.
Pubblicazione: (2025)
di: Choraria, Moulik, et al.
Pubblicazione: (2025)
Detecting Propaganda Techniques in Code-Switched Social Media Text
di: Salman, Muhammad Umar, et al.
Pubblicazione: (2023)
di: Salman, Muhammad Umar, et al.
Pubblicazione: (2023)
CoVoSwitch: Machine Translation of Synthetic Code-Switched Text Based on Intonation Units
di: Kang, Yeeun
Pubblicazione: (2024)
di: Kang, Yeeun
Pubblicazione: (2024)
Rethinking Table Instruction Tuning
di: Deng, Naihao, et al.
Pubblicazione: (2025)
di: Deng, Naihao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Skip-It? Theoretical Conditions for Layer Skipping in Vision-Language Models
di: Hartman, Max, et al.
Pubblicazione: (2025) -
Hiding in Plain Sight: Detectability-Aware Antidistillation of Reasoning Models
di: Hartman, Max, et al.
Pubblicazione: (2026) -
Transformer-based Causal Language Models Perform Clustering
di: Wu, Xinbo, et al.
Pubblicazione: (2024) -
A Meta-Learning Perspective on Transformers for Causal Language Modeling
di: Wu, Xinbo, et al.
Pubblicazione: (2023) -
Context-Gated Associative Retrieval: From Theory to Transformers
di: Choraria, Moulik, et al.
Pubblicazione: (2026)