Investigating the Effectiveness of HyperTuning via Gisting
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Phang, Jason |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GistScore: Learning Better Representations for In-Context Example Selection with Gist Bottlenecks
par: Gupta, Shivanshu, et autres
Publié: (2023)
par: Gupta, Shivanshu, et autres
Publié: (2023)
Compressing Lengthy Context With UltraGist
par: Zhang, Peitian, et autres
Publié: (2024)
par: Zhang, Peitian, et autres
Publié: (2024)
Learning to Compress Prompts with Gist Tokens
par: Mu, Jesse, et autres
Publié: (2023)
par: Mu, Jesse, et autres
Publié: (2023)
Sentence-Anchored Gist Compression for Long-Context LLMs
par: Tarasov, Dmitrii, et autres
Publié: (2025)
par: Tarasov, Dmitrii, et autres
Publié: (2025)
SciGisPy: a Novel Metric for Biomedical Text Simplification via Gist Inference Score
par: Lyu, Chen, et autres
Publié: (2024)
par: Lyu, Chen, et autres
Publié: (2024)
Say More with Less: Understanding Prompt Learning Behaviors through Gist Compression
par: Li, Xinze, et autres
Publié: (2024)
par: Li, Xinze, et autres
Publié: (2024)
UniGist: Towards General and Hardware-aligned Sequence-level Long Context Compression
par: Deng, Chenlong, et autres
Publié: (2025)
par: Deng, Chenlong, et autres
Publié: (2025)
EmoGist: Efficient In-Context Learning for Visual Emotion Understanding
par: Seoh, Ronald, et autres
Publié: (2025)
par: Seoh, Ronald, et autres
Publié: (2025)
Understand Then Memory: A Cognitive Gist-Driven RAG Framework with Global Semantic Diffusion
par: Zhou, Pengcheng, et autres
Publié: (2026)
par: Zhou, Pengcheng, et autres
Publié: (2026)
A Human-Inspired Reading Agent with Gist Memory of Very Long Contexts
par: Lee, Kuang-Huei, et autres
Publié: (2024)
par: Lee, Kuang-Huei, et autres
Publié: (2024)
A Silver Bullet or a Compromise for Full Attention? A Comprehensive Study of Gist Token-based Context Compression
par: Deng, Chenlong, et autres
Publié: (2024)
par: Deng, Chenlong, et autres
Publié: (2024)
Struc-Bench: Are Large Language Models Really Good at Generating Complex Structured Data?
par: Tang, Xiangru, et autres
Publié: (2023)
par: Tang, Xiangru, et autres
Publié: (2023)
Two Failures of Self-Consistency in the Multi-Step Reasoning of LLMs
par: Chen, Angelica, et autres
Publié: (2023)
par: Chen, Angelica, et autres
Publié: (2023)
Large Language Models as Misleading Assistants in Conversation
par: Hou, Betty Li, et autres
Publié: (2024)
par: Hou, Betty Li, et autres
Publié: (2024)
From Verbatim to Gist: Distilling Pyramidal Multimodal Memory via Semantic Information Bottleneck for Long-Horizon Video Agents
par: Lian, Niu, et autres
Publié: (2026)
par: Lian, Niu, et autres
Publié: (2026)
AutoRAG-HP: Automatic Online Hyper-Parameter Tuning for Retrieval-Augmented Generation
par: Fu, Jia, et autres
Publié: (2024)
par: Fu, Jia, et autres
Publié: (2024)
ImageInWords: Unlocking Hyper-Detailed Image Descriptions
par: Garg, Roopal, et autres
Publié: (2024)
par: Garg, Roopal, et autres
Publié: (2024)
Efficient and Effective Prompt Tuning via Prompt Decomposition and Compressed Outer Product
par: Lan, Pengxiang, et autres
Publié: (2025)
par: Lan, Pengxiang, et autres
Publié: (2025)
HyperLLaVA: Dynamic Visual and Language Expert Tuning for Multimodal Large Language Models
par: Zhang, Wenqiao, et autres
Publié: (2024)
par: Zhang, Wenqiao, et autres
Publié: (2024)
HypeLoRA: Hyper-Network-Generated LoRA Adapters for Calibrated Language Model Fine-Tuning
par: Trojan, Bartosz, et autres
Publié: (2026)
par: Trojan, Bartosz, et autres
Publié: (2026)
PAFT: A Parallel Training Paradigm for Effective LLM Fine-Tuning
par: Pentyala, Shiva Kumar, et autres
Publié: (2024)
par: Pentyala, Shiva Kumar, et autres
Publié: (2024)
Evaluating The Impact of Stimulus Quality in Investigations of LLM Language Performance
par: Pistotti, Timothy, et autres
Publié: (2025)
par: Pistotti, Timothy, et autres
Publié: (2025)
Hyper-CL: Conditioning Sentence Representations with Hypernetworks
par: Yoo, Young Hyun, et autres
Publié: (2024)
par: Yoo, Young Hyun, et autres
Publié: (2024)
Investigating Multilingual Instruction-Tuning: Do Polyglot Models Demand for Multilingual Instructions?
par: Weber, Alexander Arno, et autres
Publié: (2024)
par: Weber, Alexander Arno, et autres
Publié: (2024)
Router-Tuning: A Simple and Effective Approach for Enabling Dynamic-Depth in Transformers
par: He, Shwai, et autres
Publié: (2024)
par: He, Shwai, et autres
Publié: (2024)
GRAIT: Gradient-Driven Refusal-Aware Instruction Tuning for Effective Hallucination Mitigation
par: Zhu, Runchuan, et autres
Publié: (2025)
par: Zhu, Runchuan, et autres
Publié: (2025)
Critique Fine-Tuning: Learning to Critique is More Effective than Learning to Imitate
par: Wang, Yubo, et autres
Publié: (2025)
par: Wang, Yubo, et autres
Publié: (2025)
Investigating Instruction Tuning Large Language Models on Graphs
par: Zhu, Kerui, et autres
Publié: (2024)
par: Zhu, Kerui, et autres
Publié: (2024)
Hyper-Connections
par: Zhu, Defa, et autres
Publié: (2024)
par: Zhu, Defa, et autres
Publié: (2024)
LoRA-Squeeze: Simple and Effective Post-Tuning and In-Tuning Compression of LoRA Modules
par: Vulić, Ivan, et autres
Publié: (2026)
par: Vulić, Ivan, et autres
Publié: (2026)
HyperEdit: Unlocking Instruction-based Text Editing in LLMs via Hypernetworks
par: Zeng, Yiming, et autres
Publié: (2025)
par: Zeng, Yiming, et autres
Publié: (2025)
Confident in a Confidence Score: Investigating the Sensitivity of Confidence Scores to Supervised Fine-Tuning
par: Flores, Lorenzo Jaime Yu, et autres
Publié: (2026)
par: Flores, Lorenzo Jaime Yu, et autres
Publié: (2026)
Agent-FLAN: Designing Data and Methods of Effective Agent Tuning for Large Language Models
par: Chen, Zehui, et autres
Publié: (2024)
par: Chen, Zehui, et autres
Publié: (2024)
Self-Tuning: Instructing LLMs to Effectively Acquire New Knowledge through Self-Teaching
par: Zhang, Xiaoying, et autres
Publié: (2024)
par: Zhang, Xiaoying, et autres
Publié: (2024)
Investigating the Multilingual Calibration Effects of Language Model Instruction-Tuning
par: Huang, Jerry, et autres
Publié: (2026)
par: Huang, Jerry, et autres
Publié: (2026)
HyperCLOVA X Technical Report
par: Yoo, Kang Min, et autres
Publié: (2024)
par: Yoo, Kang Min, et autres
Publié: (2024)
Is Fine-Tuning an Effective Solution? Reassessing Knowledge Editing for Unstructured Data
par: Xiong, Hao, et autres
Publié: (2025)
par: Xiong, Hao, et autres
Publié: (2025)
Investigating the Impact of Language-Adaptive Fine-Tuning on Sentiment Analysis in Hausa Language Using AfriBERTa
par: Sani, Sani Abdullahi, et autres
Publié: (2025)
par: Sani, Sani Abdullahi, et autres
Publié: (2025)
Instruction Matters: A Simple yet Effective Task Selection for Optimized Instruction Tuning of Specific Tasks
par: Lee, Changho, et autres
Publié: (2024)
par: Lee, Changho, et autres
Publié: (2024)
MoDE: Effective Multi-task Parameter Efficient Fine-Tuning with a Mixture of Dyadic Experts
par: Ning, Lin, et autres
Publié: (2024)
par: Ning, Lin, et autres
Publié: (2024)
Documents similaires
-
GistScore: Learning Better Representations for In-Context Example Selection with Gist Bottlenecks
par: Gupta, Shivanshu, et autres
Publié: (2023) -
Compressing Lengthy Context With UltraGist
par: Zhang, Peitian, et autres
Publié: (2024) -
Learning to Compress Prompts with Gist Tokens
par: Mu, Jesse, et autres
Publié: (2023) -
Sentence-Anchored Gist Compression for Long-Context LLMs
par: Tarasov, Dmitrii, et autres
Publié: (2025) -
SciGisPy: a Novel Metric for Biomedical Text Simplification via Gist Inference Score
par: Lyu, Chen, et autres
Publié: (2024)