Divide, Reweight, and Conquer: A Logit Arithmetic Approach for In-Context Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Chengsong, Huang, Langlin, Huang, Jiaxin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
POSS: Position Specialist Generates Better Draft for Speculative Decoding
por: Huang, Langlin, et al.
Publicado: (2025)
por: Huang, Langlin, et al.
Publicado: (2025)
Efficient Test-Time Scaling via Self-Calibration
por: Huang, Chengsong, et al.
Publicado: (2025)
por: Huang, Chengsong, et al.
Publicado: (2025)
RelayLLM: Efficient Reasoning via Collaborative Decoding
por: Huang, Chengsong, et al.
Publicado: (2026)
por: Huang, Chengsong, et al.
Publicado: (2026)
Nonsense Helps: Prompt Space Perturbation Broadens Reasoning Exploration
por: Huang, Langlin, et al.
Publicado: (2026)
por: Huang, Langlin, et al.
Publicado: (2026)
Process Rewards with Learned Reliability
por: Li, Jinyuan, et al.
Publicado: (2026)
por: Li, Jinyuan, et al.
Publicado: (2026)
G-Zero: Self-Play for Open-Ended Generation from Zero Data
por: Huang, Chengsong, et al.
Publicado: (2026)
por: Huang, Chengsong, et al.
Publicado: (2026)
VisPlay: Self-Evolving Vision-Language Models from Images
por: He, Yicheng, et al.
Publicado: (2025)
por: He, Yicheng, et al.
Publicado: (2025)
An Examination on the Effectiveness of Divide-and-Conquer Prompting in Large Language Models
por: Zhang, Yizhou, et al.
Publicado: (2024)
por: Zhang, Yizhou, et al.
Publicado: (2024)
Training Data Efficiency in Multimodal Process Reward Models
por: Li, Jinyuan, et al.
Publicado: (2026)
por: Li, Jinyuan, et al.
Publicado: (2026)
Divide (Text) and Conquer (Sentiment): Improved Sentiment Classification by Constituent Conflict Resolution
por: Kościałkowski, Jan, et al.
Publicado: (2025)
por: Kościałkowski, Jan, et al.
Publicado: (2025)
R-Zero: Self-Evolving Reasoning LLM from Zero Data
por: Huang, Chengsong, et al.
Publicado: (2025)
por: Huang, Chengsong, et al.
Publicado: (2025)
More is not always better? Enhancing Many-Shot In-Context Learning with Differentiated and Reweighting Objectives
por: Zhang, Xiaoqing, et al.
Publicado: (2025)
por: Zhang, Xiaoqing, et al.
Publicado: (2025)
Aligning Frozen LLMs by Reinforcement Learning: An Iterative Reweight-then-Optimize Approach
por: Zhang, Xinnan, et al.
Publicado: (2025)
por: Zhang, Xinnan, et al.
Publicado: (2025)
CrossWordBench: Evaluating the Reasoning Capabilities of LLMs and LVLMs with Controllable Puzzle Generation
por: Leng, Jixuan, et al.
Publicado: (2025)
por: Leng, Jixuan, et al.
Publicado: (2025)
MMR-GRPO: Accelerating GRPO-Style Training through Diversity-Aware Reward Reweighting
por: Wei, Kangda, et al.
Publicado: (2026)
por: Wei, Kangda, et al.
Publicado: (2026)
GEAR: Granularity-Adaptive Advantage Reweighting for LLM Agents via Self-Distillation
por: Li, Sijia, et al.
Publicado: (2026)
por: Li, Sijia, et al.
Publicado: (2026)
Inferring from Logits: Exploring Best Practices for Decoding-Free Generative Candidate Selection
por: Ma, Mingyu Derek, et al.
Publicado: (2025)
por: Ma, Mingyu Derek, et al.
Publicado: (2025)
The Role of Diversity in In-Context Learning for Large Language Models
por: Xiao, Wenyang, et al.
Publicado: (2025)
por: Xiao, Wenyang, et al.
Publicado: (2025)
Guided Self-Evolving LLMs with Minimal Human Supervision
por: Yu, Wenhao, et al.
Publicado: (2025)
por: Yu, Wenhao, et al.
Publicado: (2025)
Spectral Logit Sculpting: Adaptive Low-Rank Logit Transformation for Controlled Text Generation
por: Li, Jin, et al.
Publicado: (2025)
por: Li, Jin, et al.
Publicado: (2025)
TTCS: Test-Time Curriculum Synthesis for Self-Evolving
por: Yang, Chengyi, et al.
Publicado: (2026)
por: Yang, Chengyi, et al.
Publicado: (2026)
How Well Can a Long Sequence Model Model Long Sequences? Comparing Architechtural Inductive Biases on Long-Context Abilities
por: Huang, Jerry
Publicado: (2024)
por: Huang, Jerry
Publicado: (2024)
DoGE: Domain Reweighting with Generalization Estimation
por: Fan, Simin, et al.
Publicado: (2023)
por: Fan, Simin, et al.
Publicado: (2023)
Logit Reweighting for Topic-Focused Summarization
por: Braun, Joschka, et al.
Publicado: (2025)
por: Braun, Joschka, et al.
Publicado: (2025)
RAVEN: In-Context Learning with Retrieval-Augmented Encoder-Decoder Language Models
por: Huang, Jie, et al.
Publicado: (2023)
por: Huang, Jie, et al.
Publicado: (2023)
Logits are All We Need to Adapt Closed Models
por: Hiranandani, Gaurush, et al.
Publicado: (2025)
por: Hiranandani, Gaurush, et al.
Publicado: (2025)
Filter-then-Weight: Online Data Selection and Reweighting for LLM Fine-Tuning
por: Wang, Fangxin, et al.
Publicado: (2026)
por: Wang, Fangxin, et al.
Publicado: (2026)
Comprehend, Divide, and Conquer: Feature Subspace Exploration via Multi-Agent Hierarchical Reinforcement Learning
por: Zhang, Weiliang, et al.
Publicado: (2025)
por: Zhang, Weiliang, et al.
Publicado: (2025)
Taming Extreme Tokens: Covariance-Aware GRPO with Gaussian-Kernel Advantage Reweighting
por: Wang, Cheng, et al.
Publicado: (2026)
por: Wang, Cheng, et al.
Publicado: (2026)
On Giant's Shoulders: Effortless Weak to Strong by Dynamic Logits Fusion
por: Fan, Chenghao, et al.
Publicado: (2024)
por: Fan, Chenghao, et al.
Publicado: (2024)
Sequences of Logits Reveal the Low Rank Structure of Language Models
por: Golowich, Noah, et al.
Publicado: (2025)
por: Golowich, Noah, et al.
Publicado: (2025)
Integrating Arithmetic Learning Improves Mathematical Reasoning in Smaller Models
por: Gangwar, Neeraj, et al.
Publicado: (2025)
por: Gangwar, Neeraj, et al.
Publicado: (2025)
Transitive RL: Value Learning via Divide and Conquer
por: Park, Seohong, et al.
Publicado: (2025)
por: Park, Seohong, et al.
Publicado: (2025)
Context-Aware Initialization for Reducing Generative Path Length in Diffusion Language Models
por: Miao, Tongyuan, et al.
Publicado: (2025)
por: Miao, Tongyuan, et al.
Publicado: (2025)
Divide-Then-Aggregate: An Efficient Tool Learning Method via Parallel Tool Invocation
por: Zhu, Dongsheng, et al.
Publicado: (2025)
por: Zhu, Dongsheng, et al.
Publicado: (2025)
Decomposing Representation Space into Interpretable Subspaces with Unsupervised Learning
por: Huang, Xinting, et al.
Publicado: (2025)
por: Huang, Xinting, et al.
Publicado: (2025)
Out-of-Domain Intent Detection Considering Multi-Turn Dialogue Contexts
por: Lang, Hao, et al.
Publicado: (2023)
por: Lang, Hao, et al.
Publicado: (2023)
DCR-Consistency: Divide-Conquer-Reasoning for Consistency Evaluation and Improvement of Large Language Models
por: Cui, Wendi, et al.
Publicado: (2024)
por: Cui, Wendi, et al.
Publicado: (2024)
Language Models Do Hard Arithmetic Tasks Easily and Hardly Do Easy Arithmetic Tasks
por: Gambardella, Andrew, et al.
Publicado: (2024)
por: Gambardella, Andrew, et al.
Publicado: (2024)
LongSafety: Enhance Safety for Long-Context LLMs
por: Huang, Mianqiu, et al.
Publicado: (2024)
por: Huang, Mianqiu, et al.
Publicado: (2024)
Ejemplares similares
-
POSS: Position Specialist Generates Better Draft for Speculative Decoding
por: Huang, Langlin, et al.
Publicado: (2025) -
Efficient Test-Time Scaling via Self-Calibration
por: Huang, Chengsong, et al.
Publicado: (2025) -
RelayLLM: Efficient Reasoning via Collaborative Decoding
por: Huang, Chengsong, et al.
Publicado: (2026) -
Nonsense Helps: Prompt Space Perturbation Broadens Reasoning Exploration
por: Huang, Langlin, et al.
Publicado: (2026) -
Process Rewards with Learned Reliability
por: Li, Jinyuan, et al.
Publicado: (2026)