W-PCA Based Gradient-Free Proxy for Efficient Search of Lightweight Language Models
Fuente:
arXiv
Saved in:
| Main Author: | Wang, Shang |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Elastic Architecture Search for Efficient Language Models
by: Wang, Shang
Published: (2025)
by: Wang, Shang
Published: (2025)
A Transformer-based Neural Architecture Search Method
by: Wang, Shang, et al.
Published: (2025)
by: Wang, Shang, et al.
Published: (2025)
MAR: Efficient Large Language Models via Module-aware Architecture Refinement
by: Cai, Junhong, et al.
Published: (2026)
by: Cai, Junhong, et al.
Published: (2026)
H-Node Attack and Defense in Large Language Models
by: Yocam, Eric, et al.
Published: (2026)
by: Yocam, Eric, et al.
Published: (2026)
Evaluating Large Language Models with Grid-Based Game Competitions: An Extensible LLM Benchmark and Leaderboard
by: Topsakal, Oguzhan, et al.
Published: (2024)
by: Topsakal, Oguzhan, et al.
Published: (2024)
Diffusion Language Models for Speech Recognition
by: Naveriani, Davyd, et al.
Published: (2026)
by: Naveriani, Davyd, et al.
Published: (2026)
When Large Language Models Meet Evolutionary Algorithms: Potential Enhancements and Challenges
by: Wang, Chao, et al.
Published: (2024)
by: Wang, Chao, et al.
Published: (2024)
Hyperbolic Fine-Tuning for Large Language Models
by: Yang, Menglin, et al.
Published: (2024)
by: Yang, Menglin, et al.
Published: (2024)
EvoMerge: Neuroevolution for Large Language Models
by: Jiang, Yushu
Published: (2024)
by: Jiang, Yushu
Published: (2024)
Solve the Loop: Attractor Models for Language and Reasoning
by: Fein-Ashley, Jacob, et al.
Published: (2026)
by: Fein-Ashley, Jacob, et al.
Published: (2026)
Large Language Models and Emergence: A Complex Systems Perspective
by: Krakauer, David C., et al.
Published: (2025)
by: Krakauer, David C., et al.
Published: (2025)
Fleet of Agents: Coordinated Problem Solving with Large Language Models
by: Klein, Lars, et al.
Published: (2024)
by: Klein, Lars, et al.
Published: (2024)
Vector Policy Optimization: Training for Diversity Improves Test-Time Search
by: Bahlous-Boldi, Ryan, et al.
Published: (2026)
by: Bahlous-Boldi, Ryan, et al.
Published: (2026)
Compute Allocation in Evolutionary Search: From Depth-Breadth to Multi-Armed Bandits
by: Xing, Sixue, et al.
Published: (2026)
by: Xing, Sixue, et al.
Published: (2026)
Assessing the Emergent Symbolic Reasoning Abilities of Llama Large Language Models
by: Petruzzellis, Flavio, et al.
Published: (2024)
by: Petruzzellis, Flavio, et al.
Published: (2024)
Analysis of Error Sources in LLM-based Hypothesis Search for Few-Shot Rule Induction
by: Parab, Aishni, et al.
Published: (2025)
by: Parab, Aishni, et al.
Published: (2025)
Evolutionary Multi-Objective Optimization of Large Language Model Prompts for Balancing Sentiments
by: Baumann, Jill, et al.
Published: (2024)
by: Baumann, Jill, et al.
Published: (2024)
LLM-SR: Scientific Equation Discovery via Programming with Large Language Models
by: Shojaee, Parshin, et al.
Published: (2024)
by: Shojaee, Parshin, et al.
Published: (2024)
Fine-Tuning and Evaluating Open-Source Large Language Models for the Army Domain
by: Ruiz, Daniel C., et al.
Published: (2024)
by: Ruiz, Daniel C., et al.
Published: (2024)
Language Models Learn Universal Representations of Numbers and Here's Why You Should Care
by: Štefánik, Michal, et al.
Published: (2025)
by: Štefánik, Michal, et al.
Published: (2025)
Recent Advances in Federated Learning Driven Large Language Models: A Survey on Architecture, Performance, and Security
by: Qu, Youyang, et al.
Published: (2024)
by: Qu, Youyang, et al.
Published: (2024)
Parameter-Efficient Fine-Tuning of LLMs with Mixture of Space Experts
by: Zhang, Buze, et al.
Published: (2026)
by: Zhang, Buze, et al.
Published: (2026)
Leave No Context Behind: Efficient Infinite Context Transformers with Infini-attention
by: Munkhdalai, Tsendsuren, et al.
Published: (2024)
by: Munkhdalai, Tsendsuren, et al.
Published: (2024)
EvoGPT-f: An Evolutionary GPT Framework for Benchmarking Formal Math Languages
by: Mercer, Johnathan
Published: (2024)
by: Mercer, Johnathan
Published: (2024)
Offline Model-Based Optimization by Learning to Rank
by: Tan, Rong-Xi, et al.
Published: (2024)
by: Tan, Rong-Xi, et al.
Published: (2024)
Beyond Scale: The Diversity Coefficient as a Data Quality Metric for Variability in Natural Language Data
by: Miranda, Brando, et al.
Published: (2023)
by: Miranda, Brando, et al.
Published: (2023)
Gradient-Free Training of Spiking Neural Networks via Low-Rank Evolution Strategies
by: Patankar, Dhruv, et al.
Published: (2026)
by: Patankar, Dhruv, et al.
Published: (2026)
ToxSearch: Evolving Prompts for Toxicity Search in Large Language Models
by: Shelar, Onkar, et al.
Published: (2025)
by: Shelar, Onkar, et al.
Published: (2025)
Do Language Models Use Their Depth Efficiently?
by: Csordás, Róbert, et al.
Published: (2025)
by: Csordás, Róbert, et al.
Published: (2025)
Topic Modelling Black Box Optimization
by: Akramov, Roman, et al.
Published: (2025)
by: Akramov, Roman, et al.
Published: (2025)
Gradient-Free Continual Learning in Spiking Neural Networks via Inter-Spike Interval Regularization
by: Roy, Samrendra, et al.
Published: (2026)
by: Roy, Samrendra, et al.
Published: (2026)
GLU Attention Improve Transformer
by: Wang, Zehao
Published: (2025)
by: Wang, Zehao
Published: (2025)
Jailbreaking LLMs' Safeguard with Universal Magic Words for Text Embedding Models
by: Liang, Haoyu, et al.
Published: (2025)
by: Liang, Haoyu, et al.
Published: (2025)
AgenticGEO: A Self-Evolving Agentic System for Generative Engine Optimization
by: Yuan, Jiaqi, et al.
Published: (2026)
by: Yuan, Jiaqi, et al.
Published: (2026)
Accelerating Training Speed of Tiny Recursive Models with Curriculum Guided Adaptive Recursion
by: Qasim, Kaleem Ullah, et al.
Published: (2025)
by: Qasim, Kaleem Ullah, et al.
Published: (2025)
BiSpikCLM: A Spiking Language Model integrating Softmax-Free Spiking Attention and Spike-Aware Alignment Distillation
by: Guo, Sihang, et al.
Published: (2026)
by: Guo, Sihang, et al.
Published: (2026)
Combining Large Language Models and Gradient-Free Optimization for Automatic Control Policy Synthesis
by: Bosio, Carlo, et al.
Published: (2025)
by: Bosio, Carlo, et al.
Published: (2025)
Efficient Evolutionary Search Over Chemical Space with Large Language Models
by: Wang, Haorui, et al.
Published: (2024)
by: Wang, Haorui, et al.
Published: (2024)
Toward Preference-aligned Large Language Models via Residual-based Model Steering
by: La Cava, Lucio, et al.
Published: (2025)
by: La Cava, Lucio, et al.
Published: (2025)
QSLM: A Performance- and Memory-aware Quantization Framework with Tiered Search Strategy for Spike-driven Language Models
by: Putra, Rachmad Vidya Wicaksana, et al.
Published: (2026)
by: Putra, Rachmad Vidya Wicaksana, et al.
Published: (2026)
Similar Items
-
Elastic Architecture Search for Efficient Language Models
by: Wang, Shang
Published: (2025) -
A Transformer-based Neural Architecture Search Method
by: Wang, Shang, et al.
Published: (2025) -
MAR: Efficient Large Language Models via Module-aware Architecture Refinement
by: Cai, Junhong, et al.
Published: (2026) -
H-Node Attack and Defense in Large Language Models
by: Yocam, Eric, et al.
Published: (2026) -
Evaluating Large Language Models with Grid-Based Game Competitions: An Extensible LLM Benchmark and Leaderboard
by: Topsakal, Oguzhan, et al.
Published: (2024)