Guardado en:
| Autor principal: | Zhou, Xiaofan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2312.10259 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Genetic Instruct: Scaling up Synthetic Generation of Coding Instructions for Large Language Models
por: Majumdar, Somshubra, et al.
Publicado: (2024)
por: Majumdar, Somshubra, et al.
Publicado: (2024)
SpikeGPT: Generative Pre-trained Language Model with Spiking Neural Networks
por: Zhu, Rui-Jie, et al.
Publicado: (2023)
por: Zhu, Rui-Jie, et al.
Publicado: (2023)
SpikeLM: Towards General Spike-Driven Language Modeling via Elastic Bi-Spiking Mechanisms
por: Xing, Xingrun, et al.
Publicado: (2024)
por: Xing, Xingrun, et al.
Publicado: (2024)
Large Language Models Suffer From Their Own Output: An Analysis of the Self-Consuming Training Loop
por: Briesch, Martin, et al.
Publicado: (2023)
por: Briesch, Martin, et al.
Publicado: (2023)
SwitchHead: Accelerating Transformers with Mixture-of-Experts Attention
por: Csordás, Róbert, et al.
Publicado: (2023)
por: Csordás, Róbert, et al.
Publicado: (2023)
Improving Language Plasticity via Pretraining with Active Forgetting
por: Chen, Yihong, et al.
Publicado: (2023)
por: Chen, Yihong, et al.
Publicado: (2023)
EvolKV: Evolutionary KV Cache Compression for LLM Inference
por: Yu, Bohan, et al.
Publicado: (2025)
por: Yu, Bohan, et al.
Publicado: (2025)
Decomposing Evolutionary Mixture-of-LoRA Architectures: The Routing Lever, the Lifecycle Penalty, and a Substrate-Conditional Boundary
por: Kumaresan, Ramchand
Publicado: (2026)
por: Kumaresan, Ramchand
Publicado: (2026)
An In-depth Walkthrough on Evolution of Neural Machine Translation
por: Jagtap, Rohan, et al.
Publicado: (2020)
por: Jagtap, Rohan, et al.
Publicado: (2020)
Pruner-Zero: Evolving Symbolic Pruning Metric from scratch for Large Language Models
por: Dong, Peijie, et al.
Publicado: (2024)
por: Dong, Peijie, et al.
Publicado: (2024)
Hysteresis Activation Function for Efficient Inference
por: Kimhi, Moshe, et al.
Publicado: (2024)
por: Kimhi, Moshe, et al.
Publicado: (2024)
Pre-trained Language Models Learn Remarkably Accurate Representations of Numbers
por: Kadlčík, Marek, et al.
Publicado: (2025)
por: Kadlčík, Marek, et al.
Publicado: (2025)
Large Language Models for Tuning Evolution Strategies
por: Kramer, Oliver
Publicado: (2024)
por: Kramer, Oliver
Publicado: (2024)
AP-BMM: Approximating Capability-Cost Pareto Sets of LLMs via Asynchronous Prior-Guided Bayesian Model Merging
por: Chen, Kesheng, et al.
Publicado: (2025)
por: Chen, Kesheng, et al.
Publicado: (2025)
On the Power of Convolution Augmented Transformer
por: Li, Mingchen, et al.
Publicado: (2024)
por: Li, Mingchen, et al.
Publicado: (2024)
A Hormone-inspired Emotion Layer for Transformer language models (HELT)
por: Reda, Eslam, et al.
Publicado: (2026)
por: Reda, Eslam, et al.
Publicado: (2026)
HAT: Hardware-Aware Transformers for Efficient Natural Language Processing
por: Wang, Hanrui, et al.
Publicado: (2020)
por: Wang, Hanrui, et al.
Publicado: (2020)
SpikingSSMs: Learning Long Sequences with Sparse and Parallel Spiking State Space Models
por: Shen, Shuaijie, et al.
Publicado: (2024)
por: Shen, Shuaijie, et al.
Publicado: (2024)
Sorbet: A Neuromorphic Hardware-Compatible Transformer-Based Spiking Language Model
por: Tang, Kaiwen, et al.
Publicado: (2024)
por: Tang, Kaiwen, et al.
Publicado: (2024)
An enhanced Teaching-Learning-Based Optimization (TLBO) with Grey Wolf Optimizer (GWO) for text feature selection and clustering
por: Azarshab, Mahsa, et al.
Publicado: (2024)
por: Azarshab, Mahsa, et al.
Publicado: (2024)
SpikeLLM: Scaling up Spiking Neural Network to Large Language Models via Saliency-based Spiking
por: Xing, Xingrun, et al.
Publicado: (2024)
por: Xing, Xingrun, et al.
Publicado: (2024)
EvoX: Meta-Evolution for Automated Discovery
por: Liu, Shu, et al.
Publicado: (2026)
por: Liu, Shu, et al.
Publicado: (2026)
Intelligent Neural Networks: From Layered Architectures to Graph-Organized Intelligence
por: Salomon, Antoine
Publicado: (2025)
por: Salomon, Antoine
Publicado: (2025)
BrainTransformers: SNN-LLM
por: Tang, Zhengzheng, et al.
Publicado: (2024)
por: Tang, Zhengzheng, et al.
Publicado: (2024)
Why Prompt Optimization Works, and Why It Sometimes Doesn't: A Causal-Inspired Edit-Level Analysis
por: Gong, Shuzhi, et al.
Publicado: (2026)
por: Gong, Shuzhi, et al.
Publicado: (2026)
Improving Sequence-to-Sequence Models for Abstractive Text Summarization Using Meta Heuristic Approaches
por: Saxena, Aditya, et al.
Publicado: (2024)
por: Saxena, Aditya, et al.
Publicado: (2024)
B'MOJO: Hybrid State Space Realizations of Foundation Models with Eidetic and Fading Memory
por: Zancato, Luca, et al.
Publicado: (2024)
por: Zancato, Luca, et al.
Publicado: (2024)
Neural Information Organizing and Processing -- Neural Machines
por: Petrila, Iosif Iulian
Publicado: (2024)
por: Petrila, Iosif Iulian
Publicado: (2024)
Enhancing Generalization in Evolutionary Feature Construction for Symbolic Regression through Vicinal Jensen Gap Minimization
por: Zhang, Hengzhe, et al.
Publicado: (2026)
por: Zhang, Hengzhe, et al.
Publicado: (2026)
Lifelong Intelligence Beyond the Edge using Hyperdimensional Computing
por: Yu, Xiaofan, et al.
Publicado: (2024)
por: Yu, Xiaofan, et al.
Publicado: (2024)
AgenticGEO: A Self-Evolving Agentic System for Generative Engine Optimization
por: Yuan, Jiaqi, et al.
Publicado: (2026)
por: Yuan, Jiaqi, et al.
Publicado: (2026)
Detect and Act: Automated Dynamic Optimizer through Meta-Black-Box Optimization
por: Gao, Zijian, et al.
Publicado: (2026)
por: Gao, Zijian, et al.
Publicado: (2026)
Recent Advances in Federated Learning Driven Large Language Models: A Survey on Architecture, Performance, and Security
por: Qu, Youyang, et al.
Publicado: (2024)
por: Qu, Youyang, et al.
Publicado: (2024)
Generative Design through Quality-Diversity Data Synthesis and Language Models
por: Gaier, Adam, et al.
Publicado: (2024)
por: Gaier, Adam, et al.
Publicado: (2024)
Combining General and Personalized Models for Epilepsy Detection with Hyperdimensional Computing
por: Pale, Una, et al.
Publicado: (2023)
por: Pale, Una, et al.
Publicado: (2023)
Symbol: Generating Flexible Black-Box Optimizers through Symbolic Equation Learning
por: Chen, Jiacheng, et al.
Publicado: (2024)
por: Chen, Jiacheng, et al.
Publicado: (2024)
Generalization Bounds and Model Complexity for Kolmogorov-Arnold Networks
por: Zhang, Xianyang, et al.
Publicado: (2024)
por: Zhang, Xianyang, et al.
Publicado: (2024)
Meta-Black-Box-Optimization through Offline Q-function Learning
por: Ma, Zeyuan, et al.
Publicado: (2025)
por: Ma, Zeyuan, et al.
Publicado: (2025)
Active Sensing with Predictive Coding and Uncertainty Minimization
por: Sharafeldin, Abdelrahman, et al.
Publicado: (2023)
por: Sharafeldin, Abdelrahman, et al.
Publicado: (2023)
Boosting Brain-inspired Path Integration Efficiency via Learning-based Replication of Continuous Attractor Neurodynamics
por: Ge, Zhangyu, et al.
Publicado: (2025)
por: Ge, Zhangyu, et al.
Publicado: (2025)
Ejemplares similares
-
Genetic Instruct: Scaling up Synthetic Generation of Coding Instructions for Large Language Models
por: Majumdar, Somshubra, et al.
Publicado: (2024) -
SpikeGPT: Generative Pre-trained Language Model with Spiking Neural Networks
por: Zhu, Rui-Jie, et al.
Publicado: (2023) -
SpikeLM: Towards General Spike-Driven Language Modeling via Elastic Bi-Spiking Mechanisms
por: Xing, Xingrun, et al.
Publicado: (2024) -
Large Language Models Suffer From Their Own Output: An Analysis of the Self-Consuming Training Loop
por: Briesch, Martin, et al.
Publicado: (2023) -
SwitchHead: Accelerating Transformers with Mixture-of-Experts Attention
por: Csordás, Róbert, et al.
Publicado: (2023)