Switchable Decision: Dynamic Neural Generation Networks
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Shujian, Tanwisuth, Korawat, Gong, Chengyue, He, Pengcheng, Zhou, Mingyuan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Language Rectified Flow: Advancing Diffusion Language Generation with Probabilistic Flows
por: Zhang, Shujian, et al.
Publicado: (2024)
por: Zhang, Shujian, et al.
Publicado: (2024)
SABER: Switchable and Balanced Training for Efficient LLM Reasoning
por: Zhao, Kai, et al.
Publicado: (2025)
por: Zhao, Kai, et al.
Publicado: (2025)
T-REG: Preference Optimization with Token-Level Reward Regularization
por: Zhou, Wenxuan, et al.
Publicado: (2024)
por: Zhou, Wenxuan, et al.
Publicado: (2024)
DLM-One: Diffusion Language Models for One-Step Sequence Generation
por: Chen, Tianqi, et al.
Publicado: (2025)
por: Chen, Tianqi, et al.
Publicado: (2025)
SFTMix: Elevating Language Model Instruction Tuning with Mixup Recipe
por: Xiao, Yuxin, et al.
Publicado: (2024)
por: Xiao, Yuxin, et al.
Publicado: (2024)
Seeking Neural Nuggets: Knowledge Transfer in Large Language Models from a Parametric Perspective
por: Zhong, Ming, et al.
Publicado: (2023)
por: Zhong, Ming, et al.
Publicado: (2023)
CharPoet: A Chinese Classical Poetry Generation System Based on Token-free LLM
por: Yu, Chengyue, et al.
Publicado: (2024)
por: Yu, Chengyue, et al.
Publicado: (2024)
InfLLM-V2: Dense-Sparse Switchable Attention for Seamless Short-to-Long Adaptation
por: Zhao, Weilin, et al.
Publicado: (2025)
por: Zhao, Weilin, et al.
Publicado: (2025)
Fantastic Reasoning Behaviors and Where to Find Them: Unsupervised Discovery of the Reasoning Process
por: Zhang, Zhenyu, et al.
Publicado: (2025)
por: Zhang, Zhenyu, et al.
Publicado: (2025)
KodCode: A Diverse, Challenging, and Verifiable Synthetic Dataset for Coding
por: Xu, Zhangchen, et al.
Publicado: (2025)
por: Xu, Zhangchen, et al.
Publicado: (2025)
WPO: Enhancing RLHF with Weighted Preference Optimization
por: Zhou, Wenxuan, et al.
Publicado: (2024)
por: Zhou, Wenxuan, et al.
Publicado: (2024)
Prune-Quantize-Distill: An Ordered Pipeline for Efficient Neural Network Compression
por: Zhou, Longsheng, et al.
Publicado: (2026)
por: Zhou, Longsheng, et al.
Publicado: (2026)
Improving Data Efficiency for LLM Reinforcement Fine-tuning Through Difficulty-targeted Online Data Selection and Rollout Replay
por: Sun, Yifan, et al.
Publicado: (2025)
por: Sun, Yifan, et al.
Publicado: (2025)
Guided Score identity Distillation for Data-Free One-Step Text-to-Image Generation
por: Zhou, Mingyuan, et al.
Publicado: (2024)
por: Zhou, Mingyuan, et al.
Publicado: (2024)
Relative Preference Optimization: Enhancing LLM Alignment through Contrasting Responses across Identical and Diverse Prompts
por: Yin, Yueqin, et al.
Publicado: (2024)
por: Yin, Yueqin, et al.
Publicado: (2024)
Interactive Training: Feedback-Driven Neural Network Optimization
por: Zhang, Wentao, et al.
Publicado: (2025)
por: Zhang, Wentao, et al.
Publicado: (2025)
Affective and Dynamic Beam Search for Story Generation
por: Huang, Tenghao, et al.
Publicado: (2023)
por: Huang, Tenghao, et al.
Publicado: (2023)
DrKGC: Dynamic Subgraph Retrieval-Augmented LLMs for Knowledge Graph Completion across General and Biomedical Domains
por: Xiao, Yongkang, et al.
Publicado: (2025)
por: Xiao, Yongkang, et al.
Publicado: (2025)
Boosting Large Language Models with Mask Fine-Tuning
por: Zhang, Mingyuan, et al.
Publicado: (2025)
por: Zhang, Mingyuan, et al.
Publicado: (2025)
Deception Detection from Linguistic and Physiological Data Streams Using Bimodal Convolutional Neural Networks
por: Li, Panfeng, et al.
Publicado: (2023)
por: Li, Panfeng, et al.
Publicado: (2023)
DoLa: Decoding by Contrasting Layers Improves Factuality in Large Language Models
por: Chuang, Yung-Sung, et al.
Publicado: (2023)
por: Chuang, Yung-Sung, et al.
Publicado: (2023)
MAPS: Preserving Vision-Language Representations via Module-Wise Proximity Scheduling for Better Vision-Language-Action Generalization
por: Huang, Chengyue, et al.
Publicado: (2025)
por: Huang, Chengyue, et al.
Publicado: (2025)
Building a Foundational Guardrail for General Agentic Systems via Synthetic Data
por: Huang, Yue, et al.
Publicado: (2025)
por: Huang, Yue, et al.
Publicado: (2025)
RichSpace: Enriching Text-to-Video Prompt Space via Text Embedding Interpolation
por: Cao, Yuefan, et al.
Publicado: (2025)
por: Cao, Yuefan, et al.
Publicado: (2025)
GL-Fusion: Rethinking the Combination of Graph Neural Network and Large Language model
por: Yang, Haotong, et al.
Publicado: (2024)
por: Yang, Haotong, et al.
Publicado: (2024)
Building Decision Making Models Through Language Model Regime
por: Zhang, Yu, et al.
Publicado: (2024)
por: Zhang, Yu, et al.
Publicado: (2024)
Forking Paths in Neural Text Generation
por: Bigelow, Eric, et al.
Publicado: (2024)
por: Bigelow, Eric, et al.
Publicado: (2024)
LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations
por: Mayne, Harry, et al.
Publicado: (2025)
por: Mayne, Harry, et al.
Publicado: (2025)
A Graph-Retrieval-Augmented Generation Framework Enhances Decision-Making in the Circular Economy
por: Zhao, Yang, et al.
Publicado: (2025)
por: Zhao, Yang, et al.
Publicado: (2025)
Skin-in-the-Game: Decision Making via Multi-Stakeholder Alignment in LLMs
por: Sel, Bilgehan, et al.
Publicado: (2024)
por: Sel, Bilgehan, et al.
Publicado: (2024)
Disentangling Feature Structure: A Mathematically Provable Two-Stage Training Dynamics in Transformers
por: Gong, Zixuan, et al.
Publicado: (2025)
por: Gong, Zixuan, et al.
Publicado: (2025)
Empirical Capacity Model for Self-Attention Neural Networks
por: Härmä, Aki, et al.
Publicado: (2024)
por: Härmä, Aki, et al.
Publicado: (2024)
Tucano: Advancing Neural Text Generation for Portuguese
por: Corrêa, Nicholas Kluge, et al.
Publicado: (2024)
por: Corrêa, Nicholas Kluge, et al.
Publicado: (2024)
FRAMES-VQA: Benchmarking Fine-Tuning Robustness across Multi-Modal Shifts in Visual Question Answering
por: Huang, Chengyue, et al.
Publicado: (2025)
por: Huang, Chengyue, et al.
Publicado: (2025)
Domain Gating Ensemble Networks for AI-Generated Text Detection
por: Tripathi, Arihant, et al.
Publicado: (2025)
por: Tripathi, Arihant, et al.
Publicado: (2025)
ME-Switch: A Memory-Efficient Expert Switching Framework for Large Language Models
por: Liu, Jing, et al.
Publicado: (2024)
por: Liu, Jing, et al.
Publicado: (2024)
DynamixSFT: Dynamic Mixture Optimization of Instruction Tuning Collections
por: Shin, Haebin, et al.
Publicado: (2025)
por: Shin, Haebin, et al.
Publicado: (2025)
$\textbf{Only-IF}$:Revealing the Decisive Effect of Instruction Diversity on Generalization
por: Zhang, Dylan, et al.
Publicado: (2024)
por: Zhang, Dylan, et al.
Publicado: (2024)
KORGym: A Dynamic Game Platform for LLM Reasoning Evaluation
por: Shi, Jiajun, et al.
Publicado: (2025)
por: Shi, Jiajun, et al.
Publicado: (2025)
On the Effectiveness and Generalization of Race Representations for Debiasing High-Stakes Decisions
por: Nguyen, Dang, et al.
Publicado: (2025)
por: Nguyen, Dang, et al.
Publicado: (2025)
Ejemplares similares
-
Language Rectified Flow: Advancing Diffusion Language Generation with Probabilistic Flows
por: Zhang, Shujian, et al.
Publicado: (2024) -
SABER: Switchable and Balanced Training for Efficient LLM Reasoning
por: Zhao, Kai, et al.
Publicado: (2025) -
T-REG: Preference Optimization with Token-Level Reward Regularization
por: Zhou, Wenxuan, et al.
Publicado: (2024) -
DLM-One: Diffusion Language Models for One-Step Sequence Generation
por: Chen, Tianqi, et al.
Publicado: (2025) -
SFTMix: Elevating Language Model Instruction Tuning with Mixup Recipe
por: Xiao, Yuxin, et al.
Publicado: (2024)