CoGenesis: A Framework Collaborating Large and Small Language Models for Secure Context-Aware Instruction Following
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Kaiyan, Wang, Jianyu, Hua, Ermo, Qi, Biqing, Ding, Ning, Zhou, Bowen |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Fast and Slow Generating: An Empirical Study on Large and Small Language Models Collaborative Decoding
por: Zhang, Kaiyan, et al.
Publicado: (2024)
por: Zhang, Kaiyan, et al.
Publicado: (2024)
Intuitive Fine-Tuning: Towards Simplifying Alignment into a Single Process
por: Hua, Ermo, et al.
Publicado: (2024)
por: Hua, Ermo, et al.
Publicado: (2024)
Scalable Efficient Training of Large Language Models with Low-dimensional Projected Attention
por: Lv, Xingtai, et al.
Publicado: (2024)
por: Lv, Xingtai, et al.
Publicado: (2024)
Retrieval-Augmented Visual Question Answering via Built-in Autoregressive Search Engines
por: Long, Xinwei, et al.
Publicado: (2025)
por: Long, Xinwei, et al.
Publicado: (2025)
Large Language Models as Biomedical Hypothesis Generators: A Comprehensive Evaluation
por: Qi, Biqing, et al.
Publicado: (2024)
por: Qi, Biqing, et al.
Publicado: (2024)
Towards Building Specialized Generalist AI with System 1 and System 2 Fusion
por: Zhang, Kaiyan, et al.
Publicado: (2024)
por: Zhang, Kaiyan, et al.
Publicado: (2024)
Fourier Position Embedding: Enhancing Attention's Periodic Extension for Length Generalization
por: Hua, Ermo, et al.
Publicado: (2024)
por: Hua, Ermo, et al.
Publicado: (2024)
PaD: Program-aided Distillation Can Teach Small Models Reasoning Better than Chain-of-thought Fine-tuning
por: Zhu, Xuekai, et al.
Publicado: (2023)
por: Zhu, Xuekai, et al.
Publicado: (2023)
UltraMedical: Building Specialized Generalists in Biomedicine
por: Zhang, Kaiyan, et al.
Publicado: (2024)
por: Zhang, Kaiyan, et al.
Publicado: (2024)
How to Synthesize Text Data without Model Collapse?
por: Zhu, Xuekai, et al.
Publicado: (2024)
por: Zhu, Xuekai, et al.
Publicado: (2024)
Instruction-Following Pruning for Large Language Models
por: Hou, Bairu, et al.
Publicado: (2025)
por: Hou, Bairu, et al.
Publicado: (2025)
MedXpertQA: Benchmarking Expert-Level Medical Reasoning and Understanding
por: Zuo, Yuxin, et al.
Publicado: (2025)
por: Zuo, Yuxin, et al.
Publicado: (2025)
Technologies on Effectiveness and Efficiency: A Survey of State Spaces Models
por: Lv, Xingtai, et al.
Publicado: (2025)
por: Lv, Xingtai, et al.
Publicado: (2025)
Online DPO: Online Direct Preference Optimization with Fast-Slow Chasing
por: Qi, Biqing, et al.
Publicado: (2024)
por: Qi, Biqing, et al.
Publicado: (2024)
TTRL: Test-Time Reinforcement Learning
por: Zuo, Yuxin, et al.
Publicado: (2025)
por: Zuo, Yuxin, et al.
Publicado: (2025)
Can 1B LLM Surpass 405B LLM? Rethinking Compute-Optimal Test-Time Scaling
por: Liu, Runze, et al.
Publicado: (2025)
por: Liu, Runze, et al.
Publicado: (2025)
On Large Language Models' Hallucination with Regard to Known Facts
por: Jiang, Che, et al.
Publicado: (2024)
por: Jiang, Che, et al.
Publicado: (2024)
Leveraging Adaptive Group Negotiation for Heterogeneous Multi-Robot Collaboration with Large Language Models
por: Song, Siqi, et al.
Publicado: (2025)
por: Song, Siqi, et al.
Publicado: (2025)
DePass: Unified Feature Attributing by Simple Decomposed Forward Pass
por: Hong, Xiangyu, et al.
Publicado: (2025)
por: Hong, Xiangyu, et al.
Publicado: (2025)
Enhancing Complex Instruction Following for Large Language Models with Mixture-of-Contexts Fine-tuning
por: Lu, Yuheng, et al.
Publicado: (2025)
por: Lu, Yuheng, et al.
Publicado: (2025)
Generative Multi-Modal Knowledge Retrieval with Large Language Models
por: Long, Xinwei, et al.
Publicado: (2024)
por: Long, Xinwei, et al.
Publicado: (2024)
LIFBench: Evaluating the Instruction Following Performance and Stability of Large Language Models in Long-Context Scenarios
por: Wu, Xiaodong, et al.
Publicado: (2024)
por: Wu, Xiaodong, et al.
Publicado: (2024)
GenPRM: Scaling Test-Time Compute of Process Reward Models via Generative Reasoning
por: Zhao, Jian, et al.
Publicado: (2025)
por: Zhao, Jian, et al.
Publicado: (2025)
Towards a Unified View of Large Language Model Post-Training
por: Lv, Xingtai, et al.
Publicado: (2025)
por: Lv, Xingtai, et al.
Publicado: (2025)
The SIFo Benchmark: Investigating the Sequential Instruction Following Ability of Large Language Models
por: Chen, Xinyi, et al.
Publicado: (2024)
por: Chen, Xinyi, et al.
Publicado: (2024)
Parrot: Enhancing Multi-Turn Instruction Following for Large Language Models
por: Sun, Yuchong, et al.
Publicado: (2023)
por: Sun, Yuchong, et al.
Publicado: (2023)
AGENTIF: Benchmarking Instruction Following of Large Language Models in Agentic Scenarios
por: Qi, Yunjia, et al.
Publicado: (2025)
por: Qi, Yunjia, et al.
Publicado: (2025)
Self Speculative Decoding for Diffusion Large Language Models
por: Gao, Yifeng, et al.
Publicado: (2025)
por: Gao, Yifeng, et al.
Publicado: (2025)
Phased Instruction Fine-Tuning for Large Language Models
por: Pang, Wei, et al.
Publicado: (2024)
por: Pang, Wei, et al.
Publicado: (2024)
MulDimIF: A Multi-Dimensional Constraint Framework for Evaluating and Improving Instruction Following in Large Language Models
por: Ye, Junjie, et al.
Publicado: (2025)
por: Ye, Junjie, et al.
Publicado: (2025)
LIFEBench: Evaluating Length Instruction Following in Large Language Models
por: Zhang, Wei, et al.
Publicado: (2025)
por: Zhang, Wei, et al.
Publicado: (2025)
Constraint Back-translation Improves Complex Instruction Following of Large Language Models
por: Qi, Yunjia, et al.
Publicado: (2024)
por: Qi, Yunjia, et al.
Publicado: (2024)
Federated Co-tuning Framework for Large and Small Language Models
por: Fan, Tao, et al.
Publicado: (2024)
por: Fan, Tao, et al.
Publicado: (2024)
DARE: Diffusion Large Language Models Alignment and Reinforcement Executor
por: Yang, Jingyi, et al.
Publicado: (2026)
por: Yang, Jingyi, et al.
Publicado: (2026)
Evaluating Large Language Models at Evaluating Instruction Following
por: Zeng, Zhiyuan, et al.
Publicado: (2023)
por: Zeng, Zhiyuan, et al.
Publicado: (2023)
XIFBench: Evaluating Large Language Models on Multilingual Instruction Following
por: Li, Zhenyu, et al.
Publicado: (2025)
por: Li, Zhenyu, et al.
Publicado: (2025)
CAPE: Context-Aware Personality Evaluation Framework for Large Language Models
por: Sandhan, Jivnesh, et al.
Publicado: (2025)
por: Sandhan, Jivnesh, et al.
Publicado: (2025)
GraphIF: Enhancing Multi-Turn Instruction Following for Large Language Models with Relation Graph Prompt
por: Li, Zhenhe, et al.
Publicado: (2025)
por: Li, Zhenhe, et al.
Publicado: (2025)
Beyond Instruction Following: Evaluating Inferential Rule Following of Large Language Models
por: Sun, Wangtao, et al.
Publicado: (2024)
por: Sun, Wangtao, et al.
Publicado: (2024)
AdaptiveLog: An Adaptive Log Analysis Framework with the Collaboration of Large and Small Language Model
por: Ma, Lipeng, et al.
Publicado: (2025)
por: Ma, Lipeng, et al.
Publicado: (2025)
Ejemplares similares
-
Fast and Slow Generating: An Empirical Study on Large and Small Language Models Collaborative Decoding
por: Zhang, Kaiyan, et al.
Publicado: (2024) -
Intuitive Fine-Tuning: Towards Simplifying Alignment into a Single Process
por: Hua, Ermo, et al.
Publicado: (2024) -
Scalable Efficient Training of Large Language Models with Low-dimensional Projected Attention
por: Lv, Xingtai, et al.
Publicado: (2024) -
Retrieval-Augmented Visual Question Answering via Built-in Autoregressive Search Engines
por: Long, Xinwei, et al.
Publicado: (2025) -
Large Language Models as Biomedical Hypothesis Generators: A Comprehensive Evaluation
por: Qi, Biqing, et al.
Publicado: (2024)