ATLAS: A Multi-LLM Training Framework for EvoDPO with Adaptive Reference Evolution
Fuente:
arXiv
Guardado en:
| Autores principales: | Jeon, Ujin, Kwon, Jiyong, Sullivan, Madison Ann, Lee, Caleb Eunho, Lin, Guang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
AIVV: Neuro-Symbolic LLM Agent-Integrated Verification and Validation for Trustworthy Autonomous Systems
por: Kwon, Jiyong, et al.
Publicado: (2026)
por: Kwon, Jiyong, et al.
Publicado: (2026)
EvoMD-LLM: Learning the Language of Species Evolution in Reactive Molecular Dynamics
por: Tang, Zhichen, et al.
Publicado: (2026)
por: Tang, Zhichen, et al.
Publicado: (2026)
BalancedDPO: Adaptive Multi-Metric Alignment
por: Tamboli, Dipesh, et al.
Publicado: (2025)
por: Tamboli, Dipesh, et al.
Publicado: (2025)
BuildEvo: Designing Building Energy Consumption Forecasting Heuristics via LLM-driven Evolution
por: Lin, Subin, et al.
Publicado: (2025)
por: Lin, Subin, et al.
Publicado: (2025)
TrajEvo: Designing Trajectory Prediction Heuristics via LLM-driven Evolution
por: Zhao, Zhikai, et al.
Publicado: (2025)
por: Zhao, Zhikai, et al.
Publicado: (2025)
Automatic Channel Pruning for Multi-Head Attention
por: Lee, Eunho, et al.
Publicado: (2024)
por: Lee, Eunho, et al.
Publicado: (2024)
Inversion-DPO: Precise and Efficient Post-Training for Diffusion Models
por: Li, Zejian, et al.
Publicado: (2025)
por: Li, Zejian, et al.
Publicado: (2025)
TrajEvo: Trajectory Prediction Heuristics Design via LLM-driven Evolution
por: Zhao, Zhikai, et al.
Publicado: (2025)
por: Zhao, Zhikai, et al.
Publicado: (2025)
EvoMesh: Adaptive Physical Simulation with Hierarchical Graph Evolutions
por: Deng, Huayu, et al.
Publicado: (2024)
por: Deng, Huayu, et al.
Publicado: (2024)
CompetEvo: Towards Morphological Evolution from Competition
por: Huang, Kangyao, et al.
Publicado: (2024)
por: Huang, Kangyao, et al.
Publicado: (2024)
Few-Shot Truly Benign DPO Attack for Jailbreaking LLMs
por: Yoon, Sangyeon, et al.
Publicado: (2026)
por: Yoon, Sangyeon, et al.
Publicado: (2026)
Cat-DPO: Category-Adaptive Safety Alignment
por: Yang, Tiankai, et al.
Publicado: (2026)
por: Yang, Tiankai, et al.
Publicado: (2026)
CogEvo-Edu: Cognitive Evolution Educational Multi-Agent Collaborative System
por: Wu, Yefeng, et al.
Publicado: (2025)
por: Wu, Yefeng, et al.
Publicado: (2025)
SP^2DPO: An LLM-assisted Semantic Per-Pair DPO Generalization
por: He, Chaoyue, et al.
Publicado: (2026)
por: He, Chaoyue, et al.
Publicado: (2026)
When to Ensemble: Identifying Token-Level Points for Stable and Fast LLM Ensembling
por: Yun, Heecheol, et al.
Publicado: (2025)
por: Yun, Heecheol, et al.
Publicado: (2025)
EvoAgent: An Evolvable Agent Framework with Skill Learning and Multi-Agent Delegation
por: Zhang, Aimin, et al.
Publicado: (2026)
por: Zhang, Aimin, et al.
Publicado: (2026)
RustEvo^2: An Evolving Benchmark for API Evolution in LLM-based Rust Code Generation
por: Liang, Linxi, et al.
Publicado: (2025)
por: Liang, Linxi, et al.
Publicado: (2025)
LRQ: Optimizing Post-Training Quantization for Large Language Models by Learning Low-Rank Weight-Scaling Matrices
por: Lee, Jung Hyun, et al.
Publicado: (2024)
por: Lee, Jung Hyun, et al.
Publicado: (2024)
Solving LLM Repetition Problem in Production: A Comprehensive Study of Multiple Solutions
por: Wang, Weiwei, et al.
Publicado: (2025)
por: Wang, Weiwei, et al.
Publicado: (2025)
ATLAS: Adaptive Trading with LLM AgentS Through Dynamic Prompt Optimization and Multi-Agent Coordination
por: Papadakis, Charidimos, et al.
Publicado: (2025)
por: Papadakis, Charidimos, et al.
Publicado: (2025)
Expertise-aware Multi-LLM Recruitment and Collaboration for Medical Decision-Making
por: Bao, Liuxin, et al.
Publicado: (2025)
por: Bao, Liuxin, et al.
Publicado: (2025)
AdvEvo-MARL: Shaping Internalized Safety through Adversarial Co-Evolution in Multi-Agent Reinforcement Learning
por: Pan, Zhenyu, et al.
Publicado: (2025)
por: Pan, Zhenyu, et al.
Publicado: (2025)
AutoEvoEval: An Automated Framework for Evolving Close-Ended LLM Evaluation Data
por: Wu, JiaRu, et al.
Publicado: (2025)
por: Wu, JiaRu, et al.
Publicado: (2025)
EvoEmo: Towards Evolved Emotional Policies for Adversarial LLM Agents in Multi-Turn Price Negotiation
por: Long, Yunbo, et al.
Publicado: (2025)
por: Long, Yunbo, et al.
Publicado: (2025)
daDPO: Distribution-Aware DPO for Distilling Conversational Abilities
por: Zhang, Zhengze, et al.
Publicado: (2025)
por: Zhang, Zhengze, et al.
Publicado: (2025)
No Prompt Left Behind: Exploiting Zero-Variance Prompts in LLM Reinforcement Learning via Entropy-Guided Advantage Shaping
por: Le, Thanh-Long V., et al.
Publicado: (2025)
por: Le, Thanh-Long V., et al.
Publicado: (2025)
GigaEvo: An Open Source Optimization Framework Powered By LLMs And Evolution Algorithms
por: Khrulkov, Valentin, et al.
Publicado: (2025)
por: Khrulkov, Valentin, et al.
Publicado: (2025)
EvoFSM: Controllable Self-Evolution for Deep Research with Finite State Machines
por: Zhang, Shuo, et al.
Publicado: (2026)
por: Zhang, Shuo, et al.
Publicado: (2026)
EvoCut: Strengthening Integer Programs via Evolution-Guided Language Models
por: Yazdani, Milad, et al.
Publicado: (2025)
por: Yazdani, Milad, et al.
Publicado: (2025)
QuantEvolve: Automating Quantitative Strategy Discovery through Multi-Agent Evolutionary Framework
por: Yun, Junhyeog, et al.
Publicado: (2025)
por: Yun, Junhyeog, et al.
Publicado: (2025)
EvoEngineer: Mastering Automated CUDA Kernel Code Evolution with Large Language Models
por: Guo, Ping, et al.
Publicado: (2025)
por: Guo, Ping, et al.
Publicado: (2025)
EvoClaw: Evaluating AI Agents on Continuous Software Evolution
por: Deng, Gangda, et al.
Publicado: (2026)
por: Deng, Gangda, et al.
Publicado: (2026)
DeltaSHAP: Explaining Prediction Evolutions in Online Patient Monitoring with Shapley Values
por: Kim, Changhun, et al.
Publicado: (2025)
por: Kim, Changhun, et al.
Publicado: (2025)
CoEvo: Continual Evolution of Symbolic Solutions Using Large Language Models
por: Guo, Ping, et al.
Publicado: (2024)
por: Guo, Ping, et al.
Publicado: (2024)
EvoAgentX: An Automated Framework for Evolving Agentic Workflows
por: Wang, Yingxu, et al.
Publicado: (2025)
por: Wang, Yingxu, et al.
Publicado: (2025)
Deriving the Scaled-Dot-Function via Maximum Likelihood Estimation and Maximum Entropy Approach
por: Ma, Jiyong
Publicado: (2025)
por: Ma, Jiyong
Publicado: (2025)
Unleashing Hierarchical Reasoning: An LLM-Driven Framework for Training-Free Referring Video Object Segmentation
por: Zhao, Bingrui, et al.
Publicado: (2025)
por: Zhao, Bingrui, et al.
Publicado: (2025)
EvoVerilog: Large Langugage Model Assisted Evolution of Verilog Code
por: Guo, Ping, et al.
Publicado: (2025)
por: Guo, Ping, et al.
Publicado: (2025)
Live-Evo: Online Evolution of Agentic Memory from Continuous Feedback
por: Zhang, Yaolun, et al.
Publicado: (2026)
por: Zhang, Yaolun, et al.
Publicado: (2026)
CktEvo: Repository-Level RTL Code Benchmark for Design Evolution
por: Shi, Zhengyuan, et al.
Publicado: (2026)
por: Shi, Zhengyuan, et al.
Publicado: (2026)
Ejemplares similares
-
AIVV: Neuro-Symbolic LLM Agent-Integrated Verification and Validation for Trustworthy Autonomous Systems
por: Kwon, Jiyong, et al.
Publicado: (2026) -
EvoMD-LLM: Learning the Language of Species Evolution in Reactive Molecular Dynamics
por: Tang, Zhichen, et al.
Publicado: (2026) -
BalancedDPO: Adaptive Multi-Metric Alignment
por: Tamboli, Dipesh, et al.
Publicado: (2025) -
BuildEvo: Designing Building Energy Consumption Forecasting Heuristics via LLM-driven Evolution
por: Lin, Subin, et al.
Publicado: (2025) -
TrajEvo: Designing Trajectory Prediction Heuristics via LLM-driven Evolution
por: Zhao, Zhikai, et al.
Publicado: (2025)