From Feedback Loops to Policy Updates: Reinforcement Fine-Tuning for LLM-Based Alpha Factor Discovery
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Lingzhe, Jia, Tong, Zhai, Yunpeng, Xie, Zixuan, Duan, Chiming, He, Minghua, Yu, Philip S., Li, Ying |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
E2E-REME: Towards End-to-End Microservices Auto-Remediation via Experience-Simulation Reinforcement Fine-Tuning
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2026)
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2026)
MicroRemed: Benchmarking LLMs in Microservices Remediation
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2025)
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2025)
Hubble: An LLM-Driven Agentic Framework for Safe, Diverse, and Reproducible Alpha Factor Discovery
von: Shi, Runze, et al.
Veröffentlicht: (2026)
von: Shi, Runze, et al.
Veröffentlicht: (2026)
QuantaAlpha: An Evolutionary Framework for LLM-Driven Alpha Mining
von: Han, Jun, et al.
Veröffentlicht: (2026)
von: Han, Jun, et al.
Veröffentlicht: (2026)
AgentFM: Role-Aware Failure Management for Distributed Databases with LLM-Driven Multi-Agents
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2025)
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2025)
ThinkFL: Self-Refining Failure Localization for Microservice Systems via Reinforcement Fine-Tuning
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2025)
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2025)
Alpha-GPT 2.0: Human-in-the-Loop AI for Quantitative Investment
von: Yuan, Hang, et al.
Veröffentlicht: (2024)
von: Yuan, Hang, et al.
Veröffentlicht: (2024)
Impacts of Economic Policies on Wealth Distribution in Token Economies
von: Sadykhov, Rem, et al.
Veröffentlicht: (2026)
von: Sadykhov, Rem, et al.
Veröffentlicht: (2026)
AlphaForge: A Framework to Mine and Dynamically Combine Formulaic Alpha Factors
von: Shi, Hao, et al.
Veröffentlicht: (2024)
von: Shi, Hao, et al.
Veröffentlicht: (2024)
Agentic Memory Enhanced Recursive Reasoning for Root Cause Localization in Microservices
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2026)
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2026)
MOOSE-Chem2: Exploring LLM Limits in Fine-Grained Scientific Hypothesis Discovery via Hierarchical Search
von: Yang, Zonglin, et al.
Veröffentlicht: (2025)
von: Yang, Zonglin, et al.
Veröffentlicht: (2025)
AlphaAgent: LLM-Driven Alpha Mining with Regularized Exploration to Counteract Alpha Decay
von: Tang, Ziyi, et al.
Veröffentlicht: (2025)
von: Tang, Ziyi, et al.
Veröffentlicht: (2025)
CatMemo at the FinLLM Challenge Task: Fine-Tuning Large Language Models using Data Fusion in Financial Applications
von: Cao, Yupeng, et al.
Veröffentlicht: (2024)
von: Cao, Yupeng, et al.
Veröffentlicht: (2024)
AlphaSAGE: Structure-Aware Alpha Mining via GFlowNets for Robust Exploration
von: Chen, Binqi, et al.
Veröffentlicht: (2025)
von: Chen, Binqi, et al.
Veröffentlicht: (2025)
AlphaLogics: A Market Logic-Driven Multi-Agent System for Scalable and Interpretable Alpha Factor Generation
von: Weng, Zhangyuhua, et al.
Veröffentlicht: (2026)
von: Weng, Zhangyuhua, et al.
Veröffentlicht: (2026)
Alpha Discovery via Grammar-Guided Learning and Search
von: Yang, Han, et al.
Veröffentlicht: (2026)
von: Yang, Han, et al.
Veröffentlicht: (2026)
Hypothesize-Then-Verify: Speculative Root Cause Analysis for Microservices with Pathwise Parallelism
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2026)
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2026)
The Alpha Illusion: Reported Alpha from LLM Trading Agents Should Not Be Treated as Deployment Evidence
von: Ye, Yuxuan, et al.
Veröffentlicht: (2026)
von: Ye, Yuxuan, et al.
Veröffentlicht: (2026)
From Flat to Hierarchical: Evolving Tree-structured Thoughts for Fine-grained Alpha Mining
von: Ren, Junji, et al.
Veröffentlicht: (2025)
von: Ren, Junji, et al.
Veröffentlicht: (2025)
A Survey on Parallel Text Generation: From Parallel Decoding to Diffusion Language Models
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2025)
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2025)
Alpha Mining and Enhancing via Warm Start Genetic Programming for Quantitative Investment
von: Ren, Weizhe, et al.
Veröffentlicht: (2024)
von: Ren, Weizhe, et al.
Veröffentlicht: (2024)
Alpha-R1: Alpha Screening with LLM Reasoning via Reinforcement Learning
von: Jiang, Zuoyou, et al.
Veröffentlicht: (2025)
von: Jiang, Zuoyou, et al.
Veröffentlicht: (2025)
LR-Robot: An Human-in-the-Loop LLM Framework for Systematic Literature Reviews with Applications in Financial Research
von: Wei, Wei, et al.
Veröffentlicht: (2026)
von: Wei, Wei, et al.
Veröffentlicht: (2026)
Sentiment-Aware Stock Price Prediction with Transformer and LLM-Generated Formulaic Alpha
von: Chen, Qizhao, et al.
Veröffentlicht: (2025)
von: Chen, Qizhao, et al.
Veröffentlicht: (2025)
$\text{Alpha}^2$: Discovering Logical Formulaic Alphas using Deep Reinforcement Learning
von: Xu, Feng, et al.
Veröffentlicht: (2024)
von: Xu, Feng, et al.
Veröffentlicht: (2024)
Alpha-GPT: Human-AI Interactive Alpha Mining for Quantitative Investment
von: Wang, Saizhuo, et al.
Veröffentlicht: (2023)
von: Wang, Saizhuo, et al.
Veröffentlicht: (2023)
Towards Robust LLM Post-Training: Automatic Failure Management for Reinforcement Fine-Tuning
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2026)
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2026)
AlphaQuanter: An End-to-End Tool-Augmented Agentic Reinforcement Learning Framework for Stock Trading
von: Deng, Zheye, et al.
Veröffentlicht: (2025)
von: Deng, Zheye, et al.
Veröffentlicht: (2025)
Multi-Dimensional Behavioral Evaluation of Agentic Stock Prediction Systems Using Large Language Model Judges with Closed-Loop Reinforcement Learning Feedback
von: Ridhawi, Mohammad Al, et al.
Veröffentlicht: (2026)
von: Ridhawi, Mohammad Al, et al.
Veröffentlicht: (2026)
Financial News-Driven LLM Reinforcement Learning for Portfolio Management
von: Unnikrishnan, Ananya
Veröffentlicht: (2024)
von: Unnikrishnan, Ananya
Veröffentlicht: (2024)
Profit Maximization In Arbitrage Loops
von: Zhang, Yu, et al.
Veröffentlicht: (2024)
von: Zhang, Yu, et al.
Veröffentlicht: (2024)
Mixing It Up: The Cocktail Effect of Multi-Task Fine-Tuning on LLM Performance -- A Case Study in Finance
von: Brief, Meni, et al.
Veröffentlicht: (2024)
von: Brief, Meni, et al.
Veröffentlicht: (2024)
Chain-of-Alpha: Unleashing the Power of Large Language Models for Alpha Mining in Quantitative Trading
von: Cao, Lang
Veröffentlicht: (2025)
von: Cao, Lang
Veröffentlicht: (2025)
Market-Dependent Communication in Multi-Agent Alpha Generation
von: Shi, Jerick, et al.
Veröffentlicht: (2025)
von: Shi, Jerick, et al.
Veröffentlicht: (2025)
QuantFactor REINFORCE: Mining Steady Formulaic Alpha Factors with Variance-bounded REINFORCE
von: Zhao, Junjie, et al.
Veröffentlicht: (2024)
von: Zhao, Junjie, et al.
Veröffentlicht: (2024)
Synergistic Formulaic Alpha Generation for Quantitative Trading based on Reinforcement Learning
von: Shin, Hong-Gi, et al.
Veröffentlicht: (2024)
von: Shin, Hong-Gi, et al.
Veröffentlicht: (2024)
Representation Signatures and Risk-Feedback Alignment in LLM Trading Agents
von: Xue, Weicheng
Veröffentlicht: (2026)
von: Xue, Weicheng
Veröffentlicht: (2026)
OSCAgent: Accelerating the Discovery of Organic Solar Cells with LLM Agents
von: Hu, Zhaolin, et al.
Veröffentlicht: (2026)
von: Hu, Zhaolin, et al.
Veröffentlicht: (2026)
Alphanetv4: Alpha Mining Model
von: Wu, Wenjun
Veröffentlicht: (2024)
von: Wu, Wenjun
Veröffentlicht: (2024)
Programmable Virtual Humans Toward Human Physiologically-Based Drug Discovery
von: Wu, You, et al.
Veröffentlicht: (2025)
von: Wu, You, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
E2E-REME: Towards End-to-End Microservices Auto-Remediation via Experience-Simulation Reinforcement Fine-Tuning
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2026) -
MicroRemed: Benchmarking LLMs in Microservices Remediation
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2025) -
Hubble: An LLM-Driven Agentic Framework for Safe, Diverse, and Reproducible Alpha Factor Discovery
von: Shi, Runze, et al.
Veröffentlicht: (2026) -
QuantaAlpha: An Evolutionary Framework for LLM-Driven Alpha Mining
von: Han, Jun, et al.
Veröffentlicht: (2026) -
AgentFM: Role-Aware Failure Management for Distributed Databases with LLM-Driven Multi-Agents
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2025)