Beyond Parameters: Exploring Virtual Logic Depth for Scaling Laws
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Ruike, Zhang, Hanwen, Li, Kevin, Shi, Tianyu, Duan, Yiqun, Wang, Chi, Zhou, Tianyi, Banerjee, Arindam, Qin, Zengyi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Conservative Contextual Bandits: Beyond Linear Representations
di: Deb, Rohan, et al.
Pubblicazione: (2024)
di: Deb, Rohan, et al.
Pubblicazione: (2024)
Beyond Johnson-Lindenstrauss: Uniform Bounds for Sketched Bilinear Forms
di: Deb, Rohan, et al.
Pubblicazione: (2025)
di: Deb, Rohan, et al.
Pubblicazione: (2025)
SynLogic: Synthesizing Verifiable Reasoning Data at Scale for Learning Logical Reasoning and Beyond
di: Liu, Junteng, et al.
Pubblicazione: (2025)
di: Liu, Junteng, et al.
Pubblicazione: (2025)
Beyond Pairwise Comparisons: A Distributional Test of Distinctiveness for Machine-Generated Works in Intellectual Property Law
di: Mukherjee, Anirban, et al.
Pubblicazione: (2026)
di: Mukherjee, Anirban, et al.
Pubblicazione: (2026)
What Scales in Cross-Entropy Scaling Law?
di: Yan, Junxi, et al.
Pubblicazione: (2025)
di: Yan, Junxi, et al.
Pubblicazione: (2025)
Beyond Uniform Scaling: Exploring Depth Heterogeneity in Neural Architectures
di: T, Akash Guna R., et al.
Pubblicazione: (2024)
di: T, Akash Guna R., et al.
Pubblicazione: (2024)
Relative-Based Scaling Law for Neural Language Models
di: Yue, Baoqing, et al.
Pubblicazione: (2025)
di: Yue, Baoqing, et al.
Pubblicazione: (2025)
Exploring Scaling Laws for EHR Foundation Models
di: Zhang, Sheng, et al.
Pubblicazione: (2025)
di: Zhang, Sheng, et al.
Pubblicazione: (2025)
DebFlow: Automating Agent Creation via Agent Debate
di: Su, Jinwei, et al.
Pubblicazione: (2025)
di: Su, Jinwei, et al.
Pubblicazione: (2025)
Strat-LLM: Stratified Strategy Alignment for LLM-based Stock Trading with Real-time Multi-Source Signals
di: Huang, Wenliang, et al.
Pubblicazione: (2026)
di: Huang, Wenliang, et al.
Pubblicazione: (2026)
Exploring Depth Generalization in Large Language Models for Solving Recursive Logic Tasks
di: He, Zhiyuan
Pubblicazione: (2025)
di: He, Zhiyuan
Pubblicazione: (2025)
Accelerate Scaling of LLM Finetuning via Quantifying the Coverage and Depth of Instruction Set
di: Wu, Chengwei, et al.
Pubblicazione: (2025)
di: Wu, Chengwei, et al.
Pubblicazione: (2025)
JetMoE: Reaching Llama2 Performance with 0.1M Dollars
di: Shen, Yikang, et al.
Pubblicazione: (2024)
di: Shen, Yikang, et al.
Pubblicazione: (2024)
Plan Before You Trade: Inference-Time Optimization for RL Trading Agents
di: Go, Eun, et al.
Pubblicazione: (2026)
di: Go, Eun, et al.
Pubblicazione: (2026)
Beyond Length Scaling: Synergizing Breadth and Depth for Generative Reward Models
di: Zhang, Qiyuan, et al.
Pubblicazione: (2026)
di: Zhang, Qiyuan, et al.
Pubblicazione: (2026)
Functional Matching of Logic Subgraphs: Beyond Structural Isomorphism
di: Zheng, Ziyang, et al.
Pubblicazione: (2025)
di: Zheng, Ziyang, et al.
Pubblicazione: (2025)
Scaling Laws for Online Advertisement Retrieval
di: Wang, Yunli, et al.
Pubblicazione: (2024)
di: Wang, Yunli, et al.
Pubblicazione: (2024)
Jailbreak Scaling Laws for Large Language Models: Polynomial-Exponential Crossover
di: Halder, Indranil, et al.
Pubblicazione: (2026)
di: Halder, Indranil, et al.
Pubblicazione: (2026)
RL-Struct: A Lightweight Reinforcement Learning Framework for Reliable Structured Output in LLMs
di: Hu, Ruike, et al.
Pubblicazione: (2025)
di: Hu, Ruike, et al.
Pubblicazione: (2025)
Exploring Nonlinear Pathway in Parameter Space for Machine Unlearning
di: Shi, Yingdan, et al.
Pubblicazione: (2025)
di: Shi, Yingdan, et al.
Pubblicazione: (2025)
See or Say Graphs: Agent-Driven Scalable Graph Structure Understanding with Vision-Language Models
di: Han, Shuo, et al.
Pubblicazione: (2025)
di: Han, Shuo, et al.
Pubblicazione: (2025)
Scaling Laws in Linear Regression: Compute, Parameters, and Data
di: Lin, Licong, et al.
Pubblicazione: (2024)
di: Lin, Licong, et al.
Pubblicazione: (2024)
Prompting Multi-Modal Tokens to Enhance End-to-End Autonomous Driving Imitation Learning with LLMs
di: Duan, Yiqun, et al.
Pubblicazione: (2024)
di: Duan, Yiqun, et al.
Pubblicazione: (2024)
LEGO-GraphRAG: Modularizing Graph-based Retrieval-Augmented Generation for Design Space Exploration
di: Cao, Yukun, et al.
Pubblicazione: (2024)
di: Cao, Yukun, et al.
Pubblicazione: (2024)
CALM: A Causal Analysis Language Model for Tabular Data in Complex Systems with Local Scores, Conditional Independence Tests, and Relation Attributes
di: Fan, Zhenjiang, et al.
Pubblicazione: (2025)
di: Fan, Zhenjiang, et al.
Pubblicazione: (2025)
CogniFold: Always-On Proactive Memory via Cognitive Folding
di: Wang, Suli, et al.
Pubblicazione: (2026)
di: Wang, Suli, et al.
Pubblicazione: (2026)
Beyond Gemini-3-Pro: Revisiting LLM Routing and Aggregation at Scale
di: Tang, Shengji, et al.
Pubblicazione: (2026)
di: Tang, Shengji, et al.
Pubblicazione: (2026)
Beyond Scaling Law: A Data-Efficient Distillation Framework for Reasoning
di: Wu, Xiaojun, et al.
Pubblicazione: (2025)
di: Wu, Xiaojun, et al.
Pubblicazione: (2025)
Scaling Laws for Educational AI Agents
di: Wu, Mengsong, et al.
Pubblicazione: (2026)
di: Wu, Mengsong, et al.
Pubblicazione: (2026)
ComfySearch: Autonomous Exploration and Reasoning for ComfyUI Workflows
di: Su, Jinwei, et al.
Pubblicazione: (2026)
di: Su, Jinwei, et al.
Pubblicazione: (2026)
Diversity of Transformer Layers: One Aspect of Parameter Scaling Laws
di: Kamigaito, Hidetaka, et al.
Pubblicazione: (2025)
di: Kamigaito, Hidetaka, et al.
Pubblicazione: (2025)
Scaling Law for Time Series Forecasting
di: Shi, Jingzhe, et al.
Pubblicazione: (2024)
di: Shi, Jingzhe, et al.
Pubblicazione: (2024)
Scaling Laws for Speculative Decoding
di: Yan, Siyuan, et al.
Pubblicazione: (2025)
di: Yan, Siyuan, et al.
Pubblicazione: (2025)
LogicBench: Towards Systematic Evaluation of Logical Reasoning Ability of Large Language Models
di: Parmar, Mihir, et al.
Pubblicazione: (2024)
di: Parmar, Mihir, et al.
Pubblicazione: (2024)
Beyond Parameter Finetuning: Test-Time Representation Refinement for Node Classification
di: Zhang, Jiaxin, et al.
Pubblicazione: (2026)
di: Zhang, Jiaxin, et al.
Pubblicazione: (2026)
Mixture of Universal Experts: Scaling Virtual Width via Depth-Width Transformation
di: Chen, Yilong, et al.
Pubblicazione: (2026)
di: Chen, Yilong, et al.
Pubblicazione: (2026)
Agentic World Modeling: Foundations, Capabilities, Laws, and Beyond
di: Chu, Meng, et al.
Pubblicazione: (2026)
di: Chu, Meng, et al.
Pubblicazione: (2026)
Parameters vs FLOPs: Scaling Laws for Optimal Sparsity for Mixture-of-Experts Language Models
di: Abnar, Samira, et al.
Pubblicazione: (2025)
di: Abnar, Samira, et al.
Pubblicazione: (2025)
Beyond Experience Retrieval: Learning to Generate Utility-Optimized Structured Experience for Frozen LLMs
di: Li, Xuancheng, et al.
Pubblicazione: (2026)
di: Li, Xuancheng, et al.
Pubblicazione: (2026)
Beyond Memorization: Extending Reasoning Depth with Recurrence, Memory and Test-Time Compute Scaling
di: Rodkin, Ivan, et al.
Pubblicazione: (2025)
di: Rodkin, Ivan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Conservative Contextual Bandits: Beyond Linear Representations
di: Deb, Rohan, et al.
Pubblicazione: (2024) -
Beyond Johnson-Lindenstrauss: Uniform Bounds for Sketched Bilinear Forms
di: Deb, Rohan, et al.
Pubblicazione: (2025) -
SynLogic: Synthesizing Verifiable Reasoning Data at Scale for Learning Logical Reasoning and Beyond
di: Liu, Junteng, et al.
Pubblicazione: (2025) -
Beyond Pairwise Comparisons: A Distributional Test of Distinctiveness for Machine-Generated Works in Intellectual Property Law
di: Mukherjee, Anirban, et al.
Pubblicazione: (2026) -
What Scales in Cross-Entropy Scaling Law?
di: Yan, Junxi, et al.
Pubblicazione: (2025)