Salvato in:
| Autori principali: | Hao, Yifan, Lu, Yanxin, Zhang, Hanning, Shen, Xinwei, Zhang, Tong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2506.04690 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Optimizing Chain-of-Thought Reasoners via Gradient Variance Minimization in Rejection Sampling and RL
di: Yao, Jiarui, et al.
Pubblicazione: (2025)
di: Yao, Jiarui, et al.
Pubblicazione: (2025)
STRAP: Spatio-Temporal Pattern Retrieval for Out-of-Distribution Generalization
di: Zhang, Haoyu, et al.
Pubblicazione: (2025)
di: Zhang, Haoyu, et al.
Pubblicazione: (2025)
Self-rewarding correction for mathematical reasoning
di: Xiong, Wei, et al.
Pubblicazione: (2025)
di: Xiong, Wei, et al.
Pubblicazione: (2025)
Transformers as Multi-task Learners: Decoupling Features in Hidden Markov Models
di: Hao, Yifan, et al.
Pubblicazione: (2025)
di: Hao, Yifan, et al.
Pubblicazione: (2025)
HyperMoE: Towards Better Mixture of Experts via Transferring Among Experts
di: Zhao, Hao, et al.
Pubblicazione: (2024)
di: Zhao, Hao, et al.
Pubblicazione: (2024)
Rethinking Input Domains in Physics-Informed Neural Networks via Geometric Compactification Mappings
di: Huang, Zhenzhen, et al.
Pubblicazione: (2026)
di: Huang, Zhenzhen, et al.
Pubblicazione: (2026)
Towards Scalable and Deep Graph Neural Networks via Noise Masking
di: Liang, Yuxuan, et al.
Pubblicazione: (2024)
di: Liang, Yuxuan, et al.
Pubblicazione: (2024)
Towards Better Generalization and Interpretability in Unsupervised Concept-Based Models
di: De Santis, Francesco, et al.
Pubblicazione: (2025)
di: De Santis, Francesco, et al.
Pubblicazione: (2025)
Art and Science of Quantizing Large-Scale Models: A Comprehensive Overview
di: Wang, Yanshu, et al.
Pubblicazione: (2024)
di: Wang, Yanshu, et al.
Pubblicazione: (2024)
Beyond Squared Error: Exploring Loss Design for Enhanced Training of Generative Flow Networks
di: Hu, Rui, et al.
Pubblicazione: (2024)
di: Hu, Rui, et al.
Pubblicazione: (2024)
Adaptive Layerwise Perturbation: Unifying Off-Policy Corrections for LLM RL
di: Ye, Chenlu, et al.
Pubblicazione: (2026)
di: Ye, Chenlu, et al.
Pubblicazione: (2026)
Toward Better Generalization in Few-Shot Learning through the Meta-Component Combination
di: Zeng, Qiuhao
Pubblicazione: (2025)
di: Zeng, Qiuhao
Pubblicazione: (2025)
When Good Equations Get Bad Scores: Improving Symbolic Regression Through Better Parameter Optimization
di: Wang, Boxiao, et al.
Pubblicazione: (2026)
di: Wang, Boxiao, et al.
Pubblicazione: (2026)
Zero-Shot End-to-End Relation Extraction in Chinese: A Comparative Study of Gemini, LLaMA and ChatGPT
di: Du, Shaoshuai, et al.
Pubblicazione: (2025)
di: Du, Shaoshuai, et al.
Pubblicazione: (2025)
Improving Prediction Certainty Estimation for Reliable Early Exiting via Null Space Projection
di: He, Jianing, et al.
Pubblicazione: (2025)
di: He, Jianing, et al.
Pubblicazione: (2025)
From Generic Correlation to Input-Specific Credit in On-Policy Self Distillation
di: Shen, Guobin, et al.
Pubblicazione: (2026)
di: Shen, Guobin, et al.
Pubblicazione: (2026)
A Comprehensive Graph Pooling Benchmark: Effectiveness, Robustness and Generalizability
di: Wang, Pengyun, et al.
Pubblicazione: (2024)
di: Wang, Pengyun, et al.
Pubblicazione: (2024)
Training and Evaluating Language Models with Template-based Data Generation
di: Zhang, Yifan
Pubblicazione: (2024)
di: Zhang, Yifan
Pubblicazione: (2024)
Towards Attributions of Input Variables in a Coalition
di: Zheng, Xinhao, et al.
Pubblicazione: (2023)
di: Zheng, Xinhao, et al.
Pubblicazione: (2023)
IPA: An Information-Reconstructive Input Projection Framework for Efficient Foundation Model Adaptation
di: Yin, Yuan, et al.
Pubblicazione: (2025)
di: Yin, Yuan, et al.
Pubblicazione: (2025)
SCL-GNN: Towards Generalizable Graph Neural Networks via Spurious Correlation Learning
di: Zhang, Yuxiang, et al.
Pubblicazione: (2026)
di: Zhang, Yuxiang, et al.
Pubblicazione: (2026)
Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data
di: Zhang, Bingjie, et al.
Pubblicazione: (2025)
di: Zhang, Bingjie, et al.
Pubblicazione: (2025)
Better LLM Reasoning via Dual-Play
di: Zhang, Zhengxin, et al.
Pubblicazione: (2025)
di: Zhang, Zhengxin, et al.
Pubblicazione: (2025)
Will More Expressive Graph Neural Networks do Better on Generative Tasks?
di: Zou, Xiandong, et al.
Pubblicazione: (2023)
di: Zou, Xiandong, et al.
Pubblicazione: (2023)
Making Large Language Models Better Knowledge Miners for Online Marketing with Progressive Prompting Augmentation
di: Gan, Chunjing, et al.
Pubblicazione: (2023)
di: Gan, Chunjing, et al.
Pubblicazione: (2023)
Improved Generalization of Weight Space Networks via Augmentations
di: Shamsian, Aviv, et al.
Pubblicazione: (2024)
di: Shamsian, Aviv, et al.
Pubblicazione: (2024)
GNNavigator: Towards Adaptive Training of Graph Neural Networks via Automatic Guideline Exploration
di: Qiao, Tong, et al.
Pubblicazione: (2024)
di: Qiao, Tong, et al.
Pubblicazione: (2024)
Towards Better Benchmark Datasets for Inductive Knowledge Graph Completion
di: Shomer, Harry, et al.
Pubblicazione: (2024)
di: Shomer, Harry, et al.
Pubblicazione: (2024)
MetaSTH-Sleep: Towards Effective Few-Shot Sleep Stage Classification for Health Management with Spatial-Temporal Hypergraph Enhanced Meta-Learning
di: Li, Jingyu, et al.
Pubblicazione: (2025)
di: Li, Jingyu, et al.
Pubblicazione: (2025)
Towards Interpretable and Inference-Optimal COT Reasoning with Sparse Autoencoder-Guided Generation
di: Zhao, Daniel, et al.
Pubblicazione: (2025)
di: Zhao, Daniel, et al.
Pubblicazione: (2025)
Balance-aware Sequence Sampling Makes Multi-modal Learning Better
di: Guan, Zhi-Hao
Pubblicazione: (2025)
di: Guan, Zhi-Hao
Pubblicazione: (2025)
FlowX: Towards Explainable Graph Neural Networks via Message Flows
di: Gui, Shurui, et al.
Pubblicazione: (2022)
di: Gui, Shurui, et al.
Pubblicazione: (2022)
Better Generative Replay for Continual Federated Learning
di: Qi, Daiqing, et al.
Pubblicazione: (2023)
di: Qi, Daiqing, et al.
Pubblicazione: (2023)
Closed-Form Concept Erasure via Double Projections
di: Zhang, Chi, et al.
Pubblicazione: (2026)
di: Zhang, Chi, et al.
Pubblicazione: (2026)
A Hybrid Model for Traffic Incident Detection based on Generative Adversarial Networks and Transformer Model
di: Lu, Xinying, et al.
Pubblicazione: (2024)
di: Lu, Xinying, et al.
Pubblicazione: (2024)
Reverse Markov Learning: Multi-Step Generative Models for Complex Distributions
di: Shen, Xinwei, et al.
Pubblicazione: (2025)
di: Shen, Xinwei, et al.
Pubblicazione: (2025)
Towards Better IncomLDL: We Are Unaware of Hidden Labels in Advance
di: Jiang, Jiecheng, et al.
Pubblicazione: (2025)
di: Jiang, Jiecheng, et al.
Pubblicazione: (2025)
Disentangling Tabular Data Towards Better One-Class Anomaly Detection
di: Ye, Jianan, et al.
Pubblicazione: (2024)
di: Ye, Jianan, et al.
Pubblicazione: (2024)
Generative Distribution Prediction: A Unified Approach to Multimodal Learning
di: Tian, Xinyu, et al.
Pubblicazione: (2025)
di: Tian, Xinyu, et al.
Pubblicazione: (2025)
Unbiased Gradient Low-Rank Projection
di: Pan, Rui, et al.
Pubblicazione: (2025)
di: Pan, Rui, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Optimizing Chain-of-Thought Reasoners via Gradient Variance Minimization in Rejection Sampling and RL
di: Yao, Jiarui, et al.
Pubblicazione: (2025) -
STRAP: Spatio-Temporal Pattern Retrieval for Out-of-Distribution Generalization
di: Zhang, Haoyu, et al.
Pubblicazione: (2025) -
Self-rewarding correction for mathematical reasoning
di: Xiong, Wei, et al.
Pubblicazione: (2025) -
Transformers as Multi-task Learners: Decoupling Features in Hidden Markov Models
di: Hao, Yifan, et al.
Pubblicazione: (2025) -
HyperMoE: Towards Better Mixture of Experts via Transferring Among Experts
di: Zhao, Hao, et al.
Pubblicazione: (2024)