Simple online learning with consistent oracle
Fuente:
arXiv
Guardado en:
| Autores principales: | Kozachinskiy, Alexander, Steifer, Tomasz |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A completely uniform transformer for parity
por: Kozachinskiy, Alexander, et al.
Publicado: (2025)
por: Kozachinskiy, Alexander, et al.
Publicado: (2025)
Ehrenfeucht-Haussler Rank and Chain of Thought
por: Barceló, Pablo, et al.
Publicado: (2025)
por: Barceló, Pablo, et al.
Publicado: (2025)
Parity, Sensitivity, and Transformers
por: Kozachinskiy, Alexander, et al.
Publicado: (2026)
por: Kozachinskiy, Alexander, et al.
Publicado: (2026)
Optimal bounds for dissatisfaction in perpetual voting
por: Kozachinskiy, Alexander, et al.
Publicado: (2024)
por: Kozachinskiy, Alexander, et al.
Publicado: (2024)
Lower bounds on transformers with infinite precision
por: Kozachinskiy, Alexander
Publicado: (2024)
por: Kozachinskiy, Alexander
Publicado: (2024)
Strassen Attention, Split VC Dimension and Compositionality in Transformers
por: Kozachinskiy, Alexander, et al.
Publicado: (2025)
por: Kozachinskiy, Alexander, et al.
Publicado: (2025)
Effective Littlestone Dimension
por: Rose, Valentino Delle, et al.
Publicado: (2024)
por: Rose, Valentino Delle, et al.
Publicado: (2024)
Computable universal online learning
por: Kalociński, Dariusz, et al.
Publicado: (2025)
por: Kalociński, Dariusz, et al.
Publicado: (2025)
Provably Shorter Scratchpads in Hybrid DeltaNet-Attention Decoders
por: Steifer, Tomasz
Publicado: (2026)
por: Steifer, Tomasz
Publicado: (2026)
Explaining k-Nearest Neighbors: Abductive and Counterfactual Explanations
por: Barceló, Pablo, et al.
Publicado: (2025)
por: Barceló, Pablo, et al.
Publicado: (2025)
Message Passing on the Edge: Towards Scalable and Expressive GNNs
por: Barceló, Pablo, et al.
Publicado: (2025)
por: Barceló, Pablo, et al.
Publicado: (2025)
Continuity and Isolation Lead to Doubts or Dilemmas in Large Language Models
por: Pasten, Hector, et al.
Publicado: (2025)
por: Pasten, Hector, et al.
Publicado: (2025)
Balancing optimism and pessimism in offline-to-online learning
por: Sentenac, Flore, et al.
Publicado: (2025)
por: Sentenac, Flore, et al.
Publicado: (2025)
On the consistency of hyper-parameter selection in value-based deep reinforcement learning
por: Obando-Ceron, Johan, et al.
Publicado: (2024)
por: Obando-Ceron, Johan, et al.
Publicado: (2024)
Language Generation: Complexity Barriers and Implications for Learning
por: Arenas, Marcelo, et al.
Publicado: (2025)
por: Arenas, Marcelo, et al.
Publicado: (2025)
Learning-augmented smooth integer programs with PAC-learnable oracles
por: He, Hao-Yuan, et al.
Publicado: (2026)
por: He, Hao-Yuan, et al.
Publicado: (2026)
Physically consistent and uncertainty-aware learning of spatiotemporal dynamics
por: Xu, Qingsong, et al.
Publicado: (2025)
por: Xu, Qingsong, et al.
Publicado: (2025)
ROCM: RLHF on consistency models
por: Shekhar, Shivanshu, et al.
Publicado: (2025)
por: Shekhar, Shivanshu, et al.
Publicado: (2025)
Data-driven simulator of multi-animal behavior with unknown dynamics via offline and online reinforcement learning
por: Fujii, Keisuke, et al.
Publicado: (2025)
por: Fujii, Keisuke, et al.
Publicado: (2025)
Position: agentic AI orchestration should be Bayes-consistent
por: Papamarkou, Theodore, et al.
Publicado: (2026)
por: Papamarkou, Theodore, et al.
Publicado: (2026)
HKAN: Hierarchical Kolmogorov-Arnold Network without Backpropagation
por: Dudek, Grzegorz, et al.
Publicado: (2025)
por: Dudek, Grzegorz, et al.
Publicado: (2025)
AR-TTA: A Simple Method for Real-World Continual Test-Time Adaptation
por: Sójka, Damian, et al.
Publicado: (2023)
por: Sójka, Damian, et al.
Publicado: (2023)
Simple Lifelong Learning Machines
por: Dey, Jayanta, et al.
Publicado: (2020)
por: Dey, Jayanta, et al.
Publicado: (2020)
Simple Hierarchical Planning with Diffusion
por: Chen, Chang, et al.
Publicado: (2024)
por: Chen, Chang, et al.
Publicado: (2024)
Simple Multigraph Convolution Networks
por: Wu, Danyang, et al.
Publicado: (2024)
por: Wu, Danyang, et al.
Publicado: (2024)
Bilinear representation mitigates reversal curse and enables consistent model editing
por: Kim, Dong-Kyum, et al.
Publicado: (2025)
por: Kim, Dong-Kyum, et al.
Publicado: (2025)
Simple Ingredients for Offline Reinforcement Learning
por: Cetin, Edoardo, et al.
Publicado: (2024)
por: Cetin, Edoardo, et al.
Publicado: (2024)
Deep Networks Favor Simple Data
por: Lu, Weyl, et al.
Publicado: (2026)
por: Lu, Weyl, et al.
Publicado: (2026)
Simple Baselines are Competitive with Code Evolution
por: Gideoni, Yonatan, et al.
Publicado: (2026)
por: Gideoni, Yonatan, et al.
Publicado: (2026)
Physics-consistent machine learning: output projection onto physical manifolds
por: Valente, Matilde, et al.
Publicado: (2025)
por: Valente, Matilde, et al.
Publicado: (2025)
An Optimistic Algorithm for online CMDPS with Anytime Adversarial Constraints
por: Zhu, Jiahui, et al.
Publicado: (2025)
por: Zhu, Jiahui, et al.
Publicado: (2025)
A Simple and Scalable Representation for Graph Generation
por: Jang, Yunhui, et al.
Publicado: (2023)
por: Jang, Yunhui, et al.
Publicado: (2023)
Simple Path Structural Encoding for Graph Transformers
por: Airale, Louis, et al.
Publicado: (2025)
por: Airale, Louis, et al.
Publicado: (2025)
Sandbagging in a Simple Survival Bandit Problem
por: Dyer, Joel, et al.
Publicado: (2025)
por: Dyer, Joel, et al.
Publicado: (2025)
Simple and Effective Specialized Representations for Fair Classifiers
por: Sinigaglia, Alberto, et al.
Publicado: (2025)
por: Sinigaglia, Alberto, et al.
Publicado: (2025)
SCATR: Simple Calibrated Test-Time Ranking
por: Shyamal, Divya, et al.
Publicado: (2026)
por: Shyamal, Divya, et al.
Publicado: (2026)
HyperAdapt: Simple High-Rank Adaptation
por: Gurung, Abel, et al.
Publicado: (2025)
por: Gurung, Abel, et al.
Publicado: (2025)
Training data attribution in diffusion models via mirrored unlearning and noise-consistent skew
por: Serrà, Joan, et al.
Publicado: (2026)
por: Serrà, Joan, et al.
Publicado: (2026)
Yes, Q-learning Helps Offline In-Context RL
por: Tarasov, Denis, et al.
Publicado: (2025)
por: Tarasov, Denis, et al.
Publicado: (2025)
Understanding the performance gap between online and offline alignment algorithms
por: Tang, Yunhao, et al.
Publicado: (2024)
por: Tang, Yunhao, et al.
Publicado: (2024)
Ejemplares similares
-
A completely uniform transformer for parity
por: Kozachinskiy, Alexander, et al.
Publicado: (2025) -
Ehrenfeucht-Haussler Rank and Chain of Thought
por: Barceló, Pablo, et al.
Publicado: (2025) -
Parity, Sensitivity, and Transformers
por: Kozachinskiy, Alexander, et al.
Publicado: (2026) -
Optimal bounds for dissatisfaction in perpetual voting
por: Kozachinskiy, Alexander, et al.
Publicado: (2024) -
Lower bounds on transformers with infinite precision
por: Kozachinskiy, Alexander
Publicado: (2024)