Polaris: A Gödel Agent Framework for Small Language Models through Experience-Abstracted Policy Repair
Fuente:
arXiv
Salvato in:
| Autori principali: | Kakade, Aditya, Srivastava, Vivek, Karande, Shirish |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Forgetting is Competition: Rethinking Unlearning as Representation Interference in Diffusion Models
di: Ranjan, Ashutosh, et al.
Pubblicazione: (2026)
di: Ranjan, Ashutosh, et al.
Pubblicazione: (2026)
The Silent Brush: Evaluating Artistic Style Leakage in AI Art Generation
di: Joshi, Ninad, et al.
Pubblicazione: (2026)
di: Joshi, Ninad, et al.
Pubblicazione: (2026)
I Know Therefore I Score: Label-Free Crafting of Scoring Functions using Constraints Based on Domain Expertise
di: Palakkadavath, Ragja, et al.
Pubblicazione: (2022)
di: Palakkadavath, Ragja, et al.
Pubblicazione: (2022)
Abstract Counterfactuals for Language Model Agents
di: Pona, Edoardo, et al.
Pubblicazione: (2025)
di: Pona, Edoardo, et al.
Pubblicazione: (2025)
Gödel's Poetry
di: Davis, Kelly J.
Pubblicazione: (2025)
di: Davis, Kelly J.
Pubblicazione: (2025)
EffGen: Enabling Small Language Models as Capable Autonomous Agents
di: Srivastava, Gaurav, et al.
Pubblicazione: (2026)
di: Srivastava, Gaurav, et al.
Pubblicazione: (2026)
Towards Improving NAM-to-Speech Synthesis Intelligibility using Self-Supervised Speech Models
di: Shah, Neil, et al.
Pubblicazione: (2024)
di: Shah, Neil, et al.
Pubblicazione: (2024)
Q-Probe: A Lightweight Approach to Reward Maximization for Language Models
di: Li, Kenneth, et al.
Pubblicazione: (2024)
di: Li, Kenneth, et al.
Pubblicazione: (2024)
Gödel Test: Can Large Language Models Solve Easy Conjectures?
di: Feldman, Moran, et al.
Pubblicazione: (2025)
di: Feldman, Moran, et al.
Pubblicazione: (2025)
Towards Reasoning Ability of Small Language Models
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
Polaris: Coupled Orbital Polar Embeddings for Hierarchical Concept Learning
di: Mishra, Sahil, et al.
Pubblicazione: (2026)
di: Mishra, Sahil, et al.
Pubblicazione: (2026)
The Realignment Problem: When Right becomes Wrong in LLMs
di: Sharma, Aakash Sen, et al.
Pubblicazione: (2025)
di: Sharma, Aakash Sen, et al.
Pubblicazione: (2025)
Persuasion Games using Large Language Models
di: Ramani, Ganesh Prasath, et al.
Pubblicazione: (2024)
di: Ramani, Ganesh Prasath, et al.
Pubblicazione: (2024)
Prescriptive Scaling Reveals the Evolution of Language Model Capabilities
di: Zhang, Hanlin, et al.
Pubblicazione: (2026)
di: Zhang, Hanlin, et al.
Pubblicazione: (2026)
Advancing NAM-to-Speech Conversion with Novel Methods and the MultiNAM Dataset
di: Shah, Neil, et al.
Pubblicazione: (2024)
di: Shah, Neil, et al.
Pubblicazione: (2024)
Deconstructing What Makes a Good Optimizer for Language Models
di: Zhao, Rosie, et al.
Pubblicazione: (2024)
di: Zhao, Rosie, et al.
Pubblicazione: (2024)
Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning
di: Jin, Jikai, et al.
Pubblicazione: (2025)
di: Jin, Jikai, et al.
Pubblicazione: (2025)
Learning an Inventory Control Policy with General Inventory Arrival Dynamics
di: Andaz, Sohrab, et al.
Pubblicazione: (2023)
di: Andaz, Sohrab, et al.
Pubblicazione: (2023)
Gradient-Based Optimization on Gödel Logic as Discrete Local Search
di: Daniele, Alessandro, et al.
Pubblicazione: (2025)
di: Daniele, Alessandro, et al.
Pubblicazione: (2025)
PACE: Two-Timescale Self-Evolution for Small Language Model Agents
di: Ling, Chen, et al.
Pubblicazione: (2026)
di: Ling, Chen, et al.
Pubblicazione: (2026)
MemoryGraft: Persistent Compromise of LLM Agents via Poisoned Experience Retrieval
di: Srivastava, Saksham Sahai, et al.
Pubblicazione: (2025)
di: Srivastava, Saksham Sahai, et al.
Pubblicazione: (2025)
Constraints-of-Thought: A Framework for Constrained Reasoning in Language-Model-Guided Search
di: Alrashedy, Kamel, et al.
Pubblicazione: (2025)
di: Alrashedy, Kamel, et al.
Pubblicazione: (2025)
Mind the Gap: Examining the Self-Improvement Capabilities of Large Language Models
di: Song, Yuda, et al.
Pubblicazione: (2024)
di: Song, Yuda, et al.
Pubblicazione: (2024)
Diminishing Returns in Expanding Generative Models and Godel-Tarski-Lob Limits
di: Majumdar, Angshul
Pubblicazione: (2026)
di: Majumdar, Angshul
Pubblicazione: (2026)
Matryoshka Representation Learning
di: Kusupati, Aditya, et al.
Pubblicazione: (2022)
di: Kusupati, Aditya, et al.
Pubblicazione: (2022)
Small Batch Size Training for Language Models: When Vanilla SGD Works, and Why Gradient Accumulation Is Wasteful
di: Marek, Martin, et al.
Pubblicazione: (2025)
di: Marek, Martin, et al.
Pubblicazione: (2025)
GQ-VAE: A gated quantized VAE for learning variable length tokens
di: Datta, Theo, et al.
Pubblicazione: (2025)
di: Datta, Theo, et al.
Pubblicazione: (2025)
Scaling Laws for Imitation Learning in Single-Agent Games
di: Tuyls, Jens, et al.
Pubblicazione: (2023)
di: Tuyls, Jens, et al.
Pubblicazione: (2023)
Policy and World Modeling Co-Training for Language Agents
di: Lu, Ning, et al.
Pubblicazione: (2026)
di: Lu, Ning, et al.
Pubblicazione: (2026)
Towards a Small Language Model Lifecycle Framework
di: Miraghaei, Parsa, et al.
Pubblicazione: (2025)
di: Miraghaei, Parsa, et al.
Pubblicazione: (2025)
Inpainting-Guided Policy Optimization for Diffusion Large Language Models
di: Zhao, Siyan, et al.
Pubblicazione: (2025)
di: Zhao, Siyan, et al.
Pubblicazione: (2025)
The Illusion of Generalization in Tabular Language Models
di: Gorla, Aditya, et al.
Pubblicazione: (2026)
di: Gorla, Aditya, et al.
Pubblicazione: (2026)
Abstract Art Interpretation Using ControlNet
di: Srivastava, Rishabh, et al.
Pubblicazione: (2024)
di: Srivastava, Rishabh, et al.
Pubblicazione: (2024)
PaperGuide: Making Small Language-Model Paper-Reading Agents More Efficient
di: Wang, Zijian, et al.
Pubblicazione: (2026)
di: Wang, Zijian, et al.
Pubblicazione: (2026)
Matching Features, Not Tokens: Energy-Based Fine-Tuning of Language Models
di: Jelassi, Samy, et al.
Pubblicazione: (2026)
di: Jelassi, Samy, et al.
Pubblicazione: (2026)
Low-Rank Agent-Specific Adaptation (LoRASA) for Multi-Agent Policy Learning
di: Zhang, Beining, et al.
Pubblicazione: (2025)
di: Zhang, Beining, et al.
Pubblicazione: (2025)
Sub-goal Distillation: A Method to Improve Small Language Agents
di: Hashemzadeh, Maryam, et al.
Pubblicazione: (2024)
di: Hashemzadeh, Maryam, et al.
Pubblicazione: (2024)
Policy Learning with a Language Bottleneck
di: Srivastava, Megha, et al.
Pubblicazione: (2024)
di: Srivastava, Megha, et al.
Pubblicazione: (2024)
PAGER: A Framework for Failure Analysis of Deep Regression Models
di: Thiagarajan, Jayaraman J., et al.
Pubblicazione: (2023)
di: Thiagarajan, Jayaraman J., et al.
Pubblicazione: (2023)
Selective Underfitting in Diffusion Models
di: Song, Kiwhan, et al.
Pubblicazione: (2025)
di: Song, Kiwhan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Forgetting is Competition: Rethinking Unlearning as Representation Interference in Diffusion Models
di: Ranjan, Ashutosh, et al.
Pubblicazione: (2026) -
The Silent Brush: Evaluating Artistic Style Leakage in AI Art Generation
di: Joshi, Ninad, et al.
Pubblicazione: (2026) -
I Know Therefore I Score: Label-Free Crafting of Scoring Functions using Constraints Based on Domain Expertise
di: Palakkadavath, Ragja, et al.
Pubblicazione: (2022) -
Abstract Counterfactuals for Language Model Agents
di: Pona, Edoardo, et al.
Pubblicazione: (2025) -
Gödel's Poetry
di: Davis, Kelly J.
Pubblicazione: (2025)