Should You Use Your Large Language Model to Explore or Exploit?
Fuente:
arXiv
Salvato in:
| Autori principali: | Harris, Keegan, Slivkins, Aleksandrs |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Can large language models explore in-context?
di: Krishnamurthy, Akshay, et al.
Pubblicazione: (2024)
di: Krishnamurthy, Akshay, et al.
Pubblicazione: (2024)
Introduction to Multi-Armed Bandits
di: Slivkins, Aleksandrs
Pubblicazione: (2019)
di: Slivkins, Aleksandrs
Pubblicazione: (2019)
Algorithmic Persuasion Through Simulation
di: Harris, Keegan, et al.
Pubblicazione: (2023)
di: Harris, Keegan, et al.
Pubblicazione: (2023)
When Should Models Change Their Minds? Contextual Belief Management in Large Language Models
di: Xu, Haoming, et al.
Pubblicazione: (2026)
di: Xu, Haoming, et al.
Pubblicazione: (2026)
Language Models Learn Universal Representations of Numbers and Here's Why You Should Care
di: Štefánik, Michal, et al.
Pubblicazione: (2025)
di: Štefánik, Michal, et al.
Pubblicazione: (2025)
Reasoning with Sampling: Your Base Model is Smarter Than You Think
di: Karan, Aayush, et al.
Pubblicazione: (2025)
di: Karan, Aayush, et al.
Pubblicazione: (2025)
SAC-KG: Exploiting Large Language Models as Skilled Automatic Constructors for Domain Knowledge Graphs
di: Chen, Hanzhu, et al.
Pubblicazione: (2024)
di: Chen, Hanzhu, et al.
Pubblicazione: (2024)
Large Language Models Explore by Latent Distilling
di: Zeng, Yuanhao, et al.
Pubblicazione: (2026)
di: Zeng, Yuanhao, et al.
Pubblicazione: (2026)
Constrained Sampling for Language Models Should Be Easy: An MCMC Perspective
di: Gonzalez, Emmanuel Anaya, et al.
Pubblicazione: (2025)
di: Gonzalez, Emmanuel Anaya, et al.
Pubblicazione: (2025)
Guidance is All You Need: Temperature-Guided Reasoning in Large Language Models
di: Gomaa, Eyad, et al.
Pubblicazione: (2024)
di: Gomaa, Eyad, et al.
Pubblicazione: (2024)
Your Finetuned Large Language Model is Already a Powerful Out-of-distribution Detector
di: Zhang, Andi, et al.
Pubblicazione: (2024)
di: Zhang, Andi, et al.
Pubblicazione: (2024)
Exploring and Benchmarking the Planning Capabilities of Large Language Models
di: Bohnet, Bernd, et al.
Pubblicazione: (2024)
di: Bohnet, Bernd, et al.
Pubblicazione: (2024)
Exploration and Persuasion
di: Slivkins, Aleksandrs
Pubblicazione: (2024)
di: Slivkins, Aleksandrs
Pubblicazione: (2024)
How Contaminated Is Your Benchmark? Quantifying Dataset Leakage in Large Language Models with Kernel Divergence
di: Choi, Hyeong Kyu, et al.
Pubblicazione: (2025)
di: Choi, Hyeong Kyu, et al.
Pubblicazione: (2025)
Exploring Multilingual Probing in Large Language Models: A Cross-Language Analysis
di: Li, Daoyang, et al.
Pubblicazione: (2024)
di: Li, Daoyang, et al.
Pubblicazione: (2024)
Are Retrials All You Need? Enhancing Large Language Model Reasoning Without Verbalized Feedback
di: Potamitis, Nearchos, et al.
Pubblicazione: (2025)
di: Potamitis, Nearchos, et al.
Pubblicazione: (2025)
Did You Forget What I Asked? Prospective Memory Failures in Large Language Models
di: Mittal, Avni
Pubblicazione: (2026)
di: Mittal, Avni
Pubblicazione: (2026)
Beyond the Last Answer: Your Reasoning Trace Uncovers More than You Think
di: Hammoud, Hasan Abed Al Kader, et al.
Pubblicazione: (2025)
di: Hammoud, Hasan Abed Al Kader, et al.
Pubblicazione: (2025)
Why is Your Language Model a Poor Implicit Reward Model?
di: Razin, Noam, et al.
Pubblicazione: (2025)
di: Razin, Noam, et al.
Pubblicazione: (2025)
Intent Factored Generation: Unleashing the Diversity in Your Language Model
di: Ahmed, Eltayeb, et al.
Pubblicazione: (2025)
di: Ahmed, Eltayeb, et al.
Pubblicazione: (2025)
Unveiling Imitation Learning: Exploring the Impact of Data Falsity to Large Language Model
di: Cho, Hyunsoo
Pubblicazione: (2024)
di: Cho, Hyunsoo
Pubblicazione: (2024)
Exploring Anti-Aging Literature via ConvexTopics and Large Language Models
di: Yeganova, Lana E., et al.
Pubblicazione: (2026)
di: Yeganova, Lana E., et al.
Pubblicazione: (2026)
Direct Preference Optimization: Your Language Model is Secretly a Reward Model
di: Rafailov, Rafael, et al.
Pubblicazione: (2023)
di: Rafailov, Rafael, et al.
Pubblicazione: (2023)
From Symbolic to Neural and Back: Exploring Knowledge Graph-Large Language Model Synergies
di: Škrlj, Blaž, et al.
Pubblicazione: (2025)
di: Škrlj, Blaž, et al.
Pubblicazione: (2025)
Large Language Models for Automating Clinical Data Standardization: HL7 FHIR Use Case
di: Riquelme, Alvaro, et al.
Pubblicazione: (2025)
di: Riquelme, Alvaro, et al.
Pubblicazione: (2025)
Can ChatGPT Learn My Life From a Week of First-Person Video?
di: Harris, Keegan
Pubblicazione: (2025)
di: Harris, Keegan
Pubblicazione: (2025)
Exploring Accuracy-Fairness Trade-off in Large Language Models
di: Zhang, Qingquan, et al.
Pubblicazione: (2024)
di: Zhang, Qingquan, et al.
Pubblicazione: (2024)
Oh! We Freeze: Improving Quantized Knowledge Distillation via Signal Propagation Analysis for Large Language Models
di: Bhardwaj, Kartikeya, et al.
Pubblicazione: (2024)
di: Bhardwaj, Kartikeya, et al.
Pubblicazione: (2024)
Exploring Concept Depth: How Large Language Models Acquire Knowledge and Concept at Different Layers?
di: Jin, Mingyu, et al.
Pubblicazione: (2024)
di: Jin, Mingyu, et al.
Pubblicazione: (2024)
Generating Individual Travel Diaries Using Large Language Models Informed by Census and Land-Use Data
di: Amin, Sepehr Golrokh, et al.
Pubblicazione: (2025)
di: Amin, Sepehr Golrokh, et al.
Pubblicazione: (2025)
Fortify the Shortest Stave in Attention: Enhancing Context Awareness of Large Language Models for Effective Tool Use
di: Chen, Yuhan, et al.
Pubblicazione: (2023)
di: Chen, Yuhan, et al.
Pubblicazione: (2023)
Language Models Use Trigonometry to Do Addition
di: Kantamneni, Subhash, et al.
Pubblicazione: (2025)
di: Kantamneni, Subhash, et al.
Pubblicazione: (2025)
Exploring Multilingual Large Language Models for Enhanced TNM classification of Radiology Report in lung cancer staging
di: Matsuo, Hidetoshi, et al.
Pubblicazione: (2024)
di: Matsuo, Hidetoshi, et al.
Pubblicazione: (2024)
Exploring the Reversal Curse and Other Deductive Logical Reasoning in BERT and GPT-Based Large Language Models
di: Wu, Da, et al.
Pubblicazione: (2023)
di: Wu, Da, et al.
Pubblicazione: (2023)
Exploring Memorization in Fine-tuned Language Models
di: Zeng, Shenglai, et al.
Pubblicazione: (2023)
di: Zeng, Shenglai, et al.
Pubblicazione: (2023)
Think Before You Prune: Self-Reflective Structured Pruning for Reasoning Language Models
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
CoDAR: Continuous Diffusion Language Models are More Powerful Than You Think
di: Shen, Junzhe, et al.
Pubblicazione: (2026)
di: Shen, Junzhe, et al.
Pubblicazione: (2026)
Use Your INSTINCT: INSTruction optimization for LLMs usIng Neural bandits Coupled with Transformers
di: Lin, Xiaoqiang, et al.
Pubblicazione: (2023)
di: Lin, Xiaoqiang, et al.
Pubblicazione: (2023)
Why Does ChatGPT "Delve" So Much? Exploring the Sources of Lexical Overrepresentation in Large Language Models
di: Juzek, Tom S., et al.
Pubblicazione: (2024)
di: Juzek, Tom S., et al.
Pubblicazione: (2024)
ArXivBench: When You Should Avoid Using ChatGPT for Academic Writing
di: Li, Ning, et al.
Pubblicazione: (2025)
di: Li, Ning, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Can large language models explore in-context?
di: Krishnamurthy, Akshay, et al.
Pubblicazione: (2024) -
Introduction to Multi-Armed Bandits
di: Slivkins, Aleksandrs
Pubblicazione: (2019) -
Algorithmic Persuasion Through Simulation
di: Harris, Keegan, et al.
Pubblicazione: (2023) -
When Should Models Change Their Minds? Contextual Belief Management in Large Language Models
di: Xu, Haoming, et al.
Pubblicazione: (2026) -
Language Models Learn Universal Representations of Numbers and Here's Why You Should Care
di: Štefánik, Michal, et al.
Pubblicazione: (2025)