Self-Questioning Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Lili, Prabhudesai, Mihir, Fragkiadaki, Katerina, Liu, Hao, Pathak, Deepak |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Maximizing Confidence Alone Improves Reasoning
di: Prabhudesai, Mihir, et al.
Pubblicazione: (2025)
di: Prabhudesai, Mihir, et al.
Pubblicazione: (2025)
Aligning Text-to-Image Diffusion Models with Reward Backpropagation
di: Prabhudesai, Mihir, et al.
Pubblicazione: (2023)
di: Prabhudesai, Mihir, et al.
Pubblicazione: (2023)
Diffusion Beats Autoregressive in Data-Constrained Settings
di: Prabhudesai, Mihir, et al.
Pubblicazione: (2025)
di: Prabhudesai, Mihir, et al.
Pubblicazione: (2025)
Unified Multimodal Discrete Diffusion
di: Swerdlow, Alexander, et al.
Pubblicazione: (2025)
di: Swerdlow, Alexander, et al.
Pubblicazione: (2025)
Video Diffusion Alignment via Reward Gradients
di: Prabhudesai, Mihir, et al.
Pubblicazione: (2024)
di: Prabhudesai, Mihir, et al.
Pubblicazione: (2024)
Iterative Refinement Improves Compositional Image Generation
di: Jaiswal, Shantanu, et al.
Pubblicazione: (2026)
di: Jaiswal, Shantanu, et al.
Pubblicazione: (2026)
Solving Physics Olympiad via Reinforcement Learning on Physics Simulators
di: Prabhudesai, Mihir, et al.
Pubblicazione: (2026)
di: Prabhudesai, Mihir, et al.
Pubblicazione: (2026)
Can LLMs Lie? Investigation beyond Hallucination
di: Huan, Haoran, et al.
Pubblicazione: (2025)
di: Huan, Haoran, et al.
Pubblicazione: (2025)
3D Diffuser Actor: Policy Diffusion with 3D Scene Representations
di: Ke, Tsung-Wei, et al.
Pubblicazione: (2024)
di: Ke, Tsung-Wei, et al.
Pubblicazione: (2024)
HELPER-X: A Unified Instructable Embodied Agent to Tackle Four Interactive Vision-Language Domains with Memory-Augmented Language Models
di: Sarch, Gabriel, et al.
Pubblicazione: (2024)
di: Sarch, Gabriel, et al.
Pubblicazione: (2024)
Bridging Vision Language Models and Symbolic Grounding for Video Question Answering
di: Ma, Haodi, et al.
Pubblicazione: (2025)
di: Ma, Haodi, et al.
Pubblicazione: (2025)
Intrinsic Explainability of Multimodal Learning for Crop Yield Prediction
di: Najjar, Hiba, et al.
Pubblicazione: (2025)
di: Najjar, Hiba, et al.
Pubblicazione: (2025)
Marginals Before Conditionals
di: Sahasrabudhe, Mihir
Pubblicazione: (2026)
di: Sahasrabudhe, Mihir
Pubblicazione: (2026)
Meta-Evolve: Continuous Robot Evolution for One-to-many Policy Transfer
di: Liu, Xingyu, et al.
Pubblicazione: (2024)
di: Liu, Xingyu, et al.
Pubblicazione: (2024)
Evolutionary Policy Optimization
di: Wang, Jianren, et al.
Pubblicazione: (2025)
di: Wang, Jianren, et al.
Pubblicazione: (2025)
Energy-based Models are Zero-Shot Planners for Compositional Scene Rearrangement
di: Gkanatsios, Nikolaos, et al.
Pubblicazione: (2023)
di: Gkanatsios, Nikolaos, et al.
Pubblicazione: (2023)
Diffusion-ES: Gradient-free Planning with Diffusion for Autonomous Driving and Zero-Shot Instruction Following
di: Yang, Brian, et al.
Pubblicazione: (2024)
di: Yang, Brian, et al.
Pubblicazione: (2024)
VLM Agents Generate Their Own Memories: Distilling Experience into Embodied Programs of Thought
di: Sarch, Gabriel, et al.
Pubblicazione: (2024)
di: Sarch, Gabriel, et al.
Pubblicazione: (2024)
UQ: Assessing Language Models on Unsolved Questions
di: Nie, Fan, et al.
Pubblicazione: (2025)
di: Nie, Fan, et al.
Pubblicazione: (2025)
ODIN: A Single Model for 2D and 3D Segmentation
di: Jain, Ayush, et al.
Pubblicazione: (2024)
di: Jain, Ayush, et al.
Pubblicazione: (2024)
Jasmine: A Simple, Performant and Scalable JAX-based World Modeling Codebase
di: Mahajan, Mihir, et al.
Pubblicazione: (2025)
di: Mahajan, Mihir, et al.
Pubblicazione: (2025)
Sanity Checks for Explanation Uncertainty
di: Valdenegro-Toro, Matias, et al.
Pubblicazione: (2024)
di: Valdenegro-Toro, Matias, et al.
Pubblicazione: (2024)
Uncertainty Quantification for Gradient-based Explanations in Neural Networks
di: Mulye, Mihir, et al.
Pubblicazione: (2024)
di: Mulye, Mihir, et al.
Pubblicazione: (2024)
Question-Adaptive Graph Learning for Multi-hop Retrieval Augmented Generation
di: Yan, Yuchen, et al.
Pubblicazione: (2025)
di: Yan, Yuchen, et al.
Pubblicazione: (2025)
Self-Improving Tabular Language Models via Iterative Reward-Guided Post-Training
di: Long, Yunbo, et al.
Pubblicazione: (2026)
di: Long, Yunbo, et al.
Pubblicazione: (2026)
Flora: Low-Rank Adapters Are Secretly Gradient Compressors
di: Hao, Yongchang, et al.
Pubblicazione: (2024)
di: Hao, Yongchang, et al.
Pubblicazione: (2024)
NeuZip: Memory-Efficient Training and Inference with Dynamic Compression of Neural Networks
di: Hao, Yongchang, et al.
Pubblicazione: (2024)
di: Hao, Yongchang, et al.
Pubblicazione: (2024)
Over-Searching in Search-Augmented Large Language Models
di: Xie, Roy, et al.
Pubblicazione: (2026)
di: Xie, Roy, et al.
Pubblicazione: (2026)
Do Neural Networks Lose Plasticity in a Gradually Changing World?
di: Liu, Tianhui, et al.
Pubblicazione: (2026)
di: Liu, Tianhui, et al.
Pubblicazione: (2026)
Learnware of Language Models: Specialized Small Language Models Can Do Big
di: Tan, Zhi-Hao, et al.
Pubblicazione: (2025)
di: Tan, Zhi-Hao, et al.
Pubblicazione: (2025)
SSR: Socratic Self-Refine for Large Language Model Reasoning
di: Shi, Haizhou, et al.
Pubblicazione: (2025)
di: Shi, Haizhou, et al.
Pubblicazione: (2025)
SIMU: Selective Influence Machine Unlearning
di: Agarwal, Anu, et al.
Pubblicazione: (2025)
di: Agarwal, Anu, et al.
Pubblicazione: (2025)
Cactus: Accelerating Auto-Regressive Decoding with Constrained Acceptance Speculative Sampling
di: Hao, Yongchang, et al.
Pubblicazione: (2026)
di: Hao, Yongchang, et al.
Pubblicazione: (2026)
Reasoning on the Manifold: Bidirectional Consistency for Self-Verification in Diffusion Language Models
di: Ruan, Jiaoyang, et al.
Pubblicazione: (2026)
di: Ruan, Jiaoyang, et al.
Pubblicazione: (2026)
Rephrase and Respond: Let Large Language Models Ask Better Questions for Themselves
di: Deng, Yihe, et al.
Pubblicazione: (2023)
di: Deng, Yihe, et al.
Pubblicazione: (2023)
Provable Training Data Identification for Large Language Models
di: Liu, Zhenlong, et al.
Pubblicazione: (2025)
di: Liu, Zhenlong, et al.
Pubblicazione: (2025)
An Interpretable and Scalable Framework for Evaluating Large Language Models
di: Qu, Xinhao, et al.
Pubblicazione: (2026)
di: Qu, Xinhao, et al.
Pubblicazione: (2026)
SelfIE: Self-Interpretation of Large Language Model Embeddings
di: Chen, Haozhe, et al.
Pubblicazione: (2024)
di: Chen, Haozhe, et al.
Pubblicazione: (2024)
Self-Exploring Language Models: Active Preference Elicitation for Online Alignment
di: Zhang, Shenao, et al.
Pubblicazione: (2024)
di: Zhang, Shenao, et al.
Pubblicazione: (2024)
SelfBC: Self Behavior Cloning for Offline Reinforcement Learning
di: Liu, Shirong, et al.
Pubblicazione: (2024)
di: Liu, Shirong, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Maximizing Confidence Alone Improves Reasoning
di: Prabhudesai, Mihir, et al.
Pubblicazione: (2025) -
Aligning Text-to-Image Diffusion Models with Reward Backpropagation
di: Prabhudesai, Mihir, et al.
Pubblicazione: (2023) -
Diffusion Beats Autoregressive in Data-Constrained Settings
di: Prabhudesai, Mihir, et al.
Pubblicazione: (2025) -
Unified Multimodal Discrete Diffusion
di: Swerdlow, Alexander, et al.
Pubblicazione: (2025) -
Video Diffusion Alignment via Reward Gradients
di: Prabhudesai, Mihir, et al.
Pubblicazione: (2024)