Generating Symbolic World Models via Test-time Scaling of Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yu, Zhouliang, Yuan, Yuhuan, Xiao, Tim Z., Xia, Fuxiang Frank, Fu, Jie, Zhang, Ge, Lin, Ge, Liu, Weiyang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Massive Editing for Large Language Models via Meta Learning
par: Tan, Chenmien, et autres
Publié: (2023)
par: Tan, Chenmien, et autres
Publié: (2023)
FormalMATH: Benchmarking Formal Mathematical Reasoning of Large Language Models
par: Yu, Zhouliang, et autres
Publié: (2025)
par: Yu, Zhouliang, et autres
Publié: (2025)
Can Large Language Models Understand Symbolic Graphics Programs?
par: Qiu, Zeju, et autres
Publié: (2024)
par: Qiu, Zeju, et autres
Publié: (2024)
Your Finetuned Large Language Model is Already a Powerful Out-of-distribution Detector
par: Zhang, Andi, et autres
Publié: (2024)
par: Zhang, Andi, et autres
Publié: (2024)
Verbalized Machine Learning: Revisiting Machine Learning with Language Models
par: Xiao, Tim Z., et autres
Publié: (2024)
par: Xiao, Tim Z., et autres
Publié: (2024)
Symbolic Graphics Programming with Large Language Models
par: Chen, Yamei, et autres
Publié: (2025)
par: Chen, Yamei, et autres
Publié: (2025)
Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models
par: Chang, Kaiyan, et autres
Publié: (2025)
par: Chang, Kaiyan, et autres
Publié: (2025)
SimKO: Simple Pass@K Policy Optimization
par: Peng, Ruotian, et autres
Publié: (2025)
par: Peng, Ruotian, et autres
Publié: (2025)
SimulatorCoder: DNN Accelerator Simulator Code Generation and Optimization via Large Language Models
par: Xia, Yuhuan, et autres
Publié: (2026)
par: Xia, Yuhuan, et autres
Publié: (2026)
The World is Not Mono: Enabling Spatial Understanding in Large Audio-Language Models
par: You, Yuhuan, et autres
Publié: (2026)
par: You, Yuhuan, et autres
Publié: (2026)
Text2World: Benchmarking Large Language Models for Symbolic World Model Generation
par: Hu, Mengkang, et autres
Publié: (2025)
par: Hu, Mengkang, et autres
Publié: (2025)
Symbol-LLM: Towards Foundational Symbol-centric Interface For Large Language Models
par: Xu, Fangzhi, et autres
Publié: (2023)
par: Xu, Fangzhi, et autres
Publié: (2023)
CodeEditorBench: Evaluating Code Editing Capability of Large Language Models
par: Guo, Jiawei, et autres
Publié: (2024)
par: Guo, Jiawei, et autres
Publié: (2024)
LoRA-Gen: Specializing Large Language Model via Online LoRA Generation
par: Xiao, Yicheng, et autres
Publié: (2025)
par: Xiao, Yicheng, et autres
Publié: (2025)
Agent2World: Learning to Generate Symbolic World Models via Adaptive Multi-Agent Feedback
par: Hu, Mengkang, et autres
Publié: (2025)
par: Hu, Mengkang, et autres
Publié: (2025)
Chinese Tiny LLM: Pretraining a Chinese-Centric Large Language Model
par: Du, Xinrun, et autres
Publié: (2024)
par: Du, Xinrun, et autres
Publié: (2024)
Can Large Language Models Solve Path Constraints in Symbolic Execution?
par: Wang, Wenhan, et autres
Publié: (2025)
par: Wang, Wenhan, et autres
Publié: (2025)
Proxy Robustness in Vision Language Models is Effortlessly Transferable
par: Fu, Xiaowei, et autres
Publié: (2026)
par: Fu, Xiaowei, et autres
Publié: (2026)
Large-Scale Universal Defect Generation: Foundation Models and Datasets
par: Fan, Yuanting, et autres
Publié: (2026)
par: Fan, Yuanting, et autres
Publié: (2026)
A Compact Representation for Bayesian Neural Networks By Removing Permutation Symmetry
par: Xiao, Tim Z., et autres
Publié: (2023)
par: Xiao, Tim Z., et autres
Publié: (2023)
EgoPlan-Bench2: A Benchmark for Multimodal Large Language Model Planning in Real-World Scenarios
par: Qiu, Lu, et autres
Publié: (2024)
par: Qiu, Lu, et autres
Publié: (2024)
SEED-Story: Multimodal Long Story Generation with Large Language Model
par: Yang, Shuai, et autres
Publié: (2024)
par: Yang, Shuai, et autres
Publié: (2024)
Solver-Informed RL: Grounding Large Language Models for Authentic Optimization Modeling
par: Chen, Yitian, et autres
Publié: (2025)
par: Chen, Yitian, et autres
Publié: (2025)
AudioStory: Generating Long-Form Narrative Audio with Large Language Models
par: Guo, Yuxin, et autres
Publié: (2025)
par: Guo, Yuxin, et autres
Publié: (2025)
Enhancing Vision-Language Models Generalization via Diversity-Driven Novel Feature Synthesis
par: Yan, Siyuan, et autres
Publié: (2024)
par: Yan, Siyuan, et autres
Publié: (2024)
a1: Steep Test-time Scaling Law via Environment Augmented Generation
par: Mei, Lingrui, et autres
Publié: (2025)
par: Mei, Lingrui, et autres
Publié: (2025)
Hallucination Detection: Robustly Discerning Reliable Answers in Large Language Models
par: Chen, Yuyan, et autres
Publié: (2024)
par: Chen, Yuyan, et autres
Publié: (2024)
LLM4Causal: Democratized Causal Tools for Everyone via Large Language Model
par: Jiang, Haitao, et autres
Publié: (2023)
par: Jiang, Haitao, et autres
Publié: (2023)
SymGPT: Auditing Smart Contracts via Combining Symbolic Execution with Large Language Models
par: Xia, Shihao, et autres
Publié: (2025)
par: Xia, Shihao, et autres
Publié: (2025)
Neuro-Symbolic Artificial Intelligence: Towards Improving the Reasoning Abilities of Large Language Models
par: Yang, Xiao-Wen, et autres
Publié: (2025)
par: Yang, Xiao-Wen, et autres
Publié: (2025)
MMRC: A Large-Scale Benchmark for Understanding Multimodal Large Language Model in Real-World Conversation
par: Xue, Haochen, et autres
Publié: (2025)
par: Xue, Haochen, et autres
Publié: (2025)
Knowledge-Aware Code Generation with Large Language Models
par: Huang, Tao, et autres
Publié: (2024)
par: Huang, Tao, et autres
Publié: (2024)
Large Language Models as Test Case Generators: Performance Evaluation and Enhancement
par: Li, Kefan, et autres
Publié: (2024)
par: Li, Kefan, et autres
Publié: (2024)
FuzzCoder: Byte-level Fuzzing Test via Large Language Model
par: Yang, Liqun, et autres
Publié: (2024)
par: Yang, Liqun, et autres
Publié: (2024)
Weak/mild solutions to the space‐fractional wave equation
par: Weiyang Li, et autres
Publié: (2025)
par: Weiyang Li, et autres
Publié: (2025)
Plan and Budget: Effective and Efficient Test-Time Scaling on Reasoning Large Language Models
par: Lin, Junhong, et autres
Publié: (2025)
par: Lin, Junhong, et autres
Publié: (2025)
Probing the effectiveness of World Models for Spatial Reasoning through Test-time Scaling
par: Jha, Saurav, et autres
Publié: (2025)
par: Jha, Saurav, et autres
Publié: (2025)
On the Evaluation of Large Language Models in Unit Test Generation
par: Yang, Lin, et autres
Publié: (2024)
par: Yang, Lin, et autres
Publié: (2024)
Efficient Diversity-Preserving Diffusion Alignment via Gradient-Informed GFlowNets
par: Liu, Zhen, et autres
Publié: (2024)
par: Liu, Zhen, et autres
Publié: (2024)
Understanding Language Model Circuits through Knowledge Editing
par: Ge, Huaizhi, et autres
Publié: (2024)
par: Ge, Huaizhi, et autres
Publié: (2024)
Documents similaires
-
Massive Editing for Large Language Models via Meta Learning
par: Tan, Chenmien, et autres
Publié: (2023) -
FormalMATH: Benchmarking Formal Mathematical Reasoning of Large Language Models
par: Yu, Zhouliang, et autres
Publié: (2025) -
Can Large Language Models Understand Symbolic Graphics Programs?
par: Qiu, Zeju, et autres
Publié: (2024) -
Your Finetuned Large Language Model is Already a Powerful Out-of-distribution Detector
par: Zhang, Andi, et autres
Publié: (2024) -
Verbalized Machine Learning: Revisiting Machine Learning with Language Models
par: Xiao, Tim Z., et autres
Publié: (2024)