Time-Scaling Is What Agents Need Now
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Zhi, Wang, Guangzhi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Refine Thought: A Test-Time Inference Method for Embedding Model Reasoning
di: Wang, Guangzhi, et al.
Pubblicazione: (2025)
di: Wang, Guangzhi, et al.
Pubblicazione: (2025)
Do Proactive Agents Really Need an LLM to Decide When to Wake and What to Anchor?
di: Liu, Xiaoze, et al.
Pubblicazione: (2026)
di: Liu, Xiaoze, et al.
Pubblicazione: (2026)
Rho-1: Not All Tokens Are What You Need
di: Lin, Zhenghao, et al.
Pubblicazione: (2024)
di: Lin, Zhenghao, et al.
Pubblicazione: (2024)
Agentic Test-Time Scaling for WebAgents
di: Lee, Nicholas, et al.
Pubblicazione: (2026)
di: Lee, Nicholas, et al.
Pubblicazione: (2026)
A Survey on Test-Time Scaling in Large Language Models: What, How, Where, and How Well?
di: Zhang, Qiyuan, et al.
Pubblicazione: (2025)
di: Zhang, Qiyuan, et al.
Pubblicazione: (2025)
Benchmark Test-Time Scaling of General LLM Agents
di: Li, Xiaochuan, et al.
Pubblicazione: (2026)
di: Li, Xiaochuan, et al.
Pubblicazione: (2026)
TUMIX: Multi-Agent Test-Time Scaling with Tool-Use Mixture
di: Chen, Yongchao, et al.
Pubblicazione: (2025)
di: Chen, Yongchao, et al.
Pubblicazione: (2025)
MineLand: Simulating Large-Scale Multi-Agent Interactions with Limited Multimodal Senses and Physical Needs
di: Yu, Xianhao, et al.
Pubblicazione: (2024)
di: Yu, Xianhao, et al.
Pubblicazione: (2024)
Not All Documents Are What You Need for Extracting Instruction Tuning Data
di: Zhang, Chi, et al.
Pubblicazione: (2025)
di: Zhang, Chi, et al.
Pubblicazione: (2025)
Now It Sounds Like You: Learning Personalized Vocabulary On Device
di: Wang, Sid, et al.
Pubblicazione: (2023)
di: Wang, Sid, et al.
Pubblicazione: (2023)
Terminal-World: Scaling Terminal-Agent Environments via Agent Skills
di: Cheng, Zihao, et al.
Pubblicazione: (2026)
di: Cheng, Zihao, et al.
Pubblicazione: (2026)
AgentFugue: Agent Scaling for Long-Horizon Tasks through Collective Reasoning
di: Hu, Yuyang, et al.
Pubblicazione: (2026)
di: Hu, Yuyang, et al.
Pubblicazione: (2026)
BrowseConf: Confidence-Guided Test-Time Scaling for Web Agents
di: Ou, Litu, et al.
Pubblicazione: (2025)
di: Ou, Litu, et al.
Pubblicazione: (2025)
Agents Are All You Need for LLM Unlearning
di: Sanyal, Debdeep, et al.
Pubblicazione: (2025)
di: Sanyal, Debdeep, et al.
Pubblicazione: (2025)
The Scaling Laws of Skills in LLM Agent Systems
di: Chen, Charles, et al.
Pubblicazione: (2026)
di: Chen, Charles, et al.
Pubblicazione: (2026)
Measuring the Redundancy of Decoder Layers in SpeechLLMs
di: Moumen, Adel, et al.
Pubblicazione: (2026)
di: Moumen, Adel, et al.
Pubblicazione: (2026)
Cross-Lingual Interleaving for Speech Language Models
di: Moumen, Adel, et al.
Pubblicazione: (2025)
di: Moumen, Adel, et al.
Pubblicazione: (2025)
Reasoning Beyond Chain-of-Thought: A Latent Computational Mode in Large Language Models
di: He, Zhenghao, et al.
Pubblicazione: (2026)
di: He, Zhenghao, et al.
Pubblicazione: (2026)
Toward Faithful Retrieval-Augmented Generation with Sparse Autoencoders
di: Xiong, Guangzhi, et al.
Pubblicazione: (2025)
di: Xiong, Guangzhi, et al.
Pubblicazione: (2025)
More Compute Is What You Need
di: Guo, Zhen
Pubblicazione: (2024)
di: Guo, Zhen
Pubblicazione: (2024)
What Scales in Cross-Entropy Scaling Law?
di: Yan, Junxi, et al.
Pubblicazione: (2025)
di: Yan, Junxi, et al.
Pubblicazione: (2025)
From Physician Expertise to Clinical Agents: Preserving, Standardizing, and Scaling Physicians' Medical Expertise with Lightweight LLM
di: Luo, Chanyong, et al.
Pubblicazione: (2026)
di: Luo, Chanyong, et al.
Pubblicazione: (2026)
Benchmarking Retrieval-Augmented Generation for Medicine
di: Xiong, Guangzhi, et al.
Pubblicazione: (2024)
di: Xiong, Guangzhi, et al.
Pubblicazione: (2024)
What Matters in Transformers? Not All Attention is Needed
di: He, Shwai, et al.
Pubblicazione: (2024)
di: He, Shwai, et al.
Pubblicazione: (2024)
Forest-of-Thought: Scaling Test-Time Compute for Enhancing LLM Reasoning
di: Bi, Zhenni, et al.
Pubblicazione: (2024)
di: Bi, Zhenni, et al.
Pubblicazione: (2024)
Skills on the Fly: Test-Time Adaptive Skill Synthesis for LLM Agents
di: Wang, Jingxing, et al.
Pubblicazione: (2026)
di: Wang, Jingxing, et al.
Pubblicazione: (2026)
s3: You Don't Need That Much Data to Train a Search Agent via RL
di: Jiang, Pengcheng, et al.
Pubblicazione: (2025)
di: Jiang, Pengcheng, et al.
Pubblicazione: (2025)
Bottom-up Domain-specific Superintelligence: A Reliable Knowledge Graph is What We Need
di: Dedhia, Bhishma, et al.
Pubblicazione: (2025)
di: Dedhia, Bhishma, et al.
Pubblicazione: (2025)
Not All Preferences are What You Need for Post-Training: Selective Alignment Strategy for Preference Optimization
di: Dong, Zhijin
Pubblicazione: (2025)
di: Dong, Zhijin
Pubblicazione: (2025)
Only Send What You Need: Learning to Communicate Efficiently in Federated Multilingual Machine Translation
di: Chu, Yun-Wei, et al.
Pubblicazione: (2024)
di: Chu, Yun-Wei, et al.
Pubblicazione: (2024)
ARE: Scaling Up Agent Environments and Evaluations
di: Froger, Romain, et al.
Pubblicazione: (2025)
di: Froger, Romain, et al.
Pubblicazione: (2025)
Agent-World: Scaling Real-World Environment Synthesis for Evolving General Agent Intelligence
di: Dong, Guanting, et al.
Pubblicazione: (2026)
di: Dong, Guanting, et al.
Pubblicazione: (2026)
Do Stop Me Now: Detecting Boilerplate Responses with a Single Iteration
di: Kainan, Yuval, et al.
Pubblicazione: (2025)
di: Kainan, Yuval, et al.
Pubblicazione: (2025)
EcoAct: Economic Agent Determines When to Register What Action
di: Zhang, Shaokun, et al.
Pubblicazione: (2024)
di: Zhang, Shaokun, et al.
Pubblicazione: (2024)
Rethinking Data Selection at Scale: Random Selection is Almost All You Need
di: Xia, Tingyu, et al.
Pubblicazione: (2024)
di: Xia, Tingyu, et al.
Pubblicazione: (2024)
Improving Retrieval-Augmented Generation in Medicine with Iterative Follow-up Questions
di: Xiong, Guangzhi, et al.
Pubblicazione: (2024)
di: Xiong, Guangzhi, et al.
Pubblicazione: (2024)
AutoAugment Is What You Need: Enhancing Rule-based Augmentation Methods in Low-resource Regimes
di: Choi, Juhwan, et al.
Pubblicazione: (2024)
di: Choi, Juhwan, et al.
Pubblicazione: (2024)
Pay Attention to What You Need
di: Gao, Yifei, et al.
Pubblicazione: (2023)
di: Gao, Yifei, et al.
Pubblicazione: (2023)
More Agents Is All You Need
di: Li, Junyou, et al.
Pubblicazione: (2024)
di: Li, Junyou, et al.
Pubblicazione: (2024)
CASE-Bench: Context-Aware SafEty Benchmark for Large Language Models
di: Sun, Guangzhi, et al.
Pubblicazione: (2025)
di: Sun, Guangzhi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Refine Thought: A Test-Time Inference Method for Embedding Model Reasoning
di: Wang, Guangzhi, et al.
Pubblicazione: (2025) -
Do Proactive Agents Really Need an LLM to Decide When to Wake and What to Anchor?
di: Liu, Xiaoze, et al.
Pubblicazione: (2026) -
Rho-1: Not All Tokens Are What You Need
di: Lin, Zhenghao, et al.
Pubblicazione: (2024) -
Agentic Test-Time Scaling for WebAgents
di: Lee, Nicholas, et al.
Pubblicazione: (2026) -
A Survey on Test-Time Scaling in Large Language Models: What, How, Where, and How Well?
di: Zhang, Qiyuan, et al.
Pubblicazione: (2025)