TermiGen: High-Fidelity Environment and Robust Trajectory Synthesis for Terminal Agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Kaijie, Nie, Yuzhou, Li, Yijiang, Huang, Yiming, Wu, Jialian, Liu, Jiang, Sun, Ximeng, Yin, Zhenfei, Wang, Lun, Liu, Zicheng, Barsoum, Emad, Wang, William Yang, Guo, Wenbo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
VideoSeek: Long-Horizon Video Agent with Tool-Guided Seeking
di: Lin, Jingyang, et al.
Pubblicazione: (2026)
di: Lin, Jingyang, et al.
Pubblicazione: (2026)
TTT-Bench: A Benchmark for Evaluating Reasoning Ability with Simple and Novel Tic-Tac-Toe-style Games
di: Mishra, Prakamya, et al.
Pubblicazione: (2025)
di: Mishra, Prakamya, et al.
Pubblicazione: (2025)
XModBench: Benchmarking Cross-Modal Capabilities and Consistency in Omni-Language Models
di: Wang, Xingrui, et al.
Pubblicazione: (2025)
di: Wang, Xingrui, et al.
Pubblicazione: (2025)
KeyVID: Keyframe-Aware Video Diffusion for Audio-Synchronized Visual Animation
di: Wang, Xingrui, et al.
Pubblicazione: (2025)
di: Wang, Xingrui, et al.
Pubblicazione: (2025)
Learning from Online Videos at Inference Time for Computer-Use Agents
di: Liu, Yujian, et al.
Pubblicazione: (2025)
di: Liu, Yujian, et al.
Pubblicazione: (2025)
Agent Laboratory: Using LLM Agents as Research Assistants
di: Schmidgall, Samuel, et al.
Pubblicazione: (2025)
di: Schmidgall, Samuel, et al.
Pubblicazione: (2025)
Latent Visual Reasoning
di: Li, Bangzheng, et al.
Pubblicazione: (2025)
di: Li, Bangzheng, et al.
Pubblicazione: (2025)
Instella-T2I: Pushing the Limits of 1D Discrete Latent Space Image Generation
di: Wang, Ze, et al.
Pubblicazione: (2025)
di: Wang, Ze, et al.
Pubblicazione: (2025)
ImageDoctor: Diagnosing Text-to-Image Generation via Grounded Image Reasoning
di: Guo, Yuxiang, et al.
Pubblicazione: (2025)
di: Guo, Yuxiang, et al.
Pubblicazione: (2025)
Self-Taught Agentic Long Context Understanding
di: Zhuang, Yufan, et al.
Pubblicazione: (2025)
di: Zhuang, Yufan, et al.
Pubblicazione: (2025)
DRIFT: Transferring Reasoning Priors for Efficient MLLM Fine-Tuning
di: Huang, Chao, et al.
Pubblicazione: (2025)
di: Huang, Chao, et al.
Pubblicazione: (2025)
CD4LM: Consistency Distillation and aDaptive Decoding for Diffusion Language Models
di: Liang, Yihao, et al.
Pubblicazione: (2026)
di: Liang, Yihao, et al.
Pubblicazione: (2026)
MOVi: Training-free Text-conditioned Multi-Object Video Generation
di: Rahman, Aimon, et al.
Pubblicazione: (2025)
di: Rahman, Aimon, et al.
Pubblicazione: (2025)
Unleashing Hour-Scale Video Training for Long Video-Language Understanding
di: Lin, Jingyang, et al.
Pubblicazione: (2025)
di: Lin, Jingyang, et al.
Pubblicazione: (2025)
CaptionQA: Is Your Caption as Useful as the Image Itself?
di: Yang, Shijia, et al.
Pubblicazione: (2025)
di: Yang, Shijia, et al.
Pubblicazione: (2025)
AdaptEvolve: Improving Efficiency of Evolutionary AI Agents through Adaptive Model Selection
di: Ray, Pretam, et al.
Pubblicazione: (2026)
di: Ray, Pretam, et al.
Pubblicazione: (2026)
TaDA: Training-free recipe for Decoding with Adaptive KV Cache Compression and Mean-centering
di: Joshi, Vinay, et al.
Pubblicazione: (2025)
di: Joshi, Vinay, et al.
Pubblicazione: (2025)
Stabilizing Efficient Reasoning with Step-Level Advantage Selection
di: Wang, Han, et al.
Pubblicazione: (2026)
di: Wang, Han, et al.
Pubblicazione: (2026)
Instella: Fully Open Language Models with Stellar Performance
di: Liu, Jiang, et al.
Pubblicazione: (2025)
di: Liu, Jiang, et al.
Pubblicazione: (2025)
SoftVQ-VAE: Efficient 1-Dimensional Continuous Tokenizer
di: Chen, Hao, et al.
Pubblicazione: (2024)
di: Chen, Hao, et al.
Pubblicazione: (2024)
Pause and Think: A Dataset and Benchmark for Video-Grounded Assistive Action Suggestion
di: Singh, Shivam, et al.
Pubblicazione: (2026)
di: Singh, Shivam, et al.
Pubblicazione: (2026)
Mental-Gen: A Brain-Computer Interface-Based Interactive Method for Interior Space Generative Design
di: Liu, Yijiang, et al.
Pubblicazione: (2024)
di: Liu, Yijiang, et al.
Pubblicazione: (2024)
SAND-Math: Using LLMs to Generate Novel, Difficult and Useful Mathematics Questions and Answers
di: Manem, Chaitanya, et al.
Pubblicazione: (2025)
di: Manem, Chaitanya, et al.
Pubblicazione: (2025)
PR2: Predictive Routing Replay for MoE-Based LLM Reinforcement Learning
di: Dong, Daize, et al.
Pubblicazione: (2026)
di: Dong, Daize, et al.
Pubblicazione: (2026)
DUET-VLM: Dual stage Unified Efficient Token reduction for VLM Training and Inference
di: Singh, Aditya Kumar, et al.
Pubblicazione: (2026)
di: Singh, Aditya Kumar, et al.
Pubblicazione: (2026)
Reliable Use of Lemmas via Eligibility Reasoning and Section$-$Aware Reinforcement Learning
di: Xu, Zhikun, et al.
Pubblicazione: (2026)
di: Xu, Zhikun, et al.
Pubblicazione: (2026)
Mindscape: Research of high-information density street environments based on electroencephalogram recording and virtual reality head-mounted simulation
di: Liu, Yijiang, et al.
Pubblicazione: (2024)
di: Liu, Yijiang, et al.
Pubblicazione: (2024)
Athena: Enhancing Multimodal Reasoning with Data-efficient Process Reward Models
di: Wang, Shuai, et al.
Pubblicazione: (2025)
di: Wang, Shuai, et al.
Pubblicazione: (2025)
rePIRL: Learn PRM with Inverse RL for LLM Reasoning
di: Wu, Xian, et al.
Pubblicazione: (2026)
di: Wu, Xian, et al.
Pubblicazione: (2026)
APRIL: Active Partial Rollouts in Reinforcement Learning to Tame Long-tail Generation
di: Zhou, Yuzhen, et al.
Pubblicazione: (2025)
di: Zhou, Yuzhen, et al.
Pubblicazione: (2025)
BlueCodeAgent: A Blue Teaming Agent Enabled by Automated Red Teaming for CodeGen AI
di: Guo, Chengquan, et al.
Pubblicazione: (2025)
di: Guo, Chengquan, et al.
Pubblicazione: (2025)
Taming Diffusion Prior for Image Super-Resolution with Domain Shift SDEs
di: Cui, Qinpeng, et al.
Pubblicazione: (2024)
di: Cui, Qinpeng, et al.
Pubblicazione: (2024)
B-VLLM: A Vision Large Language Model with Balanced Spatio-Temporal Tokens
di: Lu, Zhuqiang, et al.
Pubblicazione: (2024)
di: Lu, Zhuqiang, et al.
Pubblicazione: (2024)
Towards Trustworthy Unsupervised Domain Adaptation: A Representation Learning Perspective for Enhancing Robustness, Discrimination, and Generalization
di: Yin, Jia-Li, et al.
Pubblicazione: (2024)
di: Yin, Jia-Li, et al.
Pubblicazione: (2024)
OpenSage: Self-programming Agent Generation Engine
di: Li, Hongwei, et al.
Pubblicazione: (2026)
di: Li, Hongwei, et al.
Pubblicazione: (2026)
PARD: Accelerating LLM Inference with Low-Cost PARallel Draft Model Adaptation
di: An, Zihao, et al.
Pubblicazione: (2025)
di: An, Zihao, et al.
Pubblicazione: (2025)
PARD-2: Target-Aligned Parallel Draft Model for Dual-Mode Speculative Decoding
di: An, Zihao, et al.
Pubblicazione: (2026)
di: An, Zihao, et al.
Pubblicazione: (2026)
E-MMDiT: Revisiting Multimodal Diffusion Transformer Design for Fast Image Synthesis under Limited Resources
di: Shen, Tong, et al.
Pubblicazione: (2025)
di: Shen, Tong, et al.
Pubblicazione: (2025)
Theory-optimal Quantization Based on Flatness
di: Huang, Xiusheng, et al.
Pubblicazione: (2026)
di: Huang, Xiusheng, et al.
Pubblicazione: (2026)
FIGRET: Fine-Grained Robustness-Enhanced Traffic Engineering
di: Liu, Ximeng, et al.
Pubblicazione: (2024)
di: Liu, Ximeng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
VideoSeek: Long-Horizon Video Agent with Tool-Guided Seeking
di: Lin, Jingyang, et al.
Pubblicazione: (2026) -
TTT-Bench: A Benchmark for Evaluating Reasoning Ability with Simple and Novel Tic-Tac-Toe-style Games
di: Mishra, Prakamya, et al.
Pubblicazione: (2025) -
XModBench: Benchmarking Cross-Modal Capabilities and Consistency in Omni-Language Models
di: Wang, Xingrui, et al.
Pubblicazione: (2025) -
KeyVID: Keyframe-Aware Video Diffusion for Audio-Synchronized Visual Animation
di: Wang, Xingrui, et al.
Pubblicazione: (2025) -
Learning from Online Videos at Inference Time for Computer-Use Agents
di: Liu, Yujian, et al.
Pubblicazione: (2025)