Resultados de búsqueda - (endedededededededededededededededecoding OR decoding) (algorithmics OR algorithm)

  1. 1261

    An Exploratory Framework for Future SETI Applications: Detecting Generative Reactivity via Language Models por Yu, Po-Chieh

    Publicado 2025
    Tabla de Contenidos: “… responses in language models. Instead of assuming that extraterrestrial signals must be decoded, we evaluate…”
    Enlace del recurso
    Preprint
  2. 1262

    Towards Bridging the Reward-Generation Gap in Direct Alignment Algorithms por Xiao, Zeguan, Chen, Yun, Chen, Guanhua, Tang, Ke

    Publicado 2025
    Tabla de Contenidos: “… Feedback (RLHF) algorithms for aligning large language models (LLMs) with human preferences. However, DAAs…”
    Enlace del recurso
    Preprint
  3. 1263

    ABS: Enforcing Constraint Satisfaction On Generated Sequences Via Automata-Guided Beam Search por Collura, Vincenzo, Tit, Karim, Bussi, Laura, Giunchiglia, Eleonora, Cordy, Maxime

    Publicado 2025
    Tabla de Contenidos: “… ones, and beam search is commonly used to balance exploration and fluency during decoding. While deep…”
    Enlace del recurso
    Preprint
  4. 1264
  5. 1265

    Reading Images Like Texts: Sequential Image Understanding in Vision-Language Models por Li, Yueyan, Zhao, Chenggong, Zang, Zeyuan, Yuan, Caixia, Wang, Xiaojie

    Publicado 2025
    Tabla de Contenidos: “… an instruction-agnostic token compression algorithm based on a plug-and-play visual decoder to improve decoding…”
    Enlace del recurso
    Preprint
  6. 1266

    STARS: Synchronous Token Alignment for Robust Supervision in Large Language Models por Quamar, Mohammad Atif, Areeb, Mohammad, Kuznetsov, Mikhail, Ozmen, Muslum Ozgur, Celik, Z. Berkay

    Publicado 2025
    Tabla de Contenidos: “…, we introduce STARS, Synchronous Token Alignment for Robust Supervision, a decoding-time algorithm…”
    Enlace del recurso
    Preprint
  7. 1267

    An Information-Minimal Geometry for Qubit-Efficient Optimization por Ma, Gordon, Angelakis, Dimitris G.

    Publicado 2025
    Tabla de Contenidos: “… algorithms explore exponentially large Hilbert spaces. We recast qubit-efficient optimization as a geometric…”
    Enlace del recurso
    Preprint
  8. 1268

    Evolving Diffusion and Flow Matching Policies for Online Reinforcement Learning por Zhang, Chubin, Wan, Zhenglin, Chen, Feng, Yang, Fuchao, Feng, Lang, Zhou, Yaxin, Yu, Xingrui, You, Yang, Tsang, Ivor, An, Bo

    Publicado 2025
    Tabla de Contenidos: “… generation. Building on this, we introduce GoRL (Generative Online Reinforcement Learning), an algorithm…”
    Enlace del recurso
    Preprint
  9. 1269

    Short-Context Dominance: How Much Local Context Natural Language Actually Needs? por Vakilian, Vala, Wang, Zimeng, Rawat, Ankit Singh, Thrampoulidis, Christos

    Publicado 2025
    Tabla de Contenidos: “… with sampling strategies beyond greedy decoding. Our experiments validate that simple thresholding of the metric…”
    Enlace del recurso
    Preprint
  10. 1270

    Hold Onto That Thought: Assessing KV Cache Compression On Reasoning por Liu, Minghui, Palnitkar, Aadi, Rabbani, Tahseen, Jae, Hyunwoo, Sang, Kyle Rui, Yao, Dixi, Shabihi, Shayan, Zhao, Fuheng, Li, Tian, Zhang, Ce, Huang, Furong, Zhang, Kunpeng

    Publicado 2025
    Tabla de Contenidos: “… attention computations, grows linearly with context length. A suite of compression algorithms has been…”
    Enlace del recurso
    Preprint
  11. 1271

    LoPA: Scaling dLLM Inference via Lookahead Parallel Decoding por Xu, Chenkai, Jin, Yijie, Li, Jiajun, Tu, Yi, Long, Guoping, Tu, Dandan, Song, Mingcong, Si, Hongjie, Hou, Tianqi, Yan, Junchi, Deng, Zhijie

    Publicado 2025
    Tabla de Contenidos: “… inference. However, current confidence-driven decoding strategies are constrained by limited parallelism…”
    Enlace del recurso
    Preprint
  12. 1272

    Martingale Foresight Sampling: A Principled Approach to Inference-Time LLM Decoding por Li, Huayu, He, ZhengXiao, Tian, Siyuan, Wen, Jinghao, Li, Ao

    Publicado 2026
    Tabla de Contenidos: “…Standard autoregressive decoding in large language models (LLMs) is inherently short-sighted, often…”
    Enlace del recurso
    Preprint
  13. 1273
  14. 1274

    Reasoning Cache: Continual Improvement Over Long Horizons via Short-Horizon RL por Wu, Ian, Qu, Yuxiao, Setlur, Amrith, Kumar, Aviral

    Publicado 2026
    Tabla de Contenidos: “… RC, an iterative decoding algorithm that replaces standard autoregressive decoding during both…”
    Enlace del recurso
    Preprint
  15. 1275

    Listen to the Layers: Mitigating Hallucinations with Inter-Layer Disagreement por Subbalakshmi, Koduvayur, Ujjal, Sabbir Hossain, Mangichetty, Venkata Krishna Teja, Soofi, Nastaran Jamalipour

    Publicado 2026
    Tabla de Contenidos: “… Aware) decoder, a novel, training-free decoding algorithm that mitigates hallucinations at inference…”
    Enlace del recurso
    Preprint
  16. 1276

    ViterbiPlanNet: Injecting Procedural Knowledge via Differentiable Viterbi for Planning in Instructional Videos por Seminara, Luigi, Moltisanti, Davide, Furnari, Antonino

    Publicado 2026
    Tabla de Contenidos: “… with the Viterbi decoding algorithm, replacing non-differentiable operations with smooth relaxations that enable…”
    Enlace del recurso
    Preprint
  17. 1277

    $\nabla$-Reasoner: LLM Reasoning via Test-Time Gradient Descent in Latent Space por Wang, Peihao, Cai, Ruisi, Wang, Zhen, Mei, Hongyuan, Liu, Qiang, Li, Pan, Wang, Zhangyang

    Publicado 2026
    Tabla de Contenidos: “… and suboptimal discrete search algorithms or trial-and-error prompting to improve the online policy…”
    Enlace del recurso
    Preprint
  18. 1278

    The Model Knows, the Decoder Finds: Future Value Guided Particle Power Sampling por Nguyen, Tu, Zimmer, Matthieu, Tutunov, Rasul, Ji, Xiaotong, Ammar, Haitham Bou

    Publicado 2026
    Tabla de Contenidos: “… at inference time. Power sampling provides a principled way to bias decoding toward such modes by targeting…”
    Enlace del recurso
    Preprint
  19. 1279

    Mix-Quant: Quantized Prefilling, Precise Decoding for Agentic LLMs por Lu, Haiquan, Chen, Zigeng, Fang, Gongfan, Ma, Xinyin, Wang, Xinchao

    Publicado 2026
    Tabla de Contenidos: “… preserving BF16 precision for decoding. By decoupling prefilling acceleration from decoding quality, Mix…”
    Enlace del recurso
    Preprint
  20. 1280

    Best-First Ordered Statistics Decoding of Quantum LDPC Codes por Banfi, Michele, Ferrari, Marco, Favano, Antonino, Tarable, Alberto, Barletta, Luca

    Publicado 2026
    Tabla de Contenidos: “… standard for decoding quantum low-density parity-check (QLDPC) codes. Recent advancements in this field…”
    Enlace del recurso
    Preprint