Model-Generated Pretraining Signals Improves Zero-Shot Generalization of Text-to-Text Transformers
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gong, Linyuan, Xiong, Chenyan, Liu, Xiaodong, Bajaj, Payal, Xie, Yiqing, Cheung, Alvin, Gao, Jianfeng, Song, Xia |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AST-T5: Structure-Aware Pretraining for Code Generation and Understanding
par: Gong, Linyuan, et autres
Publié: (2024)
par: Gong, Linyuan, et autres
Publié: (2024)
Structure-Aware Fill-in-the-Middle Pretraining for Code
par: Gong, Linyuan, et autres
Publié: (2025)
par: Gong, Linyuan, et autres
Publié: (2025)
ADELT: Transpilation Between Deep Learning Frameworks
par: Gong, Linyuan, et autres
Publié: (2023)
par: Gong, Linyuan, et autres
Publié: (2023)
Generating Pretraining Tokens from Organic Data for Data-Bound Scaling
par: Yu, Zichun, et autres
Publié: (2026)
par: Yu, Zichun, et autres
Publié: (2026)
Evaluation of LLMs on Syntax-Aware Code Fill-in-the-Middle Tasks
par: Gong, Linyuan, et autres
Publié: (2024)
par: Gong, Linyuan, et autres
Publié: (2024)
RePro: Training Language Models to Faithfully Recycle the Web for Pretraining
par: Yu, Zichun, et autres
Publié: (2025)
par: Yu, Zichun, et autres
Publié: (2025)
Table-to-Text Generation with Pretrained Diffusion Models
par: Krylov, Aleksei S., et autres
Publié: (2024)
par: Krylov, Aleksei S., et autres
Publié: (2024)
Attribute Structuring Improves LLM-Based Evaluation of Clinical Text Summaries
par: Gero, Zelalem, et autres
Publié: (2024)
par: Gero, Zelalem, et autres
Publié: (2024)
Midtraining Bridges Pretraining and Posttraining Distributions
par: Liu, Emmy, et autres
Publié: (2025)
par: Liu, Emmy, et autres
Publié: (2025)
MATES: Model-Aware Data Selection for Efficient Pretraining with Data Influence Models
par: Yu, Zichun, et autres
Publié: (2024)
par: Yu, Zichun, et autres
Publié: (2024)
Zero-Shot Detection of LLM-Generated Text using Token Cohesiveness
par: Ma, Shixuan, et autres
Publié: (2024)
par: Ma, Shixuan, et autres
Publié: (2024)
Zero-Shot Detection of LLM-Generated Text via Implicit Reward Model
par: Liu, Runheng, et autres
Publié: (2026)
par: Liu, Runheng, et autres
Publié: (2026)
Craw4LLM: Efficient Web Crawling for LLM Pretraining
par: Yu, Shi, et autres
Publié: (2025)
par: Yu, Shi, et autres
Publié: (2025)
Who Wrote This? The Key to Zero-Shot LLM-Generated Text Detection Is GECScore
par: Wu, Junchao, et autres
Publié: (2024)
par: Wu, Junchao, et autres
Publié: (2024)
Evaluating and Improving Graph to Text Generation with Large Language Models
par: He, Jie, et autres
Publié: (2025)
par: He, Jie, et autres
Publié: (2025)
Text Generation Beyond Discrete Token Sampling
par: Zhuang, Yufan, et autres
Publié: (2025)
par: Zhuang, Yufan, et autres
Publié: (2025)
Spotting LLMs With Binoculars: Zero-Shot Detection of Machine-Generated Text
par: Hans, Abhimanyu, et autres
Publié: (2024)
par: Hans, Abhimanyu, et autres
Publié: (2024)
DivScore: Zero-Shot Detection of LLM-Generated Text in Specialized Domains
par: Chen, Zhihui, et autres
Publié: (2025)
par: Chen, Zhihui, et autres
Publié: (2025)
VietBinoculars: A Zero-Shot Approach for Detecting Vietnamese LLM-Generated Text
par: Nguyen, Trieu Hai, et autres
Publié: (2025)
par: Nguyen, Trieu Hai, et autres
Publié: (2025)
Controllable Text Generation with Residual Memory Transformer
par: Zhang, Hanqing, et autres
Publié: (2023)
par: Zhang, Hanqing, et autres
Publié: (2023)
Lightweight Transformers for Zero-Shot and Fine-Tuned Text-to-SQL Generation Using Spider
par: Seth, Chirag, et autres
Publié: (2025)
par: Seth, Chirag, et autres
Publié: (2025)
Improving the Calibration of Confidence Scores in Text Generation Using the Output Distribution's Characteristics
par: Flores, Lorenzo Jaime Yu, et autres
Publié: (2025)
par: Flores, Lorenzo Jaime Yu, et autres
Publié: (2025)
On The Role of Pretrained Language Models in General-Purpose Text Embeddings: A Survey
par: Zhang, Meishan, et autres
Publié: (2025)
par: Zhang, Meishan, et autres
Publié: (2025)
IT5: Text-to-text Pretraining for Italian Language Understanding and Generation
par: Sarti, Gabriele, et autres
Publié: (2022)
par: Sarti, Gabriele, et autres
Publié: (2022)
Zero-Shot Text-to-Speech for Vietnamese
par: Vu, Thi, et autres
Publié: (2025)
par: Vu, Thi, et autres
Publié: (2025)
Zero-Shot Vehicle Model Recognition via Text-Based Retrieval-Augmented Generation
par: Chang, Wei-Chia, et autres
Publié: (2025)
par: Chang, Wei-Chia, et autres
Publié: (2025)
Text Understanding and Generation Using Transformer Models for Intelligent E-commerce Recommendations
par: Xiang, Yafei, et autres
Publié: (2024)
par: Xiang, Yafei, et autres
Publié: (2024)
Improving Audio Codec-based Zero-Shot Text-to-Speech Synthesis with Multi-Modal Context and Large Language Model
par: Xue, Jinlong, et autres
Publié: (2024)
par: Xue, Jinlong, et autres
Publié: (2024)
Benchmarking and Improving Compositional Generalization of Multi-aspect Controllable Text Generation
par: Zhong, Tianqi, et autres
Publié: (2024)
par: Zhong, Tianqi, et autres
Publié: (2024)
RAGViz: Diagnose and Visualize Retrieval-Augmented Generation
par: Wang, Tevin, et autres
Publié: (2024)
par: Wang, Tevin, et autres
Publié: (2024)
Glimpse: Enabling White-Box Methods to Use Proprietary Models for Zero-Shot LLM-Generated Text Detection
par: Bao, Guangsheng, et autres
Publié: (2024)
par: Bao, Guangsheng, et autres
Publié: (2024)
Generate, Not Recommend: Personalized Multimodal Content Generation
par: Liu, Jiongnan, et autres
Publié: (2025)
par: Liu, Jiongnan, et autres
Publié: (2025)
Improving Estonian Text Simplification through Pretrained Language Models and Custom Datasets
par: Barbu, Eduard, et autres
Publié: (2025)
par: Barbu, Eduard, et autres
Publié: (2025)
Multi-Level Contextual Token Relation Modeling for Machine-Generated Text Detection
par: Wu, Chenwang, et autres
Publié: (2026)
par: Wu, Chenwang, et autres
Publié: (2026)
Thought2Text: Text Generation from EEG Signal using Large Language Models (LLMs)
par: Mishra, Abhijit, et autres
Publié: (2024)
par: Mishra, Abhijit, et autres
Publié: (2024)
AutoRule: Reasoning Chain-of-thought Extracted Rule-based Rewards Improve Preference Learning
par: Wang, Tevin, et autres
Publié: (2025)
par: Wang, Tevin, et autres
Publié: (2025)
Fast-DetectGPT: Efficient Zero-Shot Detection of Machine-Generated Text via Conditional Probability Curvature
par: Bao, Guangsheng, et autres
Publié: (2023)
par: Bao, Guangsheng, et autres
Publié: (2023)
Hound: Hunting Supervision Signals for Few and Zero Shot Node Classification on Text-attributed Graph
par: Wang, Yuxiang, et autres
Publié: (2024)
par: Wang, Yuxiang, et autres
Publié: (2024)
DocLens: Multi-aspect Fine-grained Evaluation for Medical Text Generation
par: Xie, Yiqing, et autres
Publié: (2023)
par: Xie, Yiqing, et autres
Publié: (2023)
Exploiting Text Semantics for Few and Zero Shot Node Classification on Text-attributed Graph
par: Wang, Yuxiang, et autres
Publié: (2025)
par: Wang, Yuxiang, et autres
Publié: (2025)
Documents similaires
-
AST-T5: Structure-Aware Pretraining for Code Generation and Understanding
par: Gong, Linyuan, et autres
Publié: (2024) -
Structure-Aware Fill-in-the-Middle Pretraining for Code
par: Gong, Linyuan, et autres
Publié: (2025) -
ADELT: Transpilation Between Deep Learning Frameworks
par: Gong, Linyuan, et autres
Publié: (2023) -
Generating Pretraining Tokens from Organic Data for Data-Bound Scaling
par: Yu, Zichun, et autres
Publié: (2026) -
Evaluation of LLMs on Syntax-Aware Code Fill-in-the-Middle Tasks
par: Gong, Linyuan, et autres
Publié: (2024)