Enregistré dans:
| Auteurs principaux: | Li, Xiang, Yao, Yiqun, Jiang, Xin, Fang, Xuezhi, Wang, Chao, Liu, Xinzhang, Wang, Zihan, Zhao, Yu, Wang, Xin, Huang, Yuyao, Song, Shuangyong, Li, Yongxiang, Zhang, Zheng, Zhao, Bo, Sun, Aixin, Wang, Yequan, He, Zhongjiang, Wang, Zhongyuan, Li, Xuelong, Huang, Tiejun |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2404.16645 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
52B to 1T: Lessons Learned via Tele-FLM Series
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
FLM-Audio: Natural Monologues Improves Native Full-Duplex Chatbots via Dual Training
par: Yao, Yiqun, et autres
Publié: (2025)
par: Yao, Yiqun, et autres
Publié: (2025)
TeleChat Technical Report
par: He, Zhongjiang, et autres
Publié: (2024)
par: He, Zhongjiang, et autres
Publié: (2024)
Technical Report of TeleChat2, TeleChat2.5 and T1
par: Wang, Zihan, et autres
Publié: (2025)
par: Wang, Zihan, et autres
Publié: (2025)
FLM-101B: An Open LLM and How to Train It with $100K Budget
par: Li, Xiang, et autres
Publié: (2023)
par: Li, Xiang, et autres
Publié: (2023)
RoboEgo System Card: An Omnimodal Model with Native Full Duplexity
par: Yao, Yiqun, et autres
Publié: (2025)
par: Yao, Yiqun, et autres
Publié: (2025)
Towards Robustness and Diversity: Continual Learning in Dialog Generation with Text-Mixup and Batch Nuclear-Norm Maximization
par: Wang, Zihan, et autres
Publié: (2024)
par: Wang, Zihan, et autres
Publié: (2024)
Emotional Support with LLM-based Empathetic Dialogue Generation
par: Wang, Shiquan, et autres
Publié: (2025)
par: Wang, Shiquan, et autres
Publié: (2025)
Open-domain Implicit Format Control for Large Language Model Generation
par: Yao, Yiqun, et autres
Publié: (2024)
par: Yao, Yiqun, et autres
Publié: (2024)
EgoMem: Lifelong Memory Agent for Full-duplex Omnimodal Models
par: Yao, Yiqun, et autres
Publié: (2025)
par: Yao, Yiqun, et autres
Publié: (2025)
Training Report of TeleChat3-MoE
par: Liu, Xinzhang, et autres
Publié: (2025)
par: Liu, Xinzhang, et autres
Publié: (2025)
Sketch: A Toolkit for Streamlining LLM Operations
par: Jiang, Xin, et autres
Publié: (2024)
par: Jiang, Xin, et autres
Publié: (2024)
Toward Embodied AGI: A Review of Embodied AI and the Road Ahead
par: Wang, Yequan, et autres
Publié: (2025)
par: Wang, Yequan, et autres
Publié: (2025)
Not All Layers of LLMs Are Necessary During Inference
par: Fan, Siqi, et autres
Publié: (2024)
par: Fan, Siqi, et autres
Publié: (2024)
If an LLM Were a Character, Would It Know Its Own Story? Evaluating Lifelong Learning in LLMs
par: Fan, Siqi, et autres
Publié: (2025)
par: Fan, Siqi, et autres
Publié: (2025)
MR-UIE: Multi-Perspective Reasoning with Reinforcement Learning for Universal Information Extraction
par: Li, Zhongqiu, et autres
Publié: (2025)
par: Li, Zhongqiu, et autres
Publié: (2025)
nanoLM: an Affordable LLM Pre-training Benchmark via Accurate Loss Prediction across Scales
par: Yao, Yiqun, et autres
Publié: (2023)
par: Yao, Yiqun, et autres
Publié: (2023)
TableReasoner: Advancing Table Reasoning Framework with Large Language Models
par: Xiong, Sishi, et autres
Publié: (2025)
par: Xiong, Sishi, et autres
Publié: (2025)
RB-SQL: A Retrieval-based LLM Framework for Text-to-SQL
par: Wu, Zhenhe, et autres
Publié: (2024)
par: Wu, Zhenhe, et autres
Publié: (2024)
TableZoomer: A Collaborative Agent Framework for Large-scale Table Question Answering
par: Xiong, Sishi, et autres
Publié: (2025)
par: Xiong, Sishi, et autres
Publié: (2025)
Masked Structural Growth for 2x Faster Language Model Pre-training
par: Yao, Yiqun, et autres
Publié: (2023)
par: Yao, Yiqun, et autres
Publié: (2023)
GCRE-GPT: A Generative Model for Comparative Relation Extraction
par: Wang, Yequan, et autres
Publié: (2023)
par: Wang, Yequan, et autres
Publié: (2023)
GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness
par: Chen, Hongjie, et autres
Publié: (2025)
par: Chen, Hongjie, et autres
Publié: (2025)
Mutual Enhancement Between Global Tokens and Patch Tokens: From Theory to Practice
par: Huang, Xiusheng, et autres
Publié: (2026)
par: Huang, Xiusheng, et autres
Publié: (2026)
TCNN: Triple Convolutional Neural Network Models for Retrieval-based Question Answering System in E-commerce
par: Song, Shuangyong, et autres
Publié: (2020)
par: Song, Shuangyong, et autres
Publié: (2020)
Introducing Visual Scenes and Reasoning: A More Realistic Benchmark for Spoken Language Understanding
par: Wu, Di, et autres
Publié: (2025)
par: Wu, Di, et autres
Publié: (2025)
BoSS: Beyond-Semantic Speech
par: Wang, Qing, et autres
Publié: (2025)
par: Wang, Qing, et autres
Publié: (2025)
Table-R1: Region-based Reinforcement Learning for Table Understanding
par: Wu, Zhenhe, et autres
Publié: (2025)
par: Wu, Zhenhe, et autres
Publié: (2025)
D-QRELO: Training- and Data-Free Delta Compression for Large Language Models via Quantization and Residual Low-Rank Approximation
par: Li, Junlin, et autres
Publié: (2026)
par: Li, Junlin, et autres
Publié: (2026)
Commonsense Knowledge Editing Based on Free-Text in LLMs
par: Huang, Xiusheng, et autres
Publié: (2024)
par: Huang, Xiusheng, et autres
Publié: (2024)
Prompt-Level Reward Specifications for Open-Ended Post-Training
par: Weng, Zijun, et autres
Publié: (2026)
par: Weng, Zijun, et autres
Publié: (2026)
TeleStyle: Content-Preserving Style Transfer in Images and Videos
par: Zhang, Shiwen, et autres
Publié: (2026)
par: Zhang, Shiwen, et autres
Publié: (2026)
On Switched Event-triggered Full State-constrained Formation Control for Multi-vehicle Systems
par: Li, Zihan, et autres
Publié: (2026)
par: Li, Zihan, et autres
Publié: (2026)
Stop Rewarding Hallucinated Steps: Faithfulness-Aware Step-Level Reinforcement Learning for Small Reasoning Models
par: Nie, Shuo, et autres
Publié: (2026)
par: Nie, Shuo, et autres
Publié: (2026)
TelePhysics: Physics-Grounded Multi-Object Scene Generation from a Single Image with Real-Time Interaction
par: Zhang, Xin, et autres
Publié: (2026)
par: Zhang, Xin, et autres
Publié: (2026)
Technical Report: Coopetition in Heterogeneous Cross-Silo Federated Learning
par: Huang, Chao, et autres
Publié: (2024)
par: Huang, Chao, et autres
Publié: (2024)
Light Field Transformation of Metasurface Based on Arbitrary Jones Matrix
par: Xiaotong Zhang, et autres
Publié: (2024)
par: Xiaotong Zhang, et autres
Publié: (2024)
TeleWorld: Towards Dynamic Multimodal Synthesis with a 4D World Model
par: Chen, Yabo, et autres
Publié: (2025)
par: Chen, Yabo, et autres
Publié: (2025)
Mosaic Pruning: A Hierarchical Framework for Generalizable Pruning of Mixture-of-Experts Models
par: Hu, Wentao, et autres
Publié: (2025)
par: Hu, Wentao, et autres
Publié: (2025)
The multiple points of maps from sphere to Euclidean space
par: Wang, Jun, et autres
Publié: (2021)
par: Wang, Jun, et autres
Publié: (2021)
Documents similaires
-
52B to 1T: Lessons Learned via Tele-FLM Series
par: Li, Xiang, et autres
Publié: (2024) -
FLM-Audio: Natural Monologues Improves Native Full-Duplex Chatbots via Dual Training
par: Yao, Yiqun, et autres
Publié: (2025) -
TeleChat Technical Report
par: He, Zhongjiang, et autres
Publié: (2024) -
Technical Report of TeleChat2, TeleChat2.5 and T1
par: Wang, Zihan, et autres
Publié: (2025) -
FLM-101B: An Open LLM and How to Train It with $100K Budget
par: Li, Xiang, et autres
Publié: (2023)