Gespeichert in:
| Hauptverfasser: | Li, Xiang, Yao, Yiqun, Jiang, Xin, Fang, Xuezhi, Wang, Chao, Liu, Xinzhang, Wang, Zihan, Zhao, Yu, Wang, Xin, Huang, Yuyao, Song, Shuangyong, Li, Yongxiang, Zhang, Zheng, Zhao, Bo, Sun, Aixin, Wang, Yequan, He, Zhongjiang, Wang, Zhongyuan, Li, Xuelong, Huang, Tiejun |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2404.16645 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
52B to 1T: Lessons Learned via Tele-FLM Series
von: Li, Xiang, et al.
Veröffentlicht: (2024)
von: Li, Xiang, et al.
Veröffentlicht: (2024)
FLM-Audio: Natural Monologues Improves Native Full-Duplex Chatbots via Dual Training
von: Yao, Yiqun, et al.
Veröffentlicht: (2025)
von: Yao, Yiqun, et al.
Veröffentlicht: (2025)
TeleChat Technical Report
von: He, Zhongjiang, et al.
Veröffentlicht: (2024)
von: He, Zhongjiang, et al.
Veröffentlicht: (2024)
Technical Report of TeleChat2, TeleChat2.5 and T1
von: Wang, Zihan, et al.
Veröffentlicht: (2025)
von: Wang, Zihan, et al.
Veröffentlicht: (2025)
FLM-101B: An Open LLM and How to Train It with $100K Budget
von: Li, Xiang, et al.
Veröffentlicht: (2023)
von: Li, Xiang, et al.
Veröffentlicht: (2023)
RoboEgo System Card: An Omnimodal Model with Native Full Duplexity
von: Yao, Yiqun, et al.
Veröffentlicht: (2025)
von: Yao, Yiqun, et al.
Veröffentlicht: (2025)
Towards Robustness and Diversity: Continual Learning in Dialog Generation with Text-Mixup and Batch Nuclear-Norm Maximization
von: Wang, Zihan, et al.
Veröffentlicht: (2024)
von: Wang, Zihan, et al.
Veröffentlicht: (2024)
Emotional Support with LLM-based Empathetic Dialogue Generation
von: Wang, Shiquan, et al.
Veröffentlicht: (2025)
von: Wang, Shiquan, et al.
Veröffentlicht: (2025)
Open-domain Implicit Format Control for Large Language Model Generation
von: Yao, Yiqun, et al.
Veröffentlicht: (2024)
von: Yao, Yiqun, et al.
Veröffentlicht: (2024)
EgoMem: Lifelong Memory Agent for Full-duplex Omnimodal Models
von: Yao, Yiqun, et al.
Veröffentlicht: (2025)
von: Yao, Yiqun, et al.
Veröffentlicht: (2025)
Training Report of TeleChat3-MoE
von: Liu, Xinzhang, et al.
Veröffentlicht: (2025)
von: Liu, Xinzhang, et al.
Veröffentlicht: (2025)
Sketch: A Toolkit for Streamlining LLM Operations
von: Jiang, Xin, et al.
Veröffentlicht: (2024)
von: Jiang, Xin, et al.
Veröffentlicht: (2024)
Toward Embodied AGI: A Review of Embodied AI and the Road Ahead
von: Wang, Yequan, et al.
Veröffentlicht: (2025)
von: Wang, Yequan, et al.
Veröffentlicht: (2025)
Not All Layers of LLMs Are Necessary During Inference
von: Fan, Siqi, et al.
Veröffentlicht: (2024)
von: Fan, Siqi, et al.
Veröffentlicht: (2024)
If an LLM Were a Character, Would It Know Its Own Story? Evaluating Lifelong Learning in LLMs
von: Fan, Siqi, et al.
Veröffentlicht: (2025)
von: Fan, Siqi, et al.
Veröffentlicht: (2025)
MR-UIE: Multi-Perspective Reasoning with Reinforcement Learning for Universal Information Extraction
von: Li, Zhongqiu, et al.
Veröffentlicht: (2025)
von: Li, Zhongqiu, et al.
Veröffentlicht: (2025)
nanoLM: an Affordable LLM Pre-training Benchmark via Accurate Loss Prediction across Scales
von: Yao, Yiqun, et al.
Veröffentlicht: (2023)
von: Yao, Yiqun, et al.
Veröffentlicht: (2023)
TableReasoner: Advancing Table Reasoning Framework with Large Language Models
von: Xiong, Sishi, et al.
Veröffentlicht: (2025)
von: Xiong, Sishi, et al.
Veröffentlicht: (2025)
RB-SQL: A Retrieval-based LLM Framework for Text-to-SQL
von: Wu, Zhenhe, et al.
Veröffentlicht: (2024)
von: Wu, Zhenhe, et al.
Veröffentlicht: (2024)
TableZoomer: A Collaborative Agent Framework for Large-scale Table Question Answering
von: Xiong, Sishi, et al.
Veröffentlicht: (2025)
von: Xiong, Sishi, et al.
Veröffentlicht: (2025)
Masked Structural Growth for 2x Faster Language Model Pre-training
von: Yao, Yiqun, et al.
Veröffentlicht: (2023)
von: Yao, Yiqun, et al.
Veröffentlicht: (2023)
GCRE-GPT: A Generative Model for Comparative Relation Extraction
von: Wang, Yequan, et al.
Veröffentlicht: (2023)
von: Wang, Yequan, et al.
Veröffentlicht: (2023)
GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness
von: Chen, Hongjie, et al.
Veröffentlicht: (2025)
von: Chen, Hongjie, et al.
Veröffentlicht: (2025)
Mutual Enhancement Between Global Tokens and Patch Tokens: From Theory to Practice
von: Huang, Xiusheng, et al.
Veröffentlicht: (2026)
von: Huang, Xiusheng, et al.
Veröffentlicht: (2026)
TCNN: Triple Convolutional Neural Network Models for Retrieval-based Question Answering System in E-commerce
von: Song, Shuangyong, et al.
Veröffentlicht: (2020)
von: Song, Shuangyong, et al.
Veröffentlicht: (2020)
Introducing Visual Scenes and Reasoning: A More Realistic Benchmark for Spoken Language Understanding
von: Wu, Di, et al.
Veröffentlicht: (2025)
von: Wu, Di, et al.
Veröffentlicht: (2025)
BoSS: Beyond-Semantic Speech
von: Wang, Qing, et al.
Veröffentlicht: (2025)
von: Wang, Qing, et al.
Veröffentlicht: (2025)
Table-R1: Region-based Reinforcement Learning for Table Understanding
von: Wu, Zhenhe, et al.
Veröffentlicht: (2025)
von: Wu, Zhenhe, et al.
Veröffentlicht: (2025)
D-QRELO: Training- and Data-Free Delta Compression for Large Language Models via Quantization and Residual Low-Rank Approximation
von: Li, Junlin, et al.
Veröffentlicht: (2026)
von: Li, Junlin, et al.
Veröffentlicht: (2026)
Commonsense Knowledge Editing Based on Free-Text in LLMs
von: Huang, Xiusheng, et al.
Veröffentlicht: (2024)
von: Huang, Xiusheng, et al.
Veröffentlicht: (2024)
Prompt-Level Reward Specifications for Open-Ended Post-Training
von: Weng, Zijun, et al.
Veröffentlicht: (2026)
von: Weng, Zijun, et al.
Veröffentlicht: (2026)
TeleStyle: Content-Preserving Style Transfer in Images and Videos
von: Zhang, Shiwen, et al.
Veröffentlicht: (2026)
von: Zhang, Shiwen, et al.
Veröffentlicht: (2026)
On Switched Event-triggered Full State-constrained Formation Control for Multi-vehicle Systems
von: Li, Zihan, et al.
Veröffentlicht: (2026)
von: Li, Zihan, et al.
Veröffentlicht: (2026)
Stop Rewarding Hallucinated Steps: Faithfulness-Aware Step-Level Reinforcement Learning for Small Reasoning Models
von: Nie, Shuo, et al.
Veröffentlicht: (2026)
von: Nie, Shuo, et al.
Veröffentlicht: (2026)
TelePhysics: Physics-Grounded Multi-Object Scene Generation from a Single Image with Real-Time Interaction
von: Zhang, Xin, et al.
Veröffentlicht: (2026)
von: Zhang, Xin, et al.
Veröffentlicht: (2026)
Technical Report: Coopetition in Heterogeneous Cross-Silo Federated Learning
von: Huang, Chao, et al.
Veröffentlicht: (2024)
von: Huang, Chao, et al.
Veröffentlicht: (2024)
Light Field Transformation of Metasurface Based on Arbitrary Jones Matrix
von: Xiaotong Zhang, et al.
Veröffentlicht: (2024)
von: Xiaotong Zhang, et al.
Veröffentlicht: (2024)
TeleWorld: Towards Dynamic Multimodal Synthesis with a 4D World Model
von: Chen, Yabo, et al.
Veröffentlicht: (2025)
von: Chen, Yabo, et al.
Veröffentlicht: (2025)
Mosaic Pruning: A Hierarchical Framework for Generalizable Pruning of Mixture-of-Experts Models
von: Hu, Wentao, et al.
Veröffentlicht: (2025)
von: Hu, Wentao, et al.
Veröffentlicht: (2025)
The multiple points of maps from sphere to Euclidean space
von: Wang, Jun, et al.
Veröffentlicht: (2021)
von: Wang, Jun, et al.
Veröffentlicht: (2021)
Ähnliche Einträge
-
52B to 1T: Lessons Learned via Tele-FLM Series
von: Li, Xiang, et al.
Veröffentlicht: (2024) -
FLM-Audio: Natural Monologues Improves Native Full-Duplex Chatbots via Dual Training
von: Yao, Yiqun, et al.
Veröffentlicht: (2025) -
TeleChat Technical Report
von: He, Zhongjiang, et al.
Veröffentlicht: (2024) -
Technical Report of TeleChat2, TeleChat2.5 and T1
von: Wang, Zihan, et al.
Veröffentlicht: (2025) -
FLM-101B: An Open LLM and How to Train It with $100K Budget
von: Li, Xiang, et al.
Veröffentlicht: (2023)