C-Mining: Unsupervised Discovery of Seeds for Cultural Data Synthesis via Geometric Misalignment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zeng, Pufan, Liu, Yilun, Dai, Mingchen, Piao, Mengyao, Zhao, Chunguang, Miao, Lingqi, Tao, Shimin, Meng, Weibin, He, Minggui, Liu, Chenxin, Qin, Zhenzhen, Zhang, Li, Ma, Hongxia, Chen, Boxing, Wei, Daimeng |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
M-DaQ: Retrieving Samples with Multilingual Diversity and Quality for Instruction Fine-Tuning Datasets
par: Zhao, Chunguang, et autres
Publié: (2025)
par: Zhao, Chunguang, et autres
Publié: (2025)
MIDB: Multilingual Instruction Data Booster for Enhancing Cultural Equality in Multilingual Instruction Synthesis
par: Liu, Yilun, et autres
Publié: (2025)
par: Liu, Yilun, et autres
Publié: (2025)
RationAnomaly: Log Anomaly Detection with Rationality via Chain-of-Thought and Reinforcement Learning
par: Xu, Song, et autres
Publié: (2025)
par: Xu, Song, et autres
Publié: (2025)
The GaoYao Benchmark: A Comprehensive Framework for Evaluating Multilingual and Multicultural Abilities of Large Language Models
par: Liu, Yilun, et autres
Publié: (2026)
par: Liu, Yilun, et autres
Publié: (2026)
Chart Specification: Structural Representations for Incentivizing VLM Reasoning in Chart-to-Code Generation
par: He, Minggui, et autres
Publié: (2026)
par: He, Minggui, et autres
Publié: (2026)
ELSPR: Evaluator LLM Training Data Self-Purification on Non-Transitive Preferences via Tournament Graph Reconstruction
par: Yu, Yan, et autres
Publié: (2025)
par: Yu, Yan, et autres
Publié: (2025)
R1-T1: Fully Incentivizing Translation Capability in LLMs via Reasoning Learning
par: He, Minggui, et autres
Publié: (2025)
par: He, Minggui, et autres
Publié: (2025)
R-Log: Incentivizing Log Analysis Capability in LLMs via Reasoning-based Reinforcement Learning
par: Liu, Yilun, et autres
Publié: (2025)
par: Liu, Yilun, et autres
Publié: (2025)
LogLM: From Task-based to Instruction-based Automated Log Analysis
par: Liu, Yilun, et autres
Publié: (2024)
par: Liu, Yilun, et autres
Publié: (2024)
Adapting Large Language Models to Log Analysis with Interpretable Domain Knowledge
par: Ji, Yuhe, et autres
Publié: (2024)
par: Ji, Yuhe, et autres
Publié: (2024)
CultureScope: A Dimensional Lens for Probing Cultural Understanding in LLMs
par: Zhang, Jinghao, et autres
Publié: (2025)
par: Zhang, Jinghao, et autres
Publié: (2025)
Clustering and Ranking: Diversity-preserved Instruction Selection through Expert-aligned Quality Estimation
par: Ge, Yuan, et autres
Publié: (2024)
par: Ge, Yuan, et autres
Publié: (2024)
Taming Text-to-Image Synthesis for Novices: User-centric Prompt Generation via Multi-turn Guidance
par: Liu, Yilun, et autres
Publié: (2024)
par: Liu, Yilun, et autres
Publié: (2024)
An Economic Analysis of Electricity Consumption and Electric Vehicle Adoption in California from 2010 to 2021
par: Qi, Pufan
Publié: (2025)
par: Qi, Pufan
Publié: (2025)
Improving LLM-based Document-level Machine Translation with Multi-Knowledge Fusion
par: Liu, Bin, et autres
Publié: (2025)
par: Liu, Bin, et autres
Publié: (2025)
UCorrect: An Unsupervised Framework for Automatic Speech Recognition Error Correction
par: Guo, Jiaxin, et autres
Publié: (2024)
par: Guo, Jiaxin, et autres
Publié: (2024)
From Handcrafted Features to LLMs: A Brief Survey for Machine Translation Quality Estimation
par: Zhao, Haofei, et autres
Publié: (2024)
par: Zhao, Haofei, et autres
Publié: (2024)
An Investigation into Value Misalignment in LLM-Generated Texts for Cultural Heritage
par: Bu, Fan, et autres
Publié: (2025)
par: Bu, Fan, et autres
Publié: (2025)
From Part to Whole: 3D Generative World Model with an Adaptive Structural Hierarchy
par: Du, Bi'an, et autres
Publié: (2026)
par: Du, Bi'an, et autres
Publié: (2026)
Interpretable Online Log Analysis Using Large Language Models with Prompt Strategies
par: Liu, Yilun, et autres
Publié: (2023)
par: Liu, Yilun, et autres
Publié: (2023)
Mitigating Misalignment Contagion by Steering with Implicit Traits
par: Chang, Maria, et autres
Publié: (2026)
par: Chang, Maria, et autres
Publié: (2026)
A latticed total K-theory
par: An, Qingnan, et autres
Publié: (2024)
par: An, Qingnan, et autres
Publié: (2024)
Two Intermediate Translations Are Better Than One: Fine-tuning LLMs for Document-level Translation Refinement
par: Dong, Yichen, et autres
Publié: (2025)
par: Dong, Yichen, et autres
Publié: (2025)
The Axion Helical Misalignment Mechanism
par: Chao, Wei, et autres
Publié: (2026)
par: Chao, Wei, et autres
Publié: (2026)
Geometry and Perception Guided Gaussians for Multiview-consistent 3D Generation from a Single Image
par: Li, Pufan, et autres
Publié: (2025)
par: Li, Pufan, et autres
Publié: (2025)
Dynamic Capabilities and Circular Economy Innovations for Achieving NetZero in Mining
par: Vivian Osei, et autres
Publié: (2026)
par: Vivian Osei, et autres
Publié: (2026)
Flow Structure and Manning Coefficient in Open‐Channel Flows With Staggered Tall‐Short Vegetation
par: Liu Yameng, et autres
Publié: (2026)
par: Liu Yameng, et autres
Publié: (2026)
Seed-Guided Topic Discovery with Out-of-Vocabulary Seeds
par: Zhang, Yu, et autres
Publié: (2022)
par: Zhang, Yu, et autres
Publié: (2022)
Geometrical Cross-Attention and Nonvoid Voxelization for Efficient 3D Medical Image Segmentation
par: Yuan, Chenxin, et autres
Publié: (2026)
par: Yuan, Chenxin, et autres
Publié: (2026)
An Improved Morphology‐Aware Model for Predicting the Settling Velocity of Oncomelania hupensis
par: Lingqi Yi, et autres
Publié: (2026)
par: Lingqi Yi, et autres
Publié: (2026)
Deep Taxonomic Networks for Unsupervised Hierarchical Prototype Discovery
par: Wang, Zekun, et autres
Publié: (2025)
par: Wang, Zekun, et autres
Publié: (2025)
Random Forest–Based Coal Mine Roof Displacement Prediction and Application
par: Hongxia Li, et autres
Publié: (2025)
par: Hongxia Li, et autres
Publié: (2025)
Loong: A Human-Like Long Document Translation Agent with Observe-and-Act Adaptive Context Selection
par: Wang, Yutong, et autres
Publié: (2026)
par: Wang, Yutong, et autres
Publié: (2026)
Seeing Hate Differently: Hate Subspace Modeling for Culture-Aware Hate Speech Detection
par: Cai, Weibin, et autres
Publié: (2025)
par: Cai, Weibin, et autres
Publié: (2025)
PLATZ transcription factors and their emerging roles in plant responses to environmental stresses.
par: Zhang, Hongxia, et autres
Publié: (2025)
par: Zhang, Hongxia, et autres
Publié: (2025)
Unsupervised Concept Discovery Mitigates Spurious Correlations
par: Arefin, Md Rifat, et autres
Publié: (2024)
par: Arefin, Md Rifat, et autres
Publié: (2024)
CoachLM: Automatic Instruction Revisions Improve the Data Quality in LLM Instruction Tuning
par: Liu, Yilun, et autres
Publié: (2023)
par: Liu, Yilun, et autres
Publié: (2023)
Unlocking Fine-Grained Translation Quality Estimation in LRMs through Synergistically Evolving Implicit and Explicit Reasoning
par: Dang, Renfei, et autres
Publié: (2026)
par: Dang, Renfei, et autres
Publié: (2026)
DeMPT: Decoding-enhanced Multi-phase Prompt Tuning for Making LLMs Be Better Context-aware Translators
par: Lyu, Xinglin, et autres
Publié: (2024)
par: Lyu, Xinglin, et autres
Publié: (2024)
Cross-Preference Learning for Sentence-Level and Context-Aware Machine Translation
par: Li, Ying, et autres
Publié: (2026)
par: Li, Ying, et autres
Publié: (2026)
Documents similaires
-
M-DaQ: Retrieving Samples with Multilingual Diversity and Quality for Instruction Fine-Tuning Datasets
par: Zhao, Chunguang, et autres
Publié: (2025) -
MIDB: Multilingual Instruction Data Booster for Enhancing Cultural Equality in Multilingual Instruction Synthesis
par: Liu, Yilun, et autres
Publié: (2025) -
RationAnomaly: Log Anomaly Detection with Rationality via Chain-of-Thought and Reinforcement Learning
par: Xu, Song, et autres
Publié: (2025) -
The GaoYao Benchmark: A Comprehensive Framework for Evaluating Multilingual and Multicultural Abilities of Large Language Models
par: Liu, Yilun, et autres
Publié: (2026) -
Chart Specification: Structural Representations for Incentivizing VLM Reasoning in Chart-to-Code Generation
par: He, Minggui, et autres
Publié: (2026)