Beyond Correctness: Evaluating Subjective Writing Preferences Across Cultures
Fuente:
arXiv
Salvato in:
| Autori principali: | Ying, Shuangshuang, Li, Yunwen, Qu, Xingwei, Li, Xin, Jin, Sheng, Liu, Minghao, Wen, Zhoufutu, Du, Xeron, Zheng, Tianyu, Zhang, Yichi, Ni, Letian, Cheng, Yuyang, Yang, Zhenzhu, Chen, Qiguang, Ding, Jingzhe, Long, Shengda, Zhou, Wangchunshu, Feng, Jiazhan, Zhong, Wanjun, Qin, Libo, Zhang, Ge, Huang, Wenhao, Che, Wanxiang, Lin, Chenghua |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
COIG-Writer: A High-Quality Dataset for Chinese Creative Writing with Thought Processes
di: Li, Yunwen, et al.
Pubblicazione: (2025)
di: Li, Yunwen, et al.
Pubblicazione: (2025)
AutoCAP: Towards Automatic Cross-lingual Alignment Planning for Zero-shot Chain-of-Thought
di: Zhang, Yongheng, et al.
Pubblicazione: (2024)
di: Zhang, Yongheng, et al.
Pubblicazione: (2024)
Reverse-Engineered Reasoning for Open-Ended Generation
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
di: Wang, Haozhe, et al.
Pubblicazione: (2025)
TreePO: Bridging the Gap of Policy Optimization and Efficacy and Inference Efficiency with Heuristic Tree-based Modeling
di: Li, Yizhi, et al.
Pubblicazione: (2025)
di: Li, Yizhi, et al.
Pubblicazione: (2025)
Unlocking the Capabilities of Thought: A Reasoning Boundary Framework to Quantify and Optimize Chain-of-Thought
di: Chen, Qiguang, et al.
Pubblicazione: (2024)
di: Chen, Qiguang, et al.
Pubblicazione: (2024)
M$^3$CoT: A Novel Benchmark for Multi-Domain Multi-step Multi-modal Chain-of-Thought
di: Chen, Qiguang, et al.
Pubblicazione: (2024)
di: Chen, Qiguang, et al.
Pubblicazione: (2024)
What Factors Affect Multi-Modal In-Context Learning? An In-Depth Exploration
di: Qin, Libo, et al.
Pubblicazione: (2024)
di: Qin, Libo, et al.
Pubblicazione: (2024)
I-SHEEP: Self-Alignment of LLM from Scratch through an Iterative Self-Enhancement Paradigm
di: Liang, Yiming, et al.
Pubblicazione: (2024)
di: Liang, Yiming, et al.
Pubblicazione: (2024)
First Return, Entropy-Eliciting Explore
di: Zheng, Tianyu, et al.
Pubblicazione: (2025)
di: Zheng, Tianyu, et al.
Pubblicazione: (2025)
MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models
di: Ji, Yiyan, et al.
Pubblicazione: (2025)
di: Ji, Yiyan, et al.
Pubblicazione: (2025)
ViTCoT: Video-Text Interleaved Chain-of-Thought for Boosting Video Understanding in Large Language Models
di: Zhang, Yongheng, et al.
Pubblicazione: (2025)
di: Zhang, Yongheng, et al.
Pubblicazione: (2025)
The Molecular Structure of Thought: Mapping the Topology of Long Chain-of-Thought Reasoning
di: Chen, Qiguang, et al.
Pubblicazione: (2026)
di: Chen, Qiguang, et al.
Pubblicazione: (2026)
CoMT: A Novel Benchmark for Chain of Multi-modal Thought on Large Vision-Language Models
di: Cheng, Zihui, et al.
Pubblicazione: (2024)
di: Cheng, Zihui, et al.
Pubblicazione: (2024)
ReTool: Reinforcement Learning for Strategic Tool Use in LLMs
di: Feng, Jiazhan, et al.
Pubblicazione: (2025)
di: Feng, Jiazhan, et al.
Pubblicazione: (2025)
Large Language Models Meet NLP: A Survey
di: Qin, Libo, et al.
Pubblicazione: (2024)
di: Qin, Libo, et al.
Pubblicazione: (2024)
Observing Micromotives and Macrobehavior of Large Language Models
di: Cheng, Yuyang, et al.
Pubblicazione: (2024)
di: Cheng, Yuyang, et al.
Pubblicazione: (2024)
RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
KOR-Bench: Benchmarking Language Models on Knowledge-Orthogonal Reasoning Tasks
di: Ma, Kaijing, et al.
Pubblicazione: (2024)
di: Ma, Kaijing, et al.
Pubblicazione: (2024)
Overview of the NLPCC 2024 Shared Task on Chinese Metaphor Generation
di: Qu, Xingwei, et al.
Pubblicazione: (2024)
di: Qu, Xingwei, et al.
Pubblicazione: (2024)
Multilingual Large Language Model: A Survey of Resources, Taxonomy and Frontiers
di: Qin, Libo, et al.
Pubblicazione: (2024)
di: Qin, Libo, et al.
Pubblicazione: (2024)
Aware First, Think Less: Dynamic Boundary Self-Awareness Drives Extreme Reasoning Efficiency in Large Language Models
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
Learning the Boundary of Solvability: Aligning LLMs to Detect Unsolvable Problems
di: Peng, Dengyun, et al.
Pubblicazione: (2025)
di: Peng, Dengyun, et al.
Pubblicazione: (2025)
CroPrompt: Cross-task Interactive Prompting for Zero-shot Spoken Language Understanding
di: Qin, Libo, et al.
Pubblicazione: (2024)
di: Qin, Libo, et al.
Pubblicazione: (2024)
Beware of Reasoning Overconfidence: Pitfalls in the Reasoning Process for Multi-solution Tasks
di: Guan, Jiannan, et al.
Pubblicazione: (2025)
di: Guan, Jiannan, et al.
Pubblicazione: (2025)
Kun: Answer Polishment for Chinese Self-Alignment with Instruction Back-Translation
di: Zheng, Tianyu, et al.
Pubblicazione: (2024)
di: Zheng, Tianyu, et al.
Pubblicazione: (2024)
Let's Think with Images Efficiently! An Interleaved-Modal Chain-of-Thought Reasoning Framework with Dynamic and Precise Visual Thoughts
di: Liu, Xu, et al.
Pubblicazione: (2026)
di: Liu, Xu, et al.
Pubblicazione: (2026)
On the Rigour of Scientific Writing: Criteria, Analysis, and Insights
di: James, Joseph, et al.
Pubblicazione: (2024)
di: James, Joseph, et al.
Pubblicazione: (2024)
Beyond Surface Reasoning: Unveiling the True Long Chain-of-Thought Capacity of Diffusion Large Language Models
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
OMIBench: Benchmarking Olympiad-Level Multi-Image Reasoning in Large Vision-Language Model
di: Chen, Qiguang, et al.
Pubblicazione: (2026)
di: Chen, Qiguang, et al.
Pubblicazione: (2026)
AutoKaggle: A Multi-Agent Framework for Autonomous Data Science Competitions
di: Li, Ziming, et al.
Pubblicazione: (2024)
di: Li, Ziming, et al.
Pubblicazione: (2024)
Platonic representation of foundation machine learning interatomic potentials
di: Li, Zhenzhu, et al.
Pubblicazione: (2025)
di: Li, Zhenzhu, et al.
Pubblicazione: (2025)
Electronic Circuit Principles of Large Language Models
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
Generalization and Optimization of SGD with Lookahead
di: Li, Kangcheng, et al.
Pubblicazione: (2025)
di: Li, Kangcheng, et al.
Pubblicazione: (2025)
A Two-Stage Framework with Self-Supervised Distillation For Cross-Domain Text Classification
di: Feng, Yunlong, et al.
Pubblicazione: (2023)
di: Feng, Yunlong, et al.
Pubblicazione: (2023)
ESAinsTOD: A Unified End-to-End Schema-Aware Instruction-Tuning Framework for Task-Oriented Dialog Modeling
di: Teng, Dechuan, et al.
Pubblicazione: (2026)
di: Teng, Dechuan, et al.
Pubblicazione: (2026)
Robust Batched Bandits
di: Guo, Yunwen, et al.
Pubblicazione: (2025)
di: Guo, Yunwen, et al.
Pubblicazione: (2025)
What are the Essential Factors in Crafting Effective Long Context Multi-Hop Instruction Datasets? Insights and Best Practices
di: Chen, Zhi, et al.
Pubblicazione: (2024)
di: Chen, Zhi, et al.
Pubblicazione: (2024)
Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
di: Chen, Qiguang, et al.
Pubblicazione: (2025)
AdaCtrl: Towards Adaptive and Controllable Reasoning via Difficulty-Aware Budgeting
di: Huang, Shijue, et al.
Pubblicazione: (2025)
di: Huang, Shijue, et al.
Pubblicazione: (2025)
Differential calculus for generalized geometry and geometric Lax flows
di: Hu, Shengda
Pubblicazione: (2022)
di: Hu, Shengda
Pubblicazione: (2022)
Documenti analoghi
-
COIG-Writer: A High-Quality Dataset for Chinese Creative Writing with Thought Processes
di: Li, Yunwen, et al.
Pubblicazione: (2025) -
AutoCAP: Towards Automatic Cross-lingual Alignment Planning for Zero-shot Chain-of-Thought
di: Zhang, Yongheng, et al.
Pubblicazione: (2024) -
Reverse-Engineered Reasoning for Open-Ended Generation
di: Wang, Haozhe, et al.
Pubblicazione: (2025) -
TreePO: Bridging the Gap of Policy Optimization and Efficacy and Inference Efficiency with Heuristic Tree-based Modeling
di: Li, Yizhi, et al.
Pubblicazione: (2025) -
Unlocking the Capabilities of Thought: A Reasoning Boundary Framework to Quantify and Optimize Chain-of-Thought
di: Chen, Qiguang, et al.
Pubblicazione: (2024)