Saving the legacy of Hero Ibash: Evaluating Four Language Models for Aminoacian
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Xiao, Yunze, Pan, Yiyang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Chinese Offensive Language Detection:Current Status and Future Directions
von: Xiao, Yunze, et al.
Veröffentlicht: (2024)
von: Xiao, Yunze, et al.
Veröffentlicht: (2024)
A Stitch in Time Saves Nine: Proactive Self-Refinement for Language Models
von: Han, Jinyi, et al.
Veröffentlicht: (2025)
von: Han, Jinyi, et al.
Veröffentlicht: (2025)
Lexicography Saves Lives (LSL): Automatically Translating Suicide-Related Language
von: Schoene, Annika Marie, et al.
Veröffentlicht: (2024)
von: Schoene, Annika Marie, et al.
Veröffentlicht: (2024)
Revisiting Northrop Frye's Four Myths Theory with Large Language Models
von: de Lima, Edirlei Soares, et al.
Veröffentlicht: (2026)
von: de Lima, Edirlei Soares, et al.
Veröffentlicht: (2026)
Sentipolis: Emotion-Aware Agents for Social Simulations
von: Fu, Chiyuan, et al.
Veröffentlicht: (2026)
von: Fu, Chiyuan, et al.
Veröffentlicht: (2026)
Cultural Fidelity in Large-Language Models: An Evaluation of Online Language Resources as a Driver of Model Performance in Value Representation
von: Kazemi, Sharif, et al.
Veröffentlicht: (2024)
von: Kazemi, Sharif, et al.
Veröffentlicht: (2024)
Superminds Test: Actively Evaluating Collective Intelligence of Agent Society via Probing Agents
von: Li, Xirui, et al.
Veröffentlicht: (2026)
von: Li, Xirui, et al.
Veröffentlicht: (2026)
JEEM: Vision-Language Understanding in Four Arabic Dialects
von: Kadaoui, Karima, et al.
Veröffentlicht: (2025)
von: Kadaoui, Karima, et al.
Veröffentlicht: (2025)
Beyond One World: Benchmarking Super Heros in Role-Playing Across Multiversal Contexts
von: Ngokpol, Perapard, et al.
Veröffentlicht: (2025)
von: Ngokpol, Perapard, et al.
Veröffentlicht: (2025)
Prompt4Vis: Prompting Large Language Models with Example Mining and Schema Filtering for Tabular Data Visualization
von: Li, Shuaimin, et al.
Veröffentlicht: (2024)
von: Li, Shuaimin, et al.
Veröffentlicht: (2024)
Evaluating Language Models' Evaluations of Games
von: Collins, Katherine M., et al.
Veröffentlicht: (2025)
von: Collins, Katherine M., et al.
Veröffentlicht: (2025)
EmotionQueen: A Benchmark for Evaluating Empathy of Large Language Models
von: Chen, Yuyan, et al.
Veröffentlicht: (2024)
von: Chen, Yuyan, et al.
Veröffentlicht: (2024)
Why Did Apple Fall: Evaluating Curiosity in Large Language Models
von: Wang, Haoyu, et al.
Veröffentlicht: (2025)
von: Wang, Haoyu, et al.
Veröffentlicht: (2025)
CityLens: Evaluating Large Vision-Language Models for Urban Socioeconomic Sensing
von: Liu, Tianhui, et al.
Veröffentlicht: (2025)
von: Liu, Tianhui, et al.
Veröffentlicht: (2025)
GrowLoop: Self-Evolving Conversation Evaluation Seeded by Human
von: Lin, Yihang, et al.
Veröffentlicht: (2026)
von: Lin, Yihang, et al.
Veröffentlicht: (2026)
Frozen Transformers in Language Models Are Effective Visual Encoder Layers
von: Pang, Ziqi, et al.
Veröffentlicht: (2023)
von: Pang, Ziqi, et al.
Veröffentlicht: (2023)
When Can Large Reasoning Models Save Thinking? Mechanistic Analysis of Behavioral Divergence in Reasoning
von: Zhu, Rongzhi, et al.
Veröffentlicht: (2025)
von: Zhu, Rongzhi, et al.
Veröffentlicht: (2025)
Can LLMs Estimate Student Struggles? Human-AI Difficulty Alignment with Proficiency Simulation for Item Difficulty Prediction
von: Li, Ming, et al.
Veröffentlicht: (2025)
von: Li, Ming, et al.
Veröffentlicht: (2025)
Enhancing RWKV-based Language Models for Long-Sequence Text Generation
von: Pan, Xinghan
Veröffentlicht: (2025)
von: Pan, Xinghan
Veröffentlicht: (2025)
Evaluating Neural Language Models as Cognitive Models of Language Acquisition
von: Martínez, Héctor Javier Vázquez, et al.
Veröffentlicht: (2023)
von: Martínez, Héctor Javier Vázquez, et al.
Veröffentlicht: (2023)
METER: Evaluating Multi-Level Contextual Causal Reasoning in Large Language Models
von: Li, Pengfeng, et al.
Veröffentlicht: (2026)
von: Li, Pengfeng, et al.
Veröffentlicht: (2026)
Contextual Attention Modulation: Towards Efficient Multi-Task Adaptation in Large Language Models
von: Pan, Dayan, et al.
Veröffentlicht: (2025)
von: Pan, Dayan, et al.
Veröffentlicht: (2025)
CFDLLMBench: A Benchmark Suite for Evaluating Large Language Models in Computational Fluid Dynamics
von: Somasekharan, Nithin, et al.
Veröffentlicht: (2025)
von: Somasekharan, Nithin, et al.
Veröffentlicht: (2025)
Surveying Attitudinal Alignment Between Large Language Models Vs. Humans Towards 17 Sustainable Development Goals
von: Wu, Qingyang, et al.
Veröffentlicht: (2024)
von: Wu, Qingyang, et al.
Veröffentlicht: (2024)
SED: Self-Evaluation Decoding Enhances Large Language Models for Better Generation
von: Luo, Ziqin, et al.
Veröffentlicht: (2024)
von: Luo, Ziqin, et al.
Veröffentlicht: (2024)
StrucText-Eval: Evaluating Large Language Model's Reasoning Ability in Structure-Rich Text
von: Gu, Zhouhong, et al.
Veröffentlicht: (2024)
von: Gu, Zhouhong, et al.
Veröffentlicht: (2024)
Do Large Language Models Have an English Accent? Evaluating and Improving the Naturalness of Multilingual LLMs
von: Guo, Yanzhu, et al.
Veröffentlicht: (2024)
von: Guo, Yanzhu, et al.
Veröffentlicht: (2024)
On Speeding Up Language Model Evaluation
von: Zhou, Jin Peng, et al.
Veröffentlicht: (2024)
von: Zhou, Jin Peng, et al.
Veröffentlicht: (2024)
Evaluating Quantized Large Language Models
von: Li, Shiyao, et al.
Veröffentlicht: (2024)
von: Li, Shiyao, et al.
Veröffentlicht: (2024)
How Do Language Models Process Ethical Instructions? Deliberation, Consistency, and Other-Recognition Across Four Models
von: Fukui, Hiroki
Veröffentlicht: (2026)
von: Fukui, Hiroki
Veröffentlicht: (2026)
Unveiling Trust in Multimodal Large Language Models: Evaluation, Analysis, and Mitigation
von: Zhang, Yichi, et al.
Veröffentlicht: (2025)
von: Zhang, Yichi, et al.
Veröffentlicht: (2025)
EmbodiedMidtrain: Bridging the Gap between Vision-Language Models and Vision-Language-Action Models via Mid-training
von: Du, Yiyang, et al.
Veröffentlicht: (2026)
von: Du, Yiyang, et al.
Veröffentlicht: (2026)
GenderAlign: An Alignment Dataset for Mitigating Gender Bias in Large Language Models
von: Zhang, Tao, et al.
Veröffentlicht: (2024)
von: Zhang, Tao, et al.
Veröffentlicht: (2024)
PromptIntern: Saving Inference Costs by Internalizing Recurrent Prompt during Large Language Model Fine-tuning
von: Zou, Jiaru, et al.
Veröffentlicht: (2024)
von: Zou, Jiaru, et al.
Veröffentlicht: (2024)
Graceful Forgetting in Generative Language Models
von: Jiang, Chunyang, et al.
Veröffentlicht: (2025)
von: Jiang, Chunyang, et al.
Veröffentlicht: (2025)
CritiqueLLM: Towards an Informative Critique Generation Model for Evaluation of Large Language Model Generation
von: Ke, Pei, et al.
Veröffentlicht: (2023)
von: Ke, Pei, et al.
Veröffentlicht: (2023)
Large Language Model Benchmarks in Medical Tasks
von: Yan, Lawrence K. Q., et al.
Veröffentlicht: (2024)
von: Yan, Lawrence K. Q., et al.
Veröffentlicht: (2024)
Dynamic Topic Evolution with Temporal Decay and Attention in Large Language Models
von: Wu, Di, et al.
Veröffentlicht: (2025)
von: Wu, Di, et al.
Veröffentlicht: (2025)
Detecting HIV-Related Stigma in Clinical Narratives Using Large Language Models
von: Chen, Ziyi, et al.
Veröffentlicht: (2026)
von: Chen, Ziyi, et al.
Veröffentlicht: (2026)
Evaluating Large Language Models for Abstract Evaluation Tasks: An Empirical Study
von: Liu, Yinuo, et al.
Veröffentlicht: (2026)
von: Liu, Yinuo, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Chinese Offensive Language Detection:Current Status and Future Directions
von: Xiao, Yunze, et al.
Veröffentlicht: (2024) -
A Stitch in Time Saves Nine: Proactive Self-Refinement for Language Models
von: Han, Jinyi, et al.
Veröffentlicht: (2025) -
Lexicography Saves Lives (LSL): Automatically Translating Suicide-Related Language
von: Schoene, Annika Marie, et al.
Veröffentlicht: (2024) -
Revisiting Northrop Frye's Four Myths Theory with Large Language Models
von: de Lima, Edirlei Soares, et al.
Veröffentlicht: (2026) -
Sentipolis: Emotion-Aware Agents for Social Simulations
von: Fu, Chiyuan, et al.
Veröffentlicht: (2026)