CrochetBench: Can Vision-Language Models Move from Describing to Doing in Crochet Domain?
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Peiyu, Huang, Xiaobao, Hua, Ting, Chawla, Nitesh V. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Crocheting Mathematics
por: Kekkonen, Hanne
Publicado: (2025)
por: Kekkonen, Hanne
Publicado: (2025)
Crochet representation of the Lobachevskian surface
por: Reyes, Isabella Estrada, et al.
Publicado: (2024)
por: Reyes, Isabella Estrada, et al.
Publicado: (2024)
AgentDrug: Utilizing Large Language Models in An Agentic Workflow for Zero-Shot Molecular Editing
por: Le, Khiem, et al.
Publicado: (2024)
por: Le, Khiem, et al.
Publicado: (2024)
TeachingCoach: A Fine-Tuned Scaffolding Chatbot for Instructional Guidance to Instructors
por: Molnar, Isabel, et al.
Publicado: (2026)
por: Molnar, Isabel, et al.
Publicado: (2026)
FLAME: Towards Federated Fine-Tuning Large Language Models Through Adaptive SMoE
por: Le, Khiem, et al.
Publicado: (2025)
por: Le, Khiem, et al.
Publicado: (2025)
Adaptive Testing for LLM Evaluation: A Psychometric Alternative to Static Benchmarks
por: Li, Peiyu, et al.
Publicado: (2025)
por: Li, Peiyu, et al.
Publicado: (2025)
Automated Benchmark Generation from Domain Guidelines Informed by Bloom's Taxonomy
por: Chen, Si, et al.
Publicado: (2026)
por: Chen, Si, et al.
Publicado: (2026)
ChefFusion: Multimodal Foundation Model Integrating Recipe and Food Image Generation
por: Li, Peiyu, et al.
Publicado: (2024)
por: Li, Peiyu, et al.
Publicado: (2024)
MolX: Enhancing Large Language Models for Molecular Understanding With A Multi-Modal Extension
por: Le, Khiem, et al.
Publicado: (2024)
por: Le, Khiem, et al.
Publicado: (2024)
Geometry of Knowledge Allows Extending Diversity Boundaries of Large Language Models
por: Bystroński, Mateusz, et al.
Publicado: (2025)
por: Bystroński, Mateusz, et al.
Publicado: (2025)
Exploring Conversational Design Choices in LLMs for Pedagogical Purposes: Socratic and Narrative Approaches for Improving Instructor's Teaching Practice
por: Chen, Si, et al.
Publicado: (2025)
por: Chen, Si, et al.
Publicado: (2025)
Breaking Language Barriers: Equitable Performance in Multilingual Language Models
por: Nagar, Tanay, et al.
Publicado: (2025)
por: Nagar, Tanay, et al.
Publicado: (2025)
Context Attribution with Multi-Armed Bandit Optimization
por: Pan, Deng, et al.
Publicado: (2025)
por: Pan, Deng, et al.
Publicado: (2025)
Building Scaffolding Dialogue Data with LLM-Simulated Novices
por: Chen, Si, et al.
Publicado: (2025)
por: Chen, Si, et al.
Publicado: (2025)
CaTS-Bench: Can Language Models Describe Time Series?
por: Zhou, Luca, et al.
Publicado: (2025)
por: Zhou, Luca, et al.
Publicado: (2025)
A Survey of Large Language Models for Graphs
por: Ren, Xubin, et al.
Publicado: (2024)
por: Ren, Xubin, et al.
Publicado: (2024)
Fast Explanations via Policy Gradient-Optimized Explainer
por: Pan, Deng, et al.
Publicado: (2024)
por: Pan, Deng, et al.
Publicado: (2024)
AutoBench-V: Can Large Vision-Language Models Benchmark Themselves?
por: Bao, Han, et al.
Publicado: (2024)
por: Bao, Han, et al.
Publicado: (2024)
Can LLMs Detect Their Confabulations? Estimating Reliability in Uncertainty-Aware Language Models
por: Zhou, Tianyi, et al.
Publicado: (2025)
por: Zhou, Tianyi, et al.
Publicado: (2025)
AutoLLMResearch: Training Research Agents for Automating LLM Experiment Configuration - Learning from Cheap, Optimizing Expensive
por: Guo, Taicheng, et al.
Publicado: (2026)
por: Guo, Taicheng, et al.
Publicado: (2026)
AlgBench: To What Extent Do Large Reasoning Models Understand Algorithms?
por: Sun, Henan, et al.
Publicado: (2026)
por: Sun, Henan, et al.
Publicado: (2026)
HetGPT: Harnessing the Power of Prompt Tuning in Pre-Trained Heterogeneous Graph Neural Networks
por: Ma, Yihong, et al.
Publicado: (2023)
por: Ma, Yihong, et al.
Publicado: (2023)
LocateBench: Evaluating the Locating Ability of Vision Language Models
por: Chiang, Ting-Rui, et al.
Publicado: (2024)
por: Chiang, Ting-Rui, et al.
Publicado: (2024)
Learnware of Language Models: Specialized Small Language Models Can Do Big
por: Tan, Zhi-Hao, et al.
Publicado: (2025)
por: Tan, Zhi-Hao, et al.
Publicado: (2025)
GFT: Graph Foundation Model with Transferable Tree Vocabulary
por: Wang, Zehong, et al.
Publicado: (2024)
por: Wang, Zehong, et al.
Publicado: (2024)
Graph Neural Prompting with Large Language Models
por: Tian, Yijun, et al.
Publicado: (2023)
por: Tian, Yijun, et al.
Publicado: (2023)
PTCG-Bench: Can LLM Agents Master Pokémon Trading Card Game?
por: Hua, Dongdong, et al.
Publicado: (2026)
por: Hua, Dongdong, et al.
Publicado: (2026)
VL-RouterBench: A Benchmark for Vision-Language Model Routing
por: Huang, Zhehao, et al.
Publicado: (2025)
por: Huang, Zhehao, et al.
Publicado: (2025)
MVP-Bench: Can Large Vision--Language Models Conduct Multi-level Visual Perception Like Humans?
por: Li, Guanzhen, et al.
Publicado: (2024)
por: Li, Guanzhen, et al.
Publicado: (2024)
Do Vision-Language Models Measure Up? Benchmarking Visual Measurement Reading with MeasureBench
por: Lin, Fenfen, et al.
Publicado: (2025)
por: Lin, Fenfen, et al.
Publicado: (2025)
Large Language Model based Multi-Agents: A Survey of Progress and Challenges
por: Guo, Taicheng, et al.
Publicado: (2024)
por: Guo, Taicheng, et al.
Publicado: (2024)
VideoGameBench: Can Vision-Language Models complete popular video games?
por: Zhang, Alex L., et al.
Publicado: (2025)
por: Zhang, Alex L., et al.
Publicado: (2025)
LiveLongBench: Tackling Long-Context Understanding for Spoken Texts from Live Streams
por: Wu, Yongxuan, et al.
Publicado: (2025)
por: Wu, Yongxuan, et al.
Publicado: (2025)
Beyond Answers: Transferring Reasoning Capabilities to Smaller LLMs Using Multi-Teacher Knowledge Distillation
por: Tian, Yijun, et al.
Publicado: (2024)
por: Tian, Yijun, et al.
Publicado: (2024)
ProgramBench: Can Language Models Rebuild Programs From Scratch?
por: Yang, John, et al.
Publicado: (2026)
por: Yang, John, et al.
Publicado: (2026)
"Not in My Backyard": LLMs Uncover Online and Offline Social Biases Against Homelessness
por: Karr Jr., Jonathan A., et al.
Publicado: (2025)
por: Karr Jr., Jonathan A., et al.
Publicado: (2025)
Latent Domain Prompt Learning for Vision-Language Models
por: Li, Zhixing, et al.
Publicado: (2025)
por: Li, Zhixing, et al.
Publicado: (2025)
UGMAE: A Unified Framework for Graph Masked Autoencoders
por: Tian, Yijun, et al.
Publicado: (2024)
por: Tian, Yijun, et al.
Publicado: (2024)
Towards Graph Foundation Models: Learning Generalities Across Graphs via Task-Trees
por: Wang, Zehong, et al.
Publicado: (2024)
por: Wang, Zehong, et al.
Publicado: (2024)
Learning to Predict Mutation Effects of Protein-Protein Interactions by Microenvironment-aware Hierarchical Prompt Learning
por: Wu, Lirong, et al.
Publicado: (2024)
por: Wu, Lirong, et al.
Publicado: (2024)
Ejemplares similares
-
Crocheting Mathematics
por: Kekkonen, Hanne
Publicado: (2025) -
Crochet representation of the Lobachevskian surface
por: Reyes, Isabella Estrada, et al.
Publicado: (2024) -
AgentDrug: Utilizing Large Language Models in An Agentic Workflow for Zero-Shot Molecular Editing
por: Le, Khiem, et al.
Publicado: (2024) -
TeachingCoach: A Fine-Tuned Scaffolding Chatbot for Instructional Guidance to Instructors
por: Molnar, Isabel, et al.
Publicado: (2026) -
FLAME: Towards Federated Fine-Tuning Large Language Models Through Adaptive SMoE
por: Le, Khiem, et al.
Publicado: (2025)