Enregistré dans:
| Auteurs principaux: | Vafa, Keyon, Bentley, Sarah, Kleinberg, Jon, Mullainathan, Sendhil |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2503.17482 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Do Large Language Models Perform the Way People Expect? Measuring the Human Generalization Function
par: Vafa, Keyon, et autres
Publié: (2024)
par: Vafa, Keyon, et autres
Publié: (2024)
Evaluating the World Model Implicit in a Generative Model
par: Vafa, Keyon, et autres
Publié: (2024)
par: Vafa, Keyon, et autres
Publié: (2024)
Language Generation in the Limit
par: Kleinberg, Jon, et autres
Publié: (2024)
par: Kleinberg, Jon, et autres
Publié: (2024)
Potemkin Understanding in Large Language Models
par: Mancoridis, Marina, et autres
Publié: (2025)
par: Mancoridis, Marina, et autres
Publié: (2025)
What Has a Foundation Model Found? Using Inductive Bias to Probe for World Models
par: Vafa, Keyon, et autres
Publié: (2025)
par: Vafa, Keyon, et autres
Publié: (2025)
A Foundational Generative Model for Breast Ultrasound Image Analysis
par: Yu, Haojun, et autres
Publié: (2025)
par: Yu, Haojun, et autres
Publié: (2025)
Semantic Approach to Quantifying the Consistency of Diffusion Model Image Generation
par: Bent, Brinnae
Publié: (2024)
par: Bent, Brinnae
Publié: (2024)
Generating Synthetic Satellite Imagery for Rare Objects: An Empirical Comparison of Models and Metrics
par: Nguyen, Tuong Vy, et autres
Publié: (2024)
par: Nguyen, Tuong Vy, et autres
Publié: (2024)
It's a Feature, Not a Bug: Measuring Creative Fluidity in Image Generators
par: Ramaswamy, Aditi, et autres
Publié: (2024)
par: Ramaswamy, Aditi, et autres
Publié: (2024)
DebiasPI: Inference-time Debiasing by Prompt Iteration of a Text-to-Image Generative Model
par: Bonna, Sarah, et autres
Publié: (2025)
par: Bonna, Sarah, et autres
Publié: (2025)
Generating Synthetic Satellite Imagery With Deep-Learning Text-to-Image Models -- Technical Challenges and Implications for Monitoring and Verification
par: Nguyen, Tuong Vy, et autres
Publié: (2024)
par: Nguyen, Tuong Vy, et autres
Publié: (2024)
Efficient Personalization of Generative User Interfaces
par: Peng, Yi-Hao, et autres
Publié: (2026)
par: Peng, Yi-Hao, et autres
Publié: (2026)
Generalization of CNNs on Relational Reasoning with Bar Charts
par: Cui, Zhenxing, et autres
Publié: (2025)
par: Cui, Zhenxing, et autres
Publié: (2025)
Revision Matters: Generative Design Guided by Revision Edits
par: Li, Tao, et autres
Publié: (2024)
par: Li, Tao, et autres
Publié: (2024)
Deep Generative Domain Adaptation with Temporal Attention for Cross-User Activity Recognition
par: Ye, Xiaozhou, et autres
Publié: (2024)
par: Ye, Xiaozhou, et autres
Publié: (2024)
EmoGene: Audio-Driven Emotional 3D Talking-Head Generation
par: Wang, Wenqing, et autres
Publié: (2024)
par: Wang, Wenqing, et autres
Publié: (2024)
Screen2AX: Vision-Based Approach for Automatic macOS Accessibility Generation
par: Muryn, Viktor, et autres
Publié: (2025)
par: Muryn, Viktor, et autres
Publié: (2025)
Deep Generative Domain Adaptation with Temporal Relation Knowledge for Cross-User Activity Recognition
par: Ye, Xiaozhou, et autres
Publié: (2024)
par: Ye, Xiaozhou, et autres
Publié: (2024)
LLAniMAtion: LLAMA Driven Gesture Animation
par: Windle, Jonathan, et autres
Publié: (2024)
par: Windle, Jonathan, et autres
Publié: (2024)
FERGI: Automatic Scoring of User Preferences for Text-to-Image Generation from Spontaneous Facial Expression Reaction
par: Feng, Shuangquan, et autres
Publié: (2023)
par: Feng, Shuangquan, et autres
Publié: (2023)
Yume: An Interactive World Generation Model
par: Mao, Xiaofeng, et autres
Publié: (2025)
par: Mao, Xiaofeng, et autres
Publié: (2025)
Efficient Retail Video Annotation: A Robust Key Frame Generation Approach for Product and Customer Interaction Analysis
par: Mannam, Varun, et autres
Publié: (2025)
par: Mannam, Varun, et autres
Publié: (2025)
MNIST-Gen: A Modular MNIST-Style Dataset Generation Using Hierarchical Semantics, Reinforcement Learning, and Category Theory
par: Shaeri, Pouya, et autres
Publié: (2025)
par: Shaeri, Pouya, et autres
Publié: (2025)
Training a Vision Language Model as Smartphone Assistant
par: Dorka, Nicolai, et autres
Publié: (2024)
par: Dorka, Nicolai, et autres
Publié: (2024)
LEDITS++: Limitless Image Editing using Text-to-Image Models
par: Brack, Manuel, et autres
Publié: (2023)
par: Brack, Manuel, et autres
Publié: (2023)
InterVLS: Interactive Model Understanding and Improvement with Vision-Language Surrogates
par: Huang, Jinbin, et autres
Publié: (2023)
par: Huang, Jinbin, et autres
Publié: (2023)
Predicting and Explaining Mobile UI Tappability with Vision Modeling and Saliency Analysis
par: Schoop, Eldon, et autres
Publié: (2022)
par: Schoop, Eldon, et autres
Publié: (2022)
I-CEE: Tailoring Explanations of Image Classification Models to User Expertise
par: Rong, Yao, et autres
Publié: (2023)
par: Rong, Yao, et autres
Publié: (2023)
SpiderNets: Vision Models Predict Human Fear From Aversive Images
par: Pegler, Dominik, et autres
Publié: (2025)
par: Pegler, Dominik, et autres
Publié: (2025)
HERO: Human-Feedback Efficient Reinforcement Learning for Online Diffusion Model Finetuning
par: Hiranaka, Ayano, et autres
Publié: (2024)
par: Hiranaka, Ayano, et autres
Publié: (2024)
ExpressEdit: Fast Editing of Stylized Facial Expressions with Diffusion Models in Photoshop
par: Tang, Kenan, et autres
Publié: (2026)
par: Tang, Kenan, et autres
Publié: (2026)
Characterizing Photorealism and Artifacts in Diffusion Model-Generated Images
par: Kamali, Negar, et autres
Publié: (2025)
par: Kamali, Negar, et autres
Publié: (2025)
Interaction as Explanation: A User Interaction-based Method for Explaining Image Classification Models
par: Yun, Hyeonggeun
Publié: (2024)
par: Yun, Hyeonggeun
Publié: (2024)
NeuralOS: Towards Simulating Operating Systems via Neural Generative Models
par: Rivard, Luke, et autres
Publié: (2025)
par: Rivard, Luke, et autres
Publié: (2025)
Measuring Agreeableness Bias in Multimodal Models
par: Lim, Jaehyuk, et autres
Publié: (2024)
par: Lim, Jaehyuk, et autres
Publié: (2024)
Vision-Language Models for Ergonomic Assessment of Manual Lifting Tasks: Estimating Horizontal and Vertical Hand Distances from RGB Video
par: Rajabi, Mohammad Sadra, et autres
Publié: (2026)
par: Rajabi, Mohammad Sadra, et autres
Publié: (2026)
Zero-shot Emotion Annotation in Facial Images Using Large Multimodal Models: Benchmarking and Prospects for Multi-Class, Multi-Frame Approaches
par: Zhang, He, et autres
Publié: (2025)
par: Zhang, He, et autres
Publié: (2025)
See What I Mean: Aligning Vision and Language Representations for Video Fine-grained Object Understanding
par: Sun, Boyuan, et autres
Publié: (2026)
par: Sun, Boyuan, et autres
Publié: (2026)
ShowUI-$π$: Flow-based Generative Models as GUI Dexterous Hands
par: Hu, Siyuan, et autres
Publié: (2025)
par: Hu, Siyuan, et autres
Publié: (2025)
Quantitative Movement Testing: Measuring Patient Movements from a Single Smartphone Video
par: Mahajan, Pranav, et autres
Publié: (2026)
par: Mahajan, Pranav, et autres
Publié: (2026)
Documents similaires
-
Do Large Language Models Perform the Way People Expect? Measuring the Human Generalization Function
par: Vafa, Keyon, et autres
Publié: (2024) -
Evaluating the World Model Implicit in a Generative Model
par: Vafa, Keyon, et autres
Publié: (2024) -
Language Generation in the Limit
par: Kleinberg, Jon, et autres
Publié: (2024) -
Potemkin Understanding in Large Language Models
par: Mancoridis, Marina, et autres
Publié: (2025) -
What Has a Foundation Model Found? Using Inductive Bias to Probe for World Models
par: Vafa, Keyon, et autres
Publié: (2025)