Descripción automática de secciones delgadas de rocas: una aplicación Web
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Paucar, Stalyn, Collaguazo, Christian Mejía-Escobar y Víctor |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
WebGym: Scaling Training Environments for Visual Web Agents with Realistic Tasks
par: Bai, Hao, et autres
Publié: (2026)
par: Bai, Hao, et autres
Publié: (2026)
Web-based Melanoma Detection
par: Kim, SangHyuk, et autres
Publié: (2024)
par: Kim, SangHyuk, et autres
Publié: (2024)
Noise-Tolerant Hybrid Prototypical Learning with Noisy Web Data
par: Liang, Chao, et autres
Publié: (2025)
par: Liang, Chao, et autres
Publié: (2025)
VisualWebArena: Evaluating Multimodal Agents on Realistic Visual Web Tasks
par: Koh, Jing Yu, et autres
Publié: (2024)
par: Koh, Jing Yu, et autres
Publié: (2024)
LAION-C: An Out-of-Distribution Benchmark for Web-Scale Vision Models
par: Li, Fanfei, et autres
Publié: (2025)
par: Li, Fanfei, et autres
Publié: (2025)
Web2Grasp: Learning Functional Grasps from Web Images of Hand-Object Interactions
par: Chen, Hongyi, et autres
Publié: (2025)
par: Chen, Hongyi, et autres
Publié: (2025)
WebSerial Vision Training for Microcontrollers: A Browser-Based Companion to On-Device CNN Training
par: Ellis, Jeremy
Publié: (2026)
par: Ellis, Jeremy
Publié: (2026)
Pix2Fact: When Vision Is Not Enough -- Benchmarking Fine-Grained VQA with Web Verification on High-Resolution Real-World Scenes
par: Jiang, Yifan, et autres
Publié: (2026)
par: Jiang, Yifan, et autres
Publié: (2026)
ZeroMimic: Distilling Robotic Manipulation Skills from Web Videos
par: Shi, Junyao, et autres
Publié: (2025)
par: Shi, Junyao, et autres
Publié: (2025)
WebLINX: Real-World Website Navigation with Multi-Turn Dialogue
par: Lù, Xing Han, et autres
Publié: (2024)
par: Lù, Xing Han, et autres
Publié: (2024)
Efficient License Plate Recognition in Videos Using Visual Rhythm and Accumulative Line Analysis
par: Ribeiro, Victor Nascimento, et autres
Publié: (2025)
par: Ribeiro, Victor Nascimento, et autres
Publié: (2025)
Combining YOLO and Visual Rhythm for Vehicle Counting
par: Ribeiro, Victor Nascimento, et autres
Publié: (2025)
par: Ribeiro, Victor Nascimento, et autres
Publié: (2025)
WebInject: Prompt Injection Attack to Web Agents
par: Wang, Xilong, et autres
Publié: (2025)
par: Wang, Xilong, et autres
Publié: (2025)
WALT: Web Agents that Learn Tools
par: Prabhu, Viraj, et autres
Publié: (2025)
par: Prabhu, Viraj, et autres
Publié: (2025)
ABC Easy as 123: A Blind Counter for Exemplar-Free Multi-Class Class-agnostic Counting
par: Hobley, Michael A., et autres
Publié: (2023)
par: Hobley, Michael A., et autres
Publié: (2023)
Fill the Gap: Quantifying and Reducing the Modality Gap in Image-Text Representation Learning
par: Role, François, et autres
Publié: (2025)
par: Role, François, et autres
Publié: (2025)
Tiny Neural Networks for Multi-Object Tracking in a Modular Kalman Framework
par: Holz, Christian Alexander, et autres
Publié: (2025)
par: Holz, Christian Alexander, et autres
Publié: (2025)
GR-2: A Generative Video-Language-Action Model with Web-Scale Knowledge for Robot Manipulation
par: Cheang, Chi-Lam, et autres
Publié: (2024)
par: Cheang, Chi-Lam, et autres
Publié: (2024)
Familiarity-Based Open-Set Recognition Under Adversarial Attacks
par: Enevoldsen, Philip, et autres
Publié: (2023)
par: Enevoldsen, Philip, et autres
Publié: (2023)
Supervised Anomaly Detection for Complex Industrial Images
par: Baitieva, Aimira, et autres
Publié: (2024)
par: Baitieva, Aimira, et autres
Publié: (2024)
Don't drop your samples! Coherence-aware training benefits Conditional diffusion
par: Dufour, Nicolas, et autres
Publié: (2024)
par: Dufour, Nicolas, et autres
Publié: (2024)
SD4Match: Learning to Prompt Stable Diffusion Model for Semantic Matching
par: Li, Xinghui, et autres
Publié: (2023)
par: Li, Xinghui, et autres
Publié: (2023)
Cross-Modal Redundancy and the Geometry of Vision-Language Embeddings
par: Dhimoïla, Grégoire, et autres
Publié: (2026)
par: Dhimoïla, Grégoire, et autres
Publié: (2026)
Extracting Symbolic Sequences from Visual Representations via Self-Supervised Learning
par: Pozos, Victor Sebastian Martinez, et autres
Publié: (2025)
par: Pozos, Victor Sebastian Martinez, et autres
Publié: (2025)
Dataset Enhancement with Instance-Level Augmentations
par: Kupyn, Orest, et autres
Publié: (2024)
par: Kupyn, Orest, et autres
Publié: (2024)
Visual Memory Injection Attacks for Multi-Turn Conversations
par: Schlarmann, Christian, et autres
Publié: (2026)
par: Schlarmann, Christian, et autres
Publié: (2026)
Near-Infrared Hyperspectral Imaging Applications in Food Analysis -- Improving Algorithms and Methodologies
par: Engstrøm, Ole-Christian Galbo
Publié: (2025)
par: Engstrøm, Ole-Christian Galbo
Publié: (2025)
Splatt3R: Zero-shot Gaussian Splatting from Uncalibrated Image Pairs
par: Smart, Brandon, et autres
Publié: (2024)
par: Smart, Brandon, et autres
Publié: (2024)
Map-Relative Pose Regression for Visual Re-Localization
par: Chen, Shuai, et autres
Publié: (2024)
par: Chen, Shuai, et autres
Publié: (2024)
EPTQ: Enhanced Post-Training Quantization via Hessian-guided Network-wise Optimization
par: Gordon, Ofir, et autres
Publié: (2023)
par: Gordon, Ofir, et autres
Publié: (2023)
Principal Component Analysis for Lunar Crater Detection
par: Driver, Travis, et autres
Publié: (2026)
par: Driver, Travis, et autres
Publié: (2026)
Weblica: Scalable and Reproducible Training Environments for Visual Web Agents
par: Kar, Oğuzhan Fatih, et autres
Publié: (2026)
par: Kar, Oğuzhan Fatih, et autres
Publié: (2026)
Federated Learning for Drowsiness Detection in Connected Vehicles
par: Lindskog, William, et autres
Publié: (2024)
par: Lindskog, William, et autres
Publié: (2024)
Global Mapping of Exposure and Physical Vulnerability Dynamics in Least Developed Countries using Remote Sensing and Machine Learning
par: Dimasaka, Joshua, et autres
Publié: (2024)
par: Dimasaka, Joshua, et autres
Publié: (2024)
VGGHeads: 3D Multi Head Alignment with a Large-Scale Synthetic Dataset
par: Kupyn, Orest, et autres
Publié: (2024)
par: Kupyn, Orest, et autres
Publié: (2024)
TrAct: Making First-layer Pre-Activations Trainable
par: Petersen, Felix, et autres
Publié: (2024)
par: Petersen, Felix, et autres
Publié: (2024)
Anatomically-aware conformal prediction for medical image segmentation with random walks
par: Gaillochet, Mélanie, et autres
Publié: (2026)
par: Gaillochet, Mélanie, et autres
Publié: (2026)
PASTA: Vision Transformer Patch Aggregation for Weakly Supervised Target and Anomaly Segmentation
par: Neubauer, Melanie, et autres
Publié: (2026)
par: Neubauer, Melanie, et autres
Publié: (2026)
OpenWebRL: Demystifying Online Multi-turn Reinforcement Learning for Visual Web Agents
par: Yang, Rui, et autres
Publié: (2026)
par: Yang, Rui, et autres
Publié: (2026)
RealWebAssist: A Benchmark for Long-Horizon Web Assistance with Real-World Users
par: Ye, Suyu, et autres
Publié: (2025)
par: Ye, Suyu, et autres
Publié: (2025)
Documents similaires
-
WebGym: Scaling Training Environments for Visual Web Agents with Realistic Tasks
par: Bai, Hao, et autres
Publié: (2026) -
Web-based Melanoma Detection
par: Kim, SangHyuk, et autres
Publié: (2024) -
Noise-Tolerant Hybrid Prototypical Learning with Noisy Web Data
par: Liang, Chao, et autres
Publié: (2025) -
VisualWebArena: Evaluating Multimodal Agents on Realistic Visual Web Tasks
par: Koh, Jing Yu, et autres
Publié: (2024) -
LAION-C: An Out-of-Distribution Benchmark for Web-Scale Vision Models
par: Li, Fanfei, et autres
Publié: (2025)