From Artificially Real to Real: Leveraging Pseudo Data from Large Language Models for Low-Resource Molecule Discovery
Fuente:
arXiv
Saved in:
| Main Authors: | Chen, Yuhan, Xi, Nuwa, Du, Yanrui, Wang, Haochun, Chen, Jianyu, Zhao, Sendong, Qin, Bing |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
AS-ES Learning: Towards Efficient CoT Learning in Small Models
by: Xi, Nuwa, et al.
Published: (2024)
by: Xi, Nuwa, et al.
Published: (2024)
Analyzing the Inherent Response Tendency of LLMs: Real-World Instructions-Driven Jailbreak
by: Du, Yanrui, et al.
Published: (2023)
by: Du, Yanrui, et al.
Published: (2023)
Knowledge-tuning Large Language Models with Structured Medical Knowledge Bases for Reliable Response Generation in Chinese
by: Wang, Haochun, et al.
Published: (2023)
by: Wang, Haochun, et al.
Published: (2023)
Beyond Direct Diagnosis: LLM-based Multi-Specialist Agent Consultation for Automatic Diagnosis
by: Wang, Haochun, et al.
Published: (2024)
by: Wang, Haochun, et al.
Published: (2024)
LLMs May Perform MCQA by Selecting the Least Incorrect Option
by: Wang, Haochun, et al.
Published: (2024)
by: Wang, Haochun, et al.
Published: (2024)
MolTailor: Tailoring Chemical Molecular Representation to Specific Tasks via Text Prompts
by: Guo, Haoqiang, et al.
Published: (2024)
by: Guo, Haoqiang, et al.
Published: (2024)
Manifold-based Verbalizer Space Re-embedding for Tuning-free Prompt-based Classification
by: Wang, Haochun, et al.
Published: (2023)
by: Wang, Haochun, et al.
Published: (2023)
META-RAG: Meta-Analysis-Inspired Evidence-Re-Ranking Method for Retrieval-Augmented Generation in Evidence-Based Medicine
by: Sun, Mengzhou, et al.
Published: (2025)
by: Sun, Mengzhou, et al.
Published: (2025)
M-Eval: A Heterogeneity-Based Framework for Multi-evidence Validation in Medical RAG Systems
by: Sun, Mengzhou, et al.
Published: (2025)
by: Sun, Mengzhou, et al.
Published: (2025)
From Latent Signals to Reflection Behavior: Tracing Meta-Cognitive Activation Trajectory in R1-Style LLMs
by: Du, Yanrui, et al.
Published: (2026)
by: Du, Yanrui, et al.
Published: (2026)
Don't Ignore Dual Logic Ability of LLMs while Privatizing: A Data-Intensive Analysis in Medical Domain
by: Du, Yanrui, et al.
Published: (2023)
by: Du, Yanrui, et al.
Published: (2023)
MoGU: A Framework for Enhancing Safety of Open-Sourced LLMs While Preserving Their Usability
by: Du, Yanrui, et al.
Published: (2024)
by: Du, Yanrui, et al.
Published: (2024)
MoGU V2: Toward a Higher Pareto Frontier Between Model Usability and Security
by: Du, Yanrui, et al.
Published: (2025)
by: Du, Yanrui, et al.
Published: (2025)
Uncovering the Role of Initial Saliency in U-Shaped Attention Bias: Scaling Initial Token Weight for Enhanced Long-Text Processing
by: Qiang, Zewen, et al.
Published: (2025)
by: Qiang, Zewen, et al.
Published: (2025)
SL-BiLEM: Structured Learnable Behavior-in-the-Loop Epidemic Modeling for Forecasting and Policy Evaluation
by: Wang, Haochun, et al.
Published: (2026)
by: Wang, Haochun, et al.
Published: (2026)
PICOs-RAG: PICO-supported Query Rewriting for Retrieval-Augmented Generation in Evidence-Based Medicine
by: Sun, Mengzhou, et al.
Published: (2025)
by: Sun, Mengzhou, et al.
Published: (2025)
ArcAligner: Adaptive Recursive Aligner for Compressed Context Embeddings in RAG
by: Li, Jianbo, et al.
Published: (2026)
by: Li, Jianbo, et al.
Published: (2026)
MolFusion: Multimodal Fusion Learning for Molecular Representations via Multi-granularity Views
by: Cai, Muzhen, et al.
Published: (2024)
by: Cai, Muzhen, et al.
Published: (2024)
OptiSet: Unified Optimizing Set Selection and Ranking for Retrieval-Augmented Generation
by: Jiang, Yi, et al.
Published: (2026)
by: Jiang, Yi, et al.
Published: (2026)
CoCoA: Collaborative Chain-of-Agents for Parametric-Retrieved Knowledge Synergy
by: Jiang, Yi, et al.
Published: (2025)
by: Jiang, Yi, et al.
Published: (2025)
Toward Secure Tuning: Mitigating Security Risks from Instruction Fine-Tuning
by: Du, Yanrui, et al.
Published: (2024)
by: Du, Yanrui, et al.
Published: (2024)
Anchoring Refusal Direction: Mitigating Safety Risks in Tuning via Projection Constraint
by: Du, Yanrui, et al.
Published: (2025)
by: Du, Yanrui, et al.
Published: (2025)
Easier to Judge than to Find: Predicting In-Context Learning Success for Demonstration Selection
by: Wang, Haochun, et al.
Published: (2026)
by: Wang, Haochun, et al.
Published: (2026)
When Correct Beliefs Collapse: Epistemic Resilience of LLMs under Clinical Pressure
by: Xiao, Boyu, et al.
Published: (2026)
by: Xiao, Boyu, et al.
Published: (2026)
S3-CoT: Self-Sampled Succinct Reasoning Enables Efficient Chain-of-Thought LLMs
by: Du, Yanrui, et al.
Published: (2026)
by: Du, Yanrui, et al.
Published: (2026)
GainRAG: Preference Alignment in Retrieval-Augmented Generation through Gain Signal Synthesis
by: Jiang, Yi, et al.
Published: (2025)
by: Jiang, Yi, et al.
Published: (2025)
GSEM: Graph-based Self-Evolving Memory for Experience Augmented Clinical Reasoning
by: Han, Xiao, et al.
Published: (2026)
by: Han, Xiao, et al.
Published: (2026)
Leveraging Digitized Newspapers to Collect Summarization Data in Low-Resource Languages
by: Dahan, Noam, et al.
Published: (2025)
by: Dahan, Noam, et al.
Published: (2025)
Empowering Low-Resource Language ASR via Large-Scale Pseudo Labeling
by: Bhogale, Kaushal Santosh, et al.
Published: (2024)
by: Bhogale, Kaushal Santosh, et al.
Published: (2024)
Pseudo2Real: Task Arithmetic for Pseudo-Label Correction in Automatic Speech Recognition
by: Lin, Yi-Cheng, et al.
Published: (2025)
by: Lin, Yi-Cheng, et al.
Published: (2025)
Democratizing LLMs for Low-Resource Languages by Leveraging their English Dominant Abilities with Linguistically-Diverse Prompts
by: Nguyen, Xuan-Phi, et al.
Published: (2023)
by: Nguyen, Xuan-Phi, et al.
Published: (2023)
Fine-tuning Whisper on Low-Resource Languages for Real-World Applications
by: Timmel, Vincenzo, et al.
Published: (2024)
by: Timmel, Vincenzo, et al.
Published: (2024)
Beyond Frameworks: Unpacking Collaboration Strategies in Multi-Agent Systems
by: Wang, Haochun, et al.
Published: (2025)
by: Wang, Haochun, et al.
Published: (2025)
Efficient ASR for Low-Resource Languages: Leveraging Cross-Lingual Unlabeled Data
by: Bandarupalli, Srihari, et al.
Published: (2025)
by: Bandarupalli, Srihari, et al.
Published: (2025)
Controllable and Diverse Data Augmentation with Large Language Model for Low-Resource Open-Domain Dialogue Generation
by: Liu, Zhenhua, et al.
Published: (2024)
by: Liu, Zhenhua, et al.
Published: (2024)
Quality or Quantity? On Data Scale and Diversity in Adapting Large Language Models for Low-Resource Translation
by: Iyer, Vivek, et al.
Published: (2024)
by: Iyer, Vivek, et al.
Published: (2024)
LLaST: Improved End-to-end Speech Translation System Leveraged by Large Language Models
by: Chen, Xi, et al.
Published: (2024)
by: Chen, Xi, et al.
Published: (2024)
Artificial Conversations, Real Results: Fostering Language Detection with Synthetic Data
by: Mohammadi, Fatemeh, et al.
Published: (2025)
by: Mohammadi, Fatemeh, et al.
Published: (2025)
FormosanBench: Benchmarking Low-Resource Austronesian Languages in the Era of Large Language Models
by: Lin, Kaiying Kevin, et al.
Published: (2025)
by: Lin, Kaiying Kevin, et al.
Published: (2025)
From Tokens to Materials: Leveraging Language Models for Scientific Discovery
by: Wan, Yuwei, et al.
Published: (2024)
by: Wan, Yuwei, et al.
Published: (2024)
Similar Items
-
AS-ES Learning: Towards Efficient CoT Learning in Small Models
by: Xi, Nuwa, et al.
Published: (2024) -
Analyzing the Inherent Response Tendency of LLMs: Real-World Instructions-Driven Jailbreak
by: Du, Yanrui, et al.
Published: (2023) -
Knowledge-tuning Large Language Models with Structured Medical Knowledge Bases for Reliable Response Generation in Chinese
by: Wang, Haochun, et al.
Published: (2023) -
Beyond Direct Diagnosis: LLM-based Multi-Specialist Agent Consultation for Automatic Diagnosis
by: Wang, Haochun, et al.
Published: (2024) -
LLMs May Perform MCQA by Selecting the Least Incorrect Option
by: Wang, Haochun, et al.
Published: (2024)