All papers
Every paper that carries a page of its own here. The Papers page leads with what is trending and lets you filter the recent catalog; this is the plain index of the rest.
PTD-SQL: Partitioning and Targeted Drilling with LLMs in Text-to-SQLarXiv 2024Can Compressed LLMs Truly Act? An Empirical Evaluation of Agentic Capabilities in LLM CompressionarXiv 2025Learning to Distill Global Representation for Sparse-View CTICCV 2023 1Bootstrapped Training of Score-Conditioned Generator for Offline Design of Biological Sequencesbootstrapped-training-of-score-conditionedGenerating EDU Extracts for Plan-Guided Summary Re-RankingarXiv 2023GAN Cocktail: mixing GANs without dataset accessarXiv 2021VANiLLa : Verbalized Answers in Natural Language at Large ScalearXiv 2021RDA: Reciprocal Distribution Alignment for Robust Semi-supervised LearningarXiv 2022Models Are Codes: Towards Measuring Malicious Code Poisoning Attacks on
Pre-trained Model HubsarXiv 2024Drawing Pandas: A Benchmark for LLMs in Generating Plotting CodearXiv 2024Forgotten Polygons: Multimodal Large Language Models are Shape-BlindarXiv 2025LACIE: Listener-Aware Finetuning for Confidence Calibration in Large Language ModelsarXiv 2024Expected flow networks in stochastic environments and two-player zero-sum gamesarXiv 2023Disentangled Phonetic Representation for Chinese Spelling CorrectionarXiv 2023PrimeGuard: Safe and Helpful LLMs through Tuning-Free RoutingarXiv 2024Neural Simulated Annealingneural-simulated-annealingSaliency Map Verbalization: Comparing Feature Importance Representations from Model-free and Instruction-based MethodsarXiv 2022Meningioma segmentation in T1-weighted MRI leveraging global context and attention mechanismsarXiv 2021Toward a Deeper Understanding: RetNet Viewed through ConvolutionarXiv 2023Optimal strategies for gravitational wave stochastic background searches
in pulsar timing dataarXiv 2008Filler Word Detection and Classification: A Dataset and BenchmarkarXiv 2022Unsupervised Anomaly Detection in Medical Images with a Memory-augmented Multi-level Cross-attentional Masked AutoencoderarXiv 2022Robustness Certification for Point Cloud ModelsICCV 2021 10Debiasing Multimodal Large Language Models via Noise-Aware Preference OptimizationCVPR 2025 1Training Bayesian Neural Networks with Sparse Subspace Variational InferencearXiv 2024Enabling LLM Knowledge Analysis via Extensive MaterializationarXiv 2024A Bit of a Problem: Measurement Disparities in Dataset Sizes Across LanguagesarXiv 2024Removing Undesirable Feature Contributions Using Out-of-Distribution Dataremoving-undesirable-feature-contributionsmiCSE: Mutual Information Contrastive Learning for Low-shot Sentence EmbeddingsarXiv 2022Questioning the Survey Responses of Large Language ModelsarXiv 2023Improving Medical Multi-modal Contrastive Learning with Expert AnnotationsarXiv 2024SIGHT: A Large Annotated Dataset on Student Insights Gathered from Higher Education TranscriptsarXiv 2023Code Soliloquies for Accurate Calculations in Large Language ModelsarXiv 2023Improving Online Continual Learning Performance and Stability with Temporal EnsemblesarXiv 2023TRIGO: Benchmarking Formal Mathematical Proof Reduction for Generative Language ModelsarXiv 2023T-MAE: Temporal Masked Autoencoders for Point Cloud Representation LearningarXiv 2023Coordinate-based Texture Inpainting for Pose-Guided Image GenerationarXiv 2018Benchmarking Multimodal RAG through a Chart-based Document Question-Answering Generation FrameworkarXiv 2025A General Framework for User-Guided Bayesian OptimizationarXiv 2023Transformers Struggle to Learn to SearcharXiv 2024Instruction-tuned Language Models are Better Knowledge LearnersarXiv 2024Attention Is All You Need for Chinese Word SegmentationEMNLP 2020 11MOS: Modeling Object-Scene Associations in Generalized Category DiscoveryCVPR 2025 1MT-GenEval: A Counterfactual and Contextual Dataset for Evaluating Gender Accuracy in Machine TranslationarXiv 2022Private Federated Learning using Preference-Optimized Synthetic DataarXiv 2025Semi-Siamese Bi-encoder Neural Ranking Model Using Lightweight Fine-TuningarXiv 2021AeroReformer: Aerial Referring Transformer for UAV-based Referring Image SegmentationarXiv 2025Mining experimental data from Materials Science literature with Large Language Models: an evaluation studyarXiv 2024Beemo: Benchmark of Expert-edited Machine-generated OutputsarXiv 2024Modeling Diagnostic Label Correlation for Automatic ICD Codingmodeling-diagnostic-label-correlation-forDeepHateExplainer: Explainable Hate Speech Detection in Under-resourced Bengali LanguagearXiv 2020Are distributional representations ready for the real world? Evaluating word vectors for grounded perceptual meaningare-distributional-representations-ready-for-1Benchmarking Distributional Alignment of Large Language ModelsarXiv 2024Graph Switching Dynamical SystemsarXiv 2023BGGAN: Bokeh-Glass Generative Adversarial Network for Rendering Realistic BokeharXiv 2020FlowLearn: Evaluating Large Vision-Language Models on Flowchart UnderstandingarXiv 2024IDK-MRC: Unanswerable Questions for Indonesian Machine Reading ComprehensionarXiv 2022From Modern CNNs to Vision Transformers: Assessing the Performance, Robustness, and Classification Strategies of Deep Learning Models in HistopathologyarXiv 2022Data-Efficient Contrastive Language-Image Pretraining: Prioritizing Data Quality over QuantityarXiv 2024Musical Voice Separation as Link Prediction: Modeling a Musical Perception Task as a Multi-Trajectory Tracking ProblemarXiv 2023Distill n' Explain: explaining graph neural networks using simple surrogatesarXiv 2023HGE: Embedding Temporal Knowledge Graphs in a Product Space of Heterogeneous Geometric SubspacesarXiv 2023Pre-training on Synthetic Driving Data for Trajectory PredictionarXiv 2023MATHWELL: Generating Educational Math Word Problems Using Teacher AnnotationsarXiv 2024Agent-ValueBench: A Comprehensive Benchmark for Evaluating Agent ValuesarXiv 2026Better Neural Machine Translation by Extracting Linguistic Information from BERTEACL 2021 2Are Data-driven Explanations Robust against Out-of-distribution Data?CVPR 2023 1Linguini: A benchmark for language-agnostic linguistic reasoningarXiv 2024UMIT: Unifying Medical Imaging Tasks via Vision-Language ModelsarXiv 2025A Gray-box Attack against Latent Diffusion Model-based Image Editing by Posterior CollapsearXiv 2024Towards Fast Multilingual LLM Inference: Speculative Decoding and Specialized DraftersarXiv 2024Can Self-Supervised Neural Representations Pre-Trained on Human Speech distinguish Animal Callers?arXiv 2023Optimizing CLIP Models for Image Retrieval with Maintained Joint-Embedding AlignmentarXiv 2024Semi-Offline Reinforcement Learning for Optimized Text GenerationarXiv 2023CoLES: Contrastive Learning for Event Sequences with Self-Supervisioncoles-contrastive-learning-for-eventLLM as Dataset Analyst: Subpopulation Structure Discovery with Large Language ModelarXiv 2024The Butterfly Effect of Model Editing: Few Edits Can Trigger Large Language Models CollapsearXiv 2024Simple Disentanglement of Style and Content in Visual RepresentationsarXiv 2023UniSpeech: Unified Speech Representation Learning with Labeled and Unlabeled DataarXiv 2021Granular Privacy Control for Geolocation with Vision Language ModelsarXiv 2024Conversational Tree Search: A New Hybrid Dialog TaskarXiv 2023Fine Tuning vs. Retrieval Augmented Generation for Less Popular KnowledgearXiv 2024Wrapped Cauchy Distributed Angular Softmax for Long-Tailed Visual RecognitionarXiv 2023$2 * n$ is better than $n^2$: Decomposing Event Coreference Resolution into Two Tractable ProblemsarXiv 2023Emergent Symbolic Mechanisms Support Abstract Reasoning in Large Language ModelsarXiv 2025COPA-SSE: Semi-structured Explanations for Commonsense Reasoningcopa-sse-semi-structured-explanations-forTallyQA: Answering Complex Counting QuestionsarXiv 2018Evaluating Semantic Accuracy of Data-to-Text Generation with Natural Language InferenceINLG (ACL) 2020 12FAR: Fourier Aerial Video RecognitionarXiv 2022Provable Training for Graph Contrastive Learningprovable-training-for-graph-contrastiveTowards a Robust Retrieval-Based Summarization SystemarXiv 2024Rethinking Complex Queries on Knowledge Graphs with Neural Link PredictorsarXiv 2023Proper Scoring Rules for Survival AnalysisarXiv 2023KADEL: Knowledge-Aware Denoising Learning for Commit Message GenerationarXiv 2024Classifier-free Guidance with Adaptive ScalingarXiv 2025Is poisoning a real threat to LLM alignment? Maybe more so than you thinkarXiv 2024A Topological Perspective on Demystifying GNN-Based Link Prediction PerformancearXiv 2023ClimateGPT: Towards AI Synthesizing Interdisciplinary Research on Climate ChangearXiv 2024Transformers Get Stable: An End-to-End Signal Propagation Theory for Language ModelsarXiv 2024Chest ImaGenome Dataset for Clinical ReasoningarXiv 2021Salute the Classic: Revisiting Challenges of Machine Translation in the Age of Large Language ModelsarXiv 2024BiSECT: Learning to Split and Rephrase Sentences with BitextsEMNLP 2021 11Consistency Learning via Decoding Path Augmentation for Transformers in Human Object Interaction DetectionCVPR 2022 1Black-box language model explanation by context length probingarXiv 2022Target-oriented Sentiment Classification with Sequential Cross-modal Semantic GrapharXiv 2022Guide-and-Rescale: Self-Guidance Mechanism for Effective Tuning-Free Real Image EditingarXiv 2024Are Large Language Models Geospatially Knowledgeable?arXiv 2023E-NER -- An Annotated Named Entity Recognition Corpus of Legal TextarXiv 2022GPT-Sentinel: Distinguishing Human and ChatGPT Generated ContentarXiv 2023Mobile User Interface Element Detection Via Adaptively Prompt Tuningmobile-user-interface-element-detection-viaModel Editing for LLMs4Code: How Far are We?arXiv 2024NS3: Neuro-Symbolic Semantic Code SearcharXiv 2022Feed Two Birds with One Scone: Exploiting Wild Data for Both Out-of-Distribution Generalization and DetectionarXiv 2023A Lung Nodule Dataset with Histopathology-based Cancer Type AnnotationarXiv 2024Czert -- Czech BERT-like Model for Language RepresentationarXiv 2021Learning diverse attacks on large language models for robust red-teaming and safety tuningarXiv 2024Soft Prompting for Unlearning in Large Language ModelsarXiv 2024Modular Degradation Simulation and Restoration for Under-Display CameraarXiv 2022Towards Adversarially Robust Dataset Distillation by Curvature RegularizationarXiv 2024CLARA: Classifying and Disambiguating User Commands for Reliable Interactive Robotic AgentsarXiv 2023A Universal Adversarial Policy for Text ClassifiersarXiv 2022STEER: Unified Style Transfer with Expert ReinforcementarXiv 2023Scaling LLM Inference with Optimized Sample Compute AllocationarXiv 2024Learning minimal representations of stochastic processes with variational autoencodersarXiv 2023Bi-Factorial Preference Optimization: Balancing Safety-Helpfulness in Language ModelsarXiv 2024SciReplicate-Bench: Benchmarking LLMs in Agent-driven Algorithmic Reproduction from Research PapersarXiv 2025Conditional Contrastive Learning with Kernelconditional-contrastive-learning-with-kernelUnderstanding In-Context Machine Translation for Low-Resource Languages: A Case Study on ManchuarXiv 2025Leveraging Training Data in Few-Shot Prompting for Numerical ReasoningarXiv 2023MAF: Multi-Aspect Feedback for Improving Reasoning in Large Language ModelsarXiv 2023PGFed: Personalize Each Client's Global Objective for Federated LearningICCV 2023 1Fairness through Difference Awareness: Measuring Desired Group Discrimination in LLMsarXiv 2025PeaTMOSS: A Dataset and Initial Analysis of Pre-Trained Models in Open-Source SoftwarearXiv 2024Air-Decoding: Attribute Distribution Reconstruction for Decoding-Time Controllable Text GenerationarXiv 2023LogicSolver: Towards Interpretable Math Word Problem Solving with Logical Prompt-enhanced LearningarXiv 2022Ord2Seq: Regarding Ordinal Regression as Label Sequence PredictionICCV 2023 1Knee Injury Detection using MRI with Efficiently-Layered Network (ELNet)MIDL 2019 7Mix-of-Granularity: Optimize the Chunking Granularity for Retrieval-Augmented GenerationarXiv 2024Extracting Sentiment Attitudes From Analytical TextsarXiv 2018Do Not Escape From the Manifold: Discovering the Local Coordinates on
the Latent Space of GANsarXiv 2021Relation-aware Heterogeneous Graph for User ProfilingarXiv 2021BI-RADS BERT & Using Section Segmentation to Understand Radiology ReportsarXiv 2021CodeIF: Benchmarking the Instruction-Following Capabilities of Large Language Models for Code GenerationarXiv 2025Mixture of Soft Prompts for Controllable Data GenerationarXiv 2023Falcon: Faster and Parallel Inference of Large Language Models through Enhanced Semi-Autoregressive Drafting and Custom-Designed Decoding TreearXiv 2024Supersparse Linear Integer Models for Optimized Medical Scoring SystemsarXiv 2015Hybrid Energy Based Model in the Feature Space for Out-of-Distribution DetectionarXiv 2023Deep Pixel-wise Binary Supervision for Face Presentation Attack DetectionarXiv 2019Step-by-Step Reasoning to Solve Grid Puzzles: Where do LLMs Falter?arXiv 2024The Larger the Better? Improved LLM Code-Generation via Budget ReallocationarXiv 2024A Fast Fully Octave Convolutional Neural Network for Document Image SegmentationarXiv 2020FitCLIP: Refining Large-Scale Pretrained Image-Text Models for Zero-Shot Video Understanding TasksarXiv 2022Auto-Arena: Automating LLM Evaluations with Agent Peer Battles and Committee DiscussionsarXiv 2024Evaluating the Factual Consistency of Abstractive Text SummarizationEMNLP 2020 11Implicit Feedback for Dense Passage Retrieval: A Counterfactual ApproacharXiv 2022DIGRAC: Digraph Clustering Based on Flow Imbalancedigrac-digraph-clustering-based-on-flowIntegrating Recurrence Dynamics for Speech Emotion RecognitionarXiv 2018BottleFit: Learning Compressed Representations in Deep Neural Networks for Effective and Efficient Split ComputingarXiv 2022SwinTextSpotter v2: Towards Better Synergy for Scene Text SpottingarXiv 2024StimuVAR: Spatiotemporal Stimuli-aware Video Affective Reasoning with Multimodal Large Language ModelsarXiv 2024OkwuGbé: End-to-End Speech Recognition for Fon and Igbookwugbe-end-to-end-speech-recognition-for-fon-1Neural networks trained with SGD learn distributions of increasing complexityarXiv 2022BatchPrompt: Accomplish more with lessarXiv 2023Window-Based Early-Exit Cascades for Uncertainty Estimation: When Deep Ensembles are More Efficient than Single ModelsICCV 2023 1On the Effectiveness of LayerNorm Tuning for Continual Learning in Vision TransformersarXiv 2023Deep Volumetric Ambient OcclusionarXiv 2020Decomposed Prompt Tuning via Low-Rank ReparameterizationarXiv 2023Bridging Vision and Language Spaces with Assignment PredictionarXiv 2024Efficacy of Language Model Self-Play in Non-Zero-Sum GamesarXiv 2024Lay-A-Scene: Personalized 3D Object Arrangement Using Text-to-Image PriorsarXiv 2024Graph Communal Contrastive LearningarXiv 2021Improving Both Domain Robustness and Domain Adaptability in Machine TranslationCOLING 2022 10Doubly Robust Self-TrainingarXiv 2023What Does My QA Model Know? Devising Controlled Probes using Expert KnowledgearXiv 2019FRAug: Tackling Federated Learning with Non-IID Features via Representation AugmentationICCV 2023 1GSSF: Generalized Structural Sparse Function for Deep Cross-modal Metric
LearningarXiv 2024Revealing Vision-Language Integration in the Brain with Multimodal NetworksarXiv 2024Retrieve-Plan-Generation: An Iterative Planning and Answering Framework for Knowledge-Intensive LLM GenerationarXiv 2024MACO: A Modality Adversarial and Contrastive Framework for Modality-missing Multi-modal Knowledge Graph CompletionarXiv 2023Augmentation-Aware Self-Supervision for Data-Efficient GAN Trainingaugmentation-aware-self-supervision-for-dataThe Surprising Agreement Between Convex Optimization Theory and Learning-Rate Scheduling for Large Model TrainingarXiv 2025Verification and Refinement of Natural Language Explanations through LLM-Symbolic Theorem ProvingarXiv 2024Multimedia Generative Script Learning for Task PlanningarXiv 2022CACE-Net: Co-guidance Attention and Contrastive Enhancement for Effective Audio-Visual Event LocalizationarXiv 2024Not Only Generative Art: Stable Diffusion for Content-Style Disentanglement in Art AnalysisarXiv 2023StreamHover: Livestream Transcript Summarization and AnnotationEMNLP 2021 11Towards Enhancing Relational Rules for Knowledge Graph Link PredictionarXiv 2023RED-ACE: Robust Error Detection for ASR using Confidence EmbeddingsarXiv 2022Explore Spurious Correlations at the Concept Level in Language Models for Text ClassificationarXiv 2023Enhancing the Reasoning Capabilities of Small Language Models via Solution Guidance Fine-TuningarXiv 2024A Video Is Worth 4096 Tokens: Verbalize Videos To Understand Them In Zero ShotarXiv 2023MAP-Elites with Descriptor-Conditioned Gradients and Archive Distillation into a Single PolicyarXiv 2023Leveraging Code to Improve In-context Learning for Semantic ParsingarXiv 2023Unleashing the Potential of Spiking Neural Networks by Dynamic ConfidencearXiv 2023JMLR: Joint Medical LLM and Retrieval Training for Enhancing Reasoning and Professional Question Answering CapabilityarXiv 2024Perturbations in the Wild: Leveraging Human-Written Text Perturbations for Realistic Adversarial Attack and DefenseFindings (ACL) 2022 5DADA: Dialect Adaptation via Dynamic Aggregation of Linguistic RulesarXiv 2023mHumanEval -- A Multilingual Benchmark to Evaluate Large Language Models for Code GenerationarXiv 2024Social Bias in Large Language Models For Bangla: An Empirical Study on Gender and Religious BiasarXiv 2024Multi-Domain Riemannian Graph Gluing for Building Graph Foundation ModelsarXiv 2026