Multi-Objective Bayesian Optimization for Model Merging
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
Acoustic UAV Detection in Battlefield Scenarios: Handling Noise, Domain Shift, and Weak L…
P2Skill: Privacy Preserving Skill Distillation for Cloud-Local LLM Inference Systems
From Fixed Grids to Moving Particles:A Transferable Latent Operator for Fluid Dynamics
Generating Benchmark Health Data Using a Tabular Diffusion Transformer
RecipeNet: A Hierarchical Transformer for Recipe Data
Semantically Labelled Automata for Multi-Task Reinforcement Learning with LTL Instructions
BUZZY: Contrastive Scoring to Mitigate Text-Induced Bias in Multimodal Multiple-Choice QA
CFM-Bench: A Unified Multi-Domain, Multi-Task Benchmark for Channel Foundation Models
INSIDE the Student's Mind: Jointly Modeling Latent Reasoning and Action in LLM Student Si…
Why we need an AI-resilient society
Leveraging Few-Shot Learning and Large Language Models for Analyzing Blood Pressure Varia…
The Fools are Certain; the Wise are Doubtful: Exploring LLM Confidence in Code Completion
INFORM-CT: INtegrating LLMs and VLMs FOR Incidental Findings Management in Abdominal CT
AtomBridge: Agentic VLA Inference Plugin for Long-Horizon Tasks in Scientific Experiments
ArGEnT: Arbitrary Geometry-encoded Transformer for Operator Learning
A Systematic Comparison of Training Objectives for Out-of-Distribution Detection in Image…
An InSAR Phase Unwrapping Framework for Large-scale and Complex Events
GTIN: A Unified Framework for Joint Event and Time Prediction in Temporal Graphs
Towards Practical Algorithm Selection for Unsupervised Domain Adaptation in Medical Imagi…
Benchmarking data-driven material models on the classic Treloar dataset
Scaling Domain Data Repetition in LLM Pretraining
Retrieval Grounding Latent Reasoning for Dense Retrieval
A Graph-Based Reinforcement Learning Framework for Structured Drift Diagnosis and Recover…
Reinforcement Learning-Based Production Scheduling in an Industry-Based Coating Scenario …
FreeBalance: Pre-Routing Online Moe Load Balancing via Residual Workload Prediction
Modular Cognitive Architecture Emerges in Large Language Models
Stable Miscalibration in Large Language Models: A Practical View of High-Confidence Errors
MobileMem: Learning from a Year of Mobile Experiences
Evaluating Agentic Learning Harness Capabilities Without Labels via the Scaling Hypothesis