Are Tabular Foundation Models Robust to Realistic Query Distribution Shifts in Microbiome…
Explorar
Noticias de IA
22318 elementos — filtrados, clasificados y sin duplicados
ExTra: Exploratory Trajectory Optimization for Language Model Reinforcement Learning
When Multi-Sensor Fusion Fails to Generalize: Cattle Posture Classification Under Animal-…
Retrieval-Augmented Personalization with Foundation Models for Wearable Stress Detection
Quantifying Explainable AI-introduced signal noise on ECG data with Spectral Entropy
LLM Performance on a Real, Double-Marked GCSE Benchmark
Enhancing Clinician Decision-Making via Uncertainty-Aware Multi-Expert Fusion for Stroke …
MacroLens: A Multi-Task Benchmark for Contextual Financial Reasoning under Macroeconomic …
What Does a Pathological Speech Assessment Model Know about Acoustic Features? A Case Stu…
Holographic Memory for Zero-Shot Compositional Reasoning in Knowledge Graphs: A Mechanist…
EmotionAI: A Privacy-Preserving Computational Intelligence Pipeline for Speech-Emotion-Gr…
Stable-Shift: Biologically Structured Prediction of Transcriptional Responses to Unseen G…
Error-Aware TF-IDF Retrieval-Augmented Generation for ASR Error Correction
Velocity Prediction in Automatic Guitar Transcription
Attractive and Repulsive Pattern Control in Sequence Generation
Failure Modes of Large Language Models on Research-Level Mathematics: A Taxonomy and an E…
LLM Evolution as an Industry-Scale Ecosystem: A Lifecycle Perspective on Continual Learni…
From Meta Idea to Advanced Mathematical Discovery -- Human-AI Co-Discovery of Sign-Embedd…
RWGBench: Evaluating Scholarly Positioning in Related Work Generation
InvestPhilBench: A Multi-Layer Dynamic Benchmark for Evaluating Large Language Model Proc…
Agentic System as Compressor: Quantifying System Intelligence in Bits
AI Snitches Get Glitches: Towards Evading Agentic Surveillance
Reasonable Motion: A General ASP Foundation for Environment Constrained Movement Trajecto…
Cliff Tokens: Identifying Single-Token Failure Triggers in LLM Mathematical Reasoning
Long-Term Simulation Exposes Cognitive-Developmental Risks in AI Companions
What Actually Works for Spacecraft Fault-Tolerant Control: An Honest Settled-Gate Benchma…
Agentic Knowledge Tracing: A Multi-Agent LLM Architecture for Stealth Assessment of Finan…
Heuresis: Search Strategies for Autonomous AI Research Agents Across Quality, Diversity a…
To Isolate or to Score? Model-Adaptive Assessment for Cost-Efficient Multi-Agent RAG
Transferability for General Reasoning: An Automated Curriculum for Multi-Domain RLVR