MoBayes: A Modular Bayesian Framework for Separating Reasoning from Language in Conversat…
Explorar
Noticias de IA
37834 elementos — filtrados, clasificados y sin duplicados
Treatment Effect Estimation with Differentiated Networked Effect on Graph Data
A World Model of Radiologist Reading for Medical Image Representation Learning
EditCaption: Human-Refined SFT and HAE-DPO for Image Editing Instruction Synthesis
Inference Time Context Sparsity: Illusion or Opportunity?
Copy-as-Decode: Grammar-Constrained Parallel Prefill for LLM Editing
Task-Aligned Self-Supervised Learning for Medical Image Analysis: A Systematic Review and…
Uncovering Vulnerabilities of LLM-Assisted Cyber Threat Intelligence
Depth Registers Unlock W4A4 on SwiGLU: A Reader/Generator Decomposition
Federation over Text: Insight Sharing for Multi-Agent Reasoning
Theoretical Analysis of Sparse Optimization with Reparameterization, Weight Decay, and Ad…
Rewarding Structural Conformance of Reasoning using Process Mining
Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL
ScaleAcross Explorer: Exploring Communication Optimization for Scale-Across AI Model Trai…
Identifying and Mitigating Systemic Measurement Bias in Production LLM Inference Benchmar…
An Empirical Evaluation of LLM-Generated Code Security Across Prompting Methods
How Well Do Models Follow Their Constitutions?
A Large-Scale Dataset and Benchmark: Do Protein-Ligand Models Learn Binding Sites or Just…
More Skills, Worse Agents? Skill Shadowing Degrades Performance When Expanding Skill Libr…
Spectral Probe-Circuits: A Three-Step Recipe for Identifying Attention-Head Circuits in P…
MASt3R-Nav: WayPixel Navigation in Relative 3D Maps
HiGraph: A Large-Scale Hierarchical Graph Dataset for Malware Analysis
Understanding Conversational Patterns in Multi-agent Programming: A Case Study on Fibonac…
Knowledge Graph Modulated Deep Learning for Limited-Sample Clinical Data Analysis
AvalancheBench: Evaluating Enterprise Data Agents Through Latent World Recovery
Filtered Posterior Mean Collections: A Unified Framework for Analytical Models of Diffusi…
Agent-ToM: Learning to Monitor Autonomous LLM Agents via Theory-of-Mind Reasoning
Understanding Data Temporality Impact on Large Language Models Pre-training
TimeGuard: Channel-wise Pool Training for Backdoor Defense in Time Series Forecasting
Look-Closer-Then-Diagnose: Confidence-Aware Ultrasound VQA via Active Zooming