Improved Guarantees for Heterogeneous Treatment-Effect Estimation via Matrix Completion
Explorar
Noticias de IA
30321 elementos — filtrados, clasificados y sin duplicados
Self-Supervised Laplace Approximation for Bayesian Uncertainty Quantification
The Distillation Game: Adaptive Attacks & Efficient Defenses
MedMosaic: A Challenging Large Scale Benchmark of Diverse Medical Audio
When Models Learn to Ask Why: Adaptive Causal Reasoning for Trustworthy Medical Vision-La…
Entropy-KL Divergence-based Token Masking: A Novel Approach for Selective Fine-tuning of …
In-Context Reward Adaptation for Robust Preference Modeling
Reasoning about Reasoning: BAPO Bounds on Chain-of-Thought Token Complexity in LLMs
COMET: Concept Space Dissection of the Modality Gap in Audio-Text Multimodal Contrastive …
Architecture-Induced Recoverability Bias in Differentiable Symbolic Regression
Temporal Stability and Few-Shot Prompting in Math Task Assessment
Inferring Code Correctness from Specification
SERC: LDPC-Inspired Semantic Error Correction for Retrieval-Augmented Generation
Thoughts-as-Planning: Latent World Models for Chain-of-Thoughts Optimization via Reinforc…
Make LLM Learn to Synthesize from Streaming Experiences through Feedback
Honest Lying: Understanding Memory Confabulation in Reflexive Agents
Anchorless Diversification for Parallel LLM Ideation
Evolve as a Team: Collaborative Self-Evolution for LLM-based Multi-Agent Systems
Dissociative Identity: Language Model Agents Lack Grounding for Reputation Mechanisms
On Distributional Reinforcement Learning in Chaotic Dynamical Systems
Teaching Values to Machines: Simulating Human-Like Behavior in LLMs
KLAS: Using Similarity to Stitch Neural Networks for Improved Accuracy-Efficiency Tradeof…
No More K-means:Single-Stage Sparse Coding for Efficient Multi-Vector Retrieval
Inform, Coach, Relate, Listen: Auditing LLM Caregiving Support Roles
Wait! There's a Way Out: A Decision Mechanism for Forecasting Conversational Derailment
Relevance as a Vulnerability: How Web Retrieval Degrades Safety Alignment in LLM Agents
Rethinking FID Through the Geometry of the Reference Dataset
Beyond Normalization: Rethinking the Partition Function as a Difficulty Scheduler for RLVR
DialToM: A Theory of Mind Benchmark for Forecasting State-Driven Dialogue Trajectories
GPF-LiveNews: A Streaming Evaluation Protocol for Group-Conditioned Framing in Large Lang…