Multi-Agent Reinforcement Learning for Safe Autonomous Driving Under Pedestrian Behaviora…
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
AnchorDiff: Training-Free Concept Grounding for MM-DiTs via Anchor-Based Graph Propagation
Anchor: Mitigating Artifact Drift in Agent Benchmark Generation
Is Agent Memory a Database? Rethinking Data Foundations for Long-Term AI Agent Memory
MUSE-Autoskill: Self-Evolving Agents via Skill Creation, Memory, Management, and Evaluati…
Modeling Agentic Technical Debt and Stochastic Tax: A Standalone Framework for Measuremen…
Dense2MoE: Pushing the Pareto Frontier of On-Device LLMs via Unified Pruning and Upcycling
Emergent Causal-Geometric Dynamics Across Depth in Large Language Models
Graph is a Substrate Across Data Modalities
When Does Deep RL Beat Calibrated Baselines? A Benchmark Study on Adaptive Resource Contr…
Managing Uncertainty in LLM-Generated Procedural Knowledge for Virtual Laboratory Planning
Certified Purity for Cognitive Workflow Executors: From Static Analysis to Cryptographic …
Annotator Positionality as Signal: Psychometric Weighting for Anti-Autistic Ableism Detec…
Reconstructing Multi-Scale Physical Fields from Extremely Sparse Measurements with an Aut…
Linear and Neural Dueling Bandits with Delayed Feedback
Certified Causal Attribution for Real-Time Attack Forensics in 6G Network Slicing
Prospective evaluation of multimodal respiratory failure prediction: Do chest X-rays impr…
RepoMirage: Probing Repository Context Reasoning in Code Agents with Perturbations
Recursive Flow Matching
Composition Collapse: Stable Factual Knowledge Does Not Imply Compositional Reasoning
Learning to Act under Noise: Enhancing Agent Robustness via Noisy Environments
Unified Panoramic Geometry Estimation via Multi-View Foundation Models
Why LLMs Hallucinate on Structured Knowledge: A Mechanistic Analysis of Reasoning over Li…
Boosting Knowledge Graph Foundation Models via Enhanced Negative Sampling
Personalized Generative Models for Contextual Debiasing
Auditing and Fixing Economic Validity in Tabular Foundation Models for Discrete Choice
ORCA: An End-to-End Interactive Copilot for Optimized Root Cause Analysis
Beyond a Single Direction: Chain-of-Thought Disrupts Simple Steering of Refusal
CroCo: Cross-Lingual Contrastive Preference Tuning on Self-Generations
Neuro-Symbolic Verification of LLM Outputs for Data-Sensitive Domains (extended preprint)