TRUSTMEM: Learning Trustworthy Memory Consolidation for LLM Agents with Long-Term Memory
Explorar
Noticias de IA
22318 elementos — filtrados, clasificados y sin duplicados
Do vision-language models search like humans? Reasoning tokens as a reaction-time analog …
Diagnosing and Mitigating Compounding Failures in Agentic Persuasion via Taxonomic Strate…
Beyond Shapley: Efficient Computation of Asymmetric Shapley Values
Perfect Detection, Failed Control: The Geometry of Knowing vs. Steering in Language Models
Learning with a Single Rollout via Monte Carlo Pass@k Critic
scBench-Long: Verifiable Benchmarking of Long-Horizon Single-Cell Biology
Explainable Ensemble-Based Machine Learning Models for Detecting the Presence of Cirrhosi…
Coarse-to-Fine: A Hybrid Self-Supervised Method for Non-rigid 3D Shape Matching
From Hallucination to Grounding: Diagnosing Visual Spatial Intelligence via CRISP
How agents are transforming work
Assessing Post-Reform Changes in Risk Disclosure Quality with a Multidimensional Text Ana…
Multipath Adaptive Gated Bottleneck Latent ODE with Raman Data Fusion for Cell Culture Pr…
NeuraDock Visual Cognitive Load Agent Tutorial: A Quality-Gated Open-Source EEG Workflow …
DanceDuo: Bridging Human Movement and AI Choreography
Humans Disengage, Reasoning Models Persist: Separating Difficulty Registration from Delib…
Mean-Field PhiBE: Continuous-Time Mean-Field Reinforcement Learning from Discrete-Time Da…
Nemotron-TwoTower: Diffusion Language Modeling with Pretrained Autoregressive Context
Utilizing Cognitive Signals Generated during Human Reading to Enhance Keyphrase Extractio…
A Causal Foundation Model for Structure and Outcome Prediction
Finding the Time to Think: Learning Planning Budgets in Real-Time RL
A probabilistic framework for online test-time adaptation
ProvenAI: Provenance-Native Traces of Evidence in Generated Answers
DualEval: Joint Model-Item Calibration for Unified LLM Evaluation
Geometry-Aware MCTS for Extremal Problems in Combinatorial Geometry
Charting the Growth of Social-Physical HRI (spHRI): A Systematic Review Pipeline Augmente…
EMA-FS: Accelerating GBDT Training via Gain-Informed Feature Screening
RevengeBench: Reverse Engineering Code-Space Policies from Behavioral Experiments
MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation
Same Evidence, Different Answer: Auditing Order Sensitivity in Multimodal Large Language …