VeriTrace: Evolving Mental Models for Deep Research Agents
Explorar
Noticias de IA
37834 elementos — filtrados, clasificados y sin duplicados
CITYREP: A Unified Benchmark for Urban Representations Across Cities, Tasks, and Modaliti…
Momentum Streams for Optimizer-Inspired Transformers
MX-SAFE: Versatile Inference- and Training-Proof Microscaling Format with On-the-Fly Expo…
ChaosBench-Logic v2: Evaluating LLM Logical Reasoning over Dynamical Systems at Scale
CausaLab: A Scalable Environment for Interactive Causal Discovery Toward AI Scientists
Behind EvoMap: Characterizing a Self-Evolving Agent-to-Agent Collaboration Network
Concept Drift Adaptation Using Self-Supervised and Reinforcement Learning In Android Malw…
Improving Labeling Consistency with Detailed Constitutional Definitions and AI-Driven Eva…
Action with Visual Primitives
The Path Matters: Learning a Token-Commitment Policy for Diffusion Language Models
Ordering Matters: Rank-Aware Selective Fusion for Blended Emotion Recognition
FineBench: Benchmarking and Enhancing Vision-Language Models for Fine-grained Human Activ…
ESI-Bench: Towards Embodied Spatial Intelligence that Closes the Perception-Action Loop
VaaWIT: Visual-Aware Adaptation of Large Language Models for Multilingual Web Image Trans…
CyBOKClaw: Human-in-the-Loop CyBOK Mapping for Cybersecurity Curriculum
How Few-Shot Examples Add Up: A Causal Decomposition of Function Vectors in In-Context Le…
ADMFormer: An Adaptive-Decomposition Transformer with Time-Varying Masked Spatial Attenti…
Continual Speaker Identity Unlearning with Minimal Interference
EchoPilot: Training-Free Ultrasound Video Segmentation via Scale-Space Semantic Prompting…
Demystifying the Mythos or Disrupting Bugonomics? From Zero-Day Asymmetry to Defender Rem…
Detecting Unfaithful Chain-of-Thought via Circuit-Guided Internal-External Discrepancy
Small Models, Strong Priors: Architectural Inductive Bias for Parameter-Efficient Neural …
AgentHijack: Benchmarking Computer Use Agent Robustness to Common Environment Corruptions
Causal Tongue-Tie: LLMs Can Encode Causal Direction, But Their Yes/No Outputs Fail to Exp…
Context-Instrumental Data Distillation for Kubernetes Manifest Generation: Method and Exp…
$D^2$-Monitor: Dynamic Safety Monitoring for Diffusion LLMs via Hesitation-Aware Routing
OASIS: Observation-Action Space Alignment via SE(3) Trajectory Prediction for Robotic Man…
vAttention: Verified Sparse Attention
Agent-Centric Social Trajectory Prediction: A Free Energy Principle Perspective