Do We Really Need Adaptive Global Spatial Attention for Traffic Forecasting?
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
Crossing-Free Probabilistic K-Line Forecasts Without Retraining
Aligning LLM-Simulated and Human Examinees for Psychometric Calibration: A Cognitive Diag…
A First Look at Coding Agents' Compliance with AI Contribution Rules in Open-Source Commu…
$\texttt{AMEND++}$: Benchmarking Eligibility Criteria Amendments in Clinical Trials
Linguistic Monoculture in LLM-Assisted Language Use
AgentMap: Joint Equivalence and Subsumption Discovery for Ontology Matching
Progressive Multimodal Alignment for Continual Instruction Tuning
Setoka: A Benchmark for Hierarchical User Understanding in Personalized Agents over Heter…
Evidence-Ledger Adjudication for Claim-Evidence Traceability
MultivationBench: A Benchmark for Multimodal Sequential Motivation Reasoning
Belief-Guided Decision Making with Uncertainty Gating in the Game of Go
Budget-Aware LLM Discovery via Cost-Calibrated Frontier Utility
Position: Evaluation Scores Are Perishable Knowledge Claims
Property-driven Causal Abstractions for Markov Decision Processes
UrbanDS: A Graph-Guided LLM Multi-Agent System for Data-Intensive Urban Tasks
ReCo: Reweighting GRPO Against Distributional Concentration
AlphaSchema: Exploring the Space of Trading Semantics for LLM-Based Alpha Mining
Eco3S: Complex Socio-Economic System Simulation via Agent-Based Models
Shared Symbolic Backbones for Physically Consistent Multi-Output Symbolic Regression
Cognitive Convergence: Deep Similarities Between Large Language Models and Human Cognition
A Picture Says Thousands of Words - Harnessing Dermal Exposure Data from Images through H…
GPT-Red: Automated Red Teaming via Self-Play at Scale
AI as Friction for Reflection Support in Ideation
A Reference-Free Score for Detecting Silent Reasoning Failures in Large Language Models
FinCacheServe: Dependency-Consistent Answer Reuse for Cost-Efficient RAG Serving over Mut…
IFCMemoryBench: Evaluating Long-Term Memory of LLM-Based Agents in BIM Information Retrie…
SimpleWikiSearch: A Clean Offline Wikipedia Environment for Agentic Search
ForgetBench: Benchmarking Forgetting Dynamics of Long-Term Parametric Memory in Language …
DLAM: Distributional Latent Actions with Temporal Constraints