Addressing Longstanding Challenges in Cognitive Science with Language Models
Explorar
Noticias de IA
29655 elementos — filtrados, clasificados y sin duplicados
LocalSearchBench: Benchmarking Agentic Search in Real-World Local Life Services
On the Collapse of Generative Paths: A Criterion and Correction for Diffusion Steering
Boosting RL-Based Visual Reasoning with Selective Adversarial Entropy Intervention
Unplugging a Seemingly Sentient Machine Is the Rational Choice -- A Metaphysical Perspect…
PolarMem: A Training-Free Polarized Latent Graph Memory for Verifiable Vision-Language Mo…
The Refusal--Compliance Tradeoff: A Large-Scale Safety Behavior Audit of Large Language M…
Breaking the Reversal Curse in Autoregressive Language Models via Identity Bridge
From Features to Actions: Explainability in Traditional and Agentic AI Systems
ToolSelf: Unifying Task Execution and Self-Reconfiguration via Tool-Driven Emergent Adapt…
Beyond End-to-End Video Models: An LLM-Based Multi-Agent System for Educational Video Gen…
REAL: Resolving Knowledge Conflicts in Knowledge-Intensive Visual Question Answering via …
Towards a Virtual Neuroscientist: Autonomous Neuroimaging Analysis via Multi-Agent Collab…
Causal state binding predicts action control in language agents
LLM4Cov: Execution-Aware Agentic Learning for High-coverage Testbench Generation
Vision Language Models Cannot Reason About Physical Transformation
DAG-Plan: Generating Directed Acyclic Dependency Graphs for Dual-Arm Cooperative Planning
OpenHospital: A Thing-in-itself Arena for Evolving and Benchmarking LLM-based Collective …
Retrieval-aligned Tabular Foundation Models Enable Robust Clinical Risk Prediction in Ele…
FeynmanBench: Benchmarking Multimodal LLMs on Diagrammatic Physics Reasoning
PECKER: A Precisely Efficient Critical Knowledge Erasure Recipe For Machine Unlearning in…
Toward accurate RUL and SoH estimation using reinforced graph-based physics-informed neur…
MAVEN-T: Reinforced Heterogeneous Distillation for Real-Time Multi-Agent Trajectory Predi…
Perspective on Bias in Biomedical AI: Preventing Downstream Healthcare Disparities
TrafficClaw: A Generalizable LLM Agent in the Unified Physical Environment for Urban Traf…
Deep Learning as the Disciplined Construction of Tame Objects
Neural Decision-Propagation for Answer Set Programming
ANDRE: An Attention-based Neuro-symbolic Differentiable Rule Extractor for Inductive Logi…
Catch-Only-One: Non-Transferable Examples for Model-Specific Authorization
MMSkills: Towards Multimodal Skills for General Visual Agents