Symbol Grounding in Neuro-Symbolic AI: A Gentle Introduction to Reasoning Shortcuts
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
Investigating Artificial Intelligence Digital Sovereignty in Mobile Shopping Apps: A Case…
AV-AIVAT: 74x Cheaper Agent Evaluation with Certified Anytime-Valid Stopping in Imperfect…
Resourced Authority A Mechanism-Design Model for Participatory Governance of Deployed AI …
Benchmarking the Benchmarks: Evaluating Benchmarks for Conversational Agents
PRISM: Distribution-Gated Flow Matching for Controllable Unpaired Image Translation
Toward Deployable Bangla Sign Language Recognition with Expert-Validated Data and a Light…
From Passive Mirrors to Active Agents: Holonic Digital Twins for Physical AI over Networks
Continual Learning in Transition
Visual Grounding in Zero-Shot Vision-Language Control
Learning Globally Reusable Skills for Coding Agents
Reducing belief in conspiracy theories as they unfold using large language models
Does Latent Context Help? A Controlled Evaluation of Inverse Reinforcement Learning in Ar…
Domain-Grounded Candidate Selection for Agentic Image Editing: A Shadow Removal Case
FormBharo: Designing and Evaluating a Voice Agent for Conversational Form Filling in Rura…
ProDVI: Programmatic Dynamics Priors for Value Network Initialization
TRACE: Learned Proprioceptive Odometry for Legged Robots under Unreliable Contact Conditi…
SkillMemo: Expert-guided Skill Memory Framework for Compositional Embodied Manipulation
The em-dash em-beds in Congress: A population-level rise in em-dash frequency in U.S. con…
The Ignition Index: Measuring Global Workspace Dynamics in Language Models
SkillTrace: Multi-Trace Provenance Auditing for LLM-Agent Skill Reuse
Otter: A Time-Aware, History-Conditioned Human Chess AI
Search2Skill: Skill Distillation Beyond Knowledge Boundaries Via Rubric-Based Reinforceme…
LUNAR: Benchmarking Personalized Large Language Models on UNiversal User BehAvioR Logs
CASCADE: An Agentic Regulatory Network Framework for Patient-Data-Validated Downstream Pe…
C$^3$PO: Evaluating Cross-Modal Composition and Counterfactual Performance in Omnimodal M…
Evaluating and Improving Pedagogical Fit in LLM-Based AI Tutors with the Pedagogical Suit…
Negotiating Risk Boundaries in AI for Policing Through Mixed-Stakeholder Deliberation
Recursive Synthesis for Long-Horizon Terminal Tasks
SkillHEX: Improving Agent Skills via Hypothesis-Driven Autonomous Exploration and Exploit…