Explorar

Noticias de IA

29347 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
PRISM: Distribution-Gated Flow Matching for Controllable Unpaired Image Translation
arXiv cs.AI Research & Papers
SkillMemo: Expert-guided Skill Memory Framework for Compositional Embodied Manipulation
arXiv cs.AI Research & Papers
The em-dash em-beds in Congress: A population-level rise in em-dash frequency in U.S. con…
arXiv cs.AI Research & Papers
D-CLOT: Double Closed Loop Optimal Transport for Unsupervised Action Segmentation
arXiv cs.AI Research & Papers
Continual Learning in Transition
arXiv cs.AI Research & Papers
Improving the Realism of Synthetic Clinical Benchmarks Under Utility Constraints
arXiv cs.AI Research & Papers
Learning Globally Reusable Skills for Coding Agents
arXiv cs.AI Research & Papers
From Passive Mirrors to Active Agents: Holonic Digital Twins for Physical AI over Networks
arXiv cs.AI Research & Papers
FormBharo: Designing and Evaluating a Voice Agent for Conversational Form Filling in Rura…
arXiv cs.AI Research & Papers
Temporal Bridges for Spatial Resolution: Enhancing Climate Data Super-Resolution with Bid…
arXiv cs.AI Research & Papers
Beyond Top-K: Replacing Black-Box Retrieval with Interpretable Agentic Operations
arXiv cs.AI Research & Papers
ProDVI: Programmatic Dynamics Priors for Value Network Initialization
arXiv cs.AI Research & Papers
Plausible Patients, Impossible Populations: Auditing Epidemiological Fidelity in Large La…
arXiv cs.AI Research & Papers
The Illusion of Visual Tool-Use: A Causal Audit of Thinking with Images
arXiv cs.AI Research & Papers
Investigating Artificial Intelligence Digital Sovereignty in Mobile Shopping Apps: A Case…
arXiv cs.AI Research & Papers
Reducing belief in conspiracy theories as they unfold using large language models
arXiv cs.AI Research & Papers
OSReward: Instituting Standardized Evaluation for Cross-Platform Computer-Use Reward Mode…
arXiv cs.AI Research & Papers
Revisiting Black-Box Model Ownership Verification through Information Theory
arXiv cs.AI Research & Papers
The Impossibility Triangle of Long-Context Modeling
arXiv cs.AI Research & Papers
Hardware Keystores for AI Agent Signing Workflows: A Zero-Trust MCP Enforcement Architect…
arXiv cs.AI Research & Papers
BioAgent Bench: An AI Agent Evaluation Suite for Bioinformatics
arXiv cs.AI Research & Papers
AI Playing Business Games: Benchmarking Large Language Models on Managerial Decision-Maki…
arXiv cs.AI Research & Papers
Hyper-ES: Effective Evolution Strategies for LLM Reasoning via Descent Direction Merging
arXiv cs.AI Research & Papers
Automatic Detection of Deaths from Social Networking Sites
arXiv cs.AI Research & Papers
EcoAgent-Bench: Evaluating Economic Decision-Making in Budget-Constrained LLM Agents
arXiv cs.AI Research & Papers
CREBench: Evaluating Large Language Models in Cryptographic Binary Reverse Engineering
arXiv cs.AI Research & Papers
ASTELD: A Six-Axis Classification Framework for Autonomous AI Agents - Design, Evaluation…
arXiv cs.AI Research & Papers
C$^3$PO: Evaluating Cross-Modal Composition and Counterfactual Performance in Omnimodal M…
arXiv cs.AI Research & Papers
AppDeltaWorld: Transition-Grounded Delta Code World Model for Mobile GUI Agents
arXiv cs.AI Research & Papers
Personalized Deep Research Query Refinement with Graph-Scaffolded Evidence Grounding