PRISM: Distribution-Gated Flow Matching for Controllable Unpaired Image Translation
Explorar
Noticias de IA
29347 elementos — filtrados, clasificados y sin duplicados
SkillMemo: Expert-guided Skill Memory Framework for Compositional Embodied Manipulation
The em-dash em-beds in Congress: A population-level rise in em-dash frequency in U.S. con…
D-CLOT: Double Closed Loop Optimal Transport for Unsupervised Action Segmentation
Continual Learning in Transition
Improving the Realism of Synthetic Clinical Benchmarks Under Utility Constraints
Learning Globally Reusable Skills for Coding Agents
From Passive Mirrors to Active Agents: Holonic Digital Twins for Physical AI over Networks
FormBharo: Designing and Evaluating a Voice Agent for Conversational Form Filling in Rura…
Temporal Bridges for Spatial Resolution: Enhancing Climate Data Super-Resolution with Bid…
Beyond Top-K: Replacing Black-Box Retrieval with Interpretable Agentic Operations
ProDVI: Programmatic Dynamics Priors for Value Network Initialization
Plausible Patients, Impossible Populations: Auditing Epidemiological Fidelity in Large La…
The Illusion of Visual Tool-Use: A Causal Audit of Thinking with Images
Investigating Artificial Intelligence Digital Sovereignty in Mobile Shopping Apps: A Case…
Reducing belief in conspiracy theories as they unfold using large language models
OSReward: Instituting Standardized Evaluation for Cross-Platform Computer-Use Reward Mode…
Revisiting Black-Box Model Ownership Verification through Information Theory
The Impossibility Triangle of Long-Context Modeling
Hardware Keystores for AI Agent Signing Workflows: A Zero-Trust MCP Enforcement Architect…
BioAgent Bench: An AI Agent Evaluation Suite for Bioinformatics
AI Playing Business Games: Benchmarking Large Language Models on Managerial Decision-Maki…
Hyper-ES: Effective Evolution Strategies for LLM Reasoning via Descent Direction Merging
Automatic Detection of Deaths from Social Networking Sites
EcoAgent-Bench: Evaluating Economic Decision-Making in Budget-Constrained LLM Agents
CREBench: Evaluating Large Language Models in Cryptographic Binary Reverse Engineering
ASTELD: A Six-Axis Classification Framework for Autonomous AI Agents - Design, Evaluation…
C$^3$PO: Evaluating Cross-Modal Composition and Counterfactual Performance in Omnimodal M…
AppDeltaWorld: Transition-Grounded Delta Code World Model for Mobile GUI Agents
Personalized Deep Research Query Refinement with Graph-Scaffolded Evidence Grounding