Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
When Trust Meets Truth: Trust-Truth Separability in LLM-as-Judge
arXiv cs.AI Research & Papers
KREL: Automatic Medical Coding via Knowledge-Guided Reasoning over Clinical Evidence with…
arXiv cs.AI Research & Papers
Auditable by Construction: An Ontology-Driven Framework for Trustworthy LLM Analytics in …
arXiv cs.AI Research & Papers
Applying Anthropic Primitives at Large Enterprises: Harness Paradigm for Knowledge Work
arXiv cs.AI Research & Papers
Environmental Slow AI: Design Principles for Generative Systems
arXiv cs.AI Research & Papers
Open-Weight Masked Introspection: Measuring What Language Models Can Report About Their O…
arXiv cs.AI Research & Papers
Difficulty-Aware Semantic-ID Optimization for Generative Recommendation
arXiv cs.AI Research & Papers
Volumetric Radiology AI in the Era of Multimodal Large Language Models
arXiv cs.AI Research & Papers
Dual-Cache Latent Space Communication between Heterogeneous Language Models
arXiv cs.AI Research & Papers
Evaluating Skills, Not Just Agents: Agentic Continuous Evaluation of Skills
arXiv cs.AI Research & Papers
FlavourBench: Ranking Frontier Language Models with Executable Culinary Ground Truth
arXiv cs.AI Research & Papers
Beyond Effectiveness: A Multi-Criteria Framework for Comparing Practical Socio-Technical …
arXiv cs.AI Research & Papers
SENTRY: Deterministic, Intelligent Risk Assessment for IT Change Management
arXiv cs.AI Research & Papers
ELVAE: Evidential Learning-Based Variational Autoencoder for Uncertainty-Aware Generation
arXiv cs.AI Research & Papers
DreamBench-SWE: A Multi-Session Memory-Hygiene Benchmark for Software Agents
arXiv cs.AI Research & Papers
PrimeAgentOrchestrator: Memory-Primed Agent Spawning for Personal AI Infrastructure
arXiv cs.AI Research & Papers
When Retrieval Fails Before It Begins: Structurally Indirect Prerequisite Eviction as a R…
arXiv cs.AI Research & Papers
Nexus: Depth-Adaptive KV-Cache Splicing and Retrieval-Decoupled Tool Routing for Agentic …
arXiv cs.AI Research & Papers
Interpretable Multimodal Classification with Linear Discriminant Tree Ensembles
arXiv cs.AI Research & Papers
A Survey on Foundations and Frontiers of Multimodal Agentic Frameworks: Techniques and Ap…
arXiv cs.AI Research & Papers
STCO: Conditional Neural Operators for Time-Dependent PDEs
arXiv cs.AI Research & Papers
Truth Lies Deep: Countering Semantic Camouflage via Latent Intent Verification
arXiv cs.AI Research & Papers
SDAD: Spec-Driven Agentic Development for the AI-Native SDLC
arXiv cs.AI Research & Papers
Who Delegates to AI? Evidence from 53,000 Agent Configurations
arXiv cs.AI Research & Papers
Fuzzy-MoE: Interpretable Regime-Conditioned Expert Routing for Non-Stationary Multivariat…
arXiv cs.AI Research & Papers
TRACE: Training-time Report-guided and Clinically Ordered Concept Editing
arXiv cs.AI Research & Papers
Scaling Muon for Diffusion Transformers
arXiv cs.AI Research & Papers
Graph Engineering in the Era of LLM Agents: From Individual Intelligence to System Intell…
arXiv cs.AI Research & Papers
Weighted Memory Tree: Remembering What Matters for Long-Horizon LLM Agents
arXiv cs.AI Research & Papers
StateSight: Benchmarking Latent Spatial-State Reconstruction in Vision-Language Models