Explorar

Noticias de IA

29647 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Shared Organizational Memory for Enterprise Coding Agents: System Design and Deployment S…
arXiv cs.AI Research & Papers
MemoryForge: Synthesize Lifelong Memory for Human-Like LLM Agents
arXiv cs.AI Research & Papers
What Transfers from Text to Vision? Capability Scaling Laws and Transfer Dynamics for VLMs
arXiv cs.AI Research & Papers
Fighting Fire with Fire: On the Feasibility of Protecting Exercises Against AI Cheating
arXiv cs.AI Research & Papers
Inference-Time Policy Alignment for Fair Reinforcement Learning
arXiv cs.AI Research & Papers
Corrigible Assistance in One Round: Pragmatic-Pedagogic Best Response
arXiv cs.AI Research & Papers
PATH-Bench: Path-Dependent Evaluation of Lifelong Agents
arXiv cs.AI Research & Papers
Cost-Effective Automated Judging of Natural-Language Mathematical Proofs
arXiv cs.AI Research & Papers
Exploring More to Solve More: Boosting Diversity in Text Diffusion Models via Entropy-Bas…
arXiv cs.AI Research & Papers
Width, Memory, and Delay: A Resource Accounting for the Limits of Flat Multi-Agent Systems
arXiv cs.AI Research & Papers
Perspectives on Tsallis Statistics for Artificial Intelligence
arXiv cs.AI Research & Papers
Co-evolution of social reward and punishment under institutional interventions
arXiv cs.AI Research & Papers
Trajectories That Segment Themselves: Agent-Declared Boundaries as a Training Unit
arXiv cs.AI Research & Papers
Self-Certification of Representation Adequacy: Sequential Certification at Minimum Task L…
arXiv cs.AI Research & Papers
SKT: Skill-Use Training at Scale via Verified Synthetic Data Generation
arXiv cs.AI Research & Papers
MechGeo: Autoformalizing and Proving Euclidean Geometry in Lean 4
arXiv cs.AI Research & Papers
Hard Constraints, Smooth Gradients: Learning Feasible Inventory Policies via Differentiab…
arXiv cs.AI Research & Papers
Trustworthy AI in Digital Health: A Comprehensive Review of Robustness and Explainability
arXiv cs.AI Research & Papers
MonitrLLM: A Community-Centered Evaluation Infrastructure for Large Language Models
arXiv cs.AI Research & Papers
SkillTrace: Traversing a Query-Skill Graph for Composable LLM Agents
arXiv cs.AI Research & Papers
ParEvalLayer: When Partial LLM-Agent Evaluations Support a Decision
arXiv cs.AI Research & Papers
Instruction-Conditioned Exploration with Asymmetric Reinforcement Learning and Self-Disti…
arXiv cs.AI Research & Papers
Mamba with Hierarchical Memory: Solving Representation Bottleneck in Long Sequence Modeli…
arXiv cs.AI Research & Papers
Long-term Measurements: Towards a Longitudinal Understanding of Human-AI Interactions
arXiv cs.AI Research & Papers
HPFA: Hypergraph-Based Paired Failure Attribution for LLM Reasoning
arXiv cs.AI Research & Papers
Before Reasoning Fails: Pre-Evidence Procedural Failures in Agentic RAG
arXiv cs.AI Research & Papers
Optimizing Minimax Regret in Uncertain MDPs with Small Sets of Policies
arXiv cs.AI Research & Papers
Magnet: Detecting Cross-Session AI Misuse Through Capability Accumulation
arXiv cs.AI Research & Papers
A Contractualist Argumentation Framework for Moral Decision-Making
arXiv cs.AI Research & Papers
HALT: Verification-Aware Stopping for Retrieval-Augmented Search Agents