Explorar

Noticias de IA

21010 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
KPI2KVI: A Multi Agent Workflow for Calculating Key Value Indicators from Service Descrip…
arXiv cs.AI Research & Papers
SkillOpt: Executive Strategy for Self-Evolving Agent Skills
arXiv cs.AI Research & Papers
From Raw Experience to Skill Consumption: A Systematic Study of Model-Generated Agent Ski…
arXiv cs.AI Research & Papers
Beyond Binary Edits Robust Multimodal Knowledge Editing with Adversarial Subspace Alignme…
arXiv cs.AI Research & Papers
Agentic Proving for Program Verification
arXiv cs.AI Research & Papers
One Policy, Infinite NPCs: Persona-Traceable Shared RL Policies for Scalable Game Agents
arXiv cs.AI Research & Papers
Co-ReAct: Rubrics as Step-Level Collaborators for ReAct Agents
arXiv cs.AI Research & Papers
When Planning Fails Despite Correct Execution: On Epistemic Calibration for LLM-Based Mul…
arXiv cs.AI Research & Papers
Ontological Knowledge Blocks: Executable Compliance and Profile-Based Validation for Trus…
arXiv cs.AI Research & Papers
Parallel Context Compaction for Long-Horizon LLM Agent Serving
arXiv cs.AI Research & Papers
AutoResearch AI: Towards AI-Powered Research Automation for Scientific Discovery
arXiv cs.AI Research & Papers
PathCal: State-Aware Reflection-Marker Calibration for Efficient Reasoning
arXiv cs.AI Research & Papers
The Deterministic Horizon: Impossibility Results as Design Specifications for Trustworthy…
arXiv cs.AI Research & Papers
SciAtlas: A Large-Scale Knowledge Graph for Automated Scientific Research
arXiv cs.AI Research & Papers
Skill Retrieval Augmentation for Agentic AI
arXiv cs.AI Research & Papers
Dream-MPC: Gradient-Based Model Predictive Control with Latent Imagination
arXiv cs.AI Research & Papers
Bridging the Last Mile of Circuit Design: PostEDA-Bench, a Hierarchical Benchmark for PPA…
arXiv cs.AI Research & Papers
S-Bus: Automatic Read-Set Reconstruction for Multi-Agent LLM State Coordination
arXiv cs.AI Research & Papers
DynMuon: A Dynamic Spectral Shaping View of Muon
arXiv cs.AI Research & Papers
TwinRouterBench: Fast Static and Live Dynamic Evaluation for Realistic Agentic LLM Routing
arXiv cs.AI Research & Papers
Distilling Linearized Behavior into Non-Linear Fine-Tuning for Effective Task Arithmetic
arXiv cs.AI Research & Papers
Long-Context Reasoning Through Proxy-Based Chain-of-Thought Tuning
arXiv cs.AI Research & Papers
Brain-LLM Alignment Tracks Training Data, Not Typology
arXiv cs.AI Research & Papers
Fine-grained Claim-level RAG Benchmark for Law
arXiv cs.AI Research & Papers
Proxy-Based Approximation of Shapley and Banzhaf Interactions
arXiv cs.AI Research & Papers
Energy per Successful Goal: Goal-Level Energy Accounting for Agentic AI Systems
arXiv cs.AI Research & Papers
Inductive Deductive Synthesis: Enabling AI to Generate Formally Verified Systems
arXiv cs.AI Research & Papers
Solving the Aircraft Disassembly Scheduling Problem
arXiv cs.AI Research & Papers
SPACENUM: Revisiting Spatial Numerical Understanding in VLMs
arXiv cs.AI Research & Papers
The Cognitive Kardashev Scale: Quantifying the Material Envelope of Civilisational Comput…