Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Homebot: A Personal AI Agent for Conversational Home Assistance and Automation
arXiv cs.AI Research & Papers
MEGRAG: Multi-Granular Evidence Graphs for Answer-Aware Multi-Hop RAG
arXiv cs.AI Research & Papers
PAC Approximation and DIRECT Optimization for Parametric Markov Models
arXiv cs.AI Research & Papers
Auditing Data Provenance in LLM Fine-tuning via Intrinsic Distributional Fingerprints
arXiv cs.AI Research & Papers
Beyond the Mean: Multi-Moment Policy Optimization for LLM Reasoning
arXiv cs.AI Research & Papers
Beyond Solution-Centric Search: Adaptive Inquiry and Knowledge Revision for Autonomous ML…
arXiv cs.AI Research & Papers
MemArbiter: Decision-Time Memory Arbitration for Long-Horizon LLM Agents
arXiv cs.AI Research & Papers
Fetch-then-Explore: Decoupling Selection from Extraction over a Persistent Workspace for …
arXiv cs.AI Research & Papers
Cross-Fitted Residual Utility for Primary-Preserving Cognitive Decision Correction in Aut…
arXiv cs.AI Research & Papers
EduZone: A Framework for Evaluating LLM Safety for K-12 Students and Teachers
arXiv cs.AI Research & Papers
Evolving in the Agent Jungle via History-Informed Opponent Awareness
arXiv cs.AI Research & Papers
Long-Horizon Autonomous Architecture Research with a Language-Model Agent: A Behavioural …
arXiv cs.AI Research & Papers
ProWorld: Progress-Aware Hyperbolic World Models for Long-Horizon Visual Goal Reaching
arXiv cs.AI Research & Papers
Diagnosing Search Behavior and Failure Modes in Long-Horizon Search Agents
arXiv cs.AI Research & Papers
CoEvoKG: Co-Evolving Knowledge Graphs with Self-Evolving Search Agents
arXiv cs.AI Research & Papers
Wnuan: Staged Post-Training for Question Answering over Proprietary Enterprise Knowledge
arXiv cs.AI Research & Papers
EchoChange: A Diffusion Language Model with Dual Pass Remasking for Factual Remote Sensin…
arXiv cs.AI Research & Papers
Exploring and Bridging Knowledge Holes in Unlearned Multimodal Large Language Models
arXiv cs.AI Research & Papers
FOCUS: FP4 Optimization via Coupled-Relaxation and Dual-Granularity Scaling
arXiv cs.AI Research & Papers
PCSD: Persistent Consistency for Self-Distillation in Agentic Reinforcement Learning
arXiv cs.AI Research & Papers
Leveraging AI for fine-grained food safety risk forecasting in sparse data conditions
arXiv cs.AI Research & Papers
SearchMaster: Grounded and Regulated Self-Play for Search Agents
arXiv cs.AI Research & Papers
CockpitHAT: Dependency-Graph-Driven Hierarchical Attribution for Embodied Multi-Agent Coc…
arXiv cs.AI Research & Papers
CoNav-UAV: Cooperative Dual-Altitude Aerial Navigation via Stackelberg Learning
arXiv cs.AI Research & Papers
Can You Trust the Confidence? ConfBench for Vision-Language Models on Document Extraction
arXiv cs.AI Research & Papers
REFLEX: Rethinking MoE Inference as Refinement-Aware Compute Allocation in Diffusion Lang…
arXiv cs.AI Research & Papers
Deferred Exposure of Future Trajectories for Verifiable Reasoning in Autonomous Driving V…
arXiv cs.AI Research & Papers
RL-Lock: Reinforcement Learning for Generating Interlocking Assemblies
arXiv cs.AI Research & Papers
MemSIF: From Structured Interactions to Dual-Track Fact Memory for LLM Agents
arXiv cs.AI Research & Papers
CoEvo-Mem: Co-Evolving Retrieval Policy and Memory Bank for LLM Agents