Explorar

Noticias de IA

29349 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
SAGE: A Quantitative Evaluation of Socialized Evolution in Agent Ecosystems
arXiv cs.AI Research & Papers
The Violation Situation Pattern: A Knowledge-Graph Pattern for Compliance Violations
arXiv cs.AI Research & Papers
InfoMem: Training Long-Context Memory Agents with Answer-Conditioned Information Gain
arXiv cs.AI Research & Papers
CP-Agent: Context-Aware Multimodal Reasoning for Cellular Morphological Profiling under C…
arXiv cs.AI Research & Papers
What Makes Interaction Trajectories Effective for Training Terminal Agents?
arXiv cs.AI Research & Papers
LEAP: Supercharging LLMs for Formal Mathematics with Agentic Frameworks
arXiv cs.AI Research & Papers
The Reliability Gap in Benchmark Auditing: Distribution Shift and Scale as Failure Modes …
arXiv cs.AI Research & Papers
Distilling Answer-Set Programming Rules from LLMs for Neurosymbolic Visual Question Answe…
arXiv cs.AI Research & Papers
ClinicalMC: A Benchmark for Multi-Course Clinical Decision-Making with Large Language Mod…
arXiv cs.AI Research & Papers
Effect of Demographic Bias on Skin Lesion Classification
arXiv cs.AI Research & Papers
EvoTrainer: Co-Evolving LLM Policies and Training Harnesses for Autonomous Agentic Reinfo…
arXiv cs.AI Research & Papers
GTBench: A Curriculum-Grounded Benchmark for Evaluating LLMs as Mathematical Research Ass…
arXiv cs.AI Research & Papers
AURA: Action-Gated Memory for Robot Policies at Constant VRAM
arXiv cs.AI Research & Papers
CORE: Conflict-Oriented Reasoning for General Multimodal Manipulation Detection
arXiv cs.AI Research & Papers
DELTAMEM: Incremental Experience Memory for LLM Agents via Residual Trees
arXiv cs.AI Research & Papers
Thinking Past the Answer: Evaluating Harmful Overthinking in Large Reasoning Models
arXiv cs.AI Research & Papers
E2LLM: Towards Efficient LLM Serving in Heterogeneous Edge/Fog Environments
arXiv cs.AI Research & Papers
Signed Spiking Neuron Enabled by an Orthogonal-Easy-Axis Magnetic Tunnel Junction
arXiv cs.AI Research & Papers
PURGE: Projected Unlearning via Retain-Guided Erasure
arXiv cs.AI Research & Papers
AUGUSTE: Online-Learning dApp for Predictive URLLC Scheduling
arXiv cs.AI Research & Papers
Staying Alive: Uncensored Survival Analysis with Tabular Foundation Models
arXiv cs.AI Models & Releases
Ultralytics YOLO26: Unified Real-Time End-to-End Vision Models
arXiv cs.AI Research & Papers
TurtleAI: Benchmarking Multimodal Models for Visual Programming in Turtle Graphics
arXiv cs.AI Research & Papers
Building Reliable Long-Form Generation via Hallucination Rejection Sampling
arXiv cs.AI Research & Papers
AnchorMoE: Interpretable Time Series Classification via Anchor-Routed MoE
arXiv cs.AI Research & Papers
PHASER: Phase-Aware and Semantic Experience Replay for Vision-Language-Action Models
arXiv cs.AI Research & Papers
CauTion: Knowing When to Trust LLMs for Ensemble Causal Discovery
arXiv cs.AI Research & Papers
Testing LLM Arithmetic Reasoning Generalization with Automatic Numeric-Remapping Attacks
arXiv cs.AI Security & Safety
High-Precision APT Malware Attribution with Out-of-Scope Resilience
arXiv cs.AI Research & Papers
When Should the Teacher Move? Temporal Coupling and Stability in Self On-Policy Distillat…