Explorar

Noticias de IA

30934 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Translating Natural Language to Strategic Temporal Specifications via LLMs
arXiv cs.AI Research & Papers
ADVENT: LLM-Driven Automatic Predicate Invention for ILP
arXiv cs.AI Research & Papers
ContextSniper: AntTrail's Token-Efficient Code Memory for Repository-Level Program Repair
arXiv cs.AI Research & Papers
EvoPolicyGym: Evaluating Autonomous Policy Evolution in Interactive Environments
arXiv cs.AI Research & Papers
Online Safety Monitoring for LLMs
arXiv cs.AI Research & Papers
CreativityNeuro: Steering Language Model Weights to Improve Divergent Thinking and Reduce…
arXiv cs.AI Research & Papers
Discrete Diffusion Language Models for Interactive Radiology Report Drafting
arXiv cs.AI Research & Papers
InduceKV: Fixed-Footprint Continual Adaptation of Multimodal LLMs via Inducing KV Memories
arXiv cs.AI Research & Papers
PACE: A Proxy for Agentic Capability Evaluation
arXiv cs.AI Research & Papers
Distributed Attacks in Persistent-State AI Control
arXiv cs.AI Research & Papers
Safeguarding LLM Agents from Misalignment through Provenance Analysis
arXiv cs.AI Research & Papers
Adoption and Impact of Command-Line AI Coding Agents: A Study of Microsoft's Early 2026 R…
arXiv cs.AI Research & Papers
IsoSci: A Benchmark of Isomorphic Cross-Domain Science Problems for Evaluating Reasoning …
arXiv cs.AI Research & Papers
Path-level Hindsight Instructions for Semantic Exploration in Vision-Language Navigation
arXiv cs.AI Research & Papers
SimWorlds: A Multi-Agent System for Dynamic 3D Scene Creation
arXiv cs.AI Research & Papers
Subliminal Clocks: Latent Time Modelling in Diffusion Language Models
arXiv cs.AI Research & Papers
World Feedback for Clinical Agents: Diagnosing RL in FHIR Environments
arXiv cs.AI Research & Papers
ElephantAgent: Contextual State Continuity in Agentic Systems
arXiv cs.AI Research & Papers
Don't Let Gains FADE: Breaking Down Policy Gradient Weights in RL
arXiv cs.AI Research & Papers
A$^{2}$utoLPBench: An Auto-Generated, Agent-Friendly LP Benchmark via Inverse-KKT Constru…
arXiv cs.AI Research & Papers
A rubric-based controlled comparison of frontier language models on expert-authored clini…
arXiv cs.AI Research & Papers
KernelSight-LM: A Kernel-Level LLM Inference Simulator
arXiv cs.AI Research & Papers
Algebraic Model Counting for Global Analysis of Optimal Decision Trees
arXiv cs.AI Research & Papers
Procedural Memory Distillation: Online Reflection for Self-Improving Language Models
arXiv cs.AI Research & Papers
Coding-agents can replicate scientific machine learning papers
arXiv cs.AI Research & Papers
IntentTune: Using user demand and personalization to resolve "unknown" query intents for …
arXiv cs.AI Research & Papers
The Agentic Garden of Forking Paths
arXiv cs.AI Research & Papers
Grounded Optimization: A Layered Engineering Framework for Reducing LLM Hallucination in …
arXiv cs.AI Research & Papers
A-TMA: Decoupling State-Aware Memory Failures in Long-Term Agent Memory
arXiv cs.AI Research & Papers
Criticality-Based Guard Rail Validation for AI Agent Decisions in Autonomous Telecom Netw…