Explorar

Noticias de IA

22318 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Domain Knowledge Based Temporal-Spatial Graph Convolution Network for ECG Recognition
arXiv cs.AI Research & Papers
Criticality-Based Guard Rail Validation for AI Agent Decisions in Autonomous Telecom Netw…
arXiv cs.AI Research & Papers
A rubric-based controlled comparison of frontier language models on expert-authored clini…
arXiv cs.AI Research & Papers
A$^{2}$utoLPBench: An Auto-Generated, Agent-Friendly LP Benchmark via Inverse-KKT Constru…
arXiv cs.AI Research & Papers
Subliminal Clocks: Latent Time Modelling in Diffusion Language Models
arXiv cs.AI Research & Papers
SimWorlds: A Multi-Agent System for Dynamic 3D Scene Creation
arXiv cs.AI Research & Papers
Path-level Hindsight Instructions for Semantic Exploration in Vision-Language Navigation
arXiv cs.AI Research & Papers
IsoSci: A Benchmark of Isomorphic Cross-Domain Science Problems for Evaluating Reasoning …
arXiv cs.AI Research & Papers
Adoption and Impact of Command-Line AI Coding Agents: A Study of Microsoft's Early 2026 R…
arXiv cs.AI Research & Papers
Safeguarding LLM Agents from Misalignment through Provenance Analysis
arXiv cs.AI Research & Papers
Distributed Attacks in Persistent-State AI Control
arXiv cs.AI Research & Papers
Online Safety Monitoring for LLMs
arXiv cs.AI Research & Papers
EvoPolicyGym: Evaluating Autonomous Policy Evolution in Interactive Environments
arXiv cs.AI Research & Papers
AI Assistance for Human Review of Default Judgments
arXiv cs.AI Research & Papers
Structuring the Space of Sociotechnical Alignment
arXiv cs.AI Research & Papers
LLMs as Teaching Assistants for Mathematics Exam Grading: Reliability, and Practical Usab…
arXiv cs.AI Research & Papers
ExPerT: Personalizing LLM Responses to Users' Domain Expertise via Query-Wise Semantic an…
arXiv cs.AI Research & Papers
Prompt Framing Distorts Count-Based Evaluation of LLM Error Detection: Evidence from Nume…
arXiv cs.AI Research & Papers
Scaling Trends for Lie Detector Oversight in Preference Learning
arXiv cs.AI Research & Papers
OPINE-World: Programmatic World Modeling with Ontology-error-Prioritized Interactive Expl…
arXiv cs.AI Research & Papers
Revisiting Chain-of-Thought Reasoning under Limited Supervision: Semi-supervised Chain-of…
arXiv cs.AI Research & Papers
Janus: a Playground for User-Involved Agentic Permission Management
arXiv cs.AI Research & Papers
The Agentic Garden of Forking Paths
arXiv cs.AI Research & Papers
Procedural Memory Distillation: Online Reflection for Self-Improving Language Models
arXiv cs.AI Research & Papers
World Feedback for Clinical Agents: Diagnosing RL in FHIR Environments
arXiv cs.AI Research & Papers
Discrete Diffusion Language Models for Interactive Radiology Report Drafting
arXiv cs.AI Research & Papers
CreativityNeuro: Steering Language Model Weights to Improve Divergent Thinking and Reduce…
arXiv cs.AI Research & Papers
Fast Multi-dimensional Refusal Subspaces via RFM-AGOP
arXiv cs.AI Research & Papers
Hardware-Enforced Semantic Coordination for Safety-Critical Real-Time Autonomous Systems
arXiv cs.AI Research & Papers
Generic Expert Coverage for Pruning SparseMixture-of-Experts Language Models