Explorar

Noticias de IA

29347 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Hierarchical Latent Prediction for Language Models
arXiv cs.AI Research & Papers
SearchAuditor: Auditing and Attributing Failures in Long-Horizon Search Agents
arXiv cs.AI Research & Papers
NavTrust: Benchmarking Trustworthiness for Embodied Navigation
arXiv cs.AI Research & Papers
Shapes from Examples: Foundations of Shape Learning in Recursive SHACL
arXiv cs.AI Research & Papers
Search-Aided Joint Agent-Environment Reinforcement Learning for Robust Lifelong Multi-Age…
arXiv cs.AI Research & Papers
Big, Bright, or Invisible: A Frozen-Feature Benchmark of 3D CT Foundation Models
arXiv cs.AI Research & Papers
Why the Third Axis Is Freedom
arXiv cs.AI Research & Papers
LC-GRPO: Bridging Train-Inference Gap for Flow-Based GRPO with Langevin Correction
arXiv cs.AI Research & Papers
ECG-LENS: Lead-Aware Clinical Context Enriched ECG Report Generation and Evaluation
arXiv cs.AI Research & Papers
AppDeltaWorld: Transition-Grounded Delta Code World Model for Mobile GUI Agents
arXiv cs.AI Research & Papers
Hardware Keystores for AI Agent Signing Workflows: A Zero-Trust MCP Enforcement Architect…
arXiv cs.AI Research & Papers
CodeGrep: An RL-Trained Retrieval Agent for LLM Coding Agents
arXiv cs.AI Research & Papers
Audio-to-Score Transcription using Pre-trained Features, Data Augmentation, and the New S…
arXiv cs.AI Research & Papers
D-CLOT: Double Closed Loop Optimal Transport for Unsupervised Action Segmentation
arXiv cs.AI Research & Papers
Beyond Sentiment: Comparing Traditional NLP and LLM-Based Multi-Dimensional Analysis for …
arXiv cs.AI Research & Papers
Challenges for Musical Education in the Age of AI and Digital Transformation
arXiv cs.AI Research & Papers
Beyond Information Retrieval: Generative AI as an Epistemic Arbiter to Enhance Collaborat…
arXiv cs.AI Research & Papers
Agentic Nesting: A New Methodology for Existing Enterprise Application Integration and Se…
arXiv cs.AI Research & Papers
MermaidSeqBench: An Evaluation Benchmark for NL-to-Mermaid Sequence Diagram Generation
arXiv cs.AI Research & Papers
BaKron: Efficient Quantization with Kronecker-Factored Hessians
arXiv cs.AI Research & Papers
Failing Gracefully: Mitigating Impact of Inevitable Robot Failures
arXiv cs.AI Research & Papers
An Axiomatic Benchmark for Evaluation of Scientific Novelty Metrics
arXiv cs.AI Research & Papers
Agentic Software Issue Resolution with Large Language Models: A Survey
arXiv cs.AI Research & Papers
CT Open: An Open-Access, Uncontaminated, Live Platform for the Open Challenge of Clinical…
arXiv cs.AI Research & Papers
A note on conditional PAC-efficient reasoning in large language model routing
arXiv cs.AI Research & Papers
AegisShield: Democratizing Cyber Threat Modeling with Generative AI
arXiv cs.AI Research & Papers
What Current AI Benchmarks Leave Unmeasured: Modality, Search, Citations, and Implication…
arXiv cs.AI Research & Papers
IMMENSE: Inductive Multi-perspective User Classification in Social Networks
arXiv cs.AI Research & Papers
The em-dash em-beds in Congress: A population-level rise in em-dash frequency in U.S. con…
arXiv cs.AI Research & Papers
Innocent Panels, Hateful Stories: Evaluating and Detecting Hateful Intent in Multi-Turn V…