Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Source-Free MT Evaluation Is Not MT Evaluation
arXiv cs.AI Research & Papers
BC-Bench: Evaluating Agentic Engineering in a Domain-Specific Language for ERP
arXiv cs.AI Research & Papers
WA-JEPA: Rethinking the Video JEPA Paradigm for World-Action Modeling in Autonomous Drivi…
arXiv cs.AI Research & Papers
Explainable Deepfake Detection with Feature-robust Augmentation and Evidence-grounded Exp…
arXiv cs.AI Research & Papers
Advantage-level Aggregation Reinforcement Learning for X-point Target Magnetic Configurat…
arXiv cs.AI Research & Papers
STAR-OPD: Structured Aspect-Cascade-Aware On-Policy Reward Distillation for ABSA Quadrupl…
arXiv cs.AI Research & Papers
Structured but Fragile: On the Limits of LLMs in Cybersecurity Decision-Making
arXiv cs.AI Research & Papers
Vibe Coding and Web Application Security: A Twin-Prompt Study
arXiv cs.AI Research & Papers
When Generated Images Look Right and Retrieve Wrong: Coverage-Guided Cross-Scale Re-Index…
arXiv cs.AI Research & Papers
Denoising the Future: Context-Aware Spectral Diffusion for Temporal Knowledge Graph Extra…
arXiv cs.AI Research & Papers
Extractive Summarization for Arabic Documents Using SAraBERT with a Semantic Siamese Simi…
arXiv cs.AI Research & Papers
Identity-Aware Human-Object Interaction Motion Captioning
arXiv cs.AI Research & Papers
CARD: Diagnosing Belief to Action Routing Failures in Vision Language Models
arXiv cs.AI Research & Papers
Provable Edge-of-Stability for Adam on a One-Dimensional Quadratic
arXiv cs.AI Research & Papers
C-Score: Beyond Accuracy for Robustness Assessment in Semi-Supervised Learning under Open…
arXiv cs.AI Research & Papers
RiskTraf: Risk-Extrapolated Residual Learning for Multi-Variate Traffic Flow Prediction
arXiv cs.AI Research & Papers
PSK at WMT 2026 MIST: Task-Specialized QLoRA Adapters for Multilingual Summarization and …
arXiv cs.AI Research & Papers
Temporal Validity on Real Software Histories: Eliminating Stale-Fact Errors in Code-Assis…
arXiv cs.AI Research & Papers
Do SpeechLMs Hear Their Own Opinions? Diagnosing and Mitigating Previous-Belief Contamina…
arXiv cs.AI Research & Papers
Free-Text Evaluation of LLMs for 5G Domain Knowledge and Fault Analysis using LLM-as-Judge
arXiv cs.AI Research & Papers
AT-ViT: Area-Targeted Multi-View Vision Transformer with Cross-Attention and Multi-Scale …
arXiv cs.AI Research & Papers
CertVLA: Certified Defense against Physical Visual Attacks for Vision-Language-Action Mod…
arXiv cs.AI Research & Papers
JuryProbe: An Empirical Consensus-Risk Diagnostic for Routing Reference-Free Factuality J…
arXiv cs.AI Research & Papers
When Failures Propagate: Causal Failure Attribution in Agentic Retrieval-Augmented Genera…
arXiv cs.AI Research & Papers
Testing and Evaluation of Agentic AI Systems In Military Command and Control
arXiv cs.AI Research & Papers
Large Scale AI Grading of Handwritten Physics Assessments: Score Agreement and Olympiad T…
arXiv cs.AI Research & Papers
Beyond End-to-End Success: Diagnosing Failures in Long-Horizon Security LLM Agents
arXiv cs.AI Research & Papers
Towards Traffic Modelling of Multi-Agent Systems: The Role of Coordination Topology
arXiv cs.AI Research & Papers
One Hierarchy, Two Systems: Semantic Product IDs for Discovery-Surface Ranking and Search…
arXiv cs.AI Research & Papers
Consistency Models for Fast MRI Reconstruction Using Regularization by Denoising