Explorar

Noticias de IA

21270 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Business Arena: Benchmarking LLM Agents in a Realistic Marketplace
arXiv cs.AI Research & Papers
KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Mod…
arXiv cs.AI Research & Papers
From Recovery to Drop-off: How Action Post-training Reduces a VLM's Late-Layer Depth Deco…
arXiv cs.AI Research & Papers
Revision or Re-Solving? Decomposing Second-Pass Gains in Multi-LLM Pipelines
arXiv cs.AI Research & Papers
Goose: Anisotropic Speculation Trees for Training-Free Speculative Decoding
arXiv cs.AI Research & Papers
Not an A11y: How Android Accessibility Exposes Mobile AI Agents to Indirect Prompt Inject…
arXiv cs.AI Research & Papers
Gaming Without an Attacker: Benchmark Fingerprinting in LLM-Driven Search Under Selection…
arXiv cs.AI Research & Papers
TomaMMU: A Comprehensive Multimodal Understanding Benchmark for Tomato Leaf Diseases
arXiv cs.AI Research & Papers
Unaccountable Delegation, Fading Skills: Mapping the Risks of Workplace AI Agents
arXiv cs.AI Research & Papers
Resolution Meets Reduction: Efficient Visual Context for 3D Radiology Report Generation
arXiv cs.AI Research & Papers
ForestBench: A Unified Graph Framework for Evaluating Multi-Agent Collaboration
arXiv cs.AI Research & Papers
RippleKV: Cross-Layer KV Cache Allocation via Perturbation Propagation
arXiv cs.AI Research & Papers
Adaptive Sequential Test Planning for Multi-Mechanism Reliability Qualification via Bayes…
arXiv cs.AI Research & Papers
Deep probabilistic logic programming for diagnostic reasoning from incomplete information…
arXiv cs.AI Research & Papers
Coordinated incentives in AI-generated misinformation governance
arXiv cs.AI Research & Papers
Experience-Sensitive Game Learning: A Behavioral Study of Humans and Language Agents
arXiv cs.AI Research & Papers
SkillSentry: Reliable Skill Execution for LLM Agents via Runtime Assurance
arXiv cs.AI Research & Papers
Entropy-based Code Adversarial Translation for Real-world Repository Migration
arXiv cs.AI Research & Papers
RAG-Based Auto-Configuration for Industrial Fieldbus Devices
arXiv cs.AI Research & Papers
P$^{3}$: Joint Program-and-Proof Planning for Verified Code Generation
arXiv cs.AI Research & Papers
CDGC-Net: 3D Medical Image Segmentation with Cooperative Dual-Scale Self-Attention and Gr…
arXiv cs.AI Research & Papers
Mitigating Gender Bias in English to Romanian Machine Translation
arXiv cs.AI Research & Papers
REVEAL: A Rubric-Guided Agent for Explicit Evidence Sufficiency Verificationin Long-Video…
arXiv cs.AI Research & Papers
SafeSceneReason: A Multimodal Reasoning Benchmark Connecting Industrial Hazards with Acci…
arXiv cs.AI Research & Papers
MMArch: Benchmarking Multimodal Reasoning Grounded in Architectural Evidence
arXiv cs.AI Research & Papers
GeoPhysAdapter: Scale-Matched Geophysical Adaptation for Cross-Domain Landslide Mapping w…
arXiv cs.AI Research & Papers
SuperNeuroMAT: An Efficient Matrix-based Simulator for Spiking Neural Networks
arXiv cs.AI Research & Papers
Different Feedback, Different Updates: Selective Self-Learning from User Interactions for…
arXiv cs.AI Research & Papers
On-Device Multi-Species Malaria Detection with Uncertainty-Calibrated Slide-Level Aggrega…
arXiv cs.AI Research & Papers
Signature-Guided Capacity Occupancy for Dense Expert Merging