Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
KC-Bench: A Dynamic Interactive Benchmark for Evaluating Knowledge Conflicts in LLM Agents
arXiv cs.AI Research & Papers
HalluPeer: A Taxonomy-driven Benchmark for Detecting Hallucinations in Scientific Peer Re…
arXiv cs.AI Research & Papers
Counterfactual Routing Using Integer Programming with Constraint Generation
arXiv cs.AI Research & Papers
GPS-Bench: A Governance Policy Benchmark for Automating Policy Analysis
arXiv cs.AI Research & Papers
The Attention Triangle in Audio-Video Models
arXiv cs.AI Research & Papers
CulturalMenuBench: Probing the Knowledge-Application Gap in Multimodal Culinary Reasoning
arXiv cs.AI Research & Papers
PPO-STGNN: A Proximal Policy Optimization Approach with Spatio-Temporal Graph Neural Netw…
arXiv cs.AI Research & Papers
What Matters for Aggressive Decoding-Time KV Eviction? Temporal Aggregation and Ranking P…
arXiv cs.AI Research & Papers
NeoRed: A Knowledge-Logic-Alignment Multimodal Large Language Model for Neonatal Respirat…
arXiv cs.AI Research & Papers
Analysis of Prompt Engineering for Drug Toxicity Prediction
arXiv cs.AI Research & Papers
Feature Reconfiguration With Visual Prior for Medical Lesion Segmentation
arXiv cs.AI Research & Papers
Adapting to Evolving Requirements: Agentic AI for Retail Supply Chain Operations
Hugging Face Blog Research & Papers
NeoMME: an efficient Multimodal-native and Multilingual Encoder
arXiv cs.AI Research & Papers
AI Mathematician: Towards Fully Automated Frontier Mathematical Research
arXiv cs.AI Research & Papers
Modeling and Optimizing User Preferences in AI Copilots: A Comprehensive Survey and Taxon…
arXiv cs.AI Research & Papers
Do Large Language Models Capture the Diversity in their Training Data?
arXiv cs.AI Research & Papers
RVSD: Retrieval Vision Sparse Decoding for Mitigating Visual Hallucinations in Large Visi…
arXiv cs.AI Research & Papers
TikZilla: Scaling Text-to-TikZ with High-Quality Data and Reinforcement Learning
arXiv cs.AI Research & Papers
Automated Vulnerability Injection in Smart Contracts Using Large Language Models
arXiv cs.AI Research & Papers
ProbeMatchDTI: Probe-Driven Multi-Scale Biochemical Pattern Matching for Drug-Target Inte…
arXiv cs.AI Research & Papers
MultiGhostBench: A Multilingual Benchmark for Long-Form LLM-Generated Text Attribution un…
arXiv cs.AI Research & Papers
Evidence for Shared Routing Geometry and Dynamics in Sparse Mixture-of-Experts
arXiv cs.AI Research & Papers
PolERo: Studying Political Evasion in Romanian
arXiv cs.AI Research & Papers
Competitive Market Behavior of LLMs
arXiv cs.AI Research & Papers
Fine-Grained Anomaly Perception in Wild UGC-Enhanced Images: A Comprehensive Dataset and …
arXiv cs.AI Research & Papers
PaperCompiler: Faithful Paper-to-Code Generation via Repository-Level Specification Compi…
arXiv cs.AI Research & Papers
CrashDiffuser: VLM-Guided Collision Intent Reasoning for Fine-Grained Safety-Critical Tra…
arXiv cs.AI Research & Papers
DiffuSearch: How Hybrid Trajectory Planning Benefits from Aligned Objectives in Diffusion…
arXiv cs.AI Research & Papers
Retrosynthesis of Synthetic Media for Explainable AI Provenance Forensics
arXiv cs.AI Research & Papers
Action abstractions for amortized sampling