Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
SciFigQual-Bench: A Benchmark for Scientific Figure Quality Assessment with Full-Manuscri…
arXiv cs.AI Research & Papers
MMAC: A Massive Multi-dimensional Benchmark for Audio Captioning
arXiv cs.AI Security & Safety
Borrowed Strength: Best-of-N Search over a Code EncodingBreaks Self-Check Jailbreak Defen…
arXiv cs.AI Research & Papers
The Human Utility Factor: A Computable Welfare Metric That Reframes AI Governance as a Co…
arXiv cs.AI Research & Papers
Cost-Sensitive Conformal Prediction and Human-in-the-Loop Abstention for Imbalanced High-…
arXiv cs.AI Research & Papers
Audio-Anchored Fusion of Multi-Ratio DiT Reconstruction Residuals for Cross-Domain Audio …
arXiv cs.AI Research & Papers
Property-driven Causal Abstractions for Markov Decision Processes
arXiv cs.AI Research & Papers
Anatomy Contextualized Adaption of CT Foundation Models
arXiv cs.AI Research & Papers
Improving Item Discoverability in e-Commerce Search via Related Intent Generation
arXiv cs.AI Research & Papers
The Social Cost of an AI Teammate: How an Artificial Teammate Reshapes Human-Human Commun…
arXiv cs.AI Research & Papers
APEX-Accounting
arXiv cs.AI Research & Papers
Balancing Centralized Learning and Distributed Self-Organization: A Hybrid Model for Embo…
arXiv cs.AI Research & Papers
Bridging the Gap in Ophthalmic AI: MM-Retinal-Reason Dataset and OphthaReason Model towar…
arXiv cs.AI Research & Papers
HealthSLM-Bench: Benchmarking Small Language Models for Mobile and Wearable Healthcare Mo…
arXiv cs.AI Research & Papers
Measure what Matters: Psychometric Evaluation of AI with Situational Judgment Tests
arXiv cs.AI Research & Papers
BioPro: Towards Difference-Aware Gender Fairness for Vision-Language Models
arXiv cs.AI Research & Papers
How does downsampling affect needle electromyography signals? A generalisable workflow fo…
arXiv cs.AI Research & Papers
MathNet: a Global Multimodal Benchmark for Mathematical Reasoning and Retrieval
arXiv cs.AI Security & Safety
The Capability Paradox: How Smarter Auditors Make Multi-Agent Systems Less Secure
arXiv cs.AI Research & Papers
Shared Symbolic Backbones for Physically Consistent Multi-Output Symbolic Regression
arXiv cs.AI Research & Papers
Cognitive Convergence: Deep Similarities Between Large Language Models and Human Cognition
arXiv cs.AI Research & Papers
A Picture Says Thousands of Words - Harnessing Dermal Exposure Data from Images through H…
arXiv cs.AI Research & Papers
GPT-Red: Automated Red Teaming via Self-Play at Scale
arXiv cs.AI Research & Papers
A Reference-Free Score for Detecting Silent Reasoning Failures in Large Language Models
arXiv cs.AI Research & Papers
Beyond Block Boundaries: Multi-Block Editing for Diffusion Large Language Models
arXiv cs.AI Research & Papers
The Cost of Knowing: A Resource-Aware Protocol for Benchmarking Hallucination Beyond Stat…
arXiv cs.AI Security & Safety
TRACE-CTI: Auditable Post-Extraction Governance of TTP Claims with Knowledge Graphs
arXiv cs.AI Research & Papers
One-Frame Calibration with Siamese Network in Facial Action Unit Recognition
arXiv cs.AI Research & Papers
Defending Against Backdoor Attacks via Alignment Checking in Model-Contrastive Federated …
arXiv cs.AI Research & Papers
BayesAME: Bayesian Active Model Evaluation