Explorar

Noticias de IA

21272 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Unequal Verdicts: Investigating Gender Bias in LLM-Based Fake News Detection
arXiv cs.AI Research & Papers
CVPO: Enhancing LLM Reinforcement Learning Reasoning via Value-Variance Adaptation and Dy…
arXiv cs.AI Research & Papers
Rethinking Self-Evolving Agent Skills: Feedback Dynamics over Multiple Rounds
arXiv cs.AI Research & Papers
Screenshots or Tools? Eliciting Tool Use and Managing Multimodal Context in Hybrid GUI-MC…
arXiv cs.AI Research & Papers
Uncovering Spontaneous Physics Representations in In-Context Learning
arXiv cs.AI Research & Papers
Lightweight Chunk Selection for Mobile Retrieval-Augmented Generation
arXiv cs.AI Research & Papers
Distilled Roads: Generalisable Road Network Extraction Across Sensors, Resolutions, and R…
arXiv cs.AI Research & Papers
PACE: Adaptive Budget Allocation for Time-Efficient Embodied Planning
arXiv cs.AI Research & Papers
Cross-Layer Interaction under Weight-Space Ablation: A Closed-Form Attention Jacobian Bou…
arXiv cs.AI Research & Papers
CARE-Bench: Benchmarking Patient-Facing LLM Triage
arXiv cs.AI Research & Papers
When Outputs Disperse, Does Epistemic Revision Follow? A Black-Box Diagnostic for Machine…
arXiv cs.AI Research & Papers
Optimal Liability Design for Medical AI
arXiv cs.AI Research & Papers
Rectify Then Diffuse: Disentangling Concepts Before Denoising Trajectory Unfolds
arXiv cs.AI Research & Papers
VeriTrace: Human-Like Temporal Exploration Completes Agentic Action Space
arXiv cs.AI Research & Papers
Neurosymbolic Reasoning with Incremental Knowledge for Sample Efficient Hierarchical Rein…
arXiv cs.AI Research & Papers
Interpreting Black-Box Large Language Models with Sentence-Level Energy Landscapes
arXiv cs.AI Research & Papers
From Social Coding to Agentic Coding: Productivity and Relational Reconfiguration in Open…
arXiv cs.AI Research & Papers
FOUND-AF: Benchmarking ECG Foundation Models for Atrial Fibrillation Detection
arXiv cs.AI Research & Papers
Instruction Stacking Collapse: A Benchmark and the Capability-Dependent Value of Prompt C…
arXiv cs.AI Research & Papers
Rethinking Modality Reliability in Multimodal Sentiment Analysis with Incomplete Observat…
arXiv cs.AI Research & Papers
BODHI: Do LLMs Branch Out and Discover Heterogeneous Inferences?
arXiv cs.AI Research & Papers
Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Cap…
arXiv cs.AI Research & Papers
FraQ: Efficient Coordinate-Space Recompression for Federated Low-Rank Adaptation
arXiv cs.AI Research & Papers
Enhancing Tabular Learners with Context-Aware Semantic Embeddings
arXiv cs.AI Research & Papers
Formal Verification of Agentic Systems over Operational Data
arXiv cs.AI Research & Papers
When Should Graph Attention Be Sparse? Learning a Per-Edge Tsallis Index
arXiv cs.AI Research & Papers
A Hierarchical Approach to Imitation Learning for Manipulation Tasks Requiring Time Varyi…
arXiv cs.AI Research & Papers
WeClawArena: An Auditable Sandbox and Benchmark for Cross-User Agents Collaboration and S…
arXiv cs.AI Research & Papers
ToolLIFT: Lifting Tool-Specific Trajectories into Function-Level Graphs for Generalizable…
arXiv cs.AI Research & Papers
Can LLM design high-quality experiments? A Comprehensive and Systematic Benchmark on Auto…