Explorar

Noticias de IA

29349 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
A2RAG: Adaptive Agentic Graph Retrieval for Cost-Aware and Reliable Reasoning
arXiv cs.AI Research & Papers
Active Video Perception: Iterative Evidence Seeking for Agentic Long Video Understanding
arXiv cs.AI Research & Papers
CTIConnect: A Benchmark for Retrieval-Augmented LLMs over Heterogeneous Cyber Threat Inte…
arXiv cs.AI Research & Papers
Beyond Vector Similarity: A Structural Analysis of Graph-Augmented Retrieval for Industri…
arXiv cs.AI Research & Papers
VASO: Formally Verifiable Self-Evolving Skills for Physical AI Agents
arXiv cs.AI Research & Papers
Escaping the Verifier: Learning to Reason via Demonstrations
arXiv cs.AI Research & Papers
RAG Security and Privacy: Formalizing the Threat Model and Attack Surface
arXiv cs.AI Research & Papers
Agents' Last Exam
arXiv cs.AI Research & Papers
Can AI Refute Economic Theory? Evidence from Beyond the Knowledge Cutoff
arXiv cs.AI Research & Papers
A Survey on Diffusion Language Models
arXiv cs.AI Research & Papers
EGTR-Review: Efficient Evidence-Grounded Scientific Peer Review Generation via Multi-Agen…
arXiv cs.AI Research & Papers
Emergent Language as an Approach to Conscious AI
arXiv cs.AI Research & Papers
In-Training Defenses against Emergent Misalignment in Language Models
arXiv cs.AI Research & Papers
Scaling Laws and Spectra of Shallow Neural Networks in the Feature Learning Regime
arXiv cs.AI Research & Papers
Amortizing Federated Adaptation: Hypernetwork Driven LoRA for Personalized Foundation Mod…
arXiv cs.AI Research & Papers
Residual Modeling for High-Fidelity Learned Compression of Scientific Data
arXiv cs.AI Security & Safety
Explainable AI-Driven Cyber Risk Analytics and Model Reliability Assessment for Intellige…
arXiv cs.AI Security & Safety
Domain-Conditioned Safety in Frontier Computer-Using Agents: A 793-Episode Browser Benchm…
arXiv cs.AI Research & Papers
Reformulating Neural Operators in $d+1$ Dimensions for Embedding Evolution
arXiv cs.AI Research & Papers
CLASH: Evaluating Language Models on Judging High-Stakes Dilemmas from Multiple Perspecti…
arXiv cs.AI Research & Papers
ReasoningFlow: Discourse Structures for Understanding LLM Reasoning Traces
arXiv cs.AI Research & Papers
The Mirage of Performance Gains: Why Contrastive Decoding Fails to Mitigate Object Halluc…
arXiv cs.AI Research & Papers
ProSarc: Prosody-Aware Sarcasm Recognition Framework via Temporal Prosodic Incongruity
arXiv cs.AI Research & Papers
Multilingual Coreference Resolution via Cycle-Consistent Machine Translation
arXiv cs.AI Research & Papers
Channel-Wise Mixed-Precision Quantization for Large Language Models
arXiv cs.AI Research & Papers
SubtleMemory: A Benchmark for Fine-Grained Relational Memory Discrimination in Long-Horiz…
arXiv cs.AI Research & Papers
A Framework for Measuring Appropriate Reliance on Set-Valued AI Advice
arXiv cs.AI Research & Papers
A Model of Multi-turn Human Persuadability Using Probabilistic Belief Tracing
arXiv cs.AI Research & Papers
A Taxonomy of Runtime Faults in Model Context Protocol Servers
arXiv cs.AI Research & Papers
Entropy-Based Evaluation of AI Agents: A Lightweight Framework for Measuring Behavioral P…