Explorar

Noticias de IA

21010 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
What Drives LLM Self-Reflection? A Controlled Ablation of Uncertainty Routing in Armed Co…
arXiv cs.AI Research & Papers
Unlearning at Scale: State-Exact Trace-Preserving Deletion in Billion-Parameter Language …
arXiv cs.AI Research & Papers
The AI Accountability Ecosystem in the Era of Language Models
arXiv cs.AI Research & Papers
Jagged Judges: Epistemic Stability Under Silence, Pressure, and Persistence
arXiv cs.AI Research & Papers
AnchorSIPS: A Synthetic Dataset and Evaluation Resource for Evidence-Supported Psychosis-…
arXiv cs.AI Research & Papers
StreamReason-Bench: Can Large Language Models Reason about Event-Time Stream-Processing S…
arXiv cs.AI Research & Papers
Governed Persistent Memory: Source-Bound State Semantics and Fail-Closed Release for Long…
arXiv cs.AI Research & Papers
When AI Is Your Pastor: A Benchmark for Theological Triage and Pastoral Guidance in Large…
arXiv cs.AI Research & Papers
Research Assistant: AstraZeneca's Agentic System for R&D
arXiv cs.AI Research & Papers
Learning to Adapt Cross-Domain Preferences via Meta-LoRA for LLM Personalization
arXiv cs.AI Research & Papers
DiG-bench: Discovery in Games
arXiv cs.AI Research & Papers
CAS: A Causal Attribution Score for Local and Global Explainable Artificial Intelligence
arXiv cs.AI Research & Papers
Assessment Design in the GenAI Era: The X1-X2-X3 Assessment Pattern for Testing Students'…
arXiv cs.AI Research & Papers
Humans are Missing from AI Coding Agent Research
arXiv cs.AI Research & Papers
From Observation to Intervention: Memory in Brains and Large Language Models
arXiv cs.AI Research & Papers
Unified Multi-Dimensional Benchmark for Complex Graph Reasoning in Large Language Models
arXiv cs.AI Research & Papers
Multi-Agent Scheduling with LLM-Assisted Contract Net Negotiation for Stream Processing i…
arXiv cs.AI Research & Papers
Personalized Scorer Modeling: A Learning-Based Framework for Deriving Robust Sleep Stage …
arXiv cs.AI Research & Papers
SSPO: Structure-Aware Similarity-Weighted Preference Optimization for Neural Combinatoria…
arXiv cs.AI Research & Papers
Reasoning Jury: Multi-Model Consensus for Evaluating Reasoning Traces
arXiv cs.AI Research & Papers
Predicting When Random Low-Dimensional Reparameterizations Train Neural Networks
arXiv cs.AI Research & Papers
Not All Nudges Land: Behavioral Controllability and Elaboration Quality in AI-Supported J…
arXiv cs.AI Research & Papers
SchemaLink: An Intelligent Web Editor for LinkML Schema Curation
arXiv cs.AI Research & Papers
LLMs Are Not Good Strategists, Yet Memory-Enhanced Agency Boosts Reasoning
arXiv cs.AI Research & Papers
Interpretable Causal Discovery via Causal-Effect Constraints
arXiv cs.AI Research & Papers
Tracing Provenance and Detecting Tampering with Complementary LLM Watermarks
arXiv cs.AI Research & Papers
HybridSB-MoE: Dual-Domain Schr\"odinger Bridges with Scene-Adaptive Expert Routing for Sp…
arXiv cs.AI Research & Papers
Error-Aware Reverse Auction Mechanism for Large Language Model Routing
arXiv cs.AI Research & Papers
Beyond Outcome Rewards: Step-Level Self-Distilled Policy Optimization for Deep Search Age…
arXiv cs.AI Research & Papers
SynWeaver: Website-Prior Task and Trajectory Co-Synthesis for Web Agents