Explorar

Noticias de IA

22099 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Margin-Adaptive Confidence Ranking for Reliable LLM Judgement
arXiv cs.AI Research & Papers
Evaluating Design Video Generation: Metrics for Compositional Fidelity
arXiv cs.AI Research & Papers
Full Attention Strikes Back: Transferring Full Attention into Sparse within Hundred Train…
arXiv cs.AI Research & Papers
ConflictRAG: Detecting and Resolving Knowledge Conflicts in Retrieval Augmented Generation
arXiv cs.AI Research & Papers
Post-Trained MoE Can Skip Half Experts via Self-Distillation
arXiv cs.AI Research & Papers
Diagnosing Multi-step Reasoning Failures in Black-box LLMs via Stepwise Confidence Attrib…
arXiv cs.AI Research & Papers
Weak-Driven Learning: How Weak Agents make Strong Agents Stronger
arXiv cs.AI Research & Papers
Causal Unlearning in Collaborative Optimization: Exact and Approximate Influence Reversal…
arXiv cs.AI Research & Papers
CrossVLA: Cross-Paradigm Post-Training and Inference Optimization for Vision-Language-Act…
arXiv cs.AI Research & Papers
Language-based Trial and Error Falls Behind in the Era of Experience
arXiv cs.AI Research & Papers
SKILL.nb: Selective Formalization and Gated Execution for Durable Agent Workflows
arXiv cs.AI Research & Papers
A Multi-modal Agentic Co-pilot for Evidence Grounded Computational Pathology
arXiv cs.AI Research & Papers
When Does Delegation Beat Majority? A Delegation-Based Aggregator for Multi-Sample LLM In…
arXiv cs.AI Research & Papers
Think Before You Act: Intention-Guided Reasoning for LLM-Based Location Prediction
arXiv cs.AI Research & Papers
SAGE: An LLM-driven Self Reflective Agentic Framework for Fraud Detection
arXiv cs.AI Research & Papers
SciTrace: Trajectory-Aware Safety Reasoning for Scientific Discovery Agents
arXiv cs.AI Research & Papers
When No Answer Is Correct: Diagnosing Absent Answer Detection for MLLMs in Video Understa…
arXiv cs.AI Research & Papers
Overcoming the Regulatory Bottleneck via Agent-to-Agent Protocols: A Nuclear Case Study
arXiv cs.AI Research & Papers
The AI Epistemic Deference Index: A Continuous Measure of Sycophancy
arXiv cs.AI Research & Papers
EditSR: Enhancing Neural Symbolic Regression via Edit-based Rectification
arXiv cs.AI Research & Papers
Stress-testing medical large language models reveals latent safety pathology beyond bench…
arXiv cs.AI Research & Papers
PAFO: Pareto Fairness Optimization for Personalized Reward Modeling
arXiv cs.AI Research & Papers
UniQL: Towards Dialect-Universal Benchmarking for Text-to-SQL
arXiv cs.AI Research & Papers
Standpoint Logics with Defeasible Beliefs
arXiv cs.AI Research & Papers
Scaffold Effects on GAIA: A Controlled Comparison
arXiv cs.AI Research & Papers
AgentTrust: A Self-Improving Trust Layer for AI-Agent Actions
arXiv cs.AI Research & Papers
PAEC: Position-Aware Entropy Calibration for LLM Reasoning in RLVR
arXiv cs.AI Research & Papers
Distilling LLM Reasoning into an Interpretable Policy Tree for Human-AI Collaboration
arXiv cs.AI Research & Papers
InA-Probe: Instruction-Aware Active Probing for Time Series Forecasting with LLMs
arXiv cs.AI Research & Papers
Extending Ontologies: From Dense Embeddings to Hybrid Quantum-Fuzzy Systems