Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Beyond Benchmarks: LLM Evaluation with an Anthropomorphic and Lifecycle-oriented Roadmap
arXiv cs.AI Research & Papers
One Request, Multiple Experts: LLM Orchestrates Domain Specific Models via Adaptive Task …
arXiv cs.AI Research & Papers
The Mask Is Not the Model: Auditing Prefix Invariance in Attention, State-Space, and Hybr…
arXiv cs.AI Research & Papers
The Compaction Cliff in Long-Running AI Agent Memory
arXiv cs.AI Research & Papers
Search Broadly, Seek Evidence on Both Sides, Decide Narrowly: Evidence-Admissible GraphRA…
arXiv cs.AI Research & Papers
Reliability- and Anatomy-Consistency-Aware Multimodal Learning for Robust Fracture Classi…
arXiv cs.AI Research & Papers
Molecular LLM Agents: From Architectural Design to Scientific Autonomy
arXiv cs.AI Research & Papers
What Models Know, How Well They Know It: Knowledge-Weighted Fine-Tuning for Learning When…
arXiv cs.AI Research & Papers
Complexity Induction: Compositional Generalization via Structured Label Distortion
arXiv cs.AI Research & Papers
Weakly supervised concept Bottleneck Learning for Robust Two stage Object centric visual …
arXiv cs.AI Research & Papers
ODG-NoMaD: Overhead-Camera Direction-Guided NoMaD
arXiv cs.AI Research & Papers
Diagnosing Capability Preservation and Task Sensitivity in Memory Augmented Document Clas…
arXiv cs.AI Research & Papers
Read Less, Solve More: Token-Efficient Sparse Reading for AI Agents
arXiv cs.AI Research & Papers
Model of Models: When Does Emitting a Specialist Beat Attending, Adapting, or Tuning?
arXiv cs.AI Research & Papers
A Survey Instrument to Assess Students' AI and Generative AI Knowledge
arXiv cs.AI Research & Papers
An Empirical Study on Preference Tuning Generalization and Diversity Under Domain Shift
arXiv cs.AI Research & Papers
KSE-Web: An Analysis of Hybrid Retrieval and LLM-Assisted Query Expansion for Low-Resourc…
arXiv cs.AI Research & Papers
Correcting Variable Importance Scored by Random Forests
arXiv cs.AI Research & Papers
PepLLM: ESM-Guided Llama for Structured Protein-Peptide Binding Interface Analysis
arXiv cs.AI Research & Papers
Prime Agent: A Self-Improving RLM Harness
arXiv cs.AI Research & Papers
ReWorld: An Interactive World Model with Long-Horizon Memory
arXiv cs.AI Research & Papers
Wazobia Eval: A Benchmark for Nigerian Pidgin Emotion Understanding, Sarcasm Detection, a…
arXiv cs.AI Research & Papers
Bulbul: A Dataset for Dialectal Arabic Speech Recognition
arXiv cs.AI Research & Papers
MediSkill-Evo: Process-Constrained Self-Evolution for Evidence-Grounded Clinical Interact…
arXiv cs.AI Research & Papers
Agent-G$^2$: Gaussian Guidance for Agentic Reinforcement Learning
arXiv cs.AI Research & Papers
Apodex 1.1: Scaling Agentic Intelligence for Complex Work
arXiv cs.AI Research & Papers
EviSafe: Evidence-Grounded Safety Evaluation for Vision-Language Models
arXiv cs.AI Research & Papers
Walking on the DARKSIDE
arXiv cs.AI Research & Papers
VisionCoach: Reinforcing Grounded Video Reasoning via Visual-Perception Prompting
arXiv cs.AI Research & Papers
AI emotional support is better only when chosen, but shifts preferences even when it is n…