Explorar

Noticias de IA

29670 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Exploring Accurate and Transparent Domain Adaptation in Predictive Healthcare via Concept…
arXiv cs.AI Research & Papers
TaCarla: A comprehensive benchmarking dataset for end-to-end autonomous driving
arXiv cs.AI Research & Papers
Quantifying Uncertainty in AI Visibility: A Statistical Framework for Generative Search M…
arXiv cs.AI Research & Papers
Reasoning over Semantic IDs Enhances Generative Recommendation
arXiv cs.AI Research & Papers
The Model Says Walk: How Surface Heuristics Override Implicit Constraints in LLM Reasoning
arXiv cs.AI Research & Papers
SAFE: An LLM-as-Verifier Framework for Evidence-Grounded Multi-Hop Reasoning
arXiv cs.AI Research & Papers
Prosociality by Coupling, Not Mere Observation: Homeostatic Sharing in an Inspectable Rec…
arXiv cs.AI Research & Papers
Beyond Single-Model Optimization: Preserving Plasticity in Continual Reinforcement Learni…
arXiv cs.AI Research & Papers
GCA Framework: A GCC Countries-Grounded Dataset and Agentic Pipeline for Climate Decision…
arXiv cs.AI Research & Papers
People-Centred Medical Image Analysis via Fairness-Aware Human-AI Cooperation
arXiv cs.AI Research & Papers
Communication Dynamics Neural Networks: FFT-Diagonalized Layers for Improved Hessian Cond…
arXiv cs.AI Research & Papers
RAG over Thinking Traces Can Improve Reasoning Tasks
arXiv cs.AI Research & Papers
ActiveMem: Distributed Active Memory for Long-Horizon LLM Reasoning
arXiv cs.AI Research & Papers
One Token per Multimodal Evidence: Latent Memory for Resource-Constrained QA
arXiv cs.AI Research & Papers
Infini Memory: Maintainable Topic Documents for Long-Term LLM Agent Memory
arXiv cs.AI Research & Papers
The Arbiter Agent: Continually Monitoring Multi-Agent Conversations to Detect Emergent Mi…
arXiv cs.AI Research & Papers
AutoPDE: Reliable Agentic PDE Solving via Explicitly Represented Solver Strategies
arXiv cs.AI Research & Papers
Accelerating NeurASP with vectorization and caching
arXiv cs.AI Research & Papers
Moonshine: An Autonomous Mathematical Research Agent Centered on Conjecture Generation
arXiv cs.AI Research & Papers
Do VLMs Reason Like Engineers? A Benchmark and a Stage-wise Evaluation
arXiv cs.AI Research & Papers
Large-scale semantic mapping of learner agency and autonomy reveals what measurement and …
arXiv cs.AI Research & Papers
Role-Agent: Bootstrapping LLM Agents via Dual-Role Evolution
arXiv cs.AI Research & Papers
Frontier Coding Agents Use Metaprogramming to Adapt to Unfamiliar Programming Languages
arXiv cs.AI Research & Papers
Culturally-Aware AI for Cross-Boundary Community Learning: Undergraduate Innovation at th…
arXiv cs.AI Research & Papers
Agentic Social Affordance Framework (ASAF): Agent Identity Design as a Collaboration Inte…
arXiv cs.AI Research & Papers
Reasoning or Memorization? Direction-Aware Diversity Exploration in LLM Reinforcement Lea…
arXiv cs.AI Research & Papers
ReflectiChain: Epistemic Grounding in LLM-Driven World Models for Supply Chain Resilience
arXiv cs.AI Research & Papers
Belief-Space Control for Personalized Cancer Treatment via Active Inference
arXiv cs.AI Research & Papers
Instruction Finetuning DeepSeek-R1-8B Model Using LoRA and NEFTune
arXiv cs.AI Research & Papers
STAGE-Claw: Automated State-based Agent Benchmarking for Realistic Scenarios