Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
When Does Muon Help Agentic Reinforcement Learning?
arXiv cs.AI Research & Papers
Evaluating Open-Weight LLMs for Generating Structured Threat Information for Autonomous V…
arXiv cs.AI Research & Papers
A Neuro-Symbolic Approach for Probabilistic Reasoning on Graph Data
arXiv cs.AI Research & Papers
IMBench: A Benchmark for Intuitive Robotic Manipulation
arXiv cs.AI Research & Papers
A Systematic Study of Large Language Models for Task and Motion Planning With PDDLStream
arXiv cs.AI Research & Papers
RL-Struct: A Lightweight Reinforcement Learning Framework for Reliable Structured Output …
arXiv cs.AI Research & Papers
RAD: Retrieval High-quality Demonstrations to Enhance Decision-making
arXiv cs.AI Research & Papers
Orbis 2: A Hierarchical World Model for Driving
arXiv cs.AI Research & Papers
Human-Aligned Procedural Level Generation Reinforcement Learning via Text-Level-Sketch Sh…
arXiv cs.AI Research & Papers
Mechanistic Interpretability of Cognitive Complexity in LLMs via Linear Probing using Blo…
arXiv cs.AI Research & Papers
UCOB: Learning to Utilize and Evolve Agentic Skills via Credit-Aware On-Policy Bidirectio…
arXiv cs.AI Research & Papers
When Not to Automate: A Formal Protocol for Human Preservation in AI-Optimized Organizati…
arXiv cs.AI Research & Papers
Design-Based Supervised Learning with Noisy Human Labels
arXiv cs.AI Research & Papers
Code-MUE: Measuring Code LLMs' Uncertainty through Execution-based Semantic Interaction G…
arXiv cs.AI Research & Papers
The AI Fiction Paradox
arXiv cs.AI Research & Papers
SciVisAgentBench: A Benchmark for Evaluating Scientific Data Analysis and Visualization A…
arXiv cs.AI Research & Papers
Robustness of Reinforcement Learning-Based Congestion Management in Low-Voltage Grids
arXiv cs.AI Research & Papers
Candidate Attended Dialogue State Tracking Using BERT
arXiv cs.AI Research & Papers
Precise but Uncoupled: Reviewer Precision Does Not Guarantee Critique Uptake in Multi-Age…
arXiv cs.AI Research & Papers
FAIR_XAI: Improving Multimodal Foundation Model Fairness via Explainability for Wellbeing…
arXiv cs.AI Research & Papers
ACPO: Agent-Chained Policy Optimization for Multi-Agent Reinforcement Learning
arXiv cs.AI Research & Papers
Do Coding Agents Need Executable World Models, Simplification, and Verification to Solve …
arXiv cs.AI Research & Papers
From Black Box to Executable Logic: Explainable Reinforcement Learning through Prolog Exp…
arXiv cs.AI Research & Papers
SeerGuard: A Safety Framework for Mobile GUI Agents via World Model Prediction
arXiv cs.AI Research & Papers
Long-Context Fine-Tuning with Limited VRAM
arXiv cs.AI Research & Papers
MirrorCode: AI can rebuild entire programs from behavior alone
arXiv cs.AI Research & Papers
Why do CNNs excel at feature extraction? A mathematical explanation
arXiv cs.AI Research & Papers
Are Heterogeneous Graph Neural Networks Truly Effective for Node Classification? A Causal…
arXiv cs.AI Research & Papers
CTC: The Composite Task Challenge for Cooperative Multi-Agent Reinforcement Learning
arXiv cs.AI Research & Papers
MaxSAT-Based Feedback for Guiding Vision-Language Models in Sudoku