Explorar

Noticias de IA

29655 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
MARFT: Multi-Agent Reinforcement Fine-Tuning
arXiv cs.AI Research & Papers
T1: Tool-integrated Verification for Test-time Compute Scaling in Small Language Models
arXiv cs.AI Research & Papers
Deft Scheduling of Dynamic Cloud Workflows with Varying Deadlines via Mixture-of-Experts
arXiv cs.AI Research & Papers
Ideas in Inference-time Scaling can Benefit Generative Pre-training Algorithms
arXiv cs.AI Research & Papers
Skill-Based Mixture-of-Experts: Adaptive Routing for Heterogeneous Reasoning via Inferred…
arXiv cs.AI Research & Papers
Efficient LLM Moderation with Multi-Layer Latent Prototypes
arXiv cs.AI Research & Papers
ShapeLib: Designing a library of programmatic 3D shape abstractions with Large Language M…
arXiv cs.AI Research & Papers
Introduction to Graph Neural Networks for Machine Learning Engineers
arXiv cs.AI Research & Papers
Self-supervised Monocular Depth and Pose Estimation for Endoscopy with Latent Priors
arXiv cs.AI Research & Papers
Herculean: An Agentic Benchmark for Financial Intelligence
arXiv cs.AI Research & Papers
Implicit Regularization for Multi-label Feature Selection
arXiv cs.AI Research & Papers
Recent Advances in Multi-modal 3D Intelligence: A Comprehensive Survey and Evaluation
arXiv cs.AI Research & Papers
DeepIPCv2: LiDAR-powered Robust Environmental Perception and Navigational Control for Aut…
arXiv cs.AI Research & Papers
Can LLM Agents Sustain Long-Horizon Organizational Dynamics?
arXiv cs.AI Research & Papers
Tree-Structured Parzen Estimator: Understanding Its Algorithm Components and Their Roles …
arXiv cs.AI Research & Papers
c-TPE: Tree-structured Parzen Estimator with Inequality Constraints for Expensive Hyperpa…
arXiv cs.AI Research & Papers
Emergent Ordinal Geometry in Transformers Trained on Local Comparisons
arXiv cs.AI Research & Papers
Dive into Ambiguity: A*-Inspired Multi-Agents Commonsense Obfuscation Attack on LLM Promp…
arXiv cs.AI Research & Papers
TRON: Targeted Rule-Verifiable Online Environments for Visual Reasoning RL
arXiv cs.AI Research & Papers
ReSkill: Reconciling Skill Creation with Policy Optimization in Agentic RL
arXiv cs.AI Research & Papers
PEACE: A Planner-Executor Agent with Constraint Enforcement for UAVs
arXiv cs.AI Research & Papers
Versatile Framework with Semantic and Structural guidance for Image Reconstruction from B…
arXiv cs.AI Research & Papers
Hot-Start Chinese Language Modeling:Visual Glyphs Accelerate Sample-Efficient Learning
arXiv cs.AI Research & Papers
MASCOT: Towards Multi-Agent Socio-Collaborative Companion Systems
arXiv cs.AI Research & Papers
A Monosemantic Attribution Framework for Stable Interpretability in Clinical Neuroscience…
arXiv cs.AI Research & Papers
Towards a General Intelligence and Interface for Wearable Health Data
arXiv cs.AI Research & Papers
LLM-Guided Communication for Cooperative Multi-Agent Reinforcement Learning
arXiv cs.AI Security & Safety
Ethical Hyper-Velocity (EHV): A Hardware-Rooted Zero-Trust Runtime Enforcement Architectu…
arXiv cs.AI Research & Papers
Evaluating Deep Research Agents on Expert Consulting Work: A Benchmark with Verifiers, Ru…
arXiv cs.AI Research & Papers
Structured Visual Evidence Decomposition for Evidence-Grounded Multimodal Screening of Ob…