From Multi-Agent to Single-Agent: When Is Skill Distillation Beneficial?
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
Agent psychometrics: Task-level performance prediction in agentic coding benchmarks
Just A Rather Very Intelligent Spoken Agent
A Research Prototype for Closed-Loop Generative Design of Customized Foot Orthoses via Se…
Exact Network Surgery: Functional Invariance and Gradient Plasticity in Reactive Computat…
Sparse Evidence Can Suffice: Agentic Evidence Seeking for Multimodal Video Misinformation…
The Failures of Marginal Influence-Based Attribution Methods for Global Time Series Expla…
OpenMHC: Accelerating the Science of Wearable Foundation Models
Generalize and Guide: Decomposing Rewards for Few-Shot Inverse Reinforcement Learning
Generalised Bellman recurrence and three dualities in sequential decision-making
SGN: A Similarity-based Generative Network for Data Generation under Distribution Shift
ETAS: An Effect-Typed Language for Agent Systems
From Modalities to Propositions: A Language-Centric Framework for Multimodal Intelligence
Nonuniformity Principle in Human-AI Coworking
Lil: Less is Less When Applying Post-Training Sparse-Attention Algorithms in Long-Decode …
Autoresearch with Coding Agents: Generalizers and Metric-Maximizers on Quran Recitation D…
Seg2Grasp: A Robust Modular Suction Grasping in Bin Picking
DA-Fusion: Deformable Attention-Based RGB-D Fusion Transformer for Unseen Object Instance…
Capacity and Redundancy Trade-offs in Multi-Task Learning
SEER: Supervised Learning to Control Energetic Reasoning
Can Interpretation Predict Behavior on Unseen Data?
CARV: A Diagnostic Benchmark for Compositional Analogical Reasoning in Multimodal LLMs
Depth Estimators Are Implicit Neural Fields for 3D Scene Geometry Inpainting and Reconstr…
From Outcomes to Actions: Leveraging Hindsight for Long-Horizon Language Agent Training
Feature Generation Using LLMs: An Evolutionary Algorithm Approach
Comprehensive Evaluation of Machine Learning for Type 2 Diabetes Risk Prediction: Large-S…
SOS-LoRA: Static Orthogonal-Subspace Low-Rank Adaptation with Fixed Multi-Scale Scaling
Normalized Rewards for Preference Optimization
Diffusion-corrected Autoregressive Fourier Neural Operator for Droplet Evolution Predicti…
Quantizing Recursive Reasoning Models