MemToolAgent overview with a simple restaurant booking scenario where the agent retrieves…
Explorar
Noticias de IA
22108 elementos — filtrados, clasificados y sin duplicados
Contract2Tool: Learning Preconditions and Effects for Reliable Tool-Augmented LLM Agents
Safety is Contextual, LLM-Judges Are Not: Navigating the Rigid Priors of Evaluators
Joint Structural Pruning and Mixed-Precision Quantization for LLM Compression
Where Instruction Hierarchy Breaks: Diagnosing and Repairing Failures in Reasoning Langua…
Improving Multimodal Reasoning via Worst Dimension Optimization
Land cover and flood type govern the detection limits of satellite-based flood mapping ac…
Automatic Extraction of Structured Information from Brain MRI Reports Using an Open-Weigh…
Why Limit the Residual Stream to Layers and Not Tokens? Persistent Memory for Continuous …
Trait-space Monitoring for Emergent Misalignment During Supervised Finetuning
Active Learning with Foundation Model Priors: Efficient Learning under Class Imbalance
HASA: Subnet Allocation for Compute-Constrained Model-Heterogeneous Federated Learning
ScaleSweep: Accurate NVFP4 Post-Training Quantization of LLMs via Block Scale Initializat…
No Free Lunch for Synthetic Images under Data Scarcity Conditions
NeuroAlign: Hierarchical Multimodal Fusion of Dynamic and Structural Neuroimaging for MCI…
Beyond Goodhart's Law: A Dynamic Benchmark for Evaluating Compliance in Multi-Agent Syste…
Reconstructing and forecasting disease trajectories of patients with Alzheimer's disease …
Syll: Open-Source Personal Automation with Cross-Surface Execution
SmartMixed: A Two-Phase Training Strategy for Adaptive Activation Function Learning in Ne…
DeltaBox: Scaling Stateful AI Agents with Millisecond-Level Sandbox Checkpoint/Rollback
FormalASR: End-to-End Spoken Chinese to Formal Text
LEAP: Learnable End-to-End Adaptive Pruning of Large Language Models
TempoBench: Evaluating Temporal Causal Reasoning in Large Language Models
CLPO: Curriculum Learning meets Policy Optimization for LLM Reasoning
Sound and Complete Neurosymbolic Reasoning with LLM-Grounded Interpretations
IDEQ -- Improving Diffusion Models for the Traveling Salesman Problem (TSP) by Leveraging…
A Survey on Large Language Model-Based Game Agents
APEX: Large-scale Multi-task Aesthetic-Informed Popularity Prediction for AI-Generated Mu…
Learning Behavioral Signals from Encrypted Smartphone Network Traffic
DynamicPO: Dynamic Preference Optimization for Recommendation