Explorar

Noticias de IA

22108 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
MemToolAgent overview with a simple restaurant booking scenario where the agent retrieves…
arXiv cs.AI Research & Papers
Contract2Tool: Learning Preconditions and Effects for Reliable Tool-Augmented LLM Agents
arXiv cs.AI Research & Papers
Safety is Contextual, LLM-Judges Are Not: Navigating the Rigid Priors of Evaluators
arXiv cs.AI Research & Papers
Joint Structural Pruning and Mixed-Precision Quantization for LLM Compression
arXiv cs.AI Research & Papers
Where Instruction Hierarchy Breaks: Diagnosing and Repairing Failures in Reasoning Langua…
arXiv cs.AI Research & Papers
Improving Multimodal Reasoning via Worst Dimension Optimization
arXiv cs.AI Research & Papers
Land cover and flood type govern the detection limits of satellite-based flood mapping ac…
arXiv cs.AI Research & Papers
Automatic Extraction of Structured Information from Brain MRI Reports Using an Open-Weigh…
arXiv cs.AI Research & Papers
Why Limit the Residual Stream to Layers and Not Tokens? Persistent Memory for Continuous …
arXiv cs.AI Research & Papers
Trait-space Monitoring for Emergent Misalignment During Supervised Finetuning
arXiv cs.AI Research & Papers
Active Learning with Foundation Model Priors: Efficient Learning under Class Imbalance
arXiv cs.AI Research & Papers
HASA: Subnet Allocation for Compute-Constrained Model-Heterogeneous Federated Learning
arXiv cs.AI Research & Papers
ScaleSweep: Accurate NVFP4 Post-Training Quantization of LLMs via Block Scale Initializat…
arXiv cs.AI Research & Papers
No Free Lunch for Synthetic Images under Data Scarcity Conditions
arXiv cs.AI Research & Papers
NeuroAlign: Hierarchical Multimodal Fusion of Dynamic and Structural Neuroimaging for MCI…
arXiv cs.AI Research & Papers
Beyond Goodhart's Law: A Dynamic Benchmark for Evaluating Compliance in Multi-Agent Syste…
arXiv cs.AI Research & Papers
Reconstructing and forecasting disease trajectories of patients with Alzheimer's disease …
arXiv cs.AI Research & Papers
Syll: Open-Source Personal Automation with Cross-Surface Execution
arXiv cs.AI Research & Papers
SmartMixed: A Two-Phase Training Strategy for Adaptive Activation Function Learning in Ne…
arXiv cs.AI Research & Papers
DeltaBox: Scaling Stateful AI Agents with Millisecond-Level Sandbox Checkpoint/Rollback
arXiv cs.AI Research & Papers
FormalASR: End-to-End Spoken Chinese to Formal Text
arXiv cs.AI Research & Papers
LEAP: Learnable End-to-End Adaptive Pruning of Large Language Models
arXiv cs.AI Research & Papers
TempoBench: Evaluating Temporal Causal Reasoning in Large Language Models
arXiv cs.AI Research & Papers
CLPO: Curriculum Learning meets Policy Optimization for LLM Reasoning
arXiv cs.AI Research & Papers
Sound and Complete Neurosymbolic Reasoning with LLM-Grounded Interpretations
arXiv cs.AI Research & Papers
IDEQ -- Improving Diffusion Models for the Traveling Salesman Problem (TSP) by Leveraging…
arXiv cs.AI Research & Papers
A Survey on Large Language Model-Based Game Agents
arXiv cs.AI Research & Papers
APEX: Large-scale Multi-task Aesthetic-Informed Popularity Prediction for AI-Generated Mu…
arXiv cs.AI Research & Papers
Learning Behavioral Signals from Encrypted Smartphone Network Traffic
arXiv cs.AI Research & Papers
DynamicPO: Dynamic Preference Optimization for Recommendation