Explorar

Noticias de IA

29666 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Instruction Finetuning DeepSeek-R1-8B Model Using LoRA and NEFTune
arXiv cs.AI Research & Papers
STAGE-Claw: Automated State-based Agent Benchmarking for Realistic Scenarios
arXiv cs.AI Research & Papers
A Unified Multi-Modal Framework for Intelligent Financial Systems: Integrating Reinforcem…
arXiv cs.AI Research & Papers
Soul Computing: A Theoretical Framework and Technical Architecture for Intelligent Agents…
arXiv cs.AI Research & Papers
Trace2Policy: From Expert Behavior Traces to Self-Evolving Decision Agents
arXiv cs.AI Research & Papers
ComBench: A Benchmark for Rigorous Proof Reasoning and Constructive Realization in Olympi…
arXiv cs.AI Research & Papers
A complementary study on PlanGPT: Evaluation with defined Performance Metrics and compari…
arXiv cs.AI Research & Papers
Cross-Modal Knowledge Distillation without Paired Data: Theoretical Foundation and Algori…
arXiv cs.AI Research & Papers
From Context-Aware to Conflict-Aware: Generalizing Contrastive Decoding for Knowledge Con…
arXiv cs.AI Research & Papers
What Spatial Memory Must Store: Occlusion as the Test for Language-Agent Memory
arXiv cs.AI Research & Papers
TD-Grokking: Learning from Zero-Reward Problems by Training-Time Decomposition
arXiv cs.AI Research & Papers
WorldKernel: A World Model is the Coupling Kernel of Admissible Possible Worlds
arXiv cs.AI Research & Papers
Architect-Ant: Editable Automatic Furnishing of Architectural Floor Plans
arXiv cs.AI Research & Papers
Mind the Gap: Can Frontier LLMs Pass a Standardized Office Proficiency Exam?
arXiv cs.AI Research & Papers
Bellman-Taylor Score Decoding for Markov Decision Processes with State-Dependent Feasible…
arXiv cs.AI Research & Papers
Superficial Beliefs in LLM Decision-Making
arXiv cs.AI Research & Papers
Workflow-GYM: Towards Long-Horizon Evaluation of Computer-use Agentic tasks in Real-World…
arXiv cs.AI Research & Papers
What Fits (Into Few Tokens) Doesn't Overfit: Compression and Generalization in ML Researc…
arXiv cs.AI Research & Papers
Monte Carlo Pass Search: Using Trajectory Generation for 3D Counterfactual Pass Evaluatio…
arXiv cs.AI Research & Papers
ReasonAlloc: Hierarchical Decoding-Time KV Cache Budget Allocation for Reasoning Models
arXiv cs.AI Research & Papers
Failure Modes of Deep Multi-Agent RL in Asynchronous Pricing: Reproducible Triggers, Trac…
arXiv cs.AI Research & Papers
PreAct-Bench: Benchmarking Predictive Monitoring in LLMs
arXiv cs.AI Research & Papers
Tractogram foundation model
arXiv cs.AI Research & Papers
HMAF: A Hierarchical Multi-Slot GD-RTB Allocation Framework
arXiv cs.AI Research & Papers
LongMoE: Longitudinal Multimodal Learning via Trajectory-Aware Mixture-of-Experts
arXiv cs.AI Research & Papers
Bypassing Copyright Protection in Diffusion-based Customization via Two-Stage Latent Feat…
arXiv cs.AI Research & Papers
Mix, Don't Pick: Why Synthetic Corpus Composition Matters for Time Series Foundation Mode…
arXiv cs.AI Research & Papers
Anomaly Detection and Root Cause Analysis for Microservice Systems
arXiv cs.AI Research & Papers
Co-GLANCE: Uncertainty-Aware Active Perception for Heterogeneous Robot Teaming
arXiv cs.AI Research & Papers
Conformal Prediction for Neural Operators: Distribution-Free Uncertainty Quantification i…