Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Bridging Evolutionary Algorithms and Reinforcement Learning: A Comprehensive Survey on Hy…
arXiv cs.AI Research & Papers
Fusion Embedding for Pose-Guided Person Image Synthesis with Diffusion Model
arXiv cs.AI Research & Papers
Filtered Posterior Mean Collections: A Unified Framework for Analytical Models of Diffusi…
arXiv cs.AI Research & Papers
Pragmatic Reasoning improves LLM Code Generation
arXiv cs.AI Research & Papers
PhySense: Sensor Placement Optimization for Accurate Physics Sensing
arXiv cs.AI Research & Papers
Reward-free Alignment for Conflicting Objectives
arXiv cs.AI Research & Papers
MultiPhishGuard: An Explainable and Adaptive Multi-Agent LLM System for Phishing Email De…
arXiv cs.AI Research & Papers
ClaimDiff-RL: Fine-Grained Caption Reinforcement Learning through Visual Claim Comparison
arXiv cs.AI Security & Safety
SoK: A Comprehensive Security Analysis of Jailbreak Resilience in GPT and DeepSeek Models
arXiv cs.AI Research & Papers
FLoRIST: Singular Value Thresholding for Efficient and Accurate Federated Fine-Tuning of …
arXiv cs.AI Research & Papers
Agent Primitives: Reusable Latent Building Blocks for Multi-Agent Systems
arXiv cs.AI Research & Papers
Understanding Data Temporality Impact on Large Language Models Pre-training
arXiv cs.AI Research & Papers
Adaptive Human-AI Coordination via Hierarchical Action Disentanglement
arXiv cs.AI Research & Papers
Beyond Final Answers: Auditing Trajectory-Level Hallucinations in Multi-Agent Industrial …
arXiv cs.AI Research & Papers
TimeGuard: Channel-wise Pool Training for Backdoor Defense in Time Series Forecasting
arXiv cs.AI Research & Papers
A Sober Look at Agentic Misalignment in Automated Workflows
arXiv cs.AI Research & Papers
MAPLE: Multi-State Aggregated Policy Evaluation for AlphaZero in Imperfect-Information Ga…
arXiv cs.AI Research & Papers
Look-Closer-Then-Diagnose: Confidence-Aware Ultrasound VQA via Active Zooming
arXiv cs.AI Research & Papers
The Devil is in the Condition Numbers: Why is GLU Better than non-GLU Structure?
arXiv cs.AI Research & Papers
BEAR: Towards Beam-Search-Aware Optimization for Recommendation with Large Language Models
arXiv cs.AI Research & Papers
CounterFlow: A Two-Phase Inference-Time Sampling for Counterfactual Video Foley Generation
arXiv cs.AI Research & Papers
A Simplex Witness Certificate for Constant Collapse in Variational Autoencoders
arXiv cs.AI Research & Papers
AME-TS: Anchored Mixture-of-Experts for Time Series Forecasting
arXiv cs.AI Research & Papers
RecGOAT: Graph Optimal Adaptive Transport for LLM-Enhanced Multimodal Recommendation with…
arXiv cs.AI Research & Papers
BacktestBench: Benchmarking Large Language Models for Automated Quantitative Strategy Bac…
arXiv cs.AI Research & Papers
Learning Selective Merge Policies for Deadline-Constrained Coded Caching via Deep Reinfor…
arXiv cs.AI Research & Papers
HEPA: A Self-Supervised Horizon-Conditioned Event Predictive Architecture for Time Series
arXiv cs.AI Research & Papers
Intelligent Truck Matching in Full Truckload Shipments using Ping2Hex approach
arXiv cs.AI Research & Papers
Internalizing Outcome Supervision into Process Supervision: A New Paradigm for Reinforcem…
arXiv cs.AI Security & Safety
Sparse Tokens Suffice: Jailbreaking Audio Language Models via Token-Aware Gradient Optimi…