Interpretable Policy Distillation for Power Grid Topology Control
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
CodeCytos: AI-assisted spatial molecular imaging analysis via code-augmented agent action…
PR2: Predictive Routing Replay for MoE-Based LLM Reinforcement Learning
Detector-Evasive LLM Paraphrasing via Constrained Policy Optimization
(HB-ARFM) History-Bootstrapped Flow Matching for Inverse Boiling Reconstruction
Isolating LLM Lexical Bias: A Curation-Free Triangulated Metric for Preference-Stage Lear…
FALAT: Tracing Failures in LLM Agent Trajectories via Dependency-Guided Search
ARCA: Adapter-Residual Credit Assignment When Token Signals Degenerate
Continuous Reasoning for Vision-Language-Action
BAGEN: Are LLM Agents Budget-Aware?
MyoSem: Aligning Electromyography to Natural-Language Action Semantics for Hand Action Un…
Multi-Contrast MRI Motion Correction via Parameter-Informed Disentanglement and Adaptive …
Universal Quantum Transformer
TIGER: Traceable Inference with Graph-Based Evidence Routing for Mitigating Hallucination…
Geodesics with Unified Tangent-constrained Priors and Curvature Regularization
On Effectiveness and Efficiency of Agentic Tool-calling and RL Training
VDSB-GWSyn: Diffusion Schr\"{o}dinger Bridge for Controllable and Anatomically Feasible G…
Motif-based morphology signatures for interpretable ECG screening and monitoring
CoilDrop-MRI: Self-supervised physics-guided MRI reconstruction with coil dropout
Silent Failures in Physical AI: A Literature Review of Runtime Action Authorization for A…
From Demonstrations to Rewards: Test-Time Prompt Optimization for VLM Reward Models
BitsMoE: Efficient Spectral Energy-Guided Bit Allocation for MoE LLM Quantization
Improved Belief-Attention in Vision Task
Update Opacity: Epistemic Accessibility and Governance Under AI System Change
TrustLDM: Benchmarking Trustworthiness in Language Diffusion Models
CSRP: Chain-of-Thought Reasoning for Chinese Text Correction via Reinforcement Learning w…
A Lightweight Deep Learning-based Model for Ranking Influential Nodes in Complex Networks
AGENTCL: Toward Rigorous Evaluation of Continual Learning in Language Agents
Bridging the Sim-to-Real Gap in Semiconductor Visual Program Synthesis via Input Binariza…
Spatial Representation Learning Beyond Pixels: Unifying Raster Data and Vector Semantics …