DRL-Driven Edge-Aware Utility Optimization for Multi-Slice 6G Networks
Explorar
Noticias de IA
37834 elementos — filtrados, clasificados y sin duplicados
ZipMoE: Efficient On-Device MoE Serving via Lossless Compression and Cache-Affinity Sched…
Anytime Training with Schedule-Free Spectral Optimization
Metacognition as Reward: Reinforcing LLM Reasoning via Knowledge and Regulation Signals
CHASD: Language Increment-Calibrated Contrastive Decoding against Hallucination in LVLMs
Dreaming Smoothly and Sample Efficiently with Gradient Penalized Latent Dynamics
TingIS: Real-time Risk Event Discovery from Noisy Customer Incidents at Enterprise Scale
CoReVAD: A Contextual Reasoning Framework for Training-Free Video Anomaly Detection
Empowering 9-1-1 Calltaking Training with Generative AI: Experiences and Lessons Learned
Robots That Know What to Ask: Recovering Misaligned Rewards through Targeted Explanations
Dithering Defense: Adversarial Robustness of Vision Foundation Models via Multi-Level Flo…
Tabular PDF Information Extraction with Local LLMs and Layout-Aware Parsing: A Reliabilit…
More Context, Larger Models, or Moral Knowledge? A Systematic Study of Schwartz Value Det…
Security of LLM-generated Code: A Comparative Analysis
SimInsert: Seamless Video Object Insertion via Regional Sparse Attention Fusion
Agentic-VLA: Efficient Online Adaptation for Vision-Language-Action Models
VI-CuRL: Stabilizing Verifier-Independent RL Reasoning via Confidence-Guided Variance Red…
DiLaDiff: Distilled Latent-Augmented Diffusion for Language Modeling
Every Component is a Lookup: Token Attribution and Composition from a Single Decomposition
Beyond VLM-Based Rewards: Diffusion-Native Latent Reward Modeling
ArcMark: Distortion-Free Multi-Byte LLM Watermark via Optimal Transport
PoisonForge: Task-Level Targeted Poisoning Benchmark for Instruction-Tuned LLMs
Enhancing Deep Neural Network Reliability with Refinement and Calibration
Convergence Without Understanding: When Language Models Agree on Representations but Disa…
Test-Time Training Undermines Safety Guardrails
Score-Based One-step MeanFlow Policy Optimization
PaP-NF: Probabilistic Long-Term Time Series Forecasting via Prefix-as-Prompt Reprogrammin…
Multi-Gate Residuals
Preisach Attention: A Hysteretic Model of Sequential Memory
When Good Equations Get Bad Scores: Improving Symbolic Regression Through Better Paramete…