Metacognition as Reward: Reinforcing LLM Reasoning via Knowledge and Regulation Signals
Browse
AI News
30934 items — filtered, classified, deduplicated
SSDAU: Structured Semantic Data Augmentation for Joint Entity and Relation Extraction
GENSTRAT: Toward a Science of Strategic Reasoning in Large Language Models
Design and Report Benchmarks for Knowledge Work
Human-in-the-Loop Multi-Agent Ventilator Decision Support with Contextual Bandit Preferen…
MemAudit: Post-hoc Auditing of Poisoned Agent Memory via Causal Attribution and Structura…
Learning Individual Dynamics from Sparse Cross-Sectional Snapshots
When Do LLMs Reason? A Dynamical Systems View via Entropy Phase Transitions
DRL-Driven Edge-Aware Utility Optimization for Multi-Slice 6G Networks
Anytime Training with Schedule-Free Spectral Optimization
Dreaming Smoothly and Sample Efficiently with Gradient Penalized Latent Dynamics
CoReVAD: A Contextual Reasoning Framework for Training-Free Video Anomaly Detection
Dithering Defense: Adversarial Robustness of Vision Foundation Models via Multi-Level Flo…
Security of LLM-generated Code: A Comparative Analysis
SimInsert: Seamless Video Object Insertion via Regional Sparse Attention Fusion
PoisonForge: Task-Level Targeted Poisoning Benchmark for Instruction-Tuned LLMs
Enhancing Deep Neural Network Reliability with Refinement and Calibration
Score-Based One-step MeanFlow Policy Optimization
PaP-NF: Probabilistic Long-Term Time Series Forecasting via Prefix-as-Prompt Reprogrammin…
Multi-Gate Residuals
Coloring the Noise: Adversarial Sobolev Alignment for Faithful Image Super Resolution
Reinforcement Learning for Microcanonical Graph Ensemble with Assortativity Constraints
Curriculum reinforcement learning with measurable task representation learning
Parametric Prior Mapping Framework for Non-stationary Probabilistic Time Series Forecasti…
Socially fluent AI decouples conversational signals from source identity in online intera…
Reflex: Reinforcement Learning with Reflection Symmetry Exploitation in State-Based Conti…
Deja Vu in Plots: Leveraging Cross-Session Evidence with Retrieval-Augmented LLMs for Liv…
Epistemic Skills: Reasoning about Knowledge and Oblivion
Automated Random Embedding for Practical Bayesian Optimization with Unknown Effective Dim…
Leveraging Foundation Models for Causal Generative Modeling