Mode-Dependent Rectification for Stable PPO Training
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
VisAdj: Learning Adjacency Matrices from Node-Link Images
Crossing the Margin Cliff: Toward Relearn-Robust LLM Unlearning via Margin Calibration
Beyond Benchmarks: LLM Evaluation with an Anthropomorphic and Lifecycle-oriented Roadmap
Text-ADBench: Text Anomaly Detection Benchmark Based on LLM Embeddings
AgentWeave: Routing Before Reasoning for Efficient Function Calling in Tool-Rich Language…
Diagnosing Capability Preservation and Task Sensitivity in Memory Augmented Document Clas…
Towards Safer Social Media Platforms: Scalable and Performant Few-Shot Harmful Content Mo…
Prime Agent: A Self-Improving RLM Harness
The Measurement Revolution? Credible Measurement and Inference in the Age of AI
Unlearning Is Not Just Erasing: Temporal Decoupling via Generation Inequality
The Mask Is Not the Model: Auditing Prefix Invariance in Attention, State-Space, and Hybr…
Search Broadly, Seek Evidence on Both Sides, Decide Narrowly: Evidence-Admissible GraphRA…
Read Less, Solve More: Token-Efficient Sparse Reading for AI Agents
Molecular LLM Agents: From Architectural Design to Scientific Autonomy
DeMixPert: Decomposed Response Modeling with Gaussian Mixtures for OOD Single-Cell Pertur…
Weakly supervised concept Bottleneck Learning for Robust Two stage Object centric visual …
Beyond Two Bytes per Letter: Tokenization Overhead in Cyrillic AI Systems
SPAR-Hate: An Auditor-Guided Multi-Agent Framework for Bilingual Hate Speech Parsing
Constructing Predictive Surgical Path for AI-based Capsulorhexis Skill Transfer
Deep Learning-Driven Inverse Design of Doherty Power Amplifiers Using Pixelated Combiners…
VisionCoach: Reinforcing Grounded Video Reasoning via Visual-Perception Prompting
Semantic Reasoning Denoising: Correcting Language Model Reasoning with Semantic Operators
HiMA-MDD: A Hierarchical Multi-Agent Harness for Interpretable Multimodal Depression Dete…
Evaluating SAT Solver Metrics as Predictors of Human-Perceived Nonogram Difficulty
SEAM: Shot Entity-Attribute Memory for Consistent Short-Drama Generation at Scale
What Models Know, How Well They Know It: Knowledge-Weighted Fine-Tuning for Learning When…
Aligning Human Sense: Calibrated Distributional Reward Learning for Video Generation
A Scalable Vector Graphics Latent Space
ReWorld: An Interactive World Model with Long-Horizon Memory