Answer-then-Edit: Reasoning Skeleton Editing for Anti-Distillation with Preserved Utility
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
Preference Tuning as Spectral Update Reorganization
Same Dangerous Objective, Opposite Advice: Direct Exposure versus Multi-Agent Mediation
GuardianAgentBench: Where Agents Fail and How to Guard Them
Beyond Independent Optimization: Compression, MoE Routing, and Quantization Interactions …
Delivery, Not Storage: Cue-Anchored Working Memory as a Harness Property for Coding Agents
From Scalars to Time Series: Rethinking Implicit Neural Representations for Time-Varying …
SciExplore: Evaluating Autonomous Agents from Scientific Navigation to Information Integr…
PATS: Policy-Aware Training Scaffolding for Agentic Reinforcement Learning
Logical Regression for Planning with Axioms
Towards Faithful Graph Explanations with Synergistic Edge Effects via Granular Balls
DFAH-Bench: Benchmarking Observable Agent Instability in Financial Decision-Making
SafeStep: AI-powered Travel Assistance for Elderly People with Frailty or Dementia
Reliability-Aware LLM Alignment from Inconsistent Human Feedback
Constrained latent state modeling: A unifying perspective on representation learning unde…
Playing Along: Learning a Double-Agent Defender for Belief Steering via Theory of Mind
Spatially Grounded Concept Bottleneck Models for Trustworthy Breast Ultrasound Diagnosis
From Agent Failures to Text Policies: What Works and What Breaks
Multi-Task Learning for Heterogeneous Prediction from Video Game State with Transfer Lear…
LinearARD: Linear-Memory Attention Distillation for RoPE Restoration
slang.gr as a Large-Scale Crowdsourced Resource for Non-Standard Greek
Probabilistic Residual Learning for Online Recommendations
Benchmarking Unlearning for Vision Transformers
Multimodal Learning for Arcing Detection in Pantograph-Catenary Systems
NeuraLSP: A Neural Spectral Preconditioner for Accelerating PDE Solvers
Knowledge-Guided Time-Varying Causal Inference for Arctic Sea Ice Dynamics
StabilityBench: Benchmarking Instability in LLMs
Vision-Language-Policy Model for Dynamic Robot Task Planning
Minimum Bayes Risk Decoding for Error Span Detection in Reference-Free Automatic Machine …
TeaRAG: A Token-Efficient Agentic Retrieval-Augmented Generation Framework