Search-E1: Self-Distillation Drives Self-Evolution in Search-Augmented Reasoning
Explorar
Noticias de IA
21271 elementos — filtrados, clasificados y sin duplicados
Evaluating Sample Utility for Efficient Data Selection by Mimicking Model Weights
"Give Me BF16 or Give Me Death"? Accuracy-Performance Trade-Offs in LLM Quantization
Intelligent Offloading in Vehicular Edge Computing: A Comprehensive Review of Deep Reinfo…
XGrammar-2: Efficient Dynamic Structured Generation Engine for Agentic LLMs
Chain Of Thought Compression: A Theoretical Analysis
UCPO: Uncertainty-Aware Policy Optimization
Implementation of Big Data Analytics for Diabetes Management: Needs Assessment in the Rwa…
Diffuse to Detect: Generative Diffusion Models for Unsupervised IC Anomaly Detection
ReCA: Multi-Shot Long Video Extrapolation via Recursive Context Allocation
Aligning Few-Step Generative Models by Amortizing Sample-based Variational Inference
Bridging Control with Neural Network Verifier alpha-beta-CROWN: A Tutorial
Can LLMs Introspect? A Reality Check
Personalizing Embodied Multimodal Large Language Model Agents over Long-term User Interac…
Adaptive Multi-prompt Contrastive Network for Few-shot Out-of-distribution Detection
A Physics-Informed Hierarchical Neural Network for Microwave Scattering Analysis of 3D PE…
When LLMs Benchmark Themselves: Deconstructing Self-Bias in Automated Evaluation
Monte Carlo Permutation Search
SWAP: Towards Copyright Auditing of Soft Prompts via Sequential Watermarking
Spend Your Rollouts Where It Counts: Rollout Allocation for Group-Based RL Post-Training
More Expressive Feedforward Layers: Part I. Token-Adaptive Mixing of Activations
DynFrame: Adaptive Reasoning-Driven Multimodal Framework with Dynamic Frame Augmentation …
Beyond Trajectory-Level Attribution: Graph-Based Credit Assignment for Agentic Reinforcem…
Measuring Prediction Uncertainty in Neural Cellular Automata
ICCU: In-Context Continual Unlearning via Pattern-Induced Refusal Rules
Innovation: An Almost Characterization of Hallucination
Persistent AI Agents in Academic Research: A Single-Investigator Implementation Case Study
The Strongest Teacher Is Not Always the Best Teacher: Student-Centric Answer Selection
Governed Metaprogramming for Intelligent Systems: Reclassifying Eval as a Governed Effect
Post-training makes large language models less human-like