Internal Pluralism and the Limits of Pairwise Comparisons
Explorar
Noticias de IA
30934 elementos — filtrados, clasificados y sin duplicados
dOPSD: On-Policy Self-Distillation for Diffusion Language Models
evalci: A Python Library for Statistically Rigorous Comparison of Language Model Evaluati…
Boosting Automatic Exercise Evaluation Through Musculoskeletal Simulation-Based IMU Data …
BoRP: Bootstrapped Regression Probing for Scalable and Human-Aligned LLM Evaluation
Machine Unlearning via Information Theoretic Regularization
The Rise of Large Language Models and the Direction and Impact of US Federal Research Fun…
Tracing 3D Anatomy in 2D Strokes: A Multi-Stage Projection Driven Approach to Cervical Sp…
Predicting Biased Human Decision-Making with Large Language Models in Conversational Sett…
One Prompt, Many Sounds: Modeling Listener Variability in LLM-Based Equalization
Motion Attribution for Video Generation
Attention-Guided Efficientnet Architecture For Precise Criminal Identification in Surveil…
Flow-A11y: Flow-Aware Accessibility Testing
SNR-Adaptive Unified Diffusion for Multi-Task Medical Image Segmentation
A Multi-Task Deep Learning Framework for Real-Time Intelligent Video Surveillance with Te…
Detecting Architectural Drift in Safety-Critical Firmware through Runtime Trace Analysis
Text as Partial Constraint: Core-Residual Alignment for Robust Vision-Language Learning
CuBAS: Information Geometric Curvature-Based Adaptive Sampling for Supervised Classificat…
Geometry-Aware Motion Latents for Learning Robust Manipulation Policies
RSPO: Reward-Swap Policy Optimization for Multi-Turn LLM Agents
Conditional Diffusion Guided Knowledge Transfer for Multi-Domain Knowledge Graph Completi…
Which Algorithm Specification Formats Help Language Models Implement Machine Learning Alg…
The Role of Prompt Language and Translation-Theory-Driven Prompts in Large Language Model…
Strategic Buying Agents
AnchorVLA: Bridging Discrete Decisions and Continuous Trajectories for Vision-Language-Ac…
Scalable Maximal Frequent Episode Mining with Desbordante
A Bayesian Framework for Evaluating Scenario Compatibility in Generative Population Synth…
Self-Specializing Vision-Language Transmon Chip Calibration in a Physics-Grounded Environ…
ToolFailBench: Diagnosing Tool-Use Failures in LLM Agents
Builder, Defender, Breaker: The Case Against Removing the Human from the AI-Driven Securi…