Industrializing Prediction-Powered Inference: The GLIDE Library for Reliable GenAI and Ag…
Explorar
Noticias de IA
30239 elementos — filtrados, clasificados y sin duplicados
Linear Ordering Problem: Time for a Change
Routing on the Stiefel Manifold: When Does Adaptive Subspace Selection Help for Cross-Dom…
Distilling LLM Feedback for Lean Theorem Proving
SLAT: Segment-Level Adaptive Trimming for Efficient CoT Reasoning
Generating Reports or Repeating Templates? Measuring and Mitigating Template Collapse in …
Annealed Softmax Greedy in Many-Armed Bayesian Bandits
DEM: A Distilled Explanation Model for Interpretable Anomaly Detection in Physiological S…
Structure-Induced Information for Rerooting Levin Tree Search
ImmersiveTTS: Environment-Aware Text-to-Speech with Multimodal Diffusion Transformer and …
Uncertainty-Aware and Temporally Regulated Expert Advice in Reinforcement Learning for Au…
Do Large Language Models Encode Institutional Experience? Evidence from Cross-Linguistic …
Physically Viable World Models: A Case for Query-Conditioned Embodied AI
What Makes LVLMs Hallucinate Less? Unveiling the Architectural Factors Behind Hallucinati…
BlueFin: Benchmarking LLM Agents on Financial Spreadsheets
Inverse Reinforcement Learning without an Optimal Demonstrator: A Feasible Reward Set App…
NumLeak: Public Numeric Benchmarks as Latent Labels in Foundation Models
Sophrosyne: Agentic Exploration of Relational Data Systems Needs Moderation
Safe Equilibrium Policy Optimization for Strategic Agent Policies
Fine-Tuning Improves Information Conveyance in Language Models
TRINE: A Token-Aware, Runtime-Adaptive FPGA Inference Engine for Multimodal AI
Enhancing Regime Shift Detection Using Unstructured Data: A Study on the Treasury Market
Hide-and-Seek in Trajectories: Discovering Failure Signals for VLA Runtime Monitoring
Structured interactions improve distributed coordination beyond model scaling in a real-w…
Reinterpreting Safety Thresholds as Neuron Spiking Thresholds
Hamiltonian-Inspired Attention Mechanism for Scalable RF Transmitter Fingerprinting
Unlearning in Diffusion Models: A Unified Framework with KL Divergence and Likelihood Con…
Differentially Private Preference Data Synthesis for Large Language Model Alignment
Design and Evaluation of Multi-Agent AI Oracle Systems for Prediction Market Resolution
MechVQA: Benchmarking and Enhancing Multimodal LLMs on Comprehensive Mechanical Drawing U…