Comparative evaluation of training strategies using partially labelled datasets for segme…
Explorar
Noticias de IA
22099 elementos — filtrados, clasificados y sin duplicados
More Bang for the Buck: Improving the Inference of Large Language Models at a Fixed Budge…
UA-DCM: Uncertainty-aware Causal Decision Making via Effect Bound Decomposition
MEnvAgent: Scalable Polyglot Environment Construction for Verifiable Software Engineering
How Hyper-Datafication Impacts the Sustainability Costs in Frontier AI
Performative Learning Theory
Generative Reasoning Re-ranker
Prescriptive Scaling Reveals the Evolution of Language Model Capabilities
Training-Free Intelligibility-Guided Observation Addition for Noisy ASR
CodeTaste: Can LLMs Generate Human-Level Code Refactorings?
POET-X: Memory-efficient LLM Training by Scaling Orthogonal Transformation
Context Over Compute Human-in-the-Loop Outperforms Iterative Chain-of-Thought Prompting i…
How Transformers Reject Wrong Answers: Rotational Dynamics of Factual Constraint Processi…
AgroOmni: A Large-Scale Multi-view Agricultural Dataset for Cross-Scale Multimodal Reason…
Component Ablation for Efficient Hybrid Language Model Architectures: Performance, Resili…
DecepGPT: Schema-Driven Deception Detection with Multicultural Datasets and Robust Multim…
UnWeaving the knots of GraphRAG -- turns out VectorRAG is almost enough
Muon$^2$: Boosting Muon via Adaptive Second-Moment Preconditioning
Capacity-Controlled Global Attention for Graph Transformers
Knee-xRAI: An Explainable AI Framework for Automatic Kellgren-Lawrence Grading of Knee Os…
Speech Enhancement Based on Drifting Models
When Do Diffusion Models learn to Generate Multiple Objects?
Kernel Affine Hull Machines as Compute-Efficient Encoders for Frozen Semantic Spaces
Neuron-Anchored Rule Extraction for Large Language Models via Contrastive Hierarchical Ab…
Self-Mined Hardness for Safety Fine-Tuning
NavOne: One-Step Global Planning for Vision-Language Navigation on Top-Down Maps
MinMax Recurrent Neural Cascades
Quantifying Rodda and Graham Gait Classification from 3D Markerless Kinematics derived fr…
Improving the Performance and Learning Stability of Parallelizable RNNs Designed for Ultr…
High-Rate Quantized Matrix Multiplication II