OBCache: Optimal Brain KV Cache Pruning for Efficient Long-Context LLM Inference
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
LLM Bias Evaluation: Gender, Racial, and Age Disparities in Occupational and Crime Scenar…
Human Psychometric Questionnaires Mischaracterize LLM Behavior
D$^3$: Dynamic Directional Graph-Constrained Data Scheduling for LLM Training
Developing a UXR Point of View for Cognitive Accessibility in Mobile Learning with Genera…
From Evidence to Design: Developing an AI-Augmented UX Research Point of View for Digital…
MIMO: Multilingual Information Retrieval via Monolingual Objectives
Target-Agnostic Calibration under Distribution Shift with Frequency-Aware Gradient Rectif…
Symbolic Intermediaries as a Linguistic-Numerical Interface for LLM-Driven Geometric Reas…
PictSure: Pretraining Embeddings Matters for In-Context Learning Image Classifiers
SAM for Robust Mitochondria Instance Segmentation in Fluorescence Microscopy
Practical Cross-Band Channel Prediction for AI-RAN via Physics-Guided Deep Unfolding
Developing an AI-Powered UX Research Point of View for Digital Health in A Regulatory Con…
KnowledgeGain: Evaluating and Optimizing Science News Generation for Reader Learning
STEP: Learning STructured Embeddings for Progressive Time Series
Entropic Projection Alignment: Estimating, Explaining, and Improving Model Performance Un…
Score Broadcast and Decorrelation: A General Framework for Broadcast-Based Credit Assignm…
LongDS-Bench: On the Failure of Long-Horizon Agentic Data Analysis
Correcting Split Selection in Online Decision Trees via Anytime-Valid Inference
SpecDB: LLM-Generated Customized Databases via Feature-Oriented Decomposition
EvoPool: Evolutionary Programmatic Annotation for Label-Efficient Specialized Supervision
Exploiting Semantic and Pixel Representations for Ultra-Low Bitrate Image Compression
GJDNet: Robust Graph Neural Networks via Joint Disentangled Learning Against Adversarial …
CRePE: Convolution-aware Relative Importance in Post-training Pruning with Efficient Sear…
Rethinking the Role of Positional Encoding: Sliding-Window Transformers without PE Remain…
Agent Operating Systems (AOS): Integrating Agentic Control Planes into, and Beyond, Tradi…
Startup offers free home cleaning—if it can record it all for robot training
BenHalluEval: A Multi-Task Hallucination Evaluation Framework for Large Language Models o…
Check out real-life AI prototypes from the Futures Lab.
Real-time LLM Inference on Standard GPUs: 3k tokens/s per request