A Year in LLM Serving: Workload Evolution, Caching and Load-Balancing
Explorar
Noticias de IA
37834 elementos — filtrados, clasificados y sin duplicados
AI Evaluation Should Work With Humans
Inducing Reward-Free Judging Rubrics that Reduce Over-Crediting in Agent Evaluation
Depth-Aware Sensitivity Analysis of Mixture-of-Experts Models via Magnitude-Based Expert …
A Calibrated Test of Internal Action Maps: State Signals Without Global Affine Closure
Clearing the Fog: Towards Installing and Refining Proactive Exploration Capabilities in L…
Edge Case Detection in Automated Driving: Methods, Challenges, and Future Directions
BAT: Learning to Reason about Spatial Sounds with Large Language Models
SKILLER: Language-Level Reinforcement Learning for Reusable Skill Extraction in Small Lan…
Lost in Phonation: Voice Quality Variation as an Evaluation Dimension for Speech Foundati…
PHASE: Passive Human Activity Simulation Evaluation
Ads in AI Chatbots? An Analysis of How Large Language Models Navigate Conflicts of Intere…
Context Aware AI Assistant and AR Interface for Lunar Extravehicular Activity (EVA) Proce…
Not All Tokens Are Equal: Inflation-Aware Routing for Agentic LLM Systems
Residual Dominance as a Structural Account of Last-Item Reliance in Causal Self-Attention…
When Personal Memory Has No Single Answer: Evaluating LLM Agents under Irreducible Confli…
AI Research Preference Models
From Style Replication to Style Exploration: Enabling Art Style Exploration with Analyze-…
A Hybrid LLM-Based Framework for Automated Security Annotation Generation in Business Pro…
Shift Aware Transfer Learning with Adaptive Dual-Encoder Fusion for PM Forecasting in Dat…
Participatory Moral AI Is Not Neutral: The Invisible Hand of Developers
GBU-Palm: A Multimodal Video Dataset and Benchmark for Palm Presentation Attack Detection
Evaluating Agentic Learning Harness Capabilities Without Labels via the Scaling Hypothesis
AgentRewind: Recoverable Execution for Long-Horizon LLM Agents
PACE-Bench: Benchmarking Physics Adaptation via Code Evolution in Dynamic Environments
Wyvern: An Agentic Framework for Generating Grounded Multimodal Reports
Can We Defend Against AI-Generated Video Attacks on Real-World Crisis Events? A Systemati…
Retrieval Grounding Latent Reasoning for Dense Retrieval
A Graph-Based Reinforcement Learning Framework for Structured Drift Diagnosis and Recover…
Scaling Domain Data Repetition in LLM Pretraining