BEST-KAG: Enhancing Question Answering of Building Engineering Standards with Multimodal …
Explorar
Noticias de IA
29341 elementos — filtrados, clasificados y sin duplicados
VQ-bench: A Composable Vector Quantization Framework
Low-Interaction-Rank Learning: Unifying Multiplicative Dual-Encoder Heads
Hybrid-Policy Self-Editing for Composable Unstructured Knowledge Editing
The Wording Effect: Quantifying Two-Way Drift in LLM Benchmark Performance
REOPD: Reliability-Adaptive Reward Extrapolation for On-Policy Distillation
Detecting a Route Flip Is Easier Than Knowing Whether to Fix It: Causal Route-Mediated Da…
AutoWorldModel-Bench: A State-Centric Benchmark for Automated World-Model Research
A Conceptual Framework for Enhancing Workforce Readiness for Smart Manufacturing in the A…
Towards the Harness of Embodied Agents
Who Thinks Best Depends on How Long You Let Them: Budget-Dependent Rankings in LLM Evalua…
Reinforcement Learning based DBMS Buffer Pool Auto-Tuning for Optimal Memory Utilization
From Monolithic to Modular: Segment-level Automatic Prompt Optimization
Distribird: Literature-Informed Prior Distribution Design for Bayesian Model Calibration
Conformity Mitigations in Large Language Models Lie on a Single Resistance-Receptivity Fr…
Uncertainty-Aware and Explainable Ensemble Deep Learning Framework for Multi-Class Skin L…
SegPAR: Class-Centric Decision-Based Sparse Attack for Semantic Segmentation
Is Per-Agent Policy Composition Safe? Rethinking Successor-Feature Transfer in Cooperativ…
Dynamic Governance of Multi-LLM Agent Systems for Collaborative Conversational Outcomes
Conflict and Congruency Effects in Large Language Models: In-Weight and In-Context Compet…
TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs
GCPO: Diagnosing and Constraining Subspace Geometry in Rollout RL for LLMs
GRPO for Financial Advice Generation: Outperforming Commercial LLMs under CATE Evaluation
Toward Meaningful Transparency for AI Chatbots: Disclosing Persuasive Intent Reduces Pers…
Semantic Lenia: Emergence of Homeostatic Solitons within the Semantic Space of Large Lang…
Adaptive Hybrid Particle Swarm Optimization with Gradient Descent
LinearKV: One Cached State Suffices for Position-Independent Caching in Hybrid LLMs
Confidence Calibration of Deep Learning Systems
Fingerprinting Text-to-Image Diffusion Models via Collapsed Generation
Harness-IF: Evaluating Instruction Following Across Instruction Surfaces in Coding Agents