QuArch: A Benchmark for Evaluating LLM Reasoning in Computer Architecture
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
Deep Reinforcement Learning to Master the Asymmetric Strategy of Baghchal
Using LLMs for Explainable, Data-Driven Insight Generation from Time Series
Wisdom of LLM Crowds: Aggregation and Contamination in Language Model Ensembles
State Compression in Two-Agent LLM Relays: A Closed-World Study of Constraint Preservation
Beyond-Diagonal RIS Under Non-Idealities: Learning-Based Architecture Discovery and Optim…
MUX: Continuous Reasoning via Multiplexed Tokens
Regime-Aware Physics-Guided Early Warning of Lithium-Ion Battery Thermal Runaway Using Th…
FALCON-Discover: Discovering Concentrated False-Confidence Regions for Calibration
Kontinuous Kontext: Continuous Strength Control for Instruction-based Image Editing
ProbSPARQL: Querying Knowledge Graphs with Multi-dimensional, Uncertain Numeric Data
FindStatBench: Evaluating Large Language Models on Combinatorial Code Synthesis
S2T-RLHF: Hierarchical Credit Assignment for Stable Preference-Based RLHF
PEARL: Solver-in-the-Loop Interactive Optimization Modeling from Natural Language
Cross-Dialect Generalization Without Retraining: Benchmarks and Evaluation of Schema-Deri…
MILP-Evo: Closed-Loop Fully Automatic Design of MILP Solvers
Agentic Real2Sim: Physics-based World Modeling with Vision-Language Agents
RAMP: Recognition parametrisation by Amortised Message Passing
Phionyx: A Deterministic AI Runtime Architecture with Structured State Management and Pre…
From Agent Failure Paths to Quantified Residual Risk: A Compositional Framework for Resil…
Breaking the MoE LLM Trilemma: Dynamic Expert Clustering with Structured Compression
Robust Belief-State Policy Learning for Quantum Network Routing Under Decoherence and Tim…
Variational meta-learning inference for low dimensional neural system identification
BatchDAG: LLM-Planned Execution Graphs for Scalable Ad-Hoc Analysis Over Enterprise Data
Preference-Conditioned Multi-Objective Reinforcement Learning for Runtime-Tunable Transit…
Attacking Graph Foundation Models Through Their Shared Representation
Gradient-Energy Guided Block-Wise Perturbations for Sharpness-Aware Minimization
Circuit Claims Depend on What Is Extracted and How It Is Compared
AutoJourn: Multi-Perspective Summarisation, Bias Detection and Bias Neutralisation for LL…
Reliability Scales Inversely: Bigger Models Compound Mistakes Faster via a Hidden Auto-Re…