LiveK12Bench: Have Large Multimodal Models Truly Conquered High School-level Examinations?
Explorar
Noticias de IA
30239 elementos — filtrados, clasificados y sin duplicados
Max-Window Scale Estimation for Near-Lossless HiF8 W8A8 Quantization-Aware Training
Augment Engineering: A Methodology for Multi-Tool AI Orchestration Across Professional Do…
A Universal Cliff and a Design Fingerprint: Cross-Section Defect Detection Under LLM Orch…
Stability Implies Redundancy: Delta Attention Selective Halting for Efficient Long-Contex…
Ethical Fairness without Demographics in Human-Centered AI
Grammar of the Wave: Towards Explainable Multivariate Time Series Event Detection via Neu…
Phase-Type Variational Autoencoders for Heavy-Tailed Data
MedCollab: IBIS-Guided Multi-Agent Collaboration with Hierarchical Disease Relation Chain…
Physically Native World Models: A Hamiltonian Perspective on Generative World Modeling
Effect-Transparent Governance for AI Workflow Architectures: Semantic Preservation, Expre…
Reliability and Effectiveness of Autonomous AI Agents in Supply Chain Management
Discoverable Agent Knowledge -- A Formal Framework for Agentic KG Affordances (Extended V…
Constraint acquisition needs better benchmarks
Vital Trace: Protocol-Constrained Patient-State Reasoning for Longitudinal Clinical Traje…
Scaling GraphLLM with Bilevel-Optimized Sparse Querying
Rethinking the Trust Region in LLM Reinforcement Learning
VIDA: A dataset for Visually Dependent Ambiguity in Multimodal Machine Translation
RulePlanner: All-in-One Reinforcement Learner for Unifying Design Rules in 3D Floorplanni…
ECSEL: Explainable Classification via Signomial Equation Learning
LLMs versus the Halting Problem: Characterizing Program Termination Reasoning
Shadow Unlearning: A Neuro-Semantic Approach to Fidelity-Preserving Faceless Forgetting i…
EpiQAL: Benchmarking Large Language Models in Epidemiological Question Answering and Reas…
DSA-Tokenizer: Disentangled Semantic-Acoustic Tokenization via Flow Matching-based Hierar…
How to Square Tensor Networks and Circuits Without Squaring Them
CFG-OEC: Classifier Free Guidance with Orthogonal Error Correction
Explainable Cross-Disease Reasoning for Cardiovascular Risk Assessment from Low-Dose Comp…
An End-to-End Learning Approach for Solving Capacitated Location-Routing Problems
Securing Multi-Agent Systems Against Corruptions via Node Contribution Backpropagation
Self-signals Driven Multi-LLM Debate for Efficient and Accurate Reasoning