Routing by Reasoning Need: Trajectory-Aware Decoding Control for Diffusion Vision-Languag…
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
Bio-inspired Learning and Decision-Making with Probabilistic In-Memory Computing Hardware…
Off-Target Effects of Response-Style Alignment in a Korean 27B Language Model
Predicting Train Delays in Finland Using Machine Learning and Weather Data
AI-Powered Flare Combustion Efficiency Estimation
Counterfactual Marginalisation: Framework for Evaluating Robustness to Nuisance Variables
The Oligarch Barely Steers Model Collapse in Multi-Model Ecosystems
Benchmark Radar: A Living Database and Search Engine for AI Benchmarks and Evaluation
Breaking Predictions Is Not Enough: Specified-Foil Counterfactuals for Temporal Graphs
Can LLMs Follow Medical Expert Logic? A Benchmark for Hierarchical Logical Consistency in…
From Parameters to Answers: How LLMs Retrieve and Use Their Internal Knowledge
Are We Really Doing Few-Shot Learning? A Critical Examination of Pre-Training Assumptions
A Voice-Interactive Multi-Agent System for Smart Operating Rooms: Architecture Design and…
Geospatial AI, Dataverse Metadata, and the Study of Place-Based Government
Distributed Optimization of Modular Production Systems using Model-based Reinforcement Le…
SIRF: A Spec-Internalized Risk Foundation Model for Industrial Content Risk Control
A Unified Per-Token Gating Family for On-Policy Distillation: FKL/RKL Mixing with Multi-C…
Defining AI Agents: A Compendium of Criteria, Metrics, and Benchmarks
The Agent Incident Registry: Toward Preventing Repeated AI Agent Failures
Studying Without a Syllabus: Task-Agnostic Environment Preprocessing
Finishing the Task Is Not Enough: Evaluating Agent Resilience and Considerate Participati…
When Validation Stops Learning: Auditing Update Admission for Continual Embodied Agents
Characterizing Job Power Elasticity for Power-Flexible AI Training
GitSkills: A Dataset of Agent Skills on GitHub
Continuous Diffusion Scales Competitively with Discrete Diffusion for Language
Automating Quadratic Unconstrained Binary Optimization (QUBO) Formulation Generation from…
Understanding LoRA Rank Trade-offs in Diffusion Model Fine-Tuning
On the Regularization Landscape for the Linear Recommendation Models
Monotone Neural Policy Iteration for High-Dimensional First-Order Hamilton--Jacobi--Bellm…
Analyzing LLM Reasoning to Uncover Mental Health Stigma