SATViz: Real-Time Visualization of Clausal Proofs
Explorar
Noticias de IA
21863 elementos — filtrados, clasificados y sin duplicados
Predict-then-Diffuse: Adaptive Response Length for Compute-Budgeted Inference in Diffusio…
TimeRFT: Stimulating Generalizable Time Series Forecasting for TSFMs via Reinforcement Fi…
Evaluating the Alignment Between GeoAI Explanations and Domain Knowledge in Satellite-Bas…
Generative AI in Action: Field Experimental Evidence from Alibaba's Customer Service Oper…
ActionParty: Multi-Subject Action Binding in Generative Video Games
Linear Proposal Operators and Stochastic Search Geometry in SOMA and Differential Evoluti…
Maximum Entropy Behavior Exploration for Sim2Real Zero-Shot Reinforcement Learning
A Human-Centered Validation of the Explainability-Performance Coefficient
ConnectED: A Curriculum-Aligned AI System for Vietnamese Instructional Lesson Planning an…
Why It Hurts: Identifying the Drivers of Negative Thoughts in Emotional Support Conversat…
Looks Right, Works Right: A Project-Level Benchmark for Multi-Screen Mobile App Generation
The Formalism Trap: Are LLM-as-a-Judge Evaluators Blinded by Consensus Mimicry under Soci…
Dense Temporal Contrast Synthesis via Conditioned Latent Transport
FriendBench: Benchmarking Dyadic Familiarity Inference in Humans and Multimodal Large Lan…
ARB: A Matched Authorship-Rewriting Benchmark Dataset for AI-Text Detector Evaluation
TraceViT: Grounded Trace Supervision for Visual Abstract Reasoning
TerraNova: A Foundation Model for the Anthropocene
QR-Structured Thermal Triggers for Targeted Semantic Attacks on Infrared Vision-Language …
AgentHPOBench: A Benchmark For Evaluating LLM Agents as Sequential Hyperparameter Optimiz…
AgenticRepair: Multi-Faceted Program Context Engineering for Agentic Vulnerability Repair
TFGformer: Multivariate Time Series Forecasting via Time-Frequency Graph Learning and Cov…
Explore Beyond the Boundary Using Entropic Information
Benchmarking Frontier Large Language Models Against Official Crash Database Coding Using …
Cross-Lingual Transfer for Machine Translation in Turkic Languages
Point2Radio: A Foundation Model for Cross-Scene Radio Fields from Material-Aware Point Cl…
Autonomous Repair for Multi-Agent Systems via Monte-Carlo Tree Search
WitCert: Sound Runtime Risk Observability and Gating for KV-Cache Quantization
Efficient LLM Adversarial Training via Low-Rank Defense and Circuit-Guided Surrogates
A robust association between LLM use and scientific productivity: Assessing stopping-time…