Agent-Facing Information Design in LLM Tool Registries
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
When Mean CE Fails: Median CE Can Better Track Language Model Quality
Fundamental Limitation in Explaining AI
GRAIL: AI translation for scientists application workflow on satellite data
Agent Manufacturing: Foundation-Model Agents as First-Class Industrial Entities
TaBIIC2: Interactive Building of Ontological Taxonomies using Weighted Self-Organizing Ma…
Extracting Training Data from Diffusion Language Models via Infilling
Intent Signal Theory: A Computational Framework for Intent-State Control in Human-AI Inte…
Leveraging Gauge Freedom for Learning Non-Gradient Population Dynamics of Stochastic Syst…
Courant: a State-Adaptive Perceiver-Based Neural Surrogate with Local Support and Interpr…
Trust-Aware Joint Feature-Prediction Discrepancy for Robust Domain Adaptation
Towards Multi-Turn Dialog Systems for Industrial Asset Operations and Maintenance
AION: Next-Generation Tasks and Practical Harness for Time Series
Beyond the Frontier: Stochastic Backtracking for Efficient Test-Time Scaling
Representation Without Control: Testing the Realization Effect in Language Models
SpecAlign: A Semantic Alignment Framework for SystemVerilog Assertion Generation
Boosting Inference with Guided Reasoning: Stochastic Exploration for Recursive Models
Selection-Induced Contraction of Innovation Statistics in Gated Kalman Filters
SentGraph: Hierarchical Sentence Graph for Multi-hop Retrieval-Augmented Question Answeri…
PiXTime: A Model for Federated Time Series Forecasting with Heterogeneous Data across Nod…
Overcoming "Physics Shock" in Earth Observation A Heteroscedastic Uncertainty Framework f…
Empirical Analysis and Detection of Hallucinations in LLM-Generated Bug Report Summaries
PromptAudit: Auditing Prompt Sensitivity in LLM-Based Vulnerability Detection
Whose Alignment? Comparing LLM Process Alignment Across Diverse Organizational Decision C…
Towards end-to-end LLM-based censoring-aware survival analysis
What Gets Cited: Competitive GEO in AI Answer Engines
Uncertainty Reasoning with Large Language Models for Explainable Disease Diagnosis
Back to Parsimonious Latents: Learning Task-Centric World Models from Visual Foundations
Learning to Search and Searching to Learn for Generalization in Planning
AME-TS: Anchored Mixture-of-Experts for Time Series Forecasting