Architectural Implications of Agentic AI Workflows
Explorar
Noticias de IA
29349 elementos — filtrados, clasificados y sin duplicados
Out-Of-The-Loop Multi-Fidelity Bayesian Optimization
Leak-Resistant Unlearning: A New Benchmark for Evaluating Multi-Hop Reasoning Consistency…
Protoreasoning in Tiny Transformers
Recurrent Residual Quantization: A Progressive Multi-Precision Representation for LLMs
Compass: Continuously Aligning Social Media Feeds via In-Situ Reflections
Terminal Agents Suffice for Enterprise Automation
PhysMind: From Video to Executable Worlds for Training-Free Physical Reasoning
SimMOF: AI agent for Automated MOF Simulations
Chain-of-Thought Monitoring Can Be Unreliable in Implicit-Influence Settings
FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Profe…
Beyond Linear Dynamics: Neural Bilinear Dynamical Models for Time Series Forecasting
GUARD: Grounding Uncertainty and Ablation-Based Risk Detection for Diffusion-Based VLAs
SJEPA: Learning Elegant Latent Dynamics with Hybrid Symbolic-Neural Predictors
A Model Merging Approach for Continual MLLM Unlearning
Provable Limits and Certified Deferral for Verbalized Uncertainty in Small Language Models
FinPerMA: A Theory-Informed, Event-Grounded Personalized-Memory Benchmark for LLM Agents
Traceable LLM-Generated Hazard Scenarios for Operational Safety Analysis of Aviation Syst…
The Luna Bound Propagator for Formal Analysis of Neural Networks
Diagnosing Tool-Selection Reasoning in LLM Agents with Canary Tools
Is Monitoring Enough? Strategic Agent Selection For Stealthy Attack in Multi-Agent Discus…
When Prompts Become Pixels: Prompt-Region Grounding for Multimodal Reasoning
EviGraph: Evidence-Guided Autonomous Research Agents
Item Response Theory for AI Safety
Seeking Physics in Diffusion Noise
TourSynbio-Search: A Large Language Model Driven Agent Framework for Unified Search Metho…
DisMix: Order-Aware Mixup for Medical Imaging via Disentangling Ordinal and Non-Ordinal F…
Temporal Context Awareness: A Defense Framework Against Multi-turn Manipulation Attacks o…
AFD-Ledger: Deployment Provisioning for Attention--FFN Disaggregation
IMFACT: Counterfactual Explanations for Time Series via Intrinsic Mode Function Substitut…