AgentForge: An Immersive Role-Playing Platform for Learning Agentic Software Engineering
Explorar
Noticias de IA
21272 elementos — filtrados, clasificados y sin duplicados
NeuMoSync: End-to-End Neuromodulatory Control for Plasticity and Adaptability in Continua…
Leak-Resistant Unlearning: A New Benchmark for Evaluating Multi-Hop Reasoning Consistency…
Out-Of-The-Loop Multi-Fidelity Bayesian Optimization
Architectural Implications of Agentic AI Workflows
The LLM Proposes, the Executive Disposes: A Self-Verifying Agent Instrument that Dissocia…
Chain-of-Thought Monitoring Can Be Unreliable in Implicit-Influence Settings
GUARD: Grounding Uncertainty and Ablation-Based Risk Detection for Diffusion-Based VLAs
A Model Merging Approach for Continual MLLM Unlearning
PhysMind: From Video to Executable Worlds for Training-Free Physical Reasoning
FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Profe…
Temporal Context Awareness: A Defense Framework Against Multi-turn Manipulation Attacks o…
Wiring Beats Blending: What Transfers Between Transformer Sizes -- and What Doesn't
When Prompts Become Pixels: Prompt-Region Grounding for Multimodal Reasoning
TourSynbio-Search: A Large Language Model Driven Agent Framework for Unified Search Metho…
SJEPA: Learning Elegant Latent Dynamics with Hybrid Symbolic-Neural Predictors
Traceable LLM-Generated Hazard Scenarios for Operational Safety Analysis of Aviation Syst…
Diagnosing Tool-Selection Reasoning in LLM Agents with Canary Tools
Beyond Linear Dynamics: Neural Bilinear Dynamical Models for Time Series Forecasting
FinPerMA: A Theory-Informed, Event-Grounded Personalized-Memory Benchmark for LLM Agents
Seeking Physics in Diffusion Noise
Item Response Theory for AI Safety
Is Monitoring Enough? Strategic Agent Selection For Stealthy Attack in Multi-Agent Discus…
The Luna Bound Propagator for Formal Analysis of Neural Networks
Recurrent Residual Quantization: A Progressive Multi-Precision Representation for LLMs
When does training on downscaled images yield the same gradients?
D$^2$F-ReAG: Dynamic Decomposition and Filtering for Multi-Hop Reasoning-Augmented Genera…
Q-CueGraph: Query-Conditioned Visual Evidence Graphs for Multimodal Reasoning
Image Classification Using CNN-QNN Hybrid Model with Optimized Correlated Features
AFD-Ledger: Deployment Provisioning for Attention--FFN Disaggregation