Continual Learning Bench: Evaluating Frontier AI Systems in Real-World Stateful Environme…
Explorar
Noticias de IA
29348 elementos — filtrados, clasificados y sin duplicados
FIDES: Faithful Inference via Deep Evidence Signals for Retrieval-Memory Conflict in RAG
Answer Presence Drives RAG Rewriting Gains
Self-Commitment Latency: A Reward-Free Probe for Prompted Implicit Hacking
Multilingual Fine-Tuning via Localized Gradient Conflict Resolution
GuardNet: Ensemble Strategies of Shallow Neural Networks for Robust Prompt Injection and …
Individual Gain, Collective Loss: Metacognitive Adaptation in AI-Assisted Creativity
When Should We Protect AI? A Precautionary Framework for Consciousness Uncertainty
Step-by-Step Optimization-like Reasoning in LLMs over Expanding Search Spaces
EpiEvolve: Self-Evolving Agents for Streaming Pandemic Forecasting under Regime Shifts
Output Type Before Quality: A Standards-Derived XAI Admissibility Rubric for Autonomous-D…
Brick-Composer: Using MLLMs for Assembly with Diverse Bricks
Minimizing the Hidden Cost of Scales: Graph-Guided Ultra-Low-Bit Quantization for Large L…
Assessing the Carbon Emissions and Energy Consumption of U.S. Hyperscale Data Centers
Mutation Without Variation: Convergence Dynamics in LLM-Driven Program Evolution
Harnessing Generalist Agents for Contextualized Time Series
Synthetic Contrastive Reasoning for Multi-Table Q&A
An interpretable and trustworthy AI framework for large-scale longitudinal structure-pain…
I Know What You Meme, Even If it Emerged Today: Understanding Evolving Memes through Open…
Learning Adaptive Parallel Execution for Efficient Code Localization
Channel-Wise Mixed-Precision Quantization for Large Language Models
The Mirage of Performance Gains: Why Contrastive Decoding Fails to Mitigate Object Halluc…
CLASH: Evaluating Language Models on Judging High-Stakes Dilemmas from Multiple Perspecti…
Reformulating Neural Operators in $d+1$ Dimensions for Embedding Evolution
Scaling Laws and Spectra of Shallow Neural Networks in the Feature Learning Regime
In-Training Defenses against Emergent Misalignment in Language Models
A Survey on Diffusion Language Models
RAG Security and Privacy: Formalizing the Threat Model and Attack Surface
Escaping the Verifier: Learning to Reason via Demonstrations
CTIConnect: A Benchmark for Retrieval-Augmented LLMs over Heterogeneous Cyber Threat Inte…