Unmasking Conversational Bias in AI Multiagent Systems
Explorar
Noticias de IA
29336 elementos — filtrados, clasificados y sin duplicados
Cueless EEG imagined speech for subject identification: dataset and benchmarks
Unlearning at Scale: State-Exact Trace-Preserving Deletion in Billion-Parameter Language …
Gradual Code-Switching as Inference-Time Cross-Lingual Representational Alignment for LLMs
BoardroomAI: Dependency-Aware Human-Steerable Multi-Agent Deliberation through Evolving D…
Automated Design Optimization via Strategic Search with Large Language Models
MOSAIC: Unveiling the Moral, Social and Individual Dimensions of Large Language Models
CangjieBench: Benchmarking LLMs on a Low-Resource General-Purpose Programming Language
IACDM: Interactive Adversarial Convergence Development Methodology -- A Structured Framew…
Automatic Termination Strategy of Inelastic Neutron-scattering Measurement Using Bayesian…
Erase but Preserve: Controllable Removal of Copyrighted Animation Characters via Optimize…
Cat-DPO: Category-Adaptive Safety Alignment
@skills: Attention is all you have
Predictive Memory Localization: Forecasting Selective Intervention Paths from Internal Si…
OmniScientist: An Omni-Modal Omni-Discipline AI Scientist
StreamReason-Bench: Can Large Language Models Reason about Event-Time Stream-Processing S…
Reasoning Jury: Multi-Model Consensus for Evaluating Reasoning Traces
Agent Behavioral Contracts II: Certifying Compositional Reliability Without Assuming Inde…
Beyond Retrieval: Query-Conditioned Reuse of Long-Horizon Agent Trajectories
Privacy-Preserving RAG by Concealing Sensitive Information from External LLMs
QuoteBench: How Matched Scores Can Hide Command-Path Failures
A Compositional Theory of Curvature in Probabilistic Circuits
Foundations of MT-PDCL: Measure-Theoretic Probabilistic Definite Clause Logic
From Local Mismatch to Global Impact: Optimizing Cache Reuse Policy for Efficient Diffusi…
FlashDrive: Flash Vision-Language-Action Inference for Autonomous Driving
VALG: An Agentic System for ML Theory Research
Behavioral Reprogramming of Open-Weights Models: Cognitive Plasticity and Alignment Bounds
Explanatory Engagement Under Rare Anomalous Failure: Asymptotic Rarity in Model Behavior …
Large Language Models Can Follow Instructions, But Not Many at Once: Phase Transitions in…
Unified Multi-Dimensional Benchmark for Complex Graph Reasoning in Large Language Models