Towards Healthy Evolution: Exploring the Role and Mechanisms of Human-Agent Interaction i…
Explorar
Noticias de IA
29349 elementos — filtrados, clasificados y sin duplicados
CogManip: Benchmarking Manipulative Behavior in Multi-Turn Interactions with Large Langua…
A Framework for Measuring Appropriate Reliance on Set-Valued AI Advice
Geographic Bias and Diversity in AI Evaluation
MCBench: A Multicontext Safety Assessment Benchmark for Omni Large Language Models
Agent Memory: Characterization and System Implications of Stateful Long-Horizon Workloads
Risk Assessment of Autonomous Driving: Integrating Technical Failures, Ethical Dilemmas, …
Beyond Vector Similarity: A Structural Analysis of Graph-Augmented Retrieval for Industri…
Towards World Models in Biomedical Research
QCFuse: Query-Aware Cache Fusion via Compressed View for Efficient RAG Serving
Agentic Molecular Recovery via Molecule-Aware Exploration
Insurance of Agentic AI
Zero knowledge verification for frontier AI training is possible
Critic-Guided Heterogeneous Multi-Agent Reasoning for Reliable Mathematical Problem Solvi…
Do More Agents Help? Controlled and Protocol-Aligned Evaluation of LLM Agent Workflows
Value-and-Structure Alignment for Routing-Consistent Quantization of Mixture-of-Experts M…
Beyond Waveform Robustness: Robust Feature-Vocoder Adversarial Attacks on Automatic Speec…
Agent-Orchestrated Adaptive RAG: A Comparative Study on Structured and Multi-Hop Retrieval
TensorBench: Benchmarking Coding Agents on a Compiler-Based Tensor Framework
Balancing Image Compression and Generation with Bootstrapped Tokenization
Towards AI epidemiology: a measurement standardisation framework for prospective risk det…
Code2LoRA: Hypernetwork-Generated Adapters for Code Language Models under Software Evolut…
Stability vs. Manipulability: Evaluating Robustness Under Post-Decision Interaction in LL…
Towards the Readability of LLM-Generated Codes through Multitask Representation Engineeri…
Improving Answer Extraction in Context-based Question Answering Systems Using LLMs
Sample-efficient Low-level Motion Planning for Robotic Manipulation Tasks via Zero-shot T…
OPRD: On-Policy Representation Distillation
Pretraining Recurrent Networks without Recurrence
Quantum enhanced rare event discovery and sampling
Knowledge Activation: AI Skills as the Institutional Knowledge Primitive for Agentic Soft…