Clark Hash: Stateless Sparse Johnson-Lindenstrauss Quantization for Neural Embeddings
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
Relevant Is Not Warranted: Evidence-Force Calibration for Cited RAG
BlazeEdit: Generalist Image Editing on Mobile Devices with Image-to-Image Diffusion Models
Examining Agents' Bias Amplification versus Suppression in Multi-Agent Systems
Look on Demand: A Cognitive Scheduling Framework for Visual Evidence Acquisition in Multi…
Learning When to Optimize: Verified Optimization Skills from Expert GPU-Kernel Lineages
Explaining is Harder Than Predicting Alone: Evaluating Concept-based Explanations of MLLM…
REED: Post-Training Representation Editing for Cross-Domain Linguistic Steganalysis
Better Accuracies, Worse Reasoning: A Step-Level Audit of Medical Chain-of-Thought Distil…
From Knowing to Doing: A Memory-Controlled Benchmark for LLM Trading Agents on Stock Mark…
From paper to benchmark: agentic, framework-based reproduction of under-specified methods…
Benchmarking AI for low-resource contexts: Thinking beyond leaderboards
Modeling Vehicle-Type-Specific Pedestrian Crash Avoidance Behavior in Safety-Critical Int…
Adaptive Multimodal Agents-Based Framework for Automatic Workflow Execution
Bandwidth-Efficient and Privacy-Preserving Edge-Cloud Many-to-Many Speech Translation
The Importance of Being Statistically Earnest: A Critical Re-evaluation of GSM-Symbolic
LiveBrowseComp: Are Search Agents Searching, or Just Verifying What They Already Know?
Utility-Aware Multimodal Contrastive Learning for Product Image Generation
Prefix-Safe Bayesian Belief Tracking for LLM Reasoning Reliability:Separating Calibration…
Cross-Entropy Games and Frost Training
Voluntary Collusion with Secret Tools in Competing LLM Agents
LaneRoPE: Positional Encoding for Collaborative Parallel Reasoning and Generation
BIRDS: Characterizing and Understanding Biodiversity Impact of Large Language Model Servi…
Detect by Yourself: Self-Designing Agentic Workflows for Few-Shot Graph Anomaly Detection
When prompt perturbations break your A/B test: A valid statistical test for generative su…
A Systematic Evaluation of Retrieval-Augmented Generation and Language Models for Space O…
Paraphrase Brittleness in Production Retrieval-Augmented Commercial Recommendation: Repro…
When NPUs Are Not Always Faster: A Stage-Level Analysis of Mobile LLM Inference
FD-RAG: Federated Dual-System Retrieval-Augmented Generation
RAG-Coding: Enhancing LLM Medical Coding with Structured External Knowledge