Why Low-Light Cameras Go Color Blind: Removing Color Bias in Raw Denoising
Explorar
Noticias de IA
30934 elementos — filtrados, clasificados y sin duplicados
OS-Pruner: Pruning Chains-of-Thought of Reasoning Models via Optimal Stopping
Do Video-LLMs Actually Watch? Diagnosing Character-Tracking Failures in Long-Form Video
Link Adaptation Using Joint-Thompson Sampling
MJ: Multi-turn LLM Jailbreaking via Decomposed Credit Assignment
Long-Horizon-Terminal-Bench: Testing the Limits of Agents on Long-Horizon Terminal Tasks …
MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation
KV-PRM: Efficient Process Reward Modeling via KV-Cache Transfer for Multi-Agent Test-Time…
Toward Auditable AI Scientists: A Hypothesis Evolution Protocol for LLM Agents
Decoupling Language Guidance from Backbones for Text-Guided Medical Segmentation
All Explanations are Wrong, But Many Are Useful: Exploring the Rashomon Explanation Set w…
What VGGT Knows About Overlap: Probing Geometric Foundation Models for Co-Visibility
Failure as a Process: An Anatomy of CLI Coding Agent Trajectories
ALICE: Learning a General-Purpose Pathology Foundation Model from Vision, Vision-Language…
Large-Scale Portfolio Optimization Problem Under Cardinality Constraint With Enhanced Mul…
4DR360: State Reasoning for Joint 3D Detection and Occupancy Prediction in 4D Radar-Camer…
VEXAIoT: Autonomous IoT Vulnerability EXploitation using AI Agents
Evolution of Accuracy and Visual-Cognitive Errors in a Decade of Vision-Language AI Models
PHINN-EEG: Topological Time-Series Analysis of Dream-State EEG -- Dynamic Betti Curves fo…
Beyond Black-Box Obfuscation: Mechanistic Analysis and Defense of White-Box Monitors
QAgent: An LLM-based Multi-Agent System for Autonomous OpenQASM programming
Beyond Embeddings: Interpretable Feature Extraction for Binary Code Similarity
Leveraging Multi-Agent System (MAS) and Fine-Tuned Small Language Models (SLMs) for Autom…
Improving Language Agents through BREW: Bootstrapping expeRientially-learned Environmenta…
PACE: A Personalized Adaptive Curriculum Engine for 9-1-1 Call-taker Training
A Sovereign, Open-Source Foundation Model for German and English
Test-Time Scaling for Small VLMs on Multilingual Visual MCQ
Rectification Difficulty and Optimal Sample Allocation in LLM-Augmented Surveys
Towards Shutdownable Agents: Generalizing Stochastic Choice in RL Agents and LLMs
HiPO: Hierarchical Preference Optimization for Adaptive Reasoning in LLMs