Explorar

Noticias de IA

30934 elementos — filtrados, clasificados y sin duplicados

Hugging Face Daily Papers Research & Papers
Why Low-Light Cameras Go Color Blind: Removing Color Bias in Raw Denoising
Hugging Face Daily Papers Research & Papers
OS-Pruner: Pruning Chains-of-Thought of Reasoning Models via Optimal Stopping
Hugging Face Daily Papers Research & Papers
Do Video-LLMs Actually Watch? Diagnosing Character-Tracking Failures in Long-Form Video
Hugging Face Daily Papers Research & Papers
Link Adaptation Using Joint-Thompson Sampling
Hugging Face Daily Papers Security & Safety
MJ: Multi-turn LLM Jailbreaking via Decomposed Credit Assignment
arXiv cs.AI Research & Papers
Long-Horizon-Terminal-Bench: Testing the Limits of Agents on Long-Horizon Terminal Tasks …
arXiv cs.AI Research & Papers
MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation
arXiv cs.AI Research & Papers
KV-PRM: Efficient Process Reward Modeling via KV-Cache Transfer for Multi-Agent Test-Time…
arXiv cs.AI Research & Papers
Toward Auditable AI Scientists: A Hypothesis Evolution Protocol for LLM Agents
arXiv cs.AI Research & Papers
Decoupling Language Guidance from Backbones for Text-Guided Medical Segmentation
arXiv cs.AI Research & Papers
All Explanations are Wrong, But Many Are Useful: Exploring the Rashomon Explanation Set w…
arXiv cs.AI Research & Papers
What VGGT Knows About Overlap: Probing Geometric Foundation Models for Co-Visibility
arXiv cs.AI Research & Papers
Failure as a Process: An Anatomy of CLI Coding Agent Trajectories
arXiv cs.AI Research & Papers
ALICE: Learning a General-Purpose Pathology Foundation Model from Vision, Vision-Language…
arXiv cs.AI Research & Papers
Large-Scale Portfolio Optimization Problem Under Cardinality Constraint With Enhanced Mul…
arXiv cs.AI Research & Papers
4DR360: State Reasoning for Joint 3D Detection and Occupancy Prediction in 4D Radar-Camer…
arXiv cs.AI Research & Papers
VEXAIoT: Autonomous IoT Vulnerability EXploitation using AI Agents
arXiv cs.AI Research & Papers
Evolution of Accuracy and Visual-Cognitive Errors in a Decade of Vision-Language AI Models
arXiv cs.AI Research & Papers
PHINN-EEG: Topological Time-Series Analysis of Dream-State EEG -- Dynamic Betti Curves fo…
arXiv cs.AI Research & Papers
Beyond Black-Box Obfuscation: Mechanistic Analysis and Defense of White-Box Monitors
arXiv cs.AI Research & Papers
QAgent: An LLM-based Multi-Agent System for Autonomous OpenQASM programming
arXiv cs.AI Research & Papers
Beyond Embeddings: Interpretable Feature Extraction for Binary Code Similarity
arXiv cs.AI Research & Papers
Leveraging Multi-Agent System (MAS) and Fine-Tuned Small Language Models (SLMs) for Autom…
arXiv cs.AI Research & Papers
Improving Language Agents through BREW: Bootstrapping expeRientially-learned Environmenta…
arXiv cs.AI Research & Papers
PACE: A Personalized Adaptive Curriculum Engine for 9-1-1 Call-taker Training
arXiv cs.AI Research & Papers
A Sovereign, Open-Source Foundation Model for German and English
arXiv cs.AI Research & Papers
Test-Time Scaling for Small VLMs on Multilingual Visual MCQ
arXiv cs.AI Research & Papers
Rectification Difficulty and Optimal Sample Allocation in LLM-Augmented Surveys
arXiv cs.AI Research & Papers
Towards Shutdownable Agents: Generalizing Stochastic Choice in RL Agents and LLMs
arXiv cs.AI Research & Papers
HiPO: Hierarchical Preference Optimization for Adaptive Reasoning in LLMs