Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
NetConfArena: An Executable Benchmark for LLM Agents in Closed-Loop Network Configuration
arXiv cs.AI Research & Papers
K-Bench: measuring model performance on real scientific agent requests
arXiv cs.AI Research & Papers
Training-Free VLM Personalization via Calibrated Residual Decoding
arXiv cs.AI Research & Papers
Read, Write, Relax: Why Neural PDE Surrogates Need Both Global and Local Processing
arXiv cs.AI Research & Papers
SWE Refactor Bench: Can Coding Agents Complete a Long-Horizon, Whole-Repository Stack Mig…
arXiv cs.AI Research & Papers
Deep Contrastive Unlearning for Language Models
arXiv cs.AI Research & Papers
GIM: Evaluating models via tasks that integrate multiple cognitive domains
arXiv cs.AI Research & Papers
Dissecting Neuro-Symbolic Quality Assurance for Synthetic Oncology Data Generation
arXiv cs.AI Research & Papers
Image-Conditional Diffusion Transformer for Underwater Image Enhancement
arXiv cs.AI Research & Papers
Seismic Acoustic Impedance Inversion Framework Based on Conditional Latent Generative Dif…
arXiv cs.AI Research & Papers
TELEVAL: A Benchmark Designed for Spoken Language Models in Chinese Interactive Scenarios
arXiv cs.AI Research & Papers
ExtrinSplat: Decoupling Geometry and Semantics for Open-Vocabulary Understanding in 3D Ga…
arXiv cs.AI Research & Papers
LLM-Specific Utility for Retrieval-Augmented Generation
arXiv cs.AI Research & Papers
Dynamic Cogeneration of Bug Reproduction Test in Agentic Program Repair
arXiv cs.AI Research & Papers
VGI-Bench: Probing Visual Intelligence in Video Generation Models
arXiv cs.AI Research & Papers
Robust Lightweight Deep Learning Models for Oral Cancer Screening
arXiv cs.AI Research & Papers
Vibe Coding on Trial: Operating Characteristics of Unanimous LLM Juries
arXiv cs.AI Research & Papers
Task-CoEvolve: Efficient Harness Optimization via Adaptive Validation Task Selection
arXiv cs.AI Research & Papers
Semantic Substrate Dynamics Theory: An Operator-Theoretic Framework for Geometric Semanti…
arXiv cs.AI Research & Papers
STAGE: Stateful Translation to Agentic Graph Execution with Policy-Scoped Context and Det…
arXiv cs.AI Research & Papers
RIACT: A Responsible AI System for Personalized Study Habit Tracking and Early Burnout Si…
arXiv cs.AI Research & Papers
There Is No Neutral Harness: Modern LLM Leaderboards Are Manufactured by Config-Fragile I…
arXiv cs.AI Research & Papers
CausalCache: Conditional High-Fidelity Restoration for Long-Horizon GUI Agents
arXiv cs.AI Research & Papers
Entity Representation Learning Through Onsite-Offsite Graph for Pinterest Ads
arXiv cs.AI Research & Papers
Scaling Curriculum Learning For Autonomous Driving
arXiv cs.AI Research & Papers
Spyre-Accelerated Retrieval-Augmented Generation on IBM LinuxONE: A Cloud-Native Architec…
arXiv cs.AI Research & Papers
Automated Construction of FAIR Digital Object Knowledge Graphs from Flat Cultural Heritag…
arXiv cs.AI Research & Papers
Length-Adaptive Decoding for Masked Diffusion Machine Translation
arXiv cs.AI Research & Papers
Pandora's AI Model Routing Box: Efficient Allocation with Costly Value Estimation
arXiv cs.AI Research & Papers
presto: Efficient, Training-free, and Open-world Object Placement via Imaginary Search