Explorar

Noticias de IA

30308 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Conf-Gen: Conformal Uncertainty Quantification for Generative Models
arXiv cs.AI Research & Papers
EvA: An Evidence-First Audio Understanding Paradigm for LALMs
arXiv cs.AI Research & Papers
FormInv: A Measurement Protocol for Semantic Invariance in Mathematical Reasoning Benchma…
arXiv cs.AI Research & Papers
JMed48k: A Multi-Profession Japanese Medical Licensing Benchmark for Vision-Language Mode…
arXiv cs.AI Research & Papers
Reducing Political Manipulation with Consistency Training
arXiv cs.AI Research & Papers
Label-Free Reinforcement Learning via Cross-Model Entropy
arXiv cs.AI Research & Papers
SCDBench: A Benchmark for LLM-Based Smart Contract Decompilers
arXiv cs.AI Research & Papers
OISD: On-Policy Internal Self-Distillation of Language Models
arXiv cs.AI Research & Papers
unix-ctf: Procedural Environments for Unix-Competence Reinforcement Learning
arXiv cs.AI Research & Papers
Multi-Resolution End-to-End Deep Neural Network for Optimizing Latency-Accuracy Tradeoff …
arXiv cs.AI Research & Papers
SafeRx-Agent: A Knowledge-Grounded Multi-Agent Framework for Safe and Explainable Medicat…
arXiv cs.AI Research & Papers
Parallax: Parameterized Local Linear Attention for Language Modeling
arXiv cs.AI Research & Papers
Finding DoRI: Discovery of Retained Images in Diffusion Models
arXiv cs.AI Research & Papers
PhyGenHOI: Physically-Aware 4D Generation of Dynamic Human-Object Interactions
arXiv cs.AI Research & Papers
CA-AC-MPC: CUDA-Accelerated Actor-Critic Model Predictive Control
arXiv cs.AI Research & Papers
Domain-Informed Representation for Evolutionary Sieving in Integral and Module Lattices
arXiv cs.AI Research & Papers
Beyond MSE: Improving Precipitation Nowcasting with Multi-Quantile Regression
arXiv cs.AI Research & Papers
Ultra-Reduced-Impact-Encased-Logging (URIEL): propose a new method for selective sustaina…
arXiv cs.AI Research & Papers
Behavior-Aware Auxiliary Corrections for Off-Policy Temporal-Difference Prediction
arXiv cs.AI Research & Papers
Adopt $\neq$ Adapt: Longitudinal Analyses of LLM Conversations in the Wild
arXiv cs.AI Research & Papers
The Chain Holds, the Answer Folds: Trace-Answer Dissociation in Reasoning Models Under Ad…
arXiv cs.AI Research & Papers
GRASP: Gated Regression-Aware Skill Proposer for Self-Improving LLM Agents
arXiv cs.AI Research & Papers
Think Fast, Talk Smart: Partitioning Deterministic and Neural Computation for Structured …
arXiv cs.AI Research & Papers
From Prompts to Context: An Ontology-Driven Framework for Human-Generative AI Collaborati…
arXiv cs.AI Research & Papers
DLM-SWAI: Steering Diffusion Language Models Before They Unmask
arXiv cs.AI Research & Papers
VikingMem: A Memory Base Management System for Stateful LLM-based Applications
arXiv cs.AI Research & Papers
Beyond Attack Success Rate: Temporal Logit Observability for LLM Safety Failures
arXiv cs.AI Research & Papers
Rethinking Literature Search Evaluation: Deep Research Helps, and Human Citation Lists Ar…
arXiv cs.AI Research & Papers
ReasonOps: Operator Segmentation for LLM Reasoning Traces
arXiv cs.AI Research & Papers
Rooted Absorbed Prefix Trajectory Balance with Submodular Replay for GFlowNet Training