Explorar

Noticias de IA

22318 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Uncertainty-aware reinforcement learning for chemical language models
arXiv cs.AI Research & Papers
Pulmonary Embolism Risk Stratification from CTPA and Medical Records: Vascular Graphs Are…
arXiv cs.AI Research & Papers
AutoRelAnnotator: Calibrated Model Cascades for Cost-Efficient Relevance Evaluation in Sp…
arXiv cs.AI Research & Papers
Semantic Consistency Policy Optimization for Reinforcement Learning of LLM Agents
arXiv cs.AI Research & Papers
Edges Before Embeddings: A Confidence-Aware Blur Gate for Vision-Language Pipelines
arXiv cs.AI Research & Papers
ACT-JEPA: Novel Joint-Embedding Predictive Architecture for Efficient Policy Representati…
arXiv cs.AI Research & Papers
MiniOpt: Reasoning to Model and Solve General Optimization Problems with Limited Resources
arXiv cs.AI Research & Papers
Do Encoders Suffice? A Systematic Comparison of Encoder and Decoder Safety Judges for LLM…
arXiv cs.AI Research & Papers
Uncertainty Quantification for Computer-Use Agents: A Benchmark across Vision-Language Mo…
arXiv cs.AI Research & Papers
Gradient-based inverse lithography for EUV masks via the waveguide method and a physics-i…
arXiv cs.AI Research & Papers
Steering Vision-Language Models with Joint Sparse Autoencoders
arXiv cs.AI Research & Papers
Is GraphRAG Needed? From Basic RAG to Graph-/Agentic Solutions with Context Optimization
arXiv cs.AI Research & Papers
Taxonomy of Risks on Automated Fact-Checking Systems Considering its Propagation
arXiv cs.AI Research & Papers
Staying In Character: Perspective-Bounded Memory For Book-Based Role-Playing Agents
arXiv cs.AI Research & Papers
TL++: Accuracy and Privacy Preserving Traversal Learning for Distributed Intelligent Syst…
arXiv cs.AI Research & Papers
Probabilistic Agents in Deterministic Audits: Evaluating Multi-Agent Systems for Automate…
arXiv cs.AI Research & Papers
An Approach for a Supporting Multi-LLM System for Automated Certification Based on the Ge…
arXiv cs.AI Research & Papers
Evaluating LLMs on Real-World Software Performance Optimization
arXiv cs.AI Research & Papers
The impact of artificial intelligence on enterprise software user roles
arXiv cs.AI Research & Papers
HG-Bench: A Benchmark for Multi-Page Handwritten Answer-Region Grounding in Automated Hom…
arXiv cs.AI Research & Papers
A Red Teaming Framework for Large Language Models: A Case Study on Faithfulness Evaluation
arXiv cs.AI Research & Papers
C3-Bench: A Context-Aware Change Captioning Benchmark
arXiv cs.AI Research & Papers
TopoCast: A Topological Fidelity Framework for Evaluating Transformer-Based Time Series F…
arXiv cs.AI Research & Papers
Interpretable Concept-Guided Polynomial Tabular Kolmogorov-Arnold Network for EEG-Based M…
arXiv cs.AI Research & Papers
Brevity is the Soul of Inference Efficiency: Inducing Concision in VLMs via Data Curation
arXiv cs.AI Research & Papers
CrossAccent-TTS: Cross-Lingual Accent-Intensity Controllable Text-to-Speech via Disentang…
arXiv cs.AI Research & Papers
Lightweight PCGAE-Net: Parallel CrossGate Attention and Bottleneck AutoEncoder for Effici…
arXiv cs.AI Research & Papers
FactorLibrary: From Polynomials to Circuits via Recursive Subgoals
arXiv cs.AI Research & Papers
From Sounds to Scenes: A Benchmark for Evaluating Context-Aware Auditory Scene Understand…
arXiv cs.AI Research & Papers
Anatomically-conditioned Latent Diffusion Model for Data-Efficient Few-Shot Cross-Domain …