Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
CodeGolf Bench: A Multi-Language Benchmark for Evaluating Concise Code Generation Capabil…
arXiv cs.AI Research & Papers
Hamiltonian-Inspired Attention Mechanism for Scalable RF Transmitter Fingerprinting
arXiv cs.AI Research & Papers
Sophrosyne: Agentic Exploration of Relational Data Systems Needs Moderation
arXiv cs.AI Research & Papers
Safe Equilibrium Policy Optimization for Strategic Agent Policies
arXiv cs.AI Research & Papers
FAM-Bench: A Multimodal Benchmark for Condition-Aware Food-as-Medicine Reasoning
arXiv cs.AI Research & Papers
Fine-Tuning Improves Information Conveyance in Language Models
arXiv cs.AI Research & Papers
Hide-and-Seek in Trajectories: Discovering Failure Signals for VLA Runtime Monitoring
arXiv cs.AI Research & Papers
Evolutionary Algorithm for Reservoir Learning and Yielding
arXiv cs.AI Research & Papers
Unlearning in Diffusion Models: A Unified Framework with KL Divergence and Likelihood Con…
arXiv cs.AI Research & Papers
Differentially Private Preference Data Synthesis for Large Language Model Alignment
arXiv cs.AI Research & Papers
Design and Evaluation of Multi-Agent AI Oracle Systems for Prediction Market Resolution
arXiv cs.AI Research & Papers
Updating the standard neuron model in artificial neural networks
arXiv cs.AI Research & Papers
MechVQA: Benchmarking and Enhancing Multimodal LLMs on Comprehensive Mechanical Drawing U…
arXiv cs.AI Research & Papers
FEM-Bench: A Structured Scientific Reasoning Benchmark for Evaluating Code-Generating LLMs
arXiv cs.AI Research & Papers
OpenSTBench: Beyond Semantic Evaluation for Speech Translation
arXiv cs.AI Research & Papers
On the impact of retrieved content representations in RAG Pipelines
arXiv cs.AI Research & Papers
OrcaRouter: A Production-Oriented LLM Router with Hybrid Offline-Online Learning
arXiv cs.AI Research & Papers
GSAM: A Generalizable and Safe Robotic Framework for Articulated Object Manipulation
arXiv cs.AI Research & Papers
Chatterbox-Flash: Prior-Calibrated Block Diffusion for Streaming Zero-Shot TTS
arXiv cs.AI Research & Papers
A Unified and Reproducible Experimentation Framework for Speech Understanding
arXiv cs.AI Research & Papers
Flow Equivariant World Models: Memory for Partially Observed Dynamic Environments
arXiv cs.AI Research & Papers
A Novel Global Context-aware Deep Neural Network for Enhanced Brain Tumor Segmentation us…
arXiv cs.AI Research & Papers
Industrializing Prediction-Powered Inference: The GLIDE Library for Reliable GenAI and Ag…
arXiv cs.AI Research & Papers
Seeing Before Agreeing: Aligning Multi-Agent Consensus with Visual Evidence
arXiv cs.AI Research & Papers
Simple Token-Efficient Vision-Language Model for Case-level Pathology Synoptic Report Gen…
arXiv cs.AI Research & Papers
Smaller Models are Natural Explorers for Policy-Level Diversity in GRPO
arXiv cs.AI Research & Papers
Procedural Generation of First Person Shooter Maps using Map-Elites
arXiv cs.AI Research & Papers
Human-Alignment, Calibration, and Activation Patterns in Large Language Model Uncertainty
arXiv cs.AI Research & Papers
Same Patient, Different Words, Different Diagnosis? Evaluating Semantic Stability in Clin…
arXiv cs.AI Research & Papers
LARK: Learnability-Grounded Trajectory Selection for Efficient Reasoning Distillation