Explorar

Noticias de IA

21010 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
TRACE Bench: Task-driven Roleplay Agentic Checklist Evaluation
arXiv cs.AI Research & Papers
Ethics Practices in AI Development: An Empirical Study Across Roles and Regions
arXiv cs.AI Research & Papers
HCGRec: Hint-Conditioned Generative Recommendation with Semantic IDs
arXiv cs.AI Research & Papers
From Prompting to Behavioral Alignment: Personalized LLM Judges for Recommendation Evalua…
arXiv cs.AI Research & Papers
Deep Learning Based Relative Transfer Matrix Estimation for Multiple Sources and Multiple…
arXiv cs.AI Research & Papers
GUIDE: Governed Unified Intelligence for Document-to-Artifact Generation in Enterprise Se…
arXiv cs.AI Research & Papers
DORA Explorer: Improving the Exploration Ability of LLMs Without Training
arXiv cs.AI Research & Papers
Program Semantic Inequivalence Game with Large Language Models
arXiv cs.AI Research & Papers
RoadWeaver: Large-Scale Lane-Level HD Map Generation from Scratch for Autonomous Driving …
arXiv cs.AI Research & Papers
How to Spend Your Oracle Budget: Practical Guidance for Protein Structure Prediction Mode…
arXiv cs.AI Research & Papers
ReXrank: A Public Leaderboard for AI-Powered Radiology Report Generation
arXiv cs.AI Research & Papers
Can Frontier LLMs Match Natively Multimodal Embeddings? A Comparison on Hard-Negative Tex…
arXiv cs.AI Research & Papers
AI Guardrail Survival under Single-Cycle Agentic Self-Summarization
arXiv cs.AI Research & Papers
VLM2Rec: Resolving Modality Collapse in Vision-Language Model Embedders for Multimodal Se…
arXiv cs.AI Research & Papers
Representation Finetuning for Continual Learning
arXiv cs.AI Research & Papers
Post-Training with Policy Gradients: Optimality and the Base Model Barrier
arXiv cs.AI Research & Papers
REVERE: Reflective Evolving Research Engineer
arXiv cs.AI Research & Papers
Forecasting Side Effects of Activation Steering
arXiv cs.AI Research & Papers
CoAdapt-GUI: Joint Workflow Context and Policy Adaptation for Unseen GUI Applications
arXiv cs.AI Research & Papers
Cavity-Enhanced Collective Quantum Processing with Polarization-Encoded Qubits
arXiv cs.AI Research & Papers
From Synthesis to Removal: Physics-Grounded Reflection Simulation and Diffusion-Based Vid…
arXiv cs.AI Research & Papers
Social Meaning in Large Language Models: Structure, Magnitude, and Pragmatic Prompting
arXiv cs.AI Research & Papers
VQ-bench: A Composable Vector Quantization Framework
arXiv cs.AI Research & Papers
Claim-Level Reliability Assessment for Efficient Test-Time Reasoning
arXiv cs.AI Research & Papers
Credo: Declarative Control of LLM Pipelines via Beliefs and Policies
arXiv cs.AI Research & Papers
HexEval: An Evidence-Driven Hexagonal Framework for Multidimensional Scholar Assessment
arXiv cs.AI Research & Papers
Uncertainty as a Planning Signal: Multi-Turn Decision Making for Goal-Oriented Conversati…
arXiv cs.AI Research & Papers
OpenAg: Democratizing Agricultural Intelligence
arXiv cs.AI Research & Papers
BEST-KAG: Enhancing Question Answering of Building Engineering Standards with Multimodal …
arXiv cs.AI Research & Papers
Localizing Safety Alignment: MLP Layers and Mid-Network Blocks Encode Refusal Behavior in…