Explorar

Noticias de IA

30304 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Adjudicated Captioning: Multi-Agent Alignment Scoring and Consensus-Distilled Beam Arbitr…
arXiv cs.AI Research & Papers
Auto-JEPA: A Latent World Model of Continuous Intent for End-to-End Autonomous Driving
arXiv cs.AI Research & Papers
Improving scDiffusion with Sparsity-Biased Classifier-Free Guidance
arXiv cs.AI Research & Papers
AgentHPOBench: A Benchmark For Evaluating LLM Agents as Sequential Hyperparameter Optimiz…
arXiv cs.AI Research & Papers
Learning Lookahead Lemmas for Neural Network Verification
arXiv cs.AI Research & Papers
ModelEquivBench: Certifying Multi-Relational Evaluation of LLM-Generated Optimization Mod…
arXiv cs.AI Research & Papers
The Formalism Trap: Are LLM-as-a-Judge Evaluators Blinded by Consensus Mimicry under Soci…
arXiv cs.AI Research & Papers
Federated Foundation Models Fine-Tuning with Heterogeneous Compressed Clients
arXiv cs.AI Research & Papers
Safety, or Just Capability? A Validity Audit of Agent-Safety Benchmarks
arXiv cs.AI Research & Papers
Looks Right, Works Right: A Project-Level Benchmark for Multi-Screen Mobile App Generation
arXiv cs.AI Research & Papers
Library Reachability in LSR-Synth: How Anti-Memorization Design Changes the Measurement o…
arXiv cs.AI Research & Papers
InferQ: A Database-Oriented Benchmark for Quantum Circuits Simulation
arXiv cs.AI Research & Papers
ConnectED: A Curriculum-Aligned AI System for Vietnamese Instructional Lesson Planning an…
arXiv cs.AI Research & Papers
Why It Hurts: Identifying the Drivers of Negative Thoughts in Emotional Support Conversat…
arXiv cs.AI Research & Papers
Have I Seen You? Embedding Behavior Signals Synthetic Face Dataset Membership
arXiv cs.AI Research & Papers
Maximum Entropy Behavior Exploration for Sim2Real Zero-Shot Reinforcement Learning
arXiv cs.AI Research & Papers
Reasoning in Real World Clinical Care: Why Large Language Models Are Not Yet Safe for Aut…
arXiv cs.AI Research & Papers
How Hard Does It Think? Analyzing Step-Aware Reasoning Energy in LLM Chain-of-Thought Tra…
arXiv cs.AI Research & Papers
Generative AI in Action: Field Experimental Evidence from Alibaba's Customer Service Oper…
arXiv cs.AI Research & Papers
ActionParty: Multi-Subject Action Binding in Generative Video Games
arXiv cs.AI Research & Papers
An Ontology-Guided, Deduplication-Aware Extraction Layer for Knowledge Graph Construction…
arXiv cs.AI Research & Papers
Evaluating the Alignment Between GeoAI Explanations and Domain Knowledge in Satellite-Bas…
arXiv cs.AI Research & Papers
TimeRFT: Stimulating Generalizable Time Series Forecasting for TSFMs via Reinforcement Fi…
arXiv cs.AI Research & Papers
TAPR: Enhancing LLM Performance with a Task-Aware Prompt Rewriter
arXiv cs.AI Research & Papers
Predict-then-Diffuse: Adaptive Response Length for Compute-Budgeted Inference in Diffusio…
arXiv cs.AI Research & Papers
RePaCA: Leveraging Reasoning Large Language Models for Static Automated Patch Correctness…
arXiv cs.AI Research & Papers
Patch-Based 3D Variational Autoencoder for Super-Resolution of Turbulent Channel Flow
arXiv cs.AI Research & Papers
Detecting AI-Generated Videos with Spiking Neural Networks
arXiv cs.AI Research & Papers
DRIP-R: A Benchmark for Decision-Making and Reasoning Under Real-World Policy Ambiguity i…
arXiv cs.AI Research & Papers
CLIFT: Turning Gemini Robotics On-Device into Humanoid Specialists via Non-Invasive Close…