Explorar

Noticias de IA

30350 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
RTSGameBench: An RTS Benchmark for Strategic Reasoning by Vision-Language Models
arXiv cs.AI Research & Papers
CareTransition-Audit: A Benchmark to Audit Discharge Summaries for Efficient Care Transit…
arXiv cs.AI Research & Papers
Mitigating Legibility Tax with Decoupled Prover-Verifier Games
arXiv cs.AI Research & Papers
Conditional Diffusion Guidance under Hard Constraint: A Stochastic Analysis Approach
arXiv cs.AI Research & Papers
PCBSchemaGen: Reward-Guided LLM Code Synthesis for Printed Circuit Boards (PCB) Schematic…
arXiv cs.AI Research & Papers
SIGMA: Search-Augmented On-Demand Knowledge Integration for Agentic Mathematical Reasoning
arXiv cs.AI Research & Papers
AAPA: Adversarially Anchored Preference Alignment for Post-Training of Large Language Mod…
arXiv cs.AI Research & Papers
MEAL: A Benchmark for Continual Multi-Agent Reinforcement Learning
arXiv cs.AI Research & Papers
UniMM: A Unified Mixture Model Framework for Multi-Agent Simulation
arXiv cs.AI Research & Papers
SARLO-80: Worldwide Slant SAR Language Optic Dataset 80cm
arXiv cs.AI Research & Papers
Sovereign Execution Brokers: Enforcing Certificate-Bound Authority in Agentic Control Pla…
arXiv cs.AI Research & Papers
Efficient and Sound Probabilistic Verification for AI Agents
arXiv cs.AI Research & Papers
Calibration Without Comprehension: Diagnosing the Limits of Fine-Tuning LLMs for Vulnerab…
arXiv cs.AI Research & Papers
Contagion Networks: Evaluator Bias Propagation in Multi-Agent LLM Systems
arXiv cs.AI Research & Papers
Optimal Order of Multi-Agent and General Many-Body Systems
arXiv cs.AI Research & Papers
UltraQuant: 4-bit KV Caching for Context-Heavy Agents
arXiv cs.AI Research & Papers
Repurposing a Speech Classifier for Guided Diffusion-Based Speech Generation
arXiv cs.AI Security & Safety
LLM agent safety, multi-turn red-teaming, jailbreak benchmarks, adversarial robustness, s…
arXiv cs.AI Research & Papers
DataMagic: Transforming Tabular Data into Data Insight Video
arXiv cs.AI Research & Papers
CRAX: Fast Safe Reinforcement Learning Benchmarking
arXiv cs.AI Research & Papers
Robust $Q$-learning for mean-field control under Wasserstein uncertainty in common noise
arXiv cs.AI Research & Papers
ELVA: Exploring Ranking-Driven Universal Multimodal Retrieval
arXiv cs.AI Research & Papers
Finetuning Vision-Language-Action Models Requires Fewer Layers Than You Think
arXiv cs.AI Research & Papers
SPOT-E: Test-Time Entropy Shaping with Visual Spotlights for Frozen VLMs
arXiv cs.AI Research & Papers
Learner-based Concept Drift Detection: Analysis and Evaluation
arXiv cs.AI Research & Papers
HilDA: Hierarchical Distillation with Diffusion for Advancing Self-Supervised LiDAR Pre-t…
arXiv cs.AI Research & Papers
MedRLM: Recursive Multimodal Health Intelligence for Long-Context Clinical Reasoning, Sen…
arXiv cs.AI Research & Papers
From Texts to Scores: Tracing the Emergence of Essay Quality Representations in Large Lan…
arXiv cs.AI Research & Papers
Hybrid ANN-SNN Pipeline with Local Plasticity
arXiv cs.AI Research & Papers
Frequency-Aware Flow Matching for Continuous and Consistent Robotic Action Generation