Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Measuring the Behavioral Fidelity of Long-Horizon Human Activity Simulations
arXiv cs.AI Research & Papers
CHARM: Character Hallucination for Multicultural Role Play Benchmark
arXiv cs.AI Research & Papers
Provably Safe Sim-to-Real Transfer
arXiv cs.AI Research & Papers
Towards Provable and Scalable Training of Quantized Neural Networks with Ising Optimizati…
arXiv cs.AI Research & Papers
Analog-DB: An Agent-First Analog Integrated Circuit Database, From Blocks to Systems
arXiv cs.AI Research & Papers
LEAP: Likelihood Elicitation and Aggregation for LLM-based Probabilistic Forecasting
arXiv cs.AI Research & Papers
Neuro-Symbolic Geometric Abstraction (NeuSOGA): From Observations to Symbolic Mathematica…
arXiv cs.AI Research & Papers
3D-Consistent Multi-View Editing by Correspondence Guidance
arXiv cs.AI Research & Papers
AgentFactory: Towards Automated Agentic System Design and Optimization
arXiv cs.AI Research & Papers
H2Table: Hierarchical Hypergraph-Enhanced Large Language Models for Complex Table Reasoni…
arXiv cs.AI Research & Papers
Data-Driven Persona-Conditioned Agents for A/B Test Simulation
arXiv cs.AI Research & Papers
User Representation via Cross Multi-source Behavior Pre-training for Mobile Games
arXiv cs.AI Research & Papers
Spawn Freely, Act Sparingly: Progressive Risk Vesting for Recursive LLM-Agent Trees
arXiv cs.AI Research & Papers
Athena: Vulnerability-Affected Library Identification via Knowledge Graph Completion
arXiv cs.AI Research & Papers
Prompt-Robust Language Models: Which Training Strategies Work?
arXiv cs.AI Research & Papers
Counterfactual Fragility Certificates: Exposing High-Confidence Brittleness under Structu…
arXiv cs.AI Research & Papers
StainPresetNet: Stain Preset Network for Fast Multi-to-Multi Stain Normalization
arXiv cs.AI Research & Papers
Figures as Programs: Recursive Generation of Editable Scientific Figures
arXiv cs.AI Research & Papers
Few-Shot Out of Domain Intent Detection with Covariance Corrected Mahalanobis Distance
arXiv cs.AI Research & Papers
RPCBench: A Benchmark for Proactive Premise Critique in LLM-based Recommendation
arXiv cs.AI Research & Papers
TimeSteer: Inference-Time Speech Scheduling in Joint Audio-Visual Diffusion Models
arXiv cs.AI Research & Papers
CARE: Contrastive Anchor-based Rubric Evolution for Large Language Model Post-Training
arXiv cs.AI Research & Papers
Towards reliable multimodal disaster severity assessment through preference optimization …
arXiv cs.AI Research & Papers
CacheBridge: Efficient Cross-Model KV Cache Transfer
arXiv cs.AI Research & Papers
EmbodiedSkills: A Unified Framework for Orchestrating, Training, and Deploying VLA Agents
arXiv cs.AI Research & Papers
EDRAC: Benchmarking Arabic Dialect Reading Comprehension
arXiv cs.AI Research & Papers
On Synthesis of Metric Interval Temporal Logics
arXiv cs.AI Research & Papers
Revisiting Face Recognition for Monozygotic Twins: The Celeb Twins Test Set
arXiv cs.AI Research & Papers
Calibration is the Bottleneck: An Action-Class Diagnostic of Multi-Turn Tool-Calling
arXiv cs.AI Research & Papers
Text-guided flow matching enables sample-efficient crystal structure generation