Explorar

Noticias de IA

29349 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Architectural Implications of Agentic AI Workflows
arXiv cs.AI Research & Papers
Out-Of-The-Loop Multi-Fidelity Bayesian Optimization
arXiv cs.AI Research & Papers
Leak-Resistant Unlearning: A New Benchmark for Evaluating Multi-Hop Reasoning Consistency…
arXiv cs.AI Research & Papers
Protoreasoning in Tiny Transformers
arXiv cs.AI Research & Papers
Recurrent Residual Quantization: A Progressive Multi-Precision Representation for LLMs
arXiv cs.AI Research & Papers
Compass: Continuously Aligning Social Media Feeds via In-Situ Reflections
arXiv cs.AI Research & Papers
Terminal Agents Suffice for Enterprise Automation
arXiv cs.AI Research & Papers
PhysMind: From Video to Executable Worlds for Training-Free Physical Reasoning
arXiv cs.AI Research & Papers
SimMOF: AI agent for Automated MOF Simulations
arXiv cs.AI Research & Papers
Chain-of-Thought Monitoring Can Be Unreliable in Implicit-Influence Settings
arXiv cs.AI Research & Papers
FinProBench: Evaluating Financial AI Agents with Role-Grounded Rubrics Derived from Profe…
arXiv cs.AI Research & Papers
Beyond Linear Dynamics: Neural Bilinear Dynamical Models for Time Series Forecasting
arXiv cs.AI Research & Papers
GUARD: Grounding Uncertainty and Ablation-Based Risk Detection for Diffusion-Based VLAs
arXiv cs.AI Research & Papers
SJEPA: Learning Elegant Latent Dynamics with Hybrid Symbolic-Neural Predictors
arXiv cs.AI Research & Papers
A Model Merging Approach for Continual MLLM Unlearning
arXiv cs.AI Research & Papers
Provable Limits and Certified Deferral for Verbalized Uncertainty in Small Language Models
arXiv cs.AI Research & Papers
FinPerMA: A Theory-Informed, Event-Grounded Personalized-Memory Benchmark for LLM Agents
arXiv cs.AI Research & Papers
Traceable LLM-Generated Hazard Scenarios for Operational Safety Analysis of Aviation Syst…
arXiv cs.AI Research & Papers
The Luna Bound Propagator for Formal Analysis of Neural Networks
arXiv cs.AI Research & Papers
Diagnosing Tool-Selection Reasoning in LLM Agents with Canary Tools
arXiv cs.AI Research & Papers
Is Monitoring Enough? Strategic Agent Selection For Stealthy Attack in Multi-Agent Discus…
arXiv cs.AI Research & Papers
When Prompts Become Pixels: Prompt-Region Grounding for Multimodal Reasoning
arXiv cs.AI Research & Papers
EviGraph: Evidence-Guided Autonomous Research Agents
arXiv cs.AI Research & Papers
Item Response Theory for AI Safety
arXiv cs.AI Research & Papers
Seeking Physics in Diffusion Noise
arXiv cs.AI Research & Papers
TourSynbio-Search: A Large Language Model Driven Agent Framework for Unified Search Metho…
arXiv cs.AI Research & Papers
DisMix: Order-Aware Mixup for Medical Imaging via Disentangling Ordinal and Non-Ordinal F…
arXiv cs.AI Research & Papers
Temporal Context Awareness: A Defense Framework Against Multi-turn Manipulation Attacks o…
arXiv cs.AI Research & Papers
AFD-Ledger: Deployment Provisioning for Attention--FFN Disaggregation
arXiv cs.AI Research & Papers
IMFACT: Counterfactual Explanations for Time Series via Intrinsic Mode Function Substitut…