Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
On the Generalization of Steering Vectors for Chain-of-Thought Faithfulness
arXiv cs.AI Research & Papers
On a joint simultaneous learning of relevant feature subsets and subspaces in regression-…
arXiv cs.AI Research & Papers
A Unified Benchmark of Deep Learning Models for Multi-task 3D Brain Tumor Segmentation fr…
arXiv cs.AI Research & Papers
SciToolAgent-Evo: An Ontology-Aware Self-Evolving Agent for Open-World Scientific Tool Ac…
arXiv cs.AI Research & Papers
Multi-Agent Planning with Spatio-Temporal and Topological Constraints using STL-GO
arXiv cs.AI Research & Papers
HenTwin: A Multimodal Digital Twin Framework for Longitudinal Biological State Monitoring…
arXiv cs.AI Research & Papers
COntExt: Towards Context-Aware Ontology Extension from Operational Metrics
arXiv cs.AI Developer Tooling
metasignal: A Python Package for Comprehensive Metacognitive Analysis and Decision-Making
arXiv cs.AI Research & Papers
Hypergradient-based Bilevel Reinforcement Learning with Improved Sample Complexity
arXiv cs.AI Research & Papers
Evaluating Federated Pre-Training: On the Reliability of Downstream Fine-Tuning and Intri…
arXiv cs.AI Research & Papers
Benchmarks Are Not Monolithic: Sample-Level Auditing and Orchestration for LLM Evaluation
arXiv cs.AI Research & Papers
Stratified Negation in RDF Rules: A Correct Approach (Extended Version)
arXiv cs.AI Research & Papers
LAWFUL: Law-Aligned Witness for Faithful Use of Latents
arXiv cs.AI Research & Papers
WaiT for the Signal: Simple Frequency-Aware Flow-Matching
arXiv cs.AI Research & Papers
SCMA: Structure-Conditioned and Metal-Aware Flow Matching for CT Metal Artifact Reduction
arXiv cs.AI Research & Papers
SEDR-Seq2P: A Lightweight Dilated Residual Sequence-to-Point Network for Multi-Task Indus…
arXiv cs.AI Research & Papers
Towards White-Box Deep Wireless Sensing
arXiv cs.AI Research & Papers
Beyond Borrowed Histories: Person-Aligned User Simulation for Interactive Role-Playing Ev…
arXiv cs.AI Research & Papers
WitCert: Sound Runtime Risk Observability and Gating for KV-Cache Quantization
arXiv cs.AI Research & Papers
SE(3)-MeanFlow: Few-Step Protein Backbone Generation on Lie Groups
arXiv cs.AI Research & Papers
AMTFV: Agentic Mathematical Tool-Flow Verification for LLM Self-Correction
arXiv cs.AI Research & Papers
Self-Play Meets Skill Evolution: Self-Evolving Search Agents that Pose, Solve, and Rememb…
arXiv cs.AI Research & Papers
Beyond Retrieval: Analytic Memory for Multimodal Agents
arXiv cs.AI Research & Papers
Beyond Component Testing: Validating Agentic AI Systems
arXiv cs.AI Research & Papers
Tool Specifications Matter: Uncovering and Mitigating Safety Risks in AI Agents
arXiv cs.AI Research & Papers
Efficient LLM Adversarial Training via Low-Rank Defense and Circuit-Guided Surrogates
arXiv cs.AI Research & Papers
Don't Mix Rewards, Mix Policies: Policy Decomposition and Optimization for Multi-Reward RL
arXiv cs.AI Research & Papers
MirrorCraft: Paired Evaluation under Hidden Rule Changes in Minecraft
arXiv cs.AI Research & Papers
Benchmarking LLM Competence on Logical Inference over Probability Operators
arXiv cs.AI Research & Papers
LEX-EC: A Lexical Evidence-Channel Audit Framework for Zero-Shot LLM Personality Classifi…