Explorar

Noticias de IA

30724 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
PathAgentBench: Benchmarking Evidence-Seeking Vision-Language Models on Whole-Slide Patho…
arXiv cs.AI Research & Papers
Toward Auditable Fraud Detection: Combining Graph Features, Model Explanations, and Agent…
arXiv cs.AI Research & Papers
They'll Verify. They Just Won't Act. How Authority Framing and Laundered Code Turn a Trus…
arXiv cs.AI Research & Papers
GUIDED Network-Agnostic Feature Initialization for Spatial Transferability in GNN-based M…
arXiv cs.AI Research & Papers
From Distances to Trajectories: Real-Time Signed Distance Function Mapping and Distance-A…
arXiv cs.AI Research & Papers
Provable diffusion-based posterior sampling for linear inverse problems via DDIM
arXiv cs.AI Research & Papers
Copy Less, Ground More: Overcoming Repetitive Copying in Long-Context Reasoning via Evide…
arXiv cs.AI Research & Papers
FormGym: Doing Paperwork with Agents
arXiv cs.AI Research & Papers
Learning, Reasoning, Refinement: A Framework for Kahneman's Dual-System Intelligence in G…
arXiv cs.AI Research & Papers
EvalSafetyGap: A Hybrid Survey and Conceptual Framework for LLM Evaluation-Safety Failures
arXiv cs.AI Research & Papers
Resist and Update: Counterfactual Report Coordinates for Incentive-Compatible LLMs
arXiv cs.AI Research & Papers
MEDIC: Comprehensive Evaluation of Leading Indicators for LLM Safety and Utility in Clini…
arXiv cs.AI Research & Papers
Soft-TransFormers for Continual Learning
arXiv cs.AI Research & Papers
Parameter-Efficient Continual Fine-Tuning: A Survey
arXiv cs.AI Research & Papers
GSPRec: On Improving Item Representations in Graph Signal Processing for Collaborative Fi…
arXiv cs.AI Research & Papers
TReB: A Comprehensive Benchmark for Evaluating Table Reasoning Capabilities of Large Lang…
arXiv cs.AI Research & Papers
Robust Belief-State Policy Learning for Quantum Network Routing Under Decoherence and Tim…
arXiv cs.AI Research & Papers
Breaking the MoE LLM Trilemma: Dynamic Expert Clustering with Structured Compression
arXiv cs.AI Research & Papers
Kontinuous Kontext: Continuous Strength Control for Instruction-based Image Editing
arXiv cs.AI Research & Papers
Beyond-Diagonal RIS Under Non-Idealities: Learning-Based Architecture Discovery and Optim…
arXiv cs.AI Research & Papers
QuArch: A Benchmark for Evaluating LLM Reasoning in Computer Architecture
arXiv cs.AI Research & Papers
Active Electrosensing and Communication in MARL-trained Weakly Electric Fish Collectives
arXiv cs.AI Research & Papers
Memo2496: Expert-Annotated Dataset and Dual-view Adaptive Framework for Music Emotion Rec…
arXiv cs.AI Research & Papers
When Visual Evidence is Ambiguous: Pareidolia as a Diagnostic Probe for Vision Models
arXiv cs.AI Research & Papers
TransDex: Pre-training Visuo-Tactile Policy with Point Cloud Reconstruction for Dexterous…
arXiv cs.AI Research & Papers
PlotTwist: A Creative Plot Generation Framework with Small Language Models
arXiv cs.AI Research & Papers
Doctorina MedBench-ICD10: A Dialogue-Based Benchmark and Evaluation Framework for Agent-B…
arXiv cs.AI Research & Papers
M-RAG: Semantic Key-Value Indexing for Retrieval-Augmented Generation
arXiv cs.AI Research & Papers
FVRuleLearner: Operator-Level Reasoning Tree (Op-Tree)-Based Rules Learning for Formal Ve…
arXiv cs.AI Research & Papers
CPGRec+: A Balance-oriented Framework for Personalized Video Game Recommendations