Explorar

Noticias de IA

22318 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
The Metanym Game: A Self-Contained, Self-Consistent LLM Peer-Community Benchmark for Stru…
arXiv cs.AI Research & Papers
UniRank: Unified Rank Allocation for Low-Rank LLM Compression
arXiv cs.AI Research & Papers
Intent-Governed Tool Authorization for AI Agents
arXiv cs.AI Research & Papers
AgentDSE: Reasoning-Augmented Architectural Design Space Exploration
arXiv cs.AI Research & Papers
Plans Don't Persist: Why Context Management Is Load Bearing for LLM Agents
arXiv cs.AI Research & Papers
Text-to-Image Generative AI for Modeling and Simulation: Methods, Opportunities, and Appl…
arXiv cs.AI Research & Papers
Detecting Satellites in Radio-Frequency Data via Semi-Supervised Learning
arXiv cs.AI Research & Papers
Not All Claims Are Equally Risky: FACTOR for Adaptive Verification in Factual Long-Form G…
arXiv cs.AI Research & Papers
Generating Public Health Responses using Survey-Augmented Large Language Models
arXiv cs.AI Research & Papers
A Matter of Time: Towards a General Theory of Agency
arXiv cs.AI Research & Papers
DEMM-Bench: A Cross-Regime Benchmark for Agent-Runtime Governance-Evidence Sufficiency
arXiv cs.AI Research & Papers
Human and AI collaboration for pulmonary nodule segmentation
arXiv cs.AI Research & Papers
Is Agent Code Less Maintainable Than Human Code?
arXiv cs.AI Research & Papers
Scaling Linear Mode Connectivity and Merging to Billion Parameter Pretrained Transformers
arXiv cs.AI Research & Papers
CalVerT: Augmenting Agents with Calibrated Verifier Telemetry Improves Action and Learnin…
arXiv cs.AI Research & Papers
Learning What Not to Forget: Long-Horizon Agent Memory from a Few Kilobytes of Learning
arXiv cs.AI Research & Papers
Interpretable Uncertainty Routing Separating Emotion Ambiguity from Distribution Shift in…
arXiv cs.AI Research & Papers
Scene-Level Heterogeneous Physics Simulation with 3D Gaussian Splats
arXiv cs.AI Research & Papers
When Confidence Takes the Wrong Path: Diagnosing Retrieval-State Lock-In in RAG
arXiv cs.AI Research & Papers
EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning
arXiv cs.AI Research & Papers
Cohort Organized Learning: Clustering Through Agreement
arXiv cs.AI Research & Papers
Litmus: Zero-Label, Code-Driven Metric Specification for Evaluating AI Systems
arXiv cs.AI Research & Papers
CADRE: Stable, Parameter Efficient Adaptation of Medical Vision Language Models with Boun…
arXiv cs.AI Research & Papers
Denoising Iterative Self-Correction: Structured Verification Loops for Reliable LLM Reaso…
arXiv cs.AI Research & Papers
PrivacyAlign: Contextual Privacy Alignment for LLM Agents
arXiv cs.AI Research & Papers
Clinical Term Extraction using Open-Source Small Language Models
arXiv cs.AI Research & Papers
TACO: Task-Aware Column Description Generation Using LLMs
arXiv cs.AI Research & Papers
POTracker: Optimizing Large Language Models for Standard-Compliant Power Outage Report Ge…
arXiv cs.AI Research & Papers
Decodable but Not Faithful: Coupling Natural-Language Rationales to Programmatic Verifiers
arXiv cs.AI Research & Papers
When Is an LLM Worth It for Hyperparameter Optimization? A Budget-Matched Study on Tabula…