Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
DRBENCHER: Can Your Agent Identify the Entity, Retrieve Its Properties and Do the Math?
arXiv cs.AI Research & Papers
FinTrace: Holistic Trajectory-Level Evaluation of LLM Tool Calling for Long-Horizon Finan…
arXiv cs.AI Research & Papers
ConMem: Contribution-Aware Memory for Long-Horizon Manufacturing Inspection Logs
arXiv cs.AI Research & Papers
Do Evaluation Metrics Detect Errors in Classical Chinese to English Translations?
arXiv cs.AI Research & Papers
Frequency-Domain Dual-Branch Fusion for Medical Visual Question Answering
arXiv cs.AI Research & Papers
SkillClaw: Let Skills Evolve Collectively with Agentic Evolver
arXiv cs.AI Research & Papers
Scaling Inherently Interpretable Language Models
arXiv cs.AI Research & Papers
A Statistical Framework for Auditing Behavioral Dependence and Induced Bias in LLM Judges
arXiv cs.AI Research & Papers
A foundation model of numerical intelligence with cross-disciplinary generalization
arXiv cs.AI Research & Papers
The Capability Ladder: A Curriculum-Modernization Framework for Workforce Readiness in th…
arXiv cs.AI Research & Papers
Towards Researcher Agents for Knowledge-Graph Question Answering
arXiv cs.AI Research & Papers
Neurosymbolic Discovery of Algebraic Graph Constructions
arXiv cs.AI Research & Papers
TongGuOCR: A Layout-Aware and Token-Augmented OCR Framework for Chinese Historical Docume…
arXiv cs.AI Research & Papers
MonitorBench: A Comprehensive Benchmark for Chain-of-Thought Monitorability in Large Lang…
arXiv cs.AI Research & Papers
A Comparative Study in Surgical AI: Potential and Limitations of Data, Compute, and Scali…
arXiv cs.AI Research & Papers
Constraining ontology mappings using metaphysical choices
arXiv cs.AI Research & Papers
Dynamic Coalition Formation and Communication Pricing in Skill-Based Agentic AI Systems
arXiv cs.AI Research & Papers
Beyond Static Models: An Evolving Framework for Continual Learning in Large Language Mode…
arXiv cs.AI Research & Papers
MoRSE: Task-Oriented Multi-Agent System with Mixture of Role-Subtask Experts
arXiv cs.AI Research & Papers
DistillCache: KL-Guided Adaptive KV-Cache Eviction for Memory-Efficient LLM Inference
arXiv cs.AI Research & Papers
RangeFactory: Scalable Construction of Multi-Hop Cyber Ranges
arXiv cs.AI Research & Papers
El Agente Gr\'afico: A Semantic Execution Runtime for Scientific Agents
arXiv cs.AI Research & Papers
Social Gym and SPaRTan: Benchmarking and Improving LLM Social Reasoning via Multi-Agent G…
arXiv cs.AI Research & Papers
FreSH: Frequency-Segmented Hierarchical Multi-Expert Framework for Multivariate Time Seri…
arXiv cs.AI Research & Papers
Targeted Counterfactual Fingerprinting for Black-Box LLM Ownership Verification
arXiv cs.AI Research & Papers
When Is a Steerable Concept Representation Real? Measurement Confounds in a Cross-Family …
arXiv cs.AI Research & Papers
Biologically Informed Representation Learning for Robust Cross-Center Generalization of M…
arXiv cs.AI Research & Papers
VTO: Visual Tool Orchestration for Video Anomaly Detection
arXiv cs.AI Research & Papers
Structure-Enhanced Features and Quality-Aware Dynamic Anchor Scoring for Robust Lane Dete…
arXiv cs.AI Research & Papers
Privacy-Preserving Data Drift Detection and Recovery for Large-Scale LLM Applications via…