VitalAgent: A Tool-Augmented Agent for Reactive and Proactive Physiological Monitoring ov…
Explorar
Noticias de IA
37834 elementos — filtrados, clasificados y sin duplicados
Architecture-Sensitive Supervised Fine-Tuning for Screen-Conditioned Action Prediction: A…
Do Physics Foundation Models Learn Generalizable Physics? A Bias-Aware Benchmark Across P…
Learning Context-Conditioned Predicate Semantics via Prototype Feedback
The Little Book of Generative AI Foundations: An Intuitive Mathematical Primer
When 2D Tasks Meet 1D Serialization: On Serialization Friction in Structured Tasks
Predicting Causal Effects from Natural Language Queries using Structured Representations
Teaching Language Models to Check Grounded Claim Factuality with Human Test-Taking Strate…
GrowLoop: Self-Evolving Conversation Evaluation Seeded by Human
MiraBench: Evaluating Action-Conditioned Reliability in Robotic World Models
Hallucination Detection-Guided Preference Optimization for Clinical Summarization
First head-to-head comparison of agentic AI applied to the analysis of simulated data of …
CosmicFish-HRM: Adaptive Reasoning via Hierarchical Recurrent Mechanisms in Compact Langu…
LoRe: Adaptive Interaction-Evaluation Routing with Per-Step Interaction Budgets for Itera…
No Reader Left Behind: Multi-Agent Summaries Everyone Can Understand
The Cognitive Categorical Transformer: Category-Theoretic Inductive Biases for Language M…
Rubric-Guided Process Reward for Stepwise Model Routing
UA-Legal-Bench: A Benchmark for Evaluating Large Language Models on Ukrainian Legal Reaso…
Beyond Trajectory Rewards: Step-level Credit Assignment for Agentic Search via Graph Mode…
FHRFormer: A Self-Supervised Masked Transformer Framework for Fetal Heart Rate Time-Serie…
Notation Matters: A Benchmark Study of Token-Optimized Formats in Agentic AI Systems
Archon: A Unified Multimodal Model for Holistic Digital Human Generation
Diagnosing Harmful Continuation in Answer-Correct Long-CoT Training Traces
Small Agent Group is the Future of Digital Health
Intent-aligned Autonomous Spacecraft Guidance via Reasoning Models
Rel-MOSS: Towards Imbalanced Relational Deep Learning on Relational Databases
HiKEY: Hierarchical Multimodal Retrieval for Open-Domain Document Question Answering
MemoSight: Unifying Context Compression and Multi Token Prediction for Reasoning Accelera…
Combating Data Laundering in LLM Training
Hista and Numca: Estimate State Value Effectively for LLM Reinforcement Learning