Agent Lightning v1.0: Towards Harnessed Agentic RL
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
Delegation Asymmetry in Agentic Recommender Systems: Measuring Two-Sided Receptivity in O…
Quantifying Risk Under Evolving Uncertainty: Belief-Dependent Robustness for Safe Sequent…
When to Review: Spaced Repetition for Continual Pre-Training of Language Models
AutoResearch: Insight In, Hallucination Out
TRUSS: Towards Task-Reliable and User-Safe Automated Agent Skill Generation
Efficient Dynamic Shielding for Parametric Safety Specifications
MoRA: Mobility as the Backbone for Geospatial Representation Learning at Scale
Audio Physical Dynamics Inspired Deepfake Detection for Voice Authentication Systems
When Personalization Becomes Bias: Structural and Discursive Religious Framing in AI-Gene…
Explicit State Elicitation Is Not Enough: A Controlled Audit of Memory-Policy Classificat…
EMAN: Optimization-Driven Capacity Growth through Path Emergence in Multi-Task Learning
Traceable Trust for action-ready artificial intelligence in bioscience
Benchmarking the Benchmarks: Evaluating Automated Safety Benchmarks for Small Language Mo…
HLSR: Hybrid Live Forecast Selective Dynamic Vehicle Rerouting for Real-Time Congestion A…
EvoTS-Agent: A Self-Evolving LLM Agent for Financial Time Series Change Point Detection
LEGO-RL: Harness-Native Reinforcement Learning for Coding Agents
Structure-Internalized Rule Language Model for Faithful Knowledge Graph Reasoning
Analysis of Types of Inquiries in Student-AI Interaction: A case study of two CS2 tasks
On the Fragility of Self-Improving Agents: Variance, Task Order, and Underspecification
FairNVT: Fair Classification via Noise Injection in Vision Transformers
Supporting Calibrated Reliance in Human-AI Collaboration: Different Strategies for Differ…
Attention Flows: Tracing LLM Conceptual Engagement via Story Summaries
GxP-Agent: Process-DAG Topology for Reliable Clinical Trial Programming with LLM Agents
Protect the Brain When Treating the Heart: Feasibility of 2.5D U-Net for Real-Time Gaseou…
ChannelFlow-Tools: A Configuration-Driven Pipeline for Generating Machine-Learning-Ready …
PACE: Policy-Attested Contract Execution for Safe AI Agents in Decentralized Finance
Language Family Matters: Evaluating LLM-Based ASR Across Linguistic Boundaries
Adversarial Data Modeling in Epidemiology
ASI-Bench: At the Dawn of Artificial Superintelligence