SenBen: Sensitive Scene Graphs for Explainable Content Moderation
Explorar
Noticias de IA
30288 elementos — filtrados, clasificados y sin duplicados
Governed Capability Evolution: Lifecycle-Time Compatibility Checking and Rollback for AI-…
The ATOM Report: Measuring the Open Language Model Ecosystem
Chat2Workflow: A Benchmark for Generating Executable Visual Workflows with Natural Langua…
Where Hindsight Credit Can Reside: A Signed-Capacity View of Token Updates in RLVR
BrainDINO: A Brain MRI Foundation Model for Generalizable Clinical Representation Learning
When VLMs 'Fix' Students: Identifying and Penalizing Over-Correction in the Evaluation of…
From Detection to Recovery: Operational Analysis on LLM Pre-training with 504 GPUs
VT-Bench: A Unified Benchmark for Visual-Tabular Multi-Modal Learning
Tool Calling is Linearly Readable and Steerable in Language Models
FLUIDSPLAT: Reconstructing Physical Fields from Sparse Sensors via Gaussian Primitives
TADDLE: A Tool-Augmented Agent for Detecting Deficient LLM-Generated Peer Reviews
LELA: An End-to-end LLM-based Entity Linking Framework with Zero-shot Domain Adaptation
BatteryMFormer: Multi-level Learning for Battery Degradation Trajectory Forecasting
Can Broad Biomedical Knowledge be Contextualized into Scenario-Grounded Propositions?
A Sharper Picture of Generalization in Transformers
The Compressive Knowledge Graph Hypothesis: Which Graph Facts Matter for Scientific Hypot…
Maat: The Agentic Legal Research Assistant for Competition Protection
MUSE-Autoskill: Self-Evolving Agents via Skill Creation, Memory, Management, and Evaluati…
GEM: Geometric Entropy Mixing for Optimal LLM Data Curation
VISTA: An End-to-End Benchmark for Visual Spec-to-Web-App Coding Agents
PitchBench: Measuring Pitch Hearing in Audio-Language Models
InfoQuant: Shaping Activation Distributions for Low-Bit LLM Quantization
Enhancing Autonomous Online Intrusion Detection for IoT with Balanced Learning, Reliable …
A Dataset of Robot-Patient and Doctor-Patient Medical Dialogues for Spoken Language Proce…
What Makes Chain-of-Thought Work at Probe Time? Local Co-occurrence Rather Than Global De…
Your Agents Are Aging Too: Agent Lifespan Engineering for Deployed Systems
Experiments in Agentic AI for Science
From Static Context to Calibrated Interactive RL: Mitigating Distribution Shift in Multi-…
PolyFusionAgent: A Multimodal Foundation Model and Autonomous AI Assistant for Polymer Pr…