FlashCP: Load-Balanced Communication-Efficient Context Parallelism for LLM Training
Explorar
Noticias de IA
29636 elementos — filtrados, clasificados y sin duplicados
LCAM: A Framework for Diagnosing Interactional Alignment Failures in Con-versational AI
To Nuke or Not to Nuke: LLMs' (Missing) Ethical Reasoning and Actions in a High-Stakes De…
MixReasoning: Switching Modes to Think
Difference-Aware Retrieval Policies for Imitation Learning
Curation of a Cardiology Interface Terminology for Highlighting Electronic Health Records…
An 84-Format Numeric Catalog with Bit-Exact Conformance Vectors: A Vendor-Neutral Referen…
Ego-Pi: VLA Fine-Tuning for Ego-Centric Human and Robot Data
Continual Quadruped Robots Coordination via Semantic Skill Discovery
Provably Efficient Personalized Multi-Objective Bandits with Proactive Conversational Que…
CoVEBench: Can Video Editing Models Handle Complex Instructions?
Learning to Attack and Defend: Adaptive Red Teaming of Language Models via GRPO
Segment-level Tree Search for Long Meeting Document Summarization
Causal Agent Replay: Counterfactual Attribution for LLM-Agent Failures
MatSciBench: Benchmarking the Reasoning Ability of Large Language Models in Materials Sci…
Vision-Based Early Fault Diagnosis and Self-Recovery for Strawberry Harvesting Robots
vla.cpp: A Unified Inference Runtime for Vision-Language-Action Models
AgriGov: A Structured Multilingual Dataset Curation for Indian Government Schemes for Far…
Integrating Deep Learning Demand Forecasting with Multi-Objective Optimization for Circul…
Benchmarking Open-Ended Multi-Agent Coordination in Language Agents
Not Just After One: Sleep-Inspired Replay Prevents Catastrophic Forgetting After Sequenti…
AlphaOPT: Formulating Optimization Programs with Self-Improving LLM Experience Library
Aligned but Not Partner-Specific: Distinguishing How Multimodal LLM Agents Succeed in Ref…
TeamHerald@CHIPSAL 2026: Hate Speech Detection and Sentiment Analysis of Nepali Memes usi…
Observability for Delegated Execution in Agentic AI Systems
MeCo: One-Step MeanFlow-based Corrector for Multi-Channel Speech Separation
End-to-End Context Compression at Scale
How Context Shapes Truth: Geometric Transformations of Statement-level Truth Representati…
ArtiFact: A Large-Scale Multi-Modal Cultural Heritage Dataset
TT-DAC-PS: Twin-Target Deterministic Actor-Critic with Policy Smoothing for Optimal Trade…