MetaVideoAgent: Automated Video-Agent Evolution for Long-Form Video Understanding
Explorar
Noticias de IA
21813 elementos — filtrados, clasificados y sin duplicados
Causal Evidence Extraction and Triangulation in Crisis Reports using Large Language Model…
What Is a Skill Worth? Structure-Aware Shapley Valuation of Agent Skills
Leak-Resistant Unlearning: A New Benchmark for Evaluating Multi-Hop Reasoning Consistency…
RESPClinBench: Benchmarking Multimodal Clinical Decision-Making and Longitudinal Disease …
AFD-Ledger: Deployment Provisioning for Attention--FFN Disaggregation
Eigenius: A Typed Knowledge-Graph DBMS with Epistemic Stratification and Institution-Medi…
Beyond Global Routing Aggregation: Phase-Aware Expert Merging for MoE Vision-Language Mod…
A Counterexample to Fourier Alignment in Single-Neuron Modular Addition
Zero-Mem: Zero-Token Memory Operations for LLM Agents
Predict, Then Retrieve: Cross-Instance Future-State Retrieval from Video Prefixes
Generative Optimization for Incentivized Advertising with Global Level Constraints
PI-Mem: Pushing Long-Context Reasoning to 3.6M Tokens with Parallel-Iterative Memory
Learning Music Style for Piano Arrangement Through Cross-Modal Bootstrapping
CorePath: A Breast-Specialized Pathology Foundation Model for Core Needle Biopsy Diagnosi…
Adaptive Two-Stage Visual Token Pruning for Efficient Inference in Video-Language Models
SMOPD: Multi-Reward Reinforcement Learning via Specialize-and-Merge Online Policy Distill…
Evaluating LLM Trade-offs for Enterprise Automation: Lessons from Workflow Generation in …
Principles of Robot Autonomy
PLAN: Parallel Liquid-Inspired Approximation Network for Efficient Representation Learnin…
Pattern over Pixels: Measuring Pattern Completion Bias in Multimodal Code Generation
SynEnergy: Anomaly Semantic-Guided Diffusion for Synthetic Energy Data Generation
ChronoLens: Measuring Language Change Across Time, Languages, and Linguistic Levels
FinVerse: Financial Time-Series Benchmark
Pivot-Centric Trajectory Prediction: Bridging Long Horizons via Dynamical Guidance
Training Documents Reranker with Search Rubrics for Deep Research Agent
GAP-URGENet: A Generative-Predictive Fusion Framework for Universal Speech Enhancement
Standalone DINOv3 for Training-Free Open-Vocabulary Semantic Segmentation in Remote Sensi…
Internalising the Identity Primitive: Cryptographic Individuality for an Autonomous Agent…
LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs