CastFSR: A Fast--Slow--Reflect Agentic Reasoning Framework for Context-Aware Time Series …
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
AI Agent Economics: Can Autonomous Economic Behavior Emerge among AI Agents under Minimal…
Beyond Average Performance: Dynamic Instance Clustering and Specialized Algorithm Design …
Verifiable Memory: Learning Unified Memory Management with Local and Global Verifiers for…
Spatial proteomics guided by H&E-based AI reveals recurrence-risk niches in triple-negati…
Evidence-Grounded Multimodal Knowledge Graph Construction for Multi-Lecture Educational R…
Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation
Surrogate Substitution Preserves PHI Detectability: A Multi-Detector Equivalence Study
TumorBoard: Evidence-Grounded Multi-Agent Decision Support for Longitudinal Neuro-Oncology
TaskPress: Query-Agnostic KV Cache Compression via Task-Guided Pruning
AgentPanel: Toward a New Paradigm for Human--AI Collaboration in Exploring Scientific Que…
DocTrace: Towards Traceable Long Document VQA via Hierarchical Evidence Graph Reasoning
Distractor-Aware Truncation: Disentangling Context-Length Effects from Signal Loss in Lon…
Solver-Aware Decompositions for Programming-by-Example: When Dividing Requires Knowing ho…
LeanMem: Simple and Efficient Long-Term Memory for LLM Agents
ChartAnno: Evaluating MLLMs for Chart Annotation Generation
When Correct Solutions Repeat: Rarity-Aware Credit Redistribution for GRPO
ToolLIFT: Lifting Tool-Specific Trajectories into Function-Level Graphs for Generalizable…
WeClawArena: An Auditable Sandbox and Benchmark for Cross-User Agents Collaboration and S…
Can LLM design high-quality experiments? A Comprehensive and Systematic Benchmark on Auto…
Behaviorally Adaptive Visual Diversion for Inclusive and Resilient Digital Assessment Del…
Soft Guidance Starts to Outperform CoT Prompting as LLMs Improve
Enhancing Tabular Learners with Context-Aware Semantic Embeddings
Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Cap…
From Social Coding to Agentic Coding: Productivity and Relational Reconfiguration in Open…
FOUND-AF: Benchmarking ECG Foundation Models for Atrial Fibrillation Detection
FraQ: Efficient Coordinate-Space Recompression for Federated Low-Rank Adaptation
Formal Verification of Agentic Systems over Operational Data
Rethinking Modality Reliability in Multimodal Sentiment Analysis with Incomplete Observat…
Unequal Verdicts: Investigating Gender Bias in LLM-Based Fake News Detection