Towards Agentic Cloud Engineering: Graph and Loop Engineering with a Zero-Trust Agent Har…
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
ReNFT: Repairing Mode Collapse in Reward Post-Training via Internal Probability-Mass Reca…
EDRAC: Benchmarking Arabic Dialect Reading Comprehension
ChatDev 2.0: A No-Code Multi-Agent Platform for Developing Everything
Who Judges the Judges? A Chinese Safety QA Benchmark for Evaluating LLM Responses and Saf…
Life Operators: a self-evolving framework for multiscale life modelling
InteractBench: Benchmarking LLMs on Competitive Programming under Unrevealed Information
A Study of Hidden-State Optimization Order in Predictive Coding Networks
Selective Agent Guidance via Entropy: Learning Autonomous Policies from Imperfect VLM Tea…
Visual Framing for News Stance Detection via Image Generation
RAPIDMap: Rapid Multi-Agent Pipeline for Interpretable Disaster Mapping from Satellite an…
Task-Specific Prompt with Global Context for Multi-Task Graph Pre-Training
EEG-VID: Task-Guided Latent Predictive Pretraining for EEG Decoding and Assistive Target …
The Interlingua Hypothesis: LLMs Translate via a Latent Task-agnostic Feature Space
WiseSpec: Requirements-Driven Agents for Code Generation
GeoPAR: Large-Scale Multi-Agent Combinatorial Optimization with Geometry-Guided Parallel …
Predicting Program Exit Code with LLMs and Programming Language Semantics
Breaking the Structural Identity: Personalized Federated LoRA Fine-tuning under Rank Hete…
Towards Effective Structured Context Modeling for Conversational Recommender Systems via …
Heard but Not Heeded: Paralinguistic Information Encoding and Loss in Audio-Language Mode…
Can LLMs Discover Scientific Laws in Real and Parallel Worlds?
Assessing Alignment and Stability of Feature Importance Explanations via Weight of Eviden…
Good Memory Has ECC: Evaluating the Memory of Vision-Language Models Beyond Accuracy
Lingua Franca or Probing Artifact? Rethinking Latent Language in Multilingual LLMs
EdiTikZ: Scientific Figure Editing from Revision Trajectories
When Guardrails Look Effective: Construct Validity Failures in LLM Agent Commerce Evaluat…
Parsing the Stream: A Live Trace Model for Long-Horizon Agents and Their Observers
Neuro-Symbolic Geometric Abstraction (NeuSOGA): From Observations to Symbolic Mathematica…
Intelligent Edge Computing
Delegation Without Trust: An Empirical Gap Analysis of Identity, Authorization, and Runti…