SIRIUS-SQL: Anchoring Multi-Candidate Text-to-SQL in Execution Feedback
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
SkillSmith: Co-Evolving Skills and Tools for Self-Improving Agent Systems
Science Earth: Towards A Planet-Scale Operating System for AI-Native Scientific Discovery
FlowTime: Towards Continuous Generative Watch Time Prediction via Flow-based Personalized…
GuidaPA: Privacy-Preserving Chatbot for Public Administration via Federated Learning
Don't Ask the LLM to Track Freshness: A Deterministic Recipe for Memory Conflict Resoluti…
Universal Quantum Transformer
FALAT: Tracing Failures in LLM Agent Trajectories via Dependency-Guided Search
Ev-Trust: An Evolutionarily Stable Trust Mechanism for Decentralized LLM-Based Multi-Agen…
Self-Revising Discovery Systems for Science: A Categorical Framework for Agentic Artifici…
An Enigma of Artificial Reason: Investigating the Production-Evaluation Gap in Large Reas…
A Minimalist Brain-Computer Musical Interface for Real-Time Emotion-Driven Sonification: …
TERRA: Task-Embedded Reasoning and Representation Architecture for Cross-Domain Applicati…
Latent Collaboration in Multi-Agent Systems
Crazyflow: An Accurate, GPU-Accelerated, Differentiable Drone Simulator in JAX
Neural Network Compression by Approximate Differential Equivalence
Consistent and Distinctive: LLM Benchmark Efficiency via Maximum Independent Set Prompt S…
ChronosAD: Leveraging Time Series Foundation Models for Accurate Anomaly Detection
TECCI: Tricky Edits of Collected and Curated Images
On the Limits of Token Reduction for Efficient Unified Vision Language Training
Skill or Skip? Learning Selective Skill Invocation in Agentic Tasks via Dual-Granularity …
ACON: Optimizing Context Compression for Long-horizon LLM Agents
Reinforcement Learning with Pairwise Preferences in Long-Term Decision Problems
A Unified Evaluation-Instructed Framework for Query-Dependent Prompt Optimization
Bridging Reasoning Trajectories in On-Policy Distillation via Near-Future Guidance
StressDream: Steering Video World Models for Robust Policy Evaluation and Improvement
UF-AMA: A unified framework for cross-domain emotion recognition via adaptive multimodal …
Interpreting FCDNNs via RG on Exponential Family
MobiBench: Multi-Branch, Modular Benchmark for Mobile GUI Agents
Completion at the Boundary (CaB): Deployable Switching with Completion-Aware Control unde…