When Does Persona Prompting Actually Help? A Retrieval and Metric Analysis of Expert Role…
Explorar
Noticias de IA
21272 elementos — filtrados, clasificados y sin duplicados
Architecture-Sensitive Supervised Fine-Tuning for Screen-Conditioned Action Prediction: A…
TRACER: Persistent Regularization for Robust Multimodal Finetuning
WorldMemArena: Evaluating Multimodal Agent Memory Through Action-World Interaction
SAME: Stabilized Mixture-of-Experts for Multimodal Continual Instruction Tuning
Risk-Controlled Lean-as-Judge for Natural-Language Mathematical Reasoning
MemTrace: Tracing and Attributing Errors in Large Language Model Memory Systems
BIRDNet: Mining and Encoding Boolean Implication Knowledge Graphs as Interpretable Deep N…
IPO-Mine: A Toolkit and Dataset for Section-Structured Analysis of Long, Multimodal IPO D…
Do LLMs Build World Models From Text? A Multilingual Diagnostic of Spatial Reasoning
Rethinking Memory as Continuously Evolving Connectivity
Skill-Conditioned Gated Self-Distillation for LLM Reasoning
OmniVerifier-M1: Multimodal Meta-Verifier with Explicit Structured Recalibration
The Shape of Reasoning: Topological Analysis of Reasoning Traces in Large Language Models
A Comparative Study of Rule-Based and Data-Driven Approaches in Industrial Monitoring
RL Squeezes, SFT Expands: A Comparative Study of Reasoning LLMs
CircuitLM: A Multi-Agent LLM-Aided Design Framework for Generating Circuit Schematics fro…
Can I Have Your Order? Monte-Carlo Tree Search for Slot Filling Ordering in Diffusion Lan…
COOP$^2$: Defining, Observing, and Repairing Cooperation in LLM Multi-Agent Systems
FactReview: Evidence-Grounded Peer Review with Execution-Based Claim Verification
Reading or Guessing? Visual Grounding Failures of Vision-Language Models for OCR in Ancie…
Graph-of-Skills: Dependency-Aware Structural Retrieval for Massive Agent Skills
DSSE: a drone swarm search environment
Escher-Loop: Mutual Evolution by Closed-Loop Self-Referential Optimization
Verifiable Process Rewards for Agentic Reasoning
Delay-Aware Reinforcement Learning for Highway On-Ramp Merging under Stochastic Communica…
EngiAI: A Multi-Agent Framework and Benchmark Suite for LLM-Driven Engineering Design
FLUID: From Ephemeral IDs to Multimodal Semantic Codes for Industrial-Scale Livestreaming…
Revisiting Graph Autoencoders as Implicit Contrastive Learners
Isometry pursuit