Behaviorally Grounded User Profiles from the Wild for Personalized Alignment and Multi-Pe…
Explorar
Noticias de IA
37834 elementos — filtrados, clasificados y sin duplicados
EvoSCM: Scientific Belief Revision Through Causal Model Evolution and Experimentation
ValueGraph: Value-Signal Guided Graph Pre-training for Contextualized User Representation
trajectory-judge: What Outcome-Only LLM Judges Miss on Agent Trajectories
GUI-CC: Benchmarking Contextual Consistency of GUI World Models as Agent Environments
In-Context Neurofeedback: Can LLMs Control Their Internal Representations through Privile…
When Features Become Instances: Inverted Contrastive Learning for Unsupervised Feature Se…
Vision Is Not Overhead: One-Pass Block Drafting for Lossless Speculative Decoding in Visi…
Don't Let the Model Write the YAML: Deterministic, Minimal-Diff GitOps Remediation from L…
StudyBench: Can Self-Evolution Squeeze Textbooks for Olympiad Capability?
Denoising Diffusion Generative Models Secretly Calculate Attentions
Neurosymbolics for Data Engineering: Achieving Long Context Token Reduction Without Finet…
From Detection to Refusal: Safer LLMs via Circuit-Guided Weight Scaling
Flawed in Nature, Perfect through Evolution
Selective Agent Guidance via Entropy: Learning Autonomous Policies from Imperfect VLM Tea…
SEBA: Sample-Efficient Black-Box Attacks on Visual Reinforcement Learning
RAPIDMap: Rapid Multi-Agent Pipeline for Interpretable Disaster Mapping from Satellite an…
EULER: Exploring Underused Links with Evidence-Checked Return for Multi-Agent Mathematica…
REAL-Q: E2E LLM Quantization via Dynamic Gradient Descent
Making Prospective Memory SLM-Shaped: Typed Intention Stores for Small-Model Agents
Authority Bias in Conversational Search Engines for Academic Paper Recommendation
Invalidation Contracts for Cross-Episode Agent Memory
User Representation via Cross Multi-source Behavior Pre-training for Mobile Games
Recursive Criticality of AI Self-Improvement
UI-Venus-2 Technical Report
REVISE: Validity-Guided Recovery for Online Revisions in Agent Workflows
Same Request, Different Boundary: Evaluating Cybersecurity Assistance across Conversation…
One Policy, Any Budget: Internalizing Budget-Aware Search via Reinforcement Learning
APEX-EM: Non-Parametric Online Learning for Autonomous Agents via Structured Procedural-E…
Channel-Adaptive Edge AI: Maximizing Inference Throughput by Adapting Computational Compl…