From Feelings to Metrics: Understanding and Formalizing How Users Vibe-Test LLMs
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
Generative Experiences for Digital Mental Health Interventions: Evidence from a Randomize…
MOON3.0: Reasoning-aware Multimodal Representation Learning for E-commerce Product Unders…
Place-it-R1: Unlocking Environment-aware Reasoning Potential of MLLM for Video Object Ins…
Formal Analysis and Supply Chain Security for Agentic AI Skills
AdaCorrection: Adaptive Offset Cache Correction for Accurate Diffusion Transformers
RooflineBench: A Benchmarking Framework for On-Device LLMs via Roofline Analysis
A Survey of Agent Memory in the Second Half: Towards Self-Evolving and Long-Horizon Agents
Multi-Task GRPO: Reliable LLM Reasoning Across Tasks
Beyond the Dirac Delta: Mitigating Diversity Collapse in Reinforcement Fine-Tuning for Ve…
MODEST: Multi-Optics Depth-of-Field Stereo Dataset
Chain-of-Visual-Thought: Teaching VLMs to See and Think Better with Continuous Visual Tok…
Interpreting GFlowNets for Drug Discovery: What probes can and cannot show
Neural Diversity Regularizes Hallucinations in Language Models
When Large Language Models Know the Table: A Framework for Assessing Data Contamination i…
Bi-Level Reinforcement Learning Pathway for Sim-to-Real Optimality
RESample: A Robust Data Augmentation Framework via Exploratory Sampling for Robotic Manip…
Memorization in Large Language Models in Medicine: Prevalence, Characteristics, and Impli…
Arnold: A multi-task, multi-embodiment muscle transformer policy
Pun Intended: Multi-Agent Translation of Wordplay with Contrastive Learning and Phonetic-…
Curiosity-Diffuser: Curiosity Guide Diffusion Models for Reliability
Large-Small Model Collaboration for Enhancing Edge-Deployed Small Models
Zero-shot reasoning for simulating scholarly peer-review
The Yokai Learning Environment: Tracking Beliefs Over Space and Time
GRALS: GCN-Guided Redundancy-Aware Local Search for Minimum Vertex Cover
OPD-V: Visual On-Policy Self-Distillation with Modality Balance
Chained Recursive Language Models for Multi-Iteration Reasoning
Robust and Efficient Motion Reasoning for Privacy-Aware Classroom Incident Recognition
Representational separation between unitary and channel quantum generative models via sha…
Capability-Gated Planning: Cost-to-Goal Discovery and the Limits of Myopic Experiment Sel…