Clustering as Reasoning: A $k$-Means Interpretation of Chain-of-Thought Graph Learning
Browse
AI News
30934 items — filtered, classified, deduplicated
Generative Visual Code Mobile World Models
Fine-Tuning Language Models to Know What They Know
Adversarial Network Imagination: Causal LLMs and Digital Twins for Proactive Telecom Miti…
Two-Sided Time-Independent Regret for Matching Markets with Limited Interviews
STAPO: Stabilizing Reinforcement Learning for LLMs by Silencing Rare Spurious Tokens
JAEGER: Joint 3D Audio-Visual Grounding and Reasoning in Simulated Physical Environments
When Correct Beliefs Collapse: Epistemic Resilience of LLMs under Clinical Pressure
Energy Shields for Fairness
ExplainReduce: Generating global explanations from many local explanations
Grouter: Decoupling Routing from Representation for Accelerated MoE Training
Frequency Matters: Fast Model-Agnostic Data Curation for Pruning and Quantization
Design Conditions for Intra-Group Learning of Sequence-Level Rewards: Token Gradient Canc…
Profiling learners' affective engagement: Emotion AI, intercultural pragmatics, and langu…
Privacy-Preserving Local Language Models for Longitudinal Data Retrieval in Chronic Derma…
Generative AI impacts on intra-urban inequality and skill premium in Beijing
Page image classification for content-specific data processing
M$^\star$: Every Task Deserves Its Own Memory Harness
Cooperative Memory Paging with Keyword Bookmarks for Long-Horizon LLM Conversations
Committed SAE-Feature Traces for Audited-Session Substitution Detection in Hosted LLMs
Sparse Tokens Suffice: Jailbreaking Audio Language Models via Token-Aware Gradient Optimi…
Internalizing Outcome Supervision into Process Supervision: A New Paradigm for Reinforcem…
Intelligent Truck Matching in Full Truckload Shipments using Ping2Hex approach
HEPA: A Self-Supervised Horizon-Conditioned Event Predictive Architecture for Time Series
Learning Selective Merge Policies for Deadline-Constrained Coded Caching via Deep Reinfor…
BacktestBench: Benchmarking Large Language Models for Automated Quantitative Strategy Bac…
From Simulation to Enaction: Post-trained language models recognize and react to their ow…
A Simplex Witness Certificate for Constant Collapse in Variational Autoencoders
CounterFlow: A Two-Phase Inference-Time Sampling for Counterfactual Video Foley Generation
DarkForest: Less Talk, Higher Accuracy for Multi-Agent LLMs