Language Models Learn Constructional Semantics, Not To Mention Syntax: Investigating LM U…
Explorar
Noticias de IA
37834 elementos — filtrados, clasificados y sin duplicados
LongTraceRL: Learning Long-Context Reasoning from Search Agent Trajectories with Rubric R…
PithTrain: A Compact and Agent-Native MoE Training System
Skill Reuse as Compression in Agentic RL
Feature-Optimized Vision for Adaptive 3D Scene Reconstruction
What Gets Unmasked First? Trajectory Analysis of Diffusion Models for Graph-to-Text Gener…
Lumos-Nexus: Efficient Frequency Bridging with Homogeneous Latent Space for Video Unified…
NEMO: Execution-Aware Optimization Modeling via Autonomous Coding Agents
BilliardPhys-Bench: Benchmarking Physical Reasoning and Visual Dynamics of Multimodal LLMs
GraphARC: A Comprehensive Benchmark for Graph-Based Abstract Reasoning
XOResNet: Exclusive-OR Meta-Residuals Facilitate Deep Spiking Neural Networks Learning
Human-Alignment and Calibration of Inference-Time Uncertainty in Large Language Models
PlanningBench: Generating Scalable and Verifiable Planning Data for Evaluating and Traini…
Inferring Events from Time Series using Language Models
Chain-of-Thought Reasoning In The Wild Is Not Always Faithful
COMPASS: Cognitive MCTS-Guided Process Alignment for Safe Search Agents
CobSeg: Coherence Boundary Modeling for Dialogue Topic Segmentation
GaMi: Geometry-Agnostic Material Identification via Cross-Modal Subtractive Disentangleme…
Your Teacher Can't Help You Here: Combating Supervision Fidelity Decay in On-Policy Disti…
LLMs Without Deep Neural Networks: New Architecture, Benefits and Case Study
Revisiting Padded Transformer Expressivity: Which Architectural Choices Matter and Which …
Federated Variational Preference Alignment with Gumbel-Softmax Prior for Personalized Use…
TUX: Measuring Human--AI Tacit Understanding
Learning to Solve and Optimize by Evolving Code
SWIM: Single-Instance Whole-Body Imitation for swiMming
FreeTimeGS++: Secrets of Dynamic Gaussian Splatting and Their Principles
SEMA-RAG: A Self-Evolving Multi-Agent Retrieval-Augmented Generation Framework for Medica…
The Terminal Representation in Reinforcement Learning
Envisioning Beyond the Few: Disentangled Semantics and Primitives for Few-Shot Atypical L…
Why Linear Recurrent Memory Works in Partially Observable Reinforcement Learning