PassNet: Scaling Large Language Models for Graph Compiler Pass Generation
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
ConMoE: Expert-Pool Consolidation via Prototype Reassignment for MoE Compression
Indexing the Unreadable: LLM-Native Recursive Construction and Search of Service Taxonomi…
Harmonizing Real-Time Constraints and Long-Horizon Reasoning: An Asynchronous Agentic Fra…
Citation-Closure Retrieval and Per-Rule Attribution for Real-World Regulatory Compliance …
From XXLTraffic to EvoXXLTraffic: Scaling Traffic Forecasting to Sensor-Evolving Networks
Label Over Logic? How Source Cues Bias Human Fallacy Judgments More Than LLMs
Estimating the Empowerment of Language Model Agents
Paper Agents, Paper Gains: An Empirical Analysis of DeFi Investment Agents
Mechanism Shift During Post-training from Autoregressive to Masked Diffusion Language Mod…
LaRA: Layer-wise Representation Analysis for Detecting Data Contamination in RL Post-Trai…
Demystifying Data Organization for Enhanced LLM Training
Aryabhata 2: Scaling Reinforcement Learning for Advanced STEM Reasoning
On Language Generation in the Limit with Bounded Memory
When and How Human Curation Backfires: Preference Alignment under Multi-Model Self-Consum…
Survey of End-to-End Multi-Speaker Automatic Speech Recognition for Monaural Audio
A Composable Multimodal Framework for cine CMR-Text-Driven Prediction of Heart Failure Ou…
Pushing the Limits of Block Rotations in Post-Training Quantization
CrystalXRD-Bench: Benchmarking Vision-Language Models for XRD Peak Indexing Across Divers…
Less is Enough: Synthesizing Diverse Data in LLM Feature Space with Sparse Autoencoders
Same Evidence, Different Answers: Canonical-Context On-Policy Distillation for Multi-Turn…
Reinforcement Learning with Robust Rubric Rewards
Battery-Sim-Agent: Leveraging LLM-Agent for Inverse Battery Parameter Estimation
PRO-CUA: Process-Reward Optimization for Computer Use Agents
Evolutionary Rule Extraction from Corporate Default Prediction Models
BORA: Bridging Offline Reinforcement Learning and Online Residual Adaptation for Real-Wor…
CalArena: A Large-Scale Post-Hoc Calibration Benchmark
Singularity-aware Optimization via Randomized Geometric Probing: Towards Stable Non-smoot…
How Much Is a Dataset Worth? Scaling Laws, the Vendi Score, and Matrix Spectral Functions
On the Optimizer Dependence of Neural Scaling Laws