S-MARC: Causal Streaming Reasoning for Full-Duplex Conversational Behavior Modeling
Explorar
Noticias de IA
37834 elementos — filtrados, clasificados y sin duplicados
Good SFT Optimizes for SFT, Better SFT Prepares for Reinforcement Learning
Learn from A Rationalist: Distilling Intermediate Interpretable Rationales
Grammar-Aware Literate Generative Mathematical Programming with Compiler-in-the-Loop
CORE-T: COherent REtrieval of Tables for Text-to-SQL
Causal-JEPA: Learning World Models through Object-Level Latent Masking
Dynamics Within Latent Chain-of-Thought: An Empirical Study of Causal Structure
RewardFlow: Topology-Aware Reward Propagation on State Graphs for Agentic RL with Large L…
From Rubrics to Reliable Scores: Evidence-Grounded Text Evaluation with LLM Judges
Bridging the Semantic Gap for Categorical Data Clustering via Large Language Models
AgentDropoutV2: Optimizing Information Flow in Multi-Agent Systems via Test-Time Rectify-…
The Best of the Two Worlds: Harmonizing Semantic and Hash IDs for Sequential Recommendati…
Revisiting the Reliability of Language Models in Instruction-Following
SCoOP: Semantic Consistent Opinion Pooling for Uncertainty Quantification in Multiple Vis…
MemCollab: Cross-Model Memory Collaboration via Contrastive Trajectory Distillation
BioArc: Discovering Optimal Neural Architectures for Biological Foundation Models
Cognitive Pivot Points and Visual Anchoring: Unveiling and Rectifying Hallucinations in M…
Guardrails Beat Guidance: A Large-Scale Study of Rules, Skills, and Persistent Configurat…
SVSR: A Self-Verification and Self-Rectification Paradigm for Multimodal Reasoning
Enhancing Reinforcement Learning in 3D Environments through Semantic Segmentation: A Case…
SciHorizon-DataEVA: An Agentic System for AI-Readiness Evaluation of Heterogeneous Scient…
Human-Guided Harm Recovery for Computer Use Agents
Offline Reinforcement Learning with Generative Trajectory Policies
Beyond Accuracy: Are Time Series Foundation Models Well-Calibrated?
AttuneBench: A Conversation-Based Benchmark for LLM Emotional Intelligence
The Impact of Semantic Pairs on Self-Supervised Representation Learning
NOVA: Fundamental Limits of Knowledge Discovery Through AI
Jailbreaking and Mitigation of Vulnerabilities in Large Language Models
Scalable RF Simulation in Generative 4D Worlds
Less Is More: Elevating RAG via Performance-Driven Context Compression