LLMSurgeon: Diagnosing Data Mixture of Large Language Models
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
TelecomTS: A Multi-Modal Observability Dataset for Time Series and Language Analysis
EAPO: Enhancing Policy Optimization with On-Demand Expert Assistance
SafeSearch: Automated Red-Teaming of LLM-Based Search Agents
Graph-Enhanced Policy Optimization in LLM Agent Training
Modeling Hierarchical Thinking in Large Reasoning Models
From Meta-Thought to Execution: Cognitively Aligned Post-Training for Generalizable and R…
TANDEM: Temporal-Aware Neural Detection for Multimodal Hate Speech
SCOPE: Prompt Evolution for Enhancing Agent Effectiveness
Skill-Pro: Learning Reusable Skills from Experience via Non-Parametric PPO for LLM Agents
Reasoning about Reasoning: BAPO Bounds on Chain-of-Thought Token Complexity in LLMs
Causal-JEPA: Learning World Models through Object-Level Latent Masking
Dynamics Within Latent Chain-of-Thought: An Empirical Study of Causal Structure
RewardFlow: Topology-Aware Reward Propagation on State Graphs for Agentic RL with Large L…
AgentDropoutV2: Optimizing Information Flow in Multi-Agent Systems via Test-Time Rectify-…
SCoOP: Semantic Consistent Opinion Pooling for Uncertainty Quantification in Multiple Vis…
MemCollab: Cross-Model Memory Collaboration via Contrastive Trajectory Distillation
Cognitive Pivot Points and Visual Anchoring: Unveiling and Rectifying Hallucinations in M…
Guardrails Beat Guidance: A Large-Scale Study of Rules, Skills, and Persistent Configurat…
SVSR: A Self-Verification and Self-Rectification Paradigm for Multimodal Reasoning
SciHorizon-DataEVA: An Agentic System for AI-Readiness Evaluation of Heterogeneous Scient…
Human-Guided Harm Recovery for Computer Use Agents
AttuneBench: A Conversation-Based Benchmark for LLM Emotional Intelligence
NOVA: Fundamental Limits of Knowledge Discovery Through AI
Are LLMs Socially Adaptive? Contrasting Belief Evolution in Large Language Models and Hum…
Crafting Desirable Climate Trajectories with RL Explored Socio-Environmental Simulations
MATNet: Multi-Level Fusion Transformer-Based Model for Day-Ahead PV Generation Forecasting
Weakly Supervised Detection and Temporal Localization of Whale Calls in Long-Duration Bio…
Agent4Edu: Generating Learner Response Data by Generative Agents for Intelligent Educatio…
VRAG: Learning World Models for Interactive Video Generation